llama.cpp 部署 Gemma 4 12B MTP 指南
提供基于原生 llama.cpp 部署 Gemma 4 12B Unified 架构与多 Token 预测 (MTP) 投机采样的实战调优方案。
自己动手做的小工具,以及背后的开发故事。为什么要做、怎么做的、解决了什么具体痛点。
提供基于原生 llama.cpp 部署 Gemma 4 12B Unified 架构与多 Token 预测 (MTP) 投机采样的实战调优方案。
每次屏幕脏了都很难受,尤其是沾上指纹、灰尘。于是我被大模型忽悠,花一下午“清理出”了一个网页小工具,来帮我快速定位和清理屏幕上的脏污。 许愿编程的“意外收获” 最初,我只是通过大语言模型进行“许愿式编程”,我的原始需求极其简单: “帮我写一个纯色的全屏网页,能够点击切换黑白底色,方便我把屏幕调亮来找...
每天和不同客户端的 AI 对话,重复写相同的提示词费时费力。 DRY Prompt 让你一次编写、一键应用,实现机械飞升! 痛点:碎片化的客户端与重复输入 想要把 AI 用得游刃有余,我往往需要在不同的客户端发力。 比如: 在 网页端 使用 ChatGPT,Gemini等聊天界面 在 VSCode ...