Ollama2026年9月21日 12:0317 天前
Gemma 4 深度实测:Mac 上代码 Agent 提速 90%
AI 摘要
- Ollama 0.31 为 Gemma 4 开启多 token 预测(MTP),Apple Silicon 上默认生效
- 做法是用小型草稿模型猜若干 token,主模型一次校验并采纳同意的部分
- 官方用 Aider polyglot 真实编码 Agent 基准测得平均提速近 90%,且不改变输出
为什么重要
本地推理的竞争从模型能力转向解码效率,苹果芯片上的编码 Agent 可用性被明显拉高。
- 做法是用小型草稿模型猜若干 token,主模型一次校验并采纳同意的部分
- 官方用 Aider polyglot 真实编码 Agent 基准测得平均提速近 90%,且不改变输出
AI Pulse 编辑解读
免费提速先升级再说,但别把 90% 当成所有任务的基准。
风险与不确定性
提速数据来自代码类基准,草稿长度动态调整存在波动,不同机型收益差异较大。
影响对象
开发者
相关专题
- AI 编程助手怎么选:工具类型、适用场景与评估方法
按代码补全、IDE 内 Agent、终端编程 Agent 和云端代码 Agent 梳理 AI 编程助手的差异,提供按任务、预算、隐私和验证能力选工具的方法。
来源与透明度
本文由 AI Pulse 编辑部基于公开来源整理,摘要可能使用 AI 辅助生成,并经过人工检查标题、来源和关键信息一致性。
原始来源:Ollama。发布时间:2026年9月21日 12:03。如果你发现事实错误或来源失效,欢迎通过联系页面提交纠错。