Ollama2026年9月21日 12:0317 天前

Gemma 4 深度实测:Mac 上代码 Agent 提速 90%

AI 摘要

  • Ollama 0.31 为 Gemma 4 开启多 token 预测(MTP),Apple Silicon 上默认生效
  • 做法是用小型草稿模型猜若干 token,主模型一次校验并采纳同意的部分
  • 官方用 Aider polyglot 真实编码 Agent 基准测得平均提速近 90%,且不改变输出

为什么重要

本地推理的竞争从模型能力转向解码效率,苹果芯片上的编码 Agent 可用性被明显拉高。

  • 做法是用小型草稿模型猜若干 token,主模型一次校验并采纳同意的部分
  • 官方用 Aider polyglot 真实编码 Agent 基准测得平均提速近 90%,且不改变输出

AI Pulse 编辑解读

免费提速先升级再说,但别把 90% 当成所有任务的基准。

风险与不确定性

提速数据来自代码类基准,草稿长度动态调整存在波动,不同机型收益差异较大。

影响对象

开发者

相关专题

来源与透明度

本文由 AI Pulse 编辑部基于公开来源整理,摘要可能使用 AI 辅助生成,并经过人工检查标题、来源和关键信息一致性。

原始来源:Ollama。发布时间:2026年9月21日 12:03。如果你发现事实错误或来源失效,欢迎通过联系页面提交纠错。

相关推荐