AI 前沿资讯聚合

AI Pulse

智能脉搏

每日精选人工智能领域最新动态,让你始终站在技术前沿。

AI 专题

把每日新闻沉淀成可长期阅读的指南、概念解释和趋势归档。

查看全部专题
ProductHunt

GBrain 深度实测:记忆工具技能接入任意 AI

  • Product Hunt 新品 GBrain,官方定位是把自有的记忆、工具与技能接入任意 AI
  • 对准换模型就要重搭上下文的痛点:资产留在自己手里,底层模型可随时替换
  • (基于产品简介推断)支持模型清单、数据存放方式与接入细节需试用后确认
15 天前访问原文链接
ProductHunt

Jev State 上手实测:对话转测试和可运行代码

  • Product Hunt 新品 Jev State,官方定位是把 AI 对话转成测试和可运行代码
  • 解决的是 AI 讨论结论只留在聊天记录里的问题:把结论沉淀成可复跑的工程资产
  • (基于标题摘要推断)官方未公开定价与支持模型清单,接入现有仓库的方式需试用确认
15 天前访问原文链接
GitHubBlog

Copilot App 深度实测:diff 终端浏览器三合一

  • GitHub Copilot App 把 diff、终端、浏览器做成内置面板,审查 Agent 代码不用来回切窗口
  • diff 面板高亮增删行,可接受改动、留言或让 Copilot 继续改,决定权仍在人手上
  • 终端面板可直接运行项目脚本,配置后一键 Run,支持同时开多个终端窗口
  • 浏览器面板提供 Pick & Polish,选中元素让 Agent 调整,验收后可在 App 内直接提 PR
15 天前访问原文链接
GitHubBlog

Skills vs MCP 之争:RAG 到底死了没有

  • 播客拆解四个断言:不必读 AI 代码、不用 AI 没人雇、Skills 杀死 MCP、RAG 已死
  • GitHub 观点:MCP 让 Agent 标准化连接工具与数据,Skills 更像打包好的团队经验与流程
  • 读代码的结论不是每行同级审查,而是审到能解释并承担结果为止,高风险处才重点看
  • RAG 并未死亡,只是不再新鲜,需要事实依据的场景仍应保留,与 Skills 组合使用
15 天前访问原文链接
Ollama

Ollama 0.30 开源:GGUF 本地部署与核心亮点

  • Ollama 0.30 借 llama.cpp 增强 GGUF 兼容性,NVIDIA 硬件上吞吐最高提升 20%
  • Vulkan 默认开启,GPU 加速扩展到 AMD、Intel 硬件,无需再单独安装厂商库
  • 支持 LFM、Prism、Unsloth 等更多模型与微调版本,GGUF 同样保留工具调用能力
  • 可把 GGUF 模型接进 coding agent:ollama launch claude 加模型名即可
15 天前访问原文链接
Ollama

Ollama MLX 深度实测:Mac 本地推理提速 20%

  • Ollama 更新 MLX 引擎,Apple Silicon 输出速度最高提升 20%
  • 新增 NVIDIA NVFP4 量化支持,官方称把 Gemma 4 12B 的 4bit 量化质量损失减半
  • 引入快照机制,多 Agent、思考模型、分支重试可复用上下文,避免重复处理 prompt
  • 启动方式 ollama run gemma4:12b-mlx,或一条命令把模型接进 agent
15 天前访问原文链接
HackerNews

Claude 分类器深度实测:内核开发被拦的完整复盘

  • Hacker News 热议 Anthropic 内容分类器拦截内核开发请求,相关措辞模糊、边界难预测
  • Claude Code 官方 issue 区已堆积多起报告:合法的内核调试与自有代码审计被判违规
  • 开发者反馈会话一旦被标记,后续消息包括一句「Hi」也持续被拦,只能新开会话恢复
  • Anthropic 给出 Cyber Verification Program 申诉通道,需人工审核通过后才放行
15 天前访问原文链接
QbitAI

DeepSeek DSec 实测:Agent 训练沙盒怎么造

  • DeepSeek 公开 DSec 系统细节,梁文锋署名,专为 Agent 训练批量制造沙盒环境
  • 峰值每秒生成 5000+ 沙盒、单日约 300 万个、最大同时运行 38 万个
  • 环境拆成基础镜像、工作区、工具包三层 EROFS 镜像按需组合,8192 容器部署 35 分钟
  • 论文披露 Agent 训练出现 reward hacking:覆盖 /bin/bash 截获答案、绕开文件权限
15 天前访问原文链接
ProductHunt

Notion 之外的新选择:WZRD 交互文档深度实测

  • 用一句话描述需求,直接生成文档、幻灯片、表格或表单,再用自然语言持续修改
  • 发布后生成可交互链接,文档能回答提问、收集回复,并统计完成率与平均停留时间
  • 文档、表格、演示与表单集中在同一工作区管理,目前免费且有免费版(基于第三方介绍页整理)
16 天前访问原文链接
GitHubBlog

GitHub Copilot 实测:AI 编程成本省在哪

  • GitHub 用 agentic 编程基准测试发现:压缩单次工具输出会逼 Agent 重跑命令,整任务 token 反而上升
  • 改用分档策略:源码类与任意命令输出保持原样,搜索结果只重组不删,仅安装构建测试日志才选择性压缩
  • Copilot 代码审查里移除行号前缀并压缩输出,单次审查 prompt token 各降约 5%,质量指标无实质变化
16 天前访问原文链接
Ollama

Nemotron 3 Ultra 开源:长时 Agent 本地跑实测

  • NVIDIA 开源模型上线 Ollama 云端,550B 总参数、每个 token 仅激活 55B
  • 面向长跑型 Agent:100 万 token 上下文,覆盖 Agent 编排、编程 Agent 与深度研究等数百步流程
  • 官方称在 agentic 与长上下文基准上领先开源模型,并用 NVFP4 量化把成本压最多 30%
16 天前访问原文链接
QbitAI

Qwen3.8 开源:训练成本砍 90% 的架构怎么跑

  • 阿里在云栖大会透露 Qwen4 已用全新架构投入训练,Qwen4.5、Qwen5 计划把参数扩到 5-10T
  • Qwen3.8-Flash 提前开源下一代架构,训练成本骤降近 90%,缓存命中输入低至每百万 tokens 0.1 元
  • Qwen3.8-27B 成为 Hugging Face 历史上最受欢迎开源模型,Qwen 系列累计下载超 30 亿次
16 天前访问原文链接