AI 前沿资讯聚合

AI Pulse

智能脉搏

每日精选人工智能领域最新动态,让你始终站在技术前沿。

AI 专题

把每日新闻沉淀成可长期阅读的指南、概念解释和趋势归档。

查看全部专题
HackerNews

Lossless-memory 实测:AI 记忆不再丢细节

  • 核心主张是不做摘要:原始对话日志全量保存,每条记录都带时间戳
  • 以时间轴为底层索引,先按时间缩小范围、再按关键词在范围内排序
  • 纯本地文件栈:JSONL 日志加 SQLite(FTS5 精确检索与 sqlite-vec 语义检索),面向单人单机
16 天前访问原文链接
HackerNews

Frontier AI 开源:本地部署前沿模型全流程

  • Tim Dettmers 的 dlab 发布 Open Source Week,主张学术界以开源生态而非单篇论文为研究单元
  • 核心观点:前沿研究不再取决于谁拥有最多 GPU,资源受限反而可能催生学术界复兴
  • 文章分六部分讨论开源周内容、对悲观论的回应,以及该放弃与该坚持的研究习惯(基于标题与摘要推断)
16 天前访问原文链接
HackerNews

Linear 深度实测:AI 写代码后 CI 怎么提速

  • 测试套件今年几乎翻两番,但 Linear 把 PR 等待 CI 的时间从 6 分多压到 5 分出头
  • 把 CI 从 GitHub Actions 迁到更高性能第三方 runner,任务平均快 34%,tsc 降 52%
  • 换用原生 TypeScript 编译器 tsgo 后,tsc 检查周中位数下降 73%
16 天前访问原文链接
HackerNews

JetBrains Air 深度实测:Agent 开发平台怎么选

  • JetBrains 把 Central CLI、共享上下文、云 Agent、自动化与成本治理整合成 JetBrains Air 产品体系
  • 定位从个人开发者工作台扩展到 Agent 工作的发起、执行、协调、审查与治理全链路
  • 官方判断未来是多家模型与 Agent 并存,Agent 能力将原生进入 JetBrains IDE
16 天前访问原文链接
QbitAI

Step 5 Preview 实测:27B 激活硬刚 Opus 5

  • 阶跃星辰发布 Step 5 Preview:600B 总参数、27B 激活、1M 上下文
  • Artificial Analysis 评测 44 分,位列全球开源模型 Top 2
  • 定价为百万输入 1 美元、百万输出 2.7 美元,单任务成本约为 Opus 5 的 12.5%
17 天前访问原文链接
GitHubBlog

Copilot 深度实测:多 Agent 并行写代码靠谱吗

  • GitHub Copilot 应用中每个 Agent 会话可跑在独立 Git worktree 上,互不干扰
  • 会话各自保留上下文,可随时切换,不必重新交代任务背景
  • 官方演示同时推进新功能、无障碍审查与测试三项任务
17 天前访问原文链接
Ollama

OpenJarvis 开源:本地优先的个人 AI 好用吗

  • 斯坦福 Hazy Research 等实验室开源 OpenJarvis v1.0,定位本地优先的个人 AI 框架
  • 内置 Ollama 支持,模型默认本地运行、云端可选,同时记录能耗、成本与延迟
  • 自带跨文件研究(返回引用)与本地代码助手两种预设 Agent
17 天前访问原文链接
Ollama

Gemma 4 深度实测:Mac 上代码 Agent 提速 90%

  • Ollama 0.31 为 Gemma 4 开启多 token 预测(MTP),Apple Silicon 上默认生效
  • 做法是用小型草稿模型猜若干 token,主模型一次校验并采纳同意的部分
  • 官方用 Aider polyglot 真实编码 Agent 基准测得平均提速近 90%,且不改变输出
17 天前访问原文链接
Ollama

Nemotron 3.5 实测:30B 模型本地跑 Agent

  • NVIDIA 的 Nemotron 3.5 Lightning 上架 Ollama,30B 总参数仅 3B 激活
  • 官方称同级开源模型中吞吐高 4 倍,任务完成时间快 30%
  • 支持 1M 上下文,主打常驻 Agent 的读文件、调工具与失败重试
17 天前访问原文链接
HackerNews

Mini-AGI 开源:8GB 显存从零训练持续学习模型

  • mini-AGI 是字节级持续学习模型,MIT 协议,单张 8GB 显卡就能从头训练
  • 权重以普通文件存盘、按需换入显存,参数量上限取决于磁盘而不是显存
  • 训练中模型自行增减专家,作者称未出现灾难性遗忘,但明确标注仍是玩具级
17 天前访问原文链接
HackerNews

Claude vs Cursor:AI 编程质量会塌方吗

  • 作者总结出 7 层质量防线,称产出翻倍的同时 bug 数量不升反降
  • 第一层是 spec 驱动开发:先让 AI 审查需求,挖出边界情况与遗漏
  • 单元测试覆盖率提到 95% 以上,并同时跑 Claude 与 Cursor 评审,两者发现的问题各不相同
17 天前访问原文链接
HackerNews

Google AX 开源:Agent 任务怎么批量跑起来

  • Google 开源 AX:把 Agent 任务写成声明式配置,交给集群调度执行
  • 每个任务独立沙箱加网络围栏,可单独限制 CPU 与内存
  • 官方称单集群可跑到数十亿个任务,空闲等待时间被回收成算力
17 天前访问原文链接