标签聚合

开源

开源 领域的最新 AI 动态与独家辣评,共 50 篇

QbitAI

陶哲轩启动「开放数学模型计划」

  • 数学家陶哲轩代表SAIR基金会启动开放数学模型计划
  • 以开放模型与可负担算力服务数学研究
20 天前访问原文链接
ProductHunt

Bolt Forge发布:开源模型+50倍用量

  • Bolt推出新Agent产品Bolt Forge
  • 支持开源模型并提供高达50倍的使用额度
20 天前访问原文链接
HackerNews

阿里开源可检测癌症及150种疾病的AI模型

  • 阿里开源医学AI模型,可检测癌症及近150种疾病
  • 模型面向医疗影像诊断与健康筛查场景
20 天前访问原文链接
HackerNews

8-29MB小模型自动化能力比肩DeepSeek V4 Flash

  • Cactus Needle 3推出仅8-29MB的自动化小模型
  • 在自动化任务上声称可匹配DeepSeek V4 Flash的性能表现
20 天前访问原文链接
HackerNews

NASA与IBM开源月球地理空间AI模型

  • NASA与IBM联合开源面向月球的地理空间AI基础模型
  • 该模型服务于行星科学中的地形测绘与遥感分析场景
20 天前访问原文链接
ProductHunt

Forma-oss:把提示词或图片变成硬件项目

  • Forma-oss可将提示词或图片转化为可编辑的硬件项目。
  • 面向开源硬件社区,降低从创意到可制造设计的门槛。
  • 结合AI生成与硬件工程,探索「AI造物」的落地形态。
21 天前访问原文链接
HackerNews

你的 AI 有多过时?20 款模型发布时间与训练截止一览

  • 该工具汇总 20 款主流模型的发布时间与训练数据截止日期。
  • 用可视化方式帮用户判断所选模型是否「过时」。
  • 为选型提供直观参考,揭示模型知识陈旧度的差异。
22 天前访问原文链接
HackerNews

OpenSpec:轻量可配置的 AI 规格框架

  • OpenSpec 是一个面向 AI 应用的轻量级规格(spec)框架,强调可配置性。
  • 它试图用声明式规范约束 AI 行为,让模型输出更可控。
  • 适用于需要严格约束 AI 输出的开发场景。
22 天前访问原文链接
QbitAI

杭州团队补上 AI for Science「最后一公里」

  • 一家获英伟达点名的杭州团队,在 AI for Science 领域实现从想法到结果的一次对话
  • 打通科研流程中从设想到产出结果的最后一公里
  • 展示 AI 在科学计算中的落地价值
23 天前访问原文链接
QbitAI

清华联合稳准智能发布数据大模型 LimiX-2

  • 稳准智能联合清华大学发布新一代数据大模型 LimiX-2
  • 模型参数规模提升至 400M,主打结构化数据建模
  • 在相关国际评测榜单中登顶
23 天前访问原文链接
HackerNews

Pizza Bot:为后台 AI Agent 打造的收件箱

  • 开源项目 Pizza Bot 为在后台运行的 AI Agent 提供统一收件箱
  • 让多个 agent 的异步任务与消息能够被集中管理和追踪
  • 面向需要协调后台 agent 工作流的开发者
23 天前访问原文链接
HackerNews

每瓦智能:本地 AI 效率的新度量标准

  • arXiv 论文提出用「每瓦智能」衡量本地 AI 模型的实际效率
  • 将模型智能水平与能耗挂钩,为端侧部署提供量化依据
  • 回应本地 AI 普及后能效评估体系缺失的问题
23 天前访问原文链接
HackerNews

Mistral 携手 Mozilla 打造隐私多语言 AI 浏览器

  • Mistral 与 Mozilla 达成合作,将 AI 能力深度整合进浏览器体验
  • 主打本地隐私保护,覆盖多语言浏览场景,降低云端依赖
  • 探索端侧 AI 浏览器新形态,向隐私优先用户抛出橄榄枝
23 天前访问原文链接
QbitAI

7 名博士生 3 个月从零训练 7B 大模型,全流程公开

  • 7 名博士生仅用 3 个月从零训练出一个 7B 大模型。
  • 代码、数据与训练日志全部公开,复现性强。
  • 训练过程中数百个 Agent 参与研发,「AI 开始造 AI」。
24 天前访问原文链接
QbitAI

Meta 研究:字节模型蒸馏后突破性能天花板

  • Meta 新研究显示,对字节系模型蒸馏后性能天花板被突破。
  • 探索模型蒸馏技术对性能上限的影响。
  • 为小模型逼近大模型能力提供新思路。
24 天前访问原文链接
HackerNews

开源 AI 与开放模型:一份必读清单

  • Interconnects 整理了一份开源 AI 与开放模型的阅读清单。
  • 覆盖开源模型生态、许可与社区趋势的系统性资源。
  • 适合关注开源 AI 的开发者与研究者快速入门。
24 天前访问原文链接
HackerNews

OpenArch:现代 LLM 架构的 PyTorch 开源实现

  • OpenArch 提供现代大模型架构的 PyTorch 参考实现集合。
  • 方便研究者和开发者学习、复现与二次开发 LLM 架构。
  • 开源项目在 HN 获得高关注,降低 LLM 学习门槛。
24 天前访问原文链接
HackerNews

Kinesis:用 Meta 神经手环隔空操控你的 Mac

  • 开源项目 Kinesis 让用户通过 Meta 神经手环手势操控 Mac。
  • 基于神经信号(EMG)识别手势,实现无接触交互。
  • 在 Show HN 上发布,获开发者广泛关注与讨论。
24 天前访问原文链接
HackerNews

F-Droid 应用有多少是 LLM 批量生成的?

  • F-Droid 开源应用商店被发现存在大量疑似 LLM 批量生成的垃圾应用。
  • 研究者通过文本特征与代码风格分析,估算 LLM 生成内容的占比。
  • 引发对开源生态中 AI 内容污染与质量审核的讨论。
24 天前访问原文链接
QbitAI

RunningHub 让 MiniMax H3 提速 12 倍

  • RunningHub 宣称让开源模型 MiniMax H3 满血提速 12 倍
  • 支持本地部署,宣传"15 秒视频、50 秒出片"的生成速度
  • 展示开源模型在推理优化下的性能潜力
28 天前访问原文链接
HackerNews

DeepSeek 发布 V4.1 Flash 轻量模型

  • DeepSeek 正式发布 V4.1 Flash 版本,主打更快的推理速度
  • 定位轻量高效,适合资源受限的部署场景
  • 延续 DeepSeek 开源开放的一贯路线(基于标题摘要推断)
28 天前访问原文链接
HackerNews

社区流出 DeepSeek V4.1 Flash 无审查版

  • 第三方在 HuggingFace 发布 DeepSeek V4.1 Flash 的"无审查"FP8 版本
  • 该版本移除部分安全对齐,声称可自由回答敏感问题
  • 引发关于开源模型安全对齐与滥用的争议(基于标题摘要推断)
28 天前访问原文链接
QbitAI

开源 1.3B 世界模型,单卡即可实时运行

  • 轻量版 LingBot-World 2.0 世界模型开源,参数仅 1.3B
  • 单张显卡即可实时运行,极大降低世界模型部署门槛
  • 面向资源受限场景的世界模型应用
29 天前访问原文链接
QbitAI

HSImul3R:让人类视频成为机器人技能来源

  • 大晓机器人联合南洋理工 S-Lab、上海人工智能实验室发布 HSImul3R
  • 这是全球首个可仿真的人-场景交互重建框架
  • 目标是让人类视频真正成为机器人的技能学习来源
29 天前访问原文链接
ProductHunt

Desert Ant Labs:专注语音文本视觉的小型专用模型

  • Desert Ant Labs 提供语音、文本、视觉方向的小型专用 AI 模型
  • 强调小而专,面向特定任务而非通用大模型
  • 在 Product Hunt 上架
29 天前访问原文链接
HackerNews

Qwen 3.8 复刻 GPT-5.5 Pro 的推理预填充技巧

  • 开发者演示 Qwen 3.8 通过推理预填充复刻 GPT-5.5 Pro 的行为
  • 该方法让开源小模型也能获得类似前沿模型的推理表现
  • HN 获 222 分,社区关注开源模型的工程化追赶
29 天前访问原文链接
HackerNews

仅花 998 美元,把 3.8B 模型训到 0.384 CORE

  • 一位开发者用约 998 美元成本训练出 3.8B 参数 LLM,达到 0.384 CORE 分数
  • 项目公开了完整训练方案与代码,验证小模型低成本训练的可行性
  • HN 讨论热度 91 分,吸引大量独立开发者关注
29 天前访问原文链接
HackerNews

GPT-6 Astra 解读:循环 Transformer 与隐藏推理链

  • Sebastian Raschka 撰文分析 GPT-6 Astra 的循环 Transformer 架构
  • 文章探讨模型在推理过程中隐藏的思维链机制
  • 该帖在 HN 获 451 分,成为当日热门技术解读
29 天前访问原文链接
HackerNews

DeepSeek 发布 v4.1 Flash,更便宜更强

  • DeepSeek 推出 v4.1 Flash 版本,宣称比 v4 Pro 更便宜且能力更强(基于标题摘要推断)
  • 新版本主打性价比,继续压低推理成本
  • 进一步加剧开源大模型的价格竞争
1 个月前访问原文链接
ProductHunt

Switch:把任意 AI 智能体接入 Slack/Teams/Discord

  • Switch 是一款开源工具,可将任意 AI 智能体接入 Slack、Teams 与 Discord
  • 让团队在工作沟通平台中直接调用各类 AI Agent 协作
  • 开源设计便于自定义,降低企业集成智能体的门槛
1 个月前访问原文链接
ProductHunt

Relaticle:开源 CRM,AI 写稿需人工审批

  • Relaticle 是一款开源 CRM,内置 AI 辅助撰写功能但需人工审批后才生效
  • 采用审批门控机制,AI 生成内容须经确认,避免失控
  • 面向注重数据可控与合规的团队,提供可自托管的选择
1 个月前访问原文链接
HackerNews

TradingAgents 开源多智能体金融交易框架引关注

  • 开源项目 TradingAgents 构建多智能体 LLM 框架,用于金融交易决策与分析
  • 框架模拟分析师、交易员等多角色协作,整合市场数据与新闻情绪进行研判
  • 在 HackerNews 获 67 分关注,引发对 LLM 量化交易能力的讨论
1 个月前访问原文链接
HackerNews

Mistral 获 30 亿欧元融资,押注主权开源大模型

  • 法国 AI 公司 Mistral 宣布完成 30 亿欧元融资,加速推进主权开源权重模型走向前沿水平
  • 融资将用于算力、人才与模型研发,强化欧洲在 AI 领域的技术自主能力
  • 作为欧洲开源阵营代表,Mistral 与 OpenAI、Google 等闭源巨头形成差异化竞争
1 个月前访问原文链接
QbitAI

GOSIM Shenzhen 2026 全议程公布,150+技术大咖集结

  • 开源技术大会 GOSIM 将首次落地深圳,于 10 月 16-17 日举办
  • DHH 领衔,英伟达、微软、HuggingFace 等 150+ 全球技术专家参与
  • 大会聚焦面向开发者的开源 AI 与技术生态,议程全面公布
1 个月前访问原文链接
HackerNews

ripwire:给编码智能体一张仓库地图的 AI 上下文工具

  • ripwire 是 Red Hat 开源的 CLI+MCP 工具,被称为「AI 上下文的 ripgrep」
  • 它帮助编码智能体快速理解任意代码仓库的结构与上下文
  • 通过为 agent 提供仓库地图,提升 AI 编程的准确性与效率
1 个月前访问原文链接
HackerNews

Coop:为 Claude Code 与 Codex 提供隔离 VM 运行环境

  • Coop 是 Trail of Bits 开源的隔离 VM 环境,用于运行 Claude Code 与 Codex 等编码智能体
  • 通过沙箱隔离降低 AI 编码代理执行命令带来的安全风险
  • 面向在不可信或高风险任务中部署 AI 编程工具的场景
1 个月前访问原文链接
HackerNews

Engrim:面向 AI CLI 的本地优先 SQLite 记忆引擎

  • Engrim 是一个通用的、本地优先的 SQLite 记忆引擎,专为 AI 命令行工具设计
  • 它以 SQLite 作为存储底座,让 AI 助手在会话间持久化记忆与上下文
  • 项目以 Show HN 形式发布,主打本地化、隐私友好与零依赖集成
1 个月前访问原文链接
HackerNews

OKF Agent Memory:Git 原生的 AI 编程记忆库

  • OKF 实现 Google OKF v0.2 规范,为 AI 编程 Agent 提供 Git 原生的持久化记忆能力。
  • 内置亚 300 微秒级 BM25 检索与嵌入式 MCP 服务器,采用渐进式披露,宣称 token 膨胀降低 80%。
  • 纯 Go 编写、零外部数据库依赖,可直接融入现有代码仓库工作流。
1 个月前访问原文链接
ProductHunt

开源AI网关Experiential Labs用流量优化模型

  • Experiential Labs是一款开源AI网关,声称能将流量转化为更好的模型表现。
  • 该产品面向需要统一接入与管理多个AI模型的开发团队。
  • 主打开源与可自托管,降低多模型接入与调度的复杂度。
1 个月前访问原文链接
HackerNews

美国企业正集体「上瘾」开源AI

  • 纽约时报报道,越来越多美国企业转向开源AI模型,不再局限于闭源大厂产品。
  • Anthropic、OpenAI等公司也面临开源生态带来的竞争压力,企业看重可控性与成本。
  • 开源模型在企业内部的定制、私有化部署与成本优势成为关键驱动力。
1 个月前访问原文链接
HackerNews

Spotify开源Portal,把Claude Code用量砍掉九成

  • Spotify工程团队发布Portal工具,据称将Claude Code的token消耗降低了约90%。
  • Portal通过优化上下文管理,减少重复发送冗余信息,从而大幅压缩模型调用成本。
  • 该实践来自Spotify内部真实开发场景,对重度使用编码智能体的团队有直接参考价值。
1 个月前访问原文链接
QbitAI

李飞飞发布 Atlas,中国开源「同款」已抢跑半年

  • 李飞飞团队发布 Atlas,强调智能是对世界的建模而非模式识别
  • 文章指出中国开源社区已有类似「世界模型」路线并提前半年布局
  • 引发关于中美 AI 研究方向与开源生态的对比讨论
1 个月前访问原文链接
QbitAI

金融 AI 年度大考:2 万选手、30+ 机构、百亿级数据开源

  • 金融 AI 年度竞赛落幕,吸引 2 万名选手、5000 支队伍参与
  • 30 多家机构参与,百亿级数据对外开放
  • 集中反映金融 AI 行业四年来的能力演进
1 个月前访问原文链接
TheVerge_AI

英伟达发布免费工具 PAIR,闲置电脑组网成个人 AI 数据中心

  • 英伟达发布免费开源工具 PAIR(Personal AI Router),将家中闲置电脑组网
  • 可配合 Ollama、LM Studio 等工具在本地完成 AI 推理任务
  • 无需购买专用硬件,即可搭建个人级本地 AI 算力池
1 个月前访问原文链接
HackerNews

用 LLM 读 68000 汇编,开发者将 1993 年 Amiga 游戏移植到 Godot

  • 一位开发者借助 LLM 读取 68000 汇编代码,成功将 1993 年的 Amiga 老游戏移植到 Godot 引擎
  • 展示了 LLM 在理解遗留汇编、跨平台迁移上的实用价值
  • 项目验证了 AI 辅助重构上古代码库的可行性
1 个月前访问原文链接
TheVerge_AI

英伟达近 130 亿美元收购 Hugging Face

  • 英伟达以约 129.3 亿美元收购开源 AI 平台 Hugging Face
  • Hugging Face 是全球最大的开源模型、数据集托管平台之一
  • 全球最大 AI 芯片商掌控开源 AI 生态的关键枢纽
1 个月前访问原文链接
HackerNews

METR 报告复盘 OpenAI/Hugging Face 遭入侵

  • METR 发布 OpenAI 与 Hugging Face 遭黑客入侵事件的调查报告
  • 复盘攻击路径与核心教训,涉及 AI 供应链安全
  • 为 AI 基础设施安全防护提供参考
1 个月前访问原文链接
HackerNews

欧洲发布 438B 参数旗舰模型 Quasar

  • Multiverse Computing 发布 4380 亿参数的 Quasar 模型
  • 号称欧洲领先的大模型,主打主权 AI 能力
  • 欧洲在 AI 主权焦虑下加速自研大模型
1 个月前访问原文链接
HackerNews

WebLLM:浏览器内高性能大模型推理引擎

  • WebLLM 支持在浏览器内直接运行大语言模型推理
  • 基于 WebGPU 硬件加速,无需后端服务器即可本地部署
  • 开源项目,面向隐私敏感与边缘部署场景
1 个月前访问原文链接
HackerNews

LLM City:Kimi K3权重3D可视化

  • 项目将Kimi K3大模型的全部权重渲染成3D城市
  • 每块2.5mm磁贴代表模型权重参数
  • 用可视化艺术呈现大模型的庞大结构
1 个月前访问原文链接