HackerNews8-29MB小模型自动化能力比肩DeepSeek V4 FlashCactus Needle 3推出仅8-29MB的自动化小模型在自动化任务上声称可匹配DeepSeek V4 Flash的性能表现20 天前访问原文链接
ProductHuntForma-oss:把提示词或图片变成硬件项目Forma-oss可将提示词或图片转化为可编辑的硬件项目。面向开源硬件社区,降低从创意到可制造设计的门槛。结合AI生成与硬件工程,探索「AI造物」的落地形态。21 天前访问原文链接
HackerNews你的 AI 有多过时?20 款模型发布时间与训练截止一览该工具汇总 20 款主流模型的发布时间与训练数据截止日期。用可视化方式帮用户判断所选模型是否「过时」。为选型提供直观参考,揭示模型知识陈旧度的差异。22 天前访问原文链接
HackerNewsOpenSpec:轻量可配置的 AI 规格框架OpenSpec 是一个面向 AI 应用的轻量级规格(spec)框架,强调可配置性。它试图用声明式规范约束 AI 行为,让模型输出更可控。适用于需要严格约束 AI 输出的开发场景。22 天前访问原文链接
QbitAI杭州团队补上 AI for Science「最后一公里」一家获英伟达点名的杭州团队,在 AI for Science 领域实现从想法到结果的一次对话打通科研流程中从设想到产出结果的最后一公里展示 AI 在科学计算中的落地价值23 天前访问原文链接
QbitAI清华联合稳准智能发布数据大模型 LimiX-2稳准智能联合清华大学发布新一代数据大模型 LimiX-2模型参数规模提升至 400M,主打结构化数据建模在相关国际评测榜单中登顶23 天前访问原文链接
HackerNewsPizza Bot:为后台 AI Agent 打造的收件箱开源项目 Pizza Bot 为在后台运行的 AI Agent 提供统一收件箱让多个 agent 的异步任务与消息能够被集中管理和追踪面向需要协调后台 agent 工作流的开发者23 天前访问原文链接
HackerNews每瓦智能:本地 AI 效率的新度量标准arXiv 论文提出用「每瓦智能」衡量本地 AI 模型的实际效率将模型智能水平与能耗挂钩,为端侧部署提供量化依据回应本地 AI 普及后能效评估体系缺失的问题23 天前访问原文链接
HackerNewsMistral 携手 Mozilla 打造隐私多语言 AI 浏览器Mistral 与 Mozilla 达成合作,将 AI 能力深度整合进浏览器体验主打本地隐私保护,覆盖多语言浏览场景,降低云端依赖探索端侧 AI 浏览器新形态,向隐私优先用户抛出橄榄枝23 天前访问原文链接
QbitAI7 名博士生 3 个月从零训练 7B 大模型,全流程公开7 名博士生仅用 3 个月从零训练出一个 7B 大模型。代码、数据与训练日志全部公开,复现性强。训练过程中数百个 Agent 参与研发,「AI 开始造 AI」。24 天前访问原文链接
QbitAIMeta 研究:字节模型蒸馏后突破性能天花板Meta 新研究显示,对字节系模型蒸馏后性能天花板被突破。探索模型蒸馏技术对性能上限的影响。为小模型逼近大模型能力提供新思路。24 天前访问原文链接
HackerNews开源 AI 与开放模型:一份必读清单Interconnects 整理了一份开源 AI 与开放模型的阅读清单。覆盖开源模型生态、许可与社区趋势的系统性资源。适合关注开源 AI 的开发者与研究者快速入门。24 天前访问原文链接
HackerNewsOpenArch:现代 LLM 架构的 PyTorch 开源实现OpenArch 提供现代大模型架构的 PyTorch 参考实现集合。方便研究者和开发者学习、复现与二次开发 LLM 架构。开源项目在 HN 获得高关注,降低 LLM 学习门槛。24 天前访问原文链接
HackerNewsKinesis:用 Meta 神经手环隔空操控你的 Mac开源项目 Kinesis 让用户通过 Meta 神经手环手势操控 Mac。基于神经信号(EMG)识别手势,实现无接触交互。在 Show HN 上发布,获开发者广泛关注与讨论。24 天前访问原文链接
HackerNewsF-Droid 应用有多少是 LLM 批量生成的?F-Droid 开源应用商店被发现存在大量疑似 LLM 批量生成的垃圾应用。研究者通过文本特征与代码风格分析,估算 LLM 生成内容的占比。引发对开源生态中 AI 内容污染与质量审核的讨论。24 天前访问原文链接
QbitAIRunningHub 让 MiniMax H3 提速 12 倍RunningHub 宣称让开源模型 MiniMax H3 满血提速 12 倍支持本地部署,宣传"15 秒视频、50 秒出片"的生成速度展示开源模型在推理优化下的性能潜力28 天前访问原文链接
HackerNewsDeepSeek 发布 V4.1 Flash 轻量模型DeepSeek 正式发布 V4.1 Flash 版本,主打更快的推理速度定位轻量高效,适合资源受限的部署场景延续 DeepSeek 开源开放的一贯路线(基于标题摘要推断)28 天前访问原文链接
HackerNews社区流出 DeepSeek V4.1 Flash 无审查版第三方在 HuggingFace 发布 DeepSeek V4.1 Flash 的"无审查"FP8 版本该版本移除部分安全对齐,声称可自由回答敏感问题引发关于开源模型安全对齐与滥用的争议(基于标题摘要推断)28 天前访问原文链接
QbitAI开源 1.3B 世界模型,单卡即可实时运行轻量版 LingBot-World 2.0 世界模型开源,参数仅 1.3B单张显卡即可实时运行,极大降低世界模型部署门槛面向资源受限场景的世界模型应用29 天前访问原文链接
QbitAIHSImul3R:让人类视频成为机器人技能来源大晓机器人联合南洋理工 S-Lab、上海人工智能实验室发布 HSImul3R这是全球首个可仿真的人-场景交互重建框架目标是让人类视频真正成为机器人的技能学习来源29 天前访问原文链接
ProductHuntDesert Ant Labs:专注语音文本视觉的小型专用模型Desert Ant Labs 提供语音、文本、视觉方向的小型专用 AI 模型强调小而专,面向特定任务而非通用大模型在 Product Hunt 上架29 天前访问原文链接
HackerNewsQwen 3.8 复刻 GPT-5.5 Pro 的推理预填充技巧开发者演示 Qwen 3.8 通过推理预填充复刻 GPT-5.5 Pro 的行为该方法让开源小模型也能获得类似前沿模型的推理表现HN 获 222 分,社区关注开源模型的工程化追赶29 天前访问原文链接
HackerNews仅花 998 美元,把 3.8B 模型训到 0.384 CORE一位开发者用约 998 美元成本训练出 3.8B 参数 LLM,达到 0.384 CORE 分数项目公开了完整训练方案与代码,验证小模型低成本训练的可行性HN 讨论热度 91 分,吸引大量独立开发者关注29 天前访问原文链接
HackerNewsGPT-6 Astra 解读:循环 Transformer 与隐藏推理链Sebastian Raschka 撰文分析 GPT-6 Astra 的循环 Transformer 架构文章探讨模型在推理过程中隐藏的思维链机制该帖在 HN 获 451 分,成为当日热门技术解读29 天前访问原文链接
HackerNewsDeepSeek 发布 v4.1 Flash,更便宜更强DeepSeek 推出 v4.1 Flash 版本,宣称比 v4 Pro 更便宜且能力更强(基于标题摘要推断)新版本主打性价比,继续压低推理成本进一步加剧开源大模型的价格竞争1 个月前访问原文链接
ProductHuntSwitch:把任意 AI 智能体接入 Slack/Teams/DiscordSwitch 是一款开源工具,可将任意 AI 智能体接入 Slack、Teams 与 Discord让团队在工作沟通平台中直接调用各类 AI Agent 协作开源设计便于自定义,降低企业集成智能体的门槛1 个月前访问原文链接
ProductHuntRelaticle:开源 CRM,AI 写稿需人工审批Relaticle 是一款开源 CRM,内置 AI 辅助撰写功能但需人工审批后才生效采用审批门控机制,AI 生成内容须经确认,避免失控面向注重数据可控与合规的团队,提供可自托管的选择1 个月前访问原文链接
HackerNewsTradingAgents 开源多智能体金融交易框架引关注开源项目 TradingAgents 构建多智能体 LLM 框架,用于金融交易决策与分析框架模拟分析师、交易员等多角色协作,整合市场数据与新闻情绪进行研判在 HackerNews 获 67 分关注,引发对 LLM 量化交易能力的讨论1 个月前访问原文链接
HackerNewsMistral 获 30 亿欧元融资,押注主权开源大模型法国 AI 公司 Mistral 宣布完成 30 亿欧元融资,加速推进主权开源权重模型走向前沿水平融资将用于算力、人才与模型研发,强化欧洲在 AI 领域的技术自主能力作为欧洲开源阵营代表,Mistral 与 OpenAI、Google 等闭源巨头形成差异化竞争1 个月前访问原文链接
QbitAIGOSIM Shenzhen 2026 全议程公布,150+技术大咖集结开源技术大会 GOSIM 将首次落地深圳,于 10 月 16-17 日举办DHH 领衔,英伟达、微软、HuggingFace 等 150+ 全球技术专家参与大会聚焦面向开发者的开源 AI 与技术生态,议程全面公布1 个月前访问原文链接
HackerNewsripwire:给编码智能体一张仓库地图的 AI 上下文工具ripwire 是 Red Hat 开源的 CLI+MCP 工具,被称为「AI 上下文的 ripgrep」它帮助编码智能体快速理解任意代码仓库的结构与上下文通过为 agent 提供仓库地图,提升 AI 编程的准确性与效率1 个月前访问原文链接
HackerNewsCoop:为 Claude Code 与 Codex 提供隔离 VM 运行环境Coop 是 Trail of Bits 开源的隔离 VM 环境,用于运行 Claude Code 与 Codex 等编码智能体通过沙箱隔离降低 AI 编码代理执行命令带来的安全风险面向在不可信或高风险任务中部署 AI 编程工具的场景1 个月前访问原文链接
HackerNewsEngrim:面向 AI CLI 的本地优先 SQLite 记忆引擎Engrim 是一个通用的、本地优先的 SQLite 记忆引擎,专为 AI 命令行工具设计它以 SQLite 作为存储底座,让 AI 助手在会话间持久化记忆与上下文项目以 Show HN 形式发布,主打本地化、隐私友好与零依赖集成1 个月前访问原文链接
HackerNewsOKF Agent Memory:Git 原生的 AI 编程记忆库OKF 实现 Google OKF v0.2 规范,为 AI 编程 Agent 提供 Git 原生的持久化记忆能力。内置亚 300 微秒级 BM25 检索与嵌入式 MCP 服务器,采用渐进式披露,宣称 token 膨胀降低 80%。纯 Go 编写、零外部数据库依赖,可直接融入现有代码仓库工作流。1 个月前访问原文链接
ProductHunt开源AI网关Experiential Labs用流量优化模型Experiential Labs是一款开源AI网关,声称能将流量转化为更好的模型表现。该产品面向需要统一接入与管理多个AI模型的开发团队。主打开源与可自托管,降低多模型接入与调度的复杂度。1 个月前访问原文链接
HackerNews美国企业正集体「上瘾」开源AI纽约时报报道,越来越多美国企业转向开源AI模型,不再局限于闭源大厂产品。Anthropic、OpenAI等公司也面临开源生态带来的竞争压力,企业看重可控性与成本。开源模型在企业内部的定制、私有化部署与成本优势成为关键驱动力。1 个月前访问原文链接
HackerNewsSpotify开源Portal,把Claude Code用量砍掉九成Spotify工程团队发布Portal工具,据称将Claude Code的token消耗降低了约90%。Portal通过优化上下文管理,减少重复发送冗余信息,从而大幅压缩模型调用成本。该实践来自Spotify内部真实开发场景,对重度使用编码智能体的团队有直接参考价值。1 个月前访问原文链接
QbitAI李飞飞发布 Atlas,中国开源「同款」已抢跑半年李飞飞团队发布 Atlas,强调智能是对世界的建模而非模式识别文章指出中国开源社区已有类似「世界模型」路线并提前半年布局引发关于中美 AI 研究方向与开源生态的对比讨论1 个月前访问原文链接
QbitAI金融 AI 年度大考:2 万选手、30+ 机构、百亿级数据开源金融 AI 年度竞赛落幕,吸引 2 万名选手、5000 支队伍参与30 多家机构参与,百亿级数据对外开放集中反映金融 AI 行业四年来的能力演进1 个月前访问原文链接
TheVerge_AI英伟达发布免费工具 PAIR,闲置电脑组网成个人 AI 数据中心英伟达发布免费开源工具 PAIR(Personal AI Router),将家中闲置电脑组网可配合 Ollama、LM Studio 等工具在本地完成 AI 推理任务无需购买专用硬件,即可搭建个人级本地 AI 算力池1 个月前访问原文链接
HackerNews用 LLM 读 68000 汇编,开发者将 1993 年 Amiga 游戏移植到 Godot一位开发者借助 LLM 读取 68000 汇编代码,成功将 1993 年的 Amiga 老游戏移植到 Godot 引擎展示了 LLM 在理解遗留汇编、跨平台迁移上的实用价值项目验证了 AI 辅助重构上古代码库的可行性1 个月前访问原文链接
TheVerge_AI英伟达近 130 亿美元收购 Hugging Face英伟达以约 129.3 亿美元收购开源 AI 平台 Hugging FaceHugging Face 是全球最大的开源模型、数据集托管平台之一全球最大 AI 芯片商掌控开源 AI 生态的关键枢纽1 个月前访问原文链接
HackerNewsMETR 报告复盘 OpenAI/Hugging Face 遭入侵METR 发布 OpenAI 与 Hugging Face 遭黑客入侵事件的调查报告复盘攻击路径与核心教训,涉及 AI 供应链安全为 AI 基础设施安全防护提供参考1 个月前访问原文链接
HackerNews欧洲发布 438B 参数旗舰模型 QuasarMultiverse Computing 发布 4380 亿参数的 Quasar 模型号称欧洲领先的大模型,主打主权 AI 能力欧洲在 AI 主权焦虑下加速自研大模型1 个月前访问原文链接
HackerNewsWebLLM:浏览器内高性能大模型推理引擎WebLLM 支持在浏览器内直接运行大语言模型推理基于 WebGPU 硬件加速,无需后端服务器即可本地部署开源项目,面向隐私敏感与边缘部署场景1 个月前访问原文链接
HackerNewsLLM City:Kimi K3权重3D可视化项目将Kimi K3大模型的全部权重渲染成3D城市每块2.5mm磁贴代表模型权重参数用可视化艺术呈现大模型的庞大结构1 个月前访问原文链接