QbitAI陈大年复出入局大模型,首秀对标DeepSeek万亿旗舰知名互联网创业者陈大年宣布复出,正式入局大模型赛道。其团队首款模型号称性能逼近 DeepSeek 万亿参数旗舰级模型。老一代互联网人重返 AI 战场,为国产大模型竞争再添新变量。2 小时前访问原文链接
HackerNewsDeepSeek 推出 Harness,可组合式 Agent 框架DeepSeek 发布 Harness 开发者预览,定位为可组合式 Agent 框架核心设计理念是「一切皆插件」,让开发者自由拼接工具与能力目前处于开发者预览阶段,尚未正式 GA20 天前访问原文链接
HackerNewsDeepSeek 推错峰定价,API 按时段计价DeepSeek 官方更新 API 定价,引入高峰与错峰时段的差异化计费策略错峰时段调用成本更低,鼓励开发者将批量任务调度到低峰期运行新定价与此前发布的 V4 Pro 模型配套,进一步压低推理成本20 天前访问原文链接
HackerNewsDeepSeek 官方发布 V4 Pro 0813 版本DeepSeek 官方 API 文档站更新,正式发布 V4 Pro 0813 版本新版本在推理能力与代码生成上较前代有明显提升,主打开发者 API 场景官方文档同步更新调用说明,开发者可直接接入测试21 天前访问原文链接
HackerNewsDeepSeek V4 Pro 0813 上线 OpenRouterDeepSeek 新一代 V4 Pro 0813 模型出现在 OpenRouter 平台,供第三方开发者调用HN 热帖获近千点赞,开发者社区对 DeepSeek 新版推理与代码能力关注度极高该版本延续 DeepSeek 开源低价路线,API 定价对独立开发者友好21 天前访问原文链接
HackerNewsDeepSeek V4 Flash终端基准测试达82.7%DeepSeek V4 Flash 0731版本在Terminal-Bench 2.1上取得82.7%的优异成绩测试使用完全公开可复现的评测框架,强调评测结果的透明性和第三方可验证性持续缩小开源模型与闭源模型在终端任务执行能力上的差距24 天前访问原文链接
HackerNews通义千问3.8 vs Claude Opus 5:基准测试失效的真相VentureBeat对比分析显示,通义千问3.8 Max与Claude Opus 5在原始基准分数上接近但实际API调用成本差异巨大,基准测试分数无法准确预测真实使用场景的性价比文章指出模型评测体系需要将成本纳入核心维度,纯性能排名正在失去参考价值25 天前访问原文链接
HackerNewsDeepSeek V4 Flash 0731 登顶 ARC 推理基准测试DeepSeek V4 Flash 0731 在 ARC Prize 推理基准测试中取得突破性成绩该模型在抽象推理任务上展现出接近人类的模式识别能力标志着中国 AI 团队在通用推理能力上迈出重要一步26 天前访问原文链接
HackerNewsQwen3.8 Max登顶Agentic Index榜首通义千问Qwen3.8 Max在Agentic Index评测中超越所有竞争对手排名第一Agentic Index是衡量模型在自主任务执行方面能力的综合指标中国开源模型在国际基准测试中取得里程碑式突破27 天前访问原文链接
HackerNewsDeepSeek宣布显著提价,低价策略面临挑战南华早报报道DeepSeek因需求激增宣布将进行显著的价格上调此前DeepSeek以极低API价格闻名,此次提价标志着其商业模式的重大转变此举可能影响依赖DeepSeek低成本API的中小开发者和初创企业28 天前访问原文链接
HackerNewsDeepSeek V4 Flash 成功在单张 AMD MI300X 上运行开发者成功将 DeepSeek V4 Flash 模型部署到单张 AMD MI300X GPU 上运行项目已在 GitHub 开源,包含完整的配置脚本和性能优化指南此前该级别模型通常需要多张高端 GPU,单卡运行大幅降低了硬件门槛1 个月前访问原文链接
TheVerge_AI阿里巴巴发布最强开源模型Qwen3.8-Max,挑战美国AI霸权阿里巴巴发布其最大最强的AI模型Qwen3.8-Max,声称性能对标Anthropic和OpenAI顶级模型模型采用开放权重策略,与国内竞品Moonshot AI的Kimi K3形成直接竞争代表中国AI在开源路线上对美国的又一次正面冲击1 个月前访问原文链接
ProductHuntDeepSeek V4 Flash发布:前沿Agent智能的Flash级速度DeepSeek发布V4 Flash版本,以更低的成本提供接近顶级的AI Agent推理能力定价极具竞争力,面向需要大量API调用的开发者和企业在Agent任务和代码生成基准测试中表现优异,性价比突出1 个月前访问原文链接
36Kr字节跳动成立新豆包产品团队,月之暗面变更为股份公司字节跳动成立新的豆包(AI助手)产品团队,加大AI产品化投入月之暗面(Moonshot AI)完成股份制改造,变更为股份公司,为后续资本运作铺路两家中国AI明星公司同日传来组织架构和治理结构升级的消息1 个月前访问原文链接
HackerNews蒸馏 DeepSeek 到 GPT-OSS:审查机制不会被迁移研究者通过蒸馏技术将 DeepSeek 模型的知识迁移到开源 GPT-OSS 架构中实验发现蒸馏过程中 DeepSeek 的内容审查机制并不会被迁移到目标模型这一发现对开源社区具有重要意义,意味着可以通过蒸馏获得高性能且无审查限制的模型1 个月前访问原文链接
HackerNewsDeepSeek V4 Flash 正式更新发布DeepSeek 官方发布 V4 Flash 模型更新,API 文档同步上线新版本在推理速度、上下文窗口和工具调用能力上均有显著提升定价策略延续激进路线,百万 token 成本远低于 GPT-5 和 Claude 系列1 个月前访问原文链接
HackerNewsDeepSeek V4 Flash 性能与价格深度分析Artificial Analysis 对 DeepSeek V4 Flash 进行了全面基准测试,涵盖智能、性能和价格三个维度V4 Flash 在推理速度上表现出色,延迟显著低于同类竞品,成本仅为 GPT-5 系列的几十分之一该模型在代码生成和数学推理等关键基准上接近或达到前沿水平,性价比极高1 个月前访问原文链接
TheVerge_AI中国AI公司为何免费开放最强模型权重以Moonshot AI的Kimi K3为代表,中国AI公司持续免费开放顶级模型权重K3在多项基准上追平甚至超越美国顶尖闭源模型,但训练成本仅为其零头开源策略正在重塑全球AI竞争格局,冲击美国公司的商业模型1 个月前访问原文链接
HackerNewsDeepSeek 暂停融资,梁文锋坦言算力差距DeepSeek 创始人梁文锋在投资人交流会上承认与美国存在显著算力差距会后 DeepSeek 暂停了新一轮融资计划,引发行业关注泄露的会议纪要显示梁文锋对芯片封锁的影响做出了坦率评估1 个月前访问原文链接
36Kr早报速递:宇树 CEO 登《时代》封面,国家反诈 App 新增 AI 检测功能宇树科技 CEO 王兴兴登上《时代》杂志封面,中国具身智能企业获国际关注国家反诈中心 App 上线一键检测 AI 生成内容的功能,应对 AI 深度伪造诈骗Claude Opus 5 正式发布,全球 AI 模型竞争持续升温1 个月前访问原文链接
HackerNews驳「反对开源AI」的常见论点:一篇硬核辩护开发者撰文系统反驳了反对开源AI的几大主流论点,包括安全风险、竞争劣势和国家安全隐患文章指出闭源AI反而更难审计,开源模型的透明性才是真正的安全保障作者用数据和逻辑论证开源AI对创新速度、学术研究和中小企业赋能的积极影响1 个月前访问原文链接
HackerNews美国创业者联名呼吁:不要切断中国开源AI模型多家美国初创公司创始人联合致信美国政府,反对限制中国开源AI权重模型的访问权限创业者担心切断中国开源模型将严重损害美国AI生态的竞争力和创新速度DeepSeek、Qwen等中国开源模型已在全球开发者社区中广泛采用,形成依赖生态1 个月前访问原文链接
36KrDeepSeek今年已增资65%,AI赛道军备竞赛持续升温DeepSeek在2026年已完成65%的大幅增资,资本持续涌入反映中国AI大模型赛道投融资热度不减,头部企业加速资金储备与此同时马斯克称FSD是拉动特斯拉需求的核心驱动力,AI+汽车双线并行1 个月前访问原文链接
HackerNews爆料:DeepSeek 疑似将部分请求转发至 Fable5用户在社交媒体爆料 DeepSeek 将部分用户请求路由到竞品 Fable5引发社区对 DeepSeek 服务架构和算力策略的广泛猜测目前 DeepSeek 尚未官方回应此事1 个月前访问原文链接
HackerNewsFable 5 与 GPT-5.6 对决 NP-Hard 问题:/goal 命令有何奇效实测对比 Fable 5 和 GPT-5.6 在 NP-Hard 问题求解上的表现重点测试 /goal 命令对模型推理能力的提升效果结果显示特定提示策略能显著改善复杂问题求解质量1 个月前访问原文链接
HackerNews德国AI联盟发布Soofi S开源30B模型,英德双语双双登顶基准测试德国AI研究联盟发布开源30B参数大模型Soofi S,在英语和德语基准测试中均表现领先模型采用创新训练策略,在同等参数量下实现优于Llama和Mistral等主流开源模型的性能这是欧洲AI力量在开源大模型领域的重要布局,减少对美中模型的依赖1 个月前访问原文链接
36Kr独家:面壁智能端侧大模型将预装三星旗舰手机端侧大模型公司面壁智能已与三星达成合作,其MiniCPM系列模型将预装于三星数款旗舰机型同日网信办批准7款手机端侧AI服务,包括苹果智能、华为小艺、OPPO、vivo、小米等面壁智能成为唯一以独立模型公司身份进入三星预装名单的中国AI企业1 个月前访问原文链接
36Kr国行苹果AI完成备案,DeepSeek被曝筹备IPO网信办公布7款端侧生成式AI服务完成备案,苹果Apple智能位列其中,阿里千问和百度分别提供AI能力支撑知情人士透露DeepSeek已开始筹备IPO,这家中国AI明星公司的上市计划浮出水面标志着中国AI产业从技术竞赛进入商业化落地和资本市场验证的新阶段1 个月前访问原文链接
HackerNewsDeepMind CEO Hassabis公布AI安全路线图,主张渐进式管控Google DeepMind CEO Demis Hassabis发文阐述AI安全治理方案,主张通过渐进式监管而非激进刹车来控制前沿模型风险Hassabis强调美国应主导全球AI标准制定,并呼吁建立国际AI监管机构文章发布后引发149分热议,社区对「渐进式」vs「预防式」安全路线展开激烈辩论1 个月前访问原文链接
36Kr智谱CEO唐杰内部信:万亿市值之后押注什么?36氪独家获悉智谱CEO唐杰发布内部信《巨浪已来》,公司市值半年涨10倍突破万亿港元智谱成功的核心在于2025年初押注Coding能力,与Agent共生共荣的技术路线唐杰认为后DeepSeek时代,Coding和Reasoning是AI模型的核心竞争维度1 个月前访问原文链接
HackerNewsDeepSeek 计划自研 AI 芯片,硅谷应高度警惕中国 AI 公司 DeepSeek 被曝正在规划自研 AI 芯片此举将减少对英伟达等外部供应商的依赖分析认为这标志着 DeepSeek 从模型层向基础设施层的战略延伸1 个月前访问原文链接
HackerNewsGLM 5.2 发布:AI 模型利润空间或将崩塌智谱发布 GLM 5.2 模型,多项基准测试接近 GPT-5 水平但成本大幅降低开源模型与商用闭源模型的性能差距持续缩小,价格战加剧AI 模型层利润空间面临系统性收缩,应用层价值将重新分配1 个月前访问原文链接
36KrDeepSeek V4正式版7月上线,引入峰谷定价机制DeepSeek V4正式版计划7月中旬上线,API价格引入峰谷机制,高峰期价格为平时2倍高峰时段为每天9-12点和14-18点,此举旨在优化资源配置和提升服务稳定性2 个月前访问原文链接
HackerNewsDeepSeek开源推理加速方案,生成速度提升60-85%DeepSeek发布DeepSpec论文,开源推理优化技术方案该方案可在推理阶段实现60%至85%的生成速度提升相关代码已在GitHub开源,面向社区开放使用2 个月前访问原文链接
HackerNews对全球多数国家而言,开源AI是唯一出路开源AI模型大幅降低非发达国家的技术准入门槛闭源模型高昂的API费用对发展中国家不可持续开源生态赋能本地化部署和垂直场景定制2 个月前访问原文链接
HackerNews美国暂缓将DeepSeek列入黑名单,超百家企业被认定存在安全风险路透社报道美国政府暂缓将DeepSeek列入贸易黑名单同时认定超过100家中国企业存在安全风险地缘政治博弈持续影响AI行业格局2 个月前访问原文链接
HackerNewsGPT-NL:荷兰推出自主主权语言模型荷兰TNO研究院发布GPT-NL,专为荷兰语和欧盟场景优化旨在减少对美国和大型科技公司的AI基础设施依赖完全符合欧盟数据主权和GDPR隐私法规要求2 个月前访问原文链接
TheVerge_AI特朗普迫使Anthropic关闭,为「非美国AI」打开大门分析美国政府对Anthropic的打击如何加速非美国AI生态发展欧洲、中国等地区趁机加速自主AI建设美国的AI管制政策可能适得其反强调AI主权正在成为新的全球竞赛主题2 个月前访问原文链接
ProductHuntKimi K2.7 Code:月之暗面最强编码模型上线Kimi 最新编程模型 K2.7 Code 发布号称目前最强大的代码生成能力ProductHunt 今日上榜新品2 个月前访问原文链接
HackerNewsHugging Face发起DeepSeek-R1开源复现计划Hugging Face启动Open-R1项目,全面复现DeepSeek-R1推理模型目标是完全透明地重现训练流程、数据集和评估降低先进推理模型门槛,推动开源社区发展2 个月前访问原文链接
HackerNewsHN热帖:DeepSeek深度解读与社区讨论HN用户从技术、商业、地缘政治多角度分析DeepSeek讨论其架构创新(MoE、训练效率)与对开源生态的影响对比西方闭源模型路线的优劣2 个月前访问原文链接
36Kr独家:字节 AI 制药开启拆分融资,AI4S 进入产业化阶段字节跳动 AI 制药业务启动独立融资AI for Science (AI4S) 从实验室走向产业标志中国 AI 制药进入商业化快车道2 个月前访问原文链接
HackerNewsDeepSeek V4 Pro 精度测试超越 GPT-5.5 ProDeepSeek V4 Pro 在精度基准测试中击败 GPT-5.5 Pro评测聚焦精确度指标,中国开源模型展现强劲竞争力开源路线持续缩小与 OpenAI 旗舰模型差距2 个月前访问原文链接
36Kr豆包 6 月下旬正式付费,加速打通抖音电商丨36氪独家字节旗下 AI 助手豆包将于 6 月下旬推出付费订阅四档定价:免费/68元/200元/500元每月同时加速与抖音电商生态打通,探索 AI 带货3 个月前访问原文链接
HackerNewsDeepSeek将AI成本砍到"分"级DeepSeek通过极致优化将API价格降至每百万token仅数美分采用MoE架构和量化技术创新来降低成本对OpenAI/Anthropic的定价体系形成巨大压力3 个月前访问原文链接
HackerNewsDeepSeek V4 Pro 永久降价:AI API 价格战升级DeepSeek 宣布 V4 Pro 模型的促销定价转为永久价格,不再恢复原价此举将加剧 AI API 市场的价格竞争,对 OpenAI、Anthropic 等形成压力开发者有望持续享受更低成本的推理服务3 个月前访问原文链接
HackerNewsDeepSeek Reasonix:高缓存低成本的本地编程智能体DeepSeek 推出 Reasonix 原生编程智能体,主打高缓存命中率与低运营成本社区基准测试显示其在代码生成效率上表现突出,缓存策略大幅减少重复计算有望成为开发者的低成本本地编程助手方案3 个月前访问原文链接