标签聚合

DeepSeek

DeepSeek 领域的最新 AI 动态与独家辣评,共 48

QbitAI

陈大年复出入局大模型,首秀对标DeepSeek万亿旗舰

  • 知名互联网创业者陈大年宣布复出,正式入局大模型赛道。
  • 其团队首款模型号称性能逼近 DeepSeek 万亿参数旗舰级模型。
  • 老一代互联网人重返 AI 战场,为国产大模型竞争再添新变量。
2 小时前访问原文链接
HackerNews

DeepSeek 推出 Harness,可组合式 Agent 框架

  • DeepSeek 发布 Harness 开发者预览,定位为可组合式 Agent 框架
  • 核心设计理念是「一切皆插件」,让开发者自由拼接工具与能力
  • 目前处于开发者预览阶段,尚未正式 GA
20 天前访问原文链接
HackerNews

DeepSeek 推错峰定价,API 按时段计价

  • DeepSeek 官方更新 API 定价,引入高峰与错峰时段的差异化计费策略
  • 错峰时段调用成本更低,鼓励开发者将批量任务调度到低峰期运行
  • 新定价与此前发布的 V4 Pro 模型配套,进一步压低推理成本
20 天前访问原文链接
HackerNews

DeepSeek 官方发布 V4 Pro 0813 版本

  • DeepSeek 官方 API 文档站更新,正式发布 V4 Pro 0813 版本
  • 新版本在推理能力与代码生成上较前代有明显提升,主打开发者 API 场景
  • 官方文档同步更新调用说明,开发者可直接接入测试
21 天前访问原文链接
HackerNews

DeepSeek V4 Pro 0813 上线 OpenRouter

  • DeepSeek 新一代 V4 Pro 0813 模型出现在 OpenRouter 平台,供第三方开发者调用
  • HN 热帖获近千点赞,开发者社区对 DeepSeek 新版推理与代码能力关注度极高
  • 该版本延续 DeepSeek 开源低价路线,API 定价对独立开发者友好
21 天前访问原文链接
HackerNews

DeepSeek V4 Flash终端基准测试达82.7%

  • DeepSeek V4 Flash 0731版本在Terminal-Bench 2.1上取得82.7%的优异成绩
  • 测试使用完全公开可复现的评测框架,强调评测结果的透明性和第三方可验证性
  • 持续缩小开源模型与闭源模型在终端任务执行能力上的差距
24 天前访问原文链接
HackerNews

通义千问3.8 vs Claude Opus 5:基准测试失效的真相

  • VentureBeat对比分析显示,通义千问3.8 Max与Claude Opus 5在原始基准分数上接近
  • 但实际API调用成本差异巨大,基准测试分数无法准确预测真实使用场景的性价比
  • 文章指出模型评测体系需要将成本纳入核心维度,纯性能排名正在失去参考价值
25 天前访问原文链接
HackerNews

DeepSeek V4 Flash 0731 登顶 ARC 推理基准测试

  • DeepSeek V4 Flash 0731 在 ARC Prize 推理基准测试中取得突破性成绩
  • 该模型在抽象推理任务上展现出接近人类的模式识别能力
  • 标志着中国 AI 团队在通用推理能力上迈出重要一步
26 天前访问原文链接
HackerNews

Qwen3.8 Max登顶Agentic Index榜首

  • 通义千问Qwen3.8 Max在Agentic Index评测中超越所有竞争对手排名第一
  • Agentic Index是衡量模型在自主任务执行方面能力的综合指标
  • 中国开源模型在国际基准测试中取得里程碑式突破
27 天前访问原文链接
HackerNews

DeepSeek宣布显著提价,低价策略面临挑战

  • 南华早报报道DeepSeek因需求激增宣布将进行显著的价格上调
  • 此前DeepSeek以极低API价格闻名,此次提价标志着其商业模式的重大转变
  • 此举可能影响依赖DeepSeek低成本API的中小开发者和初创企业
28 天前访问原文链接
HackerNews

DeepSeek V4 Flash 成功在单张 AMD MI300X 上运行

  • 开发者成功将 DeepSeek V4 Flash 模型部署到单张 AMD MI300X GPU 上运行
  • 项目已在 GitHub 开源,包含完整的配置脚本和性能优化指南
  • 此前该级别模型通常需要多张高端 GPU,单卡运行大幅降低了硬件门槛
1 个月前访问原文链接
TheVerge_AI

阿里巴巴发布最强开源模型Qwen3.8-Max,挑战美国AI霸权

  • 阿里巴巴发布其最大最强的AI模型Qwen3.8-Max,声称性能对标Anthropic和OpenAI顶级模型
  • 模型采用开放权重策略,与国内竞品Moonshot AI的Kimi K3形成直接竞争
  • 代表中国AI在开源路线上对美国的又一次正面冲击
1 个月前访问原文链接
ProductHunt

DeepSeek V4 Flash发布:前沿Agent智能的Flash级速度

  • DeepSeek发布V4 Flash版本,以更低的成本提供接近顶级的AI Agent推理能力
  • 定价极具竞争力,面向需要大量API调用的开发者和企业
  • 在Agent任务和代码生成基准测试中表现优异,性价比突出
1 个月前访问原文链接
36Kr

字节跳动成立新豆包产品团队,月之暗面变更为股份公司

  • 字节跳动成立新的豆包(AI助手)产品团队,加大AI产品化投入
  • 月之暗面(Moonshot AI)完成股份制改造,变更为股份公司,为后续资本运作铺路
  • 两家中国AI明星公司同日传来组织架构和治理结构升级的消息
1 个月前访问原文链接
HackerNews

蒸馏 DeepSeek 到 GPT-OSS:审查机制不会被迁移

  • 研究者通过蒸馏技术将 DeepSeek 模型的知识迁移到开源 GPT-OSS 架构中
  • 实验发现蒸馏过程中 DeepSeek 的内容审查机制并不会被迁移到目标模型
  • 这一发现对开源社区具有重要意义,意味着可以通过蒸馏获得高性能且无审查限制的模型
1 个月前访问原文链接
HackerNews

DeepSeek V4 Flash 正式更新发布

  • DeepSeek 官方发布 V4 Flash 模型更新,API 文档同步上线
  • 新版本在推理速度、上下文窗口和工具调用能力上均有显著提升
  • 定价策略延续激进路线,百万 token 成本远低于 GPT-5 和 Claude 系列
1 个月前访问原文链接
HackerNews

DeepSeek V4 Flash 性能与价格深度分析

  • Artificial Analysis 对 DeepSeek V4 Flash 进行了全面基准测试,涵盖智能、性能和价格三个维度
  • V4 Flash 在推理速度上表现出色,延迟显著低于同类竞品,成本仅为 GPT-5 系列的几十分之一
  • 该模型在代码生成和数学推理等关键基准上接近或达到前沿水平,性价比极高
1 个月前访问原文链接
TheVerge_AI

中国AI公司为何免费开放最强模型权重

  • 以Moonshot AI的Kimi K3为代表,中国AI公司持续免费开放顶级模型权重
  • K3在多项基准上追平甚至超越美国顶尖闭源模型,但训练成本仅为其零头
  • 开源策略正在重塑全球AI竞争格局,冲击美国公司的商业模型
1 个月前访问原文链接
HackerNews

DeepSeek 暂停融资,梁文锋坦言算力差距

  • DeepSeek 创始人梁文锋在投资人交流会上承认与美国存在显著算力差距
  • 会后 DeepSeek 暂停了新一轮融资计划,引发行业关注
  • 泄露的会议纪要显示梁文锋对芯片封锁的影响做出了坦率评估
1 个月前访问原文链接
36Kr

早报速递:宇树 CEO 登《时代》封面,国家反诈 App 新增 AI 检测功能

  • 宇树科技 CEO 王兴兴登上《时代》杂志封面,中国具身智能企业获国际关注
  • 国家反诈中心 App 上线一键检测 AI 生成内容的功能,应对 AI 深度伪造诈骗
  • Claude Opus 5 正式发布,全球 AI 模型竞争持续升温
1 个月前访问原文链接
HackerNews

驳「反对开源AI」的常见论点:一篇硬核辩护

  • 开发者撰文系统反驳了反对开源AI的几大主流论点,包括安全风险、竞争劣势和国家安全隐患
  • 文章指出闭源AI反而更难审计,开源模型的透明性才是真正的安全保障
  • 作者用数据和逻辑论证开源AI对创新速度、学术研究和中小企业赋能的积极影响
1 个月前访问原文链接
HackerNews

美国创业者联名呼吁:不要切断中国开源AI模型

  • 多家美国初创公司创始人联合致信美国政府,反对限制中国开源AI权重模型的访问权限
  • 创业者担心切断中国开源模型将严重损害美国AI生态的竞争力和创新速度
  • DeepSeek、Qwen等中国开源模型已在全球开发者社区中广泛采用,形成依赖生态
1 个月前访问原文链接
36Kr

DeepSeek今年已增资65%,AI赛道军备竞赛持续升温

  • DeepSeek在2026年已完成65%的大幅增资,资本持续涌入
  • 反映中国AI大模型赛道投融资热度不减,头部企业加速资金储备
  • 与此同时马斯克称FSD是拉动特斯拉需求的核心驱动力,AI+汽车双线并行
1 个月前访问原文链接
HackerNews

爆料:DeepSeek 疑似将部分请求转发至 Fable5

  • 用户在社交媒体爆料 DeepSeek 将部分用户请求路由到竞品 Fable5
  • 引发社区对 DeepSeek 服务架构和算力策略的广泛猜测
  • 目前 DeepSeek 尚未官方回应此事
1 个月前访问原文链接
HackerNews

Fable 5 与 GPT-5.6 对决 NP-Hard 问题:/goal 命令有何奇效

  • 实测对比 Fable 5 和 GPT-5.6 在 NP-Hard 问题求解上的表现
  • 重点测试 /goal 命令对模型推理能力的提升效果
  • 结果显示特定提示策略能显著改善复杂问题求解质量
1 个月前访问原文链接
HackerNews

德国AI联盟发布Soofi S开源30B模型,英德双语双双登顶基准测试

  • 德国AI研究联盟发布开源30B参数大模型Soofi S,在英语和德语基准测试中均表现领先
  • 模型采用创新训练策略,在同等参数量下实现优于Llama和Mistral等主流开源模型的性能
  • 这是欧洲AI力量在开源大模型领域的重要布局,减少对美中模型的依赖
1 个月前访问原文链接
36Kr

独家:面壁智能端侧大模型将预装三星旗舰手机

  • 端侧大模型公司面壁智能已与三星达成合作,其MiniCPM系列模型将预装于三星数款旗舰机型
  • 同日网信办批准7款手机端侧AI服务,包括苹果智能、华为小艺、OPPO、vivo、小米等
  • 面壁智能成为唯一以独立模型公司身份进入三星预装名单的中国AI企业
1 个月前访问原文链接
36Kr

国行苹果AI完成备案,DeepSeek被曝筹备IPO

  • 网信办公布7款端侧生成式AI服务完成备案,苹果Apple智能位列其中,阿里千问和百度分别提供AI能力支撑
  • 知情人士透露DeepSeek已开始筹备IPO,这家中国AI明星公司的上市计划浮出水面
  • 标志着中国AI产业从技术竞赛进入商业化落地和资本市场验证的新阶段
1 个月前访问原文链接
HackerNews

DeepMind CEO Hassabis公布AI安全路线图,主张渐进式管控

  • Google DeepMind CEO Demis Hassabis发文阐述AI安全治理方案,主张通过渐进式监管而非激进刹车来控制前沿模型风险
  • Hassabis强调美国应主导全球AI标准制定,并呼吁建立国际AI监管机构
  • 文章发布后引发149分热议,社区对「渐进式」vs「预防式」安全路线展开激烈辩论
1 个月前访问原文链接
36Kr

智谱CEO唐杰内部信:万亿市值之后押注什么?

  • 36氪独家获悉智谱CEO唐杰发布内部信《巨浪已来》,公司市值半年涨10倍突破万亿港元
  • 智谱成功的核心在于2025年初押注Coding能力,与Agent共生共荣的技术路线
  • 唐杰认为后DeepSeek时代,Coding和Reasoning是AI模型的核心竞争维度
1 个月前访问原文链接
HackerNews

DeepSeek 计划自研 AI 芯片,硅谷应高度警惕

  • 中国 AI 公司 DeepSeek 被曝正在规划自研 AI 芯片
  • 此举将减少对英伟达等外部供应商的依赖
  • 分析认为这标志着 DeepSeek 从模型层向基础设施层的战略延伸
1 个月前访问原文链接
HackerNews

GLM 5.2 发布:AI 模型利润空间或将崩塌

  • 智谱发布 GLM 5.2 模型,多项基准测试接近 GPT-5 水平但成本大幅降低
  • 开源模型与商用闭源模型的性能差距持续缩小,价格战加剧
  • AI 模型层利润空间面临系统性收缩,应用层价值将重新分配
1 个月前访问原文链接
36Kr

DeepSeek V4正式版7月上线,引入峰谷定价机制

  • DeepSeek V4正式版计划7月中旬上线,API价格引入峰谷机制,高峰期价格为平时2倍
  • 高峰时段为每天9-12点和14-18点,此举旨在优化资源配置和提升服务稳定性
2 个月前访问原文链接
HackerNews

DeepSeek开源推理加速方案,生成速度提升60-85%

  • DeepSeek发布DeepSpec论文,开源推理优化技术方案
  • 该方案可在推理阶段实现60%至85%的生成速度提升
  • 相关代码已在GitHub开源,面向社区开放使用
2 个月前访问原文链接
HackerNews

对全球多数国家而言,开源AI是唯一出路

  • 开源AI模型大幅降低非发达国家的技术准入门槛
  • 闭源模型高昂的API费用对发展中国家不可持续
  • 开源生态赋能本地化部署和垂直场景定制
2 个月前访问原文链接
HackerNews

美国暂缓将DeepSeek列入黑名单,超百家企业被认定存在安全风险

  • 路透社报道美国政府暂缓将DeepSeek列入贸易黑名单
  • 同时认定超过100家中国企业存在安全风险
  • 地缘政治博弈持续影响AI行业格局
2 个月前访问原文链接
HackerNews

DeepSeek 推出视觉功能

  • DeepSeek在聊天界面中集成视觉能力
  • 支持图片理解和多模态交互
  • 进一步缩小与GPT-4o和Claude Vision的差距
2 个月前访问原文链接
HackerNews

GPT-NL:荷兰推出自主主权语言模型

  • 荷兰TNO研究院发布GPT-NL,专为荷兰语和欧盟场景优化
  • 旨在减少对美国和大型科技公司的AI基础设施依赖
  • 完全符合欧盟数据主权和GDPR隐私法规要求
2 个月前访问原文链接
TheVerge_AI

特朗普迫使Anthropic关闭,为「非美国AI」打开大门

  • 分析美国政府对Anthropic的打击如何加速非美国AI生态发展
  • 欧洲、中国等地区趁机加速自主AI建设
  • 美国的AI管制政策可能适得其反
  • 强调AI主权正在成为新的全球竞赛主题
2 个月前访问原文链接
ProductHunt

Kimi K2.7 Code:月之暗面最强编码模型上线

  • Kimi 最新编程模型 K2.7 Code 发布
  • 号称目前最强大的代码生成能力
  • ProductHunt 今日上榜新品
2 个月前访问原文链接
HackerNews

Hugging Face发起DeepSeek-R1开源复现计划

  • Hugging Face启动Open-R1项目,全面复现DeepSeek-R1推理模型
  • 目标是完全透明地重现训练流程、数据集和评估
  • 降低先进推理模型门槛,推动开源社区发展
2 个月前访问原文链接
HackerNews

HN热帖:DeepSeek深度解读与社区讨论

  • HN用户从技术、商业、地缘政治多角度分析DeepSeek
  • 讨论其架构创新(MoE、训练效率)与对开源生态的影响
  • 对比西方闭源模型路线的优劣
2 个月前访问原文链接
36Kr

独家:字节 AI 制药开启拆分融资,AI4S 进入产业化阶段

  • 字节跳动 AI 制药业务启动独立融资
  • AI for Science (AI4S) 从实验室走向产业
  • 标志中国 AI 制药进入商业化快车道
2 个月前访问原文链接
HackerNews

DeepSeek V4 Pro 精度测试超越 GPT-5.5 Pro

  • DeepSeek V4 Pro 在精度基准测试中击败 GPT-5.5 Pro
  • 评测聚焦精确度指标,中国开源模型展现强劲竞争力
  • 开源路线持续缩小与 OpenAI 旗舰模型差距
2 个月前访问原文链接
36Kr

豆包 6 月下旬正式付费,加速打通抖音电商丨36氪独家

  • 字节旗下 AI 助手豆包将于 6 月下旬推出付费订阅
  • 四档定价:免费/68元/200元/500元每月
  • 同时加速与抖音电商生态打通,探索 AI 带货
3 个月前访问原文链接
HackerNews

DeepSeek将AI成本砍到"分"级

  • DeepSeek通过极致优化将API价格降至每百万token仅数美分
  • 采用MoE架构和量化技术创新来降低成本
  • 对OpenAI/Anthropic的定价体系形成巨大压力
3 个月前访问原文链接
HackerNews

DeepSeek V4 Pro 永久降价:AI API 价格战升级

  • DeepSeek 宣布 V4 Pro 模型的促销定价转为永久价格,不再恢复原价
  • 此举将加剧 AI API 市场的价格竞争,对 OpenAI、Anthropic 等形成压力
  • 开发者有望持续享受更低成本的推理服务
3 个月前访问原文链接
HackerNews

DeepSeek Reasonix:高缓存低成本的本地编程智能体

  • DeepSeek 推出 Reasonix 原生编程智能体,主打高缓存命中率与低运营成本
  • 社区基准测试显示其在代码生成效率上表现突出,缓存策略大幅减少重复计算
  • 有望成为开发者的低成本本地编程助手方案
3 个月前访问原文链接