ProductHuntNobodyWho:让AI模型跑在任何设备上NobodyWho致力于让AI模型在任意设备上运行。(基于标题摘要推断)主打端侧推理,降低对云端算力与网络的依赖。14 天前访问原文链接
HackerNewsNeedle2:14MB的端侧智能体LLM,可在手机手表上运行Needle2 是一个仅14MB的智能体LLM,专为手机、可穿戴设备、智能家居和机器人设计在极低资源消耗下实现了设备端的智能体决策能力,无需云端依赖开源项目已在GitHub发布,支持离线运行和隐私保护23 天前访问原文链接
HackerNews1比特LLM在浏览器中运行,端侧AI迈出关键一步开发者在浏览器中通过WebGPU实现了1比特量化的大语言模型运行极低比特量化使LLM可以在消费级设备本地运行,无需GPU这项技术展示了端侧AI推理的巨大潜力1 个月前访问原文链接
36Kr独家:面壁智能端侧大模型将预装三星旗舰手机端侧大模型公司面壁智能已与三星达成合作,其MiniCPM系列模型将预装于三星数款旗舰机型同日网信办批准7款手机端侧AI服务,包括苹果智能、华为小艺、OPPO、vivo、小米等面壁智能成为唯一以独立模型公司身份进入三星预装名单的中国AI企业1 个月前访问原文链接
HackerNews苹果芯片高管解读 Mac Mini 的 AI 需求与端侧未来Apple Silicon 高管在接受采访时深入解析 Mac Mini 在 AI 推理工作负载中的强劲需求强调了苹果在设备端 AI 处理能力上的技术优势和战略方向暗示未来 Mac 产品线将继续强化本地 AI 处理能力1 个月前访问原文链接
ProductHuntGoogle推出Gemini Omni Flash轻量模型Google发布Gemini Omni Flash,定位超低延迟的多模态轻量模型针对实时交互场景优化,延迟降低至毫秒级支持文本、图像、语音多模态输入输出,适合端侧部署2 个月前访问原文链接
HackerNewsApple Neural Engine架构与性能深度解析arXiv论文详细分析了苹果神经引擎(ANE)的架构设计、编程模型和实际性能Apple Neural Engine已成为iPhone和Mac上AI推理的核心硬件论文揭示了ANE在能效比上的巨大优势,为端侧AI提供了重要参考2 个月前访问原文链接