标签聚合

端侧AI

端侧AI 领域的最新 AI 动态与独家辣评,共 7

ProductHunt

NobodyWho:让AI模型跑在任何设备上

  • NobodyWho致力于让AI模型在任意设备上运行。
  • (基于标题摘要推断)主打端侧推理,降低对云端算力与网络的依赖。
14 天前访问原文链接
HackerNews

Needle2:14MB的端侧智能体LLM,可在手机手表上运行

  • Needle2 是一个仅14MB的智能体LLM,专为手机、可穿戴设备、智能家居和机器人设计
  • 在极低资源消耗下实现了设备端的智能体决策能力,无需云端依赖
  • 开源项目已在GitHub发布,支持离线运行和隐私保护
23 天前访问原文链接
HackerNews

1比特LLM在浏览器中运行,端侧AI迈出关键一步

  • 开发者在浏览器中通过WebGPU实现了1比特量化的大语言模型运行
  • 极低比特量化使LLM可以在消费级设备本地运行,无需GPU
  • 这项技术展示了端侧AI推理的巨大潜力
1 个月前访问原文链接
36Kr

独家:面壁智能端侧大模型将预装三星旗舰手机

  • 端侧大模型公司面壁智能已与三星达成合作,其MiniCPM系列模型将预装于三星数款旗舰机型
  • 同日网信办批准7款手机端侧AI服务,包括苹果智能、华为小艺、OPPO、vivo、小米等
  • 面壁智能成为唯一以独立模型公司身份进入三星预装名单的中国AI企业
1 个月前访问原文链接
HackerNews

苹果芯片高管解读 Mac Mini 的 AI 需求与端侧未来

  • Apple Silicon 高管在接受采访时深入解析 Mac Mini 在 AI 推理工作负载中的强劲需求
  • 强调了苹果在设备端 AI 处理能力上的技术优势和战略方向
  • 暗示未来 Mac 产品线将继续强化本地 AI 处理能力
1 个月前访问原文链接
ProductHunt

Google推出Gemini Omni Flash轻量模型

  • Google发布Gemini Omni Flash,定位超低延迟的多模态轻量模型
  • 针对实时交互场景优化,延迟降低至毫秒级
  • 支持文本、图像、语音多模态输入输出,适合端侧部署
2 个月前访问原文链接
HackerNews

Apple Neural Engine架构与性能深度解析

  • arXiv论文详细分析了苹果神经引擎(ANE)的架构设计、编程模型和实际性能
  • Apple Neural Engine已成为iPhone和Mac上AI推理的核心硬件
  • 论文揭示了ANE在能效比上的巨大优势,为端侧AI提供了重要参考
2 个月前访问原文链接