小米发布了玄戒 O3、O100 和 D100 三颗自研芯片,并在技术沟通会上展示了搭载这些芯片的工程原型机。实测中,一台折叠屏原型机在断网状态下本地运行 MiMo 3B 模型,响应延迟仅 0.45 秒,生成速度达 303 tokens/s,峰值可至 330 tokens/s,AI 回答快过人眼阅读节奏,实现了完全离线的即时交互。另一台桌面终端 AI Cube 内置 80GB 内存,本地部署 120B 参数大模型,可生成并运行完整的前端应用,并支持 3B 与 120B 快慢双模型切换,兼顾轻量响应与深度推理。这些原型机展示了端侧 AI 的两种方向:随身设备负责高频秒回,桌面终端承接复杂任务,离线 AI 能力已从概念变为真实体验,为未来低门槛本地大模型应用奠定了基础。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅