OpenAI 发布了 GPT-5.6 Sol 的“Ultrafast”服务层级预览,该模式通过 Cerebras 硬件支持,生成速度高达每秒 750 个输出 token,比标准处理快 14 倍。这标志着前沿智能模型首次在不牺牲推理能力的前提下实现实时响应,打破了以往高速需依赖小型模型的局限。文章强调,该技术将 AI 应用于时间敏感场景,如故障响应、实时金融分析、客户支持、电商决策和交互式科研实验,使复杂任务能在数秒内完成。预览期间,OpenAI 正与早期客户合作,在真实生产环境中评估速度的实际影响,并计划基于反馈扩展访问。这一进展凸显了“每秒有效工作量”作为新竞争维度的潜力,可能推动 AI 更深度融入核心业务流程。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅