OpenAI在9月开发者日推出Dot及计算机操作能力,使智能体可在云端Linux环境中运行浏览器和桌面应用。其核心突破在于智能体具备多模态感知能力,能结合截图、无障碍API和代码理解界面,并自主排错重试,显著提升任务完成率。访谈中,产品负责人Ari Weinstein指出,过去一年最大进步是智能体遇到障碍后更善于调整方法并重新尝试,瓶颈已分散在模型、推理、运行框架和信息呈现等多个环节。API平台负责人Nikunj Handa透露,Decisions API受Jev启发而启动,团队约一周完成可运行原型,未重新训练模型,而是沿用Luna权重并优化推理速度,适用于快速分类与决策场景。当前人机责任边界,尤其是支付等关键操作中的介入标准,仍待明确。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅