xAI发布了其迄今最强的模型Grok 4.7,主打编程与知识工作,基于更大的基础模型并采用更长的强化学习训练,定价为每百万输入token 2美元、每百万输出token 6美元,明显低于西方前沿模型。然而在独立评测机构Artificial Analysis的综合智能指数上,Grok 4.7仅得46分,处于中游,落后于Claude Fable 5.1和GPT-6的53分。在代理编程测试Terminal-Bench 4.0中差距更为明显,Grok 4.7仅26%,远低于GPT-6 Astra的60%和Claude Fable 5.1的55%,甚至不敌更便宜的DeepSeek V4.1 Flash。这表明xAI以低价策略切入市场,但在核心能力上仍与领先模型存在显著差距。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅