Google 在停更七个半月后正式发布 Gemini 4 Argon,这是近期少见的写作与知识能力明显强于编程和 Agent 能力的前沿模型。官方公布的 18 项测试中它拿下 13 项领先,在金融分析、法律工作等知识任务上大幅超越对手,长上下文能力同样领先逾 10%,输出上限从 6.4 万 token 提升至 100 万 token,幻觉率降至 15%,为前沿模型最低。但编程表现分化明显:长周期软件构建测试领先,从零构建项目和终端操作却垫底,Arena.ai 文本评测排名第一、工程类仅列第八。API 定价为输入每百万 token 两美元、输出十美元,约为同级对手的五分之一。文章认为,在众多模型因过度优化编程而丧失文字审美的当下,一个保留写作优势的 Gemini 反而具有独特价值。
谷歌发布新一代AI大模型Gemini 4 Argon,在推理、多模态和长上下文处理能力上实现全面代际跃升,引发行业高度关注。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅