Mistral AI 发布其迄今最强开源大模型 Mistral Large 4,采用混合专家架构,总参数达 1 万亿,但每次推理仅激活 490 亿参数,兼顾性能与硬件效率,支持超过 160 种语言。该模型在 AA Cyber Index 网络安全基准中跻身前五,修补开源项目漏洞的得分达 82%,领先同类开源模型;在图像目标识别基准 Dense200 上以 1% 优势超过 GPT-6 Astra。不过在主流编程基准上仍落后于前沿闭源模型,但优于 Qwen3.8 Max 和 DeepSeek V4 Pro,并在知识工作类基准中表现更佳。模型基于 3800 块 Grace Blackwell 芯片训练,配套软件栈可并行运行数万次 rollout,日产 330 亿 token。此次发布显示开源模型正加速缩小与闭源前沿模型的差距。
法国AI公司Mistral发布旗舰模型Mistral Large 4,以超1T参数规模对标中美头部大模型,引发行业对欧洲AI竞争力的关注。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅