🔥 今日值得一读 开源模型也能搞安全研究!apex-flash-1 一口气解决60个漏洞任务中的40个
Can an Open Model Do Security Research? Cantina’s apex-flash-1 Solves 40 of 60 Held-Out Bug Tasks
MarkTechPost 🔥 重点 开源安全对齐大模型 🕐 今天 09:47

📖 AI 总结

Cantina与Yeta Labs联合发布开源权重模型apex-flash-1,专为漏洞研究设计,基于Z.ai的GLM-5.3-Flash进行强化学习微调,采用MIT许可证发布。该模型总参数321.3B,激活参数18B,训练数据涵盖50个真实漏洞案例衍生的150项任务,其中授权、身份与范围类缺陷占比72%。在20个留出漏洞案例的60项任务评测中,apex-flash-1解决40项,通过率66.7%,单次运行成本约2.38美元;基础模型解决36项,成本4.56美元;Claude Opus 5 High解决43项,但成本高达74.68美元,约为前者的31倍。按单任务解决成本计算,apex-flash-1约为0.06美元,远低于Opus的1.74美元。Cantina将其定位为由更大模型编排的执行型模型,目标技能包括代码阅读、工具调用、漏洞利用开发与验证。上述数据均为公司自报的内部基准结果。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅