7名来自北京中关村学院、背景横跨人工智能、网络、化学、生物和网安的博士生,用一个暑假从零训练出7B大模型ZGCM-1,并将训练数据、代码、权重、中间checkpoint和日志全部开源,供研究者追溯复现。该模型在多项通用评测中与Qwen3-8B等同等规模模型表现相近,部分数学推理和搜索任务上甚至可与更大规模模型比较。为应对大厂通常需数百人协作的工程规模,团队组建了数百个Agent分头处理数据、实验、日志与评测,实践“AI4AI”研发范式,并对11类研发任务进行自主性评级,发现实验监控和部署已达L4,而架构与算法设计仍停留在L2。训练中团队还遭遇loss下降但能力退步的问题,最终定位到数据分片与shuffle环节,并建立ACE原子能力评测体系加以诊断。这项工作为AI参与自身研发的真实能力边界提供了工程结论。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅