微软发布了一份针对其自研MAI模型的AI行为准则,明确将人类控制置于首位,并划定了模型的行为边界。该准则规定,模型必须接受授权人员的打断、纠正和关停,不得自行扩大工作范围或隐瞒行为,其推理过程也必须以人类可理解的方式呈现,禁止使用无法解读的“神经语”等内部通信形式。微软表示,为保障安全,愿意牺牲模型的通用性、自主性或性能。此举是对Anthropic CEO呼吁放缓AI开发节奏的响应,微软CEO纳德拉及多家公司高管均表示支持,微软还愿意接受外部审计。该准则目前不用于训练模型,经六周公众咨询后将于2026年底修订,2027年起指导模型开发,且仅适用于微软自研模型,不自动覆盖第三方模型。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅