这篇论文提出“有限主权”概念,探讨当部署方不拥有模型时AI监管的定价问题。作者指出,许多AI控制协议假设部署方能完全掌控模型及管线,但通过API或托管端点使用前沿模型的受监管机构往往只控制业务流程,无法触及模型权重、基础设施、内部追踪和完整交互日志。论文构建了四层访问类型学、协议逐层需求矩阵,并提出“主权折扣成本”概念——即因访问权限缺失而通过合同、架构、审计、供应商保证等方式替代所产生的控制税部分。基于135万次合成案例模拟的消融实验显示,完整日志改善诊断能力,执行前网关支持干预,追踪访问和模型版本控制强化事后解释,而范围限制可提升安全性但降低实用性。作者强调,通用安全协议应明确说明其访问前提假设。
| bounded sovereignty | 有限主权:指部署者对AI系统各层仅拥有部分技术和合同访问权,而非完全控制。 |
| control tax | 控制税:为实施安全控制而付出的成本,包括替代缺失访问所需的额外资源。 |
| sovereignty discount cost | 主权折扣成本:控制税中用于弥补因访问受限而缺失能力的那部分成本。 |
| access-ablation experiment | 访问消融实验:通过移除或改变访问条件来测试其对控制协议效果影响的实验。 |
| construct-validity exercise | 构念效度检验:验证理论概念或测量工具是否有效反映其预期构念的练习。 |
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅