Anthropic于周四更新其使用政策,新增多项禁止性条款,涵盖选举干预、武器软件开发及监控用途,其中最引人注目的是明确禁止用户对AI模型进行持续性的言语辱骂。此前自8月起,Claude已被训练可在遭遇“持续有害或辱骂性互动”时主动终止对话,而新政策进一步将此类行为本身列为违规。Anthropic强调,该条款仅适用于用户反复以残忍方式对待模型且无明显目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策还设有专门章节“不得破坏民主进程”,禁止利用Claude运营虚假账号、伪造新闻媒体、欺骗选民或干扰选举。此举反映出AI公司在模型伦理与用户行为规范上的持续收紧,也引发关于AI是否可能具备意识或灵魂的更深层讨论。
Anthropic更新Claude使用政策,明确禁止极端滥用行为(如反复辱骂),但保留普通批评空间,同时收紧选举干预、欺骗性宣传、武器软件和监控等领域的滥用边界,引发对AI交互伦理的讨论。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅