一项由Aleph Alpha开展的研究显示,中国AI模型在涉及天安门、台湾、新疆等967个政治敏感话题时,仅有17%至41%的回答被评定为平衡,其余大多重复官方立场、回避或拒绝作答。DeepSeek V4 Pro对三分之二的敏感问题直接拒答,而西方对比模型Claude Sonnet 5和Mistral Small的平衡回答率分别达70%和92%。研究还发现,亲华倾向会外溢至非政治性问题,Qwen 3.6在回答美国审查制度时仍以维护中国互联网治理立场收尾。此外,英伟达Nemotron Cascade 2因训练数据中约3500条由DeepSeek和Qwen生成,也在17%的回答中表现出官方口径。该研究与中国要求公开模型体现"社会主义核心价值观"的监管规定相吻合,并与欧洲亚洲研究所此前的审计结果一致。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅