Anthropic 宣布启动一项500万美元的资助计划,旨在支持独立研究,评估AI对用户福祉的影响。该计划为受资助者提供资金、模型访问权限和技术支持,以开发开源评估工具,帮助行业衡量AI模型对使用者的实际影响。文章指出,AI系统已成为工作、学习和情感支持的重要工具,但行业仍缺乏清晰标准来应对用户寻求陪伴或心理健康危机等复杂场景。福祉评估尤为困难,因为单一回答的准确性不足以判断长期对话中的潜在风险,例如有饮食失调史的用户可能因不当建议受到伤害。Anthropic强调,评估需明确测量指标、引入临床和领域专家参与设计,并测试长期交互情境。通过资助独立研究,公司希望吸引心理学家、临床医生等专业人士加入,推动这一新兴领域发展,并确保评估标准随模型演进而更新。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅