🔥 今日值得一读 三年实测:大模型创造力正在惊人趋同!
Are LLMs becoming similarly creative? Evidence from three years of models
arXiv CL (cs.CL) 🔥 重点 #创造力#评测#大语言模型 🕐 08-21 12:00
👨‍💼 主理人解读 · 为什么值得关注
追踪三年LLM在开放式创意任务上的表现,分析模型创造力的演变趋势与多样性变化。

📖 AI 总结

该研究对三年间发布的多代大型语言模型在开放式任务中的创造性表现进行了追踪分析,使用了真实用户查询数据集Infinity-Chat100和心理学经典创造力测试“替代用途任务”作为评估材料。通过句子嵌入相似度衡量模型输出的多样性,结果显示模型输出在创造性内容上随时间呈现统计显著的趋同趋势,即不同模型生成的创意文本越来越相似。研究者指出,若这一趋势持续,LLM驱动的同质化可能逐步削弱人类在人与AI协作创作中的自主性与独特贡献,因此需要审慎考量LLM在人类创意过程中的角色定位。该研究为理解LLM在开放式、无标准答案任务上的能力演变提供了初步实证依据。

🔑 关键词速览

Large Language Model (LLM)大型语言模型,一种基于深度学习的人工智能模型,能够理解和生成自然语言文本。
Infinity-Chat100一个真实世界的开放式用户查询数据集,用于评估LLM在多样化、无固定答案任务上的表现。
Alternate Uses Task替代用途任务,一种经典的心理测量学创造力测试,要求参与者为常见物品想出非传统用途。
sentence-embedding similarity句子嵌入相似性,一种通过将句子转换为向量并计算向量间距离来量化文本语义相似度的技术。
homogenization同质化,指LLM输出在内容上趋于一致的现象,可能导致创造性多样性的丧失。
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅