🔥 今日值得一读 阿里通义千问3年从70亿冲到2.4万亿参数,全版本历程一次看全!
The Story of Qwen: Alibaba’s AI Models From 7B to 2.4T
MarkTechPost 🔥 重点 大模型开源商业化 🕐 今天 12:10

📖 AI 总结

阿里巴巴于2023年4月推出通义千问,同年8月开源Qwen-7B与Qwen-7B-Chat,直接对标Meta的Llama 2,该模型基于超2.2万亿token预训练,上下文长度为2048,并允许月活低于1亿的商业免费使用。随后Qwen-VL视觉语言模型于8月底发布,9月通义千问向公众开放,12月又推出72B和1.8B模型,形成从笔记本级到前沿级的开源权重矩阵。2024年成为Qwen的开源爆发期,团队在8个月内连发三代模型:2月的Qwen1.5覆盖0.5B至72B稠密模型,统一支持32K上下文,并推出14B MoE及首个超100B的110B稠密模型;6月发布Qwen2。这一系列迭代使Qwen迅速成为开发者默认选择,并最终演进至2.4万亿参数规模,标志着阿里在大模型开源领域从追随者成长为重要引领者。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅