🔥 今日值得一读 Qwen3.8-Omni-Flash杀疯了!音视频能力追平Gemini,API价格却低到离谱
Qwen3.8-Omni-Flash undercuts Google's Gemini Flash pricing while matching its multimodal benchmarks
The Decoder 🔥 重点 多模态Agent大模型商业化 🕐 09-19 22:30

📖 AI 总结

阿里巴巴旗下Qwen发布首款面向AI智能体的多模态模型Qwen3.8-Omni-Flash,可同时处理音频与视频,自主调用工具完成视频剪辑、短视频翻译和影片摘要等任务,上下文窗口达100万token。官方称其在音视频任务上的表现接近谷歌Gemini 3.8 Flash。定价方面,该模型每百万输入token收费0.15美元、输出0.47美元,音频输入每小时不足0.01美元,720p带音频视频约0.20美元;相比之下,Gemini 3.8 Flash输入、输出分别为0.75美元和3.75美元,且优惠价将于2027年1月1日翻倍。模型已通过Qwen Studio、Qwen Cloud及API开放,配套开源插件与实时交互工具进一步扩展了智能体能力。此举意味着多模态智能体能力的成本门槛显著降低,可能加剧该领域的价格竞争。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅