🔥 今日值得一读 阿里Qwen新模型仅8步出图,去噪步骤直降5倍!
Alibaba Qwen Releases Qwen-Image-2.1-Turbo, an 8-Step 7B Image Model
MarkTechPost 🔥 重点 多模态开源论文方法 🕐 今天 04:33

📖 AI 总结

阿里巴巴Qwen团队发布了Qwen-Image-2.1-Turbo,这是其开源权重模型Qwen-Image-2.1的加速版本。该模型在保持7B视觉生成架构不变的前提下,将去噪步数从基础版的40步压缩至8步,实现5倍加速,同时保留2K分辨率图像生成与编辑能力。模型搭配Qwen3-VL 8B文本编码器,采用单流DiT架构与块因果注意力机制,通过前缀KV缓存复用文本和参考图像上下文,并支持原生透明通道。基础版Qwen-Image-2.1在Qwen-Image-Bench上得分60.28,为Qwen报告的开源权重最高分。该模型可通过Diffusers加载,支持CUDA GPU的BF16推理,并提供托管API。需注意其仅限研究许可,商业自托管需另行授权。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅