🔥 今日值得一读 视觉语言模型解码提速3.13倍!Liquid AI发布2.8亿参数草稿模型
Liquid AI Releases LFM2.5-VL-3B-DSpark: Speculative Decoding for Vision-Language Models With Up to 3.13x Faster Decoding
MarkTechPost 🔥 重点 多模态推理加速开源 🕐 今天 07:11

📖 AI 总结

Liquid AI 发布了 LFM2.5-VL-3B-DSpark,这是为其 LFM2.5-VL-3B 视觉语言模型设计的实验性推测解码草稿模型。该草稿模型仅增加约 2.8 亿参数,在不改变模型输出的前提下显著提升解码速度,在苹果芯片上最高提速 3.13 倍,在 NVIDIA H100 上最高提速 2.66 倍。其核心思路是让小型草稿模型读取目标模型多层隐藏状态并预测后续多个 token,再由目标模型一次性验证整块 token。由于文本和图像 patch 在隐藏层中均为张量,该算法可直接复用于视觉语言模型。草稿模型为简化版纯注意力结构,采用 4 层、块大小 9 的配置,嵌入与 LM 头与目标模型共享。权重已在 Hugging Face 上线,并获 SGLang、MLX-VLM 和 llama.cpp 首日支持,采用 LFM 开放许可证,年收入低于 1000 万美元的企业可免费商用。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅