🔥 今日值得一读 DeepSeek多模态上线!我用它做了《牛来》小游戏,能力直逼Opus 4.8!
DeepSeek 上线多模态,我用它做了《牛来》小游戏|AI 上新
极客公园 🔥 重点 多模态大模型API 🕐 08-24 15:14

📖 AI 总结

DeepSeek于8月21日上线多模态视觉理解模型V4-Flash-Vision-Exp,补齐了此前缺失的视觉能力。该模型定价与V4-Flash一致,单张图片仅消耗384个token,远低于GPT和Claude的800-1100个token,且纯文本能力未降级,多模态Agent能力接近Opus-4.8。极客公园实测中,模型能识别《牛来》电影截图并生成卡通重制版,还能根据截图直接编写可交互的跑酷小游戏,以及将设计稿转化为完整HTML页面,整个过程仅需26-36秒。测试也暴露了thinking模式会消耗全部输出预算的问题,需关闭该模式才能正常输出。文章认为,视觉理解与代码生成能力的叠加,使AI在浏览器操作、前端开发等Agent场景中具备了实际生产力价值。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅