Multimodal2026-09-30Hugging Face Blog

Liquid AI 发布 LFM2.5-VL-DSpark,给视觉语言模型提速

Liquid AI 正式介绍了 LFM2.5-VL-DSpark,一个面向视觉语言模型加速的新方案。 按照官方说法,这个模型的目标是「双管齐下」:既要提升多模态任务的整体表现,又要降低把图像和文本放在一起处理时产生的计算成本。做法上,它针对视觉语言这条完整链路做了优化。 如果这套优化在实际使用中奏效,意味着多模态 AI 会变得更好用——尤其是对端侧设备、边缘计算以及需要高吞吐量的应用场景来说。这些场景过去往往受限于算力,难以顺畅跑起多模态模型。 从更大的视角看,LFM2.5-VL-DSpark 的出现也反映了一个正在成型的行业趋势:模型正朝着更小、更高效的方向演进,不必事事依赖体量庞大的云端推理,也能完成真实世界的任务。 另外,这次发布也属于 Hugging Face 持续扩张的开源多模态研究生态的一部分。对开发者而言,等于又多了一个可选的工具,用来搭建能看懂图像的助手和各类分析工具。

相关资讯