Multimodal2026-09-30
Hugging Face Blog
Liquid AI 推 LFM2.5-VL-DSpark 加速視覺語言模型
Liquid AI 端出 LFM2.5-VL-DSpark,這是一套用來加速視覺語言模型的新作法。官方定位很明確:在提升多模態表現的同時,把「圖加文一起處理」所需的運算成本壓下來。
視覺語言模型的痛點,在於同時要消化影像與文字兩種訊號,推論開銷往往比純文字模型高出一截。LFM2.5-VL-DSpark 的做法是優化整體視覺語言流程,讓多模態 AI 更有機會真正落地到裝置端、邊緣環境,以及需要高吞吐量的應用情境。
這樣的發表也呼應了近期的產業走向:模型越做越小、越做越有效率,不再什麼事都往雲端的大型推論資源丟。對開發者來說,LFM2.5-VL-DSpark 也是 Hugging Face 持續擴張的開放多模態研究生態中的新選項,可用來打造看得懂影像的助理與分析工具。