Multimodal2026-09-30
Hugging Face Blog
Liquid AI、視覚言語モデル高速化「LFM2.5-VL-DSpark」発表
Liquid AIは、視覚言語モデル(VLM)を高速化する新しいアプローチ「LFM2.5-VL-DSpark」を発表しました。画像とテキストをまとめて処理するマルチモーダル推論の性能を高めつつ、その計算コストを抑えることを狙ったモデルです。
ポイントは、視覚と言語をつなぐパイプラインの最適化です。これにより、オンデバイス、エッジ、そして大量のリクエストを処理する高スループットな用途でも、マルチモーダルAIをより現実的に使いやすくできる可能性があります。
背景にあるのは、巨大なクラウド推論だけに頼らず、より小さく効率的なモデルで実世界のタスクをこなそうという業界全体の流れです。今回のリリースは、Hugging Faceが広げているオープンで利用しやすいマルチモーダル研究のエコシステムの一部でもあり、画像を理解するアシスタントや分析ツールを作りたい開発者にとって、新たな選択肢が増えたことになります。