Liquid AIは、24, 2026に、ビジョン・ランゲージモデルの試験的バージョンであるLFM2.5-VL-3B-DSparkをリリースしました。このモデルは、投機的デコーディング技術である「DSpark」を既存のLFM2.5-VL-`3Bに適用することで、出力品質を損なうことなく、大幅に高速な推論速度を実現しています。
モデル発表Liquid AILFM2.5-VL-3B-DSpark
Liquid AIがLFM2.5-VL-3B-DSparkをリリース、ビジョン・ランゲージモデルの推論を加速
この記事は翻訳です。 原文を読む
投機的デコーディングは、軽量な「ドラフトモデル」を使用して出力トークンを事前に予測し、それをより大規模なメインモデルが検証するという仕組みで動作します。今回の実装では、ドラフトモデルは約280百万パラメータで構成されており、総パラメータ数は8.9%増加し、より多くのメモリを必要としますが、パフォーマンスの向上は極めて大きなものとなります。
M5 Max MacBook Proなどのエッジデバイスでは、エンドツーエンドのスループットが最大2.62x向上し、デコーディング速度が最大3.13x向上しました。NVIDIA H100 GPUでは、エンドツーエンドのスループットが最大2.27x改善し、デコーディング速度は最大2.66x向上しました。
このビジョン特化型のドラフトモデルは、Liquid AIのテキストベースの基盤モデルに使用されているものと同じアルゴリズムを適用して開発されました。ドラフトモデルは生の入力モダリティではなく多次元テンソル上で動作するため、このアルゴリズムはテキストと画像ベースの両方のワークロードに適用可能です。
LFM2.5-VL-3B-DSparkは、オープンモデルとしてHugging FaceにてSafetensorsおよびGGUF形式で公開されています。すでにllama.cpp、MLX-VLM、SGLangを含む推論エコシステムでサポートされています。
出典
- 軽量な視覚言語モデル「LFM2.5-VL-3B」にDSparkのドラフトモデルを適用して爆速化した「LFM2.5-VL-3B-DSpark」が登場 (GIGAZINE, 2026-09-25)
- Liquid AI Blog