Liquid AI、LFM2.5向けの投機的デコード用ドラフトモデル「DSpark」を公開

Liquid AIが2026年8月20日、LFM2.5ファミリー3モデル向けのDSparkドラフトモデルを公開。約3億パラメータの小型モデルを添えることで、H100で最大3.18倍、端末上で最大2.87倍のスループット向上を自社計測として示した。貪欲デコードでは出力が元のモデルと同一になる。

Liquid AIが2026年8月20日、LFM2.5ファミリーの3モデル(LFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1B)向けに DSpark ドラフトモデルのチェックポイントを公開した1。投機的デコードの下書き役を担う各約3億パラメータの小型モデルで、わずかなメモリ増と引き換えにデコードを速くし、出力の品質は変えない、というのが同社の説明だ1。示された数値は、GPUで最大3.18倍、端末上で最大2.87倍のスループット向上、LFM2.5-2.6B では関数呼び出しのレイテンシが**平均57%**縮んだというもの1

投機的デコードは、軽いドラフトモデルに候補トークンを出させ、本体のモデルが1回の前方計算でまとめて検証する仕組みで、重みの読み出しコストを複数トークンで分け合う1貪欲デコードでは本体が全トークンを検証するため、出力は本体だけで生成した場合と同一になり、ベンチマークの正解率は変わらない1。速度の数値はいずれもLiquid AIの自社計測で、条件はM4 Max MacBook Pro+llama.cpp/Metal、H100 80GB+SGLang、ブロックサイズ9・バッチ1・temperature 0、5つのベンチマークとされている1。llama.cpp と SGLang には初日から対応するが、それぞれ対応ビルドが必要になる1。同社は8月12日にも画面やUIの理解を改善したVLM「LFM2.5-VL-3B」を公開している2

Sources

  1. Up to 3.2x Faster Inference with LFM2.5-DSpark - Liquid AI公式ブログ(Hugging Face、2026年8月20日)
  2. LFM2.5-VL-3B for Better and Faster Vision Capabilities for the Edge - Liquid AI公式ブログ(Hugging Face、2026年8月12日)

最新のAIニュースを毎日お届けしています。

RSSで購読する 更新をいち早くチェックできます。

他のキーワードで探す →