Liquid AI、LFM2.5向けDSparkドラフトで最大3.18倍高速化

Liquid AIは、LFM2.5ファミリーの3モデル向けにDSparkのドラフトモデル(DSpark draft model checkpoints)を公開しました。
対象はLFM2.5-1.2B-Instruct、LFM2.5-2.6B、LFM2.5-8B-A1Bで、いずれも既存のターゲットモデルに対して推論を加速するドラフト経路を追加します。
約300Mパラメータのドラフトが9トークンの候補ブロックを提案し、ターゲットモデルは1回のフォワードパスでそのブロック全体を検証します。
出力は変化せず、greedy decodingではターゲット単体と同一の系列が生成されるため、ベンチマーク精度は維持されるとしています。
速度面では、H100で最大3.18倍、M4 MaxのMacBook Proで最大2.87倍のデコード高速化が報告されています。
また、llama.cppとSGLangはいずれもday-oneでDSpark対応しており、自己ホストすれば導入可能です。
ただし、受け入れ率に速度が左右され、ワークロードにより1.04倍から3.18倍まで変動すると説明しています。
特にLFM2.5-8B-A1Bは、M4 Max平均で1.18倍にとどまる弱点も示されました。
さらに、ツール呼び出しを伴うエージェントの多段推論では、LFM2.5-2.6Bで平均57%のレイテンシ削減効果があるとしています。

参照元:2026/08/21 「Liquid AI Releases LFM2.5-DSpark Draft Models That Deliver Up to 3.18x Faster Decoding Without Changing Model Outputs」 https://www.marktechpost.com/2026/08/20/liquid-ai-releases-lfm2-5-dspark-draft-models-that-deliver-up-to-3-18x-faster-decoding/

この記事へのリアクション

このニュースをどう受け止めましたか?

Reader Reaction

このニュース、みなさんはどう感じましたか?ぜひコメント欄であなたの声を聞かせてください。

※本記事に掲載している情報は公開時点のものです。最新情報は公式発表等をご確認ください。

ぜひコメントを添えてシェアお願いします。
  • URLをコピーしました!
  • URLをコピーしました!

アンケート

悩み相談をするなら、どちらに打ち明けたいですか?

回答者数:2人 投票期間:2026/04/16〜2026/08/24
回答はお一人様1回までです。


PR:実務直結の稼げるAIスキルを学べる

DMM 生成AI CAMP

AIを使いこなす側か、使われる側か。今がキャリアの分岐点。

全コース学び放題
入会金・教材費0円
最低契約期間なし・いつでも解約OK

受講生同士が繋がれるコミュニティ

Google検索で 3min AI を優先表示できます

Google検索の「優先ソース」に追加すると、通信ニュースを検索した際に、3min AIの記事が見つけやすくなります。

※Googleの設定画面が開きます。表示されたサイトにチェックを入れると、優先ソースとして設定できます。

Google検索の優先ソースに追加する

コメント

コメントする

CAPTCHA


日本語が含まれない投稿は無視されますのでご注意ください。(スパム対策)

目次