inclusionAI、軽量高効率な推論モデル「Ling-3.0-flash」を公開
ワンポイント総124B・活性5.1BでTTFTを最大80%短縮
この記事は Hacker News (trusted domains) の一次情報をもとにAIが再構成したものです。 原文を読む →
中国AI企業inclusionAIが、総パラメータ124B・活性化パラメータ5.1BのハイブリッドMoEモデル「Ling-3.0-flash」をHugging Faceで公開しました。従来の1兆パラメータ級フラグシップと同等以上の性能を、わずかな計算コストで実現しているのが特徴です。SGLangやvLLMでの推論に対応し、エージェント向けの長時間対話でも高速化が図られています。
全文を読むには有料プランへの登録が必要です。
プランを見る →