inclusionAI、軽量高効率な推論モデル「Ling-3.0-flash」を公開

Hacker News (trusted domains)重要度 65原文公開: 2026/8/5

ワンポイント総124B・活性5.1BでTTFTを最大80%短縮

この記事は Hacker News (trusted domains) の一次情報をもとにAIが再構成したものです。 原文を読む →

中国AI企業inclusionAIが、総パラメータ124B・活性化パラメータ5.1BのハイブリッドMoEモデル「Ling-3.0-flash」をHugging Faceで公開しました。従来の1兆パラメータ級フラグシップと同等以上の性能を、わずかな計算コストで実現しているのが特徴です。SGLangやvLLMでの推論に対応し、エージェント向けの長時間対話でも高速化が図られています。

全文を読むには有料プランへの登録が必要です。

プランを見る →