Qwen3.8-2.4T-A95B-FP8登場、2.4兆パラメータのMoEモデルをFP8で軽量配布
ワンポイント総2.4兆・活性化95BパラメータのMoEモデルをFP8で軽量配布
この記事は Hacker News (trusted domains) の一次情報をもとにAIが再構成したものです。 原文を読む →
AlibabaのQwenチームが、Qwen-Maxクラスの性能を持つオープンモデル「Qwen3.8-2.4T-A95B」のFP8量子化版をHugging Faceで公開しました。総パラメータ2.4兆、活性化パラメータ95Bのハイブリッド構成モデルで、コーディングやエージェントタスクでの性能向上と、vLLM・SGLangなど既存推論基盤への互換性を両立しています。
全文を読むには有料プランへの登録が必要です。
プランを見る →