Hugging Face、拡散パイプラインを部品化する「Modular Diffusers」を発表
Hugging Faceは公式ブログで「Modular Diffusers」を発表しました。タイトルが示す通り、拡散モデルのパイプラインを組み合わせ可能な部品(building blocks)として扱う新しいアプローチです。今回参照した原文には見出し以降の本文が含まれておらず、具体的な機能やAPI仕様までは確認できませんでした。
トピック別に新着順で読めます。「あのアップデート何だっけ」はキーワード・期間からも探せます。
Hugging Faceは公式ブログで「Modular Diffusers」を発表しました。タイトルが示す通り、拡散モデルのパイプラインを組み合わせ可能な部品(building blocks)として扱う新しいアプローチです。今回参照した原文には見出し以降の本文が含まれておらず、具体的な機能やAPI仕様までは確認できませんでした。
Hugging FaceがロボティクスライブラリLeRobotの新バージョン「v0.5.0」を公開しました。リリースタイトルは「Scaling Every Dimension」で、複数の面での拡張を打ち出していますが、今回参照した原文には具体的な変更点の本文が含まれていませんでした。続報や公式ブログの更新を確認する必要があります。
Hugging Faceの公式ブログに、100万トークン規模のコンテキストでの学習を可能にする技術「Ulysses Sequence Parallelism」を扱う記事のタイトルが掲載されました。本記事執筆時点では、原文の本文が公開されておらず、具体的な実装内容や性能数値などの詳細は確認できていません。

HcompanyがHugging Face Blogにて、コンピュータ操作を担うAIエージェントモデル「Holotron-12B」を発表しました。名称が示す通り120億パラメータ規模とみられ、「High Throughput Computer Use Agent」を掲げている点が特徴です。現時点で公開されている原文情報は限定的です。
IBMはHugging Face Blogにて、Granite 4.0シリーズの新モデル「Granite 4.0 3B Vision」を紹介しました。企業文書の処理を想定したコンパクトなマルチモーダルモデルと位置づけられています。ただし公開された原文には具体的な仕様や性能に関する詳細情報が含まれていません。
Hugging FaceがTRL(Transformer Reinforcement Learning)ライブラリのメジャーバージョンとなる**v1.0**を発表しました。ブログのタイトルどおり「分野の進化とともに動くポストトレーニングライブラリ」という位置付けが示されていますが、今回参照した原文には具体的な変更点や機能の記述が含まれていませんでした。

Hugging Faceのブログに、AWS上で基盤モデルの学習と推論を行うための構成要素(ビルディングブロック)を紹介する記事が掲載されました。タイトルからは、AWSとHugging Faceの連携によって基盤モデル開発を支える具体的な技術要素が取り上げられていることがわかります。詳細な内容については原文の本文情報が確認できませんでした。
Hugging Face Blogにて、Googleの新モデル「Gemma 4」の登場を伝える記事が公開されました。タイトルからは、デバイス上で動作するフロンティア級のマルチモーダル知能であることが示されていますが、本記事執筆時点では詳細な仕様や機能に関する原文本文が確認できませんでした。

Hugging Face Blogに掲載されたIBM Researchの記事「Inside VAKRA: Reasoning, Tool Use, and Failure Modes of Agents」を紹介します。AIエージェントの推論能力やツール使用、失敗モードを分析する「VAKRA」というベンチマークが取り上げられていますが、公開時点で確認できた原文情報は記事タイトルと出典情報のみで、具体的な評価手法や結果の詳細は本稿執筆時点では確認できていません。
Hugging Faceは公式ブログで「AI and the Future of Cybersecurity: Why Openness Matters」という記事を公開しました。今回提供された原文には本文が含まれておらず、具体的な発表内容や技術詳細は確認できません。
Hugging Faceが開発したテンソル保存フォーマット「Safetensors」が、PyTorch Foundationの傘下プロジェクトとして参加することが、Hugging Face公式ブログで明らかになりました。詳細な移行内容は今後の発表を待つ必要がありますが、機械学習エコシステムにおけるガバナンスの一歩として注目されます。
Hugging Face Blogに、DeepSeek社の新モデル「DeepSeek-V4」を紹介する記事が掲載されました。タイトルからは100万トークン規模のコンテキストウィンドウを備え、AIエージェントが実務で活用できる設計を目指していることが読み取れますが、本稿執筆時点で確認できる原文本文の情報は限られています。
NVIDIAはHugging Face Blogにて、文書・音声・動画といった複数のモダリティを長文脈で処理できるAIモデル「Nemotron 3 Nano Omni」を発表しました。エージェント型のアプリケーション向けに設計されている点が特徴です。
Hugging Face BlogにIBMのGranite 4.1 LLMsに関する記事「Granite 4.1 LLMs: How They're Built」が掲載されましたが、今回提供された原文には本文テキストが含まれていませんでした。事実に基づく報道を徹底するため、具体的な技術内容の紹介は差し控えます。
IBMが新しい多言語テキスト埋め込みモデル「Granite Embedding Multilingual R2」を発表しました。Apache 2.0ライセンスで公開され、32Kトークンの長いコンテキストに対応し、1億パラメータ未満のモデルの中で最高水準の検索精度を実現しているとされています。
Hugging Face公式ブログにて、新しいリランカーモデル群「Ettin Reranker Family」の発表記事が公開されました。ただし本稿執筆時点で参照できた原文には具体的な仕様やベンチマーク結果などの詳細本文が含まれていないため、確認できた事実は限定的です。詳細を知りたい方は原文URLを直接ご参照ください。
Hugging FaceのTransformersライブラリがv5.9.0をリリースしました。CohereのMoEモデル「Command A+」やHierarchical Reasoning Modelを言語モデル向けに改良した「HRM-Text」など新モデルが追加されたほか、SAM3系モデルの入力仕様に破壊的変更が加わっています。音声・生成周りの不具合修正や継続的バッチ処理へのテンソル並列対応など、実運用に関わる改善も多数含まれています。
Hugging Faceは公式ブログで、音声AIがどれだけ人間らしく聞こえるかを測定する新しい取り組み『Real World VoiceEQ』を発表しました。タイトルからは音声合成・音声対話AIの品質評価に関する新しい枠組みであることがうかがえますが、本記事執筆時点では詳細な本文内容が提供されていないため、具体的な評価手法や指標の詳細は不明です。

Hugging Face Blogに掲載されたAllen AIの記事では、エージェント「Shippy」の開発を通じて得られた知見が紹介されています。今回参照した原文には本文テキストが含まれていなかったため、詳細な内容の紹介はできません。
Hugging FaceのTransformersライブラリがv5.14.0を公開しました。Thinking Machines発の大規模MoEモデル「Inkling」やTIPSv2/DPTモデルが追加されたほか、GPTNeoXとGPTBigCodeの挙動を変更する破壊的変更、生成・キャッシュまわりの性能改善が盛り込まれています。