Modular 26.2リリース、MAXが画像生成に対応しMojoはfnキーワードを廃止
Modularの最新リリース26.2では、推論エンジンMAXにFLUXモデルによる画像生成機能と新エンドポイント/v1/responsesが追加され、DeepSeek系モデルの性能改善やKimi・Qwen3-MoEの新規サポートも実現しました。またMojo言語では長年使われてきたfnキーワードが廃止され、defへの統合や__init__の統一など大きな文法変更が加えられています。
まとめサイトの記事や機械翻訳ではなく、一次情報だけを追っています。興味のあるトピックだけ選んで読めます。
トピック: ai-llm解除
Modularの最新リリース26.2では、推論エンジンMAXにFLUXモデルによる画像生成機能と新エンドポイント/v1/responsesが追加され、DeepSeek系モデルの性能改善やKimi・Qwen3-MoEの新規サポートも実現しました。またMojo言語では長年使われてきたfnキーワードが廃止され、defへの統合や__init__の統一など大きな文法変更が加えられています。
Vercelは、ベクトルDBやembeddingを使わず、ファイルシステム操作だけで動く知識エージェントの構築手法をブログで紹介し、実装済みのオープンソーステンプレート「Knowledge Agent Template」を公開しました。社内の営業通話要約エージェントではコストが1回あたり約1.00ドルから約0.25ドルに下がり、回答精度も向上したといいます。
OpenAIはGPT-5.4シリーズの小型・高速モデルとして「GPT-5.4 mini」と「GPT-5.4 nano」を発表しました。コーディングやツール利用、マルチモーダル推論、大量のAPI・サブエージェント処理向けに最適化されています。上位モデルであるGPT-5.4の能力をベースに、規模を落として速度とコストを重視した構成になっている点が特徴です。
Next.jsチームが16.2をリリースし、AIエージェントによる開発支援を意識した4つの改善を発表しました。ブラウザ操作の連携強化やAGENTS.mdの標準搭載、エラー通知の改善、開発サーバーの二重起動防止などが含まれます。詳細はNext.js公式ブログで公開されています。
OpenAIは、社内で実際に使用しているコーディングエージェントを対象に、思考の過程(chain-of-thought)を監視することでミスアライメント(意図しない挙動)のリスクを検知する取り組みを紹介しています。実運用環境でのエージェント挙動を分析し、AIの安全対策を強化する狙いがあります。
OpenAIは、AIモデルの振る舞いを規定する公開フレームワーク「Model Spec」について、その考え方を紹介する記事を公開しました。安全性・ユーザーの自由・説明責任のバランスをどう取るかが焦点です。

Google DeepMindは新しい音声モデル「Gemini 3.1 Flash Live」を発表しました。従来モデルより精度が向上し、レイテンシが低減されたことで、より自然で滑らかな音声対話が可能になります。
OpenAIは、AIの悪用や安全性リスクを発見するための新プログラム「Safety Bug Bounty」を発表しました。エージェント型AIの脆弱性やプロンプトインジェクション、データ流出といったリスクを対象としています。詳細な報奨内容などは今後の情報開示が待たれます。
Vercelは、AI Gateway経由のコストやトークン使用量、リクエスト数をプログラムから一元的に取得できる「Custom Reporting API」をベータ公開しました。BYOK(顧客が持ち込むAPIキー)によるリクエストも含めて集計でき、モデル・プロバイダー・ユーザーID・カスタムタグ単位での内訳把握が可能になります。ある企業はこのAPIの活用でサードパーティ製プロキシを廃止し、80,000ドル超のコスト削減を実現しました。
IBMはHugging Face Blogにて、Granite 4.0シリーズの新モデル「Granite 4.0 3B Vision」を紹介しました。企業文書の処理を想定したコンパクトなマルチモーダルモデルと位置づけられています。ただし公開された原文には具体的な仕様や性能に関する詳細情報が含まれていません。
Google DeepMindが、マウスポインタを文脈を理解するAIパートナーへと再構築する取り組みを明らかにしました。従来のプロンプト入力にありがちな手間を減らし、Chromeをはじめとする環境で直感的なAI連携を目指す構想です。
Hugging FaceがTRL(Transformer Reinforcement Learning)ライブラリのメジャーバージョンとなる**v1.0**を発表しました。ブログのタイトルどおり「分野の進化とともに動くポストトレーニングライブラリ」という位置付けが示されていますが、今回参照した原文には具体的な変更点や機能の記述が含まれていませんでした。
Vercelは社内トークをもとに、コーディングエージェントが生成するコードの危険性と、それに対する組織的な備えを公開しました。テストが通ることと本番で安全であることは別問題であり、エージェントを「頼る」のではなく「活用する」姿勢と、それを支えるインフラの仕組みが必要だと説いています。
Vercelは開発ツール「Turborepo」のタスクグラフ計算を81〜91%高速化し、リポジトリ規模によっては最大96%の改善を実現しました。AIコーディングエージェント、Vercel Sandboxes、そして地道なエンジニアリングを組み合わせた8日間の最適化プロセスをVercel Blogが公開しています。
OpenAIは新たに122億ドル、日本円で換算すると約1220億ドル規模の資金調達を実施したと発表しました。調達資金はフロンティアAIの世界展開、次世代コンピュート基盤への投資、そしてChatGPT・Codex・エンタープライズAIの需要拡大への対応に充てられます。

Hugging Faceのブログに、AWS上で基盤モデルの学習と推論を行うための構成要素(ビルディングブロック)を紹介する記事が掲載されました。タイトルからは、AWSとHugging Faceの連携によって基盤モデル開発を支える具体的な技術要素が取り上げられていることがわかります。詳細な内容については原文の本文情報が確認できませんでした。
Vercelは、Nuxtアプリケーション内で直接Model Context Protocol(MCP)サーバーを構築できる新モジュール「Nuxt MCP Toolkit」を発表しました。Zodによるツール定義やリソース公開、デバッグ用インスペクターなどを備え、AI機能を組み込むNuxt開発者の実装コストを下げます。
Vercel AI GatewayでGoogleの新しいオープンモデル「Gemma 4」の26B(MoE)版と31B(Dense)版が利用可能になりました。Gemini 3と同じアーキテクチャを採用し、関数呼び出しやエージェント的なワークフロー、256Kコンテキスト、140以上の言語、ネイティブなビジョン対応など高機能を備えています。AI SDK経由でモデルIDを指定するだけで、リトライやフェイルオーバーを含むAI Gatewayの機能をそのまま利用できます。
Hugging Face Blogにて、Googleの新モデル「Gemma 4」の登場を伝える記事が公開されました。タイトルからは、デバイス上で動作するフロンティア級のマルチモーダル知能であることが示されていますが、本記事執筆時点では詳細な仕様や機能に関する原文本文が確認できませんでした。

Google DeepMindがオープンモデルファミリーの最新版「Gemma 4」を発表しました。同社の説明によれば、これまでで最も高性能なオープンモデルであり、高度な推論とエージェント型ワークフローのために設計されているとのことです。