
MiniMax M3がVercel AI Gatewayに追加、100万トークンのコンテキストとマルチモーダル対応を実現
VercelはAI GatewayでMiniMaxの新モデル「M3」の提供を開始しました。M3はMiniMax初となる100万トークン級のコンテキストウィンドウとネイティブなマルチモーダル入力を備え、ソフトウェアエンジニアリングやエージェント型タスクの性能を強化しています。AI Gateway経由で利用することで、統一APIによるコスト管理や信頼性向上の恩恵も受けられます。
トピック別に新着順で読めます。「あのアップデート何だっけ」はキーワード・期間からも探せます。

VercelはAI GatewayでMiniMaxの新モデル「M3」の提供を開始しました。M3はMiniMax初となる100万トークン級のコンテキストウィンドウとネイティブなマルチモーダル入力を備え、ソフトウェアエンジニアリングやエージェント型タスクの性能を強化しています。AI Gateway経由で利用することで、統一APIによるコスト管理や信頼性向上の恩恵も受けられます。
OpenAIは、外部機関によるAIモデルの評価を信頼できる形で行うためのガイダンスを公開しました。モデルの能力測定、安全対策の検証、評価結果の妥当性という3つの観点から、フロンティアシステムを評価する際の考え方を整理しています。

Vercelは公式ブログで、AI推論エンドポイントを狙う「推論窃取(inference theft)」の手口と、自社ドキュメント用AIチャットが実際に受けた攻撃の詳細を公開しました。1回のHTTPリクエストが数百分の1セントで済むのに対し、フロンティアモデルへの1プロンプトは数ドルかかるという極端なコスト差が、攻撃者にとって高収益な事業を成立させていると指摘しています。対策として、セッション単位ではなくリクエスト単位で検証を行うBotIDのdeep analysisが有効だったと紹介しています。
Model Context Protocol(MCP)の新バージョン仕様「2026-07-28」がリリース候補(RC)として公開されました。仕様はまだドラフト段階であり、最終版までの間に変更が入る可能性があります。クライアント・サーバー間のバージョン判定にはVersion Negotiationの仕組みを利用します。

VercelのChat SDKがReactに続きVueとSvelteの公式サポートを追加しました。AI SDK UIのメッセージストリームプロトコルを介して通信するため、サーバー側のルートはフレームワークをまたいで共通利用できます。各フレームワーク向けのuseChat相当のヘルパーは、Vue/Svelteではリアクティブなインスタンスを返す点がReactと異なります。
Hugging Faceのブログに、Direct Preference Optimization(DPO)をチャットボット向けの対話調整に限らず活用する可能性を論じた記事「Direct Preference Optimization Beyond Chatbots」が公開されました。今回は原文本文が公開情報として提供されていないため、タイトルと出典情報に基づいた紹介となります。

Redis Blogの記事「Context graphs: when nearest-neighbor search isn't enough」は、ベクトル検索を用いたRAG(検索拡張生成)パイプラインが単純な質問には強い一方、複数の情報源に分散した事実を組み合わせる必要がある質問では機能しなくなる問題を提起しています。解決策として「コンテキストグラフ」という考え方が示唆されていますが、本記事で確認できた範囲では、その課題提起が中心となっています。

NvidiaのMoE型推論モデル「Nemotron 3 Ultra」がVercel AI Gatewayに追加されました。100万トークンのコンテキストウィンドウを持ち、長時間稼働するエージェントワークフローの計画・ツール利用・サブエージェント委任・エラー復旧を得意とします。AI SDKからモデル名を指定するだけで、コスト最適化やフェイルオーバーなどGatewayの機能をそのまま利用できます。
OpenAIは米ミシガン州において、出力1ギガワット規模のデータセンター建設プロジェクトの起工式を行ったと発表しました。これは同社が推進するAIインフラ整備計画「Stargate」の一環で、AIへのアクセス拡大、雇用創出、地域社会への貢献を目的としています。

Vercelは画像から音声付き動画を生成するxAIの新モデル「Grok Imagine Video 1.5」をAI Gatewayに追加しました。音声品質やプロンプト追従性、写実性が向上し、AI SDKやAI Gateway Playgroundから利用できます。AI Gatewayは料金上乗せなしで複数プロバイダのモデルを統一APIから呼び出せる仕組みです。
GitHubの公式Blueskyアカウントが、エージェント型開発における新たなリリースを発表したことを予告する投稿を行いました。具体的な機能内容は本投稿では明かされておらず、開発者が「主導権を握ったまま」エージェントとの作業に集中できることを強調しています。

Elasticは、Microsoft Build 2026の参加者およびAzure開発者向けに、2026年の主要リリースをまとめたブログ記事を公開しました。Elastic Inference Serviceによるマルチモーダル検索、OpenTelemetryメトリクスの効率化、エージェントのコンテキストメモリ、CI/CDパイプラインのセキュリティ強化が取り上げられています。

JetBrainsがHugging Face Blogで、Mixture-of-Experts(MoE)構成を採用した新モデル「Mellum2」を発表しました。パラメータ数は12Bとされていますが、公開時点で得られる詳細情報は限られています。

Redis公式ブログは、新しいAIモデルが登場するたびに「ついに推論ができるようになった」と話題になる一方で、実際に本番環境でAIエージェントを運用するチームは今も幻覚や質問の取り違えに悩まされ続けている、というギャップを指摘しています。ベンチマークスコアの向上と実運用での信頼性は必ずしも一致しないという問題提起です。
OpenAIが「The Next Era of Knowledge Work」と題したレポートを公開し、コーディング支援ツールとして知られるCodexが、AIを活用した調査・データ分析・業務自動化・コンテンツ作成といった幅広い知識労働の場面で生産性向上に役立つ存在へと広がりつつあることを紹介しています。原文は概要のみで詳細な機能情報は限られています。
H Companyが「Holo3.1」というコンピュータ操作エージェントをHugging Face Blogで発表しました。タイトルにある通り「Fast & Local」を掲げており、高速かつローカル環境での動作を特徴としているとされます。ただし本記事執筆時点で参照できた原文本文には詳細な仕様説明が含まれていないため、具体的な性能数値や技術構成については触れていません。
OpenAIは、フロンティアAI(最先端AI)に対する米国の統治体制についての提言をまとめたブレープリントを公表しました。安全性・レジリエンス・国家安全保障の観点から、連邦レベルでの枠組み構築を提案する内容です。詳細な制度設計までは明らかにされていませんが、政府と業界の関係を方向づける動きとして注目されます。
OpenAIは生命科学研究に特化したAIモデル「GPT-Rosalind」の機能強化を発表しました。生物学的推論や医薬化学の専門知識、ゲノム解析、実験ワークフロー支援の能力が強化されています。研究者の日常的な研究活動を支援することを目的としています。
Hugging FaceのTransformersライブラリでv5.10.1がリリースされました。直前のv5.10.0は破損したブランチから公開されたため撤回(yank)されており、本バージョンがその修正版です。同時にGemma 4 12B Unified、Sapiens2、DeepSeek-OCR-2、Mellumという4つの新モデルサポートも追加されています。
OpenAIはChatGPTの新しい記憶システム「Dreaming」を発表しました。ユーザーの好みをより的確に記憶し、複数の会話にわたって文脈を鮮度高く保つことを目指す機能です。詳細な仕組みは明らかにされていませんが、対話の一貫性向上に寄与する取り組みとして注目されます。