
Vercel AI Gateway、米政府の指示によりClaude Fable 5へのアクセスを停止
VercelはAI Gatewayにおいて、Anthropicのモデル「Claude Fable 5」への全ユーザーのアクセスを停止したと発表しました。米政府の指示に準拠する措置であり、再開時期は未定です。他のAnthropicモデルはAI Gateway経由で引き続き利用可能です。
トピック別に新着順で読めます。「あのアップデート何だっけ」はキーワード・期間からも探せます。

VercelはAI Gatewayにおいて、Anthropicのモデル「Claude Fable 5」への全ユーザーのアクセスを停止したと発表しました。米政府の指示に準拠する措置であり、再開時期は未定です。他のAnthropicモデルはAI Gateway経由で引き続き利用可能です。

Redis Blogは、テストとデモを問題なく通過したAIエージェントが本番投入後にループやコスト急増、事実に基づかない自信満々の回答といった不具合を起こす現象を取り上げています。同記事は、こうした事態を防ぐための「本番で生き残るコンテキストエンジニアリングの5原則」を提示する内容として紹介されています。
OpenAIは、企業向けAI導入・展開・変革を後押しするグローバルパートナー向けの新プログラム「OpenAI Partner Network」を発表しました。同社はこの取り組みに150億円規模ではなく1億5000万ドルを投じるとしています。詳細な参加条件やパートナー企業名などは今回の発表では明らかにされていません。
vLLM v0.23.0が公開され、DeepSeek-V4の推論基盤が大幅に強化されるとともに、次世代実行エンジン「Model Runner V2」がLlama・Mistral系のdenseモデルにも標準適用されました。あわせてマルチティアKVキャッシュオフロードや推論・ツール呼び出しパーサーの統一化など、実運用を見据えた改善が多数含まれています。なお本バージョンではMinimax M3はまだサポート対象外です。
Hugging Faceのコミュニティ記事は、AnthropicのClaude分析で使われた新しい解釈可能性ツール「J-Lens」と、そこから導かれる「J-Space」という概念を解説しています。単語や概念を線形方向として捉える既存手法を発展させ、平均的なヤコビアン行列を通すことで、モデルが後の発話や推論に使う中間表現を高い精度で特定・介入できる点が特徴です。著者は、この結果が「意識の発見」という見出しほど大げさではないが、それでも神経科学的に興味深いと位置づけています。
Vercelは「AI Gateway leaderboards」に、任意のチャートを画像として共有する機能と、ランキングの裏側にあるデータを取得できる仕組みを追加しました。データはCreative Commons Attribution 4.0(CC BY 4.0)のもとで公開され、CSVダウンロードやAPI経由でのプログラム的な取得も可能になっています。

MicrosoftはAIエージェント構築フレームワーク「Microsoft Agent Framework」のGo実装をパブリックプレビューとして公開しました。既存の.NET SDK・Python SDKに続き、Goでもツール呼び出しやマルチエージェントのワークフロー、可観測性を備えたエージェント開発が可能になります。サービスやCLI、クラウドネイティブなアプリケーションを得意とするGoの開発現場に、本番運用を意識したエージェント基盤がもたらされます。

Vercelが公開した「AI Gateway Production Index」2026年7月号によると、2026年6月のトークン利用量は前月比29%増、支出は27%増となり、トークン単価はほぼ横ばいで推移しました。DeepSeekやZ.aiのGLM 5.2などオープンウェイトモデルの利用が急拡大する一方、Anthropicはコストのかかるユースケースでシェアを維持しており、企業のAI活用がより戦略的なルーティングへと向かっていることがうかがえます。

Redis Blogが公開したFAQ記事は、AIエージェントの実用性を高める鍵として「コンテキストエンジニアリング」を取り上げています。モデルの推論力や計画能力が向上しても、渡すコンテキストが誤っていたり古かったり、あるいは無関係な情報が多すぎたりすれば、良い回答は得られないと指摘しています。リアルタイムなコンテキスト供給とエージェントの記憶・検索の仕組みが今後の重要テーマになるという内容です。

Redis Blogは、AIエージェントが利用者の過去のやり取りを覚えていても、古くなった情報を自信満々に提示してしまう事例を紹介し、記憶(Memory)と検索(Retrieval)を組み合わせたコンテキストレイヤーの必要性を論じています。個人化された履歴だけでは最新性を担保できない点が課題として示されています。
Hugging Face Blogに掲載された記事「Is it agentic enough? Benchmarking open models on your own tooling」は、オープンモデルの“エージェントらしさ”を汎用ベンチマークではなく、開発者自身が実際に使うツール環境で検証することの重要性を提起するものです。ただし今回参照した原文には本文が含まれておらず、具体的な手法や対象モデルなどの詳細は確認できませんでした。
Hugging Face Blogが「Beyond LoRA: Can you beat the most popular fine-tuning technique?」と題した記事を公開しました。LoRAが事実上の標準となっているパラメータ効率的ファインチューニング(PEFT)の分野において、それを上回る手法が存在するのかを問いかける内容です。本記事執筆時点では詳細な本文内容が提供されていないため、背景と論点の紹介にとどめます。

AWSの公式ブログ「AWS News Blog」に、2026年に開催された「AWS Summit New York」での発表内容をまとめる記事が公開されました。ただし今回参照した原文には見出しと概要のみが記載されており、具体的な発表内容(新サービスや機能更新など)はまだ本文中に記述されていません。今後の本文更新や関連記事での詳細発表が待たれる状況です。
Vercelは自社で100以上のAIエージェントを本番運用する中で、デプロイの容易さに対してセキュリティ確保が課題になっていることを明らかにしました。この課題に応えるため、アイデンティティ・アクセス制御・監査ログを標準搭載した新しい提供形態「Vercel for Enterprise Apps and Agents」を発表しています。
OpenAIはChatGPT Enterpriseの利用企業向けに、新しい支出管理機能と使用状況分析ツールを発表しました。企業がAI活用にかかるコストを把握し、安心して利用規模を拡大できるようにすることが狙いです。詳細な機能仕様については引き続き情報が公開される見込みです。

Cloudflareは、Zero Trust環境の計画・展開・運用をAIエージェントが自律的に行えるようにする「Cloudflare One stack」を公開しました。エージェントスキルのライブラリとして提供され、従来必要だった移行のための打ち合わせ(migration calls)を不要にすることを目指しています。
Hugging Face Blogにて「Agentic Resource Discovery: Let agents search」というタイトルの記事が公開されました。タイトルからは、AIエージェントが必要なリソースを自律的に検索できるようにする仕組みが発表されたことが読み取れますが、詳細な本文情報が確認できないため、具体的な機能や技術仕様については現時点で明らかになっていません。
OpenAIは、AIシステムが実際の生命科学研究における課題や意思決定にどれだけ対応できるかを測る新ベンチマーク「LifeSciBench」を発表しました。専門家による作成とレビューを経ている点が特徴です。研究現場での実務的な判断力をAIが持てているかを検証する試みです。
Cloudflareは公式ブログで、自社の「Agents SDK」を任意のエージェントフレームワークが基盤にできるランタイムとして開放すると発表しました。第一弾として新フレームワーク「Flue」がAgents SDKをターゲットに位置づけられ、ダッシュボードでのエージェント管理機能も展開されます。
AWSはWAFのBot Control機能を拡張し、AIボットやAIエージェントによるコンテンツ・API アクセスに対して課金できる「AIトラフィック収益化」機能を発表しました。コンテンツ提供者はアクセス料金の設定、サードパーティ経由の決済受領、エッジでのスコープ付きアクセス許可が可能になります。