OpenAI、AIの「思考過程」を監視する新評価フレームワークを発表
tech/ai news
ワンポイントAIの内部推論を監視する方が出力監視より効果的と判明
この記事は OpenAI News の一次情報をもとにAIが再構成したものです。 原文を読む →
OpenAIは、AIモデルの思考の連鎖(Chain-of-Thought)がどれだけ人間による監視に適しているかを測る新しい評価フレームワークを公開しました。13種類の評価タスクと24種類の環境から構成され、出力結果だけを見るよりも内部の推論過程を監視する方が、モデルの危険な挙動を検知する上で有効であることが示されています。
全文を読むには有料プランへの登録が必要です。
プランを見る →