OpenAIが「CoT-Control」を発表、推論モデルは自らの思考過程を制御できないと判明
tech/ai news
ワンポイント推論モデルは自分の思考過程を制御できず、それが安全性の裏付けに
この記事は OpenAI News の一次情報をもとにAIが再構成したものです。 原文を読む →
OpenAIは新たな評価手法「CoT-Control」を用い、推論モデルが自身のチェーン・オブ・ソート(思考の連鎖)を意図的に制御することが難しいという結果を報告しました。同社はこの「制御できない」という性質こそが、AIの安全性を担保する「モニタリング可能性」を支える重要な要素だと位置づけています。
全文を読むには有料プランへの登録が必要です。
プランを見る →