Vercelが公開した「DeepsecBench」、AIモデルの脆弱性発見能力を徹底比較
tech/ai news
ワンポイント最高スコアでも脆弱性の再現率は**30.7%**にとどまる
この記事は Vercel Blog の一次情報をもとにAIが再構成したものです。 原文を読む →
Vercelは、AIモデルがアプリケーションコード内の脆弱性をどれだけ正確に見つけられるかを評価するベンチマーク「DeepsecBench」を公開しました。再現率・精度・コスト・実行時間を指標化し、予算とコードベースの複雑さに応じたスキャン体制の構築を支援します。フロンティアモデルが依然トップですが、Kimi K3やGrok 4.5などの効率的なモデルが低コストで肉薄しつつある点が注目されます。
全文を読むには有料プランへの登録が必要です。
プランを見る →