AUC-ROC (ROC曲線下面積)
読み: えーゆーしーろっく
最終更新: 2026-07-20・AI PICKS編集部
定義
AUC-ROCとは、機械学習モデルの分類性能を0から1の数値で表す評価指標で、ROC曲線の下側の面積を意味する。
AUC-ROC (ROC曲線下面積)とは — 詳しく解説
AUC-ROCは、二値分類モデルが正例と負例をどれだけ正しく順序づけられるかを示す指標で、真陽性率(TPR)と偽陽性率(FPR)の関係を描いたROC曲線の下側面積として計算される。値は0.5(ランダム予測)から1.0(完全分類)の範囲を取り、モデル比較の業界標準指標として広く採用されている。ただし2026年時点の実運用では、クラス不均衡が強いデータ(不正検知や医療診断など陽性が数%しかないケース)ではAUC-ROCが高くても実際の適合率・再現率が低いという落とし穴が知られており、そうした現場ではPR-AUC(適合率-再現率曲線下面積)を併用する選び方が定着しつつあるとされる。指標算出自体のコストは小さいが、モデル再学習や継続的なモニタリング体制の構築には相応の運用コストがかかる点も見落とされがちである。
AUC-ROC (ROC曲線下面積)の使用例
- 画像分類モデルの性能評価で、AUC-ROCが0.85なら「ランダム予測より大きく優れている」と判断できる目安になる。
- 不正検知モデルの現場ではAUC-ROCだけでなく、少数派クラスに強いPR-AUCも併記して評価するケースが増えている。
AUC-ROC (ROC曲線下面積)に関連するAIツール
関連用語
「評価指標」の他の用語
Massive Multitask Language Understanding。 57 分野・1.5 万問の LLM 知識評価ベンチマーク。
OpenAI 発の Python コーディング能力ベンチマーク。 164 問の関数実装タスク。
ユーザー投票による LLM の人間評価ランキング。 Elo レーティングで モデルを順位付け。
ベンチマークとは、AIモデルの性能を標準化されたテスト課題で数値化し、異なるモデル間を公平に比較するための評価基準セットのこと。MMLUやHumanEval等、用途別に数十種類が存在する。
SWE-benchとはGitHubの実際のIssueをAIが自動修正できるかを測る、コーディングAI評価の業界標準ベンチマークのこと。
GPQAとは、生物・物理・化学の大学院レベルの難問でAIの推論力を測る評価ベンチマークのこと。Googleで検索しても解けない設計が特徴。
AI用語辞典をすべて見てみませんか
12カテゴリ・763語以上を体系的に整理しています
辞典トップへ