人手介入率 (Intervention Rate)
読み: じんしゅかいにゅうりつ
最終更新: 2026-08-14・AI PICKS編集部
定義
人手介入率とは、AIエージェントや自動化パイプラインが出した判断・出力のうち、人間による修正・承認・差し戻しを必要とした割合を示す指標のこと。
人手介入率 (Intervention Rate)とは — 詳しく解説
人手介入率(Intervention Rate)とは、AIエージェントや自動化パイプラインの判断・出力のうち、確認・修正・承認・差し戻しなど人間の関与を必要とした件数の割合を指す業界共通の運用指標。カスタマーサポート自動応答やコンテンツモデレーション、コード生成エージェントなど、AIに業務を委譲する場面で広く使われ、エスカレーション率やヒューマン・イン・ザ・ループ率と呼ばれることもある。2026年時点の実運用では、単純に「低いほど良い」と捉えると危険とされる。介入率を下げようとAIの確認基準を緩めると、誤りが人の目を素通りして本番に流出するリスクが高まるためだ。現場での選び方としては、介入率単体でなく、介入案件の重大度や修正コスト、見逃した場合の損失額とセットで管理する運用が広く採用されている。導入初期は介入率が高く出るのが通常で、モデルやプロンプトの改善に伴い段階的に下げていくのが定石とされる。コスト面では、介入率が高止まりすると人件費が自動化のROIを食いつぶすため、AIの確信度が低い案件だけを人に回す閾値運用の併用が相場感として一般的とされる。
人手介入率 (Intervention Rate)の使用例
- 月次レポートで人手介入率を計測し、閾値を超えたら自動化フローの再学習トリガーにする運用が一般的とされる。
- AIエージェント導入初期は人手介入率をKPIに設定し、段階的に自動化範囲を広げていくのが現場での定石とされる。
人手介入率 (Intervention Rate)に関連するAIツール
人手介入率 (Intervention Rate)の関連記事
関連用語
「評価指標」の他の用語
Massive Multitask Language Understanding。 57 分野・1.5 万問の LLM 知識評価ベンチマーク。
OpenAI 発の Python コーディング能力ベンチマーク。 164 問の関数実装タスク。
ユーザー投票による LLM の人間評価ランキング。 Elo レーティングで モデルを順位付け。
ベンチマークとは、AIモデルの性能を標準化されたテスト課題で数値化し、異なるモデル間を公平に比較するための評価基準セットのこと。MMLUやHumanEval等、用途別に数十種類が存在する。
SWE-benchとはGitHubの実際のIssueをAIが自動修正できるかを測る、コーディングAI評価の業界標準ベンチマークのこと。
GPQAとは、生物・物理・化学の大学院レベルの難問でAIの推論力を測る評価ベンチマークのこと。Googleで検索しても解けない設計が特徴。
用語がわかったら、次はツール選び
12カテゴリ・1468語以上を体系的に整理しています