知能指数 (Artificial Analysis Intelligence Index)の定義
Artificial Analysis Intelligence Indexとは、米国の独立系評価会社Artificial Analysisが、複数のベンチマーク結果をまとめてAIモデルの総合的な賢さを1つの数値にした指標のことです。
- 運営
- Artificial Analysis(米サンフランシスコ本社の独立系AIベンチマーク企業)
- 測るもの
- 推論・知識・数学・プログラミングなど、言語モデルの総合力
- 最新版
- v4.3.2(2026年9月〜)。10種類の評価で構成
- 配点
- エージェント30%、コーディング20%、科学的推論20%、一般30%の加重平均
- 主な評価セット
- Terminal-Bench 4.0、SciCode、Humanity's Last Exam、AA-Omniscience、GDPval-AA など
- 注意点
- 主に英語・テキストでの評価。画像入力や多言語の性能は別枠で測定
知能指数 (Artificial Analysis Intelligence Index)とは(詳しく解説)
Artificial Analysis社が公開する知能指数は、推論・数学・コーディングなど複数の第三者ベンチマークのスコアを統合し、主要LLMの総合力を一本の数値で比較できるようにした評価指標として業界で広く採用されているとされる。単一ベンチマークへの過学習を避け、モデル間の相対的な立ち位置を素早く把握できる点が支持される理由とされる。ただし2026年時点の実運用では注意点も多い。指数が高いモデルほど推論トークン数が増えやすく、コストと応答速度が悪化する傾向があるため、スコアだけで導入判断すると相場感からずれた予算設計になりやすい。現場での選び方としては、指数はモデル選定の一次フィルタに留め、自社タスクでの精度・レイテンシ・コストを個別に検証してから本番採用するのが実務的とされる。
知能指数 (Artificial Analysis Intelligence Index)のよくある質問
Q. Artificial Analysis Intelligence Indexとは何ですか?
AIモデルを同じ条件で多数のテストにかけ、その結果を重みづけして1つのスコアにまとめた総合指標です。モデル同士の賢さをざっくり比べるのに使われます。
Q. 人間の知能指数(IQ)と同じですか?
違います。人間のIQとは関係なく、AIモデルのベンチマーク成績をまとめた独自のスコアです。評価の中身は版ごとに入れ替わるため、異なる版の数値はそのまま比べられません。
Q. スコアが高いモデルを選べば間違いないですか?
目安にはなりますが、それだけで決めるのはおすすめしません。評価は主に英語で行われているので、日本語の業務では自分のタスクで試してから選びましょう。
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「知能指数 (Artificial Analysis Intelligence Index)とは」 https://aipicks.jp/glossary/intelligence-index
知能指数 (Artificial Analysis Intelligence Index)の使用例
- GPT-5.5やClaude 5などのモデル発表時に、知能指数のスコア比較が性能アピールの根拠としてよく引用される。
- モデル選定では「知能指数は僅差でもコストが数倍違う」という理由で安価なモデルを選ぶ現場もあるとされる。
知能指数 (Artificial Analysis Intelligence Index)に関連するAIツール
知能指数 (Artificial Analysis Intelligence Index)の関連記事
知能指数 (Artificial Analysis Intelligence Index)の関連用語
12カテゴリ・1775語以上を体系的に整理しています
