定義
IVFとは、大量のベクトルデータをk-meansなどで複数のクラスタに分割し、検索時は近傍クラスタだけを走査して近似最近傍探索を高速化するベクトルインデックス手法のこと。
IVF (転置ファイルインデックス)とは(詳しく解説)
IVF(Inverted File Index、転置ファイルインデックス)とは、Faissなどのベクトル検索ライブラリで使われる近似最近傍探索(ANN)のインデックス方式で、事前にk-meansでベクトル空間をnlist個のクラスタに分割し、検索時は近いクラスタ(nprobe個)だけを対象に距離計算することで全件走査を避け高速化する手法とされる。RAGの基盤となるベクトルDB(Faiss/Milvus/Qdrant等)で広く採用されている。2026年時点の実運用では、クラスタ数nlistと探索範囲nprobeのチューニングが精度と速度のトレードオフを直接左右し、設定を誤ると検索漏れ(リコール低下)が起きやすい点が現場での落とし穴として挙げられる。クラスタ境界付近のベクトルが拾われにくい境界問題も知られ、nprobeを増やして精度を補う分だけレイテンシとコストが上がる。HNSWよりインデックス構築が軽くメモリ効率が良いため、コスト感を抑えたい大規模データセットで選ばれやすい一方、更新頻度が高いデータでは再クラスタリングの運用負荷が相場的な悩みになりやすいとされる。
この解説の引用について
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「IVF (転置ファイルインデックス)とは」 https://aipicks.jp/glossary/ivf-index
IVF (転置ファイルインデックス)の使用例
- Faissでnlist=1024のIVFインデックスを構築し、検索時にnprobe=16のクラスタだけを走査してレイテンシを抑える。
- 数百万件の商品ベクトルをIVFで分割し、ECサイトの類似商品検索を全件比較なしで数十ミリ秒に高速化する。