定義
テキスト正規化とは、数字・日付・略語・記号などをTTS/ASRが読み上げやすい表記に統一的に変換する前処理のこと。
テキスト正規化 (Text Normalization)とは(詳しく解説)
テキスト正規化は音声合成TTSや音声認識ASRの前処理として、業界では数字・日付・略語・記号などの表記ゆれをTTSやASRが読み上げやすい形に統一的に変換する処理を指すとされる。2026年時点の実運用では、固有名詞・専門用語・多言語が混在するテキストで誤読が発生しやすく、特に固有名詞の多いBtoB業界や医療・金融分野では、汎用辞書だけでは対応しきれず追加のチューニングが必要になることが多いとされる。現場では業界ごとに読み辞書をチューニングし続ける運用コストがかかる点が落とし穴とされる。ツール選びでは精度だけでなく辞書のカスタマイズ性やAPI利用の相場感、既存の音声パイプラインとの統合しやすさを比較する視点が重要とされる。
この解説の引用について
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「テキスト正規化 (Text Normalization)とは」 https://aipicks.jp/glossary/text-normalization
テキスト正規化 (Text Normalization)の使用例
- 「2026/07/27」を「にせんにじゅうろくねんしちがつにじゅうななにち」に変換するのがテキスト正規化の一例。
- 「Dr.」「¥1,000」のような略語・記号を読み上げ可能な形に展開する処理も含まれる。