ラウドネス正規化 (Loudness Normalization)
読み: らうどねすせいきか
最終更新: 2026-07-24・AI PICKS編集部
定義
ラウドネス正規化とは、音声や音楽の体感音量をLUFS基準で自動的に均一化し、視聴環境間の音量差をなくす技術のこと。
ラウドネス正規化 (Loudness Normalization)とは — 詳しく解説
ラウドネス正規化は、音声のピーク値ではなく人間の知覚に近い平均的な音圧(ラウドネス)を測定し、放送・配信規格が定めるLUFS単位に合わせて音量を揃える処理を指す。EBU R128やATSC A/85などの国際規格が広く採用されており、YouTubeやSpotify、Podcast配信プラットフォームは公開時に自動でラウドネスを揃える。局所的に音圧を上げすぎたマスターはかえって音量を下げられ、迫力が失われる落とし穴がある。2026年時点の実運用では、動画・ポッドキャスト制作の現場でマスタリングツールやAI音声編集ソフトにLUFSメーター機能が標準搭載されており、配信先ごとに目安値(概ね-14LUFS前後)を確認して調整するのが定着している。専任エンジニアを雇うコストをかけにくい個人クリエイターほど、自動ラウドネス調整機能を持つツールを選ぶことで、プラットフォームごとの音量基準に手間なく対応できる。
ラウドネス正規化 (Loudness Normalization)の使用例
- Podcast配信前にDAWのLUFSメーターで-16LUFS前後に統一し、エピソード間の音量差をなくす確認作業。
- YouTube投稿前に動画編集ソフトのラウドネス正規化機能をオンにし、規定値(-14LUFS)超過による自動音量ダウンを防ぐ。
ラウドネス正規化 (Loudness Normalization)に関連するAIツール
関連用語
「音声・音楽」の他の用語
AI 音楽生成サービス。 歌詞 + ジャンル指定で 完成楽曲を 1 分で生成。
OpenAI のオープンソース音声認識モデル。 99 言語対応、 日本語精度も高い。
AI 音声生成のトップサービス。 自分の声をクローンして 多言語ナレーションに使える。
TTS(音声合成)とは、テキストデータを人間らしい音声に変換するAI技術のこと。ナレーション・コールセンター・音声UIなど幅広い用途で使われ、2026年現在は人間と聞き分けにくい品質が標準となっている。
ASR(Automatic Speech Recognition・自動音声認識)とは、人間の音声をテキストへ自動変換する技術のこと。深層学習モデルの普及で精度が飛躍的に向上し、文字起こし・音声コマンド・翻訳など幅広い用途で使われる。
ボイスクローンとは、数秒〜数分の音声サンプルから特定人物の声質・話し方・抑揚を高精度に再現するAI音声合成技術のこと。
AI用語辞典をすべて見てみませんか
12カテゴリ・913語以上を体系的に整理しています
辞典トップへ