Deepdub(ディープダブ)は、映像のAI吹き替えと、会話型AI向けの音声合成APIを提供する法人向けの音声AIサービスです。独自のeTTS(感情表現付きの音声合成)を中心に、メディアのローカライズからAIエージェントの声までを扱います。
主な機能
吹き替えでは、音声認識による文字起こし、翻訳、eTTSやSpeech-to-Speechによる音声生成、口の動きに合わせた同期までを一つのワークフローで進めます。eTTSは80以上の演技スタイルに対応し、フランス語なまりの英語のようにアクセントを混ぜることもできます。声は1秒のサンプルから作るか、1,000以上のボイスから選べます。字幕はSRTやVTTで納品できます。社内のポストプロダクション担当者とネイティブの言語専門家が仕上がりを確認するマネージドサービスと、SaaSのDeepdub Goの2つの使い方があります。
AIエージェント向け音声API
会話型AI向けには、エンドツーエンドで約125msの応答時間をうたう音声APIを提供しています。1つの会話の中で落ち着いた口調から明るい口調へ切り替えるなど、感情表現を変えられます。アクセント、テンポ、ばらつきなどのパラメータも調整できます。
料金と注意点
APIは14日間の無料トライアルで、10,000文字(約10分)まで試せます。その後は時間単位のパッケージを選ぶ形で、価格は公開されていません。TPN Gold Shield、SOC 2、GDPRに対応し、顧客データをモデルの学習に使わない方針です。対応言語は130以上とされていますが、日本語の画面や日本語作品の実績は公式サイトでは確認できません。


