Dograhは、音声AIエージェントを構築・運用するためのオープンソースのプラットフォームです。VapiやRetellの代わりとして使えるセルフホスト型の基盤として作られており、BSD 2-Clauseライセンスで公開されています。
主な機能
- 構成を自由に選べるワークフロービルダー: 着信・発信・Webウィジェットといった入口、音声認識(STT)、LLM、音声合成(TTS)、電話回線をそれぞれ差し替えられます。OpenAI、Gemini、Deepgram、ElevenLabs、Cartesia、Twilio、Telnyx、Vonage、Asteriskなど多数のサービスに対応します。
- Speech-to-Speech: 文字起こしを挟まず、音声を直接やり取りするモードに切り替えられ、割り込みや話者交代を自然に扱えます。
- MCPサーバー: Claude CodeやCursorなどからDograhに接続し、音声エージェントの作成・変更・デプロイを指示できます。
- 録音音声とTTSの組み合わせ: 人が録音した音声と、同じ声でクローンしたTTSを混ぜ、合う録音があればそちらを使います。
- 自社環境での運用: WhisperやKokoroなどのモデルを自社VPC内で動かし、通話、録音、文字起こしを外部に出さずに運用できます。
3つの運用形態
自社サーバーでのセルフホスト(無料)、Dograhが運用するマネージドクラウド、顧客のVPC内にDograhが構築して運用するプライベートクラウドから選べます。
料金
オープンソース版はセルフホストで無期限無料です。クラウドの従量課金は1分あたり1¢のプラットフォーム料で、同時通話10件まで含まれ、クレジットは$5から購入できます。大量利用のボリューム契約や、オンプレミス導入のEnterpriseは個別見積もりです。
注意点
開発者向けの基盤で、使いこなすには音声認識やLLM、電話回線の知識が要ります。自社モデルへのLLM差し替えはベータ段階です。


