ChatGPTの発表内容

米OpenAIは2026年10月9日、「ChatGPT」に音声ファイルを直接読み込ませる機能を追加しました。音声ファイルをチャットに添付するだけで、自動で文字起こしを作成したり、要約を指示したりできます。

対応する形式は、MP3やWAV、AAC、M4A、FLACなど多岐にわたります。1ファイルあたり最大512MBまで対応します。ただし、MP4やWebMが動画として識別された場合は読み込めません。長時間の録音は分割して処理される場合や、タイムアウト(時間切れ)で失敗する場合があります。

利用できるのは、有料プランおよびワークスペースの利用者です。会議やインタビュー、講義の録音データから、整理されたメモやメールの下書きをすばやく作成できます。音声をテキスト化するだけでなく、内容についての質問もチャット上で行えます。

つまり、どういうこと?

ざっくり言うと、スマホやレコーダーで録音した会議の音声を、そのままChatGPTに渡せるようになりました。ファイルを投げ込むだけで、文字起こしから要約の作成、内容への質問までまとめて頼めます。文字起こし専用の別ツールを使わずに、普段のチャット画面だけで作業を完結できるのが利点です。

編集部の見方

音声ファイルを直接読み込めるようになったのは、かなり実用的です。長時間の録音ファイルをそのまま解析できるようになると、業務での使い道が一気に広がります。文字起こしだけでなく、要約やメールの下書きまでチャット内で完結するのは重宝します。

作業環境の一本化。

ただ、最大512MBに対応しているとはいえ、長時間のファイルでは分割処理やタイムアウトが起こる点には注意が必要です。会議の音声データを丸ごと投げてどこまで安定して動くかは、筆者としてもちょっと気になります。有料プランを契約している人なら、まずは短めの定例会議の音源から試してみるのが賢い判断です。次は年内のアップデートで処理時間の制限がどこまで緩和されるかを見たいです。

誰に関係するか

会議やインタビューの録音データを扱っている人は、音声を添付するだけで文字起こしやメールの下書きを作成できるようになります。

複数の発表・報道をもとに編集部が事実関係を確認して執筆しています。