ChatGPTに録音ファイルを添付し、文字起こし・要約・議事録の下書きを頼めます。対応する有料プラン向けの機能です。音声で会話するVoiceや、その場で録音するRecordとは使い方が異なります。すでにあるMP3・M4Aなどを使いたい場合は、ファイルの添付から始めます。

録音から議事録を作る3ステップ

01 添付する

音声ファイルを渡す
対応形式・容量を確認

02 文字にする

まず原語の文字起こし
聞き取れない箇所は残す

03 議事録にまとめる

決定事項・担当・期限
重要箇所は録音で確認

上限は512MB。ただし「容量内なら全編を正確に処理できる」という保証ではありません。

2026年10月7日にOpenAIの英語版公式ヘルプ本文を確認。この記事は仕様と実用手順の解説です。実ファイルでの文字起こし精度・処理時間は測定していません。出典:音声ファイルのアップロード・対応形式・制限。

1. 利用できるプランと、4つの音声機能の違い

OpenAIの公式ヘルプは、音声アップロードを有料のChatGPT契約・ワークスペースで利用可能とし、Enterpriseも対象に含めています。Freeは対象外です。文書や画像の添付が無料で使えても、音声ファイルまで同じ条件とは限りません。地域・ワークスペースの設定・アプリやブラウザ版のバージョン・選択したモデルによっても提供状況が変わります。

保存済み録音 → 音声アップロード

MP3・M4Aなどを会話に添付。文字起こしや録音内容についての質問に使います。この記事の対象です。

会話したい → Voice

ChatGPTと声でやり取りする機能。音声会話の記録は、録音ファイルの全文文字起こしとは異なります。

依頼文を話す → 音声入力

マイクで話した依頼文を文字にし、編集して送信する機能。録音ファイルを選ぶ操作とは別です。

その場で録る → Record

会議や音声メモを録音して整理する機能。公式のRecord案内はmacOSアプリ向けです。録音時間の制限や保存の仕組みは、ファイル添付とは分けて確認してください。

出典:Voice、音声入力、Record。音声会話のモデルや仕組みを知りたい場合は、GPT-Liveの解説を参照してください。

会議の録音を添付できることと、会議へ自動参加することも別です。録音の取り方や専用サービスを含めて比較したい場合は、AI議事録ツールと自動化の方法で選び方を整理しています。

2. 対応形式・容量・長時間録音の制限

確認項目公式に案内されている内容
対応する音声WAV、MP3/MPEG、OGG/OGA、PCM、FLAC、AAC、M4A、音声のみのWebM・MP4。
ファイルの容量音声は最大512MB。
動画を含むファイル動画として認識されるWebM・MP4は、この音声アップロードでは非対応。
録音の長さ長い録音は、Data Analysisが使える場合に分割処理されることがある。非常に長い録音は、タイムアウトで処理が止まる場合がある。
精度精度は言語によって異なる。文字起こしを間違えたり、話者を正しく区別できなかったりする場合がある。

出典:OpenAIの音声アップロード仕様。ファイル内部に読み取れる音声データが必要です。拡張子だけを変更しても、中身の形式や動画の有無は変わりません。

ファイルサイズは最大512MB

添付前に、ファイルのプロパティや情報画面でサイズを確認してください。

長い録音は途中で止まることも

容量内でも、長い録音では処理がタイムアウトする場合があります。必ず処理できる録音時間は、公式ヘルプに示されていません。

長いファイルが失敗する場合は、手元で短く区切り、順番に添付する方法を試せます。ただし、分割しても必ず成功するわけではありません。「前半・後半」の順番、元の録音での開始位置、少し重なる区間を記録すると、後で抜けと重複を確認しやすくなります。分割に外部サービスを使う場合は、機密情報を含む録音を送ってよいか確認してください。

3. 音声を添付して文字起こしする手順

  1. ファイルを確認する。手元のプレーヤーで冒頭だけでなく中盤・末尾も再生し、音が入っているか確認します。形式、容量、録音時間を控えます。
  2. 対応する有料プランのアカウントで会話を開く。入力欄の添付操作から、対応する音声ファイルを選びます。ボタン名や配置はアプリのバージョンによって異なるため、音声入力のマイクと取り違えないようにします。
  3. 添付と一緒に依頼を送る。最初は「文字起こし」を指定します。いきなり短い要約だけを頼むと、原文との照合に必要な情報が減ります。
  4. 結果を確認して、同じ会話で追加依頼する。誤記を直してから、議事録やメールの下書きへ加工します。添付できても、録音の最後まで解析されたとは限りません。回答がどの範囲を扱っているかも確認します。

公式の基本操作は「添付する → 希望する処理を伝える → 回答を確認して追加依頼」の順です。以下はその手順に沿った編集部作成の依頼文です。プロンプトの指示だけで誤りがなくなるとは保証できません。

添付した音声を、元の言語のまま文字起こししてください。
最初の出力では要約や翻訳をせず、発言の内容と順序を保ってください。
聞き取れない部分は[聞き取り不明]とし、推測で補わないでください。
発言者を確実に区別できる場合だけ話者ラベルを付け、
特定できない場合は[話者不明]としてください。
解析できなかった区間や、全編を処理できたか確認できない点も示してください。
録音の言語:日本語
録音時間:(分かる場合に記入)

録音時間を伝える目的は、出力の範囲を確認しやすくすることです。時間を書いたから、その長さの処理が保証されるわけではありません。専門用語の表記を添える場合も「実際に話されている場合だけ使う」と伝え、存在しない発言の補完に使わせないようにします。

4. 議事録・インタビュー・講義の依頼文

文字起こしを確認したら、目的に合わせて出力を変えます。重要なのは、録音から分かる事実と、AIが提案する内容を分けることです。以下は使い分けの例で、実際の生成結果を掲載したものではありません。

会議:決定・提案・未決を分ける

先ほど確認した文字起こしを基に、議事録を作ってください。
出力:会議の目的/確定した決定事項/未決の論点/次の作業。
次の作業は「内容・担当・期限・根拠の発言」を表にしてください。
提案を決定事項に変えないでください。
担当や期限が発言にない場合は「未定」と書いてください。
AIからの提案を加える場合は、録音の事実とは別の見出しにしてください。

架空の例:「金曜までに確認できるといいですね」

この発言だけでは確定しない

「期限は金曜。担当はAlex」と断定する。発言にない担当を補う。

確認できる情報にとどめる

「金曜までの確認が提案された。担当・期限の確定は要確認」と残す。

インタビュー:引用と読みやすい文章を分ける

確認済みの文字起こしを、話題ごとに整理してください。
「発言の引用」と「内容の要約」を明確に分けてください。
引用の言葉を読みやすく書き換えないでください。
話者の氏名は、録音やこちらの確認情報で特定できる場合だけ使ってください。
記事に使う前に聞き直すべき、固有名詞・数字・不明箇所の一覧も出してください。

引用として掲載する箇所は、録音に戻って確認します。整文は読みやすくできますが、語尾・留保・否定を変えると意味も変わります。「話者A」などのラベルが付いていても、それだけで誰の発言かを特定できるわけではありません。

講義:復習用ノートと、追加説明を分ける

確認済みの文字起こしから、復習用のノートを作ってください。
「講義で説明された内容」「用語」「理解を確認する質問」に分けてください。
録音にない補足説明を加える場合は、「追加説明」と明記してください。
数式・人名・専門用語で聞き取りが不確かなものは、断定せず確認項目にしてください。
まず原語のノートを作り、翻訳はまだしないでください。

別の言語へ翻訳したい場合は、元の文字起こしを直してから頼みます。誤認識を含んだまま翻訳すると、直す必要のある箇所が見えにくくなるためです。字幕ファイルや動画編集が目的なら、字幕・文字起こしツールの使い分けも参照してください。ChatGPTにSRT形式を依頼できても、正確なタイムコードが保証されるわけではありません。

5. 話者・数字・文字起こしの抜けを確認する方法

公式も文字起こしの誤りと、話者識別の不確かさを注意点に挙げています。AIに「間違いがないか確認して」と頼むだけで検証を終えず、出力と元の音声を突き合わせます。読みやすい要約になっていても、次の項目は録音と照合してください。

数字・単位

日付、金額、人数、割合。似た音の数字や単位を録音と照合。

否定・条件付きの発言

「しない」「仮に」「まだ未定」。こうした言葉が抜けると、発言の意味が変わります。

担当・期限

話者を取り違えていないか。提案と確定した約束を区別。

録音の最後まで含まれているか

冒頭・中盤・末尾の話題が含まれるか。途中で処理が終わっていないか、抜けた区間がないかを確認。

冒頭・中盤・末尾を確認するのは、短時間で大きな抜けを見つけるための点検です。ただし、この点検だけで全文が正確だとは判断できません。契約・納期など重要な用途では、該当発言を個別に聞き直します。正式な記録として使う前に、関係者にも内容を確認してもらいます。

雑音や同時発話がある区間で不明箇所が増えたら、まずその区間を手元で聞きます。AIの回答だけを繰り返し書き直させると、誤りが残ったまま、文章だけが読みやすくなることがあります。日本語の精度や特定サービスとの差は、この記事では実測していないため、優劣を付けていません。

6. 料金・利用枠・APIとの違い

ChatGPTの会話へ音声を添付する方法と、開発者向けAPIを呼ぶ方法は、請求も制限も別です。添付操作にAPIキーは使いません。APIの文字起こしを自分のアプリへ組み込む場合は、ChatGPT契約とは別のAPI利用になります。

比較項目ChatGPTへの音声添付文字起こしAPI
使い方会話にファイルを添付して依頼。プログラムから音声を送信。
契約・請求対応する有料ChatGPT契約・ワークスペースが必要。APIはChatGPTの月額契約と別に請求。
容量の上限音声は512MB。File transcriptionの案内は25MB。
仕様の確認先ChatGPTの音声アップロードヘルプ。APIのFile transcriptionガイド・料金表。

出典:ChatGPTとAPIの別請求、文字起こしAPIの容量上限。APIの25MBをChatGPTの添付上限として案内したり、Pro契約にAPI料金が含まれると考えたりしないでください。

音声添付の料金・利用枠で確認が必要な点

音声アップロードの公式ヘルプには、個人向けの追加料金の分単価や、プラン別の音声専用の処理時間・回数は掲載されていません。これは追加課金が発生するという意味ではありません。一方、「Proなら無制限」「どの契約でも追加費用は必ずゼロ」とも確認できませんでした。

同じヘルプにある文書・画像のアップロード数の表は、該当節の対象が文書・表計算・プレゼン・テキスト・画像と明記されています。その数字を音声のアップロード回数として使うことはできません。利用上限やエラーが出たら、自分の契約・ワークスペースの案内を確認してください。Voiceの通話時間上限も、添付した録音を処理できる時間の目安にはなりません。

7. アップロードできない・読めないとき

「ファイルを選べない」「添付できたが解析できない」「結果の途中で止まる」は、確認する場所が違います。契約を変える前に、症状ごとに切り分けます。以下は公式の条件を基にした確認順で、原因を必ず特定できるわけではありません。

症状先に確認すること次の対応
音声を添付できない音声アップロードに対応する有料プランか、形式と容量が対応しているか。地域・モデル・アプリのバージョン・組織の設定も確認。文書を添付できても、音声を添付できるとは限らない。
添付後に読めないと言われる手元で音声を再生できるか。動画として認識されるMP4・WebMではないか。正しく書き出した短い音声で切り分ける。拡張子の変更だけで音声形式を変えようとしない。
長い録音で止まる・抜ける回答がどこまでを扱ったか、末尾の内容があるか。元の録音を短く区切り、順番と開始位置を控えて再処理する方法を検討。
アップロード上限のエラー利用中のアカウント・契約・保存容量、OpenAIの障害情報。短時間に何度も再試行しない。公式は失敗したアップロードも上限へ計上される場合があると案内。

出典:公式のアップロード対処。改善しない場合は、問い合わせ用に日時・タイムゾーン、端末・ブラウザ、選択モデル、形式・容量・録音時間、エラー画面、取得できる場合はリクエストIDを控えます。スクリーンショットでは、録音内容や個人情報を必要以上に含めないようにします。

短いテストに使うなら、自分で用意した機密のない音声が適しています。全ファイルで失敗するのか、特定の形式や長さで失敗するのかを分けます。失敗のたびに契約のアップグレードが必要とは限らず、環境条件やファイルの問題も候補です。

8. 録音の学習利用・保存・削除をどう考えるか

録音をアップロードする前に、参加者への説明・必要な同意と、勤務先などの情報取扱ルールを確認します。音声には、依頼文に書いていない氏名・住所・顧客情報・背景の会話まで含まれることがあります。不要な区間を除いた素材を使えるか、クラウドへ渡してよいかを先に判断します。

学習利用

個人向けサービスは設定に応じて内容が学習に使われる場合があります。Proでも、学習利用の条件は法人向け契約とは異なります。

保存・削除

会話を削除しても、Libraryに保存された録音ファイルは残る場合があります。保存先ごとに確認してください。

公式の一般方針では、ChatGPTの個人向けサービスは内容を学習に使う場合があります。「モデル改善に協力する」をオフにすると新しい会話は対象外になりますが、自分から送る評価には例外があります。Business・Enterprise・EduとAPIは、既定で入力・出力を学習に使わない扱いです。出典:サービス別の学習利用方針。

一方、添付した音声そのものの学習利用が、Voiceの「音声録音を含める」設定とどう対応するかは、今回確認した音声アップロードヘルプに明記されていません。VoiceのクリップやRecordの録音についての説明を、添付したMP3・M4Aへそのまま当てはめないことが大切です。設定の読み方と入力済み情報の整理は、ChatGPT・Codexの学習利用と機密情報で詳しく説明しています。

ファイルがLibraryへ保存されている場合は、会話の削除だけではLibraryのコピーが消えません。文字起こし・要約が会話に残る場合もあり、それぞれの保存先を確認します。アーカイブは削除ではありません。出典:会話とファイルの保存・削除。学習オフは、録音を端末の外へ送信しない設定ではない点も区別してください。

まとめ:録音を渡し、文字起こしを確認してから使う

保存済み録音をChatGPTで使うなら、音声ファイルを会話へ添付し、まず文字起こしを頼みます。決定事項や引用を録音で確認してから、議事録・記事・復習ノートへ整理する順番が実用的です。

  • 利用条件:音声アップロードは有料契約向け。Freeやすべての環境で使える機能とは考えない。
  • 素材:対応する音声形式と512MBの上限を確認。動画を含むMP4・WebMは区別する。
  • 品質:話者・数字・否定の表現を録音と照合。録音の最後まで文字起こしされているかも確認する。
  • 費用とデータ:APIはChatGPTと別請求。音声添付専用の料金・利用枠には未公表の点があり、会話とファイルも別々に保存される場合がある。

FAQ

ChatGPTの無料プランでMP3を文字起こしできますか?
確認した公式ヘルプでは、音声ファイルのアップロードは有料契約・ワークスペース向けで、Freeは対象外です。無料の音声会話が使えることとは別です。

M4AやMP4も添付できますか?
M4Aは対応形式に含まれます。MP4・WebMは音声のみのファイルが対象で、動画として認識されるものはこの音声アップロードでは非対応です。内部に読み取れる音声データが必要です。

数時間の録音でも512MB以内なら大丈夫ですか?
容量だけでは判断できません。公式は長い録音を分割処理する場合と、非常に長い録音がタイムアウトする場合を案内しています。容量上限と、処理できる時間や全文の正確性は別です。

ChatGPT Proなら文字起こしAPIも料金内ですか?
いいえ。APIの利用はChatGPTの契約とは別に請求されます。会話へ音声を添付する操作と、自分のプログラムからAPIを呼ぶ操作を分けてください。