ChatGPTのレコードモード(record mode)は、会議の音声をその場で文字起こしし、停止と同時に要約ノートまで作る機能です。2026年10月時点でもmacOSデスクトップアプリ専用で、WindowsやスマホのChatGPTには録音ボタンがありません。さらに2026年9月29日のDevDayでは、後継にあたるMeetingsプラグインがPro・Business向けのベータとして発表されました。この記事では、両機能の対応プランと4時間という録音上限、音声が保存されない仕様を整理したうえで、手元の録音ファイルをAPIで文字起こしして議事録に変えるまでのコードを、OpenAI公式の記述を根拠に示します。
まとめ:ChatGPTの録音機能は「Macで同席する会議」に絞って使う
結論として、ChatGPTの録音機能は「Macを開いて同席している会議」に限って強く、それ以外は別手段に振り分けるのが現実的です。要点は5つあります。
- レコードモードはPlus・Pro・Business・Enterprise・Eduで追加課金なく使えるが、Free・Goは対象外。Enterprise・Eduは管理者が有効化するまで既定でオフ。
- 新しいMeetingsプラグインはmacOSアプリでPro・Business向けのベータ。Plusは対象に含まれず、Windows・iOS・Androidは「coming soon」の段階。
- 動作環境はどちらもmacOSデスクトップアプリのみ。Windows・iOS・Android・Web版で今日録音できる公式機能は無い。
- 1セッションの上限は4時間(240分)。超えると自動停止し、そこまでのノートが生成される。音声ファイルはノート生成後に削除され、聞き直せない。
- 録音済みの音声ファイル(m4a・mp3など)をChatGPTの画面で文字起こしさせる公式導線は無い。公式の手段はSpeech to text APIで、推奨モデル
gpt-transcribeは約$0.0045/分。1時間の会議でも40円前後に収まる。
以降で、対応環境の確認、Meetingsとの違い、手順、上限の回避、API文字起こしのコード、議事録プロンプト、データの扱いと同意、専用ツールとの使い分けの順に説明します。
レコードモードの対応プランと、Free・Goで使えない場合の判断
OpenAIの公式ヘルプ「ChatGPT Record」は、対応範囲を「Plus, Enterprise, Edu, Business, and Pro workspaces」と明記しています。無料プランのFreeと、低価格帯のGoはこの列挙に含まれません。料金は既存プランに含まれ、録音の従量課金はありません。新しいMeetingsプラグインは対象プランが異なるため、並べて確認しておくと迷いが減ります。
| プラン | レコードモード | Meetings(ベータ) |
|---|---|---|
| Free | 非対応 | 非対応 |
| Go | 非対応 | 非対応 |
| Plus | 対応 | 対象外 |
| Pro | 対応 | 対応 |
| Business(旧Team) | 対応(管理者が無効化可) | 対応(管理者の有効化が前提) |
| Enterprise | 対応(既定オフ) | 限定アルファのみ |
| Edu | 対応(既定オフ) | 記載なし |
レコードモードの提供は段階的でした。2025年6月4日にBusiness(当時のTeam)へ先行提供され、6月18日にPro・Enterprise・Eduへ、7月にPlusへmacOSアプリで全世界展開されています。「Plusでは使えずTeam以上が必要」という説明は初期ロールアウト時点の情報で、現在は誤りです。
無料のままChatGPTだけで会議を録音する道はありません。Freeプランで議事録を作りたいなら、端末標準のボイスレコーダーで録音し、後述のAPIか他社の無料枠ツールで文字起こしして、そのテキストをChatGPTに貼って要約させる流れになります。無料ツールの限界と有料化の判断ラインは議事録AIの無料と有料の違いは?無料版の限界と有料化の判断ライン【2026年版】で整理しています。
新しいMeetingsプラグインと旧レコードモードの違い・移行の判断
OpenAIはDevDay 2026のまとめ(2026年9月29日)で、会議ノートを取るMeetingsプラグインを発表しました。公式ヘルプ「The Meetings plugin in ChatGPT」によれば、提供形態はmacOS版ChatGPTデスクトップアプリのプラグインで、全Proプランと全Businessプランにベータとして段階的に展開中です。iOS・Android・Windowsは「coming soon」、Enterpriseは一部顧客とのアルファ段階にとどまります。ヘルプには「Meetings is separate from the Record feature in the older ChatGPT desktop app」とあり、レコードモードとは別機能として扱われています。
| 項目 | レコードモード | Meetingsプラグイン |
|---|---|---|
| 対象プラン | Plus・Pro・Business等 | Pro・Business(ベータ) |
| 動作環境 | macOSアプリのみ | macOSアプリ(他OSは予定) |
| 開始方法 | 入力欄のRecordボタン | サイドバーのMeetings |
| 自動開始の補助 | Google Meetのみ自動参加 | 通話を検知して記録を提案 |
| カレンダー連携 | Googleカレンダー | Google・Outlook |
| ノートの保存先 | 会話内のcanvas | ChatGPT Spaceのページ |
| 1セッション上限 | 4時間で自動停止 | 4時間で自動停止 |
| 音声の扱い | 文字起こし後に削除 | ノート完成後に削除 |
導入はサイドバーの「Plugins」からMeetingsを探してインストールし、オンボーディングの途中でマイクとシステム音声へのアクセスを許可する流れです。カレンダー接続は必須ではなく、手動で「Take notes」を押せば記録が始まります。Google CalendarまたはOutlook Calendarのプラグインをつなぐと、予定前のリマインドを受け取ることが可能です。手動で止め忘れても、ノートPCの蓋を閉じた時点、長時間無音が続いた時点、4時間に達した時点で自動的に記録が止まります。
機能面の差で大きいのは、要約の材料です。Meetingsはトランスクリプトと自分のメモに加え、許可した連携アプリの文脈も使ってアクションアイテムを提案し、各項目をワンクリックでChatGPTに実行させられます。共有の扱いも明確で、ページは既定で非公開、共有した相手にはノートは見えてもトランスクリプトは見えません。
旧レコードモードを使い続けるか、Meetingsへ移るかの判断条件
判断は3つの条件で足ります。Plusを使っているなら、Meetingsの対象外なのでレコードモードを使い続けるしかありません。ProかBusinessで、議事録をチームで共有したい、メール下書きやタスク化まで一気に進めたいという要件があるなら、Meetingsが向いています。Businessではワークスペースの管理者がChatGPT SpaceとMeetingsの両方を有効にしていないと使えないため、まず管理者に設定状況を確認してください。
一方、ベータである以上、仕様が変わる前提で業務フローを組む必要があります。全社標準にする前に、定例会議など失敗しても困らない会議で数週間試し、精度と運用手順を確かめてから広げる順番が安全です。なお、Meetingsのアプリに出る同意リマインダーは自分にしか見えず、他の参加者へ通知も同意取得もしない、とヘルプは明記しています。
macOS専用という制約と、Windows・スマホでの代替ルート
レコードモードの公式ヘルプは「only available for the macOS desktop app」と書いており、Windowsアプリ、iOS、Android、ブラウザ版のいずれにも録音ボタンは提供されていません。Meetingsプラグインも現時点ではmacOSだけで、Windows対応は「coming soon」と書かれているものの日付は示されていません。Windows版で録音ボタンを探す検索が絶えないのは、機能そのものが存在しないためです。
Windows環境での現実的な回避策は次の2通りです。ひとつは、Windows標準の「サウンドレコーダー」やTeams・Zoomの録画機能で音声を確保し、その音声ファイルを後述のAPIで文字起こししてからChatGPTに要約させる方法。もうひとつは、Windowsに対応した専用ツール(Notta、Otterなど)で文字起こしまで済ませ、ChatGPTを整形・要約だけに使う方法です。後者はNotta Brainとは|会議データを資料・ナレッジに変えるAIエージェントの仕組み・料金・使い方【2026年最新】で扱っている領域と重なります。
なお、2026年6月に登場したCodexの「Record & Replay」は、開発者の作業手順を記録してスキル化する別機能で、会議録音とは無関係です。名前が似ているため検索結果で混ざりますが、目的が違います。Codex側の音声機能についてはCodexの音声入力とは?App・CLIの2系統と設定方法・Windows対応を解説【2026年版】で整理しています。
録音開始からノート生成までの操作と、Zoom・Teams会議での使い方
初回に必要なマイクとシステム音声の権限設定と、相手の声が入らない原因
録音を開始する操作は、macOSアプリのチャット下部にあるRecordボタンのクリックです。初回起動時にmacOSの権限要求が出るため、システム設定の「プライバシーとセキュリティ」で、ChatGPTに対してマイクと画面収録およびシステムオーディオ録音の両方を許可します。後者を許可して初めて、マイクの自分の声だけでなくPCのスピーカーから鳴る相手側の声(システム音声)も取り込めます。オンライン会議で相手の発言だけが文字起こしに入らないときは、まずこの権限を疑ってください。マイク権限だけでは、相手の声が入る経路がありません。
録音中はリアルタイムに文字起こしが流れ、経過時間のタイマーが表示されます。Stopアイコンで一時停止し、「Resume」で同じセッションを再開、「Send」でトランスクリプトと要約をアップロードします。左上の「X」から選べる操作は、アップロード・削除・録音画面へ戻るの3択です。話者は自動的に分離され、名前が特定できない発言者は「Speaker 1」のような汎用ラベルになりますが、あとからリネームが可能です。
Google Meet以外の会議で自動参加が効かない理由と手動での開始
ChatGPTにGoogleカレンダーを接続すると予定と同期し、会議に合わせて録音を開始できますが、カレンダー由来の自動参加はGoogle Meetのリンクにしか対応しません。Zoom、Microsoft Teams、Webexの会議では、macOSアプリで手動でRecordを押す操作が必要です。会議ツールごとに標準のAI議事録機能とプラン条件も異なるため、併用を検討するなら会議ツール別のAI議事録|Zoom・Teams・Meet・Notionのプランと使い分けも確認しておくと判断が速くなります。Google Meet中心の組織なら、Gemini側の自動メモと比べる選択肢もあり、手順はGeminiで議事録を作る方法|Meet自動メモ生成とAI Studioの手順・音声の上限と機密の線引きで解説しています。
ここは仕組みを理解しておくと判断が早くなります。レコードモードもMeetingsも、会議室に別の参加者(bot)として入るタイプではなく、手元のMacで鳴っている音と自分のマイクを録るタイプです。したがって、自分がその会議にMacで参加していなければ録れません。「自分は欠席してbotだけ議事録を取らせる」という使い方は、Otterやtl;dvのようなbot参加型ツールの領分になります。
1セッション4時間の上限と、音声が残らない仕様への実務上の対処
録音時間の上限は240分で、超えた時点でノートを自動生成する
公式ヘルプは「capped at 4 hours (240 minutes) per session」と明記しています。上限に達したセッションは自動的に停止し、そこまでの内容からノートが生成されてprivate canvasとしてアップロードされます。録音が途中で切れて何も残らない、という事態にはなりません。1日あたり・月あたりの回数上限は公式ヘルプに記載がありません(上限が無いと明言されているわけではない点には注意が要ります)。ヘルプには「all limits and pricing are subject to change」との注記もあります。
旧来の記事や解説で見かける「録音は最大120分まで」は現在の仕様と異なります。半日の研修やワークショップでも240分までは1セッションで通せますが、それを超える終日イベントは休憩ごとにセッションを分けるのが安全です。
音声ファイルが残らない前提で、証跡が要る会議を分けて運用する
レコードモードの音声は文字起こしが終わった直後に削除されます。Meetingsも同じで、ノートが完成するとMacとOpenAIのサーバーの両方から音声が消え、再生できません(オフライン中や処理未完了のあいだは、アップロード待ちの音声が一時的にMacに残ります)。残るのはトランスクリプトと要約ノートだけで、あとから音声を聞き直して「本当にそう言ったか」を確認する手段はありません。文字起こしに誤りがあっても原本に当たれないという意味です。
この仕様は、契約交渉やハラスメント調査のように音声そのものが証跡になる場面には向きません。そうした会議では、端末側のボイスレコーダーやZoomのクラウド録画を併用し、ChatGPTは要約の下書き作りに限定するのが妥当な線引きです。逆に、社内定例やブレストのように「決まったこととTODOだけ残ればよい」会議では、音声が残らないことはむしろストレージとセキュリティの負担が減る利点になります。
録音済み音声ファイルを文字起こしする方法(ChatGPT画面ではなくAPI)
ChatGPTの画面に音声ファイルを渡す方法が公式に無い理由
すでに手元にある録音データを処理したい場合ですが、ChatGPTのFile Uploads FAQが扱える対象として挙げているのは、文書・表計算・プレゼンなどのファイルです。音声ファイルを添付して文字起こしさせる動作は公式に案内されていません。たまたま通ったという報告があっても仕様として保証されていないため、業務フローに組み込むべきではありません。
OpenAIが公式に用意している導線は、Speech to text APIです。手元にある録音(会議のm4a、ICレコーダーのmp3、Teamsの録画から抜いた音声など)は、こちらで処理します。OpenAI以外のGoogle・Azure・AWSなどの文字起こしAPIと料金や日本語対応を比べたい場合は、文字起こしAPIの比較と選び方|主要7サービスの料金・日本語対応・使い方【2026年最新】が出発点になります。
文字起こしモデル5系統の選び方と、公式が明記する25MBの上限
2026年10月時点のガイドが「recommended model」として最初に挙げるのは gpt-transcribe です。話者ラベル・単語タイムスタンプ・字幕形式・英語への翻訳が必要なときだけ、専用モデルを選ぶ設計になっています。
| モデル | 向く用途 | 単価の目安 |
|---|---|---|
| gpt-transcribe | 通常の文字起こし(推奨) | $0.0045/分 |
| gpt-4o-transcribe | 既存実装の継続 | $0.006/分 |
| gpt-4o-mini-transcribe | 既存実装の低コスト版 | $0.003/分 |
| gpt-4o-transcribe-diarize | 話者の分離 | 料金ページで確認 |
| whisper-1 | 英語への翻訳・字幕形式 | 料金ページで確認 |
対応形式は mp3・mp4・mpeg・mpga・m4a・wav・webm。ガイドとAPIリファレンスが明記している上限は1ファイル25MBです。本記事の初版(2026年7月)では、gpt-4o-transcribe系に音声長1500秒(25分)の上限もあると案内していました。2026年10月1日に確認した時点の公式ガイドには秒数の上限記述が見当たりません。ただ、長い音声を1回で投げると失敗時のやり直しが重くなるため、後述のとおり10分前後で切る運用は変えなくてよいと判断しています。
最小のコードは次のとおりです。既存の gpt-4o-transcribe 実装なら model を差し替えるだけで動きます。
from openai import OpenAI
client = OpenAI()
with open("meeting.m4a", "rb") as f:
result = client.audio.transcriptions.create(
model="gpt-4o-transcribe",
file=f,
language="ja",
)
print(result.text)
話者ごとに分けたい場合は gpt-4o-transcribe-diarize と response_format="diarized_json" を使い、30秒を超える音声では chunking_strategy="auto" などの指定が必須です。2〜10秒の参照音声を最大4人分渡すと、セグメントを既知の話者名に割り当てられます。英語への翻訳を同時に行う translations エンドポイントは whisper-1 のみが対象です。
gpt-transcribeに社内用語と言語ヒントを渡すコード例と設定値
gpt-transcribe では、録音の状況説明を prompt、聞こえるはずの固有名詞を keywords、想定する言語を languages で渡せます。ガイドは、gpt-transcribe では単数形の language ではなく languages を使い、両方を同時に送らないよう求めています。キーワードに <・>・改行を含めるとリクエスト全体が拒否される点にも注意してください。
from openai import OpenAI
client = OpenAI()
with open("meeting.m4a", "rb") as f:
result = client.audio.transcriptions.create(
model="gpt-transcribe",
file=f,
prompt="受託開発会社の社内定例。案件の進捗と見積もりの確認。",
extra_body={
"keywords": ["要件定義書", "kintone", "検収"],
"languages": ["ja"],
},
)
print(result.text)
キーワードは「出力を強制するものではなくヒント」とガイドに書かれています。発言されていない語が紛れ込むことがあるため、議題に関係する語だけを数個に絞り、入れた場合と入れない場合の結果を1本ずつ比べてから標準設定にしてください。
25MBを超える長時間音声の分割と、10分前後で切る実務上の理由
1時間の会議は、録音形式によっては25MBを超えます。公式ガイドもPyDubでの分割を例示しており、文の途中で切ると文脈が失われ精度が落ちると注意しています(AudioSegment.from_file でm4aを読むにはffmpegが別途必要です)。
from pydub import AudioSegment
audio = AudioSegment.from_file("meeting.m4a").set_channels(1)
chunk_ms = 10 * 60 * 1000
for i, start in enumerate(range(0, len(audio), chunk_ms)):
chunk = audio[start:start + chunk_ms]
chunk.export("chunk_%02d.mp3" % i, format="mp3", bitrate="64k")
64kbpsのモノラルmp3に変換すると1時間で約28MBになり、サイズ上限をわずかに超える程度です。2分割でも収まりますが、10分前後で切っておくと、1本が失敗したときに再送する範囲が小さく済み、進捗も追いやすくなります。分割すると発言の途中で切れることは避けられないため、ガイドが挙げる「前のチャンクの文脈を prompt で引き継ぐ」方法を次のスクリプトに組み込みました。
分割・文字起こし・議事録化を1本で回すPythonスクリプトの全体
分割、チャンクごとの文字起こし、全文からの議事録化までを1ファイルにまとめた例です。pip install openai pydub とffmpegの導入、環境変数 OPENAI_API_KEY の設定を済ませれば動きます。要約モデルは環境変数 SUMMARY_MODEL で差し替えられるようにし、既定値には料金ページ掲載の軽量モデルを置きました。
import os
from pydub import AudioSegment
from openai import OpenAI
client = OpenAI()
CHUNK_MS = 10 * 60 * 1000 # 10分ごとに分割する
TERMS = ["要件定義書", "kintone", "検収"] # 社内用語・固有名詞のヒント
MINUTES_INSTRUCTIONS = """あなたは議事録作成の担当者です。
推測で補わず、トランスクリプトに無い内容は書かないでください。
出力は「決定事項」「TODO(担当者と期限。無ければ期限未定)」「未決の論点」「補足」の4区分にしてください。"""
def transcribe_meeting(path):
audio = AudioSegment.from_file(path).set_channels(1)
texts = []
for i, start in enumerate(range(0, len(audio), CHUNK_MS)):
name = "chunk_%02d.mp3" % i
audio[start:start + CHUNK_MS].export(name, format="mp3", bitrate="64k")
# 直前チャンクの末尾200字を文脈として渡し、切れ目の誤認識を抑える
tail = texts[-1][-200:].replace("\n", " ") if texts else ""
with open(name, "rb") as f:
r = client.audio.transcriptions.create(
model="gpt-transcribe",
file=f,
prompt="社内会議の録音の第%d区間。直前の発言: %s" % (i + 1, tail),
extra_body={"keywords": TERMS, "languages": ["ja"]},
)
texts.append(r.text)
print("chunk %d done" % i)
return "\n".join(texts)
def make_minutes(transcript):
r = client.responses.create(
model=os.environ.get("SUMMARY_MODEL", "gpt-6-luna"),
instructions=MINUTES_INSTRUCTIONS,
input=transcript,
)
return r.output_text
if __name__ == "__main__":
text = transcribe_meeting("meeting.m4a")
with open("transcript.txt", "w", encoding="utf-8") as f:
f.write(text)
with open("minutes.md", "w", encoding="utf-8") as f:
f.write(make_minutes(text))
トランスクリプトを先にファイルへ書き出しているのは、要約のやり直しで文字起こし料金を二重に払わないためです。会議中に字幕のように流したい用途はファイル型のこのAPIではなく、リアルタイム文字起こしの領分になります。その実装はGPT-Live-Transcribeとは?OpenAIの低遅延ストリーミング文字起こしの実装手順とGPT-Transcribeとの使い分けを解説【2026年7月版】で扱っています。
gpt-transcribeの分単価と、1時間会議あたりの実費の目安
OpenAIの料金ページでは、gpt-transcribe が$0.0045/分、gpt-4o-transcribe が$0.006/分、gpt-4o-mini-transcribe が$0.003/分です(2026年10月1日時点)。1時間の会議なら順に$0.27・$0.36・$0.18。1ドル150円換算で、推奨モデルでも1本あたり40円前後に収まります。月20本の会議を回しても800円程度で、専用SaaSの月額と比べて安く済む点が、API経由を選ぶ最大の理由です。
要約に使うモデルのトークン費用は別途かかりますが、文字起こし1時間分(およそ2万〜3万字)の要約は数円から数十円の範囲です。単価は改定されるため、運用前に料金ページで最新の値を確かめてください。要約側のモデル選定はGPT-5.6とは|Sol・Terra・Lunaの3モデルと新機能・料金を実装目線で解説を参照してください。
トランスクリプトから議事録を作らせるプロンプト設計と出力形式
レコードモードやMeetingsの自動ノートも、APIで得たトランスクリプトも、そのままでは「話の要約」であって議事録ではありません。議事録に必要なのは決定事項と担当者と期限であり、雑談を削って構造化させる指示が別に要ります。ChatGPTの画面に貼る場合は次の形が使えます。
あなたは議事録作成の担当者です。以下の会議トランスクリプトから議事録を作成してください。
制約:
- 推測で補わない。トランスクリプトに無い内容は書かない。
- 発言者が特定できない決定事項は「発言者不明」と明記する。
- 雑談・脱線・あいさつは除外する。
出力形式:
1. 決定事項(決まったこと。1行1件)
2. TODO(担当者と期限。期限が言及されていなければ「期限未定」)
3. 未決の論点(次回に持ち越す争点)
4. 補足(数値・固有名詞・引用された資料名)
トランスクリプト:
"""
(ここに文字起こしを貼る)
"""
要は「推測で補わない」を先頭の制約に置くことです。これがないと、モデルは議事録らしい体裁を整えるために、実際には決まっていないことを決定事項として書きます。もう一つ効くのが、TODOの期限を「期限未定」と書かせるルールです。埋めさせずに空白のまま出させることで、会議後に「誰もいつまでにやるか決めていなかった」という事実が見えるようになります。
日本語の文字起こし精度について、OpenAIはレコードモードのヘルプで「現時点では英語が最も得意で、他言語の精度は改善中だがばらつく」と明言しています。固有名詞(社名・製品名・人名)は誤変換されやすいため、API側では前述の keywords で予防し、要約プロンプトにも社内用語の一覧を添えて表記ゆれを直させると、そのまま配布できる品質に近づきます。日本語音声に特化したモデルの選択肢を比較した記事はLFM2.5-Audio-1.5B-JPとは|1.5Bで7.7B級を上回る日本語音声モデルの性能と使い方です。
録音データの学習利用の条件と、録音前に参加者から取るべき同意
音声・トランスクリプト・ノートで異なる学習利用の扱いと保持期間
混同されやすいので分けて整理します。音声そのものは文字起こしにのみ使われ、直後に削除され、モデル学習には使われません。これは公式のヘルプに明記されている音声の扱いです。一方、文字起こしテキストと要約ノート(canvas)は通常の会話データと同じ扱いで、Plus・Pro・Freeでは設定の「Improve the model for everyone」がオンだと学習に使われる可能性があります。設定でオフにできます。
Business・Enterprise・Eduのワークスペースは、トランスクリプトとノートを含めて既定で学習対象外です。顧客情報や未公開の意思決定を含む会議を録るなら、個人のPlusではなくBusiness以上のワークスペースで運用するのが筋でしょう。保持期間は通常の会話と同じで、会話を削除すれば30日以内に削除されます(法的保持義務がある場合を除く)。「Reference record history」をオンにしている場合、削除したノートが参照されなくなるまで数日かかることがある点も覚えておきたいところです。
録音の同意に関するユーザー側の責任と、会議冒頭の告知を記録に残す運用
OpenAIは公式ヘルプで「他人を録音する際は現地の法律を確認し、適切な同意を必ず得ること。適用法の遵守はユーザーの責任」と明示しています。Meetingsのヘルプも、開始前に参加者全員へ告げて同意を得るよう求めています。日本法の解釈まで踏み込んだ記述はありません。実務上は、会議冒頭で「AIで文字起こしと議事録作成を行います」と口頭で告げ、その発言自体をトランスクリプトに残す運用が最も簡単で、後から同意の有無を確認できる形にもなります。社外との会議、特に海外拠点や欧州の相手が入る場合は、録音に事前の明示同意を要求する法域があるため、事務局側で先に確認しておく必要があります。
Notta・Otterなど専用ツールや自社開発との使い分け基準
レコードモード・Meetingsと専用議事録ツールは、置き換えの関係ではありません。判断軸は「自分がMacでその会議に出ているか」「音声を残す必要があるか」「Windowsやスマホが混ざるか」の3つです。
| 条件 | ChatGPT(録音・Meetings) | 専用ツール(Notta等) |
|---|---|---|
| 自分がMacで同席 | 適する | 適する |
| 自分は欠席・botだけ参加 | 不可 | 適する |
| Windows・スマホのみ | 不可(Meetingsは予定) | 適する |
| 音声を証跡として保存 | 不可(自動削除) | 適する |
| 要約から企画書・メールへ展開 | 適する | ツールによる |
| 追加コスト | 不要(既存プラン内) | 月額課金 |
ChatGPT側の強みは、要約ノートがそのままChatGPTの中に載っている点です。ノートを開いたまま「この内容で顧客向けのメール文面を書いて」「決定事項からプロジェクト計画に落として」と続けられ、コードのひな形まで書かせられます。「Reference record history」をオンにすれば、過去の録音ノートを別の会話から参照でき、前回の決定を踏まえた資料作成ができます。文字起こしの精度そのものを競うのではなく、文字起こしの後工程が手数なく繋がることが、月額を追加せずに得られる価値です。
逆に、議事録を組織の資産として蓄積し検索したい、複数人で共有・編集したいという要件は、レコードモードの守備範囲を超えます。Meetingsの共有機能で一部は埋まりますが、ベータでBusiness以上が前提です。法人での選び方の全体像はAI議事録・自動文字起こしとは?仕組み・精度・法人での選び方【2026年版】にまとめました。リアルタイム音声対話の基盤側の動きはGPT-Live-1とは?OpenAIのフルデュプレックス音声モデルの仕組み・Realtime APIとの違いと実装判断を解説【2026年7月版】で追えます。
さらに、録音を社内の案件管理やCRMに自動で登録したい、コールセンターや窓口の通話を毎日数百本処理したい、音声を社外に出さない構成にしたいといった要件になると、既製ツールの設定では届きません。前述のAPIスクリプトを土台に、保存先・権限・監査ログまで含めて業務システムへ組み込む段階です。一創ではAI音声認識システム開発として、文字起こしエンジンの選定から議事録・通話記録の自動化までを受託しています。
よくある質問
チャットGPTの録音は何分まで使えますか?
1セッションあたり4時間(240分)が上限です。上限に達すると録音は自動的に停止し、そこまでの内容から要約ノートが生成されてprivate canvasとしてアップロードされます。新しいMeetingsプラグインも4時間で自動停止します。一部の解説にある「最大120分」は現在の仕様と異なり、1日あたり・月あたりの回数上限は公式に記載がありません。
Windowsで ChatGPT record mode は使えますか?
使えません。公式ヘルプはmacOSデスクトップアプリのみと明記しており、Windowsアプリ・iOS・Android・ブラウザ版に録音機能はありません。Meetingsプラグインは「Windows対応はcoming soon」とされていますが、日付は未定です。Windowsで議事録を作るなら、標準のサウンドレコーダーや会議ツールの録画で音声を確保し、gpt-transcribeなどのAPIで文字起こししてからChatGPTに要約させる流れが現実的です。
無料プラン(Free)でChatGPTに議事録を作らせることはできますか?
録音機能はFreeとGoでは使えず、Meetingsも対象外です。ただし、他の手段で用意した文字起こしテキストを貼り付けて要約・整形させることはFreeでも可能です。無料で完結させたい場合は、端末のボイスレコーダーで録音し、無料枠のある文字起こしサービスでテキスト化し、そのテキストをChatGPTに投げる三段構えになります。
録音した音声はOpenAIに保存され、AIの学習に使われますか?
音声ファイルは文字起こしの直後に自動削除され、モデル学習には使われません。ただし文字起こしテキストと要約ノートは通常の会話と同じ扱いで、Plus・Pro・Freeでは設定の「Improve the model for everyone」がオンだと学習に使われる可能性があります。Business・Enterprise・Eduのワークスペースは既定で学習対象外です。
ChatGPTで議事録を作るやり方を3ステップで教えてください
Macで会議に同席しているなら、macOSアプリでRecord(Pro・BusinessならMeetingsのTake notes)を押して録音し、停止後に生成される要約ノートを整形するだけで完了します。それ以外の環境では、(1) 手元の機器や会議ツールの録画で音声ファイルを確保する、(2) gpt-transcribeなどのSpeech to text APIで文字起こしする(25MBを超える音声は分割)、(3) 得られたトランスクリプトを「決定事項・TODO・未決の論点」に構造化するプロンプトでChatGPTに整形させる、の3ステップになります。
関連記事
- 文字起こしAPIの比較と選び方|主要7サービスの料金・日本語対応・使い方【2026年最新】
- GPT-Live-Transcribeとは?OpenAIの低遅延ストリーミング文字起こしの実装手順とGPT-Transcribeとの使い分けを解説【2026年7月版】
- AI議事録・自動文字起こしとは?仕組み・精度・法人での選び方【2026年版】
- 会議ツール別のAI議事録|Zoom・Teams・Meet・Notionのプランと使い分け
- Notta Brainとは|会議データを資料・ナレッジに変えるAIエージェントの仕組み・料金・使い方【2026年最新】
- GPT-Live-1とは?OpenAIのフルデュプレックス音声モデルの仕組み・Realtime APIとの違いと実装判断を解説【2026年7月版】
- Codexの音声入力とは?App・CLIの2系統と設定方法・Windows対応を解説【2026年版】
- LFM2.5-Audio-1.5B-JPとは|1.5Bで7.7B級を上回る日本語音声モデルの性能と使い方
- GPT-5.6とは|Sol・Terra・Lunaの3モデルと新機能・料金を実装目線で解説