公開日:
この記事の結論
ChatGPT VoiceにGPT-Live-1が入り、音声会話は「AIの返事を待つ」形から「途中で話を変えながら相談する」形に近づきます。
OpenAIの2026年7月8日リリースノートでは、PaidユーザーはGPT-Live-1、FreeユーザーはGPT-Live-1 miniと案内されています。
画面共有やビデオ共有はGPT-Live-1では現時点非対応なので、そこだけ混ぜないほうが安全です。
この記事は、ChatGPTの音声機能を仕事・学習・生活の相談に使いたい人向けです。
開発者向けAPIの知識がなくても読めます。
ChatGPT GPT-Live-1とは?何が変わった?
GPT-Live-1は、ChatGPT Voiceを動かす新しい音声モデルです。
OpenAIは2026年7月8日のChatGPT Release Notesで、ChatGPT VoiceにGPT-Live-1を順次展開すると発表しました。
ここが大きい。
一番の変化は、AIが「聞く」と「話す」を同時に扱える点です。
従来の音声AIは、こちらの発話が止まった瞬間を「回答開始の合図」と誤解しがちでした。
GPT-Live-1では、途中で言い直す、条件を変える、相手の返答中に割り込む、という会話のズレが減ります。
3分で終わる一問一答より、5分かかる予定整理のほうが差が出ます。
さらに公式リリースノートでは、GPT-Live-1が通常のChatGPTチャット内で動き、音声の返答と一緒にテキストも流れると説明されています。
音声だけだと聞き逃しが残りますが、文字が残るなら後で見返せる。
私はこの点が一番実用的だと思います。
| 比較軸 | 従来の音声AIで困りがちなこと | GPT-Live-1で変わる点 |
|---|---|---|
| 会話の間 | 少し黙るとAIが返答を始める | 聞くことと話すことを同時に扱い、割り込みや言い直しに強くなる |
| 見返し | 音声で聞き流すと戻りにくい | 音声返答とストリーミングテキストが同じチャットに出る |
| 情報の扱い | 音声会話だけで閉じやすい | Web検索、メモリ、対応ウィジェット、テキスト、画像を同じ会話で扱える |
| 対象環境 | プランやアプリで差が出る | chatgpt.com、iOS、Androidに順次展開される |
GPT-Live-1とGPT-Live-1 miniの違いは?
OpenAIの案内では、PaidユーザーにはGPT-Live-1、FreeユーザーにはGPT-Live-1 miniが使われます。
つまり、今回のVoice更新は有料プランだけの話ではありません。
無料ユーザーにもmini版が入る。
この広がりはかなり大きいです。
ただし、公式リリースノートは性能差の細かい数字までは出していません。
この記事では「有料は通常版、無料はmini版」というプラン上の違いだけを扱います。
速度、精度、音質の差を数字で断定するには、OpenAIの追加資料か実機画面の確認が必要です。
1往復の質問より、10回くらい話が揺れる相談向きです。
| 項目 | 公式発表上の扱い | 私の見方 |
|---|---|---|
| Paidユーザー | GPT-Live-1 | 音声相談をよく使う人の本命 |
| Freeユーザー | GPT-Live-1 mini | まず試す入口として十分に意味がある |
| 展開先 | chatgpt.com、iOS、Android | スマホだけでなくWebでも確認したい |
| 展開方式 | 対応地域に順次展開 | 見えない日があっても即不具合とは限らない |
GPT-Live-1で最初に試す使い方は?
最初に試すなら、短い質問ではなく「話しながら条件が変わる相談」が向いています。
GPT-Live-1の売りは、単に声が自然になることではありません。
途中で割り込めることです。
私なら、予定整理か企画出しで試します。
天気を聞くような1問1答だと、旧Voiceとの差が分かりにくい。
会話が曲がる場面で見るのが早いです。
- STEP1: ChatGPTアプリを最新版に更新するか、chatgpt.comを開く。
- STEP2: 通常のチャットでVoiceを開始し、「私が話し終わるまで短く相づちだけで聞いて」と伝える。
- STEP3: 予定、買い物、企画案などを1〜2分話し、途中で条件を変える。
- STEP4: 必要なら画像やテキストを同じチャットに足し、音声返答とテキストの残り方を見る。
会議前の15分で論点を声に出す用途は、かなり相性がいいです。
試すプロンプトは、たとえばこれで十分です。
週末の予定を一緒に整理したいです。
私が話している間は短く相づちだけで聞いて、最後に優先順位を3つにまとめてください。
途中で条件を変えるので、そのたびに組み直してください。
この使い方だと、途中で「土曜の午前は使えない」「移動時間は30分以内にしたい」みたいな変更を入れられます。
音声AIの本当の価値は、きれいな返答よりも、会話中の変更にどれだけ耐えるかです。
仕事で使うならどこが便利?
仕事で効くのは、メモを打つ前の「声出し整理」です。
文章にする前の考えは、だいたい順番がぐちゃぐちゃです。
私はここにGPT-Live-1の価値が出ると思います。
公式リリースノートでは、GPT-Live-1がWeb検索、メモリ、対応ウィジェット、テキスト、画像を同じ会話で扱えると説明されています。
つまり、声で話しながら「さっきの条件で検索して」「この画像も見て」「表で出して」に近い流れを作れるわけです。
かなり実用寄り。
2分の雑談より、20分の条件整理で価値が出るタイプです。
- 会議前に論点を声で吐き出し、最後に3項目へまとめる
- 移動中に買い物リストや予定を口頭で作る
- 語学練習で、途中の言い直しや言葉の詰まりを含めて会話する
- スクリーンショットを足して、音声で条件を補足する
ただし、顧客名、住所、売上、社内の未公開情報を声に出す場面は注意です。
音声入力のリスクは、AI側だけではありません。
周囲に聞こえるリスクもあります。
GPT-Live-1でできないことは?
一番混ぜやすいのが、ビデオ共有と画面共有です。
OpenAIは、GPT-Live-1が現時点でvideo or screen sharingをサポートしないと明記しています。
ここは注意。
画面を見せながら相談したい人は、対象ユーザー向けにAdvanced Voice Modeを引き続き使う形になります。
GPT-Live-1は「声の会話が自然になるアップデート」であって、「スマホ画面やカメラ映像を見せる機能の置き換え」ではありません。
また、ChatGPT Business、Enterprise、Eduのワークスペースでは、ローンチ時点で利用できないと案内されています。
個人のChatGPTでは見えるのに、職場アカウントでは出ない。
このパターンは普通にありえます。
| 確認したいこと | 見る場所 | 判断 |
|---|---|---|
| Voice更新が来ているか | ChatGPTアプリまたはWeb | 順次展開なので日を置いて確認 |
| 職場アカウントで使えるか | Business / Enterprise / Edu workspace | ローンチ時点では対象外 |
| 画面共有やビデオ共有を使いたいか | Voice機能の表示 | GPT-Live-1ではなくAdvanced Voice Mode側を確認 |
Realtime APIの話とは何が違う?
ここは過去の音声AI記事と混ざりやすいところです。
Realtime APIは、開発者がアプリやサービスに低遅延の音声AIを組み込むための話です。
今回のGPT-Live-1は、ChatGPT Voiceを使う一般ユーザー側の話。
これは混ぜない。
もちろん、どちらも音声AIという大きな流れには入ります。
ただ、読むべき人が違います。
コードを書いて音声アプリを作りたいならRealtime API。
ChatGPTアプリで声の相談を使いたいならGPT-Live-1です。
私の見方では、非エンジニアが見るべきポイントはモデル名よりも「会話中に検索・メモリ・画像・テキストへ移れること」です。
モデルの中身を追うより、毎日の相談がどれだけ楽になるかで判断したほうがいいですね。
よくある疑問
無料プランでもGPT-Live-1は使えますか?
無料ユーザーにはGPT-Live-1 miniが使われるとOpenAIが案内しています。
通常版のGPT-Live-1はPaidユーザー向けです。
ChatGPT BusinessやEnterpriseでも使えますか?
ローンチ時点では、ChatGPT Business、Enterprise、Eduのワークスペースでは利用できないと発表されています。
個人向けプランと職場向けワークスペースは分けて見たほうが安全です。
画面共有しながらGPT-Live-1で話せますか?
GPT-Live-1は現時点でビデオ共有や画面共有をサポートしません。
画面やカメラを見せたい場合は、Advanced Voice Mode側の対応状況を確認してください。
何を最初に試すと違いが分かりますか?
予定整理、企画出し、語学練習のように、途中で言い直しや条件変更が入る相談が向いています。
単発の質問だけだと、GPT-Live-1らしさが見えにくいです。
このページに出てきた言葉
- GPT-Live-1
- ChatGPT Voiceを支える新しい音声モデル。Paidユーザー向けに順次展開されます。
- GPT-Live-1 mini
- Freeユーザー向けに案内されている軽量版の音声モデルです。
- ChatGPT Voice
- ChatGPTと声で会話する機能です。今回の更新で、音声返答とテキスト表示が同じチャット内で扱われます。
- Advanced Voice Mode
- ChatGPTの高度な音声機能です。GPT-Live-1で非対応のビデオ共有や画面共有が必要な場合に確認する候補です。
- Realtime API
- 開発者が音声AIを自作アプリへ組み込むための仕組みです。今回の記事の主題であるChatGPT Voiceとは用途が違います。
参考リンク
※この記事の内容は執筆時点のものです。AIは進化が速い分野のため、最新の仕様は公式サイトでご確認ください。