OpenAI、新世代音声モデル「GPT-Live」発表 ChatGPT音声を全面刷新

OpenAIは新世代の音声モデル「GPT-Live」を発表した。人間同士の会話に近い自然なやり取りを実現するモデルであり、ChatGPTの音声体験を刷新するものだ。

https://openai.com/index/introducing-gpt-live/

GPT-Liveは「フルデュプレックス」と呼ばれるアーキテクチャを採用している点が特徴である。従来の音声モデルが発話と聞き取りを交互に処理していたのに対し、GPT-Liveは音声入力の処理と出力の生成を同時に行う。これにより、相づちを打つ、会話に割り込む、沈黙して相手の発話を待つといった、より人間らしい対話の間合いを実現するという。

また、GPT-Liveは対話の進行を担う一方、ウェブ検索や高度な推論、複雑な作業が必要な場面では背後で最新のフロントティアモデルに処理を委譲する仕組みを備える。発表時点ではGPT-5.5が用いられており、会話のテンポを保ったまま裏側で処理が進む。今後もフロントティアモデルの更新に応じて、背後で稼働するモデルを継続的に更新するとしている。

OpenAIは「GPT-Live-1」と、より軽量な「GPT-Live-1 mini」の2種類を、ChatGPTユーザー向けに世界規模で展開を開始した。API経由での提供も準備中で、開発者や企業向けの通知登録も受け付けている。なお発表時点では、ChatGPT上での映像通話や画面共有との組み合わせには対応していない。

関連記事

最新ニュース記事

  1. 医療機関のキャッシュレス利用56%に 希望は78%、若年層では「病院選び」にも影響

  2. GMOフィナンシャルゲートとローソン、LINE活用の飲食注文実験開始 オフィス配送と店舗受取に対応

  3. LINEヤフー、Yahoo!ニュースのエキスパート知見をAIで提供 「Agent i」に第一弾「ふらおレシピ」搭載

  4. 介護現場に今も残る「大量FAX」、生成AIは事務負担をどこまで減らせるか

  5. Cursor開発元アニースフィア、コードホスティング新サービス「Origin」提供開始 GitHub連携も

  6. 駅前留学NOVA運営元、AI英会話アプリ「AI留学」提供開始 24時間スピーキング練習に対応

  7. グーグル、コーディング特化の新モデル「Gemini 3.7 Flash」公開 開発ベンチマークで大幅向上

  8. メタ、オープンウェイトAI「Muse Glimmer」公開 300億パラメータで手元のPC稼働を想定

  9. アンソロピック、Claude Coworkに「スキルを記録」機能 画面操作の実演を再利用可能な自動化へ

  10. グーグル、AIエージェント「Gemini Spark」を日本のAI Proユーザーへ拡大 24時間体制でタスク代行

365AIニュースセンター最新記事

  1. 不登校からの復学へ!お子様の心を動かす7つのきっかけ

  2. 入学できないことも?「フリースクール入学拒否問題」の現実とその対処法

  3. フリースクール中学校・通信制高校生の卒業後の進路:進学以外の就職という選択肢

  4. 中学生の不登校、30万人突破 – 教育現場の危機と新たな希望

  5. 【専門家が伝える】不登校のお子様を持つ親御様の「心の荷」を軽くする5つのヒント

  6. 不登校脱出への道?フリースクールの魅力と注意点-親子で考える新たな一歩-

  7. Amazonが「プライムデー夏祭り」を六本木で開催!

  8. 甘いとうもろこしとフライドチキンの絶妙コンビ。夏限定!「もろこしチーズバーガー」新登場