AI注目記事のキュレーターページ

← 一覧へ戻る

重要度 高2026-07-08 17:00:00

OpenAI、より自然な会話を実現する新しい音声モデルを発表

サマリー

OpenAIは新しい音声モデルGPT-Live-1とGPT-Live-1 miniを発表し、より自然な会話を実現しました。これにより、ユーザーは自然に会話を続けることができ、ライブ翻訳などの機能も利用可能です。音声が複雑な作業の主要なインターフェースになる可能性が示唆されています。

本文

OpenAIは本日、GPT-Live-1およびGPT-Live-1 miniと呼ばれる新しい会話モデルを発表しました。これらのモデルは、より自然な音声を実現し、会話のターンテイキングをよりスムーズに処理できるとしています。これらはフルデュプレックスモデルであり、同時に話し、聞くことができるため、ユーザーが自然に割り込むことができ、ライブ翻訳などの機能を可能にします。

OpenAIは、ChatGPTの現在の高度な音声モードをデフォルトでGPT-Live-1 miniに置き換えます。有料プランのユーザーは、より大きなGPT-Live-1モデルにアクセスできます。従来のモデルは、音声を文字に変換する音声認識モデル、応答を生成する大規模言語モデル、最終的な回答を提供するテキスト音声変換モデルを組み合わせていました。

新しいモデルは、ユーザーが話している間に割り込む問題や、質問に対する知識不足を解決することができるとOpenAIは述べています。新しい音声モデルは、会話を続けながら、最新のテキストモデル(GPT-5.5など)にクエリを送信し、検索や推論、エージェント機能を提供します。また、モデルは長時間沈黙を保ち、会話の文脈を吸収することができ、必要に応じて呼び出されます。新しい音声モードは、視覚的な情報を提示することも可能です。

OpenAIは、音声が複雑な作業に対する主要なインターフェースになると考えています。音声機能を使った30〜40分の会話が可能であることを示しました。競合他社もアシスタントをより表現豊かにするための取り組みを行っています。AppleやAmazonは、より会話的で文脈を理解するアシスタントにアップデートしています。OpenAIは、ユーザーが手を使わずに長時間アシスタントと会話できるようにすることを目指しています。新しい音声モードは、年齢に応じた応答を提供するための安全策が組み込まれていますが、AIのコンパニオンを目指しているわけではありません。デモ中にヒンディー語のライブ翻訳機能を示した際、アシスタントの発音が不自然であったことも報告されています。

Contact us

ご質問・ご相談等ございましたらお気軽にご相談ください。

  • フォームでのご相談
    フォームでのご相談

    ホームページ制作、運用・更新における
    ご相談はお気軽にご連絡ください。

    お問い合わせ・ご相談
  • お電話でのお問い合わせ
    お電話でのお問い合わせ

    お電話でのご相談も随時受け付けております。
    見積依頼などもお気軽にご連絡ください。

    052-700-8712 平日 10:00~19:00