ニュースに戻る
製品AI Understanding ブリーフィング

OpenAI が開発者向けに GPT-Live-1 音声モデル API をリリース

OpenAI は、全二重音声モデル GPT-Live-1 を API 経由で利用できるようにし、開発者が中断処理を改善して同時に聞きながら話すことができるアプリケーションを構築できるようにしました。

4 min readRead the original reporting
Source-provided image accompanying OpenAI releases GPT-Live-1 voice model API for developers
帰属に応じたレポート記録されたソース
出版社
theregister.com
ソースリンク
theregister.comhttps://www.theregister.com/ai-and-ml/2026/09/10/openai-arms-devs-with-ai-conversation-tool-that-can-talk-and-listen-at-the-same-time/5295708
ソースの種類
報道機関による報道であり、自社の文書ではありません。

独自に確認できなかったもの: この主張は、指定されたアウトレットに起因します。第三者の文書と照合して検証しませんでした。 (theregister.com)

コンテキスト60秒で理解できる

ここから始めましょう

重要な用語

API(アプリケーションプログラミングインターフェース)
あるソフトウェア システムが別のシステムにリクエストを送信し、別のシステムからの応答を受信するための構造化された方法。
ベンチマーク
モデルのパフォーマンスを測定および比較するために使用される標準化されたテストまたはデータセット。
レイテンシ
リクエストを送信してからモデルの出力を受信するまでの時間。
自分自身をテストしてくださいAI モデルの説明クイズ

何が起こったのか

OpenAI は、最新のリアルタイム全二重音声モデルである GPT-Live-1 の API を開始しました。これにより、開発者は同時リスニング機能とスピーキング機能をアプリケーションに統合できるようになります。 ChatGPT インターフェイス内で 7 月にデビューしたこのモデルは、外部開発でアクセスできるようになり、以前の Realtime API バージョンと比較して割り込み処理が改善され、レイテンシーが短縮されています。

OpenAI は、ソフトウェアによる音声の聞き取りと生成を同時に可能にするリアルタイム全二重音声モデルである GPT-Live-1 の API をリリースしました。この機能は、ユーザーが応答する前に AI が話し終わるまで待たなければならなかった以前のシステムの半二重の制約を超えています。このモデルは当初、7 月に ChatGPT インターフェイスを通じてのみ利用可能でしたが、現在は API 呼び出しを通じて開発者に公開されています。

同社は、Speak というパートナーからの初期の評価を引用し、スムーズな中断処理を主要な強みとして強調しています。これらの評価では、GPT-Live-1 は以前のターンベース システムと比較して中断を 80% 近く削減し、AI が応答する前にユーザーが考える時間を増やすことができることを示しました。このモデルは、情報検索やツールの使用などの複雑なタスクのために GPT-6 Astra などのバックエンド モデルと連携して動作するように設計されています。

パフォーマンス ベンチマークでは、OpenAI の以前のリアルタイム API に比べて大幅な改善が示されています。音声による顧客サービス タスクをテストする Tau3 音声エージェント インテリジェンス ベンチマークでは、GPT-Realtime-2.1 の 45.7 パーセントと比較して、GPT-Live-1 のスコアは 86.2 パーセントでした。 OpenAI はまた、全二重ベンチ メトリクスのパフォーマンスが 30% 向上し、ターンテイク レイテンシが改善されたと主張しています。

Yelp は現在、AI 主導のレストラン予約システムである Yelp Host サービスに GPT-Live-1 を使用しています。 Yelp の最高製品責任者は、このテクノロジーにより通話がより会話的で応答性が高くなり、レストランが収益機会を獲得できるようになり、スタッフがゲストに集中できるようになると述べました。 API の具体的な料金は、バックエンド モデルのコストを除き、使用量あたり 0.05 ドルで、OpenAI の営業チームを通じてカスタム音声を利用できます。

ソースの詳細: theregister.com ↗

なぜそれが重要なのか

このリリースでは、開発者がビジネス アプリケーションで自然で流動的な音声対話を作成するための障壁が低くなります。このモデルは全二重通信を可能にすることでターンベース システムの摩擦に対処し、顧客サービス、教育、その他の会話ワークフローにおけるユーザー エクスペリエンスを向上させる可能性があります。以前のモデルと比べて文書化されたパフォーマンスの向上は、実際の音声 AI 導入における大幅な前進を示唆しています。

The availability of a full-duplex voice model via API is a significant development for developers building conversational interfaces. It enables more natural human-like interactions, which can be critical in customer-facing applications where responsiveness and fluidity impact user satisfaction.

The reported performance gains, particularly in interruption handling and scores, suggest that voice AI is becoming more robust and reliable for real-world business use cases. This could accelerate the adoption of voice-first interfaces in sectors like retail, hospitality, and education.

By offering a clear pricing structure and integration with its enterprise platform, OpenAI is positioning this tool as a practical solution for businesses looking to enhance their digital customer experience. The collaboration with Yelp provides a concrete example of how the technology can be applied to solve specific business problems, such as managing phone reservations.

Interactive Mechanism

インタラクティブなメカニズム: 実際にどのように機能するか

この開発の背後にある基盤となるテクノロジーをインタラクティブに探索します。

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
インタラクティブコンセプトチェック+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

次に見るべきもの

Yelp のような早期導入企業が実稼働環境にテクノロジーをどのように実装しているか、報告されたパフォーマンス指標が独立したテストに耐えられるかどうかを監視します。 API が成熟するにつれて、より広範な企業での導入や、価格設定やカスタム音声オプションの更新の可能性を注視してください。

Independent verification of the performance claims, particularly the 80 percent reduction in interruptions and the scores, will be important to assess the real-world impact of the model.

The extent to which other major companies adopt GPT-Live-1 for their own voice services will indicate the model's market traction and competitive advantage over other voice AI solutions.

Potential updates to the API, such as new features, pricing adjustments, or expanded language support, could further influence its adoption rate among developers and enterprises.

関連ガイドとクイズ

AI モデルの説明AIエージェントAIとは何ですか?あなたが知っていることをテストする - 無料の AI クイズに挑戦してください用語集で AI 用語を検索するAI モデル リリース トラッカーをフォローする
これは役に立ちましたか?