Abstrakte KI-Visualisierung fuer ein neues Sprachmodell

OpenAIは、フルデュプレックスボイスモデルGPT-Live-1を開発者に公開

2026年9月10日、OpenAIは、APIで利用可能なフルデュープレックスボイスモデルGPT-Live-1を作成しました。 ChatGPTの音声モードを出力する同じモデルは、開発者がカスタムボイスエージェントを構築できるようになりました。

一度にリスニング&スピーキング

従来のターンベースのボイス API とは異なり、GPT-Live-1 は音声の処理を続けます。 会話を中断することなく中層を中断できます。 OpenAIによると、モデルは、ネイティブのトランスクリプトを出荷し、検出を回し、バックグラウンドノイズの処理と電話ベースの展開のためのテレフォニーサポートを処理します。 発音時に声が鳴ります。

価格とトレードオフ

OpenAIの価格は1分あたり$ 0.05でアクセスしますが、それは音声層だけをカバーします。 バックエンドモデルは、推論がトップに請求されます。 1 つの洞窟: 前任者 GPT-Realtime-2.1 受け入れられた画像入力、利用できるレポートに従って機能 GPT-Live-1 低下。

Benchmarkはベンダーの要求です

OpenAIは、GPT-Live-1は、GPT-Realtime-2.1を超える30パーセンテージポイントで、社内の「Full Duplex Bench」の性能を向上させると述べています。 これはベンダーの数字です。独立した数字は起動時に使用できませんでした。 モデルが生産中のデモまで生きているかどうかは、サードパーティのテストの土地に一度だけクリアになります。

出典:OpenAI発表と報告 データ北 (として 10 Sept 2026).

コメントする

メールアドレスが公開されることはありません。 ※ が付いている欄は必須項目です

Mastodon
上部へスクロール