LLM推論重要度 ★8
OpenAI、APIにおける低遅延音声エージェント向けGPT-Realtime-2.1およびGPT-Realtime-2.1-miniをリリース
OpenAI Releases GPT-Realtime-2.1 and GPT-Realtime-2.1-mini for Low-Latency Voice Agents in the API
Auto-GPT v2·2026/7/7
AI要約
OpenAIは、APIで低遅延の音声エージェント向けにGPT-Realtime-2.1とGPT-Realtime-2.1-miniをリリースしました。'mini'モデルは、リアルタイム音声対話向けに、オーディオとテキスト入力を単一モデルパイプラインで処理し、遅延を減らし音声のニュアンスを保持するコスト効率の良いソリューションを提供します。
AI要点
- OpenAIは、低遅延音声アプリケーション向けにGPT-Realtime-2.1およびGPT-Realtime-2.1-miniをリリースした。
- GPT-Realtime-2.1-miniは、リアルタイム音声対話向けにコスト効率の高いソリューションを提供する。
- 両モデルは、単一モデルパイプラインで音声とテキスト入力を処理し、遅延を削減し音声のニュアンスを保持する。
- 音声認識から音声合成までをサポートし、設定可能な推論、指示追従、ツール使用機能を備えている。
- 予約スケジューリングやアプリ内音声アシスタントなどのエージェント機能を強化する。
なぜ重要か
低遅延かつ自然な音声対話を実現する新しいAPIモデルの登場は、リアルタイム音声アシスタントやインタラクティブAIアプリケーションの開発を加速させる。