LLM推論3本の記事が同じ件を報じた初出 8/27 04:19
Google、AI搭載の音声認識「Gemini 3.5 Transcribe」を発表
Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text
https://arstechnica.com/feed2026/8/27
AI要約
Googleは、AIを活用した音声認識技術であるGemini 3.5 Transcribeを発表した。これは、AIによる高精度な文字起こしを可能にする技術である。
AI要点
- GoogleがAI音声認識モデル「Gemini 3.5 Transcribe」を発表しました。
- このモデルは、音声認識の精度を向上させ、「ウム」などの言い淀みや言い直しを自動で編集・除去します。
- 旧モデル「Chirp 3」と比較して、処理速度が約70%向上し、エラー率が5.5%に低下したとされています。
- Gboardの「Rambler」機能やGeminiアプリで既に利用可能で、今後Googleエコシステム全体に展開される予定です。
なぜ重要か
Gemini 3.5 Transcribeの登場は、音声入力の利便性と精度を大幅に向上させ、AIによる音声認識技術の進化と普及を加速させる可能性があるため。