The Verge によると、Google は Gemini Audio を更新し、Gemini 3.5 Live、Gemini 3.5 Live Experimental、および Gemini 3.5 Transcribe というモデルを発表しました。新しい文字起こし機能は、専門用語と 85 以上の言語を認識します。

同メディアの報道によれば、これらのモデルは、背景雑音がある場合やユーザーの話が中断される状況において、Google の音声機能の精度を高めるように設計されています。また、The Verge の見出しでは、「えーと」や「あのー」といったフィラー語句の自動削除についても言及されています。

この更新の実用的な意義は、文字起こしの後処理の手間を減らし、特に専門的な環境における音声入力の利便性を高める点にあります。ただし、入手可能な資料はメタデータのみであり、品質テストの例、結果の詳細、またはリリースに関する詳細は含まれていません。