GoogleはGemini Audioを更新し、新しい音声文字起こし機能「Gemini 3.5 Transcribe」を追加しました。
同機能は、専門用語などの語句を自動で検出しながら文字起こしを行うとしています。
また、85言語以上に対応し、多言語環境での性能を高めた点を強調しています。
Googleは、従来モデル「Chirp 3」と比べて多言語での品質と、誤った語句の割合(ワーディングエラー率)が改善したと説明しました。
さらに、利用者は声だけで自然に編集できるとしており、音声入力による修正を想定しています。
Gemini 3.5 Transcribeは、先に発表された「3.5 Live Translate」に続くGeminiファミリーの新機能です。
一方で、Googleが6月の提供開始を約束していた「Gemini 3.5 Pro」の公開はまだ待たれている状況です。
参照元:2026/08/27 「Google’s new AI transcription edits out your ‘ums’ and ‘ahs’」 https://www.theverge.com/tech/985186/google-gemini-3-5-transcribe-audio-ai
この記事へのリアクション
このニュースをどう受け止めましたか?



コメント