コンテンツへスキップ
AI1 min read

Google、フィラー音を自動削除する音声認識モデル「Gemini 3.5 Transcribe」を発表

出典: 「あー」「えー」などを自動削除しつつリアルタイムで文字起こししできる音声認識モデル「Gemini 3.5 Transcribe」をGoogleが発表

Googleが新しい音声認識モデル「Gemini 3.5 Transcribe」を発表した。このモデルは、話し言葉特有のフィラー音(「あー」「えー」など)を自動的に削除しつつ、リアルタイムで文字起こしを行う機能を備えている。ノイズや複雑な専門用語、話し言葉にも対応し、生の音声データから正確で書式設定済みのテキストを生成できる。会議の議事録作成やインタビューの文字起こしなど、実務での活用が期待される。音声認識技術の実用性が大きく向上する進化と言えるだろう。

本記事は外部記事の要約です。原典は次のリンクを参照してください。

https://gigazine.net/news/20260827-gemini-3-5-transcribe/