AIToday
大規模言語モデルThe Verge AI掲載日時: 2026年8月27日 4:002分で読める

GoogleがGemini 3.5 Transcribe発表、「えーと」除去

LINEで送る
GoogleがGemini 3.5 Transcribe発表、「えーと」除去

要点

  • GoogleがAI文字起こしモデル「Gemini 3.5 Transcribe」を発表した。

  • 85以上の言語を検出し、「えー」などの冗長語を除去できる。

  • 本日よりmacOSユーザーとAndroidのRamblerユーザー向けに提供開始。

3つのポイント

  1. 何が起きたか

    Googleは新たなAI文字起こしモデル「Gemini 3.5 Transcribe」を発表した。85以上の言語と専門用語を検出でき、「えー」「あのー」などの冗長語を除去し、テキストを自動整形する。

  2. なぜ重要か

    既存の3.5 Live Translateに続く発表で、6月に提供予定のGemini 3.5 Proを待つユーザーにとって注目の動きだ。Googleは前世代モデルChirp 3と比べ、多言語性能と語彙誤り率で大幅な進歩を遂げたと主張している。

  3. 注目点

    本モデルは本日より、macOS版Geminiアプリの全ユーザーと、一部の国でAndroid版のRambler音声入力機能向けに英語で提供開始。開発者向けにはGemini API、AI Studio、Antigravityでパブリックプレビューを公開する。Chrome対応も近日中に予定されている。

この記事についてAIに質問する →

背景と解説

Gemini 3.5 Transcribeの投入は、GoogleのAI音声処理における前進だ。3.5 Live Translateのリリースに続き、待望のGemini 3.5 Proに先駆ける形となる。新モデルは語彙誤り率の低減と多言語性能の向上を目指し、Chirp 3の後継と位置づけられる。カスタム語彙に対応し、最大3話者までの発言を識別できる点は、正確な専門用語の文字起こしを求める業務ユーザーに訴求しそうだ。ただし発表内容はやや混乱しており、当初は3.5 Liveと3.5 Live Experimentalのアップデートに言及しながら、後に本日投入されるのは3.5 Transcribeのみと訂正された。追加の音声認識機能は、延期されているGemini 3.5 Proとともに提供される可能性が高い。

よくある質問

Gemini 3.5 Transcribeはどの言語に対応していますか?
専門用語と85以上の言語を自動検出できます。
Gemini 3.5 Transcribeを利用するにはどうすればよいですか?
本日より英語で、macOS版Geminiアプリの全ユーザーと一部の国でAndroid版Rambler音声入力機能向けに提供開始。開発者はGemini API、AI Studio、Antigravityを通じてアクセスできます。
The Verge AI元記事を読む

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へSageMaker SDK v3がBYOMを簡素化