Google、同時通訳に近い音声モデル「Gemini 3.5 Live Translate」発表 「Google翻訳」アプリなどで利用可能に
米Googleは6月9日(現地時間)、最新の音声モデル「Gemini 3.5 Live Translate」を発表した。話し終わりを待ってから訳す従来の方式とは異なり、話し手から数秒遅れながら継続的に音声を生成し、シームレスな同時通訳に近い体験を実現する。70以上の言語を自動検出し、話し手のイントネーションやペース、ピッチを維持したまま自然な合成音声で訳出するとしている。
展開は3つの層で同時に進む。開発者向けには「Gemini Live API」および「Google AI Studio」でパブリックプレビューとして提供を開始。企業向けには「Google Meet」で、一部のGoogle Workspace法人顧客を対象にプライベートプレビューが今月から始まり、年内にはより広範なロールアウトを予定する。一般ユーザー向けにはAndroidおよびiOSの「Google翻訳」アプリでグローバルに順次展開される。
「Google翻訳」アプリの「ライブ翻訳モード」を利用する際は、任意のヘッドフォンを接続することで、話し手のトーンを反映した同時通訳を70以上の言語で体験できる。加えてAndroid版では、ヘッドフォンを使わず端末の受話口から訳出音声を聞ける新しい「リスニング」のロールアウトも始まる。
Google Meetでは、既存の音声翻訳機能が「Gemini 3.5 Live Translate」ベースに刷新される。従来は英語との間で5言語のみに限られていたが、今回の更新で70以上の言語に対応し、1つの会議内で2000を超える言語ペアでの会話が可能になる。インタフェースも更新し、音声翻訳機能に素早くアクセスできるようにする。
Gemini 3.5 Live Translateはストリーミングで音声を処理しながら、文脈を待って品質を高めるか、即時に訳して話し手と同期するかのトレードオフを動的に調整するという。多言語入力を手動設定なしで扱えるほか、騒がしい環境にも対応するノイズ耐性を備える。Googleは応用先として、多言語の通話や会議、授業、ライブ放送などを挙げている。パートナーである配車サービスのGrabは、ドライバーと乗客の合流時のコミュニケーション向けにこのモデルをテスト中で、同社では月間1000万件超の音声通話が発生しているという。
なお、同モデルが生成する音声にはすべて電子透かし技術「SynthID」が埋め込まれ、AI生成コンテンツであることを検出可能にしている。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
「Xが情報収集に役立たない……」熊本地震で不満の声続出 「Twitterを返して」
-
2
メルカリ、梨の転売疑惑に「盗品の出品は確認されず」 誹謗中傷には利用制限も
-
3
はてな、11億円流出の調査報告書を公開 偽警察、口外禁止、残業・休出200時間超、孤立……ほころびが連鎖
-
4
「こんなのに追われたら……」急斜面もやすやす爆走、中国製の車輪付き四足ロボのデモ動画が話題 最高時速20km超
-
5
検索結果に「詐欺ではありません」と表示させる詐欺手口、警視庁が注意喚起 AI要約も餌食に
-
6
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
7
Z世代に聞く次の流行、「AIイラスト」が1位に 「Claude Code」も上位
-
8
「痺れるほどにミスを繰り返す」Gemini 3.6 Flashは変わった? 公開から1週間、当初のおバカ回答を今検証する
-
9
NVIDIAやMicrosoftなど30社超、オープンAIの防御ツール共同開発の「Open Secure AI Alliance」設立
-
10
東野圭吾さん死去、Xなどで追悼相次ぐ 「ガリレオ」など数々の人気作、エンジニアから転身
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR