Innovative Tech
“スマホのマイクでこっそり盗聴”を妨害する技術 静かな音で会話内容を改ざん
Innovative Tech:
このコーナーでは、テクノロジーの最新研究を紹介するWebメディア「Seamless」を主宰する山下裕毅氏が執筆。新規性の高い科学論文を山下氏がピックアップし、解説する。
米コロンビア大学の研究チームが発表した「Real-Time Neural Voice Camouflage」は、不正なマイクが取得したユーザーの会話の言葉を正しく聞き取れないようにする攻撃を提案した論文だ。無線で妨害音を発し、自動音声認識(ASR)システムをリアルタイムに混乱させ、本来盗聴側が取得したい会話を間違った形で認識させる。80%の確率でユーザーの言葉を誤認識させられたという。
この妨害音は、その場にいるユーザーの邪魔にならないような静かな音に最適化されている。
スマートフォンやIoT、音声アシスタントまで、今日では多様な機器にマイクが埋め込まれており、それらは常に音を聞いている可能性がある。さらに、自動音声認識システムを使って会話を常に処理している可能性がある。
この課題に対し今回は、自動音声認識(ASR)システムに対してリアルタイムに妨害を行い、マイクで不正に取得された音声を正しく処理できないようにするアルゴリズムを提案する。会話を妨害音(適切なささやき声)でカムフラージュする方法を採用し、自動音声認識システムが文字起こしする多様な単語を混乱させ、間違った解釈へ導く。
このような自動音声認識システムの改ざんは、理論的には以前から知られていたが、実用に耐える速度で実現することが大きなボトルネックになっていた。その会話に対して、効果的に妨害できる妨害音の瞬間的な生成が難しく、リアルタイムに攻撃するのが困難であった。
そこでこの研究では、数秒先の会話を予測しそれに対して最も有効な攻撃を予測する、予測攻撃を導入する。予測攻撃は、2秒間の入力音声を条件として、その先の会話に対する効果的な妨害音を予測し継続的に生成する。これによって、リアルタイム性能を達成する。
この妨害音は、通常の背景雑音に近い音量に最適化されており、部屋にいる人々に妨害音に気が付かれないようにしている。最終的には妨害音を完全に知覚できないようにしたいという。
実験では、予測攻撃がDeepSpeech認識システムを大きく破壊できることを示した。LibriSpeechでは、この手法がベースラインよりも単語のエラー率が少なくとも3.9倍増加し、文字のエラー率が少なくとも6.6倍増加した。
Source and Image Credits: Chiquier, Mia, Chengzhi Mao, and Carl Vondrick. "Real-Time Neural Voice Camouflage."
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
なぜ酒蔵の許諾なしに? 「VTuberコラボ日本酒」騒動、主催者が経緯説明 仲介者による調整で「準備進んでいると認識」
-
2
かっぱ寿司「配布前のコラボグッズ、フリマで買わないで」 プリキュアコラボ発表日に注意喚起
-
3
「食事量は1日1200kcal以下、でも肥満」な人を14日間追跡調査 痩せない理由は……米コロンビア大などの研究
-
4
本物そっくり“AI生成レシート“が経費精算の脅威に マネフォ「自力で見破るのは難しい」 企業はどう備える?
-
5
「菜の花がおかしい」――イラストレーター制作うたうマラソン大会ポスターに指摘相次ぐ 事務局がAI使用明かす【訂正あり】
-
6
「ペンギンを返して」→「3匹全部採用して」 批判殺到のSuica新キャラ、ファンアートが空気を変えた? SNSの声
-
7
藤井風のリサイタル、公式サイトがインターネット老人会すぎると話題 公民館のチラシみたいだけど東京ドーム開催
-
8
松本デジタル相、24.6万件漏えい可能性について説明 「既知の脆弱性を対応前に悪用」
-
9
「iPhone Duo」純正ケース話題、「面白いけど高い」……1万4800円と2万4800円
-
10
「ランジェリーパープルじゃない」「買おうと思ってたのに」 iPhone 18 Pro/Pro Maxの色に落胆の声
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR