検索
ニュース

次世代技術「HBC」からスマートグラスを動かす「1bit AI」の限界と可能性まで――パーソナルデバイスの最新AI事情:Snapdragon Summit 2026(1/2 ページ)

Qualcommが開催した「Snapdragon Summit 2026」では、パーソナルデバイスにおけるオンデバイスAIの最前線が語られた。本稿では、スマートグラスなどで注目を集める「1bit AIモデル」の実用性と限界、そして次世代SnapdragonがどのようにAI処理へと最適化されていくのか、Qualcomm担当者の声とともに読み解く。

Share
Tweet
LINE
Hatena

 Qualcomm主催の「Snapdragon Summit 2026」では、最新の“AI”とそれを実現する半導体やソフトウェア技術についてさまざまな話題が語られた。今回は、特に興味深いと思った内容についてトピックを抽出して紹介したい。

Snapdragon Summit 2026が開催されたハワイ州マウイ島の夕暮れ
「Snapdragon Summit 2026」が開催されたハワイ州マウイ島の夕暮れ

1bit AIモデルで何が可能なのか?

 今回のSnapdragon Summitで興味を引いたデモの1つが、“スマートグラス”を使った物体認識だ。例えば、グラスをかけた状態で目の前に“リンゴ”を持ってくると、グラスは音声で“リンゴ(正確にはApple)”と答え、内蔵のカメラで実際に物体が何であるかを認識しているというもの。

 グラスにはQualcommの最新SoCである「Snapdragon AR1+ Gen 1」や「Snapdragon AR1 Gen 1」が搭載されており、これにPrismMLを組み合わせることで、いわゆる「1bit AIモデル」での画像認識を実現できているのだという。

スマートグラスで画像認識を行うデモンストレーション
スマートグラスで画像認識を行うデモンストレーション

 過去のレポートでも紹介してきたが、現在のTransformerをベースにしたAIモデルでは大量の行列演算を繰り返すことで推論を実現しており、この演算に用いる“値”の精度をFP8(浮動小数点)やINT8(整数)のような桁数(ビット数)で表している。

 最近ではINT4やINT2といった“値”での計算処理が用いられることがあるが、これはビット数がそれぞれ4bitまたは2bitといった単位で減少していることを意味する。ビット数が減少することで得られるメリットは、推論で用いるモデルのデータが、ビット数の減少幅に合わせてサイズが小さくなっていくことにある。

 例えば、INT8がINT4になることでサイズは半分になり、INT2であればINT8に比べて4分の1となる。演算処理もそれだけ軽くなるため、もしINT4やINT2に対応した演算装置がNPUやGPUといった“処理ブロック”に組み込まれていれば、処理の高速化が可能になる。

 一方でデメリットとしては、本来であれば得られる計算結果がビット数の減少によって失われ(丸め込まれる)、精度の低下として表れる。そのため、用途によってモデルや演算精度の使い分けが重要になるというのがAI推論での基本だ。

 そして、今回の1bit AIモデルだ。説明によれば、PrismMLの20億パラメータ(2B)を持つBonsai 2Bを使い、史上初のスマートグラス端末内でのローカル処理のみでマルチモーダル(視覚と言語処理)の1bit AIモデルを動作させることに成功したという。

 ポイントとしては、PrismMLのBonsai 2Bでは4bit AIモデル相当の推論が可能ながら、メモリ使用量が4分の1、トークン生成速度で2倍というパフォーマンスを実現している。つまり、前述の画像認識デモ(+音声ガイド)は1bit AIモデルで実行されたということを意味する。

 ただ前述のAI推論の基本に立ち返ったとき、1bit AIモデルでは何らかのトレードオフがあるわけで、実際この1bit AIモデルではどこまでのことが可能なのだろうか?

Snapdragon AR1 Gen 1
「Snapdragon AR1+ Gen 1」「Snapdragon AR1 Gen 1」とPrismMLのBonsai 2Bを組み合わせた1bit AIモデルをオンデバイスで実行

 本件に関してデモを紹介していた米Qualcomm TechnologiesでパーソナルAI担当SVP兼GMのジアード・アスガー(Ziad Asghar)氏は次のように語っている。

 「(1bit推論は)非常に重要であり、特にメモリ容量が非常に限られている小型デバイスでは、8bit AIモデルと比較してサイズだけで8分の1になり、(推論の実行に)1GBのDRAMが必要だったとして、1bit AIモデルでは125MBで済む。

 これにより、さまざまなデバイスでAI処理の実行が可能になる。他方で、1bit AIモデルでは精度が多少失われることになるものの、PrismMLではビット数を減少させても精度をかなり維持できるような独自のソリューションを持っている。必要なのは、これで何ができるかであり、AIによって視覚的な手がかりを得られることにある。

 例えば、実際に今この部屋で(スマートグラスに)質問をしたとして、ここにはたくさんの人がいて、その場所は自宅ではなくオフィスや会議室のような場所であると答えるだろう。これが外であれば、昼間で晴れているといった情報を教えてくれる。これがAIエージェントによる体験の向上で、もし実際に暗いレストランでメニューを翻訳したり、OCRを実行したりというのであれば、より高度なAI処理やカメラが必要になる。今、われわれがテーマにしているのは、いかに視覚情報をデバイスに取り込むかということにある」(アスガー氏)

ジアード・アスガー
Qualcomm TechnologiesでパーソナルAI担当SVP兼GMのジアード・アスガー氏

 つまり、スマートグラスに内蔵するタイプのAIモデルで求められるのは、スマートフォンなどに内蔵されているようなある程度の万能性を持ったAIモデルによるローカル処理ではなく、視覚情報などを取り込んでいかにユーザー体験を補助していくのかであり、そこにはスマートフォンなどとの役割の違いがあるという考えだ。

 同様に、同社でAI担当バイスプレジデントのヴァイネシュ・スクマー(Vinesh Sukumar)氏も1bit AIモデルの限界と、適した用途で使うことの重要性を説明する。

 「例えば、スマートグラスを使ってどのような機能が実現できるかを考えるべきであり、スマートグラス内に1GBのメモリしか搭載できないのであれば、そこでAI推論を動作させるには1bit AIモデルを使うしかないというのが実際だ。

 スマートグラスでも、『エアコンをつけて』『電気を消して』といったコマンドによる制御は可能であり、特にAIモデルを作成するための特別なトレーニングは必要ない。こういったシンプルなオン/オフはそれだけで充分役に立つが、仮に「2+2は?」「Strawberryという文字にrは何個含まれている?」といった質問に答えるのは非常に難しい。

 それはAI推論の世界であり、そもそもStrawberryという単語の意味を理解する必要がある。つまり、どれだけ訓練してもこうした問題の解決は1bit AIモデルには非常に困難であり、数年後には実現するかもしれないとしても、現状ではまだ最先端とはいえない。

 画像認識においても、写真を取り込んで処理はできても、その内容を分析して情報を返してくれるような仕組みは1bit AIモデルには難しく、ハイブリッドAIのような形でクラウドを組み合わせる必要がある。どのようなアクションを実行したいかによって、その目的に合わせてモデルを呼び出すことが重要だ」(スクマー氏)

ヴァイネシュ・スクマー氏
Qualcomm TechnologiesでAI担当バイスプレジデントのヴァイネシュ・スクマー氏

Copyright © ITmedia, Inc. All Rights Reserved.

       | 次のページへ
ページトップに戻る