「Jev」とは “文章を書かないAI”がなぜ話題に? 元OpenAI研究者が開発、「“スマートなif文”と考えてみて」(1/2 ページ)
米スタートアップのTypeSafe AIが9月15日(現地時間)に発表したAIモデル「Jev」(ジェヴ)が、海外や日本のAIコミュニティで大きな注目を集めている。創業者であるディオゴ・アルメイダ氏の発表はX上で3700万回以上表示されている(9月20日時点)。
JevはChatGPTのように「会話するAI」ではない。その代わり、ユーザーが決めた質問や選択肢に対して「判断」だけを構造化データ(JSON)として出力するのが特徴だ。同社はこれを「System One モデル」という新しいカテゴリだとし、既存のLLMに同じタスクをさせた場合に比べて「20~200倍速く」「40~1000倍安い」と主張している。
同社はJevへの早期アクセスのウェイトリストを受け付けている。9月19日時点では、ウェイトリストに登録すると半日程度でアクセス権が付与されるとともに、5ドル分のクレジットがチャージされた。
この記事では、Jevとは何か、LLMとはどう違うのかなどを整理する。
「文章」ではなく「判断」を返すAI
Jevは、同社が約2年の開発を経て公開した初のAIモデル。LLM(大規模言語モデル)ではなく「System One モデル」という新しいカテゴリにおける初のモデルだとしている。System Oneという名前の由来は、心理学者で行動経済学者のダニエル・カーネマンの著書「ファスト&スロー」に出てくる単語にちなむ。
同著では心の働きを「速い思考のシステム1」と「遅い思考のシステム2」に分け、システム1は印象や直感、感情といった、常時稼働する思考回路だとしている。システム2は1からの提案を受けて注意深く監視や承認、却下などを行う。
LLMの多くは、テキストを単語(トークン)単位で1つずつ生成する。これに対しJevは、あらかじめ定義した型に沿った値を、確率と確信度付きで一度に出力する。
Jevに入力できる質問は以下の3種類だ。
- Choice:選択肢(最大255個)から1つを選ぶ。 例:移動手段にどれを選ぶべきか。徒歩 or 自動車 or 飛行機
- Score:指定した範囲の数値を返す。 例:セキュリティインシデントの重大度
- Noul:はい/いいえの確率を返す。 例:この文章の言語は日本語か
Noul以外では回答に加えてその確率だけでなく、確信度も返す。開発者は「確信度がいくつ以上ならそのまま処理に回す。それに満たないならLLMや人間などに送る」といった場合分けができることになる。そのため、同社は「スマートなif文だと考えてほしい」としている。
学習には「RLCD」(キャリブレーションした判断のための強化学習)という独自の手法を使うことで、確信度が高いほど実際の正答率も高くなるように調整したという。
したがって、想定用途はLLMのようなチャットではなく、問題の振り分けや優先度付け、AIエージェントの出力チェック、大量データの分類など。デモでは、約100ミリ秒ごとに操作を判断してシューティングゲーム「DOOM」をプレイさせる様子や、Wikipediaのリンクをたどって目的のページに到達する「Wikiレーシング」でLLMを圧倒する様子などを公開した。
「Jev」の名は、経済学者ウィリアム・スタンレー・ジェヴォンズにちなむ。同氏は、蒸気機関の効率化がかえって石炭の需要を増やした「ジェヴォンズのパラドックス」で有名。それと同様に、AIもコストが下がるほどに新たな用途が増えると同社は見込んでいる。
作ったのは元OpenAI研究者で「InstructGPT」の共著者
創業者のアルメイダ氏は元OpenAIの研究者で、ChatGPTの前身にあたる「InstructGPT」論文の共著者だ。
アルメイダ氏はXのプロフィールで「ChatGPTを共同発明した」としているが、正確にはInstructGPT論文の約20人の共著者の1人であり、RLHFの手法自体は2017年の別チームの研究にさかのぼる。
アルメイダ氏自身は「(AI)モデルは何年も前からチャットで人間を超えているのに、それに見合う自動化はどこにあるのか」と問い、米The Registerに寄せた声明では「人間だけが知能の消費者であってはならない」とJevの狙いを語っている。
LLMと比べてどれだけ安くて速い? 「ハルシネーションを起こさない」は本当か
TypeSafe AIが公表した、LLMのフロンティアモデルと比べたときのJevの主な数値は以下の通り。
| 項目 | LLM | Jev |
|---|---|---|
| 応答時間 | 数秒〜数分 | 70〜500ミリ秒 |
| 出力 | 文章・コード | 型付きの判断+確率 |
| 入力単価 | 0.20〜10ドル/100万トークン | 0.042ドル/100万トークン |
| 出力単価 | 入力の5倍程度 | 無料(計測できないほど低コスト) |
| 型エラー(スキーマ外の出力) | 起こり得る | 0%(構造上不可能) |
同社の自社ワークフロー評価では、米OpenAIの「GPT-6 Astra」や米Anthropicの「Claude Fable 5.1」などのフロンティアモデルと比べて「193.6倍速く、444.6倍安い」としている。
ここで話題になっているのが、「Jevは文字列生成機能を持たない代わりに、構造化された出力に特化しており、幻覚(ハルシネーション)を起こすことがない」と同社が主張していることだ。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
経営「AIでラクして早く帰って」→社員「帰らない」 工数最大9割減のDeNAも悩むAI効率化の壁
-
2
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
3
パナソニック・サムスン撤退の裏で「中国勢5割」 独IT見本市「IFA」トップが明かす舞台裏
-
4
Microsoftが進めるCopilot再編 「Microsoft Copilot」への移行で、企業への影響は?
-
5
経営者は「AI導入」に夢中、現場は「IT環境」に疲弊 ITサポート軽視が招く時間・人件費ロスの実態
-
6
推論領域への野心強めるNVIDIA 韓国新興と協議か
-
7
散在する“29万ファイル”をAmazon S3に集約、「AIに聞くだけ」で検索可能に――AWSはどう実現?
-
8
恐るるに足らず? 中国フィジカルAI主要15社と5大集積地で見る「点と線と面」
-
9
ローカルLLM利用のクリニックが話題 院長自ら環境を構築 「医療機器より安い」は本当か
-
10
東京ゲームショウと生成AI ゲームの祭典で商談見込むベンダーたち
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR