「Grok 4.1」リリース 感情表現や対話能力を強化、ユーザー選好度も向上
米xAIは11月17日(現地時間)、AIモデル「Grok」の新バージョン「Grok 4.1」を発表した。grok.com、iOSおよびAndroid向けアプリで利用可能になっている。
自動モードで順次展開されているほか、モデル選択で明示的に「Grok 4.1」を指定することもできる。
xAIは、スタイルや人格、ユーザー支援、アライメントなどの側面を最適化するようGrok 4.1をチューニングしたと説明している。こうした側面は検証可能な正解がないタイプの報酬信号を扱うため、高度な「エージェント的推論モデル」を報酬モデルとして用い、自律的に応答を評価・反復する新たな手法を開発したという。これにより、従来モデルの知性や信頼性を維持しつつ、創造的・感情的・協調的な対話能力を強化したとしている。
11月1日から14日にかけて、grok.comやX、モバイルアプリ上でGrok 4.1のビルドを段階的に投入する「サイレントロールアウト」を実施し、従来モデルとの比較検証を行った。その結果、Grok 4.1は直前の本番モデルと比べて64.78%の割合でユーザーに選好されたという。
LMArenaの「Text Arena」ベンチマークでは、推論付きモード「Grok 4.1 Thinking」がElo 1483で総合1位を獲得した。推論を行わない通常モードも思考トークンなしで即時応答しつつ、Elo 1465で2位となった。従来のGrok 4の総合順位は33位だった。
また、悲嘆に暮れるユーザーに寄り添う応答の従来版との比較を紹介し、感情表現や語りの深みが増したとアピールしている。
事実性の向上も重点項目としており、情報検索系プロンプトでの幻覚(ハルシネーション)を減らすポストトレーニングを実施したという。ベンチマーク「FActScore」でGrok 4 FastとGrok 4.1を比較した結果、Grok 4.1では幻覚率の有意な低下が見られたとしている。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
ChatGPT、無料版を含む全ユーザーに「GPT-6」 回答内に“操作できる画面”を生成する「Intelligent UI」搭載
-
2
バイブコーディングで作った公開中のWebアプリ、9割に脆弱性 MSの研究者など調査
-
3
相次ぐ情報漏えい、攻撃側のAI活用「間違いない」 防御側はどう使うか 傾向と対策を大手ベンダー各社に聞く
-
4
止まらない不正アクセス、背景にAIの“超高速攻撃”か 識者「使われていない方が不自然」
-
5
立ち話が“宝の山”に 8人の声を聞き分けられたAI文字起こし「Klang」の実力
-
6
富士通では「Copilot」10万ライセンスの利用率が“9割超え” 「導入したけど使われない」をどう防いだ?
-
7
Anthropic、「Claude Haiku 5.5」のAPI料金を「Haiku 4.5」の10分の1に 「Sonnet 5.5」のキャッシュ読み込み料金は半額に
-
8
「異常な事態」、AI悪用は「否定する方が難しい状況」──多発する情報漏えいにセキュリティ専門家が合同で見解 攻撃の特徴と対策方法は
-
9
Anthropic、「Claude Haiku 5.5」公開 「Haiku 4.5」から大幅性能向上で利用コスト約75%減
-
10
Google、AI生成物の判定ツールを一般公開 OpenAIやNVIDIA製サービスも対象に
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR