Anthropic、AI開発の26%を「Claudeが主導」 「1%未満」から半年で急拡大
米Anthropicの社内シンクタンク・Anthropic Instituteは9月17日(現地時間)、自社のAI研究開発の仕事の26%をClaudeがほぼ自力でこなし、人間は監督するだけの「AIが主導」段階にあると発表した。26%は8月時点の数字だが、半年前の2月は1%未満だったという。
スタッフの20%を無作為抽出、Claudeが仕事を評価
Anthropicは7月の週ごとに、研究開発に関わる各部門からスタッフの20%を無作為に選出。対象者のSlackや社内文書をClaudeが読んで1週間の仕事を書き出した。
1カ月で約1万5000件のタスクを抽出、分類して整理し、その仕事に人間が費やした時間を基に重み付けした。
仕事へのAIの関わり方は、米国の研究機関Epoch AIが作った「AL0」〜「AL5」の6段階で評価した。AL0を「AIの関与なし」とし、AL3は「AIと協働」、AL4は「AIが主導」、AL5は「AIが自律」といった分類だ。
「AIが主導」26%、「協働」含め90%超
同社のAIモデルの研究開発全体を100とした時、「AL4」(AIが主導)の仕事が全体の26%を占めた。人間が細かく指示しながらAIと進める「AL3」(AIと協働)を合わせると90%を超えた一方、「AIが自律」(AL5)に達した仕事はなかった。
裏を返せば、AIの関与が補助以下にとどまる「AL2」(AIが補助)以下の仕事は10%に満たなかった。
この数字は、AIがどこまでAI自身の次のバージョンを作っているのかを社外からも見えるようにするための指標として公開した。
約3万のAIエージェントを常時監視 止めた行動は0.002%
また、AIエージェントをどれだけ監視できているかや、計算資源の使い道も公表した。
Anthropicが社内で使っているAIエージェントを動かす基盤のうち、最も使われているものでは、8月時点で、常に約3万のエージェントが研究や開発の仕事をしているという。
この基盤では、エージェントの行動はすべて、実行する前に監視システムがチェックしており、8月には10億件を超える判断を分析。うち監視システムが止めたのは0.002%(約4万7000件に1件)だったという。
7月13〜20日の1週間に、AIの研究開発に使った計算資源のうち、保守的に見て約6%を安全性のために使ったという。
同社は、AI開発の透明性を高めるため、こうした数字を今後も公表するという。
Copyright © ITmedia, Inc. All Rights Reserved.
本記事は制作段階でChatGPT等の生成系AIサービスを利用していますが、文責は編集部に帰属します。
この記事の著者
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
経営「AIでラクして早く帰って」→社員「帰らない」 工数最大9割減のDeNAも悩むAI効率化の壁
-
2
恐るるに足らず? 中国フィジカルAI主要15社と5大集積地で見る「点と線と面」
-
3
ローカルLLM利用のクリニックが話題 院長自ら環境を構築 「医療機器より安い」は本当か
-
4
“最強エージェント”は、まさかのポンコツだった 業務の30%をAIに任せるIT運用部門が明かす「つまずきポイント」
-
5
国産汎用ロボットによるフィジカルAIのデータ収集で7社が競う、試作機を披露
-
6
「きもい」「内部資料そのまま」と話題のAI生成掲示物についてセブンイレブンに聞いてみた 「本部提供ではない」
-
7
AIへの「念のためプロンプト」はもう逆効果 Claudeのトークンを浪費する6つのアンチパターン
-
8
「足りないのはCOBOL人材じゃない」 日立が語る、AI時代のシステム刷新における“人”の役割
-
9
「中国AIがClaudeやGPTから数十億トークン抽出」 米当局が暴いた「知識蒸留」の実態
-
10
千代田区、生成AI全庁展開で「年間4000時間」を削減 次の一歩は「打倒・美しい紙の資料」、そのワケは?
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR