ITmedia総合  >  キーワード一覧  > 

  • 関連の記事

「トークン」関連の最新 ニュース・レビュー・解説 記事 まとめ

「トークン」に関する情報が集まったページです。

コストと品質を両立させる手順を解説
Anthropicが示す最適なClaudeモデルの選び方 トークン単価で選ぶと失敗する
Anthropicは公式ブログで、業務システムに組み込むClaudeモデルの具体的な選定方法やモデルの併用方法を解説した。(2026/7/29)

「サナエトークン」巡る首相秘書陳述全文 「一度も説明受けず」
高市早苗首相(自民党総裁)の陣営による党総裁選などでの中傷動画作成疑惑や名前を冠した暗号資産「サナエトークン」を巡り、首相は7月22日、週刊誌などが関与を伝えていた秘書の陳述書を衆院予算委員会に提出した。秘書は、陳述書で関与を全否定した。(2026/7/23)

AIの自動改善で正解率が68%から80.2%に
もうトークンは燃やさない AIエージェントの精度を上げるドメイン知識の組み込み方
AIエージェントの「自己改善」や、処理を繰り返す「ループ」への関心が高まっている。本稿は、自己改善で無駄なトークン消費を防ぎ、AIシステムの品質を継続的に高める方法を紹介する。(2026/7/23)

学習費より厄介なAI運用コストの正体
本当に怖い「AIトークン破産」 推論コスト最適化の処方箋
AI導入で本当に恐ろしいのは学習時ではなく、利用のたびに発生する「推論コスト」だ。トークン消費の抑制やモデルの使い分けなど、プロジェクトの成否を分ける運用費の具体的な削減手法と管理の要点を徹底解説する。(2026/7/23)

Go AbekawaのGo Global! 牛尾剛さん AI vs.人間編(後編):
トークン使用量にROIを求めるのは、「当たる宝くじ」を買おうとするようなもの
米マイクロソフトでAIと向き合う牛尾剛さんインタビュー。後編では、AI導入のROI(投資対効果)を求める企業への示唆や、ビジネス部門のノウハウを「アセット化」する重要性に迫る。55歳の牛尾さんが描く「あと5年で『僕はエンジニアだ』と胸を張って言いたい」という真摯(しんし)で切実な思いも深堀りする。(2026/7/22)

実験から本番運用に進めるための3つの条件:
AIトークン消費「24倍」の衝撃 本番運用に向けて絶対に“やってはいけない”コストの捉え方
AIの試験導入から本番運用への移行が進む中、多くの企業がコストと統制の壁に直面している。将来的なトークン消費の急増を見据え、組織が今見直すべき視点とは何か。実運用を持続させるための「3つの条件」を解説します。(2026/7/22)

ChatGPT、Gemini、Claude Sonnet 5の応答が速いのは? 初回トークン到達時間や完全応答時間を比較、ICT総研調べ
ICT総研は、主要3大AIチャットサービスを対象としたAPI経由での応答速度実測調査を実施。昼帯と深夜帯の2時間帯に、各サービス計30試行の速度計測を行い、初回トークン到達時間と完全応答時間を比較した。(2026/7/21)

見栄えだけのAI活用が迎える限界
GitLabのCIOが警告 「トークン消費量」で成果を測る企業が陥る問題とは?
企業のAI活用において、トークン消費量を競う「トークンマキシング」という見栄えだけの指標が広がりつつある。GitLabはこの方針を警戒し、明確に拒絶している。表面的な目標が引き起こす、企業の誤った行動とは。(2026/7/15)

企業向けAIエージェントシステムのベンチマーク指標「Enterprise Bench」が発表 データベースにおけるTPCベンチマークのような存在を目指す
AIエージェントシステムのベンチマーク「Enterprise Bench」を、米DevRevがオープンソースとして公開した。非営利法人とともに開発したもので、企業の複雑な環境における動作の正確さや安全性、トークン消費の効率性を評価する。(2026/7/14)

TechLIVE:
【AIコスト削減】Claudeが突然止まる?「トークン死」を招くNG行動とは
AIのトークン消費が激しいという悩みの声が上がっています。トークンを多く消費するNG行為と、今日から試せる3つの具体的な節約テクニックを紹介します。(2026/7/14)

入力トークンを8万3000から4900に
入力トークンを94%削減 大手小売のエンジニアが構築したローカル検索の仕組み
英国の小売大手企業のエンジニアは、AIコーディングツールに送るコードを選別するローカル検索インデックスを構築。1回当たりの入力トークンを約8万3000から4900へ減らし、94%削減した。その裏側を紹介する。(2026/7/13)

あなたはAIを「疲弊させている」かもしれない 「トークン死」を防ぐコスト管理術
業務中のAIが突然止まる「トークン死」。その原因は、AIを“疲弊”させるあなたの無意識なNG行動かもしれない。利用枠を浪費する原因と、今日から実践できる3つのコスト節約術を解説。「AIを賢く使い倒す習慣」に迫る。(2026/7/10)

エンジニアの採用枠をトークン予算に回せるか? HRBrain常務が語る、「財布の壁」に挑む人事の未来
HRBrainの常務執行役員CSaO小山径氏は「AIも、これからは経営資源の一つになっていく」と話す。小山氏が見据えるAI活用の展望とは?(2026/7/8)

1人で月300万円を消費する事例も
Gartnerが警告 開発者の“AI費用”が人件費を逆転する日は来るのか?
Gartnerは、2028年までにAIコーディングの利用料が平均的なエンジニアの給与を上回ると予測する。天井知らずの費用高騰を招く「トークン消費」の実態と、IT部門が実施すべき統制策とは。(2026/7/8)

人工知能ニュース:
1年でAfter AIの組織に生まれ変わったソラコム、「トークン資本」の安全な器へ
ソラコムが、2025年7月から始めた「After AIの組織」に移行するための取り組みを説明。この新たな組織体制から生み出したマネージドAIエージェントサービス「SORACOM Agent」も紹介した。(2026/7/7)

AI推進にブレーキ? AWS「コスト抑制の動きある」 “トークン消費問題”への有効策は
AI利用を巡って、処理コストを抑えようとする動きが出てきている。AWSも把握しているという“トークンコスト問題”について、対策を聞いた。(2026/7/6)

AIのトークン浪費をどう防ぐか
Pythonの限界? AIに「Rust」でコードを書かせる新手法「コードモード」とは
AIツールの自動ソースコード生成は、不要なデータ処理が膨れ上がり、トークンを浪費してしまう課題がある。システムプログラミング言語「Rust」を活用した新たなアプローチは、この非効率性をどう打ち破るのか。(2026/7/4)

AIニュースピックアップ:
Mythos Previewに近い性能を3分の1のトークンで実現 OpenAIが新モデル「GPT-5.6」公開
OpenAIはGPT-5.6系を限定公開した。旗艦モデルの「Sol」、日常業務に適したバランス型の「Terra」、低コストで高速な「Luna」で構成する。安全策を厚くし、APIとCodexで先行提供してからChatGPTを含む広い公開を予定している。(2026/7/2)

IT調査ピックアップ:
アプリ構築のトークン消費は通常の3倍 Anthropicデータが明かす、高度なタスクと計算資源のリアル
AnthropicはAIの利用実態を分析した最新報告書を発表した。分析手法の刷新により、アプリ構築が通常の3倍超のトークンを消費する実態や、週末の私用増、若手の失職懸念と高度委任層の成長実感などが判明した。(2026/6/30)

生成AIの請求書、人件費と並べる時代へ 国内5社のAI責任者が語る「トークンマネジメント」の現在地
経費精算SaaSのLayerXやラクス、名刺管理から事業を広げたSansan、会計クラウドのfreee、フリマアプリのメルカリ。取材した5社のAI・人事責任者から、驚くほど重なるトーンでAIのトークンコストを語る声が聞こえてきた。(2026/7/1)

30種類のモデルを検証 理論値の「約74倍」トークンを浪費したモデルも:
5万回の評価で判明 VS Code開発チームが明かす「小型AI」の罠
コーディングエージェントの導入が進む中、「トークン浪費」が課題となっている。MicrosoftのVS Code Eval Teamは、30種類のモデルを対象に累計5万回以上の検証を実施し、AIエージェントがタスク遂行の裏側で引き起こす「過剰思考」の実態を明らかにした。今後のエージェント運用においては「評価の自動化」も焦点となりそうだ。(2026/6/29)

「HPE Discover Las Vegas 2026」現地レポート:
トークン消費の爆発をどう防ぐ? HPEとAMDが示す「自社データセンター回帰」という現実解
AIエージェントの普及に伴うトークンコストの爆発にどう挑むか。HPEの年次イベントで、ルッソCTOは外部モデル依存による隠れたコストを指摘。推論を自社データセンターへ回帰させるためのインフラ戦略を、AMDの事例とともにレポートする。(2026/6/29)

正規機能の悪用手口も明らかに:
「MFAだけでは防げない」 狙われる企業のクラウド環境、明日からできる対策は?
OAuthトークンの窃取、IT管理者へのなりすまし、正規管理ツールの悪用など、クラウド環境を狙う攻撃は高度化し、従来の多要素認証だけでは防ぎきれないフェーズに直面しています。最新の攻撃手口、明日からできる対策を整理します。(2026/6/28)

最大の敵は幻覚ではない:
「AIでコスト削減」のはずが予算超過 企業が見落とすトークン課金のわな
企業の生成AI利用が拡大する中、複雑なトークン課金や従量制モデルによる予算超過リスクが企業を圧迫している。Gartnerが明かす、AI時代の新たなコスト管理問題への備え方とは。(2026/6/26)

AI運用費が人件費を超える逆転現象も?
3カ月で1年分の予算が消滅? AI導入で情シスが陥る「トークン破産」を防ぐには
LLMの利用拡大に伴い、AIのトークン消費によるコスト増大が企業の新たな課題となっている。Pegasystemsは、AIの利用量ではなくビジネス成果に応じて料金を設定する新たな課金モデルを紹介する。(2026/6/16)

自動要約(autocompact)が失敗する原因:
「100万トークンはAIのコンテキストを腐らせる」 Claude Codeを賢く保つ5つの選択肢と使い分け方
Anthropicはエージェント型コーディングツール「Claude Code」のセッション管理とコンテキストウィンドウ管理について解説した。100万トークンのコンテキストウィンドウを活用しつつ、5つの選択肢を使い分けることが作業結果を大きく左右するとしている。(2026/6/9)

AIエージェントは「Webブラウザのタブ」:
「Claude Codeでトークン浪費」の原因 Anthropicが明かす「サブエージェント」5つの使い所と止め所
Anthropicは、同社のCLI型AIコーディングツール「Claude Code」のサブエージェントにおけるベストプラクティスやアンチパターンなどを解説したブログ記事を公開した。(2026/6/4)

“iPhoneだけで動くAI”の全貌 Google「Gemma 4」は何がスゴイの?
英Google DeepMindが開発したオープンソースAIモデル「Gemma 4」(ジェマ4)が、リリースからわずか1週間で200万ダウンロードを突破した。AIが処理する文字の単位であるトークン使用量に応じた利用料の高騰の傾向が続く中、無料モデルをローカルマシンにインストールすることでトークン出費を抑えたいユーザーに歓迎されているようだ。(2026/6/3)

Anthropic、AIエージェントの門戸を閉ざす 企業が負う「利便性」の代償
米Anthropicは自社のサブスクリプションサービス「Claude Pro」「Claude Max」の利用者に対し、第三者製のAIエージェントツールへのトークン枠適用を停止すると発表した。この一件は大規模言語モデルと、それを動かす「ハーネス」(制御機構)の関係性がどうあるべきかという、AI業界の根幹を揺るがす問いを投げかけている。(2026/5/30)

ネットワーク遅延もトークン課金もなく、システムへのAI実装が可能に:
クラウド依存、コストの課題を解消? MicrosoftのローカルAI基盤「Foundry Local」
Microsoftは、開発者がアプリケーションにAI機能を組み込めるローカルAI実行基盤「Foundry Local」の一般提供を開始した。ユーザーの端末上でAI処理を完結させる仕組みにより、クラウドへの依存やネットワーク遅延、トークン課金が発生しないAI実装が可能になるという。(2026/5/29)

月28本の記事“量産”で記者が見たもの AIを使って勝つ企業・勝てない企業を分ける「競争軸」とは?
生成AIの導入競争が激しさを増している。トークン消費量、エージェント数、AIが書いたコードの割合。企業はこぞって「どれだけAIを使っているか」を競い始めた。しかし、その競争はどこか本質から外れている。(2026/5/24)

IDC Directions 2026
MaaS市場が年平均1154%超で成長 爆伸びする中国のAI投資が抱く野望とは?
世界のAI支出は2029年に2.1兆ドルへ達し、インフラ構築から「企業実装」へと主戦場が移る。特に中国はMaaSやロボティクスで圧倒的成長を見せ、評価指標もFLOPSから「電力あたりトークン数」へ変容した。急加速するAIスーパーサイクルで、情シスが決断すべきコスト管理と戦略的投資のポイントとは?(2026/5/23)

Metaの株価急落が暴いた「AI巨額投資の死角」
あなたの会社のAI投資、すでに「負債」――トークンコスト暴走への情シスの防衛策は
Metaの株価急落は、AI投資が「資産」から「負債」へと変貌する転換点を示唆している。膨れ上がるトークンコストや不透明なROIに、情シスはどう立ち向かうべきか。(2026/5/21)

「給与は10万ドル、トークンは使い放題」 NVIDIAフアンCEOが予言した、AIが“人件費”になる日
日本企業は中国製AIの利用に慎重だとされる。しかしその間にも、企業によるAI活用の現場では大きな変化が進行している。性能面では依然として米国のクローズドモデルが上位を占めるものの、実際の利用量では中国発のオープンモデルが急速に存在感を高めている。(2026/5/14)

トークン消費から「提供」へ
「AIトークン破産」を防げ 情シスが主導すべき生成AIコスト最適化戦略
生成AIのコスト増大とデジタル主権への懸念が情シス部門を直撃している。パブリッククラウドの「トークン課金」による予算圧迫を回避するため、Red Hatは自社環境でAIを運用する「トークンプロバイダー」への転換を提唱した。(2026/5/14)

Deep Insider AI Practice:
【独自調査】日本語でAIを使うと「約1.5倍」高く付く? AI利用のコスパを左右する“トークン効率”を比較
AIの料金体系が使用量を意識する形へ移りつつある今、「日本語」はAI利用のコストにどれほど影響するのか。GPT-5.5やClaude Opus 4.7など主要モデルを実測し、トークン効率からモデル選びを考える。(2026/5/13)

2030年に登場するLLMの推論コスト 2つのシナリオで予測:
AIの推論コストは90%下落も、企業の予算を圧迫か Gartnerが警告
Gartnerは、2030年までに1兆パラメーターの大規模言語モデルによる推論コストが生成AIプロバイダーにとって2025年比で90%超低下すると予測した。一方、エージェント型AIの普及でトークン需要が増大するため、企業が支出する推論の総コストは増加する見通しだという。(2026/5/12)

Deep Insider Brief ― 技術の“今”にひと言コメント:
GPT-5.5は最高性能ではないのに、なぜエンジニアが熱狂? カギは“最後まで自走する力”
GPT-5.5は、ベンチマークだけを見れば絶対王者ではない。それでも開発者が熱狂する理由を、Codexとの組み合わせ、トークン効率、そして“最後まで自走する力”から整理する。(2026/5/12)

トークンコストで絶望しないために【後編】
AIエージェントの“トークン爆食い”を防ぐ「トークンマキシング」とは
AIエージェント運用時のトークン消費増大が企業の課題となりつつある。専門家は「トークンマキシング」による最適化やFinOpsを活用した管理体制の構築を提言する一方、より大きな視点で考えるべきだと指摘する。(2026/5/2)

トークンコストで絶望しないために【前編】
気づけば請求額が爆発 LLMコストを膨らませる4つの落とし穴
LLMの利用拡大に伴い、入力・出力トークンの消費増加が課題となっているという声がある。トークンの請求額を膨らませる4つの要因と、増大を誘発させる従業員のアクションを紹介する。(2026/5/1)

AIニュースピックアップ:
GitHub Copilot、従量課金制へ 機能高度化に伴うコスト増に対応
GitHubはCopilotの課金体系を6月から従量制へ移行する。月額料金は据え置いたまま、トークン消費量に応じた「AIクレジット」制を導入予定だ。機能高度化に伴うコスト増に対応しつつ、移行後は利用制限の緩和も予定している。(2026/4/29)

Deep Insider Brief ― 技術の“今”にひと言コメント:
AIを使わないエンジニアは「仕事をしていない」? シリコンバレーから広がる「Tokenmaxxing」という新常識
シリコンバレーで広がる「トークンマクシング」とは何か。AIをどれだけ使えるかが生産性や評価を左右し始めた現実を追い、日本のソフトウェアエンジニアがどう向き合うべきかを考える。(2026/4/27)

56%のCEOが「AIの投資効果なし」と回答 コストの暴走を防ぐには?
AI導入が加速する一方で、CEOの56%が「投資効果を実感できていない」という厳しい現実がある。予測困難なトークン課金やGPU利用料による「コストの暴走」を防ぐには、クラウド管理の知見を応用した「FinOps for AI」の確立が急務だ。(2026/4/6)

コスト統制と創造性を両立
AIの”課金地獄”を回避したアゴダの最適解 「エンジニアを遊ばせない」とは?
トークンの上限を決めれば費用の目途が立つ。だが、上限に達しない範囲でしかエンジニアが働かなくなる――。この課題に取り組み、コスト最適化とエンジニアの創造性を両立させたAgodaの取り組みを紹介する。(2026/4/3)

セキュリティニュースアラート:
npmワーム「CanisterWorm」の被害拡大 未報告の改ざんパッケージを特定
npmを標的とした攻撃「CanisterWorm」の新たな改ざんパッケージが見つかった。正規アカウントを侵害してワーム化し、トークン窃取やバックドアを設置する。JFrogは認証情報の更新や特定サービスの削除などの対処手順を示した。(2026/3/25)

利用可否も示せる:
「divやscriptの“意味”は0」 HTML読み込み時のAIトークン使用量を「8割減らす」機能、Cloudflare発表
Cloudflareは、AI向けにHTMLコンテンツをMarkdown形式に自動変換して配信する「Markdown for Agents」を発表した。AIクローラーやエージェントの増加で構造化データの需要が高まっているという。(2026/3/19)

Deep Insider Brief ― 技術の“今”にひと言コメント:
GPT-5.4登場、“やり抜くAI”へ 100万トークンとCodexアプリがもたらす“実務完遂力”
OpenAIの新モデル「GPT-5.4」が登場した。100万トークンの巨大コンテキストやCodexアプリとの連携により、AIが実務タスクを自律的に完遂する能力が大きく強化されている。本稿では、その特徴と実際の使いどころを整理する。(2026/3/13)

AIニュースピックアップ:
サブスクで外部連携は不可 Claude利用の“グレー運用”にくぎ
Anthropicは公式ドキュメントを更新し、サブスク版のOAuthトークン利用を自社ツールに限定すると明記した。第三者製ツールやAgent SDKでの利用は規約違反となり、外部連携にはAPIキーの使用が必須となる見通しだ。(2026/2/27)

「トークンファーミング」では15万件超の侵害を特定:
そのnpmパッケージは安全か? 生成AIの悪用などで「トークン」を狙うソフトウェアサプライチェーン攻撃と対策をAWSが解説
AWSは、2025年に発生した一連のnpmサプライチェーン攻撃キャンペーンへの対応経験と、そこから得た知見を公開した。(2026/2/13)

OpenTelemetryでカスタマイズ可能:
AI支援開発のコストやコード生成量、分かる? GoogleがGemini CLIに監視ダッシュボードを追加
Google Cloudは、「Gemini CLI」において、事前構成済みの監視ダッシュボードを提供開始した。ツールの導入状況やトークン消費量、パフォーマンスなどを可視化できるという。(2026/2/9)


サービス終了のお知らせ

この度「質問!ITmedia」は、誠に勝手ながら2020年9月30日(水)をもちまして、サービスを終了することといたしました。長きに渡るご愛顧に御礼申し上げます。これまでご利用いただいてまいりました皆様にはご不便をおかけいたしますが、ご理解のほどお願い申し上げます。≫「質問!ITmedia」サービス終了のお知らせ

にわかに地球規模のトピックとなった新型コロナウイルス。健康被害も心配だが、全国規模での臨時休校、マスクやトイレットペーパーの品薄など市民の日常生活への影響も大きくなっている。これに対し企業からの支援策の発表も相次いでいるが、特に今回は子供向けのコンテンツの無料提供の動きが顕著なようだ。一方産業面では、観光や小売、飲食業等が特に大きな影響を受けている。通常の企業運営においても面会や通勤の場がリスク視され、サーモグラフィやWeb会議ツールの活用、テレワークの実現などテクノロジーによるリスク回避策への注目が高まっている。