LLMはどこまで『国産』であるべきか?:
「フルスクラッチ開発」って何?──LLMを“骨格”と“筋肉”に例えて国産モデルの現在地を整理する(2/2 ページ)
どの部分が国産か?
このような比喩を踏まえると、LLMの開発段階や手法として次のように整理できることも腑に落ちるのではないだろうか。
- アーキテクチャにも手を入れ、ウェイトをフルスクラッチ(骨格に手を入れつつ筋肉を自分たちで基礎から鍛える)
- 既存アーキテクチャでウェイトをフルスクラッチ(既存の骨格を使い、筋肉を自分たちで基礎から鍛える)
- 学習済みモデルを追加学習(骨格も筋肉も大体できたものを、目的に合わせてさらに鍛える)
開発難易度でいえば基本的には上に行くほど難しい。ただし「難しいことをしているから良い」というわけではなく、大事なのはそのLLM開発が何を達成するためのものか、という目的の部分だ。
例えば「より流暢な日本語テキストを生成する」のが目的なら、学習済みモデルを追加学習するのが比較的低コストな開発手段となりうる。ただし“追加で鍛える”といっても段階はさまざまで、野球のバッティングフォームを修正する程度のものもあれば、全く異なる競技に挑戦するようなものもある。
「学習データの由来を管理して説明可能にしたい」のであれば既存アーキテクチャからのフルスクラッチ開発が選択肢となるが、ゼロから学習して性能を引き出せるまでにするには、データセットはもちろん大量の計算資源も必要となる。LLM開発ベンダーが我先にとGPUを確保する理由でもあるので、ある程度以上の規模のLLMをフルスクラッチ開発できる企業は必然と限られる。
「もっと少ない計算で速く動かしたい」「長い文章をうまく扱いたい」など、既存の骨格では実現しにくい特徴を狙うなら、アーキテクチャそのものにも手を入れる。ただし、同じ設計で大規模に学習した前例が少ないほど、どこまで性能が伸びるかは読みにくくなる。
また、いずれの段階においても“国産性”が関わる部分として「学習に使うデータセット」が挙げられる。英語圏のLLM開発に使われるデータセットの大部分は英語のデータであり、日本語が占める割合は小さい。日本向けの開発として日本語性能の向上が求められるなら、必然的に日本語でできたデータセットの投入が必要となる。
国内LLMはそれぞれどこに当たるのか
では国内の企業や研究機関が発表しているLLMが、それぞれどこに位置するのかを例示してみよう。なお、モデルの詳しい情報が公開されていないものは除外している(NTTのtsuzumiなど)。
アーキテクチャにも手を入れ、ウェイトをフルスクラッチ
- PLaMo 2/3(PFNグループ。PLaMo 3はNICTとの共同)
既存アーキテクチャでウェイトをフルスクラッチ
- CyberAgentLM3(CyberAgent)
- LLM-jpの基盤モデル(NII主宰)
- Sarashina 1/2(SB Intuitions、ただしSarashina 3はアーキテクチャが不明)
- Stockmark-100B(ストックマーク)
学習済みモデルを追加学習
- Llama-3-ELYZA-JP(ELYZA)
- Rakuten AI 7B(楽天)
- リコーLLMシリーズ(リコー)
- Swallow LLM(東京科学大学・産業技術総合研究所など)
- Takane(富士通)
補足すると、「追加学習」にも大規模なデータセットを使って専門知識などの追加獲得を目指すもの(継続事前学習)から、特定用途に沿わせるための微調整まで幅がある。上記に挙げているのは基本的に前者だ。また、ここで触れられていない開発手法としては「蒸留」や「進化的モデルマージ」などがあるが、話が複雑になってくるので割愛する。
なお、ここまで見てきたのは、あくまで「モデルをどう作ったか」という観点での国産性だ。実際に企業が利用する際には、どこのデータセンターで動かすのか、入力データを誰が管理するのか、誰がモデルを更新できるのかといった「運用の国産性」も別の軸として重要になる。
次回の記事では、PFNに「国産LLMの必要性」についてインタビューする。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
PC操作を録画→「Copilot」で作業を代理可能に Microsoftがアプリを無料公開 主にmacOS向け、Windows対応も
-
2
「大きな投資計画が次々に。久しぶりだ」――強く豊かな日本投資枠、経済成長かなうか? 片山大臣が語る狙い
-
3
「AI、結局使えないじゃん」問題 セールスフォースが431万件対応で導いた正解
-
4
AI活用を「個人の効率化」で終わらせるな セールスフォース流「4つの組織改革術」
-
5
「融資」現場にAIの足音、資金調達どう変わる? カネを借りられる企業の条件、専修大教授に聞く
-
6
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
7
富士通とNECの決算会見から読み解く、2026年下半期「AI需要」と「収益の見通し」
-
8
「日本人が海外へ行けない」を打ち破る シンガポール発LCCが仕掛ける“逆張り戦略”
-
9
「Qwen3.8-Max」登場、オープン化は「来週」 一部「Fable 5」「GPT-5.6 Sol」超えの性能うたう
-
10
NTT、独自のAIモデル「tsuzumi 2」発表 “国産AI開発競争”に「負けられない」と島田社長
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR