PFNの国産LLM「PLaMo 3.0 Prime」、さくらのAI推論基盤で提供開始 利用は申請制
さくらインターネットは8月4日、生成AI向け推論API基盤「さくらのAI Engine」で、Preferred Networks(PFN)の国産大規模言語モデル(LLM)「PLaMo 3.0 Prime」の提供を始めたと発表した。利用には申請が必要で、無償プランは対象外となる。
PLaMo 3.0 Primeは、PFNがフルスクラッチで開発する国産生成AI基盤モデル「PLaMo」シリーズの最新フラッグシップモデル。情報通信研究機構(NICT)との共同研究で得た事前学習モデルをベースにしており、PFNが6月22日に正式リリースしていた。
推論力を高めたReasoningモデルで、複雑な指示への対応や段階的な推論、数理・アルゴリズム問題への対応力を強化したという。扱えるコンテキスト長は従来の64kトークンから256kトークンに拡張し、AIエージェントとしての実務利用も想定する。
日本語性能も強化した。独自データセットに加え、日本語の業務文書や対話、専門領域での利用を想定した学習・評価を実施し、文脈理解や論理展開、業務利用に必要な指示追従の性能を高めたとしている。PFNが独自開発したトークナイザーによりトークン効率を上げ、コストパフォーマンスも改善したという。
安全性については、NICTから提供を受けたデータを活用して向上に取り組み、米スタンフォード大の研究所が開発・運用する評価ベンチマークスイート「HELM Safety」で海外モデルと同程度以上の性能を達成したとしている。PFNの社内評価では、Qwen3.6-27Bやgpt-oss-120bといった同性能帯のオープンモデル、GPT-5.4 miniやClaude Haiku 4.5といった同価格帯のクローズドモデルとの比較でも、日本語の指示追従やコーディング、ツール利用の領域で競争力のある結果が出たという。
利用にはコントロールパネル内の「モデル一覧」から申請し、モデル提供元の承認を得る必要がある。価格は申請が承認されたユーザーにのみ表示するとしている。
さくらのAI Engineは、2025年9月に一般提供を始めた推論API基盤。同社の生成AI向けクラウドサービス「高火力」を基盤に、国内のデータセンターで運用するインフラ上で、国内外の複数の基盤モデルやRAG(検索拡張生成)機能をAPI経由で提供する。現在は無償(チャット生成なら3000回/月まで)でも「Kimi K2.7 Code」「Qwen3.6-35B-A3B」「gemma-4-31B-it」などを利用できる。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
「ChatGPT」のデフォルトモデル、PlusとProは「Sol」に、無料版は「Luna」でテキストチャット無制限に
-
2
「GPT-5.6 vs. Claude Fable 5」勝者はClaude、でも企業が選びづらいワケ:891st Lap
-
3
ソフトバンクG、投資利益1.8兆円を支えた「OpenAIではない“あの半導体メーカー”」の正体
-
4
フィジカルAIに注力するインテル、組み込み市場での約40年の実績を生かせるか
-
5
書店に「3000冊の発注」、AI企業が古書を買いあさる? Anthropicも数百万冊をスキャン・破棄 実態明らかに
-
6
リクルート、新卒エンジニア向け研修資料を無料公開 “AI時代の生き残り方”など紹介する13本
-
7
KDDIも40年前はスタートアップだった 高橋会長の“昔話”から考える、日本企業の成長戦略
-
8
あえて歩かせない――準国産ヒューマノイド「D1」登場、現場稼働で日本の勝ち筋へ
-
9
銀行なら3カ月→AIは1カ月 10万件のデータで「数千万円」を引き出した“データドリブン資金調達術”
-
10
中国DeepSeek、近日中に「大幅値上げ」か API料金ページに追記
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR