“医療特化”の日本語LLM開発、東大松尾研やさくらなど 研究者に無償提供
AIの研究で知られる東京大学の松尾・岩澤研究室は3月5日、医療分野に特化した日本語LLM「Weblab-MedLLM-Qwen-2.5-109B-Instruct」を開発したと発表した。2025年の医師国家試験の正答率は、米OpenAIのAIモデル「o1」「GPT-4o」などを上回ったという。チャットAIとして研究者向けに無償提供する。
中国AlibabaのオープンなAIモデル「Qwen-2.5-72B-Instruct」をベースに開発した。さくらインターネットやAI開発企業のELYZA(東京都文京区)、ABEJA(東京都港区)のほか、理化学研究所や医療機関とも連携した。医療分野のデータなどを学習しており、日本語の医学や国内の医療制度に関する知識を備える。
25年の医師国家試験の正答率は93.3%で、o1の92.8%や中国DeepSeekのAIモデル「R1」の91.5%を上回った。外部データを参照して回答を出力する「RAG」などを組み合わせると、図の参照が必要な問題や計算問題を除き、正答率は最大約98%まで高まったという。
医療現場における電子カルテデータの標準化を想定し、感染症や検査の名前を厚生労働省が定める標準名称に変換するタスクでも性能を調べた。その結果、Qwen-2.5-72B-InstructやGPT-4oなどよりも高い性能を示したとアピールしている。
Weblab-MedLLM-Qwen-2.5-109B-Instructは、チャットAIとして研究者向けに無償提供する。期間は3月5日から8月31日まで。なお、診断や診療、治療行為には利用できない。
同LLMの開発は、政府が主導するプロジェクト「戦略的イノベーション創造プログラム」第3期で、医療分野におけるデータやAIの活用を目指す「統合型ヘルスケアシステムの構築」の補助を受けて実施した。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
アクセスランキング
-
1
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
2
Claude、一部チャットがGoogle検索で“丸見え”に 過去には「ChatGPT」でも 漏えいの原因は?
-
3
なぜ、Microsoft 365 Copilotは「会社の仕事を理解する」のがうまいのか?
-
4
Anthropicのミュトス、暗号アルゴリズムの新たな攻撃法を発見――耐量子署名「HAWK」の強度を半減
-
5
法人被害45億円、元警視庁が解説「会話もできるAI詐欺」の手口と対策
-
6
「痺れるほどにミスを繰り返す」Gemini 3.6 Flashは変わった? 公開から1週間、当初のおバカ回答を今検証する
-
7
OpenAIやAnthropicなどの従業員、米政府に「AI開発のペース調整を」と提言
-
8
Markdownファイルが、AI時代の負債に? Googleが提案する「ナレッジ標準化」の一手
-
9
医療文書の作成時間を30分から5分へ、生成AIで現場の業務効率化
-
10
「Claudeより4割安い」 M365のExcel/メール操作を丸投げる「Copilot Cowork」“従量課金”の落とし穴
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR