Google、医療関係者向け文書解析サービスをプレビュー公開 機械学習で単語を抽出、文書検索をアシスト
米Googleはこのほど、機械学習を利用して、医療文書から治療や研究に役立つデータを抽出するサービス2種類をプレビューとして公開した。
医療機関で保管している患者のデータは、カルテに文章の形で記入して保存するなど、構造化できていないことがほとんど。特定のキーワードで検索することや、キーワードごとにデータを分類して管理することはできない。必要なときは、医師などの専門知識を持つ人間が、長い時間をかけて大量の文書を読んで特定のデータを探すしかないのが現状だ。
Googleが今回プレビューとして公開したサービスは「Healthcare Natural Language API」と「AutoML Entity Extraction for Healthcare」の2種類。どちらもREST形式のAPI(Application Programming Interface)となっており、APIのURLを指定して、UNIXコマンドの「curl」などを使ってアクセスする。
Healthcare Natural Language APIは、医療文書を受け取るとクラウド側で機械学習を活用して文書を解析し、病名、薬剤の名称や投与量、医療処置などを指す単語を抽出する。医療の現場では、同じ疾病や薬剤を指す言葉が複数あることが普通で、医療関連文書でも複数の表記が使われていることが多い。そこで、同じ意味の言葉の表記を統一する機能も提供する。医療関係者の間では一般的な用語集であるMeSH(Medical Subject Headings:米国立医学図書館が作成)、あるいはICD(International Classification of Diseases:WHOが制定)の表記に統一する。
AutoML Entity Extraction for Healthcareは、簡単な操作で機械学習モデルに学習させることを可能にしたサービス。医療文書を解析する機械学習モデルに、学習用データを与えて学習させれば、Healthcare Natural Language APIでは抽出できない言葉を特定できるようになる。
学習モデルに学習させるには、50件~10万件の医療文書が必要。それぞれの文書に文書中の特定の場所と関連する言葉を記したアノテーション(注釈)を付ける必要もある。文書とアノテーションはJSON Lines(JSONL)形式にまとめ、クラウド側にアップロードする。
GoogleはAutoML Entity Extraction for Healthcareの提供に合わせて、学習用文書にアノテーションを付ける際のガイドラインをGitHubにオープンソースで公開した。Googleは、医療関係者たちが協力してこのガイドラインの修正、追加、拡張などを進めていくことを期待しているという。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
かっぱ寿司「配布前のコラボグッズ、フリマで買わないで」 プリキュアコラボ発表日に注意喚起
-
2
「食事量は1日1200kcal以下、でも肥満」な人を14日間追跡調査 痩せない理由は……米コロンビア大などの研究
-
3
「菜の花がおかしい」――イラストレーター制作うたうマラソン大会ポスターに指摘相次ぐ 事務局がAI使用明かす【訂正あり】
-
4
デジタル庁に不正アクセス、個人情報24.6万件漏えいか 各府省庁の職員情報など
-
5
幻の「ちいかわ」コラボ第3弾皿、捨てちゃうの? くら寿司に聞いてみた
-
6
iPhone 18シリーズ発表、今年はPro・Pro Maxのみ なんと“無印”なし 価格は21万9800円から
-
7
「iPhone Duo」発表 Apple初の折りたたみスマホ 36万4800円から
-
8
藤井風のリサイタル、公式サイトがインターネット老人会すぎると話題 公民館のチラシみたいだけど東京ドーム開催
-
9
「ペンギンを返して」 Suica新キャラ候補3案公開でSNSに戸惑いの声 一般投票は8日から
-
10
「すばやさがあがるリュック」など……ドラクエ商品予約にアクセス集中、エラー連発→完売 グラニフ謝罪、追加受注へ
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR