官庁出版物30万点、AIモデルに活用へ 国会図書館がNIIに提供

 国立国会図書館は10月1日、国立情報学研究所(NII)に対して、官庁出版物のテキストデータを提供することで合意したと発表した。1995年までに刊行された図書が中心で、この他雑誌や官報など約30万点を、NIIが構築を進める大規模言語モデル(LLM)の学習用データとして活用する。

photo (出典:大規模言語モデル研究開発センターの公式Webサイト)

 9月5日付で合意を結んだ。出版物のデジタル化画像からOCR(光学文字認識)技術で作成した全文検索用データを提供し、NII内の大規模言語モデル研究開発センターで利用できるようにする。

 大規模言語モデル研究開発センターは、NIIが2024年4月に開設。研究開発用LLMの構築に加え、透明性・信頼性の確保や高度化に向けた研究開発を進めている。

photo 発表全文(出典:国立国会図書館公式Webサイト)
印刷する
SNSでシェア
SpecialPR

関連記事

こんなメディアも見られています

ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。

メールマガジンを配信中
メールマガジンを配信中

国内外の業界動向、AIやクラウドなどの最新技術、キャリア情報など今知りたい情報をまとめてお届けします。

いますぐご登録

本日の新着記事

アクセスランキング

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10

ITmedia NEWS SNS

X @itmedia_newsをフォロー

インフォメーション

ITmediaNEWSをフォロー

あなたにおすすめの記事PR