わかりやすいJavaによる医療言語処理入門
発売日:2012年2月
- ISBN
- 978-4-86194-037-8
- 著者情報
- 上杉 正人(ウエスギ マサヒト)
医学博士。北海道情報大学経営情報学部医療情報学科教授、株式会社ジェイマックシステム非常勤役員。1957年生まれ。1980年北海道大学医学部附属診療放射線技師学校を卒業後、診療放射線技師として病院勤務。1989年株式会社ジェイマックシステムを起業。1993年同社に勤務し、開発に携りながらカスタマ・サポート部、システムインテグレーション部の立ち上げ、営業部を経て研究開発部を立ち上げ2009年に退職。2009年北海道大学院医学研究科(社会医学専攻)博士課程を修了しPh.Dを取得し現職
セブン-イレブン受取り(送料無料)
発送目安
発売日(発売日以降は当日)~2日で発送
宅配(送料¥550税込)
発送目安
発売日(発売日以降は当日)~2日で発送
交通状況・天候の影響や注文が集中した場合等、お届けにお時間をいただく場合がございます。
商品説明
本書はJava言語の超初心者でも簡単に医療言語処理のプログラムを作成できるように構成された教科書である。indexOf()やsubstring()など十数個のメソッドの知識で医療言語処理のプログラムを作成することができる。また、本書ではテキストファイルを読込んだり、文字種を判定したりする各機能を20行程度のプログラム(メソッド)にまとめて、分かりやすさに配慮している。各章で作り上げたメソッドを組み合わせることによりn-gramモデルやtf-idfの処理を容易に医療言語処理プログラムが作成することができ、また汎用的に機能を作っているので応用もやさしい。本書では医療用語の抽出やtf-idfによる文書の類似性を求めるアルゴリズムまで扱っている。Javaの勉強を始めて次のテーマを考えている初学者、医療言語処理について興味を持つ大学生やビジネスに応用するための基本を知りたいという開発者などにお勧めである。
現在、医療のIT化により大量の情報が医療情報システムに蓄積されている。さらには医療情報のクラウド化により扱う医療情報の量は一層増えるに違いない。医療のクラウド化は患者にとって一生涯の医療情報がいつでもどこでも診てもらえるというメリットがあり、高齢化社会に向かい慢性疾患や生活習慣病などの管理・治療に望ましいことである。一方、医療側にとって大量の情報を前にして初診患者を適切に診断・治療することは、限られた診療時間の中ではかなりの苦痛を伴う。これには診療録や検査所見などのテキスト情報からキーワード抽出したり、文章を要約あるいは分類したりする支援機能が必要になる。この機能を実現するためには自然言語処理は必須の技術であり、特に医療に特化した分野への応用は、急速に増える情報に対応するために急がれる。本書では単にJavaの初学者のための教科書としてだけではなく、医療用語の特徴についても解説を行い、次のステップに発展できるように考慮した。
目次
Chapter 1 Introduction
1 本書の目的
2 総合開発環境
3 本書の構成
4 本書で使用するおもなメソッド
Chapter 2 テキストファイル処理の基本
1 はじめに
2 研究の手順
3 フォルダ管理のためのメソッド作成
4 フォルダ内のファイルを管理するJavaプログラム
5 作業フォルダ内のファイルを操作する3つのメソッド
5-1 フォルダ内のファイル数を返すメソッド
5-2 フォルダ内の指定した番号のファイル名を返すメソッド
5-3 ファイル内のテキストを返すメソッド
5-4 メインメソッドから3つのメソッドを呼び出す
6 文のはじめと終わりにマークを付ける
6-1 文のはじめと終わりにマークを付けるメソッド
6-2 STX、ETXコードを明示的に表示するメソッド
7 文字種を調べるメソッド
8 メインメソッドから各メソッドを呼び出す
9 CSVファイルから情報を取り込む
9-1 CSVファイルに含まれる行数を返すメソッド
9-2 CSVファイルから1行読む
9-3 文字列からカンマで区切られたアイテム数を返す
9-4 CSV形式の文字列から、任意のアイテムを取り出す
9-5 文字列の両端にあるダブルクォーテーション(“)を取り除くメソッド
10 CSVファイルから情報を抽出するプログラム
Chapter 3 文字列の処理n-gramモデル
1 はじめに
2 医療用語の出現頻度と出現確率
3 文字列の予測
4 bi-gramによる文の特徴抽出
5 Javaによるn-gramプログラム 54
5-1 医学中央雑誌Web版から論文抄録のダウンロード
5-2 bi-gramによるテキストコーパスの抽出プログラム
5-3 フォルダ内のファイルから文字列データを変数に読み込む
5-4 2文字の出現頻度とその出現頻度も求める
5-5 文字の出現頻度の総数を求めるメソッドの形成
6 データのソート(整列)
6-1 数値で降順にソートするメソッドの作成
6-2 文字列で昇順にソートするメソッドの作成
7 ソートの実行
7-1 Uni-gram、Tri-gramへの応用
その他
商品詳細
- 出版社名
- PILAR PRESS
- 対象年齢
- 一般
- フォーマット
- 単行本
注意事項
- 本の帯に関して
- 帯つきでの出荷はお約束しておりません。
商品ページに、帯のみに付与される特典物等の表記がある場合でも、確実に帯つきでの出荷はお約束しておりません。
また、帯は商品の一部ではなく「広告扱い」のため、帯の有無・破損による交換や返品は承っておりません。 - 版・表紙について
- 版・表紙(カバー)のご指定は承っておりません。ご注文いただくタイミングによっては、お届けする商品の版や表紙が商品ページ上のものとは異なる場合がございます。
また、初版にのみにお付けしている特典(初回特典、初回仕様特典)がある商品は、商品ページに特典の表記がされている場合でも、無くなり次第終了となります。