深層学習による画像認識の基礎
発売日:2024年4月
- ページ数
- 353p
- ISBN
- 978-4-274-23184-1
- 著者情報
- 菅沼 雅徳(スガヌマ マサノリ)
2017年横浜国立大学大学院環境情報学府情報メディア環境学専攻博士後期課程修了(半期短縮修了)、博士(工学)。2021年理化学研究所革新知能統合研究センター客員研究員(現職、兼務)
セブン-イレブン受取り(送料無料)
発送目安
発売日(発売日以降は当日)~2日で発送
宅配(送料¥550税込)
発送目安
発売日(発売日以降は当日)~2日で発送
交通状況・天候の影響や注文が集中した場合等、お届けにお時間をいただく場合がございます。
商品説明
現代の画像認識の理論・手法が俯瞰できる一冊。CNNからViT(Vision Transformer)まで、深層学習による画像認識の基礎がわかる。物体検出や領域分割といった基本的な手法を押さえつつ、自然言語とのマルチモーダル処理もあざやかに解説。
CNNとViTによる画像認識を本格的に学ぶために!
本書は、深層学習(ディープラーニング)に基づく2つの技術、畳込みニューラルネットワーク(CNN)とVision Transformer(ViT)を通して、画像認識の基礎を実践例とともに解説するものです。
画像認識技術は、顔認証や異常検知など、現代社会に欠かせない技術として広く応用されており、研究開発も盛んに行われています。本書では、確かな理解のもとに画像認識技術の研究開発が可能となるよう、前半において理論的な基盤(深層学習の基本事項、畳込みニューラルネットワーク(CNN)、Vision Transformer(ViT))を、紙数を割いてわかりやすく解説していきます。また後半では、代表的な画像認識技術である物体検出と領域分割、学習データの大規模化に欠かせない自己教師あり学習を実例とともに解説し、最終章では今後ますます重要になると見込まれるVision and Languageを詳細に扱います。
全体を通して、擬似コードなどでアルゴリズムを把握できるようにしたほか、Python(PyTorch)のサンプルコードも用意し、読者自身が手を動かして画像認識を実践することができるようにしました。
目次
第1章 画像認識の概要
第2章 深層学習の基礎
第3章 畳込みニューラルネットワーク
第4章 Vision Transformer
第5章 物体検出
第6章 領域分割
第7章 自己教師あり学習
第8章 画像と自然言語
商品詳細
- 出版社名
- オーム社
- サイズ
- 21cm
- 対象年齢
- 一般
- フォーマット
- 単行本
注意事項
- 本の帯に関して
- 帯つきでの出荷はお約束しておりません。
商品ページに、帯のみに付与される特典物等の表記がある場合でも、確実に帯つきでの出荷はお約束しておりません。
また、帯は商品の一部ではなく「広告扱い」のため、帯の有無・破損による交換や返品は承っておりません。 - 版・表紙について
- 版・表紙(カバー)のご指定は承っておりません。ご注文いただくタイミングによっては、お届けする商品の版や表紙が商品ページ上のものとは異なる場合がございます。
また、初版にのみにお付けしている特典(初回特典、初回仕様特典)がある商品は、商品ページに特典の表記がされている場合でも、無くなり次第終了となります。