マルコフ決定過程 モデル化の基礎と応用事例
発売日:2021年3月
- ページ数
- 245p
- ISBN
- 978-4-627-85521-2
- 著者情報
- 前田 康成(マエダ ヤスナリ)
1997年早稲田大学理工学研究科修士課程機械工学専攻修了。1997年日本電信電話株式会社入社。1997年同社情報通信研究所勤務。1999年同社サイバースペース研究所勤務。2000年東日本電信電話株式会社研究開発センタ勤務。2004年博士(工学)(早稲田大学)。2005年北見工業大学助手。2007年北見工業大学助教。2010年北見工業大学准教授。2016年北見工業大学教授
セブン-イレブン受取り(送料無料)
発送目安
発売日(発売日以降は当日)~2日で発送
宅配(送料¥550税込)
発送目安
発売日(発売日以降は当日)~2日で発送
交通状況・天候の影響や注文が集中した場合等、お届けにお時間をいただく場合がございます。
商品説明
MDPでモデル化するための地力を養う。強化学習・深層強化学習のしくみの理解にも役に立つ。アルゴリズムの徹底詳説×豊富な応用事例。
目次
マルコフ決定過程とは
マルコフ決定過程の基本的な問題設定とアルゴリズム
マルコフ決定過程の基本的な機械学習
真のパラメータが変化するマルコフ決定過程
状態、行動、利得に関する工夫
推薦システムへの適用―基本的な非割引問題
金融工学への適用―基本的な割引問題
ロールプレイングゲームへの適用―複数の情報で構成される状態+複数の独立な試行で構成される状態遷移確率によるモデル
通信工学への適用―複数の情報で構成される状態+少数のパラメータで構成される状態遷移確率によるモデル
ベイズ流の仮説検定への適用―最後の期においてのみ利得が発生するモデル(基礎)
教育工学への適用―最後の期においてのみ利得が発生するモデル(発展)
設備保全、アセットマネジメントとヘルスケア支援への適用―良好な状態維持が目的のモデル
深層強化学習の入口
付録A マルコフ連鎖
付録B 隠れマルコフモデル
付録C ベイズ統計と統計的決定理論
商品詳細
- 出版社名
- 森北出版
- サイズ
- 22cm
- フォーマット
- 単行本
注意事項
- 本の帯に関して
- 帯つきでの出荷はお約束しておりません。
商品ページに、帯のみに付与される特典物等の表記がある場合でも、確実に帯つきでの出荷はお約束しておりません。
また、帯は商品の一部ではなく「広告扱い」のため、帯の有無・破損による交換や返品は承っておりません。 - 版・表紙について
- 版・表紙(カバー)のご指定は承っておりません。ご注文いただくタイミングによっては、お届けする商品の版や表紙が商品ページ上のものとは異なる場合がございます。
また、初版にのみにお付けしている特典(初回特典、初回仕様特典)がある商品は、商品ページに特典の表記がされている場合でも、無くなり次第終了となります。