基盤モデルのための強化学習

和地 瞭良/著・文・その他

予約発売日:2026年10月22日

  • 予約
  • 基盤モデルのための強化学習
  • 基盤モデルのための強化学習
  • 基盤モデルのための強化学習
  • 基盤モデルのための強化学習
ISBN
978-4-06-544722-2

¥3,080 税込

14 nanacoポイント

14 セブンマイル

セブン-イレブン受取り(送料無料)

発送目安

発売日前日~2日で発送

宅配(送料¥550税込)

発送目安

発売日前日~2日で発送

交通状況・天候の影響や注文が集中した場合等、お届けにお時間をいただく場合がございます。

商品説明

【推薦の言葉】

基盤モデルの性能を引き上げるうえで、強化学習は中核的な役割を担っている。
本書は、強化学習の基礎から、基盤モデルの事後学習を支える理論と手法、推論時スケーリング、Agentic RLまでを体系的に解説した、世界的にも類書の少ない一冊である。
なぜ強化学習が必要なのか、その可能性と限界を、理論と実例の両面から明快に示す。
AIの今後を見通すうえで、本書は重要な羅針盤となるだろう。
――岡野原大輔(Preferred Networks代表取締役社長)


【本書のポイント】

◆基盤モデルを賢くする強化学習、その理論を体系的に理解する!◆

いま、強化学習は基盤モデルの振る舞いを制御する重要なパラダイムとなっている。各手法がなぜ必要になったのか、どのような仮定のもとで何を最適化しているのか。本書では、これらを数式と直感の両方から解説する。


【主な内容】

第1章 はじめに
第2章 強化学習の基礎
第3章 基盤モデルを改良するための強化学習問題
第4章 強化学習による人間の主観的な選好への適合
第5章 強化学習による客観的な正解をともなうリーズニング能力の改善
第6章 主観的かつ客観的に良いLLMを獲得するには
第7章 言語から他のモダリティへ
第8章 推論時スケーリングと強化学習の関連性
第9章 Agentic RL
第10章 今後の課題
付録A 数学的な基礎
付録B 強化学習の補足
付録C 基盤モデルの基礎
付録D 定理3.2の証明

商品詳細

シリーズ名
KS情報科学専門書
出版社名
講談社
フォーマット
単行本

注意事項

本の帯に関して
帯つきでの出荷はお約束しておりません。
商品ページに、帯のみに付与される特典物等の表記がある場合でも、確実に帯つきでの出荷はお約束しておりません。
また、帯は商品の一部ではなく「広告扱い」のため、帯の有無・破損による交換や返品は承っておりません。
発売日について
商品によっては、セブンネットショッピングの倉庫に搬入される日を発売予定日と表記させていただく場合がございますので、出版社やメーカーが公表している発売日とは異なる場合がございます。
版・表紙について
版・表紙(カバー)のご指定は承っておりません。ご注文いただくタイミングによっては、お届けする商品の版や表紙が商品ページ上のものとは異なる場合がございます。
また、初版にのみにお付けしている特典(初回特典、初回仕様特典)がある商品は、商品ページに特典の表記がされている場合でも、無くなり次第終了となります。