強化学習(キョウカガクシュウ)
- 著者:
- 森村 哲郎(モリムラ テツロウ)
- 出版社:
- 講談社
- 出版日:
- 2019年05月23日頃
- ISBN:
- 9784065155912
- シリーズ:
- 機械学習プロフェッショナルシリーズ
- 在庫:
- 在庫あり
なぜ注目されているか
書籍紹介
理論は裏切らない
・強化学習で必要になる数理を広くカバーした。
・一貫したていねいな解説なので、じっくり読める。付録・参考文献も充実!
・ベルマン方程式、 TD 学習、方策勾配、 POMDP 、深層強化学習をより深く!
【おもな内容】
第 1 章 準備
1.1 強化学習とは
1.2 マルコフ決定過程と逐次的意思決定問題
1.3 方策
1.4 逐次的意思決定問題の定式化
第 2 章 プランニング
2.1 準備
2.2 動的計画法
2.3 動的計画法による解法
2.4 線形計画法による解法
第 3 章 探索と活用のトレードオフ
3.1 概要
3.2 探索と活用のトレードオフ
3.3 方策モデル
第 4 章 モデルフリー型の強化学習
4.1 データにもとづく意思決定
4.2 価値関数の推定
4.3 方策と行動価値関数の学習
4.4 収束性
4.5 アクター・クリティック法
第 5 章 モデルベース型の強化学習
5.1 問題設定の整理
5.2 環境推定
5.3 ブラックボックス生成モデルに対するプランニング
5.4 オンラインのモデルベース型強化学習
第 6 章 関数近似を用いた強化学習
6.1 概要
6.2 価値関数の関数近似
6.3 方策の関数近似
第 7 章 部分観測マルコフ決定過程
7.1 部分観測マルコフ決定過程 (POMDP) の基礎
7.2 POMDP のプランニング
7.3 POMDP の学習
第 8 章 最近の話題
8.1 分布強化学習
8.2 深層強化学習
付録 A 補足
A.1 証明
A.2 ノルム
A.3 線形計画法
A.4 自然勾配法の補足
準備
プランニング
探索と活用のトレードオフ
モデルフリー型の強化学習
モデルベース型の強化学習
関数近似を用いた強化学習
部分観測マルコフ決定過程
最近の話題
技書の森解説
講談社の機械学習プロフェッショナルシリーズ (MLP) に収録された、強化学習の理論を数理的に掘り下げる一冊です。マルコフ決定過程 (MDP) の定式化から始まり、動的計画法、 TD 学習、方策勾配法、さらには分布強化学習まで、各手法を定理と証明を交えて丁寧に導出していきます。直観的な説明だけでは納得しにくい「なぜこの更新式で最適方策に収束するのか」という疑問に、数学の力で正面から答える構成です。
読むには線形代数・確率論・微積分の基礎が必須であり、機械学習の入門書とは明らかに毛色が異なります。実装コードを追いながら理解したい人には Sutton & Barto の教科書のほうが取り組みやすいでしょう。しかし、理論の土台を固めた上で論文を読み解きたい、あるいはアルゴリズムの収束性や最適性の証明を自分で追いたいという段階に達した読者には、日本語で書かれた数少ない本格的参照先として確かな価値を持ちます。
言及 Qiita 記事 (8 件)
データサイエンスにオススメの本80冊!
♡ 256Python, SQL, 機械学習, 統計学, データサイエンス# ざっくりとした強化学習手法の分類
♡ 3機械学習, Python3, 強化学習, ReinforcementLearningマルチエージェントAI特集① COMAアルゴリズム
♡ 1深層強化学習, マルチエージェント深層強化学習, マルチエージェントプラットフォーマーの誤解と真実:AI進化の果てに「人間のデータ」が不可欠になる科学的理由
♡ 0機械学習, ポエム, AI, 論文解説第1回【理論編】人はなぜゲームに熱狂する? ~本能を刺激し、報酬を予感させるゲームの設計図~
♡ 0ポエム, ゲーム制作, 心理学, ゲーム理論, ゲームデザインLLMの調整方法を目的別に整理する — RAGから選好最適化・推論強化RLまで
♡ 0ファインチューニング, LLM, PEFT, 継続事前学習, GRPOAI(言語モデル)利用技術調査:コンテキストエンジニアリング技術関連(2023~2026年ごろ)
♡ 0AI, 歴史, ContextEngineeringGPUの85%が待機時間だった!MIT新手法でRL訓練が最大3倍高速化
♡ 0強化学習, AI, VOICEVOX, きなこもっちー, テック解説
言及 Zenn 記事 (8 件)
深層強化学習のための物理シミュレーション環境構築(PyBullet)
♡ 29python, tensorflow, 深層強化学習, pybullet2020年のKaggle強化学習コンペティションとか強化学習フレームワークをざっと紹介
♡ 29kaggle, 強化学習強化学習アルゴリズムの色々な分類
♡ 24機械学習, 強化学習, 深層学習, アルゴリズム, 理論強化学習で能力は“創発”するのか? - RLスケール則の現在地(2025)
♡ 22強化学習, llm, physicalai実装から始めるはじめての強化学習
♡ 6ai, python, 強化学習, 人工知能強化学習にオシレーターを学ばせるという発想
♡ 4強化学習, システムトレード深層強化学習を用いたロボット制御
♡ 2ai, ロボット, 深層強化学習, 制御工学, ppoDouble DQNで深層強化学習
♡ 1ai, python, 強化学習
この本に興味がある方におすすめ
この本に関連
関連記事
ゲームが好きならプログラミングの本も読める
ゲームの攻略本を読んだことがあるなら、プログラミングの本も読めます。攻略本とプログラミング本の共通点から、読書のハードルを下げます。
機械学習・AI 本ガイド - エンジニアが読むべき技術書の選び方
機械学習の基礎から実践まで学べる技術書の選び方を紹介。「Python ではじめる機械学習」などのハンズオン本を軸に、数学が苦手な人向けの学習ルートと ML 本の賞味期限の見極め方を解説します。
アルゴリズム本ガイド - 競プロだけじゃない、実務に活きる選び方
アルゴリズム本の 3 タイプと、実務でアルゴリズムの知識が活きる場面、数学が苦手な人向けの学習ルートを紹介します。