<新刊情報>
書名:強化学習アルゴリズム入門~「平均」からはじめる基礎と応用~
著者:曽我部東馬
発行:オーム社
AlphaGoがプロ棋士を破った2016年以降、強化学習や深層強化学習はさまざまな分野から注目を集めている。しかし、専門書では難解な専門用語や数式が多用されるため、初学者にとってはハードルが高い状態が続いていた。同書は、そのハードルの高さを解消することを目的に制作された。平均という初歩的な数学を使うことで、「価値」「探索」「マルコフ性」といった強化学習の基本をわかりやすく解説。また、各アルゴリズムについては、「多腕バンディット問題」および「グリッドワールド問題」のいずれかを用いて、比較しやすい状態で解説。そのため、各アルゴリズムの特徴や差異がわかりやすくなっている。さらに、中核的なアルゴリズムについては、PythonとMATLABの2種類のコードを、オーム社のWebサイトおよびGithubで配布。配布コードを実行することで、「原理→数式→プログラム」という一連の流れを直感的に把握できる。