2019-08-18から1日間の記事一覧

2019-08-18

Prioritized Experience Replayのsum-treeの実装

強化学習 Python

つくりながら学ぶ！深層強化学習のPrioritized Experience Replayの実装は、説明をシンプルにするためReplay Memoryを線形で探索する実装が紹介されていた。つまり、各transitionのTD誤差を優先度として、0からReplay Memoryの優先度の合計の間で、ランダム…

TadaoYamaokaの開発日記

個人開発しているスマホアプリや将棋AIの開発ネタを中心に書いていきます。

2019-08-18から1日間の記事一覧

Prioritized Experience Replayのsum-treeの実装