RL
Posts about reinforcement learning.
-
Exploring plateaus in prior self-play setups.
-
A basic introduction to policy gradient for language models.
-
Results replicating the recent L1 paper.
-
Looking into using reinforcement learning to train Pokemon battle bots.