RL²: Fast reinforcement learning via slow reinforcement learning
OpenAI demonstrates a foundational capability for AI agents: meta-learning through reinforcement learning. RL² shows that models can be trained to rapidly adapt to new tasks without retraining, a critical breakthrough for practical AI deployment at scale.
Why it ranks · · RL² (reinforcement learning squared) architecture enables fast task adaptation · November 2016
Read full story