Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning
Rethinking policy updates to make cooperative multi-agent reinforcement learning more stable.
Reinforcement learning
Work on multi-agent coordination, partial observability, and policy optimization.
Rethinking policy updates to make cooperative multi-agent reinforcement learning more stable.
Using state information during training to improve offline reinforcement learning with incomplete observations.