HUM AI JU Juan Pablo Ávila Páez Enhancing Proximal Policy Optimization (PPO) with Curriculum Learning Disclaimer: I acknowledge the use of Claude 4.5 Opus/Sonnet (Anthropic) and Gemini 3 Pro/Flash (Google) for brainstorming ideas, aiding…
AI HUM YO YouShin kim [Springer] Deep reinforcement learning for multi-agent coordination Background and Overview