AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning Paper • 2608.05987 • Published 1 day ago • 56
CAST: Game Solvers as Turn-Level Teachers for LLM Agents Paper • 2607.25308 • Published 10 days ago • 41