Paper page - AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning
… The following papers were recommended by the Semantic Scholar API Agentic Reinforcement Learning with Self-Distilled Reward Shaping 2026 EviSD: Evidence-Conditioned Self-Distillation for Search-Augmented Agents 2026 OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning 2026 ATOD: An… …