3 PRO
xuzishan
AI & ML interests
None yet
Recent Activity
upvoted a paper 1 day ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning submitted a paper 1 day ago
EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement LearningOrganizations
None yet