arxiv:2608.00782
Zhengxi Lu
LZXzju
AI & ML interests
None yet
Recent Activity
upvoted a paper 26 minutes ago
OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models upvoted a paper about 3 hours ago
EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning upvoted a paper about 5 hours ago
AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning