Xiang Hu
AI & ML interests
None yet
Recent Activity
upvoted a paper 5 days ago
T1: Terminal Agent Reinforcement Learning for Long-Horizon Tasks upvoted a paper 7 days ago
FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience