AI & ML interests
None defined yet.
Recent Activity
Papers
The Physics of Multi-Turn Long-Horizon Planning: From Pre-training to Post-training via Single- and Multi-Teacher On-Policy Agentic Distillation
Why Multi-Step Tool-Use Reinforcement Learning Collapses and How Supervisory Signals Fix It
CASIA 's datasets
None public yet