RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning Paper • 2609.20784 • Published 5 days ago • 45
HyQuant: Hybrid-Precision Quantization for LLM Attention Paper • 2608.27875 • Published 25 days ago • 30
RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks? Paper • 2609.05324 • Published 18 days ago • 28
Multi-Grid Post-Training for Long-Form Multi-Shot Video Generation Paper • 2609.06373 • Published 16 days ago • 17