ShortOPD: Recovering Pruned LLMs with Short-to-Long On-Policy Distillation Paper • 2607.13124 • Published 19 days ago • 20
Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling Paper • 2607.02980 • Published 30 days ago • 83
WARP: Weight-Space Analysis for Recovering Training Data Portfolios Paper • 2607.01686 • Published about 1 month ago • 11
Beyond Euclidean Clipping: Overcoming Exploration Collapse in LLM RL via Riemannian Isometric Policy Optimization Paper • 2607.10169 • Published 22 days ago • 14
view article Article LFM2.5-Encoders for Fast Long-Context Inference on CPU LiquidAI • 4 days ago • 57