AutoResearch-RL: Perpetual Self-Evaluating Reinforcement Learning Agents for Autonomous Neural Architecture Discovery Paper • 2603.07300 • Published Mar 7 • 19
view article Article Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident +2 hlarcher, XciD, raphael-gl, chris-rannou • 15 days ago • 454
Group-in-Group Policy Optimization for LLM Agent Training Paper • 2505.10978 • Published May 16, 2025 • 24
nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 Text Generation • 45B • Updated Jul 7 • 237k • 128
GRPO, Dr. GRPO, and DAPO Are Three Operations on One Number: The Group-Standard-Deviation Identity Paper • 2607.00152 • Published Jun 30 • 9
When More Sampling Hurts: The Modal Ceiling and Correlation Ceiling of Test-Time Scaling Paper • 2606.28661 • Published Jun 27 • 8
fastino/gliner2-privacy-filter-PII-multi Token Classification • 0.3B • Updated 21 days ago • 122k • 73