LastOPD: Taming Collapse in Latent On-Policy Distillation Paper • 2609.28845 • Published 4 days ago • 2
TimeEvo: Failure-Driven Self-Evolution of a Time Series Agent Paper • 2609.27277 • Published 4 days ago • 2
Harness-Zero: Harness Distillation via Agent-as-Harness Paper • 2609.24974 • Published 6 days ago • 36
Harness-Zero: Harness Distillation via Agent-as-Harness Paper • 2609.24974 • Published 6 days ago • 36
Macaron-A2UI: A Model for Generative UI in Personal Agents Paper • 2605.24830 • Published May 24 • 83
Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent Values Paper • 2605.10365 • Published May 11 • 10
Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent Values Paper • 2605.10365 • Published May 11 • 10