RecreationWorld: Scalable and Verifiable Environments for Hybrid Computer-Use Agents Paper • 2609.22000 • Published 10 days ago • 77
Circuit Hypernetworks for Quantum-Augmented Diffusion Language Models Paper • 2609.24657 • Published 7 days ago • 40
Transferring the Intelligence of VLMs to Robotic Control Paper • 2609.22966 • Published 9 days ago • 118
OmniVChat: Synthesizing, Benchmarking, and Training for Native Audio-Visual Dialogue Paper • 2609.21465 • Published 10 days ago • 149
Grounded Action Model: 3D Grounding as a Foundation for Robotics Paper • 2609.23863 • Published 8 days ago • 89
RULER: Instance-aware Rubric Rewards for SVG Generation Paper • 2609.25270 • Published 7 days ago • 101
Document Retrieval-Aware Chunking (D-RAC): Universal Retrieval-Aware Ingestion of Enterprise Documents via PDF Normalization and Multimodal Markdown Conversion Paper • 2609.24220 • Published 7 days ago • 68
Paint-Anything: Unified Any-Color Control for Image Generation and Editing Paper • 2609.20816 • Published 11 days ago • 56
IntBMoE: Integrating Block-Level Conditioning into Expert Composition for Full-Participation Mixture-of-Experts Paper • 2609.21346 • Published 10 days ago • 101
BI-Agent and BI-Bench: Towards Automating End-to-End Business Intelligence Paper • 2609.20886 • Published 12 days ago • 30
MintAct: A Unified Visual Agent for Digital Environments Paper • 2609.22083 • Published 10 days ago • 35
Designer-RSI: Evolving Procedural Memory from User Traffic for Agentic Graphic Design Paper • 2609.22086 • Published 10 days ago • 34
Ovis-Embedding: Pushing the Frontiers of Universal Omni-Modal Embeddings Paper • 2609.25165 • Published 7 days ago • 73
OmniVBench: A Benchmark and Large-Scale Dataset for Omni Reference-to-Video Generation Paper • 2609.22069 • Published 10 days ago • 37
One to More, More to One: Category-Aware Iterative Expert Training for Software Engineering Agents Paper • 2609.23377 • Published 8 days ago • 50
onPanda: Efficient Annotation of On-Policy Alignment Data for LLMs and Agents via Token-Level Correction Paper • 2609.24983 • Published 7 days ago • 55
GAE: Learning a Geometry-Native Latent Space for 3D-Consistent World Generation Paper • 2609.24981 • Published 7 days ago • 69
All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-Experts Paper • 2609.24058 • Published 7 days ago • 55