RynnBrain 1.1: Towards More Capable and Generalizable Embodied Foundation Model Paper • 2607.17977 • Published Jul 20 • 200
SUFLECA: Scaling Up Feature Learning for CAD-to-image Alignment Paper • 2607.15058 • Published Jul 16 • 9
Video Generation Models are General-Purpose Vision Learners Paper • 2607.09024 • Published Jul 10 • 90
OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers Paper • 2607.02461 • Published Jul 2 • 42
MemSlides: A Hierarchical Memory Driven Agent Framework for Personalized Slide Generation with Multi-turn Local Revision Paper • 2606.17162 • Published Jun 15 • 180
SciOrch: Learning to Orchestrate Expert LLMs for Solving Frontier Multimodal Scientific Reasoning Tasks Paper • 2606.15872 • Published Jun 14 • 13