RefVideo-6M: A Reliable Reference-Based Dataset for Instructional Video Editing Paper • 2608.26101 • Published 11 days ago • 4
N_0-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens Paper • 2607.23782 • Published Jul 26 • 78