MC-Sparse: Deconstructing and Closing the Dense-Sparse Attention Gap in Diffusion Transformers Paper • 2610.06801 • Published 6 days ago • 33
Does Native 3D Texture Generation Necessarily Require 3D Assets for Training? Paper • 2609.34621 • Published 13 days ago • 10
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing Paper • 2604.04911 • Published Apr 6 • 33
ViGoR-Bench: How Far Are Visual Generative Models From Zero-Shot Visual Reasoners? Paper • 2603.25823 • Published Mar 26 • 43
Efficient Autoregressive Video Diffusion with Dummy Head Paper • 2601.20499 • Published Jan 28 • 8