ShotPlan: Cinematic Video Generation with Learnable Planning Token Paper • 2607.17675 • Published 8 days ago • 6
DiFA: Inference-Time Forward-Process Alignment for Diffusion Models Paper • 2607.17972 • Published 8 days ago • 7
FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry Paper • 2607.18227 • Published 8 days ago • 49
HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement Paper • 2607.18217 • Published 8 days ago • 59