HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement Paper • 2607.18217 • Published 2 days ago • 46
DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation Paper • 2606.26058 • Published 28 days ago • 67
MUSE-VL: Modeling Unified VLM through Semantic Discrete Encoding Paper • 2411.17762 • Published Nov 26, 2024