FunCineForge: A Unified Dataset Toolkit and Model for Zero-Shot Movie Dubbing in Diverse Cinematic Scenes
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Jiaxuan, Xiang, Yang, Zhao, Han, Li, Xiangang, Ling, Zhenhua |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition
por: Phung, Quynh, et al.
Publicado: (2025)
por: Phung, Quynh, et al.
Publicado: (2025)
CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation
por: Huang, Kaiyi, et al.
Publicado: (2026)
por: Huang, Kaiyi, et al.
Publicado: (2026)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
por: Zheng, Junjie, et al.
Publicado: (2025)
por: Zheng, Junjie, et al.
Publicado: (2025)
HoloCine: Holistic Generation of Cinematic Multi-Shot Long Video Narratives
por: Meng, Yihao, et al.
Publicado: (2025)
por: Meng, Yihao, et al.
Publicado: (2025)
CoSyncDiT: Cognitive Synchronous Diffusion Transformer for Movie Dubbing
por: Cong, Gaoxiang, et al.
Publicado: (2026)
por: Cong, Gaoxiang, et al.
Publicado: (2026)
ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation
por: Yang, Songlin, et al.
Publicado: (2026)
por: Yang, Songlin, et al.
Publicado: (2026)
CineTrans: Learning to Generate Videos with Cinematic Transitions via Masked Diffusion Models
por: Wu, Xiaoxue, et al.
Publicado: (2025)
por: Wu, Xiaoxue, et al.
Publicado: (2025)
CineScale: Free Lunch in High-Resolution Cinematic Visual Generation
por: Qiu, Haonan, et al.
Publicado: (2025)
por: Qiu, Haonan, et al.
Publicado: (2025)
ShotBench: Expert-Level Cinematic Understanding in Vision-Language Models
por: Liu, Hongbo, et al.
Publicado: (2025)
por: Liu, Hongbo, et al.
Publicado: (2025)
CineLOG: A Training Free Approach for Cinematic Long Video Generation
por: Dehghanian, Zahra, et al.
Publicado: (2025)
por: Dehghanian, Zahra, et al.
Publicado: (2025)
Prosody-Enhanced Acoustic Pre-training and Acoustic-Disentangled Prosody Adapting for Movie Dubbing
por: Zhang, Zhedong, et al.
Publicado: (2025)
por: Zhang, Zhedong, et al.
Publicado: (2025)
StableDub: Taming Diffusion Prior for Generalized and Efficient Visual Dubbing
por: Chen, Liyang, et al.
Publicado: (2025)
por: Chen, Liyang, et al.
Publicado: (2025)
Zero-Shot Scene Change Detection
por: Cho, Kyusik, et al.
Publicado: (2024)
por: Cho, Kyusik, et al.
Publicado: (2024)
CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation
por: Wang, Qinghe, et al.
Publicado: (2025)
por: Wang, Qinghe, et al.
Publicado: (2025)
ZeroScene: A Zero-Shot Framework for 3D Scene Generation from a Single Image and Controllable Texture Editing
por: Tang, Xiang, et al.
Publicado: (2025)
por: Tang, Xiang, et al.
Publicado: (2025)
Generative Photographic Control for Scene-Consistent Video Cinematic Editing
por: Sun, Huiqiang, et al.
Publicado: (2025)
por: Sun, Huiqiang, et al.
Publicado: (2025)
MuSS: A Large-Scale Dataset and Cinematic Narrative Benchmark for Multi-Shot Subject-to-Video Generation
por: Zhang, Haojie, et al.
Publicado: (2026)
por: Zhang, Haojie, et al.
Publicado: (2026)
Zero-Shot Multi-Object Scene Completion
por: Iwase, Shun, et al.
Publicado: (2024)
por: Iwase, Shun, et al.
Publicado: (2024)
Zero-Shot Scene Reconstruction from Single Images with Deep Prior Assembly
por: Zhou, Junsheng, et al.
Publicado: (2024)
por: Zhou, Junsheng, et al.
Publicado: (2024)
Towards Zero-Shot Point Cloud Registration Across Diverse Scales, Scenes, and Sensor Setups
por: Lim, Hyungtae, et al.
Publicado: (2026)
por: Lim, Hyungtae, et al.
Publicado: (2026)
MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation
por: Xing, Jinbo, et al.
Publicado: (2025)
por: Xing, Jinbo, et al.
Publicado: (2025)
MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation
por: Wu, Weijia, et al.
Publicado: (2024)
por: Wu, Weijia, et al.
Publicado: (2024)
BUFFER-X: Towards Zero-Shot Point Cloud Registration in Diverse Scenes
por: Seo, Minkyun, et al.
Publicado: (2025)
por: Seo, Minkyun, et al.
Publicado: (2025)
ZeroSCD: Zero-Shot Street Scene Change Detection
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
por: Kannan, Shyam Sundar, et al.
Publicado: (2024)
MICap: A Unified Model for Identity-aware Movie Descriptions
por: Raajesh, Haran, et al.
Publicado: (2024)
por: Raajesh, Haran, et al.
Publicado: (2024)
Zero-Shot Monocular Scene Flow Estimation in the Wild
por: Liang, Yiqing, et al.
Publicado: (2025)
por: Liang, Yiqing, et al.
Publicado: (2025)
VoiceCraft-Dub: Automated Video Dubbing with Neural Codec Language Models
por: Sung-Bin, Kim, et al.
Publicado: (2025)
por: Sung-Bin, Kim, et al.
Publicado: (2025)
Enhancing Remote Sensing Vision-Language Models for Zero-Shot Scene Classification
por: Khoury, Karim El, et al.
Publicado: (2024)
por: Khoury, Karim El, et al.
Publicado: (2024)
FlowDubber: Movie Dubbing with LLM-based Semantic-aware Learning and Flow Matching based Voice Enhancing
por: Cong, Gaoxiang, et al.
Publicado: (2025)
por: Cong, Gaoxiang, et al.
Publicado: (2025)
Self-supervised Dynamic Heterogeneous Degradation Modeling for Unified Zero-Shot Image Restoration
por: Hu, XiaoWan, et al.
Publicado: (2026)
por: Hu, XiaoWan, et al.
Publicado: (2026)
Automatic Funny Scene Extraction from Long-form Cinematic Videos
por: Paul, Sibendu, et al.
Publicado: (2026)
por: Paul, Sibendu, et al.
Publicado: (2026)
Dubbing for Everyone: Data-Efficient Visual Dubbing using Neural Rendering Priors
por: Saunders, Jack, et al.
Publicado: (2024)
por: Saunders, Jack, et al.
Publicado: (2024)
A Unified Reasoning Framework for Holistic Zero-Shot Video Anomaly Analysis
por: Lin, Dongheng, et al.
Publicado: (2025)
por: Lin, Dongheng, et al.
Publicado: (2025)
FunGrasp: Functional Grasping for Diverse Dexterous Hands
por: Huang, Linyi, et al.
Publicado: (2024)
por: Huang, Linyi, et al.
Publicado: (2024)
DeepDubber-V1: Towards High Quality and Dialogue, Narration, Monologue Adaptive Movie Dubbing Via Multi-Modal Chain-of-Thoughts Reasoning Guidance
por: Zheng, Junjie, et al.
Publicado: (2025)
por: Zheng, Junjie, et al.
Publicado: (2025)
The First Swahili Language Scene Text Detection and Recognition Dataset
por: Douamba, Fadila Wendigoundi, et al.
Publicado: (2024)
por: Douamba, Fadila Wendigoundi, et al.
Publicado: (2024)
MPDS: A Movie Posters Dataset for Image Generation with Diffusion Model
por: Xu, Meng, et al.
Publicado: (2024)
por: Xu, Meng, et al.
Publicado: (2024)
The Devil is in the Distributions: Explicit Modeling of Scene Content is Key in Zero-Shot Video Captioning
por: Tian, Mingkai, et al.
Publicado: (2025)
por: Tian, Mingkai, et al.
Publicado: (2025)
VIZOR: Viewpoint-Invariant Zero-Shot Scene Graph Generation for 3D Scene Reasoning
por: Madhavaram, Vivek, et al.
Publicado: (2026)
por: Madhavaram, Vivek, et al.
Publicado: (2026)
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes
por: Mei, Jianbiao, et al.
Publicado: (2024)
por: Mei, Jianbiao, et al.
Publicado: (2024)
Ejemplares similares
-
CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition
por: Phung, Quynh, et al.
Publicado: (2025) -
CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation
por: Huang, Kaiyi, et al.
Publicado: (2026) -
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
por: Zheng, Junjie, et al.
Publicado: (2025) -
HoloCine: Holistic Generation of Cinematic Multi-Shot Long Video Narratives
por: Meng, Yihao, et al.
Publicado: (2025) -
CoSyncDiT: Cognitive Synchronous Diffusion Transformer for Movie Dubbing
por: Cong, Gaoxiang, et al.
Publicado: (2026)