FlexiFilm: Long Video Generation with Flexible Conditions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ouyang, Yichen, Yuan, jianhao, Zhao, Hao, Wang, Gaoang, zhao, Bo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FlexiDreamer: Single Image-to-3D Generation with FlexiCubes
par: Zhao, Ruowen, et autres
Publié: (2024)
par: Zhao, Ruowen, et autres
Publié: (2024)
MultiModal Action Conditioned Video Generation
par: Li, Yichen, et autres
Publié: (2025)
par: Li, Yichen, et autres
Publié: (2025)
FlexiMo: A Flexible Remote Sensing Foundation Model
par: Li, Xuyang, et autres
Publié: (2025)
par: Li, Xuyang, et autres
Publié: (2025)
AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding
par: Xu, Weili, et autres
Publié: (2025)
par: Xu, Weili, et autres
Publié: (2025)
FlexiCrackNet: A Flexible Pipeline for Enhanced Crack Segmentation with General Features Transfered from SAM
par: Wan, Xinlong, et autres
Publié: (2025)
par: Wan, Xinlong, et autres
Publié: (2025)
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
par: Song, Enxin, et autres
Publié: (2024)
par: Song, Enxin, et autres
Publié: (2024)
LumosFlow: Motion-Guided Long Video Generation
par: Chen, Jiahao, et autres
Publié: (2025)
par: Chen, Jiahao, et autres
Publié: (2025)
ConditionVideo: Training-Free Condition-Guided Text-to-Video Generation
par: Peng, Bo, et autres
Publié: (2023)
par: Peng, Bo, et autres
Publié: (2023)
FlexiD-Fuse: Flexible number of inputs multi-modal medical image fusion based on diffusion model
par: Xu, Yushen, et autres
Publié: (2025)
par: Xu, Yushen, et autres
Publié: (2025)
FlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios
par: Zhang, Shiyi, et autres
Publié: (2025)
par: Zhang, Shiyi, et autres
Publié: (2025)
Spatial-Conditioned Reasoning in Long-Egocentric Videos
par: Tribble, James, et autres
Publié: (2026)
par: Tribble, James, et autres
Publié: (2026)
DSG-World: Learning a 3D Gaussian World Model from Dual State Videos
par: Hu, Wenhao, et autres
Publié: (2025)
par: Hu, Wenhao, et autres
Publié: (2025)
DCARL: A Divide-and-Conquer Framework for Autoregressive Long-Trajectory Video Generation
par: Ouyang, Junyi, et autres
Publié: (2026)
par: Ouyang, Junyi, et autres
Publié: (2026)
Frame-Level Captions for Long Video Generation with Complex Multi Scenes
par: Zheng, Guangcong, et autres
Publié: (2025)
par: Zheng, Guangcong, et autres
Publié: (2025)
FlexiTex: Enhancing Texture Generation via Visual Guidance
par: Jiang, DaDong, et autres
Publié: (2024)
par: Jiang, DaDong, et autres
Publié: (2024)
MaskFlow: Discrete Flows For Flexible and Efficient Long Video Generation
par: Fuest, Michael, et autres
Publié: (2025)
par: Fuest, Michael, et autres
Publié: (2025)
HoloCine: Holistic Generation of Cinematic Multi-Shot Long Video Narratives
par: Meng, Yihao, et autres
Publié: (2025)
par: Meng, Yihao, et autres
Publié: (2025)
OmniShow: Unifying Multimodal Conditions for Human-Object Interaction Video Generation
par: Zhou, Donghao, et autres
Publié: (2026)
par: Zhou, Donghao, et autres
Publié: (2026)
Understanding Dynamic Scenes in Ego Centric 4D Point Clouds
par: Huang, Junsheng, et autres
Publié: (2025)
par: Huang, Junsheng, et autres
Publié: (2025)
PianoFlow: Music-Aware Streaming Piano Motion Generation with Bimanual Coordination
par: Wang, Xuan, et autres
Publié: (2026)
par: Wang, Xuan, et autres
Publié: (2026)
Adapting to Length Shift: FlexiLength Network for Trajectory Prediction
par: Xu, Yi, et autres
Publié: (2024)
par: Xu, Yi, et autres
Publié: (2024)
SpikeMM: Flexi-Magnification of High-Speed Micro-Motions
par: Zhang, Baoyue, et autres
Publié: (2024)
par: Zhang, Baoyue, et autres
Publié: (2024)
Disjoint Contrastive Regression Learning for Multi-Sourced Annotations
par: Ruan, Xiaoqian, et autres
Publié: (2021)
par: Ruan, Xiaoqian, et autres
Publié: (2021)
MovieChat: From Dense Token to Sparse Memory for Long Video Understanding
par: Song, Enxin, et autres
Publié: (2023)
par: Song, Enxin, et autres
Publié: (2023)
TokensGen: Harnessing Condensed Tokens for Long Video Generation
par: Ouyang, Wenqi, et autres
Publié: (2025)
par: Ouyang, Wenqi, et autres
Publié: (2025)
FlexSelect: Flexible Token Selection for Efficient Long Video Understanding
par: Zhang, Yunzhu, et autres
Publié: (2025)
par: Zhang, Yunzhu, et autres
Publié: (2025)
DynaHOI: Benchmarking Hand-Object Interaction for Dynamic Target
par: Hu, BoCheng, et autres
Publié: (2026)
par: Hu, BoCheng, et autres
Publié: (2026)
Generative Frame Sampler for Long Video Understanding
par: Yao, Linli, et autres
Publié: (2025)
par: Yao, Linli, et autres
Publié: (2025)
Brick-Diffusion: Generating Long Videos with Brick-to-Wall Denoising
par: Yuan, Yunlong, et autres
Publié: (2025)
par: Yuan, Yunlong, et autres
Publié: (2025)
EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
par: Tian, Linrui, et autres
Publié: (2024)
par: Tian, Linrui, et autres
Publié: (2024)
VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory
par: Yu, Yifei, et autres
Publié: (2025)
par: Yu, Yifei, et autres
Publié: (2025)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
par: Cao, Mingdeng, et autres
Publié: (2024)
par: Cao, Mingdeng, et autres
Publié: (2024)
OmniMem: Scalable and Adaptive Memory Retrieval for Long Video Generation
par: Zhao, Lin, et autres
Publié: (2026)
par: Zhao, Lin, et autres
Publié: (2026)
Recent Advances in Embedding Methods for Multi-Object Tracking: A Survey
par: Wang, Gaoang, et autres
Publié: (2022)
par: Wang, Gaoang, et autres
Publié: (2022)
CORE: Compact Object-centric REpresentations as a New Paradigm for Token Merging in LVLMs
par: Lei, Jingyu, et autres
Publié: (2025)
par: Lei, Jingyu, et autres
Publié: (2025)
Helios: Real Real-Time Long Video Generation Model
par: Yuan, Shenghai, et autres
Publié: (2026)
par: Yuan, Shenghai, et autres
Publié: (2026)
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
par: Hao, Shengyu, et autres
Publié: (2024)
par: Hao, Shengyu, et autres
Publié: (2024)
Omni-Video 2: Scaling MLLM-Conditioned Diffusion for Unified Video Generation and Editing
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
LaMo: Self-Supervised Latent Motion Priors for Physical Realism in Video Generation
par: Jiang, Bo, et autres
Publié: (2026)
par: Jiang, Bo, et autres
Publié: (2026)
FlexAM: Flexible Appearance-Motion Decomposition for Versatile Video Generation Control
par: Sheng, Mingzhi, et autres
Publié: (2026)
par: Sheng, Mingzhi, et autres
Publié: (2026)
Documents similaires
-
FlexiDreamer: Single Image-to-3D Generation with FlexiCubes
par: Zhao, Ruowen, et autres
Publié: (2024) -
MultiModal Action Conditioned Video Generation
par: Li, Yichen, et autres
Publié: (2025) -
FlexiMo: A Flexible Remote Sensing Foundation Model
par: Li, Xuyang, et autres
Publié: (2025) -
AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding
par: Xu, Weili, et autres
Publié: (2025) -
FlexiCrackNet: A Flexible Pipeline for Enhanced Crack Segmentation with General Features Transfered from SAM
par: Wan, Xinlong, et autres
Publié: (2025)