Salvato in:
| Autori principali: | Li, Chengxuan, Huang, Di, Lu, Zeyu, Xiao, Yang, Pei, Qingqi, Bai, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2403.16407 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Comprehensive Survey on Human Video Generation: Challenges, Methods, and Insights
di: Lei, Wentao, et al.
Pubblicazione: (2024)
di: Lei, Wentao, et al.
Pubblicazione: (2024)
A Comprehensive Survey on Video Scene Parsing:Advances, Challenges, and Prospects
di: Xie, Guohuan, et al.
Pubblicazione: (2025)
di: Xie, Guohuan, et al.
Pubblicazione: (2025)
Self-Supervised Learning of Deviation in Latent Representation for Co-speech Gesture Video Generation
di: Yang, Huan, et al.
Pubblicazione: (2024)
di: Yang, Huan, et al.
Pubblicazione: (2024)
LongLive: Real-time Interactive Long Video Generation
di: Yang, Shuai, et al.
Pubblicazione: (2025)
di: Yang, Shuai, et al.
Pubblicazione: (2025)
Beyond Sole Strength: Customized Ensembles for Generalized Vision-Language Models
di: Lu, Zhihe, et al.
Pubblicazione: (2023)
di: Lu, Zhihe, et al.
Pubblicazione: (2023)
Helios: Real Real-Time Long Video Generation Model
di: Yuan, Shenghai, et al.
Pubblicazione: (2026)
di: Yuan, Shenghai, et al.
Pubblicazione: (2026)
Pura: An Efficient Privacy-Preserving Solution for Face Recognition
di: Xu, Guotao, et al.
Pubblicazione: (2025)
di: Xu, Guotao, et al.
Pubblicazione: (2025)
VideoAuteur: Towards Long Narrative Video Generation
di: Xiao, Junfei, et al.
Pubblicazione: (2025)
di: Xiao, Junfei, et al.
Pubblicazione: (2025)
TokensGen: Harnessing Condensed Tokens for Long Video Generation
di: Ouyang, Wenqi, et al.
Pubblicazione: (2025)
di: Ouyang, Wenqi, et al.
Pubblicazione: (2025)
IPMix: Label-Preserving Data Augmentation Method for Training Robust Classifiers
di: Huang, Zhenglin, et al.
Pubblicazione: (2023)
di: Huang, Zhenglin, et al.
Pubblicazione: (2023)
FiT: Flexible Vision Transformer for Diffusion Model
di: Lu, Zeyu, et al.
Pubblicazione: (2024)
di: Lu, Zeyu, et al.
Pubblicazione: (2024)
Long Context Tuning for Video Generation
di: Guo, Yuwei, et al.
Pubblicazione: (2025)
di: Guo, Yuwei, et al.
Pubblicazione: (2025)
ComfyBench: Benchmarking LLM-based Agents in ComfyUI for Autonomously Designing Collaborative AI Systems
di: Xue, Xiangyuan, et al.
Pubblicazione: (2024)
di: Xue, Xiangyuan, et al.
Pubblicazione: (2024)
A Survey of AI-Generated Video Evaluation
di: Liu, Xiao, et al.
Pubblicazione: (2024)
di: Liu, Xiao, et al.
Pubblicazione: (2024)
A Survey on Visual Anomaly Detection: Challenge, Approach, and Prospect
di: Cao, Yunkang, et al.
Pubblicazione: (2024)
di: Cao, Yunkang, et al.
Pubblicazione: (2024)
FreeLong++: Training-Free Long Video Generation via Multi-band SpectralFusion
di: Lu, Yu, et al.
Pubblicazione: (2025)
di: Lu, Yu, et al.
Pubblicazione: (2025)
A Survey: Spatiotemporal Consistency in Video Generation
di: Yin, Zhiyu, et al.
Pubblicazione: (2025)
di: Yin, Zhiyu, et al.
Pubblicazione: (2025)
E-VRAG: Enhancing Long Video Understanding with Resource-Efficient Retrieval Augmented Generation
di: Xu, Zeyu, et al.
Pubblicazione: (2025)
di: Xu, Zeyu, et al.
Pubblicazione: (2025)
A Survey of Interactive Generative Video
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
Controllable Video Generation: A Survey
di: Ma, Yue, et al.
Pubblicazione: (2025)
di: Ma, Yue, et al.
Pubblicazione: (2025)
Tuning-Free Long Video Generation via Global-Local Collaborative Diffusion
di: Ma, Yongjia, et al.
Pubblicazione: (2025)
di: Ma, Yongjia, et al.
Pubblicazione: (2025)
Context as Memory: Scene-Consistent Interactive Long Video Generation with Memory Retrieval
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
di: Yu, Jiwen, et al.
Pubblicazione: (2025)
A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality
di: Elmoghany, Mohamed, et al.
Pubblicazione: (2025)
di: Elmoghany, Mohamed, et al.
Pubblicazione: (2025)
GenVideoLens: Where LVLMs Fall Short in AI-Generated Video Detection?
di: Zou, Yueying, et al.
Pubblicazione: (2026)
di: Zou, Yueying, et al.
Pubblicazione: (2026)
PVUW 2024 Challenge on Complex Video Understanding: Methods and Results
di: Ding, Henghui, et al.
Pubblicazione: (2024)
di: Ding, Henghui, et al.
Pubblicazione: (2024)
FreeLong: Training-Free Long Video Generation with SpectralBlend Temporal Attention
di: Lu, Yu, et al.
Pubblicazione: (2024)
di: Lu, Yu, et al.
Pubblicazione: (2024)
Addressing the ID-Matching Challenge in Long Video Captioning
di: Yang, Zhantao, et al.
Pubblicazione: (2025)
di: Yang, Zhantao, et al.
Pubblicazione: (2025)
Baseline Method of the Foundation Model Challenge for Ultrasound Image Analysis
di: Deng, Bo, et al.
Pubblicazione: (2026)
di: Deng, Bo, et al.
Pubblicazione: (2026)
EgoLCD: Egocentric Video Generation with Long Context Diffusion
di: Zhang, Liuzhou, et al.
Pubblicazione: (2025)
di: Zhang, Liuzhou, et al.
Pubblicazione: (2025)
WoVoGen: World Volume-aware Diffusion for Controllable Multi-camera Driving Scene Generation
di: Lu, Jiachen, et al.
Pubblicazione: (2023)
di: Lu, Jiachen, et al.
Pubblicazione: (2023)
PanoWan: Lifting Diffusion Video Generation Models to 360° with Latitude/Longitude-aware Mechanisms
di: Xia, Yifei, et al.
Pubblicazione: (2025)
di: Xia, Yifei, et al.
Pubblicazione: (2025)
Versatile Transition Generation with Image-to-Video Diffusion
di: Yang, Zuhao, et al.
Pubblicazione: (2025)
di: Yang, Zuhao, et al.
Pubblicazione: (2025)
SurgLQA: Scalable Long-Horizon Surgical Video Question Answering
di: Guo, Diandian, et al.
Pubblicazione: (2026)
di: Guo, Diandian, et al.
Pubblicazione: (2026)
NTIRE 2026 Challenge on Short-form UGC Video Restoration in the Wild with Generative Models: Datasets, Methods and Results
di: Li, Xin, et al.
Pubblicazione: (2026)
di: Li, Xin, et al.
Pubblicazione: (2026)
MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation
di: Wu, Weijia, et al.
Pubblicazione: (2024)
di: Wu, Weijia, et al.
Pubblicazione: (2024)
Long-Horizon Streaming Video Generation via Hybrid Attention with Decoupled Distillation
di: Li, Ruibin, et al.
Pubblicazione: (2026)
di: Li, Ruibin, et al.
Pubblicazione: (2026)
Remote Sensing Image Dehazing: A Systematic Review of Progress, Challenges, and Prospects
di: Zhou, Heng, et al.
Pubblicazione: (2026)
di: Zhou, Heng, et al.
Pubblicazione: (2026)
PredBench: Benchmarking Spatio-Temporal Prediction across Diverse Disciplines
di: Wang, ZiDong, et al.
Pubblicazione: (2024)
di: Wang, ZiDong, et al.
Pubblicazione: (2024)
Efficient4D: Fast Dynamic 3D Object Generation from a Single-view Video
di: Pan, Zijie, et al.
Pubblicazione: (2024)
di: Pan, Zijie, et al.
Pubblicazione: (2024)
On Learning Multi-Modal Forgery Representation for Diffusion Generated Video Detection
di: Song, Xiufeng, et al.
Pubblicazione: (2024)
di: Song, Xiufeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Comprehensive Survey on Human Video Generation: Challenges, Methods, and Insights
di: Lei, Wentao, et al.
Pubblicazione: (2024) -
A Comprehensive Survey on Video Scene Parsing:Advances, Challenges, and Prospects
di: Xie, Guohuan, et al.
Pubblicazione: (2025) -
Self-Supervised Learning of Deviation in Latent Representation for Co-speech Gesture Video Generation
di: Yang, Huan, et al.
Pubblicazione: (2024) -
LongLive: Real-time Interactive Long Video Generation
di: Yang, Shuai, et al.
Pubblicazione: (2025) -
Beyond Sole Strength: Customized Ensembles for Generalized Vision-Language Models
di: Lu, Zhihe, et al.
Pubblicazione: (2023)