LoViC: Efficient Long Video Generation with Context Compression
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Jiaxiu, Li, Wenbo, Ren, Jingjing, Qiu, Yuping, Guo, Yong, Xu, Xiaogang, Wu, Han, Zuo, Wangmeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MC$^2$: Multi-concept Guidance for Customized Multi-concept Generation
por: Jiang, Jiaxiu, et al.
Publicado: (2024)
por: Jiang, Jiaxiu, et al.
Publicado: (2024)
Generative Inbetweening through Frame-wise Conditions-Driven Video Generation
por: Zhu, Tianyi, et al.
Publicado: (2024)
por: Zhu, Tianyi, et al.
Publicado: (2024)
LPT++: Efficient Training on Mixture of Long-tailed Experts
por: Dong, Bowen, et al.
Publicado: (2024)
por: Dong, Bowen, et al.
Publicado: (2024)
HP-Edit: A Human-Preference Post-Training Framework for Image Editing
por: Li, Fan, et al.
Publicado: (2026)
por: Li, Fan, et al.
Publicado: (2026)
TextLDM: Language Modeling with Continuous Latent Diffusion
por: Jiang, Jiaxiu, et al.
Publicado: (2026)
por: Jiang, Jiaxiu, et al.
Publicado: (2026)
LoViT: Long Video Transformer for Surgical Phase Recognition
por: Liu, Yang, et al.
Publicado: (2023)
por: Liu, Yang, et al.
Publicado: (2023)
Aggregating Nearest Sharp Features via Hybrid Transformers for Video Deblurring
por: Shang, Wei, et al.
Publicado: (2023)
por: Shang, Wei, et al.
Publicado: (2023)
Auto-FlexSwitch: Efficient Dynamic Model Merging via Learnable Task Vector Compression
por: Gao, Junqi, et al.
Publicado: (2026)
por: Gao, Junqi, et al.
Publicado: (2026)
SelfHVD: Self-Supervised Handheld Video Deblurring
por: Xu, Honglei, et al.
Publicado: (2025)
por: Xu, Honglei, et al.
Publicado: (2025)
LoVR: A Benchmark for Long Video Retrieval in Multimodal Contexts
por: Cai, Qifeng, et al.
Publicado: (2025)
por: Cai, Qifeng, et al.
Publicado: (2025)
Mixture of Contexts for Long Video Generation
por: Cai, Shengqu, et al.
Publicado: (2025)
por: Cai, Shengqu, et al.
Publicado: (2025)
Long Context Tuning for Video Generation
por: Guo, Yuwei, et al.
Publicado: (2025)
por: Guo, Yuwei, et al.
Publicado: (2025)
Voyager: Long-Range and World-Consistent Video Diffusion for Explorable 3D Scene Generation
por: Huang, Tianyu, et al.
Publicado: (2025)
por: Huang, Tianyu, et al.
Publicado: (2025)
LoViF 2026 The First Challenge on Weather Removal in Videos
por: Qian, Chenghao, et al.
Publicado: (2026)
por: Qian, Chenghao, et al.
Publicado: (2026)
VideoRAG: Retrieval-Augmented Generation with Extreme Long-Context Videos
por: Ren, Xubin, et al.
Publicado: (2025)
por: Ren, Xubin, et al.
Publicado: (2025)
LoCoCo: Dropping In Convolutions for Long Context Compression
por: Cai, Ruisi, et al.
Publicado: (2024)
por: Cai, Ruisi, et al.
Publicado: (2024)
Lie Flow: Video Dynamic Fields Modeling and Predicting with Lie Algebra as Geometric Physics Principle
por: Qiao, Weidong, et al.
Publicado: (2026)
por: Qiao, Weidong, et al.
Publicado: (2026)
LongLLMLingua: Accelerating and Enhancing LLMs in Long Context Scenarios via Prompt Compression
por: Jiang, Huiqiang, et al.
Publicado: (2023)
por: Jiang, Huiqiang, et al.
Publicado: (2023)
Improved Generation of Adversarial Examples Against Safety-aligned LLMs
por: Li, Qizhang, et al.
Publicado: (2024)
por: Li, Qizhang, et al.
Publicado: (2024)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
por: Zhang, Yabo, et al.
Publicado: (2024)
por: Zhang, Yabo, et al.
Publicado: (2024)
QR-LoRA: Efficient and Disentangled Fine-tuning via QR Decomposition for Customized Generation
por: Yang, Jiahui, et al.
Publicado: (2025)
por: Yang, Jiahui, et al.
Publicado: (2025)
ScrollScape: Unlocking 32K Image Generation With Video Diffusion Priors
por: Yu, Haodong, et al.
Publicado: (2026)
por: Yu, Haodong, et al.
Publicado: (2026)
ViMo: Generating Motions from Casual Videos
por: Qiu, Liangdong, et al.
Publicado: (2024)
por: Qiu, Liangdong, et al.
Publicado: (2024)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
por: Chen, Yukang, et al.
Publicado: (2023)
por: Chen, Yukang, et al.
Publicado: (2023)
Seeing Beyond Views: Multi-View Driving Scene Video Generation with Holistic Attention
por: Lu, Hannan, et al.
Publicado: (2024)
por: Lu, Hannan, et al.
Publicado: (2024)
Arbitrary-Scale Video Super-Resolution with Structural and Textural Priors
por: Shang, Wei, et al.
Publicado: (2024)
por: Shang, Wei, et al.
Publicado: (2024)
LoVA: Long-form Video-to-Audio Generation
por: Cheng, Xin, et al.
Publicado: (2024)
por: Cheng, Xin, et al.
Publicado: (2024)
Entropy Polarization-Based Data Compression Without Frozen Set Construction
por: Ren, Zichang, et al.
Publicado: (2025)
por: Ren, Zichang, et al.
Publicado: (2025)
GLaVE-Cap: Global-Local Aligned Video Captioning with Vision Expert Integration
por: Xu, Wan, et al.
Publicado: (2025)
por: Xu, Wan, et al.
Publicado: (2025)
Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference
por: Fei, Weizhi, et al.
Publicado: (2025)
por: Fei, Weizhi, et al.
Publicado: (2025)
Deblur4DGS: 4D Gaussian Splatting from Blurry Monocular Video
por: Wu, Renlong, et al.
Publicado: (2024)
por: Wu, Renlong, et al.
Publicado: (2024)
VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling
por: Li, Xinhao, et al.
Publicado: (2024)
por: Li, Xinhao, et al.
Publicado: (2024)
NIR-Assisted Image Denoising: A Selective Fusion Approach and A Real-World Benchmark Dataset
por: Xu, Rongjian, et al.
Publicado: (2024)
por: Xu, Rongjian, et al.
Publicado: (2024)
Language-Guided Graph Representation Learning for Video Summarization
por: Li, Wenrui, et al.
Publicado: (2025)
por: Li, Wenrui, et al.
Publicado: (2025)
AstraNav-Memory: Contexts Compression for Long Memory
por: Ren, Botao, et al.
Publicado: (2025)
por: Ren, Botao, et al.
Publicado: (2025)
LongViTU: Instruction Tuning for Long-Form Video Understanding
por: Wu, Rujie, et al.
Publicado: (2025)
por: Wu, Rujie, et al.
Publicado: (2025)
Turbo2K: Towards Ultra-Efficient and High-Quality 2K Video Synthesis
por: Ren, Jingjing, et al.
Publicado: (2025)
por: Ren, Jingjing, et al.
Publicado: (2025)
Thin-Plate Spline-based Interpolation for Animation Line Inbetweening
por: Zhu, Tianyi, et al.
Publicado: (2024)
por: Zhu, Tianyi, et al.
Publicado: (2024)
PoseGen: In-Context LoRA Finetuning for Pose-Controllable Long Human Video Generation
por: He, Jingxuan, et al.
Publicado: (2025)
por: He, Jingxuan, et al.
Publicado: (2025)
DuoAttention: Efficient Long-Context LLM Inference with Retrieval and Streaming Heads
por: Xiao, Guangxuan, et al.
Publicado: (2024)
por: Xiao, Guangxuan, et al.
Publicado: (2024)
Ejemplares similares
-
MC$^2$: Multi-concept Guidance for Customized Multi-concept Generation
por: Jiang, Jiaxiu, et al.
Publicado: (2024) -
Generative Inbetweening through Frame-wise Conditions-Driven Video Generation
por: Zhu, Tianyi, et al.
Publicado: (2024) -
LPT++: Efficient Training on Mixture of Long-tailed Experts
por: Dong, Bowen, et al.
Publicado: (2024) -
HP-Edit: A Human-Preference Post-Training Framework for Image Editing
por: Li, Fan, et al.
Publicado: (2026) -
TextLDM: Language Modeling with Continuous Latent Diffusion
por: Jiang, Jiaxiu, et al.
Publicado: (2026)