UltraGen: High-Resolution Video Generation with Hierarchical Attention
Fuente:
arXiv
Guardado en:
| Autores principales: | Hu, Teng, Zhang, Jiangning, Su, Zihan, Yi, Ran |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UltraGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention
por: Zhang, Yuyao, et al.
Publicado: (2025)
por: Zhang, Yuyao, et al.
Publicado: (2025)
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
por: Yi, Ran, et al.
Publicado: (2025)
por: Yi, Ran, et al.
Publicado: (2025)
InstanceV: Instance-Level Video Generation
por: Chen, Yuheng, et al.
Publicado: (2025)
por: Chen, Yuheng, et al.
Publicado: (2025)
Evolution of Video Generative Foundations
por: Hu, Teng, et al.
Publicado: (2026)
por: Hu, Teng, et al.
Publicado: (2026)
PoseAnything: Universal Pose-guided Video Generation with Part-aware Temporal Coherence
por: Wang, Ruiyan, et al.
Publicado: (2025)
por: Wang, Ruiyan, et al.
Publicado: (2025)
MotionMaster: Training-free Camera Motion Transfer For Video Generation
por: Hu, Teng, et al.
Publicado: (2024)
por: Hu, Teng, et al.
Publicado: (2024)
SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
por: Hu, Teng, et al.
Publicado: (2024)
por: Hu, Teng, et al.
Publicado: (2024)
UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
por: Xue, Zhucun, et al.
Publicado: (2025)
por: Xue, Zhucun, et al.
Publicado: (2025)
Harmony: Harmonizing Audio and Video Generation through Cross-Task Synergy
por: Hu, Teng, et al.
Publicado: (2025)
por: Hu, Teng, et al.
Publicado: (2025)
PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement
por: Hu, Teng, et al.
Publicado: (2025)
por: Hu, Teng, et al.
Publicado: (2025)
Exploring Real&Synthetic Dataset and Linear Attention in Image Restoration
por: Du, Yuzhen, et al.
Publicado: (2024)
por: Du, Yuzhen, et al.
Publicado: (2024)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
por: Chen, Yuheng, et al.
Publicado: (2026)
por: Chen, Yuheng, et al.
Publicado: (2026)
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
por: Hu, Teng, et al.
Publicado: (2025)
por: Hu, Teng, et al.
Publicado: (2025)
AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion Model
por: Hu, Teng, et al.
Publicado: (2023)
por: Hu, Teng, et al.
Publicado: (2023)
Hierarchical Patch Diffusion Models for High-Resolution Video Generation
por: Skorokhodov, Ivan, et al.
Publicado: (2024)
por: Skorokhodov, Ivan, et al.
Publicado: (2024)
FreeSwim: Revisiting Sliding-Window Attention Mechanisms for Training-Free Ultra-High-Resolution Video Generation
por: Wu, Yunfeng, et al.
Publicado: (2025)
por: Wu, Yunfeng, et al.
Publicado: (2025)
SuperSVG: Superpixel-based Scalable Vector Graphics Synthesis
por: Hu, Teng, et al.
Publicado: (2024)
por: Hu, Teng, et al.
Publicado: (2024)
EfficientIML: Efficient High-Resolution Image Manipulation Localization
por: Li, Jinhan, et al.
Publicado: (2025)
por: Li, Jinhan, et al.
Publicado: (2025)
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
por: Xu, Yicheng, et al.
Publicado: (2026)
por: Xu, Yicheng, et al.
Publicado: (2026)
Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory
por: Liu, Jinzhuo, et al.
Publicado: (2026)
por: Liu, Jinzhuo, et al.
Publicado: (2026)
RAPTOR: Real-Time High-Resolution UAV Video Prediction with Efficient Video Attention
por: Chen, Zhan, et al.
Publicado: (2025)
por: Chen, Zhan, et al.
Publicado: (2025)
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
por: Wang, Yuji, et al.
Publicado: (2025)
por: Wang, Yuji, et al.
Publicado: (2025)
Identity-Preserving Text-to-Video Generation Guided by Simple yet Effective Spatial-Temporal Decoupled Representations
por: Wang, Yuji, et al.
Publicado: (2025)
por: Wang, Yuji, et al.
Publicado: (2025)
PixelWizard: Towards Efficient High-Fidelity Video Generation at Ultra-Large Spatial Resolution
por: Li, Wenxue, et al.
Publicado: (2026)
por: Li, Wenxue, et al.
Publicado: (2026)
FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation
por: Zhang, Shilong, et al.
Publicado: (2025)
por: Zhang, Shilong, et al.
Publicado: (2025)
Multi-Dimensional Knowledge Profiling with Large-Scale Literature Database and Hierarchical Retrieval
por: Xue, Zhucun, et al.
Publicado: (2026)
por: Xue, Zhucun, et al.
Publicado: (2026)
Transform Trained Transformer: Accelerating Naive 4K Video Generation Over 10$\times$
por: Zhang, Jiangning, et al.
Publicado: (2025)
por: Zhang, Jiangning, et al.
Publicado: (2025)
Image Inversion: A Survey from GANs to Diffusion and Beyond
por: Chen, Yinan, et al.
Publicado: (2025)
por: Chen, Yinan, et al.
Publicado: (2025)
Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation
por: Chen, Yuheng, et al.
Publicado: (2026)
por: Chen, Yuheng, et al.
Publicado: (2026)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
por: Yang, Shuo, et al.
Publicado: (2025)
por: Yang, Shuo, et al.
Publicado: (2025)
AtlasVid: Efficient Ultra-High-Resolution Long Video Generation via Decoupled Global-Local Modeling
por: Mai, Ziyang, et al.
Publicado: (2026)
por: Mai, Ziyang, et al.
Publicado: (2026)
HANet: A Hierarchical Attention Network for Change Detection With Bitemporal Very-High-Resolution Remote Sensing Images
por: Han, Chengxi, et al.
Publicado: (2024)
por: Han, Chengxi, et al.
Publicado: (2024)
GenVideoLens: Where LVLMs Fall Short in AI-Generated Video Detection?
por: Zou, Yueying, et al.
Publicado: (2026)
por: Zou, Yueying, et al.
Publicado: (2026)
SemanticGen: Video Generation in Semantic Space
por: Bai, Jianhong, et al.
Publicado: (2025)
por: Bai, Jianhong, et al.
Publicado: (2025)
OSV: One Step is Enough for High-Quality Image to Video Generation
por: Mao, Xiaofeng, et al.
Publicado: (2024)
por: Mao, Xiaofeng, et al.
Publicado: (2024)
Fast Video Generation with Sliding Tile Attention
por: Zhang, Peiyuan, et al.
Publicado: (2025)
por: Zhang, Peiyuan, et al.
Publicado: (2025)
Compressed Video Super-Resolution based on Hierarchical Encoding
por: Jiang, Yuxuan, et al.
Publicado: (2025)
por: Jiang, Yuxuan, et al.
Publicado: (2025)
HiMat: DiT-based Ultra-High Resolution SVBRDF Generation
por: Wang, Zixiong, et al.
Publicado: (2025)
por: Wang, Zixiong, et al.
Publicado: (2025)
ViBe: Ultra-High-Resolution Video Synthesis Born from Pure Images
por: Wu, Yunfeng, et al.
Publicado: (2026)
por: Wu, Yunfeng, et al.
Publicado: (2026)
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
por: Chen, Yinan, et al.
Publicado: (2025)
por: Chen, Yinan, et al.
Publicado: (2025)
Ejemplares similares
-
UltraGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention
por: Zhang, Yuyao, et al.
Publicado: (2025) -
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
por: Yi, Ran, et al.
Publicado: (2025) -
InstanceV: Instance-Level Video Generation
por: Chen, Yuheng, et al.
Publicado: (2025) -
Evolution of Video Generative Foundations
por: Hu, Teng, et al.
Publicado: (2026) -
PoseAnything: Universal Pose-guided Video Generation with Part-aware Temporal Coherence
por: Wang, Ruiyan, et al.
Publicado: (2025)