Salvato in:
| Autori principali: | Hu, Teng, Zhang, Jiangning, Su, Zihan, Yi, Ran |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2510.18775 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UltraGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention
di: Zhang, Yuyao, et al.
Pubblicazione: (2025)
di: Zhang, Yuyao, et al.
Pubblicazione: (2025)
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
di: Yi, Ran, et al.
Pubblicazione: (2025)
di: Yi, Ran, et al.
Pubblicazione: (2025)
Evolution of Video Generative Foundations
di: Hu, Teng, et al.
Pubblicazione: (2026)
di: Hu, Teng, et al.
Pubblicazione: (2026)
InstanceV: Instance-Level Video Generation
di: Chen, Yuheng, et al.
Pubblicazione: (2025)
di: Chen, Yuheng, et al.
Pubblicazione: (2025)
PoseAnything: Universal Pose-guided Video Generation with Part-aware Temporal Coherence
di: Wang, Ruiyan, et al.
Pubblicazione: (2025)
di: Wang, Ruiyan, et al.
Pubblicazione: (2025)
MotionMaster: Training-free Camera Motion Transfer For Video Generation
di: Hu, Teng, et al.
Pubblicazione: (2024)
di: Hu, Teng, et al.
Pubblicazione: (2024)
SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
di: Hu, Teng, et al.
Pubblicazione: (2024)
di: Hu, Teng, et al.
Pubblicazione: (2024)
PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement
di: Hu, Teng, et al.
Pubblicazione: (2025)
di: Hu, Teng, et al.
Pubblicazione: (2025)
Harmony: Harmonizing Audio and Video Generation through Cross-Task Synergy
di: Hu, Teng, et al.
Pubblicazione: (2025)
di: Hu, Teng, et al.
Pubblicazione: (2025)
UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
di: Xue, Zhucun, et al.
Pubblicazione: (2025)
di: Xue, Zhucun, et al.
Pubblicazione: (2025)
Exploring Real&Synthetic Dataset and Linear Attention in Image Restoration
di: Du, Yuzhen, et al.
Pubblicazione: (2024)
di: Du, Yuzhen, et al.
Pubblicazione: (2024)
Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation
di: Chen, Yuheng, et al.
Pubblicazione: (2026)
di: Chen, Yuheng, et al.
Pubblicazione: (2026)
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
di: Hu, Teng, et al.
Pubblicazione: (2025)
di: Hu, Teng, et al.
Pubblicazione: (2025)
AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion Model
di: Hu, Teng, et al.
Pubblicazione: (2023)
di: Hu, Teng, et al.
Pubblicazione: (2023)
SuperSVG: Superpixel-based Scalable Vector Graphics Synthesis
di: Hu, Teng, et al.
Pubblicazione: (2024)
di: Hu, Teng, et al.
Pubblicazione: (2024)
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
di: Xu, Yicheng, et al.
Pubblicazione: (2026)
di: Xu, Yicheng, et al.
Pubblicazione: (2026)
EfficientIML: Efficient High-Resolution Image Manipulation Localization
di: Li, Jinhan, et al.
Pubblicazione: (2025)
di: Li, Jinhan, et al.
Pubblicazione: (2025)
Hierarchical Patch Diffusion Models for High-Resolution Video Generation
di: Skorokhodov, Ivan, et al.
Pubblicazione: (2024)
di: Skorokhodov, Ivan, et al.
Pubblicazione: (2024)
Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory
di: Liu, Jinzhuo, et al.
Pubblicazione: (2026)
di: Liu, Jinzhuo, et al.
Pubblicazione: (2026)
FreeSwim: Revisiting Sliding-Window Attention Mechanisms for Training-Free Ultra-High-Resolution Video Generation
di: Wu, Yunfeng, et al.
Pubblicazione: (2025)
di: Wu, Yunfeng, et al.
Pubblicazione: (2025)
Image Inversion: A Survey from GANs to Diffusion and Beyond
di: Chen, Yinan, et al.
Pubblicazione: (2025)
di: Chen, Yinan, et al.
Pubblicazione: (2025)
Collaborative Face Experts Fusion in Video Generation: Boosting Identity Consistency Across Large Face Poses
di: Wang, Yuji, et al.
Pubblicazione: (2025)
di: Wang, Yuji, et al.
Pubblicazione: (2025)
Identity-Preserving Text-to-Video Generation Guided by Simple yet Effective Spatial-Temporal Decoupled Representations
di: Wang, Yuji, et al.
Pubblicazione: (2025)
di: Wang, Yuji, et al.
Pubblicazione: (2025)
Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation
di: Chen, Yuheng, et al.
Pubblicazione: (2026)
di: Chen, Yuheng, et al.
Pubblicazione: (2026)
Multi-Dimensional Knowledge Profiling with Large-Scale Literature Database and Hierarchical Retrieval
di: Xue, Zhucun, et al.
Pubblicazione: (2026)
di: Xue, Zhucun, et al.
Pubblicazione: (2026)
Transform Trained Transformer: Accelerating Naive 4K Video Generation Over 10$\times$
di: Zhang, Jiangning, et al.
Pubblicazione: (2025)
di: Zhang, Jiangning, et al.
Pubblicazione: (2025)
RAPTOR: Real-Time High-Resolution UAV Video Prediction with Efficient Video Attention
di: Chen, Zhan, et al.
Pubblicazione: (2025)
di: Chen, Zhan, et al.
Pubblicazione: (2025)
FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation
di: Zhang, Shilong, et al.
Pubblicazione: (2025)
di: Zhang, Shilong, et al.
Pubblicazione: (2025)
PixelWizard: Towards Efficient High-Fidelity Video Generation at Ultra-Large Spatial Resolution
di: Li, Wenxue, et al.
Pubblicazione: (2026)
di: Li, Wenxue, et al.
Pubblicazione: (2026)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
Compressed Video Super-Resolution based on Hierarchical Encoding
di: Jiang, Yuxuan, et al.
Pubblicazione: (2025)
di: Jiang, Yuxuan, et al.
Pubblicazione: (2025)
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
di: Chen, Yinan, et al.
Pubblicazione: (2025)
di: Chen, Yinan, et al.
Pubblicazione: (2025)
GenVideoLens: Where LVLMs Fall Short in AI-Generated Video Detection?
di: Zou, Yueying, et al.
Pubblicazione: (2026)
di: Zou, Yueying, et al.
Pubblicazione: (2026)
HANet: A Hierarchical Attention Network for Change Detection With Bitemporal Very-High-Resolution Remote Sensing Images
di: Han, Chengxi, et al.
Pubblicazione: (2024)
di: Han, Chengxi, et al.
Pubblicazione: (2024)
OSV: One Step is Enough for High-Quality Image to Video Generation
di: Mao, Xiaofeng, et al.
Pubblicazione: (2024)
di: Mao, Xiaofeng, et al.
Pubblicazione: (2024)
SemanticGen: Video Generation in Semantic Space
di: Bai, Jianhong, et al.
Pubblicazione: (2025)
di: Bai, Jianhong, et al.
Pubblicazione: (2025)
AtlasVid: Efficient Ultra-High-Resolution Long Video Generation via Decoupled Global-Local Modeling
di: Mai, Ziyang, et al.
Pubblicazione: (2026)
di: Mai, Ziyang, et al.
Pubblicazione: (2026)
Fast Video Generation with Sliding Tile Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
HiMat: DiT-based Ultra-High Resolution SVBRDF Generation
di: Wang, Zixiong, et al.
Pubblicazione: (2025)
di: Wang, Zixiong, et al.
Pubblicazione: (2025)
Breaking Complexity Barriers: High-Resolution Image Restoration with Rank Enhanced Linear Attention
di: Ai, Yuang, et al.
Pubblicazione: (2025)
di: Ai, Yuang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
UltraGen: Efficient Ultra-High-Resolution Image Generation with Hierarchical Local Attention
di: Zhang, Yuyao, et al.
Pubblicazione: (2025) -
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
di: Yi, Ran, et al.
Pubblicazione: (2025) -
Evolution of Video Generative Foundations
di: Hu, Teng, et al.
Pubblicazione: (2026) -
InstanceV: Instance-Level Video Generation
di: Chen, Yuheng, et al.
Pubblicazione: (2025) -
PoseAnything: Universal Pose-guided Video Generation with Part-aware Temporal Coherence
di: Wang, Ruiyan, et al.
Pubblicazione: (2025)