AsymRnR: Video Diffusion Transformers Acceleration with Asymmetric Reduction and Restoration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Wenhao, Tu, Rong-Cheng, Liao, Jingyi, Jin, Zhao, Tao, Dacheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diffusion Model-Based Video Editing: A Survey
par: Sun, Wenhao, et autres
Publié: (2024)
par: Sun, Wenhao, et autres
Publié: (2024)
VORTA: Efficient Video Diffusion via Routing Sparse Attention
par: Sun, Wenhao, et autres
Publié: (2025)
par: Sun, Wenhao, et autres
Publié: (2025)
SPAgent: Adaptive Task Decomposition and Model Selection for General Video Generation and Editing
par: Tu, Rong-Cheng, et autres
Publié: (2024)
par: Tu, Rong-Cheng, et autres
Publié: (2024)
SPAZER: Spatial-Semantic Progressive Reasoning Agent for Zero-shot 3D Visual Grounding
par: Jin, Zhao, et autres
Publié: (2025)
par: Jin, Zhao, et autres
Publié: (2025)
AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization
par: Liao, Jingyi, et autres
Publié: (2025)
par: Liao, Jingyi, et autres
Publié: (2025)
Lightning Fast Caching-based Parallel Denoising Prediction for Accelerating Talking Head Generation
par: Long, Jianzhi, et autres
Publié: (2025)
par: Long, Jianzhi, et autres
Publié: (2025)
MLLM-Guided VLM Fine-Tuning with Joint Inference for Zero-Shot Composed Image Retrieval
par: Tu, Rong-Cheng, et autres
Publié: (2025)
par: Tu, Rong-Cheng, et autres
Publié: (2025)
Robust Distribution Alignment for Industrial Anomaly Detection under Distribution Shift
par: Liao, Jingyi, et autres
Publié: (2025)
par: Liao, Jingyi, et autres
Publié: (2025)
AsymLoc: Towards Asymmetric Feature Matching for Efficient Visual Localization
par: Omama, Mohammad, et autres
Publié: (2026)
par: Omama, Mohammad, et autres
Publié: (2026)
Just-in-Time: Training-Free Spatial Acceleration for Diffusion Transformers
par: Sun, Wenhao, et autres
Publié: (2026)
par: Sun, Wenhao, et autres
Publié: (2026)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
par: Tu, Rong-Cheng, et autres
Publié: (2025)
par: Tu, Rong-Cheng, et autres
Publié: (2025)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
par: Xi, Haocheng, et autres
Publié: (2025)
par: Xi, Haocheng, et autres
Publié: (2025)
AsymFormer: Asymmetrical Cross-Modal Representation Learning for Mobile Platform Real-Time RGB-D Semantic Segmentation
par: Du, Siqi, et autres
Publié: (2023)
par: Du, Siqi, et autres
Publié: (2023)
Steering Video Diffusion Transformers with Massive Activations
par: Cheng, Xianhang, et autres
Publié: (2026)
par: Cheng, Xianhang, et autres
Publié: (2026)
$Δ$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers
par: Chen, Pengtao, et autres
Publié: (2024)
par: Chen, Pengtao, et autres
Publié: (2024)
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
par: Wang, Jianyi, et autres
Publié: (2025)
par: Wang, Jianyi, et autres
Publié: (2025)
DiTVR: Zero-Shot Diffusion Transformer for Video Restoration
par: Gao, Sicheng, et autres
Publié: (2025)
par: Gao, Sicheng, et autres
Publié: (2025)
TDiR: Transformer based Diffusion for Image Restoration Tasks
par: Anwar, Abbas, et autres
Publié: (2025)
par: Anwar, Abbas, et autres
Publié: (2025)
AsymLoRA: Harmonizing Data Conflicts and Commonalities in MLLMs
par: Wei, Xuyang, et autres
Publié: (2025)
par: Wei, Xuyang, et autres
Publié: (2025)
Astraea: A Token-wise Acceleration Framework for Video Diffusion Transformers
par: Liu, Haosong, et autres
Publié: (2025)
par: Liu, Haosong, et autres
Publié: (2025)
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
par: Ding, Hangliang, et autres
Publié: (2025)
par: Ding, Hangliang, et autres
Publié: (2025)
Vivid-VR: Distilling Concepts from Text-to-Video Diffusion Transformer for Photorealistic Video Restoration
par: Bai, Haoran, et autres
Publié: (2025)
par: Bai, Haoran, et autres
Publié: (2025)
Diff-Restorer: Unleashing Visual Prompts for Diffusion-based Universal Image Restoration
par: Zhang, Yuhong, et autres
Publié: (2024)
par: Zhang, Yuhong, et autres
Publié: (2024)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
par: Chen, Pengtao, et autres
Publié: (2025)
par: Chen, Pengtao, et autres
Publié: (2025)
Unifying Heterogeneous Degradations: Uncertainty-Aware Diffusion Bridge Model for All-in-One Image Restoration
par: Tu, Luwei, et autres
Publié: (2026)
par: Tu, Luwei, et autres
Publié: (2026)
RnG: A Unified Transformer for Complete 3D Modeling from Partial Observations
par: Xiang, Mochu, et autres
Publié: (2026)
par: Xiang, Mochu, et autres
Publié: (2026)
A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models
par: Shuai, Xincheng, et autres
Publié: (2024)
par: Shuai, Xincheng, et autres
Publié: (2024)
Temporal-Consistent Video Restoration with Pre-trained Diffusion Models
par: Wang, Hengkang, et autres
Publié: (2025)
par: Wang, Hengkang, et autres
Publié: (2025)
T2V-OptJail: Discrete Prompt Optimization for Text-to-Video Jailbreak Attacks
par: Liu, Jiayang, et autres
Publié: (2025)
par: Liu, Jiayang, et autres
Publié: (2025)
IRBridge: Solving Image Restoration Bridge with Pre-trained Generative Diffusion Models
par: Wang, Hanting, et autres
Publié: (2025)
par: Wang, Hanting, et autres
Publié: (2025)
Asymmetric VAE for One-Step Video Super-Resolution Acceleration
par: Li, Jianze, et autres
Publié: (2025)
par: Li, Jianze, et autres
Publié: (2025)
Unified Diffusion Transformer for High-fidelity Text-Aware Image Restoration
par: Kim, Jin Hyeon, et autres
Publié: (2025)
par: Kim, Jin Hyeon, et autres
Publié: (2025)
DreamID-V:Bridging the Image-to-Video Gap for High-Fidelity Face Swapping via Diffusion Transformer
par: Guo, Xu, et autres
Publié: (2026)
par: Guo, Xu, et autres
Publié: (2026)
Local-consistent Transformation Learning for Rotation-invariant Point Cloud Analysis
par: Chen, Yiyang, et autres
Publié: (2024)
par: Chen, Yiyang, et autres
Publié: (2024)
TPGDiff: Hierarchical Triple-Prior Guided Diffusion for Image Restoration
par: Tu, Yanjie, et autres
Publié: (2026)
par: Tu, Yanjie, et autres
Publié: (2026)
Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning
par: Chen, Yiyang, et autres
Publié: (2025)
par: Chen, Yiyang, et autres
Publié: (2025)
SSP-IR: Semantic and Structure Priors for Diffusion-based Realistic Image Restoration
par: Zhang, Yuhong, et autres
Publié: (2024)
par: Zhang, Yuhong, et autres
Publié: (2024)
Zero-Shot Video Restoration and Enhancement with Assistance of Video Diffusion Models
par: Cao, Cong, et autres
Publié: (2026)
par: Cao, Cong, et autres
Publié: (2026)
MonoFormer: One Transformer for Both Diffusion and Autoregression
par: Zhao, Chuyang, et autres
Publié: (2024)
par: Zhao, Chuyang, et autres
Publié: (2024)
Video Virtual Try-on with Conditional Diffusion Transformer Inpainter
par: Zou, Cheng, et autres
Publié: (2025)
par: Zou, Cheng, et autres
Publié: (2025)
Documents similaires
-
Diffusion Model-Based Video Editing: A Survey
par: Sun, Wenhao, et autres
Publié: (2024) -
VORTA: Efficient Video Diffusion via Routing Sparse Attention
par: Sun, Wenhao, et autres
Publié: (2025) -
SPAgent: Adaptive Task Decomposition and Model Selection for General Video Generation and Editing
par: Tu, Rong-Cheng, et autres
Publié: (2024) -
SPAZER: Spatial-Semantic Progressive Reasoning Agent for Zero-shot 3D Visual Grounding
par: Jin, Zhao, et autres
Publié: (2025) -
AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization
par: Liao, Jingyi, et autres
Publié: (2025)