RelaCtrl: Relevance-Guided Efficient Control for Diffusion Transformers
Fuente:
arXiv
Saved in:
| Main Authors: | Cao, Ke, Wang, Jing, Ma, Ao, Feng, Jiasong, He, Xuanhua, Ling, Run, Liu, Haowei, Lu, Jian, Feng, Wei, Wang, Haozhe, Pei, Hongjuan, Shao, Yihua, Zhang, Zhanjie, Zhang, Jie |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation
by: Ma, Ao, et al.
Published: (2025)
by: Ma, Ao, et al.
Published: (2025)
FancyVideo: Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance
by: Feng, Jiasong, et al.
Published: (2024)
by: Feng, Jiasong, et al.
Published: (2024)
FedCVU: Federated Learning for Cross-View Video Understanding
by: Zhang, Shenghan, et al.
Published: (2026)
by: Zhang, Shenghan, et al.
Published: (2026)
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
by: Ling, Run, et al.
Published: (2025)
by: Ling, Run, et al.
Published: (2025)
MoFu: Scale-Aware Modulation and Fourier Fusion for Multi-Subject Video Generation
by: Ling, Run, et al.
Published: (2025)
by: Ling, Run, et al.
Published: (2025)
StyMam: A Mamba-Based Generator for Artistic Style Transfer
by: Hong, Zhou, et al.
Published: (2026)
by: Hong, Zhou, et al.
Published: (2026)
InnoAds-Composer: Efficient Condition Composition for E-Commerce Poster Generation
by: Qin, Yuxin, et al.
Published: (2026)
by: Qin, Yuxin, et al.
Published: (2026)
Qihoo-T2X: An Efficient Proxy-Tokenized Diffusion Transformer for Text-to-Any-Task
by: Wang, Jing, et al.
Published: (2024)
by: Wang, Jing, et al.
Published: (2024)
Cross-Scale Pansharpening via ScaleFormer and the PanScale Benchmark
by: Cao, Ke, et al.
Published: (2026)
by: Cao, Ke, et al.
Published: (2026)
U-StyDiT: Ultra-high Quality Artistic Style Transfer Using Diffusion Transformers
by: Zhang, Zhanjie, et al.
Published: (2025)
by: Zhang, Zhanjie, et al.
Published: (2025)
WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation
by: Wang, Jing, et al.
Published: (2025)
by: Wang, Jing, et al.
Published: (2025)
Ctrl-Z Sampling: Scaling Diffusion Sampling with Controlled Random Zigzag Explorations
by: Mao, Shunqi, et al.
Published: (2025)
by: Mao, Shunqi, et al.
Published: (2025)
DiT4Edit: Diffusion Transformer for Image Editing
by: Feng, Kunyu, et al.
Published: (2024)
by: Feng, Kunyu, et al.
Published: (2024)
Dynamic SINR-Guided Iterative Interference Cancellation for ODDM Systems in Doubly Dispersive Channels
by: Han, Jiasong, et al.
Published: (2025)
by: Han, Jiasong, et al.
Published: (2025)
CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
by: Xi, Dianbing, et al.
Published: (2025)
by: Xi, Dianbing, et al.
Published: (2025)
CFG-Ctrl: Control-Based Classifier-Free Diffusion Guidance
by: Wang, Hanyang, et al.
Published: (2026)
by: Wang, Hanyang, et al.
Published: (2026)
TF-CoDiT: Conditional Time Series Synthesis with Diffusion Transformers for Treasury Futures
by: Zhang, Yingxiao, et al.
Published: (2026)
by: Zhang, Yingxiao, et al.
Published: (2026)
Thermalization and Mpemba-like patterns in effective temperature dynamics of strongly coupled dissipative quantum chaotic systems
by: Wang, Xuanhua, et al.
Published: (2024)
by: Wang, Xuanhua, et al.
Published: (2024)
DexCtrl: Towards Sim-to-Real Dexterity with Adaptive Controller Learning
by: Zhao, Shuqi, et al.
Published: (2025)
by: Zhao, Shuqi, et al.
Published: (2025)
Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding
by: Wang, Yun, et al.
Published: (2025)
by: Wang, Yun, et al.
Published: (2025)
What can we learn about islands and state paradox from quantum information theory?
by: Wang, Xuanhua, et al.
Published: (2021)
by: Wang, Xuanhua, et al.
Published: (2021)
Detector-Empowered Video Large Language Model for Efficient Spatio-Temporal Grounding
by: Gao, Shida, et al.
Published: (2025)
by: Gao, Shida, et al.
Published: (2025)
A Gradient Guided Diffusion Framework for Chance Constrained Programming
by: Zhang, Boyang, et al.
Published: (2025)
by: Zhang, Boyang, et al.
Published: (2025)
Language Model Decoding as Direct Metrics Optimization
by: Ji, Haozhe, et al.
Published: (2023)
by: Ji, Haozhe, et al.
Published: (2023)
FilterLoss: A Transfer Learning Approach for Communication Scene Recognition
by: Han, Jiasong, et al.
Published: (2026)
by: Han, Jiasong, et al.
Published: (2026)
Ctrl-GenAug: Controllable Generative Augmentation for Medical Sequence Classification
by: Zhou, Xinrui, et al.
Published: (2024)
by: Zhou, Xinrui, et al.
Published: (2024)
Ctrl-Crash: Controllable Diffusion for Realistic Car Crashes
by: Gosselin, Anthony, et al.
Published: (2025)
by: Gosselin, Anthony, et al.
Published: (2025)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
by: Huang, Shijue, et al.
Published: (2025)
by: Huang, Shijue, et al.
Published: (2025)
CtrlAttack: A Unified Attack on World-Model Control in Diffusion Models
by: Xu, Shuhan, et al.
Published: (2026)
by: Xu, Shuhan, et al.
Published: (2026)
A novel RHD allele caused by c.767 C>T mutation was identified in a Chinese individual
by: Hongjuan Lyu, et al.
Published: (2024)
by: Hongjuan Lyu, et al.
Published: (2024)
Mpemba effects in nonequilibrium open quantum systems
by: Wang, Xuanhua, et al.
Published: (2024)
by: Wang, Xuanhua, et al.
Published: (2024)
Ctrl123: Consistent Novel View Synthesis via Closed-Loop Transcription
by: Zhao, Hongxiang, et al.
Published: (2024)
by: Zhao, Hongxiang, et al.
Published: (2024)
FullDiT2: Efficient In-Context Conditioning for Video Diffusion Transformers
by: He, Xuanhua, et al.
Published: (2025)
by: He, Xuanhua, et al.
Published: (2025)
Anomalous Hall Effect in Type IV 2D Collinear Magnets
by: Bai, Ling, et al.
Published: (2025)
by: Bai, Ling, et al.
Published: (2025)
TR-DQ: Time-Rotation Diffusion Quantization
by: Shao, Yihua, et al.
Published: (2025)
by: Shao, Yihua, et al.
Published: (2025)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
by: Zhang, Hongfei, et al.
Published: (2025)
by: Zhang, Hongfei, et al.
Published: (2025)
SafeCtrl: Region-Based Safety Control for Text-to-Image Diffusion via Detect-Then-Suppress
by: Zhang, Lingyun, et al.
Published: (2025)
by: Zhang, Lingyun, et al.
Published: (2025)
SafeCtrl: Region-Aware Safety Control for Text-to-Image Diffusion via Detect-Then-Suppress
by: Zhang, Lingyun, et al.
Published: (2026)
by: Zhang, Lingyun, et al.
Published: (2026)
SDiT: Semantic Region-Adaptive for Diffusion Transformers
by: Lin, Bowen, et al.
Published: (2026)
by: Lin, Bowen, et al.
Published: (2026)
FEB-Cache: Frequency-Guided Exposure Bias Reduction for Enhancing Diffusion Transformer Caching
by: Zou, Zhen, et al.
Published: (2025)
by: Zou, Zhen, et al.
Published: (2025)
Similar Items
-
Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story Generation
by: Ma, Ao, et al.
Published: (2025) -
FancyVideo: Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance
by: Feng, Jiasong, et al.
Published: (2024) -
FedCVU: Federated Learning for Cross-View Video Understanding
by: Zhang, Shenghan, et al.
Published: (2026) -
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
by: Ling, Run, et al.
Published: (2025) -
MoFu: Scale-Aware Modulation and Fourier Fusion for Multi-Subject Video Generation
by: Ling, Run, et al.
Published: (2025)