NanoControl: A Lightweight Framework for Precise and Efficient Control in Diffusion Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Shanyuan, Zhu, Jian, Lu, Junda, Gong, Yue, Li, Liuzhuozheng, Cheng, Bo, Ma, Yuhang, Wu, Liebucha, Wu, Xiaoyu, Leng, Dawei, Yin, Yuhui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HiCo: Hierarchical Controllable Diffusion Model for Layout-to-image Generation
par: Cheng, Bo, et autres
Publié: (2024)
par: Cheng, Bo, et autres
Publié: (2024)
CTA-Flux: Integrating Chinese Cultural Semantics into High-Quality English Text-to-Image Communities
par: Gong, Yue, et autres
Publié: (2025)
par: Gong, Yue, et autres
Publié: (2025)
FLUX-Makeup: High-Fidelity, Identity-Consistent, and Robust Makeup Transfer via Diffusion Transformer
par: Zhu, Jian, et autres
Publié: (2025)
par: Zhu, Jian, et autres
Publié: (2025)
NAMI: Efficient Image Generation via Bridged Progressive Rectified Flow Transformers
par: Ma, Yuhang, et autres
Publié: (2025)
par: Ma, Yuhang, et autres
Publié: (2025)
Bridge Diffusion Model: Bridge Chinese Text-to-Image Diffusion Model with English Communities
par: Liu, Shanyuan, et autres
Publié: (2023)
par: Liu, Shanyuan, et autres
Publié: (2023)
RPiAE: A Representation-Pivoted Autoencoder Enhancing Both Image Generation and Editing
par: Gong, Yue, et autres
Publié: (2026)
par: Gong, Yue, et autres
Publié: (2026)
PlanGen: Towards Unified Layout Planning and Image Generation in Auto-Regressive Vision Language Models
par: He, Runze, et autres
Publié: (2025)
par: He, Runze, et autres
Publié: (2025)
RefTon: Reference person shot assist virtual Try-on
par: Li, Liuzhuozheng, et autres
Publié: (2025)
par: Li, Liuzhuozheng, et autres
Publié: (2025)
RevealLayer: Disentangling Hidden and Visible Layers via Occlusion-Aware Image Decomposition
par: Wang, Binhao, et autres
Publié: (2026)
par: Wang, Binhao, et autres
Publié: (2026)
U-StyDiT: Ultra-high Quality Artistic Style Transfer Using Diffusion Transformers
par: Zhang, Zhanjie, et autres
Publié: (2025)
par: Zhang, Zhanjie, et autres
Publié: (2025)
Qihoo-T2X: An Efficient Proxy-Tokenized Diffusion Transformer for Text-to-Any-Task
par: Wang, Jing, et autres
Publié: (2024)
par: Wang, Jing, et autres
Publié: (2024)
WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation
par: Wang, Jing, et autres
Publié: (2025)
par: Wang, Jing, et autres
Publié: (2025)
IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
RzenEmbed: Towards Comprehensive Multimodal Retrieval
par: Jian, Weijian, et autres
Publié: (2025)
par: Jian, Weijian, et autres
Publié: (2025)
Controllable Text Generation with Residual Memory Transformer
par: Zhang, Hanqing, et autres
Publié: (2023)
par: Zhang, Hanqing, et autres
Publié: (2023)
LMM-Det: Make Large Multimodal Models Excel in Object Detection
par: Li, Jincheng, et autres
Publié: (2025)
par: Li, Jincheng, et autres
Publié: (2025)
Intelligent Nano-Fingerprinting: An Efficient and Precise Approach for Liquid Biopsy
par: Yang, Yuxin, et autres
Publié: (2026)
par: Yang, Yuxin, et autres
Publié: (2026)
Nano‐Metal‐Organic Frameworks and Nano‐Covalent‐Organic Frameworks: Controllable Synthesis and Applications
par: Yaxun Hu, et autres
Publié: (2024)
par: Yaxun Hu, et autres
Publié: (2024)
SEAL: Safety Enhanced Trajectory Planning and Control Framework for Quadrotor Flight in Complex Environments
par: Wang, Yiming, et autres
Publié: (2025)
par: Wang, Yiming, et autres
Publié: (2025)
Mechanism of Overbreak and Underbreak Induced by Tunnel Blasting and Control Methods
par: Dongkui Qu, et autres
Publié: (2025)
par: Dongkui Qu, et autres
Publié: (2025)
EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer
par: Zhang, Yuxuan, et autres
Publié: (2025)
par: Zhang, Yuxuan, et autres
Publié: (2025)
MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners
par: Tsai, Fang-Duo, et autres
Publié: (2025)
par: Tsai, Fang-Duo, et autres
Publié: (2025)
SoftCap: Soft-Budget Control for Diffusion Transformer Acceleration
par: Zhang, Yuhang, et autres
Publié: (2026)
par: Zhang, Yuhang, et autres
Publié: (2026)
RelaCtrl: Relevance-Guided Efficient Control for Diffusion Transformers
par: Cao, Ke, et autres
Publié: (2025)
par: Cao, Ke, et autres
Publié: (2025)
FG-CLIP: Fine-Grained Visual and Textual Alignment
par: Xie, Chunyu, et autres
Publié: (2025)
par: Xie, Chunyu, et autres
Publié: (2025)
FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model
par: Xie, Chunyu, et autres
Publié: (2025)
par: Xie, Chunyu, et autres
Publié: (2025)
A Data-Driven Prescribed-Time Control Framework via Koopman Operator and Adaptive Backstepping
par: Wu, Yue
Publié: (2025)
par: Wu, Yue
Publié: (2025)
Fovea Transformer: Efficient Long-Context Modeling with Structured Fine-to-Coarse Attention
par: He, Ziwei, et autres
Publié: (2023)
par: He, Ziwei, et autres
Publié: (2023)
OminiControl2: Efficient Conditioning for Diffusion Transformers
par: Tan, Zhenxiong, et autres
Publié: (2025)
par: Tan, Zhenxiong, et autres
Publié: (2025)
In-Context Audio Control of Video Diffusion Transformers
par: Liu, Wenze, et autres
Publié: (2025)
par: Liu, Wenze, et autres
Publié: (2025)
PISCO: Precise Video Instance Insertion with Sparse Control
par: Gao, Xiangbo, et autres
Publié: (2026)
par: Gao, Xiangbo, et autres
Publié: (2026)
Does Optimal Control Always Benefit from Better Prediction? An Analysis Framework for Predictive Optimal Control
par: Zeng, Xiangrui, et autres
Publié: (2024)
par: Zeng, Xiangrui, et autres
Publié: (2024)
Diffusion Controller: Framework, Algorithms and Parameterization
par: Yang, Tong, et autres
Publié: (2026)
par: Yang, Tong, et autres
Publié: (2026)
Stability-Weighted Decoding for Diffusion Language Models
par: Wu, Yue, et autres
Publié: (2026)
par: Wu, Yue, et autres
Publié: (2026)
Lymph Node‐Targeted Nanomaterials for Controlled Nano‐Immunotherapy
par: Yitong Zhao, et autres
Publié: (2025)
par: Yitong Zhao, et autres
Publié: (2025)
MTMD: A Multi-Task Multi-Domain Framework for Unified Ad Lightweight Ranking at Pinterest
par: Yang, Xiao, et autres
Publié: (2025)
par: Yang, Xiao, et autres
Publié: (2025)
Preparation of Multifunctional Nano‐Protectants for High‐Efficiency Green Control of Anthracnose
par: Jiaming Yin, et autres
Publié: (2024)
par: Jiaming Yin, et autres
Publié: (2024)
An Improved and Untraceable Lightweight Authentication and Key Agreement Scheme for Wireless Body Area Networks
par: Zhongqing Wu, et autres
Publié: (2025)
par: Zhongqing Wu, et autres
Publié: (2025)
SYN-DIGITS: A Synthetic Control Framework for Calibrated Digital Twin Simulation
par: Fan, Grace Jiarui, et autres
Publié: (2026)
par: Fan, Grace Jiarui, et autres
Publié: (2026)
ControlCap: Controllable Region-level Captioning
par: Zhao, Yuzhong, et autres
Publié: (2024)
par: Zhao, Yuzhong, et autres
Publié: (2024)
Documents similaires
-
HiCo: Hierarchical Controllable Diffusion Model for Layout-to-image Generation
par: Cheng, Bo, et autres
Publié: (2024) -
CTA-Flux: Integrating Chinese Cultural Semantics into High-Quality English Text-to-Image Communities
par: Gong, Yue, et autres
Publié: (2025) -
FLUX-Makeup: High-Fidelity, Identity-Consistent, and Robust Makeup Transfer via Diffusion Transformer
par: Zhu, Jian, et autres
Publié: (2025) -
NAMI: Efficient Image Generation via Bridged Progressive Rectified Flow Transformers
par: Ma, Yuhang, et autres
Publié: (2025) -
Bridge Diffusion Model: Bridge Chinese Text-to-Image Diffusion Model with English Communities
par: Liu, Shanyuan, et autres
Publié: (2023)