PanGu-Draw: Advancing Resource-Efficient Text-to-Image Synthesis with Time-Decoupled Training and Reusable Coop-Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Guansong, Guo, Yuanfan, Han, Jianhua, Niu, Minzhe, Zeng, Yihan, Xu, Songcen, Huang, Zeyi, Zhong, Zhao, Zhang, Wei, Xu, Hang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PanGu-$π$: Enhancing Language Model Architectures via Nonlinearity Compensation
di: Wang, Yunhe, et al.
Pubblicazione: (2023)
di: Wang, Yunhe, et al.
Pubblicazione: (2023)
PanGu-$π$ Pro:Rethinking Optimization and Architecture for Tiny Language Models
di: Tang, Yehui, et al.
Pubblicazione: (2024)
di: Tang, Yehui, et al.
Pubblicazione: (2024)
LayerDiff: Exploring Text-guided Multi-layered Composable Image Synthesis via Layer-Collaborative Diffusion Model
di: Huang, Runhui, et al.
Pubblicazione: (2024)
di: Huang, Runhui, et al.
Pubblicazione: (2024)
Self-Adaptive Reality-Guided Diffusion for Artifact-Free Super-Resolution
di: Zheng, Qingping, et al.
Pubblicazione: (2024)
di: Zheng, Qingping, et al.
Pubblicazione: (2024)
TextField3D: Towards Enhancing Open-Vocabulary 3D Generation with Noisy Text Fields
di: Huang, Tianyu, et al.
Pubblicazione: (2023)
di: Huang, Tianyu, et al.
Pubblicazione: (2023)
BIVDiff: A Training-Free Framework for General-Purpose Video Synthesis via Bridging Image and Video Diffusion Models
di: Shi, Fengyuan, et al.
Pubblicazione: (2023)
di: Shi, Fengyuan, et al.
Pubblicazione: (2023)
ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance
di: Wang, Chunwei, et al.
Pubblicazione: (2024)
di: Wang, Chunwei, et al.
Pubblicazione: (2024)
DreamControl: Control-Based Text-to-3D Generation with 3D Self-Prior
di: Huang, Tianyu, et al.
Pubblicazione: (2023)
di: Huang, Tianyu, et al.
Pubblicazione: (2023)
VTimeCoT: Thinking by Drawing for Video Temporal Grounding and Reasoning
di: Zhang, Jinglei, et al.
Pubblicazione: (2025)
di: Zhang, Jinglei, et al.
Pubblicazione: (2025)
RealignDiff: Boosting Text-to-Image Diffusion Model with Coarse-to-fine Semantic Re-alignment
di: Jiang, Zutao, et al.
Pubblicazione: (2023)
di: Jiang, Zutao, et al.
Pubblicazione: (2023)
GLaVE-Cap: Global-Local Aligned Video Captioning with Vision Expert Integration
di: Xu, Wan, et al.
Pubblicazione: (2025)
di: Xu, Wan, et al.
Pubblicazione: (2025)
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance
di: Wang, Cong, et al.
Pubblicazione: (2023)
di: Wang, Cong, et al.
Pubblicazione: (2023)
Brick-Diffusion: Generating Long Videos with Brick-to-Wall Denoising
di: Yuan, Yunlong, et al.
Pubblicazione: (2025)
di: Yuan, Yunlong, et al.
Pubblicazione: (2025)
EasyControl: Transfer ControlNet to Video Diffusion for Controllable Generation and Interpolation
di: Wang, Cong, et al.
Pubblicazione: (2024)
di: Wang, Cong, et al.
Pubblicazione: (2024)
When and Why “Consoling” Marginal Underperformers With a Small Versus Zero Reward Hurts Fairness (Without Consolation)
di: Minzhe Xu, et al.
Pubblicazione: (2025)
di: Minzhe Xu, et al.
Pubblicazione: (2025)
Co-Speech Gesture Video Generation via Motion-Decoupled Diffusion Model
di: He, Xu, et al.
Pubblicazione: (2024)
di: He, Xu, et al.
Pubblicazione: (2024)
CGL: Advancing Continual GUI Learning via Reinforcement Fine-Tuning
di: Yao, Zhenquan, et al.
Pubblicazione: (2026)
di: Yao, Zhenquan, et al.
Pubblicazione: (2026)
CoopDiff: Anticipating 3D Human-object Interactions via Contact-consistent Decoupled Diffusion
di: Lin, Xiaotong, et al.
Pubblicazione: (2025)
di: Lin, Xiaotong, et al.
Pubblicazione: (2025)
Fight Poison with Poison: Enhancing Robustness in Few-shot Machine-Generated Text Detection with Adversarial Training
di: Duan, Wenjing, et al.
Pubblicazione: (2026)
di: Duan, Wenjing, et al.
Pubblicazione: (2026)
Collaborative Novel Object Discovery and Box-Guided Cross-Modal Alignment for Open-Vocabulary 3D Object Detection
di: Cao, Yang, et al.
Pubblicazione: (2024)
di: Cao, Yang, et al.
Pubblicazione: (2024)
FreqPrior: Improving Video Diffusion Models with Frequency Filtering Gaussian Noise
di: Yuan, Yunlong, et al.
Pubblicazione: (2025)
di: Yuan, Yunlong, et al.
Pubblicazione: (2025)
Artificial Intelligence Weather Prediction Improves Westward-Moving Typhoon Track Forecasts but Leaves Five-Day Error Variability Unchanged
di: Niu, Zeyi
Pubblicazione: (2026)
di: Niu, Zeyi
Pubblicazione: (2026)
ML-Physical Fusion Models Are Accelerating the Paradigm Shift in Operational Typhoon Forecasting
di: Niu, Zeyi
Pubblicazione: (2025)
di: Niu, Zeyi
Pubblicazione: (2025)
Fuse Your Latents: Video Editing with Multi-source Latent Diffusion Models
di: Lu, Tianyi, et al.
Pubblicazione: (2023)
di: Lu, Tianyi, et al.
Pubblicazione: (2023)
SlowFocus: Enhancing Fine-grained Temporal Understanding in Video LLM
di: Nie, Ming, et al.
Pubblicazione: (2026)
di: Nie, Ming, et al.
Pubblicazione: (2026)
JointDreamer: Ensuring Geometry Consistency and Text Congruence in Text-to-3D Generation via Joint Score Distillation
di: Jiang, Chenhan, et al.
Pubblicazione: (2024)
di: Jiang, Chenhan, et al.
Pubblicazione: (2024)
RADAR: Revealing Asymmetric Development of Abilities in MLLM Pre-training
di: Nie, Yunshuang, et al.
Pubblicazione: (2026)
di: Nie, Yunshuang, et al.
Pubblicazione: (2026)
Boundedness of stable minimal models with klt singularities
di: Zhu, Minzhe
Pubblicazione: (2023)
di: Zhu, Minzhe
Pubblicazione: (2023)
CoopTrack: Exploring End-to-End Learning for Efficient Cooperative Sequential Perception
di: Zhong, Jiaru, et al.
Pubblicazione: (2025)
di: Zhong, Jiaru, et al.
Pubblicazione: (2025)
FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors
di: Zhang, Yabo, et al.
Pubblicazione: (2025)
di: Zhang, Yabo, et al.
Pubblicazione: (2025)
SparseCoop: Cooperative Perception with Kinematic-Grounded Queries
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
A visualization method for data domain changes in CNN networks and the optimization method for selecting thresholds in classification tasks
di: Huang, Minzhe, et al.
Pubblicazione: (2024)
di: Huang, Minzhe, et al.
Pubblicazione: (2024)
GuReT: Distinguishing Guilt and Regret related Text
di: Butt, Sabur, et al.
Pubblicazione: (2024)
di: Butt, Sabur, et al.
Pubblicazione: (2024)
HumanRefiner: Benchmarking Abnormal Human Generation and Refining with Coarse-to-fine Pose-Reversible Guidance
di: Fang, Guian, et al.
Pubblicazione: (2024)
di: Fang, Guian, et al.
Pubblicazione: (2024)
Domain-Skewed Federated Learning with Feature Decoupling and Calibration
di: Wang, Huan, et al.
Pubblicazione: (2026)
di: Wang, Huan, et al.
Pubblicazione: (2026)
ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
di: Huang, Runhui, et al.
Pubblicazione: (2025)
di: Huang, Runhui, et al.
Pubblicazione: (2025)
EDEN: Enhanced Diffusion for High-quality Large-motion Video Frame Interpolation
di: Zhang, Zihao, et al.
Pubblicazione: (2025)
di: Zhang, Zihao, et al.
Pubblicazione: (2025)
Draw2Learn: A Human-AI Collaborative Tool for Drawing-Based Science Learning
di: Hang, Yuqi
Pubblicazione: (2026)
di: Hang, Yuqi
Pubblicazione: (2026)
Iron Sharpens Iron: Defending Against Attacks in Machine-Generated Text Detection with Adversarial Training
di: Li, Yuanfan, et al.
Pubblicazione: (2025)
di: Li, Yuanfan, et al.
Pubblicazione: (2025)
The Power of Static Pricing for Reusable Resources
di: Elmachtoub, Adam N., et al.
Pubblicazione: (2023)
di: Elmachtoub, Adam N., et al.
Pubblicazione: (2023)
Documenti analoghi
-
PanGu-$π$: Enhancing Language Model Architectures via Nonlinearity Compensation
di: Wang, Yunhe, et al.
Pubblicazione: (2023) -
PanGu-$π$ Pro:Rethinking Optimization and Architecture for Tiny Language Models
di: Tang, Yehui, et al.
Pubblicazione: (2024) -
LayerDiff: Exploring Text-guided Multi-layered Composable Image Synthesis via Layer-Collaborative Diffusion Model
di: Huang, Runhui, et al.
Pubblicazione: (2024) -
Self-Adaptive Reality-Guided Diffusion for Artifact-Free Super-Resolution
di: Zheng, Qingping, et al.
Pubblicazione: (2024) -
TextField3D: Towards Enhancing Open-Vocabulary 3D Generation with Noisy Text Fields
di: Huang, Tianyu, et al.
Pubblicazione: (2023)