OneActor: Consistent Character Generation via Cluster-Conditioned Guidance
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Jiahao, Yan, Caixia, Lin, Haonan, Zhang, Weizhan, Wang, Mengmeng, Gong, Tieliang, Dai, Guang, Sun, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SpotActor: Training-Free Layout-Controlled Consistent Image Generation
di: Wang, Jiahao, et al.
Pubblicazione: (2024)
di: Wang, Jiahao, et al.
Pubblicazione: (2024)
MVGSR: Multi-View Consistent 3D Gaussian Super-Resolution via Epipolar Guidance
di: Zhang, Kaizhe, et al.
Pubblicazione: (2025)
di: Zhang, Kaizhe, et al.
Pubblicazione: (2025)
Accelerating Non-Maximum Suppression: A Graph Theory Perspective
di: Si, King-Siong, et al.
Pubblicazione: (2024)
di: Si, King-Siong, et al.
Pubblicazione: (2024)
Rectified Diffusion Guidance for Conditional Generation
di: Xia, Mengfei, et al.
Pubblicazione: (2024)
di: Xia, Mengfei, et al.
Pubblicazione: (2024)
Flipped Classroom: Aligning Teacher Attention with Student in Generalized Category Discovery
di: Lin, Haonan, et al.
Pubblicazione: (2024)
di: Lin, Haonan, et al.
Pubblicazione: (2024)
EchoShot: Multi-Shot Portrait Video Generation
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
AnyID: Ultra-Fidelity Universal Identity-Preserving Video Generation from Any Visual References
di: Wang, Jiahao, et al.
Pubblicazione: (2026)
di: Wang, Jiahao, et al.
Pubblicazione: (2026)
InfoSAM: Fine-Tuning the Segment Anything Model from An Information-Theoretic Perspective
di: Zhang, Yuanhong, et al.
Pubblicazione: (2025)
di: Zhang, Yuanhong, et al.
Pubblicazione: (2025)
Schedule Your Edit: A Simple yet Effective Diffusion Noise Schedule for Image Editing
di: Lin, Haonan, et al.
Pubblicazione: (2024)
di: Lin, Haonan, et al.
Pubblicazione: (2024)
DreamSalon: A Staged Diffusion Framework for Preserving Identity-Context in Editable Face Generation
di: Lin, Haonan, et al.
Pubblicazione: (2024)
di: Lin, Haonan, et al.
Pubblicazione: (2024)
Towards the Generalization of Multi-view Learning: An Information-theoretical Analysis
di: Wen, Wen, et al.
Pubblicazione: (2025)
di: Wen, Wen, et al.
Pubblicazione: (2025)
Consistent123: One Image to Highly Consistent 3D Asset Using Case-Aware Diffusion Priors
di: Lin, Yukang, et al.
Pubblicazione: (2023)
di: Lin, Yukang, et al.
Pubblicazione: (2023)
CharaConsist: Fine-Grained Consistent Character Generation
di: Wang, Mengyu, et al.
Pubblicazione: (2025)
di: Wang, Mengyu, et al.
Pubblicazione: (2025)
Tile Classification Based Viewport Prediction with Multi-modal Fusion Transformer
di: Zhang, Zhihao, et al.
Pubblicazione: (2023)
di: Zhang, Zhihao, et al.
Pubblicazione: (2023)
Unsupervised Structural Scene Decomposition via Foreground-Aware Slot Attention with Pseudo-Mask Guidance
di: Sheng, Huankun, et al.
Pubblicazione: (2025)
di: Sheng, Huankun, et al.
Pubblicazione: (2025)
DepthArb: Training-Free Depth-Arbitrated Generation for Occlusion-Robust Image Synthesis
di: Niu, Hongjin, et al.
Pubblicazione: (2026)
di: Niu, Hongjin, et al.
Pubblicazione: (2026)
Exploring Time Conditioning in Diffusion Generative Models from Disjoint Noisy Data Manifolds
di: Li, Liuzhuozheng, et al.
Pubblicazione: (2026)
di: Li, Liuzhuozheng, et al.
Pubblicazione: (2026)
AnyCharV: Bootstrap Controllable Character Video Generation with Fine-to-Coarse Guidance
di: Wang, Zhao, et al.
Pubblicazione: (2025)
di: Wang, Zhao, et al.
Pubblicazione: (2025)
BachVid: Training-Free Video Generation with Consistent Background and Character
di: Yan, Han, et al.
Pubblicazione: (2025)
di: Yan, Han, et al.
Pubblicazione: (2025)
No Other Representation Component Is Needed: Diffusion Transformers Can Provide Representation Guidance by Themselves
di: Jiang, Dengyang, et al.
Pubblicazione: (2025)
di: Jiang, Dengyang, et al.
Pubblicazione: (2025)
How Does Distribution Matching Help Domain Generalization: An Information-theoretic Analysis
di: Dong, Yuxin, et al.
Pubblicazione: (2024)
di: Dong, Yuxin, et al.
Pubblicazione: (2024)
DynamicID: Zero-Shot Multi-ID Image Personalization with Flexible Facial Editability
di: Hu, Xirui, et al.
Pubblicazione: (2025)
di: Hu, Xirui, et al.
Pubblicazione: (2025)
Make-A-Character 2: Animatable 3D Character Generation From a Single Image
di: Liu, Lin, et al.
Pubblicazione: (2025)
di: Liu, Lin, et al.
Pubblicazione: (2025)
Gloria: Consistent Character Video Generation via Content Anchors
di: Yang, Yuhang, et al.
Pubblicazione: (2026)
di: Yang, Yuhang, et al.
Pubblicazione: (2026)
Consistent Video Colorization via Palette Guidance
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
Conditional Text-to-Image Generation with Reference Guidance
di: Kim, Taewook, et al.
Pubblicazione: (2024)
di: Kim, Taewook, et al.
Pubblicazione: (2024)
Information-Theoretic Generalization Bounds of Replay-based Continual Learning
di: Wen, Wen, et al.
Pubblicazione: (2025)
di: Wen, Wen, et al.
Pubblicazione: (2025)
CharacterFactory: Sampling Consistent Characters with GANs for Diffusion Models
di: Wang, Qinghe, et al.
Pubblicazione: (2024)
di: Wang, Qinghe, et al.
Pubblicazione: (2024)
CharacterShot: Controllable and Consistent 4D Character Animation
di: Gao, Junyao, et al.
Pubblicazione: (2025)
di: Gao, Junyao, et al.
Pubblicazione: (2025)
Self-Adversarial One Step Generation via Condition Shifting
di: Liu, Deyuan, et al.
Pubblicazione: (2026)
di: Liu, Deyuan, et al.
Pubblicazione: (2026)
The Chosen One: Consistent Characters in Text-to-Image Diffusion Models
di: Avrahami, Omri, et al.
Pubblicazione: (2023)
di: Avrahami, Omri, et al.
Pubblicazione: (2023)
Low-Biased General Annotated Dataset Generation
di: Jiang, Dengyang, et al.
Pubblicazione: (2024)
di: Jiang, Dengyang, et al.
Pubblicazione: (2024)
MotionLCM: Real-time Controllable Motion Generation via Latent Consistency Model
di: Dai, Wenxun, et al.
Pubblicazione: (2024)
di: Dai, Wenxun, et al.
Pubblicazione: (2024)
Conditional Polarization Guidance for Camouflaged Object Detection
di: Zhang, QIfan, et al.
Pubblicazione: (2026)
di: Zhang, QIfan, et al.
Pubblicazione: (2026)
Follow-Your-MultiPose: Tuning-Free Multi-Character Text-to-Video Generation via Pose Guidance
di: Zhang, Beiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Beiyuan, et al.
Pubblicazione: (2024)
HAODiff: Human-Aware One-Step Diffusion via Dual-Prompt Guidance
di: Gong, Jue, et al.
Pubblicazione: (2025)
di: Gong, Jue, et al.
Pubblicazione: (2025)
Deep Incomplete Multi-view Clustering with Distribution Dual-Consistency Recovery Guidance
di: Jin, Jiaqi, et al.
Pubblicazione: (2025)
di: Jin, Jiaqi, et al.
Pubblicazione: (2025)
Instructing Text-to-Image Diffusion Models via Classifier-Guided Semantic Optimization
di: Chang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Chang, Yuanyuan, et al.
Pubblicazione: (2025)
FancyVideo: Towards Dynamic and Consistent Video Generation via Cross-frame Textual Guidance
di: Feng, Jiasong, et al.
Pubblicazione: (2024)
di: Feng, Jiasong, et al.
Pubblicazione: (2024)
ReMix: Towards a Unified View of Consistent Character Generation and Editing
di: Zhou, Benjia, et al.
Pubblicazione: (2025)
di: Zhou, Benjia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SpotActor: Training-Free Layout-Controlled Consistent Image Generation
di: Wang, Jiahao, et al.
Pubblicazione: (2024) -
MVGSR: Multi-View Consistent 3D Gaussian Super-Resolution via Epipolar Guidance
di: Zhang, Kaizhe, et al.
Pubblicazione: (2025) -
Accelerating Non-Maximum Suppression: A Graph Theory Perspective
di: Si, King-Siong, et al.
Pubblicazione: (2024) -
Rectified Diffusion Guidance for Conditional Generation
di: Xia, Mengfei, et al.
Pubblicazione: (2024) -
Flipped Classroom: Aligning Teacher Attention with Student in Generalized Category Discovery
di: Lin, Haonan, et al.
Pubblicazione: (2024)