SSR-Encoder: Encoding Selective Subject Representation for Subject-Driven Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yuxuan, Song, Yiren, Liu, Jiaming, Wang, Rui, Yu, Jinpeng, Tang, Hao, Li, Huaxia, Tang, Xu, Hu, Yao, Pan, Han, Jing, Zhongliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fast Personalized Text-to-Image Syntheses With Attention Injection
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Target-Driven Distillation: Consistency Distillation with Target Timestep Selection and Decoupled Guidance
di: Wang, Cunzheng, et al.
Pubblicazione: (2024)
di: Wang, Cunzheng, et al.
Pubblicazione: (2024)
StableGarment: Garment-Centric Generation via Stable Diffusion
di: Wang, Rui, et al.
Pubblicazione: (2024)
di: Wang, Rui, et al.
Pubblicazione: (2024)
GeoFormer: Learning Point Cloud Completion with Tri-Plane Integrated Transformer
di: Yu, Jinpeng, et al.
Pubblicazione: (2024)
di: Yu, Jinpeng, et al.
Pubblicazione: (2024)
RetriBooru: Leakage-Free Retrieval of Conditions from Reference Images for Subject-Driven Generation
di: Tang, Haoran, et al.
Pubblicazione: (2023)
di: Tang, Haoran, et al.
Pubblicazione: (2023)
Stable-Hair: Real-World Hair Transfer via Diffusion Model
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Subjective Logic Encodings
di: Vasilakes, Jake, et al.
Pubblicazione: (2025)
di: Vasilakes, Jake, et al.
Pubblicazione: (2025)
Subjective Perspectives within Learned Representations Predict High-Impact Innovation
di: Cao, Likun, et al.
Pubblicazione: (2025)
di: Cao, Likun, et al.
Pubblicazione: (2025)
IdGlow: Dynamic Identity Modulation for Multi-Subject Generation
di: Cai, Honghao, et al.
Pubblicazione: (2026)
di: Cai, Honghao, et al.
Pubblicazione: (2026)
Stable-Makeup: When Real-World Makeup Transfer Meets Diffusion Model
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Loom: Diffusion-Transformer for Interleaved Generation
di: Ye, Mingcheng, et al.
Pubblicazione: (2025)
di: Ye, Mingcheng, et al.
Pubblicazione: (2025)
Noise Consistency Regularization for Improved Subject-Driven Image Synthesis
di: Ni, Yao, et al.
Pubblicazione: (2025)
di: Ni, Yao, et al.
Pubblicazione: (2025)
StoryMaker: Towards Holistic Consistent Characters in Text-to-image Generation
di: Zhou, Zhengguang, et al.
Pubblicazione: (2024)
di: Zhou, Zhengguang, et al.
Pubblicazione: (2024)
Comparison of the Pharmacokinetics of Three Budesonide Formulations in Healthy Chinese Subjects
di: Tengrui Yin, et al.
Pubblicazione: (2025)
di: Tengrui Yin, et al.
Pubblicazione: (2025)
Negative-Guided Subject Fidelity Optimization for Zero-Shot Subject-Driven Generation
di: Shin, Chaehun, et al.
Pubblicazione: (2025)
di: Shin, Chaehun, et al.
Pubblicazione: (2025)
DCRMTA: Unbiased Causal Representation for Multi-touch Attribution
di: Tang, Jiaming
Pubblicazione: (2024)
di: Tang, Jiaming
Pubblicazione: (2024)
ASTRA: Let Arbitrary Subjects Transform in Video Editing
di: Shen, Fei, et al.
Pubblicazione: (2025)
di: Shen, Fei, et al.
Pubblicazione: (2025)
Resilient Control of Dynamic Flow Networks Subject to Stochastic Cyber-Physical Disruptions
di: Tang, Yu, et al.
Pubblicazione: (2020)
di: Tang, Yu, et al.
Pubblicazione: (2020)
SMRABooth: Subject and Motion Representation Alignment for Customized Video Generation
di: Xu, Xuancheng, et al.
Pubblicazione: (2025)
di: Xu, Xuancheng, et al.
Pubblicazione: (2025)
DSH-Bench: A Difficulty- and Scenario-Aware Benchmark with Hierarchical Subject Taxonomy for Subject-Driven Text-to-Image Generation
di: Hu, Zhenyu, et al.
Pubblicazione: (2026)
di: Hu, Zhenyu, et al.
Pubblicazione: (2026)
Stencil: Subject-Driven Generation with Context Guidance
di: Chen, Gordon, et al.
Pubblicazione: (2025)
di: Chen, Gordon, et al.
Pubblicazione: (2025)
Improving Subject-Driven Image Synthesis with Subject-Agnostic Guidance
di: Chan, Kelvin C. K., et al.
Pubblicazione: (2024)
di: Chan, Kelvin C. K., et al.
Pubblicazione: (2024)
ActAnywhere: Subject-Aware Video Background Generation
di: Pan, Boxiao, et al.
Pubblicazione: (2024)
di: Pan, Boxiao, et al.
Pubblicazione: (2024)
Language, Cultural Identity, and Spirituality —A Case Study of the Representation of Minority Ethnic Subjects in Chinese Ethnographic Documentary
di: Ruohan Tang, et al.
Pubblicazione: (2024)
di: Ruohan Tang, et al.
Pubblicazione: (2024)
Decomposing Subject-Driven Image Generation via Intermediate Structural Prediction
di: Guo, Hanzhong, et al.
Pubblicazione: (2026)
di: Guo, Hanzhong, et al.
Pubblicazione: (2026)
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering
di: Lu, Runnan, et al.
Pubblicazione: (2025)
di: Lu, Runnan, et al.
Pubblicazione: (2025)
EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer
di: Zhang, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2025)
Knowledge Representation: Subject Analysis.
di: Micco, Mary, et al.
Pubblicazione: (1987)
di: Micco, Mary, et al.
Pubblicazione: (1987)
InstantID: Zero-shot Identity-Preserving Generation in Seconds
di: Wang, Qixun, et al.
Pubblicazione: (2024)
di: Wang, Qixun, et al.
Pubblicazione: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
di: Jiang, Xin, et al.
Pubblicazione: (2026)
di: Jiang, Xin, et al.
Pubblicazione: (2026)
IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
InstanceAssemble: Layout-Aware Image Generation via Instance Assembling Attention
di: Xiang, Qiang, et al.
Pubblicazione: (2025)
di: Xiang, Qiang, et al.
Pubblicazione: (2025)
TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement
di: Sun, Haiyue, et al.
Pubblicazione: (2025)
di: Sun, Haiyue, et al.
Pubblicazione: (2025)
From Competition to Synergy: Unlocking Reinforcement Learning for Subject-Driven Image Generation
di: Huang, Ziwei, et al.
Pubblicazione: (2025)
di: Huang, Ziwei, et al.
Pubblicazione: (2025)
Unlocking the Latent Canvas: Eliciting and Benchmarking Symbolic Visual Expression in LLMs
di: Zheng, Yiren, et al.
Pubblicazione: (2026)
di: Zheng, Yiren, et al.
Pubblicazione: (2026)
Flux Already Knows -- Activating Subject-Driven Image Generation without Training
di: Kang, Hao, et al.
Pubblicazione: (2025)
di: Kang, Hao, et al.
Pubblicazione: (2025)
SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control
di: Huang, Binyuan, et al.
Pubblicazione: (2024)
di: Huang, Binyuan, et al.
Pubblicazione: (2024)
Cross-Subject Mind Decoding from Inaccurate Representations
di: Xu, Yangyang, et al.
Pubblicazione: (2025)
di: Xu, Yangyang, et al.
Pubblicazione: (2025)
Unified Video-Language Pre-training with Synchronized Audio
di: Mo, Shentong, et al.
Pubblicazione: (2024)
di: Mo, Shentong, et al.
Pubblicazione: (2024)
Fine-Tuning Visual Autoregressive Models for Subject-Driven Generation
di: Chung, Jiwoo, et al.
Pubblicazione: (2025)
di: Chung, Jiwoo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fast Personalized Text-to-Image Syntheses With Attention Injection
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024) -
Target-Driven Distillation: Consistency Distillation with Target Timestep Selection and Decoupled Guidance
di: Wang, Cunzheng, et al.
Pubblicazione: (2024) -
StableGarment: Garment-Centric Generation via Stable Diffusion
di: Wang, Rui, et al.
Pubblicazione: (2024) -
GeoFormer: Learning Point Cloud Completion with Tri-Plane Integrated Transformer
di: Yu, Jinpeng, et al.
Pubblicazione: (2024) -
RetriBooru: Leakage-Free Retrieval of Conditions from Reference Images for Subject-Driven Generation
di: Tang, Haoran, et al.
Pubblicazione: (2023)