RealisID: Scale-Robust and Fine-Controllable Identity Customization via Local and Global Complementation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Zhaoyang, Du, Fei, Chen, Weihua, Wang, Fan, Chen, Yaxiong, Rong, Yi, Xiong, Shengwu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SHMT: Self-supervised Hierarchical Makeup Transfer via Latent Diffusion Models
par: Sun, Zhaoyang, et autres
Publié: (2024)
par: Sun, Zhaoyang, et autres
Publié: (2024)
Content-Style Decoupling for Unsupervised Makeup Transfer without Generating Pseudo Ground Truth
par: Sun, Zhaoyang, et autres
Publié: (2024)
par: Sun, Zhaoyang, et autres
Publié: (2024)
AnyArtisticGlyph: Multilingual Controllable Artistic Glyph Generation
par: Lu, Xiongbo, et autres
Publié: (2025)
par: Lu, Xiongbo, et autres
Publié: (2025)
Location-Oriented Sound Event Localization and Detection with Spatial Mapping and Regression Localization
par: Zhang, Xueping, et autres
Publié: (2025)
par: Zhang, Xueping, et autres
Publié: (2025)
Adaptive Learning via a Negative Selection Strategy for Few-Shot Bioacoustic Event Detection
par: Chen, Yaxiong, et autres
Publié: (2024)
par: Chen, Yaxiong, et autres
Publié: (2024)
RealisMotion: Decomposed Human Motion Control and Video Generation in the World Space
par: Liang, Jingyun, et autres
Publié: (2025)
par: Liang, Jingyun, et autres
Publié: (2025)
RealisDance-DiT: Simple yet Strong Baseline towards Controllable Character Animation in the Wild
par: Zhou, Jingkai, et autres
Publié: (2025)
par: Zhou, Jingkai, et autres
Publié: (2025)
RealisDance: Equip controllable character animation with realistic hands
par: Zhou, Jingkai, et autres
Publié: (2024)
par: Zhou, Jingkai, et autres
Publié: (2024)
RealisHuman: A Two-Stage Approach for Refining Malformed Human Parts in Generated Images
par: Wang, Benzhi, et autres
Publié: (2024)
par: Wang, Benzhi, et autres
Publié: (2024)
RealisVSR: Detail-enhanced Diffusion for Real-World 4K Video Super-Resolution
par: Zhao, Weisong, et autres
Publié: (2025)
par: Zhao, Weisong, et autres
Publié: (2025)
Visual Grounding with Multi-modal Conditional Adaptation
par: Yao, Ruilin, et autres
Publié: (2024)
par: Yao, Ruilin, et autres
Publié: (2024)
Balancing Conservatism and Aggressiveness: Prototype-Affinity Hybrid Network for Few-Shot Segmentation
par: Zou, Tianyu, et autres
Publié: (2025)
par: Zou, Tianyu, et autres
Publié: (2025)
ColLab: A Collaborative Spatial Progressive Data Engine for Referring Expression Comprehension and Generation
par: Zhang, Shilan, et autres
Publié: (2025)
par: Zhang, Shilan, et autres
Publié: (2025)
UniCrossAdapter: Multimodal Adaptation of CLIP for Radiology Report Generation
par: Chen, Yaxiong, et autres
Publié: (2025)
par: Chen, Yaxiong, et autres
Publié: (2025)
ProPL: Universal Semi-Supervised Ultrasound Image Segmentation via Prompt-Guided Pseudo-Labeling
par: Chen, Yaxiong, et autres
Publié: (2025)
par: Chen, Yaxiong, et autres
Publié: (2025)
UMO: Scaling Multi-Identity Consistency for Image Customization via Matching Reward
par: Cheng, Yufeng, et autres
Publié: (2025)
par: Cheng, Yufeng, et autres
Publié: (2025)
One-Shot Medical Video Object Segmentation via Temporal Contrastive Memory Networks
par: Chen, Yaxiong, et autres
Publié: (2025)
par: Chen, Yaxiong, et autres
Publié: (2025)
CausalCLIPSeg: Unlocking CLIP's Potential in Referring Medical Image Segmentation with Causal Intervention
par: Chen, Yaxiong, et autres
Publié: (2025)
par: Chen, Yaxiong, et autres
Publié: (2025)
Striving for Simplicity: Simple Yet Effective Prior-Aware Pseudo-Labeling for Semi-Supervised Ultrasound Image Segmentation
par: Chen, Yaxiong, et autres
Publié: (2025)
par: Chen, Yaxiong, et autres
Publié: (2025)
PuLID: Pure and Lightning ID Customization via Contrastive Alignment
par: Guo, Zinan, et autres
Publié: (2024)
par: Guo, Zinan, et autres
Publié: (2024)
Reali, presunte, ideali, ma pur sempre donne
par: Teucci, Simonetta
Publié: (2025)
par: Teucci, Simonetta
Publié: (2025)
ConsistentID: Portrait Generation with Multimodal Fine-Grained Identity Preserving
par: Huang, Jiehui, et autres
Publié: (2024)
par: Huang, Jiehui, et autres
Publié: (2024)
Infinite-ID: Identity-preserved Personalization via ID-semantics Decoupling Paradigm
par: Wu, Yi, et autres
Publié: (2024)
par: Wu, Yi, et autres
Publié: (2024)
Aligning MLLM Benchmark With Human Preferences via Structural Equation Modeling
par: Xiong, Shengwu., et autres
Publié: (2025)
par: Xiong, Shengwu., et autres
Publié: (2025)
Designing Simple Mechanisms
par: Li, Shengwu
Publié: (2024)
par: Li, Shengwu
Publié: (2024)
Robust Visual Localization via Semantic-Guided Multi-Scale Transformer
par: Tian, Zhongtao, et autres
Publié: (2025)
par: Tian, Zhongtao, et autres
Publié: (2025)
FaceID-6M: A Large-Scale, Open-Source FaceID Customization Dataset
par: Wang, Shuhe, et autres
Publié: (2025)
par: Wang, Shuhe, et autres
Publié: (2025)
Proteus-ID: ID-Consistent and Motion-Coherent Video Customization
par: Zhang, Guiyu, et autres
Publié: (2025)
par: Zhang, Guiyu, et autres
Publié: (2025)
LumosX: Relate Any Identities with Their Attributes for Personalized Video Generation
par: Xing, Jiazheng, et autres
Publié: (2026)
par: Xing, Jiazheng, et autres
Publié: (2026)
Substitution or Complement? Uncovering the Interplay between Ride-hailing Services and Public Transit
par: Jin, Zhicheng, et autres
Publié: (2025)
par: Jin, Zhicheng, et autres
Publié: (2025)
XVerse: Consistent Multi-Subject Control of Identity and Semantic Attributes via DiT Modulation
par: Chen, Bowen, et autres
Publié: (2025)
par: Chen, Bowen, et autres
Publié: (2025)
Dual Diversity and Pseudo‐Label Correction Learning for Semi‐Supervised Medical Image Segmentation
par: Guangxing Du, et autres
Publié: (2025)
par: Guangxing Du, et autres
Publié: (2025)
Futures Commission Merchants Concentration and Commodity Futures Market Microstructure: Empirical Evidence
par: Shengwu Du, et autres
Publié: (2026)
par: Shengwu Du, et autres
Publié: (2026)
LaVieID: Local Autoregressive Diffusion Transformers for Identity-Preserving Video Creation
par: Song, Wenhui, et autres
Publié: (2025)
par: Song, Wenhui, et autres
Publié: (2025)
ID-Eraser: Proactive Defense Against Face Swapping via Identity Perturbation
par: Luo, Junyan, et autres
Publié: (2026)
par: Luo, Junyan, et autres
Publié: (2026)
A Training-Free Approach for Multi-ID Customization via Attention Adjustment and Spatial Control
par: Lin, Jiawei, et autres
Publié: (2025)
par: Lin, Jiawei, et autres
Publié: (2025)
MagicID: Hybrid Preference Optimization for ID-Consistent and Dynamic-Preserved Video Customization
par: Li, Hengjia, et autres
Publié: (2025)
par: Li, Hengjia, et autres
Publié: (2025)
Diff-PC: Identity-preserving and 3D-aware Controllable Diffusion for Zero-shot Portrait Customization
par: Xu, Yifang, et autres
Publié: (2026)
par: Xu, Yifang, et autres
Publié: (2026)
Scale Up Composed Image Retrieval Learning via Modification Text Generation
par: Zhou, Yinan, et autres
Publié: (2025)
par: Zhou, Yinan, et autres
Publié: (2025)
Beyond Textual Context: Structural Graph Encoding with Adaptive Space Alignment to alleviate the hallucination of LLMs
par: Zhang, Yifang, et autres
Publié: (2025)
par: Zhang, Yifang, et autres
Publié: (2025)
Documents similaires
-
SHMT: Self-supervised Hierarchical Makeup Transfer via Latent Diffusion Models
par: Sun, Zhaoyang, et autres
Publié: (2024) -
Content-Style Decoupling for Unsupervised Makeup Transfer without Generating Pseudo Ground Truth
par: Sun, Zhaoyang, et autres
Publié: (2024) -
AnyArtisticGlyph: Multilingual Controllable Artistic Glyph Generation
par: Lu, Xiongbo, et autres
Publié: (2025) -
Location-Oriented Sound Event Localization and Detection with Spatial Mapping and Regression Localization
par: Zhang, Xueping, et autres
Publié: (2025) -
Adaptive Learning via a Negative Selection Strategy for Few-Shot Bioacoustic Event Detection
par: Chen, Yaxiong, et autres
Publié: (2024)