WithAnyone: Towards Controllable and ID Consistent Image Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Hengyuan, Cheng, Wei, Xing, Peng, Fang, Yixiao, Wu, Shuhan, Wang, Rui, Zeng, Xianfang, Jiang, Daxin, Yu, Gang, Ma, Xingjun, Jiang, Yu-Gang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation
por: Chang, Jingjing, et al.
Publicado: (2025)
por: Chang, Jingjing, et al.
Publicado: (2025)
PixelSmile: Toward Fine-Grained Facial Expression Editing
por: Hua, Jiabin, et al.
Publicado: (2026)
por: Hua, Jiabin, et al.
Publicado: (2026)
AIM: Additional Image Guided Generation of Transferable Adversarial Attacks
por: Li, Teng, et al.
Publicado: (2025)
por: Li, Teng, et al.
Publicado: (2025)
OmniSVG: A Unified Scalable Vector Graphics Generation Model
por: Yang, Yiying, et al.
Publicado: (2025)
por: Yang, Yiying, et al.
Publicado: (2025)
OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens
por: Yang, Yiying, et al.
Publicado: (2026)
por: Yang, Yiying, et al.
Publicado: (2026)
BadPatch: Diffusion-Based Generation of Physical Adversarial Patches
por: Wang, Zhixiang, et al.
Publicado: (2024)
por: Wang, Zhixiang, et al.
Publicado: (2024)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
por: Yin, Fukun, et al.
Publicado: (2025)
por: Yin, Fukun, et al.
Publicado: (2025)
UnSeg: One Universal Unlearnable Example Generator is Enough against All Image Segmentation
por: Sun, Ye, et al.
Publicado: (2024)
por: Sun, Ye, et al.
Publicado: (2024)
SC-Captioner: Improving Image Captioning with Self-Correction by Reinforcement Learning
por: Zhang, Lin, et al.
Publicado: (2025)
por: Zhang, Lin, et al.
Publicado: (2025)
GenBreak: Red Teaming Text-to-Image Generators Using Large Language Models
por: Wang, Zilong, et al.
Publicado: (2025)
por: Wang, Zilong, et al.
Publicado: (2025)
MotionAgent: Fine-grained Controllable Video Generation via Motion Field Agent
por: Liao, Xinyao, et al.
Publicado: (2025)
por: Liao, Xinyao, et al.
Publicado: (2025)
Extracting Training Data from Unconditional Diffusion Models
por: Chen, Yunhao, et al.
Publicado: (2024)
por: Chen, Yunhao, et al.
Publicado: (2024)
FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models
por: Zhai, Kun, et al.
Publicado: (2025)
por: Zhai, Kun, et al.
Publicado: (2025)
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
por: Jiang, Zhangqi, et al.
Publicado: (2026)
por: Jiang, Zhangqi, et al.
Publicado: (2026)
RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models
por: Yang, Yufeng, et al.
Publicado: (2026)
por: Yang, Yufeng, et al.
Publicado: (2026)
A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models
por: Shuai, Xincheng, et al.
Publicado: (2024)
por: Shuai, Xincheng, et al.
Publicado: (2024)
RegionE: Adaptive Region-Aware Generation for Efficient Image Editing
por: Chen, Pengtao, et al.
Publicado: (2025)
por: Chen, Pengtao, et al.
Publicado: (2025)
ControlLight: Towards Controllable, Consistent, and Generalizable Low-Light Enhancement
por: Yang, Yufeng, et al.
Publicado: (2026)
por: Yang, Yufeng, et al.
Publicado: (2026)
SAMA: Towards Multi-Turn Referential Grounded Video Chat with Large Language Models
por: Sun, Ye, et al.
Publicado: (2025)
por: Sun, Ye, et al.
Publicado: (2025)
T2UE: Generating Unlearnable Examples from Text Descriptions
por: Ma, Xingjun, et al.
Publicado: (2025)
por: Ma, Xingjun, et al.
Publicado: (2025)
BrokenVideos: A Benchmark Dataset for Fine-Grained Artifact Localization in AI-Generated Videos
por: Lin, Jiahao, et al.
Publicado: (2025)
por: Lin, Jiahao, et al.
Publicado: (2025)
Expose Before You Defend: Unifying and Enhancing Backdoor Defenses via Exposed Models
por: Li, Yige, et al.
Publicado: (2024)
por: Li, Yige, et al.
Publicado: (2024)
ModelLock: Locking Your Model With a Spell
por: Gao, Yifeng, et al.
Publicado: (2024)
por: Gao, Yifeng, et al.
Publicado: (2024)
EnJa: Ensemble Jailbreak on Large Language Models
por: Zhang, Jiahao, et al.
Publicado: (2024)
por: Zhang, Jiahao, et al.
Publicado: (2024)
ML-Bench&Guard: Policy-Grounded Multilingual Safety Benchmark and Guardrail for Large Language Models
por: Zhao, Yunhan, et al.
Publicado: (2026)
por: Zhao, Yunhan, et al.
Publicado: (2026)
Downstream Transfer Attack: Adversarial Attacks on Downstream Models with Pre-trained Vision Transformers
por: Zheng, Weijie, et al.
Publicado: (2024)
por: Zheng, Weijie, et al.
Publicado: (2024)
WildDeepfake: A Challenging Real-World Dataset for Deepfake Detection
por: Zi, Bojia, et al.
Publicado: (2021)
por: Zi, Bojia, et al.
Publicado: (2021)
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation
por: Hu, Li, et al.
Publicado: (2023)
por: Hu, Li, et al.
Publicado: (2023)
From Synthetic to Real: Toward Identity-Consistent Makeup Transfer with Synthetic and Real Data
por: Yu, Yue, et al.
Publicado: (2026)
por: Yu, Yue, et al.
Publicado: (2026)
MikuDance: Animating Character Art with Mixed Motion Dynamics
por: Zhang, Jiaxu, et al.
Publicado: (2024)
por: Zhang, Jiaxu, et al.
Publicado: (2024)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
por: Tu, Chongjun, et al.
Publicado: (2025)
por: Tu, Chongjun, et al.
Publicado: (2025)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
por: Chen, Pengtao, et al.
Publicado: (2025)
por: Chen, Pengtao, et al.
Publicado: (2025)
ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment
por: Hu, Xiwei, et al.
Publicado: (2024)
por: Hu, Xiwei, et al.
Publicado: (2024)
iMontage: Unified, Versatile, Highly Dynamic Many-to-many Image Generation
por: Fu, Zhoujie, et al.
Publicado: (2025)
por: Fu, Zhoujie, et al.
Publicado: (2025)
Step1X-Edit: A Practical Framework for General Image Editing
por: Liu, Shiyu, et al.
Publicado: (2025)
por: Liu, Shiyu, et al.
Publicado: (2025)
RedTopic: Toward Topic-Diverse Red Teaming of Large Language Models
por: Ding, Jiale, et al.
Publicado: (2025)
por: Ding, Jiale, et al.
Publicado: (2025)
DCDM: Divide-and-Conquer Diffusion Models for Consistency-Preserving Video Generation
por: Zhao, Haoyu, et al.
Publicado: (2026)
por: Zhao, Haoyu, et al.
Publicado: (2026)
Steering the Verifiability of Multimodal AI Hallucinations
por: Pang, Jianhong, et al.
Publicado: (2026)
por: Pang, Jianhong, et al.
Publicado: (2026)
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models
por: Zhang, Jiaming, et al.
Publicado: (2025)
por: Zhang, Jiaming, et al.
Publicado: (2025)
AdvQDet: Detecting Query-Based Adversarial Attacks with Adversarial Contrastive Prompt Tuning
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
Ejemplares similares
-
OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation
por: Chang, Jingjing, et al.
Publicado: (2025) -
PixelSmile: Toward Fine-Grained Facial Expression Editing
por: Hua, Jiabin, et al.
Publicado: (2026) -
AIM: Additional Image Guided Generation of Transferable Adversarial Attacks
por: Li, Teng, et al.
Publicado: (2025) -
OmniSVG: A Unified Scalable Vector Graphics Generation Model
por: Yang, Yiying, et al.
Publicado: (2025) -
OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens
por: Yang, Yiying, et al.
Publicado: (2026)