TP2O: Creative Text Pair-to-Object Generation using Balance Swap-Sampling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jun, Zhang, Zedong, Yang, Jian |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AGSwap: Overcoming Category Boundaries in Object Fusion via Adaptive Group Swapping
par: Zhang, Zedong, et autres
Publié: (2025)
par: Zhang, Zedong, et autres
Publié: (2025)
Self-Creative Text-to-Object Generation using Semantic-Aware Spatial Weighting
par: Yu, Yue, et autres
Publié: (2026)
par: Yu, Yue, et autres
Publié: (2026)
Novel Object Synthesis via Adaptive Text-Image Harmony
par: Xiong, Zeren, et autres
Publié: (2024)
par: Xiong, Zeren, et autres
Publié: (2024)
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
par: Xiong, Zeren, et autres
Publié: (2025)
par: Xiong, Zeren, et autres
Publié: (2025)
RTGen: Generating Region-Text Pairs for Open-Vocabulary Object Detection
par: Chen, Fangyi, et autres
Publié: (2024)
par: Chen, Fangyi, et autres
Publié: (2024)
Category-Aware 3D Object Composition with Disentangled Texture and Shape Multi-view Diffusion
par: Xiong, Zeren, et autres
Publié: (2025)
par: Xiong, Zeren, et autres
Publié: (2025)
HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness
par: Xue, Zihui, et autres
Publié: (2024)
par: Xue, Zihui, et autres
Publié: (2024)
Swap Attention in Spatiotemporal Diffusions for Text-to-Video Generation
par: Wang, Wenjing, et autres
Publié: (2023)
par: Wang, Wenjing, et autres
Publié: (2023)
Multi-Object Advertisement Creative Generation
par: Gao, Jialu, et autres
Publié: (2026)
par: Gao, Jialu, et autres
Publié: (2026)
RankE: End-to-End Post-Training for Discrete Text-to-Image Generation with Decoder Co-Evolution
par: Jian, Siyong, et autres
Publié: (2026)
par: Jian, Siyong, et autres
Publié: (2026)
SwapAnything: Enabling Arbitrary Object Swapping in Personalized Visual Editing
par: Gu, Jing, et autres
Publié: (2024)
par: Gu, Jing, et autres
Publié: (2024)
Towards Source-Aware Object Swapping with Initial Noise Perturbation
par: Zhan, Jiahui, et autres
Publié: (2026)
par: Zhan, Jiahui, et autres
Publié: (2026)
Pair2Scene: Learning Local Object Relations for Procedural Scene Generation
par: Ran, Xingjian, et autres
Publié: (2026)
par: Ran, Xingjian, et autres
Publié: (2026)
DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing
par: Wang, Weitao, et autres
Publié: (2025)
par: Wang, Weitao, et autres
Publié: (2025)
Text2Relight: Creative Portrait Relighting with Text Guidance
par: Cha, Junuk, et autres
Publié: (2024)
par: Cha, Junuk, et autres
Publié: (2024)
GaussianSwap: Animatable Video Face Swapping with 3D Gaussian Splatting
par: Cheng, Xuan, et autres
Publié: (2026)
par: Cheng, Xuan, et autres
Publié: (2026)
TP-Spikformer: Token Pruned Spiking Transformer
par: Wei, Wenjie, et autres
Publié: (2026)
par: Wei, Wenjie, et autres
Publié: (2026)
TOUCH: Text-guided Controllable Generation of Free-Form Hand-Object Interactions
par: Han, Guangyi, et autres
Publié: (2025)
par: Han, Guangyi, et autres
Publié: (2025)
TP-GMOT: Tracking Generic Multiple Object by Textual Prompt with Motion-Appearance Cost (MAC) SORT
par: Anh, Duy Le Dinh, et autres
Publié: (2024)
par: Anh, Duy Le Dinh, et autres
Publié: (2024)
Box-Level Class-Balanced Sampling for Active Object Detection
par: Liao, Jingyi, et autres
Publié: (2025)
par: Liao, Jingyi, et autres
Publié: (2025)
NullSwap: Proactive Identity Cloaking Against Deepfake Face Swapping
par: Wang, Tianyi, et autres
Publié: (2025)
par: Wang, Tianyi, et autres
Publié: (2025)
SwapAnyone: Consistent and Realistic Video Synthesis for Swapping Any Person into Any Video
par: Zhao, Chengshu, et autres
Publié: (2025)
par: Zhao, Chengshu, et autres
Publié: (2025)
Semantic Score Distillation Sampling for Compositional Text-to-3D Generation
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
Text2LiDAR: Text-guided LiDAR Point Cloud Generation via Equirectangular Transformer
par: Wu, Yang, et autres
Publié: (2024)
par: Wu, Yang, et autres
Publié: (2024)
DirectSwap: Mask-Free Cross-Identity Training and Benchmarking for Expression-Consistent Video Head Swapping
par: Wang, Yanan, et autres
Publié: (2025)
par: Wang, Yanan, et autres
Publié: (2025)
TP-DRSeg: Improving Diabetic Retinopathy Lesion Segmentation with Explicit Text-Prompts Assisted SAM
par: Li, Wenxue, et autres
Publié: (2024)
par: Li, Wenxue, et autres
Publié: (2024)
Nav-$R^2$ Dual-Relation Reasoning for Generalizable Open-Vocabulary Object-Goal Navigation
par: Xiang, Wentao, et autres
Publié: (2025)
par: Xiang, Wentao, et autres
Publié: (2025)
GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver
par: Chen, Yuqing, et autres
Publié: (2026)
par: Chen, Yuqing, et autres
Publié: (2026)
RoboSwap: A GAN-driven Video Diffusion Framework For Unsupervised Robot Arm Swapping
par: Bai, Yang, et autres
Publié: (2025)
par: Bai, Yang, et autres
Publié: (2025)
TP-Blend: Textual-Prompt Attention Pairing for Precise Object-Style Blending in Diffusion Models
par: Jin, Xin, et autres
Publié: (2026)
par: Jin, Xin, et autres
Publié: (2026)
Text2Avatar: Text to 3D Human Avatar Generation with Codebook-Driven Body Controllable Attribute
par: Gong, Chaoqun, et autres
Publié: (2024)
par: Gong, Chaoqun, et autres
Publié: (2024)
T-Rex2: Towards Generic Object Detection via Text-Visual Prompt Synergy
par: Jiang, Qing, et autres
Publié: (2024)
par: Jiang, Qing, et autres
Publié: (2024)
MotionSwap
par: Patil, Om, et autres
Publié: (2025)
par: Patil, Om, et autres
Publié: (2025)
YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
par: Zeng, Guanning, et autres
Publié: (2025)
par: Zeng, Guanning, et autres
Publié: (2025)
Mission Balance: Generating Under-represented Class Samples using Video Diffusion Models
par: Venkatesh, Danush Kumar, et autres
Publié: (2025)
par: Venkatesh, Danush Kumar, et autres
Publié: (2025)
LatentSwap: An Efficient Latent Code Mapping Framework for Face Swapping
par: Choi, Changho, et autres
Publié: (2024)
par: Choi, Changho, et autres
Publié: (2024)
Checklist to Define the Identification of TP, FP, and FN Object Detections in Automated Driving
par: Hoss, Michael
Publié: (2023)
par: Hoss, Michael
Publié: (2023)
PartCraft: Crafting Creative Objects by Parts
par: Ng, Kam Woh, et autres
Publié: (2024)
par: Ng, Kam Woh, et autres
Publié: (2024)
CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation
par: Luo, Xiangyang, et autres
Publié: (2025)
par: Luo, Xiangyang, et autres
Publié: (2025)
AURA : Automatic Mask Generator using Randomized Input Sampling for Object Removal
par: Oh, Changsuk, et autres
Publié: (2023)
par: Oh, Changsuk, et autres
Publié: (2023)
Documents similaires
-
AGSwap: Overcoming Category Boundaries in Object Fusion via Adaptive Group Swapping
par: Zhang, Zedong, et autres
Publié: (2025) -
Self-Creative Text-to-Object Generation using Semantic-Aware Spatial Weighting
par: Yu, Yue, et autres
Publié: (2026) -
Novel Object Synthesis via Adaptive Text-Image Harmony
par: Xiong, Zeren, et autres
Publié: (2024) -
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
par: Xiong, Zeren, et autres
Publié: (2025) -
RTGen: Generating Region-Text Pairs for Open-Vocabulary Object Detection
par: Chen, Fangyi, et autres
Publié: (2024)