Self-Creative Text-to-Object Generation using Semantic-Aware Spatial Weighting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Yue, Chen, Haibo, Chen, Shuo, Yang, Jian, Li, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TP2O: Creative Text Pair-to-Object Generation using Balance Swap-Sampling
par: Li, Jun, et autres
Publié: (2023)
par: Li, Jun, et autres
Publié: (2023)
RMLer: Synthesizing Novel Objects across Diverse Categories via Reinforcement Mixing Learning
par: Li, Jun, et autres
Publié: (2025)
par: Li, Jun, et autres
Publié: (2025)
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
par: Xiong, Zeren, et autres
Publié: (2025)
par: Xiong, Zeren, et autres
Publié: (2025)
Novel Object Synthesis via Adaptive Text-Image Harmony
par: Xiong, Zeren, et autres
Publié: (2024)
par: Xiong, Zeren, et autres
Publié: (2024)
Region-Aware Text-to-Image Generation via Hard Binding and Soft Refinement
par: Chen, Zhennan, et autres
Publié: (2024)
par: Chen, Zhennan, et autres
Publié: (2024)
Vision-Language Models as Differentiable Semantic and Spatial Rewards for Text-to-3D Generation
par: Bai, Weimin, et autres
Publié: (2025)
par: Bai, Weimin, et autres
Publié: (2025)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
par: Luo, Minxing, et autres
Publié: (2025)
par: Luo, Minxing, et autres
Publié: (2025)
Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking
par: Hu, Xiantao, et autres
Publié: (2024)
par: Hu, Xiantao, et autres
Publié: (2024)
Semantics-Guided Moving Object Segmentation with 3D LiDAR
par: Gu, Shuo, et autres
Publié: (2022)
par: Gu, Shuo, et autres
Publié: (2022)
Multi-Object Advertisement Creative Generation
par: Gao, Jialu, et autres
Publié: (2026)
par: Gao, Jialu, et autres
Publié: (2026)
Improving Text-guided Object Inpainting with Semantic Pre-inpainting
par: Chen, Yifu, et autres
Publié: (2024)
par: Chen, Yifu, et autres
Publié: (2024)
Text-promptable Object Counting via Quantity Awareness Enhancement
par: Shi, Miaojing, et autres
Publié: (2025)
par: Shi, Miaojing, et autres
Publié: (2025)
Category-Aware 3D Object Composition with Disentangled Texture and Shape Multi-view Diffusion
par: Xiong, Zeren, et autres
Publié: (2025)
par: Xiong, Zeren, et autres
Publié: (2025)
Redefining <Creative> in Dictionary: Towards an Enhanced Semantic Understanding of Creative Generation
par: Feng, Fu, et autres
Publié: (2024)
par: Feng, Fu, et autres
Publié: (2024)
SFFR: Spatial-Frequency Feature Reconstruction for Multispectral Aerial Object Detection
par: Zuo, Xin, et autres
Publié: (2025)
par: Zuo, Xin, et autres
Publié: (2025)
SAPNet++: Evolving Point-Prompted Instance Segmentation with Semantic and Spatial Awareness
par: Wei, Zhaoyang, et autres
Publié: (2026)
par: Wei, Zhaoyang, et autres
Publié: (2026)
Exploring Boundary-Aware Spatial-Frequency Fusion for Camouflaged Object Detection
par: Yu, Song, et autres
Publié: (2026)
par: Yu, Song, et autres
Publié: (2026)
TSdetector: Temporal-Spatial Self-correction Collaborative Learning for Colonoscopy Video Detection
par: Wang, Kaini, et autres
Publié: (2024)
par: Wang, Kaini, et autres
Publié: (2024)
RTGen: Generating Region-Text Pairs for Open-Vocabulary Object Detection
par: Chen, Fangyi, et autres
Publié: (2024)
par: Chen, Fangyi, et autres
Publié: (2024)
FSDETR: Frequency-Spatial Feature Enhancement for Small Object Detection
par: Huang, Jianchao, et autres
Publié: (2026)
par: Huang, Jianchao, et autres
Publié: (2026)
TIGaussian: Disentangle Gaussians for Spatial-Awared Text-Image-3D Alignment
par: Liu, Jiarun, et autres
Publié: (2026)
par: Liu, Jiarun, et autres
Publié: (2026)
FedSC: Federated Learning with Semantic-Aware Collaboration
par: Wang, Huan, et autres
Publié: (2025)
par: Wang, Huan, et autres
Publié: (2025)
Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders
par: Kou, Siqi, et autres
Publié: (2026)
par: Kou, Siqi, et autres
Publié: (2026)
SRSR: Enhancing Semantic Accuracy in Real-World Image Super-Resolution with Spatially Re-Focused Text-Conditioning
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens
par: Kim, Dongwon, et autres
Publié: (2025)
par: Kim, Dongwon, et autres
Publié: (2025)
SSD: Spatial-Semantic Head Decoupling for Efficient Autoregressive Image Generation
par: Jian, Siyong, et autres
Publié: (2025)
par: Jian, Siyong, et autres
Publié: (2025)
SMILEtrack: SiMIlarity LEarning for Occlusion-Aware Multiple Object Tracking
par: Wang, Yu-Hsiang, et autres
Publié: (2022)
par: Wang, Yu-Hsiang, et autres
Publié: (2022)
Chirpy3D: Part-Aware Multi-View Diffusion for Creative Fine-Grained Object Generation
par: Ng, Kam Woh, et autres
Publié: (2025)
par: Ng, Kam Woh, et autres
Publié: (2025)
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
par: Chen, Yang, et autres
Publié: (2024)
par: Chen, Yang, et autres
Publié: (2024)
SpatialFormer: Semantic and Target Aware Attentions for Few-Shot Learning
par: Lai, Jinxiang, et autres
Publié: (2023)
par: Lai, Jinxiang, et autres
Publié: (2023)
DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
par: Yang, Haibo, et autres
Publié: (2024)
par: Yang, Haibo, et autres
Publié: (2024)
TOUCH: Text-guided Controllable Generation of Free-Form Hand-Object Interactions
par: Han, Guangyi, et autres
Publié: (2025)
par: Han, Guangyi, et autres
Publié: (2025)
Spatially-Weighted CLIP for Street-View Geo-localization
par: Han, Ting, et autres
Publié: (2026)
par: Han, Ting, et autres
Publié: (2026)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
Scale-Aware UAV-to-Satellite Cross-View Geo-Localization: A Semantic Geometric Approach
par: Ye, Yibin, et autres
Publié: (2026)
par: Ye, Yibin, et autres
Publié: (2026)
FAFA: Frequency-Aware Flow-Aided Self-Supervision for Underwater Object Pose Estimation
par: Tang, Jingyi, et autres
Publié: (2024)
par: Tang, Jingyi, et autres
Publié: (2024)
Visual Semantic Description Generation with MLLMs for Image-Text Matching
par: Chen, Junyu, et autres
Publié: (2025)
par: Chen, Junyu, et autres
Publié: (2025)
GenHOI: Generalized Hand-Object Pose Estimation with Occlusion Awareness
par: Yang, Hui, et autres
Publié: (2026)
par: Yang, Hui, et autres
Publié: (2026)
CritiFusion: Semantic Critique and Spectral Alignment for Faithful Text-to-Image Generation
par: Chen, ZhenQi, et autres
Publié: (2025)
par: Chen, ZhenQi, et autres
Publié: (2025)
Image-Text Co-Decomposition for Text-Supervised Semantic Segmentation
par: Wu, Ji-Jia, et autres
Publié: (2024)
par: Wu, Ji-Jia, et autres
Publié: (2024)
Documents similaires
-
TP2O: Creative Text Pair-to-Object Generation using Balance Swap-Sampling
par: Li, Jun, et autres
Publié: (2023) -
RMLer: Synthesizing Novel Objects across Diverse Categories via Reinforcement Mixing Learning
par: Li, Jun, et autres
Publié: (2025) -
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
par: Xiong, Zeren, et autres
Publié: (2025) -
Novel Object Synthesis via Adaptive Text-Image Harmony
par: Xiong, Zeren, et autres
Publié: (2024) -
Region-Aware Text-to-Image Generation via Hard Binding and Soft Refinement
par: Chen, Zhennan, et autres
Publié: (2024)