Guardado en:
| Autores principales: | Li, You, Ma, Fan, Yang, Yi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2411.16752 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SpatialImaginer: Towards Adaptive Visual Imagination for Spatial Reasoning
por: Li, Yian, et al.
Publicado: (2026)
por: Li, Yian, et al.
Publicado: (2026)
Knowledge-Enhanced Dual-stream Zero-shot Composed Image Retrieval
por: Suo, Yucheng, et al.
Publicado: (2024)
por: Suo, Yucheng, et al.
Publicado: (2024)
Imagine yourself: Tuning-Free Personalized Image Generation
por: He, Zecheng, et al.
Publicado: (2024)
por: He, Zecheng, et al.
Publicado: (2024)
Imagine the Unseen: Occluded Pedestrian Detection via Adversarial Feature Completion
por: Zhang, Shanshan, et al.
Publicado: (2024)
por: Zhang, Shanshan, et al.
Publicado: (2024)
ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search
por: Yu, Tao, et al.
Publicado: (2026)
por: Yu, Tao, et al.
Publicado: (2026)
Automatic Controllable Colorization via Imagination
por: Cong, Xiaoyan, et al.
Publicado: (2024)
por: Cong, Xiaoyan, et al.
Publicado: (2024)
Mimesis, Poiesis, and Imagination: Exploring Text-to-Image Generation of Biblical Narratives
por: van Peursen, Willem Th., et al.
Publicado: (2025)
por: van Peursen, Willem Th., et al.
Publicado: (2025)
AnySynth: Harnessing the Power of Image Synthetic Data Generation for Generalized Vision-Language Tasks
por: Li, You, et al.
Publicado: (2024)
por: Li, You, et al.
Publicado: (2024)
ReImagine: Rethinking Controllable High-Quality Human Video Generation via Image-First Synthesis
por: Sun, Zhengwentai, et al.
Publicado: (2026)
por: Sun, Zhengwentai, et al.
Publicado: (2026)
ImagineMap: Enhanced HD Map Construction with SD Maps
por: Ji, Yishen, et al.
Publicado: (2024)
por: Ji, Yishen, et al.
Publicado: (2024)
Collaborative Group: Composed Image Retrieval via Consensus Learning from Noisy Annotations
por: Zhang, Xu, et al.
Publicado: (2023)
por: Zhang, Xu, et al.
Publicado: (2023)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
por: Tu, Rong-Cheng, et al.
Publicado: (2025)
por: Tu, Rong-Cheng, et al.
Publicado: (2025)
Composed Image Retrieval for Remote Sensing
por: Psomas, Bill, et al.
Publicado: (2024)
por: Psomas, Bill, et al.
Publicado: (2024)
Instance-Level Composed Image Retrieval
por: Psomas, Bill, et al.
Publicado: (2025)
por: Psomas, Bill, et al.
Publicado: (2025)
Zero Shot Composed Image Retrieval
por: Kakarla, Santhosh, et al.
Publicado: (2025)
por: Kakarla, Santhosh, et al.
Publicado: (2025)
Beyond Thinking: Imagining in 360$^\circ$ for Humanoid Visual Search
por: Zhang, Jingdong, et al.
Publicado: (2026)
por: Zhang, Jingdong, et al.
Publicado: (2026)
Do Visual Imaginations Improve Vision-and-Language Navigation Agents?
por: Perincherry, Akhil, et al.
Publicado: (2025)
por: Perincherry, Akhil, et al.
Publicado: (2025)
Composed Object Retrieval: Object-level Retrieval via Composed Expressions
por: Wang, Tong, et al.
Publicado: (2025)
por: Wang, Tong, et al.
Publicado: (2025)
From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation
por: Li, Yajie, et al.
Publicado: (2026)
por: Li, Yajie, et al.
Publicado: (2026)
Imagining the Unseen: Generative Location Modeling for Object Placement
por: Yun, Jooyeol, et al.
Publicado: (2024)
por: Yun, Jooyeol, et al.
Publicado: (2024)
Jigsaw++: Imagining Complete Shape Priors for Object Reassembly
por: Lu, Jiaxin, et al.
Publicado: (2024)
por: Lu, Jiaxin, et al.
Publicado: (2024)
ImagiDrive: A Unified Imagination-and-Planning Framework for Autonomous Driving
por: Li, Jingyu, et al.
Publicado: (2025)
por: Li, Jingyu, et al.
Publicado: (2025)
Beyond Semantic Search: Towards Referential Anchoring in Composed Image Retrieval
por: Yang, Yuxin, et al.
Publicado: (2026)
por: Yang, Yuxin, et al.
Publicado: (2026)
WRF4CIR: Weight-Regularized Fine-Tuning Network for Composed Image Retrieval
por: Xu, Yizhuo, et al.
Publicado: (2026)
por: Xu, Yizhuo, et al.
Publicado: (2026)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026)
por: Li, Jun, et al.
Publicado: (2026)
Imagine360: Immersive 360 Video Generation from Perspective Anchor
por: Tan, Jing, et al.
Publicado: (2024)
por: Tan, Jing, et al.
Publicado: (2024)
From Mapping to Composing: A Two-Stage Framework for Zero-shot Composed Image Retrieval
por: Wang, Yabing, et al.
Publicado: (2025)
por: Wang, Yabing, et al.
Publicado: (2025)
Imagine with the Teacher: Complete Shape in a Multi-View Distillation Way
por: Luo, Zhanpeng, et al.
Publicado: (2025)
por: Luo, Zhanpeng, et al.
Publicado: (2025)
Image-to-Text Logic Jailbreak: Your Imagination can Help You Do Anything
por: Zou, Xiaotian, et al.
Publicado: (2024)
por: Zou, Xiaotian, et al.
Publicado: (2024)
A Sanity Check on Composed Image Retrieval
por: Liu, Yikun, et al.
Publicado: (2026)
por: Liu, Yikun, et al.
Publicado: (2026)
Zero-shot Composed Text-Image Retrieval
por: Liu, Yikun, et al.
Publicado: (2023)
por: Liu, Yikun, et al.
Publicado: (2023)
Break Stylistic Sophon: Are We Really Meant to Confine the Imagination in Style Transfer?
por: Yan, Gary Song, et al.
Publicado: (2025)
por: Yan, Gary Song, et al.
Publicado: (2025)
Resolving Ambiguity in Composed Image Retrieval via Calibrated Interaction
por: Tran, Amsisan, et al.
Publicado: (2026)
por: Tran, Amsisan, et al.
Publicado: (2026)
DiffBody: Human Body Restoration by Imagining with Generative Diffusion Prior
por: Zhang, Yiming, et al.
Publicado: (2024)
por: Zhang, Yiming, et al.
Publicado: (2024)
Imagine Flash: Accelerating Emu Diffusion Models with Backward Distillation
por: Kohler, Jonas, et al.
Publicado: (2024)
por: Kohler, Jonas, et al.
Publicado: (2024)
Learning Object Permanence from Videos via Latent Imaginations
por: Traub, Manuel, et al.
Publicado: (2023)
por: Traub, Manuel, et al.
Publicado: (2023)
Imagine while Reasoning in Space: Multimodal Visualization-of-Thought
por: Li, Chengzu, et al.
Publicado: (2025)
por: Li, Chengzu, et al.
Publicado: (2025)
ForesightNav: Learning Scene Imagination for Efficient Exploration
por: Shah, Hardik, et al.
Publicado: (2025)
por: Shah, Hardik, et al.
Publicado: (2025)
TEMA: Anchor the Image, Follow the Text for Multi-Modification Composed Image Retrieval
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
MIGC++: Advanced Multi-Instance Generation Controller for Image Synthesis
por: Zhou, Dewei, et al.
Publicado: (2024)
por: Zhou, Dewei, et al.
Publicado: (2024)
Ejemplares similares
-
SpatialImaginer: Towards Adaptive Visual Imagination for Spatial Reasoning
por: Li, Yian, et al.
Publicado: (2026) -
Knowledge-Enhanced Dual-stream Zero-shot Composed Image Retrieval
por: Suo, Yucheng, et al.
Publicado: (2024) -
Imagine yourself: Tuning-Free Personalized Image Generation
por: He, Zecheng, et al.
Publicado: (2024) -
Imagine the Unseen: Occluded Pedestrian Detection via Adversarial Feature Completion
por: Zhang, Shanshan, et al.
Publicado: (2024) -
ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search
por: Yu, Tao, et al.
Publicado: (2026)