Retrieval-guided Cross-view Image Synthesis
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Hongji, Li, Yiru, Zhu, Yingying |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DUDE: Diffusion-Based Unsupervised Cross-Domain Image Retrieval
by: Yang, Ruohong, et al.
Published: (2025)
by: Yang, Ruohong, et al.
Published: (2025)
Geometry-guided Cross-view Diffusion for One-to-many Cross-view Image Synthesis
by: Lin, Tao Jun, et al.
Published: (2024)
by: Lin, Tao Jun, et al.
Published: (2024)
Cross-view geo-localization: a survey
by: Durgam, Abhilash, et al.
Published: (2024)
by: Durgam, Abhilash, et al.
Published: (2024)
Seeing the Unseen: Mask-Driven Positional Encoding and Strip-Convolution Context Modeling for Cross-View Object Geo-Localization
by: Hu, Shuhan, et al.
Published: (2025)
by: Hu, Shuhan, et al.
Published: (2025)
Sharp-It: A Multi-view to Multi-view Diffusion Model for 3D Synthesis and Manipulation
by: Edelstein, Yiftach, et al.
Published: (2024)
by: Edelstein, Yiftach, et al.
Published: (2024)
Consolidating Attention Features for Multi-view Image Editing
by: Patashnik, Or, et al.
Published: (2024)
by: Patashnik, Or, et al.
Published: (2024)
Improving Cross-view Object Geo-localization: A Dual Attention Approach with Cross-view Interaction and Multi-Scale Spatial Features
by: Zhu, Xingtao Ling Yingying
Published: (2025)
by: Zhu, Xingtao Ling Yingying
Published: (2025)
Multiple Code Hashing for Efficient Image Retrieval
by: Li, Ming-Wei, et al.
Published: (2020)
by: Li, Ming-Wei, et al.
Published: (2020)
Anchor-free Cross-view Object Geo-localization with Gaussian Position Encoding and Cross-view Association
by: Ling, Xingtao, et al.
Published: (2025)
by: Ling, Xingtao, et al.
Published: (2025)
Advanced Multimodal Deep Learning Architecture for Image-Text Matching
by: Wang, Jinyin, et al.
Published: (2024)
by: Wang, Jinyin, et al.
Published: (2024)
Cross-modal RAG: Sub-dimensional Text-to-Image Retrieval-Augmented Generation
by: Zhu, Mengdan, et al.
Published: (2025)
by: Zhu, Mengdan, et al.
Published: (2025)
Multi-view Deep Subspace Clustering Networks
by: Zhu, Pengfei, et al.
Published: (2019)
by: Zhu, Pengfei, et al.
Published: (2019)
Deep Incomplete Multi-view Clustering with Distribution Dual-Consistency Recovery Guidance
by: Jin, Jiaqi, et al.
Published: (2025)
by: Jin, Jiaqi, et al.
Published: (2025)
Structure-preserving contrastive learning for spatial time series
by: Jiao, Yiru, et al.
Published: (2025)
by: Jiao, Yiru, et al.
Published: (2025)
A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models
by: Fang, Tianmeng, et al.
Published: (2026)
by: Fang, Tianmeng, et al.
Published: (2026)
Object-Aware Query Perturbation for Cross-Modal Image-Text Retrieval
by: Sogi, Naoya, et al.
Published: (2024)
by: Sogi, Naoya, et al.
Published: (2024)
A Semantic Segmentation-guided Approach for Ground-to-Aerial Image Matching
by: Pro, Francesco, et al.
Published: (2024)
by: Pro, Francesco, et al.
Published: (2024)
Multi-view Clustering via Bi-level Decoupling and Consistency Learning
by: Dong, Shihao, et al.
Published: (2025)
by: Dong, Shihao, et al.
Published: (2025)
Pseudolabel guided pixels contrast for domain adaptive semantic segmentation
by: Xiang, Jianzi, et al.
Published: (2025)
by: Xiang, Jianzi, et al.
Published: (2025)
Anchor-based Multi-view Subspace Clustering with Hierarchical Feature Descent
by: Ou, Qiyuan, et al.
Published: (2023)
by: Ou, Qiyuan, et al.
Published: (2023)
Cross-Organ Domain Adaptive Neural Network for Pancreatic Endoscopic Ultrasound Image Segmentation
by: Yan, ZhiChao, et al.
Published: (2024)
by: Yan, ZhiChao, et al.
Published: (2024)
Cross-Modal Adapter: Parameter-Efficient Transfer Learning Approach for Vision-Language Models
by: Yang, Juncheng, et al.
Published: (2024)
by: Yang, Juncheng, et al.
Published: (2024)
FiLo: Zero-Shot Anomaly Detection by Fine-Grained Description and High-Quality Localization
by: Gu, Zhaopeng, et al.
Published: (2024)
by: Gu, Zhaopeng, et al.
Published: (2024)
Multisource Collaborative Domain Generalization for Cross-Scene Remote Sensing Image Classification
by: Han, Zhu, et al.
Published: (2024)
by: Han, Zhu, et al.
Published: (2024)
Native-Resolution Image Synthesis
by: Wang, Zidong, et al.
Published: (2025)
by: Wang, Zidong, et al.
Published: (2025)
Dual-Branch Residual Network for Cross-Domain Few-Shot Hyperspectral Image Classification with Refined Prototype
by: Qin, Anyong, et al.
Published: (2025)
by: Qin, Anyong, et al.
Published: (2025)
AdapNet: Adaptive Noise-Based Network for Low-Quality Image Retrieval
by: Zhang, Sihe, et al.
Published: (2024)
by: Zhang, Sihe, et al.
Published: (2024)
Expert Knowledge-Aware Image Difference Graph Representation Learning for Difference-Aware Medical Visual Question Answering
by: Hu, Xinyue, et al.
Published: (2023)
by: Hu, Xinyue, et al.
Published: (2023)
Neural Image Compression with Text-guided Encoding for both Pixel-level and Perceptual Fidelity
by: Lee, Hagyeong, et al.
Published: (2024)
by: Lee, Hagyeong, et al.
Published: (2024)
Balanced Multi-view Clustering
by: Li, Zhenglai, et al.
Published: (2025)
by: Li, Zhenglai, et al.
Published: (2025)
Spatially-guided Temporal Aggregation for Robust Event-RGB Optical Flow Estimation
by: Zhou, Qianang, et al.
Published: (2025)
by: Zhou, Qianang, et al.
Published: (2025)
Mask-informed Deep Contrastive Incomplete Multi-view Clustering
by: Li, Zhenglai, et al.
Published: (2025)
by: Li, Zhenglai, et al.
Published: (2025)
Feedback-guided Data Synthesis for Imbalanced Classification
by: Hemmat, Reyhane Askari, et al.
Published: (2023)
by: Hemmat, Reyhane Askari, et al.
Published: (2023)
Rejection Sampling IMLE: Designing Priors for Better Few-Shot Image Synthesis
by: Vashist, Chirag, et al.
Published: (2024)
by: Vashist, Chirag, et al.
Published: (2024)
Generalizable Single-Source Cross-modality Medical Image Segmentation via Invariant Causal Mechanisms
by: Chen, Boqi, et al.
Published: (2024)
by: Chen, Boqi, et al.
Published: (2024)
Triplet Synthesis For Enhancing Composed Image Retrieval via Counterfactual Image Generation
by: Uesugi, Kenta, et al.
Published: (2025)
by: Uesugi, Kenta, et al.
Published: (2025)
Deep Learning with HM-VGG: AI Strategies for Multi-modal Image Analysis
by: Du, Junliang, et al.
Published: (2024)
by: Du, Junliang, et al.
Published: (2024)
Optimizing CLIP Models for Image Retrieval with Maintained Joint-Embedding Alignment
by: Schall, Konstantin, et al.
Published: (2024)
by: Schall, Konstantin, et al.
Published: (2024)
FIRE-CIR: Fine-grained Reasoning for Composed Fashion Image Retrieval
by: Gardères, François, et al.
Published: (2026)
by: Gardères, François, et al.
Published: (2026)
Image-based Outlier Synthesis With Training Data
by: Regmi, Sudarshan
Published: (2024)
by: Regmi, Sudarshan
Published: (2024)
Similar Items
-
DUDE: Diffusion-Based Unsupervised Cross-Domain Image Retrieval
by: Yang, Ruohong, et al.
Published: (2025) -
Geometry-guided Cross-view Diffusion for One-to-many Cross-view Image Synthesis
by: Lin, Tao Jun, et al.
Published: (2024) -
Cross-view geo-localization: a survey
by: Durgam, Abhilash, et al.
Published: (2024) -
Seeing the Unseen: Mask-Driven Positional Encoding and Strip-Convolution Context Modeling for Cross-View Object Geo-Localization
by: Hu, Shuhan, et al.
Published: (2025) -
Sharp-It: A Multi-view to Multi-view Diffusion Model for 3D Synthesis and Manipulation
by: Edelstein, Yiftach, et al.
Published: (2024)