Language-driven Fine-grained Retrieval
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Shijie, Yu, Xin, Luo, Yadan, Wang, Zijian, Zhang, Pengfei, Huang, Zi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning to Align Generative Appearance Priors for Fine-grained Image Retrieval
di: Wang, Shijie, et al.
Pubblicazione: (2026)
di: Wang, Shijie, et al.
Pubblicazione: (2026)
Geometry-Guided Self-Supervision for Ultra-Fine-Grained Recognition with Limited Data
di: Wang, Shijie, et al.
Pubblicazione: (2026)
di: Wang, Shijie, et al.
Pubblicazione: (2026)
Learning to Synergize Semantic and Geometric Priors for Limited-Data Wheat Disease Segmentation
di: Wang, Shijie, et al.
Pubblicazione: (2026)
di: Wang, Shijie, et al.
Pubblicazione: (2026)
Learning Efficient Unsupervised Satellite Image-based Building Damage Detection
di: Zhang, Yiyun, et al.
Pubblicazione: (2023)
di: Zhang, Yiyun, et al.
Pubblicazione: (2023)
Divide-and-Conquer Approach to Holistic Cognition in High-Similarity Contexts with Limited Data
di: Wang, Shijie, et al.
Pubblicazione: (2026)
di: Wang, Shijie, et al.
Pubblicazione: (2026)
SCORE: Soft Label Compression-Centric Dataset Condensation via Coding Rate Optimization
di: Yuan, Bowen, et al.
Pubblicazione: (2025)
di: Yuan, Bowen, et al.
Pubblicazione: (2025)
Color-Oriented Redundancy Reduction in Dataset Distillation
di: Yuan, Bowen, et al.
Pubblicazione: (2024)
di: Yuan, Bowen, et al.
Pubblicazione: (2024)
FastEdit: Fast Text-Guided Single-Image Editing via Semantic-Aware Diffusion Fine-Tuning
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
Open-CRB: Towards Open World Active Learning for 3D Object Detection
di: Chen, Zhuoxiao, et al.
Pubblicazione: (2023)
di: Chen, Zhuoxiao, et al.
Pubblicazione: (2023)
Distributed Zero-Shot Learning for Visual Recognition
di: Chen, Zhi, et al.
Pubblicazione: (2025)
di: Chen, Zhi, et al.
Pubblicazione: (2025)
VGGT-World: Transforming VGGT into an Autoregressive Geometry World Model
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
Adversarial Reconstruction Feedback for Robust Fine-grained Generalization
di: Wang, Shijie, et al.
Pubblicazione: (2025)
di: Wang, Shijie, et al.
Pubblicazione: (2025)
CF-PRNet: Coarse-to-Fine Prototype Refining Network for Point Cloud Completion and Reconstruction
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
WisWheat: A Three-Tiered Vision-Language Dataset for Wheat Management
di: Yuan, Bowen, et al.
Pubblicazione: (2025)
di: Yuan, Bowen, et al.
Pubblicazione: (2025)
DPO: Dual-Perturbation Optimization for Test-time Adaptation in 3D Object Detection
di: Chen, Zhuoxiao, et al.
Pubblicazione: (2024)
di: Chen, Zhuoxiao, et al.
Pubblicazione: (2024)
GaussianForest: Hierarchical-Hybrid 3D Gaussian Splatting for Compressed Scene Modeling
di: Zhang, Fengyi, et al.
Pubblicazione: (2024)
di: Zhang, Fengyi, et al.
Pubblicazione: (2024)
FashionFAE: Fine-grained Attributes Enhanced Fashion Vision-Language Pre-training
di: Huang, Jiale, et al.
Pubblicazione: (2024)
di: Huang, Jiale, et al.
Pubblicazione: (2024)
GeoMamba: A Geometry-driven MambaVision Framework and Dataset for Fine-grained Optical-SAR Object Retrieval
di: Fang, Tiantong, et al.
Pubblicazione: (2026)
di: Fang, Tiantong, et al.
Pubblicazione: (2026)
TALO: Pushing 3D Vision Foundation Models Towards Globally Consistent Online Reconstruction
di: Zhang, Fengyi, et al.
Pubblicazione: (2025)
di: Zhang, Fengyi, et al.
Pubblicazione: (2025)
Test-Time 3D Occupancy Prediction
di: Zhang, Fengyi, et al.
Pubblicazione: (2025)
di: Zhang, Fengyi, et al.
Pubblicazione: (2025)
Box-QAymo: Box-Referring VQA Dataset for Autonomous Driving
di: Etchegaray, Djamahl, et al.
Pubblicazione: (2025)
di: Etchegaray, Djamahl, et al.
Pubblicazione: (2025)
Find n' Propagate: Open-Vocabulary 3D Object Detection in Urban Environments
di: Etchegaray, Djamahl, et al.
Pubblicazione: (2024)
di: Etchegaray, Djamahl, et al.
Pubblicazione: (2024)
DiPEx: Dispersing Prompt Expansion for Class-Agnostic Object Detection
di: Lim, Jia Syuen, et al.
Pubblicazione: (2024)
di: Lim, Jia Syuen, et al.
Pubblicazione: (2024)
CodeMerge: Codebook-Guided Model Merging for Robust Test-Time Adaptation in Autonomous Driving
di: Yang, Huitong, et al.
Pubblicazione: (2025)
di: Yang, Huitong, et al.
Pubblicazione: (2025)
Provable Ordering and Continuity in Vision-Language Pretraining for Generalizable Embodied Agents
di: Zhang, Zhizhen, et al.
Pubblicazione: (2025)
di: Zhang, Zhizhen, et al.
Pubblicazione: (2025)
Fine-grained Spatiotemporal Grounding on Egocentric Videos
di: Liang, Shuo, et al.
Pubblicazione: (2025)
di: Liang, Shuo, et al.
Pubblicazione: (2025)
Unleashing Video Language Models for Fine-grained HRCT Report Generation
di: Fang, Yingying, et al.
Pubblicazione: (2026)
di: Fang, Yingying, et al.
Pubblicazione: (2026)
Fine-grained Image Retrieval via Dual-Vision Adaptation
di: Jiang, Xin, et al.
Pubblicazione: (2025)
di: Jiang, Xin, et al.
Pubblicazione: (2025)
Is Less More? Exploring Token Condensation as Training-free Test-time Adaptation
di: Wang, Zixin, et al.
Pubblicazione: (2024)
di: Wang, Zixin, et al.
Pubblicazione: (2024)
Semantic Change Detection of Roads and Bridges: A Fine-grained Dataset and Multimodal Frequency-driven Detector
di: Shu, Qingling, et al.
Pubblicazione: (2025)
di: Shu, Qingling, et al.
Pubblicazione: (2025)
F2RVLM: Boosting Fine-grained Fragment Retrieval for Multi-Modal Long-form Dialogue with Vision Language Model
di: Bi, Hanbo, et al.
Pubblicazione: (2025)
di: Bi, Hanbo, et al.
Pubblicazione: (2025)
FingerCap: Fine-grained Finger-level Hand Motion Captioning
di: Shen, Xin, et al.
Pubblicazione: (2025)
di: Shen, Xin, et al.
Pubblicazione: (2025)
Unveiling Chain of Step Reasoning for Vision-Language Models with Fine-grained Rewards
di: Chen, Honghao, et al.
Pubblicazione: (2025)
di: Chen, Honghao, et al.
Pubblicazione: (2025)
Multi-Modal Motion Retrieval by Learning a Fine-Grained Joint Embedding Space
di: Yu, Shiyao, et al.
Pubblicazione: (2025)
di: Yu, Shiyao, et al.
Pubblicazione: (2025)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
di: Yang, Zhichao, et al.
Pubblicazione: (2026)
di: Yang, Zhichao, et al.
Pubblicazione: (2026)
Repeating Words for Video-Language Retrieval with Coarse-to-Fine Objectives
di: Zhao, Haoyu, et al.
Pubblicazione: (2025)
di: Zhao, Haoyu, et al.
Pubblicazione: (2025)
Track Any Peppers: Weakly Supervised Sweet Pepper Tracking Using VLMs
di: Lim, Jia Syuen, et al.
Pubblicazione: (2024)
di: Lim, Jia Syuen, et al.
Pubblicazione: (2024)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
di: Ma, Zehong, et al.
Pubblicazione: (2025)
di: Ma, Zehong, et al.
Pubblicazione: (2025)
PathFLIP: Fine-grained Language-Image Pretraining for Versatile Computational Pathology
di: Liu, Fengchun, et al.
Pubblicazione: (2025)
di: Liu, Fengchun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Learning to Align Generative Appearance Priors for Fine-grained Image Retrieval
di: Wang, Shijie, et al.
Pubblicazione: (2026) -
Geometry-Guided Self-Supervision for Ultra-Fine-Grained Recognition with Limited Data
di: Wang, Shijie, et al.
Pubblicazione: (2026) -
Learning to Synergize Semantic and Geometric Priors for Limited-Data Wheat Disease Segmentation
di: Wang, Shijie, et al.
Pubblicazione: (2026) -
Learning Efficient Unsupervised Satellite Image-based Building Damage Detection
di: Zhang, Yiyun, et al.
Pubblicazione: (2023) -
Divide-and-Conquer Approach to Holistic Cognition in High-Similarity Contexts with Limited Data
di: Wang, Shijie, et al.
Pubblicazione: (2026)