CalibCLIP: Contextual Calibration of Dominant Semantics for Text-Driven Image Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Kang, Bin, Chen, Bin, Wang, Junjie, Li, Yulin, Zhao, Junzhi, Tian, Zhuotao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DeCLIP: Decoupled Learning for Open-Vocabulary Dense Perception
por: Wang, Junjie, et al.
Publicado: (2025)
por: Wang, Junjie, et al.
Publicado: (2025)
AgentSteerTTS: A Multi-Agent Closed-Loop Framework for Composite-Instruction Text-to-Speech
por: Kang, Bin, et al.
Publicado: (2026)
por: Kang, Bin, et al.
Publicado: (2026)
Multi-path Exploration and Feedback Adjustment for Text-to-Image Person Retrieval
por: Kang, Bin, et al.
Publicado: (2024)
por: Kang, Bin, et al.
Publicado: (2024)
Explore the Potential of CLIP for Training-Free Open Vocabulary Semantic Segmentation
por: Shao, Tong, et al.
Publicado: (2024)
por: Shao, Tong, et al.
Publicado: (2024)
Less Is More, but Where? Dynamic Token Compression via LLM-Guided Keyframe Prior
por: Li, Yulin, et al.
Publicado: (2025)
por: Li, Yulin, et al.
Publicado: (2025)
Generalized Decoupled Learning for Enhancing Open-Vocabulary Dense Perception
por: Wang, Junjie, et al.
Publicado: (2025)
por: Wang, Junjie, et al.
Publicado: (2025)
EF-Calib: Spatiotemporal Calibration of Event- and Frame-Based Cameras Using Continuous-Time Trajectories
por: Wang, Shaoan, et al.
Publicado: (2024)
por: Wang, Shaoan, et al.
Publicado: (2024)
Benchmarking and Evolving Reason-Reflect-Rectify for Reflective Visual Generation
por: Wang, Junjie, et al.
Publicado: (2026)
por: Wang, Junjie, et al.
Publicado: (2026)
OV-DQUO: Open-Vocabulary DETR with Denoising Text Query Training and Open-World Unknown Objects Supervision
por: Wang, Junjie, et al.
Publicado: (2024)
por: Wang, Junjie, et al.
Publicado: (2024)
CalibAnyView: Beyond Single-View Camera Calibration in the Wild
por: Li, Boying, et al.
Publicado: (2026)
por: Li, Boying, et al.
Publicado: (2026)
Multi-Perspective Subimage CLIP with Keyword Guidance for Remote Sensing Image-Text Retrieval
por: Li, Yifan, et al.
Publicado: (2026)
por: Li, Yifan, et al.
Publicado: (2026)
ReCLIP++: Learn to Rectify the Bias of CLIP for Unsupervised Semantic Segmentation
por: Wang, Jingyun, et al.
Publicado: (2024)
por: Wang, Jingyun, et al.
Publicado: (2024)
Contrast-Aware Calibration for Fine-Tuned CLIP: Leveraging Image-Text Alignment
por: Lv, Song-Lin, et al.
Publicado: (2025)
por: Lv, Song-Lin, et al.
Publicado: (2025)
Click-Calib: A Robust Extrinsic Calibration Method for Surround-View Systems
por: Wang, Lihao
Publicado: (2025)
por: Wang, Lihao
Publicado: (2025)
PTZ-Calib: Robust Pan-Tilt-Zoom Camera Calibration
por: Guo, Jinhui, et al.
Publicado: (2025)
por: Guo, Jinhui, et al.
Publicado: (2025)
GeoCalib: Learning Single-image Calibration with Geometric Optimization
por: Veicht, Alexander, et al.
Publicado: (2024)
por: Veicht, Alexander, et al.
Publicado: (2024)
RC-AutoCalib: An End-to-End Radar-Camera Automatic Calibration Network
por: Luu, Van-Tin, et al.
Publicado: (2025)
por: Luu, Van-Tin, et al.
Publicado: (2025)
Extending CLIP's Image-Text Alignment to Referring Image Segmentation
por: Kim, Seoyeon, et al.
Publicado: (2023)
por: Kim, Seoyeon, et al.
Publicado: (2023)
Parrot Captions Teach CLIP to Spot Text
por: Lin, Yiqi, et al.
Publicado: (2023)
por: Lin, Yiqi, et al.
Publicado: (2023)
SSR: Semantic and Spatial Rectification for CLIP-based Weakly Supervised Segmentation
por: Bi, Xiuli, et al.
Publicado: (2025)
por: Bi, Xiuli, et al.
Publicado: (2025)
Ultrasound-CLIP: Semantic-Aware Contrastive Pre-training for Ultrasound Image-Text Understanding
por: Jin, Jiayun, et al.
Publicado: (2026)
por: Jin, Jiayun, et al.
Publicado: (2026)
Tensor-Based Self-Calibration of Cameras via the TrifocalCalib Method
por: Schroeder, Gregory, et al.
Publicado: (2025)
por: Schroeder, Gregory, et al.
Publicado: (2025)
From Mapping to Composing: A Two-Stage Framework for Zero-shot Composed Image Retrieval
por: Wang, Yabing, et al.
Publicado: (2025)
por: Wang, Yabing, et al.
Publicado: (2025)
FoCLIP: A Feature-Space Misalignment Framework for CLIP-Based Image Manipulation and Detection
por: Chen, Yulin, et al.
Publicado: (2025)
por: Chen, Yulin, et al.
Publicado: (2025)
OA-CNNs: Omni-Adaptive Sparse CNNs for 3D Semantic Segmentation
por: Peng, Bohao, et al.
Publicado: (2024)
por: Peng, Bohao, et al.
Publicado: (2024)
RAVES-Calib: Robust, Accurate and Versatile Extrinsic Self Calibration Using Optimal Geometric Features
por: Zhang, Haoxin, et al.
Publicado: (2025)
por: Zhang, Haoxin, et al.
Publicado: (2025)
E-Calib: A Fast, Robust and Accurate Calibration Toolbox for Event Cameras
por: Salah, Mohammed, et al.
Publicado: (2023)
por: Salah, Mohammed, et al.
Publicado: (2023)
CasCalib: Cascaded Calibration for Motion Capture from Sparse Unsynchronized Cameras
por: Tang, James, et al.
Publicado: (2024)
por: Tang, James, et al.
Publicado: (2024)
AnyCalib: On-Manifold Learning for Model-Agnostic Single-View Camera Calibration
por: Tirado-Garín, Javier, et al.
Publicado: (2025)
por: Tirado-Garín, Javier, et al.
Publicado: (2025)
GroupContrast: Semantic-aware Self-supervised Representation Learning for 3D Understanding
por: Wang, Chengyao, et al.
Publicado: (2024)
por: Wang, Chengyao, et al.
Publicado: (2024)
DiffCalib: Reformulating Monocular Camera Calibration as Diffusion-Based Dense Incident Map Generation
por: He, Xiankang, et al.
Publicado: (2024)
por: He, Xiankang, et al.
Publicado: (2024)
CalibFormer: A Transformer-based Automatic LiDAR-Camera Calibration Network
por: Xiao, Yuxuan, et al.
Publicado: (2023)
por: Xiao, Yuxuan, et al.
Publicado: (2023)
ARC-Calib: Autonomous Markerless Camera-to-Robot Calibration via Exploratory Robot Motions
por: Chanrungmaneekul, Podshara, et al.
Publicado: (2025)
por: Chanrungmaneekul, Podshara, et al.
Publicado: (2025)
Text-guided Image Restoration and Semantic Enhancement for Text-to-Image Person Retrieval
por: Liu, Delong, et al.
Publicado: (2023)
por: Liu, Delong, et al.
Publicado: (2023)
CultureCLIP: Empowering CLIP with Cultural Awareness through Synthetic Images and Contextualized Captions
por: Huang, Yuchen, et al.
Publicado: (2025)
por: Huang, Yuchen, et al.
Publicado: (2025)
MTA-CLIP: Language-Guided Semantic Segmentation with Mask-Text Alignment
por: Das, Anurag, et al.
Publicado: (2024)
por: Das, Anurag, et al.
Publicado: (2024)
MirrorCalib: Utilizing Human Pose Information for Mirror-based Virtual Camera Calibration
por: Liao, Longyun, et al.
Publicado: (2023)
por: Liao, Longyun, et al.
Publicado: (2023)
EmoCaliber: Advancing Reliable Visual Emotion Comprehension via Confidence Verbalization and Calibration
por: Wu, Daiqing, et al.
Publicado: (2025)
por: Wu, Daiqing, et al.
Publicado: (2025)
Consistency Beyond Contrast: Enhancing Open-Vocabulary Object Detection Robustness via Contextual Consistency Learning
por: Li, Bozhao, et al.
Publicado: (2026)
por: Li, Bozhao, et al.
Publicado: (2026)
CDUL: CLIP-Driven Unsupervised Learning for Multi-Label Image Classification
por: Abdelfattah, Rabab, et al.
Publicado: (2023)
por: Abdelfattah, Rabab, et al.
Publicado: (2023)
Ejemplares similares
-
DeCLIP: Decoupled Learning for Open-Vocabulary Dense Perception
por: Wang, Junjie, et al.
Publicado: (2025) -
AgentSteerTTS: A Multi-Agent Closed-Loop Framework for Composite-Instruction Text-to-Speech
por: Kang, Bin, et al.
Publicado: (2026) -
Multi-path Exploration and Feedback Adjustment for Text-to-Image Person Retrieval
por: Kang, Bin, et al.
Publicado: (2024) -
Explore the Potential of CLIP for Training-Free Open Vocabulary Semantic Segmentation
por: Shao, Tong, et al.
Publicado: (2024) -
Less Is More, but Where? Dynamic Token Compression via LLM-Guided Keyframe Prior
por: Li, Yulin, et al.
Publicado: (2025)