Half-Truths Break Similarity-Based Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kargi, Bora, Uselis, Arnas, Oh, Seong Joon |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the rankability of visual embeddings
par: Sonthalia, Ankit, et autres
Publié: (2025)
par: Sonthalia, Ankit, et autres
Publié: (2025)
How can embedding models bind concepts?
par: Uselis, Arnas, et autres
Publié: (2026)
par: Uselis, Arnas, et autres
Publié: (2026)
Compositional Generalization Requires Linear, Orthogonal Representations in Vision Embedding Models
par: Uselis, Arnas, et autres
Publié: (2026)
par: Uselis, Arnas, et autres
Publié: (2026)
CLIP Behaves like a Bag-of-Words Model Cross-modally but not Uni-modally
par: Koishigarina, Darina, et autres
Publié: (2025)
par: Koishigarina, Darina, et autres
Publié: (2025)
Sparse Autoencoders enable Robust and Interpretable Fine-tuning of CLIP models
par: Morelli, Fabian, et autres
Publié: (2026)
par: Morelli, Fabian, et autres
Publié: (2026)
Diffusion Classifiers Understand Compositionality, but Conditions Apply
par: Jeong, Yujin, et autres
Publié: (2025)
par: Jeong, Yujin, et autres
Publié: (2025)
When Do Diffusion Models learn to Generate Multiple Objects?
par: Jeong, Yujin, et autres
Publié: (2026)
par: Jeong, Yujin, et autres
Publié: (2026)
Intermediate Layer Classifiers for OOD generalization
par: Uselis, Arnas, et autres
Publié: (2025)
par: Uselis, Arnas, et autres
Publié: (2025)
VFSI: Validity First Spatial Intelligence for Constraint-Guided Traffic Diffusion
par: Chauhan, Kargi, et autres
Publié: (2025)
par: Chauhan, Kargi, et autres
Publié: (2025)
GroupCoOp: Group-robust Fine-tuning via Group Prompt Learning
par: Kim, Nayeong, et autres
Publié: (2025)
par: Kim, Nayeong, et autres
Publié: (2025)
Does Data Scaling Lead to Visual Compositional Generalization?
par: Uselis, Arnas, et autres
Publié: (2025)
par: Uselis, Arnas, et autres
Publié: (2025)
ECCV Caption: Correcting False Negatives by Collecting Machine-and-Human-verified Image-Caption Associations for MS-COCO
par: Chun, Sanghyuk, et autres
Publié: (2022)
par: Chun, Sanghyuk, et autres
Publié: (2022)
OVS Meets Continual Learning: Towards Sustainable Open-Vocabulary Segmentation
par: Hwang, Dongjun, et autres
Publié: (2024)
par: Hwang, Dongjun, et autres
Publié: (2024)
Pretrained Visual Uncertainties
par: Kirchhof, Michael, et autres
Publié: (2024)
par: Kirchhof, Michael, et autres
Publié: (2024)
Enhancing Multi-Image Understanding through Delimiter Token Scaling
par: Lee, Minyoung, et autres
Publié: (2026)
par: Lee, Minyoung, et autres
Publié: (2026)
Evaluating Self-Supervised Learning in Medical Imaging: A Benchmark for Robustness, Generalizability, and Multi-Domain Impact
par: Bundele, Valay, et autres
Publié: (2024)
par: Bundele, Valay, et autres
Publié: (2024)
Universal Algorithm-Implicit Learning
par: Woerner, Stefano, et autres
Publié: (2026)
par: Woerner, Stefano, et autres
Publié: (2026)
TestDG: Test-time Domain Generalization for Continual Test-time Adaptation
par: Lee, Sohyun, et autres
Publié: (2025)
par: Lee, Sohyun, et autres
Publié: (2025)
Scalable Ensemble Diversification for OOD Generalization and Detection
par: Rubinstein, Alexander, et autres
Publié: (2024)
par: Rubinstein, Alexander, et autres
Publié: (2024)
Are We Done with Object-Centric Learning?
par: Rubinstein, Alexander, et autres
Publié: (2025)
par: Rubinstein, Alexander, et autres
Publié: (2025)
Audio Deepfake Detection with Half-Truth Localisation Using Cross-Attentive Feature Fusion
par: Sutharya, S., et autres
Publié: (2026)
par: Sutharya, S., et autres
Publié: (2026)
MEME: Multi-entity & Evolving Memory Evaluation
par: Jung, Seokwon, et autres
Publié: (2026)
par: Jung, Seokwon, et autres
Publié: (2026)
SOI is the Root of All Evil: Quantifying and Breaking Similar Object Interference in Single Object Tracking
par: Wang, Yipei, et autres
Publié: (2025)
par: Wang, Yipei, et autres
Publié: (2025)
AMES: Asymmetric and Memory-Efficient Similarity Estimation for Instance-level Retrieval
par: Suma, Pavel, et autres
Publié: (2024)
par: Suma, Pavel, et autres
Publié: (2024)
Explorer: Robust Collection of Interactable GUI Elements
par: Chaimalas, Iason, et autres
Publié: (2025)
par: Chaimalas, Iason, et autres
Publié: (2025)
mEOL: Training-Free Instruction-Guided Multimodal Embedder for Vector Graphics and Image Retrieval
par: Kim, Kyeong Seon, et autres
Publié: (2026)
par: Kim, Kyeong Seon, et autres
Publié: (2026)
FlowMorph: Physics-Consistent Self-Supervision for Label-Free Single-Cell Mechanics in Microfluidic Videos
par: Yimenicioglu, Bora, et autres
Publié: (2026)
par: Yimenicioglu, Bora, et autres
Publié: (2026)
MIRe: Enhancing Multimodal Queries Representation via Fusion-Free Modality Interaction for Multimodal Retrieval
par: Ju, Yeong-Joon, et autres
Publié: (2024)
par: Ju, Yeong-Joon, et autres
Publié: (2024)
Mitigating Shortcut Learning with Diffusion Counterfactuals and Diverse Ensembles
par: Scimeca, Luca, et autres
Publié: (2023)
par: Scimeca, Luca, et autres
Publié: (2023)
Attention Itself Could Retrieve.RetrieveVGGT: Training-Free Long Context Streaming 3D Reconstruction via Query-Key Similarity Retrieval
par: Zou, Zichen, et autres
Publié: (2026)
par: Zou, Zichen, et autres
Publié: (2026)
Cluster-Aware Similarity Diffusion for Instance Retrieval
par: Luo, Jifei, et autres
Publié: (2024)
par: Luo, Jifei, et autres
Publié: (2024)
MCoT-RE: Multi-Faceted Chain-of-Thought and Re-Ranking for Training-Free Zero-Shot Composed Image Retrieval
par: Park, Jeong-Woo, et autres
Publié: (2025)
par: Park, Jeong-Woo, et autres
Publié: (2025)
GPTSee: Enhancing Moment Retrieval and Highlight Detection via Description-Based Similarity Features
par: Sun, Yunzhuo, et autres
Publié: (2024)
par: Sun, Yunzhuo, et autres
Publié: (2024)
Elevating Flow-Guided Video Inpainting with Reference Generation
par: Cho, Suhwan, et autres
Publié: (2024)
par: Cho, Suhwan, et autres
Publié: (2024)
Symmetric Multi-Similarity Loss for EPIC-KITCHENS-100 Multi-Instance Retrieval Challenge 2024
par: Wang, Xiaoqi, et autres
Publié: (2024)
par: Wang, Xiaoqi, et autres
Publié: (2024)
The Truth, the Whole Truth, and Nothing but the Truth: Automatic Visualization Evaluation from Reconstruction Quality
par: Bujack, Roxana, et autres
Publié: (2026)
par: Bujack, Roxana, et autres
Publié: (2026)
Amodal Ground Truth and Completion in the Wild
par: Zhan, Guanqi, et autres
Publié: (2023)
par: Zhan, Guanqi, et autres
Publié: (2023)
Retrieval-Augmented Natural Language Reasoning for Explainable Visual Question Answering
par: Lim, Su Hyeon, et autres
Publié: (2024)
par: Lim, Su Hyeon, et autres
Publié: (2024)
Scratching Visual Transformer's Back with Uniform Attention
par: Hyeon-Woo, Nam, et autres
Publié: (2022)
par: Hyeon-Woo, Nam, et autres
Publié: (2022)
Learning Segment Similarity and Alignment in Large-Scale Content Based Video Retrieval
par: Jiang, Chen, et autres
Publié: (2023)
par: Jiang, Chen, et autres
Publié: (2023)
Documents similaires
-
On the rankability of visual embeddings
par: Sonthalia, Ankit, et autres
Publié: (2025) -
How can embedding models bind concepts?
par: Uselis, Arnas, et autres
Publié: (2026) -
Compositional Generalization Requires Linear, Orthogonal Representations in Vision Embedding Models
par: Uselis, Arnas, et autres
Publié: (2026) -
CLIP Behaves like a Bag-of-Words Model Cross-modally but not Uni-modally
par: Koishigarina, Darina, et autres
Publié: (2025) -
Sparse Autoencoders enable Robust and Interpretable Fine-tuning of CLIP models
par: Morelli, Fabian, et autres
Publié: (2026)