Unifying Adversarial Robustness and Training Across Text Scoring Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Tamber, Manveer Singh, Oyarhoseini, Hosna, Lin, Jimmy |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Illusions of Relevance: Arbitrary Content Injection Attacks Deceive Retrievers, Rerankers, and LLM Judges
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
Can't Hide Behind the API: Stealing Black-Box Commercial Embedding Models
por: Tamber, Manveer Singh, et al.
Publicado: (2024)
por: Tamber, Manveer Singh, et al.
Publicado: (2024)
Teaching Dense Retrieval Models to Specialize with Listwise Distillation and LLM Data Augmentation
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
Conventional Contrastive Learning Often Falls Short: Improving Dense Retrieval with Cross-Encoder Listwise Distillation and Synthetic Data
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
Study on LLMs for Promptagator-Style Dense Retriever Training
por: Gwon, Daniel, et al.
Publicado: (2025)
por: Gwon, Daniel, et al.
Publicado: (2025)
Hard Negatives, Hard Lessons: Revisiting Training Data Quality for Robust Information Retrieval with LLMs
por: Thakur, Nandan, et al.
Publicado: (2025)
por: Thakur, Nandan, et al.
Publicado: (2025)
Leveraging LLMs for Synthesizing Training Data Across Many Languages in Multilingual Dense Retrieval
por: Thakur, Nandan, et al.
Publicado: (2023)
por: Thakur, Nandan, et al.
Publicado: (2023)
A Systematic Study of Pseudo-Relevance Feedback with LLMs
por: Jedidi, Nour, et al.
Publicado: (2026)
por: Jedidi, Nour, et al.
Publicado: (2026)
A Survey on Retrieval-Augmented Text Generation for Large Language Models
por: Huang, Yizheng, et al.
Publicado: (2024)
por: Huang, Yizheng, et al.
Publicado: (2024)
Toward Automatic Relevance Judgment using Vision--Language Models for Image--Text Retrieval Evaluation
por: Yang, Jheng-Hong, et al.
Publicado: (2024)
por: Yang, Jheng-Hong, et al.
Publicado: (2024)
An Early FIRST Reproduction and Improvements to Single-Token Decoding for Fast Listwise Reranking
por: Chen, Zijian, et al.
Publicado: (2024)
por: Chen, Zijian, et al.
Publicado: (2024)
Text2Cypher Across Languages: Evaluating and Finetuning LLMs
por: Ozsoy, Makbule Gulcin, et al.
Publicado: (2025)
por: Ozsoy, Makbule Gulcin, et al.
Publicado: (2025)
Training LLMs to be Better Text Embedders through Bidirectional Reconstruction
por: Su, Chang, et al.
Publicado: (2025)
por: Su, Chang, et al.
Publicado: (2025)
LACONIC: Dense-Level Effectiveness for Scalable Sparse Retrieval via a Two-Phase Training Curriculum
por: Xu, Zhichao, et al.
Publicado: (2026)
por: Xu, Zhichao, et al.
Publicado: (2026)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
por: Ma, Xueguang, et al.
Publicado: (2025)
por: Ma, Xueguang, et al.
Publicado: (2025)
RanAT4BIE: Random Adversarial Training for Biomedical Information Extraction
por: Chen, Jian, et al.
Publicado: (2025)
por: Chen, Jian, et al.
Publicado: (2025)
The Great Nugget Recall: Automating Fact Extraction and RAG Evaluation with Large Language Models
por: Pradeep, Ronak, et al.
Publicado: (2025)
por: Pradeep, Ronak, et al.
Publicado: (2025)
Evaluating the Robustness of Retrieval-Augmented Generation to Adversarial Evidence in the Health Domain
por: Amirshahi, Shakiba, et al.
Publicado: (2025)
por: Amirshahi, Shakiba, et al.
Publicado: (2025)
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
por: Zhuang, Shengyao, et al.
Publicado: (2025)
por: Zhuang, Shengyao, et al.
Publicado: (2025)
"Knowing When You Don't Know": A Multilingual Relevance Assessment Dataset for Robust Retrieval-Augmented Generation
por: Thakur, Nandan, et al.
Publicado: (2023)
por: Thakur, Nandan, et al.
Publicado: (2023)
mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval
por: Zhang, Xin, et al.
Publicado: (2024)
por: Zhang, Xin, et al.
Publicado: (2024)
Evaluating Concurrent Robustness of Language Models Across Diverse Challenge Sets
por: Gupta, Vatsal, et al.
Publicado: (2023)
por: Gupta, Vatsal, et al.
Publicado: (2023)
A Large-Scale Study of Relevance Assessments with Large Language Models: An Initial Look
por: Upadhyay, Shivani, et al.
Publicado: (2024)
por: Upadhyay, Shivani, et al.
Publicado: (2024)
QAEA-DR: A Unified Text Augmentation Framework for Dense Retrieval
por: Tan, Hongming, et al.
Publicado: (2024)
por: Tan, Hongming, et al.
Publicado: (2024)
UniGLM: Training One Unified Language Model for Text-Attributed Graph Embedding
por: Fang, Yi, et al.
Publicado: (2024)
por: Fang, Yi, et al.
Publicado: (2024)
SkewRoute: Training-Free LLM Routing for Knowledge Graph Retrieval-Augmented Generation via Score Skewness of Retrieved Context
por: Wang, Hairu, et al.
Publicado: (2025)
por: Wang, Hairu, et al.
Publicado: (2025)
Training Sparse Mixture Of Experts Text Embedding Models
por: Nussbaum, Zach, et al.
Publicado: (2025)
por: Nussbaum, Zach, et al.
Publicado: (2025)
Initial Nugget Evaluation Results for the TREC 2024 RAG Track with the AutoNuggetizer Framework
por: Pradeep, Ronak, et al.
Publicado: (2024)
por: Pradeep, Ronak, et al.
Publicado: (2024)
Graph Fusion Across Languages using Large Language Models
por: Kyaw, Kaung Myat, et al.
Publicado: (2026)
por: Kyaw, Kaung Myat, et al.
Publicado: (2026)
Question Difficulty Estimation for Large Language Models via Answer Plausibility Scoring
por: Mozafari, Jamshid, et al.
Publicado: (2026)
por: Mozafari, Jamshid, et al.
Publicado: (2026)
ColBERT Retrieval and Ensemble Response Scoring for Language Model Question Answering
por: Gichamba, Alex, et al.
Publicado: (2024)
por: Gichamba, Alex, et al.
Publicado: (2024)
Analysis of Plan-based Retrieval for Grounded Text Generation
por: Godbole, Ameya, et al.
Publicado: (2024)
por: Godbole, Ameya, et al.
Publicado: (2024)
CRAFT: Training-Free Cascaded Retrieval for Tabular QA
por: Singh, Adarsh, et al.
Publicado: (2025)
por: Singh, Adarsh, et al.
Publicado: (2025)
Led to Mislead: Adversarial Content Injection for Attacks on Neural Ranking Models
por: Bigdeli, Amin, et al.
Publicado: (2026)
por: Bigdeli, Amin, et al.
Publicado: (2026)
Adversarial Attacks against Neural Ranking Models via In-Context Learning
por: Bigdeli, Amin, et al.
Publicado: (2025)
por: Bigdeli, Amin, et al.
Publicado: (2025)
Bagging-Based Model Merging for Robust General Text Embeddings
por: Zhang, Hengran, et al.
Publicado: (2026)
por: Zhang, Hengran, et al.
Publicado: (2026)
Spacerini: Plug-and-play Search Engines with Pyserini and Hugging Face
por: Akiki, Christopher, et al.
Publicado: (2023)
por: Akiki, Christopher, et al.
Publicado: (2023)
State Space Models are Strong Text Rerankers
por: Xu, Zhichao, et al.
Publicado: (2024)
por: Xu, Zhichao, et al.
Publicado: (2024)
Improving Text Embeddings with Large Language Models
por: Wang, Liang, et al.
Publicado: (2023)
por: Wang, Liang, et al.
Publicado: (2023)
Language Modeling Using Tensor Trains
por: Su, Zhan, et al.
Publicado: (2024)
por: Su, Zhan, et al.
Publicado: (2024)
Ejemplares similares
-
Illusions of Relevance: Arbitrary Content Injection Attacks Deceive Retrievers, Rerankers, and LLM Judges
por: Tamber, Manveer Singh, et al.
Publicado: (2025) -
Can't Hide Behind the API: Stealing Black-Box Commercial Embedding Models
por: Tamber, Manveer Singh, et al.
Publicado: (2024) -
Teaching Dense Retrieval Models to Specialize with Listwise Distillation and LLM Data Augmentation
por: Tamber, Manveer Singh, et al.
Publicado: (2025) -
Conventional Contrastive Learning Often Falls Short: Improving Dense Retrieval with Cross-Encoder Listwise Distillation and Synthetic Data
por: Tamber, Manveer Singh, et al.
Publicado: (2025) -
Study on LLMs for Promptagator-Style Dense Retriever Training
por: Gwon, Daniel, et al.
Publicado: (2025)