Document Screenshot Retrievers are Vulnerable to Pixel Poisoning Attacks
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhuang, Shengyao, Khramtsova, Ekaterina, Ma, Xueguang, Koopman, Bevan, Lin, Jimmy, Zuccon, Guido |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PromptReps: Prompting Large Language Models to Generate Dense and Sparse Representations for Zero-Shot Document Retrieval
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
di: Zhuang, Shengyao, et al.
Pubblicazione: (2025)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2025)
VISA: Retrieval Augmented Generation with Visual Source Attribution
di: Ma, Xueguang, et al.
Pubblicazione: (2024)
di: Ma, Xueguang, et al.
Pubblicazione: (2024)
Does Vec2Text Pose a New Corpus Poisoning Threat?
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
Leveraging LLMs for Unsupervised Dense Retriever Ranking
di: Khramtsova, Ekaterina, et al.
Pubblicazione: (2024)
di: Khramtsova, Ekaterina, et al.
Pubblicazione: (2024)
Dense Retrieval with Continuous Explicit Feedback for Systematic Review Screening Prioritisation
di: Mao, Xinyu, et al.
Pubblicazione: (2024)
di: Mao, Xinyu, et al.
Pubblicazione: (2024)
2D Matryoshka Training for Information Retrieval
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
FeB4RAG: Evaluating Federated Search in the Context of Retrieval Augmented Generation
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Understanding and Mitigating the Threat of Vec2Text to Dense Retrieval Systems
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
Embark on DenseQuest: A System for Selecting the Best Dense Retriever for a Custom Collection
di: Khramtsova, Ekaterina, et al.
Pubblicazione: (2024)
di: Khramtsova, Ekaterina, et al.
Pubblicazione: (2024)
A Setwise Approach for Effective and Highly Efficient Zero-shot Ranking with Large Language Models
di: Zhuang, Shengyao, et al.
Pubblicazione: (2023)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2023)
LLM-VPRF: Large Language Model Based Vector Pseudo Relevance Feedback
di: Li, Hang, et al.
Pubblicazione: (2025)
di: Li, Hang, et al.
Pubblicazione: (2025)
ReSLLM: Large Language Models are Strong Resource Selectors for Federated Search
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Starbucks-v2: Improved Training for 2D Matryoshka Embeddings
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)
Unifying Multimodal Retrieval via Document Screenshot Embedding
di: Ma, Xueguang, et al.
Pubblicazione: (2024)
di: Ma, Xueguang, et al.
Pubblicazione: (2024)
Beyond Chunk-Then-Embed: A Comprehensive Taxonomy and Evaluation of Document Chunking Strategies for Information Retrieval
di: Zhou, Yongjie, et al.
Pubblicazione: (2026)
di: Zhou, Yongjie, et al.
Pubblicazione: (2026)
A Reproducibility Study of Goldilocks: Just-Right Tuning of BERT for TAR
di: Mao, Xinyu, et al.
Pubblicazione: (2024)
di: Mao, Xinyu, et al.
Pubblicazione: (2024)
Zero-shot Generative Large Language Models for Systematic Review Screening Automation
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Can It Reach the Generator? Investigating the Survival of Prompt-Injection Attacks in Realistic RAG Settings
di: Yin, Yu, et al.
Pubblicazione: (2026)
di: Yin, Yu, et al.
Pubblicazione: (2026)
Pseudo Relevance Feedback is Enough to Close the Gap Between Small and Large Dense Retrieval Models
di: Li, Hang, et al.
Pubblicazione: (2025)
di: Li, Hang, et al.
Pubblicazione: (2025)
Tevatron 2.0: Unified Document Retrieval Toolkit across Scale, Language, and Modality
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
TPRF: A Transformer-based Pseudo-Relevance Feedback Model for Efficient and Effective Retrieval
di: Li, Hang, et al.
Pubblicazione: (2024)
di: Li, Hang, et al.
Pubblicazione: (2024)
MAGMaR Shared Task System Description: Video Retrieval with OmniEmbed
di: Zhan, Jiaqi Samantha, et al.
Pubblicazione: (2025)
di: Zhan, Jiaqi Samantha, et al.
Pubblicazione: (2025)
AutoBool: An Reinforcement-Learning trained LLM for Effective Automated Boolean Query Generation for Systematic Reviews
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
Reassessing Large Language Model Boolean Query Generation for Systematic Reviews
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
Rank-DistiLLM: Closing the Effectiveness Gap Between Cross-Encoders and LLMs for Passage Re-Ranking
di: Schlatt, Ferdinand, et al.
Pubblicazione: (2024)
di: Schlatt, Ferdinand, et al.
Pubblicazione: (2024)
Set-Encoder: Permutation-Invariant Inter-Passage Attention for Listwise Passage Re-Ranking with Cross-Encoders
di: Schlatt, Ferdinand, et al.
Pubblicazione: (2024)
di: Schlatt, Ferdinand, et al.
Pubblicazione: (2024)
Whole-Pool Setwise Reranking with Long-Context Language Models
di: Li, Hang, et al.
Pubblicazione: (2026)
di: Li, Hang, et al.
Pubblicazione: (2026)
Large Language Models for Stemming: Promises, Pitfalls and Failures
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
An Investigation of Prompt Variations for Zero-shot LLM-based Rankers
di: Sun, Shuoqi, et al.
Pubblicazione: (2024)
di: Sun, Shuoqi, et al.
Pubblicazione: (2024)
LACONIC: Dense-Level Effectiveness for Scalable Sparse Retrieval via a Two-Phase Training Curriculum
di: Xu, Zhichao, et al.
Pubblicazione: (2026)
di: Xu, Zhichao, et al.
Pubblicazione: (2026)
On the impact of retrieved content representations in RAG Pipelines
di: Ross, Jonathan J, et al.
Pubblicazione: (2026)
di: Ross, Jonathan J, et al.
Pubblicazione: (2026)
Where Relevance Emerges: A Layer-Wise Study of Internal Attention for Zero-Shot Re-Ranking
di: Chen, Haodong, et al.
Pubblicazione: (2026)
di: Chen, Haodong, et al.
Pubblicazione: (2026)
Hard Negatives, Hard Lessons: Revisiting Training Data Quality for Robust Information Retrieval with LLMs
di: Thakur, Nandan, et al.
Pubblicazione: (2025)
di: Thakur, Nandan, et al.
Pubblicazione: (2025)
Layer-wise Token Compression for Efficient Document Reranking
di: Zhuang, Shengyao, et al.
Pubblicazione: (2026)
di: Zhuang, Shengyao, et al.
Pubblicazione: (2026)
DenseReviewer: A Screening Prioritisation Tool for Systematic Review based on Dense Retrieval
di: Mao, Xinyu, et al.
Pubblicazione: (2025)
di: Mao, Xinyu, et al.
Pubblicazione: (2025)
Pre-training vs. Fine-tuning: A Reproducibility Study on Dense Retrieval Knowledge Acquisition
di: Yao, Zheng, et al.
Pubblicazione: (2025)
di: Yao, Zheng, et al.
Pubblicazione: (2025)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
di: Ma, Xueguang, et al.
Pubblicazione: (2025)
PoisonArena: Uncovering Competing Poisoning Attacks in Retrieval-Augmented Generation
di: Chen, Liuji, et al.
Pubblicazione: (2025)
di: Chen, Liuji, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PromptReps: Prompting Large Language Models to Generate Dense and Sparse Representations for Zero-Shot Document Retrieval
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024) -
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
di: Zhuang, Shengyao, et al.
Pubblicazione: (2025) -
VISA: Retrieval Augmented Generation with Visual Source Attribution
di: Ma, Xueguang, et al.
Pubblicazione: (2024) -
Does Vec2Text Pose a New Corpus Poisoning Threat?
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024) -
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
di: Zhuang, Shengyao, et al.
Pubblicazione: (2024)