LLMs as Assessors: Right for the Right Reason?
Fuente:
arXiv
Guardado en:
| Autores principales: | Saha, Sourav, Mitra, Mandar, Dutta, Aditya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LiCQA : A Lightweight Complex Question Answering System
por: Saha, Sourav, et al.
Publicado: (2026)
por: Saha, Sourav, et al.
Publicado: (2026)
Explainability of Text Processing and Retrieval Methods: A Survey
por: Saha, Sourav, et al.
Publicado: (2022)
por: Saha, Sourav, et al.
Publicado: (2022)
One Word is Enough: Minimal Adversarial Perturbations for Neural Text Ranking
por: Karmakar, Tanmay, et al.
Publicado: (2026)
por: Karmakar, Tanmay, et al.
Publicado: (2026)
A Language-Driven Framework for Improving Personalized Recommendations: Merging LLMs with Traditional Algorithms
por: Goldstein, Aaron, et al.
Publicado: (2025)
por: Goldstein, Aaron, et al.
Publicado: (2025)
Wisdom of the Crowds in Forecasting: Forecast Summarization for Supporting Future Event Prediction
por: Saha, Anisha, et al.
Publicado: (2025)
por: Saha, Anisha, et al.
Publicado: (2025)
Few-shot Prompting for Pairwise Ranking: An Effective Non-Parametric Retrieval Model
por: Sinhababu, Nilanjan, et al.
Publicado: (2024)
por: Sinhababu, Nilanjan, et al.
Publicado: (2024)
Combining topic modelling and citation network analysis to study case law from the European Court on Human Rights on the right to respect for private and family life
por: Mohammadi, M., et al.
Publicado: (2024)
por: Mohammadi, M., et al.
Publicado: (2024)
Search Arena: Analyzing Search-Augmented LLMs
por: Miroyan, Mihran, et al.
Publicado: (2025)
por: Miroyan, Mihran, et al.
Publicado: (2025)
SoftQE: Learned Representations of Queries Expanded by LLMs
por: Pimpalkhute, Varad, et al.
Publicado: (2024)
por: Pimpalkhute, Varad, et al.
Publicado: (2024)
Adaptive Two-Phase Finetuning LLMs for Japanese Legal Text Retrieval
por: Trung, Quang Hoang, et al.
Publicado: (2024)
por: Trung, Quang Hoang, et al.
Publicado: (2024)
Navigating the Knowledge Sea: Planet-scale answer retrieval using LLMs
por: Sarkar, Dipankar
Publicado: (2024)
por: Sarkar, Dipankar
Publicado: (2024)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
por: Xu, Ran, et al.
Publicado: (2025)
por: Xu, Ran, et al.
Publicado: (2025)
Can Small Language Models be Good Reasoners for Sequential Recommendation?
por: Wang, Yuling, et al.
Publicado: (2024)
por: Wang, Yuling, et al.
Publicado: (2024)
Beyond Retrieval: Ensembling Cross-Encoders and GPT Rerankers with LLMs for Biomedical QA
por: Verma, Shashank, et al.
Publicado: (2025)
por: Verma, Shashank, et al.
Publicado: (2025)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
por: Jin, Bowen, et al.
Publicado: (2024)
por: Jin, Bowen, et al.
Publicado: (2024)
Open Deep Search: Democratizing Search with Open-source Reasoning Agents
por: Alzubi, Salaheddin, et al.
Publicado: (2025)
por: Alzubi, Salaheddin, et al.
Publicado: (2025)
Are Smaller Open-Weight LLMs Closing the Gap to Proprietary Models for Biomedical Question Answering?
por: Stachura, Damian, et al.
Publicado: (2025)
por: Stachura, Damian, et al.
Publicado: (2025)
AlpaPICO: Extraction of PICO Frames from Clinical Trial Documents Using LLMs
por: Ghosh, Madhusudan, et al.
Publicado: (2024)
por: Ghosh, Madhusudan, et al.
Publicado: (2024)
FGTR: Fine-Grained Multi-Table Retrieval via Hierarchical LLM Reasoning
por: Sun, Chaojie, et al.
Publicado: (2026)
por: Sun, Chaojie, et al.
Publicado: (2026)
Beyond Sequential Reranking: Reranker-Guided Search Improves Reasoning Intensive Retrieval
por: Xu, Haike, et al.
Publicado: (2025)
por: Xu, Haike, et al.
Publicado: (2025)
AT-RAG: An Adaptive RAG Model Enhancing Query Efficiency with Topic Filtering and Iterative Reasoning
por: Rezaei, Mohammad Reza, et al.
Publicado: (2024)
por: Rezaei, Mohammad Reza, et al.
Publicado: (2024)
From Web Search towards Agentic Deep Research: Incentivizing Search with Reasoning Agents
por: Zhang, Weizhi, et al.
Publicado: (2025)
por: Zhang, Weizhi, et al.
Publicado: (2025)
Identifying Reasons for Contraceptive Switching from Real-World Data Using Large Language Models
por: Miao, Brenda Y., et al.
Publicado: (2024)
por: Miao, Brenda Y., et al.
Publicado: (2024)
LANE: Logic Alignment of Non-tuning Large Language Models and Online Recommendation Systems for Explainable Reason Generation
por: Zhao, Hongke, et al.
Publicado: (2024)
por: Zhao, Hongke, et al.
Publicado: (2024)
LLMs for Knowledge Graph Construction and Reasoning: Recent Capabilities and Future Opportunities
por: Zhu, Yuqi, et al.
Publicado: (2023)
por: Zhu, Yuqi, et al.
Publicado: (2023)
Evaluating the Ebb and Flow: An In-depth Analysis of Question-Answering Trends across Diverse Platforms
por: Hazra, Rima, et al.
Publicado: (2023)
por: Hazra, Rima, et al.
Publicado: (2023)
Large language models can accurately predict searcher preferences
por: Thomas, Paul, et al.
Publicado: (2023)
por: Thomas, Paul, et al.
Publicado: (2023)
YT-30M: A multi-lingual multi-category dataset of YouTube comments
por: Dutta, Hridoy Sankar
Publicado: (2024)
por: Dutta, Hridoy Sankar
Publicado: (2024)
NUDGE: Lightweight Non-Parametric Fine-Tuning of Embeddings for Retrieval
por: Zeighami, Sepanta, et al.
Publicado: (2024)
por: Zeighami, Sepanta, et al.
Publicado: (2024)
ReasonIR: Training Retrievers for Reasoning Tasks
por: Shao, Rulin, et al.
Publicado: (2025)
por: Shao, Rulin, et al.
Publicado: (2025)
ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability
por: Liu, Wenhan, et al.
Publicado: (2025)
por: Liu, Wenhan, et al.
Publicado: (2025)
Combining Query Performance Predictors: A Reproducibility Study
por: Saha, Sourav, et al.
Publicado: (2025)
por: Saha, Sourav, et al.
Publicado: (2025)
Path-Constrained Retrieval: A Structural Approach to Reliable LLM Agent Reasoning Through Graph-Scoped Semantic Search
por: Oladokun, Joseph
Publicado: (2025)
por: Oladokun, Joseph
Publicado: (2025)
Quantifying Document Impact in RAG-LLMs
por: Gerami, Armin, et al.
Publicado: (2025)
por: Gerami, Armin, et al.
Publicado: (2025)
Knowledge Conflicts for LLMs: A Survey
por: Xu, Rongwu, et al.
Publicado: (2024)
por: Xu, Rongwu, et al.
Publicado: (2024)
Reasoning and Tools for Human-Level Forecasting
por: Hsieh, Elvis, et al.
Publicado: (2024)
por: Hsieh, Elvis, et al.
Publicado: (2024)
LLMInit: A Free Lunch from Large Language Models for Selective Initialization of Recommendation
por: Zhang, Weizhi, et al.
Publicado: (2025)
por: Zhang, Weizhi, et al.
Publicado: (2025)
Do LLMs Understand Collaborative Signals? Diagnosis and Repair
por: Pouryousef, Shahrooz, et al.
Publicado: (2025)
por: Pouryousef, Shahrooz, et al.
Publicado: (2025)
A Comparative Study of Specialized LLMs as Dense Retrievers
por: Zhang, Hengran, et al.
Publicado: (2025)
por: Zhang, Hengran, et al.
Publicado: (2025)
CALRec: Contrastive Alignment of Generative LLMs for Sequential Recommendation
por: Li, Yaoyiran, et al.
Publicado: (2024)
por: Li, Yaoyiran, et al.
Publicado: (2024)
Ejemplares similares
-
LiCQA : A Lightweight Complex Question Answering System
por: Saha, Sourav, et al.
Publicado: (2026) -
Explainability of Text Processing and Retrieval Methods: A Survey
por: Saha, Sourav, et al.
Publicado: (2022) -
One Word is Enough: Minimal Adversarial Perturbations for Neural Text Ranking
por: Karmakar, Tanmay, et al.
Publicado: (2026) -
A Language-Driven Framework for Improving Personalized Recommendations: Merging LLMs with Traditional Algorithms
por: Goldstein, Aaron, et al.
Publicado: (2025) -
Wisdom of the Crowds in Forecasting: Forecast Summarization for Supporting Future Event Prediction
por: Saha, Anisha, et al.
Publicado: (2025)