SiReRAG: Indexing Similar and Related Information for Multihop Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Nan, Choubey, Prafulla Kumar, Fabbri, Alexander, Bernadett-Shapiro, Gabriel, Zhang, Rui, Mitra, Prasenjit, Xiong, Caiming, Wu, Chien-Sheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do RAG Systems Cover What Matters? Evaluating and Optimizing Responses with Sub-Question Coverage
par: Xie, Kaige, et autres
Publié: (2024)
par: Xie, Kaige, et autres
Publié: (2024)
Unanswerability Evaluation for Retrieval Augmented Generation
par: Peng, Xiangyu, et autres
Publié: (2024)
par: Peng, Xiangyu, et autres
Publié: (2024)
Agentic Uncertainty Quantification
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
Embrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News Articles
par: Huang, Kung-Hsiang, et autres
Publié: (2023)
par: Huang, Kung-Hsiang, et autres
Publié: (2023)
Turning Conversations into Workflows: A Framework to Extract and Evaluate Dialog Workflows for Service AI Agents
par: Choubey, Prafulla Kumar, et autres
Publié: (2025)
par: Choubey, Prafulla Kumar, et autres
Publié: (2025)
Benchmarking Deep Search over Heterogeneous Enterprise Data
par: Choubey, Prafulla Kumar, et autres
Publié: (2025)
par: Choubey, Prafulla Kumar, et autres
Publié: (2025)
Summary of a Haystack: A Challenge to Long-Context LLMs and RAG Systems
par: Laban, Philippe, et autres
Publié: (2024)
par: Laban, Philippe, et autres
Publié: (2024)
CRMArena-Pro: Holistic Assessment of LLM Agents Across Diverse Business Scenarios and Interactions
par: Huang, Kung-Hsiang, et autres
Publié: (2025)
par: Huang, Kung-Hsiang, et autres
Publié: (2025)
Nudging the Boundaries of LLM Reasoning
par: Chen, Justin Chih-Yao, et autres
Publié: (2025)
par: Chen, Justin Chih-Yao, et autres
Publié: (2025)
When Reasoning Meets Compression: Understanding the Effects of LLMs Compression on Large Reasoning Models
par: Zhang, Nan, et autres
Publié: (2025)
par: Zhang, Nan, et autres
Publié: (2025)
ReGenesis: LLMs can Grow into Reasoning Generalists via Self-Improvement
par: Peng, Xiangyu, et autres
Publié: (2024)
par: Peng, Xiangyu, et autres
Publié: (2024)
Agentic Confidence Calibration
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
Scaling Knowledge Graph Construction through Synthetic Data Generation and Distillation
par: Choubey, Prafulla Kumar, et autres
Publié: (2024)
par: Choubey, Prafulla Kumar, et autres
Publié: (2024)
QuantLRM: Quantization of Large Reasoning Models via Fine-Tuning Signals
par: Zhang, Nan, et autres
Publié: (2026)
par: Zhang, Nan, et autres
Publié: (2026)
GTA: Generating Long-Horizon Tasks for Web Agents at Scale
par: Huang, Tenghao, et autres
Publié: (2026)
par: Huang, Tenghao, et autres
Publié: (2026)
UNIDOC-BENCH: A Unified Benchmark for Document-Centric Multimodal RAG
par: Peng, Xiangyu, et autres
Publié: (2025)
par: Peng, Xiangyu, et autres
Publié: (2025)
Dont Stop Early: Scalable Enterprise Deep Research with Controlled Information Flow and Evidence-Aware Termination
par: Choubey, Prafulla Kumar, et autres
Publié: (2026)
par: Choubey, Prafulla Kumar, et autres
Publié: (2026)
TaxoAdapt: Aligning LLM-Based Multidimensional Taxonomy Construction to Evolving Research Corpora
par: Kargupta, Priyanka, et autres
Publié: (2025)
par: Kargupta, Priyanka, et autres
Publié: (2025)
MiRAGE: A Multiagent Framework for Generating Multimodal Multihop Question-Answer Dataset for RAG Evaluation
par: Sahu, Chandan Kumar, et autres
Publié: (2026)
par: Sahu, Chandan Kumar, et autres
Publié: (2026)
Can Embedding Similarity Predict Cross-Lingual Transfer? A Systematic Study on African Languages
par: Idris, Tewodros Kederalah, et autres
Publié: (2026)
par: Idris, Tewodros Kederalah, et autres
Publié: (2026)
Shared Imagination: LLMs Hallucinate Alike
par: Zhou, Yilun, et autres
Publié: (2024)
par: Zhou, Yilun, et autres
Publié: (2024)
Convomem Benchmark: Why Your First 150 Conversations Don't Need RAG
par: Pakhomov, Egor, et autres
Publié: (2025)
par: Pakhomov, Egor, et autres
Publié: (2025)
Foundational Automatic Evaluators: Scaling Multi-Task Generative Evaluator Training for Reasoning-Centric Domains
par: Xu, Austin, et autres
Publié: (2025)
par: Xu, Austin, et autres
Publié: (2025)
Are You Sure? Challenging LLMs Leads to Performance Drops in The FlipFlop Experiment
par: Laban, Philippe, et autres
Publié: (2023)
par: Laban, Philippe, et autres
Publié: (2023)
HumorRank: A Tournament-Based Leaderboard for Evaluating Humor Generation in Large Language Models
par: Ajayi, Edward, et autres
Publié: (2026)
par: Ajayi, Edward, et autres
Publié: (2026)
HumorGen: Cognitive Synergy for Humor Generation in Large Language Models via Persona-Based Distillation
par: Ajayi, Edward, et autres
Publié: (2026)
par: Ajayi, Edward, et autres
Publié: (2026)
Transformer-Based Wildlife Species Classification from Daily Movement Trajectories
par: Irakoze, Obed, et autres
Publié: (2026)
par: Irakoze, Obed, et autres
Publié: (2026)
Performance Anomaly Detection in Athletics: A Benchmarking System with Visual Analytics
par: Madukoma, Blessed, et autres
Publié: (2026)
par: Madukoma, Blessed, et autres
Publié: (2026)
Automated Multi-Task Learning for Joint Disease Prediction on Electronic Health Records
par: Cui, Suhan, et autres
Publié: (2024)
par: Cui, Suhan, et autres
Publié: (2024)
The Illusion of Certainty: Decoupling Capability and Calibration in On-Policy Distillation
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System
par: Liu, Zhiwei, et autres
Publié: (2024)
par: Liu, Zhiwei, et autres
Publié: (2024)
Virtual Customers behind Avatars: The Relationship between Virtual Identity and Virtual Consumption in Second Life
par: Bernadett Koles
Publié: (2012)
par: Bernadett Koles
Publié: (2012)
ReIFE: Re-evaluating Instruction-Following Evaluation
par: Liu, Yixin, et autres
Publié: (2024)
par: Liu, Yixin, et autres
Publié: (2024)
Pruning as a Domain-specific LLM Extractor
par: Zhang, Nan, et autres
Publié: (2024)
par: Zhang, Nan, et autres
Publié: (2024)
MMInA: Benchmarking Multihop Multimodal Internet Agents
par: Tian, Shulin, et autres
Publié: (2024)
par: Tian, Shulin, et autres
Publié: (2024)
GReaTer: Gradients over Reasoning Makes Smaller Language Models Strong Prompt Optimizers
par: Das, Sarkar Snigdha Sarathi, et autres
Publié: (2024)
par: Das, Sarkar Snigdha Sarathi, et autres
Publié: (2024)
GUI-KV: Efficient GUI Agents via KV Cache with Spatio-Temporal Awareness
par: Huang, Kung-Hsiang, et autres
Publié: (2025)
par: Huang, Kung-Hsiang, et autres
Publié: (2025)
PEaCE: A Chemistry-Oriented Dataset for Optical Character Recognition on Scientific Documents
par: Zhang, Nan, et autres
Publié: (2024)
par: Zhang, Nan, et autres
Publié: (2024)
From Passive Metric to Active Signal: The Evolving Role of Uncertainty Quantification in Large Language Models
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
IndexRAG: Bridging Facts for Cross-Document Reasoning at Index Time
par: Bao, Zhenghua, et autres
Publié: (2026)
par: Bao, Zhenghua, et autres
Publié: (2026)
Documents similaires
-
Do RAG Systems Cover What Matters? Evaluating and Optimizing Responses with Sub-Question Coverage
par: Xie, Kaige, et autres
Publié: (2024) -
Unanswerability Evaluation for Retrieval Augmented Generation
par: Peng, Xiangyu, et autres
Publié: (2024) -
Agentic Uncertainty Quantification
par: Zhang, Jiaxin, et autres
Publié: (2026) -
Embrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News Articles
par: Huang, Kung-Hsiang, et autres
Publié: (2023) -
Turning Conversations into Workflows: A Framework to Extract and Evaluate Dialog Workflows for Service AI Agents
par: Choubey, Prafulla Kumar, et autres
Publié: (2025)