Seemingly Plausible Distractors in Multi-Hop Reasoning: Are Large Language Models Attentive Readers?
Fuente:
arXiv
Salvato in:
| Autori principali: | Bhuiya, Neeladri, Schlegel, Viktor, Winkler, Stefan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Attentive Reasoning Queries: A Systematic Method for Optimizing Instruction-Following in Large Language Models
di: Karov, Bar, et al.
Pubblicazione: (2025)
di: Karov, Bar, et al.
Pubblicazione: (2025)
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
Reasoning over Uncertain Text by Generative Large Language Models
di: Nafar, Aliakbar, et al.
Pubblicazione: (2024)
di: Nafar, Aliakbar, et al.
Pubblicazione: (2024)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
From Reading to Compressing: Exploring the Multi-document Reader for Prompt Compression
di: Choi, Eunseong, et al.
Pubblicazione: (2024)
di: Choi, Eunseong, et al.
Pubblicazione: (2024)
Can Large Language Models Grasp Legal Theories? Enhance Legal Reasoning with Insights from Multi-Agent Collaboration
di: Yuan, Weikang, et al.
Pubblicazione: (2024)
di: Yuan, Weikang, et al.
Pubblicazione: (2024)
Search-R3: Unifying Reasoning and Embedding in Large Language Models
di: Gui, Yuntao, et al.
Pubblicazione: (2025)
di: Gui, Yuntao, et al.
Pubblicazione: (2025)
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
di: Ovcharov, Volodymyr
Pubblicazione: (2026)
di: Ovcharov, Volodymyr
Pubblicazione: (2026)
Beyond Token Length: Step Pruner for Efficient and Accurate Reasoning in Large Language Models
di: Wu, Canhui, et al.
Pubblicazione: (2025)
di: Wu, Canhui, et al.
Pubblicazione: (2025)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
Internal Reasoning vs. External Control: A Thermodynamic Analysis of Sycophancy in Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2025)
di: Chang, Edward Y.
Pubblicazione: (2025)
Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers
di: Abramov, Roman, et al.
Pubblicazione: (2025)
di: Abramov, Roman, et al.
Pubblicazione: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
di: Tan, Xiaoyu, et al.
Pubblicazione: (2024)
di: Tan, Xiaoyu, et al.
Pubblicazione: (2024)
Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
Robustness of Large Language Models to Perturbations in Text
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
Enigme: Generative Text Puzzles for Evaluating Reasoning in Language Models
di: Hawkins, John
Pubblicazione: (2025)
di: Hawkins, John
Pubblicazione: (2025)
Assessing Large Language Models on Islamic Legal Reasoning: Evidence from Inheritance Law Evaluation
di: Bouchekif, Abdessalam, et al.
Pubblicazione: (2025)
di: Bouchekif, Abdessalam, et al.
Pubblicazione: (2025)
Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models
di: Yang, Yujiao, et al.
Pubblicazione: (2025)
di: Yang, Yujiao, et al.
Pubblicazione: (2025)
Inference to the Best Explanation in Large Language Models
di: Dalal, Dhairya, et al.
Pubblicazione: (2024)
di: Dalal, Dhairya, et al.
Pubblicazione: (2024)
Streamlining Redundant Layers to Compress Large Language Models
di: Chen, Xiaodong, et al.
Pubblicazione: (2024)
di: Chen, Xiaodong, et al.
Pubblicazione: (2024)
A comprehensive taxonomy of hallucinations in Large Language Models
di: Cossio, Manuel
Pubblicazione: (2025)
di: Cossio, Manuel
Pubblicazione: (2025)
Distractor Injection Attacks on Large Reasoning Models: Characterization and Defense
di: Zhang, Zhehao, et al.
Pubblicazione: (2025)
di: Zhang, Zhehao, et al.
Pubblicazione: (2025)
Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Bielik 11B v3: Multilingual Large Language Model for European Languages
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2025)
di: Ociepa, Krzysztof, et al.
Pubblicazione: (2025)
Prompt-Time Symbolic Knowledge Capture with Large Language Models
di: Çöplü, Tolga, et al.
Pubblicazione: (2024)
di: Çöplü, Tolga, et al.
Pubblicazione: (2024)
Artificial Phantasia: Emergent Mental Imagery in Large Language Models
di: McCarty, Morgan, et al.
Pubblicazione: (2025)
di: McCarty, Morgan, et al.
Pubblicazione: (2025)
Argumentative Large Language Models for Explainable and Contestable Claim Verification
di: Freedman, Gabriel, et al.
Pubblicazione: (2024)
di: Freedman, Gabriel, et al.
Pubblicazione: (2024)
PatentGPT: A Large Language Model for Intellectual Property
di: Bai, Zilong, et al.
Pubblicazione: (2024)
di: Bai, Zilong, et al.
Pubblicazione: (2024)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
di: Wang, Renxi, et al.
Pubblicazione: (2023)
di: Wang, Renxi, et al.
Pubblicazione: (2023)
EQ-Bench: An Emotional Intelligence Benchmark for Large Language Models
di: Paech, Samuel J.
Pubblicazione: (2023)
di: Paech, Samuel J.
Pubblicazione: (2023)
Machine Translation Hallucination Detection for Low and High Resource Languages using Large Language Models
di: Benkirane, Kenza, et al.
Pubblicazione: (2024)
di: Benkirane, Kenza, et al.
Pubblicazione: (2024)
Can Large Language Models perform Relation-based Argument Mining?
di: Gorur, Deniz, et al.
Pubblicazione: (2024)
di: Gorur, Deniz, et al.
Pubblicazione: (2024)
EMNLP: Educator-role Moral and Normative Large Language Models Profiling
di: Jiang, Yilin, et al.
Pubblicazione: (2025)
di: Jiang, Yilin, et al.
Pubblicazione: (2025)
Assistive Large Language Model Agents for Socially-Aware Negotiation Dialogues
di: Hua, Yuncheng, et al.
Pubblicazione: (2024)
di: Hua, Yuncheng, et al.
Pubblicazione: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025)
di: Saji, Alan, et al.
Pubblicazione: (2025)
Intention Collapse: Intention-Level Metrics for Reasoning in Language Models
di: Vera, Patricio
Pubblicazione: (2026)
di: Vera, Patricio
Pubblicazione: (2026)
Predictive Simultaneous Interpretation: Harnessing Large Language Models for Democratizing Real-Time Multilingual Communication
di: Iida, Kurando, et al.
Pubblicazione: (2024)
di: Iida, Kurando, et al.
Pubblicazione: (2024)
PustakAI: Curriculum-Aligned and Interactive Textbooks Using Large Language Models
di: Sharma, Shivam, et al.
Pubblicazione: (2025)
di: Sharma, Shivam, et al.
Pubblicazione: (2025)
Prompt-Time Ontology-Driven Symbolic Knowledge Capture with Large Language Models
di: Çöplü, Tolga, et al.
Pubblicazione: (2024)
di: Çöplü, Tolga, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Attentive Reasoning Queries: A Systematic Method for Optimizing Instruction-Following in Large Language Models
di: Karov, Bar, et al.
Pubblicazione: (2025) -
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025) -
Reasoning over Uncertain Text by Generative Large Language Models
di: Nafar, Aliakbar, et al.
Pubblicazione: (2024) -
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025) -
From Reading to Compressing: Exploring the Multi-document Reader for Prompt Compression
di: Choi, Eunseong, et al.
Pubblicazione: (2024)