Can LLMs perform structured graph reasoning?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Agrawal, Palaash, Vasania, Shavak, Tan, Cheston |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Super Tiny Language Models
par: Hillier, Dylan, et autres
Publié: (2024)
par: Hillier, Dylan, et autres
Publié: (2024)
Can formal argumentative reasoning enhance LLMs performances?
par: Castagna, Federico, et autres
Publié: (2024)
par: Castagna, Federico, et autres
Publié: (2024)
STUPD: A Synthetic Dataset for Spatial and Temporal Relation Reasoning
par: Agrawal, Palaash, et autres
Publié: (2023)
par: Agrawal, Palaash, et autres
Publié: (2023)
Theory of Mind in Large Language Models: Assessment and Enhancement
par: Chen, Ruirui, et autres
Publié: (2025)
par: Chen, Ruirui, et autres
Publié: (2025)
How do Transformer Embeddings Represent Compositions? A Functional Analysis
par: Nagar, Aishik, et autres
Publié: (2025)
par: Nagar, Aishik, et autres
Publié: (2025)
QuestBench: Can LLMs ask the right question to acquire information in reasoning tasks?
par: Li, Belinda Z., et autres
Publié: (2025)
par: Li, Belinda Z., et autres
Publié: (2025)
Are LLMs classical or nonmonotonic reasoners? Lessons from generics
par: Leidinger, Alina, et autres
Publié: (2024)
par: Leidinger, Alina, et autres
Publié: (2024)
Graphing the Truth: Structured Visualizations for Automated Hallucination Detection in LLMs
par: Agrawal, Tanmay
Publié: (2025)
par: Agrawal, Tanmay
Publié: (2025)
Zero-Shot Visual Reasoning by Vision-Language Models: Benchmarking and Analysis
par: Nagar, Aishik, et autres
Publié: (2024)
par: Nagar, Aishik, et autres
Publié: (2024)
Superhuman performance of a large language model on the reasoning tasks of a physician
par: Brodeur, Peter G., et autres
Publié: (2024)
par: Brodeur, Peter G., et autres
Publié: (2024)
Are complicated loss functions necessary for teaching LLMs to reason?
par: Carrino, Gabriele, et autres
Publié: (2026)
par: Carrino, Gabriele, et autres
Publié: (2026)
Domain Knowledge-Enhanced LLMs for Fraud and Concept Drift Detection
par: Şenol, Ali, et autres
Publié: (2025)
par: Şenol, Ali, et autres
Publié: (2025)
Child vs. machine language learning: Can the logical structure of human language unleash LLMs?
par: Sauerland, Uli, et autres
Publié: (2025)
par: Sauerland, Uli, et autres
Publié: (2025)
Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework
par: Şenol, Ali, et autres
Publié: (2026)
par: Şenol, Ali, et autres
Publié: (2026)
Beyond Next Word Prediction: Developing Comprehensive Evaluation Frameworks for measuring LLM performance on real world applications
par: Agrawal, Vishakha, et autres
Publié: (2025)
par: Agrawal, Vishakha, et autres
Publié: (2025)
Meaningless is better: hashing bias-inducing words in LLM prompts improves performance in logical reasoning and statistical learning
par: Chadimová, Milena, et autres
Publié: (2024)
par: Chadimová, Milena, et autres
Publié: (2024)
Give me a hint: Can LLMs take a hint to solve math problems?
par: Agrawal, Vansh, et autres
Publié: (2024)
par: Agrawal, Vansh, et autres
Publié: (2024)
Can GNN be Good Adapter for LLMs?
par: Huang, Xuanwen, et autres
Publié: (2024)
par: Huang, Xuanwen, et autres
Publié: (2024)
Can LLMs Ask Good Questions?
par: Zhang, Yueheng, et autres
Publié: (2025)
par: Zhang, Yueheng, et autres
Publié: (2025)
Can LLMs Explain Themselves Counterfactually?
par: Dehghanighobadi, Zahra, et autres
Publié: (2025)
par: Dehghanighobadi, Zahra, et autres
Publié: (2025)
Can LLMs Capture Human Preferences?
par: Goli, Ali, et autres
Publié: (2023)
par: Goli, Ali, et autres
Publié: (2023)
Rethinking Cross-lingual Alignment: Balancing Transfer and Cultural Erasure in Multilingual LLMs
par: Han, HyoJung, et autres
Publié: (2025)
par: Han, HyoJung, et autres
Publié: (2025)
Can GRPO Help LLMs Transcend Their Pretraining Origin?
par: Ni, Kangqi, et autres
Publié: (2025)
par: Ni, Kangqi, et autres
Publié: (2025)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
par: Yu, Ping, et autres
Publié: (2025)
par: Yu, Ping, et autres
Publié: (2025)
Can reasoning models comprehend mathematical problems in Chinese ancient texts? An empirical study based on data from Suanjing Shishu
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
TangramSR: Can Vision-Language Models Reason in Continuous Geometric Space?
par: Zong, Yikun, et autres
Publié: (2026)
par: Zong, Yikun, et autres
Publié: (2026)
Can LLMs Correct Themselves? A Benchmark of Self-Correction in LLMs
par: Tie, Guiyao, et autres
Publié: (2025)
par: Tie, Guiyao, et autres
Publié: (2025)
Is your LLM trapped in a Mental Set? Investigative study on how mental sets affect the reasoning capabilities of LLMs
par: Haq, Saiful, et autres
Publié: (2025)
par: Haq, Saiful, et autres
Publié: (2025)
Can large language models build causal graphs?
par: Long, Stephanie, et autres
Publié: (2023)
par: Long, Stephanie, et autres
Publié: (2023)
Can We Locate and Prevent Stereotypes in LLMs?
par: D'Souza, Alex
Publié: (2026)
par: D'Souza, Alex
Publié: (2026)
Can LLMs Perceive Time? An Empirical Investigation
par: Garikaparthi, Aniketh
Publié: (2026)
par: Garikaparthi, Aniketh
Publié: (2026)
Phi-4-reasoning Technical Report
par: Abdin, Marah, et autres
Publié: (2025)
par: Abdin, Marah, et autres
Publié: (2025)
Correct-Detect: Balancing Performance and Ambiguity Through the Lens of Coreference Resolution in LLMs
par: Shore, Amber, et autres
Publié: (2025)
par: Shore, Amber, et autres
Publié: (2025)
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
par: Xu, Wenda, et autres
Publié: (2025)
par: Xu, Wenda, et autres
Publié: (2025)
Position: LLMs Can be Good Tutors in English Education
par: Ye, Jingheng, et autres
Publié: (2025)
par: Ye, Jingheng, et autres
Publié: (2025)
LLMs Can Teach Themselves to Better Predict the Future
par: Turtel, Benjamin, et autres
Publié: (2025)
par: Turtel, Benjamin, et autres
Publié: (2025)
Can Hallucinations Help? Boosting LLMs for Drug Discovery
par: Yuan, Shuzhou, et autres
Publié: (2025)
par: Yuan, Shuzhou, et autres
Publié: (2025)
Can LLMs Automate Fact-Checking Article Writing?
par: Sahnan, Dhruv, et autres
Publié: (2025)
par: Sahnan, Dhruv, et autres
Publié: (2025)
Can Reasoning LLMs Enhance Clinical Document Classification?
par: Mustafa, Akram, et autres
Publié: (2025)
par: Mustafa, Akram, et autres
Publié: (2025)
LLMs Can Plan Only If We Tell Them
par: Sel, Bilgehan, et autres
Publié: (2025)
par: Sel, Bilgehan, et autres
Publié: (2025)
Documents similaires
-
Super Tiny Language Models
par: Hillier, Dylan, et autres
Publié: (2024) -
Can formal argumentative reasoning enhance LLMs performances?
par: Castagna, Federico, et autres
Publié: (2024) -
STUPD: A Synthetic Dataset for Spatial and Temporal Relation Reasoning
par: Agrawal, Palaash, et autres
Publié: (2023) -
Theory of Mind in Large Language Models: Assessment and Enhancement
par: Chen, Ruirui, et autres
Publié: (2025) -
How do Transformer Embeddings Represent Compositions? A Functional Analysis
par: Nagar, Aishik, et autres
Publié: (2025)