Enregistré dans:
| Auteurs principaux: | Chu-Carroll, Jennifer, Beck, Andrew, Burnham, Greg, Melville, David OS, Nachman, David, Özcan, A. Erdem, Ferrucci, David |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.08064 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-ARC: Enhancing LLMs with an Automated Reasoning Critic
par: Kalyanpur, Aditya, et autres
Publié: (2024)
par: Kalyanpur, Aditya, et autres
Publié: (2024)
What is Sentiment Meant to Mean to Language Models?
par: Burnham, Michael
Publié: (2024)
par: Burnham, Michael
Publié: (2024)
Reasoning about Affordances: Causal and Compositional Reasoning in LLMs
par: Gjerde, Magnus F., et autres
Publié: (2025)
par: Gjerde, Magnus F., et autres
Publié: (2025)
Beyond Behaviorist Representational Harms: A Plan for Measurement and Mitigation
par: Chien, Jennifer, et autres
Publié: (2024)
par: Chien, Jennifer, et autres
Publié: (2024)
Beyond Confidence: The Rhythms of Reasoning in Generative Models
par: Liu, Deyuan, et autres
Publié: (2026)
par: Liu, Deyuan, et autres
Publié: (2026)
The Universal Landscape of Human Reasoning
par: Chen, Qiguang, et autres
Publié: (2025)
par: Chen, Qiguang, et autres
Publié: (2025)
The Political Preferences of LLMs
par: Rozado, David
Publié: (2024)
par: Rozado, David
Publié: (2024)
Language Complexity and Speech Recognition Accuracy: Orthographic Complexity Hurts, Phonological Complexity Doesn't
par: Taguchi, Chihiro, et autres
Publié: (2024)
par: Taguchi, Chihiro, et autres
Publié: (2024)
No Text Needed: Forecasting MT Quality and Inequity from Fertility and Metadata
par: Lundin, Jessica M., et autres
Publié: (2025)
par: Lundin, Jessica M., et autres
Publié: (2025)
LLMs as Function Approximators: Terminology, Taxonomy, and Questions for Evaluation
par: Schlangen, David
Publié: (2024)
par: Schlangen, David
Publié: (2024)
Optimizing the Interface Between Knowledge Graphs and LLMs for Complex Reasoning
par: Markovic, Vasilije, et autres
Publié: (2025)
par: Markovic, Vasilije, et autres
Publié: (2025)
Beyond Words: A Latent Memory Approach to Internal Reasoning in LLMs
par: Orlicki, José I.
Publié: (2025)
par: Orlicki, José I.
Publié: (2025)
Planning Beyond Text: Graph-based Reasoning for Complex Narrative Generation
par: Gu, Hanwen, et autres
Publié: (2026)
par: Gu, Hanwen, et autres
Publié: (2026)
Are LLMs Capable of Data-based Statistical and Causal Reasoning? Benchmarking Advanced Quantitative Reasoning with Data
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
par: Su, Jinyan, et autres
Publié: (2025)
par: Su, Jinyan, et autres
Publié: (2025)
Shadow-Loom: Causal Reasoning over Graphical World Models of Narratives
par: Wilmot, David
Publié: (2026)
par: Wilmot, David
Publié: (2026)
Beyond Natural Language: LLMs Leveraging Alternative Formats for Enhanced Reasoning and Communication
par: Chen, Weize, et autres
Publié: (2024)
par: Chen, Weize, et autres
Publié: (2024)
Loss Landscape Degeneracy and Stagewise Development in Transformers
par: Hoogland, Jesse, et autres
Publié: (2024)
par: Hoogland, Jesse, et autres
Publié: (2024)
Beyond No: Quantifying AI Over-Refusal and Emotional Attachment Boundaries
par: Noever, David, et autres
Publié: (2025)
par: Noever, David, et autres
Publié: (2025)
MiniCheck: Efficient Fact-Checking of LLMs on Grounding Documents
par: Tang, Liyan, et autres
Publié: (2024)
par: Tang, Liyan, et autres
Publié: (2024)
Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?
par: Yue, Yang, et autres
Publié: (2025)
par: Yue, Yang, et autres
Publié: (2025)
Narrative Landscape: Mapping Narrative Dispositions Across LLMs
par: Jung, Donghoon, et autres
Publié: (2026)
par: Jung, Donghoon, et autres
Publié: (2026)
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
From LLMs to MLLMs: Exploring the Landscape of Multimodal Jailbreaking
par: Wang, Siyuan, et autres
Publié: (2024)
par: Wang, Siyuan, et autres
Publié: (2024)
Problem-Solving Logic Guided Curriculum In-Context Learning for LLMs Complex Reasoning
par: Ma, Xuetao, et autres
Publié: (2025)
par: Ma, Xuetao, et autres
Publié: (2025)
Causal Graphs Meet Thoughts: Enhancing Complex Reasoning in Graph-Augmented LLMs
par: Luo, Hang, et autres
Publié: (2025)
par: Luo, Hang, et autres
Publié: (2025)
Advancing Abductive Reasoning in Knowledge Graphs through Complex Logical Hypothesis Generation
par: Bai, Jiaxin, et autres
Publié: (2023)
par: Bai, Jiaxin, et autres
Publié: (2023)
Rethinking Reasoning in LLMs: Neuro-Symbolic Local RetoMaton Beyond ICL and CoT
par: Mamidala, Rushitha Santhoshi, et autres
Publié: (2025)
par: Mamidala, Rushitha Santhoshi, et autres
Publié: (2025)
Beyond Self-Consistency: Ensemble Reasoning Boosts Consistency and Accuracy of LLMs in Cancer Staging
par: Chang, Chia-Hsuan, et autres
Publié: (2024)
par: Chang, Chia-Hsuan, et autres
Publié: (2024)
Hippocrates: An Open-Source Framework for Advancing Large Language Models in Healthcare
par: Acikgoz, Emre Can, et autres
Publié: (2024)
par: Acikgoz, Emre Can, et autres
Publié: (2024)
Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?
par: Zhong, Chengzhi, et autres
Publié: (2024)
par: Zhong, Chengzhi, et autres
Publié: (2024)
A Statistical Physics of Language Model Reasoning
par: Carson, Jack David, et autres
Publié: (2025)
par: Carson, Jack David, et autres
Publié: (2025)
LLMs for Explainable AI: A Comprehensive Survey
par: Bilal, Ahsan, et autres
Publié: (2025)
par: Bilal, Ahsan, et autres
Publié: (2025)
When "Competency" in Reasoning Opens the Door to Vulnerability: Jailbreaking LLMs via Novel Complex Ciphers
par: Handa, Divij, et autres
Publié: (2024)
par: Handa, Divij, et autres
Publié: (2024)
Learning to Think Like a Cartoon Captionist: Incongruity-Resolution Supervision for Multimodal Humor Understanding
par: Vural, Hatice Merve, et autres
Publié: (2026)
par: Vural, Hatice Merve, et autres
Publié: (2026)
From Complexity to Clarity: How AI Enhances Perceptions of Scientists and the Public's Understanding of Science
par: Markowitz, David M.
Publié: (2024)
par: Markowitz, David M.
Publié: (2024)
Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning
par: Yan, Yibo, et autres
Publié: (2025)
par: Yan, Yibo, et autres
Publié: (2025)
Advancing Spatial Reasoning in Large Language Models: An In-Depth Evaluation and Enhancement Using the StepGame Benchmark
par: Li, Fangjun, et autres
Publié: (2024)
par: Li, Fangjun, et autres
Publié: (2024)
Domain Specific Specialization in Low-Resource Settings: The Efficacy of Offline Response-Based Knowledge Distillation in Large Language Models
par: Aslan, Erdem, et autres
Publié: (2026)
par: Aslan, Erdem, et autres
Publié: (2026)
Documents similaires
-
LLM-ARC: Enhancing LLMs with an Automated Reasoning Critic
par: Kalyanpur, Aditya, et autres
Publié: (2024) -
What is Sentiment Meant to Mean to Language Models?
par: Burnham, Michael
Publié: (2024) -
Reasoning about Affordances: Causal and Compositional Reasoning in LLMs
par: Gjerde, Magnus F., et autres
Publié: (2025) -
Beyond Behaviorist Representational Harms: A Plan for Measurement and Mitigation
par: Chien, Jennifer, et autres
Publié: (2024) -
Beyond Confidence: The Rhythms of Reasoning in Generative Models
par: Liu, Deyuan, et autres
Publié: (2026)