Diversity of Thought Improves Reasoning Abilities of LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Naik, Ranjita, Chandrasekaran, Varun, Yuksekgonul, Mert, Palangi, Hamid, Nushi, Besmira |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
par: Yuksekgonul, Mert, et autres
Publié: (2023)
par: Yuksekgonul, Mert, et autres
Publié: (2023)
Attention Speaks Volumes: Localizing and Mitigating Bias in Language Models
par: Adiga, Rishabh, et autres
Publié: (2024)
par: Adiga, Rishabh, et autres
Publié: (2024)
BenchAgents: Multi-Agent Systems for Structured Benchmark Creation
par: Butt, Natasha, et autres
Publié: (2024)
par: Butt, Natasha, et autres
Publié: (2024)
Improving Instruction-Following in Language Models through Activation Steering
par: Stolfo, Alessandro, et autres
Publié: (2024)
par: Stolfo, Alessandro, et autres
Publié: (2024)
Detecting Data Contamination in LLMs via In-Context Learning
par: Zawalski, Michał, et autres
Publié: (2025)
par: Zawalski, Michał, et autres
Publié: (2025)
Eureka: Evaluating and Understanding Large Foundation Models
par: Balachandran, Vidhisha, et autres
Publié: (2024)
par: Balachandran, Vidhisha, et autres
Publié: (2024)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
par: Bordt, Sebastian, et autres
Publié: (2024)
par: Bordt, Sebastian, et autres
Publié: (2024)
GATE X-E : A Challenge Set for Gender-Fair Translations from Weakly-Gendered Languages
par: Rarrick, Spencer, et autres
Publié: (2024)
par: Rarrick, Spencer, et autres
Publié: (2024)
LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs
par: Cai, Yanan, et autres
Publié: (2025)
par: Cai, Yanan, et autres
Publié: (2025)
Cost-of-Pass: An Economic Framework for Evaluating Language Models
par: Erol, Mehmet Hamza, et autres
Publié: (2025)
par: Erol, Mehmet Hamza, et autres
Publié: (2025)
How Well Can LLMs Negotiate? NegotiationArena Platform and Analysis
par: Bianchi, Federico, et autres
Publié: (2024)
par: Bianchi, Federico, et autres
Publié: (2024)
Generative Monoculture in Large Language Models
par: Wu, Fan, et autres
Publié: (2024)
par: Wu, Fan, et autres
Publié: (2024)
Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values
par: Zhang, Hongbo, et autres
Publié: (2025)
par: Zhang, Hongbo, et autres
Publié: (2025)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
par: Cai, Wenrui, et autres
Publié: (2025)
par: Cai, Wenrui, et autres
Publié: (2025)
Reverse Thinking Makes LLMs Stronger Reasoners
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
Reasoning Does Not Necessarily Improve Role-Playing Ability
par: Feng, Xiachong, et autres
Publié: (2025)
par: Feng, Xiachong, et autres
Publié: (2025)
MM-GEN: Enhancing Task Performance Through Targeted Multimodal Data Curation
par: Joshi, Siddharth, et autres
Publié: (2025)
par: Joshi, Siddharth, et autres
Publié: (2025)
DORA Explorer: Improving the Exploration Ability of LLMs Without Training
par: Gurjar, Priya, et autres
Publié: (2026)
par: Gurjar, Priya, et autres
Publié: (2026)
Unearthing Skill-Level Insights for Understanding Trade-Offs of Foundation Models
par: Moayeri, Mazda, et autres
Publié: (2024)
par: Moayeri, Mazda, et autres
Publié: (2024)
Expanding Reasoning Potential in Foundation Model by Learning Diverse Chains of Thought Patterns
par: Zhang, Xuemiao, et autres
Publié: (2025)
par: Zhang, Xuemiao, et autres
Publié: (2025)
Breaking Thought Patterns: A Multi-Dimensional Reasoning Framework for LLMs
par: Tang, Xintong, et autres
Publié: (2025)
par: Tang, Xintong, et autres
Publié: (2025)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
par: Cao, Jie, et autres
Publié: (2026)
par: Cao, Jie, et autres
Publié: (2026)
LLMs can Find Mathematical Reasoning Mistakes by Pedagogical Chain-of-Thought
par: Jiang, Zhuoxuan, et autres
Publié: (2024)
par: Jiang, Zhuoxuan, et autres
Publié: (2024)
Democratizing LLMs for Low-Resource Languages by Leveraging their English Dominant Abilities with Linguistically-Diverse Prompts
par: Nguyen, Xuan-Phi, et autres
Publié: (2023)
par: Nguyen, Xuan-Phi, et autres
Publié: (2023)
Language Models' Factuality Depends on the Language of Inquiry
par: Aggarwal, Tushar, et autres
Publié: (2025)
par: Aggarwal, Tushar, et autres
Publié: (2025)
TextGrad: Automatic "Differentiation" via Text
par: Yuksekgonul, Mert, et autres
Publié: (2024)
par: Yuksekgonul, Mert, et autres
Publié: (2024)
Which LLMs Get the Joke? Probing Non-STEM Reasoning Abilities with HumorBench
par: Narad, Reuben, et autres
Publié: (2025)
par: Narad, Reuben, et autres
Publié: (2025)
DICE: Structured Reasoning in LLMs through SLM-Guided Chain-of-Thought Correction
par: Li, Yiqi, et autres
Publié: (2025)
par: Li, Yiqi, et autres
Publié: (2025)
Causal Graphs Meet Thoughts: Enhancing Complex Reasoning in Graph-Augmented LLMs
par: Luo, Hang, et autres
Publié: (2025)
par: Luo, Hang, et autres
Publié: (2025)
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
par: Chen, Zui, et autres
Publié: (2024)
par: Chen, Zui, et autres
Publié: (2024)
ModelCitizens: Representing Community Voices in Online Safety
par: Suvarna, Ashima, et autres
Publié: (2025)
par: Suvarna, Ashima, et autres
Publié: (2025)
Learn Globally, Speak Locally: Bridging the Gaps in Multilingual Reasoning
par: Hwang, Jaedong, et autres
Publié: (2025)
par: Hwang, Jaedong, et autres
Publié: (2025)
Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought
par: Xiang, Violet, et autres
Publié: (2025)
par: Xiang, Violet, et autres
Publié: (2025)
Mechanics of Bias and Reasoning: Interpreting the Impact of Chain-of-Thought Prompting on Gender Bias in LLMs
par: Pearman, Edie, et autres
Publié: (2026)
par: Pearman, Edie, et autres
Publié: (2026)
Table as Thought: Exploring Structured Thoughts in LLM Reasoning
par: Sun, Zhenjie, et autres
Publié: (2025)
par: Sun, Zhenjie, et autres
Publié: (2025)
Tracing the Traces: Latent Temporal Signals for Efficient and Accurate Reasoning
par: Vilas, Martina G., et autres
Publié: (2025)
par: Vilas, Martina G., et autres
Publié: (2025)
AQA-Bench: An Interactive Benchmark for Evaluating LLMs' Sequential Reasoning Ability
par: Yang, Siwei, et autres
Publié: (2024)
par: Yang, Siwei, et autres
Publié: (2024)
Improving Task Diversity in Label Efficient Supervised Finetuning of LLMs
par: Arabelly, Abhinav, et autres
Publié: (2025)
par: Arabelly, Abhinav, et autres
Publié: (2025)
Does "Reasoning" with Large Language Models Improve Recognizing, Generating, and Reframing Unhelpful Thoughts?
par: Qi, Yilin, et autres
Publié: (2025)
par: Qi, Yilin, et autres
Publié: (2025)
Narrative-of-Thought: Improving Temporal Reasoning of Large Language Models via Recounted Narratives
par: Zhang, Xinliang Frederick, et autres
Publié: (2024)
par: Zhang, Xinliang Frederick, et autres
Publié: (2024)
Documents similaires
-
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
par: Yuksekgonul, Mert, et autres
Publié: (2023) -
Attention Speaks Volumes: Localizing and Mitigating Bias in Language Models
par: Adiga, Rishabh, et autres
Publié: (2024) -
BenchAgents: Multi-Agent Systems for Structured Benchmark Creation
par: Butt, Natasha, et autres
Publié: (2024) -
Improving Instruction-Following in Language Models through Activation Steering
par: Stolfo, Alessandro, et autres
Publié: (2024) -
Detecting Data Contamination in LLMs via In-Context Learning
par: Zawalski, Michał, et autres
Publié: (2025)