Large Language Model Cascades with Mixture of Thoughts Representations for Cost-efficient Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Yue, Murong, Zhao, Jie, Zhang, Min, Du, Liang, Yao, Ziyu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search
por: Yue, Murong, et al.
Publicado: (2024)
por: Yue, Murong, et al.
Publicado: (2024)
A Survey of Large Language Model Agents for Question Answering
por: Yue, Murong
Publicado: (2025)
por: Yue, Murong
Publicado: (2025)
Efficient but Vulnerable: Benchmarking and Defending LLM Batch Prompting Attack
por: Yue, Murong, et al.
Publicado: (2025)
por: Yue, Murong, et al.
Publicado: (2025)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
por: Cai, Chengkun, et al.
Publicado: (2024)
por: Cai, Chengkun, et al.
Publicado: (2024)
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
por: Tanmay, Kumar, et al.
Publicado: (2025)
por: Tanmay, Kumar, et al.
Publicado: (2025)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
por: Chen, Sijia, et al.
Publicado: (2024)
por: Chen, Sijia, et al.
Publicado: (2024)
A Survey on Sparse Autoencoders: Interpreting the Internal Mechanisms of Large Language Models
por: Shu, Dong, et al.
Publicado: (2025)
por: Shu, Dong, et al.
Publicado: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
por: Cui, Yingqian, et al.
Publicado: (2025)
por: Cui, Yingqian, et al.
Publicado: (2025)
FactorLLM: Factorizing Knowledge via Mixture of Experts for Large Language Models
por: Zhao, Zhongyu, et al.
Publicado: (2024)
por: Zhao, Zhongyu, et al.
Publicado: (2024)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
por: Ye, Jiacheng, et al.
Publicado: (2024)
por: Ye, Jiacheng, et al.
Publicado: (2024)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
por: Li, Yuangang, et al.
Publicado: (2025)
por: Li, Yuangang, et al.
Publicado: (2025)
Variational Reasoning for Language Models
por: Zhou, Xiangxin, et al.
Publicado: (2025)
por: Zhou, Xiangxin, et al.
Publicado: (2025)
Large Language Models are Contrastive Reasoners
por: Yao, Liang
Publicado: (2024)
por: Yao, Liang
Publicado: (2024)
Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
por: Yuan, Aojie, et al.
Publicado: (2026)
por: Yuan, Aojie, et al.
Publicado: (2026)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
por: Zhao, Xufeng, et al.
Publicado: (2023)
por: Zhao, Xufeng, et al.
Publicado: (2023)
SQuARE: Sequential Question Answering Reasoning Engine for Enhanced Chain-of-Thought in Large Language Models
por: Fleischer, Daniel, et al.
Publicado: (2025)
por: Fleischer, Daniel, et al.
Publicado: (2025)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
por: Zhao, Zilong, et al.
Publicado: (2024)
por: Zhao, Zilong, et al.
Publicado: (2024)
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
por: Luo, Yaxin, et al.
Publicado: (2026)
por: Luo, Yaxin, et al.
Publicado: (2026)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
por: Zhao, Haokun, et al.
Publicado: (2024)
por: Zhao, Haokun, et al.
Publicado: (2024)
NeSTR: A Neuro-Symbolic Abductive Framework for Temporal Reasoning in Large Language Models
por: Liang, Feng, et al.
Publicado: (2025)
por: Liang, Feng, et al.
Publicado: (2025)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
por: Aravindan, Ashwath Vaithinathan, et al.
Publicado: (2026)
por: Aravindan, Ashwath Vaithinathan, et al.
Publicado: (2026)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
por: Shang, Yu, et al.
Publicado: (2024)
por: Shang, Yu, et al.
Publicado: (2024)
Chain-of-Defensive-Thought: Structured Reasoning Elicits Robustness in Large Language Models against Reference Corruption
por: Wang, Wenxiao, et al.
Publicado: (2025)
por: Wang, Wenxiao, et al.
Publicado: (2025)
Improving Reasoning Performance in Large Language Models via Representation Engineering
por: Højer, Bertram, et al.
Publicado: (2025)
por: Højer, Bertram, et al.
Publicado: (2025)
All Code, No Thought: Current Language Models Struggle to Reason in Ciphered Language
por: Guo, Shiyuan, et al.
Publicado: (2025)
por: Guo, Shiyuan, et al.
Publicado: (2025)
The Price of Thought: A Multilingual Analysis of Reasoning, Performance, and Cost of Negotiation in Large Language Models
por: Hakimov, Sherzod, et al.
Publicado: (2025)
por: Hakimov, Sherzod, et al.
Publicado: (2025)
Can Large Language Models Understand Intermediate Representations in Compilers?
por: Jiang, Hailong, et al.
Publicado: (2025)
por: Jiang, Hailong, et al.
Publicado: (2025)
Iteration of Thought: Leveraging Inner Dialogue for Autonomous Large Language Model Reasoning
por: Radha, Santosh Kumar, et al.
Publicado: (2024)
por: Radha, Santosh Kumar, et al.
Publicado: (2024)
Long Chain-of-Thought Reasoning Across Languages
por: Barua, Josh, et al.
Publicado: (2025)
por: Barua, Josh, et al.
Publicado: (2025)
When More is Less: Understanding Chain-of-Thought Length in LLMs
por: Wu, Yuyang, et al.
Publicado: (2025)
por: Wu, Yuyang, et al.
Publicado: (2025)
Upcycling Large Language Models into Mixture of Experts
por: He, Ethan, et al.
Publicado: (2024)
por: He, Ethan, et al.
Publicado: (2024)
Optimal Sparsity of Mixture-of-Experts Language Models for Reasoning Tasks
por: Nakamura, Taishi, et al.
Publicado: (2025)
por: Nakamura, Taishi, et al.
Publicado: (2025)
Mini-batch Coresets for Memory-efficient Language Model Training on Data Mixtures
por: Nguyen, Dang, et al.
Publicado: (2024)
por: Nguyen, Dang, et al.
Publicado: (2024)
Reversal of Thought: Enhancing Large Language Models with Preference-Guided Reverse Reasoning Warm-up
por: Yuan, Jiahao, et al.
Publicado: (2024)
por: Yuan, Jiahao, et al.
Publicado: (2024)
Offline Learning and Forgetting for Reasoning with Large Language Models
por: Ni, Tianwei, et al.
Publicado: (2025)
por: Ni, Tianwei, et al.
Publicado: (2025)
TrajAgent: An LLM-Agent Framework for Trajectory Modeling via Large-and-Small Model Collaboration
por: Du, Yuwei, et al.
Publicado: (2024)
por: Du, Yuwei, et al.
Publicado: (2024)
Graph of Thoughts: Solving Elaborate Problems with Large Language Models
por: Besta, Maciej, et al.
Publicado: (2023)
por: Besta, Maciej, et al.
Publicado: (2023)
The Role of Deductive and Inductive Reasoning in Large Language Models
por: Cai, Chengkun, et al.
Publicado: (2024)
por: Cai, Chengkun, et al.
Publicado: (2024)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
por: Xiong, Tao, et al.
Publicado: (2025)
por: Xiong, Tao, et al.
Publicado: (2025)
Nemotron-Cascade: Scaling Cascaded Reinforcement Learning for General-Purpose Reasoning Models
por: Wang, Boxin, et al.
Publicado: (2025)
por: Wang, Boxin, et al.
Publicado: (2025)
Ejemplares similares
-
DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search
por: Yue, Murong, et al.
Publicado: (2024) -
A Survey of Large Language Model Agents for Question Answering
por: Yue, Murong
Publicado: (2025) -
Efficient but Vulnerable: Benchmarking and Defending LLM Batch Prompting Attack
por: Yue, Murong, et al.
Publicado: (2025) -
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
por: Cai, Chengkun, et al.
Publicado: (2024) -
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
por: Tanmay, Kumar, et al.
Publicado: (2025)