Learning Adaptive Parallel Reasoning with Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Pan, Jiayi, Li, Xiuyu, Lian, Long, Snell, Charlie, Zhou, Yifei, Yala, Adam, Darrell, Trevor, Keutzer, Kurt, Suhr, Alane |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models
por: Lian, Long, et al.
Publicado: (2025)
por: Lian, Long, et al.
Publicado: (2025)
TULIP: Towards Unified Language-Image Pretraining
por: Tang, Zineng, et al.
Publicado: (2025)
por: Tang, Zineng, et al.
Publicado: (2025)
LLM-grounded Video Diffusion Models
por: Lian, Long, et al.
Publicado: (2023)
por: Lian, Long, et al.
Publicado: (2023)
Long Chain-of-Thought Reasoning Across Languages
por: Barua, Josh, et al.
Publicado: (2025)
por: Barua, Josh, et al.
Publicado: (2025)
Using Language Models to Disambiguate Lexical Choices in Translation
por: Barua, Josh, et al.
Publicado: (2024)
por: Barua, Josh, et al.
Publicado: (2024)
$V_1$: Unifying Generation and Self-Verification for Parallel Reasoners
por: Singh, Harman, et al.
Publicado: (2026)
por: Singh, Harman, et al.
Publicado: (2026)
LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models
por: Lian, Long, et al.
Publicado: (2023)
por: Lian, Long, et al.
Publicado: (2023)
Grounding Language in Multi-Perspective Referential Communication
por: Tang, Zineng, et al.
Publicado: (2024)
por: Tang, Zineng, et al.
Publicado: (2024)
Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting
por: Sclar, Melanie, et al.
Publicado: (2023)
por: Sclar, Melanie, et al.
Publicado: (2023)
Fine-Tuning Large Vision-Language Models as Decision-Making Agents via Reinforcement Learning
por: Zhai, Yuexiang, et al.
Publicado: (2024)
por: Zhai, Yuexiang, et al.
Publicado: (2024)
Autonomous Evaluation and Refinement of Digital Agents
por: Pan, Jiayi, et al.
Publicado: (2024)
por: Pan, Jiayi, et al.
Publicado: (2024)
ABBEL: LLM Agents Acting through Belief Bottlenecks Expressed in Language
por: Lidayan, Aly, et al.
Publicado: (2025)
por: Lidayan, Aly, et al.
Publicado: (2025)
Reasoning Models Can Be Effective Without Thinking
por: Ma, Wenjie, et al.
Publicado: (2025)
por: Ma, Wenjie, et al.
Publicado: (2025)
MITRA: A Large-Scale Parallel Corpus and Multilingual Pretrained Language Model for Machine Translation and Semantic Retrieval for Pāli, Sanskrit, Buddhist Chinese, and Tibetan
por: Nehrdich, Sebastian, et al.
Publicado: (2026)
por: Nehrdich, Sebastian, et al.
Publicado: (2026)
LLoCO: Learning Long Contexts Offline
por: Tan, Sijun, et al.
Publicado: (2024)
por: Tan, Sijun, et al.
Publicado: (2024)
ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
por: Zhou, Yifei, et al.
Publicado: (2024)
por: Zhou, Yifei, et al.
Publicado: (2024)
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models
por: Dunlap, Lisa, et al.
Publicado: (2024)
por: Dunlap, Lisa, et al.
Publicado: (2024)
SynAdapt: Learning Adaptive Reasoning in Large Language Models via Synthetic Continuous Chain-of-Thought
por: Wang, Jianwei, et al.
Publicado: (2025)
por: Wang, Jianwei, et al.
Publicado: (2025)
Training Software Engineering Agents and Verifiers with SWE-Gym
por: Pan, Jiayi, et al.
Publicado: (2024)
por: Pan, Jiayi, et al.
Publicado: (2024)
Learning a Generative Meta-Model of LLM Activations
por: Luo, Grace, et al.
Publicado: (2026)
por: Luo, Grace, et al.
Publicado: (2026)
Stuck in the Matrix: Probing Spatial Reasoning in Large Language Models
por: Bai, Maggie, et al.
Publicado: (2025)
por: Bai, Maggie, et al.
Publicado: (2025)
ReasoningShield: Safety Detection over Reasoning Traces of Large Reasoning Models
por: Li, Changyi, et al.
Publicado: (2025)
por: Li, Changyi, et al.
Publicado: (2025)
Learned Best-Effort LLM Serving
por: Jha, Siddharth, et al.
Publicado: (2024)
por: Jha, Siddharth, et al.
Publicado: (2024)
DigiRL: Training In-The-Wild Device-Control Agents with Autonomous Reinforcement Learning
por: Bai, Hao, et al.
Publicado: (2024)
por: Bai, Hao, et al.
Publicado: (2024)
Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought
por: Xiang, Violet, et al.
Publicado: (2025)
por: Xiang, Violet, et al.
Publicado: (2025)
Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models
por: Kim, Minseo, et al.
Publicado: (2025)
por: Kim, Minseo, et al.
Publicado: (2025)
Chain-of-Knowledge: Integrating Knowledge Reasoning into Large Language Models by Learning from Knowledge Graphs
por: Zhang, Yifei, et al.
Publicado: (2024)
por: Zhang, Yifei, et al.
Publicado: (2024)
Adaptive-Solver Framework for Dynamic Strategy Selection in Large Language Model Reasoning
por: Zhou, Jianpeng, et al.
Publicado: (2023)
por: Zhou, Jianpeng, et al.
Publicado: (2023)
FactorLLM: Factorizing Knowledge via Mixture of Experts for Large Language Models
por: Zhao, Zhongyu, et al.
Publicado: (2024)
por: Zhao, Zhongyu, et al.
Publicado: (2024)
The Impact of Language Mixing on Bilingual LLM Reasoning
por: Li, Yihao, et al.
Publicado: (2025)
por: Li, Yihao, et al.
Publicado: (2025)
MotiveBench: How Far Are We From Human-Like Motivational Reasoning in Large Language Models?
por: Yong, Xixian, et al.
Publicado: (2025)
por: Yong, Xixian, et al.
Publicado: (2025)
OpenWHO: A Document-Level Parallel Corpus for Health Translation in Low-Resource Languages
por: Merx, Raphaël, et al.
Publicado: (2025)
por: Merx, Raphaël, et al.
Publicado: (2025)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
por: Xiong, Tao, et al.
Publicado: (2025)
por: Xiong, Tao, et al.
Publicado: (2025)
ARS: Adaptive Reasoning Suppression for Efficient Large Reasoning Language Models
por: Zheng, Dongqi
Publicado: (2025)
por: Zheng, Dongqi
Publicado: (2025)
Refine Knowledge of Large Language Models via Adaptive Contrastive Learning
por: Li, Yinghui, et al.
Publicado: (2025)
por: Li, Yinghui, et al.
Publicado: (2025)
Residual Context Diffusion Language Models
por: Hu, Yuezhou, et al.
Publicado: (2026)
por: Hu, Yuezhou, et al.
Publicado: (2026)
Instruct Large Language Models to Drive like Humans
por: Zhang, Ruijun, et al.
Publicado: (2024)
por: Zhang, Ruijun, et al.
Publicado: (2024)
Compositional Chain-of-Thought Prompting for Large Multimodal Models
por: Mitra, Chancharik, et al.
Publicado: (2023)
por: Mitra, Chancharik, et al.
Publicado: (2023)
EmoLLM: Appraisal-Grounded Cognitive-Emotional Co-Reasoning in Large Language Models
por: Zhang, Yifei, et al.
Publicado: (2026)
por: Zhang, Yifei, et al.
Publicado: (2026)
Sleep-time Compute: Beyond Inference Scaling at Test-time
por: Lin, Kevin, et al.
Publicado: (2025)
por: Lin, Kevin, et al.
Publicado: (2025)
Ejemplares similares
-
ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models
por: Lian, Long, et al.
Publicado: (2025) -
TULIP: Towards Unified Language-Image Pretraining
por: Tang, Zineng, et al.
Publicado: (2025) -
LLM-grounded Video Diffusion Models
por: Lian, Long, et al.
Publicado: (2023) -
Long Chain-of-Thought Reasoning Across Languages
por: Barua, Josh, et al.
Publicado: (2025) -
Using Language Models to Disambiguate Lexical Choices in Translation
por: Barua, Josh, et al.
Publicado: (2024)