Enhancing reasoning accuracy in large language models during inference time
Fuente:
arXiv
Guardado en:
| Autores principales: | Sharma, Vinay, Jain, Manish |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Response: Emergent analogical reasoning in large language models
por: Hodel, Damian, et al.
Publicado: (2023)
por: Hodel, Damian, et al.
Publicado: (2023)
MathDivide: Improved mathematical reasoning by large language models
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024)
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024)
Superhuman performance of a large language model on the reasoning tasks of a physician
por: Brodeur, Peter G., et al.
Publicado: (2024)
por: Brodeur, Peter G., et al.
Publicado: (2024)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
ThoughtSource: A central hub for large language model reasoning data
por: Ott, Simon, et al.
Publicado: (2023)
por: Ott, Simon, et al.
Publicado: (2023)
Evidence from counterfactual tasks supports emergent analogical reasoning in large language models
por: Webb, Taylor, et al.
Publicado: (2024)
por: Webb, Taylor, et al.
Publicado: (2024)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
por: Lan, Wuyang, et al.
Publicado: (2025)
por: Lan, Wuyang, et al.
Publicado: (2025)
Slm-mux: Orchestrating small language models for reasoning
por: Wang, Chenyu, et al.
Publicado: (2025)
por: Wang, Chenyu, et al.
Publicado: (2025)
Retrieval-augmented reasoning with lean language models
por: Chan, Ryan Sze-Yin, et al.
Publicado: (2025)
por: Chan, Ryan Sze-Yin, et al.
Publicado: (2025)
Multi-step retrieval and reasoning improves radiology question answering with large language models
por: Wind, Sebastian, et al.
Publicado: (2025)
por: Wind, Sebastian, et al.
Publicado: (2025)
Safety and accuracy follow different scaling laws in clinical large language models
por: Wind, Sebastian, et al.
Publicado: (2026)
por: Wind, Sebastian, et al.
Publicado: (2026)
Correcting misinformation on social media with a large language model
por: Zhou, Xinyi, et al.
Publicado: (2024)
por: Zhou, Xinyi, et al.
Publicado: (2024)
Do explanations generalize across large reasoning models?
por: Pal, Koyena, et al.
Publicado: (2026)
por: Pal, Koyena, et al.
Publicado: (2026)
Code-enabled language models can outperform reasoning models on diverse tasks
por: Zhang, Cedegao E., et al.
Publicado: (2025)
por: Zhang, Cedegao E., et al.
Publicado: (2025)
Automated stereotactic radiosurgery planning using a human-in-the-loop reasoning large language model agent
por: Nusrat, Humza, et al.
Publicado: (2025)
por: Nusrat, Humza, et al.
Publicado: (2025)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
por: Han, Yifu, et al.
Publicado: (2025)
por: Han, Yifu, et al.
Publicado: (2025)
Large language models show fragile cognitive reasoning about human emotions
por: Bhattacharyya, Sree, et al.
Publicado: (2025)
por: Bhattacharyya, Sree, et al.
Publicado: (2025)
Prompting language influences diagnostic reasoning and accuracy of large language models
por: Bazoge, Adrien, et al.
Publicado: (2026)
por: Bazoge, Adrien, et al.
Publicado: (2026)
On the attribution of confidence to large language models
por: Keeling, Geoff, et al.
Publicado: (2024)
por: Keeling, Geoff, et al.
Publicado: (2024)
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
por: Bhattacharya, Antara Raaghavi, et al.
Publicado: (2025)
por: Bhattacharya, Antara Raaghavi, et al.
Publicado: (2025)
Social preferences with unstable interactive reasoning: Large language models in economic trust games
por: Jiamin, Ou, et al.
Publicado: (2025)
por: Jiamin, Ou, et al.
Publicado: (2025)
Enhancing textual textbook question answering with large language models and retrieval augmented generation
por: Alawwad, Hessa Abdulrahman, et al.
Publicado: (2024)
por: Alawwad, Hessa Abdulrahman, et al.
Publicado: (2024)
AugSumm: towards generalizable speech summarization using synthetic labels from large language model
por: Jung, Jee-weon, et al.
Publicado: (2024)
por: Jung, Jee-weon, et al.
Publicado: (2024)
Quantifying non deterministic drift in large language models
por: Nicholson, Claire
Publicado: (2026)
por: Nicholson, Claire
Publicado: (2026)
Can large language models build causal graphs?
por: Long, Stephanie, et al.
Publicado: (2023)
por: Long, Stephanie, et al.
Publicado: (2023)
Multi-round jailbreak attack on large language models
por: Zhou, Yihua, et al.
Publicado: (2024)
por: Zhou, Yihua, et al.
Publicado: (2024)
The 20 questions game to distinguish large language models
por: Richardeau, Gurvan, et al.
Publicado: (2024)
por: Richardeau, Gurvan, et al.
Publicado: (2024)
Representation in large language models
por: Yetman, Cameron
Publicado: (2025)
por: Yetman, Cameron
Publicado: (2025)
Failure of contextual invariance in large language models
por: Kumar, Sagar, et al.
Publicado: (2026)
por: Kumar, Sagar, et al.
Publicado: (2026)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025)
por: Diaz-Garcia, Jose A., et al.
Publicado: (2025)
How effective are VLMs in assisting humans in inferring the quality of mental models from Multimodal short answers?
por: Sil, Pritam, et al.
Publicado: (2026)
por: Sil, Pritam, et al.
Publicado: (2026)
Disentangling generalization and memorization in large language models using chess
por: Pleiss, Leonard S., et al.
Publicado: (2026)
por: Pleiss, Leonard S., et al.
Publicado: (2026)
Strong and weak alignment of large language models with human values
por: Khamassi, Mehdi, et al.
Publicado: (2024)
por: Khamassi, Mehdi, et al.
Publicado: (2024)
Streamlining evidence based clinical recommendations with large language models
por: Li, Dubai, et al.
Publicado: (2025)
por: Li, Dubai, et al.
Publicado: (2025)
Re-evaluating Theory of Mind evaluation in large language models
por: Hu, Jennifer, et al.
Publicado: (2025)
por: Hu, Jennifer, et al.
Publicado: (2025)
A review on the use of large language models as virtual tutors
por: García-Méndez, Silvia, et al.
Publicado: (2024)
por: García-Méndez, Silvia, et al.
Publicado: (2024)
Evaluating large language models in medical applications: a survey
por: Chen, Xiaolan, et al.
Publicado: (2024)
por: Chen, Xiaolan, et al.
Publicado: (2024)
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024)
por: Laurito, Walter, et al.
Publicado: (2024)
A longitudinal sentiment analysis of Sinophobia during COVID-19 using large language models
por: Wang, Chen, et al.
Publicado: (2024)
por: Wang, Chen, et al.
Publicado: (2024)
Ejemplares similares
-
Response: Emergent analogical reasoning in large language models
por: Hodel, Damian, et al.
Publicado: (2023) -
MathDivide: Improved mathematical reasoning by large language models
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024) -
Superhuman performance of a large language model on the reasoning tasks of a physician
por: Brodeur, Peter G., et al.
Publicado: (2024) -
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025) -
ThoughtSource: A central hub for large language model reasoning data
por: Ott, Simon, et al.
Publicado: (2023)