Do explanations generalize across large reasoning models?
Fuente:
arXiv
Guardado en:
| Autores principales: | Pal, Koyena, Bau, David, Singh, Chandan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Internal states before wait modulate reasoning patterns
por: Troitskii, Dmitrii, et al.
Publicado: (2025)
por: Troitskii, Dmitrii, et al.
Publicado: (2025)
Model Lakes
por: Pal, Koyena, et al.
Publicado: (2024)
por: Pal, Koyena, et al.
Publicado: (2024)
Response: Emergent analogical reasoning in large language models
por: Hodel, Damian, et al.
Publicado: (2023)
por: Hodel, Damian, et al.
Publicado: (2023)
MathDivide: Improved mathematical reasoning by large language models
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024)
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024)
Enhancing reasoning accuracy in large language models during inference time
por: Sharma, Vinay, et al.
Publicado: (2026)
por: Sharma, Vinay, et al.
Publicado: (2026)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
por: Syromiatnikov, Mykyta, et al.
Publicado: (2025)
ThoughtSource: A central hub for large language model reasoning data
por: Ott, Simon, et al.
Publicado: (2023)
por: Ott, Simon, et al.
Publicado: (2023)
Superhuman performance of a large language model on the reasoning tasks of a physician
por: Brodeur, Peter G., et al.
Publicado: (2024)
por: Brodeur, Peter G., et al.
Publicado: (2024)
Evidence from counterfactual tasks supports emergent analogical reasoning in large language models
por: Webb, Taylor, et al.
Publicado: (2024)
por: Webb, Taylor, et al.
Publicado: (2024)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
por: Lan, Wuyang, et al.
Publicado: (2025)
por: Lan, Wuyang, et al.
Publicado: (2025)
Transfer Learning from Foundational Optimization Embeddings to Unsupervised SAT Representations
por: Pal, Koyena, et al.
Publicado: (2026)
por: Pal, Koyena, et al.
Publicado: (2026)
Multi-step retrieval and reasoning improves radiology question answering with large language models
por: Wind, Sebastian, et al.
Publicado: (2025)
por: Wind, Sebastian, et al.
Publicado: (2025)
Evidence of interrelated cognitive-like capabilities in large language models: Indications of artificial general intelligence or achievement?
por: Ilić, David, et al.
Publicado: (2023)
por: Ilić, David, et al.
Publicado: (2023)
Disentangling generalization and memorization in large language models using chess
por: Pleiss, Leonard S., et al.
Publicado: (2026)
por: Pleiss, Leonard S., et al.
Publicado: (2026)
Slm-mux: Orchestrating small language models for reasoning
por: Wang, Chenyu, et al.
Publicado: (2025)
por: Wang, Chenyu, et al.
Publicado: (2025)
Automated stereotactic radiosurgery planning using a human-in-the-loop reasoning large language model agent
por: Nusrat, Humza, et al.
Publicado: (2025)
por: Nusrat, Humza, et al.
Publicado: (2025)
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
por: Bhattacharya, Antara Raaghavi, et al.
Publicado: (2025)
por: Bhattacharya, Antara Raaghavi, et al.
Publicado: (2025)
Integration of cognitive tasks into artificial general intelligence test for large models
por: Qu, Youzhi, et al.
Publicado: (2024)
por: Qu, Youzhi, et al.
Publicado: (2024)
Retrieval-augmented reasoning with lean language models
por: Chan, Ryan Sze-Yin, et al.
Publicado: (2025)
por: Chan, Ryan Sze-Yin, et al.
Publicado: (2025)
Code-enabled language models can outperform reasoning models on diverse tasks
por: Zhang, Cedegao E., et al.
Publicado: (2025)
por: Zhang, Cedegao E., et al.
Publicado: (2025)
Neural networks for abstraction and reasoning: Towards broad generalization in machines
por: Bober-Irizar, Mikel, et al.
Publicado: (2024)
por: Bober-Irizar, Mikel, et al.
Publicado: (2024)
Uncovering inequalities in new knowledge learning by large language models across different languages
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
por: Han, Yifu, et al.
Publicado: (2025)
por: Han, Yifu, et al.
Publicado: (2025)
Large language models show fragile cognitive reasoning about human emotions
por: Bhattacharyya, Sree, et al.
Publicado: (2025)
por: Bhattacharyya, Sree, et al.
Publicado: (2025)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
por: Yu, Ping, et al.
Publicado: (2025)
por: Yu, Ping, et al.
Publicado: (2025)
Future Lens: Anticipating Subsequent Tokens from a Single Hidden State
por: Pal, Koyena, et al.
Publicado: (2023)
por: Pal, Koyena, et al.
Publicado: (2023)
Social preferences with unstable interactive reasoning: Large language models in economic trust games
por: Jiamin, Ou, et al.
Publicado: (2025)
por: Jiamin, Ou, et al.
Publicado: (2025)
Phi-4-reasoning Technical Report
por: Abdin, Marah, et al.
Publicado: (2025)
por: Abdin, Marah, et al.
Publicado: (2025)
Generics in science communication: Misaligned interpretations across laypeople, scientists, and large language models
por: Peters, Uwe, et al.
Publicado: (2026)
por: Peters, Uwe, et al.
Publicado: (2026)
Vector-ICL: In-context Learning with Continuous Vector Representations
por: Zhuang, Yufan, et al.
Publicado: (2024)
por: Zhuang, Yufan, et al.
Publicado: (2024)
Text Generation Beyond Discrete Token Sampling
por: Zhuang, Yufan, et al.
Publicado: (2025)
por: Zhuang, Yufan, et al.
Publicado: (2025)
Can LLMs perform structured graph reasoning?
por: Agrawal, Palaash, et al.
Publicado: (2024)
por: Agrawal, Palaash, et al.
Publicado: (2024)
Temporal reasoning for timeline summarisation in social media
por: Song, Jiayu, et al.
Publicado: (2024)
por: Song, Jiayu, et al.
Publicado: (2024)
Discovering Forbidden Topics in Language Models
por: Rager, Can, et al.
Publicado: (2025)
por: Rager, Can, et al.
Publicado: (2025)
Enhancing multimodal analogical reasoning with Logic Augmented Generation
por: Lippolis, Anna Sofia, et al.
Publicado: (2025)
por: Lippolis, Anna Sofia, et al.
Publicado: (2025)
Are LLMs classical or nonmonotonic reasoners? Lessons from generics
por: Leidinger, Alina, et al.
Publicado: (2024)
por: Leidinger, Alina, et al.
Publicado: (2024)
Can formal argumentative reasoning enhance LLMs performances?
por: Castagna, Federico, et al.
Publicado: (2024)
por: Castagna, Federico, et al.
Publicado: (2024)
Do Chinese models speak Chinese languages?
por: Wen-Yi, Andrea W, et al.
Publicado: (2025)
por: Wen-Yi, Andrea W, et al.
Publicado: (2025)
Language models show human-like content effects on reasoning tasks
por: Dasgupta, Ishita, et al.
Publicado: (2022)
por: Dasgupta, Ishita, et al.
Publicado: (2022)
HITgram: A Platform for Experimenting with n-gram Language Models
por: Dasgupta, Shibaranjani, et al.
Publicado: (2024)
por: Dasgupta, Shibaranjani, et al.
Publicado: (2024)
Ejemplares similares
-
Internal states before wait modulate reasoning patterns
por: Troitskii, Dmitrii, et al.
Publicado: (2025) -
Model Lakes
por: Pal, Koyena, et al.
Publicado: (2024) -
Response: Emergent analogical reasoning in large language models
por: Hodel, Damian, et al.
Publicado: (2023) -
MathDivide: Improved mathematical reasoning by large language models
por: Srivastava, Saksham Sahai, et al.
Publicado: (2024) -
Enhancing reasoning accuracy in large language models during inference time
por: Sharma, Vinay, et al.
Publicado: (2026)