Evidence from counterfactual tasks supports emergent analogical reasoning in large language models
Fuente:
arXiv
Salvato in:
| Autori principali: | Webb, Taylor, Holyoak, Keith J., Lu, Hongjing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Response: Emergent analogical reasoning in large language models
di: Hodel, Damian, et al.
Pubblicazione: (2023)
di: Hodel, Damian, et al.
Pubblicazione: (2023)
Superhuman performance of a large language model on the reasoning tasks of a physician
di: Brodeur, Peter G., et al.
Pubblicazione: (2024)
di: Brodeur, Peter G., et al.
Pubblicazione: (2024)
Code-enabled language models can outperform reasoning models on diverse tasks
di: Zhang, Cedegao E., et al.
Pubblicazione: (2025)
di: Zhang, Cedegao E., et al.
Pubblicazione: (2025)
MathDivide: Improved mathematical reasoning by large language models
di: Srivastava, Saksham Sahai, et al.
Pubblicazione: (2024)
di: Srivastava, Saksham Sahai, et al.
Pubblicazione: (2024)
Enhancing reasoning accuracy in large language models during inference time
di: Sharma, Vinay, et al.
Pubblicazione: (2026)
di: Sharma, Vinay, et al.
Pubblicazione: (2026)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
di: Syromiatnikov, Mykyta, et al.
Pubblicazione: (2025)
ThoughtSource: A central hub for large language model reasoning data
di: Ott, Simon, et al.
Pubblicazione: (2023)
di: Ott, Simon, et al.
Pubblicazione: (2023)
Enhancing multimodal analogical reasoning with Logic Augmented Generation
di: Lippolis, Anna Sofia, et al.
Pubblicazione: (2025)
di: Lippolis, Anna Sofia, et al.
Pubblicazione: (2025)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
di: Lan, Wuyang, et al.
Pubblicazione: (2025)
di: Lan, Wuyang, et al.
Pubblicazione: (2025)
TechGPT-2.0: A large language model project to solve the task of knowledge graph construction
di: Wang, Jiaqi, et al.
Pubblicazione: (2024)
di: Wang, Jiaqi, et al.
Pubblicazione: (2024)
Slm-mux: Orchestrating small language models for reasoning
di: Wang, Chenyu, et al.
Pubblicazione: (2025)
di: Wang, Chenyu, et al.
Pubblicazione: (2025)
Retrieval-augmented reasoning with lean language models
di: Chan, Ryan Sze-Yin, et al.
Pubblicazione: (2025)
di: Chan, Ryan Sze-Yin, et al.
Pubblicazione: (2025)
HIVMedQA: Benchmarking large language models for HIV medical decision support
di: Cardenal-Antolin, Gonzalo, et al.
Pubblicazione: (2025)
di: Cardenal-Antolin, Gonzalo, et al.
Pubblicazione: (2025)
Multi-step retrieval and reasoning improves radiology question answering with large language models
di: Wind, Sebastian, et al.
Pubblicazione: (2025)
di: Wind, Sebastian, et al.
Pubblicazione: (2025)
Do explanations generalize across large reasoning models?
di: Pal, Koyena, et al.
Pubblicazione: (2026)
di: Pal, Koyena, et al.
Pubblicazione: (2026)
Automated stereotactic radiosurgery planning using a human-in-the-loop reasoning large language model agent
di: Nusrat, Humza, et al.
Pubblicazione: (2025)
di: Nusrat, Humza, et al.
Pubblicazione: (2025)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
di: Yu, Ping, et al.
Pubblicazione: (2025)
di: Yu, Ping, et al.
Pubblicazione: (2025)
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
Just-in-time and distributed task representations in language models
di: Li, Yuxuan, et al.
Pubblicazione: (2025)
di: Li, Yuxuan, et al.
Pubblicazione: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
di: Han, Yifu, et al.
Pubblicazione: (2025)
di: Han, Yifu, et al.
Pubblicazione: (2025)
Large language models show fragile cognitive reasoning about human emotions
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
Language models show human-like content effects on reasoning tasks
di: Dasgupta, Ishita, et al.
Pubblicazione: (2022)
di: Dasgupta, Ishita, et al.
Pubblicazione: (2022)
Auxiliary task demands mask the capabilities of smaller language models
di: Hu, Jennifer, et al.
Pubblicazione: (2024)
di: Hu, Jennifer, et al.
Pubblicazione: (2024)
Evaluating large language models in medical applications: a survey
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
On the attribution of confidence to large language models
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
di: Bhattacharya, Antara Raaghavi, et al.
Pubblicazione: (2025)
di: Bhattacharya, Antara Raaghavi, et al.
Pubblicazione: (2025)
Social preferences with unstable interactive reasoning: Large language models in economic trust games
di: Jiamin, Ou, et al.
Pubblicazione: (2025)
di: Jiamin, Ou, et al.
Pubblicazione: (2025)
Predict the Next Word: Humans exhibit uncertainty in this task and language models _____
di: Ilia, Evgenia, et al.
Pubblicazione: (2024)
di: Ilia, Evgenia, et al.
Pubblicazione: (2024)
Evidence of interrelated cognitive-like capabilities in large language models: Indications of artificial general intelligence or achievement?
di: Ilić, David, et al.
Pubblicazione: (2023)
di: Ilić, David, et al.
Pubblicazione: (2023)
Integration of cognitive tasks into artificial general intelligence test for large models
di: Qu, Youzhi, et al.
Pubblicazione: (2024)
di: Qu, Youzhi, et al.
Pubblicazione: (2024)
Tracing the ongoing emergence of human-like reasoning in Large Language Models
di: Morosi, Paolo, et al.
Pubblicazione: (2026)
di: Morosi, Paolo, et al.
Pubblicazione: (2026)
Multi-round jailbreak attack on large language models
di: Zhou, Yihua, et al.
Pubblicazione: (2024)
di: Zhou, Yihua, et al.
Pubblicazione: (2024)
The 20 questions game to distinguish large language models
di: Richardeau, Gurvan, et al.
Pubblicazione: (2024)
di: Richardeau, Gurvan, et al.
Pubblicazione: (2024)
Quantifying non deterministic drift in large language models
di: Nicholson, Claire
Pubblicazione: (2026)
di: Nicholson, Claire
Pubblicazione: (2026)
Can large language models build causal graphs?
di: Long, Stephanie, et al.
Pubblicazione: (2023)
di: Long, Stephanie, et al.
Pubblicazione: (2023)
Representation in large language models
di: Yetman, Cameron
Pubblicazione: (2025)
di: Yetman, Cameron
Pubblicazione: (2025)
Long-form factuality in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2024)
di: Wei, Jerry, et al.
Pubblicazione: (2024)
Failure of contextual invariance in large language models
di: Kumar, Sagar, et al.
Pubblicazione: (2026)
di: Kumar, Sagar, et al.
Pubblicazione: (2026)
Entry-level guide to the use of large language models for medical research
di: Jin, Qiao, et al.
Pubblicazione: (2024)
di: Jin, Qiao, et al.
Pubblicazione: (2024)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
Documenti analoghi
-
Response: Emergent analogical reasoning in large language models
di: Hodel, Damian, et al.
Pubblicazione: (2023) -
Superhuman performance of a large language model on the reasoning tasks of a physician
di: Brodeur, Peter G., et al.
Pubblicazione: (2024) -
Code-enabled language models can outperform reasoning models on diverse tasks
di: Zhang, Cedegao E., et al.
Pubblicazione: (2025) -
MathDivide: Improved mathematical reasoning by large language models
di: Srivastava, Saksham Sahai, et al.
Pubblicazione: (2024) -
Enhancing reasoning accuracy in large language models during inference time
di: Sharma, Vinay, et al.
Pubblicazione: (2026)