Bigger But Not Better: Small Neural Language Models Outperform Large Language Models in Detection of Thought Disorder
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Changye, Xu, Weizhe, Pakhomov, Serguei, Bradley, Ellen, Ben-Zeev, Dror, Cohen, Trevor |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Useful Blunders: Can Automated Speech Recognition Errors Improve Downstream Dementia Classification?
di: Li, Changye, et al.
Pubblicazione: (2024)
di: Li, Changye, et al.
Pubblicazione: (2024)
Too Big to Fail: Larger Language Models are Disproportionately Resilient to Induction of Dementia-Related Linguistic Anomalies
di: Li, Changye, et al.
Pubblicazione: (2024)
di: Li, Changye, et al.
Pubblicazione: (2024)
Reading Between the Lines: Combining Pause Dynamics and Semantic Coherence for Automated Assessment of Thought Disorder
di: Chen, Feng, et al.
Pubblicazione: (2025)
di: Chen, Feng, et al.
Pubblicazione: (2025)
Reexamining Racial Disparities in Automatic Speech Recognition Performance: The Role of Confounding by Provenance
di: Li, Changye, et al.
Pubblicazione: (2024)
di: Li, Changye, et al.
Pubblicazione: (2024)
"Is There Anything Else?'': Examining Administrator Influence on Linguistic Features from the Cookie Theft Picture Description Cognitive Test
di: Li, Changye, et al.
Pubblicazione: (2025)
di: Li, Changye, et al.
Pubblicazione: (2025)
Detecting PTSD in Clinical Interviews: A Comparative Analysis of NLP Methods and Large Language Models
di: Chen, Feng, et al.
Pubblicazione: (2025)
di: Chen, Feng, et al.
Pubblicazione: (2025)
Mitigating Confounding in Speech-Based Dementia Detection through Weight Masking
di: Sheng, Zhecheng, et al.
Pubblicazione: (2025)
di: Sheng, Zhecheng, et al.
Pubblicazione: (2025)
Are Bigger Encoders Always Better in Vision Large Models?
di: Li, Bozhou, et al.
Pubblicazione: (2024)
di: Li, Bozhou, et al.
Pubblicazione: (2024)
When Prompts Interact: Assessing Prompt Arithmetic for Deconfounding under Distribution Shift
di: Sheng, Zhecheng, et al.
Pubblicazione: (2026)
di: Sheng, Zhecheng, et al.
Pubblicazione: (2026)
Task-Specific Efficiency Analysis: When Small Language Models Outperform Large Language Models
di: Cao, Jinghan, et al.
Pubblicazione: (2026)
di: Cao, Jinghan, et al.
Pubblicazione: (2026)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
Logic-of-Thought: Injecting Logic into Contexts for Full Reasoning in Large Language Models
di: Liu, Tongxuan, et al.
Pubblicazione: (2024)
di: Liu, Tongxuan, et al.
Pubblicazione: (2024)
Do We Need Bigger Models for Science? Task-Aware Retrieval with Small Language Models
di: Kelber, Florian, et al.
Pubblicazione: (2026)
di: Kelber, Florian, et al.
Pubblicazione: (2026)
Abstraction-of-Thought Makes Language Models Better Reasoners
di: Hong, Ruixin, et al.
Pubblicazione: (2024)
di: Hong, Ruixin, et al.
Pubblicazione: (2024)
ToW: Thoughts of Words Improve Reasoning in Large Language Models
di: Xu, Zhikun, et al.
Pubblicazione: (2024)
di: Xu, Zhikun, et al.
Pubblicazione: (2024)
LLMCRIT: Teaching Large Language Models to Use Criteria
di: Yuan, Weizhe, et al.
Pubblicazione: (2024)
di: Yuan, Weizhe, et al.
Pubblicazione: (2024)
Enhancing Reasoning Skills in Small Persian Medical Language Models Can Outperform Large-Scale Data Training
di: Ghassabi, Mehrdad, et al.
Pubblicazione: (2025)
di: Ghassabi, Mehrdad, et al.
Pubblicazione: (2025)
Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
Language of Thought Shapes Output Diversity in Large Language Models
di: Xu, Shaoyang, et al.
Pubblicazione: (2026)
di: Xu, Shaoyang, et al.
Pubblicazione: (2026)
Generalist Large Language Models Outperform Clinical Tools on Medical Benchmarks
di: Vishwanath, Krithik, et al.
Pubblicazione: (2025)
di: Vishwanath, Krithik, et al.
Pubblicazione: (2025)
Inverse Scaling: When Bigger Isn't Better
di: McKenzie, Ian R., et al.
Pubblicazione: (2023)
di: McKenzie, Ian R., et al.
Pubblicazione: (2023)
Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning?
di: He, Yancheng, et al.
Pubblicazione: (2025)
di: He, Yancheng, et al.
Pubblicazione: (2025)
Aligning Large Language Models with Counterfactual DPO
di: Butcher, Bradley
Pubblicazione: (2024)
di: Butcher, Bradley
Pubblicazione: (2024)
Exploring Large Language Models for Detecting Mental Disorders
di: Kuzmin, Gleb, et al.
Pubblicazione: (2024)
di: Kuzmin, Gleb, et al.
Pubblicazione: (2024)
Adapted Large Language Models Can Outperform Medical Experts in Clinical Text Summarization
di: Van Veen, Dave, et al.
Pubblicazione: (2023)
di: Van Veen, Dave, et al.
Pubblicazione: (2023)
Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models
di: Yang, Haoyan, et al.
Pubblicazione: (2024)
di: Yang, Haoyan, et al.
Pubblicazione: (2024)
Is Bigger and Deeper Always Better? Probing LLaMA Across Scales and Layers
di: Chen, Nuo, et al.
Pubblicazione: (2023)
di: Chen, Nuo, et al.
Pubblicazione: (2023)
Large Language Models Can Better Understand Knowledge Graphs Than We Thought
di: Dai, Xinbang, et al.
Pubblicazione: (2024)
di: Dai, Xinbang, et al.
Pubblicazione: (2024)
Scaling Embeddings Outperforms Scaling Experts in Language Models
di: Liu, Hong, et al.
Pubblicazione: (2026)
di: Liu, Hong, et al.
Pubblicazione: (2026)
Neural Chain-of-Thought Search: Searching the Optimal Reasoning Path to Enhance Large Language Models
di: Ling, Guoming, et al.
Pubblicazione: (2026)
di: Ling, Guoming, et al.
Pubblicazione: (2026)
On the Representational Capacity of Neural Language Models with Chain-of-Thought Reasoning
di: Nowak, Franz, et al.
Pubblicazione: (2024)
di: Nowak, Franz, et al.
Pubblicazione: (2024)
Rule or Story, Which is a Better Commonsense Expression for Talking with Large Language Models?
di: Bian, Ning, et al.
Pubblicazione: (2024)
di: Bian, Ning, et al.
Pubblicazione: (2024)
The Emergence of Abstract Thought in Large Language Models Beyond Any Language
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
Active Prompting with Chain-of-Thought for Large Language Models
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
di: Diao, Shizhe, et al.
Pubblicazione: (2023)
Making Large Language Models Perform Better in Knowledge Graph Completion
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3
di: Yoon, Junsang, et al.
Pubblicazione: (2024)
di: Yoon, Junsang, et al.
Pubblicazione: (2024)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Cognition-of-Thought Elicits Social-Aligned Reasoning in Large Language Models
di: Zhang, Xuanming, et al.
Pubblicazione: (2025)
di: Zhang, Xuanming, et al.
Pubblicazione: (2025)
From What to Why: Thought-Space Recommendation with Small Language Models
di: Biswas, Prosenjit, et al.
Pubblicazione: (2025)
di: Biswas, Prosenjit, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Useful Blunders: Can Automated Speech Recognition Errors Improve Downstream Dementia Classification?
di: Li, Changye, et al.
Pubblicazione: (2024) -
Too Big to Fail: Larger Language Models are Disproportionately Resilient to Induction of Dementia-Related Linguistic Anomalies
di: Li, Changye, et al.
Pubblicazione: (2024) -
Reading Between the Lines: Combining Pause Dynamics and Semantic Coherence for Automated Assessment of Thought Disorder
di: Chen, Feng, et al.
Pubblicazione: (2025) -
Reexamining Racial Disparities in Automatic Speech Recognition Performance: The Role of Confounding by Provenance
di: Li, Changye, et al.
Pubblicazione: (2024) -
"Is There Anything Else?'': Examining Administrator Influence on Linguistic Features from the Cookie Theft Picture Description Cognitive Test
di: Li, Changye, et al.
Pubblicazione: (2025)