When Reasoning Beats Scale: A 1.5B Reasoning Model Outranks 13B LLMs as Discriminator
Fuente:
arXiv
Salvato in:
| Autore principale: | Anjum, Md Fahim |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating LLMs' Reasoning Over Ordered Procedural Steps
di: Anika, Adrita, et al.
Pubblicazione: (2025)
di: Anika, Adrita, et al.
Pubblicazione: (2025)
Advancing Diffusion Models: Alias-Free Resampling and Enhanced Rotational Equivariance
di: Anjum, Md Fahim
Pubblicazione: (2024)
di: Anjum, Md Fahim
Pubblicazione: (2024)
When Models Know More Than They Say: Probing Analogical Reasoning in LLMs
di: McGovern, Hope, et al.
Pubblicazione: (2026)
di: McGovern, Hope, et al.
Pubblicazione: (2026)
47B Mixture-of-Experts Beats 671B Dense Models on Chinese Medical Examinations
di: Tseng, Chiung-Yi, et al.
Pubblicazione: (2025)
di: Tseng, Chiung-Yi, et al.
Pubblicazione: (2025)
PCL-Reasoner-V1.5: Advancing Math Reasoning with Offline Reinforcement Learning
di: Lu, Yao, et al.
Pubblicazione: (2026)
di: Lu, Yao, et al.
Pubblicazione: (2026)
A Implies B: Circuit Analysis in LLMs for Propositional Logical Reasoning
di: Hong, Guan Zhe, et al.
Pubblicazione: (2024)
di: Hong, Guan Zhe, et al.
Pubblicazione: (2024)
ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning
di: Lin, Bill Yuchen, et al.
Pubblicazione: (2025)
di: Lin, Bill Yuchen, et al.
Pubblicazione: (2025)
When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models
di: Wang, Kai, et al.
Pubblicazione: (2025)
di: Wang, Kai, et al.
Pubblicazione: (2025)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
di: Hou, Zhenyu, et al.
Pubblicazione: (2025)
di: Hou, Zhenyu, et al.
Pubblicazione: (2025)
Learning to Reason in LLMs by Expectation Maximization
di: Lee, Junghyun, et al.
Pubblicazione: (2025)
di: Lee, Junghyun, et al.
Pubblicazione: (2025)
Reasoning Boosts Opinion Alignment in LLMs
di: Berdoz, Frédéric, et al.
Pubblicazione: (2026)
di: Berdoz, Frédéric, et al.
Pubblicazione: (2026)
OncoReason: Structuring Clinical Reasoning in LLMs for Robust and Interpretable Survival Prediction
di: Hemadri, Raghu Vamshi, et al.
Pubblicazione: (2025)
di: Hemadri, Raghu Vamshi, et al.
Pubblicazione: (2025)
Jamba-1.5: Hybrid Transformer-Mamba Models at Scale
di: Jamba Team, et al.
Pubblicazione: (2024)
di: Jamba Team, et al.
Pubblicazione: (2024)
When Do LLMs Reason? A Dynamical Systems View via Entropy Phase Transitions
di: Xia, Wei, et al.
Pubblicazione: (2026)
di: Xia, Wei, et al.
Pubblicazione: (2026)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
di: Zhao, Siyan, et al.
Pubblicazione: (2025)
di: Zhao, Siyan, et al.
Pubblicazione: (2025)
LiPCoT: Linear Predictive Coding based Tokenizer for Self-supervised Learning of Time Series Data via Language Models
di: Anjum, Md Fahim
Pubblicazione: (2024)
di: Anjum, Md Fahim
Pubblicazione: (2024)
Scaling Speculative Decoding with Lookahead Reasoning
di: Fu, Yichao, et al.
Pubblicazione: (2025)
di: Fu, Yichao, et al.
Pubblicazione: (2025)
Efficiently Scaling LLM Reasoning with Certaindex
di: Fu, Yichao, et al.
Pubblicazione: (2024)
di: Fu, Yichao, et al.
Pubblicazione: (2024)
Demystifying Long Chain-of-Thought Reasoning in LLMs
di: Yeo, Edward, et al.
Pubblicazione: (2025)
di: Yeo, Edward, et al.
Pubblicazione: (2025)
Probabilistic Reasoning with LLMs for k-anonymity Estimation
di: Zheng, Jonathan, et al.
Pubblicazione: (2025)
di: Zheng, Jonathan, et al.
Pubblicazione: (2025)
Benchmarking and Understanding Compositional Relational Reasoning of LLMs
di: Ni, Ruikang, et al.
Pubblicazione: (2024)
di: Ni, Ruikang, et al.
Pubblicazione: (2024)
Failure Modes of LLMs for Causal Reasoning on Narratives
di: Yamin, Khurram, et al.
Pubblicazione: (2024)
di: Yamin, Khurram, et al.
Pubblicazione: (2024)
Scaling Laws for Discriminative Classification in Large Language Models
di: Wyatte, Dean, et al.
Pubblicazione: (2024)
di: Wyatte, Dean, et al.
Pubblicazione: (2024)
Parkinson's Disease Classification via EEG: All You Need is a Single Convolutional Layer
di: Anjum, Md Fahim
Pubblicazione: (2024)
di: Anjum, Md Fahim
Pubblicazione: (2024)
When Reasoning Hurts: Source-Aware Evaluation of Frontier LLMs for Clinical SOAP Note Generation
di: Faisal, Faizan
Pubblicazione: (2026)
di: Faisal, Faizan
Pubblicazione: (2026)
AdaptThink: Reasoning Models Can Learn When to Think
di: Zhang, Jiajie, et al.
Pubblicazione: (2025)
di: Zhang, Jiajie, et al.
Pubblicazione: (2025)
Scaling Policy Compliance Assessment in Language Models with Policy Reasoning Traces
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
Asynchronous Reasoning: Training-Free Interactive Thinking LLMs
di: Yakushev, George, et al.
Pubblicazione: (2025)
di: Yakushev, George, et al.
Pubblicazione: (2025)
Reasoning Beyond Limits: Advances and Open Problems for LLMs
di: Ferrag, Mohamed Amine, et al.
Pubblicazione: (2025)
di: Ferrag, Mohamed Amine, et al.
Pubblicazione: (2025)
AAPO: Enhancing the Reasoning Capabilities of LLMs with Advantage Margin
di: Xiong, Jian, et al.
Pubblicazione: (2025)
di: Xiong, Jian, et al.
Pubblicazione: (2025)
Scaling Open-Ended Reasoning to Predict the Future
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
MolReasoner: Toward Effective and Interpretable Reasoning for Molecular LLMs
di: Zhao, Guojiang, et al.
Pubblicazione: (2025)
di: Zhao, Guojiang, et al.
Pubblicazione: (2025)
Scaling Up RL: Unlocking Diverse Reasoning in LLMs via Prolonged Training
di: Liu, Mingjie, et al.
Pubblicazione: (2025)
di: Liu, Mingjie, et al.
Pubblicazione: (2025)
Automatic Pull Request Description Generation Using LLMs: A T5 Model Approach
di: Sakib, Md Nazmus, et al.
Pubblicazione: (2024)
di: Sakib, Md Nazmus, et al.
Pubblicazione: (2024)
Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs
di: Kim, Jaemin, et al.
Pubblicazione: (2025)
di: Kim, Jaemin, et al.
Pubblicazione: (2025)
Zero- and Few-Shot Prompting with LLMs: A Comparative Study with Fine-tuned Models for Bangla Sentiment Analysis
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
When Fairness Isn't Statistical: The Limits of Machine Learning in Evaluating Legal Reasoning
di: Barale, Claire, et al.
Pubblicazione: (2025)
di: Barale, Claire, et al.
Pubblicazione: (2025)
Stabilizing Reasoning in Medical LLMs with Continued Pretraining and Reasoning Preference Optimization
di: Kawakami, Wataru, et al.
Pubblicazione: (2025)
di: Kawakami, Wataru, et al.
Pubblicazione: (2025)
Rewarding Graph Reasoning Process makes LLMs more Generalized Reasoners
di: Peng, Miao, et al.
Pubblicazione: (2025)
di: Peng, Miao, et al.
Pubblicazione: (2025)
FROST: Filtering Reasoning Outliers with Attention for Efficient Reasoning
di: Luo, Haozheng, et al.
Pubblicazione: (2026)
di: Luo, Haozheng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Evaluating LLMs' Reasoning Over Ordered Procedural Steps
di: Anika, Adrita, et al.
Pubblicazione: (2025) -
Advancing Diffusion Models: Alias-Free Resampling and Enhanced Rotational Equivariance
di: Anjum, Md Fahim
Pubblicazione: (2024) -
When Models Know More Than They Say: Probing Analogical Reasoning in LLMs
di: McGovern, Hope, et al.
Pubblicazione: (2026) -
47B Mixture-of-Experts Beats 671B Dense Models on Chinese Medical Examinations
di: Tseng, Chiung-Yi, et al.
Pubblicazione: (2025) -
PCL-Reasoner-V1.5: Advancing Math Reasoning with Offline Reinforcement Learning
di: Lu, Yao, et al.
Pubblicazione: (2026)