Tiny Model, Big Logic: Diversity-Driven Optimization Elicits Large-Model Reasoning Ability in VibeThinker-1.5B
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Sen, Zhou, Yi, Wang, Wei, Min, Jixin, Yin, Zhibin, Dai, Yingwei, Liu, Shixi, Pang, Lianyu, Chen, Yirong, Zhang, Junlin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LAD-Reasoner: Tiny Multimodal Models are Good Reasoners for Logical Anomaly Detection
par: Li, Weijia, et autres
Publié: (2025)
par: Li, Weijia, et autres
Publié: (2025)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
par: Wang, Yajing, et autres
Publié: (2024)
par: Wang, Yajing, et autres
Publié: (2024)
Evaluating the Logical Reasoning Abilities of Large Reasoning Models
par: Liu, Hanmeng, et autres
Publié: (2025)
par: Liu, Hanmeng, et autres
Publié: (2025)
A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning
par: Hong, Ruixin, et autres
Publié: (2023)
par: Hong, Ruixin, et autres
Publié: (2023)
DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing
par: Yang, Hanqing, et autres
Publié: (2026)
par: Yang, Hanqing, et autres
Publié: (2026)
TinyThinker: Distilling Reasoning through Coarse-to-Fine Knowledge Internalization with Self-Reflection
par: Piao, Shengmin, et autres
Publié: (2024)
par: Piao, Shengmin, et autres
Publié: (2024)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
par: Sen, Tanmay, et autres
Publié: (2024)
par: Sen, Tanmay, et autres
Publié: (2024)
LogicAsker: Evaluating and Improving the Logical Reasoning Ability of Large Language Models
par: Wan, Yuxuan, et autres
Publié: (2024)
par: Wan, Yuxuan, et autres
Publié: (2024)
Tiny Refinements Elicit Resilience: Toward Efficient Prefix-Model Against LLM Red-Teaming
par: Liu, Jiaxu, et autres
Publié: (2024)
par: Liu, Jiaxu, et autres
Publié: (2024)
Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles
par: Shah, Kulin, et autres
Publié: (2024)
par: Shah, Kulin, et autres
Publié: (2024)
LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models
par: Parmar, Mihir, et autres
Publié: (2024)
par: Parmar, Mihir, et autres
Publié: (2024)
Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers
par: Green, Tommaso, et autres
Publié: (2025)
par: Green, Tommaso, et autres
Publié: (2025)
Position: Vibe Coding Needs Vibe Reasoning: Improving Vibe Coding with Formal Verification
par: Mitchell, Jacqueline, et autres
Publié: (2025)
par: Mitchell, Jacqueline, et autres
Publié: (2025)
Vibe Reasoning: Eliciting Frontier AI Mathematical Capabilities -- A Case Study on IMO 2025 Problem 6
par: Wu, Jiaao, et autres
Publié: (2025)
par: Wu, Jiaao, et autres
Publié: (2025)
ORACLE: Optimizing Reasoning Abilities of Large Language Models via Constraint-Led Synthetic Data Elicitation
par: Yang, Zhuojie, et autres
Publié: (2026)
par: Yang, Zhuojie, et autres
Publié: (2026)
VeriThinker: Learning to Verify Makes Reasoning Model Efficient
par: Chen, Zigeng, et autres
Publié: (2025)
par: Chen, Zigeng, et autres
Publié: (2025)
DiffThinker: Towards Generative Multimodal Reasoning with Diffusion Models
par: He, Zefeng, et autres
Publié: (2025)
par: He, Zefeng, et autres
Publié: (2025)
OneThinker: All-in-one Reasoning Model for Image and Video
par: Feng, Kaituo, et autres
Publié: (2025)
par: Feng, Kaituo, et autres
Publié: (2025)
Code Prompting Elicits Conditional Reasoning Abilities in Text+Code LLMs
par: Puerto, Haritz, et autres
Publié: (2024)
par: Puerto, Haritz, et autres
Publié: (2024)
Logic-Regularized Verifier Elicits Reasoning from LLMs
par: Wang, Xinyu, et autres
Publié: (2026)
par: Wang, Xinyu, et autres
Publié: (2026)
From Blind Solvers to Logical Thinkers: Benchmarking LLMs' Logical Integrity on Faulty Mathematical Problems
par: Rahman, A M Muntasir, et autres
Publié: (2024)
par: Rahman, A M Muntasir, et autres
Publié: (2024)
EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT
par: Pei, Baoqi, et autres
Publié: (2025)
par: Pei, Baoqi, et autres
Publié: (2025)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
par: Gui, Jiayi, et autres
Publié: (2024)
par: Gui, Jiayi, et autres
Publié: (2024)
LogTinyLLM: Tiny Large Language Models Based Contextual Log Anomaly Detection
par: Ocansey, Isaiah Thompson, et autres
Publié: (2025)
par: Ocansey, Isaiah Thompson, et autres
Publié: (2025)
Apriel-1.5-15b-Thinker
par: Radhakrishna, Shruthan, et autres
Publié: (2025)
par: Radhakrishna, Shruthan, et autres
Publié: (2025)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
par: Li, Xiaoxi, et autres
Publié: (2025)
par: Li, Xiaoxi, et autres
Publié: (2025)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
par: Liu, Junming, et autres
Publié: (2026)
par: Liu, Junming, et autres
Publié: (2026)
Vibe Modeling: Challenges and Opportunities
par: Cabot, Jordi
Publié: (2025)
par: Cabot, Jordi
Publié: (2025)
Apriel-Nemotron-15B-Thinker
par: Radhakrishna, Shruthan, et autres
Publié: (2025)
par: Radhakrishna, Shruthan, et autres
Publié: (2025)
Activation Control for Efficiently Eliciting Long Chain-of-thought Ability of Language Models
par: Zhao, Zekai, et autres
Publié: (2025)
par: Zhao, Zekai, et autres
Publié: (2025)
MDD-Thinker: Towards Large Reasoning Models for Major Depressive Disorder Diagnosis
par: Sha, Yuyang, et autres
Publié: (2025)
par: Sha, Yuyang, et autres
Publié: (2025)
VR-Thinker: Boosting Video Reward Models through Thinking-with-Image Reasoning
par: Wang, Qunzhong, et autres
Publié: (2025)
par: Wang, Qunzhong, et autres
Publié: (2025)
Intuitive Thinkers and Social Adaptation: The Role of Language Ability in Academic and Life Outcomes
par: Sugawara, Akihito
Publié: (2026)
par: Sugawara, Akihito
Publié: (2026)
Intuitive Thinkers and Social Adaptation: The Role of Language Ability in Academic and Life Outcomes
par: Sugawara, Akihito
Publié: (2026)
par: Sugawara, Akihito
Publié: (2026)
VideoThinker: Building Agentic VideoLLMs with LLM-Guided Tool Reasoning
par: Li, Chenglin, et autres
Publié: (2026)
par: Li, Chenglin, et autres
Publié: (2026)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
par: Zhu, Qin, et autres
Publié: (2025)
par: Zhu, Qin, et autres
Publié: (2025)
Eliciting Reasoning in Language Models with Cognitive Tools
par: Ebouky, Brown, et autres
Publié: (2025)
par: Ebouky, Brown, et autres
Publié: (2025)
Diversity of Thought Improves Reasoning Abilities of LLMs
par: Naik, Ranjita, et autres
Publié: (2023)
par: Naik, Ranjita, et autres
Publié: (2023)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
par: Wang, Zekun Moore, et autres
Publié: (2023)
par: Wang, Zekun Moore, et autres
Publié: (2023)
Documents similaires
-
LAD-Reasoner: Tiny Multimodal Models are Good Reasoners for Logical Anomaly Detection
par: Li, Weijia, et autres
Publié: (2025) -
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
par: Wang, Yajing, et autres
Publié: (2024) -
Evaluating the Logical Reasoning Abilities of Large Reasoning Models
par: Liu, Hanmeng, et autres
Publié: (2025) -
A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning
par: Hong, Ruixin, et autres
Publié: (2023) -
DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing
par: Yang, Hanqing, et autres
Publié: (2026)