The Self-Improvement Paradox: Can Language Models Bootstrap Reasoning Capabilities without External Scaffolding?
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Yutao, Chen, Mingshuai, Zhao, Tiancheng, Xu, Ruochen, Zhang, Zilun, Yin, Jianwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Preserving Knowledge in Large Language Model with Model-Agnostic Self-Decompression
por: Zhang, Zilun, et al.
Publicado: (2024)
por: Zhang, Zilun, et al.
Publicado: (2024)
Talking to Yourself: Defying Forgetting in Large Language Models
por: Sun, Yutao, et al.
Publicado: (2026)
por: Sun, Yutao, et al.
Publicado: (2026)
RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2023)
por: Zhang, Zilun, et al.
Publicado: (2023)
HORAE: A Domain-Agnostic Language for Automated Service Regulation
por: Sun, Yutao, et al.
Publicado: (2024)
por: Sun, Yutao, et al.
Publicado: (2024)
ZoomEye: Enhancing Multimodal LLMs with Human-Like Zooming Capabilities through Tree-Based Image Exploration
por: Shen, Haozhan, et al.
Publicado: (2024)
por: Shen, Haozhan, et al.
Publicado: (2024)
Thought Manipulation: External Thought Can Be Efficient for Large Reasoning Models
por: Liu, Yule, et al.
Publicado: (2025)
por: Liu, Yule, et al.
Publicado: (2025)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
por: Hudi, Frederikus, et al.
Publicado: (2025)
por: Hudi, Frederikus, et al.
Publicado: (2025)
RCP-Merging: Merging Long Chain-of-Thought Models with Domain-Specific Models by Considering Reasoning Capability as Prior
por: Yang, Junyao, et al.
Publicado: (2025)
por: Yang, Junyao, et al.
Publicado: (2025)
BRiTE: Bootstrapping Reinforced Thinking Process to Enhance Language Model Reasoning
por: Zhong, Han, et al.
Publicado: (2025)
por: Zhong, Han, et al.
Publicado: (2025)
SciAgent: Tool-augmented Language Models for Scientific Reasoning
por: Ma, Yubo, et al.
Publicado: (2024)
por: Ma, Yubo, et al.
Publicado: (2024)
Large Language Models Can Self-Improve in Long-context Reasoning
por: Li, Siheng, et al.
Publicado: (2024)
por: Li, Siheng, et al.
Publicado: (2024)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2025)
por: Zhang, Zilun, et al.
Publicado: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
por: Wang, Jingyuan, et al.
Publicado: (2025)
por: Wang, Jingyuan, et al.
Publicado: (2025)
MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning
por: Xi, Ningyuan, et al.
Publicado: (2024)
por: Xi, Ningyuan, et al.
Publicado: (2024)
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
por: Xu, Hainiu, et al.
Publicado: (2024)
por: Xu, Hainiu, et al.
Publicado: (2024)
Test-time Recursive Thinking: Self-Improvement without External Feedback
por: Zhuang, Yufan, et al.
Publicado: (2026)
por: Zhuang, Yufan, et al.
Publicado: (2026)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
por: Chen, Haolin, et al.
Publicado: (2024)
por: Chen, Haolin, et al.
Publicado: (2024)
Can They Dixit? Yes they Can! Dixit as a Playground for Multimodal Language Model Capabilities
por: Balepur, Nishant, et al.
Publicado: (2025)
por: Balepur, Nishant, et al.
Publicado: (2025)
TTSR: Test-Time Self-Reflection for Continual Reasoning Improvement
por: He, Haoyang, et al.
Publicado: (2026)
por: He, Haoyang, et al.
Publicado: (2026)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
por: Li, Xiaoxi, et al.
Publicado: (2025)
por: Li, Xiaoxi, et al.
Publicado: (2025)
Reasoning Capabilities of Large Language Models on Dynamic Tasks
por: Wong, Annie, et al.
Publicado: (2025)
por: Wong, Annie, et al.
Publicado: (2025)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
por: Saxena, Yash, et al.
Publicado: (2024)
por: Saxena, Yash, et al.
Publicado: (2024)
Distilling Mathematical Reasoning Capabilities into Small Language Models
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
por: Sun, Jiashuo, et al.
Publicado: (2023)
por: Sun, Jiashuo, et al.
Publicado: (2023)
Deceptive Semantic Shortcuts on Reasoning Chains: How Far Can Models Go without Hallucination?
por: Li, Bangzheng, et al.
Publicado: (2023)
por: Li, Bangzheng, et al.
Publicado: (2023)
Can Large Language Models Understand, Reason About, and Generate Code-Switched Text?
por: Winata, Genta Indra, et al.
Publicado: (2026)
por: Winata, Genta Indra, et al.
Publicado: (2026)
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
por: Chen, Yanjun, et al.
Publicado: (2024)
por: Chen, Yanjun, et al.
Publicado: (2024)
Can't say cant? Measuring and Reasoning of Dark Jargons in Large Language Models
por: Ji, Xu, et al.
Publicado: (2024)
por: Ji, Xu, et al.
Publicado: (2024)
SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities
por: Jiang, Fengqing, et al.
Publicado: (2025)
por: Jiang, Fengqing, et al.
Publicado: (2025)
Confidence Matters: Revisiting Intrinsic Self-Correction Capabilities of Large Language Models
por: Li, Loka, et al.
Publicado: (2024)
por: Li, Loka, et al.
Publicado: (2024)
Unlocking Reasoning Capability on Machine Translation in Large Language Models
por: Rajaee, Sara, et al.
Publicado: (2026)
por: Rajaee, Sara, et al.
Publicado: (2026)
CHANCERY: Evaluating Corporate Governance Reasoning Capabilities in Language Models
por: Irwin, Lucas, et al.
Publicado: (2025)
por: Irwin, Lucas, et al.
Publicado: (2025)
Self-Improvement in Language Models: The Sharpening Mechanism
por: Huang, Audrey, et al.
Publicado: (2024)
por: Huang, Audrey, et al.
Publicado: (2024)
Vision-Language Models Can Self-Improve Reasoning via Reflection
por: Cheng, Kanzhi, et al.
Publicado: (2024)
por: Cheng, Kanzhi, et al.
Publicado: (2024)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
por: Wu, Zhaofeng, et al.
Publicado: (2023)
por: Wu, Zhaofeng, et al.
Publicado: (2023)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
por: Li, Ce, et al.
Publicado: (2025)
por: Li, Ce, et al.
Publicado: (2025)
LLMs are Superior Feedback Providers: Bootstrapping Reasoning for Lie Detection with Self-Generated Feedback
por: Banerjee, Tanushree, et al.
Publicado: (2024)
por: Banerjee, Tanushree, et al.
Publicado: (2024)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
por: Kao, Kuei-Chun, et al.
Publicado: (2024)
por: Kao, Kuei-Chun, et al.
Publicado: (2024)
SEKI: Self-Evolution and Knowledge Inspiration based Neural Architecture Search via Large Language Models
por: Cai, Zicheng, et al.
Publicado: (2025)
por: Cai, Zicheng, et al.
Publicado: (2025)
Self-Route: Automatic Mode Switching via Capability Estimation for Efficient Reasoning
por: He, Yang, et al.
Publicado: (2025)
por: He, Yang, et al.
Publicado: (2025)
Ejemplares similares
-
Preserving Knowledge in Large Language Model with Model-Agnostic Self-Decompression
por: Zhang, Zilun, et al.
Publicado: (2024) -
Talking to Yourself: Defying Forgetting in Large Language Models
por: Sun, Yutao, et al.
Publicado: (2026) -
RS5M and GeoRSCLIP: A Large Scale Vision-Language Dataset and A Large Vision-Language Model for Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2023) -
HORAE: A Domain-Agnostic Language for Automated Service Regulation
por: Sun, Yutao, et al.
Publicado: (2024) -
ZoomEye: Enhancing Multimodal LLMs with Human-Like Zooming Capabilities through Tree-Based Image Exploration
por: Shen, Haozhan, et al.
Publicado: (2024)