Guardado en:
| Autores principales: | Piao, Shengmin, Park, Sanghyun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2412.08024 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
por: Piao, Shengmin, et al.
Publicado: (2025)
por: Piao, Shengmin, et al.
Publicado: (2025)
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
por: Piao, Shengmin, et al.
Publicado: (2026)
por: Piao, Shengmin, et al.
Publicado: (2026)
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
por: Piao, Shengmin, et al.
Publicado: (2025)
por: Piao, Shengmin, et al.
Publicado: (2025)
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
por: Luo, Miaosen, et al.
Publicado: (2026)
por: Luo, Miaosen, et al.
Publicado: (2026)
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
por: Wu, Zhuoyang, et al.
Publicado: (2025)
por: Wu, Zhuoyang, et al.
Publicado: (2025)
Learning to Retrieve and Reason on Knowledge Graph through Active Self-Reflection
por: Zhang, Han, et al.
Publicado: (2025)
por: Zhang, Han, et al.
Publicado: (2025)
Self-Knowledge Distillation for Learning Ambiguity
por: Park, Hancheol, et al.
Publicado: (2024)
por: Park, Hancheol, et al.
Publicado: (2024)
SituatedThinker: Grounding LLM Reasoning with Real-World through Situated Thinking
por: Liu, Junnan, et al.
Publicado: (2025)
por: Liu, Junnan, et al.
Publicado: (2025)
Learning While Staying Curious: Entropy-Preserving Supervised Fine-Tuning via Adaptive Self-Distillation for Large Reasoning Models
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
Tiny Model, Big Logic: Diversity-Driven Optimization Elicits Large-Model Reasoning Ability in VibeThinker-1.5B
por: Xu, Sen, et al.
Publicado: (2025)
por: Xu, Sen, et al.
Publicado: (2025)
ProxyThinker: Test-Time Guidance through Small Visual Reasoners
por: Xiao, Zilin, et al.
Publicado: (2025)
por: Xiao, Zilin, et al.
Publicado: (2025)
KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
por: Zhang, Dalong, et al.
Publicado: (2025)
por: Zhang, Dalong, et al.
Publicado: (2025)
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
por: Ji, Yuelyu, et al.
Publicado: (2024)
por: Ji, Yuelyu, et al.
Publicado: (2024)
Taming the Thinker: Conditional Entropy Shaping for Adaptive LLM Reasoning
por: Wei, Shuyu, et al.
Publicado: (2026)
por: Wei, Shuyu, et al.
Publicado: (2026)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
por: Zhao, Ziqi, et al.
Publicado: (2026)
por: Zhao, Ziqi, et al.
Publicado: (2026)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
por: Wang, Danqing, et al.
Publicado: (2024)
por: Wang, Danqing, et al.
Publicado: (2024)
MAgICoRe: Multi-Agent, Iterative, Coarse-to-Fine Refinement for Reasoning
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)
por: Chen, Justin Chih-Yao, et al.
Publicado: (2024)
Propulsion: Steering LLM with Tiny Fine-Tuning
por: Kowsher, Md, et al.
Publicado: (2024)
por: Kowsher, Md, et al.
Publicado: (2024)
Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection
por: Lee, Kyungjae, et al.
Publicado: (2024)
por: Lee, Kyungjae, et al.
Publicado: (2024)
Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers
por: Green, Tommaso, et al.
Publicado: (2025)
por: Green, Tommaso, et al.
Publicado: (2025)
The Markovian Thinker: Architecture-Agnostic Linear Scaling of Reasoning
por: Aghajohari, Milad, et al.
Publicado: (2025)
por: Aghajohari, Milad, et al.
Publicado: (2025)
Self-Reflective Planning with Knowledge Graphs: Enhancing LLM Reasoning Reliability for Question Answering
por: Zhu, Jiajun, et al.
Publicado: (2025)
por: Zhu, Jiajun, et al.
Publicado: (2025)
Coarse-to-Fine Highlighting: Reducing Knowledge Hallucination in Large Language Models
por: Lv, Qitan, et al.
Publicado: (2024)
por: Lv, Qitan, et al.
Publicado: (2024)
Mirror: A Multiple-perspective Self-Reflection Method for Knowledge-rich Reasoning
por: Yan, Hanqi, et al.
Publicado: (2024)
por: Yan, Hanqi, et al.
Publicado: (2024)
LLM-Guided Knowledge Distillation for Temporal Knowledge Graph Reasoning
por: Xing, Wang, et al.
Publicado: (2026)
por: Xing, Wang, et al.
Publicado: (2026)
Doc-V*:Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA
por: Zheng, Yuanlei, et al.
Publicado: (2026)
por: Zheng, Yuanlei, et al.
Publicado: (2026)
Thinking with Many Minds: Using Large Language Models for Multi-Perspective Problem-Solving
por: Park, Sanghyun, et al.
Publicado: (2025)
por: Park, Sanghyun, et al.
Publicado: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2026)
por: Zhao, Siyan, et al.
Publicado: (2026)
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
por: Huang, Qixian, et al.
Publicado: (2026)
por: Huang, Qixian, et al.
Publicado: (2026)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
por: Xing, Wang, et al.
Publicado: (2026)
por: Xing, Wang, et al.
Publicado: (2026)
LightThinker++: From Reasoning Compression to Memory Management
por: Zhu, Yuqi, et al.
Publicado: (2026)
por: Zhu, Yuqi, et al.
Publicado: (2026)
MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization
por: Xin, Haidong, et al.
Publicado: (2026)
por: Xin, Haidong, et al.
Publicado: (2026)
Crosslingual On-Policy Self-Distillation for Multilingual Reasoning
por: Liu, Yihong, et al.
Publicado: (2026)
por: Liu, Yihong, et al.
Publicado: (2026)
SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control
por: He, Xingyang, et al.
Publicado: (2025)
por: He, Xingyang, et al.
Publicado: (2025)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
por: Yang, Xuewei, et al.
Publicado: (2026)
por: Yang, Xuewei, et al.
Publicado: (2026)
SelfReflect: Can LLMs Communicate Their Internal Answer Distribution?
por: Kirchhof, Michael, et al.
Publicado: (2025)
por: Kirchhof, Michael, et al.
Publicado: (2025)
Does This Look Familiar to You? Knowledge Analysis via Model Internal Representations
por: Park, Sihyun
Publicado: (2025)
por: Park, Sihyun
Publicado: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
por: Li, Xiaoxi, et al.
Publicado: (2025)
por: Li, Xiaoxi, et al.
Publicado: (2025)
Internalizing Tool Knowledge in Small Language Models via QLoRA Fine-Tuning
por: Shemla, Yuval, et al.
Publicado: (2026)
por: Shemla, Yuval, et al.
Publicado: (2026)
Ejemplares similares
-
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
por: Piao, Shengmin, et al.
Publicado: (2025) -
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
por: Piao, Shengmin, et al.
Publicado: (2026) -
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
por: Piao, Shengmin, et al.
Publicado: (2025) -
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
por: Luo, Miaosen, et al.
Publicado: (2026) -
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
por: Wu, Zhuoyang, et al.
Publicado: (2025)