Enregistré dans:
| Auteurs principaux: | Piao, Shengmin, Park, Sanghyun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2412.08024 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
par: Piao, Shengmin, et autres
Publié: (2025)
par: Piao, Shengmin, et autres
Publié: (2025)
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
par: Piao, Shengmin, et autres
Publié: (2026)
par: Piao, Shengmin, et autres
Publié: (2026)
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
par: Piao, Shengmin, et autres
Publié: (2025)
par: Piao, Shengmin, et autres
Publié: (2025)
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
par: Luo, Miaosen, et autres
Publié: (2026)
par: Luo, Miaosen, et autres
Publié: (2026)
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
par: Wu, Zhuoyang, et autres
Publié: (2025)
par: Wu, Zhuoyang, et autres
Publié: (2025)
Learning to Retrieve and Reason on Knowledge Graph through Active Self-Reflection
par: Zhang, Han, et autres
Publié: (2025)
par: Zhang, Han, et autres
Publié: (2025)
Self-Knowledge Distillation for Learning Ambiguity
par: Park, Hancheol, et autres
Publié: (2024)
par: Park, Hancheol, et autres
Publié: (2024)
SituatedThinker: Grounding LLM Reasoning with Real-World through Situated Thinking
par: Liu, Junnan, et autres
Publié: (2025)
par: Liu, Junnan, et autres
Publié: (2025)
Learning While Staying Curious: Entropy-Preserving Supervised Fine-Tuning via Adaptive Self-Distillation for Large Reasoning Models
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
Tiny Model, Big Logic: Diversity-Driven Optimization Elicits Large-Model Reasoning Ability in VibeThinker-1.5B
par: Xu, Sen, et autres
Publié: (2025)
par: Xu, Sen, et autres
Publié: (2025)
ProxyThinker: Test-Time Guidance through Small Visual Reasoners
par: Xiao, Zilin, et autres
Publié: (2025)
par: Xiao, Zilin, et autres
Publié: (2025)
KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
par: Zhang, Dalong, et autres
Publié: (2025)
par: Zhang, Dalong, et autres
Publié: (2025)
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
Taming the Thinker: Conditional Entropy Shaping for Adaptive LLM Reasoning
par: Wei, Shuyu, et autres
Publié: (2026)
par: Wei, Shuyu, et autres
Publié: (2026)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
par: Zhao, Ziqi, et autres
Publié: (2026)
par: Zhao, Ziqi, et autres
Publié: (2026)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
MAgICoRe: Multi-Agent, Iterative, Coarse-to-Fine Refinement for Reasoning
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
Propulsion: Steering LLM with Tiny Fine-Tuning
par: Kowsher, Md, et autres
Publié: (2024)
par: Kowsher, Md, et autres
Publié: (2024)
Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection
par: Lee, Kyungjae, et autres
Publié: (2024)
par: Lee, Kyungjae, et autres
Publié: (2024)
Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers
par: Green, Tommaso, et autres
Publié: (2025)
par: Green, Tommaso, et autres
Publié: (2025)
The Markovian Thinker: Architecture-Agnostic Linear Scaling of Reasoning
par: Aghajohari, Milad, et autres
Publié: (2025)
par: Aghajohari, Milad, et autres
Publié: (2025)
Self-Reflective Planning with Knowledge Graphs: Enhancing LLM Reasoning Reliability for Question Answering
par: Zhu, Jiajun, et autres
Publié: (2025)
par: Zhu, Jiajun, et autres
Publié: (2025)
Coarse-to-Fine Highlighting: Reducing Knowledge Hallucination in Large Language Models
par: Lv, Qitan, et autres
Publié: (2024)
par: Lv, Qitan, et autres
Publié: (2024)
Mirror: A Multiple-perspective Self-Reflection Method for Knowledge-rich Reasoning
par: Yan, Hanqi, et autres
Publié: (2024)
par: Yan, Hanqi, et autres
Publié: (2024)
LLM-Guided Knowledge Distillation for Temporal Knowledge Graph Reasoning
par: Xing, Wang, et autres
Publié: (2026)
par: Xing, Wang, et autres
Publié: (2026)
Doc-V*:Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA
par: Zheng, Yuanlei, et autres
Publié: (2026)
par: Zheng, Yuanlei, et autres
Publié: (2026)
Thinking with Many Minds: Using Large Language Models for Multi-Perspective Problem-Solving
par: Park, Sanghyun, et autres
Publié: (2025)
par: Park, Sanghyun, et autres
Publié: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
par: Zhao, Siyan, et autres
Publié: (2026)
par: Zhao, Siyan, et autres
Publié: (2026)
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
par: Huang, Qixian, et autres
Publié: (2026)
par: Huang, Qixian, et autres
Publié: (2026)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
par: Xing, Wang, et autres
Publié: (2026)
par: Xing, Wang, et autres
Publié: (2026)
LightThinker++: From Reasoning Compression to Memory Management
par: Zhu, Yuqi, et autres
Publié: (2026)
par: Zhu, Yuqi, et autres
Publié: (2026)
MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization
par: Xin, Haidong, et autres
Publié: (2026)
par: Xin, Haidong, et autres
Publié: (2026)
Crosslingual On-Policy Self-Distillation for Multilingual Reasoning
par: Liu, Yihong, et autres
Publié: (2026)
par: Liu, Yihong, et autres
Publié: (2026)
SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control
par: He, Xingyang, et autres
Publié: (2025)
par: He, Xingyang, et autres
Publié: (2025)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
par: Yang, Xuewei, et autres
Publié: (2026)
par: Yang, Xuewei, et autres
Publié: (2026)
SelfReflect: Can LLMs Communicate Their Internal Answer Distribution?
par: Kirchhof, Michael, et autres
Publié: (2025)
par: Kirchhof, Michael, et autres
Publié: (2025)
Does This Look Familiar to You? Knowledge Analysis via Model Internal Representations
par: Park, Sihyun
Publié: (2025)
par: Park, Sihyun
Publié: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
par: Li, Xiaoxi, et autres
Publié: (2025)
par: Li, Xiaoxi, et autres
Publié: (2025)
Internalizing Tool Knowledge in Small Language Models via QLoRA Fine-Tuning
par: Shemla, Yuval, et autres
Publié: (2026)
par: Shemla, Yuval, et autres
Publié: (2026)
Documents similaires
-
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
par: Piao, Shengmin, et autres
Publié: (2025) -
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
par: Piao, Shengmin, et autres
Publié: (2026) -
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
par: Piao, Shengmin, et autres
Publié: (2025) -
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
par: Luo, Miaosen, et autres
Publié: (2026) -
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
par: Wu, Zhuoyang, et autres
Publié: (2025)