Salvato in:
| Autori principali: | Piao, Shengmin, Park, Sanghyun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2412.08024 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
di: Piao, Shengmin, et al.
Pubblicazione: (2025)
di: Piao, Shengmin, et al.
Pubblicazione: (2025)
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
di: Piao, Shengmin, et al.
Pubblicazione: (2026)
di: Piao, Shengmin, et al.
Pubblicazione: (2026)
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
di: Piao, Shengmin, et al.
Pubblicazione: (2025)
di: Piao, Shengmin, et al.
Pubblicazione: (2025)
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
di: Luo, Miaosen, et al.
Pubblicazione: (2026)
di: Luo, Miaosen, et al.
Pubblicazione: (2026)
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
di: Wu, Zhuoyang, et al.
Pubblicazione: (2025)
di: Wu, Zhuoyang, et al.
Pubblicazione: (2025)
Learning to Retrieve and Reason on Knowledge Graph through Active Self-Reflection
di: Zhang, Han, et al.
Pubblicazione: (2025)
di: Zhang, Han, et al.
Pubblicazione: (2025)
Self-Knowledge Distillation for Learning Ambiguity
di: Park, Hancheol, et al.
Pubblicazione: (2024)
di: Park, Hancheol, et al.
Pubblicazione: (2024)
SituatedThinker: Grounding LLM Reasoning with Real-World through Situated Thinking
di: Liu, Junnan, et al.
Pubblicazione: (2025)
di: Liu, Junnan, et al.
Pubblicazione: (2025)
Learning While Staying Curious: Entropy-Preserving Supervised Fine-Tuning via Adaptive Self-Distillation for Large Reasoning Models
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
Tiny Model, Big Logic: Diversity-Driven Optimization Elicits Large-Model Reasoning Ability in VibeThinker-1.5B
di: Xu, Sen, et al.
Pubblicazione: (2025)
di: Xu, Sen, et al.
Pubblicazione: (2025)
ProxyThinker: Test-Time Guidance through Small Visual Reasoners
di: Xiao, Zilin, et al.
Pubblicazione: (2025)
di: Xiao, Zilin, et al.
Pubblicazione: (2025)
KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
di: Zhang, Dalong, et al.
Pubblicazione: (2025)
di: Zhang, Dalong, et al.
Pubblicazione: (2025)
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
Taming the Thinker: Conditional Entropy Shaping for Adaptive LLM Reasoning
di: Wei, Shuyu, et al.
Pubblicazione: (2026)
di: Wei, Shuyu, et al.
Pubblicazione: (2026)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
di: Zhao, Ziqi, et al.
Pubblicazione: (2026)
di: Zhao, Ziqi, et al.
Pubblicazione: (2026)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
di: Wang, Danqing, et al.
Pubblicazione: (2024)
di: Wang, Danqing, et al.
Pubblicazione: (2024)
MAgICoRe: Multi-Agent, Iterative, Coarse-to-Fine Refinement for Reasoning
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2024)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2024)
Propulsion: Steering LLM with Tiny Fine-Tuning
di: Kowsher, Md, et al.
Pubblicazione: (2024)
di: Kowsher, Md, et al.
Pubblicazione: (2024)
Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection
di: Lee, Kyungjae, et al.
Pubblicazione: (2024)
di: Lee, Kyungjae, et al.
Pubblicazione: (2024)
Leaky Thoughts: Large Reasoning Models Are Not Private Thinkers
di: Green, Tommaso, et al.
Pubblicazione: (2025)
di: Green, Tommaso, et al.
Pubblicazione: (2025)
The Markovian Thinker: Architecture-Agnostic Linear Scaling of Reasoning
di: Aghajohari, Milad, et al.
Pubblicazione: (2025)
di: Aghajohari, Milad, et al.
Pubblicazione: (2025)
Self-Reflective Planning with Knowledge Graphs: Enhancing LLM Reasoning Reliability for Question Answering
di: Zhu, Jiajun, et al.
Pubblicazione: (2025)
di: Zhu, Jiajun, et al.
Pubblicazione: (2025)
Coarse-to-Fine Highlighting: Reducing Knowledge Hallucination in Large Language Models
di: Lv, Qitan, et al.
Pubblicazione: (2024)
di: Lv, Qitan, et al.
Pubblicazione: (2024)
Mirror: A Multiple-perspective Self-Reflection Method for Knowledge-rich Reasoning
di: Yan, Hanqi, et al.
Pubblicazione: (2024)
di: Yan, Hanqi, et al.
Pubblicazione: (2024)
LLM-Guided Knowledge Distillation for Temporal Knowledge Graph Reasoning
di: Xing, Wang, et al.
Pubblicazione: (2026)
di: Xing, Wang, et al.
Pubblicazione: (2026)
Doc-V*:Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA
di: Zheng, Yuanlei, et al.
Pubblicazione: (2026)
di: Zheng, Yuanlei, et al.
Pubblicazione: (2026)
Thinking with Many Minds: Using Large Language Models for Multi-Perspective Problem-Solving
di: Park, Sanghyun, et al.
Pubblicazione: (2025)
di: Park, Sanghyun, et al.
Pubblicazione: (2025)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
di: Huang, Qixian, et al.
Pubblicazione: (2026)
di: Huang, Qixian, et al.
Pubblicazione: (2026)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
di: Xing, Wang, et al.
Pubblicazione: (2026)
di: Xing, Wang, et al.
Pubblicazione: (2026)
LightThinker++: From Reasoning Compression to Memory Management
di: Zhu, Yuqi, et al.
Pubblicazione: (2026)
di: Zhu, Yuqi, et al.
Pubblicazione: (2026)
MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization
di: Xin, Haidong, et al.
Pubblicazione: (2026)
di: Xin, Haidong, et al.
Pubblicazione: (2026)
Crosslingual On-Policy Self-Distillation for Multilingual Reasoning
di: Liu, Yihong, et al.
Pubblicazione: (2026)
di: Liu, Yihong, et al.
Pubblicazione: (2026)
SmartThinker: Learning to Compress and Preserve Reasoning by Step-Level Length Control
di: He, Xingyang, et al.
Pubblicazione: (2025)
di: He, Xingyang, et al.
Pubblicazione: (2025)
Internalize the Temperature: On-Policy Self-Distillation as Policy Reheater for Reinforcement Learning
di: Yang, Xuewei, et al.
Pubblicazione: (2026)
di: Yang, Xuewei, et al.
Pubblicazione: (2026)
SelfReflect: Can LLMs Communicate Their Internal Answer Distribution?
di: Kirchhof, Michael, et al.
Pubblicazione: (2025)
di: Kirchhof, Michael, et al.
Pubblicazione: (2025)
Does This Look Familiar to You? Knowledge Analysis via Model Internal Representations
di: Park, Sihyun
Pubblicazione: (2025)
di: Park, Sihyun
Pubblicazione: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
di: Liao, Huanxuan, et al.
Pubblicazione: (2024)
di: Liao, Huanxuan, et al.
Pubblicazione: (2024)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
Internalizing Tool Knowledge in Small Language Models via QLoRA Fine-Tuning
di: Shemla, Yuval, et al.
Pubblicazione: (2026)
di: Shemla, Yuval, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
di: Piao, Shengmin, et al.
Pubblicazione: (2025) -
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
di: Piao, Shengmin, et al.
Pubblicazione: (2026) -
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
di: Piao, Shengmin, et al.
Pubblicazione: (2025) -
C2F-Thinker: Coarse-to-Fine Reasoning with Hint-Guided Reinforcement Learning for Multimodal Sentiment Analysis
di: Luo, Miaosen, et al.
Pubblicazione: (2026) -
Enhancing Long-Chain Reasoning Distillation through Error-Aware Self-Reflection
di: Wu, Zhuoyang, et al.
Pubblicazione: (2025)