Where Did This Sentence Come From? Tracing Provenance in LLM Reasoning Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Kaiyuan, Yan, Shaotian, Miao, Rui, Wang, Bing, Shen, Chen, Zhang, Jun, Ye, Jieping |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Step Length Confounding in LLM Reasoning Data Selection
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
par: Yan, Shaotian, et autres
Publié: (2026)
par: Yan, Shaotian, et autres
Publié: (2026)
Backtracking When It Strays: Mitigating Dual Exposure Biases in LLM Reasoning Distillation
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Are Rationales Necessary and Sufficient? Tuning LLMs for Explainable Misinformation Detection
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Don't Take Things Out of Context: Attention Intervention for Enhancing Chain-of-Thought Reasoning in Large Language Models
par: Yan, Shaotian, et autres
Publié: (2025)
par: Yan, Shaotian, et autres
Publié: (2025)
Concise and Organized Perception Facilitates Reasoning in Large Language Models
par: Liu, Junjie, et autres
Publié: (2023)
par: Liu, Junjie, et autres
Publié: (2023)
Prefix Teach, Suffix Fade: Local Teachability Collapse in Strong-to-Weak On-Policy Distillation
par: Liu, Kaiyuan, et autres
Publié: (2026)
par: Liu, Kaiyuan, et autres
Publié: (2026)
SalaMAnder: Shapley-based Mathematical Expression Attribution and Metric for Chain-of-Thought Reasoning
par: Xin, Yue, et autres
Publié: (2025)
par: Xin, Yue, et autres
Publié: (2025)
From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks
par: Zhang, Xiaofeng, et autres
Publié: (2024)
par: Zhang, Xiaofeng, et autres
Publié: (2024)
Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models
par: Liu, Kaiyuan, et autres
Publié: (2025)
par: Liu, Kaiyuan, et autres
Publié: (2025)
Enhancing Chain-of-Thought Reasoning with Critical Representation Fine-tuning
par: Huang, Chenxi, et autres
Publié: (2025)
par: Huang, Chenxi, et autres
Publié: (2025)
Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs
par: Pan, Zhiyu, et autres
Publié: (2026)
par: Pan, Zhiyu, et autres
Publié: (2026)
Where Did It Go Wrong? Attributing Undesirable LLM Behaviors via Representation Gradient Tracing
par: Li, Zhe, et autres
Publié: (2025)
par: Li, Zhe, et autres
Publié: (2025)
Instance-adaptive Zero-shot Chain-of-Thought Prompting
par: Yuan, Xiaosong, et autres
Publié: (2024)
par: Yuan, Xiaosong, et autres
Publié: (2024)
TROVE: A Challenge for Fine-Grained Text Provenance via Source Sentence Tracing and Relationship Classification
par: Zhu, Junnan, et autres
Publié: (2025)
par: Zhu, Junnan, et autres
Publié: (2025)
Where Did the Amaterasu Particle Come From?
par: Unger, Michael, et autres
Publié: (2023)
par: Unger, Michael, et autres
Publié: (2023)
Where Did Development Economics Come From?
par: Eric Helleiner
Publié: (2026)
par: Eric Helleiner
Publié: (2026)
Beamforming-LLM: What, Where and When Did I Miss?
par: Choudhari, Vishal
Publié: (2025)
par: Choudhari, Vishal
Publié: (2025)
Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
par: Zhang, Kongcheng, et autres
Publié: (2025)
par: Zhang, Kongcheng, et autres
Publié: (2025)
Understanding LLMs' Cross-Lingual Context Retrieval: How Good It Is And Where It Comes From
par: Gao, Changjiang, et autres
Publié: (2025)
par: Gao, Changjiang, et autres
Publié: (2025)
Refining Sentence Embedding Model through Ranking Sentences Generation with Large Language Models
par: He, Liyang, et autres
Publié: (2025)
par: He, Liyang, et autres
Publié: (2025)
From Where Words Come: Efficient Regularization of Code Tokenizers Through Source Attribution
par: Chizhov, Pavel, et autres
Publié: (2026)
par: Chizhov, Pavel, et autres
Publié: (2026)
Enhancing Large Language Models with Reward-guided Tree Search for Knowledge Graph Question and Answering
par: Long, Xiao, et autres
Publié: (2025)
par: Long, Xiao, et autres
Publié: (2025)
NaturalThoughts: Selecting and Distilling Reasoning Traces for General Reasoning Tasks
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
Learning to Reason via Self-Iterative Process Feedback for Small Language Models
par: Chen, Kaiyuan, et autres
Publié: (2024)
par: Chen, Kaiyuan, et autres
Publié: (2024)
TextSeal: A Localized LLM Watermark for Provenance & Distillation Protection
par: Sander, Tom, et autres
Publié: (2026)
par: Sander, Tom, et autres
Publié: (2026)
Towards Multidisciplinary Summarization of Hospital Stays: Efficient Sentence-Level Clinical Provenance Categorization
par: Karacan, Baris, et autres
Publié: (2026)
par: Karacan, Baris, et autres
Publié: (2026)
LLM-Guided Knowledge Distillation for Temporal Knowledge Graph Reasoning
par: Xing, Wang, et autres
Publié: (2026)
par: Xing, Wang, et autres
Publié: (2026)
Reason-Align-Respond: Aligning LLM Reasoning with Knowledge Graphs for KGQA
par: Shen, Xiangqing, et autres
Publié: (2025)
par: Shen, Xiangqing, et autres
Publié: (2025)
Enhancing LLM's Cognition via Structurization
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series
par: Cai, Wenrui, et autres
Publié: (2025)
par: Cai, Wenrui, et autres
Publié: (2025)
When and Where Did it Happen? An Encoder-Decoder Model to Identify Scenario Context
par: Noriega-Atala, Enrique, et autres
Publié: (2024)
par: Noriega-Atala, Enrique, et autres
Publié: (2024)
Controlling Thinking Speed in Reasoning Models
par: Lin, Zhengkai, et autres
Publié: (2025)
par: Lin, Zhengkai, et autres
Publié: (2025)
Improving Complex Reasoning with Dynamic Prompt Corruption: A soft prompt Optimization Approach
par: Fan, Sinan, et autres
Publié: (2025)
par: Fan, Sinan, et autres
Publié: (2025)
OmniThoughtVis: A Scalable Distillation Pipeline for Deployable Multimodal Reasoning Models
par: Yue, Yuanhao, et autres
Publié: (2026)
par: Yue, Yuanhao, et autres
Publié: (2026)
Self-Enhanced Reasoning Training: Activating Latent Reasoning in Small Models for Enhanced Reasoning Distillation
par: Zhang, Yong, et autres
Publié: (2025)
par: Zhang, Yong, et autres
Publié: (2025)
ReasonOps: Operator Segmentation for LLM Reasoning Traces
par: Lee, Daniel, et autres
Publié: (2026)
par: Lee, Daniel, et autres
Publié: (2026)
SuperCorrect: Advancing Small LLM Reasoning with Thought Template Distillation and Self-Correction
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
HypER: Literature-grounded Hypothesis Generation and Distillation with Provenance
par: Vasu, Rosni, et autres
Publié: (2025)
par: Vasu, Rosni, et autres
Publié: (2025)
SAPO: Self-Adaptive Process Optimization Makes Small Reasoners Stronger
par: Chen, Kaiyuan, et autres
Publié: (2026)
par: Chen, Kaiyuan, et autres
Publié: (2026)
Documents similaires
-
On the Step Length Confounding in LLM Reasoning Data Selection
par: Wang, Bing, et autres
Publié: (2026) -
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
par: Yan, Shaotian, et autres
Publié: (2026) -
Backtracking When It Strays: Mitigating Dual Exposure Biases in LLM Reasoning Distillation
par: Wang, Bing, et autres
Publié: (2026) -
Are Rationales Necessary and Sufficient? Tuning LLMs for Explainable Misinformation Detection
par: Wang, Bing, et autres
Publié: (2026) -
Don't Take Things Out of Context: Attention Intervention for Enhancing Chain-of-Thought Reasoning in Large Language Models
par: Yan, Shaotian, et autres
Publié: (2025)