Enregistré dans:
| Auteurs principaux: | Shi, Boyu, Jiang, YiCheng, Liu, Chang, Wang, Qiufeng, Yang, Xu, Geng, Xin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.07783 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
XPERT: Expert Knowledge Transfer for Effective Training of Language Models
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
Learngene Search Across Multiple Datasets for Building Variable-Sized Models
par: Shi, Boyu, et autres
Publié: (2026)
par: Shi, Boyu, et autres
Publié: (2026)
Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions
par: Shi, Boyu, et autres
Publié: (2026)
par: Shi, Boyu, et autres
Publié: (2026)
Thinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient Reasoners
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
Reionization History and Neutrino Mass
par: Dai, YiCheng, et autres
Publié: (2026)
par: Dai, YiCheng, et autres
Publié: (2026)
Constraint on Neutrino Statistics from Cosmological Data
par: Dai, YiCheng, et autres
Publié: (2025)
par: Dai, YiCheng, et autres
Publié: (2025)
SOD: Step-wise On-policy Distillation for Small Language Model Agents
par: Zhong, Qiyong, et autres
Publié: (2026)
par: Zhong, Qiyong, et autres
Publié: (2026)
Cross-Cultural Expert-Level Art Critique Evaluation with Vision-Language Models
par: Yu, Haorui, et autres
Publié: (2026)
par: Yu, Haorui, et autres
Publié: (2026)
Effectiveness of Chain-of-Thought in Distilling Reasoning Capability from Large Language Models
par: Do, Cong-Thanh, et autres
Publié: (2025)
par: Do, Cong-Thanh, et autres
Publié: (2025)
Symbolic Chain-of-Thought Distillation: Small Models Can Also "Think" Step-by-Step
par: Li, Liunian Harold, et autres
Publié: (2023)
par: Li, Liunian Harold, et autres
Publié: (2023)
An Analysis for Reasoning Bias of Language Models with Small Initialization
par: Yao, Junjie, et autres
Publié: (2025)
par: Yao, Junjie, et autres
Publié: (2025)
Seeing Symbols, Missing Cultures: Probing Vision-Language Models' Reasoning on Fire Imagery and Cultural Meaning
par: Yu, Haorui, et autres
Publié: (2025)
par: Yu, Haorui, et autres
Publié: (2025)
Balanced Actor Initialization: Stable RLHF Training of Distillation-Based Reasoning Models
par: Zheng, Chen, et autres
Publié: (2025)
par: Zheng, Chen, et autres
Publié: (2025)
Distilling Mathematical Reasoning Capabilities into Small Language Models
par: Zhu, Xunyu, et autres
Publié: (2024)
par: Zhu, Xunyu, et autres
Publié: (2024)
SLMRec: Distilling Large Language Models into Small for Sequential Recommendation
par: Xu, Wujiang, et autres
Publié: (2024)
par: Xu, Wujiang, et autres
Publié: (2024)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
par: Xie, Congkai, et autres
Publié: (2025)
par: Xie, Congkai, et autres
Publié: (2025)
Adam: Dense Retrieval Distillation with Adaptive Dark Examples
par: Tao, Chongyang, et autres
Publié: (2022)
par: Tao, Chongyang, et autres
Publié: (2022)
Learning to Rank Chain-of-Thought: Using a Small Model
par: Jiang, Eric Hanchen, et autres
Publié: (2025)
par: Jiang, Eric Hanchen, et autres
Publié: (2025)
Progressively Label Enhancement for Large Language Model Alignment
par: Liu, Biao, et autres
Publié: (2024)
par: Liu, Biao, et autres
Publié: (2024)
CANDLE: Iterative Conceptualization and Instantiation Distillation from Large Language Models for Commonsense Reasoning
par: Wang, Weiqi, et autres
Publié: (2024)
par: Wang, Weiqi, et autres
Publié: (2024)
Preference Orchestrator: Prompt-Aware Multi-Objective Alignment for Large Language Models
par: Liu, Biao, et autres
Publié: (2025)
par: Liu, Biao, et autres
Publié: (2025)
Learning to Maximize Mutual Information for Chain-of-Thought Distillation
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
Self and Cross-Model Distillation for LLMs: Effective Methods for Refusal Pattern Alignment
par: Li, Jie, et autres
Publié: (2024)
par: Li, Jie, et autres
Publié: (2024)
BOLT: Bootstrap Long Chain-of-Thought in Language Models without Distillation
par: Pang, Bo, et autres
Publié: (2025)
par: Pang, Bo, et autres
Publié: (2025)
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
par: Yin, Maxwell J., et autres
Publié: (2025)
par: Yin, Maxwell J., et autres
Publié: (2025)
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
par: Gu, Yanggan, et autres
Publié: (2025)
par: Gu, Yanggan, et autres
Publié: (2025)
Neural-Symbolic Collaborative Distillation: Advancing Small Language Models for Complex Reasoning Tasks
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
par: Lee, Jooyoung, et autres
Publié: (2024)
par: Lee, Jooyoung, et autres
Publié: (2024)
Advantage-Guided Distillation for Preference Alignment in Small Language Models
par: Gao, Shiping, et autres
Publié: (2025)
par: Gao, Shiping, et autres
Publié: (2025)
VULCA-Bench: A Multicultural Vision-Language Benchmark for Evaluating Cultural Understanding
par: Yu, Haorui, et autres
Publié: (2026)
par: Yu, Haorui, et autres
Publié: (2026)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
par: Cheng, Xiaoxue, et autres
Publié: (2024)
par: Cheng, Xiaoxue, et autres
Publié: (2024)
Scaling Law for Language Models Training Considering Batch Size
par: Shuai, Xian, et autres
Publié: (2024)
par: Shuai, Xian, et autres
Publié: (2024)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
par: Cheng, Bo, et autres
Publié: (2025)
par: Cheng, Bo, et autres
Publié: (2025)
Reasoning-preserved Efficient Distillation of Large Language Models via Activation-aware Initialization
par: He, Junlin, et autres
Publié: (2026)
par: He, Junlin, et autres
Publié: (2026)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
par: Zhao, Ziqi, et autres
Publié: (2026)
par: Zhao, Ziqi, et autres
Publié: (2026)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
par: Wang, Chengyu, et autres
Publié: (2025)
par: Wang, Chengyu, et autres
Publié: (2025)
Exploring Learngene via Stage-wise Weight Sharing for Initializing Variable-sized Models
par: Xia, Shi-Yu, et autres
Publié: (2024)
par: Xia, Shi-Yu, et autres
Publié: (2024)
FedCoT: Federated Chain-of-Thought Distillation for Large Language Models
par: Fan, Tao, et autres
Publié: (2024)
par: Fan, Tao, et autres
Publié: (2024)
Small Language Models as Effective Guides for Large Language Models in Chinese Relation Extraction
par: Tang, Xuemei, et autres
Publié: (2024)
par: Tang, Xuemei, et autres
Publié: (2024)
A Structured Framework for Evaluating and Enhancing Interpretive Capabilities of Multimodal LLMs in Culturally Situated Tasks
par: Yu, Haorui, et autres
Publié: (2025)
par: Yu, Haorui, et autres
Publié: (2025)
Documents similaires
-
XPERT: Expert Knowledge Transfer for Effective Training of Language Models
par: Liu, Chang, et autres
Publié: (2026) -
Learngene Search Across Multiple Datasets for Building Variable-Sized Models
par: Shi, Boyu, et autres
Publié: (2026) -
Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions
par: Shi, Boyu, et autres
Publié: (2026) -
Thinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient Reasoners
par: Xu, Xin, et autres
Publié: (2025) -
Reionization History and Neutrino Mass
par: Dai, YiCheng, et autres
Publié: (2026)