Knowledge Distillation of Black-Box Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Hongzhan, Chen, Ruijun, Yi, Yuqi, Quan, Xiaojun, Li, Chenliang, Yan, Ming, Zhang, Ji |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
por: Yang, Ziyi, et al.
Publicado: (2025)
por: Yang, Ziyi, et al.
Publicado: (2025)
Small LLMs Are Weak Tool Learners: A Multi-LLM Agent
por: Shen, Weizhou, et al.
Publicado: (2024)
por: Shen, Weizhou, et al.
Publicado: (2024)
BlockPruner: Fine-grained Pruning for Large Language Models
por: Zhong, Longguang, et al.
Publicado: (2024)
por: Zhong, Longguang, et al.
Publicado: (2024)
Lookahead Routing for Large Language Models
por: Huang, Canbin, et al.
Publicado: (2025)
por: Huang, Canbin, et al.
Publicado: (2025)
Discriminative Policy Optimization for Token-Level Reward Models
por: Chen, Hongzhan, et al.
Publicado: (2025)
por: Chen, Hongzhan, et al.
Publicado: (2025)
FuseChat: Knowledge Fusion of Chat Models
por: Wan, Fanqi, et al.
Publicado: (2024)
por: Wan, Fanqi, et al.
Publicado: (2024)
SocialBench: Sociality Evaluation of Role-Playing Conversational Agents
por: Chen, Hongzhan, et al.
Publicado: (2024)
por: Chen, Hongzhan, et al.
Publicado: (2024)
ProFuser: Progressive Fusion of Large Language Models
por: Shi, Tianyuan, et al.
Publicado: (2024)
por: Shi, Tianyuan, et al.
Publicado: (2024)
Black-Box On-Policy Distillation of Large Language Models
por: Ye, Tianzhu, et al.
Publicado: (2025)
por: Ye, Tianzhu, et al.
Publicado: (2025)
SODA: Semi On-Policy Black-Box Distillation for Large Language Models
por: Chen, Xiwen, et al.
Publicado: (2026)
por: Chen, Xiwen, et al.
Publicado: (2026)
Unleashing Implicit Rewards: Prefix-Value Learning for Distribution-Level Optimization
por: Gao, Shiping, et al.
Publicado: (2026)
por: Gao, Shiping, et al.
Publicado: (2026)
AMR-Evol: Adaptive Modular Response Evolution Elicits Better Knowledge Distillation for Large Language Models in Code Generation
por: Luo, Ziyang, et al.
Publicado: (2024)
por: Luo, Ziyang, et al.
Publicado: (2024)
Knowledge Fusion of Large Language Models
por: Wan, Fanqi, et al.
Publicado: (2024)
por: Wan, Fanqi, et al.
Publicado: (2024)
Self-Evolution Fine-Tuning for Policy Optimization
por: Chen, Ruijun, et al.
Publicado: (2024)
por: Chen, Ruijun, et al.
Publicado: (2024)
A Survey on Knowledge Distillation of Large Language Models
por: Xu, Xiaohan, et al.
Publicado: (2024)
por: Xu, Xiaohan, et al.
Publicado: (2024)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
por: Xing, Wang, et al.
Publicado: (2026)
por: Xing, Wang, et al.
Publicado: (2026)
Distilling Rule-based Knowledge into Large Language Models
por: Yang, Wenkai, et al.
Publicado: (2023)
por: Yang, Wenkai, et al.
Publicado: (2023)
Dual-Space Knowledge Distillation for Large Language Models
por: Zhang, Songming, et al.
Publicado: (2024)
por: Zhang, Songming, et al.
Publicado: (2024)
Cool-Fusion: Fuse Large Language Models without Training
por: Liu, Cong, et al.
Publicado: (2024)
por: Liu, Cong, et al.
Publicado: (2024)
Test-time Backdoor Mitigation for Black-Box Large Language Models with Defensive Demonstrations
por: Mo, Wenjie, et al.
Publicado: (2023)
por: Mo, Wenjie, et al.
Publicado: (2023)
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
por: Yang, Chuanpeng, et al.
Publicado: (2024)
por: Yang, Chuanpeng, et al.
Publicado: (2024)
FedDTPT: Federated Discrete and Transferable Prompt Tuning for Black-Box Large Language Models
por: Wu, Jiaqi, et al.
Publicado: (2024)
por: Wu, Jiaqi, et al.
Publicado: (2024)
Advantage-Guided Distillation for Preference Alignment in Small Language Models
por: Gao, Shiping, et al.
Publicado: (2025)
por: Gao, Shiping, et al.
Publicado: (2025)
Direct Preference Knowledge Distillation for Large Language Models
por: Li, Yixing, et al.
Publicado: (2024)
por: Li, Yixing, et al.
Publicado: (2024)
Contextualization Distillation from Large Language Model for Knowledge Graph Completion
por: Li, Dawei, et al.
Publicado: (2024)
por: Li, Dawei, et al.
Publicado: (2024)
Stabilizing Policy Optimization via Logits Convexity
por: Chen, Hongzhan, et al.
Publicado: (2026)
por: Chen, Hongzhan, et al.
Publicado: (2026)
Instruct Large Language Models to Drive like Humans
por: Zhang, Ruijun, et al.
Publicado: (2024)
por: Zhang, Ruijun, et al.
Publicado: (2024)
CrossTune: Black-Box Few-Shot Classification with Label Enhancement
por: Luo, Danqing, et al.
Publicado: (2024)
por: Luo, Danqing, et al.
Publicado: (2024)
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
por: Yang, Junjie, et al.
Publicado: (2025)
por: Yang, Junjie, et al.
Publicado: (2025)
Beyond the Black Box: A Survey on the Theory and Mechanism of Large Language Models
por: Gan, Zeyu, et al.
Publicado: (2026)
por: Gan, Zeyu, et al.
Publicado: (2026)
MT-PATCHER: Selective and Extendable Knowledge Distillation from Large Language Models for Machine Translation
por: Li, Jiahuan, et al.
Publicado: (2024)
por: Li, Jiahuan, et al.
Publicado: (2024)
mPLUG-PaperOwl: Scientific Diagram Analysis with the Multimodal Large Language Model
por: Hu, Anwen, et al.
Publicado: (2023)
por: Hu, Anwen, et al.
Publicado: (2023)
Evaluating, Understanding, and Improving Constrained Text Generation for Large Language Models
por: Chen, Xiang, et al.
Publicado: (2023)
por: Chen, Xiang, et al.
Publicado: (2023)
DDK: Distilling Domain Knowledge for Efficient Large Language Models
por: Liu, Jiaheng, et al.
Publicado: (2024)
por: Liu, Jiaheng, et al.
Publicado: (2024)
Benchmarking Knowledge Boundary for Large Language Models: A Different Perspective on Model Evaluation
por: Yin, Xunjian, et al.
Publicado: (2024)
por: Yin, Xunjian, et al.
Publicado: (2024)
RPM: Reasoning-Level Personalization for Black-Box Large Language Models
por: Kim, Jieyong, et al.
Publicado: (2025)
por: Kim, Jieyong, et al.
Publicado: (2025)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
por: Wang, Chengyu, et al.
Publicado: (2025)
por: Wang, Chengyu, et al.
Publicado: (2025)
LoKI: Low-damage Knowledge Implanting of Large Language Models
por: Wang, Runyu, et al.
Publicado: (2025)
por: Wang, Runyu, et al.
Publicado: (2025)
$B^4$: A Black-Box Scrubbing Attack on LLM Watermarks
por: Huang, Baizhou, et al.
Publicado: (2024)
por: Huang, Baizhou, et al.
Publicado: (2024)
Knowledge Overshadowing Causes Amalgamated Hallucination in Large Language Models
por: Zhang, Yuji, et al.
Publicado: (2024)
por: Zhang, Yuji, et al.
Publicado: (2024)
Ejemplares similares
-
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
por: Yang, Ziyi, et al.
Publicado: (2025) -
Small LLMs Are Weak Tool Learners: A Multi-LLM Agent
por: Shen, Weizhou, et al.
Publicado: (2024) -
BlockPruner: Fine-grained Pruning for Large Language Models
por: Zhong, Longguang, et al.
Publicado: (2024) -
Lookahead Routing for Large Language Models
por: Huang, Canbin, et al.
Publicado: (2025) -
Discriminative Policy Optimization for Token-Level Reward Models
por: Chen, Hongzhan, et al.
Publicado: (2025)