Learning with Less: Knowledge Distillation from Large Language Models via Unlabeled Data
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Juanhui, Nag, Sreyashi, Liu, Hui, Tang, Xianfeng, Sarwar, Sheikh, Cui, Limeng, Gu, Hansu, Wang, Suhang, He, Qi, Tang, Jiliang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reasoning with Graphs: Structuring Implicit Knowledge to Enhance LLMs Reasoning
por: Han, Haoyu, et al.
Publicado: (2025)
por: Han, Haoyu, et al.
Publicado: (2025)
RRO: LLM Agent Optimization Through Rising Reward Trajectories
por: Wang, Zilong, et al.
Publicado: (2025)
por: Wang, Zilong, et al.
Publicado: (2025)
Hierarchical Query Classification in E-commerce Search
por: He, Bing, et al.
Publicado: (2024)
por: He, Bing, et al.
Publicado: (2024)
EcomScriptBench: A Multi-task Benchmark for E-commerce Script Planning via Step-wise Intention-Driven Product Association
por: Wang, Weiqi, et al.
Publicado: (2025)
por: Wang, Weiqi, et al.
Publicado: (2025)
Exploring Query Understanding for Amazon Product Search
por: Luo, Chen, et al.
Publicado: (2024)
por: Luo, Chen, et al.
Publicado: (2024)
REAPER: Reasoning based Retrieval Planning for Complex RAG Systems
por: Joshi, Ashutosh, et al.
Publicado: (2024)
por: Joshi, Ashutosh, et al.
Publicado: (2024)
Node-wise Filtering in Graph Neural Networks: A Mixture of Experts Approach
por: Han, Haoyu, et al.
Publicado: (2024)
por: Han, Haoyu, et al.
Publicado: (2024)
SimRAG: Self-Improving Retrieval-Augmented Generation for Adapting Large Language Models to Specialized Domains
por: Xu, Ran, et al.
Publicado: (2024)
por: Xu, Ran, et al.
Publicado: (2024)
TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
por: He, Pengfei, et al.
Publicado: (2025)
por: He, Pengfei, et al.
Publicado: (2025)
Query Brand Entity Linking in E-Commerce Search
por: Liu, Dong, et al.
Publicado: (2025)
por: Liu, Dong, et al.
Publicado: (2025)
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
por: Zhang, Xianren, et al.
Publicado: (2025)
por: Zhang, Xianren, et al.
Publicado: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
por: Cui, Yingqian, et al.
Publicado: (2025)
por: Cui, Yingqian, et al.
Publicado: (2025)
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
por: Cui, Yingqian, et al.
Publicado: (2025)
por: Cui, Yingqian, et al.
Publicado: (2025)
AgentA/B: Automated and Scalable Web A/BTesting with Interactive LLM Agents
por: Lu, Yuxuan, et al.
Publicado: (2025)
por: Lu, Yuxuan, et al.
Publicado: (2025)
A Theoretical Understanding of Chain-of-Thought: Coherent Reasoning and Error-Aware Demonstration
por: Cui, Yingqian, et al.
Publicado: (2024)
por: Cui, Yingqian, et al.
Publicado: (2024)
Bidirectional Knowledge Distillation for Enhancing Sequential Recommendation with Large Language Models
por: Wu, Jiongran, et al.
Publicado: (2025)
por: Wu, Jiongran, et al.
Publicado: (2025)
Mixture of Link Predictors on Graphs
por: Ma, Li, et al.
Publicado: (2024)
por: Ma, Li, et al.
Publicado: (2024)
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
por: He, Pengfei, et al.
Publicado: (2025)
por: He, Pengfei, et al.
Publicado: (2025)
Enhancing ID and Text Fusion via Alternative Training in Session-based Recommendation
por: Li, Juanhui, et al.
Publicado: (2024)
por: Li, Juanhui, et al.
Publicado: (2024)
Divide-Verify-Refine: Can LLMs Self-Align with Complex Instructions?
por: Zhang, Xianren, et al.
Publicado: (2024)
por: Zhang, Xianren, et al.
Publicado: (2024)
LPFormer: An Adaptive Graph Transformer for Link Prediction
por: Shomer, Harry, et al.
Publicado: (2023)
por: Shomer, Harry, et al.
Publicado: (2023)
Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language Models
por: Fu, Yu, et al.
Publicado: (2025)
por: Fu, Yu, et al.
Publicado: (2025)
Enhancing Graph Neural Networks with Limited Labeled Data by Actively Distilling Knowledge from Large Language Models
por: Li, Quan, et al.
Publicado: (2024)
por: Li, Quan, et al.
Publicado: (2024)
Catastrophic Failure of LLM Unlearning via Quantization
por: Zhang, Zhiwei, et al.
Publicado: (2024)
por: Zhang, Zhiwei, et al.
Publicado: (2024)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
por: Wang, Fali, et al.
Publicado: (2025)
por: Wang, Fali, et al.
Publicado: (2025)
MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution
por: Lin, Minhua, et al.
Publicado: (2026)
por: Lin, Minhua, et al.
Publicado: (2026)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
por: Lin, Minhua, et al.
Publicado: (2025)
por: Lin, Minhua, et al.
Publicado: (2025)
Revisiting Link Prediction: A Data Perspective
por: Mao, Haitao, et al.
Publicado: (2023)
por: Mao, Haitao, et al.
Publicado: (2023)
Data Poisoning for In-context Learning
por: He, Pengfei, et al.
Publicado: (2024)
por: He, Pengfei, et al.
Publicado: (2024)
IterAlign: Iterative Constitutional Alignment of Large Language Models
por: Chen, Xiusi, et al.
Publicado: (2024)
por: Chen, Xiusi, et al.
Publicado: (2024)
Cross-Modal Knowledge Distillation for Speech Large Language Models
por: Wang, Enzhi, et al.
Publicado: (2025)
por: Wang, Enzhi, et al.
Publicado: (2025)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
por: Li, Hang, et al.
Publicado: (2025)
por: Li, Hang, et al.
Publicado: (2025)
Less is More: Selective Reflection for Compatible and Efficient Knowledge Distillation in Large Language Models
por: Liu, Lingyuan, et al.
Publicado: (2025)
por: Liu, Lingyuan, et al.
Publicado: (2025)
Hybrid Data-Free Knowledge Distillation
por: Tang, Jialiang, et al.
Publicado: (2024)
por: Tang, Jialiang, et al.
Publicado: (2024)
Comprehensive Vulnerability Analysis is Necessary for Trustworthy LLM-MAS
por: He, Pengfei, et al.
Publicado: (2025)
por: He, Pengfei, et al.
Publicado: (2025)
Leveraging Unlabeled Audio-Visual Data in Speech Emotion Recognition using Knowledge Distillation
por: Pendyala, Varsha, et al.
Publicado: (2025)
por: Pendyala, Varsha, et al.
Publicado: (2025)
Content Knowledge Identification with Multi-Agent Large Language Models (LLMs)
por: Yang, Kaiqi, et al.
Publicado: (2024)
por: Yang, Kaiqi, et al.
Publicado: (2024)
m1: Unleash the Potential of Test-Time Scaling for Medical Reasoning with Large Language Models
por: Huang, Xiaoke, et al.
Publicado: (2025)
por: Huang, Xiaoke, et al.
Publicado: (2025)
Knowledge Tagging System on Math Questions via LLMs with Flexible Demonstration Retriever
por: Li, Hang, et al.
Publicado: (2024)
por: Li, Hang, et al.
Publicado: (2024)
Sharpness-Aware Data Poisoning Attack
por: He, Pengfei, et al.
Publicado: (2023)
por: He, Pengfei, et al.
Publicado: (2023)
Ejemplares similares
-
Reasoning with Graphs: Structuring Implicit Knowledge to Enhance LLMs Reasoning
por: Han, Haoyu, et al.
Publicado: (2025) -
RRO: LLM Agent Optimization Through Rising Reward Trajectories
por: Wang, Zilong, et al.
Publicado: (2025) -
Hierarchical Query Classification in E-commerce Search
por: He, Bing, et al.
Publicado: (2024) -
EcomScriptBench: A Multi-task Benchmark for E-commerce Script Planning via Step-wise Intention-Driven Product Association
por: Wang, Weiqi, et al.
Publicado: (2025) -
Exploring Query Understanding for Amazon Product Search
por: Luo, Chen, et al.
Publicado: (2024)