Guardado en:
| Autores principales: | Miao, Ruijie, Yan, Yihan, Yao, Xinshuo, Yang, Tong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2407.20272 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Delta Knowledge Distillation for Large Language Models
por: Cao, Yihan, et al.
Publicado: (2025)
por: Cao, Yihan, et al.
Publicado: (2025)
Scaling Inference-Efficient Language Models
por: Bian, Song, et al.
Publicado: (2025)
por: Bian, Song, et al.
Publicado: (2025)
Benchmarking Benchmark Leakage in Large Language Models
por: Xu, Ruijie, et al.
Publicado: (2024)
por: Xu, Ruijie, et al.
Publicado: (2024)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
por: Zhang, Songming, et al.
Publicado: (2026)
por: Zhang, Songming, et al.
Publicado: (2026)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)
por: Cao, Yihan, et al.
Publicado: (2023)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
por: Zheng, Wenhao, et al.
Publicado: (2025)
por: Zheng, Wenhao, et al.
Publicado: (2025)
OpenELM: An Efficient Language Model Family with Open Training and Inference Framework
por: Mehta, Sachin, et al.
Publicado: (2024)
por: Mehta, Sachin, et al.
Publicado: (2024)
Large Language Model Unlearning
por: Yao, Yuanshun, et al.
Publicado: (2023)
por: Yao, Yuanshun, et al.
Publicado: (2023)
Athena: Efficient Block-Wise Post-Training Quantization for Large Language Models Using Second-Order Matrix Derivative Information
por: Wang, Yanshu, et al.
Publicado: (2024)
por: Wang, Yanshu, et al.
Publicado: (2024)
LLM in a flash: Efficient Large Language Model Inference with Limited Memory
por: Alizadeh, Keivan, et al.
Publicado: (2023)
por: Alizadeh, Keivan, et al.
Publicado: (2023)
Model Compression and Efficient Inference for Large Language Models: A Survey
por: Wang, Wenxiao, et al.
Publicado: (2024)
por: Wang, Wenxiao, et al.
Publicado: (2024)
I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models
por: Hu, Xing, et al.
Publicado: (2024)
por: Hu, Xing, et al.
Publicado: (2024)
Pretraining Data Exposure in Large Language Models: A Survey of Membership Inference, Data Contamination, and Security Implications
por: Tong, Ziyi, et al.
Publicado: (2026)
por: Tong, Ziyi, et al.
Publicado: (2026)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
Rethinking Data Mixing from the Perspective of Large Language Models
por: Xu, Yuanjian, et al.
Publicado: (2026)
por: Xu, Yuanjian, et al.
Publicado: (2026)
Sliding Window Attention Training for Efficient Large Language Models
por: Fu, Zichuan, et al.
Publicado: (2025)
por: Fu, Zichuan, et al.
Publicado: (2025)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
por: Bhatt, Gantavya, et al.
Publicado: (2024)
por: Bhatt, Gantavya, et al.
Publicado: (2024)
FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models
por: Weng, Zixuan, et al.
Publicado: (2026)
por: Weng, Zixuan, et al.
Publicado: (2026)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
A Systematic Survey on Large Language Models for Algorithm Design
por: Liu, Fei, et al.
Publicado: (2024)
por: Liu, Fei, et al.
Publicado: (2024)
Efficient Non-Parametric Uncertainty Quantification for Black-Box Large Language Models and Decision Planning
por: Tsai, Yao-Hung Hubert, et al.
Publicado: (2024)
por: Tsai, Yao-Hung Hubert, et al.
Publicado: (2024)
Upcycling Large Language Models into Mixture of Experts
por: He, Ethan, et al.
Publicado: (2024)
por: He, Ethan, et al.
Publicado: (2024)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
por: Liu, Jing, et al.
Publicado: (2024)
por: Liu, Jing, et al.
Publicado: (2024)
CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
por: Dai, Runpeng, et al.
Publicado: (2025)
por: Dai, Runpeng, et al.
Publicado: (2025)
Revisiting In-context Learning Inference Circuit in Large Language Models
por: Cho, Hakaze, et al.
Publicado: (2024)
por: Cho, Hakaze, et al.
Publicado: (2024)
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
por: Yang, Runming, et al.
Publicado: (2024)
por: Yang, Runming, et al.
Publicado: (2024)
KIEval: A Knowledge-grounded Interactive Evaluation Framework for Large Language Models
por: Yu, Zhuohao, et al.
Publicado: (2024)
por: Yu, Zhuohao, et al.
Publicado: (2024)
Efficient Deployment of Large Language Models on Resource-constrained Devices
por: Yao, Zhiwei, et al.
Publicado: (2025)
por: Yao, Zhiwei, et al.
Publicado: (2025)
CORM: Cache Optimization with Recent Message for Large Language Model Inference
por: Dai, Jincheng, et al.
Publicado: (2024)
por: Dai, Jincheng, et al.
Publicado: (2024)
FlattenQuant: Breaking Through the Inference Compute-bound for Large Language Models with Per-tensor Quantization
por: Zhang, Yi, et al.
Publicado: (2024)
por: Zhang, Yi, et al.
Publicado: (2024)
EfficientLLM: Efficiency in Large Language Models
por: Yuan, Zhengqing, et al.
Publicado: (2025)
por: Yuan, Zhengqing, et al.
Publicado: (2025)
ConsistentEE: A Consistent and Hardness-Guided Early Exiting Method for Accelerating Language Models Inference
por: Zeng, Ziqian, et al.
Publicado: (2023)
por: Zeng, Ziqian, et al.
Publicado: (2023)
Leveraging Large Language Models with Chain-of-Thought and Prompt Engineering for Traffic Crash Severity Analysis and Inference
por: Zhen, Hao, et al.
Publicado: (2024)
por: Zhen, Hao, et al.
Publicado: (2024)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
Optimizing Temperature for Language Models with Multi-Sample Inference
por: Du, Weihua, et al.
Publicado: (2025)
por: Du, Weihua, et al.
Publicado: (2025)
DivLogicEval: A Framework for Benchmarking Logical Reasoning Evaluation in Large Language Models
por: Chung, Tsz Ting, et al.
Publicado: (2025)
por: Chung, Tsz Ting, et al.
Publicado: (2025)
Extracting Training Data from Diffusion Language Models via Infilling
por: Wang, Yihan, et al.
Publicado: (2026)
por: Wang, Yihan, et al.
Publicado: (2026)
Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
por: Liang, Jing, et al.
Publicado: (2025)
por: Liang, Jing, et al.
Publicado: (2025)
Language-Image Models with 3D Understanding
por: Cho, Jang Hyun, et al.
Publicado: (2024)
por: Cho, Jang Hyun, et al.
Publicado: (2024)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
por: Chen, Mengzhao, et al.
Publicado: (2024)
por: Chen, Mengzhao, et al.
Publicado: (2024)
Ejemplares similares
-
Delta Knowledge Distillation for Large Language Models
por: Cao, Yihan, et al.
Publicado: (2025) -
Scaling Inference-Efficient Language Models
por: Bian, Song, et al.
Publicado: (2025) -
Benchmarking Benchmark Leakage in Large Language Models
por: Xu, Ruijie, et al.
Publicado: (2024) -
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
por: Zhang, Songming, et al.
Publicado: (2026) -
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)