Layer Importance and Hallucination Analysis in Large Language Models via Enhanced Activation Variance-Sparsity
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Zichen, Huang, Sitan, Wu, Yuxin, Kang, Zhongfeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AVSS: Layer Importance Evaluation in Large Language Models via Activation Variance-Sparsity Analysis
di: Song, Zichen, et al.
Pubblicazione: (2024)
di: Song, Zichen, et al.
Pubblicazione: (2024)
EM-MIAs: Enhancing Membership Inference Attacks in Large Language Models through Ensemble Modeling
di: Song, Zichen, et al.
Pubblicazione: (2024)
di: Song, Zichen, et al.
Pubblicazione: (2024)
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024)
di: Yu, Linhao, et al.
Pubblicazione: (2024)
Green AI: Exploring Carbon Footprints, Mitigation Strategies, and Trade Offs in Large Language Model Training
di: Liu, Vivian, et al.
Pubblicazione: (2024)
di: Liu, Vivian, et al.
Pubblicazione: (2024)
SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token
di: Ma, Ming, et al.
Pubblicazione: (2025)
di: Ma, Ming, et al.
Pubblicazione: (2025)
Iterative Layer Pruning for Efficient Translation Inference
di: Moslem, Yasmin, et al.
Pubblicazione: (2025)
di: Moslem, Yasmin, et al.
Pubblicazione: (2025)
Priority Sampling of Large Language Models for Compilers
di: Grubisic, Dejan, et al.
Pubblicazione: (2024)
di: Grubisic, Dejan, et al.
Pubblicazione: (2024)
Enhancing Inference Efficiency of Large Language Models: Investigating Optimization Strategies and Architectural Innovations
di: Tyukin, Georgy
Pubblicazione: (2024)
di: Tyukin, Georgy
Pubblicazione: (2024)
LOOPRAG: Enhancing Loop Transformation Optimization with Retrieval-Augmented Large Language Models
di: Zhi, Yijie, et al.
Pubblicazione: (2025)
di: Zhi, Yijie, et al.
Pubblicazione: (2025)
Model Compression and Efficient Inference for Large Language Models: A Survey
di: Wang, Wenxiao, et al.
Pubblicazione: (2024)
di: Wang, Wenxiao, et al.
Pubblicazione: (2024)
SuperCoder: Assembly Program Superoptimization with Large Language Models
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Data Efficacy for Language Model Training
di: Dai, Yalun, et al.
Pubblicazione: (2025)
di: Dai, Yalun, et al.
Pubblicazione: (2025)
EPIC: Efficient Position-Independent Caching for Serving Large Language Models
di: Hu, Junhao, et al.
Pubblicazione: (2024)
di: Hu, Junhao, et al.
Pubblicazione: (2024)
SLM-Bench: A Comprehensive Benchmark of Small Language Models on Environmental Impacts--Extended Version
di: Pham, Nghiem Thanh, et al.
Pubblicazione: (2025)
di: Pham, Nghiem Thanh, et al.
Pubblicazione: (2025)
VL-Cache: Sparsity and Modality-Aware KV Cache Compression for Vision-Language Model Inference Acceleration
di: Tu, Dezhan, et al.
Pubblicazione: (2024)
di: Tu, Dezhan, et al.
Pubblicazione: (2024)
Systematic Evaluation of Optimization Techniques for Long-Context Language Models
di: Ahmed, Ammar, et al.
Pubblicazione: (2025)
di: Ahmed, Ammar, et al.
Pubblicazione: (2025)
KG-EDAS: A Meta-Metric Framework for Evaluating Knowledge Graph Completion Models
di: Gul, Haji, et al.
Pubblicazione: (2025)
di: Gul, Haji, et al.
Pubblicazione: (2025)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
di: Zheng, Wenhao, et al.
Pubblicazione: (2025)
di: Zheng, Wenhao, et al.
Pubblicazione: (2025)
ALISA: Accelerating Large Language Model Inference via Sparsity-Aware KV Caching
di: Zhao, Youpeng, et al.
Pubblicazione: (2024)
di: Zhao, Youpeng, et al.
Pubblicazione: (2024)
Regression Language Models for Code
di: Akhauri, Yash, et al.
Pubblicazione: (2025)
di: Akhauri, Yash, et al.
Pubblicazione: (2025)
L1RA: Dynamic Rank Assignment in LoRA Fine-Tuning
di: Singh, Raul, et al.
Pubblicazione: (2025)
di: Singh, Raul, et al.
Pubblicazione: (2025)
Beyond Tokens: Semantic-Aware Speculative Decoding for Efficient Inference by Probing Internal States
di: Dong, Ximing, et al.
Pubblicazione: (2026)
di: Dong, Ximing, et al.
Pubblicazione: (2026)
ActTail: Global Activation Sparsity in Large Language Models
di: Hou, Wenwen, et al.
Pubblicazione: (2026)
di: Hou, Wenwen, et al.
Pubblicazione: (2026)
Investigating Execution-Aware Language Models for Code Optimization
di: Di Menna, Federico, et al.
Pubblicazione: (2025)
di: Di Menna, Federico, et al.
Pubblicazione: (2025)
DyLLM: Efficient Diffusion LLM Inference via Saliency-based Token Selection and Partial Attention
di: Lee, Younjoo, et al.
Pubblicazione: (2026)
di: Lee, Younjoo, et al.
Pubblicazione: (2026)
Evaluating the Efficacy of Foundational Models: Advancing Benchmarking Practices to Enhance Fine-Tuning Decision-Making
di: Amujo, Oluyemi Enoch, et al.
Pubblicazione: (2024)
di: Amujo, Oluyemi Enoch, et al.
Pubblicazione: (2024)
Developing a Modular Compiler for a Subset of a C-like Language
di: Dutta, Debasish, et al.
Pubblicazione: (2025)
di: Dutta, Debasish, et al.
Pubblicazione: (2025)
DeepSeek-R1 Outperforms Gemini 2.0 Pro, OpenAI o1, and o3-mini in Bilingual Complex Ophthalmology Reasoning
di: Xu, Pusheng, et al.
Pubblicazione: (2025)
di: Xu, Pusheng, et al.
Pubblicazione: (2025)
SparseInfer: Training-free Prediction of Activation Sparsity for Fast LLM Inference
di: Shin, Jiho, et al.
Pubblicazione: (2024)
di: Shin, Jiho, et al.
Pubblicazione: (2024)
TeleEval-OS: Performance evaluations of large language models for operations scheduling
di: Wang, Yanyan, et al.
Pubblicazione: (2025)
di: Wang, Yanyan, et al.
Pubblicazione: (2025)
MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
di: Zhao, Qihao, et al.
Pubblicazione: (2024)
di: Zhao, Qihao, et al.
Pubblicazione: (2024)
Hold Onto That Thought: Assessing KV Cache Compression On Reasoning
di: Liu, Minghui, et al.
Pubblicazione: (2025)
di: Liu, Minghui, et al.
Pubblicazione: (2025)
PEVLM: Parallel Encoding for Vision-Language Models
di: Kang, Letian, et al.
Pubblicazione: (2025)
di: Kang, Letian, et al.
Pubblicazione: (2025)
Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey
di: Moslem, Yasmin, et al.
Pubblicazione: (2026)
di: Moslem, Yasmin, et al.
Pubblicazione: (2026)
Quamba2: A Robust and Scalable Post-training Quantization Framework for Selective State Space Models
di: Chiang, Hung-Yueh, et al.
Pubblicazione: (2025)
di: Chiang, Hung-Yueh, et al.
Pubblicazione: (2025)
Scheduling Languages: A Past, Present, and Future Taxonomy
di: Hall, Mary, et al.
Pubblicazione: (2024)
di: Hall, Mary, et al.
Pubblicazione: (2024)
Comparing Parallel Functional Array Languages: Programming and Performance
di: van Balen, David, et al.
Pubblicazione: (2025)
di: van Balen, David, et al.
Pubblicazione: (2025)
Iterating Pointers: Enabling Static Analysis for Loop-based Pointers
di: Lepori, Andrea, et al.
Pubblicazione: (2025)
di: Lepori, Andrea, et al.
Pubblicazione: (2025)
Training-Free Activation Sparsity in Large Language Models
di: Liu, James, et al.
Pubblicazione: (2024)
di: Liu, James, et al.
Pubblicazione: (2024)
LEGO: A Layout Expression Language for Code Generation of Hierarchical Mapping
di: Tavakkoli, Amir Mohammad, et al.
Pubblicazione: (2025)
di: Tavakkoli, Amir Mohammad, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AVSS: Layer Importance Evaluation in Large Language Models via Activation Variance-Sparsity Analysis
di: Song, Zichen, et al.
Pubblicazione: (2024) -
EM-MIAs: Enhancing Membership Inference Attacks in Large Language Models through Ensemble Modeling
di: Song, Zichen, et al.
Pubblicazione: (2024) -
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024) -
Green AI: Exploring Carbon Footprints, Mitigation Strategies, and Trade Offs in Large Language Model Training
di: Liu, Vivian, et al.
Pubblicazione: (2024) -
SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token
di: Ma, Ming, et al.
Pubblicazione: (2025)