Green AI: Exploring Carbon Footprints, Mitigation Strategies, and Trade Offs in Large Language Model Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Vivian, Yin, Yiqiao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
par: Yu, Linhao, et autres
Publié: (2024)
par: Yu, Linhao, et autres
Publié: (2024)
Layer Importance and Hallucination Analysis in Large Language Models via Enhanced Activation Variance-Sparsity
par: Song, Zichen, et autres
Publié: (2024)
par: Song, Zichen, et autres
Publié: (2024)
SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token
par: Ma, Ming, et autres
Publié: (2025)
par: Ma, Ming, et autres
Publié: (2025)
Priority Sampling of Large Language Models for Compilers
par: Grubisic, Dejan, et autres
Publié: (2024)
par: Grubisic, Dejan, et autres
Publié: (2024)
Enhancing Inference Efficiency of Large Language Models: Investigating Optimization Strategies and Architectural Innovations
par: Tyukin, Georgy
Publié: (2024)
par: Tyukin, Georgy
Publié: (2024)
Data Efficacy for Language Model Training
par: Dai, Yalun, et autres
Publié: (2025)
par: Dai, Yalun, et autres
Publié: (2025)
Systematic Evaluation of Optimization Techniques for Long-Context Language Models
par: Ahmed, Ammar, et autres
Publié: (2025)
par: Ahmed, Ammar, et autres
Publié: (2025)
It's Not Easy Being Green: On the Energy Efficiency of Programming Languages
par: van Kempen, Nicolas, et autres
Publié: (2024)
par: van Kempen, Nicolas, et autres
Publié: (2024)
Model Compression and Efficient Inference for Large Language Models: A Survey
par: Wang, Wenxiao, et autres
Publié: (2024)
par: Wang, Wenxiao, et autres
Publié: (2024)
SuperCoder: Assembly Program Superoptimization with Large Language Models
par: Wei, Anjiang, et autres
Publié: (2025)
par: Wei, Anjiang, et autres
Publié: (2025)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
par: Zheng, Wenhao, et autres
Publié: (2025)
par: Zheng, Wenhao, et autres
Publié: (2025)
SLM-Bench: A Comprehensive Benchmark of Small Language Models on Environmental Impacts--Extended Version
par: Pham, Nghiem Thanh, et autres
Publié: (2025)
par: Pham, Nghiem Thanh, et autres
Publié: (2025)
Exploring Safety-Utility Trade-Offs in Personalized Language Models
par: Vijjini, Anvesh Rao, et autres
Publié: (2024)
par: Vijjini, Anvesh Rao, et autres
Publié: (2024)
KG-EDAS: A Meta-Metric Framework for Evaluating Knowledge Graph Completion Models
par: Gul, Haji, et autres
Publié: (2025)
par: Gul, Haji, et autres
Publié: (2025)
Serving Chain-structured Jobs with Large Memory Footprints with Application to Large Foundation Model Serving
par: Sun, Tingyang, et autres
Publié: (2026)
par: Sun, Tingyang, et autres
Publié: (2026)
EPIC: Efficient Position-Independent Caching for Serving Large Language Models
par: Hu, Junhao, et autres
Publié: (2024)
par: Hu, Junhao, et autres
Publié: (2024)
Can We Make Code Green? Understanding Trade-Offs in LLMs vs. Human Code Optimizations
par: Rani, Pooja, et autres
Publié: (2025)
par: Rani, Pooja, et autres
Publié: (2025)
Iterative Layer Pruning for Efficient Translation Inference
par: Moslem, Yasmin, et autres
Publié: (2025)
par: Moslem, Yasmin, et autres
Publié: (2025)
L1RA: Dynamic Rank Assignment in LoRA Fine-Tuning
par: Singh, Raul, et autres
Publié: (2025)
par: Singh, Raul, et autres
Publié: (2025)
Beyond Tokens: Semantic-Aware Speculative Decoding for Efficient Inference by Probing Internal States
par: Dong, Ximing, et autres
Publié: (2026)
par: Dong, Ximing, et autres
Publié: (2026)
The Sunk Carbon Fallacy: Rethinking Carbon Footprint Metrics for Effective Carbon-Aware Scheduling
par: Bashir, Noman, et autres
Publié: (2024)
par: Bashir, Noman, et autres
Publié: (2024)
Metrics and evaluations for computational and sustainable AI efficiency
par: Liu, Hongyuan, et autres
Publié: (2025)
par: Liu, Hongyuan, et autres
Publié: (2025)
TeleEval-OS: Performance evaluations of large language models for operations scheduling
par: Wang, Yanyan, et autres
Publié: (2025)
par: Wang, Yanyan, et autres
Publié: (2025)
DeepSeek-R1 Outperforms Gemini 2.0 Pro, OpenAI o1, and o3-mini in Bilingual Complex Ophthalmology Reasoning
par: Xu, Pusheng, et autres
Publié: (2025)
par: Xu, Pusheng, et autres
Publié: (2025)
LOOPRAG: Enhancing Loop Transformation Optimization with Retrieval-Augmented Large Language Models
par: Zhi, Yijie, et autres
Publié: (2025)
par: Zhi, Yijie, et autres
Publié: (2025)
Investigating Execution-Aware Language Models for Code Optimization
par: Di Menna, Federico, et autres
Publié: (2025)
par: Di Menna, Federico, et autres
Publié: (2025)
MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
par: Zhao, Qihao, et autres
Publié: (2024)
par: Zhao, Qihao, et autres
Publié: (2024)
Runtime Repeated Recursion Unfolding in CHR: A Just-In-Time Online Program Optimization Strategy That Can Achieve Super-Linear Speedup
par: Fruehwirth, Thom
Publié: (2023)
par: Fruehwirth, Thom
Publié: (2023)
Developing a Modular Compiler for a Subset of a C-like Language
par: Dutta, Debasish, et autres
Publié: (2025)
par: Dutta, Debasish, et autres
Publié: (2025)
KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache
par: Liu, Zirui, et autres
Publié: (2024)
par: Liu, Zirui, et autres
Publié: (2024)
Hold Onto That Thought: Assessing KV Cache Compression On Reasoning
par: Liu, Minghui, et autres
Publié: (2025)
par: Liu, Minghui, et autres
Publié: (2025)
Regression Language Models for Code
par: Akhauri, Yash, et autres
Publié: (2025)
par: Akhauri, Yash, et autres
Publié: (2025)
Energy-Aware LLMs: A step towards sustainable AI for downstream applications
par: Tran, Nguyen Phuc, et autres
Publié: (2025)
par: Tran, Nguyen Phuc, et autres
Publié: (2025)
Exploring the Trade-Offs: Quantization Methods, Task Difficulty, and Model Size in Large Language Models From Edge to Giant
par: Lee, Jemin, et autres
Publié: (2024)
par: Lee, Jemin, et autres
Publié: (2024)
OPTIMA: Design-Space Exploration of Discharge-Based In-SRAM Computing: Quantifying Energy-Accuracy Trade-Offs
par: Seyedfaraji, Saeed, et autres
Publié: (2024)
par: Seyedfaraji, Saeed, et autres
Publié: (2024)
Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey
par: Moslem, Yasmin, et autres
Publié: (2026)
par: Moslem, Yasmin, et autres
Publié: (2026)
Scheduling Languages: A Past, Present, and Future Taxonomy
par: Hall, Mary, et autres
Publié: (2024)
par: Hall, Mary, et autres
Publié: (2024)
Comparing Parallel Functional Array Languages: Programming and Performance
par: van Balen, David, et autres
Publié: (2025)
par: van Balen, David, et autres
Publié: (2025)
LEGO: A Layout Expression Language for Code Generation of Hierarchical Mapping
par: Tavakkoli, Amir Mohammad, et autres
Publié: (2025)
par: Tavakkoli, Amir Mohammad, et autres
Publié: (2025)
Performance Characterization of Expert Router for Scalable LLM Inference
par: Pichlmeier, Josef, et autres
Publié: (2024)
par: Pichlmeier, Josef, et autres
Publié: (2024)
Documents similaires
-
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
par: Yu, Linhao, et autres
Publié: (2024) -
Layer Importance and Hallucination Analysis in Large Language Models via Enhanced Activation Variance-Sparsity
par: Song, Zichen, et autres
Publié: (2024) -
SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token
par: Ma, Ming, et autres
Publié: (2025) -
Priority Sampling of Large Language Models for Compilers
par: Grubisic, Dejan, et autres
Publié: (2024) -
Enhancing Inference Efficiency of Large Language Models: Investigating Optimization Strategies and Architectural Innovations
par: Tyukin, Georgy
Publié: (2024)