Green Prompting: Characterizing Prompt-driven Energy Costs of LLM Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Adamska, Marta, Smirnova, Daria, Nasiri, Hamid, Yu, Zhengxin, Garraghan, Peter |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cost-Aware Model Orchestration for LLM-based Systems
par: Smirnova, Daria, et autres
Publié: (2025)
par: Smirnova, Daria, et autres
Publié: (2025)
EDoRA: Efficient Weight-Decomposed Low-Rank Adaptation via Singular Value Decomposition
par: Nasiri, Hamid, et autres
Publié: (2025)
par: Nasiri, Hamid, et autres
Publié: (2025)
PromptIntern: Saving Inference Costs by Internalizing Recurrent Prompt during Large Language Model Fine-tuning
par: Zou, Jiaru, et autres
Publié: (2024)
par: Zou, Jiaru, et autres
Publié: (2024)
DPIC: Decoupling Prompt and Intrinsic Characteristics for LLM Generated Text Detection
par: Yu, Xiao, et autres
Publié: (2023)
par: Yu, Xiao, et autres
Publié: (2023)
CAPO: Cost-Aware Prompt Optimization
par: Zehle, Tom, et autres
Publié: (2025)
par: Zehle, Tom, et autres
Publié: (2025)
ProRefine: Inference-Time Prompt Refinement with Textual Feedback
par: Pandita, Deepak, et autres
Publié: (2025)
par: Pandita, Deepak, et autres
Publié: (2025)
Automatic Prompt Optimization with Prompt Distillation
par: Dyagin, Ernest A., et autres
Publié: (2025)
par: Dyagin, Ernest A., et autres
Publié: (2025)
Prompt Engineering a Prompt Engineer
par: Ye, Qinyuan, et autres
Publié: (2023)
par: Ye, Qinyuan, et autres
Publié: (2023)
Exploring LLM Reasoning Through Controlled Prompt Variations
par: Chatziveroglou, Giannis, et autres
Publié: (2025)
par: Chatziveroglou, Giannis, et autres
Publié: (2025)
Steer Like the LLM: Activation Steering that Mimics Prompting
par: Heyman, Geert, et autres
Publié: (2026)
par: Heyman, Geert, et autres
Publié: (2026)
Reprompting: Automated Chain-of-Thought Prompt Inference Through Gibbs Sampling
par: Xu, Weijia, et autres
Publié: (2023)
par: Xu, Weijia, et autres
Publié: (2023)
No Prompt Left Behind: Exploiting Zero-Variance Prompts in LLM Reinforcement Learning via Entropy-Guided Advantage Shaping
par: Le, Thanh-Long V., et autres
Publié: (2025)
par: Le, Thanh-Long V., et autres
Publié: (2025)
Prompt-SAW: Leveraging Relation-Aware Graphs for Textual Prompt Compression
par: Ali, Muhammad Asif, et autres
Publié: (2024)
par: Ali, Muhammad Asif, et autres
Publié: (2024)
Enhancing LLM Agent Safety via Causal Influence Prompting
par: Hahm, Dongyoon, et autres
Publié: (2025)
par: Hahm, Dongyoon, et autres
Publié: (2025)
Prompt-prompted Adaptive Structured Pruning for Efficient LLM Generation
par: Dong, Harry, et autres
Publié: (2024)
par: Dong, Harry, et autres
Publié: (2024)
DynaPrompt: Dynamic Test-Time Prompt Tuning
par: Xiao, Zehao, et autres
Publié: (2025)
par: Xiao, Zehao, et autres
Publié: (2025)
PromptWizard: Task-Aware Prompt Optimization Framework
par: Agarwal, Eshaan, et autres
Publié: (2024)
par: Agarwal, Eshaan, et autres
Publié: (2024)
CP-Prompt: Composition-Based Cross-modal Prompting for Domain-Incremental Continual Learning
par: Feng, Yu, et autres
Publié: (2024)
par: Feng, Yu, et autres
Publié: (2024)
Better LLM Reasoning via Dual-Play
par: Zhang, Zhengxin, et autres
Publié: (2025)
par: Zhang, Zhengxin, et autres
Publié: (2025)
You Don't Need Prompt Engineering Anymore: The Prompting Inversion
par: Khan, Imran
Publié: (2025)
par: Khan, Imran
Publié: (2025)
Efficient Prompt Tuning by Multi-Space Projection and Prompt Fusion
par: Lan, Pengxiang, et autres
Publié: (2024)
par: Lan, Pengxiang, et autres
Publié: (2024)
Self-Supervised Prompt Optimization
par: Xiang, Jinyu, et autres
Publié: (2025)
par: Xiang, Jinyu, et autres
Publié: (2025)
Salient Information Prompting to Steer Content in Prompt-based Abstractive Summarization
par: Xu, Lei, et autres
Publié: (2024)
par: Xu, Lei, et autres
Publié: (2024)
Prompting Test-Time Scaling Is A Strong LLM Reasoning Data Augmentation
par: Bsharat, Sondos Mahmoud, et autres
Publié: (2025)
par: Bsharat, Sondos Mahmoud, et autres
Publié: (2025)
Fine-Tune an SLM or Prompt an LLM? The Case of Generating Low-Code Workflows
par: Ayala, Orlando Marquez, et autres
Publié: (2025)
par: Ayala, Orlando Marquez, et autres
Publié: (2025)
CliqueParcel: An Approach For Batching LLM Prompts That Jointly Optimizes Efficiency And Faithfulness
par: Liu, Jiayi, et autres
Publié: (2024)
par: Liu, Jiayi, et autres
Publié: (2024)
Local Prompt Optimization
par: Jain, Yash, et autres
Publié: (2025)
par: Jain, Yash, et autres
Publié: (2025)
Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)
par: Ajwani, Rohan Deepak, et autres
Publié: (2024)
Hard Prompts Made Interpretable: Sparse Entropy Regularization for Prompt Tuning with RL
par: Choi, Yunseon, et autres
Publié: (2024)
par: Choi, Yunseon, et autres
Publié: (2024)
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
par: Chen, Weizhe, et autres
Publié: (2024)
par: Chen, Weizhe, et autres
Publié: (2024)
Effective Structured Prompting by Meta-Learning and Representative Verbalizer
par: Jiang, Weisen, et autres
Publié: (2023)
par: Jiang, Weisen, et autres
Publié: (2023)
Selective Prompting Tuning for Personalized Conversations with LLMs
par: Huang, Qiushi, et autres
Publié: (2024)
par: Huang, Qiushi, et autres
Publié: (2024)
Learning to Compress Prompt in Natural Language Formats
par: Chuang, Yu-Neng, et autres
Publié: (2024)
par: Chuang, Yu-Neng, et autres
Publié: (2024)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
par: Pecher, Branislav, et autres
Publié: (2026)
par: Pecher, Branislav, et autres
Publié: (2026)
Certifying LLM Safety against Adversarial Prompting
par: Kumar, Aounon, et autres
Publié: (2023)
par: Kumar, Aounon, et autres
Publié: (2023)
Maximizing Mutual Information Between Prompt and Response Improves LLM Performance With No Additional Data
par: Nam, Hyunji, et autres
Publié: (2026)
par: Nam, Hyunji, et autres
Publié: (2026)
Enhancing LLM Problem Solving with REAP: Reflection, Explicit Problem Deconstruction, and Advanced Prompting
par: Lingo, Ryan, et autres
Publié: (2024)
par: Lingo, Ryan, et autres
Publié: (2024)
Leveraging Large Language Models with Chain-of-Thought and Prompt Engineering for Traffic Crash Severity Analysis and Inference
par: Zhen, Hao, et autres
Publié: (2024)
par: Zhen, Hao, et autres
Publié: (2024)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
par: Kim, Gyeongman, et autres
Publié: (2024)
par: Kim, Gyeongman, et autres
Publié: (2024)
PREMISE: Scalable and Strategic Prompt Optimization for Efficient Mathematical Reasoning in Large Models
par: Yu, Ye, et autres
Publié: (2025)
par: Yu, Ye, et autres
Publié: (2025)
Documents similaires
-
Cost-Aware Model Orchestration for LLM-based Systems
par: Smirnova, Daria, et autres
Publié: (2025) -
EDoRA: Efficient Weight-Decomposed Low-Rank Adaptation via Singular Value Decomposition
par: Nasiri, Hamid, et autres
Publié: (2025) -
PromptIntern: Saving Inference Costs by Internalizing Recurrent Prompt during Large Language Model Fine-tuning
par: Zou, Jiaru, et autres
Publié: (2024) -
DPIC: Decoupling Prompt and Intrinsic Characteristics for LLM Generated Text Detection
par: Yu, Xiao, et autres
Publié: (2023) -
CAPO: Cost-Aware Prompt Optimization
par: Zehle, Tom, et autres
Publié: (2025)