Saved in:
| Main Authors: | Donisch, Leo, Schacht, Sigurd, Lanquillon, Carsten |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2408.03130 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
eDIF: A European Deep Inference Fabric for Remote Interpretability of LLM
by: Guggenberger, Irma Heithoff. Marc, et al.
Published: (2025)
by: Guggenberger, Irma Heithoff. Marc, et al.
Published: (2025)
Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models
by: Barkur, Sudarshan Kamath, et al.
Published: (2025)
by: Barkur, Sudarshan Kamath, et al.
Published: (2025)
PHOENIX: Open-Source Language Adaption for Direct Preference Optimization
by: Uhlig, Matthias, et al.
Published: (2024)
by: Uhlig, Matthias, et al.
Published: (2024)
A Review of Common Online Speaker Diarization Methods
by: Aperdannier, Roman, et al.
Published: (2024)
by: Aperdannier, Roman, et al.
Published: (2024)
Systematic Evaluation of Online Speaker Diarization Systems Regarding their Latency
by: Aperdannier, Roman, et al.
Published: (2024)
by: Aperdannier, Roman, et al.
Published: (2024)
An approach to optimize inference of the DIART speaker diarization pipeline
by: Aperdannier, Roman, et al.
Published: (2024)
by: Aperdannier, Roman, et al.
Published: (2024)
Energy Considerations of Large Language Model Inference and Efficiency Optimizations
by: Fernandez, Jared, et al.
Published: (2025)
by: Fernandez, Jared, et al.
Published: (2025)
Challenges and Responses in the Practice of Large Language Models
by: Zhu, Hongyin
Published: (2024)
by: Zhu, Hongyin
Published: (2024)
Ethical Considerations of Large Language Models in Game Playing
by: Zhang, Qingquan, et al.
Published: (2025)
by: Zhang, Qingquan, et al.
Published: (2025)
An Active Inference Strategy for Prompting Reliable Responses from Large Language Models in Medical Practice
by: Shusterman, Roma, et al.
Published: (2024)
by: Shusterman, Roma, et al.
Published: (2024)
A Survey on Inference Engines for Large Language Models: Perspectives on Optimization and Efficiency
by: Park, Sihyeong, et al.
Published: (2025)
by: Park, Sihyeong, et al.
Published: (2025)
Enhancing Training Data Attribution for Large Language Models with Fitting Error Consideration
by: Wu, Kangxi, et al.
Published: (2024)
by: Wu, Kangxi, et al.
Published: (2024)
Lost in Inference: Rediscovering the Role of Natural Language Inference for Large Language Models
by: Madaan, Lovish, et al.
Published: (2024)
by: Madaan, Lovish, et al.
Published: (2024)
Scaling Up Summarization: Leveraging Large Language Models for Long Text Extractive Summarization
by: Hemamou, Léo, et al.
Published: (2024)
by: Hemamou, Léo, et al.
Published: (2024)
Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models
by: Mahmud, Saaduddin, et al.
Published: (2025)
by: Mahmud, Saaduddin, et al.
Published: (2025)
Merlin: Deterministic Byte-Exact Deduplication for Lossless Context Optimization in Large Language Model Inference
by: Schelpe, Sietse
Published: (2026)
by: Schelpe, Sietse
Published: (2026)
Grounding and Evaluation for Large Language Models: Practical Challenges and Lessons Learned (Survey)
by: Kenthapadi, Krishnaram, et al.
Published: (2024)
by: Kenthapadi, Krishnaram, et al.
Published: (2024)
CORM: Cache Optimization with Recent Message for Large Language Model Inference
by: Dai, Jincheng, et al.
Published: (2024)
by: Dai, Jincheng, et al.
Published: (2024)
Multilingual Jailbreak Challenges in Large Language Models
by: Deng, Yue, et al.
Published: (2023)
by: Deng, Yue, et al.
Published: (2023)
Query-OPT: Optimizing Inference of Large Language Models via Multi-Query Instructions in Meeting Summarization
by: Laskar, Md Tahmid Rahman, et al.
Published: (2024)
by: Laskar, Md Tahmid Rahman, et al.
Published: (2024)
DiffPO: Diffusion-styled Preference Optimization for Efficient Inference-Time Alignment of Large Language Models
by: Chen, Ruizhe, et al.
Published: (2025)
by: Chen, Ruizhe, et al.
Published: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
by: Kim, Hwichan, et al.
Published: (2024)
by: Kim, Hwichan, et al.
Published: (2024)
Explicit Inductive Inference using Large Language Models
by: Liu, Tianyang, et al.
Published: (2024)
by: Liu, Tianyang, et al.
Published: (2024)
Caveat Lector: Large Language Models in Legal Practice
by: Mik, Eliza
Published: (2024)
by: Mik, Eliza
Published: (2024)
Inference Acceleration for Large Language Models on CPUs
by: PS, Ditto, et al.
Published: (2024)
by: PS, Ditto, et al.
Published: (2024)
Code Simulation Challenges for Large Language Models
by: La Malfa, Emanuele, et al.
Published: (2024)
by: La Malfa, Emanuele, et al.
Published: (2024)
LLMs in Qualitative Research: Opportunities, Limitations, and Practical Considerations
by: Salgado, Henry, et al.
Published: (2026)
by: Salgado, Henry, et al.
Published: (2026)
Best Practices for Text Annotation with Large Language Models
by: Törnberg, Petter
Published: (2024)
by: Törnberg, Petter
Published: (2024)
Large Language Models as Search Engines: Societal Challenges
by: Sadeddine, Zacchary, et al.
Published: (2025)
by: Sadeddine, Zacchary, et al.
Published: (2025)
Large Language Models for Mathematical Reasoning: Progresses and Challenges
by: Ahn, Janice, et al.
Published: (2024)
by: Ahn, Janice, et al.
Published: (2024)
Efficient Tuning and Inference for Large Language Models on Textual Graphs
by: Zhu, Yun, et al.
Published: (2024)
by: Zhu, Yun, et al.
Published: (2024)
Task Calibration: Calibrating Large Language Models on Inference Tasks
by: Li, Yingjie, et al.
Published: (2024)
by: Li, Yingjie, et al.
Published: (2024)
Do Membership Inference Attacks Work on Large Language Models?
by: Duan, Michael, et al.
Published: (2024)
by: Duan, Michael, et al.
Published: (2024)
Structural Embedding Projection for Contextual Large Language Model Inference
by: Enoasmo, Vincent, et al.
Published: (2025)
by: Enoasmo, Vincent, et al.
Published: (2025)
TimeBill: Time-Budgeted Inference for Large Language Models
by: Fan, Qi, et al.
Published: (2025)
by: Fan, Qi, et al.
Published: (2025)
Probabilistic Subspace Manifolds for Contextual Inference in Large Language Models
by: Nightingale, Christopher, et al.
Published: (2025)
by: Nightingale, Christopher, et al.
Published: (2025)
Hypothesis-only Biases in Large Language Model-Elicited Natural Language Inference
by: Proebsting, Grace, et al.
Published: (2024)
by: Proebsting, Grace, et al.
Published: (2024)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
by: Bogoychev, Nikolay, et al.
Published: (2023)
by: Bogoychev, Nikolay, et al.
Published: (2023)
Decoding In-Context Learning: Neuroscience-inspired Analysis of Representations in Large Language Models
by: Yousefi, Safoora, et al.
Published: (2023)
by: Yousefi, Safoora, et al.
Published: (2023)
Searching for Best Practices in Medical Transcription with Large Language Model
by: Li, Jiafeng, et al.
Published: (2024)
by: Li, Jiafeng, et al.
Published: (2024)
Similar Items
-
eDIF: A European Deep Inference Fabric for Remote Interpretability of LLM
by: Guggenberger, Irma Heithoff. Marc, et al.
Published: (2025) -
Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models
by: Barkur, Sudarshan Kamath, et al.
Published: (2025) -
PHOENIX: Open-Source Language Adaption for Direct Preference Optimization
by: Uhlig, Matthias, et al.
Published: (2024) -
A Review of Common Online Speaker Diarization Methods
by: Aperdannier, Roman, et al.
Published: (2024) -
Systematic Evaluation of Online Speaker Diarization Systems Regarding their Latency
by: Aperdannier, Roman, et al.
Published: (2024)