ELMO: Efficiency via Low-precision and Peak Memory Optimization in Large Output Spaces
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Jinbin, Ullah, Nasib, Schultheis, Erik, Babbar, Rohit |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DynaSpec: Context-aware Dynamic Speculative Sampling for Large-Vocabulary Language Models
by: Zhang, Jinbin, et al.
Published: (2025)
by: Zhang, Jinbin, et al.
Published: (2025)
HASTE: Hardware-Aware Dynamic Sparse Training for Large Output Spaces
by: Ullah, Nasib, et al.
Published: (2026)
by: Ullah, Nasib, et al.
Published: (2026)
Labels in Extremes: How Well Calibrated are Extreme Multi-label Classifiers?
by: Ullah, Nasib, et al.
Published: (2024)
by: Ullah, Nasib, et al.
Published: (2024)
Navigating Extremes: Dynamic Sparsity in Large Output Spaces
by: Ullah, Nasib, et al.
Published: (2024)
by: Ullah, Nasib, et al.
Published: (2024)
Large Language Model as a Teacher for Zero-shot Tagging at Extreme Scales
by: Zhang, Jinbin, et al.
Published: (2024)
by: Zhang, Jinbin, et al.
Published: (2024)
Learning label-label correlations in Extreme Multi-label Classification via Label Features
by: Kharbanda, Siddhant, et al.
Published: (2024)
by: Kharbanda, Siddhant, et al.
Published: (2024)
Alignment Adapter to Improve the Performance of Compressed Deep Learning Models
by: Rai, Rohit Raj, et al.
Published: (2026)
by: Rai, Rohit Raj, et al.
Published: (2026)
Learn to Memorize: Optimizing LLM-based Agents with Adaptive Memory Framework
by: Zhang, Zeyu, et al.
Published: (2025)
by: Zhang, Zeyu, et al.
Published: (2025)
FlashEvaluator: Expanding Search Space with Parallel Evaluation
by: Feng, Chao, et al.
Published: (2026)
by: Feng, Chao, et al.
Published: (2026)
AT-RAG: An Adaptive RAG Model Enhancing Query Efficiency with Topic Filtering and Iterative Reasoning
by: Rezaei, Mohammad Reza, et al.
Published: (2024)
by: Rezaei, Mohammad Reza, et al.
Published: (2024)
RAG over Tables: Hierarchical Memory Index, Multi-Stage Retrieval, and Benchmarking
by: Zou, Jiaru, et al.
Published: (2025)
by: Zou, Jiaru, et al.
Published: (2025)
Optimize Incompatible Parameters through Compatibility-aware Knowledge Integration
by: Lv, Zheqi, et al.
Published: (2025)
by: Lv, Zheqi, et al.
Published: (2025)
Demystifying and Enhancing the Efficiency of Large Language Model Based Search Agents
by: Yang, Tiannuo, et al.
Published: (2025)
by: Yang, Tiannuo, et al.
Published: (2025)
From Topology to Retrieval: Decoding Embedding Spaces with Unified Signatures
by: Rottach, Florian, et al.
Published: (2025)
by: Rottach, Florian, et al.
Published: (2025)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
by: Jin, Bowen, et al.
Published: (2024)
by: Jin, Bowen, et al.
Published: (2024)
LawLLM: Law Large Language Model for the US Legal System
by: Shu, Dong, et al.
Published: (2024)
by: Shu, Dong, et al.
Published: (2024)
SLMRec: Distilling Large Language Models into Small for Sequential Recommendation
by: Xu, Wujiang, et al.
Published: (2024)
by: Xu, Wujiang, et al.
Published: (2024)
PaECTER: Patent-level Representation Learning using Citation-informed Transformers
by: Ghosh, Mainak, et al.
Published: (2024)
by: Ghosh, Mainak, et al.
Published: (2024)
Drowning in Documents: Consequences of Scaling Reranker Inference
by: Jacob, Mathew, et al.
Published: (2024)
by: Jacob, Mathew, et al.
Published: (2024)
An Experimental Study on Data Augmentation Techniques for Named Entity Recognition on Low-Resource Domains
by: Torres, Arthur Elwing, et al.
Published: (2024)
by: Torres, Arthur Elwing, et al.
Published: (2024)
Optimizing Multi-Stage Language Models for Effective Text Retrieval
by: Trung, Quang Hoang, et al.
Published: (2024)
by: Trung, Quang Hoang, et al.
Published: (2024)
Enhancing Question Answering Precision with Optimized Vector Retrieval and Instructions
by: Yang, Lixiao, et al.
Published: (2024)
by: Yang, Lixiao, et al.
Published: (2024)
Make Large Language Model a Better Ranker
by: Chao, Wen-Shuo, et al.
Published: (2024)
by: Chao, Wen-Shuo, et al.
Published: (2024)
Integrating Large Language Models with Graphical Session-Based Recommendation
by: Guo, Naicheng, et al.
Published: (2024)
by: Guo, Naicheng, et al.
Published: (2024)
Clinical Reading Comprehension with Encoder-Decoder Models Enhanced by Direct Preference Optimization
by: Nahian, Md Sultan Al, et al.
Published: (2024)
by: Nahian, Md Sultan Al, et al.
Published: (2024)
AgentPRM: Process Reward Models for LLM Agents via Step-Wise Promise and Progress
by: Xi, Zhiheng, et al.
Published: (2025)
by: Xi, Zhiheng, et al.
Published: (2025)
PashtoCorp: A 1.25-Billion-Word Corpus, Evaluation Suite, and Reproducible Pipeline for Low-Resource Language Development
by: Rahman, Hanif
Published: (2026)
by: Rahman, Hanif
Published: (2026)
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
by: Qin, Zhen, et al.
Published: (2023)
by: Qin, Zhen, et al.
Published: (2023)
ORBIT: Preserving Foundational Language Capabilities in GenRetrieval via Origin-Regulated Merging
by: Verma, Neha, et al.
Published: (2026)
by: Verma, Neha, et al.
Published: (2026)
Optimizing Small Transformer-Based Language Models for Multi-Label Sentiment Analysis in Short Texts
by: Neumann, Julius, et al.
Published: (2025)
by: Neumann, Julius, et al.
Published: (2025)
LemmaHead: RAG Assisted Proof Generation Using Large Language Models
by: Yang, Tianbo, et al.
Published: (2025)
by: Yang, Tianbo, et al.
Published: (2025)
Utilizing Large Language Models for Information Extraction from Real Estate Transactions
by: Zhao, Yu, et al.
Published: (2024)
by: Zhao, Yu, et al.
Published: (2024)
Large Language Model Can Be a Foundation for Hidden Rationale-Based Retrieval
by: Ji, Luo, et al.
Published: (2024)
by: Ji, Luo, et al.
Published: (2024)
Supply Chain Network Extraction and Entity Classification Leveraging Large Language Models
by: Liu, Tong, et al.
Published: (2024)
by: Liu, Tong, et al.
Published: (2024)
SQaLe: A Large Text-to-SQL Corpus Grounded in Real Schemas
by: Wolff, Cornelius, et al.
Published: (2025)
by: Wolff, Cornelius, et al.
Published: (2025)
Sparse and Dense Retrievers Learn Better Together: Joint Sparse-Dense Optimization for Text-Image Retrieval
by: Song, Jonghyun, et al.
Published: (2025)
by: Song, Jonghyun, et al.
Published: (2025)
How do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective
by: Liu, Qi, et al.
Published: (2025)
by: Liu, Qi, et al.
Published: (2025)
Question-Answer Extraction from Scientific Articles Using Knowledge Graphs and Large Language Models
by: Azarbonyad, Hosein, et al.
Published: (2025)
by: Azarbonyad, Hosein, et al.
Published: (2025)
Identifying Reasons for Contraceptive Switching from Real-World Data Using Large Language Models
by: Miao, Brenda Y., et al.
Published: (2024)
by: Miao, Brenda Y., et al.
Published: (2024)
Prompts as Auto-Optimized Training Hyperparameters: Training Best-in-Class IR Models from Scratch with 10 Gold Labels
by: Xian, Jasper, et al.
Published: (2024)
by: Xian, Jasper, et al.
Published: (2024)
Similar Items
-
DynaSpec: Context-aware Dynamic Speculative Sampling for Large-Vocabulary Language Models
by: Zhang, Jinbin, et al.
Published: (2025) -
HASTE: Hardware-Aware Dynamic Sparse Training for Large Output Spaces
by: Ullah, Nasib, et al.
Published: (2026) -
Labels in Extremes: How Well Calibrated are Extreme Multi-label Classifiers?
by: Ullah, Nasib, et al.
Published: (2024) -
Navigating Extremes: Dynamic Sparsity in Large Output Spaces
by: Ullah, Nasib, et al.
Published: (2024) -
Large Language Model as a Teacher for Zero-shot Tagging at Extreme Scales
by: Zhang, Jinbin, et al.
Published: (2024)