MoST: Measuring of Sustainable Throughput method for Large Language Models as a Service
Fuente:
Zenodo
Salvato in:
| Autore principale: | Anonymous |
|---|---|
| Natura: | Recurso digital |
| Pubblicazione: |
Zenodo
2026
|
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MoST: Multi-modality Scene Tokenization for Motion Prediction
di: Mu, Norman, et al.
Pubblicazione: (2024)
di: Mu, Norman, et al.
Pubblicazione: (2024)
MoST: Mixing Speech and Text with Modality-Aware Mixture of Experts
di: Lou, Yuxuan, et al.
Pubblicazione: (2026)
di: Lou, Yuxuan, et al.
Pubblicazione: (2026)
MoST: Motion Style Transformer between Diverse Action Contents
di: Kim, Boeun, et al.
Pubblicazione: (2024)
di: Kim, Boeun, et al.
Pubblicazione: (2024)
MoST: Efficient Monarch Sparse Tuning for 3D Representation Learning
di: Han, Xu, et al.
Pubblicazione: (2025)
di: Han, Xu, et al.
Pubblicazione: (2025)
Collective Electrostatics and Band Alignment in Janus MoSTe nanotubes
di: Sadanandan, Adithya, et al.
Pubblicazione: (2026)
di: Sadanandan, Adithya, et al.
Pubblicazione: (2026)
Combining Large Language Models for High-quality, Cost-efficient Conservative Reassessments of Static Security Findings
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Evaluating Large Language Models in Summarizing Developer Chat Conversations: A Linguistic Perspective
di: Anonymous
Pubblicazione: (2025)
di: Anonymous
Pubblicazione: (2025)
ST-LLM: Large Language Models Are Effective Temporal Learners
di: Liu, Ruyang, et al.
Pubblicazione: (2024)
di: Liu, Ruyang, et al.
Pubblicazione: (2024)
High-Throughput Phenotyping of Clinical Text Using Large Language Models
di: Hier, Daniel B., et al.
Pubblicazione: (2024)
di: Hier, Daniel B., et al.
Pubblicazione: (2024)
NanoFlow: Towards Optimal Large Language Model Serving Throughput
di: Zhu, Kan, et al.
Pubblicazione: (2024)
di: Zhu, Kan, et al.
Pubblicazione: (2024)
ST-LINK: Spatially-Aware Large Language Models for Spatio-Temporal Forecasting
di: Jeon, Hyotaek, et al.
Pubblicazione: (2025)
di: Jeon, Hyotaek, et al.
Pubblicazione: (2025)
High Throughput Phenotyping of Physician Notes with Large Language and Hybrid NLP Models
di: Munzir, Syed I., et al.
Pubblicazione: (2024)
di: Munzir, Syed I., et al.
Pubblicazione: (2024)
MoE-Lightning: High-Throughput MoE Inference on Memory-constrained GPUs
di: Cao, Shiyi, et al.
Pubblicazione: (2024)
di: Cao, Shiyi, et al.
Pubblicazione: (2024)
Supplementary data for Perspectives, Needs and Challenges for Sustainable Software Engineering Teams: A FinServ Case Study
di: Anonymous, Anonymous
Pubblicazione: (2025)
di: Anonymous, Anonymous
Pubblicazione: (2025)
QuST-LLM: Integrating Large Language Models for Comprehensive Spatial Transcriptomics Analysis
di: Huang, Chao Hui
Pubblicazione: (2024)
di: Huang, Chao Hui
Pubblicazione: (2024)
Prepacking: A Simple Method for Fast Prefilling and Increased Throughput in Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2024)
di: Zhao, Siyan, et al.
Pubblicazione: (2024)
MoE-Gen: High-Throughput MoE Inference on a Single GPU with Module-Based Batching
di: Xu, Tairan, et al.
Pubblicazione: (2025)
di: Xu, Tairan, et al.
Pubblicazione: (2025)
ST$^3$: Accelerating Multimodal Large Language Model by Spatial-Temporal Visual Token Trimming
di: Zhuang, Jiedong, et al.
Pubblicazione: (2024)
di: Zhuang, Jiedong, et al.
Pubblicazione: (2024)
LLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
Application of Large Language Models for Container Throughput Forecasting: Incorporating Contextual Information in Port Logistics
di: Kim, Minseop, et al.
Pubblicazione: (2026)
di: Kim, Minseop, et al.
Pubblicazione: (2026)
Abelian Measure–Defect Equivalence in Divergent Weighted Index Systems
di: Anonymous
Pubblicazione: (2026)
di: Anonymous
Pubblicazione: (2026)
Improving the Throughput of Diffusion-based Large Language Models via a Training-Free Confidence-Aware Calibration
di: Shen, Jucheng, et al.
Pubblicazione: (2025)
di: Shen, Jucheng, et al.
Pubblicazione: (2025)
Watermarks for Embeddings-as-a-Service Large Language Models
di: Shetty, Anudeex
Pubblicazione: (2025)
di: Shetty, Anudeex
Pubblicazione: (2025)
LLaVA-ST: A Multimodal Large Language Model for Fine-Grained Spatial-Temporal Understanding
di: Li, Hongyu, et al.
Pubblicazione: (2025)
di: Li, Hongyu, et al.
Pubblicazione: (2025)
PaCoST: Paired Confidence Significance Testing for Benchmark Contamination Detection in Large Language Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
LocMoE: A Low-Overhead MoE for Large Language Model Training
di: Li, Jing, et al.
Pubblicazione: (2024)
di: Li, Jing, et al.
Pubblicazione: (2024)
Towards Sustainable Large Language Model Serving
di: Nguyen, Sophia, et al.
Pubblicazione: (2024)
di: Nguyen, Sophia, et al.
Pubblicazione: (2024)
A Large Language Model Outperforms Other Computational Approaches to the High-Throughput Phenotyping of Physician Notes
di: Munzir, Syed I., et al.
Pubblicazione: (2024)
di: Munzir, Syed I., et al.
Pubblicazione: (2024)
Characterizing 5G User Throughput via Uncertainty Modeling and Crowdsourced Measurements
di: Albert-Smet, Javier, et al.
Pubblicazione: (2025)
di: Albert-Smet, Javier, et al.
Pubblicazione: (2025)
Rosetum3D: A Large-Scale 3D Vision Dataset from Rose Planting Scene
di: Anonymous, Anonymous
Pubblicazione: (2025)
di: Anonymous, Anonymous
Pubblicazione: (2025)
Circle: High-Dimensional Control on Low-Dimensional Controllers Using an Abstract Language of Gestures
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Model-based Large Language Model Customization as Service
di: Wu, Zhaomin, et al.
Pubblicazione: (2024)
di: Wu, Zhaomin, et al.
Pubblicazione: (2024)
Towards Pareto Optimal Throughput in Small Language Model Serving
di: Recasens, Pol G., et al.
Pubblicazione: (2024)
di: Recasens, Pol G., et al.
Pubblicazione: (2024)
Quality of Service-Constrained Online Routing in High Throughput Satellites
di: Bélanger, Olivier, et al.
Pubblicazione: (2023)
di: Bélanger, Olivier, et al.
Pubblicazione: (2023)
All_Models_Accuracy_Report
di: Anonymous, Anonymous
Pubblicazione: (2026)
di: Anonymous, Anonymous
Pubblicazione: (2026)
Efficient Function-as-a-Service for Large Language Models with TIDAL
di: Cui, Weihao, et al.
Pubblicazione: (2025)
di: Cui, Weihao, et al.
Pubblicazione: (2025)
MoE-Lens: Towards the Hardware Limit of High-Throughput MoE LLM Serving Under Resource Constraints
di: Yuan, Yichao, et al.
Pubblicazione: (2025)
di: Yuan, Yichao, et al.
Pubblicazione: (2025)
VReST: Enhancing Reasoning in Large Vision-Language Models through Tree Search and Self-Reward Mechanism
di: Zhang, Congzhi, et al.
Pubblicazione: (2025)
di: Zhang, Congzhi, et al.
Pubblicazione: (2025)
ThreMoLIA: Threat Modeling of Large Language Model-Integrated Applications
di: Jedrzejewski, Felix Viktor, et al.
Pubblicazione: (2025)
di: Jedrzejewski, Felix Viktor, et al.
Pubblicazione: (2025)
Automatic Raman Measurements in a High-Throughput Bioprocess Development Lab
di: Lange, Christoph, et al.
Pubblicazione: (2025)
di: Lange, Christoph, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MoST: Multi-modality Scene Tokenization for Motion Prediction
di: Mu, Norman, et al.
Pubblicazione: (2024) -
MoST: Mixing Speech and Text with Modality-Aware Mixture of Experts
di: Lou, Yuxuan, et al.
Pubblicazione: (2026) -
MoST: Motion Style Transformer between Diverse Action Contents
di: Kim, Boeun, et al.
Pubblicazione: (2024) -
MoST: Efficient Monarch Sparse Tuning for 3D Representation Learning
di: Han, Xu, et al.
Pubblicazione: (2025) -
Collective Electrostatics and Band Alignment in Janus MoSTe nanotubes
di: Sadanandan, Adithya, et al.
Pubblicazione: (2026)