RTP-LLM: High-Performance Alibaba LLM Inference Engine
Fuente:
arXiv
Salvato in:
| Autori principali: | Tan, Boyu, Guo, Jiarui, Lv, Zongwei, Sun, Hanbo, Yang, Tong, Liu, Kan, Shi, Xinfei, Hu, Zetao, Yu, Yaxin, Zhang, Chi, Zhang, Jianning, Yang, Xi, Zhang, Wei, Cai, Bo, Zhou, Silu, Wang, Xiyu, He, Na, Yu, Yinghao, Bao, Wending, Huang, Guiyang, Yuan, Yuxing, Yin, Juncheng, Wang, Nan, Yang, Lin, Zhang, Zechao, Chen, Lu, Li, Guoding, Lan, Tao, Qu, Lin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cross: A Delay Based Congestion Control Method for RTP Media
di: Zhang, Songyang, et al.
Pubblicazione: (2024)
di: Zhang, Songyang, et al.
Pubblicazione: (2024)
CTR Prediction on Alibaba's Taobao Advertising Dataset Using Traditional and Deep Learning Models
di: Yang, Hongyu, et al.
Pubblicazione: (2025)
di: Yang, Hongyu, et al.
Pubblicazione: (2025)
Fabrication and characteristics of the C3+‐ion implanted and femtosecond‐laser ablated RTP 2D waveguide
di: Jie‐Yu Zhang, et al.
Pubblicazione: (2024)
di: Jie‐Yu Zhang, et al.
Pubblicazione: (2024)
The Alibaba phenomenon
di: Varios
Pubblicazione: (2013)
di: Varios
Pubblicazione: (2013)
CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
SCOOT: SLO-Oriented Performance Tuning for LLM Inference Engines
di: Cheng, Ke, et al.
Pubblicazione: (2024)
di: Cheng, Ke, et al.
Pubblicazione: (2024)
PhysEDA: Physics-Aware Learning Framework for Efficient EDA With Manhattan Distance Decay
di: Yang, Zetao
Pubblicazione: (2026)
di: Yang, Zetao
Pubblicazione: (2026)
Mapping Space Exploration for Multi-Chiplet Accelerators Targeting LLM Inference Serving Workloads
di: Li, Boyu, et al.
Pubblicazione: (2025)
di: Li, Boyu, et al.
Pubblicazione: (2025)
LLM4PR: Improving Post-Ranking in Search Engine with Large Language Models
di: Yan, Yang, et al.
Pubblicazione: (2024)
di: Yan, Yang, et al.
Pubblicazione: (2024)
Emotional Fluctuations in AI ‐Enhanced Ecosystems: Exploring EFL Learners' Affective States During AI Technology Adoption
di: Yu Zhang, et al.
Pubblicazione: (2026)
di: Yu Zhang, et al.
Pubblicazione: (2026)
Deciphering the N─N Coupling Mechanism Over Iron–Copper Alloy Catalysts During Ammonia Decomposition
di: Xun Qi, et al.
Pubblicazione: (2025)
di: Xun Qi, et al.
Pubblicazione: (2025)
Deciphering the N─N Coupling Mechanism Over Iron–Copper Alloy Catalysts During Ammonia Decomposition
di: Xun Qi, et al.
Pubblicazione: (2025)
di: Xun Qi, et al.
Pubblicazione: (2025)
RetroInfer: A Vector Storage Engine for Scalable Long-Context LLM Inference
di: Chen, Yaoqi, et al.
Pubblicazione: (2025)
di: Chen, Yaoqi, et al.
Pubblicazione: (2025)
Ask1: Development and Reinforcement Learning-Based Control of a Custom Quadruped Robot
di: Zhang, Yang, et al.
Pubblicazione: (2024)
di: Zhang, Yang, et al.
Pubblicazione: (2024)
Ultralong‐Lived and Color‐Tunable RTP in Biodegradable Natural Fibers Based Textiles for Wearable Security and Display
di: Huie Jiang, et al.
Pubblicazione: (2025)
di: Huie Jiang, et al.
Pubblicazione: (2025)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
di: Ma, Ming, et al.
Pubblicazione: (2025)
di: Ma, Ming, et al.
Pubblicazione: (2025)
Assessing Deanonymization Risks with Stylometry-Assisted LLM Agent
di: Zhang, Boyang, et al.
Pubblicazione: (2026)
di: Zhang, Boyang, et al.
Pubblicazione: (2026)
LLM-Sketch: Enhancing Network Sketches with LLM
di: Li, Yuanpeng, et al.
Pubblicazione: (2025)
di: Li, Yuanpeng, et al.
Pubblicazione: (2025)
Unconditional quantum magic advantage in shallow circuit computation
di: Zhang, Xingjian, et al.
Pubblicazione: (2024)
di: Zhang, Xingjian, et al.
Pubblicazione: (2024)
VoltanaLLM: Feedback-Driven Frequency Control and State-Space Routing for Energy-Efficient LLM Serving
di: Yu, Jiahuan, et al.
Pubblicazione: (2025)
di: Yu, Jiahuan, et al.
Pubblicazione: (2025)
Aegis:An Advanced LLM-Based Multi-Agent for Intelligent Functional Safety Engineering
di: Shi, Lu, et al.
Pubblicazione: (2024)
di: Shi, Lu, et al.
Pubblicazione: (2024)
Robot‐assisted laparoscopic ureteroplasty for retrocaval ureter with three‐dimensional images navigation: technique and outcomes
di: Xiang Wang, et al.
Pubblicazione: (2024)
di: Xiang Wang, et al.
Pubblicazione: (2024)
RLSpoofer: A Lightweight Evaluator for LLM Watermark Spoofing Resilience
di: Huang, Hanbo, et al.
Pubblicazione: (2026)
di: Huang, Hanbo, et al.
Pubblicazione: (2026)
Simulation as Reality? The Effectiveness of LLM-Generated Data in Open-ended Question Assessment
di: Zhang, Long, et al.
Pubblicazione: (2025)
di: Zhang, Long, et al.
Pubblicazione: (2025)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
di: Wu, Yang, et al.
Pubblicazione: (2024)
di: Wu, Yang, et al.
Pubblicazione: (2024)
Highly Elastic Full Hydrocarbon Ultralong RTP Polymers with Visible Light Excitable S0→T1 Population
di: Guanyu Liu, et al.
Pubblicazione: (2024)
di: Guanyu Liu, et al.
Pubblicazione: (2024)
AQETuner: Reliable Query-level Configuration Tuning for Analytical Query Engines
di: Chen, Lixiang, et al.
Pubblicazione: (2025)
di: Chen, Lixiang, et al.
Pubblicazione: (2025)
GEO-Detective: Unveiling Location Privacy Risks in Images with LLM Agents
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses
di: Chen, Yulong, et al.
Pubblicazione: (2024)
di: Chen, Yulong, et al.
Pubblicazione: (2024)
LLM-Grounded Dynamic Task Planning with Hierarchical Temporal Logic for Human-Aware Multi-Robot Collaboration
di: Hu, Shuyuan, et al.
Pubblicazione: (2026)
di: Hu, Shuyuan, et al.
Pubblicazione: (2026)
RLCracker: Evaluating the Worst-Case Vulnerability of LLM Watermarks with Adaptive RL Attacks
di: Huang, Hanbo, et al.
Pubblicazione: (2025)
di: Huang, Hanbo, et al.
Pubblicazione: (2025)
ASAP: an Agentic Solution to Auto-optimize Performance of Large-Scale LLM Training
di: Ding, Yuran, et al.
Pubblicazione: (2025)
di: Ding, Yuran, et al.
Pubblicazione: (2025)
HalluClean: A Unified Framework to Combat Hallucinations in LLMs
di: Zhao, Yaxin, et al.
Pubblicazione: (2025)
di: Zhao, Yaxin, et al.
Pubblicazione: (2025)
LLM Reasoning Engine: Specialized Training for Enhanced Mathematical Reasoning
di: Chen, Shuguang, et al.
Pubblicazione: (2024)
di: Chen, Shuguang, et al.
Pubblicazione: (2024)
d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation
di: Qian, Yu-Yang, et al.
Pubblicazione: (2026)
di: Qian, Yu-Yang, et al.
Pubblicazione: (2026)
Benchmarking LLM Tool-Use in the Wild
di: Yu, Peijie, et al.
Pubblicazione: (2026)
di: Yu, Peijie, et al.
Pubblicazione: (2026)
Learned Query Optimizer in Alibaba MaxCompute: Challenges, Analysis, and Solutions
di: Weng, Lianggui, et al.
Pubblicazione: (2026)
di: Weng, Lianggui, et al.
Pubblicazione: (2026)
SportsGPT: An LLM-driven Framework for Interpretable Sports Motion Assessment and Training Guidance
di: Tian, Wenbo, et al.
Pubblicazione: (2025)
di: Tian, Wenbo, et al.
Pubblicazione: (2025)
ZipLLM: Efficient LLM Storage via Model-Aware Synergistic Data Deduplication and Compression
di: Wang, Zirui, et al.
Pubblicazione: (2025)
di: Wang, Zirui, et al.
Pubblicazione: (2025)
AgentGit: A Version Control Framework for Reliable and Scalable LLM-Powered Multi-Agent Systems
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Cross: A Delay Based Congestion Control Method for RTP Media
di: Zhang, Songyang, et al.
Pubblicazione: (2024) -
CTR Prediction on Alibaba's Taobao Advertising Dataset Using Traditional and Deep Learning Models
di: Yang, Hongyu, et al.
Pubblicazione: (2025) -
Fabrication and characteristics of the C3+‐ion implanted and femtosecond‐laser ablated RTP 2D waveguide
di: Jie‐Yu Zhang, et al.
Pubblicazione: (2024) -
The Alibaba phenomenon
di: Varios
Pubblicazione: (2013) -
CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering
di: Yang, Hao, et al.
Pubblicazione: (2026)