Training and Serving System of Foundation Models: A Comprehensive Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Jiahang, Chen, Yanyu, Hong, Zicong, Chen, Wuhui, Yu, Yue, Zhang, Tao, Wang, Hui, Zhang, Chuanfu, Zheng, Zibin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fate: Fast Edge Inference of Mixture-of-Experts Models via Cross-Layer Gate
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
Krul: Efficient State Restoration for Multi-turn Conversations with Dynamic Cross-layer KV Sharing
di: Wen, Junyi, et al.
Pubblicazione: (2025)
di: Wen, Junyi, et al.
Pubblicazione: (2025)
Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
What Shapes a Creative Machine Mind? Comprehensively Benchmarking Creativity in Foundation Models
di: He, Zicong, et al.
Pubblicazione: (2025)
di: He, Zicong, et al.
Pubblicazione: (2025)
D$^{2}$MoE: Dual Routing and Dynamic Scheduling for Efficient On-Device MoE-based LLM Serving
di: Wang, Haodong, et al.
Pubblicazione: (2025)
di: Wang, Haodong, et al.
Pubblicazione: (2025)
GUI Agents with Foundation Models: A Comprehensive Survey
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Empowering Time Series Analysis with Foundation Models: A Comprehensive Survey
di: Ye, Jiexia, et al.
Pubblicazione: (2024)
di: Ye, Jiexia, et al.
Pubblicazione: (2024)
A Theoretical Survey on Foundation Models
di: Fu, Shi, et al.
Pubblicazione: (2024)
di: Fu, Shi, et al.
Pubblicazione: (2024)
Large Foundation Models for Trajectory Prediction in Autonomous Driving: A Comprehensive Survey
di: Dai, Wei, et al.
Pubblicazione: (2025)
di: Dai, Wei, et al.
Pubblicazione: (2025)
Graph Foundation Models: A Comprehensive Survey
di: Wang, Zehong, et al.
Pubblicazione: (2025)
di: Wang, Zehong, et al.
Pubblicazione: (2025)
A Survey on Failure Analysis and Fault Injection in AI Systems
di: Yu, Guangba, et al.
Pubblicazione: (2024)
di: Yu, Guangba, et al.
Pubblicazione: (2024)
GUIDE: A Global Unified Inference Engine for Deploying Large Language Models in Heterogeneous Environments
di: Chen, Yanyu, et al.
Pubblicazione: (2024)
di: Chen, Yanyu, et al.
Pubblicazione: (2024)
UniDCF: A Foundation Model for Comprehensive Dentocraniofacial Hard Tissue Reconstruction
di: Ren, Chunxia, et al.
Pubblicazione: (2025)
di: Ren, Chunxia, et al.
Pubblicazione: (2025)
Evaluating Progress in Graph Foundation Models: A Comprehensive Benchmark and New Insights
di: Yu, Xingtong, et al.
Pubblicazione: (2026)
di: Yu, Xingtong, et al.
Pubblicazione: (2026)
PsyAgent: Constructing Human-like Agents Based on Psychological Modeling and Contextual Interaction
di: Meng, Zibin, et al.
Pubblicazione: (2026)
di: Meng, Zibin, et al.
Pubblicazione: (2026)
Low-Rank Adaptation for Foundation Models: A Comprehensive Review
di: Yang, Menglin, et al.
Pubblicazione: (2024)
di: Yang, Menglin, et al.
Pubblicazione: (2024)
Reliable and Responsible Foundation Models: A Comprehensive Survey
di: Yang, Xinyu, et al.
Pubblicazione: (2026)
di: Yang, Xinyu, et al.
Pubblicazione: (2026)
How to ensure a safe control strategy? Towards a SRL for urban transit autonomous operation
di: Zhao, Zicong
Pubblicazione: (2023)
di: Zhao, Zicong
Pubblicazione: (2023)
A Comprehensive Survey of Foundation Models in Medicine
di: Khan, Wasif, et al.
Pubblicazione: (2024)
di: Khan, Wasif, et al.
Pubblicazione: (2024)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
di: Lin, Minhua, et al.
Pubblicazione: (2025)
di: Lin, Minhua, et al.
Pubblicazione: (2025)
Seeing Through Experts Eyes A Foundational Vision Language Model Trained on Radiologists Gaze and Reasoning
di: Lee, Kinhei, et al.
Pubblicazione: (2026)
di: Lee, Kinhei, et al.
Pubblicazione: (2026)
Revisiting Service Level Objectives and System Level Metrics in Large Language Model Serving
di: Wang, Zhibin, et al.
Pubblicazione: (2024)
di: Wang, Zhibin, et al.
Pubblicazione: (2024)
Data-Centric Foundation Models in Computational Healthcare: A Survey
di: Zhang, Yunkun, et al.
Pubblicazione: (2024)
di: Zhang, Yunkun, et al.
Pubblicazione: (2024)
Survey on Foundation Models for Prognostics and Health Management in Industrial Cyber-Physical Systems
di: Liu, Ruonan, et al.
Pubblicazione: (2023)
di: Liu, Ruonan, et al.
Pubblicazione: (2023)
Web3 x AI Agents: Landscape, Integrations, and Foundational Challenges
di: Shen, Yiming, et al.
Pubblicazione: (2025)
di: Shen, Yiming, et al.
Pubblicazione: (2025)
Cognitive Kernel-Pro: A Framework for Deep Research Agents and Agent Foundation Models Training
di: Fang, Tianqing, et al.
Pubblicazione: (2025)
di: Fang, Tianqing, et al.
Pubblicazione: (2025)
A Comprehensive Survey of Self-Evolving AI Agents: A New Paradigm Bridging Foundation Models and Lifelong Agentic Systems
di: Fang, Jinyuan, et al.
Pubblicazione: (2025)
di: Fang, Jinyuan, et al.
Pubblicazione: (2025)
Image-to-Video Transfer Learning based on Image-Language Foundation Models: A Comprehensive Survey
di: Li, Jinxuan, et al.
Pubblicazione: (2025)
di: Li, Jinxuan, et al.
Pubblicazione: (2025)
Graph Foundation Models for Recommendation: A Comprehensive Survey
di: Wu, Bin, et al.
Pubblicazione: (2025)
di: Wu, Bin, et al.
Pubblicazione: (2025)
Recent Advances of Multimodal Continual Learning: A Comprehensive Survey
di: Yu, Dianzhi, et al.
Pubblicazione: (2024)
di: Yu, Dianzhi, et al.
Pubblicazione: (2024)
MAS-FIRE: Fault Injection and Reliability Evaluation for LLM-Based Multi-Agent Systems
di: Jia, Jin, et al.
Pubblicazione: (2026)
di: Jia, Jin, et al.
Pubblicazione: (2026)
Foundation Models for Cross-Domain EEG Analysis Application: A Survey
di: Li, Hongqi, et al.
Pubblicazione: (2025)
di: Li, Hongqi, et al.
Pubblicazione: (2025)
PlanetServe: A Decentralized, Scalable, and Privacy-Preserving Overlay for Democratizing Large Language Model Serving
di: Fang, Fei, et al.
Pubblicazione: (2025)
di: Fang, Fei, et al.
Pubblicazione: (2025)
Machine Unlearning: A Comprehensive Survey
di: Wang, Weiqi, et al.
Pubblicazione: (2024)
di: Wang, Weiqi, et al.
Pubblicazione: (2024)
A Comprehensive Survey of Artificial Intelligence Techniques for Talent Analytics
di: Qin, Chuan, et al.
Pubblicazione: (2023)
di: Qin, Chuan, et al.
Pubblicazione: (2023)
AI Alignment: A Comprehensive Survey
di: Ji, Jiaming, et al.
Pubblicazione: (2023)
di: Ji, Jiaming, et al.
Pubblicazione: (2023)
Towards Efficient Generative Large Language Model Serving: A Survey from Algorithms to Systems
di: Miao, Xupeng, et al.
Pubblicazione: (2023)
di: Miao, Xupeng, et al.
Pubblicazione: (2023)
AttenA+: Rectifying Action Inequality in Robotic Foundation Models
di: Peng, Daojie, et al.
Pubblicazione: (2026)
di: Peng, Daojie, et al.
Pubblicazione: (2026)
Reinforcement Learning Foundations for Deep Research Systems: A Survey
di: Li, Wenjun, et al.
Pubblicazione: (2025)
di: Li, Wenjun, et al.
Pubblicazione: (2025)
Diffusion Models: A Comprehensive Survey of Methods and Applications
di: Yang, Ling, et al.
Pubblicazione: (2022)
di: Yang, Ling, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Fate: Fast Edge Inference of Mixture-of-Experts Models via Cross-Layer Gate
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025) -
Krul: Efficient State Restoration for Multi-turn Conversations with Dynamic Cross-layer KV Sharing
di: Wen, Junyi, et al.
Pubblicazione: (2025) -
Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025) -
What Shapes a Creative Machine Mind? Comprehensively Benchmarking Creativity in Foundation Models
di: He, Zicong, et al.
Pubblicazione: (2025) -
D$^{2}$MoE: Dual Routing and Dynamic Scheduling for Efficient On-Device MoE-based LLM Serving
di: Wang, Haodong, et al.
Pubblicazione: (2025)