Salvato in:
| Autori principali: | Wang, Yuxiang, Yan, Xiao, Ma, Chi, Huang, Mincong, Li, Xiaoguang, Yu, Lei, Liu, Chuan, Han, Ruidong, Jiang, He, Yin, Bin, Chen, Shangyu, Jiang, Fei, Li, Xiang, Lin, Wei, Han, Haowei, Du, Bo, Jiang, Jiawei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2505.12663 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RecIS: Sparse to Dense, A Unified Training Framework for Recommendation Models
di: Zong, Hua, et al.
Pubblicazione: (2025)
di: Zong, Hua, et al.
Pubblicazione: (2025)
Embedding Samples Dispatching for Recommendation Model Training in Edge Environments
di: Li, Guopeng, et al.
Pubblicazione: (2025)
di: Li, Guopeng, et al.
Pubblicazione: (2025)
HexiSeq: Accommodating Long Context Training of LLMs over Heterogeneous Hardware
di: Liang, Yan, et al.
Pubblicazione: (2026)
di: Liang, Yan, et al.
Pubblicazione: (2026)
Efficient Pre-Training of LLMs via Topology-Aware Communication Alignment on More Than 9600 GPUs
di: He, Guoliang, et al.
Pubblicazione: (2025)
di: He, Guoliang, et al.
Pubblicazione: (2025)
HexAGenT: Efficient Agentic LLM Serving via Workflow- and Heterogeneity-Aware Scheduling
di: Peng, You, et al.
Pubblicazione: (2026)
di: Peng, You, et al.
Pubblicazione: (2026)
Accelerating Distributed MoE Training and Inference with Lina
di: Li, Jiamin, et al.
Pubblicazione: (2022)
di: Li, Jiamin, et al.
Pubblicazione: (2022)
HexiScale: Facilitating Large Language Model Training over Heterogeneous Hardware
di: Yan, Ran, et al.
Pubblicazione: (2024)
di: Yan, Ran, et al.
Pubblicazione: (2024)
Unleashing Efficient Asynchronous RL Post-Training via Staleness-Constrained Rollout Coordination
di: Li, Haoyang, et al.
Pubblicazione: (2026)
di: Li, Haoyang, et al.
Pubblicazione: (2026)
PICO: Accelerating All k-Core Paradigms on GPU
di: Zhao, Chen, et al.
Pubblicazione: (2024)
di: Zhao, Chen, et al.
Pubblicazione: (2024)
DistTrain: Addressing Model and Data Heterogeneity with Disaggregated Training for Multimodal Large Language Models
di: Zhang, Zili, et al.
Pubblicazione: (2024)
di: Zhang, Zili, et al.
Pubblicazione: (2024)
A Flexible Programmable Pipeline Parallelism Framework for Efficient DNN Training
di: Jiang, Lijuan, et al.
Pubblicazione: (2025)
di: Jiang, Lijuan, et al.
Pubblicazione: (2025)
BurstEngine: an Efficient Distributed Framework for Training Transformers on Extremely Long Sequences of over 1M Tokens
di: Sun, Ao, et al.
Pubblicazione: (2025)
di: Sun, Ao, et al.
Pubblicazione: (2025)
pFedLoRA: Model-Heterogeneous Personalized Federated Learning with LoRA Tuning
di: Yi, Liping, et al.
Pubblicazione: (2023)
di: Yi, Liping, et al.
Pubblicazione: (2023)
DCP: Addressing Input Dynamism In Long-Context Training via Dynamic Context Parallelism
di: Jiang, Chenyu, et al.
Pubblicazione: (2025)
di: Jiang, Chenyu, et al.
Pubblicazione: (2025)
Lancet: Accelerating Mixture-of-Experts Training via Whole Graph Computation-Communication Overlapping
di: Jiang, Chenyu, et al.
Pubblicazione: (2024)
di: Jiang, Chenyu, et al.
Pubblicazione: (2024)
Seq1F1B: Efficient Sequence-Level Pipeline Parallelism for Large Language Model Training
di: Sun, Ao, et al.
Pubblicazione: (2024)
di: Sun, Ao, et al.
Pubblicazione: (2024)
Beyond A Single AI Cluster: A Survey of Decentralized LLM Training
di: Dong, Haotian, et al.
Pubblicazione: (2025)
di: Dong, Haotian, et al.
Pubblicazione: (2025)
NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining
di: Jiang, Zhida, et al.
Pubblicazione: (2026)
di: Jiang, Zhida, et al.
Pubblicazione: (2026)
Probabilistic Top-k Dominating Query Monitoring over Multiple Uncertain IoT Data Streams in Edge Computing Environments
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2019)
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2019)
FuxiShuffle: An Adaptive and Resilient Shuffle Service for Distributed Data Processing on Alibaba Cloud
di: Lin, Yuhao, et al.
Pubblicazione: (2026)
di: Lin, Yuhao, et al.
Pubblicazione: (2026)
A Survey on Model-heterogeneous Federated Learning: Problems, Methods, and Prospects
di: Fan, Boyu, et al.
Pubblicazione: (2023)
di: Fan, Boyu, et al.
Pubblicazione: (2023)
FedFQ: Federated Learning with Fine-Grained Quantization
di: Li, Haowei, et al.
Pubblicazione: (2024)
di: Li, Haowei, et al.
Pubblicazione: (2024)
Hyperion: Low-Latency Ultra-HD Video Analytics via Collaborative Vision Transformer Inference
di: Jiang, Linyi, et al.
Pubblicazione: (2025)
di: Jiang, Linyi, et al.
Pubblicazione: (2025)
Research on Model Parallelism and Data Parallelism Optimization Methods in Large Language Model-Based Recommendation Systems
di: Yang, Haowei, et al.
Pubblicazione: (2025)
di: Yang, Haowei, et al.
Pubblicazione: (2025)
Federated Model Heterogeneous Matryoshka Representation Learning
di: Yi, Liping, et al.
Pubblicazione: (2024)
di: Yi, Liping, et al.
Pubblicazione: (2024)
Re-evaluating the Memory-balanced Pipeline Parallelism: BPipe
di: Huang, Mincong, et al.
Pubblicazione: (2024)
di: Huang, Mincong, et al.
Pubblicazione: (2024)
FLAME: A Serving System Optimized for Large-Scale Generative Recommendation with Efficiency
di: Guo, Xianwen, et al.
Pubblicazione: (2025)
di: Guo, Xianwen, et al.
Pubblicazione: (2025)
On the Performance and Memory Footprint of Distributed Training: An Empirical Study on Transformers
di: Lu, Zhengxian, et al.
Pubblicazione: (2024)
di: Lu, Zhengxian, et al.
Pubblicazione: (2024)
Heta: Distributed Training of Heterogeneous Graph Neural Networks
di: Zhong, Yuchen, et al.
Pubblicazione: (2024)
di: Zhong, Yuchen, et al.
Pubblicazione: (2024)
UAT20: Unifying Liquidity Across Rollups
di: Li, Yue, et al.
Pubblicazione: (2025)
di: Li, Yue, et al.
Pubblicazione: (2025)
EcoLife: Carbon-Aware Serverless Function Scheduling for Sustainable Computing
di: Jiang, Yankai, et al.
Pubblicazione: (2024)
di: Jiang, Yankai, et al.
Pubblicazione: (2024)
Chameleon: Adaptive Fault Tolerance for Distributed Training via Real-time Policy Selection
di: Zhou, Yuhang, et al.
Pubblicazione: (2025)
di: Zhou, Yuhang, et al.
Pubblicazione: (2025)
A Survey of Synchronization Technologies for Low-power Backscatter Communication
di: Jiang, Wenyuan, et al.
Pubblicazione: (2025)
di: Jiang, Wenyuan, et al.
Pubblicazione: (2025)
Distributed Indexing Schemes for k-Dominant Skyline Analytics on Uncertain Edge-IoT Data
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2023)
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2023)
Bandwidth-Aware and Cost-Efficient Pipeline Parallel Scheduling in Geo-Distributed LLM Training
di: Zhang, Han, et al.
Pubblicazione: (2026)
di: Zhang, Han, et al.
Pubblicazione: (2026)
Revisiting the Time Cost Model of AllReduce
di: Xiong, Dian, et al.
Pubblicazione: (2024)
di: Xiong, Dian, et al.
Pubblicazione: (2024)
Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism
di: Wei, Jinhui, et al.
Pubblicazione: (2025)
di: Wei, Jinhui, et al.
Pubblicazione: (2025)
PipeMax: Enhancing Offline LLM Inference on Commodity GPU Servers
di: Zhang, Hongbin, et al.
Pubblicazione: (2026)
di: Zhang, Hongbin, et al.
Pubblicazione: (2026)
The Coverage Overlapping Problem of Serving Arbitrary Crowds in 3D Drone Cellular Networks
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2020)
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2020)
RcLLM: Accelerating Generative Recommendation via Beyond-Prefix KV Caching
di: Zhao, Zhan, et al.
Pubblicazione: (2026)
di: Zhao, Zhan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RecIS: Sparse to Dense, A Unified Training Framework for Recommendation Models
di: Zong, Hua, et al.
Pubblicazione: (2025) -
Embedding Samples Dispatching for Recommendation Model Training in Edge Environments
di: Li, Guopeng, et al.
Pubblicazione: (2025) -
HexiSeq: Accommodating Long Context Training of LLMs over Heterogeneous Hardware
di: Liang, Yan, et al.
Pubblicazione: (2026) -
Efficient Pre-Training of LLMs via Topology-Aware Communication Alignment on More Than 9600 GPUs
di: He, Guoliang, et al.
Pubblicazione: (2025) -
HexAGenT: Efficient Agentic LLM Serving via Workflow- and Heterogeneity-Aware Scheduling
di: Peng, You, et al.
Pubblicazione: (2026)