HybridFlow: A Flexible and Efficient RLHF Framework
Fuente:
arXiv
Salvato in:
| Autori principali: | Sheng, Guangming, Zhang, Chi, Ye, Zilingfeng, Wu, Xibin, Zhang, Wang, Zhang, Ru, Peng, Yanghua, Lin, Haibin, Wu, Chuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
Laminar: A Scalable Asynchronous RL Post-Training Framework
di: Sheng, Guangming, et al.
Pubblicazione: (2025)
di: Sheng, Guangming, et al.
Pubblicazione: (2025)
QSync: Quantization-Minimized Synchronous Distributed Training Across Hybrid Devices
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
MSPipe: Efficient Temporal GNN Training via Staleness-Aware Pipeline
di: Sheng, Guangming, et al.
Pubblicazione: (2024)
di: Sheng, Guangming, et al.
Pubblicazione: (2024)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
di: Zhong, Yuchen, et al.
Pubblicazione: (2023)
DynaFlow: Transparent and Flexible Intra-Device Parallelism via Programmable Operator Scheduling
di: Pan, Yi, et al.
Pubblicazione: (2026)
di: Pan, Yi, et al.
Pubblicazione: (2026)
DiffusionPipe: Training Large Diffusion Models with Efficient Pipelines
di: Tian, Ye, et al.
Pubblicazione: (2024)
di: Tian, Ye, et al.
Pubblicazione: (2024)
Overcoming Memory Constraints in Quantum Circuit Simulation with a High-Fidelity Compression Framework
di: Zhang, Boyuan, et al.
Pubblicazione: (2024)
di: Zhang, Boyuan, et al.
Pubblicazione: (2024)
SP-MoE: Speculative Decoding and Prefetching for Accelerating MoE-based Model Inference
di: Chen, Liangkun, et al.
Pubblicazione: (2025)
di: Chen, Liangkun, et al.
Pubblicazione: (2025)
Communication-Efficient Collaborative LLM Inference over LEO Satellite Networks
di: Zhang, Songge, et al.
Pubblicazione: (2026)
di: Zhang, Songge, et al.
Pubblicazione: (2026)
Schedule-Level Shared-Prefix Reuse for LLM RL Training
di: Li, Pengbo, et al.
Pubblicazione: (2026)
di: Li, Pengbo, et al.
Pubblicazione: (2026)
HAP: SPMD DNN Training on Heterogeneous GPU Clusters with Automated Program Synthesis
di: Zhang, Shiwei, et al.
Pubblicazione: (2024)
di: Zhang, Shiwei, et al.
Pubblicazione: (2024)
DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training
di: Wang, Zhixin, et al.
Pubblicazione: (2025)
di: Wang, Zhixin, et al.
Pubblicazione: (2025)
RLHFless: Serverless Computing for Efficient RLHF
di: Wei, Rui, et al.
Pubblicazione: (2026)
di: Wei, Rui, et al.
Pubblicazione: (2026)
Efficient Long Context Fine-tuning with Chunk Flow
di: Yuan, Xiulong, et al.
Pubblicazione: (2025)
di: Yuan, Xiulong, et al.
Pubblicazione: (2025)
MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production
di: Xue, Chunyu, et al.
Pubblicazione: (2026)
di: Xue, Chunyu, et al.
Pubblicazione: (2026)
A Flexible Programmable Pipeline Parallelism Framework for Efficient DNN Training
di: Jiang, Lijuan, et al.
Pubblicazione: (2025)
di: Jiang, Lijuan, et al.
Pubblicazione: (2025)
Enabling Efficient Batch Serving for LMaaS via Generation Length Prediction
di: Cheng, Ke, et al.
Pubblicazione: (2024)
di: Cheng, Ke, et al.
Pubblicazione: (2024)
MuxServe: Flexible Spatial-Temporal Multiplexing for Multiple LLM Serving
di: Duan, Jiangfei, et al.
Pubblicazione: (2024)
di: Duan, Jiangfei, et al.
Pubblicazione: (2024)
Distributed Indexing Schemes for k-Dominant Skyline Analytics on Uncertain Edge-IoT Data
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2023)
di: Lai, Chuan-Chi, et al.
Pubblicazione: (2023)
Efficient Hierarchical Storage Management Framework Empowered by Reinforcement Learning
di: Zhang, Tianru, et al.
Pubblicazione: (2022)
di: Zhang, Tianru, et al.
Pubblicazione: (2022)
Efficient Column-Wise N:M Pruning on RISC-V CPU
di: Chu, Chi-Wei, et al.
Pubblicazione: (2025)
di: Chu, Chi-Wei, et al.
Pubblicazione: (2025)
Design and Implementation of Code Completion System Based on LLM and CodeBERT Hybrid Subsystem
di: Zhang, Bingbing, et al.
Pubblicazione: (2025)
di: Zhang, Bingbing, et al.
Pubblicazione: (2025)
A Scheduling Framework for Efficient MoE Inference on Edge GPU-NDP Systems
di: Wu, Qi, et al.
Pubblicazione: (2026)
di: Wu, Qi, et al.
Pubblicazione: (2026)
MILLION: Mastering Long-Context LLM Inference Via Outlier-Immunized KV Product Quantization
di: Wang, Zongwu, et al.
Pubblicazione: (2025)
di: Wang, Zongwu, et al.
Pubblicazione: (2025)
Heterogeneity-Aware Memory Efficient Federated Learning via Progressive Layer Freezing
di: Yebo, Wu, et al.
Pubblicazione: (2024)
di: Yebo, Wu, et al.
Pubblicazione: (2024)
Optimus: Accelerating Large-Scale Multi-Modal LLM Training by Bubble Exploitation
di: Feng, Weiqi, et al.
Pubblicazione: (2024)
di: Feng, Weiqi, et al.
Pubblicazione: (2024)
ParaQAOA: Efficient Parallel Divide-and-Conquer QAOA for Large-Scale Max-Cut Problems Beyond 10,000 Vertices
di: Huang, Po-Hsuan, et al.
Pubblicazione: (2026)
di: Huang, Po-Hsuan, et al.
Pubblicazione: (2026)
CacheFlow: Efficient LLM Serving with 3D-Parallel KV Cache Restoration
di: Nian, Sean, et al.
Pubblicazione: (2026)
di: Nian, Sean, et al.
Pubblicazione: (2026)
AMP4EC: Adaptive Model Partitioning Framework for Efficient Deep Learning Inference in Edge Computing Environments
di: Zhang, Guilin, et al.
Pubblicazione: (2025)
di: Zhang, Guilin, et al.
Pubblicazione: (2025)
HydraInfer: Hybrid Disaggregated Scheduling for Multimodal Large Language Model Serving
di: Dong, Xianzhe, et al.
Pubblicazione: (2025)
di: Dong, Xianzhe, et al.
Pubblicazione: (2025)
Adaptra: Straggler-Resilient Hybrid-Parallel Training with Pipeline Adaptation
di: Wu, Tianyuan, et al.
Pubblicazione: (2025)
di: Wu, Tianyuan, et al.
Pubblicazione: (2025)
eLLM: Elastic Memory Management Framework for Efficient LLM Serving
di: Xu, Jiale, et al.
Pubblicazione: (2025)
di: Xu, Jiale, et al.
Pubblicazione: (2025)
Multi-Modal Style Transfer-based Prompt Tuning for Efficient Federated Domain Generalization
di: Chen, Yuliang, et al.
Pubblicazione: (2026)
di: Chen, Yuliang, et al.
Pubblicazione: (2026)
Maple: A Multi-agent System for Portable Deep Learning across Clusters
di: Wu, Molang, et al.
Pubblicazione: (2025)
di: Wu, Molang, et al.
Pubblicazione: (2025)
InternEvo: Efficient Long-sequence Large Language Model Training via Hybrid Parallelism and Redundant Sharding
di: Chen, Qiaoling, et al.
Pubblicazione: (2024)
di: Chen, Qiaoling, et al.
Pubblicazione: (2024)
TileLink: Generating Efficient Compute-Communication Overlapping Kernels using Tile-Centric Primitives
di: Zheng, Size, et al.
Pubblicazione: (2025)
di: Zheng, Size, et al.
Pubblicazione: (2025)
SDSL-Solver: Scalable Distributed Sparse Linear Solvers for Large-Scale Interior Point Methods
di: Yang, Shaofeng, et al.
Pubblicazione: (2026)
di: Yang, Shaofeng, et al.
Pubblicazione: (2026)
MegaScale-Data: Scaling Dataloader for Multisource Large Foundation Model Training
di: Zhao, Juntao, et al.
Pubblicazione: (2025)
di: Zhao, Juntao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
di: Dong, Jiangwen, et al.
Pubblicazione: (2025) -
Laminar: A Scalable Asynchronous RL Post-Training Framework
di: Sheng, Guangming, et al.
Pubblicazione: (2025) -
QSync: Quantization-Minimized Synchronous Distributed Training Across Hybrid Devices
di: Zhao, Juntao, et al.
Pubblicazione: (2024) -
LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization
di: Zhao, Juntao, et al.
Pubblicazione: (2024) -
MSPipe: Efficient Temporal GNN Training via Staleness-Aware Pipeline
di: Sheng, Guangming, et al.
Pubblicazione: (2024)