Enregistré dans:
| Auteurs principaux: | Cai, Ye, Yang, Zonglin, Ni, Liwei, Xie, Biwei, Li, Xingquan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2404.13614 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Parallel AIG Refactoring via Conflict Breaking
par: Cai, Ye, et autres
Publié: (2024)
par: Cai, Ye, et autres
Publié: (2024)
Lectures on Parallel Computing
par: Träff, Jesper Larsson
Publié: (2024)
par: Träff, Jesper Larsson
Publié: (2024)
Mapping Gemma3 onto an Edge Dataflow Architecture
par: Du, Shouyu, et autres
Publié: (2026)
par: Du, Shouyu, et autres
Publié: (2026)
Parallel Collaborative ADMM Privacy Computing and Adaptive GPU Acceleration for Distributed Edge Networks
par: Xia, Mengchun, et autres
Publié: (2026)
par: Xia, Mengchun, et autres
Publié: (2026)
Communication-Computation Pipeline Parallel Split Learning over Wireless Edge Networks
par: Liu, Chenyu, et autres
Publié: (2025)
par: Liu, Chenyu, et autres
Publié: (2025)
Optimizing Long-context LLM Serving via Fine-grained Sequence Parallelism
par: Li, Cong, et autres
Publié: (2025)
par: Li, Cong, et autres
Publié: (2025)
Neutron particle transport 3D method of characteristic Multi GPU platform Parallel Computing
par: Zhou, Faguo, et autres
Publié: (2025)
par: Zhou, Faguo, et autres
Publié: (2025)
SparseMap: Loop Mapping for Sparse CNNs on Streaming Coarse-grained Reconfigurable Array
par: Ni, Xiaobing, et autres
Publié: (2024)
par: Ni, Xiaobing, et autres
Publié: (2024)
Enhancing Memory Efficiency in Large Language Model Training Through Chronos-aware Pipeline Parallelism
par: Lin, Xinyuan, et autres
Publié: (2025)
par: Lin, Xinyuan, et autres
Publié: (2025)
Resource-efficient Parallel Split Learning in Heterogeneous Edge Computing
par: Zhang, Mingjin, et autres
Publié: (2024)
par: Zhang, Mingjin, et autres
Publié: (2024)
What Every Computer Scientist Needs To Know About Parallelization
par: Adefemi, Temitayo
Publié: (2025)
par: Adefemi, Temitayo
Publié: (2025)
Deferred Objects to Enhance Smart Contract Programming with Optimistic Parallel Execution
par: Mitenkov, George, et autres
Publié: (2024)
par: Mitenkov, George, et autres
Publié: (2024)
EinDecomp: Decomposition of Declaratively-Specified Machine Learning and Numerical Computations for Parallel Execution
par: Bourgeois, Daniel, et autres
Publié: (2024)
par: Bourgeois, Daniel, et autres
Publié: (2024)
Malleus: Straggler-Resilient Hybrid Parallel Training of Large-scale Models via Malleable Data and Model Parallelization
par: Li, Haoyang, et autres
Publié: (2024)
par: Li, Haoyang, et autres
Publié: (2024)
GPU-Based Parallel Computing Methods for Medical Photoacoustic Image Reconstruction
par: Yi, Xinyao, et autres
Publié: (2024)
par: Yi, Xinyao, et autres
Publié: (2024)
Minimizing Communication for Parallel Symmetric Tensor Times Same Vector Computation
par: Daas, Hussam Al, et autres
Publié: (2025)
par: Daas, Hussam Al, et autres
Publié: (2025)
Mapping Parallel Matrix Multiplication in GotoBLAS2 to the AMD Versal ACAP for Deep Learning
par: Lei, Jie, et autres
Publié: (2024)
par: Lei, Jie, et autres
Publié: (2024)
DCP: Addressing Input Dynamism In Long-Context Training via Dynamic Context Parallelism
par: Jiang, Chenyu, et autres
Publié: (2025)
par: Jiang, Chenyu, et autres
Publié: (2025)
A Unified Approach to Concurrent, Parallel Map-Reduce in R using Futures
par: Bengtsson, Henrik
Publié: (2026)
par: Bengtsson, Henrik
Publié: (2026)
Balancing Pipeline Parallelism with Vocabulary Parallelism
par: Yeung, Man Tsung, et autres
Publié: (2024)
par: Yeung, Man Tsung, et autres
Publié: (2024)
Unleashing Scalable Context Parallelism for Foundation Models Pre-Training via FCP
par: Zhao, Yilong, et autres
Publié: (2026)
par: Zhao, Yilong, et autres
Publié: (2026)
Optimizing View Change for Byzantine Fault Tolerance in Parallel Consensus
par: Xie, Yifei, et autres
Publié: (2026)
par: Xie, Yifei, et autres
Publié: (2026)
Parallel Reduced Order Modeling for Digital Twins using High-Performance Computing Workflows
par: de Parga, S. Ares, et autres
Publié: (2024)
par: de Parga, S. Ares, et autres
Publié: (2024)
Mining Area Skyline Objects from Map-based Big Data using Apache Spark Framework
par: Li, Chen, et autres
Publié: (2024)
par: Li, Chen, et autres
Publié: (2024)
Optimizing Task Scheduling in Heterogeneous Computing Environments: A Comparative Analysis of CPU, GPU, and ASIC Platforms Using E2C Simulator
par: Mohammadjafari, Ali, et autres
Publié: (2024)
par: Mohammadjafari, Ali, et autres
Publié: (2024)
ResiHP: Taming LLM Training Failures with Dynamic Hybrid Parallelism
par: Ma, Tenghui, et autres
Publié: (2026)
par: Ma, Tenghui, et autres
Publié: (2026)
Accelerating Heterogeneous Tensor Parallelism via Flexible Workload Control
par: Wang, Zhigang, et autres
Publié: (2024)
par: Wang, Zhigang, et autres
Publié: (2024)
FedRFQ: Prototype-Based Federated Learning with Reduced Redundancy, Minimal Failure, and Enhanced Quality
par: Yan, Biwei, et autres
Publié: (2024)
par: Yan, Biwei, et autres
Publié: (2024)
Synergistic Tensor and Pipeline Parallelism
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
ZeroPP: Unleashing Exceptional Parallelism Efficiency through Tensor-Parallelism-Free Methodology
par: Tang, Ding, et autres
Publié: (2024)
par: Tang, Ding, et autres
Publié: (2024)
Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism
par: Wei, Jinhui, et autres
Publié: (2025)
par: Wei, Jinhui, et autres
Publié: (2025)
Committee Configuration Optimization for Parallel Byzantine Consensus in a Trusted Execution Environment
par: Xie, Yifei, et autres
Publié: (2026)
par: Xie, Yifei, et autres
Publié: (2026)
SPPO:Efficient Long-sequence LLM Training via Adaptive Sequence Pipeline Parallel Offloading
par: Chen, Qiaoling, et autres
Publié: (2025)
par: Chen, Qiaoling, et autres
Publié: (2025)
NanoCP: Request-Level Dynamic Context Parallelism for Data-Expert Parallel Decoding
par: Chen, Jiefei, et autres
Publié: (2026)
par: Chen, Jiefei, et autres
Publié: (2026)
Communication-Efficient Model Aggregation with Layer Divergence Feedback in Federated Learning
par: Wang, Liwei, et autres
Publié: (2024)
par: Wang, Liwei, et autres
Publié: (2024)
A Flexible Programmable Pipeline Parallelism Framework for Efficient DNN Training
par: Jiang, Lijuan, et autres
Publié: (2025)
par: Jiang, Lijuan, et autres
Publié: (2025)
Linear Complexity $\mathcal{H}^2$ Direct Solver for Fine-Grained Parallel Architectures
par: Boukaram, Wajih, et autres
Publié: (2025)
par: Boukaram, Wajih, et autres
Publié: (2025)
Driving Computational Efficiency in Large-Scale Platforms using HPC Technologies
par: Mendez, Alexander Martinez, et autres
Publié: (2026)
par: Mendez, Alexander Martinez, et autres
Publié: (2026)
A Unified Programming Model for Heterogeneous Computing with CPU and Accelerator Technologies
par: Xiong, Yuqing
Publié: (2022)
par: Xiong, Yuqing
Publié: (2022)
Oases: Efficient Large-Scale Model Training on Commodity Servers via Overlapped and Automated Tensor Model Parallelism
par: Li, Shengwei, et autres
Publié: (2023)
par: Li, Shengwei, et autres
Publié: (2023)
Documents similaires
-
Parallel AIG Refactoring via Conflict Breaking
par: Cai, Ye, et autres
Publié: (2024) -
Lectures on Parallel Computing
par: Träff, Jesper Larsson
Publié: (2024) -
Mapping Gemma3 onto an Edge Dataflow Architecture
par: Du, Shouyu, et autres
Publié: (2026) -
Parallel Collaborative ADMM Privacy Computing and Adaptive GPU Acceleration for Distributed Edge Networks
par: Xia, Mengchun, et autres
Publié: (2026) -
Communication-Computation Pipeline Parallel Split Learning over Wireless Edge Networks
par: Liu, Chenyu, et autres
Publié: (2025)