Swing: Short-cutting Rings for Higher Bandwidth Allreduce
Fuente:
arXiv
Salvato in:
| Autori principali: | De Sensi, Daniele, Bonato, Tommaso, Saam, David, Hoefler, Torsten |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bine Trees: Enhancing Collective Operations by Optimizing Communication Locality
di: De Sensi, Daniele, et al.
Pubblicazione: (2025)
di: De Sensi, Daniele, et al.
Pubblicazione: (2025)
Exploring GPU-to-GPU Communication: Insights into Supercomputer Interconnects
di: De Sensi, Daniele, et al.
Pubblicazione: (2024)
di: De Sensi, Daniele, et al.
Pubblicazione: (2024)
Towards Policy-Enabled Multi-Hop Routing for Cross-Chain Message Delivery
di: Rezaei, Amin, et al.
Pubblicazione: (2026)
di: Rezaei, Amin, et al.
Pubblicazione: (2026)
Near-Optimal Wafer-Scale Reduce
di: Luczynski, Piotr, et al.
Pubblicazione: (2024)
di: Luczynski, Piotr, et al.
Pubblicazione: (2024)
Exploiting Spot Instances for Time-Critical Cloud Workloads Using Optimal Randomized Strategies
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)
Opportunistic Scheduling for Optimal Spot Instance Savings in the Cloud
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)
Bandwidth Efficient Livestreaming in Mobile Wireless Networks: A Peer-to-Peer ACIDE Solution
di: Negulescu, Andrei, et al.
Pubblicazione: (2023)
di: Negulescu, Andrei, et al.
Pubblicazione: (2023)
Moonshot: Optimizing Chain-Based Rotating Leader BFT via Optimistic Proposals
di: Doidge, Isaac, et al.
Pubblicazione: (2024)
di: Doidge, Isaac, et al.
Pubblicazione: (2024)
A Survey on Heterogeneous Computing Using SmartNICs and Emerging Data Processing Units
di: Tibbetts, Nathan, et al.
Pubblicazione: (2025)
di: Tibbetts, Nathan, et al.
Pubblicazione: (2025)
Konnektor: Connection Protocol for Ensuring Peer Uniqueness in Decentralized P2P Networks
di: Ozkan, Onur
Pubblicazione: (2024)
di: Ozkan, Onur
Pubblicazione: (2024)
Directives for Function Offloading in 5G Networks Based on a Performance Characteristics Analysis
di: Dettinger, Falk, et al.
Pubblicazione: (2025)
di: Dettinger, Falk, et al.
Pubblicazione: (2025)
Cognitive Infrastructure: A Unified DCIM Framework for AI Data Centers
di: Sunkara, Krishna Chaitanya
Pubblicazione: (2026)
di: Sunkara, Krishna Chaitanya
Pubblicazione: (2026)
How Can We Train Deep Learning Models Across Clouds and Continents? An Experimental Study
di: Erben, Alexander, et al.
Pubblicazione: (2023)
di: Erben, Alexander, et al.
Pubblicazione: (2023)
LLAMP: Assessing Network Latency Tolerance of HPC Applications with Linear Programming
di: Shen, Siyuan, et al.
Pubblicazione: (2024)
di: Shen, Siyuan, et al.
Pubblicazione: (2024)
Active Admission Control in a P2P Distributed Environment for Capacity Efficient Livestreaming in Mobile Wireless Networks
di: Negulescu, Andrei, et al.
Pubblicazione: (2023)
di: Negulescu, Andrei, et al.
Pubblicazione: (2023)
Resilient AI Supercomputer Networking using MRC and SRv6
di: Araujo, Joao, et al.
Pubblicazione: (2026)
di: Araujo, Joao, et al.
Pubblicazione: (2026)
Security Analysis of Bitcoin's V2 Transport Protocol: Exploiting Design Implications for Sustained Eclipse and Downgrade Attacks
di: Ndolo, Charmaine, et al.
Pubblicazione: (2026)
di: Ndolo, Charmaine, et al.
Pubblicazione: (2026)
Nezha: Deployable and High-Performance Consensus Using Synchronized Clocks
di: Geng, Jinkun, et al.
Pubblicazione: (2022)
di: Geng, Jinkun, et al.
Pubblicazione: (2022)
Verifying In-Network Computing Systems for Design Risks
di: Bai, Tianyu, et al.
Pubblicazione: (2026)
di: Bai, Tianyu, et al.
Pubblicazione: (2026)
FPsPIN: An FPGA-based Open-Hardware Research Platform for Processing in the Network
di: Schneider, Timo, et al.
Pubblicazione: (2024)
di: Schneider, Timo, et al.
Pubblicazione: (2024)
Collective Communication for 100k+ GPUs
di: Si, Min, et al.
Pubblicazione: (2025)
di: Si, Min, et al.
Pubblicazione: (2025)
Tetris: An SLA-aware Application Placement Strategy in the Edge-Cloud Continuum
di: Almeida, Lucas, et al.
Pubblicazione: (2025)
di: Almeida, Lucas, et al.
Pubblicazione: (2025)
Joint Task Offloading and Routing in Wireless Multi-hop Networks Using Biased Backpressure Algorithm
di: Zhao, Zhongyuan, et al.
Pubblicazione: (2024)
di: Zhao, Zhongyuan, et al.
Pubblicazione: (2024)
Pioplat: A Scalable, Low-Cost Framework for Latency Reduction in Ethereum Blockchain
di: Wang, Ke, et al.
Pubblicazione: (2024)
di: Wang, Ke, et al.
Pubblicazione: (2024)
PICO: Performance Insights for Collective Operations
di: Pasqualoni, Saverio, et al.
Pubblicazione: (2025)
di: Pasqualoni, Saverio, et al.
Pubblicazione: (2025)
Self-Adaptive Probabilistic Skyline Query Processing in Distributed Edge Computing via Deep Reinforcement Learning
di: Lai, Chuan-Chi
Pubblicazione: (2026)
di: Lai, Chuan-Chi
Pubblicazione: (2026)
Near-Optimal Sparse Allreduce for Distributed Deep Learning
di: Li, Shigang, et al.
Pubblicazione: (2022)
di: Li, Shigang, et al.
Pubblicazione: (2022)
On the Bandwidth Consumption of Blockchains
di: Lebedev, Andrei, et al.
Pubblicazione: (2026)
di: Lebedev, Andrei, et al.
Pubblicazione: (2026)
Credibility Trilemma in Polymatroidal Service Markets
di: Lovén, Lauri, et al.
Pubblicazione: (2026)
di: Lovén, Lauri, et al.
Pubblicazione: (2026)
Reexamining Paradigms of End-to-End Data Movement
di: Fang, Chin, et al.
Pubblicazione: (2025)
di: Fang, Chin, et al.
Pubblicazione: (2025)
Demystifying NCCL: An In-depth Analysis of GPU Communication Protocols and Algorithms
di: Hu, Zhiyi, et al.
Pubblicazione: (2025)
di: Hu, Zhiyi, et al.
Pubblicazione: (2025)
MultiPath Memory Access: Breaking Host-GPU Bandwidth Bottlenecks in LLM Services
di: Tang, Lingfeng, et al.
Pubblicazione: (2025)
di: Tang, Lingfeng, et al.
Pubblicazione: (2025)
Uno: A One-Stop Solution for Inter- and Intra-Datacenter Congestion Control and Reliable Connectivity
di: Bonato, Tommaso, et al.
Pubblicazione: (2025)
di: Bonato, Tommaso, et al.
Pubblicazione: (2025)
MECKD: Deep Learning-Based Fall Detection in Multilayer Mobile Edge Computing With Knowledge Distillation
di: Mao, Wei-Lung, et al.
Pubblicazione: (2025)
di: Mao, Wei-Lung, et al.
Pubblicazione: (2025)
A Framework for testing Federated Learning algorithms using an edge-like environment
di: Schwanck, Felipe Machado, et al.
Pubblicazione: (2024)
di: Schwanck, Felipe Machado, et al.
Pubblicazione: (2024)
Service Discovery-Based Hybrid Network Middleware for Efficient Communication in Distributed Robotic Systems
di: Sang, Shiyao, et al.
Pubblicazione: (2025)
di: Sang, Shiyao, et al.
Pubblicazione: (2025)
T3: Transparent Tracking & Triggering for Fine-grained Overlap of Compute & Collectives
di: Pati, Suchita, et al.
Pubblicazione: (2024)
di: Pati, Suchita, et al.
Pubblicazione: (2024)
Stabilizing Consensus is Impossible in Lossy Iterated Immediate Snapshot Models
di: Felber, Stephan, et al.
Pubblicazione: (2024)
di: Felber, Stephan, et al.
Pubblicazione: (2024)
EvalNet: A Practical Toolchain for Generation and Analysis of Extreme-Scale Interconnects
di: Besta, Maciej, et al.
Pubblicazione: (2021)
di: Besta, Maciej, et al.
Pubblicazione: (2021)
Designing Scalable Rate Limiting Systems: Algorithms, Architecture, and Distributed Solutions
di: Guan, Bo
Pubblicazione: (2026)
di: Guan, Bo
Pubblicazione: (2026)
Documenti analoghi
-
Bine Trees: Enhancing Collective Operations by Optimizing Communication Locality
di: De Sensi, Daniele, et al.
Pubblicazione: (2025) -
Exploring GPU-to-GPU Communication: Insights into Supercomputer Interconnects
di: De Sensi, Daniele, et al.
Pubblicazione: (2024) -
Towards Policy-Enabled Multi-Hop Routing for Cross-Chain Message Delivery
di: Rezaei, Amin, et al.
Pubblicazione: (2026) -
Near-Optimal Wafer-Scale Reduce
di: Luczynski, Piotr, et al.
Pubblicazione: (2024) -
Exploiting Spot Instances for Time-Critical Cloud Workloads Using Optimal Randomized Strategies
di: Bhuyan, Neelkamal, et al.
Pubblicazione: (2026)