SwiftQueue: Optimizing Low-Latency Applications with Swift Packet Queuing
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ray, Siddhant, Jiang, Xi, Luo, Jack, Feamster, Nick, Jiang, Junchen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Characterizing the Impact of Active Queue Management on Speed Test Measurements
von: Ray, Siddhant, et al.
Veröffentlicht: (2025)
von: Ray, Siddhant, et al.
Veröffentlicht: (2025)
Eloquent: A More Robust Transmission Scheme for LLM Token Streaming
von: Li, Hanchen, et al.
Veröffentlicht: (2024)
von: Li, Hanchen, et al.
Veröffentlicht: (2024)
SwiftChannel: Algorithm-Hardware Co-Design for Deep Learning-Based 5G Channel Estimation
von: Lyu, Shengzhe, et al.
Veröffentlicht: (2026)
von: Lyu, Shengzhe, et al.
Veröffentlicht: (2026)
CAIP: Detecting Router Misconfigurations with Context-Aware Iterative Prompting of LLMs
von: Jiang, Xi, et al.
Veröffentlicht: (2024)
von: Jiang, Xi, et al.
Veröffentlicht: (2024)
Less is More: Optimizing Probe Selection Using Shared Latency Anomalies
von: Sharma, Taveesh, et al.
Veröffentlicht: (2026)
von: Sharma, Taveesh, et al.
Veröffentlicht: (2026)
CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
Learning Sub-Second Routing Optimization in Computer Networks requires Packet-Level Dynamics
von: Boltres, Andreas, et al.
Veröffentlicht: (2024)
von: Boltres, Andreas, et al.
Veröffentlicht: (2024)
BiSwift: Bandwidth Orchestrator for Multi-Stream Video Analytics on Edge
von: Sun, Lin, et al.
Veröffentlicht: (2023)
von: Sun, Lin, et al.
Veröffentlicht: (2023)
FlexCross: High-Speed and Flexible Packet Processing via a Crosspoint-Queued Crossbar
von: Zyla, Klajd, et al.
Veröffentlicht: (2024)
von: Zyla, Klajd, et al.
Veröffentlicht: (2024)
Beyond Data Points: Regionalizing Crowdsourced Latency Measurements
von: Sharma, Taveesh, et al.
Veröffentlicht: (2024)
von: Sharma, Taveesh, et al.
Veröffentlicht: (2024)
A Constrained RL Approach for Cost-Efficient Delivery of Latency-Sensitive Applications
von: Aygün, Ozan, et al.
Veröffentlicht: (2026)
von: Aygün, Ozan, et al.
Veröffentlicht: (2026)
NetLLM: Adapting Large Language Models for Networking
von: Wu, Duo, et al.
Veröffentlicht: (2024)
von: Wu, Duo, et al.
Veröffentlicht: (2024)
A Queuing Envelope Model for Estimating Latency Guarantees in Deterministic Networking Scenarios
von: Koneva, Nataliia, et al.
Veröffentlicht: (2024)
von: Koneva, Nataliia, et al.
Veröffentlicht: (2024)
Feasibility of State Space Models for Network Traffic Generation
von: Chu, Andrew, et al.
Veröffentlicht: (2024)
von: Chu, Andrew, et al.
Veröffentlicht: (2024)
NetSSM: Multi-Flow and State-Aware Network Trace Generation using State Space Models
von: Chu, Andrew, et al.
Veröffentlicht: (2025)
von: Chu, Andrew, et al.
Veröffentlicht: (2025)
Optimal Packetization Towards Low Latency in Random Access Networks (extended version)
von: Li, Zihong, et al.
Veröffentlicht: (2025)
von: Li, Zihong, et al.
Veröffentlicht: (2025)
Swift: Rethinking RDMA Control Plane for Elastic Computing
von: Zhang, Junxue, et al.
Veröffentlicht: (2025)
von: Zhang, Junxue, et al.
Veröffentlicht: (2025)
Multi-Plane HyperX: A Low-Latency and Cost-Effective Network for Large-Scale AI and HPC Systems
von: Wang, Ziyu, et al.
Veröffentlicht: (2026)
von: Wang, Ziyu, et al.
Veröffentlicht: (2026)
CATO: End-to-End Optimization of ML-Based Traffic Analysis Pipelines
von: Wan, Gerry, et al.
Veröffentlicht: (2024)
von: Wan, Gerry, et al.
Veröffentlicht: (2024)
A Queueing Theoretic Perspective on Low-Latency LLM Inference with Variable Token Length
von: Yang, Yuqing, et al.
Veröffentlicht: (2024)
von: Yang, Yuqing, et al.
Veröffentlicht: (2024)
Confucius: Achieving Consistent Low Latency with Practical Queue Management for Real-Time Communications
von: Meng, Zili, et al.
Veröffentlicht: (2023)
von: Meng, Zili, et al.
Veröffentlicht: (2023)
Modeling and Optimizing Latency for Delayed Hit Caching with Stochastic Miss Latency
von: Jiang, Bowen, et al.
Veröffentlicht: (2025)
von: Jiang, Bowen, et al.
Veröffentlicht: (2025)
BShare: Packet Queueing Delay-Driven Buffer Sharing for Datacenter Switches
von: Agarwal, Krishna, et al.
Veröffentlicht: (2026)
von: Agarwal, Krishna, et al.
Veröffentlicht: (2026)
Queueing-Aware Optimization of Reasoning Tokens for Accuracy-Latency Trade-offs in LLM Servers
von: Ozbas, Emre, et al.
Veröffentlicht: (2026)
von: Ozbas, Emre, et al.
Veröffentlicht: (2026)
When Semantic Communication Meets Queueing: Cross-Layer Latency and Task Fidelity Optimization
von: Sagduyu, Yalin E., et al.
Veröffentlicht: (2026)
von: Sagduyu, Yalin E., et al.
Veröffentlicht: (2026)
FastFlow: Early Yet Robust Network Flow Classification using the Minimal Number of Time-Series Packets
von: Babaria, Rushi Jayeshkumar, et al.
Veröffentlicht: (2025)
von: Babaria, Rushi Jayeshkumar, et al.
Veröffentlicht: (2025)
Programmable Cycle-Specified Queue for Long-Distance Industrial Deterministic Packet Scheduling
von: Huang, Yudong, et al.
Veröffentlicht: (2024)
von: Huang, Yudong, et al.
Veröffentlicht: (2024)
DVFS-Aware DNN Inference on GPUs: Latency Modeling and Performance Analysis
von: Han, Yunchu, et al.
Veröffentlicht: (2025)
von: Han, Yunchu, et al.
Veröffentlicht: (2025)
Jamming-Resilient PRB Reservation for Latency-Critical O-RAN Network Slicing
von: Delavari, Elahe, et al.
Veröffentlicht: (2026)
von: Delavari, Elahe, et al.
Veröffentlicht: (2026)
Generative Active Adaptation for Drifting and Imbalanced Network Intrusion Detection
von: Gupta, Ragini, et al.
Veröffentlicht: (2025)
von: Gupta, Ragini, et al.
Veröffentlicht: (2025)
Chronicles of Jockeying in Queuing Systems
von: Kiggundu, Anthony, et al.
Veröffentlicht: (2024)
von: Kiggundu, Anthony, et al.
Veröffentlicht: (2024)
LoLaFL: Low-Latency Federated Learning via Forward-only Propagation
von: Zhang, Jierui, et al.
Veröffentlicht: (2024)
von: Zhang, Jierui, et al.
Veröffentlicht: (2024)
Characterizing the Configuration of Starlink Queuing
von: Garcia, Johan, et al.
Veröffentlicht: (2026)
von: Garcia, Johan, et al.
Veröffentlicht: (2026)
Guaranteed Dynamic Scheduling of Ultra-Reliable Low-Latency Traffic via Conformal Prediction
von: Cohen, Kfir M., et al.
Veröffentlicht: (2023)
von: Cohen, Kfir M., et al.
Veröffentlicht: (2023)
Minimizing Queue Length Regret for Arbitrarily Varying Channels
von: Krishnakumar, G, et al.
Veröffentlicht: (2025)
von: Krishnakumar, G, et al.
Veröffentlicht: (2025)
Impact of Packetization on Network Calculus Analysis
von: Jiang, Yming
Veröffentlicht: (2025)
von: Jiang, Yming
Veröffentlicht: (2025)
Joint Energy and Latency Optimization in Federated Learning over Cell-Free Massive MIMO Networks
von: Mahmoudi, Afsaneh, et al.
Veröffentlicht: (2024)
von: Mahmoudi, Afsaneh, et al.
Veröffentlicht: (2024)
ReinWiFi: Application-Layer QoS Optimization of WiFi Networks with Reinforcement Learning
von: Li, Qianren, et al.
Veröffentlicht: (2024)
von: Li, Qianren, et al.
Veröffentlicht: (2024)
Learning-Augmented Online Packet Scheduling with Deadlines
von: Liang, Ya-Chun, et al.
Veröffentlicht: (2023)
von: Liang, Ya-Chun, et al.
Veröffentlicht: (2023)
GoT: Decreasing DCC Queuing for CAM Messages
von: Amador, Oscar, et al.
Veröffentlicht: (2024)
von: Amador, Oscar, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Characterizing the Impact of Active Queue Management on Speed Test Measurements
von: Ray, Siddhant, et al.
Veröffentlicht: (2025) -
Eloquent: A More Robust Transmission Scheme for LLM Token Streaming
von: Li, Hanchen, et al.
Veröffentlicht: (2024) -
SwiftChannel: Algorithm-Hardware Co-Design for Deep Learning-Based 5G Channel Estimation
von: Lyu, Shengzhe, et al.
Veröffentlicht: (2026) -
CAIP: Detecting Router Misconfigurations with Context-Aware Iterative Prompting of LLMs
von: Jiang, Xi, et al.
Veröffentlicht: (2024) -
Less is More: Optimizing Probe Selection Using Shared Latency Anomalies
von: Sharma, Taveesh, et al.
Veröffentlicht: (2026)