Large-Scale Graph Building in Dynamic Environments: Low Latency and High Quality
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | de Almeida, Filipe Miguel Gonçalves, Carey, CJ, Fichtenberger, Hendrik, Halcrow, Jonathan, Lattanzi, Silvio, Linhares, André, Meng, Tao, Norouzi-Fard, Ashkan, Parotsidis, Nikos, Perozzi, Bryan, Simcha, David |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reducing Tail Latencies Through Environment- and Neighbour-aware Thread Management
par: Jeffery, Andrew, et autres
Publié: (2024)
par: Jeffery, Andrew, et autres
Publié: (2024)
SEE++: Evolving Snowpark Execution Environment for Modern Workloads
par: Jain, Gaurav, et autres
Publié: (2025)
par: Jain, Gaurav, et autres
Publié: (2025)
Asynchronous Latency and Fast Atomic Snapshot
par: Bezerra, João Paulo, et autres
Publié: (2024)
par: Bezerra, João Paulo, et autres
Publié: (2024)
LA-IMR: Latency-Aware, Predictive In-Memory Routing and Proactive Autoscaling for Tail-Latency-Sensitive Cloud Robotics
par: Seo, Eunil, et autres
Publié: (2025)
par: Seo, Eunil, et autres
Publié: (2025)
Mahi-Mahi: Low-Latency Asynchronous BFT DAG-Based Consensus
par: Jovanovic, Philipp, et autres
Publié: (2024)
par: Jovanovic, Philipp, et autres
Publié: (2024)
DAG it off: Latency Prefers No Common Coins
par: Amores-Sesar, Ignacio, et autres
Publié: (2025)
par: Amores-Sesar, Ignacio, et autres
Publié: (2025)
Methodology for GPU Frequency Switching Latency Measurement
par: Velicka, Daniel, et autres
Publié: (2025)
par: Velicka, Daniel, et autres
Publié: (2025)
Areon: Latency-Friendly and Resilient Multi-Proposer Consensus
par: Castro-Castilla, Álvaro, et autres
Publié: (2025)
par: Castro-Castilla, Álvaro, et autres
Publié: (2025)
Clustering with Label Consistency
par: Chakraborty, Diptarka, et autres
Publié: (2025)
par: Chakraborty, Diptarka, et autres
Publié: (2025)
Tasking framework for Adaptive Speculative Parallel Mesh Generation
par: Tsolakis, Christos, et autres
Publié: (2024)
par: Tsolakis, Christos, et autres
Publié: (2024)
Highly-Efficient Persistent FIFO Queues
par: Fatourou, Panagiota, et autres
Publié: (2024)
par: Fatourou, Panagiota, et autres
Publié: (2024)
Distributed Semi-Speculative Parallel Anisotropic Mesh Adaptation
par: Garner, Kevin, et autres
Publié: (2026)
par: Garner, Kevin, et autres
Publié: (2026)
Revisiting Speculative Leaderless Protocols for Low-Latency BFT Replication
par: Qian, Daniel, et autres
Publié: (2026)
par: Qian, Daniel, et autres
Publié: (2026)
Hiding Latencies in Network-Based Image Loading for Deep Learning
par: Versaci, Francesco, et autres
Publié: (2025)
par: Versaci, Francesco, et autres
Publié: (2025)
Low Latency, High Bandwidth Streaming of Experimental Data with EJFAT
par: Baldin, Ilya, et autres
Publié: (2025)
par: Baldin, Ilya, et autres
Publié: (2025)
CD-Raft: Reducing the Latency of Distributed Consensus in Cross-Domain Sites
par: Wang, Yangyang, et autres
Publié: (2026)
par: Wang, Yangyang, et autres
Publié: (2026)
Falcon: Advancing Asynchronous BFT Consensus for Lower Latency and Enhanced Throughput
par: Dai, Xiaohai, et autres
Publié: (2025)
par: Dai, Xiaohai, et autres
Publié: (2025)
Memory Offloading for Large Language Model Inference with Latency SLO Guarantees
par: Ma, Chenxiang, et autres
Publié: (2025)
par: Ma, Chenxiang, et autres
Publié: (2025)
Accelerating Mixture-of-Experts Inference by Hiding Offloading Latency with Speculative Decoding
par: Wang, Zhibin, et autres
Publié: (2025)
par: Wang, Zhibin, et autres
Publié: (2025)
A New Approach for Evaluating the Performance of Distributed Latency-Sensitive Services
par: Theodoropoulos, Theodoros, et autres
Publié: (2024)
par: Theodoropoulos, Theodoros, et autres
Publié: (2024)
Proteus: Append-Only Ledgers for (Mostly) Trusted Execution Environments
par: Mishra, Shubham, et autres
Publié: (2026)
par: Mishra, Shubham, et autres
Publié: (2026)
Shared Memory-Aware Latency-Sensitive Message Aggregation for Fine-Grained Communication
par: Chandrasekar, Kavitha, et autres
Publié: (2024)
par: Chandrasekar, Kavitha, et autres
Publié: (2024)
BBCA-CHAIN: Low Latency, High Throughput BFT Consensus on a DAG
par: Malkhi, Dahlia, et autres
Publié: (2023)
par: Malkhi, Dahlia, et autres
Publié: (2023)
Scene-Aware Latency Estimation for Microservices via Multi-Scale Graph Fusion
par: Sun, Zhichao, et autres
Publié: (2026)
par: Sun, Zhichao, et autres
Publié: (2026)
OOCO: Latency-disaggregated Architecture for Online-Offline Co-locate LLM Serving
par: Wu, Siyu, et autres
Publié: (2025)
par: Wu, Siyu, et autres
Publié: (2025)
Shift Parallelism: Low-Latency, High-Throughput LLM Inference for Dynamic Workloads
par: Hidayetoglu, Mert, et autres
Publié: (2025)
par: Hidayetoglu, Mert, et autres
Publié: (2025)
Low-Latency Layer-Aware Proactive and Passive Container Migration in Meta Computing
par: Liu, Mengjie, et autres
Publié: (2024)
par: Liu, Mengjie, et autres
Publié: (2024)
Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference
par: Yu, Minchen, et autres
Publié: (2023)
par: Yu, Minchen, et autres
Publié: (2023)
Chasing the Speed of Light: Low-Latency Planetary-Scale Adaptive Byzantine Consensus
par: Berger, Christian, et autres
Publié: (2023)
par: Berger, Christian, et autres
Publié: (2023)
Cortex: Workflow-Aware Resource Pooling and Scheduling for Agentic Serving
par: Pagonas, Nikos, et autres
Publié: (2025)
par: Pagonas, Nikos, et autres
Publié: (2025)
A Virtual Laboratory for Managing Computational Experiments
par: Adamidi, Eleni, et autres
Publié: (2025)
par: Adamidi, Eleni, et autres
Publié: (2025)
HydraServe: Minimizing Cold Start Latency for Serverless LLM Serving in Public Clouds
par: Lou, Chiheng, et autres
Publié: (2025)
par: Lou, Chiheng, et autres
Publié: (2025)
PCR: A Prefetch-Enhanced Cache Reuse System for Low-Latency RAG Serving
par: Wang, Wenfeng, et autres
Publié: (2026)
par: Wang, Wenfeng, et autres
Publié: (2026)
TailBench++: Flexible Multi-Client, Multi-Server Benchmarking for Latency-Critical Workloads
par: Li, Zhilin, et autres
Publié: (2025)
par: Li, Zhilin, et autres
Publié: (2025)
CascadeInfer: Length-Aware Scheduling of LLM Serving with Low Latency and Load Balancing
par: Yuan, Yitao, et autres
Publié: (2025)
par: Yuan, Yitao, et autres
Publié: (2025)
Cold Start Latency in Serverless Computing: A Systematic Review, Taxonomy, and Future Directions
par: Golec, Muhammed, et autres
Publié: (2023)
par: Golec, Muhammed, et autres
Publié: (2023)
Accelerating Edge Inference for Distributed MoE Models with Latency-Optimized Expert Placement
par: Wu, Tian, et autres
Publié: (2025)
par: Wu, Tian, et autres
Publié: (2025)
Overcoming Latency-bound Limitations of Distributed Graph Algorithms using the HPX Runtime System
par: Mohammadiporshokooh, Karame, et autres
Publié: (2026)
par: Mohammadiporshokooh, Karame, et autres
Publié: (2026)
Modeling Anomaly Detection in Cloud Services: Analysis of the Properties that Impact Latency and Resource Consumption
par: Grabher, Gabriel Job Antunes, et autres
Publié: (2025)
par: Grabher, Gabriel Job Antunes, et autres
Publié: (2025)
OmniInfer: System-Wide Acceleration Techniques for Optimizing LLM Serving Throughput and Latency
par: Wang, Jun, et autres
Publié: (2025)
par: Wang, Jun, et autres
Publié: (2025)
Documents similaires
-
Reducing Tail Latencies Through Environment- and Neighbour-aware Thread Management
par: Jeffery, Andrew, et autres
Publié: (2024) -
SEE++: Evolving Snowpark Execution Environment for Modern Workloads
par: Jain, Gaurav, et autres
Publié: (2025) -
Asynchronous Latency and Fast Atomic Snapshot
par: Bezerra, João Paulo, et autres
Publié: (2024) -
LA-IMR: Latency-Aware, Predictive In-Memory Routing and Proactive Autoscaling for Tail-Latency-Sensitive Cloud Robotics
par: Seo, Eunil, et autres
Publié: (2025) -
Mahi-Mahi: Low-Latency Asynchronous BFT DAG-Based Consensus
par: Jovanovic, Philipp, et autres
Publié: (2024)