Junctiond: Extending FaaS Runtimes with Kernel-Bypass
Fuente:
arXiv
Guardado en:
| Autores principales: | Saurez, Enrique, Fried, Joshua, Chaudhry, Gohar Irfan, Choukse, Esha, Goiri, Íñigo, Elnikety, Sameh, Belay, Adam, Fonseca, Rodrigo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Resource-Efficient Compound AI Systems
por: Chaudhry, Gohar Irfan, et al.
Publicado: (2025)
por: Chaudhry, Gohar Irfan, et al.
Publicado: (2025)
StreamWise: Serving Multi-Modal Generation in Real-Time at Scale
por: Qiu, Haoran, et al.
Publicado: (2026)
por: Qiu, Haoran, et al.
Publicado: (2026)
GeoFaaS: An Edge-to-Cloud FaaS Platform
por: Malekabbasi, Mohammadreza, et al.
Publicado: (2024)
por: Malekabbasi, Mohammadreza, et al.
Publicado: (2024)
DynamoLLM: Designing LLM Inference Clusters for Performance and Energy Efficiency
por: Stojkovic, Jovan, et al.
Publicado: (2024)
por: Stojkovic, Jovan, et al.
Publicado: (2024)
LLM4FaaS: No-Code Application Development using LLMs and FaaS
por: Wang, Minghe, et al.
Publicado: (2025)
por: Wang, Minghe, et al.
Publicado: (2025)
TAPAS: Thermal- and Power-Aware Scheduling for LLM Inference in Cloud Platforms
por: Stojkovic, Jovan, et al.
Publicado: (2025)
por: Stojkovic, Jovan, et al.
Publicado: (2025)
GreenFaaS: Maximizing Energy Efficiency of HPC Workloads with FaaS
por: Kamatar, Alok, et al.
Publicado: (2024)
por: Kamatar, Alok, et al.
Publicado: (2024)
FaaS Is Not Enough: Serverless Handling of Burst-Parallel Jobs
por: Barcelona-Pons, Daniel, et al.
Publicado: (2024)
por: Barcelona-Pons, Daniel, et al.
Publicado: (2024)
Application-Centric Benchmarking of Distributed FaaS Platforms using BeFaaS
por: Grambow, Martin, et al.
Publicado: (2023)
por: Grambow, Martin, et al.
Publicado: (2023)
Towards a Testbed for Scalable FaaS Platforms
por: Schirmer, Trever, et al.
Publicado: (2025)
por: Schirmer, Trever, et al.
Publicado: (2025)
Towards Greener LLMs: Bringing Energy-Efficiency to the Forefront of LLM Inference
por: Stojkovic, Jovan, et al.
Publicado: (2024)
por: Stojkovic, Jovan, et al.
Publicado: (2024)
Optimizing FaaS Platforms for MCP-enabled Agentic Workflows
por: Kulkarni, Varad, et al.
Publicado: (2026)
por: Kulkarni, Varad, et al.
Publicado: (2026)
The State of FaaS: An analysis of public Functions-as-a-Service providers
por: Ekwe-Ekwe, Nnamdi, et al.
Publicado: (2024)
por: Ekwe-Ekwe, Nnamdi, et al.
Publicado: (2024)
Joint$λ$: Orchestrating Serverless Workflows on Jointcloud FaaS Systems
por: Li, Rui, et al.
Publicado: (2025)
por: Li, Rui, et al.
Publicado: (2025)
ElastiBench: Scalable Continuous Benchmarking on Cloud FaaS Platforms
por: Schirmer, Trever, et al.
Publicado: (2024)
por: Schirmer, Trever, et al.
Publicado: (2024)
Increasing Efficiency and Result Reliability of Continuous Benchmarking for FaaS Applications
por: Rese, Tim C., et al.
Publicado: (2024)
por: Rese, Tim C., et al.
Publicado: (2024)
Characterizing FaaS Workflows on Public Clouds: The Good, the Bad and the Ugly
por: Kulkarni, Varad, et al.
Publicado: (2025)
por: Kulkarni, Varad, et al.
Publicado: (2025)
Benchmarking Compound AI Applications for Hardware-Software Co-Design
por: Samuthrsindh, Paramuth, et al.
Publicado: (2026)
por: Samuthrsindh, Paramuth, et al.
Publicado: (2026)
Eudoxia: a FaaS scheduling simulator for the composable lakehouse
por: Srivastava, Tapan, et al.
Publicado: (2025)
por: Srivastava, Tapan, et al.
Publicado: (2025)
Nanvix: A Multikernel OS Design for High-Density Serverless Deployments
por: Segarra, Carlos, et al.
Publicado: (2026)
por: Segarra, Carlos, et al.
Publicado: (2026)
Provuse: Platform-Side Function Fusion for Performance and Efficiency in FaaS Environments
por: Kowallik, Niklas, et al.
Publicado: (2026)
por: Kowallik, Niklas, et al.
Publicado: (2026)
No Request Left Behind: Tackling Heterogeneity in Long-Context LLM Inference with Medha
por: Agrawal, Amey, et al.
Publicado: (2024)
por: Agrawal, Amey, et al.
Publicado: (2024)
Flock: A Low-Cost Streaming Query Engine on FaaS Platforms
por: Liao, Gang, et al.
Publicado: (2023)
por: Liao, Gang, et al.
Publicado: (2023)
Transformer-Based Model for Cold Start Mitigation in FaaS Architecture
por: Mouen, Alexandre Savi Fayam Mbala, et al.
Publicado: (2025)
por: Mouen, Alexandre Savi Fayam Mbala, et al.
Publicado: (2025)
ModServe: Modality- and Stage-Aware Resource Disaggregation for Scalable Multimodal Model Serving
por: Qiu, Haoran, et al.
Publicado: (2025)
por: Qiu, Haoran, et al.
Publicado: (2025)
EcoServe: Designing Carbon-Aware AI Inference Systems
por: Li, Yueying, et al.
Publicado: (2025)
por: Li, Yueying, et al.
Publicado: (2025)
Limitless FaaS: Overcoming serverless functions execution time limits with invoke driven architecture and memory checkpoints
por: Andraca, Rodrigo Landa, et al.
Publicado: (2024)
por: Andraca, Rodrigo Landa, et al.
Publicado: (2024)
Umbilical Choir: Automated Live Testing for Edge-To-Cloud FaaS Applications
por: Malekabbasi, Mohammadreza, et al.
Publicado: (2025)
por: Malekabbasi, Mohammadreza, et al.
Publicado: (2025)
Flight: A FaaS-Based Framework for Complex and Hierarchical Federated Learning
por: Hudson, Nathaniel, et al.
Publicado: (2024)
por: Hudson, Nathaniel, et al.
Publicado: (2024)
In Serverless, OS Scheduler Choice Costs Money: A Hybrid Scheduling Approach for Cheaper FaaS
por: Zhao, Yuxuan, et al.
Publicado: (2024)
por: Zhao, Yuxuan, et al.
Publicado: (2024)
AgentX: Towards Orchestrating Robust Agentic Workflow Patterns with FaaS-hosted MCP Services
por: Tokal, Shiva Sai Krishna Anand, et al.
Publicado: (2025)
por: Tokal, Shiva Sai Krishna Anand, et al.
Publicado: (2025)
Action Engine: Automatic Workflow Generation in FaaS
por: Esashi, Akiharu, et al.
Publicado: (2024)
por: Esashi, Akiharu, et al.
Publicado: (2024)
Murakkab: Resource-Efficient Agentic Workflow Orchestration in Cloud Platforms
por: Chaudhry, Gohar Irfan, et al.
Publicado: (2025)
por: Chaudhry, Gohar Irfan, et al.
Publicado: (2025)
Analytically-Driven Resource Management for Cloud-Native Microservices
por: Zhang, Yanqi, et al.
Publicado: (2024)
por: Zhang, Yanqi, et al.
Publicado: (2024)
Splitwise: Efficient generative LLM inference using phase splitting
por: Patel, Pratyush, et al.
Publicado: (2023)
por: Patel, Pratyush, et al.
Publicado: (2023)
A Framework for SLO, Carbon, and Wastewater-Aware Sustainable FaaS Cloud Platform Management
por: Qi, Sirui, et al.
Publicado: (2024)
por: Qi, Sirui, et al.
Publicado: (2024)
Intelligent Router for LLM Workloads: Improving Performance Through Workload-Aware Load Balancing
por: Jain, Kunal, et al.
Publicado: (2024)
por: Jain, Kunal, et al.
Publicado: (2024)
Taming Serverless Cold Starts Through OS Co-Design
por: Holmes, Ben, et al.
Publicado: (2025)
por: Holmes, Ben, et al.
Publicado: (2025)
Optimizing OpenFaaS on Kubernetes: Comparative Analysis of Language Runtimes and Cluster Distributions
por: Ataie, Ehsan, et al.
Publicado: (2026)
por: Ataie, Ehsan, et al.
Publicado: (2026)
Seer: Predictive Runtime Kernel Selection for Irregular Problems
por: Swann, Ryan, et al.
Publicado: (2024)
por: Swann, Ryan, et al.
Publicado: (2024)
Ejemplares similares
-
Towards Resource-Efficient Compound AI Systems
por: Chaudhry, Gohar Irfan, et al.
Publicado: (2025) -
StreamWise: Serving Multi-Modal Generation in Real-Time at Scale
por: Qiu, Haoran, et al.
Publicado: (2026) -
GeoFaaS: An Edge-to-Cloud FaaS Platform
por: Malekabbasi, Mohammadreza, et al.
Publicado: (2024) -
DynamoLLM: Designing LLM Inference Clusters for Performance and Energy Efficiency
por: Stojkovic, Jovan, et al.
Publicado: (2024) -
LLM4FaaS: No-Code Application Development using LLMs and FaaS
por: Wang, Minghe, et al.
Publicado: (2025)