ACE-Bench: A Lightweight Benchmark for Evaluating Azure SDK Usage Correctness
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Wenxing, Qi, Simeng, Chen, Junkui, Xie, Yan, Huang, Min, He, Jingkan, Wang, Xiao, Chen, Cheng, Meng, Sijing, Zhang, Tianqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cost-Performance Analysis of Cloud-Based Retail Point-of-Sale Systems: A Comparative Study of Google Cloud Platform and Microsoft Azure
di: Pagidoju, Ravi Teja
Pubblicazione: (2026)
di: Pagidoju, Ravi Teja
Pubblicazione: (2026)
ShuffleBench: A Benchmark for Large-Scale Data Shuffling Operations with Distributed Stream Processing Frameworks
di: Henning, Sören, et al.
Pubblicazione: (2024)
di: Henning, Sören, et al.
Pubblicazione: (2024)
AI-NativeBench: An Open-Source White-Box Agentic Benchmark Suite for AI-Native Systems
di: Wang, Zirui, et al.
Pubblicazione: (2026)
di: Wang, Zirui, et al.
Pubblicazione: (2026)
A Lightweight Hybrid Publish/Subscribe Event Fabric for IPC and Modular Distributed Systems
di: Gkoulis, Dimitris
Pubblicazione: (2026)
di: Gkoulis, Dimitris
Pubblicazione: (2026)
MultiKernelBench: A Multi-Platform Benchmark for Kernel Generation
di: Wen, Zhongzhen, et al.
Pubblicazione: (2025)
di: Wen, Zhongzhen, et al.
Pubblicazione: (2025)
Investigating the Impact of Isolation on Synchronized Benchmarks
di: Japke, Nils, et al.
Pubblicazione: (2025)
di: Japke, Nils, et al.
Pubblicazione: (2025)
Towards an Optimized Benchmarking Platform for CI/CD Pipelines
di: Japke, Nils, et al.
Pubblicazione: (2025)
di: Japke, Nils, et al.
Pubblicazione: (2025)
SeBS-Flow: Benchmarking Serverless Cloud Function Workflows
di: Schmid, Larissa, et al.
Pubblicazione: (2024)
di: Schmid, Larissa, et al.
Pubblicazione: (2024)
A Comprehensive Benchmarking Analysis of Fault Recovery in Stream Processing Frameworks
di: Vogel, Adriano, et al.
Pubblicazione: (2024)
di: Vogel, Adriano, et al.
Pubblicazione: (2024)
ParaQAOA: Efficient Parallel Divide-and-Conquer QAOA for Large-Scale Max-Cut Problems Beyond 10,000 Vertices
di: Huang, Po-Hsuan, et al.
Pubblicazione: (2026)
di: Huang, Po-Hsuan, et al.
Pubblicazione: (2026)
On the Challenges of Energy-Efficiency Analysis in HPC Systems: Evaluating Synthetic Benchmarks and Gromacs
di: Machado, Rafael Ravedutti Lucio, et al.
Pubblicazione: (2025)
di: Machado, Rafael Ravedutti Lucio, et al.
Pubblicazione: (2025)
MegaFlow: Large-Scale Distributed Orchestration System for the Agentic Era
di: Zhang, Lei, et al.
Pubblicazione: (2026)
di: Zhang, Lei, et al.
Pubblicazione: (2026)
ATOM: Asynchronous Training of Massive Models for Deep Learning in a Decentralized Environment
di: Wu, Xiaofeng, et al.
Pubblicazione: (2024)
di: Wu, Xiaofeng, et al.
Pubblicazione: (2024)
Metronome: Differentiated Delay Scheduling for Serverless Functions
di: Chen, Zhuangbin, et al.
Pubblicazione: (2025)
di: Chen, Zhuangbin, et al.
Pubblicazione: (2025)
FalconGEMM: Surpassing Hardware Peaks with Lower-Complexity Matrix Multiplication
di: Zhu, Honglin, et al.
Pubblicazione: (2026)
di: Zhu, Honglin, et al.
Pubblicazione: (2026)
TraceMesh: Scalable and Streaming Sampling for Distributed Traces
di: Chen, Zhuangbin, et al.
Pubblicazione: (2024)
di: Chen, Zhuangbin, et al.
Pubblicazione: (2024)
Enabling mixed-precision in spectral element codes
di: Chen, Yanxiang, et al.
Pubblicazione: (2025)
di: Chen, Yanxiang, et al.
Pubblicazione: (2025)
Wherefore Art Thou? Provenance-Guided Automatic Online Debugging with Lumos
di: Chen, Jingyuan, et al.
Pubblicazione: (2026)
di: Chen, Jingyuan, et al.
Pubblicazione: (2026)
HamilToniQ: An Open-Source Benchmark Toolkit for Quantum Computers
di: Xu, Xiaotian, et al.
Pubblicazione: (2024)
di: Xu, Xiaotian, et al.
Pubblicazione: (2024)
AlertGuardian: Intelligent Alert Life-Cycle Management for Large-scale Cloud Systems
di: Yu, Guangba, et al.
Pubblicazione: (2026)
di: Yu, Guangba, et al.
Pubblicazione: (2026)
MPI Errors Detection using GNN Embedding and Vector Embedding over LLVM IR
di: Karchi, Jad El, et al.
Pubblicazione: (2024)
di: Karchi, Jad El, et al.
Pubblicazione: (2024)
Enabling mixed-precision with the help of tools: A Nekbone case study
di: Chen, Yanxiang, et al.
Pubblicazione: (2024)
di: Chen, Yanxiang, et al.
Pubblicazione: (2024)
TorchGWAS : GPU-accelerated GWAS for thousands of quantitative phenotypes
di: Zhao, Xingzhong, et al.
Pubblicazione: (2026)
di: Zhao, Xingzhong, et al.
Pubblicazione: (2026)
Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads
di: Agyemang, Justice Owusu, et al.
Pubblicazione: (2026)
di: Agyemang, Justice Owusu, et al.
Pubblicazione: (2026)
Should I Run My Cloud Benchmark on Black Friday?
di: Henning, Sören, et al.
Pubblicazione: (2025)
di: Henning, Sören, et al.
Pubblicazione: (2025)
L4: Diagnosing Large-scale LLM Training Failures via Automated Log Analysis
di: Jiang, Zhihan, et al.
Pubblicazione: (2025)
di: Jiang, Zhihan, et al.
Pubblicazione: (2025)
Supercharging Federated Learning with Flower and NVIDIA FLARE
di: Roth, Holger R., et al.
Pubblicazione: (2024)
di: Roth, Holger R., et al.
Pubblicazione: (2024)
Towards Building Autonomous Data Services on Azure
di: Zhu, Yiwen, et al.
Pubblicazione: (2024)
di: Zhu, Yiwen, et al.
Pubblicazione: (2024)
SysMoBench: Evaluating AI on Formally Modeling Complex Real-World Systems
di: Cheng, Qian, et al.
Pubblicazione: (2025)
di: Cheng, Qian, et al.
Pubblicazione: (2025)
When Should I Run My Application Benchmark?: Studying Cloud Performance Variability for the Case of Stream Processing Applications
di: Henning, Sören, et al.
Pubblicazione: (2025)
di: Henning, Sören, et al.
Pubblicazione: (2025)
Domain Adaptation-based Edge Computing for Cross-Conditions Fault Diagnosis
di: Wang, Yanzhi, et al.
Pubblicazione: (2024)
di: Wang, Yanzhi, et al.
Pubblicazione: (2024)
LLM-HPC++: Evaluating LLM-Generated Modern C++ and MPI+OpenMP Codes for Scalable Mandelbrot Set Computation
di: Diehl, Patrick, et al.
Pubblicazione: (2025)
di: Diehl, Patrick, et al.
Pubblicazione: (2025)
A Unifying Framework to Enable Artificial Intelligence in High Performance Computing Workflows
di: Domke, Jens, et al.
Pubblicazione: (2025)
di: Domke, Jens, et al.
Pubblicazione: (2025)
CloudHeatMap: Heatmap-Based Monitoring for Large-Scale Cloud Systems
di: Sohana, Sarah, et al.
Pubblicazione: (2024)
di: Sohana, Sarah, et al.
Pubblicazione: (2024)
Integrating Odeint Time Stepping into OpenFPM for Distributed and GPU Accelerated Numerical Solvers
di: Singh, Abhinav, et al.
Pubblicazione: (2023)
di: Singh, Abhinav, et al.
Pubblicazione: (2023)
$μ$OpTime: Statically Reducing the Execution Time of Microbenchmark Suites Using Stability Metrics
di: Japke, Nils, et al.
Pubblicazione: (2025)
di: Japke, Nils, et al.
Pubblicazione: (2025)
Adaptable TeaStore
di: Bliudze, Simon, et al.
Pubblicazione: (2024)
di: Bliudze, Simon, et al.
Pubblicazione: (2024)
A Test Taxonomy and Continuous Integration Ecosystem for Dynamic Resource Management in HPC
di: Sandås, Petter, et al.
Pubblicazione: (2026)
di: Sandås, Petter, et al.
Pubblicazione: (2026)
Building Castles in the Cloud: Architecting Resilient and Scalable Infrastructure
di: Gundla, Naresh Kumar
Pubblicazione: (2024)
di: Gundla, Naresh Kumar
Pubblicazione: (2024)
Histrio: a Serverless Actor System
di: Buttiglieri, Giorgio Natale, et al.
Pubblicazione: (2024)
di: Buttiglieri, Giorgio Natale, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Cost-Performance Analysis of Cloud-Based Retail Point-of-Sale Systems: A Comparative Study of Google Cloud Platform and Microsoft Azure
di: Pagidoju, Ravi Teja
Pubblicazione: (2026) -
ShuffleBench: A Benchmark for Large-Scale Data Shuffling Operations with Distributed Stream Processing Frameworks
di: Henning, Sören, et al.
Pubblicazione: (2024) -
AI-NativeBench: An Open-Source White-Box Agentic Benchmark Suite for AI-Native Systems
di: Wang, Zirui, et al.
Pubblicazione: (2026) -
A Lightweight Hybrid Publish/Subscribe Event Fabric for IPC and Modular Distributed Systems
di: Gkoulis, Dimitris
Pubblicazione: (2026) -
MultiKernelBench: A Multi-Platform Benchmark for Kernel Generation
di: Wen, Zhongzhen, et al.
Pubblicazione: (2025)