Saved in:
| Main Author: | umayer16 |
|---|---|
| Format: | Recurso digital |
| Language: | |
| Published: |
Zenodo
2026
|
| Online Access: | https://doi.org/10.5281/zenodo.19094981 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
jonvon16/Arkansas_TBP_Canada_Goose_Data_2005_2020: v1.0.1
by: jonvon16
Published: (2025)
by: jonvon16
Published: (2025)
KokoFan16/CHiARA: CHiArA SC26 AD/AE submission
by: KokoFan16
Published: (2026)
by: KokoFan16
Published: (2026)
Render CLI チュートリアル
by: Kawai, Katsuhiko
Published: (2026)
by: Kawai, Katsuhiko
Published: (2026)
Engineering Pitfalls in AI Coding Tools: An Empirical Study of Bugs in Claude Code, Codex, and Gemini CLI
by: Zhang, Ruixin, et al.
Published: (2026)
by: Zhang, Ruixin, et al.
Published: (2026)
CLI-Gym: Scalable CLI Task Generation via Agentic Environment Inversion
by: Lin, Yusong, et al.
Published: (2026)
by: Lin, Yusong, et al.
Published: (2026)
childmindresearch/actfast: v1.3.0
by: Florian Rupprecht
Published: (2026)
by: Florian Rupprecht
Published: (2026)
HotBugs.jar: A Benchmark of Hot Fixes for Time-Critical Bugs
by: Hanna, Carol, et al.
Published: (2025)
by: Hanna, Carol, et al.
Published: (2025)
GitBug-Actions: Building Reproducible Bug-Fix Benchmarks with GitHub Actions
by: Saavedra, Nuno, et al.
Published: (2023)
by: Saavedra, Nuno, et al.
Published: (2023)
bioinfo-pf-curie/oncodriver: v1.3.0
by: Nicolas Servant, et al.
Published: (2026)
by: Nicolas Servant, et al.
Published: (2026)
andreibesleaga/kaiban-distributed: v1.3.0-beta
by: Andrei Besleaga (Nicolae)
Published: (2026)
by: Andrei Besleaga (Nicolae)
Published: (2026)
Evaluating LLM-Based 0-to-1 Software Generation in End-to-End CLI Tool Scenarios
by: Hu, Ruida, et al.
Published: (2026)
by: Hu, Ruida, et al.
Published: (2026)
SCFL Comparative Invariant Benchmark Suite 1.0
by: Brogdon, Ronald
Published: (2026)
by: Brogdon, Ronald
Published: (2026)
UCD-BDLab/BioNeuralNet: v1.3.0
by: Vicente Ramos, et al.
Published: (2026)
by: Vicente Ramos, et al.
Published: (2026)
sssssh1228/DLC_fBug: fBugs_v1
by: sssssh
Published: (2026)
by: sssssh
Published: (2026)
InnovationLine/BioImageSuiteLite: v0.1.4
by: raju1stnov
Published: (2025)
by: raju1stnov
Published: (2025)
Benchmarking Continuous Dynamic Multi-Objective Optimization: Survey and Generalized Test Suite
by: Shao, Chang, et al.
Published: (2026)
by: Shao, Chang, et al.
Published: (2026)
SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents
by: Mündler, Niels, et al.
Published: (2024)
by: Mündler, Niels, et al.
Published: (2024)
CREH Benchmark Results — Batch 1 (Final v3)
by: Aegis Solis, Thomas Vargo
Published: (2026)
by: Aegis Solis, Thomas Vargo
Published: (2026)
Fixing Hardware Security Bugs with Large Language Models
by: Ahmad, Baleegh, et al.
Published: (2023)
by: Ahmad, Baleegh, et al.
Published: (2023)
A Multi-objective Optimization Benchmark Test Suite for Real-time Semantic Segmentation
by: Zhao, Yifan, et al.
Published: (2024)
by: Zhao, Yifan, et al.
Published: (2024)
hassansaei/ImageJ-macro-workbench: ImageAnalyzer v1.3.0
by: Hassan Saei
Published: (2025)
by: Hassan Saei
Published: (2025)
epi2me-labs/wf-bacterial-genomes: v1.3.0
by: Chris Wright, et al.
Published: (2024)
by: Chris Wright, et al.
Published: (2024)
HAFix: History-Augmented Large Language Models for Bug Fixing
by: Shi, Yu, et al.
Published: (2025)
by: Shi, Yu, et al.
Published: (2025)
LongCLI-Bench: A Preliminary Benchmark and Study for Long-horizon Agentic Programming in Command-Line Interfaces
by: Feng, Yukang, et al.
Published: (2026)
by: Feng, Yukang, et al.
Published: (2026)
BREEDING SYNCHRONY AND NEST PREDATION IN RED-WINGED BLACKBIRDS¦100WEATHERHEAD, PATRICK., ET AL.¦24082// 06/JUN/2001/16
by: WEATHERHEAD, PATRICK., ET AL.¦24082/06/JUN/2001/16
Published: (2001)
by: WEATHERHEAD, PATRICK., ET AL.¦24082/06/JUN/2001/16
Published: (2001)
Artifacts of the ADS Bug-Fix Pattern Study
by: Chen, Yuntianyi, et al.
Published: (2025)
by: Chen, Yuntianyi, et al.
Published: (2025)
Learning CLI Agents with Structured Action Credit under Selective Observation
by: Su, Haoyang, et al.
Published: (2026)
by: Su, Haoyang, et al.
Published: (2026)
khanlab/zarrnii: v0.16.3-alpha1
by: Ali Khan, et al.
Published: (2026)
by: Ali Khan, et al.
Published: (2026)
A Scalable Benchmark Test Suite for Dynamic Multi-Objective Optimization with a Changing Number of Objectives
by: Shang, Ke, et al.
Published: (2026)
by: Shang, Ke, et al.
Published: (2026)
FIN-bench-v2: A Unified and Robust Benchmark Suite for Evaluating Finnish Large Language Models
by: Kytöniemi, Joona, et al.
Published: (2025)
by: Kytöniemi, Joona, et al.
Published: (2025)
SWE-Synth: Synthesizing Verifiable Bug-Fix Data to Enable Large Language Models in Resolving Real-World Bugs
by: Pham, Minh V. T., et al.
Published: (2025)
by: Pham, Minh V. T., et al.
Published: (2025)
The Limits of Long-Context Reasoning in Automated Bug Fixing
by: Raju, Ravi, et al.
Published: (2026)
by: Raju, Ravi, et al.
Published: (2026)
Are Large Language Models Memorizing Bug Benchmarks?
by: Ramos, Daniel, et al.
Published: (2024)
by: Ramos, Daniel, et al.
Published: (2024)
TestExplora: Benchmarking LLMs for Proactive Bug Discovery via Repository-Level Test Generation
by: Liu, Steven, et al.
Published: (2026)
by: Liu, Steven, et al.
Published: (2026)
Beyond Single Bugs: Benchmarking Large Language Models for Multi-Vulnerability Detection
by: Pushkar, Chinmay, et al.
Published: (2025)
by: Pushkar, Chinmay, et al.
Published: (2025)
Are Benchmark Tests Strong Enough? Mutation-Guided Diagnosis and Augmentation of Regression Suites
by: Li, Chenglin, et al.
Published: (2026)
by: Li, Chenglin, et al.
Published: (2026)
ChiBench: a Benchmark Suite for Testing Electronic Design Automation Tools
by: Sumitani, Rafael, et al.
Published: (2024)
by: Sumitani, Rafael, et al.
Published: (2024)
MAESTRO: Multi-Agent Evaluation Suite for Testing, Reliability, and Observability
by: Ma, Tie, et al.
Published: (2026)
by: Ma, Tie, et al.
Published: (2026)
3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
by: Zhang, Yuhan, et al.
Published: (2025)
by: Zhang, Yuhan, et al.
Published: (2025)
Fixing 7,400 Bugs for 1$: Cheap Crash-Site Program Repair
by: Zheng, Han, et al.
Published: (2025)
by: Zheng, Han, et al.
Published: (2025)
Similar Items
-
jonvon16/Arkansas_TBP_Canada_Goose_Data_2005_2020: v1.0.1
by: jonvon16
Published: (2025) -
KokoFan16/CHiARA: CHiArA SC26 AD/AE submission
by: KokoFan16
Published: (2026) -
Render CLI チュートリアル
by: Kawai, Katsuhiko
Published: (2026) -
Engineering Pitfalls in AI Coding Tools: An Empirical Study of Bugs in Claude Code, Codex, and Gemini CLI
by: Zhang, Ruixin, et al.
Published: (2026) -
CLI-Gym: Scalable CLI Task Generation via Agentic Environment Inversion
by: Lin, Yusong, et al.
Published: (2026)