Generating and Evaluating Sustainable Procurement Criteria for the Swiss Public Sector using In-Context Prompting with Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gao, Yingqiang, Matoshi, Veton, Rolshoven, Luca, Ellendorff, Tilia, Binder, Judith, Jann, Jeremy Austin, Schneider, Gerold, Stürmer, Matthias |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MultiLegalPile: A 689GB Multilingual Legal Corpus
par: Niklaus, Joel, et autres
Publié: (2023)
par: Niklaus, Joel, et autres
Publié: (2023)
LEXTREME: A Multi-Lingual and Multi-Task Benchmark for the Legal Domain
par: Niklaus, Joel, et autres
Publié: (2023)
par: Niklaus, Joel, et autres
Publié: (2023)
Robust Native Language Identification through Agentic Decomposition
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2025)
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2025)
One Law, Many Languages: Benchmarking Multilingual Legal Reasoning for Judicial Support
par: Stern, Ronja, et autres
Publié: (2023)
par: Stern, Ronja, et autres
Publié: (2023)
Harnessing the Potential of Gen-AI Coding Assistants in Public Sector Software Development
par: Ng, Kevin KB, et autres
Publié: (2024)
par: Ng, Kevin KB, et autres
Publié: (2024)
Public Sector Open Source Program Offices - Archetypes for how to Grow (Common) Institutional Capabilities
par: Linåker, Johan, et autres
Publié: (2026)
par: Linåker, Johan, et autres
Publié: (2026)
Sustainability Analysis of Prompt Strategies for SLM-based Automated Test Generation
par: Kumari, Pragati, et autres
Publié: (2026)
par: Kumari, Pragati, et autres
Publié: (2026)
Continuous Deployment Adoption: Insights From a Public Sector Implementation
par: Aapo Linjama, et autres
Publié: (2026)
par: Aapo Linjama, et autres
Publié: (2026)
Digital Twin Evolution for Sustainable Smart Ecosystems
par: Michael, Judith, et autres
Publié: (2024)
par: Michael, Judith, et autres
Publié: (2024)
Generalized Coverage Criteria for Combinatorial Sequence Testing
par: Elyasaf, Achiya, et autres
Publié: (2022)
par: Elyasaf, Achiya, et autres
Publié: (2022)
Testing Agentic Workflows with Structural Coverage Criteria
par: Kahani, Nafiseh, et autres
Publié: (2026)
par: Kahani, Nafiseh, et autres
Publié: (2026)
Requirements Engineering for Research Software: A Vision
par: Bajraktari, Adrian, et autres
Publié: (2024)
par: Bajraktari, Adrian, et autres
Publié: (2024)
An Empirical Study of Sustainability in Prompt-driven Test Script Generation Using Small Language Models
par: Kumari, Pragati, et autres
Publié: (2026)
par: Kumari, Pragati, et autres
Publié: (2026)
JEDI: Java Evaluation of Declarative and Imperative Queries
par: Schiavio, Filippo, et autres
Publié: (2026)
par: Schiavio, Filippo, et autres
Publié: (2026)
Context Engineering for AI Agents in Open-Source Software
par: Mohsenimofidi, Seyedmoein, et autres
Publié: (2025)
par: Mohsenimofidi, Seyedmoein, et autres
Publié: (2025)
Test Adequacy for Metamorphic Testing: Criteria, Measurement, and Implication
par: Fu, An, et autres
Publié: (2024)
par: Fu, An, et autres
Publié: (2024)
Fail‐Controlled Classifiers: A Swiss‐Army Knife Toward Trustworthy Systems
par: Fahad Ahmed Khokhar, et autres
Publié: (2025)
par: Fahad Ahmed Khokhar, et autres
Publié: (2025)
ARGUS: Defending LLM Agents Against Context-Aware Prompt Injection
par: Weng, Shihao, et autres
Publié: (2026)
par: Weng, Shihao, et autres
Publié: (2026)
Soft-lockins in Public Sector Acquisitions of Open Source Software-solutions: A Case Study on a Municipal E-Service Platform
par: Persson, Per, et autres
Publié: (2024)
par: Persson, Per, et autres
Publié: (2024)
Annotating Control-Flow Graphs for Formalized Test Coverage Criteria
par: Kauffman, Sean, et autres
Publié: (2024)
par: Kauffman, Sean, et autres
Publié: (2024)
Stop Comparing LLM Agents Without Disclosing the Harness
par: Zhang, Yunbei, et autres
Publié: (2026)
par: Zhang, Yunbei, et autres
Publié: (2026)
On Unified Prompt Tuning for Request Quality Assurance in Public Code Review
par: Chen, Xinyu, et autres
Publié: (2024)
par: Chen, Xinyu, et autres
Publié: (2024)
From Pre-labeling to Production: Engineering Lessons from a Machine Learning Pipeline in the Public Sector
par: Ferreira, Ronivaldo, et autres
Publié: (2025)
par: Ferreira, Ronivaldo, et autres
Publié: (2025)
Knowledge-Guided Prompt Learning for Request Quality Assurance in Public Code Review
par: Li, Lin, et autres
Publié: (2024)
par: Li, Lin, et autres
Publié: (2024)
Towards Synthetic Trace Generation of Modeling Operations using In-Context Learning Approach
par: Muttillo, Vittoriano, et autres
Publié: (2024)
par: Muttillo, Vittoriano, et autres
Publié: (2024)
Multi-Modal Requirements Data-based Acceptance Criteria Generation using LLMs
par: Wang, Fanyu, et autres
Publié: (2025)
par: Wang, Fanyu, et autres
Publié: (2025)
Model Context Protocol Threat Modeling and Analyzing Vulnerabilities to Prompt Injection with Tool Poisoning
par: Huang, Charoes, et autres
Publié: (2026)
par: Huang, Charoes, et autres
Publié: (2026)
PromptSet: A Programmer's Prompting Dataset
par: Pister, Kaiser, et autres
Publié: (2024)
par: Pister, Kaiser, et autres
Publié: (2024)
Misleading Microbenchmarks on the Java Virtual Machines
par: Schiavio, Filippo, et autres
Publié: (2026)
par: Schiavio, Filippo, et autres
Publié: (2026)
Towards Quantifying Requirements Technical Debt for Software Requirements concerning Veracity: A Perspective and Research Roadmap
par: Perera, Judith, et autres
Publié: (2024)
par: Perera, Judith, et autres
Publié: (2024)
Coverage Goal Selector for Combining Multiple Criteria in Search-Based Unit Test Generation
par: Zhou, Zhichao, et autres
Publié: (2023)
par: Zhou, Zhichao, et autres
Publié: (2023)
A customizable approach to assess software quality through Multi-Criteria Decision Making
par: Basciani, Francesco, et autres
Publié: (2023)
par: Basciani, Francesco, et autres
Publié: (2023)
A New Framework of Software Obfuscation Evaluation Criteria
par: De Sutter, Bjorn
Publié: (2025)
par: De Sutter, Bjorn
Publié: (2025)
Prompting in the Wild: An Empirical Study of Prompt Evolution in Software Repositories
par: Tafreshipour, Mahan, et autres
Publié: (2024)
par: Tafreshipour, Mahan, et autres
Publié: (2024)
Prompt Alchemy: Automatic Prompt Refinement for Enhancing Code Generation
par: Ye, Sixiang, et autres
Publié: (2025)
par: Ye, Sixiang, et autres
Publié: (2025)
A Practical Guide to Internet Filters. A Neal-Schuman Special Report. Neal-Schuman NetGuide Series.
par: Schneider, Karen G.
Publié: (1997)
par: Schneider, Karen G.
Publié: (1997)
Understanding the Effectiveness of Coverage Criteria for Large Language Models: A Special Angle from Jailbreak Attacks
par: Zhou, Shide, et autres
Publié: (2024)
par: Zhou, Shide, et autres
Publié: (2024)
Green Prompt Engineering: Investigating the Energy Impact of Prompt Design in Software Engineering
par: De Martino, Vincenzo, et autres
Publié: (2025)
par: De Martino, Vincenzo, et autres
Publié: (2025)
Unlocking Legal Knowledge: A Multilingual Dataset for Judicial Summarization in Switzerland
par: Rolshoven, Luca, et autres
Publié: (2024)
par: Rolshoven, Luca, et autres
Publié: (2024)
IT/OT Integration by Design
par: Schäfer, Georg, et autres
Publié: (2023)
par: Schäfer, Georg, et autres
Publié: (2023)
Documents similaires
-
MultiLegalPile: A 689GB Multilingual Legal Corpus
par: Niklaus, Joel, et autres
Publié: (2023) -
LEXTREME: A Multi-Lingual and Multi-Task Benchmark for the Legal Domain
par: Niklaus, Joel, et autres
Publié: (2023) -
Robust Native Language Identification through Agentic Decomposition
par: Uluslu, Ahmet Yavuz, et autres
Publié: (2025) -
One Law, Many Languages: Benchmarking Multilingual Legal Reasoning for Judicial Support
par: Stern, Ronja, et autres
Publié: (2023) -
Harnessing the Potential of Gen-AI Coding Assistants in Public Sector Software Development
par: Ng, Kevin KB, et autres
Publié: (2024)