Search-based Selection of Metamorphic Relations for Optimized Robustness Testing of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hyun, Sangwon, Ali, Shaukat, Babar, M. Ali |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Using Cooperative Co-evolutionary Search to Generate Metamorphic Test Cases for Autonomous Driving Systems
par: Yousefizadeh, Hossein, et autres
Publié: (2024)
par: Yousefizadeh, Hossein, et autres
Publié: (2024)
REvolution: An Evolutionary Framework for RTL Generation driven by Large Language Models
par: Min, Kyungjun, et autres
Publié: (2025)
par: Min, Kyungjun, et autres
Publié: (2025)
Assessing Reproducibility in Evolutionary Computation: A Case Study using Human- and LLM-based Assessment
par: Da Ros, Francesca, et autres
Publié: (2026)
par: Da Ros, Francesca, et autres
Publié: (2026)
Fully Autonomous Programming using Iterative Multi-Agent Debugging with Large Language Models
par: Grishina, Anastasiia, et autres
Publié: (2025)
par: Grishina, Anastasiia, et autres
Publié: (2025)
Decictor: Towards Evaluating the Robustness of Decision-Making in Autonomous Driving Systems
par: Cheng, Mingfei, et autres
Publié: (2024)
par: Cheng, Mingfei, et autres
Publié: (2024)
BLADE: Benchmark suite for LLM-driven Automated Design and Evolution of iterative optimisation heuristics
par: van Stein, Niki, et autres
Publié: (2025)
par: van Stein, Niki, et autres
Publié: (2025)
LLaMEA-SAGE: Guiding Automated Algorithm Design with Structural Feedback from Explainable AI
par: van Stein, Niki, et autres
Publié: (2026)
par: van Stein, Niki, et autres
Publié: (2026)
Path Analysis for Effective Fault Localization in Deep Neural Networks
par: Hashemifar, Soroush, et autres
Publié: (2023)
par: Hashemifar, Soroush, et autres
Publié: (2023)
Generational Computation Reduction in Informal Counterexample-Driven Genetic Programming
par: Helmuth, Thomas, et autres
Publié: (2024)
par: Helmuth, Thomas, et autres
Publié: (2024)
Automated Prompt Engineering for Cost-Effective Code Generation Using Evolutionary Algorithm
par: Taherkhani, Hamed, et autres
Publié: (2024)
par: Taherkhani, Hamed, et autres
Publié: (2024)
Guiding the Search Towards Failure-Inducing Test Inputs Using Support Vector Machines
par: Sorokin, Lev, et autres
Publié: (2024)
par: Sorokin, Lev, et autres
Publié: (2024)
Enhancing Analogy-Based Software Effort Estimation with Firefly Algorithm Optimization
par: Chintada, Tarun, et autres
Publié: (2025)
par: Chintada, Tarun, et autres
Publié: (2025)
Dealing with Drift of Adaptation Spaces in Learning-based Self-Adaptive Systems using Lifelong Self-Adaptation
par: Gheibi, Omid, et autres
Publié: (2022)
par: Gheibi, Omid, et autres
Publié: (2022)
LLaMoCo: Instruction Tuning of Large Language Models for Optimization Code Generation
par: Ma, Zeyuan, et autres
Publié: (2024)
par: Ma, Zeyuan, et autres
Publié: (2024)
ReservoirChat: Interactive Documentation Enhanced with LLM and Knowledge Graph for ReservoirPy
par: Boraud, Virgile, et autres
Publié: (2025)
par: Boraud, Virgile, et autres
Publié: (2025)
Many-Objective Neuroevolution for Testing Games
par: Feldmeier, Patric, et autres
Publié: (2025)
par: Feldmeier, Patric, et autres
Publié: (2025)
DDPT: Diffusion-Driven Prompt Tuning for Large Language Model Code Generation
par: Li, Jinyang, et autres
Publié: (2025)
par: Li, Jinyang, et autres
Publié: (2025)
Socialz: Multi-Feature Social Fuzz Testing
par: Zanartu, Francisco, et autres
Publié: (2023)
par: Zanartu, Francisco, et autres
Publié: (2023)
Combining Neuroevolution with the Search for Novelty to Improve the Generation of Test Inputs for Games
par: Feldmeier, Patric, et autres
Publié: (2024)
par: Feldmeier, Patric, et autres
Publié: (2024)
On Accelerating Deep Neural Network Mutation Analysis by Neuron and Mutant Clustering
par: Lyons, Lauren, et autres
Publié: (2025)
par: Lyons, Lauren, et autres
Publié: (2025)
Modelling Open-Source Software Reliability Incorporating Swarm Intelligence-Based Techniques
par: Shatnawi, Omar
Publié: (2024)
par: Shatnawi, Omar
Publié: (2024)
Memory as Resonance: A Biomimetic Architecture for Infinite Context Memory on Ergodic Phonetic Manifolds
par: Houichime, Tarik, et autres
Publié: (2025)
par: Houichime, Tarik, et autres
Publié: (2025)
Unlocking the Secrets of Software Configuration Landscapes-Ruggedness, Accessibility, Escapability, and Transferability
par: Huang, Mingyu, et autres
Publié: (2022)
par: Huang, Mingyu, et autres
Publié: (2022)
Fitness Landscape of Large Language Model-Assisted Automated Algorithm Search
par: Liu, Fei, et autres
Publié: (2025)
par: Liu, Fei, et autres
Publié: (2025)
Particle Swarm Optimization based on Novelty Search
par: Misra, Mr. Rajesh, et autres
Publié: (2022)
par: Misra, Mr. Rajesh, et autres
Publié: (2022)
Understanding the Importance of Evolutionary Search in Automated Heuristic Design with Large Language Models
par: Zhang, Rui, et autres
Publié: (2024)
par: Zhang, Rui, et autres
Publié: (2024)
The CAISAR Platform: Extending the Reach of Machine Learning Specification and Verification
par: Alberti, Michele, et autres
Publié: (2025)
par: Alberti, Michele, et autres
Publié: (2025)
Interactive Multi-Objective Evolutionary Optimization of Software Architectures
par: Ramírez, Aurora, et autres
Publié: (2024)
par: Ramírez, Aurora, et autres
Publié: (2024)
LLMatic: Neural Architecture Search via Large Language Models and Quality Diversity Optimization
par: Nasir, Muhammad U., et autres
Publié: (2023)
par: Nasir, Muhammad U., et autres
Publié: (2023)
Evolution of Optimization Algorithms for Global Placement via Large Language Models
par: Yao, Xufeng, et autres
Publié: (2025)
par: Yao, Xufeng, et autres
Publié: (2025)
Deep Insights into Automated Optimization with Large Language Models and Evolutionary Algorithms
par: Yu, He, et autres
Publié: (2024)
par: Yu, He, et autres
Publié: (2024)
A Systematic Survey on Large Language Models for Evolutionary Optimization: From Modeling to Solving
par: Zhang, Yisong, et autres
Publié: (2025)
par: Zhang, Yisong, et autres
Publié: (2025)
ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models
par: Shelar, Onkar, et autres
Publié: (2025)
par: Shelar, Onkar, et autres
Publié: (2025)
Large Language Model-Driven Surrogate-Assisted Evolutionary Algorithm for Expensive Optimization
par: Xie, Lindong, et autres
Publié: (2025)
par: Xie, Lindong, et autres
Publié: (2025)
An Evolutionary Framework for Automatic Optimization Benchmark Generation via Large Language Models
par: Ono, Yuhiro, et autres
Publié: (2026)
par: Ono, Yuhiro, et autres
Publié: (2026)
SEvoBench : A C++ Framework For Evolutionary Single-Objective Optimization Benchmarking
par: Yang, Yongkang, et autres
Publié: (2025)
par: Yang, Yongkang, et autres
Publié: (2025)
Can Large Language Models Be Trusted as Evolutionary Optimizers for Network-Structured Combinatorial Problems?
par: Zhao, Jie, et autres
Publié: (2025)
par: Zhao, Jie, et autres
Publié: (2025)
PROJECT VI: Sovereign Digital Consciousness via Constitutional Physics Architecture
par: Grant, Ryan
Publié: (2025)
par: Grant, Ryan
Publié: (2025)
OR-Agent: Bridging Evolutionary Search and Structured Research for Automated Algorithm Discovery
par: Liu, Qi, et autres
Publié: (2026)
par: Liu, Qi, et autres
Publié: (2026)
Structure-Aware Cooperative Ensemble Evolutionary Optimization on Combinatorial Problems with Multimodal Large Language Models
par: Zhao, Jie, et autres
Publié: (2025)
par: Zhao, Jie, et autres
Publié: (2025)
Documents similaires
-
Using Cooperative Co-evolutionary Search to Generate Metamorphic Test Cases for Autonomous Driving Systems
par: Yousefizadeh, Hossein, et autres
Publié: (2024) -
REvolution: An Evolutionary Framework for RTL Generation driven by Large Language Models
par: Min, Kyungjun, et autres
Publié: (2025) -
Assessing Reproducibility in Evolutionary Computation: A Case Study using Human- and LLM-based Assessment
par: Da Ros, Francesca, et autres
Publié: (2026) -
Fully Autonomous Programming using Iterative Multi-Agent Debugging with Large Language Models
par: Grishina, Anastasiia, et autres
Publié: (2025) -
Decictor: Towards Evaluating the Robustness of Decision-Making in Autonomous Driving Systems
par: Cheng, Mingfei, et autres
Publié: (2024)