MILE: A Mutation Testing Framework of In-Context Learning Systems
Fuente:
arXiv
Guardado en:
| Autores principales: | Wei, Zeming, Zhang, Yihao, Sun, Meng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RACC: Representation-Aware Coverage Criteria for LLM Safety Testing
por: Wei, Zeming, et al.
Publicado: (2026)
por: Wei, Zeming, et al.
Publicado: (2026)
Automata-Based Steering of Large Language Models for Diverse Structured Generation
por: Luan, Xiaokun, et al.
Publicado: (2025)
por: Luan, Xiaokun, et al.
Publicado: (2025)
ReGA: Model-Based Safeguard for LLMs via Representation-Guided Abstraction
por: Wei, Zeming, et al.
Publicado: (2025)
por: Wei, Zeming, et al.
Publicado: (2025)
LeCov: Multi-level Testing Criteria for Large Language Models
por: Xie, Xuan, et al.
Publicado: (2024)
por: Xie, Xuan, et al.
Publicado: (2024)
UniTSyn: A Large-Scale Dataset Capable of Enhancing the Prowess of Large Language Models for Program Testing
por: He, Yifeng, et al.
Publicado: (2024)
por: He, Yifeng, et al.
Publicado: (2024)
LUNA: A Model-Based Universal Analysis Framework for Large Language Models
por: Song, Da, et al.
Publicado: (2023)
por: Song, Da, et al.
Publicado: (2023)
ClawWorm: Self-Propagating Attacks Across LLM Agent Ecosystems
por: Zhang, Yihao, et al.
Publicado: (2026)
por: Zhang, Yihao, et al.
Publicado: (2026)
Adversarial Representation Engineering: A General Model Editing Framework for Large Language Models
por: Zhang, Yihao, et al.
Publicado: (2024)
por: Zhang, Yihao, et al.
Publicado: (2024)
Unsafer in Many Turns: Benchmarking and Defending Multi-Turn Safety Risks in Tool-Using Agents
por: Li, Xu, et al.
Publicado: (2026)
por: Li, Xu, et al.
Publicado: (2026)
AgentArmor: Enforcing Program Analysis on Agent Runtime Trace to Defend Against Prompt Injection
por: Wang, Peiran, et al.
Publicado: (2025)
por: Wang, Peiran, et al.
Publicado: (2025)
Security Degradation in Iterative AI Code Generation -- A Systematic Analysis of the Paradox
por: Shukla, Shivani, et al.
Publicado: (2025)
por: Shukla, Shivani, et al.
Publicado: (2025)
TraceSafe: A Systematic Assessment of LLM Guardrails on Multi-Step Tool-Calling Trajectories
por: Chen, Yen-Shan, et al.
Publicado: (2026)
por: Chen, Yen-Shan, et al.
Publicado: (2026)
Differentiated Directional Intervention A Framework for Evading LLM Safety Alignment
por: Zhang, Peng, et al.
Publicado: (2025)
por: Zhang, Peng, et al.
Publicado: (2025)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
por: Dong, Yihong, et al.
Publicado: (2024)
por: Dong, Yihong, et al.
Publicado: (2024)
Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training
por: Hubinger, Evan, et al.
Publicado: (2024)
por: Hubinger, Evan, et al.
Publicado: (2024)
Online Safety Analysis for LLMs: a Benchmark, an Assessment, and a Path Forward
por: Xie, Xuan, et al.
Publicado: (2024)
por: Xie, Xuan, et al.
Publicado: (2024)
CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion
por: Ren, Qibing, et al.
Publicado: (2024)
por: Ren, Qibing, et al.
Publicado: (2024)
HexaCoder: Secure Code Generation via Oracle-Guided Synthetic Training Data
por: Hajipour, Hossein, et al.
Publicado: (2024)
por: Hajipour, Hossein, et al.
Publicado: (2024)
Eliciting Harmful Capabilities by Fine-Tuning On Safeguarded Outputs
por: Kaunismaa, Jackson, et al.
Publicado: (2026)
por: Kaunismaa, Jackson, et al.
Publicado: (2026)
The Road of Adaptive AI for Precision in Cybersecurity
por: Garg, Sahil
Publicado: (2025)
por: Garg, Sahil
Publicado: (2025)
RuleForge: Automated Generation and Validation for Web Vulnerability Detection at Scale
por: Garg, Ayush, et al.
Publicado: (2026)
por: Garg, Ayush, et al.
Publicado: (2026)
Boosting Jailbreak Attack with Momentum
por: Zhang, Yihao, et al.
Publicado: (2024)
por: Zhang, Yihao, et al.
Publicado: (2024)
Exploring the Robustness of In-Context Learning with Noisy Labels
por: Cheng, Chen, et al.
Publicado: (2024)
por: Cheng, Chen, et al.
Publicado: (2024)
AnyPoC: Universal Proof-of-Concept Test Generation for Scalable LLM-Based Bug Detection
por: Zhao, Zijie, et al.
Publicado: (2026)
por: Zhao, Zijie, et al.
Publicado: (2026)
Groot: Adversarial Testing for Generative Text-to-Image Models with Tree-based Semantic Transformation
por: Liu, Yi, et al.
Publicado: (2024)
por: Liu, Yi, et al.
Publicado: (2024)
Innovations in Cardless Artificial Intelligence Banking: A Comprehensive Framework for Cyber Secure and Fraud Mitigation using Machine Learning Algorithms
por: Israfeel, Md
Publicado: (2026)
por: Israfeel, Md
Publicado: (2026)
Verify Before You Fix: Agentic Execution Grounding for Trustworthy Cross-Language Code Analysis
por: Gajjar, Jugal
Publicado: (2026)
por: Gajjar, Jugal
Publicado: (2026)
CASCADE: LLM-Powered JavaScript Deobfuscator at Google
por: Jiang, Shan, et al.
Publicado: (2025)
por: Jiang, Shan, et al.
Publicado: (2025)
Evaluating and Mitigating Linguistic Discrimination in Large Language Models
por: Dong, Guoliang, et al.
Publicado: (2024)
por: Dong, Guoliang, et al.
Publicado: (2024)
Secure LLM Fine-Tuning via Safety-Aware Probing
por: Wu, Chengcan, et al.
Publicado: (2025)
por: Wu, Chengcan, et al.
Publicado: (2025)
Which PPML Would a User Choose? A Structured Decision Support Framework for Developers to Rank PPML Techniques Based on User Acceptance Criteria
por: Löbner, Sascha, et al.
Publicado: (2024)
por: Löbner, Sascha, et al.
Publicado: (2024)
A Robust Pipeline for Differentially Private Federated Learning on Imbalanced Clinical Data using SMOTETomek and FedProx
por: Tertulino, Rodrigo
Publicado: (2025)
por: Tertulino, Rodrigo
Publicado: (2025)
Defending against Adversarial Malware Attacks on ML-based Android Malware Detection Systems
por: He, Ping, et al.
Publicado: (2025)
por: He, Ping, et al.
Publicado: (2025)
Efficient Detection of Toxic Prompts in Large Language Models
por: Liu, Yi, et al.
Publicado: (2024)
por: Liu, Yi, et al.
Publicado: (2024)
Tady: A Neural Disassembler without Structural Constraint Violations
por: Qin, Siliang, et al.
Publicado: (2025)
por: Qin, Siliang, et al.
Publicado: (2025)
Cyber Threat Detection and Vulnerability Assessment System using Generative AI and Large Language Model
por: M, Keerthi Kumar., et al.
Publicado: (2026)
por: M, Keerthi Kumar., et al.
Publicado: (2026)
Overeager Coding Agents: Measuring Out-of-Scope Actions on Benign Tasks
por: Qu, Yubin, et al.
Publicado: (2026)
por: Qu, Yubin, et al.
Publicado: (2026)
Agent Skills in the Wild: An Empirical Study of Security Vulnerabilities at Scale
por: Liu, Yi, et al.
Publicado: (2026)
por: Liu, Yi, et al.
Publicado: (2026)
Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings
por: Zhang, Zhixin, et al.
Publicado: (2025)
por: Zhang, Zhixin, et al.
Publicado: (2025)
Your Compiler is Backdooring Your Model: Understanding and Exploiting Compilation Inconsistency Vulnerabilities in Deep Learning Compilers
por: Chen, Simin, et al.
Publicado: (2025)
por: Chen, Simin, et al.
Publicado: (2025)
Ejemplares similares
-
RACC: Representation-Aware Coverage Criteria for LLM Safety Testing
por: Wei, Zeming, et al.
Publicado: (2026) -
Automata-Based Steering of Large Language Models for Diverse Structured Generation
por: Luan, Xiaokun, et al.
Publicado: (2025) -
ReGA: Model-Based Safeguard for LLMs via Representation-Guided Abstraction
por: Wei, Zeming, et al.
Publicado: (2025) -
LeCov: Multi-level Testing Criteria for Large Language Models
por: Xie, Xuan, et al.
Publicado: (2024) -
UniTSyn: A Large-Scale Dataset Capable of Enhancing the Prowess of Large Language Models for Program Testing
por: He, Yifeng, et al.
Publicado: (2024)