FuzzingRL: Reinforcement Fuzz-Testing for Revealing VLM Failures
Fuente:
arXiv
Saved in:
| Main Authors: | Xu, Jiajun, Mao, Jiageng, Qi, Ang, Yuan, Weiduo, Romanus, Alexander, Xia, Helen, Guizilini, Vitor Campagnolo, Wang, Yue |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
by: Wu, Yanru, et al.
Published: (2026)
by: Wu, Yanru, et al.
Published: (2026)
DreamPlan: Efficient Reinforcement Fine-Tuning of Vision-Language Planners via Video World Models
by: Jia, Emily Yue-Ting, et al.
Published: (2026)
by: Jia, Emily Yue-Ting, et al.
Published: (2026)
FuzzAug: Data Augmentation by Coverage-guided Fuzzing for Neural Test Generation
by: He, Yifeng, et al.
Published: (2024)
by: He, Yifeng, et al.
Published: (2024)
PhysBench: Benchmarking and Enhancing Vision-Language Models for Physical World Understanding
by: Chow, Wei, et al.
Published: (2025)
by: Chow, Wei, et al.
Published: (2025)
R1-Fuzz: Specializing Language Models for Textual Fuzzing via Reinforcement Learning
by: Lin, Jiayi, et al.
Published: (2025)
by: Lin, Jiayi, et al.
Published: (2025)
FuzzWiz -- Fuzzing Framework for Efficient Hardware Coverage
by: Gadde, Deepak Narayan, et al.
Published: (2024)
by: Gadde, Deepak Narayan, et al.
Published: (2024)
ToolFuzz -- Automated Agent Tool Testing
by: Milev, Ivan, et al.
Published: (2025)
by: Milev, Ivan, et al.
Published: (2025)
HFuzzer: Testing Large Language Models for Package Hallucinations via Phrase-based Fuzzing
by: Zhao, Yukai, et al.
Published: (2025)
by: Zhao, Yukai, et al.
Published: (2025)
TurboFuzzLLM: Turbocharging Mutation-based Fuzzing for Effectively Jailbreaking Large Language Models in Practice
by: Goel, Aman, et al.
Published: (2025)
by: Goel, Aman, et al.
Published: (2025)
DocFuzz: A Directed Fuzzing Method Based on a Feedback Mechanism Mutator
by: Lixia Xie, et al.
Published: (2024)
by: Lixia Xie, et al.
Published: (2024)
APIRL: Deep Reinforcement Learning for REST API Fuzzing
by: Foley, Myles, et al.
Published: (2024)
by: Foley, Myles, et al.
Published: (2024)
PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs
by: Gong, Xueluan, et al.
Published: (2024)
by: Gong, Xueluan, et al.
Published: (2024)
Fuzzing: Randomness? Reasoning! Efficient Directed Fuzzing via Large Language Models
by: Feng, Xiaotao, et al.
Published: (2025)
by: Feng, Xiaotao, et al.
Published: (2025)
ReFuzz: Reusing Tests for Processor Fuzzing with Contextual Bandits
by: Chen, Chen, et al.
Published: (2025)
by: Chen, Chen, et al.
Published: (2025)
PROMPTFUZZ: Harnessing Fuzzing Techniques for Robust Testing of Prompt Injection in LLMs
by: Yu, Jiahao, et al.
Published: (2024)
by: Yu, Jiahao, et al.
Published: (2024)
Towards Reliable LLM-Driven Fuzz Testing: Vision and Road Ahead
by: Cheng, Yiran, et al.
Published: (2025)
by: Cheng, Yiran, et al.
Published: (2025)
Towards Realistic Scene Generation with LiDAR Diffusion Models
by: Ran, Haoxi, et al.
Published: (2024)
by: Ran, Haoxi, et al.
Published: (2024)
Dance of the ADS: Orchestrating Failures through Historically-Informed Scenario Fuzzing
by: Wang, Tong, et al.
Published: (2024)
by: Wang, Tong, et al.
Published: (2024)
Causal Fuzzing for Verifying Machine Unlearning
by: Mazhar, Anna, et al.
Published: (2025)
by: Mazhar, Anna, et al.
Published: (2025)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
by: Yang, Liqun, et al.
Published: (2024)
by: Yang, Liqun, et al.
Published: (2024)
ORFuzz: Fuzzing the "Other Side" of LLM Safety -- Testing Over-Refusal
by: Zhang, Haonan, et al.
Published: (2025)
by: Zhang, Haonan, et al.
Published: (2025)
No Attack Required: Semantic Fuzzing for Specification Violations in Agent Skills
by: Li, Ying, et al.
Published: (2026)
by: Li, Ying, et al.
Published: (2026)
When Fuzzing Meets LLMs: Challenges and Opportunities
by: Jiang, Yu, et al.
Published: (2024)
by: Jiang, Yu, et al.
Published: (2024)
Testing Storage-System Correctness: Challenges, Fuzzing Limitations, and AI-Augmented Opportunities
by: Wang, Ying, et al.
Published: (2026)
by: Wang, Ying, et al.
Published: (2026)
Orion: Fuzzing Workflow Automation
by: Bazalii, Max, et al.
Published: (2025)
by: Bazalii, Max, et al.
Published: (2025)
Enhancing Fuzz Testing Efficiency through Automated Fuzz Target Generation
by: Tran, Chi Thien
Published: (2026)
by: Tran, Chi Thien
Published: (2026)
Before the Model Learns the Bug:Fuzzing RLVR Verifiers
by: Ray, Jaideep
Published: (2026)
by: Ray, Jaideep
Published: (2026)
LLMs are All You Need? Improving Fuzz Testing for MOJO with Large Language Models
by: Huang, Linghan, et al.
Published: (2025)
by: Huang, Linghan, et al.
Published: (2025)
MobFuzz: Adaptive Multi-objective Optimization in Gray-box Fuzzing
by: Zhang, Gen, et al.
Published: (2024)
by: Zhang, Gen, et al.
Published: (2024)
Locus: Agentic Predicate Synthesis for Directed Fuzzing
by: Zhu, Jie, et al.
Published: (2025)
by: Zhu, Jie, et al.
Published: (2025)
Python Fuzzing for Trustworthy Machine Learning Frameworks
by: Yegorov, Ilya, et al.
Published: (2024)
by: Yegorov, Ilya, et al.
Published: (2024)
Fuzz4All: Universal Fuzzing with Large Language Models
by: Xia, Chunqiu Steven, et al.
Published: (2023)
by: Xia, Chunqiu Steven, et al.
Published: (2023)
On the Challenges of Fuzzing Techniques via Large Language Models
by: Huang, Linghan, et al.
Published: (2024)
by: Huang, Linghan, et al.
Published: (2024)
In-Browser LLM-Guided Fuzzing for Real-Time Prompt Injection Testing in Agentic AI Browsers
by: Cohen, Avihay
Published: (2025)
by: Cohen, Avihay
Published: (2025)
Learning from Massive Human Videos for Universal Humanoid Pose Control
by: Mao, Jiageng, et al.
Published: (2024)
by: Mao, Jiageng, et al.
Published: (2024)
Prompt Fuzzing for Fuzz Driver Generation
by: Lyu, Yunlong, et al.
Published: (2023)
by: Lyu, Yunlong, et al.
Published: (2023)
LLAMAFUZZ: Large Language Model Enhanced Greybox Fuzzing
by: Zhang, Hongxiang, et al.
Published: (2024)
by: Zhang, Hongxiang, et al.
Published: (2024)
GraphFuzz: Automated Testing of Graph Algorithm Implementations with Differential Fuzzing and Lightweight Feedback
by: Yan, Wenqi, et al.
Published: (2025)
by: Yan, Wenqi, et al.
Published: (2025)
SeedAIchemy: LLM-Driven Seed Corpus Generation for Fuzzing
by: Wen, Aidan, et al.
Published: (2025)
by: Wen, Aidan, et al.
Published: (2025)
Hybrid Fuzzing with LLM-Guided Input Mutation and Semantic Feedback
by: Lin, Shiyin
Published: (2025)
by: Lin, Shiyin
Published: (2025)
Similar Items
-
Large Reward Models: Generalizable Online Robot Reward Generation with Vision-Language Models
by: Wu, Yanru, et al.
Published: (2026) -
DreamPlan: Efficient Reinforcement Fine-Tuning of Vision-Language Planners via Video World Models
by: Jia, Emily Yue-Ting, et al.
Published: (2026) -
FuzzAug: Data Augmentation by Coverage-guided Fuzzing for Neural Test Generation
by: He, Yifeng, et al.
Published: (2024) -
PhysBench: Benchmarking and Enhancing Vision-Language Models for Physical World Understanding
by: Chow, Wei, et al.
Published: (2025) -
R1-Fuzz: Specializing Language Models for Textual Fuzzing via Reinforcement Learning
by: Lin, Jiayi, et al.
Published: (2025)