How Multi-Modal LLMs Reshape Visual Deep Learning Testing? A Comprehensive Study Through the Lens of Image Mutation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Liwen, Yuan, Yuanyuan, Sun, Ao, Li, Zongjie, Ma, Pingchuan, Wu, Daoyuan, Wang, Shuai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Low-Cost and Comprehensive Non-textual Input Fuzzing with LLM-Synthesized Input Generators
por: Zhang, Kunpeng, et al.
Publicado: (2025)
por: Zhang, Kunpeng, et al.
Publicado: (2025)
SkillReducer: Optimizing LLM Agent Skills for Token Efficiency
por: Gao, Yudong, et al.
Publicado: (2026)
por: Gao, Yudong, et al.
Publicado: (2026)
API-guided Dataset Synthesis to Finetune Large Code Models
por: Li, Zongjie, et al.
Publicado: (2024)
por: Li, Zongjie, et al.
Publicado: (2024)
Digging Into the Internal: Causality-Based Analysis of LLM Function Calling
por: Ji, Zhenlan, et al.
Publicado: (2025)
por: Ji, Zhenlan, et al.
Publicado: (2025)
Reasoning as a Resource: Optimizing Fast and Slow Thinking in Code Generation Models
por: Li, Zongjie, et al.
Publicado: (2025)
por: Li, Zongjie, et al.
Publicado: (2025)
Deep Learning Framework Testing via Model Mutation: How Far Are We?
por: Mu, Yanzhou, et al.
Publicado: (2025)
por: Mu, Yanzhou, et al.
Publicado: (2025)
Understanding and Bridging the Planner-Coder Gap: A Systematic Study on the Robustness of Multi-Agent Systems for Code Generation
por: Lyu, Zongyi, et al.
Publicado: (2025)
por: Lyu, Zongyi, et al.
Publicado: (2025)
From Evaluation to Enhancement: Large Language Models for Zero-Knowledge Proof Code Generation
por: Xue, Zhantong, et al.
Publicado: (2025)
por: Xue, Zhantong, et al.
Publicado: (2025)
Examining LLMs Ability to Summarize Code Through Mutation-Analysis
por: Khatib, Lara, et al.
Publicado: (2026)
por: Khatib, Lara, et al.
Publicado: (2026)
LLM-Powered Silent Bug Fuzzing in Deep Learning Libraries via Versatile and Controlled Bug Transfer
por: Zhang, Kunpeng, et al.
Publicado: (2026)
por: Zhang, Kunpeng, et al.
Publicado: (2026)
Boosting LLMs for Mutation Generation
por: Wang, Bo, et al.
Publicado: (2026)
por: Wang, Bo, et al.
Publicado: (2026)
Measuring the Permission Gate: A Stress-Test Evaluation of Claude Code's Auto Mode
por: Ji, Zimo, et al.
Publicado: (2026)
por: Ji, Zimo, et al.
Publicado: (2026)
Exploring Multi-Lingual Bias of Large Code Models in Code Generation
por: Wang, Chaozheng, et al.
Publicado: (2024)
por: Wang, Chaozheng, et al.
Publicado: (2024)
Evaluating LLMs on Sequential API Call Through Automated Test Generation
por: Huang, Yuheng, et al.
Publicado: (2025)
por: Huang, Yuheng, et al.
Publicado: (2025)
A Comprehensive Study on Large Language Models for Mutation Testing
por: Wang, Bo, et al.
Publicado: (2024)
por: Wang, Bo, et al.
Publicado: (2024)
Towards Multi-Platform Mutation Testing of Task-based Chatbots
por: Clerissi, Diego, et al.
Publicado: (2025)
por: Clerissi, Diego, et al.
Publicado: (2025)
MuMuTestUp: Mutation-based Multi-Agent Test Case Update
por: Tian, Dawei, et al.
Publicado: (2026)
por: Tian, Dawei, et al.
Publicado: (2026)
MuFF: Stable and Sensitive Post-training Mutation Testing for Deep Learning
por: Kim, Jinhan, et al.
Publicado: (2025)
por: Kim, Jinhan, et al.
Publicado: (2025)
Mutation-Based Deep Learning Framework Testing Method in JavaScript Environment
por: Zou, Yinglong, et al.
Publicado: (2024)
por: Zou, Yinglong, et al.
Publicado: (2024)
RUM: Rule+LLM-Based Comprehensive Assessment on Testing Skills
por: Wang, Yue, et al.
Publicado: (2025)
por: Wang, Yue, et al.
Publicado: (2025)
Fix the Tests: Augmenting LLMs to Repair Test Cases with Static Collector and Neural Reranker
por: Liu, Jun, et al.
Publicado: (2024)
por: Liu, Jun, et al.
Publicado: (2024)
DevMuT: Testing Deep Learning Framework via Developer Expertise-Based Mutation
por: Mu, Yanzhou, et al.
Publicado: (2025)
por: Mu, Yanzhou, et al.
Publicado: (2025)
Mutation-Guided Unit Test Generation with a Large Language Model
por: Wang, Guancheng, et al.
Publicado: (2025)
por: Wang, Guancheng, et al.
Publicado: (2025)
Breaking Single-Tester Limits: Multi-Agent LLMs for Multi-User Feature Testing
por: Feng, Sidong, et al.
Publicado: (2025)
por: Feng, Sidong, et al.
Publicado: (2025)
muPRL: A Mutation Testing Pipeline for Deep Reinforcement Learning based on Real Faults
por: Thomas, Deepak-George, et al.
Publicado: (2024)
por: Thomas, Deepak-George, et al.
Publicado: (2024)
Multi-Modal Requirements Data-based Acceptance Criteria Generation using LLMs
por: Wang, Fanyu, et al.
Publicado: (2025)
por: Wang, Fanyu, et al.
Publicado: (2025)
Mutation-based Consistency Testing for Evaluating the Code Understanding Capability of LLMs
por: Li, Ziyu, et al.
Publicado: (2024)
por: Li, Ziyu, et al.
Publicado: (2024)
MOTIF: A tool for Mutation Testing with Fuzzing
por: Lee, Jaekwon, et al.
Publicado: (2024)
por: Lee, Jaekwon, et al.
Publicado: (2024)
Hybrid Fault-Driven Mutation Testing for Python
por: Alimadadi, Saba, et al.
Publicado: (2026)
por: Alimadadi, Saba, et al.
Publicado: (2026)
Simulink Mutation Testing using CodeBERT
por: Zhang, Jingfan, et al.
Publicado: (2025)
por: Zhang, Jingfan, et al.
Publicado: (2025)
SPVR: syntax-to-prompt vulnerability repair based on large language models
por: Wang, Ruoke, et al.
Publicado: (2024)
por: Wang, Ruoke, et al.
Publicado: (2024)
Are Benchmark Tests Strong Enough? Mutation-Guided Diagnosis and Augmentation of Regression Suites
por: Li, Chenglin, et al.
Publicado: (2026)
por: Li, Chenglin, et al.
Publicado: (2026)
Hallucination to Consensus: Multi-Agent LLMs for End-to-End JUnit Test Generation
por: Xu, Qinghua, et al.
Publicado: (2025)
por: Xu, Qinghua, et al.
Publicado: (2025)
Structural Mutation Based Differential Testing for FPGA Logic Synthesis Compilers
por: Xu, Zhihao, et al.
Publicado: (2025)
por: Xu, Zhihao, et al.
Publicado: (2025)
LLMorpheus: Mutation Testing using Large Language Models
por: Tip, Frank, et al.
Publicado: (2024)
por: Tip, Frank, et al.
Publicado: (2024)
Teaching Loop Testing to Young Learners with the Code Critters Mutation Testing Game
por: Straubinger, Philipp, et al.
Publicado: (2025)
por: Straubinger, Philipp, et al.
Publicado: (2025)
MultiTest: Physical-Aware Object Insertion for Testing Multi-sensor Fusion Perception Systems
por: Gao, Xinyu, et al.
Publicado: (2024)
por: Gao, Xinyu, et al.
Publicado: (2024)
Coverage-Guided Testing for Deep Learning Models: A Comprehensive Survey
por: Guo, Hongjing, et al.
Publicado: (2025)
por: Guo, Hongjing, et al.
Publicado: (2025)
Seeing is Fixing: Cross-Modal Reasoning with Multimodal LLMs for Visual Software Issue Fixing
por: Huang, Kai, et al.
Publicado: (2025)
por: Huang, Kai, et al.
Publicado: (2025)
EmbC-Test: How to Speed Up Embedded Software Testing Using LLMs and RAG
por: Harnot, Maximilian, et al.
Publicado: (2026)
por: Harnot, Maximilian, et al.
Publicado: (2026)
Ejemplares similares
-
Low-Cost and Comprehensive Non-textual Input Fuzzing with LLM-Synthesized Input Generators
por: Zhang, Kunpeng, et al.
Publicado: (2025) -
SkillReducer: Optimizing LLM Agent Skills for Token Efficiency
por: Gao, Yudong, et al.
Publicado: (2026) -
API-guided Dataset Synthesis to Finetune Large Code Models
por: Li, Zongjie, et al.
Publicado: (2024) -
Digging Into the Internal: Causality-Based Analysis of LLM Function Calling
por: Ji, Zhenlan, et al.
Publicado: (2025) -
Reasoning as a Resource: Optimizing Fast and Slow Thinking in Code Generation Models
por: Li, Zongjie, et al.
Publicado: (2025)