Code-Vision: Evaluating Multimodal LLMs Logic Understanding and Code Generation Capabilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Hanbin, Zhou, Xiaoxuan, Xu, Zhipeng, Cheng, Keyuan, Zuo, Yuxin, Tian, Kai, Song, Jingwei, Lu, Junting, Hu, Wenhui, Liu, Xueyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mutation-based Consistency Testing for Evaluating the Code Understanding Capability of LLMs
par: Li, Ziyu, et autres
Publié: (2024)
par: Li, Ziyu, et autres
Publié: (2024)
CodeMMLU: A Multi-Task Benchmark for Assessing Code Understanding & Reasoning Capabilities of CodeLLMs
par: Manh, Dung Nguyen, et autres
Publié: (2024)
par: Manh, Dung Nguyen, et autres
Publié: (2024)
CODEMENV: Benchmarking Large Language Models on Code Migration
par: Cheng, Keyuan, et autres
Publié: (2025)
par: Cheng, Keyuan, et autres
Publié: (2025)
SelfPiCo: Self-Guided Partial Code Execution with LLMs
par: Xue, Zhipeng, et autres
Publié: (2024)
par: Xue, Zhipeng, et autres
Publié: (2024)
Unmasking the Genuine Type Inference Capabilities of LLMs for Java Code Snippets
par: Dong, Yiwen, et autres
Publié: (2025)
par: Dong, Yiwen, et autres
Publié: (2025)
AOCI: Symbolic-Semantic Indexing for Practical Repository-Scale Code Understanding with LLMs
par: Liu, Jinshi, et autres
Publié: (2026)
par: Liu, Jinshi, et autres
Publié: (2026)
Exploring the Capabilities of LLMs for Code Change Related Tasks
par: Fan, Lishui, et autres
Publié: (2024)
par: Fan, Lishui, et autres
Publié: (2024)
Coding in a Bubble? Evaluating LLMs in Resolving Context Adaptation Bugs During Code Adaptation
par: Zhang, Tanghaoran, et autres
Publié: (2026)
par: Zhang, Tanghaoran, et autres
Publié: (2026)
Do Code LLMs Understand Design Patterns?
par: Pan, Zhenyu, et autres
Publié: (2025)
par: Pan, Zhenyu, et autres
Publié: (2025)
Can Language Models Pretend Solvers? Logic Code Simulation with LLMs
par: Chen, Minyu, et autres
Publié: (2024)
par: Chen, Minyu, et autres
Publié: (2024)
Instruct or Interact? Exploring and Eliciting LLMs' Capability in Code Snippet Adaptation Through Prompt Engineering
par: Zhang, Tanghaoran, et autres
Publié: (2024)
par: Zhang, Tanghaoran, et autres
Publié: (2024)
Evaluation of Code LLMs on Geospatial Code Generation
par: Gramacki, Piotr, et autres
Publié: (2024)
par: Gramacki, Piotr, et autres
Publié: (2024)
LLMs are Bug Replicators: An Empirical Study on LLMs' Capability in Completing Bug-prone Code
par: Guo, Liwei, et autres
Publié: (2025)
par: Guo, Liwei, et autres
Publié: (2025)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
par: Shi, Yuling, et autres
Publié: (2026)
par: Shi, Yuling, et autres
Publié: (2026)
Understanding Code Understandability Improvements in Code Reviews
par: Oliveira, Delano, et autres
Publié: (2024)
par: Oliveira, Delano, et autres
Publié: (2024)
Assessing Code Understanding in LLMs
par: Laneve, Cosimo, et autres
Publié: (2025)
par: Laneve, Cosimo, et autres
Publié: (2025)
Requirements Development and Formalization for Reliable Code Generation: A Multi-Agent Vision
par: Lu, Xu, et autres
Publié: (2025)
par: Lu, Xu, et autres
Publié: (2025)
CodeGlance: Understanding Code Reasoning Challenges in LLMs through Multi-Dimensional Feature Analysis
par: Wang, Yunkun, et autres
Publié: (2026)
par: Wang, Yunkun, et autres
Publié: (2026)
On Evaluating the Efficiency of Source Code Generated by LLMs
par: Niu, Changan, et autres
Publié: (2024)
par: Niu, Changan, et autres
Publié: (2024)
Understanding Robustness of Model Editing in Code LLMs
par: Chhetri, Vinaik, et autres
Publié: (2025)
par: Chhetri, Vinaik, et autres
Publié: (2025)
The Code Barrier: What LLMs Actually Understand?
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
par: Nikiema, Serge Lionel, et autres
Publié: (2025)
Evaluating the Test Adequacy of Benchmarks for LLMs on Code Generation
par: Xiangyue Liu, et autres
Publié: (2025)
par: Xiangyue Liu, et autres
Publié: (2025)
Hierarchical Evaluation of Software Design Capabilities of Large Language Models of Code
par: Saad, Mootez, et autres
Publié: (2025)
par: Saad, Mootez, et autres
Publié: (2025)
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
par: Zhan, Zexun, et autres
Publié: (2025)
par: Zhan, Zexun, et autres
Publié: (2025)
CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification
par: Tian, Yuchen, et autres
Publié: (2024)
par: Tian, Yuchen, et autres
Publié: (2024)
CodeScope: An Execution-based Multilingual Multitask Multidimensional Benchmark for Evaluating LLMs on Code Understanding and Generation
par: Yan, Weixiang, et autres
Publié: (2023)
par: Yan, Weixiang, et autres
Publié: (2023)
An Empirical Study on Capability of Large Language Models in Understanding Code Semantics
par: Nguyen, Thu-Trang, et autres
Publié: (2024)
par: Nguyen, Thu-Trang, et autres
Publié: (2024)
An Insight into Security Code Review with LLMs: Capabilities, Obstacles, and Influential Factors
par: Yu, Jiaxin, et autres
Publié: (2024)
par: Yu, Jiaxin, et autres
Publié: (2024)
Code2API: A Tool for Generating Reusable APIs from Stack Overflow Code Snippets
par: Mai, Yubo, et autres
Publié: (2025)
par: Mai, Yubo, et autres
Publié: (2025)
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
par: He, Mengliang, et autres
Publié: (2025)
par: He, Mengliang, et autres
Publié: (2025)
FairCoder: Evaluating Social Bias of LLMs in Code Generation
par: Du, Yongkang, et autres
Publié: (2025)
par: Du, Yongkang, et autres
Publié: (2025)
CodeWatcher: IDE Telemetry Data Extraction Tool for Understanding Coding Interactions with LLMs
par: Basha, Manaal, et autres
Publié: (2025)
par: Basha, Manaal, et autres
Publié: (2025)
Are They All Good? Evaluating the Quality of CoTs in LLM-based Code Generation
par: Zhang, Binquan, et autres
Publié: (2025)
par: Zhang, Binquan, et autres
Publié: (2025)
Clean Code, Better Models: Enhancing LLM Performance with Smell-Cleaned Dataset
par: Xue, Zhipeng, et autres
Publié: (2025)
par: Xue, Zhipeng, et autres
Publié: (2025)
Understanding Specification-Driven Code Generation with LLMs: An Empirical Study Design
par: Rosa, Giovanni, et autres
Publié: (2026)
par: Rosa, Giovanni, et autres
Publié: (2026)
DePro: Understanding the Role of LLMs in Debugging Competitive Programming Code
par: Parvez, Nabiha, et autres
Publié: (2026)
par: Parvez, Nabiha, et autres
Publié: (2026)
Demystifying and Assessing Code Understandability in Java Decompilation
par: Qin, Ruixin, et autres
Publié: (2024)
par: Qin, Ruixin, et autres
Publié: (2024)
Enhancing and Reporting Robustness Boundary of Neural Code Models for Intelligent Code Understanding
par: Han, Tingxu, et autres
Publié: (2026)
par: Han, Tingxu, et autres
Publié: (2026)
Gotcha! This Model Uses My Code! Evaluating Membership Leakage Risks in Code Models
par: Yang, Zhou, et autres
Publié: (2023)
par: Yang, Zhou, et autres
Publié: (2023)
Help Me to Understand this Commit! -- A Vision for Contextualized Code Reviews
par: Unterkalmsteiner, Michael, et autres
Publié: (2024)
par: Unterkalmsteiner, Michael, et autres
Publié: (2024)
Documents similaires
-
Mutation-based Consistency Testing for Evaluating the Code Understanding Capability of LLMs
par: Li, Ziyu, et autres
Publié: (2024) -
CodeMMLU: A Multi-Task Benchmark for Assessing Code Understanding & Reasoning Capabilities of CodeLLMs
par: Manh, Dung Nguyen, et autres
Publié: (2024) -
CODEMENV: Benchmarking Large Language Models on Code Migration
par: Cheng, Keyuan, et autres
Publié: (2025) -
SelfPiCo: Self-Guided Partial Code Execution with LLMs
par: Xue, Zhipeng, et autres
Publié: (2024) -
Unmasking the Genuine Type Inference Capabilities of LLMs for Java Code Snippets
par: Dong, Yiwen, et autres
Publié: (2025)