IndicEval-XL: Bridging Linguistic Diversity in Code Generation Across Indic Languages
Fuente:
arXiv
Salvato in:
| Autori principali: | Singh, Ujjwal, Sharma, Aditi, Gupta, Nikhil, Deepakshi, Jha, Vivek Kumar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
IndicEval: A Bilingual Indian Educational Evaluation Framework for Large Language Models
di: Bharti, Saurabh, et al.
Pubblicazione: (2026)
di: Bharti, Saurabh, et al.
Pubblicazione: (2026)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?
di: Zhao, Yuwei, et al.
Pubblicazione: (2024)
di: Zhao, Yuwei, et al.
Pubblicazione: (2024)
ConCodeEval: Evaluating Large Language Models for Code Constraints in Domain-Specific Languages
di: Kammakomati, Mehant, et al.
Pubblicazione: (2024)
di: Kammakomati, Mehant, et al.
Pubblicazione: (2024)
HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation
di: Yu, Zhaojian, et al.
Pubblicazione: (2024)
di: Yu, Zhaojian, et al.
Pubblicazione: (2024)
IndicParam: Benchmark to evaluate LLMs on low-resource Indic Languages
di: Maheshwari, Ayush, et al.
Pubblicazione: (2025)
di: Maheshwari, Ayush, et al.
Pubblicazione: (2025)
IndicSentEval: How Effectively do Multilingual Transformer Models encode Linguistic Properties for Indic Languages?
di: Aravapalli, Akhilesh, et al.
Pubblicazione: (2024)
di: Aravapalli, Akhilesh, et al.
Pubblicazione: (2024)
Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval
di: Wu, Jiarong, et al.
Pubblicazione: (2025)
di: Wu, Jiarong, et al.
Pubblicazione: (2025)
DevEval: A Manually-Annotated Code Generation Benchmark Aligned with Real-World Code Repositories
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
ClassEval-Pro: A Cross-Domain Benchmark for Class-Level Code Generation
di: Chen, Yeheng, et al.
Pubblicazione: (2026)
di: Chen, Yeheng, et al.
Pubblicazione: (2026)
Bridging Code Graphs and Large Language Models for Better Code Understanding
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
ProjectEval: A Benchmark for Programming Agents Automated Evaluation on Project-Level Code Generation
di: Liu, Kaiyuan, et al.
Pubblicazione: (2025)
di: Liu, Kaiyuan, et al.
Pubblicazione: (2025)
VHDL-Eval: A Framework for Evaluating Large Language Models in VHDL Code Generation
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2024)
di: Vijayaraghavan, Prashanth, et al.
Pubblicazione: (2024)
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis
di: Li, Yansong, et al.
Pubblicazione: (2025)
di: Li, Yansong, et al.
Pubblicazione: (2025)
DevEval: Evaluating Code Generation in Practical Software Projects
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)
ArtifactsBench: Bridging the Visual-Interactive Gap in LLM Code Generation Evaluation
di: Zhang, Chenchen, et al.
Pubblicazione: (2025)
di: Zhang, Chenchen, et al.
Pubblicazione: (2025)
Using Large Language Models for Student-Code Guided Test Case Generation in Computer Science Education
di: Kumar, Nischal Ashok, et al.
Pubblicazione: (2024)
di: Kumar, Nischal Ashok, et al.
Pubblicazione: (2024)
IndicGenBench: A Multilingual Benchmark to Evaluate Generation Capabilities of LLMs on Indic Languages
di: Singh, Harman, et al.
Pubblicazione: (2024)
di: Singh, Harman, et al.
Pubblicazione: (2024)
StackEval: Benchmarking LLMs in Coding Assistance
di: Shah, Nidhish, et al.
Pubblicazione: (2024)
di: Shah, Nidhish, et al.
Pubblicazione: (2024)
How Diversely Can Language Models Solve Problems? Exploring the Algorithmic Diversity of Model-Generated Code
di: Lee, Seonghyeon, et al.
Pubblicazione: (2025)
di: Lee, Seonghyeon, et al.
Pubblicazione: (2025)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
di: Chou, Jason, et al.
Pubblicazione: (2025)
di: Chou, Jason, et al.
Pubblicazione: (2025)
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation
di: Petrukha, Ivan, et al.
Pubblicazione: (2025)
di: Petrukha, Ivan, et al.
Pubblicazione: (2025)
Novel Preprocessing Technique for Data Embedding in Engineering Code Generation Using Large Language Model
di: Lin, Yu-Chen, et al.
Pubblicazione: (2023)
di: Lin, Yu-Chen, et al.
Pubblicazione: (2023)
MERA Code: A Unified Framework for Evaluating Code Generation Across Tasks
di: Chervyakov, Artem, et al.
Pubblicazione: (2025)
di: Chervyakov, Artem, et al.
Pubblicazione: (2025)
NaturalCodeBench: Examining Coding Performance Mismatch on HumanEval and Natural User Prompts
di: Zhang, Shudan, et al.
Pubblicazione: (2024)
di: Zhang, Shudan, et al.
Pubblicazione: (2024)
Hybrid-Gym: Training Coding Agents to Generalize Across Tasks
di: Xie, Yiqing, et al.
Pubblicazione: (2026)
di: Xie, Yiqing, et al.
Pubblicazione: (2026)
Leveraging Print Debugging to Improve Code Generation in Large Language Models
di: Hu, Xueyu, et al.
Pubblicazione: (2024)
di: Hu, Xueyu, et al.
Pubblicazione: (2024)
A Survey of using Large Language Models for Generating Infrastructure as Code
di: Srivatsa, Kalahasti Ganesh, et al.
Pubblicazione: (2024)
di: Srivatsa, Kalahasti Ganesh, et al.
Pubblicazione: (2024)
From Effectiveness to Efficiency: Uncovering Linguistic Bias in Large Language Model-based Code Generation
di: Jiang, Weipeng, et al.
Pubblicazione: (2024)
di: Jiang, Weipeng, et al.
Pubblicazione: (2024)
CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
What's Wrong with Your Code Generated by Large Language Models? An Extensive Study
di: Dou, Shihan, et al.
Pubblicazione: (2024)
di: Dou, Shihan, et al.
Pubblicazione: (2024)
Seeker: Towards Exception Safety Code Generation with Intermediate Language Agents Framework
di: Zhang, Xuanming, et al.
Pubblicazione: (2024)
di: Zhang, Xuanming, et al.
Pubblicazione: (2024)
Evaluation of Code LLMs on Geospatial Code Generation
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2024)
DependEval: Benchmarking LLMs for Repository Dependency Understanding
di: Du, Junjia, et al.
Pubblicazione: (2025)
di: Du, Junjia, et al.
Pubblicazione: (2025)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
VersiCode: Towards Version-controllable Code Generation
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
di: Shi, Yuling, et al.
Pubblicazione: (2026)
di: Shi, Yuling, et al.
Pubblicazione: (2026)
Documenti analoghi
-
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
di: Peng, Qiwei, et al.
Pubblicazione: (2024) -
IndicEval: A Bilingual Indian Educational Evaluation Framework for Large Language Models
di: Bharti, Saurabh, et al.
Pubblicazione: (2026) -
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
di: Wang, Jiexin, et al.
Pubblicazione: (2024) -
CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?
di: Zhao, Yuwei, et al.
Pubblicazione: (2024) -
ConCodeEval: Evaluating Large Language Models for Code Constraints in Domain-Specific Languages
di: Kammakomati, Mehant, et al.
Pubblicazione: (2024)