McEval: Massively Multilingual Code Evaluation
Fuente:
arXiv
Salvato in:
| Autori principali: | Chai, Linzheng, Liu, Shukai, Yang, Jian, Yin, Yuwei, Jin, Ke, Liu, Jiaheng, Sun, Tao, Zhang, Ge, Ren, Changyu, Guo, Hongcheng, Wang, Zekun, Wang, Boyang, Wu, Xianjie, Wang, Bing, Li, Tongliang, Yang, Liqun, Duan, Sufeng, Li, Zhoujun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MdEval: Massively Multilingual Code Debugging
di: Liu, Shukai, et al.
Pubblicazione: (2024)
di: Liu, Shukai, et al.
Pubblicazione: (2024)
UniCoder: Scaling Code Large Language Model via Universal Code
di: Sun, Tao, et al.
Pubblicazione: (2024)
di: Sun, Tao, et al.
Pubblicazione: (2024)
m3P: Towards Multimodal Multilingual Translation with Multimodal Prompt
di: Yang, Jian, et al.
Pubblicazione: (2024)
di: Yang, Jian, et al.
Pubblicazione: (2024)
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)
di: Liu, Jiaheng, et al.
Pubblicazione: (2024)
SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
di: Ji, Hangyuan, et al.
Pubblicazione: (2024)
di: Ji, Hangyuan, et al.
Pubblicazione: (2024)
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
di: Chai, Linzheng, et al.
Pubblicazione: (2024)
di: Chai, Linzheng, et al.
Pubblicazione: (2024)
Multilingual Multimodal Software Developer for Code Generation
di: Chai, Linzheng, et al.
Pubblicazione: (2025)
di: Chai, Linzheng, et al.
Pubblicazione: (2025)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
di: Wu, Xianjie, et al.
Pubblicazione: (2024)
di: Wu, Xianjie, et al.
Pubblicazione: (2024)
M3TQA: Massively Multilingual Multitask Table Question Answering
di: Shu, Daixin, et al.
Pubblicazione: (2025)
di: Shu, Daixin, et al.
Pubblicazione: (2025)
H2HTalk: Evaluating Large Language Models as Emotional Companion
di: Wang, Boyang, et al.
Pubblicazione: (2025)
di: Wang, Boyang, et al.
Pubblicazione: (2025)
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
di: Hou, Xia, et al.
Pubblicazione: (2024)
di: Hou, Xia, et al.
Pubblicazione: (2024)
IFEvalCode: Controlled Code Generation
di: Yang, Jian, et al.
Pubblicazione: (2025)
di: Yang, Jian, et al.
Pubblicazione: (2025)
DependEval: Benchmarking LLMs for Repository Dependency Understanding
di: Du, Junjia, et al.
Pubblicazione: (2025)
di: Du, Junjia, et al.
Pubblicazione: (2025)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
di: Yang, Liqun, et al.
Pubblicazione: (2024)
di: Yang, Liqun, et al.
Pubblicazione: (2024)
LogFormer: A Pre-train and Tuning Pipeline for Log Anomaly Detection
di: Guo, Hongcheng, et al.
Pubblicazione: (2024)
di: Guo, Hongcheng, et al.
Pubblicazione: (2024)
OWL: A Large Language Model for IT Operations
di: Guo, Hongcheng, et al.
Pubblicazione: (2023)
di: Guo, Hongcheng, et al.
Pubblicazione: (2023)
XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form Parser
di: Cheng, Xianfu, et al.
Pubblicazione: (2024)
di: Cheng, Xianfu, et al.
Pubblicazione: (2024)
M2G-Eval: Enhancing and Evaluating Multi-granularity Multilingual Code Generation
di: Xu, Fanglin, et al.
Pubblicazione: (2025)
di: Xu, Fanglin, et al.
Pubblicazione: (2025)
RoNID: New Intent Discovery with Generated-Reliable Labels and Cluster-friendly Representations
di: Zhang, Shun, et al.
Pubblicazione: (2024)
di: Zhang, Shun, et al.
Pubblicazione: (2024)
DinoCompanion: An Attachment-Theory Informed Multimodal Robot for Emotionally Responsive Child-AI Interaction
di: Wang, Boyang, et al.
Pubblicazione: (2025)
di: Wang, Boyang, et al.
Pubblicazione: (2025)
PilotBench: A Benchmark for General Aviation Agents with Safety Constraints
di: Wu, Yalun, et al.
Pubblicazione: (2026)
di: Wu, Yalun, et al.
Pubblicazione: (2026)
Towards Real-world Scenario: Imbalanced New Intent Discovery
di: Zhang, Shun, et al.
Pubblicazione: (2024)
di: Zhang, Shun, et al.
Pubblicazione: (2024)
In-Context Code-Text Learning for Bimodal Software Engineering
di: Tang, Xunzhu, et al.
Pubblicazione: (2024)
di: Tang, Xunzhu, et al.
Pubblicazione: (2024)
SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
WGAN-AFL: Seed Generation Augmented Fuzzer with Wasserstein-GAN
di: Yang, Liqun, et al.
Pubblicazione: (2024)
di: Yang, Liqun, et al.
Pubblicazione: (2024)
Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
MLAD: A Unified Model for Multi-system Log Anomaly Detection
di: Zang, Runqiang, et al.
Pubblicazione: (2024)
di: Zang, Runqiang, et al.
Pubblicazione: (2024)
MVU-Eval: Towards Multi-Video Understanding Evaluation for Multimodal LLMs
di: Peng, Tianhao, et al.
Pubblicazione: (2025)
di: Peng, Tianhao, et al.
Pubblicazione: (2025)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
Improving Non-autoregressive Machine Translation with Error Exposure and Consistency Regularization
di: Chen, Xinran, et al.
Pubblicazione: (2024)
di: Chen, Xinran, et al.
Pubblicazione: (2024)
REALM: RAG-Driven Enhancement of Multimodal Electronic Health Records Analysis via Large Language Models
di: Zhu, Yinghao, et al.
Pubblicazione: (2024)
di: Zhu, Yinghao, et al.
Pubblicazione: (2024)
Scalable Multilingual Multimodal Machine Translation with Speech-Text Fusion
di: Du, Yexing, et al.
Pubblicazione: (2026)
di: Du, Yexing, et al.
Pubblicazione: (2026)
Redefining Machine Translation on Social Network Services with Large Language Models
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
Table-R1: Region-based Reinforcement Learning for Table Understanding
di: Wu, Zhenhe, et al.
Pubblicazione: (2025)
di: Wu, Zhenhe, et al.
Pubblicazione: (2025)
GlotEval: A Test Suite for Massively Multilingual Evaluation of Large Language Models
di: Luo, Hengyu, et al.
Pubblicazione: (2025)
di: Luo, Hengyu, et al.
Pubblicazione: (2025)
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
Overcome Limited Efficiency in All‐Perovskite Tandem Solar Cells Upon Light Management at Top Perovskite‐ Transparent Electrode Interfaces
di: Jinfeng Li, et al.
Pubblicazione: (2025)
di: Jinfeng Li, et al.
Pubblicazione: (2025)
Diffusion on Graph: Augmentation of Graph Structure for Node Classification
di: Wang, Yancheng, et al.
Pubblicazione: (2025)
di: Wang, Yancheng, et al.
Pubblicazione: (2025)
MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQL
di: Wang, Bing, et al.
Pubblicazione: (2023)
di: Wang, Bing, et al.
Pubblicazione: (2023)
Judge Before Answer: Can MLLM Discern the False Premise in Question?
di: Li, Jidong, et al.
Pubblicazione: (2025)
di: Li, Jidong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MdEval: Massively Multilingual Code Debugging
di: Liu, Shukai, et al.
Pubblicazione: (2024) -
UniCoder: Scaling Code Large Language Model via Universal Code
di: Sun, Tao, et al.
Pubblicazione: (2024) -
m3P: Towards Multimodal Multilingual Translation with Multimodal Prompt
di: Yang, Jian, et al.
Pubblicazione: (2024) -
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
di: Liu, Jiaheng, et al.
Pubblicazione: (2024) -
SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
di: Ji, Hangyuan, et al.
Pubblicazione: (2024)