CodeUltraFeedback: An LLM-as-a-Judge Dataset for Aligning Large Language Models to Coding Preferences
Fuente:
arXiv
Salvato in:
| Autori principali: | Weyssow, Martin, Kamanda, Aton, Zhou, Xin, Sahraoui, Houari |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring Parameter-Efficient Fine-Tuning Techniques for Code Generation with Large Language Models
di: Weyssow, Martin, et al.
Pubblicazione: (2023)
di: Weyssow, Martin, et al.
Pubblicazione: (2023)
On the Usage of Continual Learning for Out-of-Distribution Generalization in Pre-trained Language Models of Code
di: Weyssow, Martin, et al.
Pubblicazione: (2023)
di: Weyssow, Martin, et al.
Pubblicazione: (2023)
Harnessing Large Language Models for Curated Code Reviews
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025)
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025)
Leveraging Reward Models for Guiding Code Review Comment Generation
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025)
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025)
CodeJudge: Evaluating Code Generation with Large Language Models
di: Tong, Weixi, et al.
Pubblicazione: (2024)
di: Tong, Weixi, et al.
Pubblicazione: (2024)
Combining Large Language Models with Static Analyzers for Code Review Generation
di: Jaoua, Imen, et al.
Pubblicazione: (2025)
di: Jaoua, Imen, et al.
Pubblicazione: (2025)
Vibe Checker: Aligning Code Evaluation with Human Preference
di: Zhong, Ming, et al.
Pubblicazione: (2025)
di: Zhong, Ming, et al.
Pubblicazione: (2025)
Rewriting the Code: A Simple Method for Large Language Model Augmented Code Search
di: Li, Haochen, et al.
Pubblicazione: (2024)
di: Li, Haochen, et al.
Pubblicazione: (2024)
GLLM: Self-Corrective G-Code Generation using Large Language Models with User Feedback
di: Abdelaal, Mohamed, et al.
Pubblicazione: (2025)
di: Abdelaal, Mohamed, et al.
Pubblicazione: (2025)
SelfCodeAlign: Self-Alignment for Code Generation
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
di: Wei, Yuxiang, et al.
Pubblicazione: (2024)
Evaluating the Generalization Capabilities of Large Language Models on Code Reasoning
di: Yang, Rem, et al.
Pubblicazione: (2025)
di: Yang, Rem, et al.
Pubblicazione: (2025)
Improving the Learning of Code Review Successive Tasks with Cross-Task Knowledge Distillation
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2024)
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2024)
LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
di: Jain, Naman, et al.
Pubblicazione: (2024)
di: Jain, Naman, et al.
Pubblicazione: (2024)
Large Language Models for Multilingual Code Intelligence: A Survey
di: Jiang, Chao, et al.
Pubblicazione: (2026)
di: Jiang, Chao, et al.
Pubblicazione: (2026)
Learning Code Preference via Synthetic Evolution
di: Liu, Jiawei, et al.
Pubblicazione: (2024)
di: Liu, Jiawei, et al.
Pubblicazione: (2024)
LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs
di: Xia, Yunhui, et al.
Pubblicazione: (2025)
di: Xia, Yunhui, et al.
Pubblicazione: (2025)
Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models
di: Riddell, Martin, et al.
Pubblicazione: (2024)
di: Riddell, Martin, et al.
Pubblicazione: (2024)
Large Language Models for Code: Security Hardening and Adversarial Testing
di: He, Jingxuan, et al.
Pubblicazione: (2023)
di: He, Jingxuan, et al.
Pubblicazione: (2023)
SIMCOPILOT: Evaluating Large Language Models for Copilot-Style Code Generation
di: Jiang, Mingchao, et al.
Pubblicazione: (2025)
di: Jiang, Mingchao, et al.
Pubblicazione: (2025)
Large Language Models for Code Summarization
di: Szalontai, Balázs, et al.
Pubblicazione: (2024)
di: Szalontai, Balázs, et al.
Pubblicazione: (2024)
CodeJudge-Eval: Can Large Language Models be Good Judges in Code Understanding?
di: Zhao, Yuwei, et al.
Pubblicazione: (2024)
di: Zhao, Yuwei, et al.
Pubblicazione: (2024)
NExT: Teaching Large Language Models to Reason about Code Execution
di: Ni, Ansong, et al.
Pubblicazione: (2024)
di: Ni, Ansong, et al.
Pubblicazione: (2024)
Improving Code Generation by Training with Natural Language Feedback
di: Chen, Angelica, et al.
Pubblicazione: (2023)
di: Chen, Angelica, et al.
Pubblicazione: (2023)
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
di: Guo, Jiawei, et al.
Pubblicazione: (2024)
di: Guo, Jiawei, et al.
Pubblicazione: (2024)
Prompting and Fine-tuning Large Language Models for Automated Code Review Comment Generation
di: Haider, Md. Asif, et al.
Pubblicazione: (2024)
di: Haider, Md. Asif, et al.
Pubblicazione: (2024)
Suggesting Code Edits in Interactive Machine Learning Notebooks Using Large Language Models
di: Jin, Bihui, et al.
Pubblicazione: (2025)
di: Jin, Bihui, et al.
Pubblicazione: (2025)
Evaluating Language Models for Efficient Code Generation
di: Liu, Jiawei, et al.
Pubblicazione: (2024)
di: Liu, Jiawei, et al.
Pubblicazione: (2024)
MLCPD: A Unified Multi-Language Code Parsing Dataset with Universal AST Schema
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
GiFT: Gibbs Fine-Tuning for Code Generation
di: Li, Haochen, et al.
Pubblicazione: (2025)
di: Li, Haochen, et al.
Pubblicazione: (2025)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
di: Wang, Xinchen, et al.
Pubblicazione: (2025)
di: Wang, Xinchen, et al.
Pubblicazione: (2025)
DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
di: Guo, Daya, et al.
Pubblicazione: (2024)
di: Guo, Daya, et al.
Pubblicazione: (2024)
Uncertainty Awareness of Large Language Models Under Code Distribution Shifts: A Benchmark Study
di: Li, Yufei, et al.
Pubblicazione: (2024)
di: Li, Yufei, et al.
Pubblicazione: (2024)
Towards Understanding What Code Language Models Learned
di: Ahmed, Toufique, et al.
Pubblicazione: (2023)
di: Ahmed, Toufique, et al.
Pubblicazione: (2023)
Language Models for Code Completion: A Practical Evaluation
di: Izadi, Maliheh, et al.
Pubblicazione: (2024)
di: Izadi, Maliheh, et al.
Pubblicazione: (2024)
code_transformed: The Influence of Large Language Models on Code
di: Xu, Yuliang, et al.
Pubblicazione: (2025)
di: Xu, Yuliang, et al.
Pubblicazione: (2025)
CODEMENV: Benchmarking Large Language Models on Code Migration
di: Cheng, Keyuan, et al.
Pubblicazione: (2025)
di: Cheng, Keyuan, et al.
Pubblicazione: (2025)
DeepCode AI Fix: Fixing Security Vulnerabilities with Large Language Models
di: Berabi, Berkay, et al.
Pubblicazione: (2024)
di: Berabi, Berkay, et al.
Pubblicazione: (2024)
Wisdom and Delusion of LLM Ensembles for Code Generation and Repair
di: Vallecillos-Ruiz, Fernando, et al.
Pubblicazione: (2025)
di: Vallecillos-Ruiz, Fernando, et al.
Pubblicazione: (2025)
EffiPair: Improving the Efficiency of LLM-generated Code with Relative Contrastive Feedback
di: Hajizadeh, Samira, et al.
Pubblicazione: (2026)
di: Hajizadeh, Samira, et al.
Pubblicazione: (2026)
TAROT: Test-driven and Capability-adaptive Curriculum Reinforcement Fine-tuning for Code Generation with Large Language Models
di: Park, Chansung, et al.
Pubblicazione: (2026)
di: Park, Chansung, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Exploring Parameter-Efficient Fine-Tuning Techniques for Code Generation with Large Language Models
di: Weyssow, Martin, et al.
Pubblicazione: (2023) -
On the Usage of Continual Learning for Out-of-Distribution Generalization in Pre-trained Language Models of Code
di: Weyssow, Martin, et al.
Pubblicazione: (2023) -
Harnessing Large Language Models for Curated Code Reviews
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025) -
Leveraging Reward Models for Guiding Code Review Comment Generation
di: Sghaier, Oussama Ben, et al.
Pubblicazione: (2025) -
CodeJudge: Evaluating Code Generation with Large Language Models
di: Tong, Weixi, et al.
Pubblicazione: (2024)