Code Needs Comments: Enhancing Code LLMs with Comment Augmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Demin, Guo, Honglin, Zhou, Yunhua, Xing, Shuhao, Wang, Yudong, Song, Zifan, Zhang, Wenwei, Guo, Qipeng, Yan, Hang, Qiu, Xipeng, Lin, Dahua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AlchemistCoder: Harmonizing and Eliciting Code Capability by Hindsight Tuning on Multi-source Data
di: Song, Zifan, et al.
Pubblicazione: (2024)
di: Song, Zifan, et al.
Pubblicazione: (2024)
Data-free Weight Compress and Denoise for Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2024)
di: Peng, Runyu, et al.
Pubblicazione: (2024)
Case2Code: Scalable Synthetic Data for Code Generation
di: Shao, Yunfan, et al.
Pubblicazione: (2024)
di: Shao, Yunfan, et al.
Pubblicazione: (2024)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2026)
di: Peng, Runyu, et al.
Pubblicazione: (2026)
UnitCoder: Scalable Iterative Code Synthesis with Unit Test Guidance
di: Ma, Yichuan, et al.
Pubblicazione: (2025)
di: Ma, Yichuan, et al.
Pubblicazione: (2025)
DuoDecoding: Hardware-aware Heterogeneous Speculative Decoding with Dynamic Multi-Sequence Drafting
di: Lv, Kai, et al.
Pubblicazione: (2025)
di: Lv, Kai, et al.
Pubblicazione: (2025)
How to Set the Learning Rate for Large-Scale Pre-training?
di: Zhou, Yunhua, et al.
Pubblicazione: (2026)
di: Zhou, Yunhua, et al.
Pubblicazione: (2026)
Mousse: Rectifying the Geometry of Muon with Curvature-Aware Preconditioning
di: Zhang, Yechen, et al.
Pubblicazione: (2026)
di: Zhang, Yechen, et al.
Pubblicazione: (2026)
LongWanjuan: Towards Systematic Measurement for Long Text Quality
di: Lv, Kai, et al.
Pubblicazione: (2024)
di: Lv, Kai, et al.
Pubblicazione: (2024)
Identifying Semantic Induction Heads to Understand In-Context Learning
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
Turn Waste into Worth: Rectifying Top-$k$ Router of MoE
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2024)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2024)
OriGen:Enhancing RTL Code Generation with Code-to-Code Augmentation and Self-Reflection
di: Cui, Fan, et al.
Pubblicazione: (2024)
di: Cui, Fan, et al.
Pubblicazione: (2024)
How Attention Sinks Emerge in Large Language Models: An Interpretability Perspective
di: Peng, Runyu, et al.
Pubblicazione: (2026)
di: Peng, Runyu, et al.
Pubblicazione: (2026)
CritiQ: Mining Data Quality Criteria from Human Preferences
di: Guo, Honglin, et al.
Pubblicazione: (2025)
di: Guo, Honglin, et al.
Pubblicazione: (2025)
AdaLomo: Low-memory Optimization with Adaptive Learning Rate
di: Lv, Kai, et al.
Pubblicazione: (2023)
di: Lv, Kai, et al.
Pubblicazione: (2023)
Pre-Trained Policy Discriminators are General Reward Models
di: Dou, Shihan, et al.
Pubblicazione: (2025)
di: Dou, Shihan, et al.
Pubblicazione: (2025)
F-Eval: Assessing Fundamental Abilities with Refined Evaluation Methods
di: Sun, Yu, et al.
Pubblicazione: (2024)
di: Sun, Yu, et al.
Pubblicazione: (2024)
Unearthing Large Scale Domain-Specific Knowledge from Public Corpora
di: Fei, Zhaoye, et al.
Pubblicazione: (2024)
di: Fei, Zhaoye, et al.
Pubblicazione: (2024)
LongLLaDA: Unlocking Long Context Capabilities in Diffusion LLMs
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
Sparse-dLLM: Accelerating Diffusion LLMs with Dynamic Cache Eviction
di: Song, Yuerong, et al.
Pubblicazione: (2025)
di: Song, Yuerong, et al.
Pubblicazione: (2025)
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
di: Ge, Qiming, et al.
Pubblicazione: (2025)
di: Ge, Qiming, et al.
Pubblicazione: (2025)
Comments as Natural Logic Pivots: Improve Code Generation via Comment Perspective
di: Chen, Yijie, et al.
Pubblicazione: (2024)
di: Chen, Yijie, et al.
Pubblicazione: (2024)
CIBench: Evaluating Your LLMs with a Code Interpreter Plugin
di: Zhang, Chuyu, et al.
Pubblicazione: (2024)
di: Zhang, Chuyu, et al.
Pubblicazione: (2024)
Scaling Laws of RoPE-based Extrapolation
di: Liu, Xiaoran, et al.
Pubblicazione: (2023)
di: Liu, Xiaoran, et al.
Pubblicazione: (2023)
Beyond Real: Imaginary Extension of Rotary Position Embeddings for Long-Context LLMs
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
Balanced Data Sampling for Language Model Training with Clustering
di: Shao, Yunfan, et al.
Pubblicazione: (2024)
di: Shao, Yunfan, et al.
Pubblicazione: (2024)
CodeGraph: Enhancing Graph Reasoning of LLMs with Code
di: Cai, Qiaolong, et al.
Pubblicazione: (2024)
di: Cai, Qiaolong, et al.
Pubblicazione: (2024)
Reasoning by Commented Code for Table Question Answering
di: Pyo, Seho, et al.
Pubblicazione: (2026)
di: Pyo, Seho, et al.
Pubblicazione: (2026)
AI-Mediated Code Comment Improvement
di: Dhakal, Maria, et al.
Pubblicazione: (2025)
di: Dhakal, Maria, et al.
Pubblicazione: (2025)
ReAttention: Training-Free Infinite Context with Finite Attention Scope
di: Liu, Xiaoran, et al.
Pubblicazione: (2024)
di: Liu, Xiaoran, et al.
Pubblicazione: (2024)
Compliance-to-Code: Enhancing Financial Compliance Checking via Code Generation
di: Li, Siyuan, et al.
Pubblicazione: (2025)
di: Li, Siyuan, et al.
Pubblicazione: (2025)
Exploratory Data Analysis on Code-mixed Misogynistic Comments
di: Yadav, Sargam, et al.
Pubblicazione: (2024)
di: Yadav, Sargam, et al.
Pubblicazione: (2024)
AI-Assisted Fixes to Code Review Comments at Scale
di: Maddila, Chandra, et al.
Pubblicazione: (2025)
di: Maddila, Chandra, et al.
Pubblicazione: (2025)
Mask-DPO: Generalizable Fine-grained Factuality Alignment of LLMs
di: Gu, Yuzhe, et al.
Pubblicazione: (2025)
di: Gu, Yuzhe, et al.
Pubblicazione: (2025)
Enhancing Code Generation via Bidirectional Comment-Level Mutual Grounding
di: Di, Yifeng, et al.
Pubblicazione: (2025)
di: Di, Yifeng, et al.
Pubblicazione: (2025)
Full Parameter Fine-tuning for Large Language Models with Limited Resources
di: Lv, Kai, et al.
Pubblicazione: (2023)
di: Lv, Kai, et al.
Pubblicazione: (2023)
Benchmarking Hallucination in Large Language Models based on Unanswerable Math Word Problem
di: Sun, Yuhong, et al.
Pubblicazione: (2024)
di: Sun, Yuhong, et al.
Pubblicazione: (2024)
The Open-World Lottery Ticket Hypothesis for OOD Intent Classification
di: Zhou, Yunhua, et al.
Pubblicazione: (2022)
di: Zhou, Yunhua, et al.
Pubblicazione: (2022)
Implicit Reward as the Bridge: A Unified View of SFT and DPO Connections
di: Wang, Bo, et al.
Pubblicazione: (2025)
di: Wang, Bo, et al.
Pubblicazione: (2025)
GAOKAO-Eval: Does high scores truly reflect strong capabilities in LLMs?
di: Lei, Zhikai, et al.
Pubblicazione: (2024)
di: Lei, Zhikai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AlchemistCoder: Harmonizing and Eliciting Code Capability by Hindsight Tuning on Multi-source Data
di: Song, Zifan, et al.
Pubblicazione: (2024) -
Data-free Weight Compress and Denoise for Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2024) -
Case2Code: Scalable Synthetic Data for Code Generation
di: Shao, Yunfan, et al.
Pubblicazione: (2024) -
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2026) -
UnitCoder: Scalable Iterative Code Synthesis with Unit Test Guidance
di: Ma, Yichuan, et al.
Pubblicazione: (2025)