Curriculum Learning for Small Code Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Naïr, Marwa, Yamani, Kamel, Lhadj, Lynda Said, Baghdadi, Riyadh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automatic Generation of Python Programs Using Context-Free Grammars
di: Yamani, Kamel, et al.
Pubblicazione: (2024)
di: Yamani, Kamel, et al.
Pubblicazione: (2024)
A Deep Learning Model for Predicting Transformation Legality
di: Tiwari, Avani, et al.
Pubblicazione: (2025)
di: Tiwari, Avani, et al.
Pubblicazione: (2025)
Data-efficient Performance Modeling via Pre-training
di: Liu, Chunting, et al.
Pubblicazione: (2025)
di: Liu, Chunting, et al.
Pubblicazione: (2025)
Exploring the Knowledge Mismatch Hypothesis: Hallucination Propensity in Small Models Fine-tuned on Data from Larger Models
di: Wee, Phil, et al.
Pubblicazione: (2024)
di: Wee, Phil, et al.
Pubblicazione: (2024)
LOOPerSet: A Large-Scale Dataset for Data-Driven Polyhedral Compiler Optimization
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)
Combining Neural Architecture Search and Automatic Code Optimization: A Survey
di: Bachiri, Inas, et al.
Pubblicazione: (2024)
di: Bachiri, Inas, et al.
Pubblicazione: (2024)
Sign-Symmetry Learning Rules are Robust Fine-Tuners
di: Berriche, Aymene, et al.
Pubblicazione: (2025)
di: Berriche, Aymene, et al.
Pubblicazione: (2025)
PerfRL: A Small Language Model Framework for Efficient Code Optimization
di: Duan, Shukai, et al.
Pubblicazione: (2023)
di: Duan, Shukai, et al.
Pubblicazione: (2023)
A Data-driven Analysis of Code Optimizations
di: Hakimi, Yacine, et al.
Pubblicazione: (2025)
di: Hakimi, Yacine, et al.
Pubblicazione: (2025)
Neural Architecture Search with Mixed Bio-inspired Learning Rules
di: Hamzaoui, Imane, et al.
Pubblicazione: (2025)
di: Hamzaoui, Imane, et al.
Pubblicazione: (2025)
Code Simulation Challenges for Large Language Models
di: La Malfa, Emanuele, et al.
Pubblicazione: (2024)
di: La Malfa, Emanuele, et al.
Pubblicazione: (2024)
From Reasoning to Code: GRPO Optimization for Underrepresented Languages
di: Pennino, Federico, et al.
Pubblicazione: (2025)
di: Pennino, Federico, et al.
Pubblicazione: (2025)
Agentic Auto-Scheduling: An Experimental Study of LLM-Guided Loop Optimization
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)
Large Language Models for Code Summarization
di: Szalontai, Balázs, et al.
Pubblicazione: (2024)
di: Szalontai, Balázs, et al.
Pubblicazione: (2024)
MonoCoder: Domain-Specific Code Language Model for HPC Codes and Tasks
di: Kadosh, Tal, et al.
Pubblicazione: (2023)
di: Kadosh, Tal, et al.
Pubblicazione: (2023)
LILO: Learning Interpretable Libraries by Compressing and Documenting Code
di: Grand, Gabriel, et al.
Pubblicazione: (2023)
di: Grand, Gabriel, et al.
Pubblicazione: (2023)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
di: Liu, Max, et al.
Pubblicazione: (2024)
di: Liu, Max, et al.
Pubblicazione: (2024)
Bridging the Knowledge Void: Inference-time Acquisition of Unfamiliar Programming Languages for Coding Tasks
di: Shen, Chen, et al.
Pubblicazione: (2026)
di: Shen, Chen, et al.
Pubblicazione: (2026)
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
di: Ojo, Jessica, et al.
Pubblicazione: (2025)
di: Ojo, Jessica, et al.
Pubblicazione: (2025)
A Multi-Expert Large Language Model Architecture for Verilog Code Generation
di: Nadimi, Bardia, et al.
Pubblicazione: (2024)
di: Nadimi, Bardia, et al.
Pubblicazione: (2024)
Can It Edit? Evaluating the Ability of Large Language Models to Follow Code Editing Instructions
di: Cassano, Federico, et al.
Pubblicazione: (2023)
di: Cassano, Federico, et al.
Pubblicazione: (2023)
Program Semantic Inequivalence Game with Large Language Models
di: Miceli-Barone, Antonio Valerio, et al.
Pubblicazione: (2025)
di: Miceli-Barone, Antonio Valerio, et al.
Pubblicazione: (2025)
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
di: Cao, Jialun, et al.
Pubblicazione: (2024)
di: Cao, Jialun, et al.
Pubblicazione: (2024)
From Large to Small: Transferring CUDA Optimization Expertise via Reasoning Graph
di: Gong, Junfeng, et al.
Pubblicazione: (2025)
di: Gong, Junfeng, et al.
Pubblicazione: (2025)
Chain of Execution Supervision Promotes General Reasoning in Large Language Models
di: Chen, Nuo, et al.
Pubblicazione: (2025)
di: Chen, Nuo, et al.
Pubblicazione: (2025)
ProofOptimizer: Training Language Models to Simplify Proofs without Human Demonstrations
di: Gu, Alex, et al.
Pubblicazione: (2025)
di: Gu, Alex, et al.
Pubblicazione: (2025)
PassNet: Scaling Large Language Models for Graph Compiler Pass Generation
di: Liu, Yiqun, et al.
Pubblicazione: (2026)
di: Liu, Yiqun, et al.
Pubblicazione: (2026)
Can LLMs Compress (and Decompress)? Evaluating Code Understanding and Execution via Invertibility
di: Maveli, Nickil, et al.
Pubblicazione: (2026)
di: Maveli, Nickil, et al.
Pubblicazione: (2026)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
di: Dong, Honghua, et al.
Pubblicazione: (2024)
di: Dong, Honghua, et al.
Pubblicazione: (2024)
Code-Switching Curriculum Learning for Multilingual Transfer in LLMs
di: Yoo, Haneul, et al.
Pubblicazione: (2024)
di: Yoo, Haneul, et al.
Pubblicazione: (2024)
Dreaming in Code for Curriculum Learning in Open-Ended Worlds
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2026)
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2026)
Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates
di: Hooda, Ashish, et al.
Pubblicazione: (2024)
di: Hooda, Ashish, et al.
Pubblicazione: (2024)
Large Language Models Synergize with Automated Machine Learning
di: Xu, Jinglue, et al.
Pubblicazione: (2024)
di: Xu, Jinglue, et al.
Pubblicazione: (2024)
Emergent Representations of Program Semantics in Language Models Trained on Programs
di: Jin, Charles, et al.
Pubblicazione: (2023)
di: Jin, Charles, et al.
Pubblicazione: (2023)
A Fast, Reliable, and Secure Programming Language for LLM Agents with Code Actions
di: Mell, Stephen, et al.
Pubblicazione: (2025)
di: Mell, Stephen, et al.
Pubblicazione: (2025)
CodeARC: Benchmarking Reasoning Capabilities of LLM Agents for Inductive Program Synthesis
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Improving LLM Code Reasoning via Semantic Equivalence Self-Play with Formal Verification
di: Barone, Antonio Valerio Miceli, et al.
Pubblicazione: (2026)
di: Barone, Antonio Valerio Miceli, et al.
Pubblicazione: (2026)
Evaluating Quantized Large Language Models for Code Generation on Low-Resource Language Benchmarks
di: Nyamsuren, Enkhbold
Pubblicazione: (2024)
di: Nyamsuren, Enkhbold
Pubblicazione: (2024)
Linguacodus: A Synergistic Framework for Transformative Code Generation in Machine Learning Pipelines
di: Trofimova, Ekaterina, et al.
Pubblicazione: (2024)
di: Trofimova, Ekaterina, et al.
Pubblicazione: (2024)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Automatic Generation of Python Programs Using Context-Free Grammars
di: Yamani, Kamel, et al.
Pubblicazione: (2024) -
A Deep Learning Model for Predicting Transformation Legality
di: Tiwari, Avani, et al.
Pubblicazione: (2025) -
Data-efficient Performance Modeling via Pre-training
di: Liu, Chunting, et al.
Pubblicazione: (2025) -
Exploring the Knowledge Mismatch Hypothesis: Hallucination Propensity in Small Models Fine-tuned on Data from Larger Models
di: Wee, Phil, et al.
Pubblicazione: (2024) -
LOOPerSet: A Large-Scale Dataset for Data-Driven Polyhedral Compiler Optimization
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)