Scaling Laws for Code: Every Programming Language Matters
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Jian, Guo, Shawn, Jing, Lin, Zhang, Wei, Liu, Aishan, Hao, Chuan, Li, Zhoujun, Zhao, Wayne Xin, Liu, Xianglong, Lv, Weifeng, Dai, Bryan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CodeSimpleQA: Scaling Factuality in Code Large Language Models
par: Yang, Jian, et autres
Publié: (2025)
par: Yang, Jian, et autres
Publié: (2025)
M2G-Eval: Enhancing and Evaluating Multi-granularity Multilingual Code Generation
par: Xu, Fanglin, et autres
Publié: (2025)
par: Xu, Fanglin, et autres
Publié: (2025)
InCoder-32B: Code Foundation Model for Industrial Scenarios
par: Yang, Jian, et autres
Publié: (2026)
par: Yang, Jian, et autres
Publié: (2026)
InCoder-32B-Thinking: Industrial Code World Model for Thinking
par: Yang, Jian, et autres
Publié: (2026)
par: Yang, Jian, et autres
Publié: (2026)
UCoder: Unsupervised Code Generation by Internal Probing of Large Language Models
par: Wu, Jiajun, et autres
Publié: (2025)
par: Wu, Jiajun, et autres
Publié: (2025)
CodeChemist: Functional Knowledge Transfer for Low-Resource Code Generation via Test-Time Scaling
par: Wang, Kaixin, et autres
Publié: (2025)
par: Wang, Kaixin, et autres
Publié: (2025)
SLMQuant:Benchmarking Small Language Model Quantization for Practical Deployment
par: Wang, Jiacheng, et autres
Publié: (2025)
par: Wang, Jiacheng, et autres
Publié: (2025)
UniCoder: Scaling Code Large Language Model via Universal Code
par: Sun, Tao, et autres
Publié: (2024)
par: Sun, Tao, et autres
Publié: (2024)
Fairness Mediator: Neutralize Stereotype Associations to Mitigate Bias in Large Language Models
par: Xiao, Yisong, et autres
Publié: (2025)
par: Xiao, Yisong, et autres
Publié: (2025)
Unveiling the Safety of GPT-4o: An Empirical Study using Jailbreak Attacks
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
Latent Imitator: Generating Natural Individual Discriminatory Instances for Black-Box Fairness Testing
par: Xiao, Yisong, et autres
Publié: (2023)
par: Xiao, Yisong, et autres
Publié: (2023)
From Context to Intent: Reasoning-Guided Function-Level Code Completion
par: Li, Yanzhou, et autres
Publié: (2025)
par: Li, Yanzhou, et autres
Publié: (2025)
Detoxifying Large Language Models via Autoregressive Reward Guided Representation Editing
par: Xiao, Yisong, et autres
Publié: (2025)
par: Xiao, Yisong, et autres
Publié: (2025)
Uncovering Strategic Egoism Behaviors in Large Language Models
par: Zhang, Yaoyuan, et autres
Publié: (2025)
par: Zhang, Yaoyuan, et autres
Publié: (2025)
Reading Between the Pixels: An Inscriptive Jailbreak Attack on Text-to-Image Models
par: Ying, Zonghao, et autres
Publié: (2026)
par: Ying, Zonghao, et autres
Publié: (2026)
Towards Robust Physical-world Backdoor Attacks on Lane Detection
par: Zhang, Xinwei, et autres
Publié: (2024)
par: Zhang, Xinwei, et autres
Publié: (2024)
Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents
par: Wang, Kaixin, et autres
Publié: (2025)
par: Wang, Kaixin, et autres
Publié: (2025)
SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
Code2Bench: Scaling Source and Rigor for Dynamic Benchmark Construction
par: Zhang, Zhe, et autres
Publié: (2025)
par: Zhang, Zhe, et autres
Publié: (2025)
Context as a Tool: Context Management for Long-Horizon SWE-Agents
par: Liu, Shukai, et autres
Publié: (2025)
par: Liu, Shukai, et autres
Publié: (2025)
Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt
par: Ying, Zonghao, et autres
Publié: (2024)
par: Ying, Zonghao, et autres
Publié: (2024)
CogMorph: Cognitive Morphing Attacks for Text-to-Image Models
par: Jing, Zonglei, et autres
Publié: (2025)
par: Jing, Zonglei, et autres
Publié: (2025)
PromptSafe: Gated Prompt Tuning for Safe Text-to-Image Generation
par: Jing, Zonglei, et autres
Publié: (2025)
par: Jing, Zonglei, et autres
Publié: (2025)
Evolving Deception: When Agents Evolve, Deception Wins
par: Ying, Zonghao, et autres
Publié: (2026)
par: Ying, Zonghao, et autres
Publié: (2026)
LLMCBench: Benchmarking Large Language Model Compression for Efficient Deployment
par: Yang, Ge, et autres
Publié: (2024)
par: Yang, Ge, et autres
Publié: (2024)
AgentVisor: Defending LLM Agents Against Prompt Injection via Semantic Virtualization
par: Ying, Zonghao, et autres
Publié: (2026)
par: Ying, Zonghao, et autres
Publié: (2026)
Programming Every Example: Lifting Pre-training Data Quality Like Experts at Scale
par: Zhou, Fan, et autres
Publié: (2024)
par: Zhou, Fan, et autres
Publié: (2024)
Towards Effective Experiential Learning: Dual Guidance for Utilization and Internalization
par: Bai, Fei, et autres
Publié: (2026)
par: Bai, Fei, et autres
Publié: (2026)
Black-Box Adversarial Attack on Vision Language Models for Autonomous Driving
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
GenderBias-\emph{VL}: Benchmarking Gender Bias in Vision Language Models via Counterfactual Probing
par: Xiao, Yisong, et autres
Publié: (2024)
par: Xiao, Yisong, et autres
Publié: (2024)
Investigating Training Data Detection in AI Coders
par: Li, Tianlin, et autres
Publié: (2025)
par: Li, Tianlin, et autres
Publié: (2025)
PTSBench: A Comprehensive Post-Training Sparsity Benchmark Towards Algorithms and Models
par: Wnag, Zining, et autres
Publié: (2024)
par: Wnag, Zining, et autres
Publié: (2024)
Byzantine Robust Cooperative Multi-Agent Reinforcement Learning as a Bayesian Game
par: Li, Simin, et autres
Publié: (2023)
par: Li, Simin, et autres
Publié: (2023)
Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models
par: Ying, Zonghao, et autres
Publié: (2025)
par: Ying, Zonghao, et autres
Publié: (2025)
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
par: Yan, Kaiwen, et autres
Publié: (2025)
par: Yan, Kaiwen, et autres
Publié: (2025)
Every Part Matters: Integrity Verification of Scientific Figures Based on Multimodal Large Language Models
par: Shi, Xiang, et autres
Publié: (2024)
par: Shi, Xiang, et autres
Publié: (2024)
Every Sample Matters: Leveraging Mixture-of-Experts and High-Quality Data for Efficient and Accurate Code LLM
par: Codefuse, et autres
Publié: (2025)
par: Codefuse, et autres
Publié: (2025)
How Emotion Shapes the Behavior of LLMs and Agents: A Mechanistic Study
par: Sun, Moran, et autres
Publié: (2026)
par: Sun, Moran, et autres
Publié: (2026)
Adversarial Generation and Collaborative Evolution of Safety-Critical Scenarios for Autonomous Vehicles
par: Liu, Jiangfan, et autres
Publié: (2025)
par: Liu, Jiangfan, et autres
Publié: (2025)
Parallel Scaling Law for Language Models
par: Chen, Mouxiang, et autres
Publié: (2025)
par: Chen, Mouxiang, et autres
Publié: (2025)
Documents similaires
-
CodeSimpleQA: Scaling Factuality in Code Large Language Models
par: Yang, Jian, et autres
Publié: (2025) -
M2G-Eval: Enhancing and Evaluating Multi-granularity Multilingual Code Generation
par: Xu, Fanglin, et autres
Publié: (2025) -
InCoder-32B: Code Foundation Model for Industrial Scenarios
par: Yang, Jian, et autres
Publié: (2026) -
InCoder-32B-Thinking: Industrial Code World Model for Thinking
par: Yang, Jian, et autres
Publié: (2026) -
UCoder: Unsupervised Code Generation by Internal Probing of Large Language Models
par: Wu, Jiajun, et autres
Publié: (2025)