Token Sugar: Making Source Code Sweeter for LLMs through Token-Efficient Shorthand
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Zhensu, Yang, Chengran, Du, Xiaoning, Yang, Zhou, Li, Li, Lo, David |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Bridging Developer Instructions and Code Completion Through Instruction-Aware Fill-in-the-Middle Paradigm
by: Sun, Zhensu, et al.
Published: (2025)
by: Sun, Zhensu, et al.
Published: (2025)
AI Coders Are Among Us: Rethinking Programming Language Grammar Towards Efficient Code Generation
by: Sun, Zhensu, et al.
Published: (2024)
by: Sun, Zhensu, et al.
Published: (2024)
Think Like Human Developers: Harnessing Community Knowledge for Structured Code Reasoning
by: Yang, Chengran, et al.
Published: (2025)
by: Yang, Chengran, et al.
Published: (2025)
FDI: Attack Neural Code Generation Systems through User Feedback Channel
by: Sun, Zhensu, et al.
Published: (2024)
by: Sun, Zhensu, et al.
Published: (2024)
The Hidden Cost of Readability: How Code Formatting Silently Consumes Your LLM Budget
by: Pan, Dangfeng, et al.
Published: (2025)
by: Pan, Dangfeng, et al.
Published: (2025)
Executing as You Generate: Hiding Execution Latency in LLM Code Generation
by: Sun, Zhensu, et al.
Published: (2026)
by: Sun, Zhensu, et al.
Published: (2026)
Don't Complete It! Preventing Unhelpful Code Completion for Productive and Sustainable Neural Code Completion Systems
by: Sun, Zhensu, et al.
Published: (2022)
by: Sun, Zhensu, et al.
Published: (2022)
When Neural Code Completion Models Size up the Situation: Attaining Cheaper and Faster Completion through Dynamic Model Inference
by: Sun, Zhensu, et al.
Published: (2024)
by: Sun, Zhensu, et al.
Published: (2024)
Robustness, Security, Privacy, Explainability, Efficiency, and Usability of Large Language Models for Code
by: Yang, Zhou, et al.
Published: (2024)
by: Yang, Zhou, et al.
Published: (2024)
Towards Agentic Runtime Healing
by: Sun, Zhensu, et al.
Published: (2024)
by: Sun, Zhensu, et al.
Published: (2024)
Autoregressive, Yet Revisable: In Decoding Revision for Secure Code Generation
by: Yang, Chengran, et al.
Published: (2026)
by: Yang, Chengran, et al.
Published: (2026)
Compiling Code LLMs into Lightweight Executables
by: Shi, Jieke, et al.
Published: (2026)
by: Shi, Jieke, et al.
Published: (2026)
ACECode: A Reinforcement Learning Framework for Aligning Code Efficiency and Correctness in Code Language Models
by: Yang, Chengran, et al.
Published: (2024)
by: Yang, Chengran, et al.
Published: (2024)
Curiosity-Driven Testing for Sequential Decision-Making Process
by: He, Junda, et al.
Published: (2025)
by: He, Junda, et al.
Published: (2025)
SparseCoder: Advancing Source Code Analysis with Sparse Attention and Learned Token Pruning
by: Yang, Xueqi, et al.
Published: (2023)
by: Yang, Xueqi, et al.
Published: (2023)
From Code to Courtroom: LLMs as the New Software Judges
by: He, Junda, et al.
Published: (2025)
by: He, Junda, et al.
Published: (2025)
When to Stop? Towards Efficient Code Generation in LLMs with Excess Token Prevention
by: Guo, Lianghong, et al.
Published: (2024)
by: Guo, Lianghong, et al.
Published: (2024)
Hotfixing Large Language Models for Code
by: Yang, Zhou, et al.
Published: (2024)
by: Yang, Zhou, et al.
Published: (2024)
Babbling Suppression: Making LLMs Greener One Token at a Time
by: Solovyeva, Lola, et al.
Published: (2026)
by: Solovyeva, Lola, et al.
Published: (2026)
TestDecision: Sequential Test Suite Generation via Greedy Optimization and Reinforcement Learning
by: Wang, Guoqing, et al.
Published: (2026)
by: Wang, Guoqing, et al.
Published: (2026)
On the Effect of Token Merging on Pre-trained Models for Code
by: Saad, Mootez, et al.
Published: (2025)
by: Saad, Mootez, et al.
Published: (2025)
Not All Tokens Matter: Data-Centric Optimization for Efficient Code Summarization
by: Afrin, Saima, et al.
Published: (2026)
by: Afrin, Saima, et al.
Published: (2026)
Enhancing LLMs in Long Code Translation through Instrumentation and Program State Alignment
by: Xin-Ye, Li, et al.
Published: (2025)
by: Xin-Ye, Li, et al.
Published: (2025)
CC2Vec: Combining Typed Tokens with Contrastive Learning for Effective Code Clone Detection
by: Dou, Shihan, et al.
Published: (2024)
by: Dou, Shihan, et al.
Published: (2024)
Optimizing Token Consumption in LLMs: A Nano Surge Approach for Code Reasoning Efficiency
by: Hu, Junwei, et al.
Published: (2025)
by: Hu, Junwei, et al.
Published: (2025)
Reinforcement Learning-Guided Chain-of-Draft for Token-Efficient Code Generation
by: Tang, Xunzhu, et al.
Published: (2025)
by: Tang, Xunzhu, et al.
Published: (2025)
Can LLMs Deobfuscate Binary Code? A Systematic Analysis of Large Language Models into Pseudocode Deobfuscation
by: Hu, Li, et al.
Published: (2026)
by: Hu, Li, et al.
Published: (2026)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
by: Shi, Yuling, et al.
Published: (2026)
by: Shi, Yuling, et al.
Published: (2026)
Ecosystem of Large Language Models for Code
by: Yang, Zhou, et al.
Published: (2024)
by: Yang, Zhou, et al.
Published: (2024)
PTM4Tag+: Tag Recommendation of Stack Overflow Posts with Pre-trained Models
by: He, Junda, et al.
Published: (2024)
by: He, Junda, et al.
Published: (2024)
APIDocBooster: An Extract-Then-Abstract Framework Leveraging Large Language Models for Augmenting API Documentation
by: Yang, Chengran, et al.
Published: (2023)
by: Yang, Chengran, et al.
Published: (2023)
EfficientUICoder: Efficient MLLM-based UI Code Generation via Input and Output Token Compression
by: Xiao, Jingyu, et al.
Published: (2025)
by: Xiao, Jingyu, et al.
Published: (2025)
Decoding Secret Memorization in Code LLMs Through Token-Level Characterization
by: Nie, Yuqing, et al.
Published: (2024)
by: Nie, Yuqing, et al.
Published: (2024)
Exploring the Capabilities of LLMs for Code Change Related Tasks
by: Fan, Lishui, et al.
Published: (2024)
by: Fan, Lishui, et al.
Published: (2024)
A Comprehensive Evaluation of Parameter-Efficient Fine-Tuning on Code Smell Detection
by: Zhang, Beiqi, et al.
Published: (2024)
by: Zhang, Beiqi, et al.
Published: (2024)
On Evaluating the Efficiency of Source Code Generated by LLMs
by: Niu, Changan, et al.
Published: (2024)
by: Niu, Changan, et al.
Published: (2024)
Efficient and Green Large Language Models for Software Engineering: Literature Review, Vision, and the Road Ahead
by: Shi, Jieke, et al.
Published: (2024)
by: Shi, Jieke, et al.
Published: (2024)
CREME: Robustness Enhancement of Code LLMs via Layer-Aware Model Editing
by: Liu, Shuhan, et al.
Published: (2025)
by: Liu, Shuhan, et al.
Published: (2025)
Enhancing Function Name Prediction using Votes-Based Name Tokenization and Multi-Task Learning
by: Zhang, Xiaoling, et al.
Published: (2024)
by: Zhang, Xiaoling, et al.
Published: (2024)
Enabling Global, Human-Centered Explanations for LLMs:From Tokens to Interpretable Code and Test Generation
by: Khati, Dipin, et al.
Published: (2025)
by: Khati, Dipin, et al.
Published: (2025)
Similar Items
-
Bridging Developer Instructions and Code Completion Through Instruction-Aware Fill-in-the-Middle Paradigm
by: Sun, Zhensu, et al.
Published: (2025) -
AI Coders Are Among Us: Rethinking Programming Language Grammar Towards Efficient Code Generation
by: Sun, Zhensu, et al.
Published: (2024) -
Think Like Human Developers: Harnessing Community Knowledge for Structured Code Reasoning
by: Yang, Chengran, et al.
Published: (2025) -
FDI: Attack Neural Code Generation Systems through User Feedback Channel
by: Sun, Zhensu, et al.
Published: (2024) -
The Hidden Cost of Readability: How Code Formatting Silently Consumes Your LLM Budget
by: Pan, Dangfeng, et al.
Published: (2025)