TransformCode: A Contrastive Learning Framework for Code Embedding via Subtree Transformation
Fuente:
arXiv
Saved in:
| Main Authors: | Xian, Zixiang, Huang, Rubing, Towey, Dave, Fang, Chunrong, Chen, Zhenyu |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
An Effective Approach to Embedding Source Code by Combining Large Language and Sentence Embedding Models
by: Xian, Zixiang, et al.
Published: (2024)
by: Xian, Zixiang, et al.
Published: (2024)
CodeTF: One-stop Transformer Library for State-of-the-art Code LLMs
by: Bui, Nghi D. Q., et al.
Published: (2023)
by: Bui, Nghi D. Q., et al.
Published: (2023)
Quality Evaluation of COBOL to Java Code Transformation
by: Froimovich, Shmulik, et al.
Published: (2025)
by: Froimovich, Shmulik, et al.
Published: (2025)
CSA-Trans: Code Structure Aware Transformer for AST
by: Oh, Saeyoon, et al.
Published: (2024)
by: Oh, Saeyoon, et al.
Published: (2024)
Auto-SPT: Automating Semantic Preserving Transformations for Code
by: Hooda, Ashish, et al.
Published: (2025)
by: Hooda, Ashish, et al.
Published: (2025)
Requirements-Based Test Generation: A Comprehensive Survey
by: Yang, Zhenzhen, et al.
Published: (2025)
by: Yang, Zhenzhen, et al.
Published: (2025)
CodeVision: Detecting LLM-Generated Code Using 2D Token Probability Maps and Vision Models
by: Xu, Zhenyu, et al.
Published: (2025)
by: Xu, Zhenyu, et al.
Published: (2025)
GitHub Copilot: the perfect Code compLeeter?
by: Siroš, Ilja, et al.
Published: (2024)
by: Siroš, Ilja, et al.
Published: (2024)
Large Language Models for Automated Web-Form-Test Generation: An Empirical Study
by: Li, Tao, et al.
Published: (2024)
by: Li, Tao, et al.
Published: (2024)
Integrating Artificial Intelligence with Human Expertise: An In-depth Analysis of ChatGPT's Capabilities in Generating Metamorphic Relations
by: Zhang, Yifan, et al.
Published: (2025)
by: Zhang, Yifan, et al.
Published: (2025)
Test Script Intention Generation for Mobile Application via GUI Image and Code Understanding
by: Yu, Shengcheng, et al.
Published: (2021)
by: Yu, Shengcheng, et al.
Published: (2021)
Towards Better Code Understanding in Decoder-Only Models with Contrastive Learning
by: Lin, Jiayi, et al.
Published: (2024)
by: Lin, Jiayi, et al.
Published: (2024)
CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval
by: Liu, Ye, et al.
Published: (2024)
by: Liu, Ye, et al.
Published: (2024)
ESALE: Enhancing Code-Summary Alignment Learning for Source Code Summarization
by: Fang, Chunrong, et al.
Published: (2024)
by: Fang, Chunrong, et al.
Published: (2024)
CriterAlign: Criterion-Centric Rationale Alignment for Code Preference Judging
by: Li, Zhenyu, et al.
Published: (2026)
by: Li, Zhenyu, et al.
Published: (2026)
GenCode: A Generic Data Augmentation Framework for Boosting Deep Learning-Based Code Understanding
by: Dong, Zeming, et al.
Published: (2024)
by: Dong, Zeming, et al.
Published: (2024)
Nova: Generative Language Models for Assembly Code with Hierarchical Attention and Contrastive Learning
by: Jiang, Nan, et al.
Published: (2023)
by: Jiang, Nan, et al.
Published: (2023)
XSearch: Explainable Code Search via Concept-to-Code Alignment
by: Liu, Yiming, et al.
Published: (2026)
by: Liu, Yiming, et al.
Published: (2026)
Automatic Identification of Parallelizable Loops Using Transformer-Based Source Code Representations
by: Correia, Izavan dos S., et al.
Published: (2026)
by: Correia, Izavan dos S., et al.
Published: (2026)
LLM-Based Static Verification of Code Against Natural-Language Requirements: An Industrial Experience Report
by: Zhou, Zhi Quan, et al.
Published: (2026)
by: Zhou, Zhi Quan, et al.
Published: (2026)
SWE-Skills-Bench: Do Agent Skills Actually Help in Real-World Software Engineering?
by: Han, Tingxu, et al.
Published: (2026)
by: Han, Tingxu, et al.
Published: (2026)
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts
by: Jiang, Yuan, et al.
Published: (2025)
by: Jiang, Yuan, et al.
Published: (2025)
When the Code Autopilot Breaks: Why LLMs Falter in Embedded Machine Learning
by: Morabito, Roberto, et al.
Published: (2025)
by: Morabito, Roberto, et al.
Published: (2025)
Toward Cost-effective Adaptive Random Testing: An Approximate Nearest Neighbor Approach
by: Huang, Rubing, et al.
Published: (2023)
by: Huang, Rubing, et al.
Published: (2023)
Large Language Models for Mobile GUI Text Input Generation: An Empirical Study
by: Cui, Chenhui, et al.
Published: (2024)
by: Cui, Chenhui, et al.
Published: (2024)
Unraveling Code Clone Dynamics in Deep Learning Frameworks
by: Assi, Maram, et al.
Published: (2024)
by: Assi, Maram, et al.
Published: (2024)
NARRepair: Non-Autoregressive Code Generation Model for Automatic Program Repair
by: Yang, Zhenyu, et al.
Published: (2024)
by: Yang, Zhenyu, et al.
Published: (2024)
FastCode: Fast and Cost-Efficient Code Understanding and Reasoning
by: Li, Zhonghang, et al.
Published: (2026)
by: Li, Zhonghang, et al.
Published: (2026)
CodeCoT: Tackling Code Syntax Errors in CoT Reasoning for Code Generation
by: Huang, Dong, et al.
Published: (2023)
by: Huang, Dong, et al.
Published: (2023)
DeepCode: Open Agentic Coding
by: Li, Zongwei, et al.
Published: (2025)
by: Li, Zongwei, et al.
Published: (2025)
An Evaluation of Context Length Extrapolation in Long Code via Positional Embeddings and Efficient Attention
by: Ghosh, Madhusudan, et al.
Published: (2026)
by: Ghosh, Madhusudan, et al.
Published: (2026)
Uncovering LLM-Generated Code: A Zero-Shot Synthetic Code Detector via Code Rewriting
by: Ye, Tong, et al.
Published: (2024)
by: Ye, Tong, et al.
Published: (2024)
How Do Semantically Equivalent Code Transformations Impact Membership Inference on LLMs for Code?
by: Yang, Hua, et al.
Published: (2025)
by: Yang, Hua, et al.
Published: (2025)
ACE: Self-Evolving LLM Coding Framework via Adversarial Unit Test Generation and Preference Optimization
by: Huang, Yixu, et al.
Published: (2026)
by: Huang, Yixu, et al.
Published: (2026)
Process-Supervised Reinforcement Learning for Code Generation
by: Ye, Yufan, et al.
Published: (2025)
by: Ye, Yufan, et al.
Published: (2025)
CodeSift: An LLM-Based Reference-Less Framework for Automatic Code Validation
by: Aggarwal, Pooja, et al.
Published: (2024)
by: Aggarwal, Pooja, et al.
Published: (2024)
CAM: A Causality-based Analysis Framework for Multi-Agent Code Generation Systems
by: Lyu, Zongyi, et al.
Published: (2026)
by: Lyu, Zongyi, et al.
Published: (2026)
Do Code LLMs Understand Design Patterns?
by: Pan, Zhenyu, et al.
Published: (2025)
by: Pan, Zhenyu, et al.
Published: (2025)
A Survey on Web Application Testing: A Decade of Evolution
by: Li, Tao, et al.
Published: (2024)
by: Li, Tao, et al.
Published: (2024)
Improving LLM Code Generation via Requirement-Aware Curriculum Reinforcement Learning
by: Yin, Shouyu, et al.
Published: (2026)
by: Yin, Shouyu, et al.
Published: (2026)
Similar Items
-
An Effective Approach to Embedding Source Code by Combining Large Language and Sentence Embedding Models
by: Xian, Zixiang, et al.
Published: (2024) -
CodeTF: One-stop Transformer Library for State-of-the-art Code LLMs
by: Bui, Nghi D. Q., et al.
Published: (2023) -
Quality Evaluation of COBOL to Java Code Transformation
by: Froimovich, Shmulik, et al.
Published: (2025) -
CSA-Trans: Code Structure Aware Transformer for AST
by: Oh, Saeyoon, et al.
Published: (2024) -
Auto-SPT: Automating Semantic Preserving Transformations for Code
by: Hooda, Ashish, et al.
Published: (2025)