Specification-Driven Code Translation Powered by Large Language Models: How Far Are We?
Fuente:
arXiv
Saved in:
| Main Authors: | Saha, Soumit Kanti, Rabbi, Fazle, Wang, Song, Yang, Jinqiu |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Beyond Translation Accuracy: Addressing False Failures in LLM-Based Code Translation
by: Rabbi, Fazle, et al.
Published: (2026)
by: Rabbi, Fazle, et al.
Published: (2026)
BabelCoder: Agentic Code Translation with Specification Alignment
by: Rabbi, Fazle, et al.
Published: (2025)
by: Rabbi, Fazle, et al.
Published: (2025)
A Multi-Language Perspective on the Robustness of LLM Code Generation
by: Rabbi, Fazle, et al.
Published: (2025)
by: Rabbi, Fazle, et al.
Published: (2025)
HEJ-Robust: A Robustness Benchmark for LLM-Based Automated Program Repair
by: Rabbi, Fazle, et al.
Published: (2026)
by: Rabbi, Fazle, et al.
Published: (2026)
Bias Unveiled: Investigating Social Bias in LLM-Generated Code
by: Ling, Lin, et al.
Published: (2024)
by: Ling, Lin, et al.
Published: (2024)
Secure-Instruct: An Automated Pipeline for Synthesizing Instruction-Tuning Datasets Using LLMs for Secure Code Generation
by: Li, Junjie, et al.
Published: (2025)
by: Li, Junjie, et al.
Published: (2025)
Demystifying Errors in LLM Reasoning Traces: An Empirical Study of Code Execution Simulation
by: Abdollahi, Mohammad, et al.
Published: (2025)
by: Abdollahi, Mohammad, et al.
Published: (2025)
Social Bias in LLM-Generated Code: Benchmark and Mitigation
by: Rabbi, Fazle, et al.
Published: (2026)
by: Rabbi, Fazle, et al.
Published: (2026)
An Exploratory Study on Fine-Tuning Large Language Models for Secure Code Generation
by: Li, Junjie, et al.
Published: (2024)
by: Li, Junjie, et al.
Published: (2024)
Unraveling the Potential of Large Language Models in Code Translation: How Far Are We?
by: Tao, Qingxiao, et al.
Published: (2024)
by: Tao, Qingxiao, et al.
Published: (2024)
Automatically Detecting Checked-In Secrets in Android Apps: How Far Are We?
by: Li, Kevin, et al.
Published: (2024)
by: Li, Kevin, et al.
Published: (2024)
CFCEval: Evaluating Security Aspects in Code Generated by Large Language Models
by: Cheng, Cheng, et al.
Published: (2025)
by: Cheng, Cheng, et al.
Published: (2025)
Large Language Models for Equivalent Mutant Detection: How Far Are We?
by: Tian, Zhao, et al.
Published: (2024)
by: Tian, Zhao, et al.
Published: (2024)
Vulnerability Detection with Code Language Models: How Far Are We?
by: Ding, Yangruibo, et al.
Published: (2024)
by: Ding, Yangruibo, et al.
Published: (2024)
A Task-Level Evaluation of AI Agents in Open-Source Projects
by: Rahman, Shojibur, et al.
Published: (2026)
by: Rahman, Shojibur, et al.
Published: (2026)
Chasing the Clock: How Fast Are Vulnerabilities Fixed in the Maven Ecosystem?
by: Rabbi, Md Fazle, et al.
Published: (2025)
by: Rabbi, Md Fazle, et al.
Published: (2025)
How Far Have We Gone in Binary Code Understanding Using Large Language Models
by: Shang, Xiuwei, et al.
Published: (2024)
by: Shang, Xiuwei, et al.
Published: (2024)
Model Editing for LLMs4Code: How Far are We?
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
The Quiet Contributions: Insights into AI-Generated Silent Pull Requests
by: Hasan, S M Mahedy, et al.
Published: (2026)
by: Hasan, S M Mahedy, et al.
Published: (2026)
COBOL-Coder: Domain-Adapted Large Language Models for COBOL Code Generation and Translation
by: Dau, Anh T. V., et al.
Published: (2026)
by: Dau, Anh T. V., et al.
Published: (2026)
Deep Learning Framework Testing via Model Mutation: How Far Are We?
by: Mu, Yanzhou, et al.
Published: (2025)
by: Mu, Yanzhou, et al.
Published: (2025)
ABTest: Behavior-Driven Testing for AI Coding Agents
by: Dai, Wuyang, et al.
Published: (2026)
by: Dai, Wuyang, et al.
Published: (2026)
Leveraging Language Models for Log Statement Generation in Multilingual Scenarios: How Far Are We?
by: Kusama, Kazuki, et al.
Published: (2026)
by: Kusama, Kazuki, et al.
Published: (2026)
An Empirical Study on Automatically Detecting AI-Generated Source Code: How Far Are We?
by: Suh, Hyunjae, et al.
Published: (2024)
by: Suh, Hyunjae, et al.
Published: (2024)
Vulnerability-Affected Versions Identification: How Far Are We?
by: Chen, Xingchu, et al.
Published: (2025)
by: Chen, Xingchu, et al.
Published: (2025)
Retrieval-Augmented Test Generation: How Far Are We?
by: Shin, Jiho, et al.
Published: (2024)
by: Shin, Jiho, et al.
Published: (2024)
A Large-Scale Evaluation for Log Parsing Techniques: How Far Are We?
by: Jiang, Zhihan, et al.
Published: (2023)
by: Jiang, Zhihan, et al.
Published: (2023)
Understanding Software Vulnerabilities in the Maven Ecosystem: Patterns, Timelines, and Risks
by: Rabbi, Md Fazle, et al.
Published: (2025)
by: Rabbi, Md Fazle, et al.
Published: (2025)
Insights into Dependency Maintenance Trends in the Maven Ecosystem
by: Chowdhury, Barisha, et al.
Published: (2025)
by: Chowdhury, Barisha, et al.
Published: (2025)
Representation Learning for Stack Overflow Posts: How Far are We?
by: He, Junda, et al.
Published: (2023)
by: He, Junda, et al.
Published: (2023)
Duplicate Bug Report Detection: How Far Are We?
by: Zhang, Ting, et al.
Published: (2022)
by: Zhang, Ting, et al.
Published: (2022)
Tracking the Evolution of Static Code Warnings: the State-of-the-Art and a Better Approach
by: Li, Junjie, et al.
Published: (2022)
by: Li, Junjie, et al.
Published: (2022)
Exploring and Unleashing the Power of Large Language Models in Automated Code Translation
by: Yang, Zhen, et al.
Published: (2024)
by: Yang, Zhen, et al.
Published: (2024)
Faster Releases, Fewer Risks: A Study on Maven Artifact Vulnerabilities and Lifecycle Management
by: Shafin, Md Shafiullah, et al.
Published: (2025)
by: Shafin, Md Shafiullah, et al.
Published: (2025)
Insights into Security-Related AI-Generated Pull Requests
by: Rabbi, Md Fazle, et al.
Published: (2026)
by: Rabbi, Md Fazle, et al.
Published: (2026)
Can AI Agents Generate Microservices? How Far are We?
by: Adnan, Bassam, et al.
Published: (2026)
by: Adnan, Bassam, et al.
Published: (2026)
Automated Testing of Task-based Chatbots: How Far Are We?
by: Clerissi, Diego, et al.
Published: (2026)
by: Clerissi, Diego, et al.
Published: (2026)
Static Application Security Testing (SAST) Tools for Smart Contracts: How Far Are We?
by: Li, Kaixuan, et al.
Published: (2024)
by: Li, Kaixuan, et al.
Published: (2024)
Measuring Emergent Capabilities of LLMs for Software Engineering: How Far Are We?
by: O'Brien, Conor, et al.
Published: (2024)
by: O'Brien, Conor, et al.
Published: (2024)
On the Effectiveness of Large Language Models in Domain-Specific Code Generation
by: Gu, Xiaodong, et al.
Published: (2023)
by: Gu, Xiaodong, et al.
Published: (2023)
Similar Items
-
Beyond Translation Accuracy: Addressing False Failures in LLM-Based Code Translation
by: Rabbi, Fazle, et al.
Published: (2026) -
BabelCoder: Agentic Code Translation with Specification Alignment
by: Rabbi, Fazle, et al.
Published: (2025) -
A Multi-Language Perspective on the Robustness of LLM Code Generation
by: Rabbi, Fazle, et al.
Published: (2025) -
HEJ-Robust: A Robustness Benchmark for LLM-Based Automated Program Repair
by: Rabbi, Fazle, et al.
Published: (2026) -
Bias Unveiled: Investigating Social Bias in LLM-Generated Code
by: Ling, Lin, et al.
Published: (2024)