Tree-of-Code: A Hybrid Approach for Robust Complex Task Planning and Execution
Fuente:
arXiv
Guardado en:
| Autores principales: | Ni, Ziyi, Li, Yifan, Dong, Daxiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tree-of-Code: A Tree-Structured Exploring Framework for End-to-End Code Generation and Execution in Complex Task Handling
por: Ni, Ziyi, et al.
Publicado: (2024)
por: Ni, Ziyi, et al.
Publicado: (2024)
SWE-Hub: A Unified Production System for Scalable, Executable Software Engineering Tasks
por: Zeng, Yucheng, et al.
Publicado: (2026)
por: Zeng, Yucheng, et al.
Publicado: (2026)
GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
por: Ni, Ziyi, et al.
Publicado: (2025)
por: Ni, Ziyi, et al.
Publicado: (2025)
RA-Gen: A Controllable Code Generation Framework Using ReAct for Multi-Agent Task Execution
por: Liu, Aofan, et al.
Publicado: (2025)
por: Liu, Aofan, et al.
Publicado: (2025)
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
por: Guo, Chengquan, et al.
Publicado: (2024)
por: Guo, Chengquan, et al.
Publicado: (2024)
RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving
por: Wang, Huacan, et al.
Publicado: (2025)
por: Wang, Huacan, et al.
Publicado: (2025)
Learning Adaptive Parallel Execution for Efficient Code Localization
por: Xu, Ke, et al.
Publicado: (2026)
por: Xu, Ke, et al.
Publicado: (2026)
FasterPy: An LLM-based Code Execution Efficiency Optimization Framework
por: Wu, Yue, et al.
Publicado: (2025)
por: Wu, Yue, et al.
Publicado: (2025)
An Execution-Verified Multi-Language Benchmark for Code Semantic Reasoning
por: Li, Yikun, et al.
Publicado: (2026)
por: Li, Yikun, et al.
Publicado: (2026)
Do Code Semantics Help? A Comprehensive Study on Execution Trace-Based Information for Code Large Language Models
por: Wang, Jian, et al.
Publicado: (2025)
por: Wang, Jian, et al.
Publicado: (2025)
Analyzing Chain of Thought (CoT) Approaches in Control Flow Code Deobfuscation Tasks
por: Mohseni, Seyedreza, et al.
Publicado: (2026)
por: Mohseni, Seyedreza, et al.
Publicado: (2026)
VisCoder: Fine-Tuning LLMs for Executable Python Visualization Code Generation
por: Ni, Yuansheng, et al.
Publicado: (2025)
por: Ni, Yuansheng, et al.
Publicado: (2025)
Integrating Symbolic Execution into the Fine-Tuning of Code-Generating LLMs
por: Sakharova, Marina, et al.
Publicado: (2025)
por: Sakharova, Marina, et al.
Publicado: (2025)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
por: Jiang, Xue, et al.
Publicado: (2025)
por: Jiang, Xue, et al.
Publicado: (2025)
Enhancing LLM-Based Code Generation with Complexity Metrics: A Feedback-Driven Approach
por: Sepidband, Melika, et al.
Publicado: (2025)
por: Sepidband, Melika, et al.
Publicado: (2025)
Executing as You Generate: Hiding Execution Latency in LLM Code Generation
por: Sun, Zhensu, et al.
Publicado: (2026)
por: Sun, Zhensu, et al.
Publicado: (2026)
GeoCode-GPT: A Large Language Model for Geospatial Code Generation Tasks
por: Hou, Shuyang, et al.
Publicado: (2024)
por: Hou, Shuyang, et al.
Publicado: (2024)
Constraint-Guided Multi-Agent Decompilation for Executable Binary Recovery
por: Zhang, Yifan, et al.
Publicado: (2026)
por: Zhang, Yifan, et al.
Publicado: (2026)
Toward Executable Repository-Level Code Generation via Environment Alignment
por: Pan, Ruwei, et al.
Publicado: (2026)
por: Pan, Ruwei, et al.
Publicado: (2026)
MutaGReP: Execution-Free Repository-Grounded Plan Search for Code-Use
por: Khan, Zaid, et al.
Publicado: (2025)
por: Khan, Zaid, et al.
Publicado: (2025)
When Prompts Go Wrong: Evaluating Code Model Robustness to Ambiguous, Contradictory, and Incomplete Task Descriptions
por: Larbi, Maya, et al.
Publicado: (2025)
por: Larbi, Maya, et al.
Publicado: (2025)
CASET: Complexity Analysis using Simple Execution Traces for CS* submissions
por: Mehta, Aaryen, et al.
Publicado: (2024)
por: Mehta, Aaryen, et al.
Publicado: (2024)
Benchmarking Multimodal LLMs on Code Generation for Complex Interactive Webpages
por: Wu, Fan, et al.
Publicado: (2026)
por: Wu, Fan, et al.
Publicado: (2026)
Automatically Generating UI Code from Screenshot: A Divide-and-Conquer-Based Approach
por: Wan, Yuxuan, et al.
Publicado: (2024)
por: Wan, Yuxuan, et al.
Publicado: (2024)
ResearchEnvBench: Benchmarking Agents on Environment Synthesis for Research Code Execution
por: Wang, Yubang, et al.
Publicado: (2026)
por: Wang, Yubang, et al.
Publicado: (2026)
Survey of GenAI for Automotive Software Development: From Requirements to Executable Code
por: Petrovic, Nenad, et al.
Publicado: (2025)
por: Petrovic, Nenad, et al.
Publicado: (2025)
A Benchmark for Localizing Code and Non-Code Issues in Software Projects
por: Zhang, Zejun, et al.
Publicado: (2025)
por: Zhang, Zejun, et al.
Publicado: (2025)
Task Abstention for Large Language Models in Code Generation
por: Zhou, Yanke, et al.
Publicado: (2026)
por: Zhou, Yanke, et al.
Publicado: (2026)
Learning to Align Human Code Preferences
por: Yin, Xin, et al.
Publicado: (2025)
por: Yin, Xin, et al.
Publicado: (2025)
Beyond Execution: Static-Analysis Rewards and Hint-Conditioned Diffusion RL for Code Generation
por: Ouyang, Shuyin, et al.
Publicado: (2026)
por: Ouyang, Shuyin, et al.
Publicado: (2026)
RobuNFR: Evaluating the Robustness of Large Language Models on Non-Functional Requirements Aware Code Generation
por: Lin, Feng, et al.
Publicado: (2025)
por: Lin, Feng, et al.
Publicado: (2025)
Don't Complete It! Preventing Unhelpful Code Completion for Productive and Sustainable Neural Code Completion Systems
por: Sun, Zhensu, et al.
Publicado: (2022)
por: Sun, Zhensu, et al.
Publicado: (2022)
Seed-CTS: Unleashing the Power of Tree Search for Superior Performance in Competitive Coding Tasks
por: Wang, Hao, et al.
Publicado: (2024)
por: Wang, Hao, et al.
Publicado: (2024)
CodeFort: Robust Training for Code Generation Models
por: Zhang, Yuhao, et al.
Publicado: (2024)
por: Zhang, Yuhao, et al.
Publicado: (2024)
Treefix: Enabling Execution with a Tree of Prefixes
por: Souza, Beatriz, et al.
Publicado: (2025)
por: Souza, Beatriz, et al.
Publicado: (2025)
TaskEval: Assessing Difficulty of Code Generation Tasks for Large Language Models
por: Tambon, Florian, et al.
Publicado: (2024)
por: Tambon, Florian, et al.
Publicado: (2024)
TransAgent: Enhancing LLM-Based Code Translation via Fine-Grained Execution Alignment
por: Yuan, Zhiqiang, et al.
Publicado: (2024)
por: Yuan, Zhiqiang, et al.
Publicado: (2024)
SolidCoder: Bridging the Mental-Reality Gap in LLM Code Generation through Concrete Execution
por: Lee, Woojin, et al.
Publicado: (2026)
por: Lee, Woojin, et al.
Publicado: (2026)
Do Machines and Humans Focus on Similar Code? Exploring Explainability of Large Language Models in Code Summarization
por: Li, Jiliang, et al.
Publicado: (2024)
por: Li, Jiliang, et al.
Publicado: (2024)
Terminus-4B: Can a Smaller Model Replace Frontier LLMs at Agentic Execution Tasks?
por: Garg, Spandan, et al.
Publicado: (2026)
por: Garg, Spandan, et al.
Publicado: (2026)
Ejemplares similares
-
Tree-of-Code: A Tree-Structured Exploring Framework for End-to-End Code Generation and Execution in Complex Task Handling
por: Ni, Ziyi, et al.
Publicado: (2024) -
SWE-Hub: A Unified Production System for Scalable, Executable Software Engineering Tasks
por: Zeng, Yucheng, et al.
Publicado: (2026) -
GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
por: Ni, Ziyi, et al.
Publicado: (2025) -
RA-Gen: A Controllable Code Generation Framework Using ReAct for Multi-Agent Task Execution
por: Liu, Aofan, et al.
Publicado: (2025) -
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
por: Guo, Chengquan, et al.
Publicado: (2024)