Code Simulation Challenges for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | La Malfa, Emanuele, Weinhuber, Christoph, Torre, Orazio, Lin, Fangru, Marro, Samuele, Cohn, Anthony, Shadbolt, Nigel, Wooldridge, Michael |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Code Simulation as a Proxy for High-order Tasks in Large Language Models
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
A Notion of Complexity for Theory of Mind via Discrete World Models
por: Huang, X. Angelo, et al.
Publicado: (2024)
por: Huang, X. Angelo, et al.
Publicado: (2024)
Language Models Are Implicitly Continuous
por: Marro, Samuele, et al.
Publicado: (2025)
por: Marro, Samuele, et al.
Publicado: (2025)
A Scalable Communication Protocol for Networks of Large Language Models
por: Marro, Samuele, et al.
Publicado: (2024)
por: Marro, Samuele, et al.
Publicado: (2024)
Graph-enhanced Large Language Models in Asynchronous Plan Reasoning
por: Lin, Fangru, et al.
Publicado: (2024)
por: Lin, Fangru, et al.
Publicado: (2024)
Out-of-Context Reasoning in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2025)
por: Shaki, Jonathan, et al.
Publicado: (2025)
Jailbreaking Large Language Models in Infinitely Many Ways
por: Goldstein, Oliver, et al.
Publicado: (2025)
por: Goldstein, Oliver, et al.
Publicado: (2025)
Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
por: Lin, Fangru, et al.
Publicado: (2024)
por: Lin, Fangru, et al.
Publicado: (2024)
Large Language Models Miss the Multi-Agent Mark
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
End-to-end PDDL Planning with Hardcoded and Dynamic Agents
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
Can Large Language Models Generalize Procedures Across Representations?
por: Lin, Fangru, et al.
Publicado: (2026)
por: Lin, Fangru, et al.
Publicado: (2026)
LLM4Decompile: Decompiling Binary Code with Large Language Models
por: Tan, Hanzhuo, et al.
Publicado: (2024)
por: Tan, Hanzhuo, et al.
Publicado: (2024)
OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
por: Huang, Siming, et al.
Publicado: (2024)
por: Huang, Siming, et al.
Publicado: (2024)
Probing Large Language Models for Scalar Adjective Lexical Semantics and Scalar Diversity Pragmatics
por: Lin, Fangru, et al.
Publicado: (2024)
por: Lin, Fangru, et al.
Publicado: (2024)
CodeMind: Evaluating Large Language Models for Code Reasoning
por: Liu, Changshu, et al.
Publicado: (2024)
por: Liu, Changshu, et al.
Publicado: (2024)
Semantic Source Code Segmentation using Small and Large Language Models
por: Dahou, Abdelhalim, et al.
Publicado: (2025)
por: Dahou, Abdelhalim, et al.
Publicado: (2025)
Cognitive Effects in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2023)
por: Shaki, Jonathan, et al.
Publicado: (2023)
Can Large Language Models Reason about the Region Connection Calculus?
por: Cohn, Anthony G, et al.
Publicado: (2024)
por: Cohn, Anthony G, et al.
Publicado: (2024)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions
por: Cohn, Anthony G, et al.
Publicado: (2024)
por: Cohn, Anthony G, et al.
Publicado: (2024)
Tacit Coordination of Large Language Models
por: Aharon, Ido, et al.
Publicado: (2026)
por: Aharon, Ido, et al.
Publicado: (2026)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions, Revisited
por: Cohn, Anthony G, et al.
Publicado: (2025)
por: Cohn, Anthony G, et al.
Publicado: (2025)
Bounded Model Checking of RISC-V Machine Code with Context-Free-Language Ordered Binary Decision Diagrams
por: Bolotina, Anna, et al.
Publicado: (2025)
por: Bolotina, Anna, et al.
Publicado: (2025)
NExT: Teaching Large Language Models to Reason about Code Execution
por: Ni, Ansong, et al.
Publicado: (2024)
por: Ni, Ansong, et al.
Publicado: (2024)
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
por: Lin, Honglin, et al.
Publicado: (2025)
por: Lin, Honglin, et al.
Publicado: (2025)
VRank: Enhancing Verilog Code Generation from Large Language Models via Self-Consistency
por: Zhao, Zhuorui, et al.
Publicado: (2025)
por: Zhao, Zhuorui, et al.
Publicado: (2025)
Strengthening Programming Comprehension in Large Language Models through Code Generation
por: Ren, Xiaoning, et al.
Publicado: (2025)
por: Ren, Xiaoning, et al.
Publicado: (2025)
CodeIF-Bench: Evaluating Instruction-Following Capabilities of Large Language Models in Interactive Code Generation
por: Wang, Peiding, et al.
Publicado: (2025)
por: Wang, Peiding, et al.
Publicado: (2025)
How Programming Concepts and Neurons Are Shared in Code Language Models
por: Kargaran, Amir Hossein, et al.
Publicado: (2025)
por: Kargaran, Amir Hossein, et al.
Publicado: (2025)
SUQL: Conversational Search over Structured and Unstructured Data with Large Language Models
por: Liu, Shicheng, et al.
Publicado: (2023)
por: Liu, Shicheng, et al.
Publicado: (2023)
LLMigrate: Transforming "Lazy" Large Language Models into Efficient Source Code Migrators
por: Liu, Yuchen, et al.
Publicado: (2025)
por: Liu, Yuchen, et al.
Publicado: (2025)
Scalable, Validated Code Translation of Entire Projects using Large Language Models
por: Zhang, Hanliang, et al.
Publicado: (2024)
por: Zhang, Hanliang, et al.
Publicado: (2024)
Constrained Code Generation with Discrete Diffusion
por: Shao, Lize, et al.
Publicado: (2026)
por: Shao, Lize, et al.
Publicado: (2026)
When Claims Evolve: Evaluating and Enhancing the Robustness of Embedding Models Against Misinformation Edits
por: Magomere, Jabez, et al.
Publicado: (2025)
por: Magomere, Jabez, et al.
Publicado: (2025)
Can Large Language Models Simulate Symbolic Execution Output Like KLEE?
por: Feng, Rong, et al.
Publicado: (2025)
por: Feng, Rong, et al.
Publicado: (2025)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
por: Paul, Indraneil, et al.
Publicado: (2024)
por: Paul, Indraneil, et al.
Publicado: (2024)
SWE-QA: Can Language Models Answer Repository-level Code Questions?
por: Peng, Weihan, et al.
Publicado: (2025)
por: Peng, Weihan, et al.
Publicado: (2025)
How Do Humans Write Code? Large Models Do It the Same Way Too
por: Li, Long, et al.
Publicado: (2024)
por: Li, Long, et al.
Publicado: (2024)
CLMTracing: Black-box User-level Watermarking for Code Language Model Tracing
por: Zhang, Boyu, et al.
Publicado: (2025)
por: Zhang, Boyu, et al.
Publicado: (2025)
COBOL-Coder: Domain-Adapted Large Language Models for COBOL Code Generation and Translation
por: Dau, Anh T. V., et al.
Publicado: (2026)
por: Dau, Anh T. V., et al.
Publicado: (2026)
Large Language Model Powered Symbolic Execution
por: Li, Yihe, et al.
Publicado: (2025)
por: Li, Yihe, et al.
Publicado: (2025)
Ejemplares similares
-
Code Simulation as a Proxy for High-order Tasks in Large Language Models
por: La Malfa, Emanuele, et al.
Publicado: (2025) -
A Notion of Complexity for Theory of Mind via Discrete World Models
por: Huang, X. Angelo, et al.
Publicado: (2024) -
Language Models Are Implicitly Continuous
por: Marro, Samuele, et al.
Publicado: (2025) -
A Scalable Communication Protocol for Networks of Large Language Models
por: Marro, Samuele, et al.
Publicado: (2024) -
Graph-enhanced Large Language Models in Asynchronous Plan Reasoning
por: Lin, Fangru, et al.
Publicado: (2024)