A benchmark for vericoding: formally verified program synthesis
Fuente:
arXiv
Guardado en:
| Autores principales: | Bursuc, Sergiu, Ehrenborg, Theodore, Lin, Shaowei, Astefanoaei, Lacramioara, Chiosa, Ionel Emilian, Kukovec, Jure, Singh, Alok, Butterley, Oliver, Bizid, Adem, Dougherty, Quinn, Zhao, Miranda, Tan, Max, Tegmark, Max |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Language Models Use Trigonometry to Do Addition
por: Kantamneni, Subhash, et al.
Publicado: (2025)
por: Kantamneni, Subhash, et al.
Publicado: (2025)
A Neural Scaling Law from Lottery Ticket Ensembling
por: Liu, Ziming, et al.
Publicado: (2023)
por: Liu, Ziming, et al.
Publicado: (2023)
The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets
por: Marks, Samuel, et al.
Publicado: (2023)
por: Marks, Samuel, et al.
Publicado: (2023)
Language Models Represent Space and Time
por: Gurnee, Wes, et al.
Publicado: (2023)
por: Gurnee, Wes, et al.
Publicado: (2023)
Towards Understanding Distilled Reasoning Models: A Representational Approach
por: Baek, David D., et al.
Publicado: (2025)
por: Baek, David D., et al.
Publicado: (2025)
FVSpec: Real-World Property-Based Tests as Lean Challenges
por: Dougherty, Quinn, et al.
Publicado: (2026)
por: Dougherty, Quinn, et al.
Publicado: (2026)
Low-Rank Adapting Models for Sparse Autoencoders
por: Chen, Matthew, et al.
Publicado: (2025)
por: Chen, Matthew, et al.
Publicado: (2025)
Decomposing The Dark Matter of Sparse Autoencoders
por: Engels, Joshua, et al.
Publicado: (2024)
por: Engels, Joshua, et al.
Publicado: (2024)
OptPDE: Discovering Novel Integrable Systems via AI-Human Collaboration
por: Kantamneni, Subhash, et al.
Publicado: (2024)
por: Kantamneni, Subhash, et al.
Publicado: (2024)
How Do Transformers "Do" Physics? Investigating the Simple Harmonic Oscillator
por: Kantamneni, Subhash, et al.
Publicado: (2024)
por: Kantamneni, Subhash, et al.
Publicado: (2024)
Do Two AI Scientists Agree?
por: Fu, Xinghong, et al.
Publicado: (2025)
por: Fu, Xinghong, et al.
Publicado: (2025)
Technical Report: Exploring Automatic Model-Checking of the Ethereum specification
por: Konnov, Igor, et al.
Publicado: (2025)
por: Konnov, Igor, et al.
Publicado: (2025)
GenEFT: Understanding Statics and Dynamics of Model Generalization via Effective Theory
por: Baek, David D., et al.
Publicado: (2024)
por: Baek, David D., et al.
Publicado: (2024)
Investigating Representation Universality: Case Study on Genealogical Representations
por: Baek, David D., et al.
Publicado: (2024)
por: Baek, David D., et al.
Publicado: (2024)
Exponential mixing for singular skew-products
por: Butterley, Oliver
Publicado: (2023)
por: Butterley, Oliver
Publicado: (2023)
Two classes of level Eulerian posets
por: Ehrenborg, Richard
Publicado: (2024)
por: Ehrenborg, Richard
Publicado: (2024)
Cyclotomic enumeration of polynomials
por: Ehrenborg, Richard
Publicado: (2024)
por: Ehrenborg, Richard
Publicado: (2024)
Gauss Circle Primes
por: Ehrenborg, Thomas
Publicado: (2025)
por: Ehrenborg, Thomas
Publicado: (2025)
Conjectures for cutting pizza with Coxeter arrangements
por: Ehrenborg, Richard
Publicado: (2024)
por: Ehrenborg, Richard
Publicado: (2024)
On the creation of narrow AI: hierarchy and nonlocality of neural network skills
por: Michaud, Eric J., et al.
Publicado: (2025)
por: Michaud, Eric J., et al.
Publicado: (2025)
A Resource Model For Neural Scaling Law
por: Song, Jinyeop, et al.
Publicado: (2024)
por: Song, Jinyeop, et al.
Publicado: (2024)
Neural Thermodynamic Laws for Large Language Model Training
por: Liu, Ziming, et al.
Publicado: (2025)
por: Liu, Ziming, et al.
Publicado: (2025)
Proving the Coding Interview: A Benchmark for Formally Verified Code Generation
por: Dougherty, Quinn, et al.
Publicado: (2025)
por: Dougherty, Quinn, et al.
Publicado: (2025)
Software-Based Memory Erasure with relaxed isolation requirements: Extended Version
por: Bursuc, Sergiu, et al.
Publicado: (2024)
por: Bursuc, Sergiu, et al.
Publicado: (2024)
The Quantization Model of Neural Scaling
por: Michaud, Eric J., et al.
Publicado: (2023)
por: Michaud, Eric J., et al.
Publicado: (2023)
Harmonic Loss Trains Interpretable AI Models
por: Baek, David D., et al.
Publicado: (2025)
por: Baek, David D., et al.
Publicado: (2025)
The Remarkable Robustness of LLMs: Stages of Inference?
por: Lad, Vedang, et al.
Publicado: (2024)
por: Lad, Vedang, et al.
Publicado: (2024)
Scaling Laws For Scalable Oversight
por: Engels, Joshua, et al.
Publicado: (2025)
por: Engels, Joshua, et al.
Publicado: (2025)
Propagation of Love waves in linear elastic isotropic Cosserat materials
por: Apetrii, Marius, et al.
Publicado: (2025)
por: Apetrii, Marius, et al.
Publicado: (2025)
Anisotropic spaces and nil-automorphisms
por: Butterley, Oliver, et al.
Publicado: (2023)
por: Butterley, Oliver, et al.
Publicado: (2023)
Discontinuous observables as an obstruction for small essential spectral radius
por: Butterley, Oliver, et al.
Publicado: (2025)
por: Butterley, Oliver, et al.
Publicado: (2025)
Are Sparse Autoencoders Useful? A Case Study in Sparse Probing
por: Kantamneni, Subhash, et al.
Publicado: (2025)
por: Kantamneni, Subhash, et al.
Publicado: (2025)
KAN 2.0: Kolmogorov-Arnold Networks Meet Science
por: Liu, Ziming, et al.
Publicado: (2024)
por: Liu, Ziming, et al.
Publicado: (2024)
On the structure of the d-indivisible noncrossing partition posets
por: Ehrenborg, Richard, et al.
Publicado: (2024)
por: Ehrenborg, Richard, et al.
Publicado: (2024)
Fundamental bounds on MIMO antennas
por: Ehrenborg, Casimir, et al.
Publicado: (2017)
por: Ehrenborg, Casimir, et al.
Publicado: (2017)
Blood Coagulation Factor IX: Structure, Function, and Regulation
por: Lacramioara Ivanciu, et al.
Publicado: (2025)
por: Lacramioara Ivanciu, et al.
Publicado: (2025)
A Behaviour-Aware Federated Forecasting Framework for Distributed Stand-Alone Wind Turbines
por: Li, Bowen, et al.
Publicado: (2026)
por: Li, Bowen, et al.
Publicado: (2026)
Performance monitoring
por: Andrei, Bursuc
Publicado: (2025)
por: Andrei, Bursuc
Publicado: (2025)
Duality theory in linear optimization and its extensions -- formally verified
por: Dvorak, Martin, et al.
Publicado: (2024)
por: Dvorak, Martin, et al.
Publicado: (2024)
Physics of Skill Learning
por: Liu, Ziming, et al.
Publicado: (2025)
por: Liu, Ziming, et al.
Publicado: (2025)
Ejemplares similares
-
Language Models Use Trigonometry to Do Addition
por: Kantamneni, Subhash, et al.
Publicado: (2025) -
A Neural Scaling Law from Lottery Ticket Ensembling
por: Liu, Ziming, et al.
Publicado: (2023) -
The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets
por: Marks, Samuel, et al.
Publicado: (2023) -
Language Models Represent Space and Time
por: Gurnee, Wes, et al.
Publicado: (2023) -
Towards Understanding Distilled Reasoning Models: A Representational Approach
por: Baek, David D., et al.
Publicado: (2025)