Learning to Disprove: Formal Counterexample Generation with Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Zenan, Li, Zhaoyu, Yang, Kaiyu, Ma, Xiaoxing, Su, Zhendong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Proving Olympiad Inequalities by Synergizing LLMs and Symbolic Reasoning
by: Li, Zenan, et al.
Published: (2025)
by: Li, Zenan, et al.
Published: (2025)
Neuro-Symbolic Proof Generation for Scaling Systems Software Verification
by: He, Baoding, et al.
Published: (2026)
by: He, Baoding, et al.
Published: (2026)
Task Abstention for Large Language Models in Code Generation
by: Zhou, Yanke, et al.
Published: (2026)
by: Zhou, Yanke, et al.
Published: (2026)
A Survey on Deep Learning for Theorem Proving
by: Li, Zhaoyu, et al.
Published: (2024)
by: Li, Zhaoyu, et al.
Published: (2024)
Neuro-symbolic Learning Yielding Logical Constraints
by: Li, Zenan, et al.
Published: (2024)
by: Li, Zenan, et al.
Published: (2024)
FormalML: A Benchmark for Evaluating Formal Subgoal Completion in Machine Learning Theory
by: Yang, Xiao-Wen, et al.
Published: (2025)
by: Yang, Xiao-Wen, et al.
Published: (2025)
Neuro-Symbolic Data Generation for Math Reasoning
by: Li, Zenan, et al.
Published: (2024)
by: Li, Zenan, et al.
Published: (2024)
Goedel-Code-Prover: Hierarchical Proof Search for Open State-of-the-Art Code Verification
by: Li, Zenan, et al.
Published: (2026)
by: Li, Zenan, et al.
Published: (2026)
Learning with Logical Constraints but without Shortcut Satisfaction
by: Li, Zenan, et al.
Published: (2024)
by: Li, Zenan, et al.
Published: (2024)
From Reasoning to Learning: A Survey on Hypothesis Discovery and Rule Learning with Large Language Models
by: He, Kaiyu, et al.
Published: (2025)
by: He, Kaiyu, et al.
Published: (2025)
Reference-based Metrics Disprove Themselves in Question Generation
by: Nguyen, Bang, et al.
Published: (2024)
by: Nguyen, Bang, et al.
Published: (2024)
Uncertainty Quantification for LLM-based Code Generation
by: Xu, Senrong, et al.
Published: (2026)
by: Xu, Senrong, et al.
Published: (2026)
API-guided Dataset Synthesis to Finetune Large Code Models
by: Li, Zongjie, et al.
Published: (2024)
by: Li, Zongjie, et al.
Published: (2024)
Softened Symbol Grounding for Neuro-symbolic Systems
by: Li, Zenan, et al.
Published: (2024)
by: Li, Zenan, et al.
Published: (2024)
A Theoretical Study on Bridging Internal Probability and Self-Consistency for LLM Reasoning
by: Zhou, Zhi, et al.
Published: (2025)
by: Zhou, Zhi, et al.
Published: (2025)
Multilingual Collaborative Defense for Large Language Models
by: Li, Hongliang, et al.
Published: (2025)
by: Li, Hongliang, et al.
Published: (2025)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
by: Song, Peiyang, et al.
Published: (2024)
by: Song, Peiyang, et al.
Published: (2024)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
by: Yu, Zhouliang, et al.
Published: (2025)
by: Yu, Zhouliang, et al.
Published: (2025)
Bridging Internal Probability and Self-Consistency for Effective and Efficient LLM Reasoning
by: Zhou, Zhi, et al.
Published: (2025)
by: Zhou, Zhi, et al.
Published: (2025)
The Counterexample Game: Iterated Conceptual Analysis and Repair in Language Models
by: Drucker, Daniel, et al.
Published: (2026)
by: Drucker, Daniel, et al.
Published: (2026)
Automated Creativity Evaluation for Large Language Models: A Reference-Based Approach
by: Li, Ruizhe, et al.
Published: (2025)
by: Li, Ruizhe, et al.
Published: (2025)
Autoformalizing Euclidean Geometry
by: Murphy, Logan, et al.
Published: (2024)
by: Murphy, Logan, et al.
Published: (2024)
SysMoBench: Evaluating AI on Formally Modeling Complex Real-World Systems
by: Cheng, Qian, et al.
Published: (2025)
by: Cheng, Qian, et al.
Published: (2025)
Automatic MILP Model Construction for Multi-Robot Task Allocation and Scheduling Based on Large Language Models
by: Peng, Mingming, et al.
Published: (2025)
by: Peng, Mingming, et al.
Published: (2025)
Imagine in Space: Exploring the Frontier of Spatial Intelligence and Reasoning Efficiency in Vision Language Models
by: Lian, Xiaoxing, et al.
Published: (2025)
by: Lian, Xiaoxing, et al.
Published: (2025)
IDEA: Enhancing the Rule Learning Ability of Large Language Model Agent through Induction, Deduction, and Abduction
by: He, Kaiyu, et al.
Published: (2024)
by: He, Kaiyu, et al.
Published: (2024)
Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?
by: Jiang, Jin, et al.
Published: (2025)
by: Jiang, Jin, et al.
Published: (2025)
Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning
by: Wang, Haiming, et al.
Published: (2025)
by: Wang, Haiming, et al.
Published: (2025)
Evolving Subnetwork Training for Large Language Models
by: Li, Hanqi, et al.
Published: (2024)
by: Li, Hanqi, et al.
Published: (2024)
Formal Mathematical Reasoning: A New Frontier in AI
by: Yang, Kaiyu, et al.
Published: (2024)
by: Yang, Kaiyu, et al.
Published: (2024)
OmniGeo: Towards a Multimodal Large Language Models for Geospatial Artificial Intelligence
by: Yuan, Long, et al.
Published: (2025)
by: Yuan, Long, et al.
Published: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
by: Dong, Honghua, et al.
Published: (2024)
by: Dong, Honghua, et al.
Published: (2024)
Lifelong Learning of Large Language Model based Agents: A Roadmap
by: Zheng, Junhao, et al.
Published: (2025)
by: Zheng, Junhao, et al.
Published: (2025)
ExpertPrompting: Instructing Large Language Models to be Distinguished Experts
by: Xu, Benfeng, et al.
Published: (2023)
by: Xu, Benfeng, et al.
Published: (2023)
Local Success Does Not Compose: Benchmarking Large Language Models for Compositional Formal Verification
by: Xu, Xu, et al.
Published: (2025)
by: Xu, Xu, et al.
Published: (2025)
Geolocation Representation from Large Language Models are Generic Enhancers for Spatio-Temporal Learning
by: He, Junlin, et al.
Published: (2024)
by: He, Junlin, et al.
Published: (2024)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
by: Lei, Yuxuan, et al.
Published: (2024)
by: Lei, Yuxuan, et al.
Published: (2024)
EvoJail: Evolutionary Diverse Jailbreak Prompt Generation for Large Language Models
by: Tang, Rui, et al.
Published: (2026)
by: Tang, Rui, et al.
Published: (2026)
Empowering Large Language Model Agents through Action Learning
by: Zhao, Haiteng, et al.
Published: (2024)
by: Zhao, Haiteng, et al.
Published: (2024)
JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models
by: Chi, Ce, et al.
Published: (2025)
by: Chi, Ce, et al.
Published: (2025)
Similar Items
-
Proving Olympiad Inequalities by Synergizing LLMs and Symbolic Reasoning
by: Li, Zenan, et al.
Published: (2025) -
Neuro-Symbolic Proof Generation for Scaling Systems Software Verification
by: He, Baoding, et al.
Published: (2026) -
Task Abstention for Large Language Models in Code Generation
by: Zhou, Yanke, et al.
Published: (2026) -
A Survey on Deep Learning for Theorem Proving
by: Li, Zhaoyu, et al.
Published: (2024) -
Neuro-symbolic Learning Yielding Logical Constraints
by: Li, Zenan, et al.
Published: (2024)