Enregistré dans:
| Auteurs principaux: | Tso, Joseph, Schmittou, Preston, Huynh, Quan, Hutchins, Jibran |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.22465 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
R-ConstraintBench: Evaluating LLMs on NP-Complete Scheduling
par: Jain, Raj, et autres
Publié: (2025)
par: Jain, Raj, et autres
Publié: (2025)
MCJudgeBench: A Benchmark for Constraint-Level Judge Evaluation in Multi-Constraint Instruction Following
par: Lee, Jaeyun, et autres
Publié: (2026)
par: Lee, Jaeyun, et autres
Publié: (2026)
ActionReasoningBench: Reasoning about Actions with and without Ramification Constraints
par: Handa, Divij, et autres
Publié: (2024)
par: Handa, Divij, et autres
Publié: (2024)
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints
par: Xu, Rui, et autres
Publié: (2025)
par: Xu, Rui, et autres
Publié: (2025)
An Empirical Study of LLM Reasoning Ability Under Strict Output Length Constraint
par: Sun, Yi, et autres
Publié: (2025)
par: Sun, Yi, et autres
Publié: (2025)
BikeBench: A Bicycle Design Benchmark for Generative Models with Objectives and Constraints
par: Regenwetter, Lyle, et autres
Publié: (2025)
par: Regenwetter, Lyle, et autres
Publié: (2025)
Can Large Language Models Reason and Optimize Under Constraints?
par: Bernier, Fabien, et autres
Publié: (2026)
par: Bernier, Fabien, et autres
Publié: (2026)
Reasoning with Preference Constraints: A Benchmark for Language Models in Many-to-One Matching Markets
par: Fauchard, Marylou, et autres
Publié: (2025)
par: Fauchard, Marylou, et autres
Publié: (2025)
ConstraintLLM: A Neuro-Symbolic Framework for Industrial-Level Constraint Programming
par: Shi, Weichun, et autres
Publié: (2025)
par: Shi, Weichun, et autres
Publié: (2025)
Via Negativa for AI Alignment: Why Negative Constraints Are Structurally Superior to Positive Preferences
par: Cheng, Quan
Publié: (2026)
par: Cheng, Quan
Publié: (2026)
SMH-Bench: Benchmarking LLM Agents for Environment-Grounded Reasoning and Action in Smart Homes
par: Li, Kuan, et autres
Publié: (2026)
par: Li, Kuan, et autres
Publié: (2026)
CCR-Bench: A Comprehensive Benchmark for Evaluating LLMs on Complex Constraints, Control Flows, and Real-World Cases
par: Xue, Xiaona, et autres
Publié: (2026)
par: Xue, Xiaona, et autres
Publié: (2026)
Direct Encoding of Declare Constraints in ASP
par: Chiariello, Francesco, et autres
Publié: (2024)
par: Chiariello, Francesco, et autres
Publié: (2024)
PilotBench: A Benchmark for General Aviation Agents with Safety Constraints
par: Wu, Yalun, et autres
Publié: (2026)
par: Wu, Yalun, et autres
Publié: (2026)
Hyperparameter Optimization of Constraint Programming Solvers
par: Haddad, Hedieh, et autres
Publié: (2026)
par: Haddad, Hedieh, et autres
Publié: (2026)
Explainable Distributed Constraint Optimization Problems
par: Rachmut, Ben, et autres
Publié: (2025)
par: Rachmut, Ben, et autres
Publié: (2025)
DCP-Bench-Open: Evaluating LLMs for Constraint Modelling of Discrete Combinatorial Problems
par: Michailidis, Kostis, et autres
Publié: (2025)
par: Michailidis, Kostis, et autres
Publié: (2025)
Hard Constraints Meet Soft Generation: Guaranteed Feasibility for LLM-based Combinatorial Optimization
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
TCP: a Benchmark for Temporal Constraint-Based Planning
par: Ding, Zifeng, et autres
Publié: (2025)
par: Ding, Zifeng, et autres
Publié: (2025)
Trivial Vocabulary Bans Improve LLM Reasoning More Than Deep Linguistic Constraints
par: Jehu-Appiah, Rodney
Publié: (2026)
par: Jehu-Appiah, Rodney
Publié: (2026)
The Model Says Walk: How Surface Heuristics Override Implicit Constraints in LLM Reasoning
par: Li, Yubo, et autres
Publié: (2026)
par: Li, Yubo, et autres
Publié: (2026)
Constraint-Based Analysis of Reasoning Shortcuts in Neurosymbolic Learning
par: Takemura, Akihiro, et autres
Publié: (2026)
par: Takemura, Akihiro, et autres
Publié: (2026)
Constraints-Guided Diffusion Reasoner for Neuro-Symbolic Learning
par: Zhang, Xuan, et autres
Publié: (2025)
par: Zhang, Xuan, et autres
Publié: (2025)
LinAlg-Bench: A Forensic Benchmark Revealing Structural Failure Modes in LLM Mathematical Reasoning
par: Agarwal, Shradha, et autres
Publié: (2026)
par: Agarwal, Shradha, et autres
Publié: (2026)
Omission Constraints Decay While Commission Constraints Persist in Long-Context LLM Agents
par: Gamage, Yeran
Publié: (2026)
par: Gamage, Yeran
Publié: (2026)
Generalizing Constraint Models in Constraint Acquisition
par: Tsouros, Dimos, et autres
Publié: (2024)
par: Tsouros, Dimos, et autres
Publié: (2024)
KG-LLM-Bench: A Scalable Benchmark for Evaluating LLM Reasoning on Textualized Knowledge Graphs
par: Markowitz, Elan, et autres
Publié: (2025)
par: Markowitz, Elan, et autres
Publié: (2025)
CombiBench: Benchmarking LLM Capability for Combinatorial Mathematics
par: Liu, Junqi, et autres
Publié: (2025)
par: Liu, Junqi, et autres
Publié: (2025)
LLM-Enhanced Bayesian Optimization for Efficient Analog Layout Constraint Generation
par: Chen, Guojin, et autres
Publié: (2024)
par: Chen, Guojin, et autres
Publié: (2024)
Evaluating the Safety and Skill Reasoning of Large Reasoning Models Under Compute Constraints
par: Balaji, Adarsha, et autres
Publié: (2025)
par: Balaji, Adarsha, et autres
Publié: (2025)
ORACLE: Optimizing Reasoning Abilities of Large Language Models via Constraint-Led Synthetic Data Elicitation
par: Yang, Zhuojie, et autres
Publié: (2026)
par: Yang, Zhuojie, et autres
Publié: (2026)
FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning
par: Wang, Zeyu, et autres
Publié: (2026)
par: Wang, Zeyu, et autres
Publié: (2026)
MorphoBench: A Benchmark with Difficulty Adaptive to Model Reasoning
par: Wang, Xukai, et autres
Publié: (2025)
par: Wang, Xukai, et autres
Publié: (2025)
Living Off the LLM: How LLMs Will Change Adversary Tactics
par: Oesch, Sean, et autres
Publié: (2025)
par: Oesch, Sean, et autres
Publié: (2025)
OckBench: Measuring the Efficiency of LLM Reasoning
par: Du, Zheng, et autres
Publié: (2025)
par: Du, Zheng, et autres
Publié: (2025)
Benchmarking Complex Instruction-Following with Multiple Constraints Composition
par: Wen, Bosi, et autres
Publié: (2024)
par: Wen, Bosi, et autres
Publié: (2024)
MMR-Bench: A Comprehensive Benchmark for Multimodal LLM Routing
par: Ma, Haoxuan, et autres
Publié: (2026)
par: Ma, Haoxuan, et autres
Publié: (2026)
TopoBench: Benchmarking LLMs on Hard Topological Reasoning
par: Maniparambil, Mayug, et autres
Publié: (2026)
par: Maniparambil, Mayug, et autres
Publié: (2026)
Automatic Constraint Policy Optimization based on Continuous Constraint Interpolation Framework for Offline Reinforcement Learning
par: Han, Xinchen, et autres
Publié: (2026)
par: Han, Xinchen, et autres
Publié: (2026)
Eidoku: A Neuro-Symbolic Verification Gate for LLM Reasoning via Structural Constraint Satisfaction
par: Miya, Shinobu
Publié: (2025)
par: Miya, Shinobu
Publié: (2025)
Documents similaires
-
R-ConstraintBench: Evaluating LLMs on NP-Complete Scheduling
par: Jain, Raj, et autres
Publié: (2025) -
MCJudgeBench: A Benchmark for Constraint-Level Judge Evaluation in Multi-Constraint Instruction Following
par: Lee, Jaeyun, et autres
Publié: (2026) -
ActionReasoningBench: Reasoning about Actions with and without Ramification Constraints
par: Handa, Divij, et autres
Publié: (2024) -
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints
par: Xu, Rui, et autres
Publié: (2025) -
An Empirical Study of LLM Reasoning Ability Under Strict Output Length Constraint
par: Sun, Yi, et autres
Publié: (2025)