Strategy-Aware Optimization Modeling with Reasoning LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Ruiqing, Li, Fengzhi, Zuo, Yuan, Liu, Rui, Liu, Yansong, Ma, Yunfei, Meng, Fanyu, Feng, Junlan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond One-Size-Fits-All: Adaptive Subgraph Denoising for Zero-Shot Graph Learning with Large Language Models
par: Li, Fengzhi, et autres
Publié: (2026)
par: Li, Fengzhi, et autres
Publié: (2026)
CCR-Bench: A Comprehensive Benchmark for Evaluating LLMs on Complex Constraints, Control Flows, and Real-World Cases
par: Xue, Xiaona, et autres
Publié: (2026)
par: Xue, Xiaona, et autres
Publié: (2026)
LLMs as Zero-shot Graph Learners: Alignment of GNN Representations with LLM Token Embeddings
par: Wang, Duo, et autres
Publié: (2024)
par: Wang, Duo, et autres
Publié: (2024)
HRBench: Benchmarking and Understanding Thinking-Mode Switch Strategies in Hybrid-Reasoning LLMs
par: Ning, Yansong, et autres
Publié: (2026)
par: Ning, Yansong, et autres
Publié: (2026)
Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
par: Gan, Siyuan, et autres
Publié: (2026)
par: Gan, Siyuan, et autres
Publié: (2026)
Plan before Solving: Problem-Aware Strategy Routing for Mathematical Reasoning with LLMs
par: Qi, Shihao, et autres
Publié: (2025)
par: Qi, Shihao, et autres
Publié: (2025)
JT-Safe: Intrinsically Enhancing the Safety and Trustworthiness of LLMs
par: Feng, Junlan, et autres
Publié: (2025)
par: Feng, Junlan, et autres
Publié: (2025)
USTBench: Benchmarking and Dissecting Spatiotemporal Reasoning of LLMs as Urban Agents
par: Lai, Siqi, et autres
Publié: (2025)
par: Lai, Siqi, et autres
Publié: (2025)
Scene-Aware Explainable Multimodal Trajectory Prediction
par: Liu, Pei, et autres
Publié: (2024)
par: Liu, Pei, et autres
Publié: (2024)
Where Do Deep-Research Agents Go Wrong? Span-Level Error Localization in Agent Trajectories
par: Wang, Jiaming, et autres
Publié: (2026)
par: Wang, Jiaming, et autres
Publié: (2026)
Reconsidering Overthinking: Penalizing Internal and External Redundancy in CoT Reasoning
par: Hong, Jialiang, et autres
Publié: (2025)
par: Hong, Jialiang, et autres
Publié: (2025)
Are LLMs Capable of Data-based Statistical and Causal Reasoning? Benchmarking Advanced Quantitative Reasoning with Data
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
RefTool: Reference-Guided Tool Creation for Knowledge-Intensive Reasoning
par: Liu, Xiao, et autres
Publié: (2025)
par: Liu, Xiao, et autres
Publié: (2025)
Calibration-Aware Policy Optimization for Reasoning LLMs
par: Wang, Ziqi, et autres
Publié: (2026)
par: Wang, Ziqi, et autres
Publié: (2026)
Seeing and Reasoning with Confidence: Supercharging Multimodal LLMs with an Uncertainty-Aware Agentic Framework
par: Zhi, Zhuo, et autres
Publié: (2025)
par: Zhi, Zhuo, et autres
Publié: (2025)
UrbanKGent: A Unified Large Language Model Agent Framework for Urban Knowledge Graph Construction
par: Ning, Yansong, et autres
Publié: (2024)
par: Ning, Yansong, et autres
Publié: (2024)
Empowering Small Language Models with Factual Hallucination-Aware Reasoning for Financial Classification
par: Yuan, Han, et autres
Publié: (2026)
par: Yuan, Han, et autres
Publié: (2026)
JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models
par: Chi, Ce, et autres
Publié: (2025)
par: Chi, Ce, et autres
Publié: (2025)
From Single to Societal: Analyzing Persona-Induced Bias in Multi-Agent Interactions
par: Li, Jiayi, et autres
Publié: (2025)
par: Li, Jiayi, et autres
Publié: (2025)
Kill Two Birds with One Stone! Trajectory enabled Unified Online Detection of Adversarial Examples and Backdoor Attacks
par: Fu, Anmin, et autres
Publié: (2025)
par: Fu, Anmin, et autres
Publié: (2025)
Chart-RL: Policy Optimization Reinforcement Learning for Enhanced Visual Reasoning in Chart Question Answering with Vision Language Models
par: Bai, Yunfei, et autres
Publié: (2026)
par: Bai, Yunfei, et autres
Publié: (2026)
Effective Learning for Small Reasoning Models: An Empirical Study on 0.5B Reasoning LLMs
par: Zhuang, Xialie, et autres
Publié: (2025)
par: Zhuang, Xialie, et autres
Publié: (2025)
Efficient Reasoning via Reward Model
par: Wang, Yuhao, et autres
Publié: (2025)
par: Wang, Yuhao, et autres
Publié: (2025)
Hardness-Aware Dynamic Curriculum Learning for Robust Multimodal Emotion Recognition with Missing Modalities
par: Liu, Rui, et autres
Publié: (2025)
par: Liu, Rui, et autres
Publié: (2025)
Forge: Quality-Aware Reinforcement Learning for NP-Hard Optimization in LLMs
par: Li, Xiaozhe, et autres
Publié: (2026)
par: Li, Xiaozhe, et autres
Publié: (2026)
Chain-of-Discussion: A Multi-Model Framework for Complex Evidence-Based Question Answering
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
CohEx: A Generalized Framework for Cohort Explanation
par: Meng, Fanyu, et autres
Publié: (2024)
par: Meng, Fanyu, et autres
Publié: (2024)
JUREX-4E: Juridical Expert-Annotated Four-Element Knowledge Base for Legal Reasoning
par: Liu, Huanghai, et autres
Publié: (2025)
par: Liu, Huanghai, et autres
Publié: (2025)
From Superficial to Deep: Integrating External Knowledge for Follow-up Question Generation Using Knowledge Graph and LLM
par: Liu, Jianyu, et autres
Publié: (2025)
par: Liu, Jianyu, et autres
Publié: (2025)
CausalAbstain: Enhancing Multilingual LLMs with Causal Reasoning for Trustworthy Abstention
par: Sun, Yuxi, et autres
Publié: (2025)
par: Sun, Yuxi, et autres
Publié: (2025)
MoveGPT: Scaling Mobility Foundation Models with Spatially-Aware Mixture of Experts
par: Han, Chonghua, et autres
Publié: (2025)
par: Han, Chonghua, et autres
Publié: (2025)
LLMs for High-Frequency Decision-Making: Normalized Action Reward-Guided Consistency Policy Optimization
par: Zhao, Yang, et autres
Publié: (2026)
par: Zhao, Yang, et autres
Publié: (2026)
Confidence-Aware Alignment Makes Reasoning LLMs More Reliable
par: Chen, Kejia, et autres
Publié: (2026)
par: Chen, Kejia, et autres
Publié: (2026)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
par: Li, Ce, et autres
Publié: (2025)
par: Li, Ce, et autres
Publié: (2025)
Improving Medical Reasoning with Curriculum-Aware Reinforcement Learning
par: Rui, Shaohao, et autres
Publié: (2025)
par: Rui, Shaohao, et autres
Publié: (2025)
Automating Legal Interpretation with LLMs: Retrieval, Generation, and Evaluation
par: Luo, Kangcheng, et autres
Publié: (2025)
par: Luo, Kangcheng, et autres
Publié: (2025)
When Models Learn to Ask Why: Adaptive Causal Reasoning for Trustworthy Medical Vision-Language Models
par: Lin, Jianxin, et autres
Publié: (2026)
par: Lin, Jianxin, et autres
Publié: (2026)
SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
par: Cao, Hongye, et autres
Publié: (2025)
par: Cao, Hongye, et autres
Publié: (2025)
Rethinking Reasoning: A Survey on Reasoning-based Backdoors in LLMs
par: Hu, Man, et autres
Publié: (2025)
par: Hu, Man, et autres
Publié: (2025)
Enhancing Crash Frequency Modeling Based on Augmented Multi-Type Data by Hybrid VAE-Diffusion-Based Generative Neural Networks
par: Chen, Junlan, et autres
Publié: (2025)
par: Chen, Junlan, et autres
Publié: (2025)
Documents similaires
-
Beyond One-Size-Fits-All: Adaptive Subgraph Denoising for Zero-Shot Graph Learning with Large Language Models
par: Li, Fengzhi, et autres
Publié: (2026) -
CCR-Bench: A Comprehensive Benchmark for Evaluating LLMs on Complex Constraints, Control Flows, and Real-World Cases
par: Xue, Xiaona, et autres
Publié: (2026) -
LLMs as Zero-shot Graph Learners: Alignment of GNN Representations with LLM Token Embeddings
par: Wang, Duo, et autres
Publié: (2024) -
HRBench: Benchmarking and Understanding Thinking-Mode Switch Strategies in Hybrid-Reasoning LLMs
par: Ning, Yansong, et autres
Publié: (2026) -
Thinking-Based Non-Thinking: Solving the Reward Hacking Problem in Training Hybrid Reasoning Models via Reinforcement Learning
par: Gan, Siyuan, et autres
Publié: (2026)