StepORLM: A Self-Evolving Framework With Generative Process Supervision For Operations Research Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Chenyu, Xu, Tianyi, Lin, Jianghao, Ge, Dongdong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ORLM: A Customizable Framework in Training Large Models for Automated Optimization Modeling
by: Huang, Chenyu, et al.
Published: (2024)
by: Huang, Chenyu, et al.
Published: (2024)
From Soliloquy to Agora: Memory-Enhanced LLM Agents with Decentralized Debate for Optimization Modeling
by: Lin, Jianghao, et al.
Published: (2026)
by: Lin, Jianghao, et al.
Published: (2026)
OR-Space: A Full-Lifecycle Workspace Benchmark for Industrial Optimization Agents
by: Zhou, Chenyu, et al.
Published: (2026)
by: Zhou, Chenyu, et al.
Published: (2026)
InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees
by: Huang, Chenyu, et al.
Published: (2026)
by: Huang, Chenyu, et al.
Published: (2026)
Auto-Formulating Dynamic Programming Problems with Large Language Models
by: Zhou, Chenyu, et al.
Published: (2025)
by: Zhou, Chenyu, et al.
Published: (2025)
MoE-SpAc: Efficient MoE Inference Based on Speculative Activation Utility in Heterogeneous Edge Scenarios
by: Li, Shuhuai, et al.
Published: (2026)
by: Li, Shuhuai, et al.
Published: (2026)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
by: Zheng, Congmin, et al.
Published: (2025)
by: Zheng, Congmin, et al.
Published: (2025)
SSPO: Self-traced Step-wise Preference Optimization for Process Supervision and Reasoning Compression
by: Xu, Yuyang, et al.
Published: (2025)
by: Xu, Yuyang, et al.
Published: (2025)
FMIP: Joint Continuous-Integer Flow For Mixed-Integer Linear Programming
by: Li, Hongpei, et al.
Published: (2025)
by: Li, Hongpei, et al.
Published: (2025)
EvoLM: Self-Evolving Language Models through Co-Evolved Discriminative Rubrics
by: Li, Shuyue Stella, et al.
Published: (2026)
by: Li, Shuyue Stella, et al.
Published: (2026)
GraphMind: From Operational Traces to Self-Evolving Workflow Automation
by: Zhu, Yiwen, et al.
Published: (2026)
by: Zhu, Yiwen, et al.
Published: (2026)
The Evolving Landscape of Generative Large Language Models and Traditional Natural Language Processing in Medicine
by: Yang, Rui, et al.
Published: (2025)
by: Yang, Rui, et al.
Published: (2025)
Knowledge-Graph Paths as Intermediate Supervision for Self-Evolving Search Agents
by: Wu, Huyu, et al.
Published: (2026)
by: Wu, Huyu, et al.
Published: (2026)
S1-NexusAgent: a Self-Evolving Agent Framework for Multidisciplinary Scientific Research
by: NexusAgent Team
Published: (2026)
by: NexusAgent Team
Published: (2026)
Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards
by: Tamber, Manveer Singh, et al.
Published: (2025)
by: Tamber, Manveer Singh, et al.
Published: (2025)
SE-VLN: A Self-Evolving Vision-Language Navigation Framework Based on Multimodal Large Language Models
by: Dong, Xiangyu, et al.
Published: (2025)
by: Dong, Xiangyu, et al.
Published: (2025)
Evo: Autoregressive-Diffusion Large Language Models with Evolving Balance
by: Wu, Junde, et al.
Published: (2026)
by: Wu, Junde, et al.
Published: (2026)
Solver-Informed RL: Grounding Large Language Models for Authentic Optimization Modeling
by: Chen, Yitian, et al.
Published: (2025)
by: Chen, Yitian, et al.
Published: (2025)
SEAS: Self-Evolving Adversarial Safety Optimization for Large Language Models
by: Diao, Muxi, et al.
Published: (2024)
by: Diao, Muxi, et al.
Published: (2024)
Self-Evolving Critique Abilities in Large Language Models
by: Tang, Zhengyang, et al.
Published: (2025)
by: Tang, Zhengyang, et al.
Published: (2025)
Artificial Intelligence for Operations Research: Revolutionizing the Operations Research Process
by: Fan, Zhenan, et al.
Published: (2024)
by: Fan, Zhenan, et al.
Published: (2024)
RAG4ITOps: A Supervised Fine-Tunable and Comprehensive RAG Framework for IT Operations and Maintenance
by: Zhang, Tianyang, et al.
Published: (2024)
by: Zhang, Tianyang, et al.
Published: (2024)
Language Models as Continuous Self-Evolving Data Engineers
by: Wang, Peidong, et al.
Published: (2024)
by: Wang, Peidong, et al.
Published: (2024)
Performance of LLMs on Stochastic Modeling Operations Research Problems: From Theory to Practice
by: Kumar, Akshit, et al.
Published: (2025)
by: Kumar, Akshit, et al.
Published: (2025)
Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents
by: Wang, Jingxing, et al.
Published: (2026)
by: Wang, Jingxing, et al.
Published: (2026)
Robust Uncertainty Quantification for Self-Evolving Large Language Models via Continual Domain Pretraining
by: Zhou, Xiaofan, et al.
Published: (2025)
by: Zhou, Xiaofan, et al.
Published: (2025)
AppAgentX: Evolving GUI Agents as Proficient Smartphone Users
by: Jiang, Wenjia, et al.
Published: (2025)
by: Jiang, Wenjia, et al.
Published: (2025)
MAO: A Framework for Process Model Generation with Multi-Agent Orchestration
by: Lin, Leilei, et al.
Published: (2024)
by: Lin, Leilei, et al.
Published: (2024)
AdvKT: An Adversarial Multi-Step Training Framework for Knowledge Tracing
by: Fu, Lingyue, et al.
Published: (2025)
by: Fu, Lingyue, et al.
Published: (2025)
Guided Self-Evolving LLMs with Minimal Human Supervision
by: Yu, Wenhao, et al.
Published: (2025)
by: Yu, Wenhao, et al.
Published: (2025)
A Self-Evolving Defect Detection Framework for Industrial Photovoltaic Systems
by: He, Haoyu, et al.
Published: (2026)
by: He, Haoyu, et al.
Published: (2026)
EasyRAG: Efficient Retrieval-Augmented Generation Framework for Automated Network Operations
by: Feng, Zhangchi, et al.
Published: (2024)
by: Feng, Zhangchi, et al.
Published: (2024)
Auto-Evolve: Enhancing Large Language Model's Performance via Self-Reasoning Framework
by: Aswani, Krishna, et al.
Published: (2024)
by: Aswani, Krishna, et al.
Published: (2024)
Alita-G: Self-Evolving Generative Agent for Agent Generation
by: Qiu, Jiahao, et al.
Published: (2025)
by: Qiu, Jiahao, et al.
Published: (2025)
Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
by: Ling Team, et al.
Published: (2025)
by: Ling Team, et al.
Published: (2025)
Learning to Self-Evolve
by: Chen, Xiaoyin, et al.
Published: (2026)
by: Chen, Xiaoyin, et al.
Published: (2026)
MetaCogAgent: A Metacognitive Multi-Agent LLM Framework with Self-Aware Task Delegation
by: Wang, Chenyu, et al.
Published: (2026)
by: Wang, Chenyu, et al.
Published: (2026)
NOTAM-Evolve: A Knowledge-Guided Self-Evolving Optimization Framework with LLMs for NOTAM Interpretation
by: Liu, Maoqi, et al.
Published: (2025)
by: Liu, Maoqi, et al.
Published: (2025)
Graph-Augmented Reasoning: Evolving Step-by-Step Knowledge Graph Retrieval for LLM Reasoning
by: Wu, Wenjie, et al.
Published: (2025)
by: Wu, Wenjie, et al.
Published: (2025)
SAC-NeRF: Adaptive Ray Sampling for Neural Radiance Fields via Soft Actor-Critic Reinforcement Learning
by: Ge, Chenyu
Published: (2025)
by: Ge, Chenyu
Published: (2025)
Similar Items
-
ORLM: A Customizable Framework in Training Large Models for Automated Optimization Modeling
by: Huang, Chenyu, et al.
Published: (2024) -
From Soliloquy to Agora: Memory-Enhanced LLM Agents with Decentralized Debate for Optimization Modeling
by: Lin, Jianghao, et al.
Published: (2026) -
OR-Space: A Full-Lifecycle Workspace Benchmark for Industrial Optimization Agents
by: Zhou, Chenyu, et al.
Published: (2026) -
InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees
by: Huang, Chenyu, et al.
Published: (2026) -
Auto-Formulating Dynamic Programming Problems with Large Language Models
by: Zhou, Chenyu, et al.
Published: (2025)