Teacher-Aware Evolution of Heuristic Programs from Learned Optimization Policies
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Minyu, Qin, Song, Wu, Ling-I, Xue, Jianxin, Li, Guoqiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DaSAThco: Data-Aware SAT Heuristics Combinations Optimization via Large Language Models
por: Chen, Minyu, et al.
Publicado: (2025)
por: Chen, Minyu, et al.
Publicado: (2025)
Enhancing Automated Loop Invariant Generation for Complex Programs with Large Language Models
por: Liu, Ruibang, et al.
Publicado: (2024)
por: Liu, Ruibang, et al.
Publicado: (2024)
Can Language Models Pretend Solvers? Logic Code Simulation with LLMs
por: Chen, Minyu, et al.
Publicado: (2024)
por: Chen, Minyu, et al.
Publicado: (2024)
ARCEAK: An Automated Rule Checking Framework Enhanced with Architectural Knowledge
por: Chen, Junyong, et al.
Publicado: (2024)
por: Chen, Junyong, et al.
Publicado: (2024)
Subgoal-Guided Policy Heuristic Search with Learned Subgoals
por: Tuero, Jake, et al.
Publicado: (2025)
por: Tuero, Jake, et al.
Publicado: (2025)
Heuristic-Free Multi-Teacher Learning
por: Nguyen, Huy Thong, et al.
Publicado: (2024)
por: Nguyen, Huy Thong, et al.
Publicado: (2024)
Heuristic Methods are Good Teachers to Distill MLPs for Graph Link Prediction
por: Qin, Zongyue, et al.
Publicado: (2025)
por: Qin, Zongyue, et al.
Publicado: (2025)
EoH-S: Evolution of Heuristic Set using LLMs for Automated Heuristic Design
por: Liu, Fei, et al.
Publicado: (2025)
por: Liu, Fei, et al.
Publicado: (2025)
Counteraction-Aware Multi-Teacher On-Policy Distillation for General Capability Recovery with Domain Preservation
por: Chen, Tianlei, et al.
Publicado: (2026)
por: Chen, Tianlei, et al.
Publicado: (2026)
Evolutionary Discovery of Heuristic Policies for Traffic Signal Control
por: Wang, Ruibing, et al.
Publicado: (2025)
por: Wang, Ruibing, et al.
Publicado: (2025)
Generalizable Heuristic Generation Through LLMs with Meta-Optimization
por: Shi, Yiding, et al.
Publicado: (2025)
por: Shi, Yiding, et al.
Publicado: (2025)
Game-Theoretic Co-Evolution for LLM-Based Heuristic Discovery
por: Ke, Xinyi, et al.
Publicado: (2026)
por: Ke, Xinyi, et al.
Publicado: (2026)
Formalize, Don't Optimize: The Heuristic Trap in LLM-Generated Combinatorial Solvers
por: Wang, Haoyu, et al.
Publicado: (2026)
por: Wang, Haoyu, et al.
Publicado: (2026)
Pathology-Aware Prototype Evolution via LLM-Driven Semantic Disambiguation for Multicenter Diabetic Retinopathy Diagnosis
por: Zhu, Chunzheng, et al.
Publicado: (2025)
por: Zhu, Chunzheng, et al.
Publicado: (2025)
Boosting Universal LLM Reward Design through Heuristic Reward Observation Space Evolution
por: Heng, Zen Kit, et al.
Publicado: (2025)
por: Heng, Zen Kit, et al.
Publicado: (2025)
Rethinking LLM-Driven Heuristic Design: Generating Efficient and Specialized Solvers via Dynamics-Aware Optimization
por: Wang, Rongzheng, et al.
Publicado: (2026)
por: Wang, Rongzheng, et al.
Publicado: (2026)
UCPO: Uncertainty-Aware Policy Optimization
por: Zeng, Xianzhou, et al.
Publicado: (2026)
por: Zeng, Xianzhou, et al.
Publicado: (2026)
Fine-tuning Pocket-Aware Diffusion Models via Denoising Policy Optimization
por: Xue, Yuan, et al.
Publicado: (2026)
por: Xue, Yuan, et al.
Publicado: (2026)
Tool-Augmented Policy Optimization: Synergizing Reasoning and Adaptive Tool Use with Reinforcement Learning
por: Wu, Wenxun, et al.
Publicado: (2025)
por: Wu, Wenxun, et al.
Publicado: (2025)
TIDE: Tuning-Integrated Dynamic Evolution for LLM-Based Automated Heuristic Design
por: Chen, Chentong, et al.
Publicado: (2026)
por: Chen, Chentong, et al.
Publicado: (2026)
BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search
por: Liu, Shiyu, et al.
Publicado: (2026)
por: Liu, Shiyu, et al.
Publicado: (2026)
Learning Social Heuristics for Human-Aware Path Planning
por: Eirale, Andrea, et al.
Publicado: (2025)
por: Eirale, Andrea, et al.
Publicado: (2025)
Calibration-Aware Policy Optimization for Reasoning LLMs
por: Wang, Ziqi, et al.
Publicado: (2026)
por: Wang, Ziqi, et al.
Publicado: (2026)
Multi-objective Evolution of Heuristic Using Large Language Model
por: Yao, Shunyu, et al.
Publicado: (2024)
por: Yao, Shunyu, et al.
Publicado: (2024)
COPO: Consistency-Aware Policy Optimization
por: Han, Jinghang, et al.
Publicado: (2025)
por: Han, Jinghang, et al.
Publicado: (2025)
Deep Reinforcement Learning Guided Improvement Heuristic for Job Shop Scheduling
por: Zhang, Cong, et al.
Publicado: (2022)
por: Zhang, Cong, et al.
Publicado: (2022)
Reinforcement Learning-based Heuristics to Guide Domain-Independent Dynamic Programming
por: Narita, Minori, et al.
Publicado: (2025)
por: Narita, Minori, et al.
Publicado: (2025)
An effective Genetic Programming Hyper-Heuristic for Uncertain Agile Satellite Scheduling
por: Chen, Yuning, et al.
Publicado: (2026)
por: Chen, Yuning, et al.
Publicado: (2026)
SEED-GRPO: Semantic Entropy Enhanced GRPO for Uncertainty-Aware Policy Optimization
por: Chen, Minghan, et al.
Publicado: (2025)
por: Chen, Minghan, et al.
Publicado: (2025)
Learning to Explore: Scaling Agentic Reasoning via Exploration-Aware Policy Optimization
por: Hua, Xingyuan, et al.
Publicado: (2026)
por: Hua, Xingyuan, et al.
Publicado: (2026)
Return to Tradition: Learning Reliable Heuristics with Classical Machine Learning
por: Chen, Dillon Z., et al.
Publicado: (2024)
por: Chen, Dillon Z., et al.
Publicado: (2024)
Adversarial Attack-Defense Co-Evolution for LLM Safety Alignment via Tree-Group Dual-Aware Search and Optimization
por: Li, Xurui, et al.
Publicado: (2025)
por: Li, Xurui, et al.
Publicado: (2025)
ReEvo: Large Language Models as Hyper-Heuristics with Reflective Evolution
por: Ye, Haoran, et al.
Publicado: (2024)
por: Ye, Haoran, et al.
Publicado: (2024)
ACPO: Adaptive Curriculum Policy Optimization for Aligning Vision-Language Models in Complex Reasoning
por: Wang, Yunhao, et al.
Publicado: (2025)
por: Wang, Yunhao, et al.
Publicado: (2025)
Enhancing Q-Learning with Large Language Model Heuristics
por: Wu, Xiefeng
Publicado: (2024)
por: Wu, Xiefeng
Publicado: (2024)
Improving Learnt Local MAPF Policies with Heuristic Search
por: Veerapaneni, Rishi, et al.
Publicado: (2024)
por: Veerapaneni, Rishi, et al.
Publicado: (2024)
Learning Domain-Independent Heuristics for Grounded and Lifted Planning
por: Chen, Dillon Z., et al.
Publicado: (2023)
por: Chen, Dillon Z., et al.
Publicado: (2023)
Safe Planning and Policy Optimization via World Model Learning
por: Latyshev, Artem, et al.
Publicado: (2025)
por: Latyshev, Artem, et al.
Publicado: (2025)
Planning of Heuristics: Strategic Planning on Large Language Models with Monte Carlo Tree Search for Automating Heuristic Optimization
por: Wang, Hui, et al.
Publicado: (2025)
por: Wang, Hui, et al.
Publicado: (2025)
Learning a Generic Value-Selection Heuristic Inside a Constraint Programming Solver
por: Marty, Tom, et al.
Publicado: (2023)
por: Marty, Tom, et al.
Publicado: (2023)
Ejemplares similares
-
DaSAThco: Data-Aware SAT Heuristics Combinations Optimization via Large Language Models
por: Chen, Minyu, et al.
Publicado: (2025) -
Enhancing Automated Loop Invariant Generation for Complex Programs with Large Language Models
por: Liu, Ruibang, et al.
Publicado: (2024) -
Can Language Models Pretend Solvers? Logic Code Simulation with LLMs
por: Chen, Minyu, et al.
Publicado: (2024) -
ARCEAK: An Automated Rule Checking Framework Enhanced with Architectural Knowledge
por: Chen, Junyong, et al.
Publicado: (2024) -
Subgoal-Guided Policy Heuristic Search with Learned Subgoals
por: Tuero, Jake, et al.
Publicado: (2025)