Training Greedy Policy for Proposal Batch Selection in Expensive Multi-Objective Combinatorial Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Lee, Deokjae, Song, Hyun Oh, Cho, Kyunghyun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Q-Palette: Fractional-Bit Quantizers Toward Optimal Bit Allocation for Efficient LLM Deployment
di: Lee, Deokjae, et al.
Pubblicazione: (2025)
di: Lee, Deokjae, et al.
Pubblicazione: (2025)
Expensive Multi-Objective Bayesian Optimization Based on Diffusion Models
di: Li, Bingdong, et al.
Pubblicazione: (2024)
di: Li, Bingdong, et al.
Pubblicazione: (2024)
Divide and Learn: Multi-Objective Combinatorial Optimization at Scale
di: Singh, Esha, et al.
Pubblicazione: (2026)
di: Singh, Esha, et al.
Pubblicazione: (2026)
Pareto Front-Diverse Batch Multi-Objective Bayesian Optimization
di: Ahmadianshalchi, Alaleh, et al.
Pubblicazione: (2024)
di: Ahmadianshalchi, Alaleh, et al.
Pubblicazione: (2024)
Unsupervised Training of Diffusion Models for Feasible Solution Generation in Neural Combinatorial Optimization
di: Hong, Seong-Hyun, et al.
Pubblicazione: (2024)
di: Hong, Seong-Hyun, et al.
Pubblicazione: (2024)
Adversarial Instance Generation and Robust Training for Neural Combinatorial Optimization with Multiple Objectives
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
Trust the Batch, On- or Off-Policy: Adaptive Policy Optimization for RL Post-Training
di: Fakoor, Rasool, et al.
Pubblicazione: (2026)
di: Fakoor, Rasool, et al.
Pubblicazione: (2026)
Context-aware Diversity Enhancement for Neural Multi-Objective Combinatorial Optimization
di: Lu, Yongfan, et al.
Pubblicazione: (2024)
di: Lu, Yongfan, et al.
Pubblicazione: (2024)
FoMEMO: Towards Foundation Models for Expensive Multi-objective Optimization
di: Yao, Yiming, et al.
Pubblicazione: (2025)
di: Yao, Yiming, et al.
Pubblicazione: (2025)
Non-convolutional Graph Neural Networks
di: Wang, Yuanqing, et al.
Pubblicazione: (2024)
di: Wang, Yuanqing, et al.
Pubblicazione: (2024)
Meta-Statistical Learning: Supervised Learning of Statistical Estimators
di: Peyrard, Maxime, et al.
Pubblicazione: (2025)
di: Peyrard, Maxime, et al.
Pubblicazione: (2025)
Deep Sensitivity Analysis for Objective-Oriented Combinatorial Optimization
di: Gireesan, Ganga, et al.
Pubblicazione: (2024)
di: Gireesan, Ganga, et al.
Pubblicazione: (2024)
On Constructing Algorithm Portfolios in Algorithm Selection for Computationally Expensive Black-box Optimization in the Fixed-budget Setting
di: Yoshikawa, Takushi, et al.
Pubblicazione: (2024)
di: Yoshikawa, Takushi, et al.
Pubblicazione: (2024)
NOCTA: Non-Greedy Objective Cost-Tradeoff Acquisition for Longitudinal Data
di: Dinh, Dzung, et al.
Pubblicazione: (2025)
di: Dinh, Dzung, et al.
Pubblicazione: (2025)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
di: Xu, Wenzhe, et al.
Pubblicazione: (2026)
di: Xu, Wenzhe, et al.
Pubblicazione: (2026)
Combinatorial Optimization with Policy Adaptation using Latent Space Search
di: Chalumeau, Felix, et al.
Pubblicazione: (2023)
di: Chalumeau, Felix, et al.
Pubblicazione: (2023)
CombiMOTS: Combinatorial Multi-Objective Tree Search for Dual-Target Molecule Generation
di: Southiratn, Thibaud, et al.
Pubblicazione: (2026)
di: Southiratn, Thibaud, et al.
Pubblicazione: (2026)
Preference Conditioned Multi-Objective Reinforcement Learning: Decomposed, Diversity-Driven Policy Optimization
di: Ambadkar, Tanmay, et al.
Pubblicazione: (2026)
di: Ambadkar, Tanmay, et al.
Pubblicazione: (2026)
In-Context Multi-Objective Optimization
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
di: Zhang, Xinyu, et al.
Pubblicazione: (2025)
Entropy-Gated Selective Policy Optimization:Token-Level Gradient Allocation for Hybrid Training of Large Language Models
di: Hu, Yuelin, et al.
Pubblicazione: (2026)
di: Hu, Yuelin, et al.
Pubblicazione: (2026)
Efficient semantic uncertainty quantification in language models via diversity-steered sampling
di: Park, Ji Won, et al.
Pubblicazione: (2025)
di: Park, Ji Won, et al.
Pubblicazione: (2025)
c-TPE: Tree-structured Parzen Estimator with Inequality Constraints for Expensive Hyperparameter Optimization
di: Watanabe, Shuhei, et al.
Pubblicazione: (2022)
di: Watanabe, Shuhei, et al.
Pubblicazione: (2022)
Greedy and Transformer-Based Multi-Port Selection for Slow Fluid Antenna Multiple Access
di: Perez-Adan, Darian, et al.
Pubblicazione: (2026)
di: Perez-Adan, Darian, et al.
Pubblicazione: (2026)
Tula: Optimizing Time, Cost, and Generalization in Distributed Large-Batch Training
di: Tyagi, Sahil, et al.
Pubblicazione: (2026)
di: Tyagi, Sahil, et al.
Pubblicazione: (2026)
Neural Solver Selection for Combinatorial Optimization
di: Gao, Chengrui, et al.
Pubblicazione: (2024)
di: Gao, Chengrui, et al.
Pubblicazione: (2024)
Forget Forgetting: Continual Learning in a World of Abundant Memory
di: Cho, Dongkyu, et al.
Pubblicazione: (2025)
di: Cho, Dongkyu, et al.
Pubblicazione: (2025)
AutoLLMResearch: Training Research Agents for Automating LLM Experiment Configuration - Learning from Cheap, Optimizing Expensive
di: Guo, Taicheng, et al.
Pubblicazione: (2026)
di: Guo, Taicheng, et al.
Pubblicazione: (2026)
MODE: Multi-Objective Adaptive Coreset Selection
di: Mukherjee, Tanmoy, et al.
Pubblicazione: (2025)
di: Mukherjee, Tanmoy, et al.
Pubblicazione: (2025)
BoLT: A Benchmark to Democratize Black-box Optimization Research for Expensive LLM Tasks
di: Chew, Ruth Wan Theng, et al.
Pubblicazione: (2026)
di: Chew, Ruth Wan Theng, et al.
Pubblicazione: (2026)
Optimizing Data Curation through Spectral Analysis and Joint Batch Selection (SALN)
di: Sharifi, Mohammadreza
Pubblicazione: (2024)
di: Sharifi, Mohammadreza
Pubblicazione: (2024)
Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization
di: Honari, Homayoun, et al.
Pubblicazione: (2024)
di: Honari, Homayoun, et al.
Pubblicazione: (2024)
Multi-Objective Instruction-Aware Representation Learning in Procedural Content Generation RL
di: Kim, Sung-Hyun, et al.
Pubblicazione: (2025)
di: Kim, Sung-Hyun, et al.
Pubblicazione: (2025)
Conformal Policy Control
di: Prinster, Drew, et al.
Pubblicazione: (2026)
di: Prinster, Drew, et al.
Pubblicazione: (2026)
GreedySnake: Accelerating SSD-Offloaded LLM Training with Efficient Scheduling and Optimizer Step Overlapping
di: Yin, Yishu, et al.
Pubblicazione: (2025)
di: Yin, Yishu, et al.
Pubblicazione: (2025)
Non-Myopic Multi-Objective Bayesian Optimization
di: Belakaria, Syrine, et al.
Pubblicazione: (2024)
di: Belakaria, Syrine, et al.
Pubblicazione: (2024)
Taming the Adversary: Stable Minimax Deep Deterministic Policy Gradient via Fractional Objectives
di: Lee, Taeho, et al.
Pubblicazione: (2026)
di: Lee, Taeho, et al.
Pubblicazione: (2026)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
di: Bai, Qinbo, et al.
Pubblicazione: (2021)
di: Bai, Qinbo, et al.
Pubblicazione: (2021)
Information-Theoretic Greedy Layer-wise Training for Traffic Sign Recognition
di: Lyu, Shuyan, et al.
Pubblicazione: (2025)
di: Lyu, Shuyan, et al.
Pubblicazione: (2025)
Multi-Objective Multi-Fidelity Bayesian Optimization with Causal Priors
di: Hossen, Md Abir, et al.
Pubblicazione: (2026)
di: Hossen, Md Abir, et al.
Pubblicazione: (2026)
Adversarial Policy Optimization for Offline Preference-based Reinforcement Learning
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
di: Kang, Hyungkyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Q-Palette: Fractional-Bit Quantizers Toward Optimal Bit Allocation for Efficient LLM Deployment
di: Lee, Deokjae, et al.
Pubblicazione: (2025) -
Expensive Multi-Objective Bayesian Optimization Based on Diffusion Models
di: Li, Bingdong, et al.
Pubblicazione: (2024) -
Divide and Learn: Multi-Objective Combinatorial Optimization at Scale
di: Singh, Esha, et al.
Pubblicazione: (2026) -
Pareto Front-Diverse Batch Multi-Objective Bayesian Optimization
di: Ahmadianshalchi, Alaleh, et al.
Pubblicazione: (2024) -
Unsupervised Training of Diffusion Models for Feasible Solution Generation in Neural Combinatorial Optimization
di: Hong, Seong-Hyun, et al.
Pubblicazione: (2024)