GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Zhiheng, Wang, Yunzhe, Marr, Ryan, Novoseller, Ellen, Files, Benjamin T., Ustun, Volkan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
X-Ego: Acquiring Team-Level Tactical Situational Awareness via Cross-Egocentric Contrastive Video Representation Learning
par: Wang, Yunzhe, et autres
Publié: (2025)
par: Wang, Yunzhe, et autres
Publié: (2025)
A Data-Driven Discretized CS:GO Simulation Environment to Facilitate Strategic Multi-Agent Planning Research
par: Wang, Yunzhe, et autres
Publié: (2025)
par: Wang, Yunzhe, et autres
Publié: (2025)
Abstracting Geo-specific Terrains to Scale Up Reinforcement Learning
par: Ustun, Volkan, et autres
Publié: (2025)
par: Ustun, Volkan, et autres
Publié: (2025)
Efficient Preference-Based Reinforcement Learning Using Learned Dynamics Models
par: Liu, Yi, et autres
Publié: (2023)
par: Liu, Yi, et autres
Publié: (2023)
Crowd-PrefRL: Preference-Based Reward Learning from Crowds
par: Chhan, David, et autres
Publié: (2024)
par: Chhan, David, et autres
Publié: (2024)
Preference Conditioned Multi-Objective Reinforcement Learning: Decomposed, Diversity-Driven Policy Optimization
par: Ambadkar, Tanmay, et autres
Publié: (2026)
par: Ambadkar, Tanmay, et autres
Publié: (2026)
Hindsight Preference Replay Improves Preference-Conditioned Multi-Objective Reinforcement Learning
par: Shianifar, Jonaid, et autres
Publié: (2026)
par: Shianifar, Jonaid, et autres
Publié: (2026)
FERERO: A Flexible Framework for Preference-Guided Multi-Objective Learning
par: Chen, Lisha, et autres
Publié: (2024)
par: Chen, Lisha, et autres
Publié: (2024)
Latent-Conditioned Policy Gradient for Multi-Objective Deep Reinforcement Learning
par: Kanazawa, Takuya, et autres
Publié: (2023)
par: Kanazawa, Takuya, et autres
Publié: (2023)
Preference-based Multi-Objective Reinforcement Learning
par: Mu, Ni, et autres
Publié: (2025)
par: Mu, Ni, et autres
Publié: (2025)
Robust Multi-Objective Preference Alignment with Online DPO
par: Gupta, Raghav, et autres
Publié: (2025)
par: Gupta, Raghav, et autres
Publié: (2025)
Scalable Interactive Machine Learning for Future Command and Control
par: Madison, Anna, et autres
Publié: (2024)
par: Madison, Anna, et autres
Publié: (2024)
Split the Differences, Pool the Rest: Provably Efficient Multi-Objective Imitation
par: Sheebaelhamd, Ziyad, et autres
Publié: (2026)
par: Sheebaelhamd, Ziyad, et autres
Publié: (2026)
Efficient First-Order Optimization on the Pareto Set for Multi-Objective Learning under Preference Guidance
par: Chen, Lisha, et autres
Publié: (2025)
par: Chen, Lisha, et autres
Publié: (2025)
Preference-based Conditional Treatment Effects and Policy Learning
par: Parnas, Dovid, et autres
Publié: (2026)
par: Parnas, Dovid, et autres
Publié: (2026)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
par: Xu, Wenzhe, et autres
Publié: (2026)
par: Xu, Wenzhe, et autres
Publié: (2026)
Rating-based Reinforcement Learning
par: White, Devin, et autres
Publié: (2023)
par: White, Devin, et autres
Publié: (2023)
Introducing CausalBench: A Flexible Benchmark Framework for Causal Analysis and Machine Learning
par: Kapkiç, Ahmet, et autres
Publié: (2024)
par: Kapkiç, Ahmet, et autres
Publié: (2024)
Conditional Language Policy: A General Framework for Steerable Multi-Objective Finetuning
par: Wang, Kaiwen, et autres
Publié: (2024)
par: Wang, Kaiwen, et autres
Publié: (2024)
Easy Data Unlearning Bench
par: Rinberg, Roy, et autres
Publié: (2026)
par: Rinberg, Roy, et autres
Publié: (2026)
YRC-Bench: A Benchmark for Learning to Coordinate with Experts
par: Danesh, Mohamad H., et autres
Publié: (2025)
par: Danesh, Mohamad H., et autres
Publié: (2025)
Multi-Objective Reward and Preference Optimization: Theory and Algorithms
par: Agnihotri, Akhil
Publié: (2025)
par: Agnihotri, Akhil
Publié: (2025)
Benchmarking Offline Multi-Objective Reinforcement Learning in Critical Care
par: Bansal, Aryaman, et autres
Publié: (2025)
par: Bansal, Aryaman, et autres
Publié: (2025)
RouterBench: A Benchmark for Multi-LLM Routing System
par: Hu, Qitian Jason, et autres
Publié: (2024)
par: Hu, Qitian Jason, et autres
Publié: (2024)
A Single Deep Preference-Conditioned Policy for Learning Pareto Coverage Sets
par: Kubo, Akihiro, et autres
Publié: (2026)
par: Kubo, Akihiro, et autres
Publié: (2026)
Interactive Multi-Objective Probabilistic Preference Learning with Soft and Hard Bounds
par: Chen, Edward, et autres
Publié: (2025)
par: Chen, Edward, et autres
Publié: (2025)
Interactive Hyperparameter Optimization in Multi-Objective Problems via Preference Learning
par: Giovanelli, Joseph, et autres
Publié: (2023)
par: Giovanelli, Joseph, et autres
Publié: (2023)
SNPL: Simultaneous Policy Learning and Evaluation for Safe Multi-Objective Policy Improvement
par: Cho, Brian, et autres
Publié: (2025)
par: Cho, Brian, et autres
Publié: (2025)
Meta-Learning Objectives for Preference Optimization
par: Alfano, Carlo, et autres
Publié: (2024)
par: Alfano, Carlo, et autres
Publié: (2024)
Multi-Objective Recommendation via Multivariate Policy Learning
par: Jeunen, Olivier, et autres
Publié: (2024)
par: Jeunen, Olivier, et autres
Publié: (2024)
NAS-Bench-Graph: Benchmarking Graph Neural Architecture Search
par: Qin, Yijian, et autres
Publié: (2022)
par: Qin, Yijian, et autres
Publié: (2022)
Conditions on Preference Relations that Guarantee the Existence of Optimal Policies
par: Carr, Jonathan Colaço, et autres
Publié: (2023)
par: Carr, Jonathan Colaço, et autres
Publié: (2023)
IGL-Bench: Establishing the Comprehensive Benchmark for Imbalanced Graph Learning
par: Qin, Jiawen, et autres
Publié: (2024)
par: Qin, Jiawen, et autres
Publié: (2024)
Exploring Equity of Climate Policies using Multi-Agent Multi-Objective Reinforcement Learning
par: Biswas, Palok, et autres
Publié: (2025)
par: Biswas, Palok, et autres
Publié: (2025)
Dynamic Preference Multi-Objective Reinforcement Learning for Internet Network Management
par: Heo, DongNyeong, et autres
Publié: (2025)
par: Heo, DongNyeong, et autres
Publié: (2025)
GC-Bench: An Open and Unified Benchmark for Graph Condensation
par: Sun, Qingyun, et autres
Publié: (2024)
par: Sun, Qingyun, et autres
Publié: (2024)
Preference-Guided Diffusion for Multi-Objective Offline Optimization
par: Annadani, Yashas, et autres
Publié: (2025)
par: Annadani, Yashas, et autres
Publié: (2025)
Pareto Merging: Multi-Objective Optimization for Preference-Aware Model Merging
par: Chen, Weiyu, et autres
Publié: (2024)
par: Chen, Weiyu, et autres
Publié: (2024)
Multi-Objective Preference Optimization: Improving Human Alignment of Generative Models
par: Agnihotri, Akhil, et autres
Publié: (2025)
par: Agnihotri, Akhil, et autres
Publié: (2025)
User Preference Meets Pareto-Optimality in Multi-Objective Bayesian Optimization
par: Ip, Joshua Hang Sai, et autres
Publié: (2025)
par: Ip, Joshua Hang Sai, et autres
Publié: (2025)
Documents similaires
-
X-Ego: Acquiring Team-Level Tactical Situational Awareness via Cross-Egocentric Contrastive Video Representation Learning
par: Wang, Yunzhe, et autres
Publié: (2025) -
A Data-Driven Discretized CS:GO Simulation Environment to Facilitate Strategic Multi-Agent Planning Research
par: Wang, Yunzhe, et autres
Publié: (2025) -
Abstracting Geo-specific Terrains to Scale Up Reinforcement Learning
par: Ustun, Volkan, et autres
Publié: (2025) -
Efficient Preference-Based Reinforcement Learning Using Learned Dynamics Models
par: Liu, Yi, et autres
Publié: (2023) -
Crowd-PrefRL: Preference-Based Reward Learning from Crowds
par: Chhan, David, et autres
Publié: (2024)