OID-PPO: Optimal Interior Design using Proximal Policy Optimization by Transforming Design Guidelines into Reward Functions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yoon, Chanyoung, Yoo, Sangbong, Yim, Soobin, Kim, Chansoo, Jang, Yun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Discrepancies in Mental Workload Estimation: Self-Reported versus EEG-Based Measures in Data Visualization Evaluation
par: Yim, Soobin, et autres
Publié: (2025)
par: Yim, Soobin, et autres
Publié: (2025)
Data Transformation Strategies to Remove Heterogeneity
par: Yoo, Sangbong, et autres
Publié: (2025)
par: Yoo, Sangbong, et autres
Publié: (2025)
d-DQIVAR: Data-centric Visual Analytics and Reasoning for Data Quality Improvement
par: Hong, Hyein, et autres
Publié: (2025)
par: Hong, Hyein, et autres
Publié: (2025)
OPRA-Vis: Visual Analytics System to Assist Organization-Public Relationship Assessment with Large Language Models
par: Yoo, Sangbong, et autres
Publié: (2025)
par: Yoo, Sangbong, et autres
Publié: (2025)
Time Series Imputation with Multivariate Radial Basis Function Neural Network
par: Jung, Chanyoung, et autres
Publié: (2024)
par: Jung, Chanyoung, et autres
Publié: (2024)
Eval-PPO: Building an Efficient Threat Evaluator Using Proximal Policy Optimization
par: Sun, Wuzhou, et autres
Publié: (2025)
par: Sun, Wuzhou, et autres
Publié: (2025)
CIM-PPO:Proximal Policy Optimization with Liu-Correntropy Induced Metric
par: Guo, Yunxiao, et autres
Publié: (2021)
par: Guo, Yunxiao, et autres
Publié: (2021)
AM-PPO: (Advantage) Alpha-Modulation with Proximal Policy Optimization
par: Sane, Soham
Publié: (2025)
par: Sane, Soham
Publié: (2025)
Composite Reward Design in PPO-Driven Adaptive Filtering
par: Bereketoglu, Abdullah Burkan
Publié: (2025)
par: Bereketoglu, Abdullah Burkan
Publié: (2025)
ExO-PPO: an Extended Off-policy Proximal Policy Optimization Algorithm
par: Wang, Hanyong, et autres
Publié: (2026)
par: Wang, Hanyong, et autres
Publié: (2026)
PPO-MI: Efficient Black-Box Model Inversion via Proximal Policy Optimization
par: Shou, Xinpeng
Publié: (2025)
par: Shou, Xinpeng
Publié: (2025)
PPO-BR: Dual-Signal Entropy-Reward Adaptation for Trust Region Policy Optimization
par: Rahman, Ben
Publié: (2025)
par: Rahman, Ben
Publié: (2025)
Optimal Design for Reward Modeling in RLHF
par: Scheid, Antoine, et autres
Publié: (2024)
par: Scheid, Antoine, et autres
Publié: (2024)
Training Robust Graph Neural Networks by Modeling Noise Dependencies
par: In, Yeonjun, et autres
Publié: (2025)
par: In, Yeonjun, et autres
Publié: (2025)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
GOPO: Policy Optimization using Ranked Rewards
par: Choi, Kyuseong, et autres
Publié: (2026)
par: Choi, Kyuseong, et autres
Publié: (2026)
Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
Solving a Real-World Optimization Problem Using Proximal Policy Optimization with Curriculum Learning and Reward Engineering
par: Pendyala, Abhijeet, et autres
Publié: (2024)
par: Pendyala, Abhijeet, et autres
Publié: (2024)
BinaryPPO: Efficient Policy Optimization for Binary Classification
par: Pandey, Punya Syon, et autres
Publié: (2026)
par: Pandey, Punya Syon, et autres
Publié: (2026)
Reward-Agnostic Prompt Optimization for Text-to-Image Diffusion Models
par: Kim, Semin, et autres
Publié: (2025)
par: Kim, Semin, et autres
Publié: (2025)
Enhancing PPO with Trajectory-Aware Hybrid Policies
par: Liu, Qisai, et autres
Publié: (2025)
par: Liu, Qisai, et autres
Publié: (2025)
Central Path Proximal Policy Optimization
par: Milosevic, Nikola, et autres
Publié: (2025)
par: Milosevic, Nikola, et autres
Publié: (2025)
Accelerating Proximal Policy Optimization Learning Using Task Prediction for Solving Environments with Delayed Rewards
par: Ahmad, Ahmad, et autres
Publié: (2024)
par: Ahmad, Ahmad, et autres
Publié: (2024)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
par: Kapoor, Aditya, et autres
Publié: (2024)
par: Kapoor, Aditya, et autres
Publié: (2024)
On-Policy Optimization of ANFIS Policies Using Proximal Policy Optimization
par: Shankar, Kaaustaaub, et autres
Publié: (2025)
par: Shankar, Kaaustaaub, et autres
Publié: (2025)
Self-Guided Robust Graph Structure Refinement
par: In, Yeonjun, et autres
Publié: (2024)
par: In, Yeonjun, et autres
Publié: (2024)
Reparameterization Proximal Policy Optimization
par: Zhong, Hai, et autres
Publié: (2025)
par: Zhong, Hai, et autres
Publié: (2025)
Gradient-Informed Bayesian and Interior Point Optimization for Efficient Inverse Design in Nanophotonics
par: Mahlau, Yannik, et autres
Publié: (2026)
par: Mahlau, Yannik, et autres
Publié: (2026)
ConfPO: Exploiting Policy Model Confidence for Critical Token Selection in Preference Optimization
par: Yoon, Hee Suk, et autres
Publié: (2025)
par: Yoon, Hee Suk, et autres
Publié: (2025)
MobiCLR: Mobility Time Series Contrastive Learning for Urban Region Representations
par: Kim, Namwoo, et autres
Publié: (2025)
par: Kim, Namwoo, et autres
Publié: (2025)
A Further Efficient Algorithm with Best-of-Both-Worlds Guarantees for $m$-Set Semi-Bandit Problem
par: Chen, Botao, et autres
Publié: (2026)
par: Chen, Botao, et autres
Publié: (2026)
Diffusion Policy through Conditional Proximal Policy Optimization
par: Liu, Ben, et autres
Publié: (2026)
par: Liu, Ben, et autres
Publié: (2026)
Transductive Off-policy Proximal Policy Optimization
par: Gan, Yaozhong, et autres
Publié: (2024)
par: Gan, Yaozhong, et autres
Publié: (2024)
Deep Gaussian Process Proximal Policy Optimization
par: van der Lende, Matthijs, et autres
Publié: (2025)
par: van der Lende, Matthijs, et autres
Publié: (2025)
Actor-Critic Pretraining for Proximal Policy Optimization
par: Kernbach, Andreas, et autres
Publié: (2026)
par: Kernbach, Andreas, et autres
Publié: (2026)
RevoNAD: Reflective Evolutionary Exploration for Neural Architecture Design
par: Chang, Gyusam, et autres
Publié: (2025)
par: Chang, Gyusam, et autres
Publié: (2025)
Design-MLLM: A Reinforcement Alignment Framework for Verifiable and Aesthetic Interior Design
par: Yang, Yuxuan, et autres
Publié: (2026)
par: Yang, Yuxuan, et autres
Publié: (2026)
Quantile Reward Policy Optimization: Alignment with Pointwise Regression and Exact Partition Functions
par: Matrenok, Simon, et autres
Publié: (2025)
par: Matrenok, Simon, et autres
Publié: (2025)
Complexity-Regularized Proximal Policy Optimization
par: Serfilippi, Luca, et autres
Publié: (2025)
par: Serfilippi, Luca, et autres
Publié: (2025)
Beyond the Boundaries of Proximal Policy Optimization
par: Tan, Charlie B., et autres
Publié: (2024)
par: Tan, Charlie B., et autres
Publié: (2024)
Documents similaires
-
Discrepancies in Mental Workload Estimation: Self-Reported versus EEG-Based Measures in Data Visualization Evaluation
par: Yim, Soobin, et autres
Publié: (2025) -
Data Transformation Strategies to Remove Heterogeneity
par: Yoo, Sangbong, et autres
Publié: (2025) -
d-DQIVAR: Data-centric Visual Analytics and Reasoning for Data Quality Improvement
par: Hong, Hyein, et autres
Publié: (2025) -
OPRA-Vis: Visual Analytics System to Assist Organization-Public Relationship Assessment with Large Language Models
par: Yoo, Sangbong, et autres
Publié: (2025) -
Time Series Imputation with Multivariate Radial Basis Function Neural Network
par: Jung, Chanyoung, et autres
Publié: (2024)