TRACED: Transition-aware Regret Approximation with Co-learnability for Environment Design
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cho, Geonwoo, Im, Jaegyun, Lee, Jihwan, Yi, Hojun, Kim, Sejin, Kim, Sundong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Causal-Paced Deep Reinforcement Learning
par: Cho, Geonwoo, et autres
Publié: (2025)
par: Cho, Geonwoo, et autres
Publié: (2025)
AMPED: Adaptive Multi-objective Projection for balancing Exploration and skill Diversification
par: Cho, Geonwoo, et autres
Publié: (2025)
par: Cho, Geonwoo, et autres
Publié: (2025)
ARCLE: The Abstraction and Reasoning Corpus Learning Environment for Reinforcement Learning
par: Lee, Hosung, et autres
Publié: (2024)
par: Lee, Hosung, et autres
Publié: (2024)
Adversarial Environment Design via Regret-Guided Diffusion Models
par: Chung, Hojun, et autres
Publié: (2024)
par: Chung, Hojun, et autres
Publié: (2024)
DIAR: Diffusion-model-guided Implicit Q-learning with Adaptive Revaluation
par: Park, Jaehyun, et autres
Publié: (2024)
par: Park, Jaehyun, et autres
Publié: (2024)
Enhancing Analogical Reasoning in the Abstraction and Reasoning Corpus via Model-Based RL
par: Lee, Jihwan, et autres
Publié: (2024)
par: Lee, Jihwan, et autres
Publié: (2024)
System 2 Reasoning for Human-AI Alignment: Generality and Adaptivity via ARC-AGI
par: Kim, Sejin, et autres
Publié: (2024)
par: Kim, Sejin, et autres
Publié: (2024)
Diffusion-Based Offline RL for Improved Decision-Making in Augmented ARC Task
par: Kim, Yunho, et autres
Publié: (2024)
par: Kim, Yunho, et autres
Publié: (2024)
Partial Inverse Design of High-Performance Concrete Using Cooperative Neural Networks for Constraint-Aware Mix Generation
par: Nugraha, Agung, et autres
Publié: (2025)
par: Nugraha, Agung, et autres
Publié: (2025)
Addressing and Visualizing Misalignments in Human Task-Solving Trajectories
par: Kim, Sejin, et autres
Publié: (2024)
par: Kim, Sejin, et autres
Publié: (2024)
Refining Minimax Regret for Unsupervised Environment Design
par: Beukman, Michael, et autres
Publié: (2024)
par: Beukman, Michael, et autres
Publié: (2024)
ARCTraj: A Dataset and Benchmark of Human Reasoning Trajectories for Abstract Problem Solving
par: Kim, Sejin, et autres
Publié: (2025)
par: Kim, Sejin, et autres
Publié: (2025)
BoA: Attention-aware Post-training Quantization without Backpropagation
par: Kim, Junhan, et autres
Publié: (2024)
par: Kim, Junhan, et autres
Publié: (2024)
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees
par: Kim, Dohyeong, et autres
Publié: (2024)
par: Kim, Dohyeong, et autres
Publié: (2024)
No Regrets: Investigating and Improving Regret Approximations for Curriculum Discovery
par: Rutherford, Alexander, et autres
Publié: (2024)
par: Rutherford, Alexander, et autres
Publié: (2024)
Backdoor defense, learnability and obfuscation
par: Christiano, Paul, et autres
Publié: (2024)
par: Christiano, Paul, et autres
Publié: (2024)
Progressive Weight Loading: Accelerating Initial Inference and Gradually Boosting Performance on Resource-Constrained Environments
par: Kim, Hyunwoo, et autres
Publié: (2025)
par: Kim, Hyunwoo, et autres
Publié: (2025)
Subspace-based Approximate Hessian Method for Zeroth-Order Optimization
par: Kim, Dongyoon, et autres
Publié: (2025)
par: Kim, Dongyoon, et autres
Publié: (2025)
Bellman Unbiasedness: Toward Provably Efficient Distributional Reinforcement Learning with General Value Function Approximation
par: Cho, Taehyun, et autres
Publié: (2024)
par: Cho, Taehyun, et autres
Publié: (2024)
Generalized Gaussian Temporal Difference Error for Uncertainty-aware Reinforcement Learning
par: Kim, Seyeon, et autres
Publié: (2024)
par: Kim, Seyeon, et autres
Publié: (2024)
Causal Disentanglement Learning for Accurate Anomaly Detection in Multivariate Time Series
par: Kim, Wonah, et autres
Publié: (2025)
par: Kim, Wonah, et autres
Publié: (2025)
The Othello AI Arena: Evaluating Intelligent Systems Through Limited-Time Adaptation to Unseen Boards
par: Kim, Sundong
Publié: (2025)
par: Kim, Sundong
Publié: (2025)
Scaling Laws of SignSGD in Linear Regression: When Does It Outperform SGD?
par: Kim, Jihwan, et autres
Publié: (2026)
par: Kim, Jihwan, et autres
Publié: (2026)
SASSHA: Sharpness-aware Adaptive Second-order Optimization with Stable Hessian Approximation
par: Shin, Dahun, et autres
Publié: (2025)
par: Shin, Dahun, et autres
Publié: (2025)
Offline Reinforcement Learning with Universal Horizon Models
par: Chung, Hojun, et autres
Publié: (2026)
par: Chung, Hojun, et autres
Publié: (2026)
TransPL: VQ-Code Transition Matrices for Pseudo-Labeling of Time Series Unsupervised Domain Adaptation
par: Kim, Jaeho, et autres
Publié: (2025)
par: Kim, Jaeho, et autres
Publié: (2025)
Explicit Feature Interaction-aware Graph Neural Networks
par: Kim, Minkyu, et autres
Publié: (2022)
par: Kim, Minkyu, et autres
Publié: (2022)
Bridging the Gap Between Molecule and Textual Descriptions via Substructure-aware Alignment
par: Park, Hyuntae, et autres
Publié: (2025)
par: Park, Hyuntae, et autres
Publié: (2025)
Hierarchical and Modular Network on Non-prehensile Manipulation in General Environments
par: Cho, Yoonyoung, et autres
Publié: (2025)
par: Cho, Yoonyoung, et autres
Publié: (2025)
Attention-aware Semantic Communications for Collaborative Inference
par: Im, Jiwoong, et autres
Publié: (2024)
par: Im, Jiwoong, et autres
Publié: (2024)
Lipschitz-aware Linearity Grafting for Certified Robustness
par: Han, Yongjin, et autres
Publié: (2025)
par: Han, Yongjin, et autres
Publié: (2025)
QUICK: Quantization-aware Interleaving and Conflict-free Kernel for efficient LLM inference
par: Kim, Taesu, et autres
Publié: (2024)
par: Kim, Taesu, et autres
Publié: (2024)
Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm
par: Vakili, Sattar, et autres
Publié: (2024)
par: Vakili, Sattar, et autres
Publié: (2024)
Reinforcement Learning via Conservative Agent for Environments with Random Delays
par: Lee, Jongsoo, et autres
Publié: (2025)
par: Lee, Jongsoo, et autres
Publié: (2025)
Learning-augmented smooth integer programs with PAC-learnable oracles
par: He, Hao-Yuan, et autres
Publié: (2026)
par: He, Hao-Yuan, et autres
Publié: (2026)
Objectomaly: Objectness-Aware Refinement for OoD Segmentation with Structural Consistency and Boundary Precision
par: Song, Jeonghoon, et autres
Publié: (2025)
par: Song, Jeonghoon, et autres
Publié: (2025)
FlowerFormer: Empowering Neural Architecture Encoding using a Flow-aware Graph Transformer
par: Hwang, Dongyeong, et autres
Publié: (2024)
par: Hwang, Dongyeong, et autres
Publié: (2024)
Vocabulary shapes cross-lingual variation of word-order learnability in language models
par: Martins, Jonas Mayer, et autres
Publié: (2026)
par: Martins, Jonas Mayer, et autres
Publié: (2026)
On the Convergence of Continual Learning with Adaptive Methods
par: Han, Seungyub, et autres
Publié: (2024)
par: Han, Seungyub, et autres
Publié: (2024)
Temporal Distance-aware Transition Augmentation for Offline Model-based Reinforcement Learning
par: Lee, Dongsu, et autres
Publié: (2025)
par: Lee, Dongsu, et autres
Publié: (2025)
Documents similaires
-
Causal-Paced Deep Reinforcement Learning
par: Cho, Geonwoo, et autres
Publié: (2025) -
AMPED: Adaptive Multi-objective Projection for balancing Exploration and skill Diversification
par: Cho, Geonwoo, et autres
Publié: (2025) -
ARCLE: The Abstraction and Reasoning Corpus Learning Environment for Reinforcement Learning
par: Lee, Hosung, et autres
Publié: (2024) -
Adversarial Environment Design via Regret-Guided Diffusion Models
par: Chung, Hojun, et autres
Publié: (2024) -
DIAR: Diffusion-model-guided Implicit Q-learning with Adaptive Revaluation
par: Park, Jaehyun, et autres
Publié: (2024)