Guardado en:
| Autores principales: | Neo, Dexter, Chen, Tsuhan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2310.17173 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MaxEnt Loss: Constrained Maximum Entropy for Calibration under Out-of-Distribution Shift
por: Neo, Dexter, et al.
Publicado: (2023)
por: Neo, Dexter, et al.
Publicado: (2023)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
por: Ma, Xiaoteng, et al.
Publicado: (2020)
por: Ma, Xiaoteng, et al.
Publicado: (2020)
VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models
por: Neo, Dexter, et al.
Publicado: (2024)
por: Neo, Dexter, et al.
Publicado: (2024)
FastDSAC: Unlocking the Potential of Maximum Entropy RL in High-Dimensional Humanoid Control
por: Xue, Jun, et al.
Publicado: (2026)
por: Xue, Jun, et al.
Publicado: (2026)
Revisiting Discrete Soft Actor-Critic
por: Zhou, Haibin, et al.
Publicado: (2022)
por: Zhou, Haibin, et al.
Publicado: (2022)
Maximum Entropy On-Policy Actor-Critic via Entropy Advantage Estimation
por: Choe, Jean Seong Bjorn, et al.
Publicado: (2024)
por: Choe, Jean Seong Bjorn, et al.
Publicado: (2024)
Dissecting Discrete Soft Actor-Critic: Limitations and Principled Alternatives
por: Asad, Reza, et al.
Publicado: (2025)
por: Asad, Reza, et al.
Publicado: (2025)
Safe Langevin Soft Actor Critic
por: Keswani, Mahesh, et al.
Publicado: (2026)
por: Keswani, Mahesh, et al.
Publicado: (2026)
Finite-Time Analysis of Three-Timescale Constrained Actor-Critic and Constrained Natural Actor-Critic Algorithms
por: Panda, Prashansa, et al.
Publicado: (2023)
por: Panda, Prashansa, et al.
Publicado: (2023)
Average-Reward Soft Actor-Critic
por: Adamczyk, Jacob, et al.
Publicado: (2025)
por: Adamczyk, Jacob, et al.
Publicado: (2025)
Wasserstein Barycenter Soft Actor-Critic
por: Shahrooei, Zahra, et al.
Publicado: (2025)
por: Shahrooei, Zahra, et al.
Publicado: (2025)
Distributional Soft Actor-Critic with Diffusion Policy
por: Liu, Tong, et al.
Publicado: (2025)
por: Liu, Tong, et al.
Publicado: (2025)
PAC-Bayesian Soft Actor-Critic Learning
por: Tasdighi, Bahareh, et al.
Publicado: (2023)
por: Tasdighi, Bahareh, et al.
Publicado: (2023)
Diffusion Actor-Critic with Entropy Regulator
por: Wang, Yinuo, et al.
Publicado: (2024)
por: Wang, Yinuo, et al.
Publicado: (2024)
Primal-Only Actor Critic Algorithm for Robust Constrained Average Cost MDPs
por: Satheesh, Anirudh, et al.
Publicado: (2025)
por: Satheesh, Anirudh, et al.
Publicado: (2025)
Refined Analysis of Entropy-Regularized Actor-Critic
por: Labbi, Safwan, et al.
Publicado: (2026)
por: Labbi, Safwan, et al.
Publicado: (2026)
Distributional Soft Actor-Critic with Three Refinements
por: Duan, Jingliang, et al.
Publicado: (2023)
por: Duan, Jingliang, et al.
Publicado: (2023)
Generative Actor-Critic with Soft Bridge Policies
por: He, Ke, et al.
Publicado: (2026)
por: He, Ke, et al.
Publicado: (2026)
SACn: Soft Actor-Critic with n-step Returns
por: Łyskawa, Jakub, et al.
Publicado: (2025)
por: Łyskawa, Jakub, et al.
Publicado: (2025)
Soft Actor-Critic-based Control Barrier Adaptation for Robust Autonomous Navigation in Unknown Environments
por: Mohammad, Nicholas, et al.
Publicado: (2025)
por: Mohammad, Nicholas, et al.
Publicado: (2025)
Revisiting Mixture Policies in Entropy-Regularized Actor-Critic
por: He, Jiamin, et al.
Publicado: (2026)
por: He, Jiamin, et al.
Publicado: (2026)
1S-DAug: One-Shot Data Augmentation for Robust Few-Shot Generalization
por: Bai, Yunwei, et al.
Publicado: (2026)
por: Bai, Yunwei, et al.
Publicado: (2026)
S$^2$AC: Energy-Based Reinforcement Learning with Stein Soft Actor Critic
por: Messaoud, Safa, et al.
Publicado: (2024)
por: Messaoud, Safa, et al.
Publicado: (2024)
ISAACS: Iterative Soft Adversarial Actor-Critic for Safety
por: Hsu, Kai-Chieh, et al.
Publicado: (2022)
por: Hsu, Kai-Chieh, et al.
Publicado: (2022)
Risk-Sensitive Soft Actor-Critic for Robust Deep Reinforcement Learning under Distribution Shifts
por: Enders, Tobias, et al.
Publicado: (2024)
por: Enders, Tobias, et al.
Publicado: (2024)
Chunking the Critic: A Transformer-based Soft Actor-Critic with N-Step Returns
por: Tian, Dong, et al.
Publicado: (2025)
por: Tian, Dong, et al.
Publicado: (2025)
Langevin Soft Actor-Critic: Efficient Exploration through Uncertainty-Driven Critic Learning
por: Ishfaq, Haque, et al.
Publicado: (2025)
por: Ishfaq, Haque, et al.
Publicado: (2025)
DR-SAC: Distributionally Robust Soft Actor-Critic for Reinforcement Learning under Uncertainty
por: Cui, Mingxuan, et al.
Publicado: (2025)
por: Cui, Mingxuan, et al.
Publicado: (2025)
Actor-Critic without Actor
por: Ki, Donghyeon, et al.
Publicado: (2025)
por: Ki, Donghyeon, et al.
Publicado: (2025)
Learning Without Time-Based Embodiment Resets in Soft-Actor Critic
por: Farrahi, Homayoon, et al.
Publicado: (2025)
por: Farrahi, Homayoon, et al.
Publicado: (2025)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
por: Küçükoğlu, Burcu, et al.
Publicado: (2025)
por: Küçükoğlu, Burcu, et al.
Publicado: (2025)
Mind Your Entropy: From Maximum Entropy to Trajectory Entropy-Constrained RL
por: Zhan, Guojian, et al.
Publicado: (2025)
por: Zhan, Guojian, et al.
Publicado: (2025)
Two-Stage Constrained Actor-Critic for Short Video Recommendation
por: Cai, Qingpeng, et al.
Publicado: (2023)
por: Cai, Qingpeng, et al.
Publicado: (2023)
AI Olympics challenge with Evolutionary Soft Actor Critic
por: Calì, Marco, et al.
Publicado: (2024)
por: Calì, Marco, et al.
Publicado: (2024)
Actor-Critic Reinforcement Learning with Phased Actor
por: Wu, Ruofan, et al.
Publicado: (2024)
por: Wu, Ruofan, et al.
Publicado: (2024)
Actor-Critic or Critic-Actor? A Tale of Two Time Scales
por: Bhatnagar, Shalabh, et al.
Publicado: (2022)
por: Bhatnagar, Shalabh, et al.
Publicado: (2022)
D2 Actor Critic: Diffusion Actor Meets Distributional Critic
por: Zhang, Lunjun, et al.
Publicado: (2025)
por: Zhang, Lunjun, et al.
Publicado: (2025)
Efficient Soft Actor-Critic with LLM-Based Action-Level Guidance for Continuous Control
por: Ma, Hao, et al.
Publicado: (2026)
por: Ma, Hao, et al.
Publicado: (2026)
Generative Actor Critic
por: Qin, Aoyang, et al.
Publicado: (2025)
por: Qin, Aoyang, et al.
Publicado: (2025)
Causal Policy Learning in Reinforcement Learning: Backdoor-Adjusted Soft Actor-Critic
por: Vo, Thanh Vinh, et al.
Publicado: (2025)
por: Vo, Thanh Vinh, et al.
Publicado: (2025)
Ejemplares similares
-
MaxEnt Loss: Constrained Maximum Entropy for Calibration under Out-of-Distribution Shift
por: Neo, Dexter, et al.
Publicado: (2023) -
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
por: Ma, Xiaoteng, et al.
Publicado: (2020) -
VORD: Visual Ordinal Calibration for Mitigating Object Hallucinations in Large Vision-Language Models
por: Neo, Dexter, et al.
Publicado: (2024) -
FastDSAC: Unlocking the Potential of Maximum Entropy RL in High-Dimensional Humanoid Control
por: Xue, Jun, et al.
Publicado: (2026) -
Revisiting Discrete Soft Actor-Critic
por: Zhou, Haibin, et al.
Publicado: (2022)