Generative Actor Critic
Fuente:
arXiv
Salvato in:
| Autori principali: | Qin, Aoyang, Kong, Deqian, Wang, Wei, Wu, Ying Nian, Zhu, Song-Chun, Xie, Sirui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Molecule Design by Latent Prompt Transformer
di: Kong, Deqian, et al.
Pubblicazione: (2023)
di: Kong, Deqian, et al.
Pubblicazione: (2023)
FFT-Accelerated Auxiliary Variable MCMC for Fermionic Lattice Models: A Determinant-Free Approach with $O(N\log N)$ Complexity
di: Kong, Deqian, et al.
Pubblicazione: (2025)
di: Kong, Deqian, et al.
Pubblicazione: (2025)
Latent Plan Transformer for Trajectory Abstraction: Planning as Latent Space Inference
di: Kong, Deqian, et al.
Pubblicazione: (2024)
di: Kong, Deqian, et al.
Pubblicazione: (2024)
DODT: Enhanced Online Decision Transformer Learning through Dreamer's Actor-Critic Trajectory Forecasting
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024)
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024)
Latent Space Energy-based Neural ODEs
di: Cheng, Sheng, et al.
Pubblicazione: (2024)
di: Cheng, Sheng, et al.
Pubblicazione: (2024)
Inference-Time Rethinking with Latent Thought Vectors for Math Reasoning
di: Kong, Deqian, et al.
Pubblicazione: (2026)
di: Kong, Deqian, et al.
Pubblicazione: (2026)
Place Cells as Multi-Scale Position Embeddings: Random Walk Transition Kernels for Path Planning
di: Zhao, Minglu, et al.
Pubblicazione: (2025)
di: Zhao, Minglu, et al.
Pubblicazione: (2025)
Latent Thought Models with Variational Bayes Inference-Time Computation
di: Kong, Deqian, et al.
Pubblicazione: (2025)
di: Kong, Deqian, et al.
Pubblicazione: (2025)
Latent Adaptive Planner for Dynamic Manipulation
di: Noh, Donghun, et al.
Pubblicazione: (2025)
di: Noh, Donghun, et al.
Pubblicazione: (2025)
A minimalistic representation model for head direction system
di: Zhao, Minglu, et al.
Pubblicazione: (2024)
di: Zhao, Minglu, et al.
Pubblicazione: (2024)
The Actor-Critic Update Order Matters for PPO in Federated Reinforcement Learning
di: Xie, Zhijie, et al.
Pubblicazione: (2025)
di: Xie, Zhijie, et al.
Pubblicazione: (2025)
Score Neural Operator: A Generative Model for Learning and Generalizing Across Multiple Probability Distributions
di: Liao, Xinyu, et al.
Pubblicazione: (2024)
di: Liao, Xinyu, et al.
Pubblicazione: (2024)
Actor-Critic Reinforcement Learning with Phased Actor
di: Wu, Ruofan, et al.
Pubblicazione: (2024)
di: Wu, Ruofan, et al.
Pubblicazione: (2024)
"Noisier" Noise Contrastive Eestimation is (Almost) Maximum Likelihood
di: Yu, Peiyu, et al.
Pubblicazione: (2024)
di: Yu, Peiyu, et al.
Pubblicazione: (2024)
Actor-Critic without Actor
di: Ki, Donghyeon, et al.
Pubblicazione: (2025)
di: Ki, Donghyeon, et al.
Pubblicazione: (2025)
Diffusion Actor-Critic with Entropy Regulator
di: Wang, Yinuo, et al.
Pubblicazione: (2024)
di: Wang, Yinuo, et al.
Pubblicazione: (2024)
Designing Instance-Level Sampling Schedules via REINFORCE with James-Stein Shrinkage
di: Yu, Peiyu, et al.
Pubblicazione: (2025)
di: Yu, Peiyu, et al.
Pubblicazione: (2025)
D2 Actor Critic: Diffusion Actor Meets Distributional Critic
di: Zhang, Lunjun, et al.
Pubblicazione: (2025)
di: Zhang, Lunjun, et al.
Pubblicazione: (2025)
Actor-Critic or Critic-Actor? A Tale of Two Time Scales
di: Bhatnagar, Shalabh, et al.
Pubblicazione: (2022)
di: Bhatnagar, Shalabh, et al.
Pubblicazione: (2022)
Generative Actor-Critic with Soft Bridge Policies
di: He, Ke, et al.
Pubblicazione: (2026)
di: He, Ke, et al.
Pubblicazione: (2026)
Molecule Design by Latent Prompt Transformer
di: Kong, Deqian, et al.
Pubblicazione: (2024)
di: Kong, Deqian, et al.
Pubblicazione: (2024)
Adaptive Ensemble Aggregation for Actor-Critics
di: Werge, Nicklas, et al.
Pubblicazione: (2025)
di: Werge, Nicklas, et al.
Pubblicazione: (2025)
Weak Convergence Analysis of Online Neural Actor-Critic Algorithms
di: Lam, Samuel Chun-Hei, et al.
Pubblicazione: (2024)
di: Lam, Samuel Chun-Hei, et al.
Pubblicazione: (2024)
An Investigation of Batch Normalization in Off-Policy Actor-Critic Algorithms
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Distributional Soft Actor-Critic with Diffusion Policy
di: Liu, Tong, et al.
Pubblicazione: (2025)
di: Liu, Tong, et al.
Pubblicazione: (2025)
Distributional Soft Actor-Critic with Three Refinements
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
di: Duan, Jingliang, et al.
Pubblicazione: (2023)
Neural-Symbolic Recursive Machine for Systematic Generalization
di: Li, Qing, et al.
Pubblicazione: (2022)
di: Li, Qing, et al.
Pubblicazione: (2022)
Deep Actor-Critics with Tight Risk Certificates
di: Tasdighi, Bahareh, et al.
Pubblicazione: (2025)
di: Tasdighi, Bahareh, et al.
Pubblicazione: (2025)
Discrete Markov Bridge
di: Li, Hengli, et al.
Pubblicazione: (2025)
di: Li, Hengli, et al.
Pubblicazione: (2025)
Actor-Critics Can Achieve Optimal Sample Efficiency
di: Tan, Kevin, et al.
Pubblicazione: (2025)
di: Tan, Kevin, et al.
Pubblicazione: (2025)
Finite-Time Analysis of Three-Timescale Constrained Actor-Critic and Constrained Natural Actor-Critic Algorithms
di: Panda, Prashansa, et al.
Pubblicazione: (2023)
di: Panda, Prashansa, et al.
Pubblicazione: (2023)
Revisiting Discrete Soft Actor-Critic
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
di: Zhou, Haibin, et al.
Pubblicazione: (2022)
Multi-Actor Multi-Critic Deep Deterministic Reinforcement Learning with a Novel Q-Ensemble Method
di: Wu, Andy, et al.
Pubblicazione: (2025)
di: Wu, Andy, et al.
Pubblicazione: (2025)
Ask-AC: An Initiative Advisor-in-the-Loop Actor-Critic Framework
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
Risk-Sensitive Exponential Actor Critic
di: Granados, Alonso, et al.
Pubblicazione: (2026)
di: Granados, Alonso, et al.
Pubblicazione: (2026)
Safe Langevin Soft Actor Critic
di: Keswani, Mahesh, et al.
Pubblicazione: (2026)
di: Keswani, Mahesh, et al.
Pubblicazione: (2026)
On the Convergence of Single-Timescale Actor-Critic
di: Kumar, Navdeep, et al.
Pubblicazione: (2024)
di: Kumar, Navdeep, et al.
Pubblicazione: (2024)
Actor-Critic with Active Importance Sampling
di: Molaei, Majid, et al.
Pubblicazione: (2026)
di: Molaei, Majid, et al.
Pubblicazione: (2026)
SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning
di: Li, Na, et al.
Pubblicazione: (2025)
di: Li, Na, et al.
Pubblicazione: (2025)
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning
di: Wei, Honghao, et al.
Pubblicazione: (2024)
di: Wei, Honghao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Molecule Design by Latent Prompt Transformer
di: Kong, Deqian, et al.
Pubblicazione: (2023) -
FFT-Accelerated Auxiliary Variable MCMC for Fermionic Lattice Models: A Determinant-Free Approach with $O(N\log N)$ Complexity
di: Kong, Deqian, et al.
Pubblicazione: (2025) -
Latent Plan Transformer for Trajectory Abstraction: Planning as Latent Space Inference
di: Kong, Deqian, et al.
Pubblicazione: (2024) -
DODT: Enhanced Online Decision Transformer Learning through Dreamer's Actor-Critic Trajectory Forecasting
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2024) -
Latent Space Energy-based Neural ODEs
di: Cheng, Sheng, et al.
Pubblicazione: (2024)