SafeDreamer: Safe Reinforcement Learning with World Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Weidong, Ji, Jiaming, Xia, Chunhe, Zhang, Borong, Yang, Yaodong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
par: Ji, Jiaming, et autres
Publié: (2023)
par: Ji, Jiaming, et autres
Publié: (2023)
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
par: Luo, Lirui, et autres
Publié: (2026)
par: Luo, Lirui, et autres
Publié: (2026)
SoNIC: Safe Social Navigation with Adaptive Conformal Inference and Constrained Reinforcement Learning
par: Yao, Jianpeng, et autres
Publié: (2024)
par: Yao, Jianpeng, et autres
Publié: (2024)
HASARD: A Benchmark for Vision-Based Safe Reinforcement Learning in Embodied Agents
par: Tomilin, Tristan, et autres
Publié: (2025)
par: Tomilin, Tristan, et autres
Publié: (2025)
ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration
par: Ni, Chaojun, et autres
Publié: (2024)
par: Ni, Chaojun, et autres
Publié: (2024)
Tackling Snow-Induced Challenges: Safe Autonomous Lane-Keeping with Robust Reinforcement Learning
par: Aghdasian, Amin Jalal, et autres
Publié: (2025)
par: Aghdasian, Amin Jalal, et autres
Publié: (2025)
SafeFix: Targeted Model Repair via Controlled Image Generation
par: Xu, Ouyang, et autres
Publié: (2025)
par: Xu, Ouyang, et autres
Publié: (2025)
Fast yet Safe: Early-Exiting with Risk Control
par: Jazbec, Metod, et autres
Publié: (2024)
par: Jazbec, Metod, et autres
Publié: (2024)
SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
par: Dai, Josef, et autres
Publié: (2024)
par: Dai, Josef, et autres
Publié: (2024)
PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics
par: Luan, Xueyu, et autres
Publié: (2026)
par: Luan, Xueyu, et autres
Publié: (2026)
Safe Semi-Supervised Contrastive Learning Using In-Distribution Data as Positive Examples
par: Kwak, Min Gu, et autres
Publié: (2024)
par: Kwak, Min Gu, et autres
Publié: (2024)
Towards Explainable, Safe Autonomous Driving with Language Embeddings for Novelty Identification and Active Learning: Framework and Experimental Analysis with Real-World Data Sets
par: Greer, Ross, et autres
Publié: (2024)
par: Greer, Ross, et autres
Publié: (2024)
EditWorld: Simulating World Dynamics for Instruction-Following Image Editing
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
CURLing the Dream: Contrastive Representations for World Modeling in Reinforcement Learning
par: Kich, Victor Augusto, et autres
Publié: (2024)
par: Kich, Victor Augusto, et autres
Publié: (2024)
SAFREE: Training-Free and Adaptive Guard for Safe Text-to-Image And Video Generation
par: Yoon, Jaehong, et autres
Publié: (2024)
par: Yoon, Jaehong, et autres
Publié: (2024)
SafeRedir: Prompt Embedding Redirection for Robust Unlearning in Image Generation Models
par: Liu, Renyang, et autres
Publié: (2026)
par: Liu, Renyang, et autres
Publié: (2026)
SafeR-CLIP: Mitigating NSFW Content in Vision-Language Models While Preserving Pre-Trained Knowledge
par: Yousaf, Adeel, et autres
Publié: (2025)
par: Yousaf, Adeel, et autres
Publié: (2025)
Refusing Safe Prompts for Multi-modal Large Language Models
par: Shao, Zedian, et autres
Publié: (2024)
par: Shao, Zedian, et autres
Publié: (2024)
KAN-Dreamer: Benchmarking Kolmogorov-Arnold Networks as Function Approximators in World Models
par: Shi, Chenwei, et autres
Publié: (2025)
par: Shi, Chenwei, et autres
Publié: (2025)
Agile But Safe: Learning Collision-Free High-Speed Legged Locomotion
par: He, Tairan, et autres
Publié: (2024)
par: He, Tairan, et autres
Publié: (2024)
SafeEditor: Unified MLLM for Efficient Post-hoc T2I Safety Editing
par: Zhang, Ruiyang, et autres
Publié: (2025)
par: Zhang, Ruiyang, et autres
Publié: (2025)
Doe-1: Closed-Loop Autonomous Driving with Large World Model
par: Zheng, Wenzhao, et autres
Publié: (2024)
par: Zheng, Wenzhao, et autres
Publié: (2024)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
par: Ji, Jiaming, et autres
Publié: (2025)
par: Ji, Jiaming, et autres
Publié: (2025)
ConsistDreamer: 3D-Consistent 2D Diffusion for High-Fidelity Scene Editing
par: Chen, Jun-Kun, et autres
Publié: (2024)
par: Chen, Jun-Kun, et autres
Publié: (2024)
Large-scale Reinforcement Learning for Diffusion Models
par: Zhang, Yinan, et autres
Publié: (2024)
par: Zhang, Yinan, et autres
Publié: (2024)
Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models
par: Xia, Zaishuo, et autres
Publié: (2025)
par: Xia, Zaishuo, et autres
Publié: (2025)
DreamSAC: Learning Hamiltonian World Models via Symmetry Exploration
par: Tang, Jinzhou, et autres
Publié: (2026)
par: Tang, Jinzhou, et autres
Publié: (2026)
MuDreamer: Learning Predictive World Models without Reconstruction
par: Burchi, Maxime, et autres
Publié: (2024)
par: Burchi, Maxime, et autres
Publié: (2024)
Better Safe than Sorry: Pre-training CLIP against Targeted Data Poisoning and Backdoor Attacks
par: Yang, Wenhan, et autres
Publié: (2023)
par: Yang, Wenhan, et autres
Publié: (2023)
Learning and Leveraging World Models in Visual Representation Learning
par: Garrido, Quentin, et autres
Publié: (2024)
par: Garrido, Quentin, et autres
Publié: (2024)
Training Diffusion Models with Reinforcement Learning
par: Black, Kevin, et autres
Publié: (2023)
par: Black, Kevin, et autres
Publié: (2023)
E-GRPO: High Entropy Steps Drive Effective Reinforcement Learning for Flow Models
par: Zhang, Shengjun, et autres
Publié: (2026)
par: Zhang, Shengjun, et autres
Publié: (2026)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
par: Shriram, Jaidev, et autres
Publié: (2024)
par: Shriram, Jaidev, et autres
Publié: (2024)
AdaWorld: Learning Adaptable World Models with Latent Actions
par: Gao, Shenyuan, et autres
Publié: (2025)
par: Gao, Shenyuan, et autres
Publié: (2025)
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
par: Dai, Juntao, et autres
Publié: (2024)
par: Dai, Juntao, et autres
Publié: (2024)
FuRL: Visual-Language Models as Fuzzy Rewards for Reinforcement Learning
par: Fu, Yuwei, et autres
Publié: (2024)
par: Fu, Yuwei, et autres
Publié: (2024)
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
par: Zuo, Sicheng, et autres
Publié: (2024)
par: Zuo, Sicheng, et autres
Publié: (2024)
Wasserstein Distance Rivals Kullback-Leibler Divergence for Knowledge Distillation
par: Lv, Jiaming, et autres
Publié: (2024)
par: Lv, Jiaming, et autres
Publié: (2024)
Robustness Evaluation for Video Models with Reinforcement Learning
par: Babu, Ashwin Ramesh, et autres
Publié: (2025)
par: Babu, Ashwin Ramesh, et autres
Publié: (2025)
Seeing Unseen: Discover Novel Biomedical Concepts via Geometry-Constrained Probabilistic Modeling
par: Fan, Jianan, et autres
Publié: (2024)
par: Fan, Jianan, et autres
Publié: (2024)
Documents similaires
-
Safety-Gymnasium: A Unified Safe Reinforcement Learning Benchmark
par: Ji, Jiaming, et autres
Publié: (2023) -
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
par: Luo, Lirui, et autres
Publié: (2026) -
SoNIC: Safe Social Navigation with Adaptive Conformal Inference and Constrained Reinforcement Learning
par: Yao, Jianpeng, et autres
Publié: (2024) -
HASARD: A Benchmark for Vision-Based Safe Reinforcement Learning in Embodied Agents
par: Tomilin, Tristan, et autres
Publié: (2025) -
ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration
par: Ni, Chaojun, et autres
Publié: (2024)