Salvato in:
| Autore principale: | Kobayashi, Taisuke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2409.19617 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Consolidated Adaptive T-soft Update for Deep Reinforcement Learning
di: Kobayashi, Taisuke
Pubblicazione: (2022)
di: Kobayashi, Taisuke
Pubblicazione: (2022)
Real-time Sampling-based Model Predictive Control based on Reverse Kullback-Leibler Divergence and Its Adaptive Acceleration
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2022)
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2022)
Intentionally-underestimated Value Function at Terminal State for Temporal-difference Learning with Mis-designed Reward
di: Kobayashi, Taisuke
Pubblicazione: (2023)
di: Kobayashi, Taisuke
Pubblicazione: (2023)
CubeDAgger: Interactive Imitation Learning for Dynamic Systems with Efficient yet Low-risk Interaction
di: Kobayashi, Taisuke
Pubblicazione: (2025)
di: Kobayashi, Taisuke
Pubblicazione: (2025)
Towards Autonomous Driving of Personal Mobility with Small and Noisy Dataset using Tsallis-statistics-based Behavioral Cloning
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2021)
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2021)
Design of Restricted Normalizing Flow towards Arbitrary Stochastic Policy with Computational Efficiency
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2024)
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2024)
Variational Adaptive Noise and Dropout towards Stable Recurrent Neural Networks
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2025)
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2025)
Domains as Objectives: Domain-Uncertainty-Aware Policy Optimization through Explicit Multi-Domain Convex Coverage Set Learning
di: Ilboudo, Wendyam Eric Lionel, et al.
Pubblicazione: (2024)
di: Ilboudo, Wendyam Eric Lionel, et al.
Pubblicazione: (2024)
Revisiting the LiRA Membership Inference Attack Under Realistic Assumptions
di: Jebreel, Najeeb, et al.
Pubblicazione: (2026)
di: Jebreel, Najeeb, et al.
Pubblicazione: (2026)
Evaluating and Improving the Robustness of LiDAR Odometry and Localization Under Real-World Corruptions
di: Yang, Bo, et al.
Pubblicazione: (2024)
di: Yang, Bo, et al.
Pubblicazione: (2024)
Dexterous Grasping with Real-World Robotic Reinforcement Learning
di: Huang, Dongchi, et al.
Pubblicazione: (2025)
di: Huang, Dongchi, et al.
Pubblicazione: (2025)
Weber-Fechner Law in Temporal Difference learning derived from Control as Inference
di: Takahashi, Keiichiro, et al.
Pubblicazione: (2024)
di: Takahashi, Keiichiro, et al.
Pubblicazione: (2024)
WOMBET: World Model-based Experience Transfer for Robust and Sample-efficient Reinforcement Learning
di: Kim, Mintae, et al.
Pubblicazione: (2026)
di: Kim, Mintae, et al.
Pubblicazione: (2026)
Robotic Strawberry Harvesting with Robust Vision and Deep Reinforcement Learning based Sim-to-Real Control
di: Bashir, Al, et al.
Pubblicazione: (2026)
di: Bashir, Al, et al.
Pubblicazione: (2026)
Exploring Adversarial Robustness of LiDAR-Camera Fusion Model in Autonomous Driving
di: Yang, Bo, et al.
Pubblicazione: (2023)
di: Yang, Bo, et al.
Pubblicazione: (2023)
LiRA: A Multi-Agent Framework for Reliable and Readable Literature Review Generation
di: Go, Gregory Hok Tjoan, et al.
Pubblicazione: (2025)
di: Go, Gregory Hok Tjoan, et al.
Pubblicazione: (2025)
Exponential-Family Membership Inference: From LiRA and RMIA to BaVarIA
di: Brännvall, Rickard
Pubblicazione: (2026)
di: Brännvall, Rickard
Pubblicazione: (2026)
A Vision-Language-Action-Critic Model for Robotic Real-World Reinforcement Learning
di: Zhai, Shaopeng, et al.
Pubblicazione: (2025)
di: Zhai, Shaopeng, et al.
Pubblicazione: (2025)
A Simulation Pipeline to Facilitate Real-World Robotic Reinforcement Learning Applications
di: Silveira, Jefferson, et al.
Pubblicazione: (2025)
di: Silveira, Jefferson, et al.
Pubblicazione: (2025)
Reset-Free Reinforcement Learning for Real-World Agile Driving: An Empirical Study
di: Honda, Kohei, et al.
Pubblicazione: (2026)
di: Honda, Kohei, et al.
Pubblicazione: (2026)
Skin-Machine Interface with Multimodal Contact Motion Classifier
di: Confente, Alberto, et al.
Pubblicazione: (2025)
di: Confente, Alberto, et al.
Pubblicazione: (2025)
Real-World Reinforcement Learning of Active Perception Behaviors
di: Hu, Edward S., et al.
Pubblicazione: (2025)
di: Hu, Edward S., et al.
Pubblicazione: (2025)
Adversarial Fine-tuning in Offline-to-Online Reinforcement Learning for Robust Robot Control
di: Ayabe, Shingo, et al.
Pubblicazione: (2025)
di: Ayabe, Shingo, et al.
Pubblicazione: (2025)
Real-World Offline Reinforcement Learning from Vision Language Model Feedback
di: Venkataraman, Sreyas, et al.
Pubblicazione: (2024)
di: Venkataraman, Sreyas, et al.
Pubblicazione: (2024)
Incremental Residual Reinforcement Learning Toward Real-World Learning for Social Navigation
di: Nagahisa, Haruto, et al.
Pubblicazione: (2026)
di: Nagahisa, Haruto, et al.
Pubblicazione: (2026)
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes
di: Tang, Chen, et al.
Pubblicazione: (2024)
di: Tang, Chen, et al.
Pubblicazione: (2024)
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning
di: Zhang, Hongyin, et al.
Pubblicazione: (2023)
di: Zhang, Hongyin, et al.
Pubblicazione: (2023)
TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation
di: Xu, Qinwen, et al.
Pubblicazione: (2026)
di: Xu, Qinwen, et al.
Pubblicazione: (2026)
Towards Accessible Physical AI: LoRA-Based Fine-Tuning of VLA Models for Real-World Robot Control
di: Omaisan, Abdullah Yahya Abdullah, et al.
Pubblicazione: (2025)
di: Omaisan, Abdullah Yahya Abdullah, et al.
Pubblicazione: (2025)
Synthesis and Deployment of Maximal Robust Control Barrier Functions through Adversarial Reinforcement Learning
di: Oh, Donggeon David, et al.
Pubblicazione: (2026)
di: Oh, Donggeon David, et al.
Pubblicazione: (2026)
Tac2Real: Reliable and GPU Visuotactile Simulation for Online Reinforcement Learning and Zero-Shot Real-World Deployment
di: Yan, Ningyu, et al.
Pubblicazione: (2026)
di: Yan, Ningyu, et al.
Pubblicazione: (2026)
RUMOR: Reinforcement learning for Understanding a Model of the Real World for Navigation in Dynamic Environments
di: Martinez-Baselga, Diego, et al.
Pubblicazione: (2024)
di: Martinez-Baselga, Diego, et al.
Pubblicazione: (2024)
Towards Autonomous Reinforcement Learning for Real-World Robotic Manipulation with Large Language Models
di: Turcato, Niccolò, et al.
Pubblicazione: (2025)
di: Turcato, Niccolò, et al.
Pubblicazione: (2025)
CycleRL: Sim-to-Real Deep Reinforcement Learning for Robust Autonomous Bicycle Control
di: Liu, Gelu, et al.
Pubblicazione: (2026)
di: Liu, Gelu, et al.
Pubblicazione: (2026)
Efficiently Learning Robust Torque-based Locomotion Through Reinforcement with Model-Based Supervision
di: Yan, Yashuai, et al.
Pubblicazione: (2026)
di: Yan, Yashuai, et al.
Pubblicazione: (2026)
Satellite Chasers: Divergent Adversarial Reinforcement Learning to Engage Intelligent Adversaries on Orbit
di: Mehlman, Cameron, et al.
Pubblicazione: (2024)
di: Mehlman, Cameron, et al.
Pubblicazione: (2024)
Towards Practical World Model-based Reinforcement Learning for Vision-Language-Action Models
di: Zhang, Zhilong, et al.
Pubblicazione: (2026)
di: Zhang, Zhilong, et al.
Pubblicazione: (2026)
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models
di: Chen, Zhongxi, et al.
Pubblicazione: (2026)
di: Chen, Zhongxi, et al.
Pubblicazione: (2026)
DROP: Distributional and Regular Optimism and Pessimism for Reinforcement Learning
di: Kobayashi, Taisuke
Pubblicazione: (2024)
di: Kobayashi, Taisuke
Pubblicazione: (2024)
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Thanh, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Consolidated Adaptive T-soft Update for Deep Reinforcement Learning
di: Kobayashi, Taisuke
Pubblicazione: (2022) -
Real-time Sampling-based Model Predictive Control based on Reverse Kullback-Leibler Divergence and Its Adaptive Acceleration
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2022) -
Intentionally-underestimated Value Function at Terminal State for Temporal-difference Learning with Mis-designed Reward
di: Kobayashi, Taisuke
Pubblicazione: (2023) -
CubeDAgger: Interactive Imitation Learning for Dynamic Systems with Efficient yet Low-risk Interaction
di: Kobayashi, Taisuke
Pubblicazione: (2025) -
Towards Autonomous Driving of Personal Mobility with Small and Noisy Dataset using Tsallis-statistics-based Behavioral Cloning
di: Kobayashi, Taisuke, et al.
Pubblicazione: (2021)