Weber-Fechner Law in Temporal Difference learning derived from Control as Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Takahashi, Keiichiro, Kobayashi, Taisuke, Yamanokuchi, Tomoya, Matsubara, Takamitsu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Feasibility-aware Imitation Learning from Observations through a Hand-mounted Demonstration Interface
par: Takahashi, Kei, et autres
Publié: (2025)
par: Takahashi, Kei, et autres
Publié: (2025)
Intentionally-underestimated Value Function at Terminal State for Temporal-difference Learning with Mis-designed Reward
par: Kobayashi, Taisuke
Publié: (2023)
par: Kobayashi, Taisuke
Publié: (2023)
Disentangled Iterative Surface Fitting for Contact-stable Grasp Planning
par: Yamanokuchi, Tomoya, et autres
Publié: (2025)
par: Yamanokuchi, Tomoya, et autres
Publié: (2025)
BEAC: Imitating Complex Exploration and Task-oriented Behaviors for Invisible Object Nonprehensile Manipulation
par: Tahara, Hirotaka, et autres
Publié: (2025)
par: Tahara, Hirotaka, et autres
Publié: (2025)
Consolidated Adaptive T-soft Update for Deep Reinforcement Learning
par: Kobayashi, Taisuke
Publié: (2022)
par: Kobayashi, Taisuke
Publié: (2022)
CubeDAgger: Interactive Imitation Learning for Dynamic Systems with Efficient yet Low-risk Interaction
par: Kobayashi, Taisuke
Publié: (2025)
par: Kobayashi, Taisuke
Publié: (2025)
DISF: Disentangled Iterative Surface Fitting for Contact-stable Grasp Planning with Grasp Pose Alignment to the Object Center of Mass
par: Yamanokuchi, Tomoya, et autres
Publié: (2025)
par: Yamanokuchi, Tomoya, et autres
Publié: (2025)
Progressive-Resolution Policy Distillation: Leveraging Coarse-Resolution Simulations for Time-Efficient Fine-Resolution Policy Learning
par: Kadokawa, Yuki, et autres
Publié: (2024)
par: Kadokawa, Yuki, et autres
Publié: (2024)
Composite Gaussian Processes Flows for Learning Discontinuous Multimodal Policies
par: Wang, Shu-yuan, et autres
Publié: (2025)
par: Wang, Shu-yuan, et autres
Publié: (2025)
Domains as Objectives: Domain-Uncertainty-Aware Policy Optimization through Explicit Multi-Domain Convex Coverage Set Learning
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2024)
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2024)
Design of Restricted Normalizing Flow towards Arbitrary Stochastic Policy with Computational Efficiency
par: Kobayashi, Taisuke, et autres
Publié: (2024)
par: Kobayashi, Taisuke, et autres
Publié: (2024)
Variational Adaptive Noise and Dropout towards Stable Recurrent Neural Networks
par: Kobayashi, Taisuke, et autres
Publié: (2025)
par: Kobayashi, Taisuke, et autres
Publié: (2025)
Towards Autonomous Driving of Personal Mobility with Small and Noisy Dataset using Tsallis-statistics-based Behavioral Cloning
par: Kobayashi, Taisuke, et autres
Publié: (2021)
par: Kobayashi, Taisuke, et autres
Publié: (2021)
Self-Supervised Learning of Grasping Arbitrary Objects On-the-Move
par: Kiyokawa, Takuya, et autres
Publié: (2024)
par: Kiyokawa, Takuya, et autres
Publié: (2024)
Prolonging Tool Life: Learning Skillful Use of General-purpose Tools through Lifespan-guided Reinforcement Learning
par: Wu, Po-Yen, et autres
Publié: (2025)
par: Wu, Po-Yen, et autres
Publié: (2025)
ViSA: Visited-State Augmentation for Generalized Goal-Space Contrastive Reinforcement Learning
par: Nakamura, Issa, et autres
Publié: (2026)
par: Nakamura, Issa, et autres
Publié: (2026)
Pseudo-Quantized Actor-Critic Algorithm for Robustness to Noisy Temporal Difference Error
par: Kobayashi, Taisuke
Publié: (2026)
par: Kobayashi, Taisuke
Publié: (2026)
Feasibility-aware Imitation Learning from Observation with Multimodal Feedback
par: Takahashi, Kei, et autres
Publié: (2026)
par: Takahashi, Kei, et autres
Publié: (2026)
Incipient Slip Detection by Vibration Injection into Soft Sensor
par: Komeno, Naoto, et autres
Publié: (2024)
par: Komeno, Naoto, et autres
Publié: (2024)
Leveraging Demonstrator-perceived Precision for Safe Interactive Imitation Learning of Clearance-limited Tasks
par: Oh, Hanbit, et autres
Publié: (2024)
par: Oh, Hanbit, et autres
Publié: (2024)
Collision Probability Distribution Estimation via Temporal Difference Learning
par: Steinecker, Thomas, et autres
Publié: (2024)
par: Steinecker, Thomas, et autres
Publié: (2024)
Bi-VLA: Bilateral Control-Based Imitation Learning via Vision-Language Fusion for Action Generation
par: Kobayashi, Masato, et autres
Publié: (2025)
par: Kobayashi, Masato, et autres
Publié: (2025)
Physics-informed Temporal Difference Metric Learning for Robot Motion Planning
par: Ni, Ruiqi, et autres
Publié: (2025)
par: Ni, Ruiqi, et autres
Publié: (2025)
Temporal Difference Calibration in Sequential Tasks: Application to Vision-Language-Action Models
par: Francis-Meretzki, Shelly, et autres
Publié: (2026)
par: Francis-Meretzki, Shelly, et autres
Publié: (2026)
Real-World Robot Control by Deep Active Inference With a Temporally Hierarchical World Model
par: Fujii, Kentaro, et autres
Publié: (2025)
par: Fujii, Kentaro, et autres
Publié: (2025)
TD-M(PC)$^2$: Improving Temporal Difference MPC Through Policy Constraint
par: Lin, Haotian, et autres
Publié: (2025)
par: Lin, Haotian, et autres
Publié: (2025)
ASBI: Leveraging Informative Real-World Data for Active Black-Box Simulator Tuning
par: Kim, Gahee, et autres
Publié: (2025)
par: Kim, Gahee, et autres
Publié: (2025)
Dual Online Stein Variational Inference for Control and Dynamics
par: Barcelos, Lucas, et autres
Publié: (2021)
par: Barcelos, Lucas, et autres
Publié: (2021)
Hierarchical Policy Blending as Inference for Reactive Robot Control
par: Hansel, Kay, et autres
Publié: (2022)
par: Hansel, Kay, et autres
Publié: (2022)
Tracing Energy Flow: Learning Tactile-based Grasping Force Control to Prevent Slippage in Dynamic Object Interaction
par: Kuo, Cheng-Yu, et autres
Publié: (2025)
par: Kuo, Cheng-Yu, et autres
Publié: (2025)
LiRA: Light-Robust Adversary for Model-based Reinforcement Learning in Real World
par: Kobayashi, Taisuke
Publié: (2024)
par: Kobayashi, Taisuke
Publié: (2024)
Revisiting Experience Replayable Conditions
par: Kobayashi, Taisuke
Publié: (2024)
par: Kobayashi, Taisuke
Publié: (2024)
DROP: Distributional and Regular Optimism and Pessimism for Reinforcement Learning
par: Kobayashi, Taisuke
Publié: (2024)
par: Kobayashi, Taisuke
Publié: (2024)
Flexible Empowerment at Reasoning with Extended Best-of-N Sampling
par: Kobayashi, Taisuke
Publié: (2026)
par: Kobayashi, Taisuke
Publié: (2026)
Improvements of Dark Experience Replay and Reservoir Sampling towards Better Balance between Consolidation and Plasticity
par: Kobayashi, Taisuke
Publié: (2025)
par: Kobayashi, Taisuke
Publié: (2025)
Real-time Sampling-based Model Predictive Control based on Reverse Kullback-Leibler Divergence and Its Adaptive Acceleration
par: Kobayashi, Taisuke, et autres
Publié: (2022)
par: Kobayashi, Taisuke, et autres
Publié: (2022)
Cutting Sequence Diffuser: Sim-to-Real Transferable Planning for Object Shaping by Grinding
par: Hachimine, Takumi, et autres
Publié: (2024)
par: Hachimine, Takumi, et autres
Publié: (2024)
Reinforcement Learning of Flexible Policies for Symbolic Instructions with Adjustable Mapping Specifications
par: Hatanaka, Wataru, et autres
Publié: (2025)
par: Hatanaka, Wataru, et autres
Publié: (2025)
Cerebellar-Inspired Residual Control for Fault Recovery: From Inference-Time Adaptation to Structural Consolidation
par: Jayasinghe, Nethmi, et autres
Publié: (2026)
par: Jayasinghe, Nethmi, et autres
Publié: (2026)
Robust Sim-to-Real Cloth Untangling through Reduced-Resolution Observations via Adaptive Force-Difference Quantization
par: Tsurumine, Yoshihisa, et autres
Publié: (2026)
par: Tsurumine, Yoshihisa, et autres
Publié: (2026)
Documents similaires
-
Feasibility-aware Imitation Learning from Observations through a Hand-mounted Demonstration Interface
par: Takahashi, Kei, et autres
Publié: (2025) -
Intentionally-underestimated Value Function at Terminal State for Temporal-difference Learning with Mis-designed Reward
par: Kobayashi, Taisuke
Publié: (2023) -
Disentangled Iterative Surface Fitting for Contact-stable Grasp Planning
par: Yamanokuchi, Tomoya, et autres
Publié: (2025) -
BEAC: Imitating Complex Exploration and Task-oriented Behaviors for Invisible Object Nonprehensile Manipulation
par: Tahara, Hirotaka, et autres
Publié: (2025) -
Consolidated Adaptive T-soft Update for Deep Reinforcement Learning
par: Kobayashi, Taisuke
Publié: (2022)