TD-MPC-Opt: Distilling Model-Based Multi-Task Reinforcement Learning Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kuzmenko, Dmytro, Shvai, Nadiya |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Knowledge Transfer in Model-Based Reinforcement Learning Agents for Efficient Multi-Task Learning
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025)
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025)
MoIRA: Modular Instruction Routing Architecture for Multi-Task Robotics
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025)
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025)
When Robots Say No: The Empathic Ethical Disobedience Benchmark
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025)
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025)
Balancing Performance and Efficiency in Zero-shot Robotic Navigation
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2024)
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2024)
MisSynth: Improving MISSCI Logical Fallacies Classification with Synthetic Data
von: Poliakov, Mykhailo, et al.
Veröffentlicht: (2025)
von: Poliakov, Mykhailo, et al.
Veröffentlicht: (2025)
TD-M(PC)$^2$: Improving Temporal Difference MPC Through Policy Constraint
von: Lin, Haotian, et al.
Veröffentlicht: (2025)
von: Lin, Haotian, et al.
Veröffentlicht: (2025)
License Plate Images Generation with Diffusion Models
von: Shpir, Mariia, et al.
Veröffentlicht: (2025)
von: Shpir, Mariia, et al.
Veröffentlicht: (2025)
Reinforcement Learning via Auxiliary Task Distillation
von: Harish, Abhinav Narayan, et al.
Veröffentlicht: (2024)
von: Harish, Abhinav Narayan, et al.
Veröffentlicht: (2024)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
von: Pan, Minting, et al.
Veröffentlicht: (2023)
von: Pan, Minting, et al.
Veröffentlicht: (2023)
Multi-Task Reinforcement Learning for Quadrotors
von: Xing, Jiaxu, et al.
Veröffentlicht: (2024)
von: Xing, Jiaxu, et al.
Veröffentlicht: (2024)
TD-MPC2: Scalable, Robust World Models for Continuous Control
von: Hansen, Nicklas, et al.
Veröffentlicht: (2023)
von: Hansen, Nicklas, et al.
Veröffentlicht: (2023)
Hybrid DQN-TD3 Reinforcement Learning for Autonomous Navigation in Dynamic Environments
von: He, Xiaoyi, et al.
Veröffentlicht: (2025)
von: He, Xiaoyi, et al.
Veröffentlicht: (2025)
FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control
von: Seo, Younggyo, et al.
Veröffentlicht: (2025)
von: Seo, Younggyo, et al.
Veröffentlicht: (2025)
Multi-Agent Reinforcement Learning-Based UAV Pathfinding for Obstacle Avoidance in Stochastic Environment
von: Wu, Qizhen, et al.
Veröffentlicht: (2023)
von: Wu, Qizhen, et al.
Veröffentlicht: (2023)
Re4MPC: Reactive Nonlinear MPC for Multi-model Motion Planning via Deep Reinforcement Learning
von: Akmandor, Neşet Ünver, et al.
Veröffentlicht: (2025)
von: Akmandor, Neşet Ünver, et al.
Veröffentlicht: (2025)
MPC-based Deep Reinforcement Learning Method for Space Robotic Control with Fuel Sloshing Mitigation
von: Ramezani, Mahya, et al.
Veröffentlicht: (2025)
von: Ramezani, Mahya, et al.
Veröffentlicht: (2025)
Grammarization-Based Grasping with Deep Multi-Autoencoder Latent Space Exploration by Reinforcement Learning Agent
von: Askianakis, Leonidas
Veröffentlicht: (2024)
von: Askianakis, Leonidas
Veröffentlicht: (2024)
MPC-Inspired Reinforcement Learning for Verifiable Model-Free Control
von: Lu, Yiwen, et al.
Veröffentlicht: (2023)
von: Lu, Yiwen, et al.
Veröffentlicht: (2023)
Projected Task-Specific Layers for Multi-Task Reinforcement Learning
von: Roberts, Josselin Somerville, et al.
Veröffentlicht: (2023)
von: Roberts, Josselin Somerville, et al.
Veröffentlicht: (2023)
Flow-Opt: Scalable Centralized Multi-Robot Trajectory Optimization with Flow Matching and Differentiable Optimization
von: Idoko, Simon, et al.
Veröffentlicht: (2025)
von: Idoko, Simon, et al.
Veröffentlicht: (2025)
Distributionally Robust Multi-Agent Reinforcement Learning for Dynamic Chute Mapping
von: Liu, Guangyi, et al.
Veröffentlicht: (2025)
von: Liu, Guangyi, et al.
Veröffentlicht: (2025)
Safe Multi-Agent Reinforcement Learning with Bilevel Optimization in Autonomous Driving
von: Zheng, Zhi, et al.
Veröffentlicht: (2024)
von: Zheng, Zhi, et al.
Veröffentlicht: (2024)
PriPG-RL: Privileged Planner-Guided Reinforcement Learning for Partially Observable Systems with Anytime-Feasible MPC
von: Amiri, Mohsen, et al.
Veröffentlicht: (2026)
von: Amiri, Mohsen, et al.
Veröffentlicht: (2026)
SOMTP: Self-Supervised Learning-Based Optimizer for MPC-Based Safe Trajectory Planning Problems in Robotics
von: Liu, Yifan, et al.
Veröffentlicht: (2024)
von: Liu, Yifan, et al.
Veröffentlicht: (2024)
Efficient Multi-Task Reinforcement Learning via Task-Specific Action Correction
von: Feng, Jinyuan, et al.
Veröffentlicht: (2024)
von: Feng, Jinyuan, et al.
Veröffentlicht: (2024)
Safe Multi-Agent Navigation guided by Goal-Conditioned Safe Reinforcement Learning
von: Feng, Meng, et al.
Veröffentlicht: (2025)
von: Feng, Meng, et al.
Veröffentlicht: (2025)
Logical Specifications-guided Dynamic Task Sampling for Reinforcement Learning Agents
von: Shukla, Yash, et al.
Veröffentlicht: (2024)
von: Shukla, Yash, et al.
Veröffentlicht: (2024)
Multi-robot Path Planning and Scheduling via Model Predictive Optimal Transport (MPC-OT)
von: Khan, Usman A., et al.
Veröffentlicht: (2025)
von: Khan, Usman A., et al.
Veröffentlicht: (2025)
Dashing for the Golden Snitch: Multi-Drone Time-Optimal Motion Planning with Multi-Agent Reinforcement Learning
von: Wang, Xian, et al.
Veröffentlicht: (2024)
von: Wang, Xian, et al.
Veröffentlicht: (2024)
Knowledge-Guided Manipulation Using Multi-Task Reinforcement Learning
von: Narendra, Aditya, et al.
Veröffentlicht: (2026)
von: Narendra, Aditya, et al.
Veröffentlicht: (2026)
Autonomous Vehicle Lateral Control Using Deep Reinforcement Learning with MPC-PID Demonstration
von: Wu, Chengdong, et al.
Veröffentlicht: (2025)
von: Wu, Chengdong, et al.
Veröffentlicht: (2025)
MAGNNET: Multi-Agent Graph Neural Network-based Efficient Task Allocation for Autonomous Vehicles with Deep Reinforcement Learning
von: Ratnabala, Lavanya, et al.
Veröffentlicht: (2025)
von: Ratnabala, Lavanya, et al.
Veröffentlicht: (2025)
Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning
von: Bhardwaj, Arjun, et al.
Veröffentlicht: (2023)
von: Bhardwaj, Arjun, et al.
Veröffentlicht: (2023)
Random Network Distillation Based Deep Reinforcement Learning for AGV Path Planning
von: Yin, Huilin, et al.
Veröffentlicht: (2024)
von: Yin, Huilin, et al.
Veröffentlicht: (2024)
CoVO-MPC: Theoretical Analysis of Sampling-based MPC and Optimal Covariance Design
von: Yi, Zeji, et al.
Veröffentlicht: (2024)
von: Yi, Zeji, et al.
Veröffentlicht: (2024)
TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing
von: Li, Yuanpeng, et al.
Veröffentlicht: (2026)
von: Li, Yuanpeng, et al.
Veröffentlicht: (2026)
Differentiable Information Enhanced Model-Based Reinforcement Learning
von: Zhang, Xiaoyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaoyuan, et al.
Veröffentlicht: (2025)
Deep Reinforcement Learning for Haptic Shared Control in Unknown Tasks
von: Fernandez, Franklin Cardeñoso, et al.
Veröffentlicht: (2021)
von: Fernandez, Franklin Cardeñoso, et al.
Veröffentlicht: (2021)
M3PO: Massively Multi-Task Model-Based Policy Optimization
von: Narendra, Aditya, et al.
Veröffentlicht: (2025)
von: Narendra, Aditya, et al.
Veröffentlicht: (2025)
Toward Scalable Multirobot Control: Fast Policy Learning in Distributed MPC
von: Zhang, Xinglong, et al.
Veröffentlicht: (2024)
von: Zhang, Xinglong, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Knowledge Transfer in Model-Based Reinforcement Learning Agents for Efficient Multi-Task Learning
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025) -
MoIRA: Modular Instruction Routing Architecture for Multi-Task Robotics
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025) -
When Robots Say No: The Empathic Ethical Disobedience Benchmark
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2025) -
Balancing Performance and Efficiency in Zero-shot Robotic Navigation
von: Kuzmenko, Dmytro, et al.
Veröffentlicht: (2024) -
MisSynth: Improving MISSCI Logical Fallacies Classification with Synthetic Data
von: Poliakov, Mykhailo, et al.
Veröffentlicht: (2025)