Instruction Following with Goal-Conditioned Reinforcement Learning in Virtual Environments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Volovikova, Zoya, Skrynnik, Alexey, Kuderov, Petr, Panov, Aleksandr I. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CrafText Benchmark: Advancing Instruction Following in Complex Multimodal Open-Ended World
par: Volovikova, Zoya, et autres
Publié: (2025)
par: Volovikova, Zoya, et autres
Publié: (2025)
Self-Guided Plan Extraction for Instruction-Following Tasks with Goal-Conditional Reinforcement Learning
par: Volovikova, Zoya, et autres
Publié: (2026)
par: Volovikova, Zoya, et autres
Publié: (2026)
AmbiK: Dataset of Ambiguous Tasks in Kitchen Environment
par: Ivanova, Anastasiia, et autres
Publié: (2025)
par: Ivanova, Anastasiia, et autres
Publié: (2025)
Learning Successor Features with Distributed Hebbian Temporal Memory
par: Dzhivelikian, Evgenii, et autres
Publié: (2023)
par: Dzhivelikian, Evgenii, et autres
Publié: (2023)
CAMAR: Continuous Actions Multi-Agent Routing
par: Pshenitsyn, Artem, et autres
Publié: (2025)
par: Pshenitsyn, Artem, et autres
Publié: (2025)
MAPF-GPT: Imitation Learning for Multi-Agent Pathfinding at Scale
par: Andreychuk, Anton, et autres
Publié: (2024)
par: Andreychuk, Anton, et autres
Publié: (2024)
Revisiting Tree Search for LLMs: Gumbel and Sequential Halving for Budget-Scalable Reasoning
par: Ugadiarov, Leonid, et autres
Publié: (2026)
par: Ugadiarov, Leonid, et autres
Publié: (2026)
Advancing Learnable Multi-Agent Pathfinding Solvers with Active Fine-Tuning
par: Andreychuk, Anton, et autres
Publié: (2025)
par: Andreychuk, Anton, et autres
Publié: (2025)
MARL-GPT: Foundation Model for Multi-Agent Reinforcement Learning
par: Nesterova, Maria, et autres
Publié: (2026)
par: Nesterova, Maria, et autres
Publié: (2026)
LookPlanGraph: Embodied Instruction Following Method with VLM Graph Augmentation
par: Onishchenko, Anatoly O., et autres
Publié: (2025)
par: Onishchenko, Anatoly O., et autres
Publié: (2025)
POGEMA: A Benchmark Platform for Cooperative Multi-Agent Pathfinding
par: Skrynnik, Alexey, et autres
Publié: (2024)
par: Skrynnik, Alexey, et autres
Publié: (2024)
Memory Retention Is Not Enough to Master Memory Tasks in Reinforcement Learning
par: Shchendrigin, Oleg, et autres
Publié: (2026)
par: Shchendrigin, Oleg, et autres
Publié: (2026)
Memory, Benchmark & Robots: A Benchmark for Solving Complex Tasks with Reinforcement Learning
par: Cherepanov, Egor, et autres
Publié: (2025)
par: Cherepanov, Egor, et autres
Publié: (2025)
Learning to Communicate Locally for Large-Scale Multi-Agent Pathfinding
par: Vyaltsev, Valeriy, et autres
Publié: (2026)
par: Vyaltsev, Valeriy, et autres
Publié: (2026)
KAGE-Bench: Fast Known-Axis Visual Generalization Evaluation for Reinforcement Learning
par: Cherepanov, Egor, et autres
Publié: (2026)
par: Cherepanov, Egor, et autres
Publié: (2026)
A New Perspective on Transformers in Online Reinforcement Learning for Continuous Control
par: Kachaev, Nikita, et autres
Publié: (2025)
par: Kachaev, Nikita, et autres
Publié: (2025)
VerifyLLM: LLM-Based Pre-Execution Task Plan Verification for Robots
par: Grigorev, Danil S., et autres
Publié: (2025)
par: Grigorev, Danil S., et autres
Publié: (2025)
Recurrent Action Transformer with Memory
par: Cherepanov, Egor, et autres
Publié: (2023)
par: Cherepanov, Egor, et autres
Publié: (2023)
ELMUR: External Layer Memory with Update/Rewrite for Long-Horizon RL Problems
par: Cherepanov, Egor, et autres
Publié: (2025)
par: Cherepanov, Egor, et autres
Publié: (2025)
Safe Planning and Policy Optimization via World Model Learning
par: Latyshev, Artem, et autres
Publié: (2025)
par: Latyshev, Artem, et autres
Publié: (2025)
Symbolic Disentangled Representations for Images
par: Korchemnyi, Alexandr, et autres
Publié: (2024)
par: Korchemnyi, Alexandr, et autres
Publié: (2024)
Object-Centric Learning with Slot Mixture Module
par: Kirilenko, Daniil, et autres
Publié: (2023)
par: Kirilenko, Daniil, et autres
Publié: (2023)
Re:Frame -- Retrieving Experience From Associative Memory
par: Zelezetsky, Daniil, et autres
Publié: (2025)
par: Zelezetsky, Daniil, et autres
Publié: (2025)
Spatial Traces: Enhancing VLA Models with Spatial-Temporal Understanding
par: Patratskiy, Maxim A., et autres
Publié: (2025)
par: Patratskiy, Maxim A., et autres
Publié: (2025)
Knowledge-Guided Manipulation Using Multi-Task Reinforcement Learning
par: Narendra, Aditya, et autres
Publié: (2026)
par: Narendra, Aditya, et autres
Publié: (2026)
Goal-Conditioned Decision Transformer for Multi-Goal Offline Reinforcement Learning
par: Gajewski, Paweł, et autres
Publié: (2024)
par: Gajewski, Paweł, et autres
Publié: (2024)
Unraveling the Complexity of Memory in RL Agents: an Approach for Classification and Evaluation
par: Cherepanov, Egor, et autres
Publié: (2024)
par: Cherepanov, Egor, et autres
Publié: (2024)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
par: Wibault, Clarisse, et autres
Publié: (2026)
par: Wibault, Clarisse, et autres
Publié: (2026)
General Dynamic Goal Recognition using Goal-Conditioned and Meta Reinforcement Learning
par: Elhadad, Osher, et autres
Publié: (2025)
par: Elhadad, Osher, et autres
Publié: (2025)
Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization
par: Kachaev, Nikita, et autres
Publié: (2025)
par: Kachaev, Nikita, et autres
Publié: (2025)
SVL: Goal-Conditioned Reinforcement Learning as Survival Learning
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2026)
par: Tiofack, Franki Nguimatsia, et autres
Publié: (2026)
Relational Object-Centric Actor-Critic
par: Ugadiarov, Leonid, et autres
Publié: (2023)
par: Ugadiarov, Leonid, et autres
Publié: (2023)
Goal Exploration via Adaptive Skill Distribution for Goal-Conditioned Reinforcement Learning
par: Wu, Lisheng, et autres
Publié: (2024)
par: Wu, Lisheng, et autres
Publié: (2024)
Proposing Hierarchical Goal-Conditioned Policy Planning in Multi-Goal Reinforcement Learning
par: Rens, Gavin B.
Publié: (2025)
par: Rens, Gavin B.
Publié: (2025)
Embodied Instruction Following in Unknown Environments
par: Wu, Zhenyu, et autres
Publié: (2024)
par: Wu, Zhenyu, et autres
Publié: (2024)
VerIF: Verification Engineering for Reinforcement Learning in Instruction Following
par: Peng, Hao, et autres
Publié: (2025)
par: Peng, Hao, et autres
Publié: (2025)
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning
par: Huang, Xingshuai, et autres
Publié: (2024)
par: Huang, Xingshuai, et autres
Publié: (2024)
Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning
par: Chuck, Caleb, et autres
Publié: (2025)
par: Chuck, Caleb, et autres
Publié: (2025)
Goal-Conditioned Reinforcement Learning for Data-Driven Maritime Navigation
par: Vaidheeswaran, Vaishnav, et autres
Publié: (2025)
par: Vaidheeswaran, Vaishnav, et autres
Publié: (2025)
Object-Centric World Models Meet Monte Carlo Tree Search
par: Vakhitov, Rodion, et autres
Publié: (2026)
par: Vakhitov, Rodion, et autres
Publié: (2026)
Documents similaires
-
CrafText Benchmark: Advancing Instruction Following in Complex Multimodal Open-Ended World
par: Volovikova, Zoya, et autres
Publié: (2025) -
Self-Guided Plan Extraction for Instruction-Following Tasks with Goal-Conditional Reinforcement Learning
par: Volovikova, Zoya, et autres
Publié: (2026) -
AmbiK: Dataset of Ambiguous Tasks in Kitchen Environment
par: Ivanova, Anastasiia, et autres
Publié: (2025) -
Learning Successor Features with Distributed Hebbian Temporal Memory
par: Dzhivelikian, Evgenii, et autres
Publié: (2023) -
CAMAR: Continuous Actions Multi-Agent Routing
par: Pshenitsyn, Artem, et autres
Publié: (2025)