Salvato in:
| Autori principali: | Yang, Lanyu, Jiang, Dongchun, Guo, Fuqiang, Fu, Mingjian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2406.17326 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Perspective Attention Mechanism for Bias-Aware Sequential Recommendation
di: Fu, Mingjian, et al.
Pubblicazione: (2025)
di: Fu, Mingjian, et al.
Pubblicazione: (2025)
Dilution, Diffusion and Symbiosis in Spatial Prisoner's Dilemma with Reinforcement Learning
di: Mangold, Gustavo C., et al.
Pubblicazione: (2025)
di: Mangold, Gustavo C., et al.
Pubblicazione: (2025)
When Trust Collides: Decoding Human-LLM Cooperation Dynamics through the Prisoner's Dilemma
di: Jiang, Guanxuan, et al.
Pubblicazione: (2025)
di: Jiang, Guanxuan, et al.
Pubblicazione: (2025)
Learning Lifted Action Models From Traces of Incomplete Actions and States
di: Jansen, Niklas, et al.
Pubblicazione: (2025)
di: Jansen, Niklas, et al.
Pubblicazione: (2025)
The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks
di: Cuadron, Alejandro, et al.
Pubblicazione: (2025)
di: Cuadron, Alejandro, et al.
Pubblicazione: (2025)
Learning Lifted Action Models from Traces with Minimal Information About Actions and States
di: Gösgens, Jonas, et al.
Pubblicazione: (2026)
di: Gösgens, Jonas, et al.
Pubblicazione: (2026)
Steganography in Game Actions
di: Chang, Ching-Chun, et al.
Pubblicazione: (2024)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2024)
Action-to-Action Flow Matching
di: Jia, Jindou, et al.
Pubblicazione: (2026)
di: Jia, Jindou, et al.
Pubblicazione: (2026)
LLMs for High-Frequency Decision-Making: Normalized Action Reward-Guided Consistency Policy Optimization
di: Zhao, Yang, et al.
Pubblicazione: (2026)
di: Zhao, Yang, et al.
Pubblicazione: (2026)
SAJA: A State-Action Joint Attack Framework on Multi-Agent Deep Reinforcement Learning
di: Guo, Weiqi, et al.
Pubblicazione: (2025)
di: Guo, Weiqi, et al.
Pubblicazione: (2025)
Discovering State Equivalences in UCT Search Trees By Action Pruning
di: Schmöcker, Robin, et al.
Pubblicazione: (2025)
di: Schmöcker, Robin, et al.
Pubblicazione: (2025)
On the Geometry of Reinforcement Learning in Continuous State and Action Spaces
di: Tiwari, Saket, et al.
Pubblicazione: (2022)
di: Tiwari, Saket, et al.
Pubblicazione: (2022)
State-Action Inpainting Diffuser for Continuous Control with Delay
di: Han, Dongqi, et al.
Pubblicazione: (2026)
di: Han, Dongqi, et al.
Pubblicazione: (2026)
Select before Act: Spatially Decoupled Action Repetition for Continuous Control
di: Nie, Buqing, et al.
Pubblicazione: (2025)
di: Nie, Buqing, et al.
Pubblicazione: (2025)
Algorithmic Collective Action with Multiple Collectives
di: Battiloro, Claudio, et al.
Pubblicazione: (2025)
di: Battiloro, Claudio, et al.
Pubblicazione: (2025)
Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse Reward
di: Yang, Jiarui, et al.
Pubblicazione: (2025)
di: Yang, Jiarui, et al.
Pubblicazione: (2025)
Android Coach: Improve Online Agentic Training Efficiency with Single State Multiple Actions
di: Gan, Guo, et al.
Pubblicazione: (2026)
di: Gan, Guo, et al.
Pubblicazione: (2026)
State-Novelty Guided Action Persistence in Deep Reinforcement Learning
di: Hu, Jianshu, et al.
Pubblicazione: (2024)
di: Hu, Jianshu, et al.
Pubblicazione: (2024)
Geometry of Neural Reinforcement Learning in Continuous State and Action Spaces
di: Tiwari, Saket, et al.
Pubblicazione: (2025)
di: Tiwari, Saket, et al.
Pubblicazione: (2025)
CombatVLA: An Efficient Vision-Language-Action Model for Combat Tasks in 3D Action Role-Playing Games
di: Chen, Peng, et al.
Pubblicazione: (2025)
di: Chen, Peng, et al.
Pubblicazione: (2025)
Evaluate-as-Action: Self-Evaluated Process Rewards for Retrieval-Augmented Agents
di: Shu, Jiangming, et al.
Pubblicazione: (2026)
di: Shu, Jiangming, et al.
Pubblicazione: (2026)
GROW: Aligning GRPO with State-Action Modeling for Open-World VLM Agents
di: Wu, Xiongbin, et al.
Pubblicazione: (2026)
di: Wu, Xiongbin, et al.
Pubblicazione: (2026)
From Forecasting to Planning: Policy World Model for Collaborative State-Action Prediction
di: Zhao, Zhida, et al.
Pubblicazione: (2025)
di: Zhao, Zhida, et al.
Pubblicazione: (2025)
ActionParty: Multi-Subject Action Binding in Generative Video Games
di: Pondaven, Alexander, et al.
Pubblicazione: (2026)
di: Pondaven, Alexander, et al.
Pubblicazione: (2026)
Planning Domain Model Acquisition from State Traces without Action Parameters
di: Balyo, Tomáš, et al.
Pubblicazione: (2024)
di: Balyo, Tomáš, et al.
Pubblicazione: (2024)
HIQL: Offline Goal-Conditioned RL with Latent States as Actions
di: Park, Seohong, et al.
Pubblicazione: (2023)
di: Park, Seohong, et al.
Pubblicazione: (2023)
NORA-1.5: A Vision-Language-Action Model Trained using World Model- and Action-based Preference Rewards
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model
di: Qu, Delin, et al.
Pubblicazione: (2025)
di: Qu, Delin, et al.
Pubblicazione: (2025)
SAGE: Steering Dialog Generation with Future-Aware State-Action Augmentation
di: Zhang, Yizhe, et al.
Pubblicazione: (2025)
di: Zhang, Yizhe, et al.
Pubblicazione: (2025)
Action-Free Offline-to-Online RL via Discretised State Policies
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2026)
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2026)
GroundAct: Can LLM Agents Ground Actions in Environmental States?
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
An Analysis of Action-Value Temporal-Difference Methods That Learn State Values
di: Daley, Brett, et al.
Pubblicazione: (2025)
di: Daley, Brett, et al.
Pubblicazione: (2025)
From Spatial to Actions: Grounding Vision-Language-Action Model in Spatial Foundation Priors
di: Zhang, Zhengshen, et al.
Pubblicazione: (2025)
di: Zhang, Zhengshen, et al.
Pubblicazione: (2025)
villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models
di: Chen, Xiaoyu, et al.
Pubblicazione: (2025)
di: Chen, Xiaoyu, et al.
Pubblicazione: (2025)
Low Dimensional State Representation Learning with Robotics Priors in Continuous Action Spaces
di: Botteghi, Nicolò, et al.
Pubblicazione: (2021)
di: Botteghi, Nicolò, et al.
Pubblicazione: (2021)
Evolution of Rewards for Food and Motor Action by Simulating Birth and Death
di: Kanagawa, Yuji, et al.
Pubblicazione: (2024)
di: Kanagawa, Yuji, et al.
Pubblicazione: (2024)
Hilbert-Guided Sparse Local Attention
di: Li, Yunge, et al.
Pubblicazione: (2025)
di: Li, Yunge, et al.
Pubblicazione: (2025)
Adaptive Segment-level Reward: Bridging the Gap Between Action and Reward Space in Alignment
di: Li, Yanshi, et al.
Pubblicazione: (2024)
di: Li, Yanshi, et al.
Pubblicazione: (2024)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Multi-Perspective Attention Mechanism for Bias-Aware Sequential Recommendation
di: Fu, Mingjian, et al.
Pubblicazione: (2025) -
Dilution, Diffusion and Symbiosis in Spatial Prisoner's Dilemma with Reinforcement Learning
di: Mangold, Gustavo C., et al.
Pubblicazione: (2025) -
When Trust Collides: Decoding Human-LLM Cooperation Dynamics through the Prisoner's Dilemma
di: Jiang, Guanxuan, et al.
Pubblicazione: (2025) -
Learning Lifted Action Models From Traces of Incomplete Actions and States
di: Jansen, Niklas, et al.
Pubblicazione: (2025) -
The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks
di: Cuadron, Alejandro, et al.
Pubblicazione: (2025)