Real-Time Diffusion Policies for Games: Enhancing Consistency Policies with Q-Ensembles
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Ruoqi, Luo, Ziwei, Sjölund, Jens, Mattsson, Per, Gisslén, Linus, Sestini, Alessandro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Entropy-regularized Diffusion Policy with Q-Ensembles for Offline Reinforcement Learning
par: Zhang, Ruoqi, et autres
Publié: (2024)
par: Zhang, Ruoqi, et autres
Publié: (2024)
Self-correcting Reward Shaping via Language Models for Reinforcement Learning Agents in Games
par: Afonso, António, et autres
Publié: (2025)
par: Afonso, António, et autres
Publié: (2025)
Towards Better Sample Efficiency in Multi-Agent Reinforcement Learning via Exploration
par: Baghi, Amir, et autres
Publié: (2025)
par: Baghi, Amir, et autres
Publié: (2025)
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
par: Sestini, Alessandro, et autres
Publié: (2025)
par: Sestini, Alessandro, et autres
Publié: (2025)
Leveraging Large Language Models for Efficient Failure Analysis in Game Development
par: Marini, Leonardo, et autres
Publié: (2024)
par: Marini, Leonardo, et autres
Publié: (2024)
Reinforcement Learning for High-Level Strategic Control in Tower Defense Games
par: Bergdahl, Joakim, et autres
Publié: (2024)
par: Bergdahl, Joakim, et autres
Publié: (2024)
Using Deep Convolutional Neural Networks to Detect Rendered Glitches in Video Games
par: Ling, Carlos Garcia, et autres
Publié: (2024)
par: Ling, Carlos Garcia, et autres
Publié: (2024)
Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforcement Learning Approach
par: Sestini, Alessandro, et autres
Publié: (2025)
par: Sestini, Alessandro, et autres
Publié: (2025)
ManiCM: Real-time 3D Diffusion Policy via Consistency Model for Robotic Manipulation
par: Lu, Guanxing, et autres
Publié: (2024)
par: Lu, Guanxing, et autres
Publié: (2024)
Real-Time Iteration Scheme for Diffusion Policy
par: Duan, Yufei, et autres
Publié: (2025)
par: Duan, Yufei, et autres
Publié: (2025)
Improving Generalization in Game Agents with Data Augmentation in Imitation Learning
par: Yadgaroff, Derek, et autres
Publié: (2023)
par: Yadgaroff, Derek, et autres
Publié: (2023)
SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data
par: Romeo, Carlo, et autres
Publié: (2026)
par: Romeo, Carlo, et autres
Publié: (2026)
Consistency Policy: Accelerated Visuomotor Policies via Consistency Distillation
par: Prasad, Aaditya, et autres
Publié: (2024)
par: Prasad, Aaditya, et autres
Publié: (2024)
A Benchmark Environment for Offline Reinforcement Learning in Racing Games
par: Macaluso, Girolamo, et autres
Publié: (2024)
par: Macaluso, Girolamo, et autres
Publié: (2024)
Q-Policy: Quantum-Enhanced Policy Evaluation for Scalable Reinforcement Learning
par: Cherukuri, Kalyan, et autres
Publié: (2025)
par: Cherukuri, Kalyan, et autres
Publié: (2025)
An Enhanced Iterative Deepening Search Algorithm for the Unrestricted Container Rehandling Problem
par: Wang, Ruoqi, et autres
Publié: (2025)
par: Wang, Ruoqi, et autres
Publié: (2025)
From Off-Policy to On-Policy: Enhancing GUI Agents via Bi-level Expert-to-Policy Assimilation
par: Wang, Zezhou, et autres
Publié: (2026)
par: Wang, Zezhou, et autres
Publié: (2026)
Tool-Aided Evolutionary LLM for Generative Policy Toward Efficient Resource Management in Wireless Federated Learning
par: Tan, Chongyang, et autres
Publié: (2025)
par: Tan, Chongyang, et autres
Publié: (2025)
SPEQ: Offline Stabilization Phases for Efficient Q-Learning in High Update-To-Data Ratio Reinforcement Learning
par: Romeo, Carlo, et autres
Publié: (2025)
par: Romeo, Carlo, et autres
Publié: (2025)
Diffusion Fine-Tuning via Reparameterized Policy Gradient of the Soft Q-Function
par: Kang, Hyeongyu, et autres
Publié: (2025)
par: Kang, Hyeongyu, et autres
Publié: (2025)
FreqPolicy: Efficient Flow-based Visuomotor Policy via Frequency Consistency
par: Su, Yifei, et autres
Publié: (2025)
par: Su, Yifei, et autres
Publié: (2025)
Improving Conditional Level Generation using Automated Validation in Match-3 Games
par: Aylagas, Monica Villanueva, et autres
Publié: (2024)
par: Aylagas, Monica Villanueva, et autres
Publié: (2024)
LLM-Driven Policy Diffusion: Enhancing Generalization in Offline Reinforcement Learning
par: Zhang, Hanping, et autres
Publié: (2025)
par: Zhang, Hanping, et autres
Publié: (2025)
Imitation Learning of Correlated Policies in Stackelberg Games
par: Wang, Kuang-Da, et autres
Publié: (2025)
par: Wang, Kuang-Da, et autres
Publié: (2025)
Style-Preserving Policy Optimization for Game Agents
par: Li, Lingfeng, et autres
Publié: (2025)
par: Li, Lingfeng, et autres
Publié: (2025)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
par: Psenka, Michael, et autres
Publié: (2023)
par: Psenka, Michael, et autres
Publié: (2023)
Streaming Diffusion Policy: Fast Policy Synthesis with Variable Noise Diffusion Models
par: Høeg, Sigmund H., et autres
Publié: (2024)
par: Høeg, Sigmund H., et autres
Publié: (2024)
Salience-Invariant Consistent Policy Learning for Generalization in Visual Reinforcement Learning
par: Sun, Jingbo, et autres
Publié: (2025)
par: Sun, Jingbo, et autres
Publié: (2025)
Rethinking Policy Diversity in Ensemble Policy Gradient in Large-Scale Reinforcement Learning
par: Shitanda, Naoki, et autres
Publié: (2026)
par: Shitanda, Naoki, et autres
Publié: (2026)
Truth or Deceit? A Bayesian Decoding Game Enhances Consistency and Reliability
par: Zhang, Weitong, et autres
Publié: (2024)
par: Zhang, Weitong, et autres
Publié: (2024)
Real-Time Execution of Action Chunking Flow Policies
par: Black, Kevin, et autres
Publié: (2025)
par: Black, Kevin, et autres
Publié: (2025)
D2PPO: Diffusion Policy Policy Optimization with Dispersive Loss
par: Zou, Guowei, et autres
Publié: (2025)
par: Zou, Guowei, et autres
Publié: (2025)
Optimizing Sentence Embedding with Pseudo-Labeling and Model Ensembles: A Hierarchical Framework for Enhanced NLP Tasks
par: Liu, Ziwei, et autres
Publié: (2025)
par: Liu, Ziwei, et autres
Publié: (2025)
COPO: Consistency-Aware Policy Optimization
par: Han, Jinghang, et autres
Publié: (2025)
par: Han, Jinghang, et autres
Publié: (2025)
Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies
par: Li, Zhuoran, et autres
Publié: (2026)
par: Li, Zhuoran, et autres
Publié: (2026)
Ising on the Graph: Task-specific Graph Subsampling via the Ising Model
par: Bånkestad, Maria, et autres
Publié: (2024)
par: Bånkestad, Maria, et autres
Publié: (2024)
Formal Architecture Descriptors as Navigation Primitives for AI Coding Agents
par: Jin, Ruoqi
Publié: (2026)
par: Jin, Ruoqi
Publié: (2026)
Ternary Gamma Semirings: From Neural Implementation to Categorical Foundations
par: Sun, Ruoqi
Publié: (2026)
par: Sun, Ruoqi
Publié: (2026)
STEP: Warm-Started Visuomotor Policies with Spatiotemporal Consistency Prediction
par: Li, Jinhao, et autres
Publié: (2026)
par: Li, Jinhao, et autres
Publié: (2026)
Global Policy-Space Response Oracles for Two-Player Zero-Sum Games
par: Zhang, Junyu, et autres
Publié: (2026)
par: Zhang, Junyu, et autres
Publié: (2026)
Documents similaires
-
Entropy-regularized Diffusion Policy with Q-Ensembles for Offline Reinforcement Learning
par: Zhang, Ruoqi, et autres
Publié: (2024) -
Self-correcting Reward Shaping via Language Models for Reinforcement Learning Agents in Games
par: Afonso, António, et autres
Publié: (2025) -
Towards Better Sample Efficiency in Multi-Agent Reinforcement Learning via Exploration
par: Baghi, Amir, et autres
Publié: (2025) -
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
par: Sestini, Alessandro, et autres
Publié: (2025) -
Leveraging Large Language Models for Efficient Failure Analysis in Game Development
par: Marini, Leonardo, et autres
Publié: (2024)