ShuttleEnv: An Interactive Data-Driven RL Environment for Badminton Strategy Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Ang, Gong, Xinyang, Chen, Bozhou, Lu, Yunlong, Ji, Jiaming, Wang, Yongyi, Yang, Yaodong, Li, Wenxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
di: Wang, Yongyi, et al.
Pubblicazione: (2025)
di: Wang, Yongyi, et al.
Pubblicazione: (2025)
Decoupling Return-to-Go for Efficient Decision Transformer
di: Wang, Yongyi, et al.
Pubblicazione: (2026)
di: Wang, Yongyi, et al.
Pubblicazione: (2026)
Style-Preserving Policy Optimization for Game Agents
di: Li, Lingfeng, et al.
Pubblicazione: (2025)
di: Li, Lingfeng, et al.
Pubblicazione: (2025)
Beyond Autoregressive RTG: Conditioning via Injection Outside Sequential Modeling in Decision Transformer
di: Wang, Yongyi, et al.
Pubblicazione: (2026)
di: Wang, Yongyi, et al.
Pubblicazione: (2026)
One-Shot Badminton Shuttle Detection for Mobile Robots
di: Dipner, Florentin, et al.
Pubblicazione: (2026)
di: Dipner, Florentin, et al.
Pubblicazione: (2026)
Mxplainer: Explain and Learn Insights by Imitating Mahjong Agents
di: Li, Lingfeng, et al.
Pubblicazione: (2025)
di: Li, Lingfeng, et al.
Pubblicazione: (2025)
SortingEnv: An Extendable RL-Environment for an Industrial Sorting Process
di: Maus, Tom, et al.
Pubblicazione: (2025)
di: Maus, Tom, et al.
Pubblicazione: (2025)
Pareto-guided Pipeline for Distilling Featherweight AI Agents in Mobile MOBA Games
di: Yang, Xionghui, et al.
Pubblicazione: (2026)
di: Yang, Xionghui, et al.
Pubblicazione: (2026)
EnvFactory: Scaling Tool-Use Agents via Executable Environments Synthesis and Robust RL
di: Xu, Minrui, et al.
Pubblicazione: (2026)
di: Xu, Minrui, et al.
Pubblicazione: (2026)
Constructing Non-Markovian Decision Process via History Aggregator
di: Wang, Yongyi, et al.
Pubblicazione: (2025)
di: Wang, Yongyi, et al.
Pubblicazione: (2025)
SAE-V: Interpreting Multimodal Models for Enhanced Alignment
di: Lou, Hantao, et al.
Pubblicazione: (2025)
di: Lou, Hantao, et al.
Pubblicazione: (2025)
LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI
di: Wang, Jianan, et al.
Pubblicazione: (2026)
di: Wang, Jianan, et al.
Pubblicazione: (2026)
EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026)
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026)
ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents
di: Lu, Yuxing, et al.
Pubblicazione: (2026)
di: Lu, Yuxing, et al.
Pubblicazione: (2026)
Sequence to Sequence Reward Modeling: Improving RLHF by Language Feedback
di: Zhou, Jiayi, et al.
Pubblicazione: (2024)
di: Zhou, Jiayi, et al.
Pubblicazione: (2024)
Learning Human-Like Badminton Skills for Humanoid Robots
di: Chen, Yeke, et al.
Pubblicazione: (2026)
di: Chen, Yeke, et al.
Pubblicazione: (2026)
daVinci-Env: Open SWE Environment Synthesis at Scale
di: Fu, Dayuan, et al.
Pubblicazione: (2026)
di: Fu, Dayuan, et al.
Pubblicazione: (2026)
EnvGS: Modeling View-Dependent Appearance with Environment Gaussian
di: Xie, Tao, et al.
Pubblicazione: (2024)
di: Xie, Tao, et al.
Pubblicazione: (2024)
ClawEnvKit: Automatic Environment Generation for Claw-Like Agents
di: Li, Xirui, et al.
Pubblicazione: (2026)
di: Li, Xirui, et al.
Pubblicazione: (2026)
ResearchEnvBench: Benchmarking Agents on Environment Synthesis for Research Code Execution
di: Wang, Yubang, et al.
Pubblicazione: (2026)
di: Wang, Yubang, et al.
Pubblicazione: (2026)
DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback
di: Khan, Zaid, et al.
Pubblicazione: (2024)
di: Khan, Zaid, et al.
Pubblicazione: (2024)
ScaleEnv: Scaling Environment Synthesis from Scratch for Generalist Interactive Tool-Use Agent Training
di: Tu, Dunwei, et al.
Pubblicazione: (2026)
di: Tu, Dunwei, et al.
Pubblicazione: (2026)
World-Env: Leveraging World Model as a Virtual Environment for VLA Post-Training
di: Xiao, Junjin, et al.
Pubblicazione: (2025)
di: Xiao, Junjin, et al.
Pubblicazione: (2025)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
Adapting Rules of Official International Mahjong for Online Players
di: Wang, Chucai, et al.
Pubblicazione: (2026)
di: Wang, Chucai, et al.
Pubblicazione: (2026)
Mobile-Env: Building Qualified Evaluation Benchmarks for LLM-GUI Interaction
di: Zhang, Danyang, et al.
Pubblicazione: (2023)
di: Zhang, Danyang, et al.
Pubblicazione: (2023)
CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment
di: Kang, Li, et al.
Pubblicazione: (2026)
di: Kang, Li, et al.
Pubblicazione: (2026)
TrEnv-X: Transparently Share Serverless Execution Environments Across Different Functions and Nodes
di: Huang, Jialiang, et al.
Pubblicazione: (2025)
di: Huang, Jialiang, et al.
Pubblicazione: (2025)
The EnvDesign Model: A Method to Solve the Environment Design Problem
di: Sathiya, Akshay, et al.
Pubblicazione: (2024)
di: Sathiya, Akshay, et al.
Pubblicazione: (2024)
Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction
di: Lou, Hantao, et al.
Pubblicazione: (2025)
di: Lou, Hantao, et al.
Pubblicazione: (2025)
BadmintonGRF: A Multimodal Dataset and Benchmark for Markerless Ground Reaction Force Estimation in Badminton
di: Niu, Kuoye, et al.
Pubblicazione: (2026)
di: Niu, Kuoye, et al.
Pubblicazione: (2026)
EnvBench: A Benchmark for Automated Environment Setup
di: Eliseeva, Aleksandra, et al.
Pubblicazione: (2025)
di: Eliseeva, Aleksandra, et al.
Pubblicazione: (2025)
SafeDreamer: Safe Reinforcement Learning with World Models
di: Huang, Weidong, et al.
Pubblicazione: (2023)
di: Huang, Weidong, et al.
Pubblicazione: (2023)
ID-Align: RoPE-Conscious Position Remapping for Dynamic High-Resolution Adaptation in Vision-Language Models
di: Li, Bozhou, et al.
Pubblicazione: (2025)
di: Li, Bozhou, et al.
Pubblicazione: (2025)
SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence
di: Bu, Yuyan, et al.
Pubblicazione: (2026)
di: Bu, Yuyan, et al.
Pubblicazione: (2026)
EnvBridge: Bridging Diverse Environments with Cross-Environment Knowledge Transfer for Embodied AI
di: Kagaya, Tomoyuki, et al.
Pubblicazione: (2024)
di: Kagaya, Tomoyuki, et al.
Pubblicazione: (2024)
RedVLA: Physical Red Teaming for Vision-Language-Action Models
di: Zhang, Yuhao, et al.
Pubblicazione: (2026)
di: Zhang, Yuhao, et al.
Pubblicazione: (2026)
Language Models Resist Alignment: Evidence From Data Compression
di: Ji, Jiaming, et al.
Pubblicazione: (2024)
di: Ji, Jiaming, et al.
Pubblicazione: (2024)
GenEnv: Difficulty-Aligned Co-Evolution Between LLM Agents and Environment Simulators
di: Guo, Jiacheng, et al.
Pubblicazione: (2025)
di: Guo, Jiacheng, et al.
Pubblicazione: (2025)
SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning
di: Wang, Lichao, et al.
Pubblicazione: (2026)
di: Wang, Lichao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
di: Wang, Yongyi, et al.
Pubblicazione: (2025) -
Decoupling Return-to-Go for Efficient Decision Transformer
di: Wang, Yongyi, et al.
Pubblicazione: (2026) -
Style-Preserving Policy Optimization for Game Agents
di: Li, Lingfeng, et al.
Pubblicazione: (2025) -
Beyond Autoregressive RTG: Conditioning via Injection Outside Sequential Modeling in Decision Transformer
di: Wang, Yongyi, et al.
Pubblicazione: (2026) -
One-Shot Badminton Shuttle Detection for Mobile Robots
di: Dipner, Florentin, et al.
Pubblicazione: (2026)