Learnable Behavior Control: Breaking Atari Human World Records via Sample-Efficient Behavior Selection
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Jiajun, Zhuang, Yuzheng, Liu, Yuecheng, Hao, Jianye, Wang, Bin, Zhu, Jiangcheng, Wang, Hao, Xia, Shu-Tao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow
di: Ma, Yueen, et al.
Pubblicazione: (2025)
di: Ma, Yueen, et al.
Pubblicazione: (2025)
A Survey on Vision-Language-Action Models for Embodied AI
di: Ma, Yueen, et al.
Pubblicazione: (2024)
di: Ma, Yueen, et al.
Pubblicazione: (2024)
CR-Eyes: A Computational Rational Model of Visual Sampling Behavior in Atari Games
di: Lorenz, Martin, et al.
Pubblicazione: (2026)
di: Lorenz, Martin, et al.
Pubblicazione: (2026)
ED2: Environment Dynamics Decomposition World Models for Continuous Control
di: Hao, Jianye, et al.
Pubblicazione: (2021)
di: Hao, Jianye, et al.
Pubblicazione: (2021)
Succeed or Learn Slowly: Sample Efficient Off-Policy Reinforcement Learning for Mobile App Control
di: Papoudakis, Georgios, et al.
Pubblicazione: (2025)
di: Papoudakis, Georgios, et al.
Pubblicazione: (2025)
Astra: Efficient Transformer Architecture and Contrastive Dynamics Learning for Embodied Instruction Following
di: Ma, Yueen, et al.
Pubblicazione: (2024)
di: Ma, Yueen, et al.
Pubblicazione: (2024)
MedDialBench: Benchmarking LLM Diagnostic Robustness under Parametric Adversarial Patient Behaviors
di: Luo, Xiaotian, et al.
Pubblicazione: (2026)
di: Luo, Xiaotian, et al.
Pubblicazione: (2026)
Controllable Diverse Sampling for Diffusion Based Motion Behavior Forecasting
di: Xu, Yiming, et al.
Pubblicazione: (2024)
di: Xu, Yiming, et al.
Pubblicazione: (2024)
EVLP:Learning Unified Embodied Vision-Language Planner with Reinforced Supervised Fine-Tuning
di: Cai, Xinyan, et al.
Pubblicazione: (2025)
di: Cai, Xinyan, et al.
Pubblicazione: (2025)
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
di: Dong, Zibin, et al.
Pubblicazione: (2023)
di: Dong, Zibin, et al.
Pubblicazione: (2023)
Learning to Play Atari in a World of Tokens
di: Agarwal, Pranav, et al.
Pubblicazione: (2024)
di: Agarwal, Pranav, et al.
Pubblicazione: (2024)
Probing the Impact of Scale on Data-Efficient, Generalist Transformer World Models for Atari
di: Kim, Jooyeon
Pubblicazione: (2026)
di: Kim, Jooyeon
Pubblicazione: (2026)
SCALE: Self-Correcting Visual Navigation for Mobile Robots via Anti-Novelty Estimation
di: Chen, Chang, et al.
Pubblicazione: (2024)
di: Chen, Chang, et al.
Pubblicazione: (2024)
Path planning for unmanned surface vehicle based on predictive artificial potential field. International Journal of Advanced Robotic Systems
di: Song, Jia, et al.
Pubblicazione: (2026)
di: Song, Jia, et al.
Pubblicazione: (2026)
Diffusion for World Modeling: Visual Details Matter in Atari
di: Alonso, Eloi, et al.
Pubblicazione: (2024)
di: Alonso, Eloi, et al.
Pubblicazione: (2024)
MotionLLM: Understanding Human Behaviors from Human Motions and Videos
di: Chen, Ling-Hao, et al.
Pubblicazione: (2024)
di: Chen, Ling-Hao, et al.
Pubblicazione: (2024)
OmniEVA: Embodied Versatile Planner via Task-Adaptive 3D-Grounded and Embodiment-aware Reasoning
di: Liu, Yuecheng, et al.
Pubblicazione: (2025)
di: Liu, Yuecheng, et al.
Pubblicazione: (2025)
HackAtari: Atari Learning Environments for Robust and Continual Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
Theory of Dielectric Behavior in Composites
di: Hao, Lifeng, et al.
Pubblicazione: (2025)
di: Hao, Lifeng, et al.
Pubblicazione: (2025)
Occlusion-Aware 3D Motion Interpretation for Abnormal Behavior Detection
di: Li, Su, et al.
Pubblicazione: (2024)
di: Li, Su, et al.
Pubblicazione: (2024)
Behavioral Authentication for Security and Safety
di: Wang, Cheng, et al.
Pubblicazione: (2023)
di: Wang, Cheng, et al.
Pubblicazione: (2023)
FastAnimate: Towards Learnable Template Construction and Pose Deformation for Fast 3D Human Avatar Animation
di: Shu, Jian, et al.
Pubblicazione: (2025)
di: Shu, Jian, et al.
Pubblicazione: (2025)
BTC-LLM: Efficient Sub-1-Bit LLM Quantization via Learnable Transformation and Binary Codebook
di: Gu, Hao, et al.
Pubblicazione: (2025)
di: Gu, Hao, et al.
Pubblicazione: (2025)
ET-Plan-Bench: Embodied Task-level Planning Benchmark Towards Spatial-Temporal Cognition with Foundation Models
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
di: Zhang, Lingfeng, et al.
Pubblicazione: (2024)
AutoSSVH: Exploring Automated Frame Sampling for Efficient Self-Supervised Video Hashing
di: Lian, Niu, et al.
Pubblicazione: (2025)
di: Lian, Niu, et al.
Pubblicazione: (2025)
Your Language Model Can Secretly Write Like Humans: Contrastive Paraphrase Attacks on LLM-Generated Text Detectors
di: Fang, Hao, et al.
Pubblicazione: (2025)
di: Fang, Hao, et al.
Pubblicazione: (2025)
SCB-Dataset3: A Benchmark for Detecting Student Classroom Behavior
di: Yang, Fan, et al.
Pubblicazione: (2023)
di: Yang, Fan, et al.
Pubblicazione: (2023)
Sample-Efficient Behavior Cloning Using General Domain Knowledge
di: Zhu, Feiyu, et al.
Pubblicazione: (2025)
di: Zhu, Feiyu, et al.
Pubblicazione: (2025)
More than A Point: Capturing Uncertainty with Adaptive Affordance Heatmaps for Spatial Grounding in Robotic Tasks
di: Shao, Xinyu, et al.
Pubblicazione: (2025)
di: Shao, Xinyu, et al.
Pubblicazione: (2025)
Offline Behavioral Data Selection
di: Lei, Shiye, et al.
Pubblicazione: (2025)
di: Lei, Shiye, et al.
Pubblicazione: (2025)
Atari-GPT: Benchmarking Multimodal Large Language Models as Low-Level Policies in Atari Games
di: Waytowich, Nicholas R., et al.
Pubblicazione: (2024)
di: Waytowich, Nicholas R., et al.
Pubblicazione: (2024)
QB-LIF: Learnable-Scale Quantized Burst Neurons for Efficient SNNs
di: Bai, Dewei, et al.
Pubblicazione: (2026)
di: Bai, Dewei, et al.
Pubblicazione: (2026)
Efficient Self-Supervised Video Hashing with Selective State Spaces
di: Wang, Jinpeng, et al.
Pubblicazione: (2024)
di: Wang, Jinpeng, et al.
Pubblicazione: (2024)
Optimal-Agent-Selection: State-Aware Routing Framework for Efficient Multi-Agent Collaboration
di: Wang, Jingbo, et al.
Pubblicazione: (2025)
di: Wang, Jingbo, et al.
Pubblicazione: (2025)
Towards Automatic Sampling of User Behaviors for Sequential Recommender Systems
di: Zhang, Hao, et al.
Pubblicazione: (2023)
di: Zhang, Hao, et al.
Pubblicazione: (2023)
Unexpected Crystallization Behavior of Polypropylene With Low Rubber Content
di: Hengyuan Zhang, et al.
Pubblicazione: (2026)
di: Hengyuan Zhang, et al.
Pubblicazione: (2026)
Generative Modeling for Adversarial Lane-Change Scenarios
di: Zhang, Chuancheng, et al.
Pubblicazione: (2025)
di: Zhang, Chuancheng, et al.
Pubblicazione: (2025)
SL-BiLEM: Structured Learnable Behavior-in-the-Loop Epidemic Modeling for Forecasting and Policy Evaluation
di: Wang, Haochun, et al.
Pubblicazione: (2026)
di: Wang, Haochun, et al.
Pubblicazione: (2026)
MMHU: A Massive-Scale Multimodal Benchmark for Human Behavior Understanding
di: Li, Renjie, et al.
Pubblicazione: (2025)
di: Li, Renjie, et al.
Pubblicazione: (2025)
Student Classroom Behavior Detection based on YOLOv7-BRA and Multi-Model Fusion
di: Yang, Fan, et al.
Pubblicazione: (2023)
di: Yang, Fan, et al.
Pubblicazione: (2023)
Documenti analoghi
-
3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow
di: Ma, Yueen, et al.
Pubblicazione: (2025) -
A Survey on Vision-Language-Action Models for Embodied AI
di: Ma, Yueen, et al.
Pubblicazione: (2024) -
CR-Eyes: A Computational Rational Model of Visual Sampling Behavior in Atari Games
di: Lorenz, Martin, et al.
Pubblicazione: (2026) -
ED2: Environment Dynamics Decomposition World Models for Continuous Control
di: Hao, Jianye, et al.
Pubblicazione: (2021) -
Succeed or Learn Slowly: Sample Efficient Off-Policy Reinforcement Learning for Mobile App Control
di: Papoudakis, Georgios, et al.
Pubblicazione: (2025)