A Review of Nine Physics Engines for Reinforcement Learning Research
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kaup, Michael, Wolff, Cornelius, Hwang, Hyerim, Mayer, Julius, Bruni, Elia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Strategy Masking: A Method for Guardrails in Value-based Reinforcement Learning Agents
par: Keane, Jonathan, et autres
Publié: (2025)
par: Keane, Jonathan, et autres
Publié: (2025)
The Station: An Open-World Environment for AI-Driven Discovery
par: Chung, Stephen, et autres
Publié: (2025)
par: Chung, Stephen, et autres
Publié: (2025)
Slipstream: Trajectory-Grounded Compaction Validation for Long-Horizon Agents
par: Chen, Zhuofu, et autres
Publié: (2026)
par: Chen, Zhuofu, et autres
Publié: (2026)
Decentralizing Coordination in Open Vehicle Fleets for Scalable and Dynamic Task Allocation
par: Lujak, Marin, et autres
Publié: (2024)
par: Lujak, Marin, et autres
Publié: (2024)
Cognition is All You Need -- The Next Layer of AI Above Large Language Models
par: Spivack, Nova, et autres
Publié: (2024)
par: Spivack, Nova, et autres
Publié: (2024)
Personality-Driven Decision-Making in LLM-Based Autonomous Agents
par: Newsham, Lewis, et autres
Publié: (2025)
par: Newsham, Lewis, et autres
Publié: (2025)
Value-Aware Multiagent Systems
par: Osman, Nardine
Publié: (2025)
par: Osman, Nardine
Publié: (2025)
DM$^2$: Decentralized Multi-Agent Reinforcement Learning for Distribution Matching
par: Wang, Caroline, et autres
Publié: (2022)
par: Wang, Caroline, et autres
Publié: (2022)
KnowThyself: An Agentic Assistant for LLM Interpretability
par: Prasai, Suraj, et autres
Publié: (2025)
par: Prasai, Suraj, et autres
Publié: (2025)
Empowering VLMs for Few-Shot Multimodal Time Series Classification via Tailored Agentic Reasoning
par: Li, Lin, et autres
Publié: (2026)
par: Li, Lin, et autres
Publié: (2026)
A computational framework for human values
par: Osman, Nardine, et autres
Publié: (2023)
par: Osman, Nardine, et autres
Publié: (2023)
A survey of air combat behavior modeling using machine learning
par: Gorton, Patrick Ribu, et autres
Publié: (2024)
par: Gorton, Patrick Ribu, et autres
Publié: (2024)
MATCH: Engineering Transparent and Controllable Conversational XAI Systems through Composable Building Blocks
par: Vanbrabant, Sebe, et autres
Publié: (2025)
par: Vanbrabant, Sebe, et autres
Publié: (2025)
Generating Causal Explanations of Vehicular Agent Behavioural Interactions with Learnt Reward Profiles
par: Howard, Rhys, et autres
Publié: (2025)
par: Howard, Rhys, et autres
Publié: (2025)
Solution Concepts in Hierarchical Games under Bounded Rationality with Applications to Autonomous Driving
par: Sarkar, Atrisha, et autres
Publié: (2020)
par: Sarkar, Atrisha, et autres
Publié: (2020)
Off-Policy Correction For Multi-Agent Reinforcement Learning
par: Zawalski, Michał, et autres
Publié: (2021)
par: Zawalski, Michał, et autres
Publié: (2021)
Pioneer Agent: Continual Improvement of Small Language Models in Production
par: Atreja, Dhruv, et autres
Publié: (2026)
par: Atreja, Dhruv, et autres
Publié: (2026)
Multi-Agent Systems Powered by Large Language Models: Applications in Swarm Intelligence
par: Jimenez-Romero, Cristian, et autres
Publié: (2025)
par: Jimenez-Romero, Cristian, et autres
Publié: (2025)
Communication Methods in Multi-Agent Reinforcement Learning
par: Wittner, Christoph
Publié: (2026)
par: Wittner, Christoph
Publié: (2026)
Multi-Agent Reinforcement Learning with Selective State-Space Models
par: Daniel, Jemma, et autres
Publié: (2024)
par: Daniel, Jemma, et autres
Publié: (2024)
Social Interpretable Reinforcement Learning
par: Custode, Leonardo Lucio, et autres
Publié: (2024)
par: Custode, Leonardo Lucio, et autres
Publié: (2024)
FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation
par: Jiang, Wenzheng, et autres
Publié: (2025)
par: Jiang, Wenzheng, et autres
Publié: (2025)
ReCoDe: Reinforcement Learning-based Dynamic Constraint Design for Multi-Agent Coordination
par: Amir, Michael, et autres
Publié: (2025)
par: Amir, Michael, et autres
Publié: (2025)
A Principle of Targeted Intervention for Multi-Agent Reinforcement Learning
par: Liu, Anjie, et autres
Publié: (2025)
par: Liu, Anjie, et autres
Publié: (2025)
Genflow Ad Studio: A Compound AI Architecture for Brand-Aligned, Self-Correcting Video Generation
par: Das, Debanshu, et autres
Publié: (2026)
par: Das, Debanshu, et autres
Publié: (2026)
Individual Contributions as Intrinsic Exploration Scaffolds for Multi-agent Reinforcement Learning
par: Li, Xinran, et autres
Publié: (2024)
par: Li, Xinran, et autres
Publié: (2024)
Risk-Sensitive Multi-Agent Reinforcement Learning in Network Aggregative Markov Games
par: Ghaemi, Hafez, et autres
Publié: (2024)
par: Ghaemi, Hafez, et autres
Publié: (2024)
Learning Actionable World Models for Industrial Process Control
par: Yan, Peng, et autres
Publié: (2025)
par: Yan, Peng, et autres
Publié: (2025)
Mean-Field Sampling for Cooperative Multi-Agent Reinforcement Learning
par: Anand, Emile, et autres
Publié: (2024)
par: Anand, Emile, et autres
Publié: (2024)
Information-Theoretic Measures in AI: A Practical Decision Guide
par: Papadopoulos, Nikolaos Al., et autres
Publié: (2026)
par: Papadopoulos, Nikolaos Al., et autres
Publié: (2026)
Interpretation, Learning, and Empathy as One Constraint: A Residual-Adequacy Architecture with Accountable Abstention
par: Amornbunchornvej, Chainarong
Publié: (2026)
par: Amornbunchornvej, Chainarong
Publié: (2026)
Interpretation as Linear Transformation: A Cognitive-Geometric Model of Belief and Meaning
par: Amornbunchornvej, Chainarong
Publié: (2025)
par: Amornbunchornvej, Chainarong
Publié: (2025)
A Hormetic Approach to the Value-Loading Problem: Preventing the Paperclip Apocalypse?
par: Henry, Nathan I. N., et autres
Publié: (2024)
par: Henry, Nathan I. N., et autres
Publié: (2024)
Deep Reinforcement Learning for Adverse Garage Scenario Generation
par: Li, Kai
Publié: (2024)
par: Li, Kai
Publié: (2024)
A Modular Cognitive Architecture for Assisted Reasoning: The Nemosine Framework
par: Melo, Edervaldo
Publié: (2025)
par: Melo, Edervaldo
Publié: (2025)
Graphon Mean-Field Subsampling for Cooperative Heterogeneous Multi-Agent Reinforcement Learning
par: Anand, Emile, et autres
Publié: (2026)
par: Anand, Emile, et autres
Publié: (2026)
LLM-augmented empirical game theoretic simulation for social-ecological systems
par: Shi, Jennifer, et autres
Publié: (2025)
par: Shi, Jennifer, et autres
Publié: (2025)
Benefits and Limitations of Communication in Multi-Agent Reasoning
par: Rizvi-Martel, Michael, et autres
Publié: (2025)
par: Rizvi-Martel, Michael, et autres
Publié: (2025)
Literature Review Of Multi-Agent Debate For Problem-Solving
par: Tillmann, Arne
Publié: (2025)
par: Tillmann, Arne
Publié: (2025)
LLM Wardens: Mitigating Adversarial Persuasion with Third-Party Conversational Oversight
par: Wachowiak, Lennart, et autres
Publié: (2026)
par: Wachowiak, Lennart, et autres
Publié: (2026)
Documents similaires
-
Strategy Masking: A Method for Guardrails in Value-based Reinforcement Learning Agents
par: Keane, Jonathan, et autres
Publié: (2025) -
The Station: An Open-World Environment for AI-Driven Discovery
par: Chung, Stephen, et autres
Publié: (2025) -
Slipstream: Trajectory-Grounded Compaction Validation for Long-Horizon Agents
par: Chen, Zhuofu, et autres
Publié: (2026) -
Decentralizing Coordination in Open Vehicle Fleets for Scalable and Dynamic Task Allocation
par: Lujak, Marin, et autres
Publié: (2024) -
Cognition is All You Need -- The Next Layer of AI Above Large Language Models
par: Spivack, Nova, et autres
Publié: (2024)