RAMP: Hybrid DRL for Online Learning of Numeric Action Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Benyamin, Yarin, Mordoch, Argaman, Shperberg, Shahaf S., Stern, Roni |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Integrating Reinforcement Learning, Action Model Learning, and Numeric Planning for Tackling Complex Tasks
di: Benyamin, Yarin, et al.
Pubblicazione: (2025)
di: Benyamin, Yarin, et al.
Pubblicazione: (2025)
Toward PDDL Planning Copilot
di: Benyamin, Yarin, et al.
Pubblicazione: (2025)
di: Benyamin, Yarin, et al.
Pubblicazione: (2025)
Learning Safe Numeric Planning Action Models
di: Mordoch, Argaman, et al.
Pubblicazione: (2023)
di: Mordoch, Argaman, et al.
Pubblicazione: (2023)
EvoGPT: Leveraging LLM-Driven Seed Diversity to Improve Search-Based Test Suite Generation
di: Broide, Lior, et al.
Pubblicazione: (2025)
di: Broide, Lior, et al.
Pubblicazione: (2025)
Safe Learning of PDDL Domains with Conditional Effects -- Extended Version
di: Mordoch, Argaman, et al.
Pubblicazione: (2024)
di: Mordoch, Argaman, et al.
Pubblicazione: (2024)
From Kinematics to Dynamics: Learning to Refine Hybrid Plans for Physically Feasible Execution
di: Erez, Lidor, et al.
Pubblicazione: (2026)
di: Erez, Lidor, et al.
Pubblicazione: (2026)
Beyond Single-Step Updates: Reinforcement Learning of Heuristics with Limited-Horizon Search
di: Hadar, Gal, et al.
Pubblicazione: (2025)
di: Hadar, Gal, et al.
Pubblicazione: (2025)
On Parallel External-Memory Bidirectional Search
di: Siag, Lior, et al.
Pubblicazione: (2024)
di: Siag, Lior, et al.
Pubblicazione: (2024)
Bidirectional Bounded-Suboptimal Heuristic Search with Consistent Heuristics
di: Shperberg, Shahaf S., et al.
Pubblicazione: (2025)
di: Shperberg, Shahaf S., et al.
Pubblicazione: (2025)
A* Search Without Expansions: Learning Heuristic Functions with Deep Q-Networks
di: Agostinelli, Forest, et al.
Pubblicazione: (2021)
di: Agostinelli, Forest, et al.
Pubblicazione: (2021)
Planning and Acting While the Clock Ticks
di: Coles, Andrew, et al.
Pubblicazione: (2024)
di: Coles, Andrew, et al.
Pubblicazione: (2024)
Budget Allocation Policies for Real-Time Multi-Agent Path Finding
di: Beck, Raz, et al.
Pubblicazione: (2025)
di: Beck, Raz, et al.
Pubblicazione: (2025)
Optimal and Bounded Suboptimal Any-Angle Multi-agent Pathfinding
di: Yakovlev, Konstantin, et al.
Pubblicazione: (2024)
di: Yakovlev, Konstantin, et al.
Pubblicazione: (2024)
Benchmarks are Not Enough: RAMP for Runtime Assessing of Agentic Models in Production Systems
di: Ouyang, Yipeng, et al.
Pubblicazione: (2026)
di: Ouyang, Yipeng, et al.
Pubblicazione: (2026)
Algorithm Selection for Optimal Multi-Agent Path Finding via Graph Embedding
di: Shabalin, Carmel, et al.
Pubblicazione: (2024)
di: Shabalin, Carmel, et al.
Pubblicazione: (2024)
The Latency Wall: Benchmarking Off-the-Shelf Emotion Recognition for Real-Time Virtual Avatars
di: Benyamin, Yarin
Pubblicazione: (2026)
di: Benyamin, Yarin
Pubblicazione: (2026)
Real-DRL: Teach and Learn in Reality
di: Mao, Yanbing, et al.
Pubblicazione: (2025)
di: Mao, Yanbing, et al.
Pubblicazione: (2025)
Transient Multi-Agent Path Finding for Lifelong Navigation in Dense Environments
di: Morag, Jonathan, et al.
Pubblicazione: (2024)
di: Morag, Jonathan, et al.
Pubblicazione: (2024)
Enhancing Lifelong Multi-Agent Path-finding by Using Artificial Potential Fields
di: Pertzovsky, Arseniy, et al.
Pubblicazione: (2025)
di: Pertzovsky, Arseniy, et al.
Pubblicazione: (2025)
RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference
di: Gautam, Arpit Singh, et al.
Pubblicazione: (2026)
di: Gautam, Arpit Singh, et al.
Pubblicazione: (2026)
In-Context Learning Learns Label Relationships but Is Not Conventional Learning
di: Kossen, Jannik, et al.
Pubblicazione: (2023)
di: Kossen, Jannik, et al.
Pubblicazione: (2023)
DRL-Based RAT Selection in a Hybrid Vehicular Communication Network
di: Yacheur, Badreddine Yacine, et al.
Pubblicazione: (2024)
di: Yacheur, Badreddine Yacine, et al.
Pubblicazione: (2024)
Wittgenstein's Family Resemblance Clustering Algorithm
di: Amanpour, Golbahar, et al.
Pubblicazione: (2026)
di: Amanpour, Golbahar, et al.
Pubblicazione: (2026)
Temporal-Difference Variational Continual Learning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
FGeo-DRL: Deductive Reasoning for Geometric Problems through Deep Reinforcement Learning
di: Zou, Jia, et al.
Pubblicazione: (2024)
di: Zou, Jia, et al.
Pubblicazione: (2024)
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
Momentum-constrained Hybrid Heuristic Trajectory Optimization Framework with Residual-enhanced DRL for Visually Impaired Scenarios
di: Zeng, Yuting, et al.
Pubblicazione: (2025)
di: Zeng, Yuting, et al.
Pubblicazione: (2025)
TimeDRL: Disentangled Representation Learning for Multivariate Time-Series
di: Chang, Ching, et al.
Pubblicazione: (2023)
di: Chang, Ching, et al.
Pubblicazione: (2023)
Safe and Economical UAV Trajectory Planning in Low-Altitude Airspace: A Hybrid DRL-LLM Approach with Compliance Awareness
di: Gong, Yanwei, et al.
Pubblicazione: (2025)
di: Gong, Yanwei, et al.
Pubblicazione: (2025)
FedDRL: A Trustworthy Federated Learning Model Fusion Method Based on Staged Reinforcement Learning
di: Chen, Leiming, et al.
Pubblicazione: (2023)
di: Chen, Leiming, et al.
Pubblicazione: (2023)
HeSum: a Novel Dataset for Abstractive Text Summarization in Hebrew
di: Paz-Argaman, Tzuf, et al.
Pubblicazione: (2024)
di: Paz-Argaman, Tzuf, et al.
Pubblicazione: (2024)
FH-DRL: Exponential-Hyperbolic Frontier Heuristics with DRL for accelerated Exploration in Unknown Environments
di: Nam, Seunghyeop, et al.
Pubblicazione: (2024)
di: Nam, Seunghyeop, et al.
Pubblicazione: (2024)
DRL4AOI: A DRL Framework for Semantic-aware AOI Segmentation in Location-Based Services
di: Lin, Youfang, et al.
Pubblicazione: (2024)
di: Lin, Youfang, et al.
Pubblicazione: (2024)
Language Models Change Facts Based on the Way You Talk
di: Kearney, Matthew, et al.
Pubblicazione: (2025)
di: Kearney, Matthew, et al.
Pubblicazione: (2025)
Playing Angry Birds with a Domain-Independent PDDL+ Planner
di: Piotrowski, Wiktor, et al.
Pubblicazione: (2021)
di: Piotrowski, Wiktor, et al.
Pubblicazione: (2021)
Into the Unknown: Generating Geospatial Descriptions for New Environments
di: Paz-Argaman, Tzuf, et al.
Pubblicazione: (2024)
di: Paz-Argaman, Tzuf, et al.
Pubblicazione: (2024)
Multi-agent DRL-based Lane Change Decision Model for Cooperative Planning in Mixed Traffic
di: Mu, Zeyu, et al.
Pubblicazione: (2026)
di: Mu, Zeyu, et al.
Pubblicazione: (2026)
Parametrized Sharing for Multi-Agent Hybrid DRL for Multiple Multi-Functional RISs-Aided Downlink NOMA Networks
di: Kuo, Chi-Te, et al.
Pubblicazione: (2026)
di: Kuo, Chi-Te, et al.
Pubblicazione: (2026)
CVeDRL: An Efficient Code Verifier via Difficulty-aware Reinforcement Learning
di: Shi, Ji, et al.
Pubblicazione: (2026)
di: Shi, Ji, et al.
Pubblicazione: (2026)
Subgoaling Relaxation-based Heuristics for Numeric Planning with Infinite Actions
di: Aso-Mollar, Ángel, et al.
Pubblicazione: (2025)
di: Aso-Mollar, Ángel, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Integrating Reinforcement Learning, Action Model Learning, and Numeric Planning for Tackling Complex Tasks
di: Benyamin, Yarin, et al.
Pubblicazione: (2025) -
Toward PDDL Planning Copilot
di: Benyamin, Yarin, et al.
Pubblicazione: (2025) -
Learning Safe Numeric Planning Action Models
di: Mordoch, Argaman, et al.
Pubblicazione: (2023) -
EvoGPT: Leveraging LLM-Driven Seed Diversity to Improve Search-Based Test Suite Generation
di: Broide, Lior, et al.
Pubblicazione: (2025) -
Safe Learning of PDDL Domains with Conditional Effects -- Extended Version
di: Mordoch, Argaman, et al.
Pubblicazione: (2024)