Exploration with Foundation Models: Capabilities, Limitations, and Hybrid Approaches
Fuente:
arXiv
Guardado en:
| Autores principales: | Sasso, Remo, Conserva, Michelangelo, Jeurissen, Dominik, Rauber, Paulo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Foundation Models as World Models: A Foundational Study in Text-Based GridWorlds
por: Sasso, Remo, et al.
Publicado: (2025)
por: Sasso, Remo, et al.
Publicado: (2025)
AI Agents: Evolution, Architecture, and Real-World Applications
por: Krishnan, Naveen
Publicado: (2025)
por: Krishnan, Naveen
Publicado: (2025)
Adaptive Minds: Empowering Agents with LoRA-as-Tools
por: Shekar, Pavan C, et al.
Publicado: (2025)
por: Shekar, Pavan C, et al.
Publicado: (2025)
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
por: Mishra, Satyam, et al.
Publicado: (2025)
por: Mishra, Satyam, et al.
Publicado: (2025)
GoldenStart: Q-Guided Priors and Entropy Control for Distilling Flow Policies
por: Zhang, He, et al.
Publicado: (2026)
por: Zhang, He, et al.
Publicado: (2026)
Evolving machine learning workflows through interactive AutoML
por: Barbudo, Rafael, et al.
Publicado: (2024)
por: Barbudo, Rafael, et al.
Publicado: (2024)
Active Causal Experimentalist (ACE): Learning Intervention Strategies via Direct Preference Optimization
por: Cooper, Patrick, et al.
Publicado: (2026)
por: Cooper, Patrick, et al.
Publicado: (2026)
The Mirror Loop: Recursive Non-Convergence in Generative Reasoning Systems
por: DeVilling, Bentley
Publicado: (2025)
por: DeVilling, Bentley
Publicado: (2025)
Proving Olympiad Algebraic Inequalities without Human Demonstrations
por: Wei, Chenrui, et al.
Publicado: (2024)
por: Wei, Chenrui, et al.
Publicado: (2024)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
por: Vincze, Mátyás, et al.
Publicado: (2024)
por: Vincze, Mátyás, et al.
Publicado: (2024)
A Parallel Hybrid Action Space Reinforcement Learning Model for Real-world Adaptive Traffic Signal Control
por: Wang, Yuxuan, et al.
Publicado: (2025)
por: Wang, Yuxuan, et al.
Publicado: (2025)
STRIDE: A Self-Reflective Agent Framework for Reliable Automatic Equation Discovery
por: Su, Jiarui, et al.
Publicado: (2026)
por: Su, Jiarui, et al.
Publicado: (2026)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
por: Saini, Saurabh, et al.
Publicado: (2026)
por: Saini, Saurabh, et al.
Publicado: (2026)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
por: Yousaf, Iqra
Publicado: (2024)
por: Yousaf, Iqra
Publicado: (2024)
Streaming Continual Learning for Unified Adaptive Intelligence in Dynamic Environments
por: Giannini, Federico, et al.
Publicado: (2026)
por: Giannini, Federico, et al.
Publicado: (2026)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
por: Estevanell-Valladares, Ernesto L., et al.
Publicado: (2025)
por: Estevanell-Valladares, Ernesto L., et al.
Publicado: (2025)
SALE-Based Offline Reinforcement Learning with Ensemble Q-Networks
por: Chun, Zheng
Publicado: (2025)
por: Chun, Zheng
Publicado: (2025)
Task Memory Engine (TME): Enhancing State Awareness for Multi-Step LLM Agent Tasks
por: Ye, Ye
Publicado: (2025)
por: Ye, Ye
Publicado: (2025)
Can a Bayesian Oracle Prevent Harm from an Agent?
por: Bengio, Yoshua, et al.
Publicado: (2024)
por: Bengio, Yoshua, et al.
Publicado: (2024)
Diffusion-MPC in Discrete Domains: Feasibility Constraints, Horizon Effects, and Critic Alignment: Case study with Tetris
por: Wang, Haochuan Kevin
Publicado: (2026)
por: Wang, Haochuan Kevin
Publicado: (2026)
Constrained Auto-Bidding via Generative Response Modeling
por: Yang, Eunseok, et al.
Publicado: (2026)
por: Yang, Eunseok, et al.
Publicado: (2026)
Efficient Contextual Preferential Bayesian Optimization with Historical Examples
por: Khan, Farha A., et al.
Publicado: (2022)
por: Khan, Farha A., et al.
Publicado: (2022)
Modeling and Controlling Deployment Reliability under Temporal Distribution Shift
por: Rahman, Naimur, et al.
Publicado: (2026)
por: Rahman, Naimur, et al.
Publicado: (2026)
From Imitation to Interaction: Mastering Game of Schnapsen with Shallow Reinforcement Learning
por: Klačan, Ján, et al.
Publicado: (2026)
por: Klačan, Ján, et al.
Publicado: (2026)
On Divergence Measures for Training GFlowNets
por: da Silva, Tiago, et al.
Publicado: (2024)
por: da Silva, Tiago, et al.
Publicado: (2024)
Connectivity-Aware Representations for Constrained Motion Planning via Multi-Scale Contrastive Learning
por: Jeon, Suhyun, et al.
Publicado: (2026)
por: Jeon, Suhyun, et al.
Publicado: (2026)
Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models
por: Fu, Tianyu, et al.
Publicado: (2025)
por: Fu, Tianyu, et al.
Publicado: (2025)
A New Modeling to Feature Selection Based on the Fuzzy Rough Set Theory in Normal and Optimistic States on Hybrid Information Systems
por: Safarpour, Mohammad Hossein, et al.
Publicado: (2026)
por: Safarpour, Mohammad Hossein, et al.
Publicado: (2026)
Sketch Decompositions for Classical Planning via Deep Reinforcement Learning
por: Aichmüller, Michael, et al.
Publicado: (2024)
por: Aichmüller, Michael, et al.
Publicado: (2024)
LeanProgress: Guiding Search for Neural Theorem Proving via Proof Progress Prediction
por: George, Robert Joseph, et al.
Publicado: (2025)
por: George, Robert Joseph, et al.
Publicado: (2025)
NeSIG: A Neuro-Symbolic Method for Learning to Generate Planning Problems
por: Núñez-Molina, Carlos, et al.
Publicado: (2023)
por: Núñez-Molina, Carlos, et al.
Publicado: (2023)
Learning to Select Goals in Automated Planning with Deep-Q Learning
por: Núñez-Molina, Carlos, et al.
Publicado: (2024)
por: Núñez-Molina, Carlos, et al.
Publicado: (2024)
SuS: Strategy-aware Surprise for Intrinsic Exploration
por: Kashirskiy, Mark, et al.
Publicado: (2026)
por: Kashirskiy, Mark, et al.
Publicado: (2026)
Improving Hyperparameter Optimization with Checkpointed Model Weights
por: Mehta, Nikhil, et al.
Publicado: (2024)
por: Mehta, Nikhil, et al.
Publicado: (2024)
LLM-Assisted Iterative Evolution with Swarm Intelligence Toward SuperBrain
por: Weigang, Li, et al.
Publicado: (2025)
por: Weigang, Li, et al.
Publicado: (2025)
A Structural Threshold in Decision Capacity Governs Collapse in Self-Play Reinforcement Learning
por: Kujur, Arahan
Publicado: (2026)
por: Kujur, Arahan
Publicado: (2026)
Emotion-Inspired Learning Signals (EILS): A Homeostatic Framework for Adaptive Autonomous Agents
por: Tiwari, Dhruv
Publicado: (2025)
por: Tiwari, Dhruv
Publicado: (2025)
Statistical Guarantees for Lifelong Reinforcement Learning using PAC-Bayes Theory
por: Zhang, Zhi, et al.
Publicado: (2024)
por: Zhang, Zhi, et al.
Publicado: (2024)
A Comparison Between Decision Transformers and Traditional Offline Reinforcement Learning Algorithms
por: Caunhye, Ali Murtaza, et al.
Publicado: (2025)
por: Caunhye, Ali Murtaza, et al.
Publicado: (2025)
ASkDAgger: Active Skill-level Data Aggregation for Interactive Imitation Learning
por: Luijkx, Jelle, et al.
Publicado: (2025)
por: Luijkx, Jelle, et al.
Publicado: (2025)
Ejemplares similares
-
Foundation Models as World Models: A Foundational Study in Text-Based GridWorlds
por: Sasso, Remo, et al.
Publicado: (2025) -
AI Agents: Evolution, Architecture, and Real-World Applications
por: Krishnan, Naveen
Publicado: (2025) -
Adaptive Minds: Empowering Agents with LoRA-as-Tools
por: Shekar, Pavan C, et al.
Publicado: (2025) -
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
por: Mishra, Satyam, et al.
Publicado: (2025) -
GoldenStart: Q-Guided Priors and Entropy Control for Distilling Flow Policies
por: Zhang, He, et al.
Publicado: (2026)