Thinker: Learning to Think Fast and Slow
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chung, Stephen, Du, Wenyu, Fu, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicting Future Actions of Reinforcement Learning Agents
par: Chung, Stephen, et autres
Publié: (2024)
par: Chung, Stephen, et autres
Publié: (2024)
Improving Industrial Injection Molding Processes with Explainable AI for Quality Classification
par: Rottenwalter, Georg, et autres
Publié: (2025)
par: Rottenwalter, Georg, et autres
Publié: (2025)
Novel Approaches to Artificial Intelligence Development Based on the Nearest Neighbor Method
par: Priezzhev, I. I., et autres
Publié: (2025)
par: Priezzhev, I. I., et autres
Publié: (2025)
Advancements in synthetic data extraction for industrial injection molding
par: Rottenwalter, Georg, et autres
Publié: (2025)
par: Rottenwalter, Georg, et autres
Publié: (2025)
LakeMLB: Data Lake Machine Learning Benchmark
par: Pan, Feiyu, et autres
Publié: (2026)
par: Pan, Feiyu, et autres
Publié: (2026)
LEFT: Learnable Fusion of Tri-view Tokens for Unsupervised Time Series Anomaly Detection
par: Wang, Dezheng, et autres
Publié: (2026)
par: Wang, Dezheng, et autres
Publié: (2026)
DGTEN: A Robust Deep Gaussian based Graph Neural Network for Dynamic Trust Evaluation with Uncertainty-Quantification Support
par: Usman, Muhammad, et autres
Publié: (2025)
par: Usman, Muhammad, et autres
Publié: (2025)
Soft Actor-Critic with Beta Policy via Implicit Reparameterization Gradients
par: Della Libera, Luca
Publié: (2024)
par: Della Libera, Luca
Publié: (2024)
RHiOTS: A Framework for Evaluating Hierarchical Time Series Forecasting Algorithms
par: Roque, Luis, et autres
Publié: (2024)
par: Roque, Luis, et autres
Publié: (2024)
On Divergence Measures for Training GFlowNets
par: da Silva, Tiago, et autres
Publié: (2024)
par: da Silva, Tiago, et autres
Publié: (2024)
Learning, Fast and Slow: Towards LLMs That Adapt Continually
par: Tiwari, Rishabh, et autres
Publié: (2026)
par: Tiwari, Rishabh, et autres
Publié: (2026)
CellARC: Measuring Intelligence with Cellular Automata
par: Lžičař, Miroslav
Publié: (2025)
par: Lžičař, Miroslav
Publié: (2025)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
Deep Policy Iteration with Integer Programming for Inventory Management
par: Harsha, Pavithra, et autres
Publié: (2021)
par: Harsha, Pavithra, et autres
Publié: (2021)
Evading Overlapping Community Detection via Proxy Node Injection
par: Loi, Dario, et autres
Publié: (2025)
par: Loi, Dario, et autres
Publié: (2025)
How to Choose a Reinforcement-Learning Algorithm
par: Bongratz, Fabian, et autres
Publié: (2024)
par: Bongratz, Fabian, et autres
Publié: (2024)
FDQN: A Flexible Deep Q-Network Framework for Game Automation
par: Gujavarthy, Prabhath Reddy
Publié: (2024)
par: Gujavarthy, Prabhath Reddy
Publié: (2024)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
par: Silue, Bram, et autres
Publié: (2025)
par: Silue, Bram, et autres
Publié: (2025)
Adaptive Negative Scheduling for Graph Contrastive Learning
par: Ali, Adnan, et autres
Publié: (2026)
par: Ali, Adnan, et autres
Publié: (2026)
Fast and Precise: Adjusting Planning Horizon with Adaptive Subgoal Search
par: Zawalski, Michał, et autres
Publié: (2022)
par: Zawalski, Michał, et autres
Publié: (2022)
Scalable Nested Optimization for Deep Learning
par: Lorraine, Jonathan
Publié: (2024)
par: Lorraine, Jonathan
Publié: (2024)
Neural Reasoning Networks: Efficient Interpretable Neural Networks With Automatic Textual Explanations
par: Carrow, Stephen, et autres
Publié: (2024)
par: Carrow, Stephen, et autres
Publié: (2024)
Out of Distribution Detection for Efficient Continual Learning in Quality Prediction for Arc Welding
par: Hahn, Yannik, et autres
Publié: (2025)
par: Hahn, Yannik, et autres
Publié: (2025)
The Impact of Data Characteristics on GNN Evaluation for Detecting Fake News
par: Karn, Isha, et autres
Publié: (2025)
par: Karn, Isha, et autres
Publié: (2025)
Less is More: Learning Graph Tasks with Just LLMs
par: Shirai, Sola, et autres
Publié: (2025)
par: Shirai, Sola, et autres
Publié: (2025)
Score-informed Neural Operator for Enhancing Ordering-based Causal Discovery
par: Kang, Jiyeon, et autres
Publié: (2025)
par: Kang, Jiyeon, et autres
Publié: (2025)
Augmenting Replay in World Models for Continual Reinforcement Learning
par: Yang, Luke, et autres
Publié: (2024)
par: Yang, Luke, et autres
Publié: (2024)
What Do World Models Learn in RL? Probing Latent Representations in Learned Environment Simulators
par: Zhang, Xinyu
Publié: (2026)
par: Zhang, Xinyu
Publié: (2026)
Working Paper: Active Causal Structure Learning with Latent Variables: Towards Learning to Detour in Autonomous Robots
par: Riscos, Pablo de los, et autres
Publié: (2024)
par: Riscos, Pablo de los, et autres
Publié: (2024)
QuIDE: Mastering the Quantized Intelligence Trade-off via Active Optimization
par: Jiang, Xiantao
Publié: (2026)
par: Jiang, Xiantao
Publié: (2026)
GCAD: Anomaly Detection in Multivariate Time Series from the Perspective of Granger Causality
par: Liu, Zehao, et autres
Publié: (2025)
par: Liu, Zehao, et autres
Publié: (2025)
Optimizing Robustness and Accuracy in Mixture of Experts: A Dual-Model Approach
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
Entropy Causal Graphs for Multivariate Time Series Anomaly Detection
par: Febrinanto, Falih Gozi, et autres
Publié: (2023)
par: Febrinanto, Falih Gozi, et autres
Publié: (2023)
Safe Reinforcement Learning with Preference-based Constraint Inference
par: Li, Chenglin, et autres
Publié: (2026)
par: Li, Chenglin, et autres
Publié: (2026)
Adaptable Hindsight Experience Replay for Search-Based Learning
par: Vazaios, Alexandros, et autres
Publié: (2025)
par: Vazaios, Alexandros, et autres
Publié: (2025)
CORE: Towards Scalable and Efficient Causal Discovery with Reinforcement Learning
par: Sauter, Andreas W. M., et autres
Publié: (2024)
par: Sauter, Andreas W. M., et autres
Publié: (2024)
Adaptive Activation Cancellation for Hallucination Mitigation in Large Language Models
par: Yocam, Eric, et autres
Publié: (2026)
par: Yocam, Eric, et autres
Publié: (2026)
Differentiable Symbolic Planning: A Neural Architecture for Constraint Reasoning with Learned Feasibility
par: Oruganti, Venkatakrishna Reddy
Publié: (2026)
par: Oruganti, Venkatakrishna Reddy
Publié: (2026)
Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems
par: Nuzhin, Egor E., et autres
Publié: (2024)
par: Nuzhin, Egor E., et autres
Publié: (2024)
GIRL: Generative Imagination Reinforcement Learning via Information-Theoretic Hallucination Control
par: Hiremath, Prakul Sunil
Publié: (2026)
par: Hiremath, Prakul Sunil
Publié: (2026)
Documents similaires
-
Predicting Future Actions of Reinforcement Learning Agents
par: Chung, Stephen, et autres
Publié: (2024) -
Improving Industrial Injection Molding Processes with Explainable AI for Quality Classification
par: Rottenwalter, Georg, et autres
Publié: (2025) -
Novel Approaches to Artificial Intelligence Development Based on the Nearest Neighbor Method
par: Priezzhev, I. I., et autres
Publié: (2025) -
Advancements in synthetic data extraction for industrial injection molding
par: Rottenwalter, Georg, et autres
Publié: (2025) -
LakeMLB: Data Lake Machine Learning Benchmark
par: Pan, Feiyu, et autres
Publié: (2026)