Federated Distributional Reinforcement Learning with Distributional Critic Regularization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Millard, David, Alm, Cecilia, Ali, Rashid, Shi, Pengcheng, Baheri, Ali |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Comparison Between Decision Transformers and Traditional Offline Reinforcement Learning Algorithms
par: Caunhye, Ali Murtaza, et autres
Publié: (2025)
par: Caunhye, Ali Murtaza, et autres
Publié: (2025)
Adaptive Negative Scheduling for Graph Contrastive Learning
par: Ali, Adnan, et autres
Publié: (2026)
par: Ali, Adnan, et autres
Publié: (2026)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
par: Saini, Saurabh, et autres
Publié: (2026)
par: Saini, Saurabh, et autres
Publié: (2026)
Function-Valued Causal Influence in Nonlinear Time Series
par: Kuskova, Valentina V., et autres
Publié: (2026)
par: Kuskova, Valentina V., et autres
Publié: (2026)
Conditional Temporal Neural Processes with Covariance Loss
par: Yoo, Boseon, et autres
Publié: (2025)
par: Yoo, Boseon, et autres
Publié: (2025)
KL-Regularised Q-Learning: A Token-level Action-Value perspective on Online RLHF
par: Brown, Jason R, et autres
Publié: (2025)
par: Brown, Jason R, et autres
Publié: (2025)
Emotion-Inspired Learning Signals (EILS): A Homeostatic Framework for Adaptive Autonomous Agents
par: Tiwari, Dhruv
Publié: (2025)
par: Tiwari, Dhruv
Publié: (2025)
Learning from Preferences and Mixed Demonstrations in General Settings
par: Brown, Jason R, et autres
Publié: (2025)
par: Brown, Jason R, et autres
Publié: (2025)
From Imitation to Interaction: Mastering Game of Schnapsen with Shallow Reinforcement Learning
par: Klačan, Ján, et autres
Publié: (2026)
par: Klačan, Ján, et autres
Publié: (2026)
The Impact of Data Characteristics on GNN Evaluation for Detecting Fake News
par: Karn, Isha, et autres
Publié: (2025)
par: Karn, Isha, et autres
Publié: (2025)
CellARC: Measuring Intelligence with Cellular Automata
par: Lžičař, Miroslav
Publié: (2025)
par: Lžičař, Miroslav
Publié: (2025)
Scalable Heterogeneous Graph Foundation Models for Data-Driven Optimal Power Flow in Smart Grids
par: Pasini, Massimiliano Lupo, et autres
Publié: (2026)
par: Pasini, Massimiliano Lupo, et autres
Publié: (2026)
Navigating WebAI: Training Agents to Complete Web Tasks with Large Language Models and Reinforcement Learning
par: Thil, Lucas-Andreï, et autres
Publié: (2024)
par: Thil, Lucas-Andreï, et autres
Publié: (2024)
On the Fundamental Limitations of Decentralized Learnable Reward Shaping in Cooperative Multi-Agent Reinforcement Learning
par: Akella, Aditya
Publié: (2025)
par: Akella, Aditya
Publié: (2025)
Streaming Continual Learning for Unified Adaptive Intelligence in Dynamic Environments
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation
par: Osman, Asim, et autres
Publié: (2026)
par: Osman, Asim, et autres
Publié: (2026)
From Heuristics to Data: Quantifying Site Planning Layout Indicators with Deep Learning and Multi-Modal Data
par: Cao, Qian, et autres
Publié: (2025)
par: Cao, Qian, et autres
Publié: (2025)
Normalisation and Initialisation Strategies for Graph Neural Networks in Blockchain Anomaly Detection
par: Duy, Dang Sy, et autres
Publié: (2026)
par: Duy, Dang Sy, et autres
Publié: (2026)
When Does Global Attention Help? A Unified Empirical Study on Atomistic Graph Learning
par: Chowdhury, Arindam, et autres
Publié: (2025)
par: Chowdhury, Arindam, et autres
Publié: (2025)
CogniLoad: A Synthetic Natural Language Reasoning Benchmark With Tunable Length, Intrinsic Difficulty, and Distractor Density
par: Kaiser, Daniel, et autres
Publié: (2025)
par: Kaiser, Daniel, et autres
Publié: (2025)
SMOSE: Sparse Mixture of Shallow Experts for Interpretable Reinforcement Learning in Continuous Control Tasks
par: Vincze, Mátyás, et autres
Publié: (2024)
par: Vincze, Mátyás, et autres
Publié: (2024)
Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models
par: Fu, Tianyu, et autres
Publié: (2025)
par: Fu, Tianyu, et autres
Publié: (2025)
Modeling and Controlling Deployment Reliability under Temporal Distribution Shift
par: Rahman, Naimur, et autres
Publié: (2026)
par: Rahman, Naimur, et autres
Publié: (2026)
Learning Morphisms with Gauss-Newton Approximation for Growing Networks
par: Lawton, Neal, et autres
Publié: (2024)
par: Lawton, Neal, et autres
Publié: (2024)
UWM-JEPA: Predictive World Models That Imagine in Belief Space
par: Radha, Santosh Kumar, et autres
Publié: (2026)
par: Radha, Santosh Kumar, et autres
Publié: (2026)
iLTM: Integrated Large Tabular Model
par: Bonet, David, et autres
Publié: (2025)
par: Bonet, David, et autres
Publié: (2025)
Effective High-order Graph Representation Learning for Credit Card Fraud Detection
par: Zou, Yao, et autres
Publié: (2025)
par: Zou, Yao, et autres
Publié: (2025)
Improving LLM Agent Planning with In-Context Learning via Atomic Fact Augmentation and Lookahead Search
par: Holt, Samuel, et autres
Publié: (2025)
par: Holt, Samuel, et autres
Publié: (2025)
MSMixer: Learned Multi-Scale Temporal Mixing with Complementary Linear Shortcut for Long-Term Time Series Forecasting
par: Cherif, Ahmed
Publié: (2026)
par: Cherif, Ahmed
Publié: (2026)
SafeRL-Lite: A Lightweight, Explainable, and Constrained Reinforcement Learning Library
par: Mishra, Satyam, et autres
Publié: (2025)
par: Mishra, Satyam, et autres
Publié: (2025)
Semantic-Constrained Federated Aggregation: Convergence Theory and Privacy-Utility Bounds for Knowledge-Enhanced Distributed Learning
par: Arafat, Jahidul
Publié: (2025)
par: Arafat, Jahidul
Publié: (2025)
The two clocks and the innovation window: When and how generative models learn rules
par: Wang, Binxu, et autres
Publié: (2026)
par: Wang, Binxu, et autres
Publié: (2026)
KGMark: A Diffusion Watermark for Knowledge Graphs
par: Peng, Hongrui, et autres
Publié: (2025)
par: Peng, Hongrui, et autres
Publié: (2025)
Wake-Informed 3D Path Planning for Autonomous Underwater Vehicles Using A* and Neural Network Approximations
par: Cooper-Baldock, Zachary, et autres
Publié: (2025)
par: Cooper-Baldock, Zachary, et autres
Publié: (2025)
Improving Efficiency of Sampling-based Motion Planning via Message-Passing Monte Carlo
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
SuS: Strategy-aware Surprise for Intrinsic Exploration
par: Kashirskiy, Mark, et autres
Publié: (2026)
par: Kashirskiy, Mark, et autres
Publié: (2026)
Evolving machine learning workflows through interactive AutoML
par: Barbudo, Rafael, et autres
Publié: (2024)
par: Barbudo, Rafael, et autres
Publié: (2024)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
Compressive Meta-Learning
par: Montserrat, Daniel Mas, et autres
Publié: (2025)
par: Montserrat, Daniel Mas, et autres
Publié: (2025)
HRM-Agent: Training a recurrent reasoning model in dynamic environments using reinforcement learning
par: Dang, Long H, et autres
Publié: (2025)
par: Dang, Long H, et autres
Publié: (2025)
Documents similaires
-
A Comparison Between Decision Transformers and Traditional Offline Reinforcement Learning Algorithms
par: Caunhye, Ali Murtaza, et autres
Publié: (2025) -
Adaptive Negative Scheduling for Graph Contrastive Learning
par: Ali, Adnan, et autres
Publié: (2026) -
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
par: Saini, Saurabh, et autres
Publié: (2026) -
Function-Valued Causal Influence in Nonlinear Time Series
par: Kuskova, Valentina V., et autres
Publié: (2026) -
Conditional Temporal Neural Processes with Covariance Loss
par: Yoo, Boseon, et autres
Publié: (2025)