Mastering Continual Reinforcement Learning through Fine-Grained Sparse Network Allocation and Dormant Neuron Exploration
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Chengqi, Yin, Haiyan, Chen, Jianda, Ng, Terence, Ong, Yew-Soon, Tsang, Ivor |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MermaidFlow: Redefining Agentic Workflow Generation via Safety-Constrained Evolutionary Programming
di: Zheng, Chengqi, et al.
Pubblicazione: (2025)
di: Zheng, Chengqi, et al.
Pubblicazione: (2025)
Dual Action Policy for Robust Sim-to-Real Reinforcement Learning
di: Terence, Ng Wen Zheng, et al.
Pubblicazione: (2024)
di: Terence, Ng Wen Zheng, et al.
Pubblicazione: (2024)
Flow-Direct: Feedback-Efficient and Reusable Guidance for Flow Models via Non-Parametric Guidance Field
di: Tan, Kim Yong, et al.
Pubblicazione: (2026)
di: Tan, Kim Yong, et al.
Pubblicazione: (2026)
Towards Harmless Rawlsian Fairness Regardless of Demographic Prior
di: Wang, Xuanqian, et al.
Pubblicazione: (2024)
di: Wang, Xuanqian, et al.
Pubblicazione: (2024)
Fast Direct: Query-Efficient Online Black-box Guidance for Diffusion-model Target Generation
di: Tan, Kim Yong, et al.
Pubblicazione: (2025)
di: Tan, Kim Yong, et al.
Pubblicazione: (2025)
Distributional Multi-objective Black-box Optimization for Diffusion-model Inference-time Multi-Target Generation
di: Tan, Kim Yong, et al.
Pubblicazione: (2025)
di: Tan, Kim Yong, et al.
Pubblicazione: (2025)
Covariance-Adaptive Sequential Black-box Optimization for Diffusion Targeted Generation
di: Lyu, Yueming, et al.
Pubblicazione: (2024)
di: Lyu, Yueming, et al.
Pubblicazione: (2024)
Lang-PINN: From Language to Physics-Informed Neural Networks via a Multi-Agent Framework
di: He, Xin, et al.
Pubblicazione: (2025)
di: He, Xin, et al.
Pubblicazione: (2025)
Evaluating LLMs Without Oracle Feedback: Agentic Annotation Evaluation Through Unsupervised Consistency Signals
di: Chen, Cheng, et al.
Pubblicazione: (2025)
di: Chen, Cheng, et al.
Pubblicazione: (2025)
DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization
di: Xu, Guowei, et al.
Pubblicazione: (2023)
di: Xu, Guowei, et al.
Pubblicazione: (2023)
Improving the Generalization of Unseen Crowd Behaviors for Reinforcement Learning based Local Motion Planners
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2024)
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2024)
State Chrono Representation for Enhancing Generalization in Reinforcement Learning
di: Chen, Jianda, et al.
Pubblicazione: (2024)
di: Chen, Jianda, et al.
Pubblicazione: (2024)
Fine-grained Abnormality Prompt Learning for Zero-shot Anomaly Detection
di: Zhu, Jiawen, et al.
Pubblicazione: (2024)
di: Zhu, Jiawen, et al.
Pubblicazione: (2024)
Off-dynamics Conditional Diffusion Planners
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2024)
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2024)
RouteMark: A Fingerprint for Intellectual Property Attribution in Routing-based Model Merging
di: He, Xin, et al.
Pubblicazione: (2025)
di: He, Xin, et al.
Pubblicazione: (2025)
Policy Dispersion in Non-Markovian Environment
di: Qu, Bohao, et al.
Pubblicazione: (2023)
di: Qu, Bohao, et al.
Pubblicazione: (2023)
Hybrid Memetic Search for Electric Vehicle Routing with Time Windows, Simultaneous Pickup-Delivery, and Partial Recharges
di: Zheng, Zubin, et al.
Pubblicazione: (2024)
di: Zheng, Zubin, et al.
Pubblicazione: (2024)
ExpertFlow: Efficient Mixture-of-Experts Inference via Predictive Expert Caching and Token Scheduling
di: He, Xin, et al.
Pubblicazione: (2024)
di: He, Xin, et al.
Pubblicazione: (2024)
LLM Agents Make Collective Belief Dynamics Programmable: Challenges and Research Directions
di: He, Xin, et al.
Pubblicazione: (2026)
di: He, Xin, et al.
Pubblicazione: (2026)
Multi-Task Learning with Multi-Task Optimization
di: Bai, Lu, et al.
Pubblicazione: (2024)
di: Bai, Lu, et al.
Pubblicazione: (2024)
A Continuous Encoding-Based Representation for Efficient Multi-Fidelity Multi-Objective Neural Architecture Search
di: Wei, Zhao, et al.
Pubblicazione: (2025)
di: Wei, Zhao, et al.
Pubblicazione: (2025)
Pix2Fact: When Vision Is Not Enough -- Benchmarking Fine-Grained VQA with Web Verification on High-Resolution Real-World Scenes
di: Jiang, Yifan, et al.
Pubblicazione: (2026)
di: Jiang, Yifan, et al.
Pubblicazione: (2026)
Jack and Masters of all Trades: One-Pass Learning Sets of Model Sets From Large Pre-Trained Models
di: Choong, Han Xiang, et al.
Pubblicazione: (2022)
di: Choong, Han Xiang, et al.
Pubblicazione: (2022)
Latent Embedding Adaptation for Human Preference Alignment in Diffusion Planners
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2025)
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2025)
Diversifying Policy Behaviors with Extrinsic Behavioral Curiosity
di: Wan, Zhenglin, et al.
Pubblicazione: (2024)
di: Wan, Zhenglin, et al.
Pubblicazione: (2024)
A Simple Yet Effective Approach for Diversified Session-Based Recommendation
di: Yin, Qing, et al.
Pubblicazione: (2024)
di: Yin, Qing, et al.
Pubblicazione: (2024)
Co-Learning Bayesian Optimization
di: Guo, Zhendong, et al.
Pubblicazione: (2025)
di: Guo, Zhendong, et al.
Pubblicazione: (2025)
Possibilistic Predictive Uncertainty for Deep Learning
di: Ni, Yao, et al.
Pubblicazione: (2026)
di: Ni, Yao, et al.
Pubblicazione: (2026)
Automated Large-scale CVRP Solver Design via LLM-assisted Flexible MCTS
di: Guo, Tong, et al.
Pubblicazione: (2026)
di: Guo, Tong, et al.
Pubblicazione: (2026)
EvoSpeak: Large Language Models for Interpretable Genetic Programming-Evolved Heuristics
di: Xu, Meng, et al.
Pubblicazione: (2025)
di: Xu, Meng, et al.
Pubblicazione: (2025)
Bayesian Inverse Transfer in Evolutionary Multiobjective Optimization
di: Liu, Jiao, et al.
Pubblicazione: (2023)
di: Liu, Jiao, et al.
Pubblicazione: (2023)
Finding Sets of Pareto Sets in Real-World Scenarios -- A Multitask Multiobjective Perspective
di: Liu, Jiao, et al.
Pubblicazione: (2026)
di: Liu, Jiao, et al.
Pubblicazione: (2026)
Quality Diversity Genetic Programming for Learning Scheduling Heuristics
di: Xu, Meng, et al.
Pubblicazione: (2025)
di: Xu, Meng, et al.
Pubblicazione: (2025)
FedRLHF: A Convergence-Guaranteed Federated Framework for Privacy-Preserving and Personalized RLHF
di: Fan, Flint Xiaofeng, et al.
Pubblicazione: (2024)
di: Fan, Flint Xiaofeng, et al.
Pubblicazione: (2024)
Learning with Foresight: Enhancing Neural Routing Policy via Multi-Node Lookahead Prediction
di: Jiang, Xia, et al.
Pubblicazione: (2026)
di: Jiang, Xia, et al.
Pubblicazione: (2026)
Evolutionary Computation as Natural Generative AI
di: Shi, Yaxin, et al.
Pubblicazione: (2025)
di: Shi, Yaxin, et al.
Pubblicazione: (2025)
Road Network Representation Learning with the Third Law of Geography
di: Zhou, Haicang, et al.
Pubblicazione: (2024)
di: Zhou, Haicang, et al.
Pubblicazione: (2024)
Agentic Spatio-Temporal Grounding via Collaborative Reasoning
di: Zhao, Heng, et al.
Pubblicazione: (2026)
di: Zhao, Heng, et al.
Pubblicazione: (2026)
The Digital Ecosystem of Beliefs: does evolution favour AI over humans?
di: Bossens, David M., et al.
Pubblicazione: (2024)
di: Bossens, David M., et al.
Pubblicazione: (2024)
Analytical Survey of Learning with Low-Resource Data: From Analysis to Investigation
di: Cao, Xiaofeng, et al.
Pubblicazione: (2025)
di: Cao, Xiaofeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MermaidFlow: Redefining Agentic Workflow Generation via Safety-Constrained Evolutionary Programming
di: Zheng, Chengqi, et al.
Pubblicazione: (2025) -
Dual Action Policy for Robust Sim-to-Real Reinforcement Learning
di: Terence, Ng Wen Zheng, et al.
Pubblicazione: (2024) -
Flow-Direct: Feedback-Efficient and Reusable Guidance for Flow Models via Non-Parametric Guidance Field
di: Tan, Kim Yong, et al.
Pubblicazione: (2026) -
Towards Harmless Rawlsian Fairness Regardless of Demographic Prior
di: Wang, Xuanqian, et al.
Pubblicazione: (2024) -
Fast Direct: Query-Efficient Online Black-box Guidance for Diffusion-model Target Generation
di: Tan, Kim Yong, et al.
Pubblicazione: (2025)