SMCEvolve: Principled Scientific Discovery via Sequential Monte Carlo Evolution
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Jiachen, Zhu, Huminhao, Zhu, Zhihui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improve Value Estimation of Q Function and Reshape Reward with Monte Carlo Tree Search
par: Li, Jiamian
Publié: (2024)
par: Li, Jiamian
Publié: (2024)
GenoMAS: A Multi-Agent Framework for Scientific Discovery via Code-Driven Gene Expression Analysis
par: Liu, Haoyang, et autres
Publié: (2025)
par: Liu, Haoyang, et autres
Publié: (2025)
DeltaEvolve: Accelerating Scientific Discovery through Momentum-Driven Evolution
par: Jiang, Jiachen, et autres
Publié: (2026)
par: Jiang, Jiachen, et autres
Publié: (2026)
SrSv: Integrating Sequential Rollouts with Sequential Value Estimation for Multi-agent Reinforcement Learning
par: Wan, Xu, et autres
Publié: (2025)
par: Wan, Xu, et autres
Publié: (2025)
COSAC: Counterfactual Credit Assignment in Sequential Cooperative Teams
par: Deshmukh, Shripad, et autres
Publié: (2026)
par: Deshmukh, Shripad, et autres
Publié: (2026)
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
par: Wu, Xuefei, et autres
Publié: (2025)
par: Wu, Xuefei, et autres
Publié: (2025)
Beyond Shallow Behavior: Task-Efficient Value-Based Multi-Task Offline MARL via Skill Discovery
par: Wang, Xun, et autres
Publié: (2025)
par: Wang, Xun, et autres
Publié: (2025)
Talk Freely, Execute Strictly: Schema-Gated Agentic AI for Flexible and Reproducible Scientific Workflows
par: Strickland, Joel, et autres
Publié: (2026)
par: Strickland, Joel, et autres
Publié: (2026)
Reinforced Agent: Inference-Time Feedback for Tool-Calling Agents
par: Ta, Anh, et autres
Publié: (2026)
par: Ta, Anh, et autres
Publié: (2026)
Planner Matters! An Efficient and Unbalanced Multi-agent Collaboration Framework for Long-horizon Planning
par: Wu, Wenyi, et autres
Publié: (2026)
par: Wu, Wenyi, et autres
Publié: (2026)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
par: Xu, Zelai, et autres
Publié: (2026)
par: Xu, Zelai, et autres
Publié: (2026)
Multi-Agent Diagnostics for Robustness via Illuminated Diversity
par: Samvelyan, Mikayel, et autres
Publié: (2024)
par: Samvelyan, Mikayel, et autres
Publié: (2024)
Human Implicit Preference-Based Policy Fine-tuning for Multi-Agent Reinforcement Learning in USV Swarm
par: Kim, Hyeonjun, et autres
Publié: (2025)
par: Kim, Hyeonjun, et autres
Publié: (2025)
MetaVIM: Meta Variationally Intrinsic Motivated Reinforcement Learning for Decentralized Traffic Signal Control
par: Zhu, Liwen, et autres
Publié: (2021)
par: Zhu, Liwen, et autres
Publié: (2021)
Fast Peer Adaptation with Context-aware Exploration
par: Ma, Long, et autres
Publié: (2024)
par: Ma, Long, et autres
Publié: (2024)
QSIM: Mitigating Overestimation in Multi-Agent Reinforcement Learning via Action Similarity Weighted Q-Learning
par: Li, Yuanjun, et autres
Publié: (2026)
par: Li, Yuanjun, et autres
Publié: (2026)
Balancing Specialization and Centralization: A Multi-Agent Reinforcement Learning Benchmark for Sequential Industrial Control
par: Maus, Tom, et autres
Publié: (2025)
par: Maus, Tom, et autres
Publié: (2025)
Enabling Agents to Communicate Entirely in Latent Space
par: Du, Zhuoyun, et autres
Publié: (2025)
par: Du, Zhuoyun, et autres
Publié: (2025)
A Roadmap Towards Improving Multi-Agent Reinforcement Learning With Causal Discovery And Inference
par: Briglia, Giovanni, et autres
Publié: (2025)
par: Briglia, Giovanni, et autres
Publié: (2025)
Tacit Learning with Adaptive Information Selection for Cooperative Multi-Agent Reinforcement Learning
par: Liu, Lunjun, et autres
Publié: (2024)
par: Liu, Lunjun, et autres
Publié: (2024)
Settling Decentralized Multi-Agent Coordinated Exploration by Novelty Sharing
par: Jiang, Haobin, et autres
Publié: (2024)
par: Jiang, Haobin, et autres
Publié: (2024)
Fully Decentralized Cooperative Multi-Agent Reinforcement Learning: A Survey
par: Jiang, Jiechuan, et autres
Publié: (2024)
par: Jiang, Jiechuan, et autres
Publié: (2024)
CORD: Generalizable Cooperation via Role Diversity
par: Matsuyama, Kanefumi, et autres
Publié: (2025)
par: Matsuyama, Kanefumi, et autres
Publié: (2025)
Argumentative Ensembling for Robust Recourse under Model Multiplicity
par: Jiang, Junqi, et autres
Publié: (2025)
par: Jiang, Junqi, et autres
Publié: (2025)
Shaping Zero-Shot Coordination via State Blocking
par: Kang, Mingu, et autres
Publié: (2026)
par: Kang, Mingu, et autres
Publié: (2026)
RiskAgent: Synergizing Language Models with Validated Tools for Evidence-Based Risk Prediction
par: Liu, Fenglin, et autres
Publié: (2025)
par: Liu, Fenglin, et autres
Publié: (2025)
Training Generalizable Collaborative Agents via Strategic Risk Aversion
par: Qu, Chengrui, et autres
Publié: (2026)
par: Qu, Chengrui, et autres
Publié: (2026)
SPIRAL: Symbolic LLM Planning via Grounded and Reflective Search
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
Scalable Submodular Policy Optimization via Pruned Submodularity Graph
par: Anand, Aditi, et autres
Publié: (2025)
par: Anand, Aditi, et autres
Publié: (2025)
Aligning Compound AI Systems via System-level DPO
par: Wang, Xiangwen, et autres
Publié: (2025)
par: Wang, Xiangwen, et autres
Publié: (2025)
Adaptively Coordinating with Novel Partners via Learned Latent Strategies
par: Li, Benjamin, et autres
Publié: (2025)
par: Li, Benjamin, et autres
Publié: (2025)
PIVOT: Bridging Planning and Execution in LLM Agents via Trajectory Refinement
par: Zhang, Tuo, et autres
Publié: (2026)
par: Zhang, Tuo, et autres
Publié: (2026)
ANNEAL: Adapting LLM Agents via Governed Symbolic Patch Learning
par: Hakim, Safayat Bin, et autres
Publié: (2026)
par: Hakim, Safayat Bin, et autres
Publié: (2026)
Multi-Agent Path Finding via Offline RL and LLM Collaboration
par: Atasever, Merve, et autres
Publié: (2025)
par: Atasever, Merve, et autres
Publié: (2025)
Emergence of Fair Leaders via Mediators in Multi-Agent Reinforcement Learning
par: Dodwadmath, Akshay, et autres
Publié: (2025)
par: Dodwadmath, Akshay, et autres
Publié: (2025)
Meritocratic Fairness in Budgeted Combinatorial Multi-armed Bandits via Shapley Values
par: Sharma, Shradha, et autres
Publié: (2026)
par: Sharma, Shradha, et autres
Publié: (2026)
Achieving Collective Welfare in Multi-Agent Reinforcement Learning via Suggestion Sharing
par: Jin, Yue, et autres
Publié: (2024)
par: Jin, Yue, et autres
Publié: (2024)
Resource Governance in Networked Systems via Integrated Variational Autoencoders and Reinforcement Learning
par: Chen, Qiliang, et autres
Publié: (2024)
par: Chen, Qiliang, et autres
Publié: (2024)
Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus
par: Zhao, Zijian, et autres
Publié: (2026)
par: Zhao, Zijian, et autres
Publié: (2026)
ProAgent: Building Proactive Cooperative Agents with Large Language Models
par: Zhang, Ceyao, et autres
Publié: (2023)
par: Zhang, Ceyao, et autres
Publié: (2023)
Documents similaires
-
Improve Value Estimation of Q Function and Reshape Reward with Monte Carlo Tree Search
par: Li, Jiamian
Publié: (2024) -
GenoMAS: A Multi-Agent Framework for Scientific Discovery via Code-Driven Gene Expression Analysis
par: Liu, Haoyang, et autres
Publié: (2025) -
DeltaEvolve: Accelerating Scientific Discovery through Momentum-Driven Evolution
par: Jiang, Jiachen, et autres
Publié: (2026) -
SrSv: Integrating Sequential Rollouts with Sequential Value Estimation for Multi-agent Reinforcement Learning
par: Wan, Xu, et autres
Publié: (2025) -
COSAC: Counterfactual Credit Assignment in Sequential Cooperative Teams
par: Deshmukh, Shripad, et autres
Publié: (2026)