Salvato in:
| Autori principali: | Zhang, Jenny, Zhao, Bingchen, Yang, Wannan, Foerster, Jakob, Clune, Jeff, Jiang, Minqi, Devlin, Sam, Shavrina, Tatiana |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.19461 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
APRES: An Agentic Paper Revision and Evaluation System
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
OMNI: Open-endedness via Models of human Notions of Interestingness
di: Zhang, Jenny, et al.
Pubblicazione: (2023)
di: Zhang, Jenny, et al.
Pubblicazione: (2023)
Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents
di: Zhang, Jenny, et al.
Pubblicazione: (2025)
di: Zhang, Jenny, et al.
Pubblicazione: (2025)
Thought Cloning: Learning to Think while Acting by Imitating Human Thinking
di: Hu, Shengran, et al.
Pubblicazione: (2023)
di: Hu, Shengran, et al.
Pubblicazione: (2023)
First-Explore, then Exploit: Meta-Learning to Solve Hard Exploration-Exploitation Trade-Offs
di: Norman, Ben, et al.
Pubblicazione: (2023)
di: Norman, Ben, et al.
Pubblicazione: (2023)
Asking the Right Questions: Improving Reasoning with Generated Stepping Stones
di: Hu, Hengyuan, et al.
Pubblicazione: (2026)
di: Hu, Hengyuan, et al.
Pubblicazione: (2026)
Quality Diversity through Human Feedback: Towards Open-Ended Diversity-Driven Optimization
di: Ding, Li, et al.
Pubblicazione: (2023)
di: Ding, Li, et al.
Pubblicazione: (2023)
The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search
di: Yamada, Yutaro, et al.
Pubblicazione: (2025)
di: Yamada, Yutaro, et al.
Pubblicazione: (2025)
Refining Minimax Regret for Unsupervised Environment Design
di: Beukman, Michael, et al.
Pubblicazione: (2024)
di: Beukman, Michael, et al.
Pubblicazione: (2024)
Learning to Continually Learn via Meta-learning Agentic Memory Designs
di: Xiong, Yiming, et al.
Pubblicazione: (2026)
di: Xiong, Yiming, et al.
Pubblicazione: (2026)
Automated Design of Agentic Systems
di: Hu, Shengran, et al.
Pubblicazione: (2024)
di: Hu, Shengran, et al.
Pubblicazione: (2024)
Foundation Model Self-Play: Open-Ended Strategy Innovation via Foundation Models
di: Dharna, Aaron, et al.
Pubblicazione: (2025)
di: Dharna, Aaron, et al.
Pubblicazione: (2025)
Automated Capability Discovery via Foundation Model Self-Exploration
di: Lu, Cong, et al.
Pubblicazione: (2025)
di: Lu, Cong, et al.
Pubblicazione: (2025)
Intelligent Go-Explore: Standing on the Shoulders of Giant Foundation Models
di: Lu, Cong, et al.
Pubblicazione: (2024)
di: Lu, Cong, et al.
Pubblicazione: (2024)
The Automated LLM Speedrunning Benchmark: Reproducing NanoGPT Improvements
di: Zhao, Bingchen, et al.
Pubblicazione: (2025)
di: Zhao, Bingchen, et al.
Pubblicazione: (2025)
AI & Human Co-Improvement for Safer Co-Superintelligence
di: Weston, Jason, et al.
Pubblicazione: (2025)
di: Weston, Jason, et al.
Pubblicazione: (2025)
Continual learning under domain transfer with sparse synaptic bursting
di: Beaulieu, Shawn L., et al.
Pubblicazione: (2021)
di: Beaulieu, Shawn L., et al.
Pubblicazione: (2021)
Learning to Act without Actions
di: Schmidt, Dominik, et al.
Pubblicazione: (2023)
di: Schmidt, Dominik, et al.
Pubblicazione: (2023)
PARDEN, Can You Repeat That? Defending against Jailbreaks via Repetition
di: Zhang, Ziyang, et al.
Pubblicazione: (2024)
di: Zhang, Ziyang, et al.
Pubblicazione: (2024)
JaxUED: A simple and useable UED library in Jax
di: Coward, Samuel, et al.
Pubblicazione: (2024)
di: Coward, Samuel, et al.
Pubblicazione: (2024)
QuanForge: A Mutation Testing Framework for Quantum Neural Networks
di: Shao, Minqi, et al.
Pubblicazione: (2026)
di: Shao, Minqi, et al.
Pubblicazione: (2026)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
di: Barde, Paul, et al.
Pubblicazione: (2023)
di: Barde, Paul, et al.
Pubblicazione: (2023)
AgentBreeder: Mitigating the AI Safety Risks of Multi-Agent Scaffolds via Self-Improvement
di: Rosser, J, et al.
Pubblicazione: (2025)
di: Rosser, J, et al.
Pubblicazione: (2025)
MLGym: A New Framework and Benchmark for Advancing AI Research Agents
di: Nathani, Deepak, et al.
Pubblicazione: (2025)
di: Nathani, Deepak, et al.
Pubblicazione: (2025)
AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench
di: Toledo, Edan, et al.
Pubblicazione: (2025)
di: Toledo, Edan, et al.
Pubblicazione: (2025)
Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control Tasks
di: Matthews, Michael, et al.
Pubblicazione: (2024)
di: Matthews, Michael, et al.
Pubblicazione: (2024)
AQA-Bench: An Interactive Benchmark for Evaluating LLMs' Sequential Reasoning Ability
di: Yang, Siwei, et al.
Pubblicazione: (2024)
di: Yang, Siwei, et al.
Pubblicazione: (2024)
The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind
di: Lupu, Andrei, et al.
Pubblicazione: (2025)
di: Lupu, Andrei, et al.
Pubblicazione: (2025)
JaxLife: An Open-Ended Agentic Simulator
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
Oasis: One Image is All You Need for Multimodal Instruction Data Synthesis
di: Zhang, Letian, et al.
Pubblicazione: (2025)
di: Zhang, Letian, et al.
Pubblicazione: (2025)
Hallucination reduction with CASAL: Contrastive Activation Steering For Amortized Learning
di: Wannan, et al.
Pubblicazione: (2025)
di: Wannan, et al.
Pubblicazione: (2025)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
di: Sims, Anya, et al.
Pubblicazione: (2024)
di: Sims, Anya, et al.
Pubblicazione: (2024)
Mirror Learning: A Unifying Framework of Policy Optimisation
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
Learning Multi-Agent Communication with Contrastive Learning
di: Lo, Yat Long, et al.
Pubblicazione: (2023)
di: Lo, Yat Long, et al.
Pubblicazione: (2023)
The Generalization Gap in Offline Reinforcement Learning
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
di: Mediratta, Ishita, et al.
Pubblicazione: (2023)
minimax: Efficient Baselines for Autocurricula in JAX
di: Jiang, Minqi, et al.
Pubblicazione: (2023)
di: Jiang, Minqi, et al.
Pubblicazione: (2023)
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
SpecBench: Measuring Reward Hacking in Long-Horizon Coding Agents
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
Documenti analoghi
-
APRES: An Agentic Paper Revision and Evaluation System
di: Zhao, Bingchen, et al.
Pubblicazione: (2026) -
OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code
di: Faldor, Maxence, et al.
Pubblicazione: (2024) -
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024) -
OMNI: Open-endedness via Models of human Notions of Interestingness
di: Zhang, Jenny, et al.
Pubblicazione: (2023) -
Darwin Godel Machine: Open-Ended Evolution of Self-Improving Agents
di: Zhang, Jenny, et al.
Pubblicazione: (2025)