Dreaming in Code for Curriculum Learning in Open-Ended Worlds
Fuente:
arXiv
Salvato in:
| Autori principali: | Mitsides, Konstantinos, Faldor, Maxence, Cully, Antoine |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Policy Gradient Quality-Diversity with Massive Parallelization via Behavioral Variations
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2025)
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2025)
CAX: Cellular Automata Accelerated in JAX
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
Synergizing Quality-Diversity with Descriptor-Conditioned Reinforcement Learning
di: Faldor, Maxence, et al.
Pubblicazione: (2023)
di: Faldor, Maxence, et al.
Pubblicazione: (2023)
Quality-Diversity Actor-Critic: Learning High-Performing and Diverse Behaviors via Value and Successor Features Critics
di: Grillotti, Luca, et al.
Pubblicazione: (2024)
di: Grillotti, Luca, et al.
Pubblicazione: (2024)
Toward Artificial Open-Ended Evolution within Lenia using Quality-Diversity
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
From Tabula Rasa to Emergent Abilities: Discovering Robot Skills via Real-World Unsupervised Quality-Diversity
di: Grillotti, Luca, et al.
Pubblicazione: (2025)
di: Grillotti, Luca, et al.
Pubblicazione: (2025)
OMNI-EPIC: Open-endedness via Models of human Notions of Interestingness with Environments Programmed in Code
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
di: Faldor, Maxence, et al.
Pubblicazione: (2024)
Discovering Quality-Diversity Algorithms via Meta-Black-Box Optimization
di: Faldor, Maxence, et al.
Pubblicazione: (2025)
di: Faldor, Maxence, et al.
Pubblicazione: (2025)
KASER: Knowledge-Aligned Student Error Simulator for Open-Ended Coding Tasks
di: Duan, Zhangqi, et al.
Pubblicazione: (2026)
di: Duan, Zhangqi, et al.
Pubblicazione: (2026)
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
di: Ye, Zhiling, et al.
Pubblicazione: (2025)
di: Ye, Zhiling, et al.
Pubblicazione: (2025)
GRLO: Towards Generalizable Reinforcement Learning in Open-Ended Environments from Zero
di: Yin, Shangjian, et al.
Pubblicazione: (2026)
di: Yin, Shangjian, et al.
Pubblicazione: (2026)
MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research
di: Chen, Hui, et al.
Pubblicazione: (2025)
di: Chen, Hui, et al.
Pubblicazione: (2025)
DIVERGE: Diversity-Enhanced RAG for Open-Ended Information Seeking
di: Hu, Tianyi, et al.
Pubblicazione: (2026)
di: Hu, Tianyi, et al.
Pubblicazione: (2026)
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
Code-Switching Curriculum Learning for Multilingual Transfer in LLMs
di: Yoo, Haneul, et al.
Pubblicazione: (2024)
di: Yoo, Haneul, et al.
Pubblicazione: (2024)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)
AutoLibra: Agent Metric Induction from Open-Ended Human Feedback
di: Zhu, Hao, et al.
Pubblicazione: (2025)
di: Zhu, Hao, et al.
Pubblicazione: (2025)
Preference-Conditioned Gradient Variations for Multi-Objective Quality-Diversity
di: Janmohamed, Hannah, et al.
Pubblicazione: (2024)
di: Janmohamed, Hannah, et al.
Pubblicazione: (2024)
XL-Suite: Cross-Lingual Synthetic Training and Evaluation Data for Open-Ended Generation
di: Iyer, Vivek, et al.
Pubblicazione: (2025)
di: Iyer, Vivek, et al.
Pubblicazione: (2025)
Can LLMs Reliably Simulate Human Learner Actions? A Simulation Authoring Framework for Open-Ended Learning Environments
di: Mannekote, Amogh, et al.
Pubblicazione: (2024)
di: Mannekote, Amogh, et al.
Pubblicazione: (2024)
DreamPRM-Code: Function-as-Step Process Reward Model with Label Correction for LLM Coding
di: Zhang, Ruiyi, et al.
Pubblicazione: (2025)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2025)
Flexible Agent Alignment with Goal Inference from Open-Ended Dialog
di: Ma, Rachel, et al.
Pubblicazione: (2025)
di: Ma, Rachel, et al.
Pubblicazione: (2025)
Hard2Verify: A Step-Level Verification Benchmark for Open-Ended Frontier Math
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics
di: Nagar, Aishik, et al.
Pubblicazione: (2026)
di: Nagar, Aishik, et al.
Pubblicazione: (2026)
Distributional Open-Ended Evaluation of LLM Cultural Value Alignment Based on Value Codebook
di: Lee, Jaehyeok, et al.
Pubblicazione: (2026)
di: Lee, Jaehyeok, et al.
Pubblicazione: (2026)
MCU: An Evaluation Framework for Open-Ended Game Agents
di: Zheng, Xinyue, et al.
Pubblicazione: (2023)
di: Zheng, Xinyue, et al.
Pubblicazione: (2023)
Agentic Reinforcement Learning for Real-World Code Repair
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
G-Zero: Self-Play for Open-Ended Generation from Zero Data
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
HelpSteer3: Human-Annotated Feedback and Edit Data to Empower Inference-Time Scaling in Open-Ended General-Domain Tasks
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
A Path to Universal Neural Cellular Automata
di: Béna, Gabriel, et al.
Pubblicazione: (2025)
di: Béna, Gabriel, et al.
Pubblicazione: (2025)
Curriculum Learning with Quality-Driven Data Selection
di: Wu, Biao, et al.
Pubblicazione: (2024)
di: Wu, Biao, et al.
Pubblicazione: (2024)
Curriculum Learning for Small Code Language Models
di: Naïr, Marwa, et al.
Pubblicazione: (2024)
di: Naïr, Marwa, et al.
Pubblicazione: (2024)
CLewR: Curriculum Learning with Restarts for Machine Translation Preference Learning
di: Dragomir, Alexandra, et al.
Pubblicazione: (2026)
di: Dragomir, Alexandra, et al.
Pubblicazione: (2026)
Distributed Representations of Entities in Open-World Knowledge Graphs
di: Guo, Lingbing, et al.
Pubblicazione: (2020)
di: Guo, Lingbing, et al.
Pubblicazione: (2020)
Mars: Situated Inductive Reasoning in an Open-World Environment
di: Tang, Xiaojuan, et al.
Pubblicazione: (2024)
di: Tang, Xiaojuan, et al.
Pubblicazione: (2024)
Train Long, Think Short: Curriculum Learning for Efficient Reasoning
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2025)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2025)
Multi-Objective Quality-Diversity in Unstructured and Unbounded Spaces
di: Janmohamed, Hannah, et al.
Pubblicazione: (2025)
di: Janmohamed, Hannah, et al.
Pubblicazione: (2025)
Do Androids Know They're Only Dreaming of Electric Sheep?
di: CH-Wang, Sky, et al.
Pubblicazione: (2023)
di: CH-Wang, Sky, et al.
Pubblicazione: (2023)
Curry-DPO: Enhancing Alignment using Curriculum Learning & Ranked Preferences
di: Pattnaik, Pulkit, et al.
Pubblicazione: (2024)
di: Pattnaik, Pulkit, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scaling Policy Gradient Quality-Diversity with Massive Parallelization via Behavioral Variations
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2025) -
CAX: Cellular Automata Accelerated in JAX
di: Faldor, Maxence, et al.
Pubblicazione: (2024) -
Synergizing Quality-Diversity with Descriptor-Conditioned Reinforcement Learning
di: Faldor, Maxence, et al.
Pubblicazione: (2023) -
Quality-Diversity Actor-Critic: Learning High-Performing and Diverse Behaviors via Value and Successor Features Critics
di: Grillotti, Luca, et al.
Pubblicazione: (2024) -
Toward Artificial Open-Ended Evolution within Lenia using Quality-Diversity
di: Faldor, Maxence, et al.
Pubblicazione: (2024)