AIRA_2: Overcoming Bottlenecks in AI Research Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Hambardzumyan, Karen, Baldwin, Nicolas, Toledo, Edan, Hazra, Rishi, Kuchnik, Michael, Omari, Bassel Al, Foster, Thomas Simon, Protopopov, Anton, Gagnon-Audet, Jean-Christophe, Mediratta, Ishita, Niu, Kelvin, Shvartsman, Michael, Lupidi, Alisia, Audran-Reiss, Alexis, Pathak, Parth, Shavrina, Tatiana, Magka, Despoina, Momand, Hela, Dunfield, Derek, Cancedda, Nicola, Stenetorp, Pontus, Wu, Carole-Jean, Foerster, Jakob Nicolaus, Bachrach, Yoram, Josifoski, Martin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Agentic Discovery of Neural Architectures: AIRA-Compose and AIRA-Design
di: Pepe, Alberto, et al.
Pubblicazione: (2026)
di: Pepe, Alberto, et al.
Pubblicazione: (2026)
AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench
di: Toledo, Edan, et al.
Pubblicazione: (2025)
di: Toledo, Edan, et al.
Pubblicazione: (2025)
The Automated LLM Speedrunning Benchmark: Reproducing NanoGPT Improvements
di: Zhao, Bingchen, et al.
Pubblicazione: (2025)
di: Zhao, Bingchen, et al.
Pubblicazione: (2025)
Souper-Model: How Simple Arithmetic Unlocks State-of-the-Art LLM Performance
di: Maiti, Shalini, et al.
Pubblicazione: (2025)
di: Maiti, Shalini, et al.
Pubblicazione: (2025)
What Does It Take to Be a Good AI Research Agent? Studying the Role of Ideation Diversity
di: Audran-Reiss, Alexis, et al.
Pubblicazione: (2025)
di: Audran-Reiss, Alexis, et al.
Pubblicazione: (2025)
AIRS-Bench: a Suite of Tasks for Frontier AI Research Science Agents
di: Lupidi, Alisia, et al.
Pubblicazione: (2026)
di: Lupidi, Alisia, et al.
Pubblicazione: (2026)
APRES: An Agentic Paper Revision and Evaluation System
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
A Scalable Measure of Loss Landscape Curvature for Analyzing the Training Dynamics of LLMs
di: Kalra, Dayal Singh, et al.
Pubblicazione: (2026)
di: Kalra, Dayal Singh, et al.
Pubblicazione: (2026)
Source2Synth: Synthetic Data Generation and Curation Grounded in Real Data Sources
di: Lupidi, Alisia, et al.
Pubblicazione: (2024)
di: Lupidi, Alisia, et al.
Pubblicazione: (2024)
Robust LLM safeguarding via refusal feature adversarial training
di: Yu, Lei, et al.
Pubblicazione: (2024)
di: Yu, Lei, et al.
Pubblicazione: (2024)
MLGym: A New Framework and Benchmark for Advancing AI Research Agents
di: Nathani, Deepak, et al.
Pubblicazione: (2025)
di: Nathani, Deepak, et al.
Pubblicazione: (2025)
Bootstrapping Task Spaces for Self-Improvement
di: Jiang, Minqi, et al.
Pubblicazione: (2025)
di: Jiang, Minqi, et al.
Pubblicazione: (2025)
Neural Mean-Field Games: Extending Mean-Field Game Theory with Neural Stochastic Differential Equations
di: Thöni, Anna C. M., et al.
Pubblicazione: (2025)
di: Thöni, Anna C. M., et al.
Pubblicazione: (2025)
Over-the-air White-box Attack on the Wav2Vec Speech Recognition Neural Network
di: Alexey, Protopopov
Pubblicazione: (2026)
di: Alexey, Protopopov
Pubblicazione: (2026)
A Robust Remote Photoplethysmography Method
di: Protopopov, Alexey
Pubblicazione: (2025)
di: Protopopov, Alexey
Pubblicazione: (2025)
A Robust Camera-based Method for Breath Rate Measurement
di: Protopopov, Alexey
Pubblicazione: (2025)
di: Protopopov, Alexey
Pubblicazione: (2025)
Scaling and Distilling Transformer Models for sEMG
di: Mehlman, Nicholas, et al.
Pubblicazione: (2025)
di: Mehlman, Nicholas, et al.
Pubblicazione: (2025)
Scaling Small Agents Through Strategy Auctions
di: Alazraki, Lisa, et al.
Pubblicazione: (2026)
di: Alazraki, Lisa, et al.
Pubblicazione: (2026)
Flattening subtyping by eta expansion
di: Dunfield, Jana
Pubblicazione: (2024)
di: Dunfield, Jana
Pubblicazione: (2024)
Spectral Filters, Dark Signals, and Attention Sinks
di: Cancedda, Nicola
Pubblicazione: (2024)
di: Cancedda, Nicola
Pubblicazione: (2024)
Innovative Behaviour Is Associated With Increased Collision Incidence in Birds
di: Timothy J. Boycott, et al.
Pubblicazione: (2026)
di: Timothy J. Boycott, et al.
Pubblicazione: (2026)
Crowd IQ -- Aggregating Opinions to Boost Performance
di: Kosinski, Michal, et al.
Pubblicazione: (2024)
di: Kosinski, Michal, et al.
Pubblicazione: (2024)
Multi-Agent Craftax: Benchmarking Open-Ended Multi-Agent Reinforcement Learning at the Hyperscale
di: Omari, Bassel Al, et al.
Pubblicazione: (2025)
di: Omari, Bassel Al, et al.
Pubblicazione: (2025)
MODA 69: PUIG, AIRA Y MALLARMÉ
di: Carlos Walker
Pubblicazione: (2020)
di: Carlos Walker
Pubblicazione: (2020)
From MTEB to MTOB: Retrieval-Augmented Classification for Descriptive Grammars
di: Kornilov, Albert, et al.
Pubblicazione: (2024)
di: Kornilov, Albert, et al.
Pubblicazione: (2024)
How Data Inter-connectivity Shapes LLMs Unlearning: A Structural Unlearning Perspective
di: Qiu, Xinchi, et al.
Pubblicazione: (2024)
di: Qiu, Xinchi, et al.
Pubblicazione: (2024)
The Finiteness Principle for the boundary values of $C^2$-functions
di: Shvartsman, Pavel
Pubblicazione: (2024)
di: Shvartsman, Pavel
Pubblicazione: (2024)
Efficient Algorithms for Lipschitz Selections of Set-Valued Mappings in ${\bf R}^2$: long version
di: Shvartsman, Pavel
Pubblicazione: (2025)
di: Shvartsman, Pavel
Pubblicazione: (2025)
julieaudet/cell-manufacturing: HDDE
di: Julie Audet
Pubblicazione: (2026)
di: Julie Audet
Pubblicazione: (2026)
GIS in schools / Richard Audet and Gail Ludwig
di: Audet, Richard
di: Audet, Richard
Feature Likelihood Divergence: Evaluating the Generalization of Generative Models Using Samples
di: Jiralerspong, Marco, et al.
Pubblicazione: (2023)
di: Jiralerspong, Marco, et al.
Pubblicazione: (2023)
Modelling Chemical Reaction Networks using Neural Ordinary Differential Equations
di: Thöni, Anna C. M., et al.
Pubblicazione: (2025)
di: Thöni, Anna C. M., et al.
Pubblicazione: (2025)
DUAS FACES DO PODER
di: Peter Bachrach
Pubblicazione: (2011)
di: Peter Bachrach
Pubblicazione: (2011)
Can LLMs Extract Frame-Semantic Arguments?
di: Devasier, Jacob, et al.
Pubblicazione: (2025)
di: Devasier, Jacob, et al.
Pubblicazione: (2025)
Asking the Right Questions: Improving Reasoning with Generated Stepping Stones
di: Hu, Hengyuan, et al.
Pubblicazione: (2026)
di: Hu, Hengyuan, et al.
Pubblicazione: (2026)
Irreducibility and locus of complex roots of polynomials related to Fermat's Last Theorem
di: Karapetyan, Hayk, et al.
Pubblicazione: (2025)
di: Karapetyan, Hayk, et al.
Pubblicazione: (2025)
On ideal class groups of totally degenerate number rings
di: Hambardzumyan, Ruben, et al.
Pubblicazione: (2025)
di: Hambardzumyan, Ruben, et al.
Pubblicazione: (2025)
Graphs, Disjoint Matchings and Some Inequalities
di: Hambardzumyan, Lianna, et al.
Pubblicazione: (2015)
di: Hambardzumyan, Lianna, et al.
Pubblicazione: (2015)
Real Time Fatigue Crack Growth Monitoring Using High Precision Control and Data Acquisition Systems
di: Hambardzumyan, Arev, et al.
Pubblicazione: (2025)
di: Hambardzumyan, Arev, et al.
Pubblicazione: (2025)
GPS-derived precipitable water vapor content calculated for station AIRA
di: Wang, Xiaoming
Pubblicazione: (2016)
di: Wang, Xiaoming
Pubblicazione: (2016)
Documenti analoghi
-
Agentic Discovery of Neural Architectures: AIRA-Compose and AIRA-Design
di: Pepe, Alberto, et al.
Pubblicazione: (2026) -
AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench
di: Toledo, Edan, et al.
Pubblicazione: (2025) -
The Automated LLM Speedrunning Benchmark: Reproducing NanoGPT Improvements
di: Zhao, Bingchen, et al.
Pubblicazione: (2025) -
Souper-Model: How Simple Arithmetic Unlocks State-of-the-Art LLM Performance
di: Maiti, Shalini, et al.
Pubblicazione: (2025) -
What Does It Take to Be a Good AI Research Agent? Studying the Role of Ideation Diversity
di: Audran-Reiss, Alexis, et al.
Pubblicazione: (2025)