Enregistré dans:
| Auteurs principaux: | Lehrach, Wolfgang, Hennes, Daniel, Lazaro-Gredilla, Miguel, Lou, Xinghua, Wendelken, Carter, Li, Zun, Dedieu, Antoine, Grau-Moya, Jordi, Lanctot, Marc, Iscen, Atil, Schultz, John, Chiam, Marcus, Gemp, Ian, Zielinski, Piotr, Singh, Satinder, Murphy, Kevin P. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.04542 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AutoHarness: improving LLM agents by automatically synthesizing a code harness
par: Lou, Xinghua, et autres
Publié: (2026)
par: Lou, Xinghua, et autres
Publié: (2026)
Improving Transformer World Models for Data-Efficient RL
par: Dedieu, Antoine, et autres
Publié: (2025)
par: Dedieu, Antoine, et autres
Publié: (2025)
DMC-VB: A Benchmark for Representation Learning for Control with Visual Distractors
par: Ortiz, Joseph, et autres
Publié: (2024)
par: Ortiz, Joseph, et autres
Publié: (2024)
Learning Cognitive Maps from Transformer Representations for Efficient Planning in Partially Observed Environments
par: Dedieu, Antoine, et autres
Publié: (2024)
par: Dedieu, Antoine, et autres
Publié: (2024)
Discovering Multiagent Learning Algorithms with Large Language Models
par: Li, Zun, et autres
Publié: (2026)
par: Li, Zun, et autres
Publié: (2026)
Code-Space Response Oracles: Generating Interpretable Multi-Agent Policies with Large Language Models
par: Hennes, Daniel, et autres
Publié: (2026)
par: Hennes, Daniel, et autres
Publié: (2026)
Diffusion Model Predictive Control
par: Zhou, Guangyao, et autres
Publié: (2024)
par: Zhou, Guangyao, et autres
Publié: (2024)
Model Predictive Simulation Using Structured Graphical Models and Transformers
par: Lou, Xinghua, et autres
Publié: (2024)
par: Lou, Xinghua, et autres
Publié: (2024)
Combining Tree-Search, Generative Models, and Nash Bargaining Concepts in Game-Theoretic Reinforcement Learning
par: Li, Zun, et autres
Publié: (2023)
par: Li, Zun, et autres
Publié: (2023)
Nash without Numbers: A Social Choice Approach to Mixed Equilibria in Context-Ordinal Games
par: Gemp, Ian, et autres
Publié: (2026)
par: Gemp, Ian, et autres
Publié: (2026)
Active Evaluation of General Agents: Problem Definition and Comparison of Baseline Algorithms
par: Lanctot, Marc, et autres
Publié: (2026)
par: Lanctot, Marc, et autres
Publié: (2026)
What type of inference is planning?
par: Lázaro-Gredilla, Miguel, et autres
Publié: (2024)
par: Lázaro-Gredilla, Miguel, et autres
Publié: (2024)
Deviation Ratings: A General, Clone-Invariant Rating Method
par: Marris, Luke, et autres
Publié: (2025)
par: Marris, Luke, et autres
Publié: (2025)
Prosody for Intuitive Robotic Interface Design: It's Not What You Said, It's How You Said It
par: Sanoubari, Elaheh, et autres
Publié: (2024)
par: Sanoubari, Elaheh, et autres
Publié: (2024)
Re-evaluating Open-ended Evaluation of Large Language Models
par: Liu, Siqi, et autres
Publié: (2025)
par: Liu, Siqi, et autres
Publié: (2025)
Mastering Board Games by External and Internal Planning with Language Models
par: Schultz, John, et autres
Publié: (2024)
par: Schultz, John, et autres
Publié: (2024)
Joint Learning of Hierarchical Neural Options and Abstract World Model
par: Piriyakulkij, Wasu Top, et autres
Publié: (2026)
par: Piriyakulkij, Wasu Top, et autres
Publié: (2026)
Nash Equilibria via Stochastic Eigendecomposition
par: Gemp, Ian
Publié: (2024)
par: Gemp, Ian
Publié: (2024)
Problembezeichnung und Problemerlebnis - Gedanken zum problematischen Selbstverständnis einer Übersetzungswissenschaft
par: Ismail Işcen
Publié: (2005)
par: Ismail Işcen
Publié: (2005)
SUPRAPEA:Temperature-dependent Structural Evolution of Defatted and Non-defatted Pea Globulins: SAXS and SR-CD Study
par: Atil, Gokhan
Publié: (2026)
par: Atil, Gokhan
Publié: (2026)
Analysis of Threat-Based Manipulation in Large Language Models: A Dual Perspective on Vulnerabilities and Performance Enhancement Opportunities
par: Samancioglu, Atil
Publié: (2025)
par: Samancioglu, Atil
Publié: (2025)
Partition Tree Weighting for Non-Stationary Stochastic Bandits
par: Veness, Joel, et autres
Publié: (2025)
par: Veness, Joel, et autres
Publié: (2025)
Enumerative geometry of $K3$ surfaces
par: Dedieu, Thomas
Publié: (2026)
par: Dedieu, Thomas
Publié: (2026)
Two lectures on the enumeration of curves by means of floor diagrams
par: Dedieu, Thomas
Publié: (2025)
par: Dedieu, Thomas
Publié: (2025)
Some classical formulæ for curves and surfaces
par: Dedieu, Thomas
Publié: (2025)
par: Dedieu, Thomas
Publié: (2025)
Node polynomials for curves on surfaces
par: Dedieu, Thomas
Publié: (2025)
par: Dedieu, Thomas
Publié: (2025)
Approximating the Core via Iterative Coalition Sampling
par: Gemp, Ian, et autres
Publié: (2024)
par: Gemp, Ian, et autres
Publié: (2024)
Question-Answering Based Summarization of Electronic Health Records using Retrieval Augmented Generation
par: Saba, Walid, et autres
Publié: (2024)
par: Saba, Walid, et autres
Publié: (2024)
Rafael M. Mérida Jiménez (2016). Transbarcelonas. Cultura, género y sexualidad en la España del siglo XX. Barcelona: Edicions Bellaterra. ISBN: 9788472907423
par: Jordi Mas Grau
Publié: (2016)
par: Jordi Mas Grau
Publié: (2016)
LLMs are Greedy Agents: Effects of RL Fine-tuning on Decision-Making Abilities
par: Schmied, Thomas, et autres
Publié: (2025)
par: Schmied, Thomas, et autres
Publié: (2025)
Steering Language Models with Game-Theoretic Solvers
par: Gemp, Ian, et autres
Publié: (2024)
par: Gemp, Ian, et autres
Publié: (2024)
Innovationspotenziale – Entdecken! Wertschätzen! Nutzen!
par: Dornaus, Christina, et autres
Publié: (2026)
par: Dornaus, Christina, et autres
Publié: (2026)
Why is prompting hard? Understanding prompts on binary sequence predictors
par: Wenliang, Li Kevin, et autres
Publié: (2025)
par: Wenliang, Li Kevin, et autres
Publié: (2025)
$K3$ curves with index $k>1$
par: Ciliberto, Ciro, et autres
Publié: (2020)
par: Ciliberto, Ciro, et autres
Publié: (2020)
Extensions of curves with high degree with respect to the genus
par: Ciliberto, Ciro, et autres
Publié: (2023)
par: Ciliberto, Ciro, et autres
Publié: (2023)
Deformations and extensions of Gorenstein weighted projective spaces
par: Dedieu, Thomas, et autres
Publié: (2021)
par: Dedieu, Thomas, et autres
Publié: (2021)
Generalized weight properties of resultants and discriminants, and applications to projective enumerative geometry
par: Busé, Laurent, et autres
Publié: (2018)
par: Busé, Laurent, et autres
Publié: (2018)
LLM-Mediated Guidance of MARL Systems
par: Siedler, Philipp D., et autres
Publié: (2025)
par: Siedler, Philipp D., et autres
Publié: (2025)
SAS-Prompt: Large Language Models as Numerical Optimizers for Robot Self-Improvement
par: Amor, Heni Ben, et autres
Publié: (2025)
par: Amor, Heni Ben, et autres
Publié: (2025)
The Essence of the Essence from the Web:The Metasearch Engine
par: Nath, Rajender, et autres
Publié: (2024)
par: Nath, Rajender, et autres
Publié: (2024)
Documents similaires
-
AutoHarness: improving LLM agents by automatically synthesizing a code harness
par: Lou, Xinghua, et autres
Publié: (2026) -
Improving Transformer World Models for Data-Efficient RL
par: Dedieu, Antoine, et autres
Publié: (2025) -
DMC-VB: A Benchmark for Representation Learning for Control with Visual Distractors
par: Ortiz, Joseph, et autres
Publié: (2024) -
Learning Cognitive Maps from Transformer Representations for Efficient Planning in Partially Observed Environments
par: Dedieu, Antoine, et autres
Publié: (2024) -
Discovering Multiagent Learning Algorithms with Large Language Models
par: Li, Zun, et autres
Publié: (2026)