Learning to Discover at Test Time
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yuksekgonul, Mert, Koceja, Daniel, Li, Xinhao, Bianchi, Federico, McCaleb, Jed, Wang, Xiaolong, Kautz, Jan, Choi, Yejin, Zou, James, Guestrin, Carlos, Sun, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
End-to-End Test-Time Training for Long Context
par: Tandon, Arnuv, et autres
Publié: (2025)
par: Tandon, Arnuv, et autres
Publié: (2025)
metaTextGrad: Automatically optimizing language model optimizers
par: Xu, Guowei, et autres
Publié: (2025)
par: Xu, Guowei, et autres
Publié: (2025)
Dynamic Cheatsheet: Test-Time Learning with Adaptive Memory
par: Suzgun, Mirac, et autres
Publié: (2025)
par: Suzgun, Mirac, et autres
Publié: (2025)
TextGrad: Automatic "Differentiation" via Text
par: Yuksekgonul, Mert, et autres
Publié: (2024)
par: Yuksekgonul, Mert, et autres
Publié: (2024)
One-Minute Video Generation with Test-Time Training
par: Dalal, Karan, et autres
Publié: (2025)
par: Dalal, Karan, et autres
Publié: (2025)
Thinking agents for zero-shot generalization to qualitatively novel tasks
par: Miconi, Thomas, et autres
Publié: (2025)
par: Miconi, Thomas, et autres
Publié: (2025)
Inefficiencies of Meta Agents for Agent Design
par: El, Batu, et autres
Publié: (2025)
par: El, Batu, et autres
Publié: (2025)
Sparse Reward Subsystem in Large Language Models
par: Xu, Guowei, et autres
Publié: (2026)
par: Xu, Guowei, et autres
Publié: (2026)
Learning to (Learn at Test Time)
par: Sun, Yu, et autres
Publié: (2023)
par: Sun, Yu, et autres
Publié: (2023)
How Well Can LLMs Negotiate? NegotiationArena Platform and Analysis
par: Bianchi, Federico, et autres
Publié: (2024)
par: Bianchi, Federico, et autres
Publié: (2024)
SiriuS: Self-improving Multi-agent Systems via Bootstrapped Reasoning
par: Zhao, Wanjia, et autres
Publié: (2025)
par: Zhao, Wanjia, et autres
Publié: (2025)
Goal-Directed Search Outperforms Goal-Agnostic Memory Compression in Long-Context Memory Tasks
par: Zheng, Yicong, et autres
Publié: (2025)
par: Zheng, Yicong, et autres
Publié: (2025)
Gated DeltaNet-2: Decoupling Erase and Write in Linear Attention
par: Hatamizadeh, Ali, et autres
Publié: (2026)
par: Hatamizadeh, Ali, et autres
Publié: (2026)
Learning to (Learn at Test Time): RNNs with Expressive Hidden States
par: Sun, Yu, et autres
Publié: (2024)
par: Sun, Yu, et autres
Publié: (2024)
Discovering Implicit Large Language Model Alignment Objectives
par: Chen, Edward, et autres
Publié: (2026)
par: Chen, Edward, et autres
Publié: (2026)
Cost-of-Pass: An Economic Framework for Evaluating Language Models
par: Erol, Mehmet Hamza, et autres
Publié: (2025)
par: Erol, Mehmet Hamza, et autres
Publié: (2025)
Model Equality Testing: Which Model Is This API Serving?
par: Gao, Irena, et autres
Publié: (2024)
par: Gao, Irena, et autres
Publié: (2024)
Large Language Models are Vulnerable to Bait-and-Switch Attacks for Generating Harmful Content
par: Bianchi, Federico, et autres
Publié: (2024)
par: Bianchi, Federico, et autres
Publié: (2024)
Diversity of Thought Improves Reasoning Abilities of LLMs
par: Naik, Ranjita, et autres
Publié: (2023)
par: Naik, Ranjita, et autres
Publié: (2023)
Can LLM feedback enhance review quality? A randomized study of 20K reviews at ICLR 2025
par: Thakkar, Nitya, et autres
Publié: (2025)
par: Thakkar, Nitya, et autres
Publié: (2025)
Trust No Bot: Discovering Personal Disclosures in Human-LLM Conversations in the Wild
par: Mireshghallah, Niloofar, et autres
Publié: (2024)
par: Mireshghallah, Niloofar, et autres
Publié: (2024)
Societal Impacts Research Requires Benchmarks for Creative Composition Tasks
par: Shen, Judy Hanwen, et autres
Publié: (2025)
par: Shen, Judy Hanwen, et autres
Publié: (2025)
Benchmarking Distributional Alignment of Large Language Models
par: Meister, Nicole, et autres
Publié: (2024)
par: Meister, Nicole, et autres
Publié: (2024)
The Extractive-Abstractive Spectrum: Uncovering Verifiability Trade-offs in LLM Generations
par: Worledge, Theodora, et autres
Publié: (2024)
par: Worledge, Theodora, et autres
Publié: (2024)
Exploring the use of AI authors and reviewers at Agents4Science
par: Bianchi, Federico, et autres
Publié: (2025)
par: Bianchi, Federico, et autres
Publié: (2025)
LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models
par: Kojima, Yuto, et autres
Publié: (2025)
par: Kojima, Yuto, et autres
Publié: (2025)
Thinking While Listening: Simple Test Time Scaling For Audio Classification
par: Verma, Prateek, et autres
Publié: (2025)
par: Verma, Prateek, et autres
Publié: (2025)
iGRPO: Self-Feedback-Driven LLM Reasoning
par: Hatamizadeh, Ali, et autres
Publié: (2026)
par: Hatamizadeh, Ali, et autres
Publié: (2026)
ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models
par: Liu, Mingjie, et autres
Publié: (2025)
par: Liu, Mingjie, et autres
Publié: (2025)
Socratic-MCTS: Test-Time Visual Reasoning by Asking the Right Questions
par: Acuna, David, et autres
Publié: (2025)
par: Acuna, David, et autres
Publié: (2025)
"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
par: Zhou, Kaitlyn, et autres
Publié: (2026)
par: Zhou, Kaitlyn, et autres
Publié: (2026)
Peer Review in Nursing: A Guide for Early Career Scholars
par: Hye Ri Choi, et autres
Publié: (2025)
par: Hye Ri Choi, et autres
Publié: (2025)
Can LLMs Reason with Rules? Logic Scaffolding for Stress-Testing and Improving LLMs
par: Wang, Siyuan, et autres
Publié: (2024)
par: Wang, Siyuan, et autres
Publié: (2024)
A ghost mechanism: An analytical model of abrupt learning in recurrent networks
par: Dinc, Fatih, et autres
Publié: (2025)
par: Dinc, Fatih, et autres
Publié: (2025)
Test-Time Training on Video Streams
par: Wang, Renhao, et autres
Publié: (2023)
par: Wang, Renhao, et autres
Publié: (2023)
RLP: Reinforcement as a Pretraining Objective
par: Hatamizadeh, Ali, et autres
Publié: (2025)
par: Hatamizadeh, Ali, et autres
Publié: (2025)
Learning from Trials and Errors: Reflective Test-Time Planning for Embodied LLMs
par: Hong, Yining, et autres
Publié: (2026)
par: Hong, Yining, et autres
Publié: (2026)
Outcome Rewards Do Not Guarantee Verifiable or Causally Important Reasoning
par: Yu, Qinan, et autres
Publié: (2026)
par: Yu, Qinan, et autres
Publié: (2026)
ACORN: Performant and Predicate-Agnostic Search Over Vector Embeddings and Structured Data
par: Patel, Liana, et autres
Publié: (2024)
par: Patel, Liana, et autres
Publié: (2024)
Opt-ICL at LeWiDi-2025: Maximizing In-Context Signal from Rater Examples via Meta-Learning
par: Sorensen, Taylor, et autres
Publié: (2025)
par: Sorensen, Taylor, et autres
Publié: (2025)
Documents similaires
-
End-to-End Test-Time Training for Long Context
par: Tandon, Arnuv, et autres
Publié: (2025) -
metaTextGrad: Automatically optimizing language model optimizers
par: Xu, Guowei, et autres
Publié: (2025) -
Dynamic Cheatsheet: Test-Time Learning with Adaptive Memory
par: Suzgun, Mirac, et autres
Publié: (2025) -
TextGrad: Automatic "Differentiation" via Text
par: Yuksekgonul, Mert, et autres
Publié: (2024) -
One-Minute Video Generation with Test-Time Training
par: Dalal, Karan, et autres
Publié: (2025)