SR-TTT: Surprisal-Aware Residual Test-Time Training
Fuente:
arXiv
Salvato in:
| Autore principale: | P, Swamynathan V |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
di: Akyürek, Ekin, et al.
Pubblicazione: (2024)
di: Akyürek, Ekin, et al.
Pubblicazione: (2024)
In-Place Test-Time Training
di: Feng, Guhao, et al.
Pubblicazione: (2026)
di: Feng, Guhao, et al.
Pubblicazione: (2026)
Self-Trained Verification for Training- and Test-Time Self-Improvement
di: Wu, Chen Henry, et al.
Pubblicazione: (2026)
di: Wu, Chen Henry, et al.
Pubblicazione: (2026)
Latency and Token-Aware Test-Time Compute
di: Huang, Jenny Y., et al.
Pubblicazione: (2025)
di: Huang, Jenny Y., et al.
Pubblicazione: (2025)
MMLU-SR: A Benchmark for Stress-Testing Reasoning Capability of Large Language Models
di: Wang, Wentian, et al.
Pubblicazione: (2024)
di: Wang, Wentian, et al.
Pubblicazione: (2024)
Test-Time Detoxification without Training or Learning Anything
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
Enhancing LLM Reasoning via Critique Models with Test-Time and Training-Time Supervision
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
REE-TTT: Highly Adaptive Radar Echo Extrapolation Based on Test-Time Training
di: Di, Xin, et al.
Pubblicazione: (2026)
di: Di, Xin, et al.
Pubblicazione: (2026)
Query-Conditioned Test-Time Self-Training for Large Language Models
di: Song, Chaehee, et al.
Pubblicazione: (2026)
di: Song, Chaehee, et al.
Pubblicazione: (2026)
MesaNet: Sequence Modeling by Locally Optimal Test-Time Training
di: von Oswald, Johannes, et al.
Pubblicazione: (2025)
di: von Oswald, Johannes, et al.
Pubblicazione: (2025)
Calibrated Surprise: An Information-Theoretic Account of Creative Quality
di: Zou, Bo, et al.
Pubblicazione: (2026)
di: Zou, Bo, et al.
Pubblicazione: (2026)
A Surprising Failure? Multimodal LLMs and the NLVR Challenge
di: Wu, Anne, et al.
Pubblicazione: (2024)
di: Wu, Anne, et al.
Pubblicazione: (2024)
scFusionTTT: Single-cell transcriptomics and proteomics fusion with Test-Time Training layers
di: Meng, Dian, et al.
Pubblicazione: (2024)
di: Meng, Dian, et al.
Pubblicazione: (2024)
Time-Aware Feature Selection: Adaptive Temporal Masking for Stable Sparse Autoencoder Training
di: Li, T. Ed, et al.
Pubblicazione: (2025)
di: Li, T. Ed, et al.
Pubblicazione: (2025)
AutoDiscovery: Open-ended Scientific Discovery via Bayesian Surprise
di: Agarwal, Dhruv, et al.
Pubblicazione: (2025)
di: Agarwal, Dhruv, et al.
Pubblicazione: (2025)
SuRe: Surprise-Driven Prioritised Replay for Continual LLM Learning
di: Hazard, Hugo, et al.
Pubblicazione: (2025)
di: Hazard, Hugo, et al.
Pubblicazione: (2025)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
Noise-Aware Training of Layout-Aware Language Models
di: Sarkhel, Ritesh, et al.
Pubblicazione: (2024)
di: Sarkhel, Ritesh, et al.
Pubblicazione: (2024)
"I've Seen How This Goes": Characterizing Diversity via Progressive Conditional Surprise
di: Khoriaty, Matthew, et al.
Pubblicazione: (2026)
di: Khoriaty, Matthew, et al.
Pubblicazione: (2026)
Training-Trajectory-Aware Token Selection
di: Shen, Zhanming, et al.
Pubblicazione: (2026)
di: Shen, Zhanming, et al.
Pubblicazione: (2026)
Training on the Test Task Confounds Evaluation and Emergence
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2024)
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2024)
Test-Time Safety Alignment
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
di: Saglam, Baturay, et al.
Pubblicazione: (2026)
Low-Rank Quantization-Aware Training for LLMs
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
Online Reasoning Calibration: Test-Time Training Enables Generalizable Conformal LLM Reasoning
di: Zhou, Cai, et al.
Pubblicazione: (2026)
di: Zhou, Cai, et al.
Pubblicazione: (2026)
Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context
di: Alizadeh, Keivan, et al.
Pubblicazione: (2026)
di: Alizadeh, Keivan, et al.
Pubblicazione: (2026)
Continuous Approximations for Improving Quantization Aware Training of LLMs
di: Li, He, et al.
Pubblicazione: (2024)
di: Li, He, et al.
Pubblicazione: (2024)
Titans: Learning to Memorize at Test Time
di: Behrouz, Ali, et al.
Pubblicazione: (2024)
di: Behrouz, Ali, et al.
Pubblicazione: (2024)
Vector Policy Optimization: Training for Diversity Improves Test-Time Search
di: Bahlous-Boldi, Ryan, et al.
Pubblicazione: (2026)
di: Bahlous-Boldi, Ryan, et al.
Pubblicazione: (2026)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2025)
It's Not That Simple. An Analysis of Simple Test-Time Scaling
di: Wu, Guojun
Pubblicazione: (2025)
di: Wu, Guojun
Pubblicazione: (2025)
Self-Improving LLM Agents at Test-Time
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
On the Role of Temperature Sampling in Test-Time Scaling
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
di: Wu, Yuheng, et al.
Pubblicazione: (2025)
Crosslingual Reasoning through Test-Time Scaling
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
Test-Time Learning for Large Language Models
di: Hu, Jinwu, et al.
Pubblicazione: (2025)
di: Hu, Jinwu, et al.
Pubblicazione: (2025)
Learning to Reason from Feedback at Test-Time
di: Li, Yanyang, et al.
Pubblicazione: (2025)
di: Li, Yanyang, et al.
Pubblicazione: (2025)
Reinforcement Learning Teachers of Test Time Scaling
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
di: Chen, Mengzhao, et al.
Pubblicazione: (2024)
di: Chen, Mengzhao, et al.
Pubblicazione: (2024)
SiLQ: Simple Large Language Model Quantization-Aware Training
di: Esser, Steven K., et al.
Pubblicazione: (2025)
di: Esser, Steven K., et al.
Pubblicazione: (2025)
SPAM: Spike-Aware Adam with Momentum Reset for Stable LLM Training
di: Huang, Tianjin, et al.
Pubblicazione: (2025)
di: Huang, Tianjin, et al.
Pubblicazione: (2025)
AutoScale: Scale-Aware Data Mixing for Pre-Training LLMs
di: Kang, Feiyang, et al.
Pubblicazione: (2024)
di: Kang, Feiyang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
di: Akyürek, Ekin, et al.
Pubblicazione: (2024) -
In-Place Test-Time Training
di: Feng, Guhao, et al.
Pubblicazione: (2026) -
Self-Trained Verification for Training- and Test-Time Self-Improvement
di: Wu, Chen Henry, et al.
Pubblicazione: (2026) -
Latency and Token-Aware Test-Time Compute
di: Huang, Jenny Y., et al.
Pubblicazione: (2025) -
MMLU-SR: A Benchmark for Stress-Testing Reasoning Capability of Large Language Models
di: Wang, Wentian, et al.
Pubblicazione: (2024)