Predicting Large Model Test Losses with a Noisy Quadratic System
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Chuning, Maddison, Chris J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Observational Scaling Laws and the Predictability of Language Model Performance
di: Ruan, Yangjun, et al.
Pubblicazione: (2024)
di: Ruan, Yangjun, et al.
Pubblicazione: (2024)
MixMax: Distributional Robustness in Function Space via Optimal Data Mixtures
di: Thudi, Anvith, et al.
Pubblicazione: (2024)
di: Thudi, Anvith, et al.
Pubblicazione: (2024)
Experts Don't Cheat: Learning What You Don't Know By Predicting Pairs
di: Johnson, Daniel D., et al.
Pubblicazione: (2024)
di: Johnson, Daniel D., et al.
Pubblicazione: (2024)
Online Algorithm for Aggregating Experts' Predictions with Unbounded Quadratic Loss
di: Korotin, Alexander, et al.
Pubblicazione: (2025)
di: Korotin, Alexander, et al.
Pubblicazione: (2025)
Bayesian Sensitivity of Causal Inference Estimators under Evidence-Based Priors
di: Dhawan, Nikita, et al.
Pubblicazione: (2026)
di: Dhawan, Nikita, et al.
Pubblicazione: (2026)
A Geometric Analysis of PCA
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2025)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2025)
Minimax Linear Regression under the Quantile Risk
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
On the Efficiency of ERM in Feature Learning
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
di: Hanchi, Ayoub El, et al.
Pubblicazione: (2024)
Noisy Test-Time Adaptation in Vision-Language Models
di: Cao, Chentao, et al.
Pubblicazione: (2025)
di: Cao, Chentao, et al.
Pubblicazione: (2025)
Generalizing Linear Autoencoder Recommenders with Decoupled Expected Quadratic Loss
di: Guo, Ruixin, et al.
Pubblicazione: (2026)
di: Guo, Ruixin, et al.
Pubblicazione: (2026)
Unified World Models: Coupling Video and Action Diffusion for Pretraining on Large Robotic Datasets
di: Zhu, Chuning, et al.
Pubblicazione: (2025)
di: Zhu, Chuning, et al.
Pubblicazione: (2025)
MixMin: Finding Data Mixtures via Convex Minimization
di: Thudi, Anvith, et al.
Pubblicazione: (2025)
di: Thudi, Anvith, et al.
Pubblicazione: (2025)
Convergent Privacy Loss of Noisy-SGD without Convexity and Smoothness
di: Chien, Eli, et al.
Pubblicazione: (2024)
di: Chien, Eli, et al.
Pubblicazione: (2024)
FAFE: Immune Complex Modeling with Geodesic Distance Loss on Noisy Group Frames
di: Wu, Ruidong, et al.
Pubblicazione: (2024)
di: Wu, Ruidong, et al.
Pubblicazione: (2024)
Loss-Controlling Calibration for Predictive Models
di: Wang, Di, et al.
Pubblicazione: (2023)
di: Wang, Di, et al.
Pubblicazione: (2023)
An Empirical Study on Noisy Data and LLM Pretraining Loss Divergence
di: Zhang, Qizhen, et al.
Pubblicazione: (2026)
di: Zhang, Qizhen, et al.
Pubblicazione: (2026)
Introducing Fractional Classification Loss for Robust Learning with Noisy Labels
di: Kurucu, Mert Can, et al.
Pubblicazione: (2025)
di: Kurucu, Mert Can, et al.
Pubblicazione: (2025)
Robust Loss Functions for Training Decision Trees with Noisy Labels
di: Wilton, Jonathan, et al.
Pubblicazione: (2023)
di: Wilton, Jonathan, et al.
Pubblicazione: (2023)
Reasoning to Learn from Latent Thoughts
di: Ruan, Yangjun, et al.
Pubblicazione: (2025)
di: Ruan, Yangjun, et al.
Pubblicazione: (2025)
Semantic World Models
di: Berg, Jacob, et al.
Pubblicazione: (2025)
di: Berg, Jacob, et al.
Pubblicazione: (2025)
Causal Risk Minimization for High-Dimensional Treatments
di: Dhawan, Nikita, et al.
Pubblicazione: (2026)
di: Dhawan, Nikita, et al.
Pubblicazione: (2026)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
di: Dong, Honghua, et al.
Pubblicazione: (2024)
di: Dong, Honghua, et al.
Pubblicazione: (2024)
Tree-Based Predictive Models for Noisy Input Data
di: McCoy, Kevin, et al.
Pubblicazione: (2026)
di: McCoy, Kevin, et al.
Pubblicazione: (2026)
On Symmetric Losses for Robust Policy Optimization with Noisy Preferences
di: Nishimori, Soichiro, et al.
Pubblicazione: (2025)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2025)
Distributional Successor Features Enable Zero-Shot Policy Optimization
di: Zhu, Chuning, et al.
Pubblicazione: (2024)
di: Zhu, Chuning, et al.
Pubblicazione: (2024)
Enhancing Noise-Robust Losses for Large-Scale Noisy Data Learning
di: Staats, Max, et al.
Pubblicazione: (2023)
di: Staats, Max, et al.
Pubblicazione: (2023)
ASID: Active Exploration for System Identification in Robotic Manipulation
di: Memmel, Marius, et al.
Pubblicazione: (2024)
di: Memmel, Marius, et al.
Pubblicazione: (2024)
Test-Time Fairness and Robustness in Large Language Models
di: Cotta, Leonardo, et al.
Pubblicazione: (2024)
di: Cotta, Leonardo, et al.
Pubblicazione: (2024)
Joint Asymmetric Loss for Learning with Noisy Labels
di: Wang, Jialiang, et al.
Pubblicazione: (2025)
di: Wang, Jialiang, et al.
Pubblicazione: (2025)
Conformal Loss-Controlling Prediction
di: Wang, Di, et al.
Pubblicazione: (2023)
di: Wang, Di, et al.
Pubblicazione: (2023)
Correcting Noisy Multilabel Predictions: Modeling Label Noise through Latent Space Shifts
di: Huang, Weipeng, et al.
Pubblicazione: (2025)
di: Huang, Weipeng, et al.
Pubblicazione: (2025)
End-To-End Causal Effect Estimation from Unstructured Natural Language Data
di: Dhawan, Nikita, et al.
Pubblicazione: (2024)
di: Dhawan, Nikita, et al.
Pubblicazione: (2024)
Deep Generative Modeling for Identification of Noisy, Non-Stationary Dynamical Systems
di: Voina, Doris, et al.
Pubblicazione: (2024)
di: Voina, Doris, et al.
Pubblicazione: (2024)
Interpolation Conditions for Data Consistency and Prediction in Noisy Linear Systems
di: Vanelli, Martina, et al.
Pubblicazione: (2025)
di: Vanelli, Martina, et al.
Pubblicazione: (2025)
Blending Complementary Memory Systems in Hybrid Quadratic-Linear Transformers
di: Irie, Kazuki, et al.
Pubblicazione: (2025)
di: Irie, Kazuki, et al.
Pubblicazione: (2025)
MVeLMA: Multimodal Vegetation Loss Modeling Architecture for Predicting Post-fire Vegetation Loss
di: Ravi, Meenu, et al.
Pubblicazione: (2025)
di: Ravi, Meenu, et al.
Pubblicazione: (2025)
Overfitting and Generalizing with (PAC) Bayesian Prediction in Noisy Binary Classification
di: Zhu, Xiaohan, et al.
Pubblicazione: (2026)
di: Zhu, Xiaohan, et al.
Pubblicazione: (2026)
Noisy Early Stopping for Noisy Labels
di: Toner, William, et al.
Pubblicazione: (2024)
di: Toner, William, et al.
Pubblicazione: (2024)
Smooth Quadratic Prediction Markets
di: Nueve, Enrique, et al.
Pubblicazione: (2025)
di: Nueve, Enrique, et al.
Pubblicazione: (2025)
Multiple Testing of Linear Forms for Noisy Matrix Completion
di: Ma, Wanteng, et al.
Pubblicazione: (2023)
di: Ma, Wanteng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Observational Scaling Laws and the Predictability of Language Model Performance
di: Ruan, Yangjun, et al.
Pubblicazione: (2024) -
MixMax: Distributional Robustness in Function Space via Optimal Data Mixtures
di: Thudi, Anvith, et al.
Pubblicazione: (2024) -
Experts Don't Cheat: Learning What You Don't Know By Predicting Pairs
di: Johnson, Daniel D., et al.
Pubblicazione: (2024) -
Online Algorithm for Aggregating Experts' Predictions with Unbounded Quadratic Loss
di: Korotin, Alexander, et al.
Pubblicazione: (2025) -
Bayesian Sensitivity of Causal Inference Estimators under Evidence-Based Priors
di: Dhawan, Nikita, et al.
Pubblicazione: (2026)