(Mis)Fitting: A Survey of Scaling Laws
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Margaret, Kudugunta, Sneha, Zettlemoyer, Luke |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Slicing and Dicing: Configuring Optimal Mixtures of Experts
par: Li, Margaret, et autres
Publié: (2026)
par: Li, Margaret, et autres
Publié: (2026)
A Causal Lens for Evaluating Faithfulness Metrics
par: Zaman, Kerem, et autres
Publié: (2025)
par: Zaman, Kerem, et autres
Publié: (2025)
From Ground Truth to Measurement: A Statistical Framework for Human Labeling
par: Chew, Robert, et autres
Publié: (2026)
par: Chew, Robert, et autres
Publié: (2026)
Enhancing Causal Reasoning in Large Language Models: A Causal Attribution Model for Precision Fine-Tuning
par: Cai, Hengrui, et autres
Publié: (2023)
par: Cai, Hengrui, et autres
Publié: (2023)
Text Rationalization for Robust Causal Effect Estimation
par: Zhang, Lijinghua, et autres
Publié: (2025)
par: Zhang, Lijinghua, et autres
Publié: (2025)
The Leaderboard Illusion
par: Singh, Shivalika, et autres
Publié: (2025)
par: Singh, Shivalika, et autres
Publié: (2025)
Majority of the Bests: Improving Best-of-N via Bootstrapping
par: Rakhsha, Amin, et autres
Publié: (2025)
par: Rakhsha, Amin, et autres
Publié: (2025)
Embedding Trust: Semantic Isotropy Predicts Nonfactuality in Long-Form Text Generation
par: Bhardwaj, Dhrupad, et autres
Publié: (2025)
par: Bhardwaj, Dhrupad, et autres
Publié: (2025)
RCT Rejection Sampling for Causal Estimation Evaluation
par: Keith, Katherine A., et autres
Publié: (2023)
par: Keith, Katherine A., et autres
Publié: (2023)
Evaluating Interventional Reasoning Capabilities of Large Language Models
par: Kasetty, Tejas, et autres
Publié: (2024)
par: Kasetty, Tejas, et autres
Publié: (2024)
AutoEval Done Right: Using Synthetic Data for Model Evaluation
par: Boyeau, Pierre, et autres
Publié: (2024)
par: Boyeau, Pierre, et autres
Publié: (2024)
Efficient Exploration for LLMs
par: Dwaracherla, Vikranth, et autres
Publié: (2024)
par: Dwaracherla, Vikranth, et autres
Publié: (2024)
ALCM: Autonomous LLM-Augmented Causal Discovery Framework
par: Khatibi, Elahe, et autres
Publié: (2024)
par: Khatibi, Elahe, et autres
Publié: (2024)
Adaptive Uncertainty Quantification for Generative AI
par: Kim, Jungeum, et autres
Publié: (2024)
par: Kim, Jungeum, et autres
Publié: (2024)
Industrial-Grade Smart Troubleshooting through Causal Technical Language Processing: a Proof of Concept
par: Trilla, Alexandre, et autres
Publié: (2024)
par: Trilla, Alexandre, et autres
Publié: (2024)
Propagation and Pitfalls: Reasoning-based Assessment of Knowledge Editing through Counterfactual Tasks
par: Hua, Wenyue, et autres
Publié: (2024)
par: Hua, Wenyue, et autres
Publié: (2024)
CLEAR: Can Language Models Really Understand Causal Graphs?
par: Chen, Sirui, et autres
Publié: (2024)
par: Chen, Sirui, et autres
Publié: (2024)
Uncertainty Quantification for Prior-Data Fitted Networks using Martingale Posteriors
par: Nagler, Thomas, et autres
Publié: (2025)
par: Nagler, Thomas, et autres
Publié: (2025)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
par: Nguyen, Thao, et autres
Publié: (2025)
par: Nguyen, Thao, et autres
Publié: (2025)
Removing Spurious Correlation from Neural Network Interpretations
par: Fotouhi, Milad, et autres
Publié: (2024)
par: Fotouhi, Milad, et autres
Publié: (2024)
Language Models as Causal Effect Generators
par: Bynum, Lucius E. J., et autres
Publié: (2024)
par: Bynum, Lucius E. J., et autres
Publié: (2024)
Discovering influential text using convolutional neural networks
par: Ayers, Megan, et autres
Publié: (2024)
par: Ayers, Megan, et autres
Publié: (2024)
Better Alignment with Instruction Back-and-Forth Translation
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
A Comparative Study of DSPy Teleprompter Algorithms for Aligning Large Language Models Evaluation Metrics to Human Evaluation
par: Sarmah, Bhaskarjit, et autres
Publié: (2024)
par: Sarmah, Bhaskarjit, et autres
Publié: (2024)
Few-shot Personalization of LLMs with Mis-aligned Responses
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
Distillation Scaling Laws
par: Busbridge, Dan, et autres
Publié: (2025)
par: Busbridge, Dan, et autres
Publié: (2025)
P$^2$ Law: Scaling Law for Post-Training After Model Pruning
par: Chen, Xiaodong, et autres
Publié: (2024)
par: Chen, Xiaodong, et autres
Publié: (2024)
What Scales in Cross-Entropy Scaling Law?
par: Yan, Junxi, et autres
Publié: (2025)
par: Yan, Junxi, et autres
Publié: (2025)
Can Language Models Discover Scaling Laws?
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
Mind Your Tone: Investigating How Prompt Politeness Affects LLM Accuracy (short paper)
par: Dobariya, Om, et autres
Publié: (2025)
par: Dobariya, Om, et autres
Publié: (2025)
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
par: Shao, Rulin, et autres
Publié: (2024)
par: Shao, Rulin, et autres
Publié: (2024)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
par: Min, Sewon, et autres
Publié: (2023)
par: Min, Sewon, et autres
Publié: (2023)
MisSynth: Improving MISSCI Logical Fallacies Classification with Synthetic Data
par: Poliakov, Mykhailo, et autres
Publié: (2025)
par: Poliakov, Mykhailo, et autres
Publié: (2025)
Alignment Pretraining: AI Discourse Causes Self-Fulfilling (Mis)alignment
par: Tice, Cameron, et autres
Publié: (2026)
par: Tice, Cameron, et autres
Publié: (2026)
Theoretical Foundations of Scaling Law in Familial Models
par: Song, Huan, et autres
Publié: (2025)
par: Song, Huan, et autres
Publié: (2025)
Generative Adapter: Contextualizing Language Models in Parameters with A Single Forward Pass
par: Chen, Tong, et autres
Publié: (2024)
par: Chen, Tong, et autres
Publié: (2024)
A Hitchhiker's Guide to Scaling Law Estimation
par: Choshen, Leshem, et autres
Publié: (2024)
par: Choshen, Leshem, et autres
Publié: (2024)
Evaluation of Stress Detection as Time Series Events -- A Novel Window-Based F1-Metric
par: Skat-Rørdam, Harald Vilhelm, et autres
Publié: (2025)
par: Skat-Rørdam, Harald Vilhelm, et autres
Publié: (2025)
Fast Byte Latent Transformer
par: Kallini, Julie, et autres
Publié: (2026)
par: Kallini, Julie, et autres
Publié: (2026)
Documents similaires
-
Slicing and Dicing: Configuring Optimal Mixtures of Experts
par: Li, Margaret, et autres
Publié: (2026) -
A Causal Lens for Evaluating Faithfulness Metrics
par: Zaman, Kerem, et autres
Publié: (2025) -
From Ground Truth to Measurement: A Statistical Framework for Human Labeling
par: Chew, Robert, et autres
Publié: (2026) -
Enhancing Causal Reasoning in Large Language Models: A Causal Attribution Model for Precision Fine-Tuning
par: Cai, Hengrui, et autres
Publié: (2023) -
Text Rationalization for Robust Causal Effect Estimation
par: Zhang, Lijinghua, et autres
Publié: (2025)