Improving ML Training Data with Gold-Standard Quality Metrics
Fuente:
arXiv
Salvato in:
| Autori principali: | Barrett, Leslie, Sherman, Michael W. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Closing the Curvature Gap: Full Transformer Hessians and Their Implications for Scaling Laws
di: Petrov, Egor, et al.
Pubblicazione: (2025)
di: Petrov, Egor, et al.
Pubblicazione: (2025)
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026)
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Counterfactual Causal Inference in Natural Language with Large Language Models
di: Gendron, Gaël, et al.
Pubblicazione: (2024)
di: Gendron, Gaël, et al.
Pubblicazione: (2024)
Extreme AutoML: Analysis of Classification, Regression, and NLP Performance
di: Ratner, Edward, et al.
Pubblicazione: (2024)
di: Ratner, Edward, et al.
Pubblicazione: (2024)
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
Scalable GPU-Accelerated Euler Characteristic Curves: Optimization and Differentiable Learning for PyTorch
di: Saxena, Udit
Pubblicazione: (2025)
di: Saxena, Udit
Pubblicazione: (2025)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
di: Ye, Hua, et al.
Pubblicazione: (2025)
di: Ye, Hua, et al.
Pubblicazione: (2025)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
Revisiting LRP: Positional Attribution as the Missing Ingredient for Transformer Explainability
di: Bakish, Yarden, et al.
Pubblicazione: (2025)
di: Bakish, Yarden, et al.
Pubblicazione: (2025)
QuAnTS: Question Answering on Time Series
di: Divo, Felix, et al.
Pubblicazione: (2025)
di: Divo, Felix, et al.
Pubblicazione: (2025)
Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring
di: Heyman, Alex, et al.
Pubblicazione: (2025)
di: Heyman, Alex, et al.
Pubblicazione: (2025)
Latent Instruction Representation Alignment: defending against jailbreaks, backdoors and undesired knowledge in LLMs
di: Easley, Eric, et al.
Pubblicazione: (2026)
di: Easley, Eric, et al.
Pubblicazione: (2026)
Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features
di: McCann, Jordan F.
Pubblicazione: (2026)
di: McCann, Jordan F.
Pubblicazione: (2026)
Super Apriel: One Checkpoint, Many Speeds
di: Labs, SLAM, et al.
Pubblicazione: (2026)
di: Labs, SLAM, et al.
Pubblicazione: (2026)
Learned Relay Representations for Forward-Thinking Discrete Diffusion Models
di: Rozonoyer, Benjamin, et al.
Pubblicazione: (2026)
di: Rozonoyer, Benjamin, et al.
Pubblicazione: (2026)
Why LoRA Resists Label Noise: A Theoretical Framework for Noise-Robust Parameter-Efficient Fine-Tuning
di: Steele, Brady
Pubblicazione: (2026)
di: Steele, Brady
Pubblicazione: (2026)
Variance Is Not Importance: Structural Analysis of Transformer Compressibility Across Model Scales
di: Salfati, Samuel
Pubblicazione: (2026)
di: Salfati, Samuel
Pubblicazione: (2026)
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
di: Atad, Ido Andrew, et al.
Pubblicazione: (2026)
di: Atad, Ido Andrew, et al.
Pubblicazione: (2026)
Transformer Scalability Crisis: The First Comprehensive Empirical Analysis of Performance Walls in Modern Language Models
di: Moghadasi, Mahdi Naser, et al.
Pubblicazione: (2026)
di: Moghadasi, Mahdi Naser, et al.
Pubblicazione: (2026)
The Trilemma of Truth in Large Language Models
di: Savcisens, Germans, et al.
Pubblicazione: (2025)
di: Savcisens, Germans, et al.
Pubblicazione: (2025)
Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers
di: Abramov, Roman, et al.
Pubblicazione: (2025)
di: Abramov, Roman, et al.
Pubblicazione: (2025)
PoTS: Proof-of-Training-Steps for Backdoor Detection in Large Language Models
di: Seddik, Issam, et al.
Pubblicazione: (2025)
di: Seddik, Issam, et al.
Pubblicazione: (2025)
How Does Unfaithful Reasoning Emerge from Autoregressive Training? A Study of Synthetic Experiments
di: Wang, Fuxin, et al.
Pubblicazione: (2026)
di: Wang, Fuxin, et al.
Pubblicazione: (2026)
Can Large Language Models Learn Independent Causal Mechanisms?
di: Gendron, Gaël, et al.
Pubblicazione: (2024)
di: Gendron, Gaël, et al.
Pubblicazione: (2024)
Relating Misfit to Gain in Weak-to-Strong Generalization Beyond the Squared Loss
di: Mulgund, Abhijeet, et al.
Pubblicazione: (2025)
di: Mulgund, Abhijeet, et al.
Pubblicazione: (2025)
Causal Cartographer: From Mapping to Reasoning Over Counterfactual Worlds
di: Gendron, Gaël, et al.
Pubblicazione: (2025)
di: Gendron, Gaël, et al.
Pubblicazione: (2025)
Latent Cache Flow: Model-to-Model Communication Without Text
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
The Data Efficiency Frontier of Financial Foundation Models: Scaling Laws from Continued Pretraining
di: Ponnock, Jesse
Pubblicazione: (2025)
di: Ponnock, Jesse
Pubblicazione: (2025)
Convex Optimization for Alignment and Preference Learning on a Single GPU
di: Feng, Miria, et al.
Pubblicazione: (2026)
di: Feng, Miria, et al.
Pubblicazione: (2026)
From Syntax to Semantics: Unveiling the Emergence of Chirality in SMILES Translation Models
di: Li, Zehao, et al.
Pubblicazione: (2026)
di: Li, Zehao, et al.
Pubblicazione: (2026)
QoSGMAA: A Robust Multi-Order Graph Attention and Adversarial Framework for Sparse QoS Prediction
di: Du, Guanchen, et al.
Pubblicazione: (2025)
di: Du, Guanchen, et al.
Pubblicazione: (2025)
BioAlchemy: Distilling Biological Literature into Reasoning-Ready Reinforcement Learning Training Data
di: Hsu, Brian, et al.
Pubblicazione: (2026)
di: Hsu, Brian, et al.
Pubblicazione: (2026)
Stroke Lesions as a Rosetta Stone for Language Model Interpretability
di: Fridriksson, Julius, et al.
Pubblicazione: (2026)
di: Fridriksson, Julius, et al.
Pubblicazione: (2026)
Language Models Are Implicitly Continuous
di: Marro, Samuele, et al.
Pubblicazione: (2025)
di: Marro, Samuele, et al.
Pubblicazione: (2025)
EdgeJury: Cross-Reviewed Small-Model Ensembles for Truthful Question Answering on Serverless Edge Inference
di: Kumar, Aayush
Pubblicazione: (2025)
di: Kumar, Aayush
Pubblicazione: (2025)
Evolve: A Persistent Knowledge Lifecycle for Small Language Models
di: Hovagimian, Dikran
Pubblicazione: (2026)
di: Hovagimian, Dikran
Pubblicazione: (2026)
Listwise Direct Preference Optimization with Multi-Dimensional Preference Mixing
di: Sun, Yuhui, et al.
Pubblicazione: (2025)
di: Sun, Yuhui, et al.
Pubblicazione: (2025)
Before the Last Token: Diagnosing Final-Token Safety Probe Failures
di: Doda, Shravan
Pubblicazione: (2026)
di: Doda, Shravan
Pubblicazione: (2026)
Documenti analoghi
-
Closing the Curvature Gap: Full Transformer Hessians and Their Implications for Scaling Laws
di: Petrov, Egor, et al.
Pubblicazione: (2025) -
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026) -
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025) -
Counterfactual Causal Inference in Natural Language with Large Language Models
di: Gendron, Gaël, et al.
Pubblicazione: (2024)