Scales++: Compute Efficient Evaluation Subset Selection with Cognitive Scales Embeddings
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bean, Andrew M., Seedat, Nabeel, Chen, Shengzhuang, Schwarz, Jonathan Richard |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
To Whom Do Language Models Align? Measuring Principal Hierarchies Under High-Stakes Competing Demands
par: Yu, Fangyi, et autres
Publié: (2026)
par: Yu, Fangyi, et autres
Publié: (2026)
ADMIRE-BayesOpt: Accelerated Data MIxture RE-weighting for Language Models with Bayesian Optimization
par: Chen, Shengzhuang, et autres
Publié: (2025)
par: Chen, Shengzhuang, et autres
Publié: (2025)
When is Off-Policy Evaluation (Reward Modeling) Useful in Contextual Bandits? A Data-Centric Perspective
par: Sun, Hao, et autres
Publié: (2023)
par: Sun, Hao, et autres
Publié: (2023)
You can't handle the (dirty) truth: Data-centric insights improve pseudo-labeling
par: Seedat, Nabeel, et autres
Publié: (2024)
par: Seedat, Nabeel, et autres
Publié: (2024)
Large Language Models to Enhance Bayesian Optimization
par: Liu, Tennison, et autres
Publié: (2024)
par: Liu, Tennison, et autres
Publié: (2024)
Self-Healing Machine Learning: A Framework for Autonomous Adaptation in Real-World Environments
par: Rauba, Paulius, et autres
Publié: (2024)
par: Rauba, Paulius, et autres
Publié: (2024)
DAGnosis: Localized Identification of Data Inconsistencies using Structures
par: Huynh, Nicolas, et autres
Publié: (2024)
par: Huynh, Nicolas, et autres
Publié: (2024)
Curated LLM: Synergy of LLMs and Data Curation for tabular augmentation in low-data regimes
par: Seedat, Nabeel, et autres
Publié: (2023)
par: Seedat, Nabeel, et autres
Publié: (2023)
DC-Check: A Data-Centric AI checklist to guide the development of reliable machine learning systems
par: Seedat, Nabeel, et autres
Publié: (2022)
par: Seedat, Nabeel, et autres
Publié: (2022)
CoScale-RL: Efficient Post-Training by Co-Scaling Data and Computation
par: Chen, Yutong, et autres
Publié: (2026)
par: Chen, Yutong, et autres
Publié: (2026)
Beyond Pointwise Scores: Decomposed Criteria-Based Evaluation of LLM Responses
par: Yu, Fangyi, et autres
Publié: (2025)
par: Yu, Fangyi, et autres
Publié: (2025)
Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts
par: Chen, Shengzhuang, et autres
Publié: (2025)
par: Chen, Shengzhuang, et autres
Publié: (2025)
PSNE: Efficient Spectral Sparsification Algorithms for Scaling Network Embedding
par: Lin, Longlong, et autres
Publié: (2024)
par: Lin, Longlong, et autres
Publié: (2024)
Influence-Guided Symbolic Regression: Scientific Discovery via LLM-Driven Equation Search with Granular Feedback
par: Saveliev, Evgeny S., et autres
Publié: (2026)
par: Saveliev, Evgeny S., et autres
Publié: (2026)
DataS^3: Dataset Subset Selection for Specialization
par: Hulkund, Neha, et autres
Publié: (2025)
par: Hulkund, Neha, et autres
Publié: (2025)
Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
Bandit Guided Submodular Curriculum for Adaptive Subset Selection
par: Chanda, Prateek, et autres
Publié: (2025)
par: Chanda, Prateek, et autres
Publié: (2025)
You Only Train Once: Differentiable Subset Selection for Omics Data
par: Chopard, Daphné, et autres
Publié: (2025)
par: Chopard, Daphné, et autres
Publié: (2025)
Compute-Optimal LLMs Provably Generalize Better With Scale
par: Finzi, Marc, et autres
Publié: (2025)
par: Finzi, Marc, et autres
Publié: (2025)
NuTime: Numerically Multi-Scaled Embedding for Large-Scale Time-Series Pretraining
par: Lin, Chenguo, et autres
Publié: (2023)
par: Lin, Chenguo, et autres
Publié: (2023)
Selecting Subsets of Source Data for Transfer Learning with Applications in Metal Additive Manufacturing
par: Tang, Yifan, et autres
Publié: (2024)
par: Tang, Yifan, et autres
Publié: (2024)
Efficient Exploration at Scale
par: Asghari, Seyed Mohammad, et autres
Publié: (2026)
par: Asghari, Seyed Mohammad, et autres
Publié: (2026)
Scaling Embeddings Outperforms Scaling Experts in Language Models
par: Liu, Hong, et autres
Publié: (2026)
par: Liu, Hong, et autres
Publié: (2026)
LinkedIn Post Embeddings: Industrial Scale Embedding Generation and Usage across LinkedIn
par: Ramanujam, Sudarshan Srinivasa, et autres
Publié: (2024)
par: Ramanujam, Sudarshan Srinivasa, et autres
Publié: (2024)
Leveraging Data Symmetries to Select an Optimal Subset of Training Data under Label Noise
par: Shubham, Kumar, et autres
Publié: (2026)
par: Shubham, Kumar, et autres
Publié: (2026)
Market-Driven Subset Selection for Budgeted Training
par: Jha, Ashish, et autres
Publié: (2025)
par: Jha, Ashish, et autres
Publié: (2025)
CLIP-Embed-KD: Computationally Efficient Knowledge Distillation Using Embeddings as Teachers
par: Nair, Lakshmi
Publié: (2024)
par: Nair, Lakshmi
Publié: (2024)
Class-based Subset Selection for Transfer Learning under Extreme Label Shift
par: Goyal, Akul, et autres
Publié: (2024)
par: Goyal, Akul, et autres
Publié: (2024)
Memory-Efficient Gradient Unrolling for Large-Scale Bi-level Optimization
par: Shen, Qianli, et autres
Publié: (2024)
par: Shen, Qianli, et autres
Publié: (2024)
The Art of Scaling Reinforcement Learning Compute for LLMs
par: Khatri, Devvrit, et autres
Publié: (2025)
par: Khatri, Devvrit, et autres
Publié: (2025)
Evaluation-driven Scaling for Scientific Discovery
par: Ye, Haotian, et autres
Publié: (2026)
par: Ye, Haotian, et autres
Publié: (2026)
IsoCompute Playbook: Optimally Scaling Sampling Compute for LLM RL
par: Cheng, Zhoujun, et autres
Publié: (2026)
par: Cheng, Zhoujun, et autres
Publié: (2026)
CauScale: Neural Causal Discovery at Scale
par: Peng, Bo, et autres
Publié: (2026)
par: Peng, Bo, et autres
Publié: (2026)
Scaling Strategy, Not Compute: A Stand-Alone, Open-Source StarCraft II Benchmark for Accessible Reinforcement Learning Research
par: Panda, Sourav, et autres
Publié: (2026)
par: Panda, Sourav, et autres
Publié: (2026)
Efficient Deep Learning Infrastructures for Embedded Computing Systems: A Comprehensive Survey and Future Envision
par: Luo, Xiangzhong, et autres
Publié: (2024)
par: Luo, Xiangzhong, et autres
Publié: (2024)
LOCUS: Low-Dimensional Model Embeddings for Efficient Model Exploration, Comparison, and Selection
par: Patel, Shivam, et autres
Publié: (2026)
par: Patel, Shivam, et autres
Publié: (2026)
Large Language Monkeys: Scaling Inference Compute with Repeated Sampling
par: Brown, Bradley, et autres
Publié: (2024)
par: Brown, Bradley, et autres
Publié: (2024)
Computation-Aware Kalman Filtering with Model Selection for Neural Dynamics
par: Huml, JR, et autres
Publié: (2026)
par: Huml, JR, et autres
Publié: (2026)
Scaling Laws for Data-Efficient Visual Transfer Learning
par: Yang, Wenxuan, et autres
Publié: (2025)
par: Yang, Wenxuan, et autres
Publié: (2025)
DynScaling: Efficient Verifier-free Inference Scaling via Dynamic and Integrated Sampling
par: Wang, Fei, et autres
Publié: (2025)
par: Wang, Fei, et autres
Publié: (2025)
Documents similaires
-
To Whom Do Language Models Align? Measuring Principal Hierarchies Under High-Stakes Competing Demands
par: Yu, Fangyi, et autres
Publié: (2026) -
ADMIRE-BayesOpt: Accelerated Data MIxture RE-weighting for Language Models with Bayesian Optimization
par: Chen, Shengzhuang, et autres
Publié: (2025) -
When is Off-Policy Evaluation (Reward Modeling) Useful in Contextual Bandits? A Data-Centric Perspective
par: Sun, Hao, et autres
Publié: (2023) -
You can't handle the (dirty) truth: Data-centric insights improve pseudo-labeling
par: Seedat, Nabeel, et autres
Publié: (2024) -
Large Language Models to Enhance Bayesian Optimization
par: Liu, Tennison, et autres
Publié: (2024)