Geometric Median Matching for Robust k-Subset Selection from Noisy Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Acharya, Anish, Sanghavi, Sujay, Dimakis, Alexandros G., Dhillon, Inderjit S |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Geometric Median (GM) Matching for Robust Data Pruning
par: Acharya, Anish, et autres
Publié: (2024)
par: Acharya, Anish, et autres
Publié: (2024)
Understanding Contrastive Representation Learning from Positive Unlabeled (PU) Data
par: Acharya, Anish, et autres
Publié: (2024)
par: Acharya, Anish, et autres
Publié: (2024)
Positive Unlabeled Contrastive Learning
par: Acharya, Anish, et autres
Publié: (2022)
par: Acharya, Anish, et autres
Publié: (2022)
Towards Quantifying the Preconditioning Effect of Adam
par: Das, Rudrajit, et autres
Publié: (2024)
par: Das, Rudrajit, et autres
Publié: (2024)
When Attention Collapses: How Degenerate Layers in LLMs Enable Smaller, Stronger Models
par: Sanyal, Sunny, et autres
Publié: (2024)
par: Sanyal, Sunny, et autres
Publié: (2024)
Context-Free Synthetic Data Mitigates Forgetting
par: Bansal, Parikshit, et autres
Publié: (2025)
par: Bansal, Parikshit, et autres
Publié: (2025)
Neural Distributed Source Coding
par: Whang, Jay, et autres
Publié: (2021)
par: Whang, Jay, et autres
Publié: (2021)
Retraining with Predicted Hard Labels Provably Increases Model Accuracy
par: Das, Rudrajit, et autres
Publié: (2024)
par: Das, Rudrajit, et autres
Publié: (2024)
Consistent Diffusion Meets Tweedie: Training Exact Ambient Diffusion Models with Noisy Data
par: Daras, Giannis, et autres
Publié: (2024)
par: Daras, Giannis, et autres
Publié: (2024)
ODRPO: Ordinal Decompositions of Discrete Rewards for Robust Policy Optimization
par: Patel, Nirmal, et autres
Publié: (2026)
par: Patel, Nirmal, et autres
Publié: (2026)
Enabling Approximate Joint Sampling in Diffusion LMs
par: Bansal, Parikshit, et autres
Publié: (2025)
par: Bansal, Parikshit, et autres
Publié: (2025)
LASER: Attention with Exponential Transformation
par: Duvvuri, Sai Surya, et autres
Publié: (2024)
par: Duvvuri, Sai Surya, et autres
Publié: (2024)
Learning Mixtures of Experts with EM: A Mirror Descent Perspective
par: Fruytier, Quentin, et autres
Publié: (2024)
par: Fruytier, Quentin, et autres
Publié: (2024)
Understanding Self-Supervised Learning via Gaussian Mixture Models
par: Bansal, Parikshit, et autres
Publié: (2024)
par: Bansal, Parikshit, et autres
Publié: (2024)
Test-Time Speculation
par: Kumar, Avinash, et autres
Publié: (2026)
par: Kumar, Avinash, et autres
Publié: (2026)
SIEVE: Sample-Efficient Parametric Learning from Natural Language
par: Asawa, Parth, et autres
Publié: (2026)
par: Asawa, Parth, et autres
Publié: (2026)
HiSpec: Hierarchical Speculative Decoding for LLMs
par: Kumar, Avinash, et autres
Publié: (2025)
par: Kumar, Avinash, et autres
Publié: (2025)
Blocking Bandits
par: Basu, Soumya, et autres
Publié: (2019)
par: Basu, Soumya, et autres
Publié: (2019)
Private Geometric Median
par: Haghifam, Mahdi, et autres
Publié: (2024)
par: Haghifam, Mahdi, et autres
Publié: (2024)
LUCID: Attention with Preconditioned Representations
par: Duvvuri, Sai Surya, et autres
Publié: (2026)
par: Duvvuri, Sai Surya, et autres
Publié: (2026)
Understanding the Training Speedup from Sampling with Approximate Losses
par: Das, Rudrajit, et autres
Publié: (2024)
par: Das, Rudrajit, et autres
Publié: (2024)
Asymptotically-Optimal Gaussian Bandits with Side Observations
par: Atsidakou, Alexia, et autres
Publié: (2025)
par: Atsidakou, Alexia, et autres
Publié: (2025)
Finite-Time Logarithmic Bayes Regret Upper Bounds
par: Atsidakou, Alexia, et autres
Publié: (2023)
par: Atsidakou, Alexia, et autres
Publié: (2023)
Upweighting Easy Samples in Fine-Tuning Mitigates Forgetting
par: Sanyal, Sunny, et autres
Publié: (2025)
par: Sanyal, Sunny, et autres
Publié: (2025)
Adaptive and Optimal Second-order Optimistic Methods for Minimax Optimization
par: Jiang, Ruichen, et autres
Publié: (2024)
par: Jiang, Ruichen, et autres
Publié: (2024)
Extracting Clean and Balanced Subset for Noisy Long-tailed Classification
par: Li, Zhuo, et autres
Publié: (2024)
par: Li, Zhuo, et autres
Publié: (2024)
Coreset for Robust Geometric Median: Eliminating Size Dependency on Outliers
par: Fang, Ziyi, et autres
Publié: (2025)
par: Fang, Ziyi, et autres
Publié: (2025)
Dual-Encoders for Extreme Multi-Label Classification
par: Gupta, Nilesh, et autres
Publié: (2023)
par: Gupta, Nilesh, et autres
Publié: (2023)
SVFT: Parameter-Efficient Fine-Tuning with Singular Vectors
par: Lingam, Vijay, et autres
Publié: (2024)
par: Lingam, Vijay, et autres
Publié: (2024)
DataS^3: Dataset Subset Selection for Specialization
par: Hulkund, Neha, et autres
Publié: (2025)
par: Hulkund, Neha, et autres
Publié: (2025)
Time Weaver: A Conditional Time Series Generation Model
par: Narasimhan, Sai Shankar, et autres
Publié: (2024)
par: Narasimhan, Sai Shankar, et autres
Publié: (2024)
In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness
par: Collins, Liam, et autres
Publié: (2024)
par: Collins, Liam, et autres
Publié: (2024)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
par: Tejaswi, Atula, et autres
Publié: (2026)
par: Tejaswi, Atula, et autres
Publié: (2026)
Fair Column Subset Selection
par: Matakos, Antonis, et autres
Publié: (2023)
par: Matakos, Antonis, et autres
Publié: (2023)
Median of Forests for Robust Density Estimation
par: Wen, Hongwei, et autres
Publié: (2025)
par: Wen, Hongwei, et autres
Publié: (2025)
From Invariant Representations to Invariant Data: Provable Robustness to Spurious Correlations via Noisy Counterfactual Matching
par: Bai, Ruqi, et autres
Publié: (2025)
par: Bai, Ruqi, et autres
Publié: (2025)
Robust Neural Processes for Noisy Data
par: Shapira, Chen, et autres
Publié: (2024)
par: Shapira, Chen, et autres
Publié: (2024)
Revisiting Score Function Estimators for $k$-Subset Sampling
par: Wijk, Klas, et autres
Publié: (2024)
par: Wijk, Klas, et autres
Publié: (2024)
LLM-guided Hierarchical Search for End-to-end Reasoning Intensive Retrieval
par: Gupta, Nilesh, et autres
Publié: (2025)
par: Gupta, Nilesh, et autres
Publié: (2025)
Scalable In-context Ranking with Generative Models
par: Gupta, Nilesh, et autres
Publié: (2025)
par: Gupta, Nilesh, et autres
Publié: (2025)
Documents similaires
-
Geometric Median (GM) Matching for Robust Data Pruning
par: Acharya, Anish, et autres
Publié: (2024) -
Understanding Contrastive Representation Learning from Positive Unlabeled (PU) Data
par: Acharya, Anish, et autres
Publié: (2024) -
Positive Unlabeled Contrastive Learning
par: Acharya, Anish, et autres
Publié: (2022) -
Towards Quantifying the Preconditioning Effect of Adam
par: Das, Rudrajit, et autres
Publié: (2024) -
When Attention Collapses: How Degenerate Layers in LLMs Enable Smaller, Stronger Models
par: Sanyal, Sunny, et autres
Publié: (2024)