Pretrained deep models outperform GBDTs in Learning-To-Rank under label scarcity
Fuente:
arXiv
Guardado en:
| Autores principales: | Hou, Charlie, Thekumparampil, Kiran Koshy, Shavlovsky, Michael, Fanti, Giulia, Dattatreya, Yesh, Sanghavi, Sujay |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
por: Thekumparampil, Kiran Koshy, et al.
Publicado: (2024)
por: Thekumparampil, Kiran Koshy, et al.
Publicado: (2024)
Zeroth-Order Optimization Finds Flat Minima
por: Zhang, Liang, et al.
Publicado: (2025)
por: Zhang, Liang, et al.
Publicado: (2025)
Characterizing the Training Dynamics of Private Fine-tuning with Langevin diffusion
por: Ke, Shuqi, et al.
Publicado: (2024)
por: Ke, Shuqi, et al.
Publicado: (2024)
A Sinkhorn-type Algorithm for Constrained Optimal Transport
por: Tang, Xun, et al.
Publicado: (2024)
por: Tang, Xun, et al.
Publicado: (2024)
Geometric Median (GM) Matching for Robust Data Pruning
por: Acharya, Anish, et al.
Publicado: (2024)
por: Acharya, Anish, et al.
Publicado: (2024)
POPri: Private Federated Learning using Preference-Optimized Synthetic Data
por: Hou, Charlie, et al.
Publicado: (2025)
por: Hou, Charlie, et al.
Publicado: (2025)
RewardRank: Optimizing True Learning-to-Rank Utility
por: Bhatt, Gaurav, et al.
Publicado: (2025)
por: Bhatt, Gaurav, et al.
Publicado: (2025)
HiSpec: Hierarchical Speculative Decoding for LLMs
por: Kumar, Avinash, et al.
Publicado: (2025)
por: Kumar, Avinash, et al.
Publicado: (2025)
Accelerating Sinkhorn Algorithm with Sparse Newton Iterations
por: Tang, Xun, et al.
Publicado: (2024)
por: Tang, Xun, et al.
Publicado: (2024)
Value-Based Pre-Training with Downstream Feedback
por: Ke, Shuqi, et al.
Publicado: (2026)
por: Ke, Shuqi, et al.
Publicado: (2026)
Graph Mining under Data scarcity
por: Rakaraddi, Appan, et al.
Publicado: (2024)
por: Rakaraddi, Appan, et al.
Publicado: (2024)
In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness
por: Collins, Liam, et al.
Publicado: (2024)
por: Collins, Liam, et al.
Publicado: (2024)
RARe: Retrieval Augmented Retrieval with In-Context Examples
por: Tejaswi, Atula, et al.
Publicado: (2024)
por: Tejaswi, Atula, et al.
Publicado: (2024)
Positive Unlabeled Contrastive Learning
por: Acharya, Anish, et al.
Publicado: (2022)
por: Acharya, Anish, et al.
Publicado: (2022)
Upweighting Easy Samples in Fine-Tuning Mitigates Forgetting
por: Sanyal, Sunny, et al.
Publicado: (2025)
por: Sanyal, Sunny, et al.
Publicado: (2025)
BaNEL: Exploration Posteriors for Generative Modeling Using Only Negative Rewards
por: Lee, Sangyun, et al.
Publicado: (2025)
por: Lee, Sangyun, et al.
Publicado: (2025)
MaxShapley: Towards Incentive-compatible Generative Search with Fair Context Attribution
por: Patel, Sara, et al.
Publicado: (2025)
por: Patel, Sara, et al.
Publicado: (2025)
When Attention Collapses: How Degenerate Layers in LLMs Enable Smaller, Stronger Models
por: Sanyal, Sunny, et al.
Publicado: (2024)
por: Sanyal, Sunny, et al.
Publicado: (2024)
Entropy Aware Reward Guidance for Diffusion Language Model Alignment
por: Tejaswi, Atula, et al.
Publicado: (2026)
por: Tejaswi, Atula, et al.
Publicado: (2026)
Understanding Contrastive Representation Learning from Positive Unlabeled (PU) Data
por: Acharya, Anish, et al.
Publicado: (2024)
por: Acharya, Anish, et al.
Publicado: (2024)
OmniTabBench: Mapping the Empirical Frontiers of GBDTs, Neural Networks, and Foundation Models for Tabular Data at Scale
por: Jiang, Dihong, et al.
Publicado: (2026)
por: Jiang, Dihong, et al.
Publicado: (2026)
Sculpting Latent Spaces With MMD: Disentanglement With Programmable Priors
por: Fruytier, Quentin, et al.
Publicado: (2025)
por: Fruytier, Quentin, et al.
Publicado: (2025)
Mixture-of-Linear-Experts for Long-term Time Series Forecasting
por: Ni, Ronghao, et al.
Publicado: (2023)
por: Ni, Ronghao, et al.
Publicado: (2023)
Improving the Training of Rectified Flows
por: Lee, Sangyun, et al.
Publicado: (2024)
por: Lee, Sangyun, et al.
Publicado: (2024)
No More Marching: Learning Humanoid Locomotion for Short-Range SE(2) Targets
por: Dugar, Pranay, et al.
Publicado: (2025)
por: Dugar, Pranay, et al.
Publicado: (2025)
Do Language Models Need Sleep? Offline Recurrence for Improved Online Inference
por: Lee, Sangyun, et al.
Publicado: (2026)
por: Lee, Sangyun, et al.
Publicado: (2026)
PrE-Text: Training Language Models on Private Federated Data in the Age of LLMs
por: Hou, Charlie, et al.
Publicado: (2024)
por: Hou, Charlie, et al.
Publicado: (2024)
MURPHY: Feedback-Aware GRPO with Retrospective Credit Assignment for Multi-Turn Code Generation
por: Ekbote, Chanakya, et al.
Publicado: (2025)
por: Ekbote, Chanakya, et al.
Publicado: (2025)
Code-enabled language models can outperform reasoning models on diverse tasks
por: Zhang, Cedegao E., et al.
Publicado: (2025)
por: Zhang, Cedegao E., et al.
Publicado: (2025)
Learning under Temporal Label Noise
por: Nagaraj, Sujay, et al.
Publicado: (2024)
por: Nagaraj, Sujay, et al.
Publicado: (2024)
ConMeZO: Adaptive Descent-Direction Sampling for Gradient-Free Finetuning of Large Language Models
por: Behric, Lejs Deen, et al.
Publicado: (2025)
por: Behric, Lejs Deen, et al.
Publicado: (2025)
GiVA: Gradient-Informed Bases for Vector-Based Adaptation
por: Gangwar, Neeraj, et al.
Publicado: (2026)
por: Gangwar, Neeraj, et al.
Publicado: (2026)
RankCLIP: Ranking-Consistent Language-Image Pretraining
por: Zhang, Yiming, et al.
Publicado: (2024)
por: Zhang, Yiming, et al.
Publicado: (2024)
DARIL: When Imitation Learning outperforms Reinforcement Learning in Surgical Action Planning
por: Boels, Maxence, et al.
Publicado: (2025)
por: Boels, Maxence, et al.
Publicado: (2025)
AlphaZeroES: Direct score maximization outperforms planning loss minimization
por: Martin, Carlos, et al.
Publicado: (2024)
por: Martin, Carlos, et al.
Publicado: (2024)
DPZero: Private Fine-Tuning of Language Models without Backpropagation
por: Zhang, Liang, et al.
Publicado: (2023)
por: Zhang, Liang, et al.
Publicado: (2023)
Multi-agent AI systems outperform human teams in creativity
por: Hu, Tiancheng, et al.
Publicado: (2026)
por: Hu, Tiancheng, et al.
Publicado: (2026)
RWESummary: A Framework and Test for Choosing Large Language Models to Summarize Real-World Evidence (RWE) Studies
por: Mukerji, Arjun, et al.
Publicado: (2025)
por: Mukerji, Arjun, et al.
Publicado: (2025)
InteractRank: Personalized Web-Scale Search Pre-Ranking with Cross Interaction Features
por: Khandagale, Sujay, et al.
Publicado: (2025)
por: Khandagale, Sujay, et al.
Publicado: (2025)
FuXi-S2S: A machine learning model that outperforms conventional global subseasonal forecast models
por: Chen, Lei, et al.
Publicado: (2023)
por: Chen, Lei, et al.
Publicado: (2023)
Ejemplares similares
-
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
por: Thekumparampil, Kiran Koshy, et al.
Publicado: (2024) -
Zeroth-Order Optimization Finds Flat Minima
por: Zhang, Liang, et al.
Publicado: (2025) -
Characterizing the Training Dynamics of Private Fine-tuning with Langevin diffusion
por: Ke, Shuqi, et al.
Publicado: (2024) -
A Sinkhorn-type Algorithm for Constrained Optimal Transport
por: Tang, Xun, et al.
Publicado: (2024) -
Geometric Median (GM) Matching for Robust Data Pruning
por: Acharya, Anish, et al.
Publicado: (2024)