The Sign Estimator: LLM Alignment in the Face of Choice Heterogeneity
Fuente:
arXiv
Salvato in:
| Autori principali: | Aouad, Ali, Gadarri, Aymane El, Farias, Vivek F. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Value of Covariance Matching in Gaussian DDPMs and the Lanczos Sampler
di: Akhtar, Md Sahil, et al.
Pubblicazione: (2026)
di: Akhtar, Md Sahil, et al.
Pubblicazione: (2026)
High-dimensional Learning with Noisy Labels
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
$α$-LoRA: Effective Fine-Tuning via Base Model Rescaling
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2025)
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2025)
Self-Normalized Resets for Plasticity in Continual Learning
di: Farias, Vivek F., et al.
Pubblicazione: (2024)
di: Farias, Vivek F., et al.
Pubblicazione: (2024)
Beyond Pairwise: Empowering LLM Alignment With Ranked Choice Modeling
di: Tang, Yuxuan, et al.
Pubblicazione: (2025)
di: Tang, Yuxuan, et al.
Pubblicazione: (2025)
Direct Alignment with Heterogeneous Preferences
di: Shirali, Ali, et al.
Pubblicazione: (2025)
di: Shirali, Ali, et al.
Pubblicazione: (2025)
A foundation for exact binarized morphological neural networks
di: Aouad, Theodore, et al.
Pubblicazione: (2024)
di: Aouad, Theodore, et al.
Pubblicazione: (2024)
Feature Distillation is the Better Choice for Model-Heterogeneous Federated Learning
di: Li, Yichen, et al.
Pubblicazione: (2025)
di: Li, Yichen, et al.
Pubblicazione: (2025)
Open Problems in Differentiable Social Choice: Learning Mechanisms, Decisions, and Alignment
di: An, Zhiyu, et al.
Pubblicazione: (2026)
di: An, Zhiyu, et al.
Pubblicazione: (2026)
LLM Safety Alignment is Divergence Estimation in Disguise
di: Haldar, Rajdeep, et al.
Pubblicazione: (2025)
di: Haldar, Rajdeep, et al.
Pubblicazione: (2025)
Maximizing the Potential of Synthetic Data: Insights from Random Matrix Theory
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024)
Policy Optimization for Personalized Interventions in Behavioral Health
di: Baek, Jackie, et al.
Pubblicazione: (2023)
di: Baek, Jackie, et al.
Pubblicazione: (2023)
Tokenized Bandit for LLM Decoding and Alignment
di: Shin, Suho, et al.
Pubblicazione: (2025)
di: Shin, Suho, et al.
Pubblicazione: (2025)
Alignment Dynamics in LLM Fine-Tuning
di: Huang, Yuhan, et al.
Pubblicazione: (2026)
di: Huang, Yuhan, et al.
Pubblicazione: (2026)
Aggregation Alignment for Federated Learning with Mixture-of-Experts under Data Heterogeneity
di: Fang, Zihan, et al.
Pubblicazione: (2026)
di: Fang, Zihan, et al.
Pubblicazione: (2026)
Conformal Feedback Alignment: Quantifying Answer-Level Reliability for Robust LLM Alignment
di: Chen, Tiejin, et al.
Pubblicazione: (2026)
di: Chen, Tiejin, et al.
Pubblicazione: (2026)
Adversarial Preference Learning for Robust LLM Alignment
di: Wang, Yuanfu, et al.
Pubblicazione: (2025)
di: Wang, Yuanfu, et al.
Pubblicazione: (2025)
A Small Math Model: Recasting Strategy Choice Theory in an LLM-Inspired Architecture
di: Rahman, Roussel, et al.
Pubblicazione: (2025)
di: Rahman, Roussel, et al.
Pubblicazione: (2025)
Echo: Decoupling Inference and Training for Large-Scale RL Alignment on Heterogeneous Swarms
di: Xiao, Jie, et al.
Pubblicazione: (2025)
di: Xiao, Jie, et al.
Pubblicazione: (2025)
Rethinking LoRA for Data Heterogeneous Federated Learning: Subspace and State Alignment
di: Peng, Hongyi, et al.
Pubblicazione: (2026)
di: Peng, Hongyi, et al.
Pubblicazione: (2026)
ECLIPTICA -- A Framework for Switchable LLM Alignment via CITA - Contrastive Instruction-Tuned Alignment
di: Wanaskar, Kapil, et al.
Pubblicazione: (2026)
di: Wanaskar, Kapil, et al.
Pubblicazione: (2026)
PIPA: Preference Alignment as Prior-Informed Statistical Estimation
di: Li, Junbo, et al.
Pubblicazione: (2025)
di: Li, Junbo, et al.
Pubblicazione: (2025)
The Alignment Game: A Theory of Long-Horizon Alignment Through Recursive Curation
di: Falahati, Ali, et al.
Pubblicazione: (2025)
di: Falahati, Ali, et al.
Pubblicazione: (2025)
GRADE: Replacing Policy Gradients with Backpropagation for LLM Alignment
di: Nel, Lukas Abrie
Pubblicazione: (2025)
di: Nel, Lukas Abrie
Pubblicazione: (2025)
Training LLM Agents to Empower Humans
di: Ellis, Evan, et al.
Pubblicazione: (2025)
di: Ellis, Evan, et al.
Pubblicazione: (2025)
Adaptive Sparse Allocation with Mutual Choice & Feature Choice Sparse Autoencoders
di: Ayonrinde, Kola
Pubblicazione: (2024)
di: Ayonrinde, Kola
Pubblicazione: (2024)
Generalised Probabilistic Modelling and Improved Uncertainty Estimation in Comparative LLM-as-a-judge
di: Fathullah, Yassir, et al.
Pubblicazione: (2025)
di: Fathullah, Yassir, et al.
Pubblicazione: (2025)
Cost-Minimized Label-Flipping Poisoning Attack to LLM Alignment
di: Kusaka, Shigeki, et al.
Pubblicazione: (2025)
di: Kusaka, Shigeki, et al.
Pubblicazione: (2025)
Find A Winning Sign: Sign Is All We Need to Win the Lottery
di: Oh, Junghun, et al.
Pubblicazione: (2025)
di: Oh, Junghun, et al.
Pubblicazione: (2025)
Early Detection of Pancreatic Cancer Using Multimodal Learning on Electronic Health Records
di: Aouad, Mosbah, et al.
Pubblicazione: (2025)
di: Aouad, Mosbah, et al.
Pubblicazione: (2025)
Data-Driven Estimation of Heterogeneous Treatment Effects
di: Tran, Christopher, et al.
Pubblicazione: (2023)
di: Tran, Christopher, et al.
Pubblicazione: (2023)
Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment
di: Trivedi, Prashant, et al.
Pubblicazione: (2025)
di: Trivedi, Prashant, et al.
Pubblicazione: (2025)
Robust LLM Alignment via Distributionally Robust Direct Preference Optimization
di: Xu, Zaiyan, et al.
Pubblicazione: (2025)
di: Xu, Zaiyan, et al.
Pubblicazione: (2025)
Entropy-Guided Dynamic Tokens for Graph-LLM Alignment in Molecular Understanding
di: Jing, Zihao, et al.
Pubblicazione: (2026)
di: Jing, Zihao, et al.
Pubblicazione: (2026)
Intra-Fairness Dynamics: The Bias Spillover Effect in Targeted LLM Alignment
di: Paraschou, Eva, et al.
Pubblicazione: (2026)
di: Paraschou, Eva, et al.
Pubblicazione: (2026)
Safeguarding LLM Fine-tuning via Push-Pull Distributional Alignment
di: Wang, Haozhong, et al.
Pubblicazione: (2026)
di: Wang, Haozhong, et al.
Pubblicazione: (2026)
Style Outweighs Substance: Failure Modes of LLM Judges in Alignment Benchmarking
di: Feuer, Benjamin, et al.
Pubblicazione: (2024)
di: Feuer, Benjamin, et al.
Pubblicazione: (2024)
Moral Alignment for LLM Agents
di: Tennant, Elizaveta, et al.
Pubblicazione: (2024)
di: Tennant, Elizaveta, et al.
Pubblicazione: (2024)
Certified Signed Graph Unlearning
di: Zhao, Junpeng, et al.
Pubblicazione: (2025)
di: Zhao, Junpeng, et al.
Pubblicazione: (2025)
Toward Practical Entity Alignment Method Design: Insights from New Highly Heterogeneous Knowledge Graph Datasets
di: Jiang, Xuhui, et al.
Pubblicazione: (2023)
di: Jiang, Xuhui, et al.
Pubblicazione: (2023)
Documenti analoghi
-
The Value of Covariance Matching in Gaussian DDPMs and the Lanczos Sampler
di: Akhtar, Md Sahil, et al.
Pubblicazione: (2026) -
High-dimensional Learning with Noisy Labels
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2024) -
$α$-LoRA: Effective Fine-Tuning via Base Model Rescaling
di: Firdoussi, Aymane El, et al.
Pubblicazione: (2025) -
Self-Normalized Resets for Plasticity in Continual Learning
di: Farias, Vivek F., et al.
Pubblicazione: (2024) -
Beyond Pairwise: Empowering LLM Alignment With Ranked Choice Modeling
di: Tang, Yuxuan, et al.
Pubblicazione: (2025)