SPECTRA: Revealing the Full Spectrum of User Preferences via Distributional LLM Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Luyang, Wang, Jialu, Zhu, Shichao, Li, Beibei, Wang, Zhongcun, Pan, Guangmou, Song, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Aligning Language Models with Human Preferences via a Bayesian Approach
por: Wang, Jiashuo, et al.
Publicado: (2023)
por: Wang, Jiashuo, et al.
Publicado: (2023)
Fairshare Data Pricing via Data Valuation for Large Language Models
por: Zhang, Luyang, et al.
Publicado: (2025)
por: Zhang, Luyang, et al.
Publicado: (2025)
Dissecting Human and LLM Preferences
por: Li, Junlong, et al.
Publicado: (2024)
por: Li, Junlong, et al.
Publicado: (2024)
Improving LLM-as-a-Judge Inference with the Judgment Distribution
por: Wang, Victor, et al.
Publicado: (2025)
por: Wang, Victor, et al.
Publicado: (2025)
BUZZ: Beehive-structured Sparse KV Cache with Segmented Heavy Hitters for Efficient LLM Inference
por: Zhao, Junqi, et al.
Publicado: (2024)
por: Zhao, Junqi, et al.
Publicado: (2024)
Value-Spectrum: Quantifying Preferences of Vision-Language Models via Value Decomposition in Social Media Contexts
por: Li, Jingxuan, et al.
Publicado: (2024)
por: Li, Jingxuan, et al.
Publicado: (2024)
ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization
por: Wang, Yinjie, et al.
Publicado: (2025)
por: Wang, Yinjie, et al.
Publicado: (2025)
LLM-Driven Preference Data Synthesis for Proactive Prediction of the Next User Utterance in Human-Machine Dialogue
por: Wang, Jinqiang, et al.
Publicado: (2025)
por: Wang, Jinqiang, et al.
Publicado: (2025)
CLIPer: Tailoring Diverse User Preference via Classifier-Guided Inference-Time Personalization
por: Su, Jinyan, et al.
Publicado: (2026)
por: Su, Jinyan, et al.
Publicado: (2026)
Probability-Consistent Preference Optimization for Enhanced LLM Reasoning
por: Yang, Yunqiao, et al.
Publicado: (2025)
por: Yang, Yunqiao, et al.
Publicado: (2025)
Effectively Steer LLM To Follow Preference via Building Confident Directions
por: Song, Bingqing, et al.
Publicado: (2025)
por: Song, Bingqing, et al.
Publicado: (2025)
User-LLM: Efficient LLM Contextualization with User Embeddings
por: Ning, Lin, et al.
Publicado: (2024)
por: Ning, Lin, et al.
Publicado: (2024)
CATNIP: LLM Unlearning via Calibrated and Tokenized Negative Preference Alignment
por: Yang, Zhengbang, et al.
Publicado: (2026)
por: Yang, Zhengbang, et al.
Publicado: (2026)
Do Agents Repair When Challenged -- or Just Reply? Challenge, Repair, and Public Correction in a Deployed Agent Forum
por: Zhang, Luyang, et al.
Publicado: (2026)
por: Zhang, Luyang, et al.
Publicado: (2026)
Enhancing User Engagement in Socially-Driven Dialogue through Interactive LLM Alignments
por: Wang, Jiashuo, et al.
Publicado: (2025)
por: Wang, Jiashuo, et al.
Publicado: (2025)
Users as Annotators: LLM Preference Learning from Comparison Mode
por: Cai, Zhongze, et al.
Publicado: (2025)
por: Cai, Zhongze, et al.
Publicado: (2025)
Reading Users' Minds from What They Say: An Investigation into LLM-based Empathic Mental Inference
por: Zhu, Qihao, et al.
Publicado: (2024)
por: Zhu, Qihao, et al.
Publicado: (2024)
Scaling LLM Inference with Optimized Sample Compute Allocation
por: Zhang, Kexun, et al.
Publicado: (2024)
por: Zhang, Kexun, et al.
Publicado: (2024)
LRHP: Learning Representations for Human Preferences via Preference Pairs
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
NeuronMLP: Efficient LLM Inference via Singular Value Decomposition Compression and Tiling on AWS Trainium
por: Song, Dinghong, et al.
Publicado: (2025)
por: Song, Dinghong, et al.
Publicado: (2025)
Full-Step-DPO: Self-Supervised Preference Optimization with Step-wise Rewards for Mathematical Reasoning
por: Xu, Huimin, et al.
Publicado: (2025)
por: Xu, Huimin, et al.
Publicado: (2025)
DPO-Shift: Shifting the Distribution of Direct Preference Optimization
por: Yang, Xiliang, et al.
Publicado: (2025)
por: Yang, Xiliang, et al.
Publicado: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
por: Zhang, Rongzhi, et al.
Publicado: (2024)
por: Zhang, Rongzhi, et al.
Publicado: (2024)
No Preference Left Behind: Group Distributional Preference Optimization
por: Yao, Binwei, et al.
Publicado: (2024)
por: Yao, Binwei, et al.
Publicado: (2024)
Latent Inter-User Difference Modeling for LLM Personalization
por: Qiu, Yilun, et al.
Publicado: (2025)
por: Qiu, Yilun, et al.
Publicado: (2025)
Efficient Long-Context LLM Inference via KV Cache Clustering
por: Hu, Jie, et al.
Publicado: (2025)
por: Hu, Jie, et al.
Publicado: (2025)
Multi-modal Preference Alignment Remedies Degradation of Visual Instruction Tuning on Language Models
por: Li, Shengzhi, et al.
Publicado: (2024)
por: Li, Shengzhi, et al.
Publicado: (2024)
Aligning Large Language Models with Implicit Preferences from User-Generated Content
por: Tan, Zhaoxuan, et al.
Publicado: (2025)
por: Tan, Zhaoxuan, et al.
Publicado: (2025)
AdaptFuse: Training-Free Sequential Preference Learning via Externalized Bayesian Inference
por: Lin, Fangzhou, et al.
Publicado: (2026)
por: Lin, Fangzhou, et al.
Publicado: (2026)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
por: Chen, Yizhuo, et al.
Publicado: (2025)
por: Chen, Yizhuo, et al.
Publicado: (2025)
LATTE: Forecasting Peer Anchored Preference Trajectories for Personalized LLM Generation
por: Li, Jinze, et al.
Publicado: (2026)
por: Li, Jinze, et al.
Publicado: (2026)
ImplicitRM: Unbiased Reward Modeling from Implicit Preference Data for LLM alignment
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
Beyond the Surface: Measuring Self-Preference in LLM Judgments
por: Chen, Zhi-Yuan, et al.
Publicado: (2025)
por: Chen, Zhi-Yuan, et al.
Publicado: (2025)
ChiMed-GPT: A Chinese Medical Large Language Model with Full Training Regime and Better Alignment to Human Preferences
por: Tian, Yuanhe, et al.
Publicado: (2023)
por: Tian, Yuanhe, et al.
Publicado: (2023)
DrugClaw and DrugAudit: A Primary-Source-Grounded Agent and Authority-Aware Benchmark for Drug-Information Question Answering
por: Wang, Qing, et al.
Publicado: (2026)
por: Wang, Qing, et al.
Publicado: (2026)
Mitigating KV Cache Competition to Enhance User Experience in LLM Inference
por: Shen, Haiying, et al.
Publicado: (2025)
por: Shen, Haiying, et al.
Publicado: (2025)
Nash CoT: Multi-Path Inference with Preference Equilibrium
por: Zhang, Ziqi, et al.
Publicado: (2024)
por: Zhang, Ziqi, et al.
Publicado: (2024)
DuPO: Enabling Reliable LLM Self-Verification via Dual Preference Optimization
por: She, Shuaijie, et al.
Publicado: (2025)
por: She, Shuaijie, et al.
Publicado: (2025)
Learning LLM Preference over Intra-Dialogue Pairs: A Framework for Utterance-level Understandings
por: Liu, Xuanqing, et al.
Publicado: (2025)
por: Liu, Xuanqing, et al.
Publicado: (2025)
Judging with Confidence: Calibrating Autoraters to Preference Distributions
por: Li, Zhuohang, et al.
Publicado: (2025)
por: Li, Zhuohang, et al.
Publicado: (2025)
Ejemplares similares
-
Aligning Language Models with Human Preferences via a Bayesian Approach
por: Wang, Jiashuo, et al.
Publicado: (2023) -
Fairshare Data Pricing via Data Valuation for Large Language Models
por: Zhang, Luyang, et al.
Publicado: (2025) -
Dissecting Human and LLM Preferences
por: Li, Junlong, et al.
Publicado: (2024) -
Improving LLM-as-a-Judge Inference with the Judgment Distribution
por: Wang, Victor, et al.
Publicado: (2025) -
BUZZ: Beehive-structured Sparse KV Cache with Segmented Heavy Hitters for Efficient LLM Inference
por: Zhao, Junqi, et al.
Publicado: (2024)