CATTO: Balancing Preferences and Confidence in Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Parikh, Nisarg, Sai, Ananya, Shivaswamy, Pannaga, Panchal, Kunjal, Lan, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Thinking Forward: Memory-Efficient Federated Finetuning of Language Models
di: Panchal, Kunjal, et al.
Pubblicazione: (2024)
di: Panchal, Kunjal, et al.
Pubblicazione: (2024)
Flow: Per-Instance Personalized Federated Learning Through Dynamic Routing
di: Panchal, Kunjal, et al.
Pubblicazione: (2022)
di: Panchal, Kunjal, et al.
Pubblicazione: (2022)
What is in a name? Mitigating Name Bias in Text Embeddings via Anonymization
di: Manchanda, Sahil, et al.
Pubblicazione: (2025)
di: Manchanda, Sahil, et al.
Pubblicazione: (2025)
The Cost of Avoiding Backpropagation
di: Panchal, Kunjal, et al.
Pubblicazione: (2025)
di: Panchal, Kunjal, et al.
Pubblicazione: (2025)
LookAlike: Consistent Distractor Generation in Math MCQs
di: Parikh, Nisarg, et al.
Pubblicazione: (2025)
di: Parikh, Nisarg, et al.
Pubblicazione: (2025)
POSIT: Promotion of Semantic Item Tail via Adversarial Learning
di: Xu, Qiuling, et al.
Pubblicazione: (2023)
di: Xu, Qiuling, et al.
Pubblicazione: (2023)
Atom: Efficient On-Device Video-Language Pipelines Through Modular Reuse
di: Panchal, Kunjal, et al.
Pubblicazione: (2025)
di: Panchal, Kunjal, et al.
Pubblicazione: (2025)
Confidence Diagram of Nonparametric Ranking for Uncertainty Assessment in Large Language Models Evaluation
di: Wang, Zebin, et al.
Pubblicazione: (2024)
di: Wang, Zebin, et al.
Pubblicazione: (2024)
Phi: Preference Hijacking in Multi-modal Large Language Models at Inference Time
di: Lan, Yifan, et al.
Pubblicazione: (2025)
di: Lan, Yifan, et al.
Pubblicazione: (2025)
Conservative Prediction via Data-Driven Confidence Minimization
di: Choi, Caroline, et al.
Pubblicazione: (2023)
di: Choi, Caroline, et al.
Pubblicazione: (2023)
Bi-Factorial Preference Optimization: Balancing Safety-Helpfulness in Language Models
di: Zhang, Wenxuan, et al.
Pubblicazione: (2024)
di: Zhang, Wenxuan, et al.
Pubblicazione: (2024)
Closing the Gap in the Trade-off between Fair Representations and Accuracy
di: Rout, Biswajit, et al.
Pubblicazione: (2024)
di: Rout, Biswajit, et al.
Pubblicazione: (2024)
Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences
di: Shrivastava, Vaishnavi, et al.
Pubblicazione: (2025)
di: Shrivastava, Vaishnavi, et al.
Pubblicazione: (2025)
Predicting VBAC Outcomes from U.S. Natality Data using Deep and Classical Machine Learning Models
di: Anand, Ananya
Pubblicazione: (2025)
di: Anand, Ananya
Pubblicazione: (2025)
Learning to Select In-Context Demonstration Preferred by Large Language Model
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
di: Zhang, Zheng, et al.
Pubblicazione: (2025)
Confidence Calibration in Large Language Models
di: Michael, Noam, et al.
Pubblicazione: (2026)
di: Michael, Noam, et al.
Pubblicazione: (2026)
Confidence in the Reasoning of Large Language Models
di: Pawitan, Yudi, et al.
Pubblicazione: (2024)
di: Pawitan, Yudi, et al.
Pubblicazione: (2024)
Confidence Calibration in Vision-Language-Action Models
di: Zollo, Thomas P, et al.
Pubblicazione: (2025)
di: Zollo, Thomas P, et al.
Pubblicazione: (2025)
Enhancing Financial Data Visualization for Investment Decision-Making
di: Patel, Nisarg, et al.
Pubblicazione: (2023)
di: Patel, Nisarg, et al.
Pubblicazione: (2023)
Improving Socratic Question Generation using Data Augmentation and Preference Optimization
di: Kumar, Nischal Ashok, et al.
Pubblicazione: (2024)
di: Kumar, Nischal Ashok, et al.
Pubblicazione: (2024)
Predator Prey Scavenger Model using Holling's Functional Response of Type III and Physics-Informed Deep Neural Networks
di: Panchal, Aneesh, et al.
Pubblicazione: (2024)
di: Panchal, Aneesh, et al.
Pubblicazione: (2024)
CRISP-NAM: Competing Risks Interpretable Survival Prediction with Neural Additive Models
di: Ramachandram, Dhanesh, et al.
Pubblicazione: (2025)
di: Ramachandram, Dhanesh, et al.
Pubblicazione: (2025)
Causal Evidence that Language Models use Confidence to Drive Behavior
di: Kumaran, Dharshan, et al.
Pubblicazione: (2026)
di: Kumaran, Dharshan, et al.
Pubblicazione: (2026)
Optimal Best-Arm Identification under Fixed Confidence with Multiple Optima
di: Truong, Lan V.
Pubblicazione: (2025)
di: Truong, Lan V.
Pubblicazione: (2025)
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
di: Mao, Zhenjiang, et al.
Pubblicazione: (2026)
di: Mao, Zhenjiang, et al.
Pubblicazione: (2026)
Online Self-Preferring Language Models
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
QA-Calibration of Language Model Confidence Scores
di: Manggala, Putra, et al.
Pubblicazione: (2024)
di: Manggala, Putra, et al.
Pubblicazione: (2024)
Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model
di: Tu, Songjun, et al.
Pubblicazione: (2024)
di: Tu, Songjun, et al.
Pubblicazione: (2024)
Semantic-Aware Confidence Calibration for Automated Audio Captioning
di: Dunker, Lucas, et al.
Pubblicazione: (2025)
di: Dunker, Lucas, et al.
Pubblicazione: (2025)
Driving Privacy Forward: Mitigating Information Leakage within Smart Vehicles through Synthetic Data Generation
di: Parikh, Krish
Pubblicazione: (2024)
di: Parikh, Krish
Pubblicazione: (2024)
Confidence Regulation Neurons in Language Models
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
di: Stolfo, Alessandro, et al.
Pubblicazione: (2024)
ConfPO: Exploiting Policy Model Confidence for Critical Token Selection in Preference Optimization
di: Yoon, Hee Suk, et al.
Pubblicazione: (2025)
di: Yoon, Hee Suk, et al.
Pubblicazione: (2025)
Balancing Performance and Reject Inclusion: A Novel Confident Inlier Extrapolation Framework for Credit Scoring
di: Ribeiro, Athyrson Machado, et al.
Pubblicazione: (2025)
di: Ribeiro, Athyrson Machado, et al.
Pubblicazione: (2025)
Self-Training Large Language Models with Confident Reasoning
di: Jang, Hyosoon, et al.
Pubblicazione: (2025)
di: Jang, Hyosoon, et al.
Pubblicazione: (2025)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
di: Kumar, Abhishek, et al.
Pubblicazione: (2024)
Prior Distribution and Model Confidence
di: Kazanskii, Maksim, et al.
Pubblicazione: (2025)
di: Kazanskii, Maksim, et al.
Pubblicazione: (2025)
On the "Induction Bias" in Sequence Models
di: Ebrahimi, M. Reza, et al.
Pubblicazione: (2026)
di: Ebrahimi, M. Reza, et al.
Pubblicazione: (2026)
Human Alignment of Large Language Models through Online Preference Optimisation
di: Calandriello, Daniele, et al.
Pubblicazione: (2024)
di: Calandriello, Daniele, et al.
Pubblicazione: (2024)
Discovering Preference Optimization Algorithms with and for Large Language Models
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
Proportional Fairness in Non-Centroid Clustering
di: Caragiannis, Ioannis, et al.
Pubblicazione: (2024)
di: Caragiannis, Ioannis, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Thinking Forward: Memory-Efficient Federated Finetuning of Language Models
di: Panchal, Kunjal, et al.
Pubblicazione: (2024) -
Flow: Per-Instance Personalized Federated Learning Through Dynamic Routing
di: Panchal, Kunjal, et al.
Pubblicazione: (2022) -
What is in a name? Mitigating Name Bias in Text Embeddings via Anonymization
di: Manchanda, Sahil, et al.
Pubblicazione: (2025) -
The Cost of Avoiding Backpropagation
di: Panchal, Kunjal, et al.
Pubblicazione: (2025) -
LookAlike: Consistent Distractor Generation in Math MCQs
di: Parikh, Nisarg, et al.
Pubblicazione: (2025)