Salvato in:
| Autore principale: | Li, Mujing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2605.30758 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reward Modeling with Ordinal Feedback: Wisdom of the Crowd
di: Liu, Shang, et al.
Pubblicazione: (2024)
di: Liu, Shang, et al.
Pubblicazione: (2024)
Learn Your Reference Model for Real Good Alignment
di: Gorbatovski, Alexey, et al.
Pubblicazione: (2024)
di: Gorbatovski, Alexey, et al.
Pubblicazione: (2024)
CPC-CMS: Cognitive Pairwise Comparison Classification Model Selection Framework for Document-level Sentiment Analysis
di: Li, Jianfei, et al.
Pubblicazione: (2025)
di: Li, Jianfei, et al.
Pubblicazione: (2025)
Exploring Key Point Analysis with Pairwise Generation and Graph Partitioning
di: Li, Xiao, et al.
Pubblicazione: (2024)
di: Li, Xiao, et al.
Pubblicazione: (2024)
Teach CLIP to Develop a Number Sense for Ordinal Regression
di: Du, Yao, et al.
Pubblicazione: (2024)
di: Du, Yao, et al.
Pubblicazione: (2024)
Highly Fast Text Segmentation With Pairwise Markov Chains
di: Azeraf, Elie, et al.
Pubblicazione: (2021)
di: Azeraf, Elie, et al.
Pubblicazione: (2021)
Gained in Translation: Privileged Pairwise Judges Enhance Multilingual Reasoning
di: Sutawika, Lintang, et al.
Pubblicazione: (2026)
di: Sutawika, Lintang, et al.
Pubblicazione: (2026)
Exploring Ordinality in Text Classification: A Comparative Study of Explicit and Implicit Techniques
di: Kasa, Siva Rajesh, et al.
Pubblicazione: (2024)
di: Kasa, Siva Rajesh, et al.
Pubblicazione: (2024)
LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
di: Qin, Zhen, et al.
Pubblicazione: (2024)
di: Qin, Zhen, et al.
Pubblicazione: (2024)
Enhancing Marker Scoring Accuracy through Ordinal Confidence Modelling in Educational Assessments
di: Chakravarty, Abhirup, et al.
Pubblicazione: (2025)
di: Chakravarty, Abhirup, et al.
Pubblicazione: (2025)
Phrase-Instance Alignment for Generalized Referring Segmentation
di: Nguyen, E-Ro, et al.
Pubblicazione: (2024)
di: Nguyen, E-Ro, et al.
Pubblicazione: (2024)
References Improve LLM Alignment in Non-Verifiable Domains
di: Shi, Kejian, et al.
Pubblicazione: (2026)
di: Shi, Kejian, et al.
Pubblicazione: (2026)
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
di: Qin, Zhen, et al.
Pubblicazione: (2023)
di: Qin, Zhen, et al.
Pubblicazione: (2023)
REFA: Reference Free Alignment for multi-preference optimization
di: Gupta, Taneesh, et al.
Pubblicazione: (2024)
di: Gupta, Taneesh, et al.
Pubblicazione: (2024)
Online Rubrics Elicitation from Pairwise Comparisons
di: Rezaei, MohammadHossein, et al.
Pubblicazione: (2025)
di: Rezaei, MohammadHossein, et al.
Pubblicazione: (2025)
Beyond Semantic Entropy: Boosting LLM Uncertainty Quantification with Pairwise Semantic Similarity
di: Nguyen, Dang, et al.
Pubblicazione: (2025)
di: Nguyen, Dang, et al.
Pubblicazione: (2025)
Observable Propagation: Uncovering Feature Vectors in Transformers
di: Dunefsky, Jacob, et al.
Pubblicazione: (2023)
di: Dunefsky, Jacob, et al.
Pubblicazione: (2023)
Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
Few-shot Prompting for Pairwise Ranking: An Effective Non-Parametric Retrieval Model
di: Sinhababu, Nilanjan, et al.
Pubblicazione: (2024)
di: Sinhababu, Nilanjan, et al.
Pubblicazione: (2024)
Detecting Token-Level Hallucinations Using Variance Signals: A Reference-Free Approach
di: Kumar, Keshav
Pubblicazione: (2025)
di: Kumar, Keshav
Pubblicazione: (2025)
Epistemic Observability in Language Models
di: Mason, Tony, et al.
Pubblicazione: (2026)
di: Mason, Tony, et al.
Pubblicazione: (2026)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
di: Zhang, Songming, et al.
Pubblicazione: (2025)
di: Zhang, Songming, et al.
Pubblicazione: (2025)
Learning from Reference Answers: Versatile Language Model Alignment without Binary Human Preference Data
di: Zhao, Shuai, et al.
Pubblicazione: (2025)
di: Zhao, Shuai, et al.
Pubblicazione: (2025)
Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
di: Deng, Wenlong, et al.
Pubblicazione: (2026)
di: Deng, Wenlong, et al.
Pubblicazione: (2026)
Direct-Scoring NLG Evaluators Can Use Pairwise Comparisons Too
di: Lawrence, Logan, et al.
Pubblicazione: (2025)
di: Lawrence, Logan, et al.
Pubblicazione: (2025)
Knowledge-Level Consistency Reinforcement Learning: Dual-Fact Alignment for Long-Form Factuality
di: Li, Junliang, et al.
Pubblicazione: (2025)
di: Li, Junliang, et al.
Pubblicazione: (2025)
ORCE: Order-Aware Alignment of Verbalized Confidence in Large Language Models
di: Li, Chen, et al.
Pubblicazione: (2026)
di: Li, Chen, et al.
Pubblicazione: (2026)
Generating Chain-of-Thoughts with a Pairwise-Comparison Approach to Searching for the Most Promising Intermediate Thought
di: Zhang, Zhen-Yu, et al.
Pubblicazione: (2024)
di: Zhang, Zhen-Yu, et al.
Pubblicazione: (2024)
A Survey on Training-free Alignment of Large Language Models
di: Pan, Birong, et al.
Pubblicazione: (2025)
di: Pan, Birong, et al.
Pubblicazione: (2025)
Meanings and Feelings of Large Language Models: Observability of Latent States in Generative AI
di: Liu, Tian Yu, et al.
Pubblicazione: (2024)
di: Liu, Tian Yu, et al.
Pubblicazione: (2024)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Stream Aligner: Efficient Sentence-Level Alignment via Distribution Induction
di: Lou, Hantao, et al.
Pubblicazione: (2025)
di: Lou, Hantao, et al.
Pubblicazione: (2025)
Multi-Reference Preference Optimization for Large Language Models
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
Pair2Score: Pairwise-to-Absolute Transfer for LLM-Based Essay Scoring
di: Hallaç, İbrahim Rıza, et al.
Pubblicazione: (2026)
di: Hallaç, İbrahim Rıza, et al.
Pubblicazione: (2026)
MAPLE: Micro Analysis of Pairwise Language Evolution for Few-Shot Claim Verification
di: Zeng, Xia, et al.
Pubblicazione: (2024)
di: Zeng, Xia, et al.
Pubblicazione: (2024)
DELAN: Dual-Level Alignment for Vision-and-Language Navigation by Cross-Modal Contrastive Learning
di: Du, Mengfei, et al.
Pubblicazione: (2024)
di: Du, Mengfei, et al.
Pubblicazione: (2024)
Baichuan Alignment Technical Report
di: Lin, Mingan, et al.
Pubblicazione: (2024)
di: Lin, Mingan, et al.
Pubblicazione: (2024)
Energy-Based Reward Models for Robust Language Model Alignment
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
Enhancing Time Series Forecasting via Multi-Level Text Alignment with LLMs
di: Zhao, Taibiao, et al.
Pubblicazione: (2025)
di: Zhao, Taibiao, et al.
Pubblicazione: (2025)
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
di: Wu, Junda, et al.
Pubblicazione: (2024)
di: Wu, Junda, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Reward Modeling with Ordinal Feedback: Wisdom of the Crowd
di: Liu, Shang, et al.
Pubblicazione: (2024) -
Learn Your Reference Model for Real Good Alignment
di: Gorbatovski, Alexey, et al.
Pubblicazione: (2024) -
CPC-CMS: Cognitive Pairwise Comparison Classification Model Selection Framework for Document-level Sentiment Analysis
di: Li, Jianfei, et al.
Pubblicazione: (2025) -
Exploring Key Point Analysis with Pairwise Generation and Graph Partitioning
di: Li, Xiao, et al.
Pubblicazione: (2024) -
Teach CLIP to Develop a Number Sense for Ordinal Regression
di: Du, Yao, et al.
Pubblicazione: (2024)