Predicting Text Preference Via Structured Comparative Reasoning
Fuente:
arXiv
Saved in:
| Main Authors: | Yan, Jing Nathan, Liu, Tianqi, Chiu, Justin T, Shen, Jiaming, Qin, Zhen, Yu, Yue, Zhao, Yao, Lakshmanan, Charu, Kurzion, Yair, Rush, Alexander M., Liu, Jialu, Bendersky, Michael |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
by: Zhang, Rongzhi, et al.
Published: (2024)
by: Zhang, Rongzhi, et al.
Published: (2024)
Multilingual Fine-Grained News Headline Hallucination Detection
by: Shen, Jiaming, et al.
Published: (2024)
by: Shen, Jiaming, et al.
Published: (2024)
Boosting Reward Model with Preference-Conditional Multi-Aspect Synthetic Data Generation
by: Shen, Jiaming, et al.
Published: (2024)
by: Shen, Jiaming, et al.
Published: (2024)
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
by: Qin, Zhen, et al.
Published: (2023)
by: Qin, Zhen, et al.
Published: (2023)
LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
by: Qin, Zhen, et al.
Published: (2024)
by: Qin, Zhen, et al.
Published: (2024)
LiPO: Listwise Preference Optimization through Learning-to-Rank
by: Liu, Tianqi, et al.
Published: (2024)
by: Liu, Tianqi, et al.
Published: (2024)
Statistical Rejection Sampling Improves Preference Optimization
by: Liu, Tianqi, et al.
Published: (2023)
by: Liu, Tianqi, et al.
Published: (2023)
Integrating Planning into Single-Turn Long-Form Text Generation
by: Liang, Yi, et al.
Published: (2024)
by: Liang, Yi, et al.
Published: (2024)
Building Math Agents with Multi-Turn Iterative Preference Learning
by: Xiong, Wei, et al.
Published: (2024)
by: Xiong, Wei, et al.
Published: (2024)
Simple and Effective Masked Diffusion Language Models
by: Sahoo, Subham Sekhar, et al.
Published: (2024)
by: Sahoo, Subham Sekhar, et al.
Published: (2024)
Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference Optimization
by: Liu, Zhuohan, et al.
Published: (2026)
by: Liu, Zhuohan, et al.
Published: (2026)
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
by: Yang, Shentao, et al.
Published: (2024)
by: Yang, Shentao, et al.
Published: (2024)
Evidence gaps in orthognathic surgery, a Delphi study protocol
by: Josefina Bendersky
Published: (2023)
by: Josefina Bendersky
Published: (2023)
Consolidating Ranking and Relevance Predictions of Large Language Models through Post-Processing
by: Yan, Le, et al.
Published: (2024)
by: Yan, Le, et al.
Published: (2024)
Soft Contextualized Encoder For User Defined Text Classification
by: Maheshwari, Charu, et al.
Published: (2026)
by: Maheshwari, Charu, et al.
Published: (2026)
Reliable Confidence Intervals for Information Retrieval Evaluation Using Generative A.I
by: Oosterhuis, Harrie, et al.
Published: (2024)
by: Oosterhuis, Harrie, et al.
Published: (2024)
TextReasoningBench: Does Reasoning Really Improve Text Classification in Large Language Models?
by: Guo, Xinyu, et al.
Published: (2026)
by: Guo, Xinyu, et al.
Published: (2026)
A Controlled Study on Long Context Extension and Generalization in LLMs
by: Lu, Yi, et al.
Published: (2024)
by: Lu, Yi, et al.
Published: (2024)
Robot formations as an emergent collective task using target-following behavior
by: Diego Ariel Bendersky
Published: (2003)
by: Diego Ariel Bendersky
Published: (2003)
Uncovering the Impact of Chain-of-Thought Reasoning for Direct Preference Optimization: Lessons from Text-to-SQL
by: Liu, Hanbing, et al.
Published: (2025)
by: Liu, Hanbing, et al.
Published: (2025)
Bridging the Preference Gap between Retrievers and LLMs
by: Ke, Zixuan, et al.
Published: (2024)
by: Ke, Zixuan, et al.
Published: (2024)
AG-TAL: Anatomically-Guided Topology-Aware Loss for Multiclass Segmentation of the Circle of Willis Using Large-Scale Multi-Center Datasets
by: Liu, Jialu, et al.
Published: (2026)
by: Liu, Jialu, et al.
Published: (2026)
Reasoning-Enhanced Self-Training for Long-Form Personalized Text Generation
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
nvBench 2.0: Resolving Ambiguity in Text-to-Visualization through Stepwise Reasoning
by: Luo, Tianqi, et al.
Published: (2025)
by: Luo, Tianqi, et al.
Published: (2025)
A Survey of Preferences for Estate Distribution at Death
by: John Morley, et al.
Published: (2026)
by: John Morley, et al.
Published: (2026)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
by: Cui, Mingxuan, et al.
Published: (2026)
by: Cui, Mingxuan, et al.
Published: (2026)
Learning to Rewrite Prompts for Personalized Text Generation
by: Li, Cheng, et al.
Published: (2023)
by: Li, Cheng, et al.
Published: (2023)
A Predictive Framework for Base-n Radix Sort Optimization
by: Pandey, Atharv, et al.
Published: (2025)
by: Pandey, Atharv, et al.
Published: (2025)
I Will Have Order! Optimizing Orders for Fair Reviewer Assignment
by: Payan, Justin, et al.
Published: (2021)
by: Payan, Justin, et al.
Published: (2021)
$K$-Bad Spheres
by: Bendersky, Martin, et al.
Published: (2026)
by: Bendersky, Martin, et al.
Published: (2026)
Models for the Cohomology of Certain Polyhedral Products
by: Bendersky, Martin, et al.
Published: (2022)
by: Bendersky, Martin, et al.
Published: (2022)
Stochastic RAG: End-to-End Retrieval-Augmented Generation through Expected Utility Maximization
by: Zamani, Hamed, et al.
Published: (2024)
by: Zamani, Hamed, et al.
Published: (2024)
The Evolving Landscape of Modern Regression: A Systematic Review and Mapping Study of Penalized, Algorithmic, and Interpretable Models
by: Michael Bendersky, et al.
Published: (2026)
by: Michael Bendersky, et al.
Published: (2026)
Selective continuous-variable quantum process tomography
by: Feldman, Virginia, et al.
Published: (2024)
by: Feldman, Virginia, et al.
Published: (2024)
Selective quantum state tomography for continuous-variable systems
by: Feldman, Virginia, et al.
Published: (2024)
by: Feldman, Virginia, et al.
Published: (2024)
Teal: Learning-Accelerated Optimization of WAN Traffic Engineering
by: Xu, Zhiying, et al.
Published: (2022)
by: Xu, Zhiying, et al.
Published: (2022)
Disentangling Length Bias In Preference Learning Via Response-Conditioned Modeling
by: Cai, Jianfeng, et al.
Published: (2025)
by: Cai, Jianfeng, et al.
Published: (2025)
Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning
by: Yuan, Aojie, et al.
Published: (2026)
by: Yuan, Aojie, et al.
Published: (2026)
Factorized Latent Reasoning for LLM-based Recommendation
by: Gao, Tianqi, et al.
Published: (2026)
by: Gao, Tianqi, et al.
Published: (2026)
Practically Predefined‐Time‐Synchronized Robust Adaptive Trajectory Tracking Control for Underactuated SVs With Input Saturation and Control Gain Unknown
by: Junfeng Qin, et al.
Published: (2026)
by: Junfeng Qin, et al.
Published: (2026)
Similar Items
-
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
by: Zhang, Rongzhi, et al.
Published: (2024) -
Multilingual Fine-Grained News Headline Hallucination Detection
by: Shen, Jiaming, et al.
Published: (2024) -
Boosting Reward Model with Preference-Conditional Multi-Aspect Synthetic Data Generation
by: Shen, Jiaming, et al.
Published: (2024) -
Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting
by: Qin, Zhen, et al.
Published: (2023) -
LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
by: Qin, Zhen, et al.
Published: (2024)