PLOT: Enhancing Preference Learning via Optimal Transport
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhu, Liang, Bai, Yuelin, Ren, Xiankun, Yang, Jiaxi, Zhang, Lei, Fang, Feiteng, Alinejad-Rokny, Hamid, Tan, Minghuan, Yang, Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CollectiveSFT: Scaling Large Language Models for Chinese Medical Benchmark with Collective Instructions in Healthcare
por: Zhu, Jingwei, et al.
Publicado: (2024)
por: Zhu, Jingwei, et al.
Publicado: (2024)
DEFT: Distribution-guided Efficient Fine-Tuning for Human Alignment
por: Zhu, Liang, et al.
Publicado: (2026)
por: Zhu, Liang, et al.
Publicado: (2026)
Lower Layers Matter: Alleviating Hallucination via Multi-Layer Fusion Contrastive Decoding with Truthfulness Refocused
por: Chen, Dingwei, et al.
Publicado: (2024)
por: Chen, Dingwei, et al.
Publicado: (2024)
Expanding before Inferring: Enhancing Factuality in Large Language Models through Premature Layers Interpolation
por: Chen, Dingwei, et al.
Publicado: (2025)
por: Chen, Dingwei, et al.
Publicado: (2025)
STORYTELLER: An Enhanced Plot-Planning Framework for Coherent and Cohesive Story Generation
por: Li, Jiaming, et al.
Publicado: (2025)
por: Li, Jiaming, et al.
Publicado: (2025)
Small Language Model as Data Prospector for Large Language Model
por: Ni, Shiwen, et al.
Publicado: (2024)
por: Ni, Shiwen, et al.
Publicado: (2024)
Act-Adaptive Margin: Dynamically Calibrating Reward Models for Subjective Ambiguity
por: Fang, Feiteng, et al.
Publicado: (2025)
por: Fang, Feiteng, et al.
Publicado: (2025)
RxSafeBench: Identifying Medication Safety Issues of Large Language Models in Simulated Consultation
por: Zhao, Jiahao, et al.
Publicado: (2025)
por: Zhao, Jiahao, et al.
Publicado: (2025)
InteractWeb-Bench: Can Multimodal Agent Escape Blind Execution in Interactive Website Generation?
por: Wang, Qiyao, et al.
Publicado: (2026)
por: Wang, Qiyao, et al.
Publicado: (2026)
PatRe: A Full-Stage Office Action and Rebuttal Generation Benchmark for Patent Examination
por: Wang, Qiyao, et al.
Publicado: (2026)
por: Wang, Qiyao, et al.
Publicado: (2026)
DeliLaw: A Chinese Legal Counselling System Based on a Large Language Model
por: Xie, Nan, et al.
Publicado: (2024)
por: Xie, Nan, et al.
Publicado: (2024)
Automatic Paper Reviewing with Heterogeneous Graph Reasoning over LLM-Simulated Reviewer-Author Debates
por: Li, Shuaimin, et al.
Publicado: (2025)
por: Li, Shuaimin, et al.
Publicado: (2025)
Training Superior Sparse Autoencoders for Instruct Models
por: Li, Jiaming, et al.
Publicado: (2025)
por: Li, Jiaming, et al.
Publicado: (2025)
EVADE-Bench: Multimodal Benchmark for Evaluating and Enhancing Evasive Content Detection
por: Xu, Ancheng, et al.
Publicado: (2025)
por: Xu, Ancheng, et al.
Publicado: (2025)
xJailbreak: Representation Space Guided Reinforcement Learning for Interpretable LLM Jailbreaking
por: Lee, Sunbowen, et al.
Publicado: (2025)
por: Lee, Sunbowen, et al.
Publicado: (2025)
FlowPIE: Test-Time Scientific Idea Evolution with Flow-Guided Literature Exploration
por: Wang, Qiyao, et al.
Publicado: (2026)
por: Wang, Qiyao, et al.
Publicado: (2026)
CLaSp: In-Context Layer Skip for Self-Speculative Decoding
por: Chen, Longze, et al.
Publicado: (2025)
por: Chen, Longze, et al.
Publicado: (2025)
ToolRM: Towards Agentic Tool-Use Reward Modeling
por: Li, Renhao, et al.
Publicado: (2025)
por: Li, Renhao, et al.
Publicado: (2025)
PersonaMath: Boosting Mathematical Reasoning via Persona-Driven Data Augmentation
por: Luo, Jing, et al.
Publicado: (2024)
por: Luo, Jing, et al.
Publicado: (2024)
Enhancing Noise Robustness of Retrieval-Augmented Language Models with Adaptive Adversarial Training
por: Fang, Feiteng, et al.
Publicado: (2024)
por: Fang, Feiteng, et al.
Publicado: (2024)
NUMCoT: Numerals and Units of Measurement in Chain-of-Thought Reasoning using Large Language Models
por: Xu, Ancheng, et al.
Publicado: (2024)
por: Xu, Ancheng, et al.
Publicado: (2024)
RuCL: Stratified Rubric-Based Curriculum Learning for Multimodal Large Language Model Reasoning
por: Chen, Yukun, et al.
Publicado: (2026)
por: Chen, Yukun, et al.
Publicado: (2026)
How chromatin interactions shed light on interpreting non-coding genomic variants: opportunities and future direc-tions
por: Liang, Yuheng, et al.
Publicado: (2024)
por: Liang, Yuheng, et al.
Publicado: (2024)
CoEvol: Constructing Better Responses for Instruction Finetuning through Multi-Agent Cooperation
por: Li, Renhao, et al.
Publicado: (2024)
por: Li, Renhao, et al.
Publicado: (2024)
MeasHalu: Mitigation of Scientific Measurement Hallucinations for Large Language Models with Enhanced Reasoning
por: Huang, Ruijun, et al.
Publicado: (2026)
por: Huang, Ruijun, et al.
Publicado: (2026)
DualCoTs: Dual Chain-of-Thoughts Prompting for Sentiment Lexicon Expansion of Idioms
por: Niu, Fuqiang, et al.
Publicado: (2024)
por: Niu, Fuqiang, et al.
Publicado: (2024)
AgentCourt: Simulating Court with Adversarial Evolvable Lawyer Agents
por: Chen, Guhong, et al.
Publicado: (2024)
por: Chen, Guhong, et al.
Publicado: (2024)
AutoPatent: A Multi-Agent Framework for Automatic Patent Generation
por: Wang, Qiyao, et al.
Publicado: (2024)
por: Wang, Qiyao, et al.
Publicado: (2024)
Quantification of Large Language Model Distillation
por: Lee, Sunbowen, et al.
Publicado: (2025)
por: Lee, Sunbowen, et al.
Publicado: (2025)
CoTJudger: A Graph-Driven Framework for Automatic Evaluation of Chain-of-Thought Efficiency and Redundancy in LRMs
por: Li, Siyi, et al.
Publicado: (2026)
por: Li, Siyi, et al.
Publicado: (2026)
MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual Property
por: Ni, Shiwen, et al.
Publicado: (2024)
por: Ni, Shiwen, et al.
Publicado: (2024)
Enhancing Monte Carlo Dropout Performance for Uncertainty Quantification
por: Asgharnezhad, Hamzeh, et al.
Publicado: (2025)
por: Asgharnezhad, Hamzeh, et al.
Publicado: (2025)
PLOT: Progressive Localization via Optimal Transport in Neural Causal Abstraction
por: Chang, Jonathn, et al.
Publicado: (2026)
por: Chang, Jonathn, et al.
Publicado: (2026)
OpenOmni: Advancing Open-Source Omnimodal Large Language Models with Progressive Multimodal Alignment and Real-Time Self-Aware Emotional Speech Synthesis
por: Luo, Run, et al.
Publicado: (2025)
por: Luo, Run, et al.
Publicado: (2025)
Evaluating and Aligning CodeLLMs on Human Preference
por: Yang, Jian, et al.
Publicado: (2024)
por: Yang, Jian, et al.
Publicado: (2024)
Reverse Preference Optimization for Complex Instruction Following
por: Huang, Xiang, et al.
Publicado: (2025)
por: Huang, Xiang, et al.
Publicado: (2025)
Interpretable graph-based models on multimodal biomedical data integration: A technical review and benchmarking
por: Sadeghi, Alireza, et al.
Publicado: (2025)
por: Sadeghi, Alireza, et al.
Publicado: (2025)
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
por: Li, Meng, et al.
Publicado: (2025)
por: Li, Meng, et al.
Publicado: (2025)
APTNESS: Incorporating Appraisal Theory and Emotion Support Strategies for Empathetic Response Generation
por: Hu, Yuxuan, et al.
Publicado: (2024)
por: Hu, Yuxuan, et al.
Publicado: (2024)
LRHP: Learning Representations for Human Preferences via Preference Pairs
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Ejemplares similares
-
CollectiveSFT: Scaling Large Language Models for Chinese Medical Benchmark with Collective Instructions in Healthcare
por: Zhu, Jingwei, et al.
Publicado: (2024) -
DEFT: Distribution-guided Efficient Fine-Tuning for Human Alignment
por: Zhu, Liang, et al.
Publicado: (2026) -
Lower Layers Matter: Alleviating Hallucination via Multi-Layer Fusion Contrastive Decoding with Truthfulness Refocused
por: Chen, Dingwei, et al.
Publicado: (2024) -
Expanding before Inferring: Enhancing Factuality in Large Language Models through Premature Layers Interpolation
por: Chen, Dingwei, et al.
Publicado: (2025) -
STORYTELLER: An Enhanced Plot-Planning Framework for Coherent and Cohesive Story Generation
por: Li, Jiaming, et al.
Publicado: (2025)