TUR-DPO: Topology- and Uncertainty-Aware Direct Preference Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Abdullah, Abdulhady Abas, Daneshfar, Fatemeh, Mirjalili, Seyedali, Oussalah, Mourad |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evolution of meta's llama models and parameter-efficient fine-tuning of large language models: a survey
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
BiCLIP: Bidirectional and Consistent Language-Image Processing for Robust Medical Image Segmentation
par: Talaei, Saivan, et autres
Publié: (2026)
par: Talaei, Saivan, et autres
Publié: (2026)
KurdSTS: The Kurdish Semantic Textual Similarity
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
KuBERT: Central Kurdish BERT Model and Its Application for Sentiment Analysis
par: Awlla, Kozhin muhealddin, et autres
Publié: (2025)
par: Awlla, Kozhin muhealddin, et autres
Publié: (2025)
From Dialect Gaps to Identity Maps: Tackling Variability in Speaker Verification
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
Advanced Clustering Techniques for Speech Signal Enhancement: A Review and Metanalysis of Fuzzy C-Means, K-Means, and Kernel Fuzzy C-Means Methods
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024)
$β$-DPO: Direct Preference Optimization with Dynamic $β$
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
AI-based Approach in Early Warning Systems: Focus on Emergency Communication Ecosystem and Citizen Participation in Nordic Countries
par: Shaik, Fuzel, et autres
Publié: (2025)
par: Shaik, Fuzel, et autres
Publié: (2025)
C2-DPO: Constrained Controlled Direct Preference Optimization
par: Asadi, Kavosh, et autres
Publié: (2025)
par: Asadi, Kavosh, et autres
Publié: (2025)
AnnoDPO: Protein Functional Annotation Learning with Direct Preference Optimization
par: Jiang, Zixuan, et autres
Publié: (2025)
par: Jiang, Zixuan, et autres
Publié: (2025)
Effect of Information Technology on Job Creation to Support Economic: Case Studies of Graduates in Universities (2023-2024) of the KRG of Iraq
par: Bapir, Azhi Kh., et autres
Publié: (2025)
par: Bapir, Azhi Kh., et autres
Publié: (2025)
$ξ$-DPO: Direct Preference Optimization via Ratio Reward Margin
par: Fan, Zhengyuan, et autres
Publié: (2026)
par: Fan, Zhengyuan, et autres
Publié: (2026)
ActiveDPO: Active Direct Preference Optimization for Sample-Efficient Alignment
par: Lin, Xiaoqiang, et autres
Publié: (2025)
par: Lin, Xiaoqiang, et autres
Publié: (2025)
AlphaDPO: Adaptive Reward Margin for Direct Preference Optimization
par: Wu, Junkang, et autres
Publié: (2024)
par: Wu, Junkang, et autres
Publié: (2024)
2D-Curri-DPO: Two-Dimensional Curriculum Learning for Direct Preference Optimization
par: Li, Mengyang, et autres
Publié: (2025)
par: Li, Mengyang, et autres
Publié: (2025)
2D-DPO: Scaling Direct Preference Optimization with 2-Dimensional Supervision
par: Li, Shilong, et autres
Publié: (2024)
par: Li, Shilong, et autres
Publié: (2024)
SafeDPO: A Simple Approach to Direct Preference Optimization with Enhanced Safety
par: Kim, Geon-Hyeong, et autres
Publié: (2025)
par: Kim, Geon-Hyeong, et autres
Publié: (2025)
PKG-DPO: Optimizing Domain-Specific AI systems with Physics Knowledge Graphs and Direct Preference Optimization
par: Kulkarni, Nitin Nagesh, et autres
Publié: (2025)
par: Kulkarni, Nitin Nagesh, et autres
Publié: (2025)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
par: Qi, Biqing, et autres
Publié: (2024)
par: Qi, Biqing, et autres
Publié: (2024)
Classification of 24-hour movement behaviors from wrist-worn accelerometer data: from handcrafted features to deep learning techniques
par: Sameh, Alireza, et autres
Publié: (2025)
par: Sameh, Alireza, et autres
Publié: (2025)
DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization
par: Das, Amitava, et autres
Publié: (2025)
par: Das, Amitava, et autres
Publié: (2025)
The Role of Orthographic Consistency in Multilingual Embedding Models for Text Classification in Arabic-Script Languages
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
Mix- and MoE-DPO: A Variational Inference Approach to Direct Preference Optimization
par: Bohne, Jason, et autres
Publié: (2025)
par: Bohne, Jason, et autres
Publié: (2025)
EnerBridge-DPO: Energy-Guided Protein Inverse Folding with Markov Bridges and Direct Preference Optimization
par: Rong, Dingyi, et autres
Publié: (2025)
par: Rong, Dingyi, et autres
Publié: (2025)
MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models
par: Liu, Ziyu, et autres
Publié: (2024)
par: Liu, Ziyu, et autres
Publié: (2024)
Reg-DPO: SFT-Regularized Direct Preference Optimization with GT-Pair for Improving Video Generation
par: Du, Jie, et autres
Publié: (2025)
par: Du, Jie, et autres
Publié: (2025)
OmniDPO: A Preference Optimization Framework to Address Omni-Modal Hallucination
par: Chen, Junzhe, et autres
Publié: (2025)
par: Chen, Junzhe, et autres
Publié: (2025)
Leveraging Foundation Models for Enhancing Robot Perception and Action
par: Mirjalili, Reihaneh
Publié: (2025)
par: Mirjalili, Reihaneh
Publié: (2025)
DA-DPO: Cost-efficient Difficulty-aware Preference Optimization for Reducing MLLM Hallucinations
par: Qiu, Longtian, et autres
Publié: (2026)
par: Qiu, Longtian, et autres
Publié: (2026)
Curriculum-DPO++: Direct Preference Optimization via Data and Model Curricula for Text-to-Image Generation
par: Croitoru, Florinel-Alin, et autres
Publié: (2026)
par: Croitoru, Florinel-Alin, et autres
Publié: (2026)
Uncertainty-Penalized Direct Preference Optimization
par: Houliston, Sam, et autres
Publié: (2024)
par: Houliston, Sam, et autres
Publié: (2024)
V-DPO: Mitigating Hallucination in Large Vision Language Models via Vision-Guided Direct Preference Optimization
par: Xie, Yuxi, et autres
Publié: (2024)
par: Xie, Yuxi, et autres
Publié: (2024)
Margin Adaptive DPO: Leveraging Reward Model for Granular Control in Preference Optimization
par: Rho, Hyung Gyu
Publié: (2025)
par: Rho, Hyung Gyu
Publié: (2025)
Sem-DPO: Mitigating Semantic Inconsistency in Preference Optimization for Prompt Engineering
par: Mohamed, Anas, et autres
Publié: (2025)
par: Mohamed, Anas, et autres
Publié: (2025)
Multi-Preference Optimization: Generalizing DPO via Set-Level Contrasts
par: Gupta, Taneesh, et autres
Publié: (2024)
par: Gupta, Taneesh, et autres
Publié: (2024)
RealDPO: Real or Not Real, that is the Preference
par: Cheng, Guo, et autres
Publié: (2025)
par: Cheng, Guo, et autres
Publié: (2025)
When Preferences Diverge: Aligning Diffusion Models with Minority-Aware Adaptive DPO
par: Zhang, Lingfan, et autres
Publié: (2025)
par: Zhang, Lingfan, et autres
Publié: (2025)
ECG-NAT: A Self-supervised Neighborhood Attention Transformer for Multi-lead Electrocardiogram Classification
par: Gazeran, Mahsa, et autres
Publié: (2026)
par: Gazeran, Mahsa, et autres
Publié: (2026)
Rethinking DPO: The Role of Rejected Responses in Preference Misalignment
par: Cho, Jay Hyeon, et autres
Publié: (2025)
par: Cho, Jay Hyeon, et autres
Publié: (2025)
daDPO: Distribution-Aware DPO for Distilling Conversational Abilities
par: Zhang, Zhengze, et autres
Publié: (2025)
par: Zhang, Zhengze, et autres
Publié: (2025)
Documents similaires
-
Evolution of meta's llama models and parameter-efficient fine-tuning of large language models: a survey
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025) -
BiCLIP: Bidirectional and Consistent Language-Image Processing for Robust Medical Image Segmentation
par: Talaei, Saivan, et autres
Publié: (2026) -
KurdSTS: The Kurdish Semantic Textual Similarity
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025) -
KuBERT: Central Kurdish BERT Model and Its Application for Sentiment Analysis
par: Awlla, Kozhin muhealddin, et autres
Publié: (2025) -
From Dialect Gaps to Identity Maps: Tackling Variability in Speaker Verification
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)