Guardado en:
| Autores principales: | Uhlig, Matthias, Schacht, Sigurd, Barkur, Sudarshan Kamath |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2401.10580 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models
por: Barkur, Sudarshan Kamath, et al.
Publicado: (2025)
por: Barkur, Sudarshan Kamath, et al.
Publicado: (2025)
Inference Optimizations for Large Language Models: Effects, Challenges, and Practical Considerations
por: Donisch, Leo, et al.
Publicado: (2024)
por: Donisch, Leo, et al.
Publicado: (2024)
Cross-lingual Human-Preference Alignment for Neural Machine Translation with Direct Quality Optimization
por: Uhlig, Kaden, et al.
Publicado: (2024)
por: Uhlig, Kaden, et al.
Publicado: (2024)
A Review of Common Online Speaker Diarization Methods
por: Aperdannier, Roman, et al.
Publicado: (2024)
por: Aperdannier, Roman, et al.
Publicado: (2024)
Systematic Evaluation of Online Speaker Diarization Systems Regarding their Latency
por: Aperdannier, Roman, et al.
Publicado: (2024)
por: Aperdannier, Roman, et al.
Publicado: (2024)
An approach to optimize inference of the DIART speaker diarization pipeline
por: Aperdannier, Roman, et al.
Publicado: (2024)
por: Aperdannier, Roman, et al.
Publicado: (2024)
Language Models Largely Exhibit Human-like Constituent Ordering Preferences
por: Tur, Ada Defne, et al.
Publicado: (2025)
por: Tur, Ada Defne, et al.
Publicado: (2025)
eDIF: A European Deep Inference Fabric for Remote Interpretability of LLM
por: Guggenberger, Irma Heithoff. Marc, et al.
Publicado: (2025)
por: Guggenberger, Irma Heithoff. Marc, et al.
Publicado: (2025)
Direct Judgement Preference Optimization
por: Wang, Peifeng, et al.
Publicado: (2024)
por: Wang, Peifeng, et al.
Publicado: (2024)
BPO: Revisiting Preference Modeling in Direct Preference Optimization
por: Sun, Lin, et al.
Publicado: (2025)
por: Sun, Lin, et al.
Publicado: (2025)
Direct Multi-Turn Preference Optimization for Language Agents
por: Shi, Wentao, et al.
Publicado: (2024)
por: Shi, Wentao, et al.
Publicado: (2024)
New Desiderata for Direct Preference Optimization
por: Hu, Xiangkun, et al.
Publicado: (2024)
por: Hu, Xiangkun, et al.
Publicado: (2024)
BiasDPO: Mitigating Bias in Language Models through Direct Preference Optimization
por: Allam, Ahmed
Publicado: (2024)
por: Allam, Ahmed
Publicado: (2024)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
por: Kim, Dain, et al.
Publicado: (2026)
por: Kim, Dain, et al.
Publicado: (2026)
On Extending Direct Preference Optimization to Accommodate Ties
por: Chen, Jinghong, et al.
Publicado: (2024)
por: Chen, Jinghong, et al.
Publicado: (2024)
Token-weighted Direct Preference Optimization with Attention
por: Huang, Chengyu, et al.
Publicado: (2026)
por: Huang, Chengyu, et al.
Publicado: (2026)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
por: Xiao, Teng, et al.
Publicado: (2024)
por: Xiao, Teng, et al.
Publicado: (2024)
Knowledge Editing in Language Models via Adapted Direct Preference Optimization
por: Rozner, Amit, et al.
Publicado: (2024)
por: Rozner, Amit, et al.
Publicado: (2024)
Length Desensitization in Direct Preference Optimization
por: Liu, Wei, et al.
Publicado: (2024)
por: Liu, Wei, et al.
Publicado: (2024)
Token-level Direct Preference Optimization
por: Zeng, Yongcheng, et al.
Publicado: (2024)
por: Zeng, Yongcheng, et al.
Publicado: (2024)
Filtered Direct Preference Optimization
por: Morimura, Tetsuro, et al.
Publicado: (2024)
por: Morimura, Tetsuro, et al.
Publicado: (2024)
Direct Preference Optimization with an Offset
por: Amini, Afra, et al.
Publicado: (2024)
por: Amini, Afra, et al.
Publicado: (2024)
Enhancing LLM Language Adaption through Cross-lingual In-Context Pre-training
por: Wu, Linjuan, et al.
Publicado: (2025)
por: Wu, Linjuan, et al.
Publicado: (2025)
DPO-Shift: Shifting the Distribution of Direct Preference Optimization
por: Yang, Xiliang, et al.
Publicado: (2025)
por: Yang, Xiliang, et al.
Publicado: (2025)
Ambiguity Awareness Optimization: Towards Semantic Disambiguation for Direct Preference Optimization
por: Li, Jian, et al.
Publicado: (2025)
por: Li, Jian, et al.
Publicado: (2025)
Does Synthetic Data Help Named Entity Recognition for Low-Resource Languages?
por: Kamath, Gaurav, et al.
Publicado: (2025)
por: Kamath, Gaurav, et al.
Publicado: (2025)
Understanding Reference Policies in Direct Preference Optimization
por: Liu, Yixin, et al.
Publicado: (2024)
por: Liu, Yixin, et al.
Publicado: (2024)
Accelerating Direct Preference Optimization with Prefix Sharing
por: Wang, Franklin, et al.
Publicado: (2024)
por: Wang, Franklin, et al.
Publicado: (2024)
Entropy Controllable Direct Preference Optimization
por: Omura, Motoki, et al.
Publicado: (2024)
por: Omura, Motoki, et al.
Publicado: (2024)
Orthogonal Finetuning for Direct Preference Optimization
por: Yang, Chenxu, et al.
Publicado: (2024)
por: Yang, Chenxu, et al.
Publicado: (2024)
System Message Generation for User Preferences using Open-Source Models
por: Jeong, Minbyul, et al.
Publicado: (2025)
por: Jeong, Minbyul, et al.
Publicado: (2025)
Direct Preference Knowledge Distillation for Large Language Models
por: Li, Yixing, et al.
Publicado: (2024)
por: Li, Yixing, et al.
Publicado: (2024)
Bridging and Modeling Correlations in Pairwise Data for Direct Preference Optimization
por: Jiang, Yuxin, et al.
Publicado: (2024)
por: Jiang, Yuxin, et al.
Publicado: (2024)
Backtranslation Augmented Direct Preference Optimization for Neural Machine Translation
por: Ghassabi, Mehrdad, et al.
Publicado: (2026)
por: Ghassabi, Mehrdad, et al.
Publicado: (2026)
DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization
por: Deng, Mengyi, et al.
Publicado: (2026)
por: Deng, Mengyi, et al.
Publicado: (2026)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
por: Zhang, Huatian, et al.
Publicado: (2026)
por: Zhang, Huatian, et al.
Publicado: (2026)
Fine Tuning Large Language Models for Medicine: The Role and Importance of Direct Preference Optimization
por: Savage, Thomas, et al.
Publicado: (2024)
por: Savage, Thomas, et al.
Publicado: (2024)
FedPDPO: Federated Personalized Direct Preference Optimization for Large Language Model Alignment
por: Zhu, Kewen, et al.
Publicado: (2026)
por: Zhu, Kewen, et al.
Publicado: (2026)
Difficulty-Controllable Multiple-Choice Question Generation Using Large Language Models and Direct Preference Optimization
por: Tomikawa, Yuto, et al.
Publicado: (2025)
por: Tomikawa, Yuto, et al.
Publicado: (2025)
The Crucial Role of Samplers in Online Direct Preference Optimization
por: Shi, Ruizhe, et al.
Publicado: (2024)
por: Shi, Ruizhe, et al.
Publicado: (2024)
Ejemplares similares
-
Deception in LLMs: Self-Preservation and Autonomous Goals in Large Language Models
por: Barkur, Sudarshan Kamath, et al.
Publicado: (2025) -
Inference Optimizations for Large Language Models: Effects, Challenges, and Practical Considerations
por: Donisch, Leo, et al.
Publicado: (2024) -
Cross-lingual Human-Preference Alignment for Neural Machine Translation with Direct Quality Optimization
por: Uhlig, Kaden, et al.
Publicado: (2024) -
A Review of Common Online Speaker Diarization Methods
por: Aperdannier, Roman, et al.
Publicado: (2024) -
Systematic Evaluation of Online Speaker Diarization Systems Regarding their Latency
por: Aperdannier, Roman, et al.
Publicado: (2024)