Autoregressive Direct Preference Optimization
Fuente:
arXiv
Salvato in:
| Autori principali: | Oi, Masanari, Ukai, Mahiro, Kaneko, Masahiro, Okazaki, Naoaki, Inoue, Nakamasa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
di: Ohi, Masanari, et al.
Pubblicazione: (2024)
di: Ohi, Masanari, et al.
Pubblicazione: (2024)
STATUS Bench: A Rigorous Benchmark for Evaluating Object State Understanding in Vision-Language Models
di: Ukai, Mahiro, et al.
Pubblicazione: (2025)
di: Ukai, Mahiro, et al.
Pubblicazione: (2025)
DISCODE: Distribution-Aware Score Decoder for Robust Automatic Evaluation of Image Captioning
di: Inoue, Nakamasa, et al.
Pubblicazione: (2025)
di: Inoue, Nakamasa, et al.
Pubblicazione: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024)
di: Oi, Masanari, et al.
Pubblicazione: (2024)
Referring Expression Comprehension for Small Objects
di: Goto, Kanoko, et al.
Pubblicazione: (2025)
di: Goto, Kanoko, et al.
Pubblicazione: (2025)
AdaCoder: Adaptive Prompt Compression for Programmatic Visual Question Answering
di: Ukai, Mahiro, et al.
Pubblicazione: (2024)
di: Ukai, Mahiro, et al.
Pubblicazione: (2024)
Intent-Aware Self-Correction for Mitigating Social Biases in Large Language Models
di: Anantaprayoon, Panatchakorn, et al.
Pubblicazione: (2025)
di: Anantaprayoon, Panatchakorn, et al.
Pubblicazione: (2025)
From Correspondence to Actions: Human-Like Multi-Image Spatial Reasoning in Multi-modal Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2026)
di: Oi, Masanari, et al.
Pubblicazione: (2026)
ELP-Adapters: Parameter Efficient Adapter Tuning for Various Speech Processing Tasks
di: Inoue, Nakamasa, et al.
Pubblicazione: (2024)
di: Inoue, Nakamasa, et al.
Pubblicazione: (2024)
JaWildText: A Benchmark for Vision-Language Models on Japanese Scene Text Understanding
di: Maeda, Koki, et al.
Pubblicazione: (2026)
di: Maeda, Koki, et al.
Pubblicazione: (2026)
Pyramid Coder: Hierarchical Code Generator for Compositional Visual Question Answering
di: Shen, Ruoyue, et al.
Pubblicazione: (2024)
di: Shen, Ruoyue, et al.
Pubblicazione: (2024)
Aligning Tree-Search Policies with Fixed Token Budgets in Test-Time Scaling of LLMs
di: Miyamoto, Sora, et al.
Pubblicazione: (2026)
di: Miyamoto, Sora, et al.
Pubblicazione: (2026)
A Japanese Benchmark for Evaluating Social Bias in Reasoning Based on Attribution Theory
di: Shiotani, Taihei, et al.
Pubblicazione: (2026)
di: Shiotani, Taihei, et al.
Pubblicazione: (2026)
Synthesizing Instruction-Tuning Datasets with Contrastive Decoding
di: Ichinose, Tatsuya, et al.
Pubblicazione: (2026)
di: Ichinose, Tatsuya, et al.
Pubblicazione: (2026)
Evaluating Gender Bias of Pre-trained Language Models in Natural Language Inference by Considering All Labels
di: Anantaprayoon, Panatchakorn, et al.
Pubblicazione: (2023)
di: Anantaprayoon, Panatchakorn, et al.
Pubblicazione: (2023)
OUTFOX: LLM-Generated Essay Detection Through In-Context Learning with Adversarially Generated Examples
di: Koike, Ryuto, et al.
Pubblicazione: (2023)
di: Koike, Ryuto, et al.
Pubblicazione: (2023)
How You Prompt Matters! Even Task-Oriented Constraints in Instructions Affect LLM-Generated Text Detection
di: Koike, Ryuto, et al.
Pubblicazione: (2023)
di: Koike, Ryuto, et al.
Pubblicazione: (2023)
Solving NLP Problems through Human-System Collaboration: A Discussion-based Approach
di: Kaneko, Masahiro, et al.
Pubblicazione: (2023)
di: Kaneko, Masahiro, et al.
Pubblicazione: (2023)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
di: Hida, Rem, et al.
Pubblicazione: (2024)
di: Hida, Rem, et al.
Pubblicazione: (2024)
SAIE Framework: Support Alone Isn't Enough -- Advancing LLM Training with Adversarial Remarks
di: Loem, Mengsay, et al.
Pubblicazione: (2023)
di: Loem, Mengsay, et al.
Pubblicazione: (2023)
LLM Output Detectability and Task Performance Can be Jointly Optimized
di: Saito, Koshiro, et al.
Pubblicazione: (2026)
di: Saito, Koshiro, et al.
Pubblicazione: (2026)
Paraphrasing Adversarial Attack on LLM-as-a-Reviewer
di: Kaneko, Masahiro
Pubblicazione: (2026)
di: Kaneko, Masahiro
Pubblicazione: (2026)
EC-Bench: Enumeration and Counting Benchmark for Ultra-Long Videos
di: Tsuchiya, Fumihiko, et al.
Pubblicazione: (2026)
di: Tsuchiya, Fumihiko, et al.
Pubblicazione: (2026)
Continual Pre-Training for Cross-Lingual LLM Adaptation: Enhancing Japanese Language Capabilities
di: Fujii, Kazuki, et al.
Pubblicazione: (2024)
di: Fujii, Kazuki, et al.
Pubblicazione: (2024)
Building a Large Japanese Web Corpus for Large Language Models
di: Okazaki, Naoaki, et al.
Pubblicazione: (2024)
di: Okazaki, Naoaki, et al.
Pubblicazione: (2024)
Vision Language Model-based Caption Evaluation Method Leveraging Visual Context Extraction
di: Maeda, Koki, et al.
Pubblicazione: (2024)
di: Maeda, Koki, et al.
Pubblicazione: (2024)
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
di: Chidambaram, Keertana, et al.
Pubblicazione: (2025)
di: Chidambaram, Keertana, et al.
Pubblicazione: (2025)
Rewriting Pre-Training Data Boosts LLM Performance in Math and Code
di: Fujii, Kazuki, et al.
Pubblicazione: (2025)
di: Fujii, Kazuki, et al.
Pubblicazione: (2025)
Token-Importance Guided Direct Preference Optimization
di: Yang, Ning, et al.
Pubblicazione: (2025)
di: Yang, Ning, et al.
Pubblicazione: (2025)
Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control
di: Nakao, Mahiro, et al.
Pubblicazione: (2026)
di: Nakao, Mahiro, et al.
Pubblicazione: (2026)
Multi-Point Positional Insertion Tuning for Small Object Detection
di: Goto, Kanoko, et al.
Pubblicazione: (2024)
di: Goto, Kanoko, et al.
Pubblicazione: (2024)
JUBAKU: An Adversarial Benchmark for Exposing Culturally Grounded Stereotypes in Japanese LLMs
di: Shiotani, Taihei, et al.
Pubblicazione: (2026)
di: Shiotani, Taihei, et al.
Pubblicazione: (2026)
Rectified Lagrangian for Out-of-Distribution Detection in Modern Hopfield Networks
di: Moriai, Ryo, et al.
Pubblicazione: (2025)
di: Moriai, Ryo, et al.
Pubblicazione: (2025)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
di: Oba, Daisuke, et al.
Pubblicazione: (2026)
Sampling-based Pseudo-Likelihood for Membership Inference Attacks
di: Kaneko, Masahiro, et al.
Pubblicazione: (2024)
di: Kaneko, Masahiro, et al.
Pubblicazione: (2024)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
di: Kaneko, Masahiro, et al.
Pubblicazione: (2024)
di: Kaneko, Masahiro, et al.
Pubblicazione: (2024)
Continuous-Utility Direct Preference Optimization
di: Mohsin, Muhammad Ahmed, et al.
Pubblicazione: (2026)
di: Mohsin, Muhammad Ahmed, et al.
Pubblicazione: (2026)
ADPO: Anchored Direct Preference Optimization
di: Zixian, Wang
Pubblicazione: (2025)
di: Zixian, Wang
Pubblicazione: (2025)
Token-level Direct Preference Optimization
di: Zeng, Yongcheng, et al.
Pubblicazione: (2024)
di: Zeng, Yongcheng, et al.
Pubblicazione: (2024)
On Softmax Direct Preference Optimization for Recommendation
di: Chen, Yuxin, et al.
Pubblicazione: (2024)
di: Chen, Yuxin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
di: Ohi, Masanari, et al.
Pubblicazione: (2024) -
STATUS Bench: A Rigorous Benchmark for Evaluating Object State Understanding in Vision-Language Models
di: Ukai, Mahiro, et al.
Pubblicazione: (2025) -
DISCODE: Distribution-Aware Score Decoder for Robust Automatic Evaluation of Image Captioning
di: Inoue, Nakamasa, et al.
Pubblicazione: (2025) -
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024) -
Referring Expression Comprehension for Small Objects
di: Goto, Kanoko, et al.
Pubblicazione: (2025)