Relative Density Ratio Optimization for Stable and Statistically Consistent Model Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Takahashi, Hiroshi, Iwata, Tomoharu, Kumagai, Atsutoshi, Kanai, Sekitoshi, Yamada, Masanori, Nishida, Kosuke, Shinoda, Kazutoshi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Debiasing Reward Models via Causally Motivated Inference-Time Intervention
par: Shinoda, Kazutoshi, et autres
Publié: (2026)
par: Shinoda, Kazutoshi, et autres
Publié: (2026)
Deep Positive-Unlabeled Anomaly Detection for Contaminated Unlabeled Data
par: Takahashi, Hiroshi, et autres
Publié: (2024)
par: Takahashi, Hiroshi, et autres
Publié: (2024)
Positive-Unlabeled Diffusion Models for Preventing Sensitive Data Generation
par: Takahashi, Hiroshi, et autres
Publié: (2025)
par: Takahashi, Hiroshi, et autres
Publié: (2025)
Transfer Learning with Pre-trained Conditional Generative Models
par: Yamaguchi, Shin'ya, et autres
Publié: (2022)
par: Yamaguchi, Shin'ya, et autres
Publié: (2022)
Meta-learning for Positive-unlabeled Classification
par: Kumagai, Atsutoshi, et autres
Publié: (2024)
par: Kumagai, Atsutoshi, et autres
Publié: (2024)
Test-Time Alignment of LLMs via Sampling-Based Optimal Control in pre-logit space
par: Kanai, Sekitoshi, et autres
Publié: (2025)
par: Kanai, Sekitoshi, et autres
Publié: (2025)
Let's Put Ourselves in Sally's Shoes: Shoes-of-Others Prefilling Improves Theory of Mind in Large Language Models
par: Shinoda, Kazutoshi, et autres
Publié: (2025)
par: Shinoda, Kazutoshi, et autres
Publié: (2025)
Analysis of Linear Mode Connectivity via Permutation-Based Weight Matching: With Insights into Other Permutation Search Methods
par: Ito, Akira, et autres
Publié: (2024)
par: Ito, Akira, et autres
Publié: (2024)
Concept Unlearning in Large Language Models via Self-Constructed Knowledge Triplets
par: Yamashita, Tomoya, et autres
Publié: (2025)
par: Yamashita, Tomoya, et autres
Publié: (2025)
Do We Really Need Permutations? Impact of Model Width on Linear Mode Connectivity
par: Ito, Akira, et autres
Publié: (2025)
par: Ito, Akira, et autres
Publié: (2025)
ToMATO: Verbalizing the Mental States of Role-Playing LLMs for Benchmarking Theory of Mind
par: Shinoda, Kazutoshi, et autres
Publié: (2025)
par: Shinoda, Kazutoshi, et autres
Publié: (2025)
Meta-learning Representations for Learning from Multiple Annotators
par: Kumagai, Atsutoshi, et autres
Publié: (2025)
par: Kumagai, Atsutoshi, et autres
Publié: (2025)
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
par: Yamaguchi, Shin'ya, et autres
Publié: (2025)
par: Yamaguchi, Shin'ya, et autres
Publié: (2025)
Test-time Adaptation for Regression by Subspace Alignment
par: Adachi, Kazuki, et autres
Publié: (2024)
par: Adachi, Kazuki, et autres
Publié: (2024)
Direct Density Ratio Optimization: A Statistically Consistent Approach to Aligning Large Language Models
par: Higuchi, Rei, et autres
Publié: (2025)
par: Higuchi, Rei, et autres
Publié: (2025)
Covariance-aware Feature Alignment with Pre-computed Source Statistics for Test-time Adaptation to Multiple Image Corruptions
par: Adachi, Kazuki, et autres
Publié: (2022)
par: Adachi, Kazuki, et autres
Publié: (2022)
Initialization of Large Language Models via Reparameterization to Mitigate Loss Spikes
par: Nishida, Kosuke, et autres
Publié: (2024)
par: Nishida, Kosuke, et autres
Publié: (2024)
Adaptive Random Feature Regularization on Fine-tuning Deep Neural Networks
par: Yamaguchi, Shin'ya, et autres
Publié: (2024)
par: Yamaguchi, Shin'ya, et autres
Publié: (2024)
Data-driven Projection Generation for Efficiently Solving Heterogeneous Quadratic Programming Problems
par: Iwata, Tomoharu, et autres
Publié: (2025)
par: Iwata, Tomoharu, et autres
Publié: (2025)
Can LLMs Detect Their Own Hallucinations?
par: Kadotani, Sora, et autres
Publié: (2025)
par: Kadotani, Sora, et autres
Publié: (2025)
Evaluating Time-Series Training Dataset through Lens of Spectrum in Deep State Space Models
par: Kanai, Sekitoshi, et autres
Publié: (2024)
par: Kanai, Sekitoshi, et autres
Publié: (2024)
Density-Guided Response Optimization: Community-Grounded Alignment via Implicit Acceptance Signals
par: Gerard, Patrick, et autres
Publié: (2026)
par: Gerard, Patrick, et autres
Publié: (2026)
Pretraining and Updates of Domain-Specific LLM: A Case Study in the Japanese Business Domain
par: Takahashi, Kosuke, et autres
Publié: (2024)
par: Takahashi, Kosuke, et autres
Publié: (2024)
VAL-Bench: Belief Consistency as a measure for Value Alignment in Language Models
par: Gupta, Aman, et autres
Publié: (2025)
par: Gupta, Aman, et autres
Publié: (2025)
TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching
par: Nguyen, Truong, et autres
Publié: (2026)
par: Nguyen, Truong, et autres
Publié: (2026)
Personalized Group Relative Policy Optimization for Heterogenous Preference Alignment
par: Wang, Jialu, et autres
Publié: (2026)
par: Wang, Jialu, et autres
Publié: (2026)
Counterfactual-Consistency Prompting for Relative Temporal Understanding in Large Language Models
par: Kim, Jongho, et autres
Publié: (2025)
par: Kim, Jongho, et autres
Publié: (2025)
Out-of-the-Box Conditional Text Embeddings from Large Language Models
par: Yamada, Kosuke, et autres
Publié: (2025)
par: Yamada, Kosuke, et autres
Publié: (2025)
TriAlign: Towards Universal Truth Consistency in Personalized LLM Alignment
par: Nguyen, Thi-Nhung, et autres
Publié: (2026)
par: Nguyen, Thi-Nhung, et autres
Publié: (2026)
Revisiting Self-Consistency from Dynamic Distributional Alignment Perspective on Answer Aggregation
par: Li, Yiwei, et autres
Publié: (2025)
par: Li, Yiwei, et autres
Publié: (2025)
Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search
par: Cao, Zhiyu, et autres
Publié: (2026)
par: Cao, Zhiyu, et autres
Publié: (2026)
MoCoRP: Modeling Consistent Relations between Persona and Response for Persona-based Dialogue
par: Lee, Kyungro, et autres
Publié: (2025)
par: Lee, Kyungro, et autres
Publié: (2025)
Preference Optimization by Estimating the Ratio of the Data Distribution
par: Kim, Yeongmin, et autres
Publié: (2025)
par: Kim, Yeongmin, et autres
Publié: (2025)
Preference Ranking Optimization for Human Alignment
par: Song, Feifan, et autres
Publié: (2023)
par: Song, Feifan, et autres
Publié: (2023)
OptiHive: Ensemble Selection for LLM-Based Optimization via Statistical Modeling
par: Bouscary, Maxime, et autres
Publié: (2025)
par: Bouscary, Maxime, et autres
Publié: (2025)
Self-Consistency Preference Optimization
par: Prasad, Archiki, et autres
Publié: (2024)
par: Prasad, Archiki, et autres
Publié: (2024)
Binary Classifier Optimization for Large Language Model Alignment
par: Jung, Seungjae, et autres
Publié: (2024)
par: Jung, Seungjae, et autres
Publié: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
par: He, Jiafan, et autres
Publié: (2024)
par: He, Jiafan, et autres
Publié: (2024)
Self-Play Preference Optimization for Language Model Alignment
par: Wu, Yue, et autres
Publié: (2024)
par: Wu, Yue, et autres
Publié: (2024)
Stepwise Alignment for Constrained Language Model Policy Optimization
par: Wachi, Akifumi, et autres
Publié: (2024)
par: Wachi, Akifumi, et autres
Publié: (2024)
Documents similaires
-
Debiasing Reward Models via Causally Motivated Inference-Time Intervention
par: Shinoda, Kazutoshi, et autres
Publié: (2026) -
Deep Positive-Unlabeled Anomaly Detection for Contaminated Unlabeled Data
par: Takahashi, Hiroshi, et autres
Publié: (2024) -
Positive-Unlabeled Diffusion Models for Preventing Sensitive Data Generation
par: Takahashi, Hiroshi, et autres
Publié: (2025) -
Transfer Learning with Pre-trained Conditional Generative Models
par: Yamaguchi, Shin'ya, et autres
Publié: (2022) -
Meta-learning for Positive-unlabeled Classification
par: Kumagai, Atsutoshi, et autres
Publié: (2024)