ContraSolver: Self-Alignment of Language Models by Resolving Internal Preference Contradictions
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xu, Yin, Xunjian, Wan, Xiaojun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Benchmarking Knowledge Boundary for Large Language Models: A Different Perspective on Model Evaluation
di: Yin, Xunjian, et al.
Pubblicazione: (2024)
di: Yin, Xunjian, et al.
Pubblicazione: (2024)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
di: Li, Jiatao, et al.
Pubblicazione: (2024)
di: Li, Jiatao, et al.
Pubblicazione: (2024)
EAMA : Entity-Aware Multimodal Alignment Based Approach for News Image Captioning
di: Zhang, Junzhe, et al.
Pubblicazione: (2024)
di: Zhang, Junzhe, et al.
Pubblicazione: (2024)
DSGram: Dynamic Weighting Sub-Metrics for Grammatical Error Correction in the Era of Large Language Models
di: Xie, Jinxiang, et al.
Pubblicazione: (2024)
di: Xie, Jinxiang, et al.
Pubblicazione: (2024)
Themis: A Reference-free NLG Evaluation Language Model with Flexibility and Interpretability
di: Hu, Xinyu, et al.
Pubblicazione: (2024)
di: Hu, Xinyu, et al.
Pubblicazione: (2024)
ContraDoc: Understanding Self-Contradictions in Documents with Large Language Models
di: Li, Jierui, et al.
Pubblicazione: (2023)
di: Li, Jierui, et al.
Pubblicazione: (2023)
Error-Robust Retrieval for Chinese Spelling Check
di: Yin, Xunjian, et al.
Pubblicazione: (2022)
di: Yin, Xunjian, et al.
Pubblicazione: (2022)
Harnessing Rule-Based Reinforcement Learning for Enhanced Grammatical Error Correction
di: Li, Yilin, et al.
Pubblicazione: (2025)
di: Li, Yilin, et al.
Pubblicazione: (2025)
Advantage-Guided Distillation for Preference Alignment in Small Language Models
di: Gao, Shiping, et al.
Pubblicazione: (2025)
di: Gao, Shiping, et al.
Pubblicazione: (2025)
AGENT-X: Adaptive Guideline-based Expert Network for Threshold-free AI-generated teXt detection
di: Li, Jiatao, et al.
Pubblicazione: (2025)
di: Li, Jiatao, et al.
Pubblicazione: (2025)
MC-MKE: A Fine-Grained Multimodal Knowledge Editing Benchmark Emphasizing Modality Consistency
di: Zhang, Junzhe, et al.
Pubblicazione: (2024)
di: Zhang, Junzhe, et al.
Pubblicazione: (2024)
LEDOM: Reverse Language Model
di: Yin, Xunjian, et al.
Pubblicazione: (2025)
di: Yin, Xunjian, et al.
Pubblicazione: (2025)
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
di: Yin, Yueqin, et al.
Pubblicazione: (2024)
di: Yin, Yueqin, et al.
Pubblicazione: (2024)
Re-Thinking the Automatic Evaluation of Image-Text Alignment in Text-to-Image Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
di: Zhang, Huixuan, et al.
Pubblicazione: (2025)
Understanding the Interplay between Parametric and Contextual Knowledge for Large Language Models
di: Cheng, Sitao, et al.
Pubblicazione: (2024)
di: Cheng, Sitao, et al.
Pubblicazione: (2024)
NILE: Internal Consistency Alignment in Large Language Models
di: Hu, Minda, et al.
Pubblicazione: (2024)
di: Hu, Minda, et al.
Pubblicazione: (2024)
Self-Play Preference Optimization for Language Model Alignment
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
Quantity Matters: Towards Assessing and Mitigating Number Hallucination in Large Vision-Language Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
Evaluating, Understanding, and Improving Constrained Text Generation for Large Language Models
di: Chen, Xiang, et al.
Pubblicazione: (2023)
di: Chen, Xiang, et al.
Pubblicazione: (2023)
Weighted-Reward Preference Optimization for Implicit Model Fusion
di: Yang, Ziyi, et al.
Pubblicazione: (2024)
di: Yang, Ziyi, et al.
Pubblicazione: (2024)
Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
di: Gao, Mingqi, et al.
Pubblicazione: (2024)
COrAL: Order-Agnostic Language Modeling for Efficient Iterative Refinement
di: Xie, Yuxi, et al.
Pubblicazione: (2024)
di: Xie, Yuxi, et al.
Pubblicazione: (2024)
HealthContradict: Evaluating Biomedical Knowledge Conflicts in Language Models
di: Zhang, Boya, et al.
Pubblicazione: (2025)
di: Zhang, Boya, et al.
Pubblicazione: (2025)
Preference Alignment Improves Language Model-Based TTS
di: Tian, Jinchuan, et al.
Pubblicazione: (2024)
di: Tian, Jinchuan, et al.
Pubblicazione: (2024)
StoicLLM: Preference Optimization for Philosophical Alignment in Small Language Models
di: Khan, Ishmam, et al.
Pubblicazione: (2026)
di: Khan, Ishmam, et al.
Pubblicazione: (2026)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
di: Wan, Xu, et al.
Pubblicazione: (2025)
di: Wan, Xu, et al.
Pubblicazione: (2025)
SemPA: Improving Sentence Embeddings of Large Language Models through Semantic Preference Alignment
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
FuseRL: Dense Preference Optimization for Heterogeneous Model Fusion
di: Zhong, Longguang, et al.
Pubblicazione: (2025)
di: Zhong, Longguang, et al.
Pubblicazione: (2025)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
di: Li, Jian, et al.
Pubblicazione: (2024)
di: Li, Jian, et al.
Pubblicazione: (2024)
CFunModel: A "Funny" Language Model Capable of Chinese Humor Generation and Processing
di: Yu, Zhenghan, et al.
Pubblicazione: (2025)
di: Yu, Zhenghan, et al.
Pubblicazione: (2025)
ChemAgent: Self-updating Library in Large Language Models Improves Chemical Reasoning
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
di: Zhang, Yifan, et al.
Pubblicazione: (2024)
di: Zhang, Yifan, et al.
Pubblicazione: (2024)
Self-Pluralising Culture Alignment for Large Language Models
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
Coding Agents are Effective Long-Context Processors
di: Cao, Weili, et al.
Pubblicazione: (2026)
di: Cao, Weili, et al.
Pubblicazione: (2026)
Large Language Models as an Indirect Reasoner: Contrapositive and Contradiction for Automated Reasoning
di: Zhang, Yanfang, et al.
Pubblicazione: (2024)
di: Zhang, Yanfang, et al.
Pubblicazione: (2024)
Impact of Preference Noise on the Alignment Performance of Generative Language Models
di: Gao, Yang, et al.
Pubblicazione: (2024)
di: Gao, Yang, et al.
Pubblicazione: (2024)
Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
di: Zhang, Glenn, et al.
Pubblicazione: (2025)
di: Zhang, Glenn, et al.
Pubblicazione: (2025)
Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
di: Pan, Yurui, et al.
Pubblicazione: (2026)
di: Pan, Yurui, et al.
Pubblicazione: (2026)
FuseChat-3.0: Preference Optimization Meets Heterogeneous Model Fusion
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
Self-Supervised Visual Preference Alignment
di: Zhu, Ke, et al.
Pubblicazione: (2024)
di: Zhu, Ke, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Benchmarking Knowledge Boundary for Large Language Models: A Different Perspective on Model Evaluation
di: Yin, Xunjian, et al.
Pubblicazione: (2024) -
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
di: Li, Jiatao, et al.
Pubblicazione: (2024) -
EAMA : Entity-Aware Multimodal Alignment Based Approach for News Image Captioning
di: Zhang, Junzhe, et al.
Pubblicazione: (2024) -
DSGram: Dynamic Weighting Sub-Metrics for Grammatical Error Correction in the Era of Large Language Models
di: Xie, Jinxiang, et al.
Pubblicazione: (2024) -
Themis: A Reference-free NLG Evaluation Language Model with Flexibility and Interpretability
di: Hu, Xinyu, et al.
Pubblicazione: (2024)