Enregistré dans:
| Auteurs principaux: | Wang, Jianing, Zhou, Yang, Zhang, Xiaocheng, Bao, Mengjiao, Yan, Peng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2409.11212 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TrendFact: A Benchmark for Explainable Hotspot Perception in Fact-Checking with Natural Language Explanation
par: Zhang, Xiaocheng, et autres
Publié: (2024)
par: Zhang, Xiaocheng, et autres
Publié: (2024)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
par: Xiang, Hao, et autres
Publié: (2024)
par: Xiang, Hao, et autres
Publié: (2024)
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models
par: Gu, Yanggan, et autres
Publié: (2025)
par: Gu, Yanggan, et autres
Publié: (2025)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
par: Zhang, Yuanchi, et autres
Publié: (2024)
par: Zhang, Yuanchi, et autres
Publié: (2024)
Advancing Large Language Model Attribution through Self-Improving
par: Huang, Lei, et autres
Publié: (2024)
par: Huang, Lei, et autres
Publié: (2024)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
par: Li, Jian, et autres
Publié: (2024)
par: Li, Jian, et autres
Publié: (2024)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
par: Zhang, Huatian, et autres
Publié: (2026)
par: Zhang, Huatian, et autres
Publié: (2026)
Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning
par: Wang, Jianing, et autres
Publié: (2025)
par: Wang, Jianing, et autres
Publié: (2025)
Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
par: Pan, Yurui, et autres
Publié: (2026)
par: Pan, Yurui, et autres
Publié: (2026)
Dynamic Noise Preference Optimization: Self-Improvement of Large Language Models with Self-Synthetic Data
par: Yang, Haoyan, et autres
Publié: (2025)
par: Yang, Haoyan, et autres
Publié: (2025)
Large Language Model for Multi-objective Evolutionary Optimization
par: Liu, Fei, et autres
Publié: (2023)
par: Liu, Fei, et autres
Publié: (2023)
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
par: Wang, Jianing, et autres
Publié: (2024)
par: Wang, Jianing, et autres
Publié: (2024)
Weights-Rotated Preference Optimization for Large Language Models
par: Yang, Chenxu, et autres
Publié: (2025)
par: Yang, Chenxu, et autres
Publié: (2025)
Uncertainty is Fragile: Manipulating Uncertainty in Large Language Models
par: Zeng, Qingcheng, et autres
Publié: (2024)
par: Zeng, Qingcheng, et autres
Publié: (2024)
Enhancing Non-English Capabilities of English-Centric Large Language Models through Deep Supervision Fine-Tuning
par: Huo, Wenshuai, et autres
Publié: (2025)
par: Huo, Wenshuai, et autres
Publié: (2025)
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
par: Yin, Yueqin, et autres
Publié: (2024)
par: Yin, Yueqin, et autres
Publié: (2024)
LongPO: Long Context Self-Evolution of Large Language Models through Short-to-Long Preference Optimization
par: Chen, Guanzheng, et autres
Publié: (2025)
par: Chen, Guanzheng, et autres
Publié: (2025)
Decomposing Uncertainty for Large Language Models through Input Clarification Ensembling
par: Hou, Bairu, et autres
Publié: (2023)
par: Hou, Bairu, et autres
Publié: (2023)
Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization
par: Wang, Weiyun, et autres
Publié: (2024)
par: Wang, Weiyun, et autres
Publié: (2024)
Aligning Large Language Models with Human Preferences through Representation Engineering
par: Liu, Wenhao, et autres
Publié: (2023)
par: Liu, Wenhao, et autres
Publié: (2023)
Users as Annotators: LLM Preference Learning from Comparison Mode
par: Cai, Zhongze, et autres
Publié: (2025)
par: Cai, Zhongze, et autres
Publié: (2025)
Enhancing Multilingual Counterfactual Generation through Alignment-as-Preference Optimization
par: Wang, Yilong, et autres
Publié: (2026)
par: Wang, Yilong, et autres
Publié: (2026)
Self-Play Preference Optimization for Language Model Alignment
par: Wu, Yue, et autres
Publié: (2024)
par: Wu, Yue, et autres
Publié: (2024)
Preference-Oriented Supervised Fine-Tuning: Favoring Target Model Over Aligned Large Language Models
par: Fan, Yuchen, et autres
Publié: (2024)
par: Fan, Yuchen, et autres
Publié: (2024)
Aligning Large Language Models with Searcher Preferences
par: Wu, Wei, et autres
Publié: (2026)
par: Wu, Wei, et autres
Publié: (2026)
Preference Packing: Efficient Preference Optimization for Large Language Models
par: Cho, Jaekyung
Publié: (2026)
par: Cho, Jaekyung
Publié: (2026)
GENUINE: Graph Enhanced Multi-level Uncertainty Estimation for Large Language Models
par: Wang, Tuo, et autres
Publié: (2025)
par: Wang, Tuo, et autres
Publié: (2025)
HIPPO: Enhancing the Table Understanding Capability of LLMs through Hybrid-Modal Preference Optimization
par: Wang, Haolan, et autres
Publié: (2025)
par: Wang, Haolan, et autres
Publié: (2025)
Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
mDPO: Conditional Preference Optimization for Multimodal Large Language Models
par: Wang, Fei, et autres
Publié: (2024)
par: Wang, Fei, et autres
Publié: (2024)
Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?
par: Jiang, Jin, et autres
Publié: (2025)
par: Jiang, Jin, et autres
Publié: (2025)
DiffPO: Diffusion-styled Preference Optimization for Efficient Inference-Time Alignment of Large Language Models
par: Chen, Ruizhe, et autres
Publié: (2025)
par: Chen, Ruizhe, et autres
Publié: (2025)
Self-Boosting Large Language Models with Synthetic Preference Data
par: Dong, Qingxiu, et autres
Publié: (2024)
par: Dong, Qingxiu, et autres
Publié: (2024)
Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize?
par: Zhang, Yanjian, et autres
Publié: (2025)
par: Zhang, Yanjian, et autres
Publié: (2025)
Ensemble Learning for Heterogeneous Large Language Models with Deep Parallel Collaboration
par: Huang, Yichong, et autres
Publié: (2024)
par: Huang, Yichong, et autres
Publié: (2024)
Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment
par: Peng, Tianyu, et autres
Publié: (2024)
par: Peng, Tianyu, et autres
Publié: (2024)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
par: Singh, Joykirat, et autres
Publié: (2025)
par: Singh, Joykirat, et autres
Publié: (2025)
Observations and Remedies for Large Language Model Bias in Self-Consuming Performative Loop
par: Wang, Yaxuan, et autres
Publié: (2026)
par: Wang, Yaxuan, et autres
Publié: (2026)
METEOR: Evolutionary Journey of Large Language Models from Guidance to Self-Growth
par: Li, Jiawei, et autres
Publié: (2024)
par: Li, Jiawei, et autres
Publié: (2024)
From Implicit to Explicit: Enhancing Self-Recognition in Large Language Models
par: Zhou, Yinghan, et autres
Publié: (2025)
par: Zhou, Yinghan, et autres
Publié: (2025)
Documents similaires
-
TrendFact: A Benchmark for Explainable Hotspot Perception in Fact-Checking with Natural Language Explanation
par: Zhang, Xiaocheng, et autres
Publié: (2024) -
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
par: Xiang, Hao, et autres
Publié: (2024) -
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models
par: Gu, Yanggan, et autres
Publié: (2025) -
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
par: Zhang, Yuanchi, et autres
Publié: (2024) -
Advancing Large Language Model Attribution through Self-Improving
par: Huang, Lei, et autres
Publié: (2024)