Salvato in:
| Autori principali: | Zhang, Yiming, Chang, Zheng, Cai, Wentao, Ren, MengXing, Yuan, Kang, Sun, Yining, Ding, Zenghui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2501.02869 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FRAME: Feedback-Refined Agent Methodology for Enhancing Medical Research Insights
di: Yu, Chengzhang, et al.
Pubblicazione: (2025)
di: Yu, Chengzhang, et al.
Pubblicazione: (2025)
The Paradox of Outcome Optimization: A Causal Information-Theoretic Bound on Reasoning Shortcuts in LLMs
di: Chen, Zihan, et al.
Pubblicazione: (2026)
di: Chen, Zihan, et al.
Pubblicazione: (2026)
Beyond Training: Dynamic Token Merging for Zero-Shot Video Understanding
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
RankCLIP: Ranking-Consistent Language-Image Pretraining
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
Exploring the Capability of ChatGPT to Reproduce Human Labels for Social Computing Tasks (Extended Version)
di: Zhu, Yiming, et al.
Pubblicazione: (2024)
di: Zhu, Yiming, et al.
Pubblicazione: (2024)
AlignGPT: Multi-modal Large Language Models with Adaptive Alignment Capability
di: Zhao, Fei, et al.
Pubblicazione: (2024)
di: Zhao, Fei, et al.
Pubblicazione: (2024)
Rethinking RL Evaluation: Can Benchmarks Truly Reveal Failures of RL Methods?
di: Chen, Zihan, et al.
Pubblicazione: (2025)
di: Chen, Zihan, et al.
Pubblicazione: (2025)
ChiMed-GPT: A Chinese Medical Large Language Model with Full Training Regime and Better Alignment to Human Preferences
di: Tian, Yuanhe, et al.
Pubblicazione: (2023)
di: Tian, Yuanhe, et al.
Pubblicazione: (2023)
Large Language Model's Multi-Capability Alignment in Biomedical Domain
di: Wu, Wentao, et al.
Pubblicazione: (2025)
di: Wu, Wentao, et al.
Pubblicazione: (2025)
A simulation-based training framework for machine-learning applications in ARPES
di: Na, MengXing, et al.
Pubblicazione: (2025)
di: Na, MengXing, et al.
Pubblicazione: (2025)
Diverse Preference Learning for Capabilities and Alignment
di: Slocum, Stewart, et al.
Pubblicazione: (2025)
di: Slocum, Stewart, et al.
Pubblicazione: (2025)
COIG-P: A High-Quality and Large-Scale Chinese Preference Dataset for Alignment with Human Values
di: P Team, et al.
Pubblicazione: (2025)
di: P Team, et al.
Pubblicazione: (2025)
Uncovering Cross-Objective Interference in Multi-Objective Alignment
di: Lu, Yining, et al.
Pubblicazione: (2026)
di: Lu, Yining, et al.
Pubblicazione: (2026)
Capabilities of GPT-5 on Multimodal Medical Reasoning
di: Wang, Shansong, et al.
Pubblicazione: (2025)
di: Wang, Shansong, et al.
Pubblicazione: (2025)
Instruction-Oriented Preference Alignment for Enhancing Multi-Modal Comprehension Capability of MLLMs
di: Wang, Zitian, et al.
Pubblicazione: (2025)
di: Wang, Zitian, et al.
Pubblicazione: (2025)
Implicit Preference Alignment for Human Image Animation
di: Wang, Yuanzhi, et al.
Pubblicazione: (2026)
di: Wang, Yuanzhi, et al.
Pubblicazione: (2026)
Self-Play Preference Optimization for Language Model Alignment
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
Neural Network Graph Similarity Computation Based on Graph Fusion
di: Chang, Zenghui, et al.
Pubblicazione: (2025)
di: Chang, Zenghui, et al.
Pubblicazione: (2025)
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
di: Ge, Qiming, et al.
Pubblicazione: (2025)
di: Ge, Qiming, et al.
Pubblicazione: (2025)
Decoding the Ear: A Framework for Objectifying Expressiveness from Human Preference Through Efficient Alignment
di: Lin, Zhiyu, et al.
Pubblicazione: (2025)
di: Lin, Zhiyu, et al.
Pubblicazione: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
di: Yan, Ziang, et al.
Pubblicazione: (2024)
di: Yan, Ziang, et al.
Pubblicazione: (2024)
EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
di: Zhu, Yufei, et al.
Pubblicazione: (2025)
di: Zhu, Yufei, et al.
Pubblicazione: (2025)
DINORANKCLIP: DINOv3 Distillation and Injection for Vision-Language Pretraining with High-Order Ranking Consistency
di: Jiang, Shuyang, et al.
Pubblicazione: (2026)
di: Jiang, Shuyang, et al.
Pubblicazione: (2026)
Beyond Under-Alignment: Atomic Preference Enhanced Factuality Tuning for Large Language Models
di: Yuan, Hongbang, et al.
Pubblicazione: (2024)
di: Yuan, Hongbang, et al.
Pubblicazione: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
di: He, Jiafan, et al.
Pubblicazione: (2024)
di: He, Jiafan, et al.
Pubblicazione: (2024)
OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment
di: Deng, Jiaxin, et al.
Pubblicazione: (2025)
di: Deng, Jiaxin, et al.
Pubblicazione: (2025)
SPA: Efficient User-Preference Alignment against Uncertainty in Medical Image Segmentation
di: Zhu, Jiayuan, et al.
Pubblicazione: (2024)
di: Zhu, Jiayuan, et al.
Pubblicazione: (2024)
Alignment Data Map for Efficient Preference Data Selection and Diagnosis
di: Lee, Seohyeong, et al.
Pubblicazione: (2025)
di: Lee, Seohyeong, et al.
Pubblicazione: (2025)
MaxMin-RLHF: Alignment with Diverse Human Preferences
di: Chakraborty, Souradip, et al.
Pubblicazione: (2024)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2024)
HPS: Hard Preference Sampling for Human Preference Alignment
di: Zou, Xiandong, et al.
Pubblicazione: (2025)
di: Zou, Xiandong, et al.
Pubblicazione: (2025)
Latent Embedding Adaptation for Human Preference Alignment in Diffusion Planners
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2025)
di: Ng, Wen Zheng Terence, et al.
Pubblicazione: (2025)
Putting HUMANS first: Efficient LAM Evaluation with Human Preference Alignment
di: Gan, Woody Haosheng, et al.
Pubblicazione: (2026)
di: Gan, Woody Haosheng, et al.
Pubblicazione: (2026)
Beyond Preferences: Learning Alignment Principles Grounded in Human Reasons and Values
di: Bell, Henry, et al.
Pubblicazione: (2026)
di: Bell, Henry, et al.
Pubblicazione: (2026)
From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment
di: Chen, Hao, et al.
Pubblicazione: (2026)
di: Chen, Hao, et al.
Pubblicazione: (2026)
Human Alignment of Large Language Models through Online Preference Optimisation
di: Calandriello, Daniele, et al.
Pubblicazione: (2024)
di: Calandriello, Daniele, et al.
Pubblicazione: (2024)
Preference Ranking Optimization for Human Alignment
di: Song, Feifan, et al.
Pubblicazione: (2023)
di: Song, Feifan, et al.
Pubblicazione: (2023)
Differentiate ChatGPT-generated and Human-written Medical Texts
di: Liao, Wenxiong, et al.
Pubblicazione: (2023)
di: Liao, Wenxiong, et al.
Pubblicazione: (2023)
ChatGPT Capabilities for Promoting Sustainability in Education: A Framework for Mapping With SDGs
di: Mohanad Halaweh
Pubblicazione: (2025)
di: Mohanad Halaweh
Pubblicazione: (2025)
Data-Centric Human Preference with Rationales for Direct Preference Alignment
di: Just, Hoang Anh, et al.
Pubblicazione: (2024)
di: Just, Hoang Anh, et al.
Pubblicazione: (2024)
Hybrid Time-Domain Behavior Model Based on Neural Differential Equations and RNNs
di: Chang, Zenghui, et al.
Pubblicazione: (2025)
di: Chang, Zenghui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FRAME: Feedback-Refined Agent Methodology for Enhancing Medical Research Insights
di: Yu, Chengzhang, et al.
Pubblicazione: (2025) -
The Paradox of Outcome Optimization: A Causal Information-Theoretic Bound on Reasoning Shortcuts in LLMs
di: Chen, Zihan, et al.
Pubblicazione: (2026) -
Beyond Training: Dynamic Token Merging for Zero-Shot Video Understanding
di: Zhang, Yiming, et al.
Pubblicazione: (2024) -
RankCLIP: Ranking-Consistent Language-Image Pretraining
di: Zhang, Yiming, et al.
Pubblicazione: (2024) -
Exploring the Capability of ChatGPT to Reproduce Human Labels for Social Computing Tasks (Extended Version)
di: Zhu, Yiming, et al.
Pubblicazione: (2024)