Direct Advantage Regression: Aligning LLMs with Online AI Reward
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Li, Zhao, He, Wan, Stephen, Wang, Dadong, Yao, Lina, Liu, Tongliang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Direct Language Model Alignment from Online AI Feedback
par: Guo, Shangmin, et autres
Publié: (2024)
par: Guo, Shangmin, et autres
Publié: (2024)
The Alignment Floor: How Persona Customization Breaks Safety in Weakly-Aligned LLMs
par: Zhang, Xing, et autres
Publié: (2026)
par: Zhang, Xing, et autres
Publié: (2026)
Aligning LLMs with Individual Preferences via Interaction
par: Wu, Shujin, et autres
Publié: (2024)
par: Wu, Shujin, et autres
Publié: (2024)
SARGes: Semantically Aligned Reliable Gesture Generation via Intent Chain
par: Gao, Nan, et autres
Publié: (2025)
par: Gao, Nan, et autres
Publié: (2025)
Effects of Theory of Mind and Prosocial Beliefs on Steering Human-Aligned Behaviors of LLMs in Ultimatum Games
par: Yadav, Neemesh, et autres
Publié: (2025)
par: Yadav, Neemesh, et autres
Publié: (2025)
Your Co-Workers Matter: Evaluating Collaborative Capabilities of Language Models in Blocks World
par: Wu, Guande, et autres
Publié: (2024)
par: Wu, Guande, et autres
Publié: (2024)
Are Today's LLMs Ready to Explain Well-Being Concepts?
par: Jiang, Bohan, et autres
Publié: (2025)
par: Jiang, Bohan, et autres
Publié: (2025)
Human-AI Interaction and User Satisfaction: Empirical Evidence from Online Reviews of AI Products
par: Pasch, Stefan, et autres
Publié: (2025)
par: Pasch, Stefan, et autres
Publié: (2025)
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Interaction Dynamics as a Reward Signal for LLMs
par: Gooding, Sian, et autres
Publié: (2025)
par: Gooding, Sian, et autres
Publié: (2025)
AI Conversational Interviewing: Transforming Surveys with LLMs as Adaptive Interviewers
par: Wuttke, Alexander, et autres
Publié: (2024)
par: Wuttke, Alexander, et autres
Publié: (2024)
CulturalTeaming: AI-Assisted Interactive Red-Teaming for Challenging LLMs' (Lack of) Multicultural Knowledge
par: Chiu, Yu Ying, et autres
Publié: (2024)
par: Chiu, Yu Ying, et autres
Publié: (2024)
Copiloting Diagnosis of Autism in Real Clinical Scenarios via LLMs
par: Jiang, Yi, et autres
Publié: (2024)
par: Jiang, Yi, et autres
Publié: (2024)
Inclusion Arena: An Open Platform for Evaluating Large Foundation Models with Real-World Apps
par: Wang, Kangyu, et autres
Publié: (2025)
par: Wang, Kangyu, et autres
Publié: (2025)
Human Empathy as Encoder: AI-Assisted Depression Assessment in Special Education
par: Zhao, Boning, et autres
Publié: (2025)
par: Zhao, Boning, et autres
Publié: (2025)
CHBench: A Cognitive Hierarchy Benchmark for Evaluating Strategic Reasoning Capability of LLMs
par: Liu, Hongtao, et autres
Publié: (2025)
par: Liu, Hongtao, et autres
Publié: (2025)
Talking to Machines: do you read me?
par: Rojas-Barahona, Lina M.
Publié: (2024)
par: Rojas-Barahona, Lina M.
Publié: (2024)
ConsistencyAI: A Benchmark to Assess LLMs' Factual Consistency When Responding to Different Demographic Groups
par: Banyas, Peter, et autres
Publié: (2025)
par: Banyas, Peter, et autres
Publié: (2025)
Olapa-MCoT: Enhancing the Chinese Mathematical Reasoning Capability of LLMs
par: Zhu, Shaojie, et autres
Publié: (2023)
par: Zhu, Shaojie, et autres
Publié: (2023)
HICode: Hierarchical Inductive Coding with LLMs
par: Zhong, Mian, et autres
Publié: (2025)
par: Zhong, Mian, et autres
Publié: (2025)
Analyzing Cognitive Differences Among Large Language Models through the Lens of Social Worldview
par: Li, Jiatao, et autres
Publié: (2025)
par: Li, Jiatao, et autres
Publié: (2025)
An AI-Powered Research Assistant in the Lab: A Practical Guide for Text Analysis Through Iterative Collaboration with LLMs
par: Carmona-Díaz, Gino, et autres
Publié: (2025)
par: Carmona-Díaz, Gino, et autres
Publié: (2025)
A Comprehensive Survey of Bias in LLMs: Current Landscape and Future Directions
par: Ranjan, Rajesh, et autres
Publié: (2024)
par: Ranjan, Rajesh, et autres
Publié: (2024)
Flowco: Rethinking Data Analysis in the Age of LLMs
par: Freund, Stephen N., et autres
Publié: (2025)
par: Freund, Stephen N., et autres
Publié: (2025)
From Control to Foresight: Simulation as a New Paradigm for Human-Agent Collaboration
par: He, Gaole, et autres
Publié: (2026)
par: He, Gaole, et autres
Publié: (2026)
LLMs for XAI: Future Directions for Explaining Explanations
par: Zytek, Alexandra, et autres
Publié: (2024)
par: Zytek, Alexandra, et autres
Publié: (2024)
EUDAIMONIA: Evaluating Undesirable Dynamics in AI
par: Huang, Jun Rui, et autres
Publié: (2026)
par: Huang, Jun Rui, et autres
Publié: (2026)
StressPrompt: Does Stress Impact Large Language Models and Human Performance Similarly?
par: Shen, Guobin, et autres
Publié: (2024)
par: Shen, Guobin, et autres
Publié: (2024)
SymbolicThought: Integrating Language Models and Symbolic Reasoning for Consistent and Interpretable Human Relationship Understanding
par: Zhao, Runcong, et autres
Publié: (2025)
par: Zhao, Runcong, et autres
Publié: (2025)
AutoLife: Automatic Life Journaling with Smartphones and LLMs
par: Xu, Huatao, et autres
Publié: (2024)
par: Xu, Huatao, et autres
Publié: (2024)
Awaking the Slides: A Tuning-free and Knowledge-regulated AI Tutoring System via Language Model Coordination
par: Zhang-Li, Daniel, et autres
Publié: (2024)
par: Zhang-Li, Daniel, et autres
Publié: (2024)
Performance Gains of LLMs With Humans in a World of LLMs Versus Humans
par: McCullum, Lucas, et autres
Publié: (2025)
par: McCullum, Lucas, et autres
Publié: (2025)
Model-in-the-Loop (MILO): Accelerating Multimodal AI Data Annotation with LLMs
par: Wang, Yifan, et autres
Publié: (2024)
par: Wang, Yifan, et autres
Publié: (2024)
Advancing Speech Language Models by Scaling Supervised Fine-Tuning with Over 60,000 Hours of Synthetic Speech Dialogue Data
par: Zhao, Shuaijiang, et autres
Publié: (2024)
par: Zhao, Shuaijiang, et autres
Publié: (2024)
Aligning Model Evaluations with Human Preferences: Mitigating Token Count Bias in Language Model Assessments
par: Daynauth, Roland, et autres
Publié: (2024)
par: Daynauth, Roland, et autres
Publié: (2024)
The Good, The Bad, and Why: Unveiling Emotions in Generative AI
par: Li, Cheng, et autres
Publié: (2023)
par: Li, Cheng, et autres
Publié: (2023)
From Voices to Validity: Leveraging Large Language Models (LLMs) for Textual Analysis of Policy Stakeholder Interviews
par: Liu, Alex, et autres
Publié: (2023)
par: Liu, Alex, et autres
Publié: (2023)
ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents
par: Liu, Tianjian, et autres
Publié: (2025)
par: Liu, Tianjian, et autres
Publié: (2025)
When Models Know More Than They Can Explain: Quantifying Knowledge Transfer in Human-AI Collaboration
par: Shi, Quan, et autres
Publié: (2025)
par: Shi, Quan, et autres
Publié: (2025)
User-Assistant Bias in LLMs
par: Pan, Xu, et autres
Publié: (2025)
par: Pan, Xu, et autres
Publié: (2025)
Documents similaires
-
Direct Language Model Alignment from Online AI Feedback
par: Guo, Shangmin, et autres
Publié: (2024) -
The Alignment Floor: How Persona Customization Breaks Safety in Weakly-Aligned LLMs
par: Zhang, Xing, et autres
Publié: (2026) -
Aligning LLMs with Individual Preferences via Interaction
par: Wu, Shujin, et autres
Publié: (2024) -
SARGes: Semantically Aligned Reliable Gesture Generation via Intent Chain
par: Gao, Nan, et autres
Publié: (2025) -
Effects of Theory of Mind and Prosocial Beliefs on Steering Human-Aligned Behaviors of LLMs in Ultimatum Games
par: Yadav, Neemesh, et autres
Publié: (2025)