Sotopia-RL: Reward Design for Social Intelligence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Haofei, Qi, Zhengyang, Zhao, Yining, Nottingham, Kolby, Xuan, Keyang, Majumder, Bodhisattwa Prasad, Zhu, Hao, Liang, Paul Pu, You, Jiaxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Skill Set Optimization: Reinforcing Language Model Behavior via Transferable Skills
par: Nottingham, Kolby, et autres
Publié: (2024)
par: Nottingham, Kolby, et autres
Publié: (2024)
ArtifactLinker: Linking Scientific Artifacts for Automatic State-of-the-Art Discovery
par: Yu, Haofei, et autres
Publié: (2026)
par: Yu, Haofei, et autres
Publié: (2026)
SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers
par: Xuan, Keyang, et autres
Publié: (2026)
par: Xuan, Keyang, et autres
Publié: (2026)
To Tell The Truth: Language of Deception and Language Models
par: Hazra, Sanchaita, et autres
Publié: (2023)
par: Hazra, Sanchaita, et autres
Publié: (2023)
SoMi-ToM: Evaluating Multi-Perspective Theory of Mind in Embodied Social Interactions
par: Fan, Xianzhe, et autres
Publié: (2025)
par: Fan, Xianzhe, et autres
Publié: (2025)
Tell, Don't Show!: Language Guidance Eases Transfer Across Domains in Images and Videos
par: Kalluri, Tarun, et autres
Publié: (2024)
par: Kalluri, Tarun, et autres
Publié: (2024)
AI Safety Should Prioritize the Future of Work
par: Hazra, Sanchaita, et autres
Publié: (2025)
par: Hazra, Sanchaita, et autres
Publié: (2025)
TinyScientist: An Interactive, Extensible, and Controllable Framework for Building Research Agents
par: Yu, Haofei, et autres
Publié: (2025)
par: Yu, Haofei, et autres
Publié: (2025)
ResearchTown: Simulator of Human Research Community
par: Yu, Haofei, et autres
Publié: (2024)
par: Yu, Haofei, et autres
Publié: (2024)
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
par: Hao, Yijie, et autres
Publié: (2025)
par: Hao, Yijie, et autres
Publié: (2025)
SOTOPIA-$π$: Interactive Learning of Socially Intelligent Language Agents
par: Wang, Ruiyi, et autres
Publié: (2024)
par: Wang, Ruiyi, et autres
Publié: (2024)
CTM-AI: A Blueprint for General AI Inspired by a Model of Consciousness
par: Yu, Haofei, et autres
Publié: (2026)
par: Yu, Haofei, et autres
Publié: (2026)
Accepted with Minor Revisions: Value of AI-Assisted Scientific Writing
par: Hazra, Sanchaita, et autres
Publié: (2025)
par: Hazra, Sanchaita, et autres
Publié: (2025)
The Good, the Bad, and the Ugly: The Role of AI Quality Disclosure in Lie Detection
par: Bhattacharya, Haimanti, et autres
Publié: (2024)
par: Bhattacharya, Haimanti, et autres
Publié: (2024)
LiveTradeBench: Seeking Real-World Alpha with Large Language Models
par: Yu, Haofei, et autres
Publié: (2025)
par: Yu, Haofei, et autres
Publié: (2025)
ConsistencyChecker: Tree-based Evaluation of LLM Generalization Capabilities
par: Hong, Zhaochen, et autres
Publié: (2025)
par: Hong, Zhaochen, et autres
Publié: (2025)
MMoE: Enhancing Multimodal Models with Mixtures of Multimodal Interaction Experts
par: Yu, Haofei, et autres
Publié: (2023)
par: Yu, Haofei, et autres
Publié: (2023)
Put Your Money Where Your Mouth Is: Evaluating Strategic Planning and Execution of LLM Agents in an Auction Arena
par: Chen, Jiangjie, et autres
Publié: (2023)
par: Chen, Jiangjie, et autres
Publié: (2023)
SOTOPIA: Interactive Evaluation for Social Intelligence in Language Agents
par: Zhou, Xuhui, et autres
Publié: (2023)
par: Zhou, Xuhui, et autres
Publié: (2023)
Table as Thought: Exploring Structured Thoughts in LLM Reasoning
par: Sun, Zhenjie, et autres
Publié: (2025)
par: Sun, Zhenjie, et autres
Publié: (2025)
In-Context Learning May Not Elicit Trustworthy Reasoning: A-Not-B Errors in Pretrained Language Models
par: Han, Pengrui, et autres
Publié: (2024)
par: Han, Pengrui, et autres
Publié: (2024)
On Designing Effective RL Reward at Training Time for LLM Reasoning
par: Gao, Jiaxuan, et autres
Publié: (2024)
par: Gao, Jiaxuan, et autres
Publié: (2024)
Data-driven Discovery with Large Generative Models
par: Majumder, Bodhisattwa Prasad, et autres
Publié: (2024)
par: Majumder, Bodhisattwa Prasad, et autres
Publié: (2024)
Auto-Dreamer: Learning Offline Memory Consolidation for Language Agents
par: Ye, Chongrui, et autres
Publié: (2026)
par: Ye, Chongrui, et autres
Publié: (2026)
Collaborating Action by Action: A Multi-agent LLM Framework for Embodied Reasoning
par: White, Isadora, et autres
Publié: (2025)
par: White, Isadora, et autres
Publié: (2025)
Onondaga County Public Library, Final Performance Report for Library Services and Construction Act (LSCA) Title VI, Library Literacy Program.
par: Nottingham, Sharon
Publié: (1993)
par: Nottingham, Sharon
Publié: (1993)
MINT: Multimodal Instruction Tuning with Multimodal Interaction Grouping
par: Shan, Xiaojun, et autres
Publié: (2025)
par: Shan, Xiaojun, et autres
Publié: (2025)
Tailoring with Targeted Precision: Edit-Based Agents for Open-Domain Procedure Customization
par: Lal, Yash Kumar, et autres
Publié: (2023)
par: Lal, Yash Kumar, et autres
Publié: (2023)
Few-shot Dialogue Strategy Learning for Motivational Interviewing via Inductive Reasoning
par: Xie, Zhouhang, et autres
Publié: (2024)
par: Xie, Zhouhang, et autres
Publié: (2024)
Debugging Tabular Log as Dynamic Graphs
par: Liang, Chumeng, et autres
Publié: (2025)
par: Liang, Chumeng, et autres
Publié: (2025)
Foundations of Multisensory Artificial Intelligence
par: Liang, Paul Pu
Publié: (2024)
par: Liang, Paul Pu
Publié: (2024)
TAMP: Token-Adaptive Layerwise Pruning in Multimodal Large Language Models
par: Lee, Jaewoo, et autres
Publié: (2025)
par: Lee, Jaewoo, et autres
Publié: (2025)
Time-R1: Towards Comprehensive Temporal Reasoning in LLMs
par: Liu, Zijia, et autres
Publié: (2025)
par: Liu, Zijia, et autres
Publié: (2025)
ResearchArcade: Graph Interface for Academic Tasks
par: Xu, Jingjun, et autres
Publié: (2025)
par: Xu, Jingjun, et autres
Publié: (2025)
Towards Socially and Morally Aware RL agent: Reward Design With LLM
par: Wang, Zhaoyue
Publié: (2024)
par: Wang, Zhaoyue
Publié: (2024)
A Vision for Multisensory Intelligence: Sensing, Science, and Synergy
par: Liang, Paul Pu
Publié: (2026)
par: Liang, Paul Pu
Publié: (2026)
Towards Improving Reward Design in RL: A Reward Alignment Metric for RL Practitioners
par: Muslimani, Calarina, et autres
Publié: (2025)
par: Muslimani, Calarina, et autres
Publié: (2025)
D6.2 User stories usage scenarios and use case validation v2
par: Nottingham Trent University
Publié: (2025)
par: Nottingham Trent University
Publié: (2025)
When LLM Reward Design Fails: Diagnostic-Driven Refinement for Sparse Structured RL
par: Wang, Youting, et autres
Publié: (2026)
par: Wang, Youting, et autres
Publié: (2026)
Advancing Social Intelligence in AI Agents: Technical Challenges and Open Questions
par: Mathur, Leena, et autres
Publié: (2024)
par: Mathur, Leena, et autres
Publié: (2024)
Documents similaires
-
Skill Set Optimization: Reinforcing Language Model Behavior via Transferable Skills
par: Nottingham, Kolby, et autres
Publié: (2024) -
ArtifactLinker: Linking Scientific Artifacts for Automatic State-of-the-Art Discovery
par: Yu, Haofei, et autres
Publié: (2026) -
SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers
par: Xuan, Keyang, et autres
Publié: (2026) -
To Tell The Truth: Language of Deception and Language Models
par: Hazra, Sanchaita, et autres
Publié: (2023) -
SoMi-ToM: Evaluating Multi-Perspective Theory of Mind in Embodied Social Interactions
par: Fan, Xianzhe, et autres
Publié: (2025)