RLSLM: A Hybrid Reinforcement Learning Framework Aligning Rule-Based Social Locomotion Model with Human Social Norms
Fuente:
arXiv
Saved in:
| Main Authors: | Kou, Yitian, Gu, Yihe, Zhou, Chen, Zhu, DanDan, Kuai, Shuguang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PPS-QMIX: Periodically Parameter Sharing for Accelerating Convergence of Multi-Agent Reinforcement Learning
by: Zhang, Ke, et al.
Published: (2024)
by: Zhang, Ke, et al.
Published: (2024)
VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation
by: Jiang, Longteng, et al.
Published: (2026)
by: Jiang, Longteng, et al.
Published: (2026)
Social-R1: Towards Human-like Social Reasoning in LLMs
by: Wu, Jincenzi, et al.
Published: (2026)
by: Wu, Jincenzi, et al.
Published: (2026)
AI Models Exceed Individual Human Accuracy in Predicting Everyday Social Norms
by: Strimling, Pontus, et al.
Published: (2025)
by: Strimling, Pontus, et al.
Published: (2025)
6Diffusion: IPv6 Target Generation Using a Diffusion Model with Global-Local Attention Mechanisms for Internet-wide IPv6 Scanning
by: He, Nabo, et al.
Published: (2024)
by: He, Nabo, et al.
Published: (2024)
SHE: Stepwise Hybrid Examination Reinforcement Learning Framework for E-commerce Search Relevance
by: Jiao, Pengkun, et al.
Published: (2025)
by: Jiao, Pengkun, et al.
Published: (2025)
Learning Quadruped Locomotion Policies using Logical Rules
by: DeFazio, David, et al.
Published: (2021)
by: DeFazio, David, et al.
Published: (2021)
VideoMAR: Autoregressive Video Generatio with Continuous Tokens
by: Yu, Hu, et al.
Published: (2025)
by: Yu, Hu, et al.
Published: (2025)
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
by: Wang, Xiaohan, et al.
Published: (2024)
by: Wang, Xiaohan, et al.
Published: (2024)
Dynamics for a diffusive epidemic model with a free boundary: spreading-vanishing dichotomy
by: Li, Xueping, et al.
Published: (2024)
by: Li, Xueping, et al.
Published: (2024)
Let Hybrid A* Path Planner Obey Traffic Rules: A Deep Reinforcement Learning-Based Planning Framework
by: Li, Xibo, et al.
Published: (2024)
by: Li, Xibo, et al.
Published: (2024)
Measuring Social Norms of Large Language Models
by: Yuan, Ye, et al.
Published: (2024)
by: Yuan, Ye, et al.
Published: (2024)
Social Norm Reasoning in Multimodal Language Models: An Evaluation
by: Chowdhury, Oishik, et al.
Published: (2026)
by: Chowdhury, Oishik, et al.
Published: (2026)
Explainable Ethical Assessment on Human Behaviors by Generating Conflicting Social Norms
by: Sun, Yuxi, et al.
Published: (2025)
by: Sun, Yuxi, et al.
Published: (2025)
Comparing Reinforcement Learning and Human Learning using the Game of Hidden Rules
by: Pulick, Eric, et al.
Published: (2023)
by: Pulick, Eric, et al.
Published: (2023)
Representing Rule-based Chatbots with Transformers
by: Friedman, Dan, et al.
Published: (2024)
by: Friedman, Dan, et al.
Published: (2024)
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning
by: Long, Qian, et al.
Published: (2024)
by: Long, Qian, et al.
Published: (2024)
Agent Alignment in Evolving Social Norms
by: Li, Shimin, et al.
Published: (2024)
by: Li, Shimin, et al.
Published: (2024)
Advancing Humanoid Locomotion: Mastering Challenging Terrains with Denoising World Model Learning
by: Gu, Xinyang, et al.
Published: (2024)
by: Gu, Xinyang, et al.
Published: (2024)
Marrying Generative Model of Healthcare Events with Digital Twin of Social Determinants of Health for Disease Reasoning
by: Wei, Ziquan, et al.
Published: (2026)
by: Wei, Ziquan, et al.
Published: (2026)
From Prediction to Justification: Aligning Sentiment Reasoning with Human Rationale via Reinforcement Learning
by: Zhang, Shihao, et al.
Published: (2026)
by: Zhang, Shihao, et al.
Published: (2026)
Are Large Language Models Aligned with People's Social Intuitions for Human-Robot Interactions?
by: Wachowiak, Lennart, et al.
Published: (2024)
by: Wachowiak, Lennart, et al.
Published: (2024)
Understanding Transferable Representation Learning and Zero-shot Transfer in CLIP
by: Chen, Zixiang, et al.
Published: (2023)
by: Chen, Zixiang, et al.
Published: (2023)
GASim: A Graph-Accelerated Hybrid Framework for Social Simulation
by: Zhou, Xuan, et al.
Published: (2026)
by: Zhou, Xuan, et al.
Published: (2026)
Can LLMs Understand Social Norms in Autonomous Driving Games?
by: Wang, Boxuan, et al.
Published: (2024)
by: Wang, Boxuan, et al.
Published: (2024)
ScioMind: Cognitively Grounded Multi-Agent Social Simulation with Anchoring-Based Belief Dynamics and Dynamic Profiles
by: Yang, Yitian, et al.
Published: (2026)
by: Yang, Yitian, et al.
Published: (2026)
Aligning Humans and Robots via Reinforcement Learning from Implicit Human Feedback
by: Kim, Suzie, et al.
Published: (2025)
by: Kim, Suzie, et al.
Published: (2025)
As Confidence Aligns: Exploring the Effect of AI Confidence on Human Self-confidence in Human-AI Decision Making
by: Li, Jingshu, et al.
Published: (2025)
by: Li, Jingshu, et al.
Published: (2025)
Dream to Chat: Model-based Reinforcement Learning on Dialogues with User Belief Modeling
by: Zhao, Yue, et al.
Published: (2025)
by: Zhao, Yue, et al.
Published: (2025)
Scalable Frame-based Construction of Sociocultural NormBases for Socially-Aware Dialogues
by: Qu, Shilin, et al.
Published: (2024)
by: Qu, Shilin, et al.
Published: (2024)
EgoNormia: Benchmarking Physical Social Norm Understanding
by: Rezaei, MohammadHossein, et al.
Published: (2025)
by: Rezaei, MohammadHossein, et al.
Published: (2025)
HAELT: A Hybrid Attentive Ensemble Learning Transformer Framework for High-Frequency Stock Price Forecasting
by: Bui, Thanh Dan
Published: (2025)
by: Bui, Thanh Dan
Published: (2025)
Aligning Crowd-sourced Human Feedback for Reinforcement Learning on Code Generation by Large Language Models
by: Wong, Man Fai, et al.
Published: (2025)
by: Wong, Man Fai, et al.
Published: (2025)
A2PO: Towards Effective Offline Reinforcement Learning from an Advantage-aware Perspective
by: Qing, Yunpeng, et al.
Published: (2024)
by: Qing, Yunpeng, et al.
Published: (2024)
Latent Action Priors for Locomotion with Deep Reinforcement Learning
by: Hausdörfer, Oliver, et al.
Published: (2024)
by: Hausdörfer, Oliver, et al.
Published: (2024)
Variable Stiffness for Robust Locomotion through Reinforcement Learning
by: Spoljaric, Dario, et al.
Published: (2025)
by: Spoljaric, Dario, et al.
Published: (2025)
Harnessing Rule-Based Reinforcement Learning for Enhanced Grammatical Error Correction
by: Li, Yilin, et al.
Published: (2025)
by: Li, Yilin, et al.
Published: (2025)
DreamerNLplus: Interpretable Modeling of Mental Health Dynamics from Social Media Timelines using Hybrid Rule-Based and RAG Methods
by: Zhyrko, Maryia, et al.
Published: (2026)
by: Zhyrko, Maryia, et al.
Published: (2026)
Reduced-Order Model-Guided Reinforcement Learning for Demonstration-Free Humanoid Locomotion
by: Liu, Shuai, et al.
Published: (2025)
by: Liu, Shuai, et al.
Published: (2025)
Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning
by: Xie, Tian, et al.
Published: (2025)
by: Xie, Tian, et al.
Published: (2025)
Similar Items
-
PPS-QMIX: Periodically Parameter Sharing for Accelerating Convergence of Multi-Agent Reinforcement Learning
by: Zhang, Ke, et al.
Published: (2024) -
VGA-Bench: A Unified Benchmark and Multi-Model Framework for Video Aesthetics and Generation Quality Evaluation
by: Jiang, Longteng, et al.
Published: (2026) -
Social-R1: Towards Human-like Social Reasoning in LLMs
by: Wu, Jincenzi, et al.
Published: (2026) -
AI Models Exceed Individual Human Accuracy in Predicting Everyday Social Norms
by: Strimling, Pontus, et al.
Published: (2025) -
6Diffusion: IPv6 Target Generation Using a Diffusion Model with Global-Local Attention Mechanisms for Internet-wide IPv6 Scanning
by: He, Nabo, et al.
Published: (2024)