Autonomous Alignment with Human Value on Altruism through Considerate Self-imagination and Theory of Mind
Fuente:
arXiv
Saved in:
| Main Authors: | Tong, Haibo, Lu, Enmeng, Sun, Yinqian, Han, Zhengqiang, Liu, Chao, Zhao, Feifei, Zeng, Yi |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Building Altruistic and Moral AI Agent with Brain-inspired Emotional Empathy Mechanisms
by: Zhao, Feifei, et al.
Published: (2024)
by: Zhao, Feifei, et al.
Published: (2024)
CogToM: A Comprehensive Theory of Mind Benchmark inspired by Human Cognition for Large Language Models
by: Tong, Haibo, et al.
Published: (2026)
by: Tong, Haibo, et al.
Published: (2026)
MTDP: A Modulated Transformer based Diffusion Policy Model
by: Wang, Qianhao, et al.
Published: (2025)
by: Wang, Qianhao, et al.
Published: (2025)
Brain-inspired Action Generation with Spiking Transformer Diffusion Policy Model
by: Wang, Qianhao, et al.
Published: (2024)
by: Wang, Qianhao, et al.
Published: (2024)
C-VARC: A Large-Scale Chinese Value Rule Corpus for Value Alignment of Large Language Models
by: Wu, Ping, et al.
Published: (2025)
by: Wu, Ping, et al.
Published: (2025)
Multi-compartment Neuron and Population Encoding Powered Spiking Neural Network for Deep Distributional Reinforcement Learning
by: Sun, Yinqian, et al.
Published: (2023)
by: Sun, Yinqian, et al.
Published: (2023)
Spiking World Model with Multi-Compartment Neurons for Model-based Reinforcement Learning
by: Sun, Yinqian, et al.
Published: (2025)
by: Sun, Yinqian, et al.
Published: (2025)
Continual Learning of Multiple Cognitive Functions with Brain-inspired Temporal Development Mechanism
by: Han, Bing, et al.
Published: (2025)
by: Han, Bing, et al.
Published: (2025)
Super Co-alignment of Human and AI for Sustainable Symbiotic Society
by: Zeng, Yi, et al.
Published: (2025)
by: Zeng, Yi, et al.
Published: (2025)
Evolving Efficient Genetic Encoding for Deep Spiking Neural Networks
by: Pan, Wenxuan, et al.
Published: (2024)
by: Pan, Wenxuan, et al.
Published: (2024)
Safety Instincts: LLMs Learn to Trust Their Internal Compass for Self-Defense
by: Shen, Guobin, et al.
Published: (2025)
by: Shen, Guobin, et al.
Published: (2025)
SafeMind: Benchmarking and Mitigating Safety Risks in Embodied LLM Agents
by: Chen, Ruolin, et al.
Published: (2025)
by: Chen, Ruolin, et al.
Published: (2025)
Brain-inspired and Self-based Artificial Intelligence
by: Zeng, Yi, et al.
Published: (2024)
by: Zeng, Yi, et al.
Published: (2024)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
by: Lyu, Mingyang, et al.
Published: (2025)
by: Lyu, Mingyang, et al.
Published: (2025)
Combining Theory of Mind and Kindness for Self-Supervised Human-AI Alignment
by: Hewson, Joshua T. S.
Published: (2024)
by: Hewson, Joshua T. S.
Published: (2024)
ForesightSafety Bench: A Frontier Risk Evaluation and Governance Framework towards Safe AI
by: Tong, Haibo, et al.
Published: (2026)
by: Tong, Haibo, et al.
Published: (2026)
Informational Cardinality: A Unifying Framework for Set Theory, Fractal Geometry, and Analytic Number Theory
by: Li, Zhengqiang
Published: (2026)
by: Li, Zhengqiang
Published: (2026)
Machine Theory of Mind and the Structure of Human Values
by: de Font-Reaulx, Paul
Published: (2025)
by: de Font-Reaulx, Paul
Published: (2025)
Prime--Zero Duality: Fractal Geometry, Renormalization-Group Flow, and an Information-Ontological Framework for Number Theory
by: Li, Zhengqiang
Published: (2026)
by: Li, Zhengqiang
Published: (2026)
Bidirectional Intention Inference Enhances LLMs' Defense Against Multi-Turn Jailbreak Attacks
by: Tong, Haibo, et al.
Published: (2025)
by: Tong, Haibo, et al.
Published: (2025)
MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
by: Liang, Yao, et al.
Published: (2025)
by: Liang, Yao, et al.
Published: (2025)
Light Alignment Improves LLM Safety via Model Self-Reflection with a Single Neuron
by: Shen, Sicheng, et al.
Published: (2026)
by: Shen, Sicheng, et al.
Published: (2026)
Parallel Spiking Unit for Efficient Training of Spiking Neural Networks
by: Li, Yang, et al.
Published: (2024)
by: Li, Yang, et al.
Published: (2024)
The Self as an Open System: Altruism, Quasi-Entropic Dissipation, and the Structural Conditions for Personality Stability
by: Liu, Echo
Published: (2026)
by: Liu, Echo
Published: (2026)
When Altruism Meets Autonomy: Managing Bottleneck Congestion with Strategic Autonomous Vehicles
by: Wang, Kexin, et al.
Published: (2026)
by: Wang, Kexin, et al.
Published: (2026)
Mind the Value-Action Gap: Do LLMs Act in Alignment with Their Values?
by: Shen, Hua, et al.
Published: (2025)
by: Shen, Hua, et al.
Published: (2025)
Altruism or Self-Interest? Exploring the Motivations of Open Access Authors
by: Heaton, Robert, et al.
Published: (2019)
by: Heaton, Robert, et al.
Published: (2019)
Developmental Plasticity-inspired Adaptive Pruning for Deep Spiking and Artificial Neural Networks
by: Han, Bing, et al.
Published: (2022)
by: Han, Bing, et al.
Published: (2022)
Re-imagining Spectral Graph Theory
by: Aksoy, Sinan G., et al.
Published: (2025)
by: Aksoy, Sinan G., et al.
Published: (2025)
LLM Theory of Mind and Alignment: Opportunities and Risks
by: Street, Winnie
Published: (2024)
by: Street, Winnie
Published: (2024)
Machine Theory of Mind for Autonomous Cyber-Defence
by: Swaby, Luke, et al.
Published: (2024)
by: Swaby, Luke, et al.
Published: (2024)
Electronic Nose‐Based a Time‐Sensor Feature Classification Network for Adzuki Bean Origin Traceability
by: Junliang Han, et al.
Published: (2026)
by: Junliang Han, et al.
Published: (2026)
Do Theory of Mind Benchmarks Need Explicit Human-like Reasoning in Language Models?
by: Lu, Yi-Long, et al.
Published: (2025)
by: Lu, Yi-Long, et al.
Published: (2025)
The Emergence of Altruism in Large-Language-Model Agents Society
by: Li, Haoyang, et al.
Published: (2025)
by: Li, Haoyang, et al.
Published: (2025)
On Altruism and Spite in Bimatrix Games
by: Fasoulakis, Michail, et al.
Published: (2025)
by: Fasoulakis, Michail, et al.
Published: (2025)
Information Visualization for Effective Altruism
by: Dragicevic, Pierre
Published: (2022)
by: Dragicevic, Pierre
Published: (2022)
Money: Altruism's Unlikely Ally
by: Luke Semrau
Published: (2026)
by: Luke Semrau
Published: (2026)
On Donations: Pure and Impure Altruism
by: Marta Faias, et al.
Published: (2025)
by: Marta Faias, et al.
Published: (2025)
A Deterministic Fractal Set Derived from the Sequence of Prime Numbers
by: Li, Zhengqiang
Published: (2026)
by: Li, Zhengqiang
Published: (2026)
Novel diarylpyrimidine subtypes as HIV‐1 nonnucleoside reverse transcriptase inhibitors with improved resistance profile
by: Zhengqiang Wang
Published: (2024)
by: Zhengqiang Wang
Published: (2024)
Similar Items
-
Building Altruistic and Moral AI Agent with Brain-inspired Emotional Empathy Mechanisms
by: Zhao, Feifei, et al.
Published: (2024) -
CogToM: A Comprehensive Theory of Mind Benchmark inspired by Human Cognition for Large Language Models
by: Tong, Haibo, et al.
Published: (2026) -
MTDP: A Modulated Transformer based Diffusion Policy Model
by: Wang, Qianhao, et al.
Published: (2025) -
Brain-inspired Action Generation with Spiking Transformer Diffusion Policy Model
by: Wang, Qianhao, et al.
Published: (2024) -
C-VARC: A Large-Scale Chinese Value Rule Corpus for Value Alignment of Large Language Models
by: Wu, Ping, et al.
Published: (2025)