Reasoning Shapes Alignment: Investigating Cultural Alignment in Large Reasoning Models with Cultural Norms
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Yuhang, Zhu, Yanxu, Sang, Jitao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Self-Guided Defense: Adaptive Safety Alignment for Reasoning Models via Synthesized Guidelines
por: Wang, Yuhang, et al.
Publicado: (2025)
por: Wang, Yuhang, et al.
Publicado: (2025)
KG-FPQ: Evaluating Factuality Hallucination in LLMs with Knowledge Graph-based False Premise Questions
por: Zhu, Yanxu, et al.
Publicado: (2024)
por: Zhu, Yanxu, et al.
Publicado: (2024)
Cultural Bias and Cultural Alignment of Large Language Models
por: Tao, Yan, et al.
Publicado: (2023)
por: Tao, Yan, et al.
Publicado: (2023)
OpenRFT: Adapting Reasoning Foundation Model for Domain-specific Tasks with Reinforcement Fine-Tuning
por: Zhang, Yuxiang, et al.
Publicado: (2024)
por: Zhang, Yuxiang, et al.
Publicado: (2024)
SeaEval for Multilingual Foundation Models: From Cross-Lingual Alignment to Cultural Reasoning
por: Wang, Bin, et al.
Publicado: (2023)
por: Wang, Bin, et al.
Publicado: (2023)
Unifying Perplexing Behaviors in Modified BP Attributions through Alignment Perspective
por: Zheng, Guanhua, et al.
Publicado: (2025)
por: Zheng, Guanhua, et al.
Publicado: (2025)
Don't Command, Cultivate: An Exploratory Study of System-2 Alignment
por: Wang, Yuhang, et al.
Publicado: (2024)
por: Wang, Yuhang, et al.
Publicado: (2024)
Reasoning Structure Matters for Safety Alignment of Reasoning Models
por: In, Yeonjun, et al.
Publicado: (2026)
por: In, Yeonjun, et al.
Publicado: (2026)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
por: Eren, Maksim, et al.
Publicado: (2026)
por: Eren, Maksim, et al.
Publicado: (2026)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
por: Wang, Yuhang, et al.
Publicado: (2023)
por: Wang, Yuhang, et al.
Publicado: (2023)
Rethinking AI Cultural Alignment
por: Bravansky, Michal, et al.
Publicado: (2025)
por: Bravansky, Michal, et al.
Publicado: (2025)
ALIGN: Word Association Learning for Cultural Alignment in Large Language Models
por: Liu, Chunhua, et al.
Publicado: (2025)
por: Liu, Chunhua, et al.
Publicado: (2025)
RAJ-PGA: Reasoning-Activated Jailbreak and Principle-Guided Alignment Framework for Large Reasoning Models
por: Chen, Jianhao, et al.
Publicado: (2025)
por: Chen, Jianhao, et al.
Publicado: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
An Evaluation of Cultural Value Alignment in LLM
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
Reasoning Pattern Alignment Merging for Adaptive Reasoning
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
por: Zhong, Zhaofeng, et al.
Publicado: (2026)
Agent models: Internalizing Chain-of-Action Generation into Reasoning models
por: Zhang, Yuxiang, et al.
Publicado: (2025)
por: Zhang, Yuxiang, et al.
Publicado: (2025)
THINKSAFE: Self-Generated Safety Alignment for Reasoning Models
por: Lee, Seanie, et al.
Publicado: (2026)
por: Lee, Seanie, et al.
Publicado: (2026)
Exploring the Privacy Protection Capabilities of Chinese Large Language Models
por: Yang, Yuqi, et al.
Publicado: (2024)
por: Yang, Yuqi, et al.
Publicado: (2024)
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
por: Guo, Hanze, et al.
Publicado: (2025)
por: Guo, Hanze, et al.
Publicado: (2025)
Whispers of Many Shores: Cultural Alignment through Collaborative Cultural Expertise
por: Feng, Shuai, et al.
Publicado: (2025)
por: Feng, Shuai, et al.
Publicado: (2025)
Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable
por: Huang, Tiansheng, et al.
Publicado: (2025)
por: Huang, Tiansheng, et al.
Publicado: (2025)
AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models
por: Zhu, Zihao, et al.
Publicado: (2025)
por: Zhu, Zihao, et al.
Publicado: (2025)
Training-Free Cultural Alignment of Large Language Models via Persona Disagreement
por: Kiet, Huynh Trung, et al.
Publicado: (2026)
por: Kiet, Huynh Trung, et al.
Publicado: (2026)
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
por: Zhang, Hongbin, et al.
Publicado: (2025)
por: Zhang, Hongbin, et al.
Publicado: (2025)
Reasoning-Aware AIGC Detection via Alignment and Reinforcement
por: Wang, Zhao, et al.
Publicado: (2026)
por: Wang, Zhao, et al.
Publicado: (2026)
A Survey of Multimodal Mathematical Reasoning: From Perception, Alignment to Reasoning
por: Yang, Tianyu, et al.
Publicado: (2026)
por: Yang, Tianyu, et al.
Publicado: (2026)
Reasoning-as-Logic-Units: Scaling Test-Time Reasoning in Large Language Models Through Logic Unit Alignment
por: Li, Cheryl, et al.
Publicado: (2025)
por: Li, Cheryl, et al.
Publicado: (2025)
The Shape of Reasoning: Topological Analysis of Reasoning Traces in Large Language Models
por: Tan, Xue Wen, et al.
Publicado: (2025)
por: Tan, Xue Wen, et al.
Publicado: (2025)
Effort as Ceiling, Not Dial: Reasoning Budget Does Not Modulate Cognitive Cost Alignment Between Humans and Large Reasoning Models
por: Hu, Yueqing, et al.
Publicado: (2026)
por: Hu, Yueqing, et al.
Publicado: (2026)
Unifying Ontology Construction and Semantic Alignment for Deterministic Enterprise Reasoning at Scale
por: Zhu, Hongyin
Publicado: (2026)
por: Zhu, Hongyin
Publicado: (2026)
Chain-of-Thought as a Lens: Evaluating Structured Reasoning Alignment between Human Preferences and Large Language Models
por: Wang, Boxuan, et al.
Publicado: (2025)
por: Wang, Boxuan, et al.
Publicado: (2025)
ENIGMA: The Geometry of Reasoning and Alignment in Large-Language Models
por: Seneque, Gareth, et al.
Publicado: (2025)
por: Seneque, Gareth, et al.
Publicado: (2025)
ITDR: An Instruction Tuning Dataset for Enhancing Large Language Models in Recommendations
por: Liu, Zekun, et al.
Publicado: (2025)
por: Liu, Zekun, et al.
Publicado: (2025)
Agent Alignment in Evolving Social Norms
por: Li, Shimin, et al.
Publicado: (2024)
por: Li, Shimin, et al.
Publicado: (2024)
Multiple LLM Agents Debate for Equitable Cultural Alignment
por: Ki, Dayeon, et al.
Publicado: (2025)
por: Ki, Dayeon, et al.
Publicado: (2025)
CulturalFrames: Assessing Cultural Expectation Alignment in Text-to-Image Models and Evaluation Metrics
por: Nayak, Shravan, et al.
Publicado: (2025)
por: Nayak, Shravan, et al.
Publicado: (2025)
TDA-RC: Task-Driven Alignment for Knowledge-Based Reasoning Chains in Large Language Models
por: Zhang, Jiaquan, et al.
Publicado: (2026)
por: Zhang, Jiaquan, et al.
Publicado: (2026)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
por: Cai, Wenrui, et al.
Publicado: (2025)
por: Cai, Wenrui, et al.
Publicado: (2025)
How Reliable is Your Simulator? Analysis on the Limitations of Current LLM-based User Simulators for Conversational Recommendation
por: Zhu, Lixi, et al.
Publicado: (2024)
por: Zhu, Lixi, et al.
Publicado: (2024)
Ejemplares similares
-
Self-Guided Defense: Adaptive Safety Alignment for Reasoning Models via Synthesized Guidelines
por: Wang, Yuhang, et al.
Publicado: (2025) -
KG-FPQ: Evaluating Factuality Hallucination in LLMs with Knowledge Graph-based False Premise Questions
por: Zhu, Yanxu, et al.
Publicado: (2024) -
Cultural Bias and Cultural Alignment of Large Language Models
por: Tao, Yan, et al.
Publicado: (2023) -
OpenRFT: Adapting Reasoning Foundation Model for Domain-specific Tasks with Reinforcement Fine-Tuning
por: Zhang, Yuxiang, et al.
Publicado: (2024) -
SeaEval for Multilingual Foundation Models: From Cross-Lingual Alignment to Cultural Reasoning
por: Wang, Bin, et al.
Publicado: (2023)