'Too much alignment; not enough culture': Re-balancing cultural alignment practices in LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Orlowski, Eric J. W., Norhashim, Hakim, Wey, Tristan Koh Ly |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Are aligned neural networks adversarially aligned?
par: Carlini, Nicholas, et autres
Publié: (2023)
par: Carlini, Nicholas, et autres
Publié: (2023)
Synthelite: Chemist-aligned and feasibility-aware synthesis planning with LLMs
par: Xuan-Vu, Nguyen, et autres
Publié: (2025)
par: Xuan-Vu, Nguyen, et autres
Publié: (2025)
Getting aligned on representational alignment
par: Sucholutsky, Ilia, et autres
Publié: (2023)
par: Sucholutsky, Ilia, et autres
Publié: (2023)
Grammar and Gameplay-aligned RL for Game Description Generation with LLMs
par: Tanaka, Tsunehiko, et autres
Publié: (2025)
par: Tanaka, Tsunehiko, et autres
Publié: (2025)
Few-shot Personalization of LLMs with Mis-aligned Responses
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
Extracting alignment data in open models
par: Barbero, Federico, et autres
Publié: (2025)
par: Barbero, Federico, et autres
Publié: (2025)
Value alignment: a formal approach
par: Sierra, Carles, et autres
Publié: (2021)
par: Sierra, Carles, et autres
Publié: (2021)
XBreaking: Understanding how LLMs security alignment can be broken
par: Arazzi, Marco, et autres
Publié: (2025)
par: Arazzi, Marco, et autres
Publié: (2025)
An alignment safety case sketch based on debate
par: Buhl, Marie Davidsen, et autres
Publié: (2025)
par: Buhl, Marie Davidsen, et autres
Publié: (2025)
Automated alignment is harder than you think
par: Bowkis, Aleksandr, et autres
Publié: (2026)
par: Bowkis, Aleksandr, et autres
Publié: (2026)
Misalignment or misuse? The AGI alignment tradeoff
par: Hellrigel-Holderbaum, Max, et autres
Publié: (2025)
par: Hellrigel-Holderbaum, Max, et autres
Publié: (2025)
RealignDiff: Boosting Text-to-Image Diffusion Model with Coarse-to-fine Semantic Re-alignment
par: Jiang, Zutao, et autres
Publié: (2023)
par: Jiang, Zutao, et autres
Publié: (2023)
Human-aligned Chess with a Bit of Search
par: Zhang, Yiming, et autres
Publié: (2024)
par: Zhang, Yiming, et autres
Publié: (2024)
Super Co-alignment of Human and AI for Sustainable Symbiotic Society
par: Zeng, Yi, et autres
Publié: (2025)
par: Zeng, Yi, et autres
Publié: (2025)
Auto-regressive transformation for image alignment
par: Lee, Kanggeon, et autres
Publié: (2025)
par: Lee, Kanggeon, et autres
Publié: (2025)
On Goodhart's law, with an application to value alignment
par: El-Mhamdi, El-Mahdi, et autres
Publié: (2024)
par: El-Mhamdi, El-Mahdi, et autres
Publié: (2024)
PsyMem: Fine-grained psychological alignment and Explicit Memory Control for Advanced Role-Playing LLMs
par: Cheng, Xilong, et autres
Publié: (2025)
par: Cheng, Xilong, et autres
Publié: (2025)
Causality-aligned Prompt Learning via Diffusion-based Counterfactual Generation
par: Li, Xinshu, et autres
Publié: (2025)
par: Li, Xinshu, et autres
Publié: (2025)
GRACE: Gradient-aligned Reasoning Data Curation for Efficient Post-training
par: Li, Junjie, et autres
Publié: (2026)
par: Li, Junjie, et autres
Publié: (2026)
Knowledge distillation through geometry-aware representational alignment
par: Bhattarai, Prajjwal, et autres
Publié: (2025)
par: Bhattarai, Prajjwal, et autres
Publié: (2025)
Towards Stable Preferences for Stakeholder-aligned Machine Learning
par: Sheraz, Haleema, et autres
Publié: (2024)
par: Sheraz, Haleema, et autres
Publié: (2024)
Don't Get Too Excited -- Eliciting Emotions in LLMs
par: Fazzi, Gino Franco, et autres
Publié: (2025)
par: Fazzi, Gino Franco, et autres
Publié: (2025)
Towards aligned body representations in vision models
par: Gizdov, Andrey, et autres
Publié: (2025)
par: Gizdov, Andrey, et autres
Publié: (2025)
Why human-AI relationships need socioaffective alignment
par: Kirk, Hannah Rose, et autres
Publié: (2025)
par: Kirk, Hannah Rose, et autres
Publié: (2025)
Ethics2vec: aligning automatic agents and human preferences
par: Bontempi, Gianluca
Publié: (2025)
par: Bontempi, Gianluca
Publié: (2025)
Directed Graph-alignment Approach for Identification of Gaps in Short Answers
par: Sahu, Archana, et autres
Publié: (2025)
par: Sahu, Archana, et autres
Publié: (2025)
EDUMATH: Generating Standards-aligned Educational Math Word Problems
par: Christ, Bryan R., et autres
Publié: (2025)
par: Christ, Bryan R., et autres
Publié: (2025)
Strong and weak alignment of large language models with human values
par: Khamassi, Mehdi, et autres
Publié: (2024)
par: Khamassi, Mehdi, et autres
Publié: (2024)
ProtAlign: Contrastive learning paradigm for Sequence and structure alignment
par: Ranganath, Aditya, et autres
Publié: (2026)
par: Ranganath, Aditya, et autres
Publié: (2026)
Gram: Assessing sabotage propensities via automated alignment auditing
par: Lindner, David, et autres
Publié: (2026)
par: Lindner, David, et autres
Publié: (2026)
Understanding the performance gap between online and offline alignment algorithms
par: Tang, Yunhao, et autres
Publié: (2024)
par: Tang, Yunhao, et autres
Publié: (2024)
Language models align with human judgments on key grammatical constructions
par: Hu, Jennifer, et autres
Publié: (2024)
par: Hu, Jennifer, et autres
Publié: (2024)
LLMs Need Encoders for Semantic IDs Too
par: Chen, Xiangyi, et autres
Publié: (2026)
par: Chen, Xiangyi, et autres
Publié: (2026)
Feature-aligned N-BEATS with Sinkhorn divergence
par: Lee, Joonhun, et autres
Publié: (2023)
par: Lee, Joonhun, et autres
Publié: (2023)
PEAR: Pixel-aligned Expressive humAn mesh Recovery
par: Wu, Jiahao, et autres
Publié: (2026)
par: Wu, Jiahao, et autres
Publié: (2026)
Effective faking of verbal deception detection with target-aligned adversarial attacks
par: Kleinberg, Bennett, et autres
Publié: (2025)
par: Kleinberg, Bennett, et autres
Publié: (2025)
CLUE: Neural Networks Calibration via Learning Uncertainty-Error alignment
par: Mendes, Pedro, et autres
Publié: (2025)
par: Mendes, Pedro, et autres
Publié: (2025)
Diffusion Tree Sampling: Scalable inference-time alignment of diffusion models
par: Jain, Vineet, et autres
Publié: (2025)
par: Jain, Vineet, et autres
Publié: (2025)
Brain-aligning of semantic vectors improves neural decoding of visual stimuli
par: Vafaei, Shirin, et autres
Publié: (2024)
par: Vafaei, Shirin, et autres
Publié: (2024)
Demystifying the unreasonable effectiveness of online alignment methods
par: Kang, Enoch Hyunwook
Publié: (2026)
par: Kang, Enoch Hyunwook
Publié: (2026)
Documents similaires
-
Are aligned neural networks adversarially aligned?
par: Carlini, Nicholas, et autres
Publié: (2023) -
Synthelite: Chemist-aligned and feasibility-aware synthesis planning with LLMs
par: Xuan-Vu, Nguyen, et autres
Publié: (2025) -
Getting aligned on representational alignment
par: Sucholutsky, Ilia, et autres
Publié: (2023) -
Grammar and Gameplay-aligned RL for Game Description Generation with LLMs
par: Tanaka, Tsunehiko, et autres
Publié: (2025) -
Few-shot Personalization of LLMs with Mis-aligned Responses
par: Kim, Jaehyung, et autres
Publié: (2024)