MacBehaviour: An R package for behavioural experimentation on large language models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Duan, Xufeng, Li, Shixuan, Cai1, Zhenguang G. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Large Language Models for Automated Literature Review: An Evaluation of Reference Generation, Abstract Writing, and Review Composition
par: Tang, Xuemei, et autres
Publié: (2024)
par: Tang, Xuemei, et autres
Publié: (2024)
SCALPEL: Selective Capability Ablation via Low-rank Parameter Editing for Large Language Model Interpretability Analysis
par: Fu, Zihao, et autres
Publié: (2026)
par: Fu, Zihao, et autres
Publié: (2026)
Distinct social-linguistic processing between humans and large audio-language models: Evidence from model-brain alignment
par: Wu, Hanlin, et autres
Publié: (2025)
par: Wu, Hanlin, et autres
Publié: (2025)
How Syntax Specialization Emerges in Language Models
par: Duan, Xufeng, et autres
Publié: (2025)
par: Duan, Xufeng, et autres
Publié: (2025)
Do large language models resemble humans in language use?
par: Cai, Zhenguang G., et autres
Publié: (2023)
par: Cai, Zhenguang G., et autres
Publié: (2023)
A funny companion: Distinct neural responses to perceived AI- versus human-generated humor
par: Rao, Xiaohui, et autres
Publié: (2025)
par: Rao, Xiaohui, et autres
Publié: (2025)
Dissociating language and thought in large language models
par: Mahowald, Kyle, et autres
Publié: (2023)
par: Mahowald, Kyle, et autres
Publié: (2023)
Grammaticality Representation in ChatGPT as Compared to Linguists and Laypeople
par: Qiu, Zhuang, et autres
Publié: (2024)
par: Qiu, Zhuang, et autres
Publié: (2024)
Do Large Language Models Plan Answer Positions? Position Bias in Multiple-Choice Question Generation
par: Tang, Xuemei, et autres
Publié: (2026)
par: Tang, Xuemei, et autres
Publié: (2026)
On the attribution of confidence to large language models
par: Keeling, Geoff, et autres
Publié: (2024)
par: Keeling, Geoff, et autres
Publié: (2024)
Streamlining evidence based clinical recommendations with large language models
par: Li, Dubai, et autres
Publié: (2025)
par: Li, Dubai, et autres
Publié: (2025)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
par: Lan, Wuyang, et autres
Publié: (2025)
par: Lan, Wuyang, et autres
Publié: (2025)
Multi-round jailbreak attack on large language models
par: Zhou, Yihua, et autres
Publié: (2024)
par: Zhou, Yihua, et autres
Publié: (2024)
The 20 questions game to distinguish large language models
par: Richardeau, Gurvan, et autres
Publié: (2024)
par: Richardeau, Gurvan, et autres
Publié: (2024)
Quantifying non deterministic drift in large language models
par: Nicholson, Claire
Publié: (2026)
par: Nicholson, Claire
Publié: (2026)
Can large language models build causal graphs?
par: Long, Stephanie, et autres
Publié: (2023)
par: Long, Stephanie, et autres
Publié: (2023)
Response: Emergent analogical reasoning in large language models
par: Hodel, Damian, et autres
Publié: (2023)
par: Hodel, Damian, et autres
Publié: (2023)
Representation in large language models
par: Yetman, Cameron
Publié: (2025)
par: Yetman, Cameron
Publié: (2025)
Failure of contextual invariance in large language models
par: Kumar, Sagar, et autres
Publié: (2026)
par: Kumar, Sagar, et autres
Publié: (2026)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
par: Diaz-Garcia, Jose A., et autres
Publié: (2025)
par: Diaz-Garcia, Jose A., et autres
Publié: (2025)
Strong and weak alignment of large language models with human values
par: Khamassi, Mehdi, et autres
Publié: (2024)
par: Khamassi, Mehdi, et autres
Publié: (2024)
Correcting misinformation on social media with a large language model
par: Zhou, Xinyi, et autres
Publié: (2024)
par: Zhou, Xinyi, et autres
Publié: (2024)
A review on the use of large language models as virtual tutors
par: García-Méndez, Silvia, et autres
Publié: (2024)
par: García-Méndez, Silvia, et autres
Publié: (2024)
Evaluating large language models in medical applications: a survey
par: Chen, Xiaolan, et autres
Publié: (2024)
par: Chen, Xiaolan, et autres
Publié: (2024)
MathDivide: Improved mathematical reasoning by large language models
par: Srivastava, Saksham Sahai, et autres
Publié: (2024)
par: Srivastava, Saksham Sahai, et autres
Publié: (2024)
Re-evaluating Theory of Mind evaluation in large language models
par: Hu, Jennifer, et autres
Publié: (2025)
par: Hu, Jennifer, et autres
Publié: (2025)
Disentangling generalization and memorization in large language models using chess
par: Pleiss, Leonard S., et autres
Publié: (2026)
par: Pleiss, Leonard S., et autres
Publié: (2026)
AI-AI Bias: large language models favor communications generated by large language models
par: Laurito, Walter, et autres
Publié: (2024)
par: Laurito, Walter, et autres
Publié: (2024)
Superhuman performance of a large language model on the reasoning tasks of a physician
par: Brodeur, Peter G., et autres
Publié: (2024)
par: Brodeur, Peter G., et autres
Publié: (2024)
Alignment faking in large language models
par: Greenblatt, Ryan, et autres
Publié: (2024)
par: Greenblatt, Ryan, et autres
Publié: (2024)
Optimizing watermarks for large language models
par: Wouters, Bram
Publié: (2023)
par: Wouters, Bram
Publié: (2023)
CAST: Compositional Analysis via Spectral Tracking for Understanding Transformer Layer Functions
par: Fu, Zihao, et autres
Publié: (2025)
par: Fu, Zihao, et autres
Publié: (2025)
Uncovering inequalities in new knowledge learning by large language models across different languages
par: Wang, Chenglong, et autres
Publié: (2025)
par: Wang, Chenglong, et autres
Publié: (2025)
Entry-level guide to the use of large language models for medical research
par: Jin, Qiao, et autres
Publié: (2024)
par: Jin, Qiao, et autres
Publié: (2024)
Facilitating large language model Russian adaptation with Learned Embedding Propagation
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
Hyacinth6B: A large language model for Traditional Chinese
par: Song, Chih-Wei, et autres
Publié: (2024)
par: Song, Chih-Wei, et autres
Publié: (2024)
Can large language models understand uncommon meanings of common words?
par: Wu, Jinyang, et autres
Publié: (2024)
par: Wu, Jinyang, et autres
Publié: (2024)
Generating bilingual example sentences with large language models as lexicography assistants
par: Merx, Raphael, et autres
Publié: (2024)
par: Merx, Raphael, et autres
Publié: (2024)
Leveraging large language models for efficient representation learning for entity resolution
par: Xu, Xiaowei, et autres
Publié: (2024)
par: Xu, Xiaowei, et autres
Publié: (2024)
Are they human? Detecting large language models by probing human memory constraints
par: Schug, Simon, et autres
Publié: (2026)
par: Schug, Simon, et autres
Publié: (2026)
Documents similaires
-
Large Language Models for Automated Literature Review: An Evaluation of Reference Generation, Abstract Writing, and Review Composition
par: Tang, Xuemei, et autres
Publié: (2024) -
SCALPEL: Selective Capability Ablation via Low-rank Parameter Editing for Large Language Model Interpretability Analysis
par: Fu, Zihao, et autres
Publié: (2026) -
Distinct social-linguistic processing between humans and large audio-language models: Evidence from model-brain alignment
par: Wu, Hanlin, et autres
Publié: (2025) -
How Syntax Specialization Emerges in Language Models
par: Duan, Xufeng, et autres
Publié: (2025) -
Do large language models resemble humans in language use?
par: Cai, Zhenguang G., et autres
Publié: (2023)