Enregistré dans:
| Auteurs principaux: | Schelb, Julian, Borin, Orr, Garcia, David, Spitz, Andreas |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.10229 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Assessing In-context Learning and Fine-tuning for Topic Classification of German Web Data
par: Schelb, Julian, et autres
Publié: (2024)
par: Schelb, Julian, et autres
Publié: (2024)
Loci Similes: A Benchmark for Extracting Intertextualities in Latin Literature
par: Schelb, Julian, et autres
Publié: (2026)
par: Schelb, Julian, et autres
Publié: (2026)
Only a Little to the Left: A Theory-grounded Measure of Political Bias in Large Language Models
par: Faulborn, Mats, et autres
Publié: (2025)
par: Faulborn, Mats, et autres
Publié: (2025)
PsychoLex: Unveiling the Psychological Mind of Large Language Models
par: Abbasi, Mohammad Amin, et autres
Publié: (2024)
par: Abbasi, Mohammad Amin, et autres
Publié: (2024)
Quantifying the Risks of Tool-assisted Rephrasing to Linguistic Diversity
par: Wang, Mengying, et autres
Publié: (2024)
par: Wang, Mengying, et autres
Publié: (2024)
Do Psychometric Tests Work for Large Language Models? Evaluation of Tests on Sexism, Racism, and Morality
par: Jung, Jana, et autres
Publié: (2025)
par: Jung, Jana, et autres
Publié: (2025)
Generative Psycho-Lexical Approach for Constructing Value Systems in Large Language Models
par: Ye, Haoran, et autres
Publié: (2025)
par: Ye, Haoran, et autres
Publié: (2025)
Tag-Pag: A Dedicated Tool for Systematic Web Page Annotations
par: Pogrebnjak, Anton, et autres
Publié: (2025)
par: Pogrebnjak, Anton, et autres
Publié: (2025)
Evaluating Large Language Models with Psychometrics
par: Li, Yuan, et autres
Publié: (2024)
par: Li, Yuan, et autres
Publié: (2024)
Preference Learning Unlocks LLMs' Psycho-Counseling Skills
par: Zhang, Mian, et autres
Publié: (2025)
par: Zhang, Mian, et autres
Publié: (2025)
Psychometric Predictive Power of Large Language Models
par: Kuribayashi, Tatsuki, et autres
Publié: (2023)
par: Kuribayashi, Tatsuki, et autres
Publié: (2023)
Who is ChatGPT? Benchmarking LLMs' Psychological Portrayal Using PsychoBench
par: Huang, Jen-tse, et autres
Publié: (2023)
par: Huang, Jen-tse, et autres
Publié: (2023)
Statistical Hypothesis Testing for Auditing Robustness in Language Models
par: Rauba, Paulius, et autres
Publié: (2025)
par: Rauba, Paulius, et autres
Publié: (2025)
Psycho-linguistic Experiment on Universal Semantic Components of Verbal Humor: System Description and Annotation
par: Mikhalkova, Elena, et autres
Publié: (2024)
par: Mikhalkova, Elena, et autres
Publié: (2024)
Do LLMs Give Psychometrically Plausible Responses in Educational Assessments?
par: Säuberli, Andreas, et autres
Publié: (2025)
par: Säuberli, Andreas, et autres
Publié: (2025)
Psychometric Personality Shaping Modulates Capabilities and Safety in Language Models
par: Fitz, Stephen, et autres
Publié: (2025)
par: Fitz, Stephen, et autres
Publié: (2025)
Unified Enhancement of the Generalization and Robustness of Language Models via Bi-Stage Optimization
par: Sun, Yudao, et autres
Publié: (2025)
par: Sun, Yudao, et autres
Publié: (2025)
Test-Time Fairness and Robustness in Large Language Models
par: Cotta, Leonardo, et autres
Publié: (2024)
par: Cotta, Leonardo, et autres
Publié: (2024)
Psychometric Alignment: Capturing Human Knowledge Distributions via Language Models
par: He-Yueya, Joy, et autres
Publié: (2024)
par: He-Yueya, Joy, et autres
Publié: (2024)
Automatic Generation and Evaluation of Reading Comprehension Test Items with Large Language Models
par: Säuberli, Andreas, et autres
Publié: (2024)
par: Säuberli, Andreas, et autres
Publié: (2024)
Adaptive Testing for LLM Evaluation: A Psychometric Alternative to Static Benchmarks
par: Li, Peiyu, et autres
Publié: (2025)
par: Li, Peiyu, et autres
Publié: (2025)
United States Politicians' Tone Became More Negative with 2016 Primary Campaigns
par: Külz, Jonathan, et autres
Publié: (2022)
par: Külz, Jonathan, et autres
Publié: (2022)
Measuring Human and AI Values Based on Generative Psychometrics with Large Language Models
par: Ye, Haoran, et autres
Publié: (2024)
par: Ye, Haoran, et autres
Publié: (2024)
Large Language Model Psychometrics: A Systematic Review of Evaluation, Validation, and Enhancement
par: Ye, Haoran, et autres
Publié: (2025)
par: Ye, Haoran, et autres
Publié: (2025)
The Impact of Image Resolution on Biomedical Multimodal Large Language Models
par: Chen, Liangyu, et autres
Publié: (2025)
par: Chen, Liangyu, et autres
Publié: (2025)
The Expressions of Depression and Anxiety in Chinese Psycho-counseling: Usage of First-person Singular Pronoun and Negative Emotional Words
par: Ma, Lizhi, et autres
Publié: (2025)
par: Ma, Lizhi, et autres
Publié: (2025)
Evaluating Implicit Bias in Large Language Models by Attacking From a Psychometric Perspective
par: Wen, Yuchen, et autres
Publié: (2024)
par: Wen, Yuchen, et autres
Publié: (2024)
Defining and Evaluating Visual Language Models' Basic Spatial Abilities: A Perspective from Psychometrics
par: Xu, Wenrui, et autres
Publié: (2025)
par: Xu, Wenrui, et autres
Publié: (2025)
Political Alignment in Large Language Models: A Multidimensional Audit of Psychometric Identity and Behavioral Bias
par: Sakhawat, Adib, et autres
Publié: (2026)
par: Sakhawat, Adib, et autres
Publié: (2026)
VideoAgent: Long-form Video Understanding with Large Language Model as Agent
par: Wang, Xiaohan, et autres
Publié: (2024)
par: Wang, Xiaohan, et autres
Publié: (2024)
Camouflage is all you need: Evaluating and Enhancing Language Model Robustness Against Camouflage Adversarial Attacks
par: Huertas-García, Álvaro, et autres
Publié: (2024)
par: Huertas-García, Álvaro, et autres
Publié: (2024)
A Novel Psychometrics-Based Approach to Developing Professional Competency Benchmark for Large Language Models
par: Kardanova, Elena, et autres
Publié: (2024)
par: Kardanova, Elena, et autres
Publié: (2024)
Mixed-R1: Unified Reward Perspective For Reasoning Capability in Multimodal Large Language Models
par: Xu, Shilin, et autres
Publié: (2025)
par: Xu, Shilin, et autres
Publié: (2025)
Synchronic and Diachronic Aspects of Kanashi
par: Saxena, Anju, et autres
Publié: (2022)
par: Saxena, Anju, et autres
Publié: (2022)
You don't need a personality test to know these models are unreliable: Assessing the Reliability of Large Language Models on Psychometric Instruments
par: Shu, Bangzhao, et autres
Publié: (2023)
par: Shu, Bangzhao, et autres
Publié: (2023)
Do GPT Language Models Suffer From Split Personality Disorder? The Advent Of Substrate-Free Psychometrics
par: Romero, Peter, et autres
Publié: (2024)
par: Romero, Peter, et autres
Publié: (2024)
Search-R3: Unifying Reasoning and Embedding in Large Language Models
par: Gui, Yuntao, et autres
Publié: (2025)
par: Gui, Yuntao, et autres
Publié: (2025)
PsychoGAT: A Novel Psychological Measurement Paradigm through Interactive Fiction Games with LLM Agents
par: Yang, Qisen, et autres
Publié: (2024)
par: Yang, Qisen, et autres
Publié: (2024)
On Non-interactive Evaluation of Animal Communication Translators
par: Paradise, Orr, et autres
Publié: (2025)
par: Paradise, Orr, et autres
Publié: (2025)
Langformers: Unified NLP Pipelines for Language Models
par: Lamsal, Rabindra, et autres
Publié: (2025)
par: Lamsal, Rabindra, et autres
Publié: (2025)
Documents similaires
-
Assessing In-context Learning and Fine-tuning for Topic Classification of German Web Data
par: Schelb, Julian, et autres
Publié: (2024) -
Loci Similes: A Benchmark for Extracting Intertextualities in Latin Literature
par: Schelb, Julian, et autres
Publié: (2026) -
Only a Little to the Left: A Theory-grounded Measure of Political Bias in Large Language Models
par: Faulborn, Mats, et autres
Publié: (2025) -
PsychoLex: Unveiling the Psychological Mind of Large Language Models
par: Abbasi, Mohammad Amin, et autres
Publié: (2024) -
Quantifying the Risks of Tool-assisted Rephrasing to Linguistic Diversity
par: Wang, Mengying, et autres
Publié: (2024)