Measuring Teaching with LLMs
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Hardy, Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ELEPHANT: Measuring and understanding social sycophancy in LLMs
par: Cheng, Myra, et autres
Publié: (2025)
par: Cheng, Myra, et autres
Publié: (2025)
Towards Measuring and Modeling "Culture" in LLMs: A Survey
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024)
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024)
HumT DumT: Measuring and controlling human-like language in LLMs
par: Cheng, Myra, et autres
Publié: (2025)
par: Cheng, Myra, et autres
Publié: (2025)
AdAEM: An Adaptively and Automated Extensible Measurement of LLMs' Value Difference
par: Yao, Jing, et autres
Publié: (2025)
par: Yao, Jing, et autres
Publié: (2025)
Knowledge without Wisdom: Measuring Misalignment between LLMs and Intended Impact
par: Hardy, Michael, et autres
Publié: (2026)
par: Hardy, Michael, et autres
Publié: (2026)
Ask LLMs Directly, "What shapes your bias?": Measuring Social Bias in Large Language Models
par: Shin, Jisu, et autres
Publié: (2024)
par: Shin, Jisu, et autres
Publié: (2024)
Are LLMs (Really) Ideological? An IRT-based Analysis and Alignment Tool for Perceived Socio-Economic Bias in LLMs
par: Wachter, Jasmin, et autres
Publié: (2025)
par: Wachter, Jasmin, et autres
Publié: (2025)
neuralFOMO: Can LLMs Handle Being Second Best? Measuring Envy-Like Preferences in Multi-Agent Settings
par: Ramamoorthy, Arnav, et autres
Publié: (2025)
par: Ramamoorthy, Arnav, et autres
Publié: (2025)
Assessing the Performance of Human-Capable LLMs -- Are LLMs Coming for Your Job?
par: Mavi, John, et autres
Publié: (2024)
par: Mavi, John, et autres
Publié: (2024)
Teaching at Scale: Leveraging AI to Evaluate and Elevate Engineering Education
par: Chamberland, Jean-Francois, et autres
Publié: (2025)
par: Chamberland, Jean-Francois, et autres
Publié: (2025)
Application of GPT Language Models for Innovation in Activities in University Teaching
par: de Buenaga, Manuel, et autres
Publié: (2024)
par: de Buenaga, Manuel, et autres
Publié: (2024)
The simulation of judgment in LLMs
par: Loru, Edoardo, et autres
Publié: (2025)
par: Loru, Edoardo, et autres
Publié: (2025)
The Political Preferences of LLMs
par: Rozado, David
Publié: (2024)
par: Rozado, David
Publié: (2024)
Why are all LLMs Obsessed with Japanese Culture? On the Hidden Cultural and Regional Biases of LLMs
par: de Landa, Joseba Fernandez, et autres
Publié: (2026)
par: de Landa, Joseba Fernandez, et autres
Publié: (2026)
Moral Mazes in the Era of LLMs
par: Nguyen, Dang, et autres
Publié: (2026)
par: Nguyen, Dang, et autres
Publié: (2026)
Comparative analysis of privacy-preserving open-source LLMs regarding extraction of diagnostic information from clinical CMR imaging reports
par: Amirrajab, Sina, et autres
Publié: (2025)
par: Amirrajab, Sina, et autres
Publié: (2025)
A Platform for Generating Educational Activities to Teach English as a Second Language
par: Rosá, Aiala, et autres
Publié: (2025)
par: Rosá, Aiala, et autres
Publié: (2025)
Interpretability Framework for LLMs in Undergraduate Calculus
par: Dakshit, Sagnik, et autres
Publié: (2025)
par: Dakshit, Sagnik, et autres
Publié: (2025)
Teaching Language Models How to Code Like Learners: Conversational Serialization for Student Simulation
par: Koutcheme, Charles, et autres
Publié: (2026)
par: Koutcheme, Charles, et autres
Publié: (2026)
MEDEQUALQA: Evaluating Biases in LLMs with Counterfactual Reasoning
par: Ghosh, Rajarshi, et autres
Publié: (2025)
par: Ghosh, Rajarshi, et autres
Publié: (2025)
On the Credibility of Evaluating LLMs using Survey Questions
par: Libovický, Jindřich
Publié: (2026)
par: Libovický, Jindřich
Publié: (2026)
Verbalizing LLMs' assumptions to explain and control sycophancy
par: Cheng, Myra, et autres
Publié: (2026)
par: Cheng, Myra, et autres
Publié: (2026)
Misaligned by Reward: Socially Undesirable Preferences in LLMs
par: Ghazaryan, Gayane, et autres
Publié: (2026)
par: Ghazaryan, Gayane, et autres
Publié: (2026)
Prompt-Based Cost-Effective Evaluation and Operation of ChatGPT as a Computer Programming Teaching Assistant
par: Ballestero-Ribó, Marc, et autres
Publié: (2025)
par: Ballestero-Ribó, Marc, et autres
Publié: (2025)
EtiCor++: Towards Understanding Etiquettical Bias in LLMs
par: Dwivedi, Ashutosh, et autres
Publié: (2025)
par: Dwivedi, Ashutosh, et autres
Publié: (2025)
EulerESG: Automating ESG Disclosure Analysis with LLMs
par: Ding, Yi, et autres
Publié: (2025)
par: Ding, Yi, et autres
Publié: (2025)
Large Language Models (LLMs) as Agents for Augmented Democracy
par: Gudiño-Rosero, Jairo, et autres
Publié: (2024)
par: Gudiño-Rosero, Jairo, et autres
Publié: (2024)
Automated Assessment of Students' Code Comprehension using LLMs
par: Oli, Priti, et autres
Publié: (2023)
par: Oli, Priti, et autres
Publié: (2023)
Evaluating the Capabilities of LLMs for Supporting Anticipatory Impact Assessment
par: Allaham, Mowafak, et autres
Publié: (2024)
par: Allaham, Mowafak, et autres
Publié: (2024)
Explore the Potential of LLMs in Misinformation Detection: An Empirical Study
par: Chen, Mengyang, et autres
Publié: (2023)
par: Chen, Mengyang, et autres
Publié: (2023)
Perceived Political Bias in LLMs Reduces Persuasive Abilities
par: DiGiuseppe, Matthew, et autres
Publié: (2026)
par: DiGiuseppe, Matthew, et autres
Publié: (2026)
Evaluating Cultural Awareness of LLMs for Yoruba, Malayalam, and English
par: Dawson, Fiifi, et autres
Publié: (2024)
par: Dawson, Fiifi, et autres
Publié: (2024)
Lived Experience Not Found: LLMs Struggle to Align with Experts on Addressing Adverse Drug Reactions from Psychiatric Medication Use
par: Chandra, Mohit, et autres
Publié: (2024)
par: Chandra, Mohit, et autres
Publié: (2024)
Fluent but Foreign: Even Regional LLMs Lack Cultural Alignment
par: Agarwal, Dhruv, et autres
Publié: (2025)
par: Agarwal, Dhruv, et autres
Publié: (2025)
HugAgent: Benchmarking LLMs for Simulation of Individualized Human Reasoning
par: Li, Chance Jiajie, et autres
Publié: (2025)
par: Li, Chance Jiajie, et autres
Publié: (2025)
What Is The Political Content in LLMs' Pre- and Post-Training Data?
par: Ceron, Tanise, et autres
Publié: (2025)
par: Ceron, Tanise, et autres
Publié: (2025)
Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs
par: Wei, Kangda, et autres
Publié: (2025)
par: Wei, Kangda, et autres
Publié: (2025)
The Homogenization Problem in LLMs: Towards Meaningful Diversity in AI Safety
par: Rios-Sialer, Ian
Publié: (2026)
par: Rios-Sialer, Ian
Publié: (2026)
Empathy and the Right to Be an Exception: What LLMs Can and Cannot Do
par: Kidder, William, et autres
Publié: (2024)
par: Kidder, William, et autres
Publié: (2024)
Widespread Gender and Pronoun Bias in Moral Judgments Across LLMs
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
Documents similaires
-
ELEPHANT: Measuring and understanding social sycophancy in LLMs
par: Cheng, Myra, et autres
Publié: (2025) -
Towards Measuring and Modeling "Culture" in LLMs: A Survey
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024) -
HumT DumT: Measuring and controlling human-like language in LLMs
par: Cheng, Myra, et autres
Publié: (2025) -
AdAEM: An Adaptively and Automated Extensible Measurement of LLMs' Value Difference
par: Yao, Jing, et autres
Publié: (2025) -
Knowledge without Wisdom: Measuring Misalignment between LLMs and Intended Impact
par: Hardy, Michael, et autres
Publié: (2026)