REALM: A Dataset of Real-World LLM Use Cases
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheng, Jingwen, Ghate, Kshitish, Hua, Wenyue, Wang, William Yang, Shen, Hong, Fang, Fei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Who's in Charge? Disempowerment Patterns in Real-World LLM Usage
par: Sharma, Mrinank, et autres
Publié: (2026)
par: Sharma, Mrinank, et autres
Publié: (2026)
Towards Apples to Apples for AI Evaluations: From Real-World Use Cases to Evaluation Scenarios
par: Choong, Yee-Yin, et autres
Publié: (2026)
par: Choong, Yee-Yin, et autres
Publié: (2026)
Beyond One-Way Influence: Bidirectional Opinion Dynamics in Multi-Turn Human-LLM Interactions
par: Jiang, Yuyang, et autres
Publié: (2025)
par: Jiang, Yuyang, et autres
Publié: (2025)
Multi-Agent Comedy Club: Investigating Community Discussion Effects on LLM Humor Generation
par: Hong, Shiwei, et autres
Publié: (2026)
par: Hong, Shiwei, et autres
Publié: (2026)
LLM BiasScope: A Real-Time Bias Analysis Platform for Comparative LLM Evaluation
par: Ghosh, Himel, et autres
Publié: (2026)
par: Ghosh, Himel, et autres
Publié: (2026)
If Eleanor Rigby Had Met ChatGPT: A Study on Loneliness in a Post-LLM World
par: de Wynter, Adrian
Publié: (2024)
par: de Wynter, Adrian
Publié: (2024)
LLM Agents for Education: Advances and Applications
par: Chu, Zhendong, et autres
Publié: (2025)
par: Chu, Zhendong, et autres
Publié: (2025)
DiMA: An LLM-Powered Ride-Hailing Assistant at DiDi
par: Ning, Yansong, et autres
Publié: (2025)
par: Ning, Yansong, et autres
Publié: (2025)
LLM Novice Uplift on Dual-Use, In Silico Biology Tasks
par: Zhang, Chen Bo Calvin, et autres
Publié: (2026)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2026)
Exploring Communication Strategies for Collaborative LLM Agents in Mathematical Problem-Solving
par: Zhang, Liang, et autres
Publié: (2025)
par: Zhang, Liang, et autres
Publié: (2025)
Minion: A Technology Probe to Explore How Users Negotiate Harmful Value Conflicts with AI Companions
par: Fan, Xianzhe, et autres
Publié: (2024)
par: Fan, Xianzhe, et autres
Publié: (2024)
Social Welfare Function Leaderboard: When LLM Agents Allocate Social Welfare
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
Psychometric Comparability of LLM-Based Digital Twins
par: Zhang, Yufei, et autres
Publié: (2025)
par: Zhang, Yufei, et autres
Publié: (2025)
Human-Centred LLM Privacy Audits: Findings and Frictions
par: Staufer, Dimitri, et autres
Publié: (2026)
par: Staufer, Dimitri, et autres
Publié: (2026)
LLM Social Simulations Are a Promising Research Method
par: Anthis, Jacy Reese, et autres
Publié: (2025)
par: Anthis, Jacy Reese, et autres
Publié: (2025)
MythTriage: Scalable Detection of Opioid Use Disorder Myths on a Video-Sharing Platform
par: Jung, Hayoung, et autres
Publié: (2025)
par: Jung, Hayoung, et autres
Publié: (2025)
Toxic HallucinAItions: Perturbing Prompts and Tracing LLM Circuits
par: Shimgekar, Soorya Ram, et autres
Publié: (2026)
par: Shimgekar, Soorya Ram, et autres
Publié: (2026)
Between Rules and Reality: On the Context Sensitivity of LLM Moral Judgment
par: Sauter, Adrian, et autres
Publié: (2026)
par: Sauter, Adrian, et autres
Publié: (2026)
TALES: A Taxonomy and Analysis of Cultural Representations in LLM-generated Stories
par: Bhagat, Kirti, et autres
Publié: (2025)
par: Bhagat, Kirti, et autres
Publié: (2025)
Real or Robotic? Assessing Whether LLMs Accurately Simulate Qualities of Human Responses in Dialogue
par: Ivey, Jonathan, et autres
Publié: (2024)
par: Ivey, Jonathan, et autres
Publié: (2024)
From Prompts to Constructs: A Dual-Validity Framework for LLM Research in Psychology
par: Lin, Zhicheng
Publié: (2025)
par: Lin, Zhicheng
Publié: (2025)
LearnLens: LLM-Enabled Personalised, Curriculum-Grounded Feedback with Educators in the Loop
par: Zhao, Runcong, et autres
Publié: (2025)
par: Zhao, Runcong, et autres
Publié: (2025)
Synthetic Reader Panels: Tournament-Based Ideation with LLM Personas for Autonomous Publishing
par: Zimmerman, Fred
Publié: (2026)
par: Zimmerman, Fred
Publié: (2026)
An Empirical Investigation of Gender Stereotype Representation in Large Language Models: The Italian Case
par: Giachino, Gioele, et autres
Publié: (2025)
par: Giachino, Gioele, et autres
Publié: (2025)
Alignment Drift in Long-Term Human-LLM Interaction: A Mechanism-Oriented Framework
par: Yao, Xintong
Publié: (2026)
par: Yao, Xintong
Publié: (2026)
Comprehensive Study on Sentiment Analysis: From Rule-based to modern LLM based system
par: Gupta, Shailja, et autres
Publié: (2024)
par: Gupta, Shailja, et autres
Publié: (2024)
Enhancing Mathematics Learning for Hard-of-Hearing Students Through Real-Time Palestinian Sign Language Recognition: A New Dataset
par: Khandaqji, Fidaa, et autres
Publié: (2025)
par: Khandaqji, Fidaa, et autres
Publié: (2025)
Bidirectional Human-AI Alignment in Education for Trustworthy Learning Environments
par: Shen, Hua
Publié: (2025)
par: Shen, Hua
Publié: (2025)
Understanding the LLM-ification of CHI: Unpacking the Impact of LLMs at CHI through a Systematic Literature Review
par: Pang, Rock Yuren, et autres
Publié: (2025)
par: Pang, Rock Yuren, et autres
Publié: (2025)
Causal Stories from Sensor Traces: Auditing Epistemic Overreach in LLM-Generated Personal Sensing Explanations
par: Zhu, Shanshan, et autres
Publié: (2026)
par: Zhu, Shanshan, et autres
Publié: (2026)
MentalChat16K: A Benchmark Dataset for Conversational Mental Health Assistance
par: Xu, Jia, et autres
Publié: (2025)
par: Xu, Jia, et autres
Publié: (2025)
From tools to thieves: Measuring and understanding public perceptions of AI through crowdsourced metaphors
par: Cheng, Myra, et autres
Publié: (2025)
par: Cheng, Myra, et autres
Publié: (2025)
Benchmarking LLM Tool-Use in the Wild
par: Yu, Peijie, et autres
Publié: (2026)
par: Yu, Peijie, et autres
Publié: (2026)
Exploring the Human-LLM Synergy in Advancing Theory-driven Qualitative Analysis
par: Meng, Han, et autres
Publié: (2024)
par: Meng, Han, et autres
Publié: (2024)
The Ideation-Execution Gap: Execution Outcomes of LLM-Generated versus Human Research Ideas
par: Si, Chenglei, et autres
Publié: (2025)
par: Si, Chenglei, et autres
Publié: (2025)
STAR: SocioTechnical Approach to Red Teaming Language Models
par: Weidinger, Laura, et autres
Publié: (2024)
par: Weidinger, Laura, et autres
Publié: (2024)
Epistemic Alignment: A Mediating Framework for User-LLM Knowledge Delivery
par: Clark, Nicholas, et autres
Publié: (2025)
par: Clark, Nicholas, et autres
Publié: (2025)
When LLMs Can't Help: Real-World Evaluation of LLMs in Nutrition
par: Li, Karen Jia-Hui, et autres
Publié: (2025)
par: Li, Karen Jia-Hui, et autres
Publié: (2025)
Documenting Deployment with Fabric: A Repository of Real-World AI Governance
par: Jorgensen, Mackenzie, et autres
Publié: (2025)
par: Jorgensen, Mackenzie, et autres
Publié: (2025)
Case Study of GAI for Generating Novel Images for Real-World Embroidery
par: Glazko, Kate, et autres
Publié: (2025)
par: Glazko, Kate, et autres
Publié: (2025)
Documents similaires
-
Who's in Charge? Disempowerment Patterns in Real-World LLM Usage
par: Sharma, Mrinank, et autres
Publié: (2026) -
Towards Apples to Apples for AI Evaluations: From Real-World Use Cases to Evaluation Scenarios
par: Choong, Yee-Yin, et autres
Publié: (2026) -
Beyond One-Way Influence: Bidirectional Opinion Dynamics in Multi-Turn Human-LLM Interactions
par: Jiang, Yuyang, et autres
Publié: (2025) -
Multi-Agent Comedy Club: Investigating Community Discussion Effects on LLM Humor Generation
par: Hong, Shiwei, et autres
Publié: (2026) -
LLM BiasScope: A Real-Time Bias Analysis Platform for Comparative LLM Evaluation
par: Ghosh, Himel, et autres
Publié: (2026)