Generalizable Error Modeling for Human Data Annotation: Evidence From an Industry-Scale Search Data Annotation Program
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Peters, Heinrich, Hashemi, Alireza, Rae, James |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Model-in-the-Loop (MILO): Accelerating Multimodal AI Data Annotation with LLMs
par: Wang, Yifan, et autres
Publié: (2024)
par: Wang, Yifan, et autres
Publié: (2024)
If in a Crowdsourced Data Annotation Pipeline, a GPT-4
par: He, Zeyu, et autres
Publié: (2024)
par: He, Zeyu, et autres
Publié: (2024)
Evaluating Interactive 2D Visualization as a Sample Selection Strategy for Biomedical Time-Series Data Annotation
par: Vaaras, Einari, et autres
Publié: (2026)
par: Vaaras, Einari, et autres
Publié: (2026)
ScaleViz: Scaling Visualization Recommendation Models on Large Data
par: Ahmad, Ghazi Shazan, et autres
Publié: (2024)
par: Ahmad, Ghazi Shazan, et autres
Publié: (2024)
Transferring Annotator- and Instance-dependent Transition Matrix for Learning from Crowds
par: Li, Shikun, et autres
Publié: (2023)
par: Li, Shikun, et autres
Publié: (2023)
The Human-Data-Model Interaction Canvas for Visual Analytics
par: Bernard, Jürgen
Publié: (2025)
par: Bernard, Jürgen
Publié: (2025)
Explainability for Machine Learning Models: From Data Adaptability to User Perception
par: Delaunay, julien
Publié: (2024)
par: Delaunay, julien
Publié: (2024)
CodeAlignBench: Assessing Code Generation Models on Developer-Preferred Code Adjustments
par: Mehralian, Forough, et autres
Publié: (2025)
par: Mehralian, Forough, et autres
Publié: (2025)
Leveraging Large Language Models (LLMs) to Support Collaborative Human-AI Online Risk Data Annotation
par: Park, Jinkyung, et autres
Publié: (2024)
par: Park, Jinkyung, et autres
Publié: (2024)
Predictive AI Can Support Human Learning while Preserving Error Diversity
par: He, Vivianna Fang, et autres
Publié: (2025)
par: He, Vivianna Fang, et autres
Publié: (2025)
Decoding Human Emotions: Analyzing Multi-Channel EEG Data using LSTM Networks
par: Sateesh, Shyam K, et autres
Publié: (2024)
par: Sateesh, Shyam K, et autres
Publié: (2024)
Towards User-Focused Research in Training Data Attribution for Human-Centered Explainable AI
par: Nguyen, Elisa, et autres
Publié: (2024)
par: Nguyen, Elisa, et autres
Publié: (2024)
Text-to-SQL Domain Adaptation via Human-LLM Collaborative Data Annotation
par: Tian, Yuan, et autres
Publié: (2025)
par: Tian, Yuan, et autres
Publié: (2025)
Efficient Human-in-the-Loop Active Learning: A Novel Framework for Data Labeling in AI Systems
par: Huang, Yiran, et autres
Publié: (2024)
par: Huang, Yiran, et autres
Publié: (2024)
Demo: Statistically Significant Results On Biases and Errors of LLMs Do Not Guarantee Generalizable Results
par: Liu, Jonathan, et autres
Publié: (2025)
par: Liu, Jonathan, et autres
Publié: (2025)
Wrapper Boxes: Faithful Attribution of Model Predictions to Training Data
par: Su, Yiheng, et autres
Publié: (2023)
par: Su, Yiheng, et autres
Publié: (2023)
Improving Dialogue Agents by Decomposing One Global Explicit Annotation with Local Implicit Multimodal Feedback
par: Lee, Dong Won, et autres
Publié: (2024)
par: Lee, Dong Won, et autres
Publié: (2024)
Fully Data-driven but Interpretable Human Behavioural Modelling with Differentiable Discrete Choice Model
par: Makinoshima, Fumiyasu, et autres
Publié: (2024)
par: Makinoshima, Fumiyasu, et autres
Publié: (2024)
Learning to Pay Attention: Unsupervised Modeling of Attentive and Inattentive Respondents in Survey Data
par: Triantafyllopoulos, Ilias, et autres
Publié: (2026)
par: Triantafyllopoulos, Ilias, et autres
Publié: (2026)
Reinforcement Learning Driven Generalizable Feature Representation for Cross-User Activity Recognition
par: Ye, Xiaozhou, et autres
Publié: (2025)
par: Ye, Xiaozhou, et autres
Publié: (2025)
Large Language Models Can Infer Personality from Free-Form User Interactions
par: Peters, Heinrich, et autres
Publié: (2024)
par: Peters, Heinrich, et autres
Publié: (2024)
Scaling Wearable Foundation Models
par: Narayanswamy, Girish, et autres
Publié: (2024)
par: Narayanswamy, Girish, et autres
Publié: (2024)
TimeSRL: Generalizable Time-Series Behavioral Modeling via Semantic RL-Tuned LLMs -- A Case Study in Mental Health
par: Fan, Yuang, et autres
Publié: (2026)
par: Fan, Yuang, et autres
Publié: (2026)
From Accuracy to Readiness: Metrics and Benchmarks for Human-AI Decision-Making
par: Lee, Min Hun
Publié: (2026)
par: Lee, Min Hun
Publié: (2026)
Learning a Canonical Basis of Human Preferences from Binary Ratings
par: Vodrahalli, Kailas, et autres
Publié: (2025)
par: Vodrahalli, Kailas, et autres
Publié: (2025)
Explanation through Reward Model Reconciliation using POMDP Tree Search
par: Kraske, Benjamin D., et autres
Publié: (2023)
par: Kraske, Benjamin D., et autres
Publié: (2023)
A Toolkit for Virtual Reality Data Collection
par: Rolff, Tim, et autres
Publié: (2024)
par: Rolff, Tim, et autres
Publié: (2024)
Influencing Humans to Conform to Preference Models for RLHF
par: Hatgis-Kessell, Stephane, et autres
Publié: (2025)
par: Hatgis-Kessell, Stephane, et autres
Publié: (2025)
SpiroActive: Active Learning for Efficient Data Acquisition for Spirometry
par: Jain, Ankita Kumari, et autres
Publié: (2024)
par: Jain, Ankita Kumari, et autres
Publié: (2024)
Interactive Program Synthesis for Modeling Collaborative Physical Activities from Narrated Demonstrations
par: Kim, Edward, et autres
Publié: (2025)
par: Kim, Edward, et autres
Publié: (2025)
Catch Me if You Search: When Contextual Web Search Results Affect the Detection of Hallucinations
par: Nahar, Mahjabin, et autres
Publié: (2025)
par: Nahar, Mahjabin, et autres
Publié: (2025)
Transparent Adaptive Learning via Data-Centric Multimodal Explainable AI
par: Mosleh, Maryam, et autres
Publié: (2025)
par: Mosleh, Maryam, et autres
Publié: (2025)
A Sustainable AI Economy Needs Data Deals That Work for Generators
par: Jia, Ruoxi, et autres
Publié: (2026)
par: Jia, Ruoxi, et autres
Publié: (2026)
NeuroRVQ: Multi-Scale Biosignal Tokenization for Generative Foundation Models
par: Barmpas, Konstantinos, et autres
Publié: (2025)
par: Barmpas, Konstantinos, et autres
Publié: (2025)
Evaluation of Human-Understandability of Global Model Explanations using Decision Tree
par: Sivaprasad, Adarsa, et autres
Publié: (2023)
par: Sivaprasad, Adarsa, et autres
Publié: (2023)
The Model Mastery Lifecycle: A Framework for Designing Human-AI Interaction
par: Chignell, Mark, et autres
Publié: (2024)
par: Chignell, Mark, et autres
Publié: (2024)
Optimizing Data Delivery: Insights from User Preferences on Visuals, Tables, and Text
par: Luera, Reuben, et autres
Publié: (2024)
par: Luera, Reuben, et autres
Publié: (2024)
Large Language Models Can Infer Psychological Dispositions of Social Media Users
par: Peters, Heinrich, et autres
Publié: (2023)
par: Peters, Heinrich, et autres
Publié: (2023)
RuleEdit: Failure-Guided Human-AI Model Editing with Prospective Impact Preview
par: Lee, Min Hun, et autres
Publié: (2026)
par: Lee, Min Hun, et autres
Publié: (2026)
Chain-of-Modality: Learning Manipulation Programs from Multimodal Human Videos with Vision-Language-Models
par: Wang, Chen, et autres
Publié: (2025)
par: Wang, Chen, et autres
Publié: (2025)
Documents similaires
-
Model-in-the-Loop (MILO): Accelerating Multimodal AI Data Annotation with LLMs
par: Wang, Yifan, et autres
Publié: (2024) -
If in a Crowdsourced Data Annotation Pipeline, a GPT-4
par: He, Zeyu, et autres
Publié: (2024) -
Evaluating Interactive 2D Visualization as a Sample Selection Strategy for Biomedical Time-Series Data Annotation
par: Vaaras, Einari, et autres
Publié: (2026) -
ScaleViz: Scaling Visualization Recommendation Models on Large Data
par: Ahmad, Ghazi Shazan, et autres
Publié: (2024) -
Transferring Annotator- and Instance-dependent Transition Matrix for Learning from Crowds
par: Li, Shikun, et autres
Publié: (2023)