Automated Quality Assessment for LLM-Based Complex Qualitative Coding: A Confidence-Diversity Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Zhilong, Liu, Yindi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Confidence-Diversity Framework for Calibrating AI Judgement in Accessible Qualitative Coding Tasks
par: Zhao, Zhilong, et autres
Publié: (2025)
par: Zhao, Zhilong, et autres
Publié: (2025)
A Novel Kuhnian Ontology for Epistemic Classification of STM Scholarly Articles
par: Saqr, Khalid M.
Publié: (2020)
par: Saqr, Khalid M.
Publié: (2020)
Perception-Aware Bias Detection for Query Suggestions
par: Haak, Fabian, et autres
Publié: (2026)
par: Haak, Fabian, et autres
Publié: (2026)
Why is it so hard to find a job now? Enter Ghost Jobs
par: Ng, Hunter
Publié: (2024)
par: Ng, Hunter
Publié: (2024)
MEDLEY-BENCH: Scale Buys Evaluation but Not Control in AI Metacognition
par: Abtahi, Farhad, et autres
Publié: (2026)
par: Abtahi, Farhad, et autres
Publié: (2026)
AI Psychometrics: Evaluating the Psychological Reasoning of Large Language Models with Psychometric Validities
par: Li, Yibai, et autres
Publié: (2026)
par: Li, Yibai, et autres
Publié: (2026)
Pairwise Comparison for Bias Identification and Quantification
par: Haak, Fabian, et autres
Publié: (2025)
par: Haak, Fabian, et autres
Publié: (2025)
Claim Automation using Large Language Model
par: Mo, Zhengda, et autres
Publié: (2026)
par: Mo, Zhengda, et autres
Publié: (2026)
The Ethics Engine: A Modular Pipeline for Accessible Psychometric Assessment of Large Language Models
par: Van Clief, Jake, et autres
Publié: (2025)
par: Van Clief, Jake, et autres
Publié: (2025)
LLM-based IR-system for Bank Supervisors
par: Aarab, Ilias
Publié: (2025)
par: Aarab, Ilias
Publié: (2025)
Narrative Fingerprints: Multi-Scale Author Identification via Novelty Curve Dynamics
par: Zimmerman, Fred, et autres
Publié: (2026)
par: Zimmerman, Fred, et autres
Publié: (2026)
Mapping the Web of Science, a large-scale graph and text-based dataset with LLM embeddings
par: Kunt, Tim, et autres
Publié: (2026)
par: Kunt, Tim, et autres
Publié: (2026)
Towards Explainable Automated Data Quality Enhancement without Domain Knowledge
par: Sarr, Djibril
Publié: (2024)
par: Sarr, Djibril
Publié: (2024)
Argument Quality Annotation and Gender Bias Detection in Financial Communication through Large Language Models
par: Alhamzeh, Alaa, et autres
Publié: (2025)
par: Alhamzeh, Alaa, et autres
Publié: (2025)
The Association of Transformer-based Sentiment Analysis with Symptom Distress and Deterioration in Routine Psychotherapy Care
par: Faust, Douglas K., et autres
Publié: (2026)
par: Faust, Douglas K., et autres
Publié: (2026)
A Structural Text-Based Scaling Model for Analyzing Political Discourse
par: Vávra, Jan, et autres
Publié: (2024)
par: Vávra, Jan, et autres
Publié: (2024)
Moral Semantics Survive Machine Translation: Cross-Lingual Evidence from Moral Foundations Corpora
par: Skorski, Maciej
Publié: (2026)
par: Skorski, Maciej
Publié: (2026)
Sentiment and Volatility in Financial Markets: A Review of BERT and GARCH Applications during Geopolitical Crises
par: Mino, Domenica, et autres
Publié: (2025)
par: Mino, Domenica, et autres
Publié: (2025)
Artificial intelligence and downscaling global climate model future projections
par: Benestad, Rasmus E.
Publié: (2026)
par: Benestad, Rasmus E.
Publié: (2026)
Beyond Human Judgment: A Bayesian Evaluation of LLMs' Moral Values Understanding
par: Skorski, Maciej, et autres
Publié: (2025)
par: Skorski, Maciej, et autres
Publié: (2025)
2025 Southeast Asia Eleven Nations Influence Index Report
par: Meng, Wei
Publié: (2025)
par: Meng, Wei
Publié: (2025)
Automating Feedback Analysis in Surgical Training: Detection, Categorization, and Assessment
par: Nasriddinov, Firdavs, et autres
Publié: (2024)
par: Nasriddinov, Firdavs, et autres
Publié: (2024)
ValueBlindBench: Agreement-Gated Stress Testing of LLM-Judged Investment Rationales Before Returns Are Observable
par: Chang, Sidi, et autres
Publié: (2026)
par: Chang, Sidi, et autres
Publié: (2026)
Conformal Prediction Sets for Next-Token Prediction in Large Language Models: Balancing Coverage Guarantees with Set Efficiency
par: Kotla, Yoshith Roy, et autres
Publié: (2025)
par: Kotla, Yoshith Roy, et autres
Publié: (2025)
Computational Social Linguistics for Telugu Cultural Preservation: Novel Algorithms for Chandassu Metrical Pattern Recognition
par: Pavan, Boddu Sri, et autres
Publié: (2025)
par: Pavan, Boddu Sri, et autres
Publié: (2025)
Can Large Language Models Revolutionize Survey Research? Experiments with Disaster Preparedness Responses
par: Wang, Yan, et autres
Publié: (2026)
par: Wang, Yan, et autres
Publié: (2026)
Taskmaster Deconstructed: A Quantitative Look at Tension, Volatility, and Viewer Ratings
par: Silver, David H.
Publié: (2025)
par: Silver, David H.
Publié: (2025)
AETAS: Analysis of Evolving Temporal Affect and Semantics for Legal History
par: Wang, Qizhi
Publié: (2025)
par: Wang, Qizhi
Publié: (2025)
Semantic Search over 9 Million Mathematical Theorems
par: Alexander, Luke, et autres
Publié: (2026)
par: Alexander, Luke, et autres
Publié: (2026)
Modeling Political Discourse with Sentence-BERT and BERTopic
par: Mendonca, Margarida, et autres
Publié: (2025)
par: Mendonca, Margarida, et autres
Publié: (2025)
A Method for Quantifying Human Risk and a Blueprint for LLM Integration
par: Canale, Giuseppe
Publié: (2025)
par: Canale, Giuseppe
Publié: (2025)
Scalable AI-Driven Analytics for User Engagement and Stance Detection on Social Media
par: Seneviratne, Thammitage Piyumi Wathsala, et autres
Publié: (2026)
par: Seneviratne, Thammitage Piyumi Wathsala, et autres
Publié: (2026)
Whisper-LM: Improving ASR Models with Language Models for Low-Resource Languages
par: de Zuazo, Xabier, et autres
Publié: (2025)
par: de Zuazo, Xabier, et autres
Publié: (2025)
An Information-Theoretic Approach for Detecting Edits in AI-Generated Text
par: Kashtan, Idan, et autres
Publié: (2023)
par: Kashtan, Idan, et autres
Publié: (2023)
LLM-supported document separation for printed reviews from zbMATH Open
par: Pluzhnikov, Ivan, et autres
Publié: (2026)
par: Pluzhnikov, Ivan, et autres
Publié: (2026)
Modeling and Visualization Reasoning for Stakeholders in Education and Industry Integration Systems: Research on Structured Synthetic Dialogue Data Generation Based on NIST Standards
par: Meng, Wei
Publié: (2025)
par: Meng, Wei
Publié: (2025)
Supercharging Federated Intelligence Retrieval
par: Stripelis, Dimitris, et autres
Publié: (2026)
par: Stripelis, Dimitris, et autres
Publié: (2026)
The Syntactic Acceptability Dataset (Preview): A Resource for Machine Learning and Linguistic Analysis of English
par: Juzek, Tom S
Publié: (2025)
par: Juzek, Tom S
Publié: (2025)
Tokens with Meaning: A Hybrid Tokenization Approach for Turkish
par: Bayram, M. Ali, et autres
Publié: (2025)
par: Bayram, M. Ali, et autres
Publié: (2025)
Tokenization Standards for Linguistic Integrity: Turkish as a Benchmark
par: Bayram, M. Ali, et autres
Publié: (2025)
par: Bayram, M. Ali, et autres
Publié: (2025)
Documents similaires
-
A Confidence-Diversity Framework for Calibrating AI Judgement in Accessible Qualitative Coding Tasks
par: Zhao, Zhilong, et autres
Publié: (2025) -
A Novel Kuhnian Ontology for Epistemic Classification of STM Scholarly Articles
par: Saqr, Khalid M.
Publié: (2020) -
Perception-Aware Bias Detection for Query Suggestions
par: Haak, Fabian, et autres
Publié: (2026) -
Why is it so hard to find a job now? Enter Ghost Jobs
par: Ng, Hunter
Publié: (2024) -
MEDLEY-BENCH: Scale Buys Evaluation but Not Control in AI Metacognition
par: Abtahi, Farhad, et autres
Publié: (2026)