Hands-On Tutorial: Labeling with LLM and Human-in-the-Loop
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Artemova, Ekaterina, Tsvigun, Akim, Schlechtweg, Dominik, Fedorova, Natalia, Chernyshev, Konstantin, Tilga, Sergei, Obmoroshev, Boris |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Voices of Freelance Professional Writers on AI: Limitations, Expectations, and Fears
par: Ivanova, Anastasiia, et autres
Publié: (2025)
par: Ivanova, Anastasiia, et autres
Publié: (2025)
Tendem: A Hybrid AI+Human Platform
par: Chernyshev, Konstantin, et autres
Publié: (2026)
par: Chernyshev, Konstantin, et autres
Publié: (2026)
U-MATH: A University-Level Benchmark for Evaluating Mathematical Skills in LLMs
par: Chernyshev, Konstantin, et autres
Publié: (2024)
par: Chernyshev, Konstantin, et autres
Publié: (2024)
Beemo: Benchmark of Expert-edited Machine-generated Outputs
par: Artemova, Ekaterina, et autres
Publié: (2024)
par: Artemova, Ekaterina, et autres
Publié: (2024)
JEEM: Vision-Language Understanding in Four Arabic Dialects
par: Kadaoui, Karima, et autres
Publié: (2025)
par: Kadaoui, Karima, et autres
Publié: (2025)
Enriching Word Usage Graphs with Cluster Definitions
par: Fedorova, Mariia, et autres
Publié: (2024)
par: Fedorova, Mariia, et autres
Publié: (2024)
XL-DURel: Finetuning Sentence Transformers for Ordinal Word-in-Context Classification
par: Yadav, Sachin, et autres
Publié: (2025)
par: Yadav, Sachin, et autres
Publié: (2025)
A Head to Predict and a Head to Question: Pre-trained Uncertainty Quantification Heads for Hallucination Detection in LLM Outputs
par: Shelmanov, Artem, et autres
Publié: (2025)
par: Shelmanov, Artem, et autres
Publié: (2025)
Towards Automating Text Annotation: A Case Study on Semantic Proximity Annotation using GPT-4
par: Yadav, Sachin, et autres
Publié: (2024)
par: Yadav, Sachin, et autres
Publié: (2024)
Presence or Absence: Are Unknown Word Usages in Dictionaries?
par: Ma, Xianghe, et autres
Publié: (2024)
par: Ma, Xianghe, et autres
Publié: (2024)
Exploring the Robustness of Task-oriented Dialogue Systems for Colloquial German Varieties
par: Artemova, Ekaterina, et autres
Publié: (2024)
par: Artemova, Ekaterina, et autres
Publié: (2024)
The LSCD Benchmark: a Testbed for Diachronic Word Meaning Tasks
par: Schlechtweg, Dominik, et autres
Publié: (2024)
par: Schlechtweg, Dominik, et autres
Publié: (2024)
Detection of Non-recorded Word Senses in English and Swedish
par: Lautenschlager, Jonathan, et autres
Publié: (2024)
par: Lautenschlager, Jonathan, et autres
Publié: (2024)
LUNA: A Framework for Language Understanding and Naturalness Assessment
par: Saidov, Marat, et autres
Publié: (2024)
par: Saidov, Marat, et autres
Publié: (2024)
RuBia: A Russian Language Bias Detection Dataset
par: Grigoreva, Veronika, et autres
Publié: (2024)
par: Grigoreva, Veronika, et autres
Publié: (2024)
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
par: Shirnin, Alexander, et autres
Publié: (2024)
par: Shirnin, Alexander, et autres
Publié: (2024)
Papilusion at DAGPap24: Paper or Illusion? Detecting AI-generated Scientific Papers
par: Andreev, Nikita, et autres
Publié: (2024)
par: Andreev, Nikita, et autres
Publié: (2024)
REPA: Russian Error Types Annotation for Evaluating Text Generation and Judgment Capabilities
par: Pugachev, Alexander, et autres
Publié: (2025)
par: Pugachev, Alexander, et autres
Publié: (2025)
RuBLiMP: Russian Benchmark of Linguistic Minimal Pairs
par: Taktasheva, Ekaterina, et autres
Publié: (2024)
par: Taktasheva, Ekaterina, et autres
Publié: (2024)
Donkii: Can Annotation Error Detection Methods Find Errors in Instruction-Tuning Datasets?
par: Weber-Genzel, Leon, et autres
Publié: (2023)
par: Weber-Genzel, Leon, et autres
Publié: (2023)
NER-Luxury: Named entity recognition for the fashion and luxury domain
par: Mousterou, Akim
Publié: (2024)
par: Mousterou, Akim
Publié: (2024)
DWUG: A large Resource of Diachronic Word Usage Graphs in Four Languages
par: Schlechtweg, Dominik, et autres
Publié: (2021)
par: Schlechtweg, Dominik, et autres
Publié: (2021)
Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
par: Wang, Yuxia, et autres
Publié: (2025)
par: Wang, Yuxia, et autres
Publié: (2025)
LLM-DetectAIve: a Tool for Fine-Grained Machine-Generated Text Detection
par: Abassy, Mervat, et autres
Publié: (2024)
par: Abassy, Mervat, et autres
Publié: (2024)
ATGen: A Framework for Active Text Generation
par: Tsvigun, Akim, et autres
Publié: (2025)
par: Tsvigun, Akim, et autres
Publié: (2025)
SemEval-2026 Task 4: Narrative Story Similarity and Narrative Representation Learning
par: Hatzel, Hans Ole, et autres
Publié: (2026)
par: Hatzel, Hans Ole, et autres
Publié: (2026)
GenAI Content Detection Task 1: English and Multilingual Machine-Generated Text Detection: AI vs. Human
par: Wang, Yuxia, et autres
Publié: (2025)
par: Wang, Yuxia, et autres
Publié: (2025)
LLM-based Automated Grading with Human-in-the-Loop
par: Chu, Yucheng, et autres
Publié: (2025)
par: Chu, Yucheng, et autres
Publié: (2025)
Sebastian, Basti, Wastl?! Recognizing Named Entities in Bavarian Dialectal Data
par: Peng, Siyao, et autres
Publié: (2024)
par: Peng, Siyao, et autres
Publié: (2024)
Low-Resource, High-Impact: Building Corpora for Inclusive Language Technologies
par: Artemova, Ekaterina, et autres
Publié: (2025)
par: Artemova, Ekaterina, et autres
Publié: (2025)
Benchmarking Uncertainty Quantification Methods for Large Language Models with LM-Polygraph
par: Vashurin, Roman, et autres
Publié: (2024)
par: Vashurin, Roman, et autres
Publié: (2024)
Exploring Empty Spaces: Human-in-the-Loop Data Augmentation
par: Yeh, Catherine, et autres
Publié: (2024)
par: Yeh, Catherine, et autres
Publié: (2024)
Tutorial Proposal: Speculative Decoding for Efficient LLM Inference
par: Xia, Heming, et autres
Publié: (2025)
par: Xia, Heming, et autres
Publié: (2025)
The DURel Annotation Tool: Human and Computational Measurement of Semantic Proximity, Sense Clusters and Semantic Change
par: Schlechtweg, Dominik, et autres
Publié: (2023)
par: Schlechtweg, Dominik, et autres
Publié: (2023)
Towards A Human-in-the-Loop LLM Approach to Collaborative Discourse Analysis
par: Cohn, Clayton, et autres
Publié: (2024)
par: Cohn, Clayton, et autres
Publié: (2024)
Label-Looping: Highly Efficient Decoding for Transducers
par: Bataev, Vladimir, et autres
Publié: (2024)
par: Bataev, Vladimir, et autres
Publié: (2024)
Facilitating large language model Russian adaptation with Learned Embedding Propagation
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
A Fully Automated Pipeline for Conversational Discourse Annotation: Tree Scheme Generation and Labeling with Large Language Models
par: Petukhova, Kseniia, et autres
Publié: (2025)
par: Petukhova, Kseniia, et autres
Publié: (2025)
No Free Labels: Limitations of LLM-as-a-Judge Without Human Grounding
par: Krumdick, Michael, et autres
Publié: (2025)
par: Krumdick, Michael, et autres
Publié: (2025)
Learning to Predict Usage Options of Product Reviews with LLM-Generated Labels
par: Kohlenberg, Leo, et autres
Publié: (2024)
par: Kohlenberg, Leo, et autres
Publié: (2024)
Documents similaires
-
Voices of Freelance Professional Writers on AI: Limitations, Expectations, and Fears
par: Ivanova, Anastasiia, et autres
Publié: (2025) -
Tendem: A Hybrid AI+Human Platform
par: Chernyshev, Konstantin, et autres
Publié: (2026) -
U-MATH: A University-Level Benchmark for Evaluating Mathematical Skills in LLMs
par: Chernyshev, Konstantin, et autres
Publié: (2024) -
Beemo: Benchmark of Expert-edited Machine-generated Outputs
par: Artemova, Ekaterina, et autres
Publié: (2024) -
JEEM: Vision-Language Understanding in Four Arabic Dialects
par: Kadaoui, Karima, et autres
Publié: (2025)