Co-DETECT: Collaborative Discovery of Edge Cases in Text Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiong, Chenfei, Ni, Jingwei, Fan, Yu, Zouhar, Vilém, Rooein, Donya, Calvo-Bartolomé, Lorena, Hoyle, Alexander, Jin, Zhijing, Sachan, Mrinmaya, Leippold, Markus, Hovy, Dirk, El-Assady, Mennatallah, Ash, Elliott |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
di: Rooein, Donya, et al.
Pubblicazione: (2025)
di: Rooein, Donya, et al.
Pubblicazione: (2025)
Multilingual Performance Biases of Large Language Models in Education
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
RELIC: Investigating Large Language Model Responses using Self-Consistency
di: Cheng, Furui, et al.
Pubblicazione: (2023)
di: Cheng, Furui, et al.
Pubblicazione: (2023)
Conversations as a Source for Teaching Scientific Concepts at Different Education Levels
di: Rooein, Donya, et al.
Pubblicazione: (2024)
di: Rooein, Donya, et al.
Pubblicazione: (2024)
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM Annotators
di: Ni, Jingwei, et al.
Pubblicazione: (2024)
di: Ni, Jingwei, et al.
Pubblicazione: (2024)
DIRAS: Efficient LLM Annotation of Document Relevance in Retrieval Augmented Generation
di: Ni, Jingwei, et al.
Pubblicazione: (2024)
di: Ni, Jingwei, et al.
Pubblicazione: (2024)
AI-Assisted Human Evaluation of Machine Translation
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
How to Select Datapoints for Efficient Human Evaluation of NLG Models?
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Educators' Perceptions of Large Language Models as Tutors: Comparing Human and AI Tutors in a Blind Text-only Setting
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2025)
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2025)
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2024)
di: Chowdhury, Sankalan Pal, et al.
Pubblicazione: (2024)
PATS: Personality-Aware Teaching Strategies with Large Language Model Tutors
di: Rooein, Donya, et al.
Pubblicazione: (2026)
di: Rooein, Donya, et al.
Pubblicazione: (2026)
CafGa: Customizing Feature Attributions to Explain Language Models
di: Boyle, Alan, et al.
Pubblicazione: (2025)
di: Boyle, Alan, et al.
Pubblicazione: (2025)
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
di: Cui, Peng, et al.
Pubblicazione: (2024)
di: Cui, Peng, et al.
Pubblicazione: (2024)
Beyond Flesch-Kincaid: Prompt-based Metrics Improve Difficulty Classification of Educational Texts
di: Rooein, Donya, et al.
Pubblicazione: (2024)
di: Rooein, Donya, et al.
Pubblicazione: (2024)
Balancing Truthfulness and Informativeness with Uncertainty-Aware Instruction Fine-Tuning
di: Wu, Tianyi, et al.
Pubblicazione: (2025)
di: Wu, Tianyi, et al.
Pubblicazione: (2025)
The Medium Is Not the Message: Deconfounding Document Embeddings via Linear Concept Erasure
di: Fan, Yu, et al.
Pubblicazione: (2025)
di: Fan, Yu, et al.
Pubblicazione: (2025)
Can LLMs Model Incorrect Student Reasoning? A Case Study on Distractor Generation
di: Zengaffinen, Yanick, et al.
Pubblicazione: (2026)
di: Zengaffinen, Yanick, et al.
Pubblicazione: (2026)
Towards Faithful and Robust LLM Specialists for Evidence-Based Question-Answering
di: Schimanski, Tobias, et al.
Pubblicazione: (2024)
di: Schimanski, Tobias, et al.
Pubblicazione: (2024)
Exploring Subjective Tasks in Farsi: A Survey Analysis and Evaluation of Language Models
di: Rooein, Donya, et al.
Pubblicazione: (2025)
di: Rooein, Donya, et al.
Pubblicazione: (2025)
Early-Exit and Instant Confidence Translation Quality Estimation
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
di: Zouhar, Vilém, et al.
Pubblicazione: (2025)
Understanding Large Language Model Behaviors through Interactive Counterfactual Generation and Analysis
di: Cheng, Furui, et al.
Pubblicazione: (2024)
di: Cheng, Furui, et al.
Pubblicazione: (2024)
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
di: Zouhar, Vilém
Pubblicazione: (2024)
di: Zouhar, Vilém
Pubblicazione: (2024)
Deconstructing Human-AI Collaboration: Agency, Interaction, and Adaptation
di: Holter, Steffen, et al.
Pubblicazione: (2024)
di: Holter, Steffen, et al.
Pubblicazione: (2024)
Deconstructing Human‐AI Collaboration: Agency, Interaction, and Adaptation
di: Steffen Holter, et al.
Pubblicazione: (2024)
di: Steffen Holter, et al.
Pubblicazione: (2024)
ReProbe: Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
di: Ni, Jingwei, et al.
Pubblicazione: (2025)
COMET-poly: Machine Translation Metric Grounded in Other Candidates
di: Züfle, Maike, et al.
Pubblicazione: (2025)
di: Züfle, Maike, et al.
Pubblicazione: (2025)
PWESuite: Phonetic Word Embeddings and Tasks They Facilitate
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
A Formal Perspective on Byte-Pair Encoding
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
di: Zouhar, Vilém, et al.
Pubblicazione: (2023)
Error Span Annotation: A Balanced Approach for Human Evaluation of Machine Translation
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
di: Kocmi, Tom, et al.
Pubblicazione: (2024)
Quality and Quantity of Machine Translation References for Automatic Metrics
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Pearmut: Human Evaluation of Translation Made Trivial
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
di: Zouhar, Vilém, et al.
Pubblicazione: (2026)
Improving Large Language Model Safety with Contrastive Representation Learning
di: Simko, Samuel, et al.
Pubblicazione: (2025)
di: Simko, Samuel, et al.
Pubblicazione: (2025)
Uncovering Hidden Correctness in LLM Causal Reasoning via Symbolic Verification
di: He, Paul, et al.
Pubblicazione: (2026)
di: He, Paul, et al.
Pubblicazione: (2026)
pdfQA: Diverse, Challenging, and Realistic Question Answering over PDFs
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
di: Schimanski, Tobias, et al.
Pubblicazione: (2026)
On Affine Homotopy between Language Encoders
di: Chan, Robin SM, et al.
Pubblicazione: (2024)
di: Chan, Robin SM, et al.
Pubblicazione: (2024)
ProxAnn: Use-Oriented Evaluations of Topic Models and Document Clustering
di: Hoyle, Alexander, et al.
Pubblicazione: (2025)
di: Hoyle, Alexander, et al.
Pubblicazione: (2025)
Cross-Cultural Simulation of Citizen Emotional Responses to Bureaucratic Red Tape Using LLM Agents
di: Ni, Wanchun, et al.
Pubblicazione: (2026)
di: Ni, Wanchun, et al.
Pubblicazione: (2026)
Tackling the Root of Misinformation by Teaching Laypeople about Logical Fallacies via Socratic Questioning and Critical Argumentation
di: Shi, Minjing, et al.
Pubblicazione: (2026)
di: Shi, Minjing, et al.
Pubblicazione: (2026)
Fluid Representations in Reasoning Models
di: Kharlapenko, Dmitrii, et al.
Pubblicazione: (2026)
di: Kharlapenko, Dmitrii, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
di: Ni, Jingwei, et al.
Pubblicazione: (2025) -
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
di: Rooein, Donya, et al.
Pubblicazione: (2025) -
Multilingual Performance Biases of Large Language Models in Education
di: Gupta, Vansh, et al.
Pubblicazione: (2025) -
RELIC: Investigating Large Language Model Responses using Self-Consistency
di: Cheng, Furui, et al.
Pubblicazione: (2023) -
Conversations as a Source for Teaching Scientific Concepts at Different Education Levels
di: Rooein, Donya, et al.
Pubblicazione: (2024)