Data Quality Enhancement on the Basis of Diversity with Large Language Models for Text Classification: Uncovered, Difficult, and Noisy
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zeng, Min, Liu, Caiquan, Zhang, Shiqi, Xie, Li, Sang, Chen, Chen, Xiaoxin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GTA: Supervised-Guided Reinforcement Learning for Text Classification with Large Language Models
par: Zeng, Min, et autres
Publié: (2025)
par: Zeng, Min, et autres
Publié: (2025)
Annotation Guidelines-Based Knowledge Augmentation: Towards Enhancing Large Language Models for Educational Text Classification
par: Liu, Shiqi, et autres
Publié: (2024)
par: Liu, Shiqi, et autres
Publié: (2024)
Uncovering Overfitting in Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Resilience of Large Language Models for Noisy Instructions
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Advancing Text Classification with Large Language Models and Neural Attention Mechanisms
par: Lyu, Ning, et autres
Publié: (2025)
par: Lyu, Ning, et autres
Publié: (2025)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
par: Iyer, Vivek, et autres
Publié: (2024)
par: Iyer, Vivek, et autres
Publié: (2024)
Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?
par: Zhu, Dawei, et autres
Publié: (2024)
par: Zhu, Dawei, et autres
Publié: (2024)
Arrows of Math Reasoning Data Synthesis for Large Language Models: Diversity, Complexity and Correctness
par: Chen, Sirui, et autres
Publié: (2025)
par: Chen, Sirui, et autres
Publié: (2025)
Generating Difficult-to-Translate Texts
par: Zouhar, Vilém, et autres
Publié: (2025)
par: Zouhar, Vilém, et autres
Publié: (2025)
Beyond Quality: Unlocking Diversity in Ad Headline Generation with Large Language Models
par: Wang, Chang, et autres
Publié: (2025)
par: Wang, Chang, et autres
Publié: (2025)
Entity Alignment with Noisy Annotations from Large Language Models
par: Chen, Shengyuan, et autres
Publié: (2024)
par: Chen, Shengyuan, et autres
Publié: (2024)
Basis Sharing: Cross-Layer Parameter Sharing for Large Language Model Compression
par: Wang, Jingcun, et autres
Publié: (2024)
par: Wang, Jingcun, et autres
Publié: (2024)
Post-training Large Language Models for Diverse High-Quality Responses
par: Chen, Yilei, et autres
Publié: (2025)
par: Chen, Yilei, et autres
Publié: (2025)
Detecting the Clinical Features of Difficult-to-Treat Depression using Synthetic Data from Large Language Models
par: Lorge, Isabelle, et autres
Publié: (2024)
par: Lorge, Isabelle, et autres
Publié: (2024)
Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples
par: Gao, Chengqian, et autres
Publié: (2025)
par: Gao, Chengqian, et autres
Publié: (2025)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
par: Lin, Yujie, et autres
Publié: (2026)
par: Lin, Yujie, et autres
Publié: (2026)
Temporal Text Classification with Large Language Models
par: Raihan, Nishat, et autres
Publié: (2026)
par: Raihan, Nishat, et autres
Publié: (2026)
Large Language Models for Oral History Understanding with Text Classification and Sentiment Analysis
par: Cherukuri, Komala Subramanyam, et autres
Publié: (2025)
par: Cherukuri, Komala Subramanyam, et autres
Publié: (2025)
On the Diversity of Synthetic Data and its Impact on Training Large Language Models
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Data Generation Using Large Language Models for Text Classification: An Empirical Case Study
par: Li, Yinheng, et autres
Publié: (2024)
par: Li, Yinheng, et autres
Publié: (2024)
Diversity-oriented Data Augmentation with Large Language Models
par: Wang, Zaitian, et autres
Publié: (2025)
par: Wang, Zaitian, et autres
Publié: (2025)
Controllable and Diverse Data Augmentation with Large Language Model for Low-Resource Open-Domain Dialogue Generation
par: Liu, Zhenhua, et autres
Publié: (2024)
par: Liu, Zhenhua, et autres
Publié: (2024)
Uncovering Safety Risks of Large Language Models through Concept Activation Vector
par: Xu, Zhihao, et autres
Publié: (2024)
par: Xu, Zhihao, et autres
Publié: (2024)
Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning
par: Zhao, Hang, et autres
Publié: (2024)
par: Zhao, Hang, et autres
Publié: (2024)
TextReasoningBench: Does Reasoning Really Improve Text Classification in Large Language Models?
par: Guo, Xinyu, et autres
Publié: (2026)
par: Guo, Xinyu, et autres
Publié: (2026)
RECAP: Resistance Capture in Text-based Mental Health Counseling with Large Language Models
par: Li, Anqi, et autres
Publié: (2026)
par: Li, Anqi, et autres
Publié: (2026)
Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models
par: Havrilla, Alex, et autres
Publié: (2024)
par: Havrilla, Alex, et autres
Publié: (2024)
Retrieval-style In-Context Learning for Few-shot Hierarchical Text Classification
par: Chen, Huiyao, et autres
Publié: (2024)
par: Chen, Huiyao, et autres
Publié: (2024)
When Truth Is Overridden: Uncovering the Internal Origins of Sycophancy in Large Language Models
par: Wang, Keyu, et autres
Publié: (2025)
par: Wang, Keyu, et autres
Publié: (2025)
Adaptable and Reliable Text Classification using Large Language Models
par: Wang, Zhiqiang, et autres
Publié: (2024)
par: Wang, Zhiqiang, et autres
Publié: (2024)
Exploring Mathematical Extrapolation of Large Language Models with Synthetic Data
par: Li, Haolong, et autres
Publié: (2024)
par: Li, Haolong, et autres
Publié: (2024)
Constructions Are So Difficult That Even Large Language Models Get Them Right for the Wrong Reasons
par: Zhou, Shijia, et autres
Publié: (2024)
par: Zhou, Shijia, et autres
Publié: (2024)
Quantization of Large Language Models with an Overdetermined Basis
par: Merkulov, Daniil, et autres
Publié: (2024)
par: Merkulov, Daniil, et autres
Publié: (2024)
Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation
par: Zhang, Yuanhe, et autres
Publié: (2025)
par: Zhang, Yuanhe, et autres
Publié: (2025)
Improving Attributed Text Generation of Large Language Models via Preference Learning
par: Li, Dongfang, et autres
Publié: (2024)
par: Li, Dongfang, et autres
Publié: (2024)
PsychCounsel-Bench: Evaluating the Psychology Intelligence of Large Language Models
par: Zeng, Min
Publié: (2025)
par: Zeng, Min
Publié: (2025)
Text Data Augmentation for Large Language Models: A Comprehensive Survey of Methods, Challenges, and Opportunities
par: Chai, Yaping, et autres
Publié: (2025)
par: Chai, Yaping, et autres
Publié: (2025)
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
par: Chen, Longze, et autres
Publié: (2024)
par: Chen, Longze, et autres
Publié: (2024)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
Theory of Mind in Large Language Models: Assessment and Enhancement
par: Chen, Ruirui, et autres
Publié: (2025)
par: Chen, Ruirui, et autres
Publié: (2025)
Documents similaires
-
GTA: Supervised-Guided Reinforcement Learning for Text Classification with Large Language Models
par: Zeng, Min, et autres
Publié: (2025) -
Annotation Guidelines-Based Knowledge Augmentation: Towards Enhancing Large Language Models for Educational Text Classification
par: Liu, Shiqi, et autres
Publié: (2024) -
Uncovering Overfitting in Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024) -
Resilience of Large Language Models for Noisy Instructions
par: Wang, Bin, et autres
Publié: (2024) -
Advancing Text Classification with Large Language Models and Neural Attention Mechanisms
par: Lyu, Ning, et autres
Publié: (2025)