Two Directions for Clinical Data Generation with Large Language Models: Data-to-Label and Label-to-Data
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Rumeng, Wang, Xun, Yu, Hong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DualAlign: Generating Clinically Grounded Synthetic Data
por: Li, Rumeng, et al.
Publicado: (2025)
por: Li, Rumeng, et al.
Publicado: (2025)
MetaMT,a MetaLearning Method Leveraging Multiple Domain Data for Low Resource Machine Translation
por: Li, Rumeng, et al.
Publicado: (2019)
por: Li, Rumeng, et al.
Publicado: (2019)
A New NMT Model for Translating Clinical Texts from English to Spanish
por: Li, Rumeng, et al.
Publicado: (2025)
por: Li, Rumeng, et al.
Publicado: (2025)
Exploring LLM Multi-Agents for ICD Coding
por: Li, Rumeng, et al.
Publicado: (2024)
por: Li, Rumeng, et al.
Publicado: (2024)
Labeling Free-text Data using Language Model Ensembles
por: Qiu, Jiaxing, et al.
Publicado: (2025)
por: Qiu, Jiaxing, et al.
Publicado: (2025)
Leveraging Large Language Models for Generating Labeled Mineral Site Record Linkage Data
por: Pyo, Jiyoon, et al.
Publicado: (2024)
por: Pyo, Jiyoon, et al.
Publicado: (2024)
NoteChat: A Dataset of Synthetic Doctor-Patient Conversations Conditioned on Clinical Notes
por: Wang, Junda, et al.
Publicado: (2023)
por: Wang, Junda, et al.
Publicado: (2023)
Intuitionistic Fuzzy Sets for Large Language Model Data Annotation: A Novel Approach to Side-by-Side Preference Labeling
por: Du, Yimin
Publicado: (2025)
por: Du, Yimin
Publicado: (2025)
Strategies for Span Labeling with Large Language Models
por: Semin, Danil, et al.
Publicado: (2026)
por: Semin, Danil, et al.
Publicado: (2026)
Unlocking the Potential of Weakly Labeled Data: A Co-Evolutionary Learning Framework for Abnormality Detection and Report Generation
por: Sun, Jinghan, et al.
Publicado: (2024)
por: Sun, Jinghan, et al.
Publicado: (2024)
FUSE: Ensembling Verifiers with Zero Labeled Data
por: Lee, Joonhyuk, et al.
Publicado: (2026)
por: Lee, Joonhyuk, et al.
Publicado: (2026)
From LLM-anation to LLM-orchestrator: Coordinating Small Models for Data Labeling
por: Lu, Yao, et al.
Publicado: (2025)
por: Lu, Yao, et al.
Publicado: (2025)
Label-Consistent Data Generation for Aspect-Based Sentiment Analysis Using LLM Agents
por: Monfared, Mohammad H. A., et al.
Publicado: (2026)
por: Monfared, Mohammad H. A., et al.
Publicado: (2026)
DECT: Harnessing LLM-assisted Fine-Grained Linguistic Knowledge and Label-Switched and Label-Preserved Data Generation for Diagnosis of Alzheimer's Disease
por: Mo, Tingyu, et al.
Publicado: (2025)
por: Mo, Tingyu, et al.
Publicado: (2025)
Mitigating Label Length Bias in Large Language Models
por: Sanz-Guerrero, Mario, et al.
Publicado: (2025)
por: Sanz-Guerrero, Mario, et al.
Publicado: (2025)
The Re-Label Method For Data-Centric Machine Learning
por: Guo, Tong
Publicado: (2023)
por: Guo, Tong
Publicado: (2023)
Discriminative Finetuning of Generative Large Language Models without Reward Models and Human Preference Data
por: Guo, Siqi, et al.
Publicado: (2025)
por: Guo, Siqi, et al.
Publicado: (2025)
Fabricator: An Open Source Toolkit for Generating Labeled Training Data with Teacher LLMs
por: Golde, Jonas, et al.
Publicado: (2023)
por: Golde, Jonas, et al.
Publicado: (2023)
Can We Reliably Rank Model Performance across Domains without Labeled Data?
por: Rammouz, Veronica, et al.
Publicado: (2025)
por: Rammouz, Veronica, et al.
Publicado: (2025)
Based on Data Balancing and Model Improvement for Multi-Label Sentiment Classification Performance Enhancement
por: Su, Zijin, et al.
Publicado: (2025)
por: Su, Zijin, et al.
Publicado: (2025)
TAIA: Large Language Models are Out-of-Distribution Data Learners
por: Jiang, Shuyang, et al.
Publicado: (2024)
por: Jiang, Shuyang, et al.
Publicado: (2024)
Automatic Prompt Augmentation and Selection with Chain-of-Thought from Labeled Data
por: Shum, KaShun, et al.
Publicado: (2023)
por: Shum, KaShun, et al.
Publicado: (2023)
Augmenting In-Context-Learning in LLMs via Automatic Data Labeling and Refinement
por: Shtok, Joseph, et al.
Publicado: (2024)
por: Shtok, Joseph, et al.
Publicado: (2024)
Large Language Models Do Multi-Label Classification Differently
por: Ma, Marcus, et al.
Publicado: (2025)
por: Ma, Marcus, et al.
Publicado: (2025)
Large Language Models for Patient Comments Multi-Label Classification
por: Sakai, Hajar, et al.
Publicado: (2024)
por: Sakai, Hajar, et al.
Publicado: (2024)
Improving Clinical NLP Performance through Language Model-Generated Synthetic Clinical Data
por: Chen, Shan, et al.
Publicado: (2024)
por: Chen, Shan, et al.
Publicado: (2024)
Exploring Mathematical Extrapolation of Large Language Models with Synthetic Data
por: Li, Haolong, et al.
Publicado: (2024)
por: Li, Haolong, et al.
Publicado: (2024)
DALL: Data Labeling via Data Programming and Active Learning Enhanced by Large Language Models
por: Li, Guozheng, et al.
Publicado: (2026)
por: Li, Guozheng, et al.
Publicado: (2026)
Cost-efficient Crowdsourcing for Span-based Sequence Labeling: Worker Selection and Data Augmentation
por: Wang, Yujie, et al.
Publicado: (2023)
por: Wang, Yujie, et al.
Publicado: (2023)
Labels Generated by Large Language Models Help Measure People's Empathy in Vitro
por: Hasan, Md Rakibul, et al.
Publicado: (2025)
por: Hasan, Md Rakibul, et al.
Publicado: (2025)
Progressively Label Enhancement for Large Language Model Alignment
por: Liu, Biao, et al.
Publicado: (2024)
por: Liu, Biao, et al.
Publicado: (2024)
TarGEN: Targeted Data Generation with Large Language Models
por: Gupta, Himanshu, et al.
Publicado: (2023)
por: Gupta, Himanshu, et al.
Publicado: (2023)
Zero-Shot Grammar Competency Estimation Using Large Language Model Generated Pseudo Labels
por: Das, Sourya Dipta, et al.
Publicado: (2025)
por: Das, Sourya Dipta, et al.
Publicado: (2025)
Synthetic vs. Gold: The Role of LLM Generated Labels and Data in Cyberbullying Detection
por: Kazemi, Arefeh, et al.
Publicado: (2025)
por: Kazemi, Arefeh, et al.
Publicado: (2025)
End-to-End Speech Translation for Low-Resource Languages Using Weakly Labeled Data
por: Pothula, Aishwarya, et al.
Publicado: (2025)
por: Pothula, Aishwarya, et al.
Publicado: (2025)
Fairshare Data Pricing via Data Valuation for Large Language Models
por: Zhang, Luyang, et al.
Publicado: (2025)
por: Zhang, Luyang, et al.
Publicado: (2025)
OPTIC: Optimizing Patient-Provider Triaging & Improving Communications in Clinical Operations using GPT-4 Data Labeling and Model Distillation
por: Santamaria-Pang, Alberto, et al.
Publicado: (2025)
por: Santamaria-Pang, Alberto, et al.
Publicado: (2025)
Data-Efficient Hate Speech Detection via Cross-Lingual Nearest Neighbor Retrieval with Limited Labeled Data
por: Ghorbanpour, Faeze, et al.
Publicado: (2025)
por: Ghorbanpour, Faeze, et al.
Publicado: (2025)
Iterative Data Generation with Large Language Models for Aspect-based Sentiment Analysis
por: Zhong, Qihuang, et al.
Publicado: (2024)
por: Zhong, Qihuang, et al.
Publicado: (2024)
Think Less, Label Better: Multi-Stage Domain-Grounded Synthetic Data Generation for Fine-Tuning Large Language Models in Telecommunications
por: Shi, Chenhua, et al.
Publicado: (2025)
por: Shi, Chenhua, et al.
Publicado: (2025)
Ejemplares similares
-
DualAlign: Generating Clinically Grounded Synthetic Data
por: Li, Rumeng, et al.
Publicado: (2025) -
MetaMT,a MetaLearning Method Leveraging Multiple Domain Data for Low Resource Machine Translation
por: Li, Rumeng, et al.
Publicado: (2019) -
A New NMT Model for Translating Clinical Texts from English to Spanish
por: Li, Rumeng, et al.
Publicado: (2025) -
Exploring LLM Multi-Agents for ICD Coding
por: Li, Rumeng, et al.
Publicado: (2024) -
Labeling Free-text Data using Language Model Ensembles
por: Qiu, Jiaxing, et al.
Publicado: (2025)