Data Augmentation using Large Language Models: Data Perspectives, Learning Paradigms and Challenges
Fuente:
arXiv
Saved in:
| Main Authors: | Ding, Bosheng, Qin, Chengwei, Zhao, Ruochen, Luo, Tianze, Li, Xinze, Chen, Guizhen, Xia, Wenhan, Hu, Junjie, Luu, Anh Tuan, Joty, Shafiq |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Lifelong Event Detection with Embedding Space Separation and Compaction
by: Qin, Chengwei, et al.
Published: (2024)
by: Qin, Chengwei, et al.
Published: (2024)
Beyond Output Matching: Bidirectional Alignment for Enhanced In-Context Learning
by: Qin, Chengwei, et al.
Published: (2023)
by: Qin, Chengwei, et al.
Published: (2023)
Relevant or Random: Can LLMs Truly Perform Analogical Reasoning?
by: Qin, Chengwei, et al.
Published: (2024)
by: Qin, Chengwei, et al.
Published: (2024)
A Comprehensive Survey of Contamination Detection Methods in Large Language Models
by: Ravaut, Mathieu, et al.
Published: (2024)
by: Ravaut, Mathieu, et al.
Published: (2024)
Chain-of-Knowledge: Grounding Large Language Models via Dynamic Knowledge Adapting over Heterogeneous Sources
by: Li, Xingxuan, et al.
Published: (2023)
by: Li, Xingxuan, et al.
Published: (2023)
Exploring the Potential of Large Language Models in Computational Argumentation
by: Chen, Guizhen, et al.
Published: (2023)
by: Chen, Guizhen, et al.
Published: (2023)
Exploring Self-supervised Logic-enhanced Training for Large Language Models
by: Jiao, Fangkai, et al.
Published: (2023)
by: Jiao, Fangkai, et al.
Published: (2023)
ChatGPT's One-year Anniversary: Are Open-Source Large Language Models Catching up?
by: Chen, Hailin, et al.
Published: (2023)
by: Chen, Hailin, et al.
Published: (2023)
Can We Further Elicit Reasoning in LLMs? Critic-Guided Planning with Retrieval-Augmentation for Solving Challenging Tasks
by: Li, Xingxuan, et al.
Published: (2024)
by: Li, Xingxuan, et al.
Published: (2024)
Chain of LoRA: Efficient Fine-tuning of Language Models via Residual Learning
by: Xia, Wenhan, et al.
Published: (2024)
by: Xia, Wenhan, et al.
Published: (2024)
NAACL2025 Tutorial: Adaptation of Large Language Models
by: Ke, Zixuan, et al.
Published: (2025)
by: Ke, Zixuan, et al.
Published: (2025)
Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing
by: Jiao, Fangkai, et al.
Published: (2024)
by: Jiao, Fangkai, et al.
Published: (2024)
Beyond In-Context Learning: Aligning Long-form Generation of Large Language Models via Task-Inherent Attribute Guidelines
by: Long, Do Xuan, et al.
Published: (2025)
by: Long, Do Xuan, et al.
Published: (2025)
StructTest: Benchmarking LLMs' Reasoning through Compositional Structured Outputs
by: Chen, Hailin, et al.
Published: (2024)
by: Chen, Hailin, et al.
Published: (2024)
On Context Utilization in Summarization with Large Language Models
by: Ravaut, Mathieu, et al.
Published: (2023)
by: Ravaut, Mathieu, et al.
Published: (2023)
A Survey on Neural Topic Models: Methods, Applications, and Challenges
by: Wu, Xiaobao, et al.
Published: (2024)
by: Wu, Xiaobao, et al.
Published: (2024)
Evaluating Psychological Safety of Large Language Models
by: Li, Xingxuan, et al.
Published: (2022)
by: Li, Xingxuan, et al.
Published: (2022)
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
by: Chia, Yew Ken, et al.
Published: (2024)
by: Chia, Yew Ken, et al.
Published: (2024)
Towards Reliable Truth-Aligned Uncertainty Estimation in Large Language Models
by: Srey, Ponhvoan, et al.
Published: (2026)
by: Srey, Ponhvoan, et al.
Published: (2026)
Learning Uncertainty from Sequential Internal Dispersion in Large Language Models
by: Srey, Ponhvoan, et al.
Published: (2026)
by: Srey, Ponhvoan, et al.
Published: (2026)
Open-RAG: Enhanced Retrieval-Augmented Reasoning with Open-Source Large Language Models
by: Islam, Shayekh Bin, et al.
Published: (2024)
by: Islam, Shayekh Bin, et al.
Published: (2024)
DataNarrative: Automated Data-Driven Storytelling with Visualizations and Texts
by: Islam, Mohammed Saidul, et al.
Published: (2024)
by: Islam, Mohammed Saidul, et al.
Published: (2024)
Learning from Language Feedback via Variational Policy Distillation
by: Li, Yang, et al.
Published: (2026)
by: Li, Yang, et al.
Published: (2026)
Universal Vulnerabilities in Large Language Models: Backdoor Attacks for In-context Learning
by: Zhao, Shuai, et al.
Published: (2024)
by: Zhao, Shuai, et al.
Published: (2024)
Who's Who: Large Language Models Meet Knowledge Conflicts in Practice
by: Pham, Quang Hieu, et al.
Published: (2024)
by: Pham, Quang Hieu, et al.
Published: (2024)
Conditional Multidimensional Scaling with Incomplete Conditioning Data
by: Bui, Anh Tuan
Published: (2025)
by: Bui, Anh Tuan
Published: (2025)
Diffusion vs. Autoregressive Language Models: A Text Embedding Perspective
by: Zhang, Siyue, et al.
Published: (2025)
by: Zhang, Siyue, et al.
Published: (2025)
Video-Language Understanding: A Survey from Model Architecture, Model Training, and Data Perspectives
by: Nguyen, Thong, et al.
Published: (2024)
by: Nguyen, Thong, et al.
Published: (2024)
Unsupervised Summarization Re-ranking
by: Ravaut, Mathieu, et al.
Published: (2022)
by: Ravaut, Mathieu, et al.
Published: (2022)
Variation in Verification: Understanding Verification Dynamics in Large Language Models
by: Zhou, Yefan, et al.
Published: (2025)
by: Zhou, Yefan, et al.
Published: (2025)
UniBridge: A Unified Approach to Cross-Lingual Transfer Learning for Low-Resource Languages
by: Pham, Trinh, et al.
Published: (2024)
by: Pham, Trinh, et al.
Published: (2024)
GeoPQA: Bridging the Visual Perception Gap in MLLMs for Geometric Reasoning
by: Chen, Guizhen, et al.
Published: (2025)
by: Chen, Guizhen, et al.
Published: (2025)
Discrete Diffusion Language Model for Efficient Text Summarization
by: Dat, Do Huu, et al.
Published: (2024)
by: Dat, Do Huu, et al.
Published: (2024)
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
by: Niu, Tong, et al.
Published: (2024)
by: Niu, Tong, et al.
Published: (2024)
Thinking with Nothinking Calibration: A New In-Context Learning Paradigm in Reasoning Large Language Models
by: Wu, Haotian, et al.
Published: (2025)
by: Wu, Haotian, et al.
Published: (2025)
Is Translation All You Need? A Study on Solving Multilingual Tasks with Large Language Models
by: Liu, Chaoqun, et al.
Published: (2024)
by: Liu, Chaoqun, et al.
Published: (2024)
Text Data Augmentation for Large Language Models: A Comprehensive Survey of Methods, Challenges, and Opportunities
by: Chai, Yaping, et al.
Published: (2025)
by: Chai, Yaping, et al.
Published: (2025)
Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models
by: Hu, Yuchen, et al.
Published: (2024)
by: Hu, Yuchen, et al.
Published: (2024)
Mercury: A Code Efficiency Benchmark for Code Large Language Models
by: Du, Mingzhe, et al.
Published: (2024)
by: Du, Mingzhe, et al.
Published: (2024)
Text2Vis: A Challenging and Diverse Benchmark for Generating Multimodal Visualizations from Text
by: Rahman, Mizanur, et al.
Published: (2025)
by: Rahman, Mizanur, et al.
Published: (2025)
Similar Items
-
Lifelong Event Detection with Embedding Space Separation and Compaction
by: Qin, Chengwei, et al.
Published: (2024) -
Beyond Output Matching: Bidirectional Alignment for Enhanced In-Context Learning
by: Qin, Chengwei, et al.
Published: (2023) -
Relevant or Random: Can LLMs Truly Perform Analogical Reasoning?
by: Qin, Chengwei, et al.
Published: (2024) -
A Comprehensive Survey of Contamination Detection Methods in Large Language Models
by: Ravaut, Mathieu, et al.
Published: (2024) -
Chain-of-Knowledge: Grounding Large Language Models via Dynamic Knowledge Adapting over Heterogeneous Sources
by: Li, Xingxuan, et al.
Published: (2023)