Salvato in:
| Autori principali: | Gong, Chen, Liang, Bo, Gao, Wei, Xu, Chenren |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.23174 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Your Agent Can Defend Itself against Backdoor Attacks
di: Changjiang, Li, et al.
Pubblicazione: (2025)
di: Changjiang, Li, et al.
Pubblicazione: (2025)
AdamS: Momentum Itself Can Be A Normalizer for LLM Pretraining and Post-training
di: Zhang, Huishuai, et al.
Pubblicazione: (2025)
di: Zhang, Huishuai, et al.
Pubblicazione: (2025)
Utilizing GANs for Fraud Detection: Model Training with Synthetic Transaction Data
di: Zhu, Mengran, et al.
Pubblicazione: (2024)
di: Zhu, Mengran, et al.
Pubblicazione: (2024)
LoReUn: Data Itself Implicitly Provides Cues to Improve Machine Unlearning
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
A Model Can Help Itself: Reward-Free Self-Training for LLM Reasoning
di: Li, Mengqi, et al.
Pubblicazione: (2025)
di: Li, Mengqi, et al.
Pubblicazione: (2025)
SynQP: A Framework and Metrics for Evaluating the Quality and Privacy Risk of Synthetic Data
di: Hu, Bing, et al.
Pubblicazione: (2026)
di: Hu, Bing, et al.
Pubblicazione: (2026)
The LLM Data Auditor: A Metric-oriented Survey on Quality and Trustworthiness in Evaluating Synthetic Data
di: Zhang, Kaituo, et al.
Pubblicazione: (2026)
di: Zhang, Kaituo, et al.
Pubblicazione: (2026)
CauKer: Classification Time Series Foundation Models Can Be Pretrained on Synthetic Data
di: Xie, Shifeng, et al.
Pubblicazione: (2025)
di: Xie, Shifeng, et al.
Pubblicazione: (2025)
Lightweight Safety Guardrails via Synthetic Data and RL-guided Adversarial Training
di: Ilin, Aleksei, et al.
Pubblicazione: (2025)
di: Ilin, Aleksei, et al.
Pubblicazione: (2025)
Are Synthetic Time-series Data Really not as Good as Real Data?
di: Fu, Fanzhe, et al.
Pubblicazione: (2024)
di: Fu, Fanzhe, et al.
Pubblicazione: (2024)
KL-regularization Itself is Differentially Private in Bandits and RLHF
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
When AI Eats Itself: On the Caveats of AI Autophagy
di: Xing, Xiaodan, et al.
Pubblicazione: (2024)
di: Xing, Xiaodan, et al.
Pubblicazione: (2024)
Quality over Quantity: Boosting Data Efficiency Through Ensembled Multimodal Data Curation
di: Xu, Jinda, et al.
Pubblicazione: (2025)
di: Xu, Jinda, et al.
Pubblicazione: (2025)
Synthetic Data Privacy Metrics
di: Steier, Amy, et al.
Pubblicazione: (2025)
di: Steier, Amy, et al.
Pubblicazione: (2025)
SynCircuit: Automated Generation of New Synthetic RTL Circuits Can Enable Big Data in Circuits
di: Liu, Shang, et al.
Pubblicazione: (2025)
di: Liu, Shang, et al.
Pubblicazione: (2025)
Generating Synthetic Electronic Health Record Data: a Methodological Scoping Review with Benchmarking on Phenotype Data and Open-Source Software
di: Chen, Xingran, et al.
Pubblicazione: (2024)
di: Chen, Xingran, et al.
Pubblicazione: (2024)
Can Past Experience Accelerate LLM Reasoning?
di: Pan, Bo, et al.
Pubblicazione: (2025)
di: Pan, Bo, et al.
Pubblicazione: (2025)
Generative Synthetic Data for Causal Inference: Pitfalls, Remedies, and Opportunities
di: Xu, Yichen
Pubblicazione: (2026)
di: Xu, Yichen
Pubblicazione: (2026)
Synthetic Data Generation for Residential Load Patterns via Recurrent GAN and Ensemble Method
di: Liang, Xinyu, et al.
Pubblicazione: (2024)
di: Liang, Xinyu, et al.
Pubblicazione: (2024)
BC Protocol: Structured Dual-Expert Dialogue for Eliciting High-Quality Chain-of-Thought Post-Training Data
di: Zou, Bo, et al.
Pubblicazione: (2026)
di: Zou, Bo, et al.
Pubblicazione: (2026)
A Technical Exploration of Causal Inference with Hybrid LLM Synthetic Data
di: Kim, Dana, et al.
Pubblicazione: (2025)
di: Kim, Dana, et al.
Pubblicazione: (2025)
Valid Inference with Imperfect Synthetic Data
di: Byun, Yewon, et al.
Pubblicazione: (2025)
di: Byun, Yewon, et al.
Pubblicazione: (2025)
Can Data-Driven Dynamics Reveal Hidden Physics? There Is A Need for Interpretable Neural Operators
di: Gao, Wenhan, et al.
Pubblicazione: (2025)
di: Gao, Wenhan, et al.
Pubblicazione: (2025)
ChatEMG: Synthetic Data Generation to Control a Robotic Hand Orthosis for Stroke
di: Xu, Jingxi, et al.
Pubblicazione: (2024)
di: Xu, Jingxi, et al.
Pubblicazione: (2024)
Boosting Meta-Learning for Few-Shot Text Classification via Label-guided Distance Scaling
di: Gao, Yunlong, et al.
Pubblicazione: (2026)
di: Gao, Yunlong, et al.
Pubblicazione: (2026)
CodecLM: Aligning Language Models with Tailored Synthetic Data
di: Wang, Zifeng, et al.
Pubblicazione: (2024)
di: Wang, Zifeng, et al.
Pubblicazione: (2024)
Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models
di: Havrilla, Alex, et al.
Pubblicazione: (2024)
di: Havrilla, Alex, et al.
Pubblicazione: (2024)
TabKANet: Tabular Data Modeling with Kolmogorov-Arnold Network and Transformer
di: Gao, Weihao, et al.
Pubblicazione: (2024)
di: Gao, Weihao, et al.
Pubblicazione: (2024)
Synthetic Data Generation for Augmenting Small Samples
di: Liu, Dan, et al.
Pubblicazione: (2025)
di: Liu, Dan, et al.
Pubblicazione: (2025)
Self-Improving Diffusion Models with Synthetic Data
di: Alemohammad, Sina, et al.
Pubblicazione: (2024)
di: Alemohammad, Sina, et al.
Pubblicazione: (2024)
Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era
di: Li, Dawei, et al.
Pubblicazione: (2025)
di: Li, Dawei, et al.
Pubblicazione: (2025)
Enhancing Indoor Temperature Forecasting through Synthetic Data in Low-Data Environments
di: Thiry, Zachari, et al.
Pubblicazione: (2024)
di: Thiry, Zachari, et al.
Pubblicazione: (2024)
StreamFP: Learnable Fingerprint-guided Data Selection for Efficient Stream Learning
di: Shi, Tongjun, et al.
Pubblicazione: (2024)
di: Shi, Tongjun, et al.
Pubblicazione: (2024)
CasualSynth: Generating Structurally Sound Synthetic Data
di: Cheng, Zehua, et al.
Pubblicazione: (2026)
di: Cheng, Zehua, et al.
Pubblicazione: (2026)
Learning from Synthetic Data Improves Multi-hop Reasoning
di: Kabra, Anmol, et al.
Pubblicazione: (2026)
di: Kabra, Anmol, et al.
Pubblicazione: (2026)
Speaking the Same Language: Leveraging LLMs in Standardizing Clinical Data for AI
di: Sett, Arindam, et al.
Pubblicazione: (2024)
di: Sett, Arindam, et al.
Pubblicazione: (2024)
Data Value in the Age of Scaling: Understanding LLM Scaling Dynamics Under Real-Synthetic Data Mixtures
di: Wang, Haohui, et al.
Pubblicazione: (2025)
di: Wang, Haohui, et al.
Pubblicazione: (2025)
Not All Synthetic Data Is Yours to Learn From
di: Alemohammad, Sina, et al.
Pubblicazione: (2026)
di: Alemohammad, Sina, et al.
Pubblicazione: (2026)
Opportunities and Challenges of Frontier Data Governance With Synthetic Data
di: Thakur, Madhavendra, et al.
Pubblicazione: (2025)
di: Thakur, Madhavendra, et al.
Pubblicazione: (2025)
Unlocking Post-hoc Dataset Inference with Synthetic Data
di: Zhao, Bihe, et al.
Pubblicazione: (2025)
di: Zhao, Bihe, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Your Agent Can Defend Itself against Backdoor Attacks
di: Changjiang, Li, et al.
Pubblicazione: (2025) -
AdamS: Momentum Itself Can Be A Normalizer for LLM Pretraining and Post-training
di: Zhang, Huishuai, et al.
Pubblicazione: (2025) -
Utilizing GANs for Fraud Detection: Model Training with Synthetic Transaction Data
di: Zhu, Mengran, et al.
Pubblicazione: (2024) -
LoReUn: Data Itself Implicitly Provides Cues to Improve Machine Unlearning
di: Li, Xiang, et al.
Pubblicazione: (2025) -
A Model Can Help Itself: Reward-Free Self-Training for LLM Reasoning
di: Li, Mengqi, et al.
Pubblicazione: (2025)