A Pre-trained Data Deduplication Model based on Active Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Shi, Haochen, Liu, Xinyao, Lv, Fengmao, Xue, Hongtao, Hu, Jie, Du, Shengdong, Li, Tianrui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning Contrastive Feature Representations for Facial Action Unit Detection
di: Shang, Ziqiao, et al.
Pubblicazione: (2024)
di: Shang, Ziqiao, et al.
Pubblicazione: (2024)
Machine Unlearning of Pre-trained Large Language Models
di: Yao, Jin, et al.
Pubblicazione: (2024)
di: Yao, Jin, et al.
Pubblicazione: (2024)
Feature Alignment: Rethinking Efficient Active Learning via Proxy in the Context of Pre-trained Models
di: Wen, Ziting, et al.
Pubblicazione: (2024)
di: Wen, Ziting, et al.
Pubblicazione: (2024)
Privacy-Preserving Data Deduplication for Enhancing Federated Learning of Language Models (Extended Version)
di: Abadi, Aydin, et al.
Pubblicazione: (2024)
di: Abadi, Aydin, et al.
Pubblicazione: (2024)
Dataset Ownership Verification in Contrastive Pre-trained Models
di: Xie, Yuechen, et al.
Pubblicazione: (2025)
di: Xie, Yuechen, et al.
Pubblicazione: (2025)
Pre-training with Synthetic Data Helps Offline Reinforcement Learning
di: Wang, Zecheng, et al.
Pubblicazione: (2023)
di: Wang, Zecheng, et al.
Pubblicazione: (2023)
Graph Generative Pre-trained Transformer
di: Chen, Xiaohui, et al.
Pubblicazione: (2025)
di: Chen, Xiaohui, et al.
Pubblicazione: (2025)
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
Transfer Learning with Pre-trained Conditional Generative Models
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2022)
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2022)
DecompGAIL: Learning Realistic Traffic Behaviors with Decomposed Multi-Agent Generative Adversarial Imitation Learning
di: Guo, Ke, et al.
Pubblicazione: (2025)
di: Guo, Ke, et al.
Pubblicazione: (2025)
Unified View Imputation and Feature Selection Learning for Incomplete Multi-view Data
di: Huang, Yanyong, et al.
Pubblicazione: (2024)
di: Huang, Yanyong, et al.
Pubblicazione: (2024)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
di: Chen, Tong, et al.
Pubblicazione: (2025)
di: Chen, Tong, et al.
Pubblicazione: (2025)
GraphSculptor: Sculpting Pre-training Coreset for Graph Self-supervised Learning
di: Liu, Chuang, et al.
Pubblicazione: (2026)
di: Liu, Chuang, et al.
Pubblicazione: (2026)
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
di: Yin, Weimin, et al.
Pubblicazione: (2024)
di: Yin, Weimin, et al.
Pubblicazione: (2024)
MOTO: Offline Pre-training to Online Fine-tuning for Model-based Robot Learning
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
Causally Sufficient and Necessary Feature Expansion for Class-Incremental Learning
di: Zhang, Zhen, et al.
Pubblicazione: (2026)
di: Zhang, Zhen, et al.
Pubblicazione: (2026)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
di: Yang, Kailai, et al.
Pubblicazione: (2025)
di: Yang, Kailai, et al.
Pubblicazione: (2025)
Relational In-Context Learning via Synthetic Pre-training with Structural Prior
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
Enhanced Atrial Fibrillation Prediction in ESUS Patients with Hypergraph-based Pre-training
di: Xie, Yuzhang, et al.
Pubblicazione: (2026)
di: Xie, Yuzhang, et al.
Pubblicazione: (2026)
Cross-domain Random Pre-training with Prototypes for Reinforcement Learning
di: Liu, Xin, et al.
Pubblicazione: (2023)
di: Liu, Xin, et al.
Pubblicazione: (2023)
Pre-trained Large Language Models Learn Hidden Markov Models In-context
di: Dai, Yijia, et al.
Pubblicazione: (2025)
di: Dai, Yijia, et al.
Pubblicazione: (2025)
Parallel Structures in Pre-training Data Yield In-Context Learning
di: Chen, Yanda, et al.
Pubblicazione: (2024)
di: Chen, Yanda, et al.
Pubblicazione: (2024)
Utilizing Strategic Pre-training to Reduce Overfitting: Baguan -- A Pre-trained Weather Forecasting Model
di: Niu, Peisong, et al.
Pubblicazione: (2025)
di: Niu, Peisong, et al.
Pubblicazione: (2025)
Measuring Pre-training Data Quality without Labels for Time Series Foundation Models
di: Wen, Songkang, et al.
Pubblicazione: (2024)
di: Wen, Songkang, et al.
Pubblicazione: (2024)
Gradient-based Fine-Tuning through Pre-trained Model Regularization
di: Liu, Xuanbo, et al.
Pubblicazione: (2025)
di: Liu, Xuanbo, et al.
Pubblicazione: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
di: Song, Weixi, et al.
Pubblicazione: (2023)
di: Song, Weixi, et al.
Pubblicazione: (2023)
Slight Corruption in Pre-training Data Makes Better Diffusion Models
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
KG-TREAT: Pre-training for Treatment Effect Estimation by Synergizing Patient Data with Knowledge Graphs
di: Liu, Ruoqi, et al.
Pubblicazione: (2024)
di: Liu, Ruoqi, et al.
Pubblicazione: (2024)
OSF: On Pre-training and Scaling of Sleep Foundation Models
di: Shuai, Zitao, et al.
Pubblicazione: (2026)
di: Shuai, Zitao, et al.
Pubblicazione: (2026)
Scaling Laws for Pre-training Agents and World Models
di: Pearce, Tim, et al.
Pubblicazione: (2024)
di: Pearce, Tim, et al.
Pubblicazione: (2024)
A Pre-training Framework for Relational Data with Information-theoretic Principles
di: Truong, Quang, et al.
Pubblicazione: (2025)
di: Truong, Quang, et al.
Pubblicazione: (2025)
Stack Trace Deduplication: Faster, More Accurately, and in More Realistic Scenarios
di: Shibaev, Egor, et al.
Pubblicazione: (2024)
di: Shibaev, Egor, et al.
Pubblicazione: (2024)
Subequivariant Reinforcement Learning in 3D Multi-Entity Physical Environments
di: Chen, Runfa, et al.
Pubblicazione: (2024)
di: Chen, Runfa, et al.
Pubblicazione: (2024)
Endowing Pre-trained Graph Models with Provable Fairness
di: Zhang, Zhongjian, et al.
Pubblicazione: (2024)
di: Zhang, Zhongjian, et al.
Pubblicazione: (2024)
Urban Region Pre-training and Prompting: A Graph-based Approach
di: Jin, Jiahui, et al.
Pubblicazione: (2024)
di: Jin, Jiahui, et al.
Pubblicazione: (2024)
Mochi: Aligning Pre-training and Inference for Efficient Graph Foundation Models via Meta-Learning
di: Mattos, João, et al.
Pubblicazione: (2026)
di: Mattos, João, et al.
Pubblicazione: (2026)
GPD-1: Generative Pre-training for Driving
di: Xie, Zixun, et al.
Pubblicazione: (2024)
di: Xie, Zixun, et al.
Pubblicazione: (2024)
3D Interaction Geometric Pre-training for Molecular Relational Learning
di: Lee, Namkyeong, et al.
Pubblicazione: (2024)
di: Lee, Namkyeong, et al.
Pubblicazione: (2024)
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
Programming Every Example: Lifting Pre-training Data Quality Like Experts at Scale
di: Zhou, Fan, et al.
Pubblicazione: (2024)
di: Zhou, Fan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Learning Contrastive Feature Representations for Facial Action Unit Detection
di: Shang, Ziqiao, et al.
Pubblicazione: (2024) -
Machine Unlearning of Pre-trained Large Language Models
di: Yao, Jin, et al.
Pubblicazione: (2024) -
Feature Alignment: Rethinking Efficient Active Learning via Proxy in the Context of Pre-trained Models
di: Wen, Ziting, et al.
Pubblicazione: (2024) -
Privacy-Preserving Data Deduplication for Enhancing Federated Learning of Language Models (Extended Version)
di: Abadi, Aydin, et al.
Pubblicazione: (2024) -
Dataset Ownership Verification in Contrastive Pre-trained Models
di: Xie, Yuechen, et al.
Pubblicazione: (2025)