Meta-rater: A Multi-dimensional Data Selection Method for Pre-training Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhuang, Xinlin, Peng, Jiahui, Ma, Ren, Wang, Yinfan, Bai, Tianyi, Wei, Xingjian, Qiu, Jiantao, Zhang, Chi, Qian, Ying, He, Conghui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Topic Over Source: The Key to Effective Data Mixing for Language Models Pre-training
por: Peng, Jiahui, et al.
Publicado: (2025)
por: Peng, Jiahui, et al.
Publicado: (2025)
Efficient Pretraining Data Selection for Language Models via Multi-Actor Collaboration
por: Bai, Tianyi, et al.
Publicado: (2024)
por: Bai, Tianyi, et al.
Publicado: (2024)
Harnessing Diversity for Important Data Selection in Pretraining Large Language Models
por: Zhang, Chi, et al.
Publicado: (2024)
por: Zhang, Chi, et al.
Publicado: (2024)
VADE: Variance-Aware Dynamic Sampling via Online Sample-Level Difficulty Estimation for Multimodal RL
por: Hu, Zengjie, et al.
Publicado: (2025)
por: Hu, Zengjie, et al.
Publicado: (2025)
Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification
por: Bai, Tianyi, et al.
Publicado: (2025)
por: Bai, Tianyi, et al.
Publicado: (2025)
Hallucination at a Glance: Controlled Visual Edits and Fine-Grained Multimodal Learning
por: Bai, Tianyi, et al.
Publicado: (2025)
por: Bai, Tianyi, et al.
Publicado: (2025)
Wasserstein distributional adversarial training for deep neural networks
por: Bai, Xingjian, et al.
Publicado: (2025)
por: Bai, Xingjian, et al.
Publicado: (2025)
OPUS: Towards Efficient and Principled Data Selection in Large Language Model Pre-training in Every Iteration
por: Wang, Shaobo, et al.
Publicado: (2026)
por: Wang, Shaobo, et al.
Publicado: (2026)
GTR-CoT: Graph Traversal as Visual Chain of Thought for Molecular Structure Recognition
por: Wang, Jingchao, et al.
Publicado: (2025)
por: Wang, Jingchao, et al.
Publicado: (2025)
MetaDAT: Generalizable Trajectory Prediction via Meta Pre-training and Data-Adaptive Test-Time Updating
por: Wang, Yuning, et al.
Publicado: (2026)
por: Wang, Yuning, et al.
Publicado: (2026)
Molecular Identifier Visual Prompt and Verifiable Reinforcement Learning for Chemical Reaction Diagram Parsing
por: Song, Jiahe, et al.
Publicado: (2026)
por: Song, Jiahe, et al.
Publicado: (2026)
AFL: A Single-Round Analytic Approach for Federated Learning with Pre-trained Models
por: He, Run, et al.
Publicado: (2024)
por: He, Run, et al.
Publicado: (2024)
“P‐Strengthening Strategy” of Nickel Single‐Atom Catalyst With Boosting Selective Generation of Nonradicals: Synergy of Metal Center and Substrate
por: Jiantao Tong, et al.
Publicado: (2025)
por: Jiantao Tong, et al.
Publicado: (2025)
Incorporating Pre-training Data Matters in Unsupervised Domain Adaptation
por: Xu, Yinsong, et al.
Publicado: (2023)
por: Xu, Yinsong, et al.
Publicado: (2023)
VisionPAD: A Vision-Centric Pre-training Paradigm for Autonomous Driving
por: Zhang, Haiming, et al.
Publicado: (2024)
por: Zhang, Haiming, et al.
Publicado: (2024)
3D Scene Graph Guided Vision-Language Pre-training
por: Liu, Hao, et al.
Publicado: (2024)
por: Liu, Hao, et al.
Publicado: (2024)
Universal Adversarial Perturbations for Vision-Language Pre-trained Models
por: Zhang, Peng-Fei, et al.
Publicado: (2024)
por: Zhang, Peng-Fei, et al.
Publicado: (2024)
LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training
por: Zhu, Tong, et al.
Publicado: (2024)
por: Zhu, Tong, et al.
Publicado: (2024)
A Unified Understanding of Offline Data Selection and Online Self-refining Generation for Post-training LLMs
por: Xiao, Quan, et al.
Publicado: (2025)
por: Xiao, Quan, et al.
Publicado: (2025)
SHapley Estimated Explanation (SHEP): A Fast Post-Hoc Attribution Method for Interpreting Intelligent Fault Diagnosis
por: Chen, Qian, et al.
Publicado: (2025)
por: Chen, Qian, et al.
Publicado: (2025)
Point Cloud Unsupervised Pre-training via 3D Gaussian Splatting
por: Liu, Hao, et al.
Publicado: (2024)
por: Liu, Hao, et al.
Publicado: (2024)
An Aggregation‐Induced Emission Active Peptide‐Based Fluorescent Probe for Highly Selective and Sensitive Detection of Hg(II) Ions and Its Multifield Applications
por: Shiyi Xiong, et al.
Publicado: (2025)
por: Shiyi Xiong, et al.
Publicado: (2025)
Learn or Recall? Revisiting Incremental Learning with Pre-trained Language Models
por: Zheng, Junhao, et al.
Publicado: (2023)
por: Zheng, Junhao, et al.
Publicado: (2023)
Rational Design of Cobalt Phthalocyanine (CoPc)‐Anchored TiO 2 Nanorods for High‐Efficiency Selective Catalytic Oxidation
por: Simeng Zhu, et al.
Publicado: (2024)
por: Simeng Zhu, et al.
Publicado: (2024)
RxnCaption: Reformulating Reaction Diagram Parsing as Visual Prompt Guided Captioning
por: Song, Jiahe, et al.
Publicado: (2025)
por: Song, Jiahe, et al.
Publicado: (2025)
Dripper: Token-Efficient Main HTML Extraction with a Lightweight LM
por: Liu, Mengjie, et al.
Publicado: (2025)
por: Liu, Mengjie, et al.
Publicado: (2025)
MAA: Meticulous Adversarial Attack against Vision-Language Pre-trained Models
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
por: Zhang, Peng-Fei, et al.
Publicado: (2025)
Fractional Denoising for 3D Molecular Pre-training
por: Feng, Shikun, et al.
Publicado: (2023)
por: Feng, Shikun, et al.
Publicado: (2023)
Parallel Structures in Pre-training Data Yield In-Context Learning
por: Chen, Yanda, et al.
Publicado: (2024)
por: Chen, Yanda, et al.
Publicado: (2024)
KeyVideoLLM: Towards Large-scale Video Keyframe Selection
por: Liang, Hao, et al.
Publicado: (2024)
por: Liang, Hao, et al.
Publicado: (2024)
Hidding the Ghostwriters: An Adversarial Evaluation of AI-Generated Student Essay Detection
por: Peng, Xinlin, et al.
Publicado: (2024)
por: Peng, Xinlin, et al.
Publicado: (2024)
Task Groupings Regularization: Data-Free Meta-Learning with Heterogeneous Pre-trained Models
por: Wei, Yongxian, et al.
Publicado: (2024)
por: Wei, Yongxian, et al.
Publicado: (2024)
ASteISR: Adapting Single Image Super-resolution Pre-trained Model for Efficient Stereo Image Super-resolution
por: Zhou, Yuanbo, et al.
Publicado: (2024)
por: Zhou, Yuanbo, et al.
Publicado: (2024)
Contrastive Pre-training for Deep Session Data Understanding
por: Li, Zixuan, et al.
Publicado: (2024)
por: Li, Zixuan, et al.
Publicado: (2024)
Not All Documents Are What You Need for Extracting Instruction Tuning Data
por: Zhang, Chi, et al.
Publicado: (2025)
por: Zhang, Chi, et al.
Publicado: (2025)
SoftDedup: an Efficient Data Reweighting Method for Speeding Up Language Model Pre-training
por: He, Nan, et al.
Publicado: (2024)
por: He, Nan, et al.
Publicado: (2024)
Unleashing the Power of Pre-trained Encoders for Universal Adversarial Attack Detection
por: Zhang, Yinghe, et al.
Publicado: (2025)
por: Zhang, Yinghe, et al.
Publicado: (2025)
Is Pre-training Truly Better Than Meta-Learning?
por: Miranda, Brando, et al.
Publicado: (2023)
por: Miranda, Brando, et al.
Publicado: (2023)
Towards Unified Representation of Multi-Modal Pre-training for 3D Understanding via Differentiable Rendering
por: Fei, Ben, et al.
Publicado: (2024)
por: Fei, Ben, et al.
Publicado: (2024)
VIP: Vision Instructed Pre-training for Robotic Manipulation
por: Li, Zhuoling, et al.
Publicado: (2024)
por: Li, Zhuoling, et al.
Publicado: (2024)
Ejemplares similares
-
Topic Over Source: The Key to Effective Data Mixing for Language Models Pre-training
por: Peng, Jiahui, et al.
Publicado: (2025) -
Efficient Pretraining Data Selection for Language Models via Multi-Actor Collaboration
por: Bai, Tianyi, et al.
Publicado: (2024) -
Harnessing Diversity for Important Data Selection in Pretraining Large Language Models
por: Zhang, Chi, et al.
Publicado: (2024) -
VADE: Variance-Aware Dynamic Sampling via Online Sample-Level Difficulty Estimation for Multimodal RL
por: Hu, Zengjie, et al.
Publicado: (2025) -
Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification
por: Bai, Tianyi, et al.
Publicado: (2025)