DIDS: Domain Impact-aware Data Sampling for Large Language Model Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Weijie, Zhang, Jipeng, Wu, Yaguang, Fang, Jingzhi, Zhang, Ruiyuan, Xu, Jiajie, Zhu, Jia, Chen, Hao, Zhao, Yao, Han, Sirui, Zhou, Xiaofang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Semantic-guided Diverse Decoding for Large Language Model
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
Benchmarking Multi-National Value Alignment for Large Language Models
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
LegalReasoner: Step-wised Verification-Correction for Legal Judgment Reasoning
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
HKGAI-V1: Towards Regional Sovereign Large Language Model for Hong Kong
par: Han, Sirui, et autres
Publié: (2025)
par: Han, Sirui, et autres
Publié: (2025)
Data-Aware Socratic Query Refinement in Database Systems
par: Zhang, Ruiyuan, et autres
Publié: (2025)
par: Zhang, Ruiyuan, et autres
Publié: (2025)
Reading Between the Timelines: RAG for Answering Diachronic Questions
par: Lau, Kwun Hang, et autres
Publié: (2025)
par: Lau, Kwun Hang, et autres
Publié: (2025)
ExeSQL: Self-Taught Text-to-SQL Models with Execution-Driven Bootstrapping for SQL Dialects
par: Zhang, Jipeng, et autres
Publié: (2025)
par: Zhang, Jipeng, et autres
Publié: (2025)
SpecBlock: Block-Iterative Speculative Decoding with Dynamic Tree Drafting
par: Shi, Weijie, et autres
Publié: (2026)
par: Shi, Weijie, et autres
Publié: (2026)
Zero-Shot Cellular Trajectory Map Matching
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
Cognitive-Uncertainty Guided Knowledge Distillation for Accurate Classification of Student Misconceptions
par: Liu, Qirui, et autres
Publié: (2026)
par: Liu, Qirui, et autres
Publié: (2026)
GEM: A Native Graph-based Index for Multi-Vector Retrieval
par: Tian, Yao, et autres
Publié: (2026)
par: Tian, Yao, et autres
Publié: (2026)
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
par: Pan, Rui, et autres
Publié: (2024)
par: Pan, Rui, et autres
Publié: (2024)
Toward Temporal Attribution Analytics in Dataflows
par: Kosyfaki, Chrysanthi, et autres
Publié: (2026)
par: Kosyfaki, Chrysanthi, et autres
Publié: (2026)
Cardinality Estimation for High Dimensional Similarity Queries with Adaptive Bucket Probing
par: Chen, Zhonghan, et autres
Publié: (2026)
par: Chen, Zhonghan, et autres
Publié: (2026)
Enhancing Tool Learning in Large Language Models with Hierarchical Error Checklists
par: Cui, Yue, et autres
Publié: (2025)
par: Cui, Yue, et autres
Publié: (2025)
E3-Rewrite: Learning to Rewrite SQL for Executability, Equivalence,and Efficiency
par: Xu, Dongjie, et autres
Publié: (2025)
par: Xu, Dongjie, et autres
Publié: (2025)
SSR3D-LLM: Structured Spatial Reasoning via Latent Steps for Fine-Grained Grounding in Unified 3D-LLMs
par: Li, Jiawei, et autres
Publié: (2026)
par: Li, Jiawei, et autres
Publié: (2026)
Consistent and Invariant Generalization Learning for Short-video Misinformation Detection
par: Guo, Hanghui, et autres
Publié: (2025)
par: Guo, Hanghui, et autres
Publié: (2025)
Pointing to a Llama and Call it a Camel: On the Sycophancy of Multimodal Large Language Models
par: Pi, Renjie, et autres
Publié: (2025)
par: Pi, Renjie, et autres
Publié: (2025)
R$^3$L: Reflect-then-Retry Reinforcement Learning with Language-Guided Exploration, Pivotal Credit, and Positive Amplification
par: Shi, Weijie, et autres
Publié: (2026)
par: Shi, Weijie, et autres
Publié: (2026)
Adaptation Method for Misinformation Identification
par: Chen, Yangping, et autres
Publié: (2025)
par: Chen, Yangping, et autres
Publié: (2025)
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
par: Shi, Haizhou, et autres
Publié: (2024)
par: Shi, Haizhou, et autres
Publié: (2024)
RW-TTT: Batched Serving for Request-Owned Test-Time Training State
par: Yang, Jian, et autres
Publié: (2026)
par: Yang, Jian, et autres
Publié: (2026)
Exploring the Meaningfulness of Nearest Neighbor Search in High-Dimensional Space
par: Chen, Zhonghan, et autres
Publié: (2024)
par: Chen, Zhonghan, et autres
Publié: (2024)
Token-wise Influential Training Data Retrieval for Large Language Models
par: Lin, Huawei, et autres
Publié: (2024)
par: Lin, Huawei, et autres
Publié: (2024)
On Domain-Adaptive Post-Training for Multimodal Large Language Models
par: Cheng, Daixuan, et autres
Publié: (2024)
par: Cheng, Daixuan, et autres
Publié: (2024)
Sample-aware Adaptive Structured Pruning for Large Language Models
par: Kong, Jun, et autres
Publié: (2025)
par: Kong, Jun, et autres
Publié: (2025)
DioR: Adaptive Cognitive Detection and Contextual Retrieval Optimization for Dynamic Retrieval-Augmented Generation
par: Guo, Hanghui, et autres
Publié: (2025)
par: Guo, Hanghui, et autres
Publié: (2025)
Exploring User Retrieval Integration towards Large Language Models for Cross-Domain Sequential Recommendation
par: Shen, Tingjia, et autres
Publié: (2024)
par: Shen, Tingjia, et autres
Publié: (2024)
Feature-aware Modulation for Learning from Temporal Tabular Data
par: Cai, Hao-Run, et autres
Publié: (2025)
par: Cai, Hao-Run, et autres
Publié: (2025)
Clickbait Detection via Large Language Models
par: Wang, Han, et autres
Publié: (2023)
par: Wang, Han, et autres
Publié: (2023)
Structure-aware Domain Knowledge Injection for Large Language Models
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Measuring Hong Kong Massive Multi-Task Language Understanding
par: Cao, Chuxue, et autres
Publié: (2025)
par: Cao, Chuxue, et autres
Publié: (2025)
VisualNeo: Bridging the Gap between Visual Query Interfaces and Graph Query Engines
par: Huang, Kai, et autres
Publié: (2026)
par: Huang, Kai, et autres
Publié: (2026)
Interaction Between YTH Domain‐Containing Family Protein 2 and SET Domain‐Containing Lysine Methyltransferase 7 Suppresses Autophagy in Osteoarthritis Chondrocytes, Exacerbating Cartilage Damage
par: Lexiang Li, et autres
Publié: (2025)
par: Lexiang Li, et autres
Publié: (2025)
Progressive Document-level Text Simplification via Large Language Models
par: Fang, Dengzhao, et autres
Publié: (2025)
par: Fang, Dengzhao, et autres
Publié: (2025)
On the Diversity of Synthetic Data and its Impact on Training Large Language Models
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
PIP: Perturbation-based Iterative Pruning for Large Language Models
par: Cao, Yi, et autres
Publié: (2025)
par: Cao, Yi, et autres
Publié: (2025)
Chain-Oriented Objective Logic with Neural Network Feedback Control and Cascade Filtering for Dynamic Multi-DSL Regulation
par: Han, Jipeng
Publié: (2024)
par: Han, Jipeng
Publié: (2024)
Documents similaires
-
Semantic-guided Diverse Decoding for Large Language Model
par: Shi, Weijie, et autres
Publié: (2025) -
Benchmarking Multi-National Value Alignment for Large Language Models
par: Shi, Weijie, et autres
Publié: (2025) -
LegalReasoner: Step-wised Verification-Correction for Legal Judgment Reasoning
par: Shi, Weijie, et autres
Publié: (2025) -
HKGAI-V1: Towards Regional Sovereign Large Language Model for Hong Kong
par: Han, Sirui, et autres
Publié: (2025) -
Data-Aware Socratic Query Refinement in Database Systems
par: Zhang, Ruiyuan, et autres
Publié: (2025)