UNSEEN: Enhancing Dataset Pruning from a Generalization Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Furui, Wang, Shaobo, Zhang, Jiajun, Sun, Chenghao, Tang, Haixiang, Zhang, Linfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dataset Distillation with Neural Characteristic Function: A Minmax Perspective
par: Wang, Shaobo, et autres
Publié: (2025)
par: Wang, Shaobo, et autres
Publié: (2025)
Not All Samples Should Be Utilized Equally: Towards Understanding and Improving Dataset Distillation
par: Wang, Shaobo, et autres
Publié: (2024)
par: Wang, Shaobo, et autres
Publié: (2024)
Towards Principled Dataset Distillation: A Spectral Distribution Perspective
par: Wu, Ruixi, et autres
Publié: (2026)
par: Wu, Ruixi, et autres
Publié: (2026)
DRUPI: Dataset Reduction Using Privileged Information
par: Wang, Shaobo, et autres
Publié: (2024)
par: Wang, Shaobo, et autres
Publié: (2024)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
par: Zhang, Qizhe, et autres
Publié: (2024)
par: Zhang, Qizhe, et autres
Publié: (2024)
Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction
par: Jiao, Zhengbo, et autres
Publié: (2026)
par: Jiao, Zhengbo, et autres
Publié: (2026)
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
par: Zhang, Chengsheng, et autres
Publié: (2026)
par: Zhang, Chengsheng, et autres
Publié: (2026)
SP-VLA: A Joint Model Scheduling and Token Pruning Approach for VLA Model Acceleration
par: Li, Ye, et autres
Publié: (2025)
par: Li, Ye, et autres
Publié: (2025)
ImagebindDC: Compressing Multi-modal Data with Imagebind-based Condensation
par: Min, Yue, et autres
Publié: (2025)
par: Min, Yue, et autres
Publié: (2025)
Challenges and Trends in Egocentric Vision: A Survey
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
ForestPrune: High-ratio Visual Token Compression for Video Multimodal Large Language Models via Spatial-Temporal Forest Modeling
par: Ju, Shaobo, et autres
Publié: (2026)
par: Ju, Shaobo, et autres
Publié: (2026)
Unified Batch Normalization: Identifying and Alleviating the Feature Condensation in Batch Normalization and a Unified Framework
par: Wang, Shaobo, et autres
Publié: (2023)
par: Wang, Shaobo, et autres
Publié: (2023)
Accelerating Diffusion Models with One-to-Many Knowledge Distillation
par: Zhang, Linfeng, et autres
Publié: (2024)
par: Zhang, Linfeng, et autres
Publié: (2024)
OmniScience: A Large-scale Multi-modal Dataset for Scientific Image Understanding
par: Tao, Haoyi, et autres
Publié: (2026)
par: Tao, Haoyi, et autres
Publié: (2026)
Model Compression using Progressive Channel Pruning
par: Guo, Jinyang, et autres
Publié: (2025)
par: Guo, Jinyang, et autres
Publié: (2025)
Synthesizing Multimodal Geometry Datasets from Scratch and Enabling Visual Alignment via Plotting Code
par: Lin, Haobo, et autres
Publié: (2026)
par: Lin, Haobo, et autres
Publié: (2026)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
par: Zhang, Pu, et autres
Publié: (2025)
par: Zhang, Pu, et autres
Publié: (2025)
Temporal Aware Pruning for Efficient Diffusion-based Video Generation
par: Li, Sheng, et autres
Publié: (2026)
par: Li, Sheng, et autres
Publié: (2026)
Enhanced Semantic Segmentation Pipeline for WeatherProof Dataset Challenge
par: Zhang, Nan, et autres
Publié: (2024)
par: Zhang, Nan, et autres
Publié: (2024)
Long-Tailed Classification Based on Coarse-Grained Leading Forest and Multi-Center Loss
par: Yang, Jinye, et autres
Publié: (2023)
par: Yang, Jinye, et autres
Publié: (2023)
FastDriveVLA: Efficient End-to-End Driving via Plug-and-Play Reconstruction-based Token Pruning
par: Cao, Jiajun, et autres
Publié: (2025)
par: Cao, Jiajun, et autres
Publié: (2025)
SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
par: Liu, Jiacheng, et autres
Publié: (2025)
par: Liu, Jiacheng, et autres
Publié: (2025)
Distill Gold from Massive Ores: Bi-level Data Pruning towards Efficient Dataset Distillation
par: Xu, Yue, et autres
Publié: (2023)
par: Xu, Yue, et autres
Publié: (2023)
ST-Prune: Training-Free Spatio-Temporal Token Pruning for Vision-Language Models in Autonomous Driving
par: Sha, Lin, et autres
Publié: (2026)
par: Sha, Lin, et autres
Publié: (2026)
TransPrune: Token Transition Pruning for Efficient Large Vision-Language Model
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
OpenGPT-4o-Image: A Comprehensive Dataset for Advanced Image Generation and Editing
par: Chen, Zhihong, et autres
Publié: (2025)
par: Chen, Zhihong, et autres
Publié: (2025)
A Second-Order Perspective on Pruning at Initialization and Knowledge Transfer
par: Iurada, Leonardo, et autres
Publié: (2025)
par: Iurada, Leonardo, et autres
Publié: (2025)
Enhanced Structured Lasso Pruning with Class-wise Information
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
Human-Guided Image Generation for Expanding Small-Scale Training Image Datasets
par: Chen, Changjian, et autres
Publié: (2024)
par: Chen, Changjian, et autres
Publié: (2024)
Prefill-Time Intervention for Mitigating Hallucination in Large Vision-Language Models
par: Zhang, Chengsheng, et autres
Publié: (2026)
par: Zhang, Chengsheng, et autres
Publié: (2026)
UI-Ins: Enhancing GUI Grounding with Multi-Perspective Instruction-as-Reasoning
par: Chen, Liangyu, et autres
Publié: (2025)
par: Chen, Liangyu, et autres
Publié: (2025)
PruneHal: Reducing Hallucinations in Multi-modal Large Language Models through Adaptive KV Cache Pruning
par: Sun, Fengyuan, et autres
Publié: (2025)
par: Sun, Fengyuan, et autres
Publié: (2025)
MASC: Boosting Autoregressive Image Generation with a Manifold-Aligned Semantic Clustering
par: He, Lixuan, et autres
Publié: (2025)
par: He, Lixuan, et autres
Publié: (2025)
AnomalyAgent: Agentic Industrial Anomaly Synthesis via Tool-Augmented Reinforcement Learning
par: Su, Jiaming, et autres
Publié: (2026)
par: Su, Jiaming, et autres
Publié: (2026)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
par: Chien, Tzu-Chun, et autres
Publié: (2025)
par: Chien, Tzu-Chun, et autres
Publié: (2025)
RU-AI: A Large Multimodal Dataset for Machine-Generated Content Detection
par: Huang, Liting, et autres
Publié: (2024)
par: Huang, Liting, et autres
Publié: (2024)
Region-to-Region: Enhancing Generative Image Harmonization with Adaptive Regional Injection
par: Zhang, Zhiqiu, et autres
Publié: (2025)
par: Zhang, Zhiqiu, et autres
Publié: (2025)
WeatherDG: LLM-assisted Diffusion Model for Procedural Weather Generation in Domain-Generalized Semantic Segmentation
par: Qian, Chenghao, et autres
Publié: (2024)
par: Qian, Chenghao, et autres
Publié: (2024)
A High-Quality Dataset and Reliable Evaluation for Interleaved Image-Text Generation
par: Feng, Yukang, et autres
Publié: (2025)
par: Feng, Yukang, et autres
Publié: (2025)
Content-Conditioned Generation of Stylized Free hand Sketches
par: Liu, Jiajun, et autres
Publié: (2024)
par: Liu, Jiajun, et autres
Publié: (2024)
Documents similaires
-
Dataset Distillation with Neural Characteristic Function: A Minmax Perspective
par: Wang, Shaobo, et autres
Publié: (2025) -
Not All Samples Should Be Utilized Equally: Towards Understanding and Improving Dataset Distillation
par: Wang, Shaobo, et autres
Publié: (2024) -
Towards Principled Dataset Distillation: A Spectral Distribution Perspective
par: Wu, Ruixi, et autres
Publié: (2026) -
DRUPI: Dataset Reduction Using Privileged Information
par: Wang, Shaobo, et autres
Publié: (2024) -
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
par: Zhang, Qizhe, et autres
Publié: (2024)