EfficientTrain++: Generalized Curriculum Learning for Efficient Visual Backbone Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yulin, Yue, Yang, Lu, Rui, Han, Yizeng, Song, Shiji, Huang, Gao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Emulating Human-like Adaptive Vision for Efficient and Flexible Machine Visual Perception
di: Wang, Yulin, et al.
Pubblicazione: (2025)
di: Wang, Yulin, et al.
Pubblicazione: (2025)
Uni-AdaFocus: Spatial-temporal Dynamic Computation for Video Recognition
di: Wang, Yulin, et al.
Pubblicazione: (2024)
di: Wang, Yulin, et al.
Pubblicazione: (2024)
HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
di: Tang, Haotian, et al.
Pubblicazione: (2024)
di: Tang, Haotian, et al.
Pubblicazione: (2024)
Scale Efficient Training for Large Datasets
di: Zhou, Qing, et al.
Pubblicazione: (2025)
di: Zhou, Qing, et al.
Pubblicazione: (2025)
Revisiting Non-Autoregressive Transformers for Efficient Image Synthesis
di: Ni, Zanlin, et al.
Pubblicazione: (2024)
di: Ni, Zanlin, et al.
Pubblicazione: (2024)
Probabilistic Contrastive Learning for Long-Tailed Visual Recognition
di: Du, Chaoqun, et al.
Pubblicazione: (2024)
di: Du, Chaoqun, et al.
Pubblicazione: (2024)
Generate Any Scene: Scene Graph Driven Data Synthesis for Visual Generation Training
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
di: Gao, Ziqi, et al.
Pubblicazione: (2024)
FP4 Explore, BF16 Train: Diffusion Reinforcement Learning via Efficient Rollout Scaling
di: Li, Yitong, et al.
Pubblicazione: (2026)
di: Li, Yitong, et al.
Pubblicazione: (2026)
ViR: Towards Efficient Vision Retention Backbones
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2023)
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2023)
Efficient and Robust Quantization-aware Training via Adaptive Coreset Selection
di: Huang, Xijie, et al.
Pubblicazione: (2023)
di: Huang, Xijie, et al.
Pubblicazione: (2023)
Empowering Backbone Models for Visual Text Generation with Input Granularity Control and Glyph-Aware Training
di: Li, Wenbo, et al.
Pubblicazione: (2024)
di: Li, Wenbo, et al.
Pubblicazione: (2024)
Efficient Training with Denoised Neural Weights
di: Gong, Yifan, et al.
Pubblicazione: (2024)
di: Gong, Yifan, et al.
Pubblicazione: (2024)
Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?
di: Yue, Yang, et al.
Pubblicazione: (2025)
di: Yue, Yang, et al.
Pubblicazione: (2025)
Proactive Gradient Conflict Mitigation in Multi-Task Learning: A Sparse Training Perspective
di: Zhang, Zhi, et al.
Pubblicazione: (2024)
di: Zhang, Zhi, et al.
Pubblicazione: (2024)
Vision Backbone Efficient Selection for Image Classification in Low-Data Regimes
di: Guerin, Joris, et al.
Pubblicazione: (2024)
di: Guerin, Joris, et al.
Pubblicazione: (2024)
A General and Efficient Training for Transformer via Token Expansion
di: Huang, Wenxuan, et al.
Pubblicazione: (2024)
di: Huang, Wenxuan, et al.
Pubblicazione: (2024)
E$^{2}$GAN: Efficient Training of Efficient GANs for Image-to-Image Translation
di: Gong, Yifan, et al.
Pubblicazione: (2024)
di: Gong, Yifan, et al.
Pubblicazione: (2024)
Pre-Training Meta-Rule Selection Policy for Visual Generative Abductive Learning
di: Jin, Yu, et al.
Pubblicazione: (2025)
di: Jin, Yu, et al.
Pubblicazione: (2025)
FastDINOv2: Frequency Based Curriculum Learning Improves Robustness and Training Speed
di: Zhang, Jiaqi, et al.
Pubblicazione: (2025)
di: Zhang, Jiaqi, et al.
Pubblicazione: (2025)
DeeR-VLA: Dynamic Inference of Multimodal Large Language Models for Efficient Robot Execution
di: Yue, Yang, et al.
Pubblicazione: (2024)
di: Yue, Yang, et al.
Pubblicazione: (2024)
FACTR: Force-Attending Curriculum Training for Contact-Rich Policy Learning
di: Liu, Jason Jingzhou, et al.
Pubblicazione: (2025)
di: Liu, Jason Jingzhou, et al.
Pubblicazione: (2025)
CMT: Mid-Training for Efficient Learning of Consistency, Mean Flow, and Flow Map Models
di: Hu, Zheyuan, et al.
Pubblicazione: (2025)
di: Hu, Zheyuan, et al.
Pubblicazione: (2025)
ENAT: Rethinking Spatial-temporal Interactions in Token-based Image Synthesis
di: Ni, Zanlin, et al.
Pubblicazione: (2024)
di: Ni, Zanlin, et al.
Pubblicazione: (2024)
Efficient Multi-turn RL for GUI Agents via Decoupled Training and Adaptive Data Curation
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
FlashVID: Efficient Video Large Language Models via Training-free Tree-based Spatiotemporal Token Merging
di: Fan, Ziyang, et al.
Pubblicazione: (2026)
di: Fan, Ziyang, et al.
Pubblicazione: (2026)
JetViT: Efficient High-Resolution Vision Transformer with Post-Training Attention Search
di: Zou, Dongyun, et al.
Pubblicazione: (2026)
di: Zou, Dongyun, et al.
Pubblicazione: (2026)
Diffusion Adversarial Post-Training for One-Step Video Generation
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
Meta-Semi: A Meta-learning Approach for Semi-supervised Learning
di: Wang, Yulin, et al.
Pubblicazione: (2020)
di: Wang, Yulin, et al.
Pubblicazione: (2020)
Latency-aware Unified Dynamic Networks for Efficient Image Recognition
di: Han, Yizeng, et al.
Pubblicazione: (2023)
di: Han, Yizeng, et al.
Pubblicazione: (2023)
Free Video-LLM: Prompt-guided Visual Perception for Efficient Training-free Video LLMs
di: Han, Kai, et al.
Pubblicazione: (2024)
di: Han, Kai, et al.
Pubblicazione: (2024)
The Temporal Trap: Entanglement in Pre-Trained Visual Representations for Visuomotor Policy Learning
di: Tsagkas, Nikolaos, et al.
Pubblicazione: (2025)
di: Tsagkas, Nikolaos, et al.
Pubblicazione: (2025)
What Drives Compositional Generalization? The Importance of Continuous Training Objectives in Visual Generative Models
di: Farid, Karim, et al.
Pubblicazione: (2025)
di: Farid, Karim, et al.
Pubblicazione: (2025)
Efficient Training for Human Video Generation with Entropy-Guided Prioritized Progressive Learning
di: Li, Changlin, et al.
Pubblicazione: (2025)
di: Li, Changlin, et al.
Pubblicazione: (2025)
Automatic Joint Structured Pruning and Quantization for Efficient Neural Network Training and Compression
di: Qu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Qu, Xiaoyi, et al.
Pubblicazione: (2025)
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
Vision-LSTM: xLSTM as Generic Vision Backbone
di: Alkin, Benedikt, et al.
Pubblicazione: (2024)
di: Alkin, Benedikt, et al.
Pubblicazione: (2024)
The Surprising Ineffectiveness of Pre-Trained Visual Representations for Model-Based Reinforcement Learning
di: Schneider, Moritz, et al.
Pubblicazione: (2024)
di: Schneider, Moritz, et al.
Pubblicazione: (2024)
ScalSelect: Scalable Training-Free Multimodal Data Selection for Efficient Visual Instruction Tuning
di: Wu, Changti, et al.
Pubblicazione: (2026)
di: Wu, Changti, et al.
Pubblicazione: (2026)
GSVA: Generalized Segmentation via Multimodal Large Language Models
di: Xia, Zhuofan, et al.
Pubblicazione: (2023)
di: Xia, Zhuofan, et al.
Pubblicazione: (2023)
Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation
di: Zhang, Zhuoyang, et al.
Pubblicazione: (2025)
di: Zhang, Zhuoyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Emulating Human-like Adaptive Vision for Efficient and Flexible Machine Visual Perception
di: Wang, Yulin, et al.
Pubblicazione: (2025) -
Uni-AdaFocus: Spatial-temporal Dynamic Computation for Video Recognition
di: Wang, Yulin, et al.
Pubblicazione: (2024) -
HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
di: Tang, Haotian, et al.
Pubblicazione: (2024) -
Scale Efficient Training for Large Datasets
di: Zhou, Qing, et al.
Pubblicazione: (2025) -
Revisiting Non-Autoregressive Transformers for Efficient Image Synthesis
di: Ni, Zanlin, et al.
Pubblicazione: (2024)