Dynamic Vision Mamba
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Mengxuan, Li, Zekai, Liang, Zhiyuan, Li, Moyang, Zhao, Xuanlei, Khaki, Samir, Zhu, Zheng, Peng, Xiaojiang, Plataniotis, Konstantinos N., Wang, Kai, Zhao, Wangbo, You, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Faster Vision Mamba is Rebuilt in Minutes via Merged Token Re-training
di: Shi, Mingjia, et al.
Pubblicazione: (2024)
di: Shi, Mingjia, et al.
Pubblicazione: (2024)
The Need for Speed: Pruning Transformers with One Recipe
di: Khaki, Samir, et al.
Pubblicazione: (2024)
di: Khaki, Samir, et al.
Pubblicazione: (2024)
Prioritize Alignment in Dataset Distillation
di: Li, Zekai, et al.
Pubblicazione: (2024)
di: Li, Zekai, et al.
Pubblicazione: (2024)
Emphasizing Discriminative Features for Dataset Distillation in Complex Scenarios
di: Wang, Kai, et al.
Pubblicazione: (2024)
di: Wang, Kai, et al.
Pubblicazione: (2024)
ProbMCL: Simple Probabilistic Contrastive Learning for Multi-label Visual Classification
di: Sajedi, Ahmad, et al.
Pubblicazione: (2024)
di: Sajedi, Ahmad, et al.
Pubblicazione: (2024)
EA-ViT: Efficient Adaptation for Elastic Vision Transformer
di: Zhu, Chen, et al.
Pubblicazione: (2025)
di: Zhu, Chen, et al.
Pubblicazione: (2025)
REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
di: Wang, Ziqiao, et al.
Pubblicazione: (2025)
di: Wang, Ziqiao, et al.
Pubblicazione: (2025)
ATOM: Attention Mixer for Efficient Dataset Distillation
di: Khaki, Samir, et al.
Pubblicazione: (2024)
di: Khaki, Samir, et al.
Pubblicazione: (2024)
Drag-and-Drop LLMs: Zero-Shot Prompt-to-Weights
di: Liang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Liang, Zhiyuan, et al.
Pubblicazione: (2025)
Data-to-Model Distillation: Data-Efficient Learning Framework
di: Sajedi, Ahmad, et al.
Pubblicazione: (2024)
di: Sajedi, Ahmad, et al.
Pubblicazione: (2024)
DataDAM: Efficient Dataset Distillation with Attention Matching
di: Sajedi, Ahmad, et al.
Pubblicazione: (2023)
di: Sajedi, Ahmad, et al.
Pubblicazione: (2023)
Real-Time Video Generation with Pyramid Attention Broadcast
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
SparseLoRA: Accelerating LLM Fine-Tuning with Contextual Sparsity
di: Khaki, Samir, et al.
Pubblicazione: (2025)
di: Khaki, Samir, et al.
Pubblicazione: (2025)
SparseVILA: Decoupling Visual Sparsity for Efficient VLM Inference
di: Khaki, Samir, et al.
Pubblicazione: (2025)
di: Khaki, Samir, et al.
Pubblicazione: (2025)
ResearchGPT: Benchmarking and Training LLMs for End-to-End Computer Science Research Workflows
di: Wang, Penghao, et al.
Pubblicazione: (2025)
di: Wang, Penghao, et al.
Pubblicazione: (2025)
DSP: Dynamic Sequence Parallelism for Multi-Dimensional Transformers
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
Active Inference and Reinforcement Learning: A unified inference on continuous state and action spaces under partial observability
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2022)
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2022)
Mamba-Enhanced Text-Audio-Video Alignment Network for Emotion Recognition in Conversations
di: Li, Xinran, et al.
Pubblicazione: (2024)
di: Li, Xinran, et al.
Pubblicazione: (2024)
HelixPipe: Efficient Distributed Training of Long Sequence Transformers with Attention Parallel Pipeline Parallelism
di: Zhang, Geng, et al.
Pubblicazione: (2025)
di: Zhang, Geng, et al.
Pubblicazione: (2025)
Dynamic Diffusion Transformer
di: Zhao, Wangbo, et al.
Pubblicazione: (2024)
di: Zhao, Wangbo, et al.
Pubblicazione: (2024)
A Closer Look at Time Steps is Worthy of Triple Speed-Up for Diffusion Model Training
di: Wang, Kai, et al.
Pubblicazione: (2024)
di: Wang, Kai, et al.
Pubblicazione: (2024)
DD-Ranking: Rethinking the Evaluation of Dataset Distillation
di: Li, Zekai, et al.
Pubblicazione: (2025)
di: Li, Zekai, et al.
Pubblicazione: (2025)
StarTrail: Concentric Ring Sequence Parallelism for Efficient Near-Infinite-Context Transformer Model Training
di: Liu, Ziming, et al.
Pubblicazione: (2024)
di: Liu, Ziming, et al.
Pubblicazione: (2024)
Recurrent Diffusion for Large-Scale Parameter Generation
di: Wang, Kai, et al.
Pubblicazione: (2025)
di: Wang, Kai, et al.
Pubblicazione: (2025)
A unified uncertainty-aware exploration: Combining epistemic and aleatory uncertainty
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2024)
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2024)
Uncertainty-aware transfer across tasks using hybrid model-based successor feature reinforcement learning
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2023)
di: Malekzadeh, Parvin, et al.
Pubblicazione: (2023)
MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
di: Xu, Zhaopan, et al.
Pubblicazione: (2025)
di: Xu, Zhaopan, et al.
Pubblicazione: (2025)
Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
di: Zhao, Wangbo, et al.
Pubblicazione: (2024)
di: Zhao, Wangbo, et al.
Pubblicazione: (2024)
Distribution Alignment for Fully Test-Time Adaptation with Dynamic Online Data Streams
di: Wang, Ziqiang, et al.
Pubblicazione: (2024)
di: Wang, Ziqiang, et al.
Pubblicazione: (2024)
Ultraspherical Spectral Method for Block Copolymer Systems on Unit Disk
di: Luo, Wangbo, et al.
Pubblicazione: (2024)
di: Luo, Wangbo, et al.
Pubblicazione: (2024)
Double Fourier Sphere Methods with Low Rank Approximation for Block Copolymer Systems on Sphere
di: Luo, Wangbo, et al.
Pubblicazione: (2025)
di: Luo, Wangbo, et al.
Pubblicazione: (2025)
Asymptotically compatible schemes for nonlocal Ohta–Kawasaki model
di: Wangbo Luo, et al.
Pubblicazione: (2024)
di: Wangbo Luo, et al.
Pubblicazione: (2024)
HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
Enhance-A-Video: Better Generated Video for Free
di: Luo, Yang, et al.
Pubblicazione: (2025)
di: Luo, Yang, et al.
Pubblicazione: (2025)
Test-Time Domain Adaptation by Learning Domain-Aware Batch Normalization
di: Wu, Yanan, et al.
Pubblicazione: (2023)
di: Wu, Yanan, et al.
Pubblicazione: (2023)
USB-NeRF: Unrolling Shutter Bundle Adjusted Neural Radiance Fields
di: Li, Moyang, et al.
Pubblicazione: (2023)
di: Li, Moyang, et al.
Pubblicazione: (2023)
Data Efficient Any Transformer-to-Mamba Distillation via Attention Bridge
di: Wang, Penghao, et al.
Pubblicazione: (2025)
di: Wang, Penghao, et al.
Pubblicazione: (2025)
The Missing Point in Vision Transformers for Universal Image Segmentation
di: Shahabodini, Sajjad, et al.
Pubblicazione: (2025)
di: Shahabodini, Sajjad, et al.
Pubblicazione: (2025)
CDIO: Cross-Domain Inference Optimization with Resource Preference Prediction for Edge-Cloud Collaboration
di: Yang, Zheming, et al.
Pubblicazione: (2025)
di: Yang, Zheming, et al.
Pubblicazione: (2025)
PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models
di: Xu, Zhaopan, et al.
Pubblicazione: (2025)
di: Xu, Zhaopan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Faster Vision Mamba is Rebuilt in Minutes via Merged Token Re-training
di: Shi, Mingjia, et al.
Pubblicazione: (2024) -
The Need for Speed: Pruning Transformers with One Recipe
di: Khaki, Samir, et al.
Pubblicazione: (2024) -
Prioritize Alignment in Dataset Distillation
di: Li, Zekai, et al.
Pubblicazione: (2024) -
Emphasizing Discriminative Features for Dataset Distillation in Complex Scenarios
di: Wang, Kai, et al.
Pubblicazione: (2024) -
ProbMCL: Simple Probabilistic Contrastive Learning for Multi-label Visual Classification
di: Sajedi, Ahmad, et al.
Pubblicazione: (2024)