TransMamba: Fast Universal Architecture Adaption from Transformers to Mamba
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Xiuwei, Hu, Wentao, Dong, Xiao, Lin, Sihao, Chen, Zisheng, Cao, Meng, Zhuang, Yina, Han, Jianhua, Xu, Hang, Liang, Xiaodan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TransMamba: A Sequence-Level Hybrid Transformer-Mamba Language Model
por: Li, Yixing, et al.
Publicado: (2025)
por: Li, Yixing, et al.
Publicado: (2025)
C2-Evo: Co-Evolving Multimodal Data and Model for Self-Improving Reasoning
por: Chen, Xiuwei, et al.
Publicado: (2025)
por: Chen, Xiuwei, et al.
Publicado: (2025)
SemHiTok: A Unified Image Tokenizer via Semantic-Guided Hierarchical Codebook for Multimodal Understanding and Generation
por: Chen, Zisheng, et al.
Publicado: (2025)
por: Chen, Zisheng, et al.
Publicado: (2025)
GeoMamba: A Geometry-driven MambaVision Framework and Dataset for Fine-grained Optical-SAR Object Retrieval
por: Fang, Tiantong, et al.
Publicado: (2026)
por: Fang, Tiantong, et al.
Publicado: (2026)
AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots
por: Zhang, Likui, et al.
Publicado: (2026)
por: Zhang, Likui, et al.
Publicado: (2026)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
por: Chen, Wenchao, et al.
Publicado: (2024)
por: Chen, Wenchao, et al.
Publicado: (2024)
InfoMamba: An Attention-Free Hybrid Mamba-Transformer Model
por: Wang, Youjin, et al.
Publicado: (2026)
por: Wang, Youjin, et al.
Publicado: (2026)
MUSE: Mamba is Efficient Multi-scale Learner for Text-video Retrieval
por: Tang, Haoran, et al.
Publicado: (2024)
por: Tang, Haoran, et al.
Publicado: (2024)
VAMamba: An Efficient Visual Adaptive Mamba for Image Restoration
por: Hu, Han, et al.
Publicado: (2025)
por: Hu, Han, et al.
Publicado: (2025)
OccluDentNet : Self‐Supervised 3D Tooth Segmentation via MambaTrans Architecture
por: Hong‐an Li, et al.
Publicado: (2026)
por: Hong‐an Li, et al.
Publicado: (2026)
Vamba: Understanding Hour-Long Videos with Hybrid Mamba-Transformers
por: Ren, Weiming, et al.
Publicado: (2025)
por: Ren, Weiming, et al.
Publicado: (2025)
MedSegMamba: 3D CNN-Mamba Hybrid Architecture for Brain Segmentation
por: Cao, Aaron, et al.
Publicado: (2024)
por: Cao, Aaron, et al.
Publicado: (2024)
Decision Mamba Architectures
por: Correia, André, et al.
Publicado: (2024)
por: Correia, André, et al.
Publicado: (2024)
MambaFlow: A Mamba-Centric Architecture for End-to-End Optical Flow Estimation
por: Du, Juntian, et al.
Publicado: (2025)
por: Du, Juntian, et al.
Publicado: (2025)
MambaVesselNet++: A Hybrid CNN-Mamba Architecture for Medical Image Segmentation
por: Xu, Qing, et al.
Publicado: (2025)
por: Xu, Qing, et al.
Publicado: (2025)
MambaGlue: Fast and Robust Local Feature Matching With Mamba
por: Ryoo, Kihwan, et al.
Publicado: (2025)
por: Ryoo, Kihwan, et al.
Publicado: (2025)
Laplace-Mamba: Laplace Frequency Prior-Guided Mamba-CNN Fusion Network for Image Dehazing
por: Wang, Yongzhen, et al.
Publicado: (2025)
por: Wang, Yongzhen, et al.
Publicado: (2025)
InceptionMamba: An Efficient Hybrid Network with Large Band Convolution and Bottleneck Mamba
por: Wang, Yuhang, et al.
Publicado: (2025)
por: Wang, Yuhang, et al.
Publicado: (2025)
InfiniMotion: Mamba Boosts Memory in Transformer for Arbitrary Long Motion Generation
por: Zhang, Zeyu, et al.
Publicado: (2024)
por: Zhang, Zeyu, et al.
Publicado: (2024)
Mamba Modulation: On the Length Generalization of Mamba
por: Lu, Peng, et al.
Publicado: (2025)
por: Lu, Peng, et al.
Publicado: (2025)
MedMamba: Recasting Mamba for Medical Time Series Classification
por: He, ZhengXiao, et al.
Publicado: (2026)
por: He, ZhengXiao, et al.
Publicado: (2026)
TextMamba: Scene Text Detector with Mamba
por: Zhao, Qiyan, et al.
Publicado: (2025)
por: Zhao, Qiyan, et al.
Publicado: (2025)
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
por: Hatamizadeh, Ali, et al.
Publicado: (2024)
por: Hatamizadeh, Ali, et al.
Publicado: (2024)
MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods
por: Xu, Zukang, et al.
Publicado: (2025)
por: Xu, Zukang, et al.
Publicado: (2025)
Hazy Pedestrian Trajectory Prediction via Physical Priors and Graph-Mamba
por: Chen, Jian, et al.
Publicado: (2025)
por: Chen, Jian, et al.
Publicado: (2025)
SMILES-Mamba: Chemical Mamba Foundation Models for Drug ADMET Prediction
por: Xu, Bohao, et al.
Publicado: (2024)
por: Xu, Bohao, et al.
Publicado: (2024)
MambaNet: Mamba-assisted Channel Estimation Neural Network With Attention Mechanism
por: Luan, Dianxin, et al.
Publicado: (2026)
por: Luan, Dianxin, et al.
Publicado: (2026)
MobileMamba: Lightweight Multi-Receptive Visual Mamba Network
por: He, Haoyang, et al.
Publicado: (2024)
por: He, Haoyang, et al.
Publicado: (2024)
Mamba-SEUNet: Mamba UNet for Monaural Speech Enhancement
por: Wang, Junyu, et al.
Publicado: (2024)
por: Wang, Junyu, et al.
Publicado: (2024)
MxT: Mamba x Transformer for Image Inpainting
por: Chen, Shuang, et al.
Publicado: (2024)
por: Chen, Shuang, et al.
Publicado: (2024)
RankMamba: Benchmarking Mamba's Document Ranking Performance in the Era of Transformers
por: Xu, Zhichao
Publicado: (2024)
por: Xu, Zhichao
Publicado: (2024)
GTR-Mamba: Geometry-to-Tangent Routing Mamba for Hyperbolic POI Recommendation
por: Li, Zhuoxuan, et al.
Publicado: (2025)
por: Li, Zhuoxuan, et al.
Publicado: (2025)
Bi-Mamba+: Bidirectional Mamba for Time Series Forecasting
por: Liang, Aobo, et al.
Publicado: (2024)
por: Liang, Aobo, et al.
Publicado: (2024)
Hybrid Transformer-Mamba Architecture for Weakly Supervised Volumetric Medical Segmentation
por: Lyu, Yiheng, et al.
Publicado: (2025)
por: Lyu, Yiheng, et al.
Publicado: (2025)
MambaSCI: Efficient Mamba-UNet for Quad-Bayer Patterned Video Snapshot Compressive Imaging
por: Pan, Zhenghao, et al.
Publicado: (2024)
por: Pan, Zhenghao, et al.
Publicado: (2024)
TC-BiMamba: Trans-Chunk bidirectionally within BiMamba for unified streaming and non-streaming ASR
por: She, Qingshun, et al.
Publicado: (2026)
por: She, Qingshun, et al.
Publicado: (2026)
MM-DETR: An Efficient Multimodal Detection Transformer with Mamba-Driven Dual-Granularity Fusion and Frequency-Aware Modality Adapters
por: Han, Jianhong, et al.
Publicado: (2025)
por: Han, Jianhong, et al.
Publicado: (2025)
Mamba4KT:An Efficient and Effective Mamba-based Knowledge Tracing Model
por: Cao, Yang, et al.
Publicado: (2024)
por: Cao, Yang, et al.
Publicado: (2024)
FastMamba: A High-Speed and Efficient Mamba Accelerator on FPGA with Accurate Quantization
por: Wang, Aotao, et al.
Publicado: (2025)
por: Wang, Aotao, et al.
Publicado: (2025)
PhysMamba: Efficient Remote Physiological Measurement with SlowFast Temporal Difference Mamba
por: Luo, Chaoqi, et al.
Publicado: (2024)
por: Luo, Chaoqi, et al.
Publicado: (2024)
Ejemplares similares
-
TransMamba: A Sequence-Level Hybrid Transformer-Mamba Language Model
por: Li, Yixing, et al.
Publicado: (2025) -
C2-Evo: Co-Evolving Multimodal Data and Model for Self-Improving Reasoning
por: Chen, Xiuwei, et al.
Publicado: (2025) -
SemHiTok: A Unified Image Tokenizer via Semantic-Guided Hierarchical Codebook for Multimodal Understanding and Generation
por: Chen, Zisheng, et al.
Publicado: (2025) -
GeoMamba: A Geometry-driven MambaVision Framework and Dataset for Fine-grained Optical-SAR Object Retrieval
por: Fang, Tiantong, et al.
Publicado: (2026) -
AtomicVLA: Unlocking the Potential of Atomic Skill Learning in Robots
por: Zhang, Likui, et al.
Publicado: (2026)