Dimba: Transformer-Mamba Diffusion Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Fei, Zhengcong, Fan, Mingyuan, Yu, Changqian, Li, Debang, Zhang, Youqiang, Huang, Junshi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Scaling Diffusion Transformers to 16 Billion Parameters
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
Diffusion-RWKV: Scaling RWKV-Like Architectures for Diffusion Models
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
Video Diffusion Transformers are In-Context Learners
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
Scalable Diffusion Models with State Space Backbone
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
Ingredients: Blending Custom Photos with Video Diffusion Transformers
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)
FLUX that Plays Music
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
A-JEPA: Joint-Embedding Predictive Architecture Can Listen
von: Fei, Zhengcong, et al.
Veröffentlicht: (2023)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2023)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
von: Qiu, Di, et al.
Veröffentlicht: (2025)
von: Qiu, Di, et al.
Veröffentlicht: (2025)
SkyReels-A2: Compose Anything in Video Diffusion Transformers
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)
MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis
von: Qiu, Di, et al.
Veröffentlicht: (2024)
von: Qiu, Di, et al.
Veröffentlicht: (2024)
SkyReels-V3 Technique Report
von: Li, Debang, et al.
Veröffentlicht: (2026)
von: Li, Debang, et al.
Veröffentlicht: (2026)
HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion
von: He, Yu, et al.
Veröffentlicht: (2026)
von: He, Yu, et al.
Veröffentlicht: (2026)
FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion
von: Ma, Lichen, et al.
Veröffentlicht: (2026)
von: Ma, Lichen, et al.
Veröffentlicht: (2026)
Music Consistency Models
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024)
SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time Segmentation
von: Xu, Zhengze, et al.
Veröffentlicht: (2023)
von: Xu, Zhengze, et al.
Veröffentlicht: (2023)
SkyReels-V2: Infinite-length Film Generative Model
von: Chen, Guibin, et al.
Veröffentlicht: (2025)
von: Chen, Guibin, et al.
Veröffentlicht: (2025)
LaMamba-Diff: Linear-Time High-Fidelity Diffusion Models Based on Local Attention and Mamba
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
von: Fu, Yunxiang, et al.
Veröffentlicht: (2024)
Diffusion Transformer-to-Mamba Distillation for High-Resolution Image Generation
von: Yao, Yuan, et al.
Veröffentlicht: (2025)
von: Yao, Yuan, et al.
Veröffentlicht: (2025)
Growth Inhibitors for Suppressing Inappropriate Image Concepts in Diffusion Models
von: Chen, Die, et al.
Veröffentlicht: (2024)
von: Chen, Die, et al.
Veröffentlicht: (2024)
Soft Masked Mamba Diffusion Model for CT to MRI Conversion
von: Wang, Zhenbin, et al.
Veröffentlicht: (2024)
von: Wang, Zhenbin, et al.
Veröffentlicht: (2024)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
von: Chen, Wenchao, et al.
Veröffentlicht: (2024)
von: Chen, Wenchao, et al.
Veröffentlicht: (2024)
Causal Diffusion Transformers for Generative Modeling
von: Deng, Chaorui, et al.
Veröffentlicht: (2024)
von: Deng, Chaorui, et al.
Veröffentlicht: (2024)
MambaDFuse: A Mamba-based Dual-phase Model for Multi-modality Image Fusion
von: Li, Zhe, et al.
Veröffentlicht: (2024)
von: Li, Zhe, et al.
Veröffentlicht: (2024)
ChangeMamba: Remote Sensing Change Detection With Spatiotemporal State Space Model
von: Chen, Hongruixuan, et al.
Veröffentlicht: (2024)
von: Chen, Hongruixuan, et al.
Veröffentlicht: (2024)
DSDFormer: An Innovative Transformer-Mamba Framework for Robust High-Precision Driver Distraction Identification
von: Chen, Junzhou, et al.
Veröffentlicht: (2024)
von: Chen, Junzhou, et al.
Veröffentlicht: (2024)
MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling
von: Li, Yingyue, et al.
Veröffentlicht: (2025)
von: Li, Yingyue, et al.
Veröffentlicht: (2025)
Mamba-Adaptor: State Space Model Adaptor for Visual Recognition
von: Xie, Fei, et al.
Veröffentlicht: (2025)
von: Xie, Fei, et al.
Veröffentlicht: (2025)
MambaVision: A Hybrid Mamba-Transformer Vision Backbone
von: Hatamizadeh, Ali, et al.
Veröffentlicht: (2024)
von: Hatamizadeh, Ali, et al.
Veröffentlicht: (2024)
CLIP-Mamba: CLIP Pretrained Mamba Models with OOD and Hessian Evaluation
von: Huang, Weiquan, et al.
Veröffentlicht: (2024)
von: Huang, Weiquan, et al.
Veröffentlicht: (2024)
P-Mamba: Marrying Perona Malik Diffusion with Mamba for Efficient Pediatric Echocardiographic Left Ventricular Segmentation
von: Ye, Zi, et al.
Veröffentlicht: (2024)
von: Ye, Zi, et al.
Veröffentlicht: (2024)
MxT: Mamba x Transformer for Image Inpainting
von: Chen, Shuang, et al.
Veröffentlicht: (2024)
von: Chen, Shuang, et al.
Veröffentlicht: (2024)
Trajectory Mamba: Efficient Attention-Mamba Forecasting Model Based on Selective SSM
von: Huang, Yizhou, et al.
Veröffentlicht: (2025)
von: Huang, Yizhou, et al.
Veröffentlicht: (2025)
TransMamba: Fast Universal Architecture Adaption from Transformers to Mamba
von: Chen, Xiuwei, et al.
Veröffentlicht: (2025)
von: Chen, Xiuwei, et al.
Veröffentlicht: (2025)
QuadMamba: Learning Quadtree-based Selective Scan for Visual State Space Model
von: Xie, Fei, et al.
Veröffentlicht: (2024)
von: Xie, Fei, et al.
Veröffentlicht: (2024)
FocusDiT: Masking Queries in Diffusion Transformers for Fine-grained Image Generation
von: Fang, Xueji, et al.
Veröffentlicht: (2026)
von: Fang, Xueji, et al.
Veröffentlicht: (2026)
Dynamic Diffusion Transformer
von: Zhao, Wangbo, et al.
Veröffentlicht: (2024)
von: Zhao, Wangbo, et al.
Veröffentlicht: (2024)
OutDreamer: Video Outpainting with a Diffusion Transformer
von: Zhong, Linhao, et al.
Veröffentlicht: (2025)
von: Zhong, Linhao, et al.
Veröffentlicht: (2025)
DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis
von: Teng, Yao, et al.
Veröffentlicht: (2024)
von: Teng, Yao, et al.
Veröffentlicht: (2024)
Toward Next-generation Medical Vision Backbones: Modeling Finer-grained Long-range Visual Dependency
von: Meng, Mingyuan
Veröffentlicht: (2025)
von: Meng, Mingyuan
Veröffentlicht: (2025)
Ähnliche Einträge
-
Scaling Diffusion Transformers to 16 Billion Parameters
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024) -
Diffusion-RWKV: Scaling RWKV-Like Architectures for Diffusion Models
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024) -
Video Diffusion Transformers are In-Context Learners
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024) -
Scalable Diffusion Models with State Space Backbone
von: Fei, Zhengcong, et al.
Veröffentlicht: (2024) -
Ingredients: Blending Custom Photos with Video Diffusion Transformers
von: Fei, Zhengcong, et al.
Veröffentlicht: (2025)