Diffusion-RWKV: Scaling RWKV-Like Architectures for Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Fei, Zhengcong, Fan, Mingyuan, Yu, Changqian, Li, Debang, Huang, Junshi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Scaling Diffusion Transformers to 16 Billion Parameters
por: Fei, Zhengcong, et al.
Publicado: (2024)
por: Fei, Zhengcong, et al.
Publicado: (2024)
Dimba: Transformer-Mamba Diffusion Models
por: Fei, Zhengcong, et al.
Publicado: (2024)
por: Fei, Zhengcong, et al.
Publicado: (2024)
Scalable Diffusion Models with State Space Backbone
por: Fei, Zhengcong, et al.
Publicado: (2024)
por: Fei, Zhengcong, et al.
Publicado: (2024)
Video Diffusion Transformers are In-Context Learners
por: Fei, Zhengcong, et al.
Publicado: (2024)
por: Fei, Zhengcong, et al.
Publicado: (2024)
Ingredients: Blending Custom Photos with Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)
por: Fei, Zhengcong, et al.
Publicado: (2025)
FLUX that Plays Music
por: Fei, Zhengcong, et al.
Publicado: (2024)
por: Fei, Zhengcong, et al.
Publicado: (2024)
Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures
por: Duan, Yuchen, et al.
Publicado: (2024)
por: Duan, Yuchen, et al.
Publicado: (2024)
A-JEPA: Joint-Embedding Predictive Architecture Can Listen
por: Fei, Zhengcong, et al.
Publicado: (2023)
por: Fei, Zhengcong, et al.
Publicado: (2023)
PointRWKV: Efficient RWKV-Like Model for Hierarchical Point Cloud Learning
por: He, Qingdong, et al.
Publicado: (2024)
por: He, Qingdong, et al.
Publicado: (2024)
StyleRWKV: High-Quality and High-Efficiency Style Transfer with RWKV-like Architecture
por: Dai, Miaomiao, et al.
Publicado: (2024)
por: Dai, Miaomiao, et al.
Publicado: (2024)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
por: Qiu, Di, et al.
Publicado: (2025)
por: Qiu, Di, et al.
Publicado: (2025)
RWKV-PCSSC: Exploring RWKV Model for Point Cloud Semantic Scene Completion
por: He, Wenzhe, et al.
Publicado: (2025)
por: He, Wenzhe, et al.
Publicado: (2025)
Video RWKV:Video Action Recognition Based RWKV
por: Yin, Zhuowen, et al.
Publicado: (2024)
por: Yin, Zhuowen, et al.
Publicado: (2024)
Restore-RWKV: Efficient and Effective Medical Image Restoration with RWKV
por: Yang, Zhiwen, et al.
Publicado: (2024)
por: Yang, Zhiwen, et al.
Publicado: (2024)
SkyReels-A2: Compose Anything in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)
por: Fei, Zhengcong, et al.
Publicado: (2025)
VisualRWKV: Exploring Recurrent Neural Networks for Visual Language Models
por: Hou, Haowen, et al.
Publicado: (2024)
por: Hou, Haowen, et al.
Publicado: (2024)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)
por: Fei, Zhengcong, et al.
Publicado: (2025)
U-RWKV: Lightweight medical image segmentation with direction-adaptive RWKV
por: Ye, Hongbo, et al.
Publicado: (2025)
por: Ye, Hongbo, et al.
Publicado: (2025)
FS-RWKV: Leveraging Frequency Spatial-Aware RWKV for 3T-to-7T MRI Translation
por: Lei, Yingtie, et al.
Publicado: (2025)
por: Lei, Yingtie, et al.
Publicado: (2025)
MovieCharacter: A Tuning-Free Framework for Controllable Character Video Synthesis
por: Qiu, Di, et al.
Publicado: (2024)
por: Qiu, Di, et al.
Publicado: (2024)
PointDGRWKV: Generalizing RWKV-like Architecture to Unseen Domains for Point Cloud Classification
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Cross-attention for State-based model RWKV-7
por: Xiao, Liu, et al.
Publicado: (2025)
por: Xiao, Liu, et al.
Publicado: (2025)
Beyond Quadratic: Linear-Time Change Detection with RWKV
por: Yang, Zhenyu, et al.
Publicado: (2026)
por: Yang, Zhenyu, et al.
Publicado: (2026)
Fourier-RWKV: A Multi-State Perception Network for Efficient Image Dehazing
por: Zheng, Lirong, et al.
Publicado: (2025)
por: Zheng, Lirong, et al.
Publicado: (2025)
EvRWKV: A Continuous Interactive RWKV Framework for Effective Event-Guided Low-Light Image Enhancement
por: Cai, Wenjie, et al.
Publicado: (2025)
por: Cai, Wenjie, et al.
Publicado: (2025)
Mamba or RWKV: Exploring High-Quality and High-Efficiency Segment Anything Model
por: Yuan, Haobo, et al.
Publicado: (2024)
por: Yuan, Haobo, et al.
Publicado: (2024)
SCRWKV: Ultra-Compact Structure-Calibrated Vision-RWKV for Topological Crack Segmentation
por: Zhang, Hanxu, et al.
Publicado: (2026)
por: Zhang, Hanxu, et al.
Publicado: (2026)
RWKV-CLIP: A Robust Vision-Language Representation Learner
por: Gu, Tiancheng, et al.
Publicado: (2024)
por: Gu, Tiancheng, et al.
Publicado: (2024)
ITC-RWKV: Interactive Tissue-Cell Modeling with Recurrent Key-Value Aggregation for Histopathological Subtyping
por: Huang, Yating, et al.
Publicado: (2025)
por: Huang, Yating, et al.
Publicado: (2025)
URWKV: Unified RWKV Model with Multi-state Perspective for Low-light Image Restoration
por: Xu, Rui, et al.
Publicado: (2025)
por: Xu, Rui, et al.
Publicado: (2025)
RWKV-UI: UI Understanding with Enhanced Perception and Reasoning
por: Yang, Jiaxi, et al.
Publicado: (2025)
por: Yang, Jiaxi, et al.
Publicado: (2025)
MRT: Learning Compact Representations with Mixed RWKV-Transformer for Extreme Image Compression
por: Liu, Han, et al.
Publicado: (2025)
por: Liu, Han, et al.
Publicado: (2025)
Vision-QRWKV: Exploring Quantum-Enhanced RWKV Models for Image Classification
por: Chen, Chi-Sheng
Publicado: (2025)
por: Chen, Chi-Sheng
Publicado: (2025)
Otter: Mitigating Background Distractions of Wide-Angle Few-Shot Action Recognition with Enhanced RWKV
por: Huang, Wenbo, et al.
Publicado: (2025)
por: Huang, Wenbo, et al.
Publicado: (2025)
VisualRWKV-HD and UHD: Advancing High-Resolution Processing for Visual Language Models
por: Li, Zihang, et al.
Publicado: (2024)
por: Li, Zihang, et al.
Publicado: (2024)
OccRWKV: Rethinking Efficient 3D Semantic Occupancy Prediction with Linear Complexity
por: Wang, Junming, et al.
Publicado: (2024)
por: Wang, Junming, et al.
Publicado: (2024)
Multigrain-aware Semantic Prototype Scanning and Tri-Token Prompt Learning Embraced High-Order RWKV for Pan-Sharpening
por: Li, Junfeng, et al.
Publicado: (2026)
por: Li, Junfeng, et al.
Publicado: (2026)
MD-RWKV-UNet: Scale-Aware Anatomical Encoding with Cross-Stage Fusion for Multi-Organ Segmentation
por: Fang, Zhuoyi
Publicado: (2026)
por: Fang, Zhuoyi
Publicado: (2026)
KAN We Flow? Advancing Robotic Manipulation with 3D Flow Matching via KAN & RWKV
por: Chen, Zhihao, et al.
Publicado: (2026)
por: Chen, Zhihao, et al.
Publicado: (2026)
RGB-Event based Pedestrian Attribute Recognition: A Benchmark Dataset and An Asymmetric RWKV Fusion Framework
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
Ejemplares similares
-
Scaling Diffusion Transformers to 16 Billion Parameters
por: Fei, Zhengcong, et al.
Publicado: (2024) -
Dimba: Transformer-Mamba Diffusion Models
por: Fei, Zhengcong, et al.
Publicado: (2024) -
Scalable Diffusion Models with State Space Backbone
por: Fei, Zhengcong, et al.
Publicado: (2024) -
Video Diffusion Transformers are In-Context Learners
por: Fei, Zhengcong, et al.
Publicado: (2024) -
Ingredients: Blending Custom Photos with Video Diffusion Transformers
por: Fei, Zhengcong, et al.
Publicado: (2025)