SkyReels-V4: Multi-modal Video-Audio Generation, Inpainting and Editing model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Guibin, Lin, Dixuan, Yang, Jiangping, Zhang, Youqiang, Fei, Zhengcong, Li, Debang, Chen, Sheng, Ao, Chaofeng, Pang, Nuo, Wang, Yiming, Dou, Yikun, Chen, Zheng, Fan, Mingyuan, Li, Tuanhui, Chang, Mingshan, Zhang, Hao, Sun, Xiaopeng, Xu, Jingtao, Xie, Yuqiang, Wang, Jiahua, Xu, Zhiheng, Xiong, Weiming, Jin, Yuzhe, Gu, Baoxuan, Mao, Binjie, Yu, Yunjie, He, Jujie, Feng, Yuhao, Tu, Shiwen, Wang, Chaojie, Yan, Rui, Shen, Wei, Wu, Jingchen, Zhao, Peng, Zhong, Xuanyue, Liu, Zhuangzhuang, Wang, Kaifei, Zhang, Fuxiang, Xu, Weikai, Liu, Wenyan, Zhang, Binglu, Shen, Yu, Xiong, Tianhui, Peng, Bin, Zeng, Liang, Song, Xuchen, Guo, Haoxiang, Wang, Peiyu, Lam, Max W. Y., Liu, Chien-Hung, Zhou, Yahui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SkyReels-V3 Technique Report
par: Li, Debang, et autres
Publié: (2026)
par: Li, Debang, et autres
Publié: (2026)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025)
par: Fei, Zhengcong, et autres
Publié: (2025)
SkyReels-A2: Compose Anything in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025)
par: Fei, Zhengcong, et autres
Publié: (2025)
SkyReels-V2: Infinite-length Film Generative Model
par: Chen, Guibin, et autres
Publié: (2025)
par: Chen, Guibin, et autres
Publié: (2025)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
par: Qiu, Di, et autres
Publié: (2025)
par: Qiu, Di, et autres
Publié: (2025)
SkyReels-Text: Fine-Grained Font-Controllable Text Editing for Poster Design
par: Yu, Yunjie, et autres
Publié: (2025)
par: Yu, Yunjie, et autres
Publié: (2025)
Dimba: Transformer-Mamba Diffusion Models
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
Characterization of Microbial Community Succession and Flavor Formation During Fermentation in Chinese Northern Strong‐Flavor Daqu
par: Peng Xiao, et autres
Publié: (2025)
par: Peng Xiao, et autres
Publié: (2025)
Self‐Compression of Ultrahigh‐Peak‐Power Lasers
par: Renjing Chen, et autres
Publié: (2024)
par: Renjing Chen, et autres
Publié: (2024)
The Grothendieck Theorem in Bergman Spaces
par: Liu, Yutao, et autres
Publié: (2025)
par: Liu, Yutao, et autres
Publié: (2025)
Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy
par: Liu, Chris Yuhao, et autres
Publié: (2025)
par: Liu, Chris Yuhao, et autres
Publié: (2025)
Chitosan‐Based Hydrogels as Antibacterial/Antioxidant/Anti‐Inflammation Multifunctional Dressings for Chronic Wound Healing
par: Jingchen Xu, et autres
Publié: (2024)
par: Jingchen Xu, et autres
Publié: (2024)
Reasoning in Diffusion Large Language Models is Concentrated in Dynamic Confusion Zones
par: Chen, Ranfei, et autres
Publié: (2025)
par: Chen, Ranfei, et autres
Publié: (2025)
Enhancing Texture Generation with High-Fidelity Using Advanced Texture Priors
par: Xu, Kuo, et autres
Publié: (2024)
par: Xu, Kuo, et autres
Publié: (2024)
Global Feature Enhancing and Fusion Framework for Strain Gauge Time Series Classification
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
Skywork Open Reasoner 1 Technical Report
par: He, Jujie, et autres
Publié: (2025)
par: He, Jujie, et autres
Publié: (2025)
Imbalance between boron and phosphorus supply influences boron deficiency symptoms in Brassica napus L.
par: Zhe Zhao, et autres
Publié: (2025)
par: Zhe Zhao, et autres
Publié: (2025)
Vision-based Wearable Steering Assistance for People with Impaired Vision in Jogging
par: Liu, Xiaotong, et autres
Publié: (2024)
par: Liu, Xiaotong, et autres
Publié: (2024)
Reducing Differential Item Functioning via Process Data
par: Chen, Ling, et autres
Publié: (2025)
par: Chen, Ling, et autres
Publié: (2025)
Incentivizing LLMs to Self-Verify Their Answers
par: Zhang, Fuxiang, et autres
Publié: (2025)
par: Zhang, Fuxiang, et autres
Publié: (2025)
Burgeoning Silicon/MXene Nanocomposites for Lithium Ion Batteries: A Review
par: Peng Zhang, et autres
Publié: (2024)
par: Peng Zhang, et autres
Publié: (2024)
Herman-Kluk-Like Semi-Classical Initial-Value Representation for Boltzmann Operator
par: Wang, Binhao, et autres
Publié: (2025)
par: Wang, Binhao, et autres
Publié: (2025)
Hierarchical Time-Aware Mixture of Experts for Multi-Modal Sequential Recommendation
par: Zhang, Shengzhe, et autres
Publié: (2025)
par: Zhang, Shengzhe, et autres
Publié: (2025)
Diffusion-RWKV: Scaling RWKV-Like Architectures for Diffusion Models
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
Ingredients: Blending Custom Photos with Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025)
par: Fei, Zhengcong, et autres
Publié: (2025)
Video Diffusion Transformers are In-Context Learners
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
Scaling Diffusion Transformers to 16 Billion Parameters
par: Fei, Zhengcong, et autres
Publié: (2024)
par: Fei, Zhengcong, et autres
Publié: (2024)
Broadband Reflective Elastic Mode Conversion Enabled by a Single Row of Inclined Long-Slits
par: Feng, Kaifei, et autres
Publié: (2025)
par: Feng, Kaifei, et autres
Publié: (2025)
CACA Agent: Capability Collaboration based AI Agent
par: Xu, Peng, et autres
Publié: (2024)
par: Xu, Peng, et autres
Publié: (2024)
ColLab: A Collaborative Spatial Progressive Data Engine for Referring Expression Comprehension and Generation
par: Zhang, Shilan, et autres
Publié: (2025)
par: Zhang, Shilan, et autres
Publié: (2025)
SEMixer: Semantics Enhanced MLP-Mixer for Multiscale Mixing and Long-term Time Series Forecasting
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
A Lightweight Sparse Interaction Network for Time Series Forecasting
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
Research on the laser melting coating process of an AlCoCrFeNi high‐entropy alloy
par: Hao Zhang, et autres
Publié: (2024)
par: Hao Zhang, et autres
Publié: (2024)
Toward Accurate PBE Bandgaps: A Data‐Driven Correction Method Applied to I 2 ‐II‐IV‐X 4 Quaternary Chalcogenides
par: Xun Tong, et autres
Publié: (2025)
par: Xun Tong, et autres
Publié: (2025)
TFN: An Interpretable Neural Network with Time-Frequency Transform Embedded for Intelligent Fault Diagnosis
par: Chen, Qian, et autres
Publié: (2022)
par: Chen, Qian, et autres
Publié: (2022)
Serotonergic neurotransmission mediated cognitive dysfunction in two mouse models of sepsis‐associated encephalopathy
par: Chen Zhang, et autres
Publié: (2024)
par: Chen Zhang, et autres
Publié: (2024)
Preparation of Monohydric Alcohols From Small‐Molecule Diols Using Pd/C and Phosphotungstic Acid Bifunctional Catalysts
par: Tong Zhang, et autres
Publié: (2026)
par: Tong Zhang, et autres
Publié: (2026)
Coherent Rydberg excitation of single atoms using a pulsed fiber amplifier
par: Zhang, Ying-Wen, et autres
Publié: (2026)
par: Zhang, Ying-Wen, et autres
Publié: (2026)
Autophagy inhibitors 3‐MA and BAF may attenuate hippocampal neuronal necroptosis after global cerebral ischemia–reperfusion injury in male rats by inhibiting the interaction of the RIP3 / AIF / CypA complex
par: Chen Zhang, et autres
Publié: (2024)
par: Chen Zhang, et autres
Publié: (2024)
Exploring Dynamic Properties of Backdoor Training Through Information Bottleneck
par: Liu, Xinyu, et autres
Publié: (2025)
par: Liu, Xinyu, et autres
Publié: (2025)
Documents similaires
-
SkyReels-V3 Technique Report
par: Li, Debang, et autres
Publié: (2026) -
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025) -
SkyReels-A2: Compose Anything in Video Diffusion Transformers
par: Fei, Zhengcong, et autres
Publié: (2025) -
SkyReels-V2: Infinite-length Film Generative Model
par: Chen, Guibin, et autres
Publié: (2025) -
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
par: Qiu, Di, et autres
Publié: (2025)