SkyReels-V4: Multi-modal Video-Audio Generation, Inpainting and Editing model
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Guibin, Lin, Dixuan, Yang, Jiangping, Zhang, Youqiang, Fei, Zhengcong, Li, Debang, Chen, Sheng, Ao, Chaofeng, Pang, Nuo, Wang, Yiming, Dou, Yikun, Chen, Zheng, Fan, Mingyuan, Li, Tuanhui, Chang, Mingshan, Zhang, Hao, Sun, Xiaopeng, Xu, Jingtao, Xie, Yuqiang, Wang, Jiahua, Xu, Zhiheng, Xiong, Weiming, Jin, Yuzhe, Gu, Baoxuan, Mao, Binjie, Yu, Yunjie, He, Jujie, Feng, Yuhao, Tu, Shiwen, Wang, Chaojie, Yan, Rui, Shen, Wei, Wu, Jingchen, Zhao, Peng, Zhong, Xuanyue, Liu, Zhuangzhuang, Wang, Kaifei, Zhang, Fuxiang, Xu, Weikai, Liu, Wenyan, Zhang, Binglu, Shen, Yu, Xiong, Tianhui, Peng, Bin, Zeng, Liang, Song, Xuchen, Guo, Haoxiang, Wang, Peiyu, Lam, Max W. Y., Liu, Chien-Hung, Zhou, Yahui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SkyReels-V3 Technique Report
di: Li, Debang, et al.
Pubblicazione: (2026)
di: Li, Debang, et al.
Pubblicazione: (2026)
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
SkyReels-A2: Compose Anything in Video Diffusion Transformers
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
SkyReels-V2: Infinite-length Film Generative Model
di: Chen, Guibin, et al.
Pubblicazione: (2025)
di: Chen, Guibin, et al.
Pubblicazione: (2025)
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
di: Qiu, Di, et al.
Pubblicazione: (2025)
di: Qiu, Di, et al.
Pubblicazione: (2025)
SkyReels-Text: Fine-Grained Font-Controllable Text Editing for Poster Design
di: Yu, Yunjie, et al.
Pubblicazione: (2025)
di: Yu, Yunjie, et al.
Pubblicazione: (2025)
Dimba: Transformer-Mamba Diffusion Models
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
Characterization of Microbial Community Succession and Flavor Formation During Fermentation in Chinese Northern Strong‐Flavor Daqu
di: Peng Xiao, et al.
Pubblicazione: (2025)
di: Peng Xiao, et al.
Pubblicazione: (2025)
Self‐Compression of Ultrahigh‐Peak‐Power Lasers
di: Renjing Chen, et al.
Pubblicazione: (2024)
di: Renjing Chen, et al.
Pubblicazione: (2024)
The Grothendieck Theorem in Bergman Spaces
di: Liu, Yutao, et al.
Pubblicazione: (2025)
di: Liu, Yutao, et al.
Pubblicazione: (2025)
Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2025)
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2025)
Chitosan‐Based Hydrogels as Antibacterial/Antioxidant/Anti‐Inflammation Multifunctional Dressings for Chronic Wound Healing
di: Jingchen Xu, et al.
Pubblicazione: (2024)
di: Jingchen Xu, et al.
Pubblicazione: (2024)
Reasoning in Diffusion Large Language Models is Concentrated in Dynamic Confusion Zones
di: Chen, Ranfei, et al.
Pubblicazione: (2025)
di: Chen, Ranfei, et al.
Pubblicazione: (2025)
Enhancing Texture Generation with High-Fidelity Using Advanced Texture Priors
di: Xu, Kuo, et al.
Pubblicazione: (2024)
di: Xu, Kuo, et al.
Pubblicazione: (2024)
Global Feature Enhancing and Fusion Framework for Strain Gauge Time Series Classification
di: Zhang, Xu, et al.
Pubblicazione: (2025)
di: Zhang, Xu, et al.
Pubblicazione: (2025)
Skywork Open Reasoner 1 Technical Report
di: He, Jujie, et al.
Pubblicazione: (2025)
di: He, Jujie, et al.
Pubblicazione: (2025)
Imbalance between boron and phosphorus supply influences boron deficiency symptoms in Brassica napus L.
di: Zhe Zhao, et al.
Pubblicazione: (2025)
di: Zhe Zhao, et al.
Pubblicazione: (2025)
Vision-based Wearable Steering Assistance for People with Impaired Vision in Jogging
di: Liu, Xiaotong, et al.
Pubblicazione: (2024)
di: Liu, Xiaotong, et al.
Pubblicazione: (2024)
Reducing Differential Item Functioning via Process Data
di: Chen, Ling, et al.
Pubblicazione: (2025)
di: Chen, Ling, et al.
Pubblicazione: (2025)
Incentivizing LLMs to Self-Verify Their Answers
di: Zhang, Fuxiang, et al.
Pubblicazione: (2025)
di: Zhang, Fuxiang, et al.
Pubblicazione: (2025)
Burgeoning Silicon/MXene Nanocomposites for Lithium Ion Batteries: A Review
di: Peng Zhang, et al.
Pubblicazione: (2024)
di: Peng Zhang, et al.
Pubblicazione: (2024)
Herman-Kluk-Like Semi-Classical Initial-Value Representation for Boltzmann Operator
di: Wang, Binhao, et al.
Pubblicazione: (2025)
di: Wang, Binhao, et al.
Pubblicazione: (2025)
Hierarchical Time-Aware Mixture of Experts for Multi-Modal Sequential Recommendation
di: Zhang, Shengzhe, et al.
Pubblicazione: (2025)
di: Zhang, Shengzhe, et al.
Pubblicazione: (2025)
Diffusion-RWKV: Scaling RWKV-Like Architectures for Diffusion Models
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
Ingredients: Blending Custom Photos with Video Diffusion Transformers
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
di: Fei, Zhengcong, et al.
Pubblicazione: (2025)
Video Diffusion Transformers are In-Context Learners
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
Scaling Diffusion Transformers to 16 Billion Parameters
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
Broadband Reflective Elastic Mode Conversion Enabled by a Single Row of Inclined Long-Slits
di: Feng, Kaifei, et al.
Pubblicazione: (2025)
di: Feng, Kaifei, et al.
Pubblicazione: (2025)
CACA Agent: Capability Collaboration based AI Agent
di: Xu, Peng, et al.
Pubblicazione: (2024)
di: Xu, Peng, et al.
Pubblicazione: (2024)
ColLab: A Collaborative Spatial Progressive Data Engine for Referring Expression Comprehension and Generation
di: Zhang, Shilan, et al.
Pubblicazione: (2025)
di: Zhang, Shilan, et al.
Pubblicazione: (2025)
SEMixer: Semantics Enhanced MLP-Mixer for Multiscale Mixing and Long-term Time Series Forecasting
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
A Lightweight Sparse Interaction Network for Time Series Forecasting
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
Research on the laser melting coating process of an AlCoCrFeNi high‐entropy alloy
di: Hao Zhang, et al.
Pubblicazione: (2024)
di: Hao Zhang, et al.
Pubblicazione: (2024)
Toward Accurate PBE Bandgaps: A Data‐Driven Correction Method Applied to I 2 ‐II‐IV‐X 4 Quaternary Chalcogenides
di: Xun Tong, et al.
Pubblicazione: (2025)
di: Xun Tong, et al.
Pubblicazione: (2025)
TFN: An Interpretable Neural Network with Time-Frequency Transform Embedded for Intelligent Fault Diagnosis
di: Chen, Qian, et al.
Pubblicazione: (2022)
di: Chen, Qian, et al.
Pubblicazione: (2022)
Serotonergic neurotransmission mediated cognitive dysfunction in two mouse models of sepsis‐associated encephalopathy
di: Chen Zhang, et al.
Pubblicazione: (2024)
di: Chen Zhang, et al.
Pubblicazione: (2024)
Preparation of Monohydric Alcohols From Small‐Molecule Diols Using Pd/C and Phosphotungstic Acid Bifunctional Catalysts
di: Tong Zhang, et al.
Pubblicazione: (2026)
di: Tong Zhang, et al.
Pubblicazione: (2026)
Coherent Rydberg excitation of single atoms using a pulsed fiber amplifier
di: Zhang, Ying-Wen, et al.
Pubblicazione: (2026)
di: Zhang, Ying-Wen, et al.
Pubblicazione: (2026)
Autophagy inhibitors 3‐MA and BAF may attenuate hippocampal neuronal necroptosis after global cerebral ischemia–reperfusion injury in male rats by inhibiting the interaction of the RIP3 / AIF / CypA complex
di: Chen Zhang, et al.
Pubblicazione: (2024)
di: Chen Zhang, et al.
Pubblicazione: (2024)
Exploring Dynamic Properties of Backdoor Training Through Information Bottleneck
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SkyReels-V3 Technique Report
di: Li, Debang, et al.
Pubblicazione: (2026) -
SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers
di: Fei, Zhengcong, et al.
Pubblicazione: (2025) -
SkyReels-A2: Compose Anything in Video Diffusion Transformers
di: Fei, Zhengcong, et al.
Pubblicazione: (2025) -
SkyReels-V2: Infinite-length Film Generative Model
di: Chen, Guibin, et al.
Pubblicazione: (2025) -
SkyReels-A1: Expressive Portrait Animation in Video Diffusion Transformers
di: Qiu, Di, et al.
Pubblicazione: (2025)