Stream-T1: Test-Time Scaling for Streaming Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Tu, Yijing, Wu, Shaojin, Huang, Mengqi, Wang, Wenchuan, Wang, Yuxin, Liu, Chunxiao, Mao, Zhendong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation
por: Wu, Bin, et al.
Publicado: (2026)
por: Wu, Bin, et al.
Publicado: (2026)
DualReal: Adaptive Joint Training for Lossless Identity-Motion Fusion in Video Customization
por: Wang, Wenchuan, et al.
Publicado: (2025)
por: Wang, Wenchuan, et al.
Publicado: (2025)
RealGeneral: Unifying Visual Generation via Temporal In-Context Learning with Video Models
por: Lin, Yijing, et al.
Publicado: (2025)
por: Lin, Yijing, et al.
Publicado: (2025)
StreamingEffect: Real-Time Human-Centric Video Effect Generation
por: Song, Yiren, et al.
Publicado: (2026)
por: Song, Yiren, et al.
Publicado: (2026)
Test-Time Training on Video Streams
por: Wang, Renhao, et al.
Publicado: (2023)
por: Wang, Renhao, et al.
Publicado: (2023)
Gradual Residuals Alignment: A Dual-Stream Framework for GAN Inversion and Image Attribute Editing
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
NativeTok: Native Visual Tokenization for Improved Image Generation
por: Wu, Bin, et al.
Publicado: (2026)
por: Wu, Bin, et al.
Publicado: (2026)
DSE-GAN: Dynamic Semantic Evolution Generative Adversarial Network for Text-to-Image Generation
por: Huang, Mengqi, et al.
Publicado: (2022)
por: Huang, Mengqi, et al.
Publicado: (2022)
StreamChat: Chatting with Streaming Video
por: Liu, Jihao, et al.
Publicado: (2024)
por: Liu, Jihao, et al.
Publicado: (2024)
ShotStream: Streaming Multi-Shot Video Generation for Interactive Storytelling
por: Luo, Yawen, et al.
Publicado: (2026)
por: Luo, Yawen, et al.
Publicado: (2026)
VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control
por: Wu, Shaojin, et al.
Publicado: (2024)
por: Wu, Shaojin, et al.
Publicado: (2024)
LongAnimation: Long Animation Generation with Dynamic Global-Local Memory
por: Chen, Nan, et al.
Publicado: (2025)
por: Chen, Nan, et al.
Publicado: (2025)
StreamEQA: Towards Streaming Video Understanding for Embodied Scenarios
por: Wang, Yifei, et al.
Publicado: (2025)
por: Wang, Yifei, et al.
Publicado: (2025)
SSR: A Training-Free Approach for Streaming 3D Reconstruction
por: Deng, Hui, et al.
Publicado: (2026)
por: Deng, Hui, et al.
Publicado: (2026)
RealCustom: Narrowing Real Text Word for Real-Time Open-Domain Text-to-Image Customization
por: Huang, Mengqi, et al.
Publicado: (2024)
por: Huang, Mengqi, et al.
Publicado: (2024)
MoGA: Mixture-of-Groups Attention for End-to-End Long Video Generation
por: Jia, Weinan, et al.
Publicado: (2025)
por: Jia, Weinan, et al.
Publicado: (2025)
StreamOV: Streaming Omni-Video Understanding via Evidence-Guided Memory and Response Triggering
por: Xie, Ming, et al.
Publicado: (2026)
por: Xie, Ming, et al.
Publicado: (2026)
Dual-Stream Diffusion Net for Text-to-Video Generation
por: Liu, Binhui, et al.
Publicado: (2023)
por: Liu, Binhui, et al.
Publicado: (2023)
UMO: Scaling Multi-Identity Consistency for Image Customization via Matching Reward
por: Cheng, Yufeng, et al.
Publicado: (2025)
por: Cheng, Yufeng, et al.
Publicado: (2025)
DeformStream: Deformation-based Adaptive Volumetric Video Streaming
por: Li, Boyan, et al.
Publicado: (2024)
por: Li, Boyan, et al.
Publicado: (2024)
Less-to-More Generalization: Unlocking More Controllability by In-Context Generation
por: Wu, Shaojin, et al.
Publicado: (2025)
por: Wu, Shaojin, et al.
Publicado: (2025)
StreamSTGS: Streaming Spatial and Temporal Gaussian Grids for Real-Time Free-Viewpoint Video
por: Ke, Zhihui, et al.
Publicado: (2025)
por: Ke, Zhihui, et al.
Publicado: (2025)
HiStream: Efficient High-Resolution Video Generation via Redundancy-Eliminated Streaming
por: Qiu, Haonan, et al.
Publicado: (2025)
por: Qiu, Haonan, et al.
Publicado: (2025)
Video-T1: Test-Time Scaling for Video Generation
por: Liu, Fangfu, et al.
Publicado: (2025)
por: Liu, Fangfu, et al.
Publicado: (2025)
Flash-VStream: Efficient Real-Time Understanding for Long Video Streams
por: Zhang, Haoji, et al.
Publicado: (2025)
por: Zhang, Haoji, et al.
Publicado: (2025)
RealCustom++: Representing Images as Real Textual Word for Real-Time Customization
por: Mao, Zhendong, et al.
Publicado: (2024)
por: Mao, Zhendong, et al.
Publicado: (2024)
D$^2$iT: Dynamic Diffusion Transformer for Accurate Image Generation
por: Jia, Weinan, et al.
Publicado: (2025)
por: Jia, Weinan, et al.
Publicado: (2025)
Streaming Autoregressive Video Generation via Diagonal Distillation
por: Liu, Jinxiu, et al.
Publicado: (2026)
por: Liu, Jinxiu, et al.
Publicado: (2026)
StreamGVE: Training-Free Video Editing via Few-Step Streaming Video Generation
por: Jiao, Guanlong, et al.
Publicado: (2026)
por: Jiao, Guanlong, et al.
Publicado: (2026)
LayerEdit: Disentangled Multi-Object Editing via Conflict-Aware Multi-Layer Learning
por: Fu, Fengyi, et al.
Publicado: (2025)
por: Fu, Fengyi, et al.
Publicado: (2025)
Distribution Alignment for Fully Test-Time Adaptation with Dynamic Online Data Streams
por: Wang, Ziqiang, et al.
Publicado: (2024)
por: Wang, Ziqiang, et al.
Publicado: (2024)
VideoLLM-online: Online Video Large Language Model for Streaming Video
por: Chen, Joya, et al.
Publicado: (2024)
por: Chen, Joya, et al.
Publicado: (2024)
CogStream: Context-guided Streaming Video Question Answering
por: Zhao, Zicheng, et al.
Publicado: (2025)
por: Zhao, Zicheng, et al.
Publicado: (2025)
EvoStreaming: Your Offline Video Model Is a Natively Streaming Assistant
por: Wen, Zichen, et al.
Publicado: (2026)
por: Wen, Zichen, et al.
Publicado: (2026)
Flash-VStream: Memory-Based Real-Time Understanding for Long Video Streams
por: Zhang, Haoji, et al.
Publicado: (2024)
por: Zhang, Haoji, et al.
Publicado: (2024)
VAG: Dual-Stream Video-Action Generation for Embodied Data Synthesis
por: Lang, Xiaolei, et al.
Publicado: (2026)
por: Lang, Xiaolei, et al.
Publicado: (2026)
StreamingVLM: Real-Time Understanding for Infinite Video Streams
por: Xu, Ruyi, et al.
Publicado: (2025)
por: Xu, Ruyi, et al.
Publicado: (2025)
EndoStreamDepth: Temporally Consistent Monocular Depth Estimation for Endoscopic Video Streams
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
StreamingEval: A Unified Evaluation Protocol towards Realistic Streaming Video Understanding
por: Tang, Guowei, et al.
Publicado: (2026)
por: Tang, Guowei, et al.
Publicado: (2026)
Motion Matters: Compact Gaussian Streaming for Free-Viewpoint Video Reconstruction
por: Chen, Jiacong, et al.
Publicado: (2025)
por: Chen, Jiacong, et al.
Publicado: (2025)
Ejemplares similares
-
Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation
por: Wu, Bin, et al.
Publicado: (2026) -
DualReal: Adaptive Joint Training for Lossless Identity-Motion Fusion in Video Customization
por: Wang, Wenchuan, et al.
Publicado: (2025) -
RealGeneral: Unifying Visual Generation via Temporal In-Context Learning with Video Models
por: Lin, Yijing, et al.
Publicado: (2025) -
StreamingEffect: Real-Time Human-Centric Video Effect Generation
por: Song, Yiren, et al.
Publicado: (2026) -
Test-Time Training on Video Streams
por: Wang, Renhao, et al.
Publicado: (2023)