EvoStreaming: Your Offline Video Model Is a Natively Streaming Assistant
Fuente:
arXiv
Salvato in:
| Autori principali: | Wen, Zichen, Yang, Boxue, Ke, Junlong, Huang, Jiajie, Liao, Chenfei, Wang, Junxi, Liu, Xuyang, Zhang, Linfeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Flash-Unified: A Training-Free and Task-Aware Acceleration Framework for Native Unified Models
di: Ke, Junlong, et al.
Pubblicazione: (2026)
di: Ke, Junlong, et al.
Pubblicazione: (2026)
Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
di: Wang, Yiyu, et al.
Pubblicazione: (2025)
di: Wang, Yiyu, et al.
Pubblicazione: (2025)
StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding
di: Wang, Junxi, et al.
Pubblicazione: (2026)
di: Wang, Junxi, et al.
Pubblicazione: (2026)
StreamBridge: Turning Your Offline Video Large Language Model into a Proactive Streaming Assistant
di: Wang, Haibo, et al.
Pubblicazione: (2025)
di: Wang, Haibo, et al.
Pubblicazione: (2025)
Click-to-Ask: An AI Live Streaming Assistant with Offline Copywriting and Online Interactive QA
di: Yu, Ruizhi, et al.
Pubblicazione: (2026)
di: Yu, Ruizhi, et al.
Pubblicazione: (2026)
AI for Service: Proactive Assistance with AI Glasses
di: Wen, Zichen, et al.
Pubblicazione: (2025)
di: Wen, Zichen, et al.
Pubblicazione: (2025)
LiveStar: Live Streaming Assistant for Real-World Online Video Understanding
di: Yang, Zhenyu, et al.
Pubblicazione: (2025)
di: Yang, Zhenyu, et al.
Pubblicazione: (2025)
StreamGVE: Training-Free Video Editing via Few-Step Streaming Video Generation
di: Jiao, Guanlong, et al.
Pubblicazione: (2026)
di: Jiao, Guanlong, et al.
Pubblicazione: (2026)
PhoStream: Benchmarking Real-World Streaming for Omnimodal Assistants in Mobile Scenarios
di: Lu, Xudong, et al.
Pubblicazione: (2026)
di: Lu, Xudong, et al.
Pubblicazione: (2026)
StreamChat: Chatting with Streaming Video
di: Liu, Jihao, et al.
Pubblicazione: (2024)
di: Liu, Jihao, et al.
Pubblicazione: (2024)
StreamSTGS: Streaming Spatial and Temporal Gaussian Grids for Real-Time Free-Viewpoint Video
di: Ke, Zhihui, et al.
Pubblicazione: (2025)
di: Ke, Zhihui, et al.
Pubblicazione: (2025)
Stream-T1: Test-Time Scaling for Streaming Video Generation
di: Tu, Yijing, et al.
Pubblicazione: (2026)
di: Tu, Yijing, et al.
Pubblicazione: (2026)
Video Compression Commander: Plug-and-Play Inference Acceleration for Video Large Language Models
di: Liu, Xuyang, et al.
Pubblicazione: (2025)
di: Liu, Xuyang, et al.
Pubblicazione: (2025)
StreamingCoT: A Dataset for Temporal Dynamics and Multimodal Chain-of-Thought Reasoning in Streaming VideoQA
di: Hu, Yuhang, et al.
Pubblicazione: (2025)
di: Hu, Yuhang, et al.
Pubblicazione: (2025)
VSAS-Bench: Real-Time Evaluation of Visual Streaming Assistant Models
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2026)
di: Vasu, Pavan Kumar Anasosalu, et al.
Pubblicazione: (2026)
StreamAgent: Towards Anticipatory Agents for Streaming Video Understanding
di: Yang, Haolin, et al.
Pubblicazione: (2025)
di: Yang, Haolin, et al.
Pubblicazione: (2025)
Streaming Video Diffusion: Online Video Editing with Diffusion Models
di: Chen, Feng, et al.
Pubblicazione: (2024)
di: Chen, Feng, et al.
Pubblicazione: (2024)
StreamingFlow: Streaming Occupancy Forecasting with Asynchronous Multi-modal Data Streams via Neural Ordinary Differential Equation
di: Shi, Yining, et al.
Pubblicazione: (2023)
di: Shi, Yining, et al.
Pubblicazione: (2023)
Streaming Autoregressive Video Generation via Diagonal Distillation
di: Liu, Jinxiu, et al.
Pubblicazione: (2026)
di: Liu, Jinxiu, et al.
Pubblicazione: (2026)
StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding
di: Jin, Xinqi, et al.
Pubblicazione: (2025)
di: Jin, Xinqi, et al.
Pubblicazione: (2025)
StreamEQA: Towards Streaming Video Understanding for Embodied Scenarios
di: Wang, Yifei, et al.
Pubblicazione: (2025)
di: Wang, Yifei, et al.
Pubblicazione: (2025)
DeformStream: Deformation-based Adaptive Volumetric Video Streaming
di: Li, Boyan, et al.
Pubblicazione: (2024)
di: Li, Boyan, et al.
Pubblicazione: (2024)
Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation
di: Wu, Bin, et al.
Pubblicazione: (2026)
di: Wu, Bin, et al.
Pubblicazione: (2026)
StreamSplat: Towards Online Dynamic 3D Reconstruction from Uncalibrated Video Streams
di: Wu, Zike, et al.
Pubblicazione: (2025)
di: Wu, Zike, et al.
Pubblicazione: (2025)
StreamReady: Learning What to Answer and When in Long Streaming Videos
di: Azad, Shehreen, et al.
Pubblicazione: (2026)
di: Azad, Shehreen, et al.
Pubblicazione: (2026)
ShotStream: Streaming Multi-Shot Video Generation for Interactive Storytelling
di: Luo, Yawen, et al.
Pubblicazione: (2026)
di: Luo, Yawen, et al.
Pubblicazione: (2026)
Streaming Video Instruction Tuning
di: Xia, Jiaer, et al.
Pubblicazione: (2025)
di: Xia, Jiaer, et al.
Pubblicazione: (2025)
Streaming Dense Video Captioning
di: Zhou, Xingyi, et al.
Pubblicazione: (2024)
di: Zhou, Xingyi, et al.
Pubblicazione: (2024)
StreamOV: Streaming Omni-Video Understanding via Evidence-Guided Memory and Response Triggering
di: Xie, Ming, et al.
Pubblicazione: (2026)
di: Xie, Ming, et al.
Pubblicazione: (2026)
Think-as-You-See: Streaming Chain-of-Thought Reasoning for Large Vision-Language Models
di: Zhang, Jialiang, et al.
Pubblicazione: (2026)
di: Zhang, Jialiang, et al.
Pubblicazione: (2026)
Eyes Wide Open: Ego Proactive Video-LLM for Streaming Video
di: Zhang, Yulin, et al.
Pubblicazione: (2025)
di: Zhang, Yulin, et al.
Pubblicazione: (2025)
EvoVid: Temporal-Centric Self-Evolution for Video Large Language Models
di: Huang, Shiqi, et al.
Pubblicazione: (2026)
di: Huang, Shiqi, et al.
Pubblicazione: (2026)
GIFStream: 4D Gaussian-based Immersive Video with Feature Stream
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
StreamingBench: Assessing the Gap for MLLMs to Achieve Streaming Video Understanding
di: Lin, Junming, et al.
Pubblicazione: (2024)
di: Lin, Junming, et al.
Pubblicazione: (2024)
Streaming Long Video Understanding with Large Language Models
di: Qian, Rui, et al.
Pubblicazione: (2024)
di: Qian, Rui, et al.
Pubblicazione: (2024)
SPKLIP: Aligning Spike Video Streams with Natural Language
di: Gao, Yongchang, et al.
Pubblicazione: (2025)
di: Gao, Yongchang, et al.
Pubblicazione: (2025)
Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial Intelligence
di: Gao, Yuanyuan, et al.
Pubblicazione: (2026)
di: Gao, Yuanyuan, et al.
Pubblicazione: (2026)
VideoLLM-online: Online Video Large Language Model for Streaming Video
di: Chen, Joya, et al.
Pubblicazione: (2024)
di: Chen, Joya, et al.
Pubblicazione: (2024)
Proactive Assistant Dialogue Generation from Streaming Egocentric Videos
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
Thinking in Streaming Video
di: Liu, Zikang, et al.
Pubblicazione: (2026)
di: Liu, Zikang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Flash-Unified: A Training-Free and Task-Aware Acceleration Framework for Native Unified Models
di: Ke, Junlong, et al.
Pubblicazione: (2026) -
Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
di: Wang, Yiyu, et al.
Pubblicazione: (2025) -
StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding
di: Wang, Junxi, et al.
Pubblicazione: (2026) -
StreamBridge: Turning Your Offline Video Large Language Model into a Proactive Streaming Assistant
di: Wang, Haibo, et al.
Pubblicazione: (2025) -
Click-to-Ask: An AI Live Streaming Assistant with Offline Copywriting and Online Interactive QA
di: Yu, Ruizhi, et al.
Pubblicazione: (2026)