Graph2Video: Leveraging Video Models to Model Dynamic Graph Evolution
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Hua, Wei, Yanbin, Xing, Fei, Derr, Tyler, Han, Haoyu, Zhang, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inverse-LLaVA: Eliminating Alignment Pre-training Through Text-to-Vision Mapping
di: Zhan, Xuhui, et al.
Pubblicazione: (2025)
di: Zhan, Xuhui, et al.
Pubblicazione: (2025)
Video-Driven Graph Network-Based Simulators
di: Szewczyk, Franciszek, et al.
Pubblicazione: (2024)
di: Szewczyk, Franciszek, et al.
Pubblicazione: (2024)
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
di: Huang, Haojian, et al.
Pubblicazione: (2025)
di: Huang, Haojian, et al.
Pubblicazione: (2025)
A Survey on Video Diffusion Models
di: Xing, Zhen, et al.
Pubblicazione: (2023)
di: Xing, Zhen, et al.
Pubblicazione: (2023)
Box2Flow: Instance-based Action Flow Graphs from Videos
di: Li, Jiatong, et al.
Pubblicazione: (2024)
di: Li, Jiatong, et al.
Pubblicazione: (2024)
CurEvo: Curriculum-Guided Self-Evolution for Video Understanding
di: Zeng, Guiyi, et al.
Pubblicazione: (2026)
di: Zeng, Guiyi, et al.
Pubblicazione: (2026)
Corruption-Aware Training of Latent Video Diffusion Models for Robust Text-to-Video Generation
di: Maduabuchi, Chika, et al.
Pubblicazione: (2025)
di: Maduabuchi, Chika, et al.
Pubblicazione: (2025)
VideoOrion: Tokenizing Object Dynamics in Videos
di: Feng, Yicheng, et al.
Pubblicazione: (2024)
di: Feng, Yicheng, et al.
Pubblicazione: (2024)
VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling
di: Li, Xinhao, et al.
Pubblicazione: (2024)
di: Li, Xinhao, et al.
Pubblicazione: (2024)
Lyapunov Stable Graph Neural Flow
di: Chu, Haoyu, et al.
Pubblicazione: (2026)
di: Chu, Haoyu, et al.
Pubblicazione: (2026)
Physics-Driven Spatiotemporal Modeling for AI-Generated Video Detection
di: Zhang, Shuhai, et al.
Pubblicazione: (2025)
di: Zhang, Shuhai, et al.
Pubblicazione: (2025)
DynamicGTR: Leveraging Graph Topology Representation Preferences to Boost VLM Capabilities on Graph QAs
di: Wei, Yanbin, et al.
Pubblicazione: (2026)
di: Wei, Yanbin, et al.
Pubblicazione: (2026)
Progressive Autoregressive Video Diffusion Models
di: Xie, Desai, et al.
Pubblicazione: (2024)
di: Xie, Desai, et al.
Pubblicazione: (2024)
Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models
di: Ge, Songwei, et al.
Pubblicazione: (2023)
di: Ge, Songwei, et al.
Pubblicazione: (2023)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
Inferring Dynamic Physical Properties from Video Foundation Models
di: Zhan, Guanqi, et al.
Pubblicazione: (2025)
di: Zhan, Guanqi, et al.
Pubblicazione: (2025)
Unifying Specialized Visual Encoders for Video Language Models
di: Chung, Jihoon, et al.
Pubblicazione: (2025)
di: Chung, Jihoon, et al.
Pubblicazione: (2025)
STEP: Enhancing Video-LLMs' Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
di: Qiu, Haiyi, et al.
Pubblicazione: (2024)
di: Qiu, Haiyi, et al.
Pubblicazione: (2024)
Innovative Silicosis and Pneumonia Classification: Leveraging Graph Transformer Post-hoc Modeling and Ensemble Techniques
di: Bui, Bao Q., et al.
Pubblicazione: (2024)
di: Bui, Bao Q., et al.
Pubblicazione: (2024)
GraphVLM: Benchmarking Vision Language Models for Multimodal Graph Learning
di: Liu, Jiajin, et al.
Pubblicazione: (2026)
di: Liu, Jiajin, et al.
Pubblicazione: (2026)
Cross-View Graph Consistency Learning for Invariant Graph Representations
di: Chen, Jie, et al.
Pubblicazione: (2023)
di: Chen, Jie, et al.
Pubblicazione: (2023)
AID: Adapting Image2Video Diffusion Models for Instruction-guided Video Prediction
di: Xing, Zhen, et al.
Pubblicazione: (2024)
di: Xing, Zhen, et al.
Pubblicazione: (2024)
Vidu: a Highly Consistent, Dynamic and Skilled Text-to-Video Generator with Diffusion Models
di: Bao, Fan, et al.
Pubblicazione: (2024)
di: Bao, Fan, et al.
Pubblicazione: (2024)
Unlearning Concepts from Text-to-Video Diffusion Models
di: Liu, Shiqi, et al.
Pubblicazione: (2024)
di: Liu, Shiqi, et al.
Pubblicazione: (2024)
Chain-of-Trajectories: Unlocking the Intrinsic Generative Optimality of Diffusion Models via Graph-Theoretic Planning
di: Chen, Ping, et al.
Pubblicazione: (2026)
di: Chen, Ping, et al.
Pubblicazione: (2026)
Tracktention: Leveraging Point Tracking to Attend Videos Faster and Better
di: Lai, Zihang, et al.
Pubblicazione: (2025)
di: Lai, Zihang, et al.
Pubblicazione: (2025)
Leveraging Transformers for Weakly Supervised Object Localization in Unconstrained Videos
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2024)
di: Murtaza, Shakeeb, et al.
Pubblicazione: (2024)
ColonCrafter: A Depth Estimation Model for Colonoscopy Videos Using Diffusion Priors
di: Hardy, Romain, et al.
Pubblicazione: (2025)
di: Hardy, Romain, et al.
Pubblicazione: (2025)
DyCoke: Dynamic Compression of Tokens for Fast Video Large Language Models
di: Tao, Keda, et al.
Pubblicazione: (2024)
di: Tao, Keda, et al.
Pubblicazione: (2024)
Semantically Consistent Video Inpainting with Conditional Diffusion Models
di: Green, Dylan, et al.
Pubblicazione: (2024)
di: Green, Dylan, et al.
Pubblicazione: (2024)
Vchitect-2.0: Parallel Transformer for Scaling Up Video Diffusion Models
di: Fan, Weichen, et al.
Pubblicazione: (2025)
di: Fan, Weichen, et al.
Pubblicazione: (2025)
Pretrained Image-Text Models are Secretly Video Captioners
di: Zhang, Chunhui, et al.
Pubblicazione: (2025)
di: Zhang, Chunhui, et al.
Pubblicazione: (2025)
Multimodal Long Video Modeling Based on Temporal Dynamic Context
di: Hao, Haoran, et al.
Pubblicazione: (2025)
di: Hao, Haoran, et al.
Pubblicazione: (2025)
Vid2World: Crafting Video Diffusion Models to Interactive World Models
di: Huang, Siqiao, et al.
Pubblicazione: (2025)
di: Huang, Siqiao, et al.
Pubblicazione: (2025)
Lifelong Learning of Video Diffusion Models From a Single Video Stream
di: Yoo, Jason, et al.
Pubblicazione: (2024)
di: Yoo, Jason, et al.
Pubblicazione: (2024)
CircuitProbe: Tracing Visual Temporal Evidence Flow in Video Language Models
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
Video Diffusion Models: A Survey
di: Melnik, Andrew, et al.
Pubblicazione: (2024)
di: Melnik, Andrew, et al.
Pubblicazione: (2024)
AVID: Adapting Video Diffusion Models to World Models
di: Rigter, Marc, et al.
Pubblicazione: (2024)
di: Rigter, Marc, et al.
Pubblicazione: (2024)
VISAGE: Video Synthesis using Action Graphs for Surgery
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
di: Yeganeh, Yousef, et al.
Pubblicazione: (2024)
Detection-Fusion for Knowledge Graph Extraction from Videos
di: Das, Taniya, et al.
Pubblicazione: (2024)
di: Das, Taniya, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Inverse-LLaVA: Eliminating Alignment Pre-training Through Text-to-Vision Mapping
di: Zhan, Xuhui, et al.
Pubblicazione: (2025) -
Video-Driven Graph Network-Based Simulators
di: Szewczyk, Franciszek, et al.
Pubblicazione: (2024) -
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
di: Huang, Haojian, et al.
Pubblicazione: (2025) -
A Survey on Video Diffusion Models
di: Xing, Zhen, et al.
Pubblicazione: (2023) -
Box2Flow: Instance-based Action Flow Graphs from Videos
di: Li, Jiatong, et al.
Pubblicazione: (2024)