STREAM: Spatio-TempoRal Evaluation and Analysis Metric for Video Generative Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Pum Jun, Kim, Seojun, Yoo, Jaejun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TopP&R: Robust Support Estimation Approach for Evaluating Fidelity and Diversity in Generative Models
di: Kim, Pum Jun, et al.
Pubblicazione: (2023)
di: Kim, Pum Jun, et al.
Pubblicazione: (2023)
On the Reliability of Cue Conflict and Beyond
di: Kim, Pum Jun, et al.
Pubblicazione: (2026)
di: Kim, Pum Jun, et al.
Pubblicazione: (2026)
PosterLlama: Bridging Design Ability of Langauge Model to Contents-Aware Layout Generation
di: Seol, Jaejung, et al.
Pubblicazione: (2024)
di: Seol, Jaejung, et al.
Pubblicazione: (2024)
Singular Value Scaling: Efficient Generative Model Compression via Pruned Weights Refinement
di: Kim, Hyeonjin, et al.
Pubblicazione: (2024)
di: Kim, Hyeonjin, et al.
Pubblicazione: (2024)
BF-STVSR: B-Splines and Fourier-Best Friends for High Fidelity Spatial-Temporal Video Super-Resolution
di: Kim, Eunjin, et al.
Pubblicazione: (2025)
di: Kim, Eunjin, et al.
Pubblicazione: (2025)
Dynamic-Aware Spatio-temporal Representation Learning for Dynamic MRI Reconstruction
di: Baik, Dayoung, et al.
Pubblicazione: (2025)
di: Baik, Dayoung, et al.
Pubblicazione: (2025)
Bridging the Domain Gap: A Simple Domain Matching Method for Reference-based Image Super-Resolution in Remote Sensing
di: Min, Jeongho, et al.
Pubblicazione: (2024)
di: Min, Jeongho, et al.
Pubblicazione: (2024)
LIFT and PLACE: A Simple, Stable, and Effective Knowledge Distillation Framework for Lightweight Diffusion Models
di: Han, Hyunsoo, et al.
Pubblicazione: (2026)
di: Han, Hyunsoo, et al.
Pubblicazione: (2026)
Beyond Spatial Frequency: Pixel-wise Temporal Frequency-based Deepfake Video Detection
di: Kim, Taehoon, et al.
Pubblicazione: (2025)
di: Kim, Taehoon, et al.
Pubblicazione: (2025)
Generic Event Boundary Detection via Denoising Diffusion
di: Hwang, Jaejun, et al.
Pubblicazione: (2025)
di: Hwang, Jaejun, et al.
Pubblicazione: (2025)
Attribute Based Interpretable Evaluation Metrics for Generative Models
di: Kim, Dongkyun, et al.
Pubblicazione: (2023)
di: Kim, Dongkyun, et al.
Pubblicazione: (2023)
QEVA: A Reference-Free Evaluation Metric for Narrative Video Summarization with Multimodal Question Answering
di: Jung, Woojun, et al.
Pubblicazione: (2026)
di: Jung, Woojun, et al.
Pubblicazione: (2026)
GuidNoise: Single-Pair Guided Diffusion for Generalized Noise Synthesis
di: Kim, Changjin, et al.
Pubblicazione: (2025)
di: Kim, Changjin, et al.
Pubblicazione: (2025)
DETACH : Decomposed Spatio-Temporal Alignment for Exocentric Video and Ambient Sensors with Staged Learning
di: Yoon, Junho, et al.
Pubblicazione: (2025)
di: Yoon, Junho, et al.
Pubblicazione: (2025)
Multi-Granular Spatio-Temporal Token Merging for Training-Free Acceleration of Video LLMs
di: Hyun, Jeongseok, et al.
Pubblicazione: (2025)
di: Hyun, Jeongseok, et al.
Pubblicazione: (2025)
VGenST-Bench: A Benchmark for Spatio-Temporal Reasoning via Active Video Synthesis
di: Park, Jinho, et al.
Pubblicazione: (2026)
di: Park, Jinho, et al.
Pubblicazione: (2026)
Evaluating Design Video Generation: Metrics for Compositional Fidelity
di: Deganutti, Adrienne, et al.
Pubblicazione: (2026)
di: Deganutti, Adrienne, et al.
Pubblicazione: (2026)
Deformable Dynamic Convolution for Accurate yet Efficient Spatio-Temporal Traffic Prediction
di: Jin, Hyeonseok, et al.
Pubblicazione: (2025)
di: Jin, Hyeonseok, et al.
Pubblicazione: (2025)
EXPERT: An Explainable Image Captioning Evaluation Metric with Structured Explanations
di: Kim, Hyunjong, et al.
Pubblicazione: (2025)
di: Kim, Hyunjong, et al.
Pubblicazione: (2025)
SALOVA: Segment-Augmented Long Video Assistant for Targeted Retrieval and Routing in Long-Form Video Analysis
di: Kim, Junho, et al.
Pubblicazione: (2024)
di: Kim, Junho, et al.
Pubblicazione: (2024)
Model Already Knows the Best Noise: Bayesian Active Noise Selection via Attention in Video Diffusion Model
di: Kim, Kwanyoung, et al.
Pubblicazione: (2025)
di: Kim, Kwanyoung, et al.
Pubblicazione: (2025)
VideoStir: Understanding Long Videos via Spatio-Temporally Structured and Intent-Aware RAG
di: Fu, Honghao, et al.
Pubblicazione: (2026)
di: Fu, Honghao, et al.
Pubblicazione: (2026)
DropletVideo: A Dataset and Approach to Explore Integral Spatio-Temporal Consistent Video Generation
di: Zhang, Runze, et al.
Pubblicazione: (2025)
di: Zhang, Runze, et al.
Pubblicazione: (2025)
3DPhysVideo: Consistency-Guided Flow SDE for Video Generation via 3D Scene Reconstruction and Physical Simulation
di: Kim, Hwidong, et al.
Pubblicazione: (2026)
di: Kim, Hwidong, et al.
Pubblicazione: (2026)
Hybrid Video Diffusion Models with 2D Triplane and 3D Wavelet Representation
di: Kim, Kihong, et al.
Pubblicazione: (2024)
di: Kim, Kihong, et al.
Pubblicazione: (2024)
CubeComposer: Spatio-Temporal Autoregressive 4K 360° Video Generation from Perspective Video
di: Li, Lingen, et al.
Pubblicazione: (2026)
di: Li, Lingen, et al.
Pubblicazione: (2026)
Fine-Grained Pillar Feature Encoding Via Spatio-Temporal Virtual Grid for 3D Object Detection
di: Park, Konyul, et al.
Pubblicazione: (2024)
di: Park, Konyul, et al.
Pubblicazione: (2024)
Beyond FVD: Enhanced Evaluation Metrics for Video Generation Quality
di: Luo, Ge Ya, et al.
Pubblicazione: (2024)
di: Luo, Ge Ya, et al.
Pubblicazione: (2024)
Representing 3D Shapes With 64 Latent Vectors for 3D Diffusion Models
di: Cho, In, et al.
Pubblicazione: (2025)
di: Cho, In, et al.
Pubblicazione: (2025)
Multimodal Alignment with Cross-Attentive GRUs for Fine-Grained Video Understanding
di: Kim, Namho, et al.
Pubblicazione: (2025)
di: Kim, Namho, et al.
Pubblicazione: (2025)
Gaussian Mixture Proposals with Pull-Push Learning Scheme to Capture Diverse Events for Weakly Supervised Temporal Video Grounding
di: Kim, Sunoh, et al.
Pubblicazione: (2023)
di: Kim, Sunoh, et al.
Pubblicazione: (2023)
VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation
di: He, Xuan, et al.
Pubblicazione: (2024)
di: He, Xuan, et al.
Pubblicazione: (2024)
VideoRFSplat: Direct Scene-Level Text-to-3D Gaussian Splatting Generation with Flexible Pose and Multi-View Joint Modeling
di: Go, Hyojun, et al.
Pubblicazione: (2025)
di: Go, Hyojun, et al.
Pubblicazione: (2025)
InsertAnywhere: Bridging 4D Scene Geometry and Diffusion Models for Realistic Video Object Insertion
di: Jin, Hoiyeong, et al.
Pubblicazione: (2025)
di: Jin, Hoiyeong, et al.
Pubblicazione: (2025)
UST-SSM: Unified Spatio-Temporal State Space Models for Point Cloud Video Modeling
di: Li, Peiming, et al.
Pubblicazione: (2025)
di: Li, Peiming, et al.
Pubblicazione: (2025)
CRIMSON: A Clinically-Grounded LLM-Based Metric for Generative Radiology Report Evaluation
di: Baharoon, Mohammed, et al.
Pubblicazione: (2026)
di: Baharoon, Mohammed, et al.
Pubblicazione: (2026)
Tracking the Truth: Object-Centric Spatio-Temporal Monitoring for Video Large Language Models
di: Cao, Tri, et al.
Pubblicazione: (2026)
di: Cao, Tri, et al.
Pubblicazione: (2026)
SLVMEval: Synthetic Meta Evaluation Benchmark for Text-to-Long Video Generation
di: Matsuda, Ryosuke, et al.
Pubblicazione: (2026)
di: Matsuda, Ryosuke, et al.
Pubblicazione: (2026)
Learning Coordinate-based Convolutional Kernels for Continuous SE(3) Equivariant and Efficient Point Cloud Analysis
di: Kim, Jaein, et al.
Pubblicazione: (2026)
di: Kim, Jaein, et al.
Pubblicazione: (2026)
TempoControl: Temporal Attention Guidance for Text-to-Video Models
di: Schiber, Shira, et al.
Pubblicazione: (2025)
di: Schiber, Shira, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TopP&R: Robust Support Estimation Approach for Evaluating Fidelity and Diversity in Generative Models
di: Kim, Pum Jun, et al.
Pubblicazione: (2023) -
On the Reliability of Cue Conflict and Beyond
di: Kim, Pum Jun, et al.
Pubblicazione: (2026) -
PosterLlama: Bridging Design Ability of Langauge Model to Contents-Aware Layout Generation
di: Seol, Jaejung, et al.
Pubblicazione: (2024) -
Singular Value Scaling: Efficient Generative Model Compression via Pruned Weights Refinement
di: Kim, Hyeonjin, et al.
Pubblicazione: (2024) -
BF-STVSR: B-Splines and Fourier-Best Friends for High Fidelity Spatial-Temporal Video Super-Resolution
di: Kim, Eunjin, et al.
Pubblicazione: (2025)