A Large-Scale Study on Video Action Dataset Condensation
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yang, Guo, Sheng, Zheng, Bo, Wang, Limin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EgoVid-5M: A Large-Scale Video-Action Dataset for Egocentric Video Generation
di: Wang, Xiaofeng, et al.
Pubblicazione: (2024)
di: Wang, Xiaofeng, et al.
Pubblicazione: (2024)
Adapting Short-Term Transformers for Action Detection in Untrimmed Videos
di: Yang, Min, et al.
Pubblicazione: (2023)
di: Yang, Min, et al.
Pubblicazione: (2023)
ActionHub: A Large-scale Action Video Description Dataset for Zero-shot Action Recognition
di: Zhou, Jiaming, et al.
Pubblicazione: (2024)
di: Zhou, Jiaming, et al.
Pubblicazione: (2024)
Action100M: A Large-scale Video Action Dataset
di: Chen, Delong, et al.
Pubblicazione: (2026)
di: Chen, Delong, et al.
Pubblicazione: (2026)
PDPP: Projected Diffusion for Procedure Planning in Instructional Videos
di: Wang, Hanlin, et al.
Pubblicazione: (2023)
di: Wang, Hanlin, et al.
Pubblicazione: (2023)
Condensing Action Segmentation Datasets via Generative Network Inversion
di: Ding, Guodong, et al.
Pubblicazione: (2025)
di: Ding, Guodong, et al.
Pubblicazione: (2025)
Video Dataset Condensation with Diffusion Models
di: Li, Zhe, et al.
Pubblicazione: (2025)
di: Li, Zhe, et al.
Pubblicazione: (2025)
MobileViCLIP: An Efficient Video-Text Model for Mobile Devices
di: Yang, Min, et al.
Pubblicazione: (2025)
di: Yang, Min, et al.
Pubblicazione: (2025)
OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding
di: Zheng, Minghang, et al.
Pubblicazione: (2026)
di: Zheng, Minghang, et al.
Pubblicazione: (2026)
SpatialVID: A Large-Scale Video Dataset with Spatial Annotations
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation
di: Wang, Yi, et al.
Pubblicazione: (2023)
di: Wang, Yi, et al.
Pubblicazione: (2023)
VideoNet: A Large-Scale Dataset for Domain-Specific Action Recognition
di: Yadav, Tanush, et al.
Pubblicazione: (2026)
di: Yadav, Tanush, et al.
Pubblicazione: (2026)
WildWorld: A Large-Scale Dataset for Dynamic World Modeling with Actions and Explicit State toward Generative ARPG
di: Li, Zhen, et al.
Pubblicazione: (2026)
di: Li, Zhen, et al.
Pubblicazione: (2026)
UENR-600K: A Large-Scale Physically Grounded Dataset for Nighttime Video Deraining
di: Yang, Pei, et al.
Pubblicazione: (2026)
di: Yang, Pei, et al.
Pubblicazione: (2026)
MM-SEAL: A Large-scale Video Dataset of Multi-person Multi-grained Spatio-temporally Action Localization
di: Chen, Shimin, et al.
Pubblicazione: (2022)
di: Chen, Shimin, et al.
Pubblicazione: (2022)
Multisize Dataset Condensation
di: He, Yang, et al.
Pubblicazione: (2024)
di: He, Yang, et al.
Pubblicazione: (2024)
SportsHHI: A Dataset for Human-Human Interaction Detection in Sports Videos
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
UW-VOS: A Large-Scale Dataset for Underwater Video Object Segmentation
di: Zhao, Hongshen, et al.
Pubblicazione: (2026)
di: Zhao, Hongshen, et al.
Pubblicazione: (2026)
TalkCuts: A Large-Scale Dataset for Multi-Shot Human Speech Video Generation
di: Chen, Jiaben, et al.
Pubblicazione: (2025)
di: Chen, Jiaben, et al.
Pubblicazione: (2025)
SceneScribe-1M: A Large-Scale Video Dataset with Comprehensive Geometric and Semantic Annotations
di: Wang, Yunnan, et al.
Pubblicazione: (2026)
di: Wang, Yunnan, et al.
Pubblicazione: (2026)
VideoUFO: A Million-Scale User-Focused Dataset for Text-to-Video Generation
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
ROVR-Open-Dataset: A Large-Scale Depth Dataset for Autonomous Driving
di: Guo, Xianda, et al.
Pubblicazione: (2025)
di: Guo, Xianda, et al.
Pubblicazione: (2025)
Temporal2Seq: A Unified Framework for Temporal Video Understanding Tasks
di: Yang, Min, et al.
Pubblicazione: (2024)
di: Yang, Min, et al.
Pubblicazione: (2024)
AnyHand: A Large-Scale Synthetic Dataset for RGB(-D) Hand Pose Estimation
di: Si, Chen, et al.
Pubblicazione: (2026)
di: Si, Chen, et al.
Pubblicazione: (2026)
MotionScape: A Large-Scale Real-World Highly Dynamic UAV Video Dataset for World Models
di: Guo, Zile, et al.
Pubblicazione: (2026)
di: Guo, Zile, et al.
Pubblicazione: (2026)
MSVCOD:A Large-Scale Multi-Scene Dataset for Video Camouflage Object Detection
di: Gao, Shuyong, et al.
Pubblicazione: (2025)
di: Gao, Shuyong, et al.
Pubblicazione: (2025)
TripVVT: A Large-Scale Triplet Dataset and a Coarse-Mask Baseline for In-the-Wild Video Virtual Try-On
di: Shao, Dingbao, et al.
Pubblicazione: (2026)
di: Shao, Dingbao, et al.
Pubblicazione: (2026)
Sparse Global Matching for Video Frame Interpolation with Large Motion
di: Liu, Chunxu, et al.
Pubblicazione: (2024)
di: Liu, Chunxu, et al.
Pubblicazione: (2024)
HabitAction: A Video Dataset for Human Habitual Behavior Recognition
di: Li, Hongwu, et al.
Pubblicazione: (2024)
di: Li, Hongwu, et al.
Pubblicazione: (2024)
VADB: A Large-Scale Video Aesthetic Database with Professional and Multi-Dimensional Annotations
di: Qiao, Qianqian, et al.
Pubblicazione: (2025)
di: Qiao, Qianqian, et al.
Pubblicazione: (2025)
Progressive Video Condensation with MLLM Agent for Long-form Video Understanding
di: Yin, Yufei, et al.
Pubblicazione: (2026)
di: Yin, Yufei, et al.
Pubblicazione: (2026)
MiraData: A Large-Scale Video Dataset with Long Durations and Structured Captions
di: Ju, Xuan, et al.
Pubblicazione: (2024)
di: Ju, Xuan, et al.
Pubblicazione: (2024)
InternVideo2: Scaling Foundation Models for Multimodal Video Understanding
di: Wang, Yi, et al.
Pubblicazione: (2024)
di: Wang, Yi, et al.
Pubblicazione: (2024)
DH-FaceVid-1K: A Large-Scale High-Quality Dataset for Face Video Generation
di: Di, Donglin, et al.
Pubblicazione: (2024)
di: Di, Donglin, et al.
Pubblicazione: (2024)
OpenHumanVid: A Large-Scale High-Quality Dataset for Enhancing Human-Centric Video Generation
di: Li, Hui, et al.
Pubblicazione: (2024)
di: Li, Hui, et al.
Pubblicazione: (2024)
BASKET: A Large-Scale Video Dataset for Fine-Grained Skill Estimation
di: Pan, Yulu, et al.
Pubblicazione: (2025)
di: Pan, Yulu, et al.
Pubblicazione: (2025)
OpenVE-3M: A Large-Scale High-Quality Dataset for Instruction-Guided Video Editing
di: He, Haoyang, et al.
Pubblicazione: (2025)
di: He, Haoyang, et al.
Pubblicazione: (2025)
BACON: Bayesian Optimal Condensation Framework for Dataset Distillation
di: Zhou, Zheng, et al.
Pubblicazione: (2024)
di: Zhou, Zheng, et al.
Pubblicazione: (2024)
DriveWAM: Video Generative Priors Enable Scalable World-Action Modeling for Autonomous Driving
di: Shi, Chen, et al.
Pubblicazione: (2026)
di: Shi, Chen, et al.
Pubblicazione: (2026)
Knowledge Condensation and Reasoning for Knowledge-based VQA
di: Hao, Dongze, et al.
Pubblicazione: (2024)
di: Hao, Dongze, et al.
Pubblicazione: (2024)
Documenti analoghi
-
EgoVid-5M: A Large-Scale Video-Action Dataset for Egocentric Video Generation
di: Wang, Xiaofeng, et al.
Pubblicazione: (2024) -
Adapting Short-Term Transformers for Action Detection in Untrimmed Videos
di: Yang, Min, et al.
Pubblicazione: (2023) -
ActionHub: A Large-scale Action Video Description Dataset for Zero-shot Action Recognition
di: Zhou, Jiaming, et al.
Pubblicazione: (2024) -
Action100M: A Large-scale Video Action Dataset
di: Chen, Delong, et al.
Pubblicazione: (2026) -
PDPP: Projected Diffusion for Procedure Planning in Instructional Videos
di: Wang, Hanlin, et al.
Pubblicazione: (2023)