FineBio: A Fine-Grained Video Dataset of Biological Experiments with Hierarchical Annotation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yagi, Takuma, Ohashi, Misaki, Huang, Yifei, Furuta, Ryosuke, Adachi, Shungo, Mitsuyama, Toutai, Sato, Yoichi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning Multiple Object States from Actions via Large Language Models
di: Tateno, Masatoshi, et al.
Pubblicazione: (2024)
di: Tateno, Masatoshi, et al.
Pubblicazione: (2024)
HanDyVQA: A Video QA Benchmark for Fine-Grained Hand-Object Interaction Dynamics
di: Tateno, Masatoshi, et al.
Pubblicazione: (2025)
di: Tateno, Masatoshi, et al.
Pubblicazione: (2025)
Exo2EgoDVC: Dense Video Captioning of Egocentric Procedural Activities Using Web Instructional Videos
di: Ohkawa, Takehiko, et al.
Pubblicazione: (2023)
di: Ohkawa, Takehiko, et al.
Pubblicazione: (2023)
ActionVOS: Actions as Prompts for Video Object Segmentation
di: Ouyang, Liangyang, et al.
Pubblicazione: (2024)
di: Ouyang, Liangyang, et al.
Pubblicazione: (2024)
Seeking Flat Minima with Mean Teacher on Semi- and Weakly-Supervised Domain Generalization for Object Detection
di: Furuta, Ryosuke, et al.
Pubblicazione: (2023)
di: Furuta, Ryosuke, et al.
Pubblicazione: (2023)
EgoInstruct: An Egocentric Video Dataset of Face-to-face Instructional Interactions with Multi-modal LLM Benchmarking
di: Sakai, Yuki, et al.
Pubblicazione: (2025)
di: Sakai, Yuki, et al.
Pubblicazione: (2025)
Pre-Training for 3D Hand Pose Estimation with Contrastive Learning on Large-Scale Hand Images in the Wild
di: Lin, Nie, et al.
Pubblicazione: (2024)
di: Lin, Nie, et al.
Pubblicazione: (2024)
Multi-speaker Attention Alignment for Multimodal Social Interaction
di: Ouyang, Liangyang, et al.
Pubblicazione: (2025)
di: Ouyang, Liangyang, et al.
Pubblicazione: (2025)
AssemblyHands-X: Modeling 3D Hand-Body Coordination for Understanding Bimanual Human Activities
di: Banno, Tatsuro, et al.
Pubblicazione: (2025)
di: Banno, Tatsuro, et al.
Pubblicazione: (2025)
SiMHand: Mining Similar Hands for Large-Scale 3D Hand Pose Pre-training
di: Lin, Nie, et al.
Pubblicazione: (2025)
di: Lin, Nie, et al.
Pubblicazione: (2025)
Masked Video and Body-worn IMU Autoencoder for Egocentric Action Recognition
di: Zhang, Mingfang, et al.
Pubblicazione: (2024)
di: Zhang, Mingfang, et al.
Pubblicazione: (2024)
Inference-time Trajectory Optimization for Manga Image Editing
di: Furuta, Ryosuke
Pubblicazione: (2026)
di: Furuta, Ryosuke
Pubblicazione: (2026)
The N-Body Problem: Parallel Execution from Single-Person Egocentric Video
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
Leadership Assessment in Pediatric Intensive Care Unit Team Training
di: Ouyang, Liangyang, et al.
Pubblicazione: (2025)
di: Ouyang, Liangyang, et al.
Pubblicazione: (2025)
Affordance-Guided Diffusion Prior for 3D Hand Reconstruction
di: Suzuki, Naru, et al.
Pubblicazione: (2025)
di: Suzuki, Naru, et al.
Pubblicazione: (2025)
WTS: A Pedestrian-Centric Traffic Video Dataset for Fine-grained Spatial-Temporal Understanding
di: Kong, Quan, et al.
Pubblicazione: (2024)
di: Kong, Quan, et al.
Pubblicazione: (2024)
HateClipSeg: A Segment-Level Annotated Dataset for Fine-Grained Hate Video Detection
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
SocialDirector: Training-Free Social Interaction Control for Multi-Person Video Generation
di: Ouyang, Liangyang, et al.
Pubblicazione: (2026)
di: Ouyang, Liangyang, et al.
Pubblicazione: (2026)
Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning
di: Pei, Baoqi, et al.
Pubblicazione: (2025)
di: Pei, Baoqi, et al.
Pubblicazione: (2025)
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)
BASKET: A Large-Scale Video Dataset for Fine-Grained Skill Estimation
di: Pan, Yulu, et al.
Pubblicazione: (2025)
di: Pan, Yulu, et al.
Pubblicazione: (2025)
FiGO: Fine-Grained Object Counting without Annotations
di: D'Alessandro, Adriano, et al.
Pubblicazione: (2025)
di: D'Alessandro, Adriano, et al.
Pubblicazione: (2025)
Fine-Grained Open-Vocabulary Object Detection with Fined-Grained Prompts: Task, Dataset and Benchmark
di: Liu, Ying, et al.
Pubblicazione: (2025)
di: Liu, Ying, et al.
Pubblicazione: (2025)
Towards Fine-Grained Human Motion Video Captioning
di: Song, Guorui, et al.
Pubblicazione: (2025)
di: Song, Guorui, et al.
Pubblicazione: (2025)
Learning Gaussian Data Augmentation in Feature Space for One-shot Object Detection in Manga
di: Taniguchi, Takara, et al.
Pubblicazione: (2024)
di: Taniguchi, Takara, et al.
Pubblicazione: (2024)
BrokenVideos: A Benchmark Dataset for Fine-Grained Artifact Localization in AI-Generated Videos
di: Lin, Jiahao, et al.
Pubblicazione: (2025)
di: Lin, Jiahao, et al.
Pubblicazione: (2025)
Benchmarking Badminton Action Recognition with a New Fine-Grained Dataset
di: Li, Qi, et al.
Pubblicazione: (2024)
di: Li, Qi, et al.
Pubblicazione: (2024)
Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
di: Chen, Harold Haodong, et al.
Pubblicazione: (2025)
FineMotion: A Dataset and Benchmark with both Spatial and Temporal Annotation for Fine-grained Motion Generation and Editing
di: Wu, Bizhu, et al.
Pubblicazione: (2025)
di: Wu, Bizhu, et al.
Pubblicazione: (2025)
PartNeXt: A Next-Generation Dataset for Fine-Grained and Hierarchical 3D Part Understanding
di: Wang, Penghao, et al.
Pubblicazione: (2025)
di: Wang, Penghao, et al.
Pubblicazione: (2025)
Text-guided Fine-Grained Video Anomaly Understanding
di: Gu, Jihao, et al.
Pubblicazione: (2025)
di: Gu, Jihao, et al.
Pubblicazione: (2025)
SketchVL: Policy Optimization via Fine-Grained Credit Assignment for Chart Understanding and More
di: Huang, Muye, et al.
Pubblicazione: (2026)
di: Huang, Muye, et al.
Pubblicazione: (2026)
Generating Vision-Language Navigation Instructions Incorporated Fine-Grained Alignment Annotations
di: Cui, Yibo, et al.
Pubblicazione: (2025)
di: Cui, Yibo, et al.
Pubblicazione: (2025)
FineVAU: A Novel Human-Aligned Benchmark for Fine-Grained Video Anomaly Understanding
di: Pereira, João, et al.
Pubblicazione: (2026)
di: Pereira, João, et al.
Pubblicazione: (2026)
Multi-entity Video Transformers for Fine-Grained Video Representation Learning
di: Walmer, Matthew, et al.
Pubblicazione: (2023)
di: Walmer, Matthew, et al.
Pubblicazione: (2023)
Towards Fine-Grained Video Question Answering
di: Dai, Wei, et al.
Pubblicazione: (2025)
di: Dai, Wei, et al.
Pubblicazione: (2025)
An Approach to Enriching Surgical Video Datasets for Fine-Grained Spatial-Temporal Understanding of Vision-Language Models
di: Maack, Lennart, et al.
Pubblicazione: (2026)
di: Maack, Lennart, et al.
Pubblicazione: (2026)
HieroAction: Hierarchically Guided VLM for Fine-Grained Action Analysis
di: Wu, Junhao, et al.
Pubblicazione: (2025)
di: Wu, Junhao, et al.
Pubblicazione: (2025)
Cross-Hierarchical Bidirectional Consistency Learning for Fine-Grained Visual Classification
di: Gao, Pengxiang, et al.
Pubblicazione: (2025)
di: Gao, Pengxiang, et al.
Pubblicazione: (2025)
EgoBrain: Synergizing Minds and Eyes For Human Action Understanding
di: Lin, Nie, et al.
Pubblicazione: (2025)
di: Lin, Nie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Learning Multiple Object States from Actions via Large Language Models
di: Tateno, Masatoshi, et al.
Pubblicazione: (2024) -
HanDyVQA: A Video QA Benchmark for Fine-Grained Hand-Object Interaction Dynamics
di: Tateno, Masatoshi, et al.
Pubblicazione: (2025) -
Exo2EgoDVC: Dense Video Captioning of Egocentric Procedural Activities Using Web Instructional Videos
di: Ohkawa, Takehiko, et al.
Pubblicazione: (2023) -
ActionVOS: Actions as Prompts for Video Object Segmentation
di: Ouyang, Liangyang, et al.
Pubblicazione: (2024) -
Seeking Flat Minima with Mean Teacher on Semi- and Weakly-Supervised Domain Generalization for Object Detection
di: Furuta, Ryosuke, et al.
Pubblicazione: (2023)