HAVANA: Hierarchical stochastic neighbor embedding for Accelerated Video ANnotAtions
Fuente:
arXiv
Salvato in:
| Autori principali: | Bobe, Alexandru, van Gemert, Jan C. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Assessing Situational and Spatial Awareness of VLMs with Synthetically Generated Video
di: Benschop, Pascal, et al.
Pubblicazione: (2026)
di: Benschop, Pascal, et al.
Pubblicazione: (2026)
End-to-End Chess Recognition
di: Masouris, Athanasios, et al.
Pubblicazione: (2023)
di: Masouris, Athanasios, et al.
Pubblicazione: (2023)
End-to-End Implicit Neural Representations for Classification
di: Gielisse, Alexander, et al.
Pubblicazione: (2025)
di: Gielisse, Alexander, et al.
Pubblicazione: (2025)
Learning to Adapt to Position Bias in Vision Transformer Classifiers
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2025)
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2025)
LayoutGKN: Graph Similarity Learning of Floor Plans
di: van Engelenburg, Casper, et al.
Pubblicazione: (2025)
di: van Engelenburg, Casper, et al.
Pubblicazione: (2025)
PopulAtion Parameter Averaging (PAPA)
di: Jolicoeur-Martineau, Alexia, et al.
Pubblicazione: (2023)
di: Jolicoeur-Martineau, Alexia, et al.
Pubblicazione: (2023)
Local Attention Transformers for High-Detail Optical Flow Upsampling
di: Gielisse, Alexander, et al.
Pubblicazione: (2024)
di: Gielisse, Alexander, et al.
Pubblicazione: (2024)
Pushing the boundaries of event subsampling in event-based video classification using CNNs
di: Araghi, Hesam, et al.
Pubblicazione: (2024)
di: Araghi, Hesam, et al.
Pubblicazione: (2024)
Identifying Ethical Biases in Action Recognition Models
di: Baltaretu, Ana, et al.
Pubblicazione: (2026)
di: Baltaretu, Ana, et al.
Pubblicazione: (2026)
Making Every Event Count: Balancing Data Efficiency and Accuracy in Event Camera Subsampling
di: Araghi, Hesam, et al.
Pubblicazione: (2025)
di: Araghi, Hesam, et al.
Pubblicazione: (2025)
Learning Physics From Video: Unsupervised Physical Parameter Estimation for Continuous Dynamical Systems
di: Garcia, Alejandro Castañeda, et al.
Pubblicazione: (2024)
di: Garcia, Alejandro Castañeda, et al.
Pubblicazione: (2024)
PSALM: Pixelwise SegmentAtion with Large Multi-Modal Model
di: Zhang, Zheng, et al.
Pubblicazione: (2024)
di: Zhang, Zheng, et al.
Pubblicazione: (2024)
Deep Continuous Networks
di: Tomen, Nergis, et al.
Pubblicazione: (2024)
di: Tomen, Nergis, et al.
Pubblicazione: (2024)
Bringing a Personal Point of View: Evaluating Dynamic 3D Gaussian Splatting for Egocentric Scene Reconstruction
di: Warchocki, Jan, et al.
Pubblicazione: (2026)
di: Warchocki, Jan, et al.
Pubblicazione: (2026)
Deep activity propagation via weight initialization in spiking neural networks
di: Micheli, Aurora, et al.
Pubblicazione: (2024)
di: Micheli, Aurora, et al.
Pubblicazione: (2024)
ARC: Anchored Representation Clouds for High-Resolution INR Classification
di: Luijmes, Joost, et al.
Pubblicazione: (2025)
di: Luijmes, Joost, et al.
Pubblicazione: (2025)
Do Object Detection Localization Errors Affect Human Performance and Trust?
di: de Witte, Sven, et al.
Pubblicazione: (2024)
di: de Witte, Sven, et al.
Pubblicazione: (2024)
RAP-SR: RestorAtion Prior Enhancement in Diffusion Models for Realistic Image Super-Resolution
di: Wang, Jiangang, et al.
Pubblicazione: (2024)
di: Wang, Jiangang, et al.
Pubblicazione: (2024)
Pushing Joint Image Denoising and Classification to the Edge
di: Markhorst, Thomas C, et al.
Pubblicazione: (2024)
di: Markhorst, Thomas C, et al.
Pubblicazione: (2024)
Aligning Object Detector Bounding Boxes with Human Preference
di: Strafforello, Ombretta, et al.
Pubblicazione: (2024)
di: Strafforello, Ombretta, et al.
Pubblicazione: (2024)
GazeHTA: End-to-end Gaze Target Detection with Head-Target Association
di: Lin, Zhi-Yi, et al.
Pubblicazione: (2024)
di: Lin, Zhi-Yi, et al.
Pubblicazione: (2024)
Rare-Aware Autoencoding: Reconstructing Spatially Imbalanced Data
di: Garcia, Alejandro Castañeda, et al.
Pubblicazione: (2026)
di: Garcia, Alejandro Castañeda, et al.
Pubblicazione: (2026)
MSD: A Benchmark Dataset for Floor Plan Generation of Building Complexes
di: van Engelenburg, Casper, et al.
Pubblicazione: (2024)
di: van Engelenburg, Casper, et al.
Pubblicazione: (2024)
VIPriors 4: Visual Inductive Priors for Data-Efficient Deep Learning Challenges
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2024)
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2024)
Data-Efficient Challenges in Visual Inductive Priors: A Retrospective
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2025)
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2025)
Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
di: Wang, Yiyu, et al.
Pubblicazione: (2025)
di: Wang, Yiyu, et al.
Pubblicazione: (2025)
CleanUMamba: A Compact Mamba Network for Speech Denoising using Channel Pruning
di: Groot, Sjoerd, et al.
Pubblicazione: (2024)
di: Groot, Sjoerd, et al.
Pubblicazione: (2024)
MuPPet: Multi-person 2D-to-3D Pose Lifting
di: Markhorst, Thomas, et al.
Pubblicazione: (2026)
di: Markhorst, Thomas, et al.
Pubblicazione: (2026)
An Analysis of Multi-Task Architectures for the Hierarchic Multi-Label Problem of Vehicle Model and Make Classification
di: Manole, Alexandru, et al.
Pubblicazione: (2026)
di: Manole, Alexandru, et al.
Pubblicazione: (2026)
Hierarchical Memory for Long Video QA
di: Wang, Yiqin, et al.
Pubblicazione: (2024)
di: Wang, Yiqin, et al.
Pubblicazione: (2024)
AccVideo: Accelerating Video Diffusion Model with Synthetic Dataset
di: Zhang, Haiyu, et al.
Pubblicazione: (2025)
di: Zhang, Haiyu, et al.
Pubblicazione: (2025)
Variance-Based Pruning for Accelerating and Compressing Trained Networks
di: Berisha, Uranik, et al.
Pubblicazione: (2025)
di: Berisha, Uranik, et al.
Pubblicazione: (2025)
GaussianVideo: Efficient Video Representation via Hierarchical Gaussian Splatting
di: Bond, Andrew, et al.
Pubblicazione: (2025)
di: Bond, Andrew, et al.
Pubblicazione: (2025)
Video Compression with Hierarchical Temporal Neural Representation
di: Zhu, Jun, et al.
Pubblicazione: (2026)
di: Zhu, Jun, et al.
Pubblicazione: (2026)
VideoLifter: Lifting Videos to 3D with Fast Hierarchical Stereo Alignment
di: Cong, Wenyan, et al.
Pubblicazione: (2025)
di: Cong, Wenyan, et al.
Pubblicazione: (2025)
Hierarchical Separable Video Transformer for Snapshot Compressive Imaging
di: Wang, Ping, et al.
Pubblicazione: (2024)
di: Wang, Ping, et al.
Pubblicazione: (2024)
Accelerating Video Diffusion Models via Distribution Matching
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
RMAvatar: Photorealistic Human Avatar Reconstruction from Monocular Video Based on Rectified Mesh-embedded Gaussians
di: Peng, Sen, et al.
Pubblicazione: (2025)
di: Peng, Sen, et al.
Pubblicazione: (2025)
TaoCache: Structure-Maintained Video Generation Acceleration
di: Fan, Zhentao, et al.
Pubblicazione: (2025)
di: Fan, Zhentao, et al.
Pubblicazione: (2025)
Accelerating Text-to-Video Generation with Calibrated Sparse Attention
di: Yehezkel, Shai, et al.
Pubblicazione: (2026)
di: Yehezkel, Shai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Assessing Situational and Spatial Awareness of VLMs with Synthetically Generated Video
di: Benschop, Pascal, et al.
Pubblicazione: (2026) -
End-to-End Chess Recognition
di: Masouris, Athanasios, et al.
Pubblicazione: (2023) -
End-to-End Implicit Neural Representations for Classification
di: Gielisse, Alexander, et al.
Pubblicazione: (2025) -
Learning to Adapt to Position Bias in Vision Transformer Classifiers
di: Bruintjes, Robert-Jan, et al.
Pubblicazione: (2025) -
LayoutGKN: Graph Similarity Learning of Floor Plans
di: van Engelenburg, Casper, et al.
Pubblicazione: (2025)