Anticipating Next Active Objects for Egocentric Videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Thakur, Sanket, Beyan, Cigdem, Morerio, Pietro, Murino, Vittorio, Del Bue, Alessio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pre-trained Multiple Latent Variable Generative Models are good defenders against Adversarial Attacks
di: Serez, Dario, et al.
Pubblicazione: (2024)
di: Serez, Dario, et al.
Pubblicazione: (2024)
A Mutual Information Perspective on Multiple Latent Variable Generative Models for Positive View Generation
di: Serez, Dario, et al.
Pubblicazione: (2025)
di: Serez, Dario, et al.
Pubblicazione: (2025)
MADPOT: Medical Anomaly Detection with CLIP Adaptation and Partial Optimal Transport
di: Shiri, Mahshid, et al.
Pubblicazione: (2025)
di: Shiri, Mahshid, et al.
Pubblicazione: (2025)
Discriminator-Guided Adaptive Diffusion for Source-Free Test-Time Adaptation under Image Corruptions
di: Olivato, Francesco, et al.
Pubblicazione: (2026)
di: Olivato, Francesco, et al.
Pubblicazione: (2026)
HAC: Parameter-Efficient Hyperbolic Adaptation of CLIP for Zero-Shot VQA
di: Dibitonto, Francesco, et al.
Pubblicazione: (2026)
di: Dibitonto, Francesco, et al.
Pubblicazione: (2026)
MadCLIP: Few-shot Medical Anomaly Detection with CLIP
di: Shiri, Mahshid, et al.
Pubblicazione: (2025)
di: Shiri, Mahshid, et al.
Pubblicazione: (2025)
Upper-Body Pose-based Gaze Estimation for Privacy-Preserving 3D Gaze Target Detection
di: Toaiari, Andrea, et al.
Pubblicazione: (2024)
di: Toaiari, Andrea, et al.
Pubblicazione: (2024)
Model Debiasing by Learnable Data Augmentation
di: Morerio, Pietro, et al.
Pubblicazione: (2024)
di: Morerio, Pietro, et al.
Pubblicazione: (2024)
Look Around and Learn: Self-Training Object Detection by Exploration
di: Scarpellini, Gianluca, et al.
Pubblicazione: (2023)
di: Scarpellini, Gianluca, et al.
Pubblicazione: (2023)
Lifelong Imitation Learning with Multimodal Latent Replay and Incremental Adjustment
di: Yu, Fanqi, et al.
Pubblicazione: (2026)
di: Yu, Fanqi, et al.
Pubblicazione: (2026)
CloseUpAvatar: High-Fidelity Animatable Full-Body Avatars with Mixture of Multi-Scale Textures
di: Svitov, David, et al.
Pubblicazione: (2025)
di: Svitov, David, et al.
Pubblicazione: (2025)
BillBoard Splatting (BBSplat): Learnable Textured Primitives for Novel View Synthesis
di: Svitov, David, et al.
Pubblicazione: (2024)
di: Svitov, David, et al.
Pubblicazione: (2024)
HAHA: Highly Articulated Gaussian Human Avatars with Textured Mesh Prior
di: Svitov, David, et al.
Pubblicazione: (2024)
di: Svitov, David, et al.
Pubblicazione: (2024)
Memory-Augmented Vision-Language Agents for Persistent and Semantically Consistent Object Captioning
di: Galliena, Tommaso, et al.
Pubblicazione: (2026)
di: Galliena, Tommaso, et al.
Pubblicazione: (2026)
DiffAssemble: A Unified Graph-Diffusion Model for 2D and 3D Reassembly
di: Scarpellini, Gianluca, et al.
Pubblicazione: (2024)
di: Scarpellini, Gianluca, et al.
Pubblicazione: (2024)
ReassembleNet: Learnable Keypoints and Diffusion for 2D Fresco Reconstruction
di: Islam, Adeela, et al.
Pubblicazione: (2025)
di: Islam, Adeela, et al.
Pubblicazione: (2025)
Embodied Image Captioning: Self-supervised Learning Agents for Spatially Coherent Image Descriptions
di: Galliena, Tommaso, et al.
Pubblicazione: (2025)
di: Galliena, Tommaso, et al.
Pubblicazione: (2025)
E-M3RF: An Equivariant Multimodal 3D Re-assembly Framework
di: Islam, Adeela, et al.
Pubblicazione: (2025)
di: Islam, Adeela, et al.
Pubblicazione: (2025)
CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection
di: Appiani, Andrea, et al.
Pubblicazione: (2024)
di: Appiani, Andrea, et al.
Pubblicazione: (2024)
Uncertainty-guided Open-Set Source-Free Unsupervised Domain Adaptation with Target-private Class Segregation
di: Litrico, Mattia, et al.
Pubblicazione: (2024)
di: Litrico, Mattia, et al.
Pubblicazione: (2024)
Towards Unconstrained Human-Object Interaction
di: Tonini, Francesco, et al.
Pubblicazione: (2026)
di: Tonini, Francesco, et al.
Pubblicazione: (2026)
Dynamic Scoring with Enhanced Semantics for Training-Free Human-Object Interaction Detection
di: Tonini, Francesco, et al.
Pubblicazione: (2025)
di: Tonini, Francesco, et al.
Pubblicazione: (2025)
AL-GTD: Deep Active Learning for Gaze Target Detection
di: Tonini, Francesco, et al.
Pubblicazione: (2024)
di: Tonini, Francesco, et al.
Pubblicazione: (2024)
Leveraging Gaze and Set-of-Mark in VLLMs for Human-Object Interaction Anticipation from Egocentric Videos
di: Materia, Daniele, et al.
Pubblicazione: (2026)
di: Materia, Daniele, et al.
Pubblicazione: (2026)
PRAGO: Differentiable Multi-View Pose Optimization From Objectness Detections
di: Taiana, Matteo, et al.
Pubblicazione: (2024)
di: Taiana, Matteo, et al.
Pubblicazione: (2024)
Geometry-Conditioned Diffusion for Occlusion-Robust In-Bed Pose Estimation
di: Khameneh, Navid Aslankhani, et al.
Pubblicazione: (2026)
di: Khameneh, Navid Aslankhani, et al.
Pubblicazione: (2026)
EgoInteract: Synthetic Egocentric Videos Generation for Interaction Understanding and Anticipation
di: Leonardi, Rosario, et al.
Pubblicazione: (2026)
di: Leonardi, Rosario, et al.
Pubblicazione: (2026)
Learning to Evaluate Autonomous Behaviour in Human-Robot Interaction
di: Tiezzi, Matteo, et al.
Pubblicazione: (2025)
di: Tiezzi, Matteo, et al.
Pubblicazione: (2025)
Gaussian Heritage: 3D Digitization of Cultural Heritage with Integrated Object Segmentation
di: Dahaghin, Mahtab, et al.
Pubblicazione: (2024)
di: Dahaghin, Mahtab, et al.
Pubblicazione: (2024)
SelfGeo: Self-supervised and Geodesic-consistent Estimation of Keypoints on Deformable Shapes
di: Zohaib, Mohammad, et al.
Pubblicazione: (2024)
di: Zohaib, Mohammad, et al.
Pubblicazione: (2024)
Interaction Region Visual Transformer for Egocentric Action Anticipation
di: Roy, Debaditya, et al.
Pubblicazione: (2022)
di: Roy, Debaditya, et al.
Pubblicazione: (2022)
Anticipating Object State Changes in Long Procedural Videos
di: Manousaki, Victoria, et al.
Pubblicazione: (2024)
di: Manousaki, Victoria, et al.
Pubblicazione: (2024)
Maps from Motion (MfM): Generating 2D Semantic Maps from Sparse Multi-view Images
di: Toso, Matteo, et al.
Pubblicazione: (2024)
di: Toso, Matteo, et al.
Pubblicazione: (2024)
Listen to Look into the Future: Audio-Visual Egocentric Gaze Anticipation
di: Lai, Bolin, et al.
Pubblicazione: (2023)
di: Lai, Bolin, et al.
Pubblicazione: (2023)
Exploring Fine-grained Retail Product Discrimination with Zero-shot Object Classification Using Vision-Language Models
di: Tur, Anil Osman, et al.
Pubblicazione: (2024)
di: Tur, Anil Osman, et al.
Pubblicazione: (2024)
SplatFill: 3D Scene Inpainting via Depth-Guided Gaussian Splatting
di: Dahaghin, Mahtab, et al.
Pubblicazione: (2025)
di: Dahaghin, Mahtab, et al.
Pubblicazione: (2025)
Reconstructing Objects along Hand Interaction Timelines in Egocentric Video
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
6DGS: 6D Pose Estimation from a Single Image and a 3D Gaussian Splatting Model
di: Bortolon, Matteo, et al.
Pubblicazione: (2024)
di: Bortolon, Matteo, et al.
Pubblicazione: (2024)
WHOLE: World-Grounded Hand-Object Lifted from Egocentric Videos
di: Ye, Yufei, et al.
Pubblicazione: (2026)
di: Ye, Yufei, et al.
Pubblicazione: (2026)
Towards Stable Self-Supervised Object Representations in Unconstrained Egocentric Video
di: Tan, Yuting, et al.
Pubblicazione: (2026)
di: Tan, Yuting, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Pre-trained Multiple Latent Variable Generative Models are good defenders against Adversarial Attacks
di: Serez, Dario, et al.
Pubblicazione: (2024) -
A Mutual Information Perspective on Multiple Latent Variable Generative Models for Positive View Generation
di: Serez, Dario, et al.
Pubblicazione: (2025) -
MADPOT: Medical Anomaly Detection with CLIP Adaptation and Partial Optimal Transport
di: Shiri, Mahshid, et al.
Pubblicazione: (2025) -
Discriminator-Guided Adaptive Diffusion for Source-Free Test-Time Adaptation under Image Corruptions
di: Olivato, Francesco, et al.
Pubblicazione: (2026) -
HAC: Parameter-Efficient Hyperbolic Adaptation of CLIP for Zero-Shot VQA
di: Dibitonto, Francesco, et al.
Pubblicazione: (2026)