AMEGO: Active Memory from long EGOcentric videos
Fuente:
arXiv
Salvato in:
| Autori principali: | Goletto, Gabriele, Nagarajan, Tushar, Averta, Giuseppe, Damen, Dima |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Egocentric zone-aware action recognition across environments
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024)
PREGO: online mistake detection in PRocedural EGOcentric videos
di: Flaborea, Alessandro, et al.
Pubblicazione: (2024)
di: Flaborea, Alessandro, et al.
Pubblicazione: (2024)
An Outlook into the Future of Egocentric Vision
di: Plizzari, Chiara, et al.
Pubblicazione: (2023)
di: Plizzari, Chiara, et al.
Pubblicazione: (2023)
Get a Grip: Reconstructing Hand-Object Stable Grasps in Egocentric Videos
di: Zhu, Zhifan, et al.
Pubblicazione: (2023)
di: Zhu, Zhifan, et al.
Pubblicazione: (2023)
HiERO: understanding the hierarchy of human behavior enhances reasoning on egocentric videos
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
What does CLIP know about peeling a banana?
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
HOI-Ref: Hand-Object Interaction Referral in Egocentric Vision
di: Bansal, Siddhant, et al.
Pubblicazione: (2024)
di: Bansal, Siddhant, et al.
Pubblicazione: (2024)
Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review
di: Fragomeni, Adriano, et al.
Pubblicazione: (2025)
di: Fragomeni, Adriano, et al.
Pubblicazione: (2025)
Leveraging Modality Tags for Enhanced Cross-Modal Video Retrieval
di: Fragomeni, Adriano, et al.
Pubblicazione: (2025)
di: Fragomeni, Adriano, et al.
Pubblicazione: (2025)
Moment of Untruth: Dealing with Negative Queries in Video Moment Retrieval
di: Flanagan, Kevin, et al.
Pubblicazione: (2025)
di: Flanagan, Kevin, et al.
Pubblicazione: (2025)
SANSA: Unleashing the Hidden Semantics in SAM2 for Few-Shot Segmentation
di: Cuttano, Claudia, et al.
Pubblicazione: (2025)
di: Cuttano, Claudia, et al.
Pubblicazione: (2025)
SAMWISE: Infusing Wisdom in SAM2 for Text-Driven Video Segmentation
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
PointSt3R: Point Tracking through 3D Grounded Correspondence
di: Guerrier, Rhodri, et al.
Pubblicazione: (2025)
di: Guerrier, Rhodri, et al.
Pubblicazione: (2025)
Learning reusable concepts across different egocentric video understanding tasks
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
The N-Body Problem: Parallel Execution from Single-Person Egocentric Video
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
The revenge of BiSeNet: Efficient Multi-Task Image Segmentation
di: Rosi, Gabriele, et al.
Pubblicazione: (2024)
di: Rosi, Gabriele, et al.
Pubblicazione: (2024)
It's Just Another Day: Unique Video Captioning by Discriminative Prompting
di: Perrett, Toby, et al.
Pubblicazione: (2024)
di: Perrett, Toby, et al.
Pubblicazione: (2024)
The Invisible EgoHand: 3D Hand Forecasting through EgoBody Pose Estimation
di: Hatano, Masashi, et al.
Pubblicazione: (2025)
di: Hatano, Masashi, et al.
Pubblicazione: (2025)
Reconstructing Objects along Hand Interaction Timelines in Egocentric Video
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
di: Zhu, Zhifan, et al.
Pubblicazione: (2025)
EarthMatch: Iterative Coregistration for Fine-grained Localization of Astronaut Photography
di: Berton, Gabriele, et al.
Pubblicazione: (2024)
di: Berton, Gabriele, et al.
Pubblicazione: (2024)
Step Differences in Instructional Video
di: Nagarajan, Tushar, et al.
Pubblicazione: (2024)
di: Nagarajan, Tushar, et al.
Pubblicazione: (2024)
Every Shot Counts: Using Exemplars for Repetition Counting in Videos
di: Sinha, Saptarshi, et al.
Pubblicazione: (2024)
di: Sinha, Saptarshi, et al.
Pubblicazione: (2024)
Seeing without Pixels: Perception from Camera Trajectories
di: Xue, Zihui, et al.
Pubblicazione: (2025)
di: Xue, Zihui, et al.
Pubblicazione: (2025)
EgoPoints: Advancing Point Tracking for Egocentric Videos
di: Darkhalil, Ahmad, et al.
Pubblicazione: (2024)
di: Darkhalil, Ahmad, et al.
Pubblicazione: (2024)
GenHowTo: Learning to Generate Actions and State Transformations from Instructional Videos
di: Souček, Tomáš, et al.
Pubblicazione: (2023)
di: Souček, Tomáš, et al.
Pubblicazione: (2023)
LEGO: Learning EGOcentric Action Frame Generation via Visual Instruction Tuning
di: Lai, Bolin, et al.
Pubblicazione: (2023)
di: Lai, Bolin, et al.
Pubblicazione: (2023)
TIM: A Time Interval Machine for Audio-Visual Action Recognition
di: Chalk, Jacob, et al.
Pubblicazione: (2024)
di: Chalk, Jacob, et al.
Pubblicazione: (2024)
RGB-only Active 3D Scene Graph Generation for Indoor Mobile Robots
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
Fixed External Cameras as Common Prior Maps for Active 3D Scene Graph Generation
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
FORESCENE: FOREcasting human activity via latent SCENE graphs diffusion
di: Alliegro, Antonio, et al.
Pubblicazione: (2025)
di: Alliegro, Antonio, et al.
Pubblicazione: (2025)
Spatial Cognition from Egocentric Video: Out of Sight, Not Out of Mind
di: Plizzari, Chiara, et al.
Pubblicazione: (2024)
di: Plizzari, Chiara, et al.
Pubblicazione: (2024)
Beyond Caption-Based Queries for Video Moment Retrieval
di: Pujol-Perich, David, et al.
Pubblicazione: (2026)
di: Pujol-Perich, David, et al.
Pubblicazione: (2026)
TI-PREGO: Chain of Thought and In-Context Learning for Online Mistake Detection in PRocedural EGOcentric Videos
di: Plini, Leonardo, et al.
Pubblicazione: (2024)
di: Plini, Leonardo, et al.
Pubblicazione: (2024)
HiERO-StepG @ Ego4D Step Grounding Challenge: hierarchical activity understanding enables zero-shot step grounding
di: Zenotto, Andrea, et al.
Pubblicazione: (2026)
di: Zenotto, Andrea, et al.
Pubblicazione: (2026)
Cross-Domain Transfer Learning with CoRTe: Consistent and Reliable Transfer from Black-Box to Lightweight Segmentation Model
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
ShowHowTo: Generating Scene-Conditioned Step-by-Step Visual Instructions
di: Souček, Tomáš, et al.
Pubblicazione: (2024)
di: Souček, Tomáš, et al.
Pubblicazione: (2024)
Video Editing for Video Retrieval
di: Zhu, Bin, et al.
Pubblicazione: (2024)
di: Zhu, Bin, et al.
Pubblicazione: (2024)
Prime and Reach: Synthesising Body Motion for Gaze-Primed Object Reach
di: Hatano, Masashi, et al.
Pubblicazione: (2025)
di: Hatano, Masashi, et al.
Pubblicazione: (2025)
Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos
di: Majumder, Sagnik, et al.
Pubblicazione: (2024)
di: Majumder, Sagnik, et al.
Pubblicazione: (2024)
Detours for Navigating Instructional Videos
di: Ashutosh, Kumar, et al.
Pubblicazione: (2024)
di: Ashutosh, Kumar, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Egocentric zone-aware action recognition across environments
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024) -
PREGO: online mistake detection in PRocedural EGOcentric videos
di: Flaborea, Alessandro, et al.
Pubblicazione: (2024) -
An Outlook into the Future of Egocentric Vision
di: Plizzari, Chiara, et al.
Pubblicazione: (2023) -
Get a Grip: Reconstructing Hand-Object Stable Grasps in Egocentric Videos
di: Zhu, Zhifan, et al.
Pubblicazione: (2023) -
HiERO: understanding the hierarchy of human behavior enhances reasoning on egocentric videos
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)