AMEGO: Active Memory from long EGOcentric videos
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Goletto, Gabriele, Nagarajan, Tushar, Averta, Giuseppe, Damen, Dima |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Egocentric zone-aware action recognition across environments
par: Peirone, Simone Alberto, et autres
Publié: (2024)
par: Peirone, Simone Alberto, et autres
Publié: (2024)
PREGO: online mistake detection in PRocedural EGOcentric videos
par: Flaborea, Alessandro, et autres
Publié: (2024)
par: Flaborea, Alessandro, et autres
Publié: (2024)
An Outlook into the Future of Egocentric Vision
par: Plizzari, Chiara, et autres
Publié: (2023)
par: Plizzari, Chiara, et autres
Publié: (2023)
Get a Grip: Reconstructing Hand-Object Stable Grasps in Egocentric Videos
par: Zhu, Zhifan, et autres
Publié: (2023)
par: Zhu, Zhifan, et autres
Publié: (2023)
HiERO: understanding the hierarchy of human behavior enhances reasoning on egocentric videos
par: Peirone, Simone Alberto, et autres
Publié: (2025)
par: Peirone, Simone Alberto, et autres
Publié: (2025)
What does CLIP know about peeling a banana?
par: Cuttano, Claudia, et autres
Publié: (2024)
par: Cuttano, Claudia, et autres
Publié: (2024)
HOI-Ref: Hand-Object Interaction Referral in Egocentric Vision
par: Bansal, Siddhant, et autres
Publié: (2024)
par: Bansal, Siddhant, et autres
Publié: (2024)
Leveraging Auxiliary Information in Text-to-Video Retrieval: A Review
par: Fragomeni, Adriano, et autres
Publié: (2025)
par: Fragomeni, Adriano, et autres
Publié: (2025)
Leveraging Modality Tags for Enhanced Cross-Modal Video Retrieval
par: Fragomeni, Adriano, et autres
Publié: (2025)
par: Fragomeni, Adriano, et autres
Publié: (2025)
Moment of Untruth: Dealing with Negative Queries in Video Moment Retrieval
par: Flanagan, Kevin, et autres
Publié: (2025)
par: Flanagan, Kevin, et autres
Publié: (2025)
SANSA: Unleashing the Hidden Semantics in SAM2 for Few-Shot Segmentation
par: Cuttano, Claudia, et autres
Publié: (2025)
par: Cuttano, Claudia, et autres
Publié: (2025)
SAMWISE: Infusing Wisdom in SAM2 for Text-Driven Video Segmentation
par: Cuttano, Claudia, et autres
Publié: (2024)
par: Cuttano, Claudia, et autres
Publié: (2024)
PointSt3R: Point Tracking through 3D Grounded Correspondence
par: Guerrier, Rhodri, et autres
Publié: (2025)
par: Guerrier, Rhodri, et autres
Publié: (2025)
Learning reusable concepts across different egocentric video understanding tasks
par: Peirone, Simone Alberto, et autres
Publié: (2025)
par: Peirone, Simone Alberto, et autres
Publié: (2025)
The N-Body Problem: Parallel Execution from Single-Person Egocentric Video
par: Zhu, Zhifan, et autres
Publié: (2025)
par: Zhu, Zhifan, et autres
Publié: (2025)
The revenge of BiSeNet: Efficient Multi-Task Image Segmentation
par: Rosi, Gabriele, et autres
Publié: (2024)
par: Rosi, Gabriele, et autres
Publié: (2024)
It's Just Another Day: Unique Video Captioning by Discriminative Prompting
par: Perrett, Toby, et autres
Publié: (2024)
par: Perrett, Toby, et autres
Publié: (2024)
The Invisible EgoHand: 3D Hand Forecasting through EgoBody Pose Estimation
par: Hatano, Masashi, et autres
Publié: (2025)
par: Hatano, Masashi, et autres
Publié: (2025)
Reconstructing Objects along Hand Interaction Timelines in Egocentric Video
par: Zhu, Zhifan, et autres
Publié: (2025)
par: Zhu, Zhifan, et autres
Publié: (2025)
EarthMatch: Iterative Coregistration for Fine-grained Localization of Astronaut Photography
par: Berton, Gabriele, et autres
Publié: (2024)
par: Berton, Gabriele, et autres
Publié: (2024)
Step Differences in Instructional Video
par: Nagarajan, Tushar, et autres
Publié: (2024)
par: Nagarajan, Tushar, et autres
Publié: (2024)
Every Shot Counts: Using Exemplars for Repetition Counting in Videos
par: Sinha, Saptarshi, et autres
Publié: (2024)
par: Sinha, Saptarshi, et autres
Publié: (2024)
Seeing without Pixels: Perception from Camera Trajectories
par: Xue, Zihui, et autres
Publié: (2025)
par: Xue, Zihui, et autres
Publié: (2025)
EgoPoints: Advancing Point Tracking for Egocentric Videos
par: Darkhalil, Ahmad, et autres
Publié: (2024)
par: Darkhalil, Ahmad, et autres
Publié: (2024)
GenHowTo: Learning to Generate Actions and State Transformations from Instructional Videos
par: Souček, Tomáš, et autres
Publié: (2023)
par: Souček, Tomáš, et autres
Publié: (2023)
LEGO: Learning EGOcentric Action Frame Generation via Visual Instruction Tuning
par: Lai, Bolin, et autres
Publié: (2023)
par: Lai, Bolin, et autres
Publié: (2023)
TIM: A Time Interval Machine for Audio-Visual Action Recognition
par: Chalk, Jacob, et autres
Publié: (2024)
par: Chalk, Jacob, et autres
Publié: (2024)
RGB-only Active 3D Scene Graph Generation for Indoor Mobile Robots
par: Modi, Giorgia, et autres
Publié: (2026)
par: Modi, Giorgia, et autres
Publié: (2026)
Fixed External Cameras as Common Prior Maps for Active 3D Scene Graph Generation
par: Modi, Giorgia, et autres
Publié: (2026)
par: Modi, Giorgia, et autres
Publié: (2026)
FORESCENE: FOREcasting human activity via latent SCENE graphs diffusion
par: Alliegro, Antonio, et autres
Publié: (2025)
par: Alliegro, Antonio, et autres
Publié: (2025)
Spatial Cognition from Egocentric Video: Out of Sight, Not Out of Mind
par: Plizzari, Chiara, et autres
Publié: (2024)
par: Plizzari, Chiara, et autres
Publié: (2024)
Beyond Caption-Based Queries for Video Moment Retrieval
par: Pujol-Perich, David, et autres
Publié: (2026)
par: Pujol-Perich, David, et autres
Publié: (2026)
TI-PREGO: Chain of Thought and In-Context Learning for Online Mistake Detection in PRocedural EGOcentric Videos
par: Plini, Leonardo, et autres
Publié: (2024)
par: Plini, Leonardo, et autres
Publié: (2024)
HiERO-StepG @ Ego4D Step Grounding Challenge: hierarchical activity understanding enables zero-shot step grounding
par: Zenotto, Andrea, et autres
Publié: (2026)
par: Zenotto, Andrea, et autres
Publié: (2026)
Cross-Domain Transfer Learning with CoRTe: Consistent and Reliable Transfer from Black-Box to Lightweight Segmentation Model
par: Cuttano, Claudia, et autres
Publié: (2024)
par: Cuttano, Claudia, et autres
Publié: (2024)
ShowHowTo: Generating Scene-Conditioned Step-by-Step Visual Instructions
par: Souček, Tomáš, et autres
Publié: (2024)
par: Souček, Tomáš, et autres
Publié: (2024)
Video Editing for Video Retrieval
par: Zhu, Bin, et autres
Publié: (2024)
par: Zhu, Bin, et autres
Publié: (2024)
Prime and Reach: Synthesising Body Motion for Gaze-Primed Object Reach
par: Hatano, Masashi, et autres
Publié: (2025)
par: Hatano, Masashi, et autres
Publié: (2025)
Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos
par: Majumder, Sagnik, et autres
Publié: (2024)
par: Majumder, Sagnik, et autres
Publié: (2024)
Detours for Navigating Instructional Videos
par: Ashutosh, Kumar, et autres
Publié: (2024)
par: Ashutosh, Kumar, et autres
Publié: (2024)
Documents similaires
-
Egocentric zone-aware action recognition across environments
par: Peirone, Simone Alberto, et autres
Publié: (2024) -
PREGO: online mistake detection in PRocedural EGOcentric videos
par: Flaborea, Alessandro, et autres
Publié: (2024) -
An Outlook into the Future of Egocentric Vision
par: Plizzari, Chiara, et autres
Publié: (2023) -
Get a Grip: Reconstructing Hand-Object Stable Grasps in Egocentric Videos
par: Zhu, Zhifan, et autres
Publié: (2023) -
HiERO: understanding the hierarchy of human behavior enhances reasoning on egocentric videos
par: Peirone, Simone Alberto, et autres
Publié: (2025)