Interactive Episodic Memory with User Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Subedi, Nikesh, Bazzani, Loris, Al-Halah, Ziad |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How Would It Sound? Material-Controlled Multimodal Acoustic Profile Generation for Indoor Scenes
par: Saad, Mahnoor Fatima, et autres
Publié: (2025)
par: Saad, Mahnoor Fatima, et autres
Publié: (2025)
MistExit: Learning to Exit for Early Mistake Detection in Procedural Videos
par: Majumder, Sagnik, et autres
Publié: (2026)
par: Majumder, Sagnik, et autres
Publié: (2026)
Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos
par: Majumder, Sagnik, et autres
Publié: (2024)
par: Majumder, Sagnik, et autres
Publié: (2024)
Learning Spatial Features from Audio-Visual Correspondence in Egocentric Videos
par: Majumder, Sagnik, et autres
Publié: (2023)
par: Majumder, Sagnik, et autres
Publié: (2023)
Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos
par: Majumder, Sagnik, et autres
Publié: (2024)
par: Majumder, Sagnik, et autres
Publié: (2024)
UniCoRN: Unified Commented Retrieval Network with LMMs
par: Jaritz, Maximilian, et autres
Publié: (2025)
par: Jaritz, Maximilian, et autres
Publié: (2025)
Materialistic RIR: Material Conditioned Realistic RIR Generation
par: Saad, Mahnoor Fatima, et autres
Publié: (2026)
par: Saad, Mahnoor Fatima, et autres
Publié: (2026)
ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task
par: Pippi, Vittorio, et autres
Publié: (2025)
par: Pippi, Vittorio, et autres
Publié: (2025)
Learning Visual Hierarchies in Hyperbolic Space for Image Retrieval
par: Wang, Ziwei, et autres
Publié: (2024)
par: Wang, Ziwei, et autres
Publié: (2024)
Benchmarking Interaction, Beyond Policy: a Reproducible Benchmark for Collaborative Instance Object Navigation
par: Zorzi, Edoardo, et autres
Publié: (2026)
par: Zorzi, Edoardo, et autres
Publié: (2026)
EMemBench: Interactive Benchmarking of Episodic Memory for VLM Agents
par: Li, Xinze, et autres
Publié: (2026)
par: Li, Xinze, et autres
Publié: (2026)
ChartCheck: Explainable Fact-Checking over Real-World Chart Images
par: Akhtar, Mubashara, et autres
Publié: (2023)
par: Akhtar, Mubashara, et autres
Publié: (2023)
Towards Adaptable and Interactive Image Captioning with Data Augmentation and Episodic Memory
par: Anagnostopoulou, Aliki, et autres
Publié: (2023)
par: Anagnostopoulou, Aliki, et autres
Publié: (2023)
ViewFusion: Towards Multi-View Consistency via Interpolated Denoising
par: Yang, Xianghui, et autres
Publié: (2024)
par: Yang, Xianghui, et autres
Publié: (2024)
Multi-Level Conditioning by Pairing Localized Text and Sketch for Fashion Image Generation
par: Liu, Ziyue, et autres
Publié: (2026)
par: Liu, Ziyue, et autres
Publié: (2026)
LatteCLIP: Unsupervised CLIP Fine-Tuning via LMM-Synthetic Texts
par: Cao, Anh-Quan, et autres
Publié: (2024)
par: Cao, Anh-Quan, et autres
Publié: (2024)
ESceme: Vision-and-Language Navigation with Episodic Scene Memory
par: Zheng, Qi, et autres
Publié: (2023)
par: Zheng, Qi, et autres
Publié: (2023)
Online Episodic Memory Visual Query Localization with Egocentric Streaming Object Memory
par: Manigrasso, Zaira, et autres
Publié: (2024)
par: Manigrasso, Zaira, et autres
Publié: (2024)
Exploring Multimodal LMMs for Online Episodic Memory Question Answering on the Edge
par: Lando, Giuseppe, et autres
Publié: (2026)
par: Lando, Giuseppe, et autres
Publié: (2026)
EGOSTREAM: A Diagnostic Benchmark for Streaming Episodic Memory in Egocentric Vision
par: Forte, Rosario, et autres
Publié: (2026)
par: Forte, Rosario, et autres
Publié: (2026)
ESSENTIAL: Episodic and Semantic Memory Integration for Video Class-Incremental Learning
par: Lee, Jongseo, et autres
Publié: (2025)
par: Lee, Jongseo, et autres
Publié: (2025)
OSGNet with MLLM Reranking @ Ego4D Episodic Memory Challenge 2026
par: Feng, Yisen, et autres
Publié: (2026)
par: Feng, Yisen, et autres
Publié: (2026)
Planning from Imagination: Episodic Simulation and Episodic Memory for Vision-and-Language Navigation
par: Pan, Yiyuan, et autres
Publié: (2024)
par: Pan, Yiyuan, et autres
Publié: (2024)
Visual Episodic Memory-based Exploration
par: Vice, Jack, et autres
Publié: (2024)
par: Vice, Jack, et autres
Publié: (2024)
OSGNet @ Ego4D Episodic Memory Challenge 2025
par: Feng, Yisen, et autres
Publié: (2025)
par: Feng, Yisen, et autres
Publié: (2025)
Chameleon: Episodic Memory for Long-Horizon Robotic Manipulation
par: Guo, Xinying, et autres
Publié: (2026)
par: Guo, Xinying, et autres
Publié: (2026)
ESCAPE: Episodic Spatial Memory and Adaptive Execution Policy for Long-Horizon Mobile Manipulation
par: Qian, Jingjing, et autres
Publié: (2026)
par: Qian, Jingjing, et autres
Publié: (2026)
GCAgent: Long-Video Understanding via Schematic and Narrative Episodic Memory
par: Yeo, Jeong Hun, et autres
Publié: (2025)
par: Yeo, Jeong Hun, et autres
Publié: (2025)
ObjectNLQ @ Ego4D Episodic Memory Challenge 2024
par: Feng, Yisen, et autres
Publié: (2024)
par: Feng, Yisen, et autres
Publié: (2024)
Improving Generalization Performance of YOLOv8 for Camera Trap Object Detection
par: Subedi, Aroj
Publié: (2024)
par: Subedi, Aroj
Publié: (2024)
Med-MMFL: A Multimodal Federated Learning Benchmark in Healthcare
par: Chhetri, Aavash, et autres
Publié: (2026)
par: Chhetri, Aavash, et autres
Publié: (2026)
How Far Can Off-the-Shelf Multimodal Large Language Models Go in Online Episodic Memory Question Answering?
par: Lando, Giuseppe, et autres
Publié: (2025)
par: Lando, Giuseppe, et autres
Publié: (2025)
EAGLE: Episodic Appearance- and Geometry-aware Memory for Unified 2D-3D Visual Query Localization in Egocentric Vision
par: Cao, Yifei, et autres
Publié: (2025)
par: Cao, Yifei, et autres
Publié: (2025)
Reconstruction of Contour Lines During the Digitization of Contour Maps to Build a Digital Elevation Model
par: Subedi, Aroj, et autres
Publié: (2024)
par: Subedi, Aroj, et autres
Publié: (2024)
How to Take a Memorable Picture? Empowering Users with Actionable Feedback
par: Laiti, Francesco, et autres
Publié: (2026)
par: Laiti, Francesco, et autres
Publié: (2026)
PrIINeR: Towards Prior-Informed Implicit Neural Representations for Accelerated MRI
par: Hemidi, Ziad Al-Haj, et autres
Publié: (2025)
par: Hemidi, Ziad Al-Haj, et autres
Publié: (2025)
Video-EM: Event-Centric Episodic Memory for Long-Form Video Understanding
par: Wang, Yun, et autres
Publié: (2025)
par: Wang, Yun, et autres
Publié: (2025)
Ranking-based Preference Optimization for Diffusion Models from Implicit User Feedback
par: Wu, Yi-Lun, et autres
Publié: (2025)
par: Wu, Yi-Lun, et autres
Publié: (2025)
SE3D: A Framework For Saliency Method Evaluation In 3D Imaging
par: Wiśniewski, Mariusz, et autres
Publié: (2024)
par: Wiśniewski, Mariusz, et autres
Publié: (2024)
Question-guided Visual Compression with Memory Feedback for Long-Term Video Understanding
par: Yamao, Sosuke, et autres
Publié: (2026)
par: Yamao, Sosuke, et autres
Publié: (2026)
Documents similaires
-
How Would It Sound? Material-Controlled Multimodal Acoustic Profile Generation for Indoor Scenes
par: Saad, Mahnoor Fatima, et autres
Publié: (2025) -
MistExit: Learning to Exit for Early Mistake Detection in Procedural Videos
par: Majumder, Sagnik, et autres
Publié: (2026) -
Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos
par: Majumder, Sagnik, et autres
Publié: (2024) -
Learning Spatial Features from Audio-Visual Correspondence in Egocentric Videos
par: Majumder, Sagnik, et autres
Publié: (2023) -
Which Viewpoint Shows it Best? Language for Weakly Supervising View Selection in Multi-view Instructional Videos
par: Majumder, Sagnik, et autres
Publié: (2024)