Egocentric Co-Pilot: Web-Native Smart-Glasses Agents for Assistive Egocentric AI
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Sicheng, Huang, Yukai, Cai, Weitong, Sun, Shitong, Fang, Fengyi, He, You, Xie, Yiqiao, Deng, Jiankang, Zhang, Hang, Song, Jifei, Zhang, Zhensong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Plug-and-Play Clarifier: A Zero-Shot Multimodal Framework for Egocentric Intent Disambiguation
por: Yang, Sicheng, et al.
Publicado: (2025)
por: Yang, Sicheng, et al.
Publicado: (2025)
Optimizing Multimodal LLMs for Egocentric Video Understanding: A Solution for the HD-EPIC VQA Challenge
por: Yang, Sicheng, et al.
Publicado: (2026)
por: Yang, Sicheng, et al.
Publicado: (2026)
EgoGraph: Temporal Knowledge Graph for Egocentric Video Understanding
por: Sun, Shitong, et al.
Publicado: (2026)
por: Sun, Shitong, et al.
Publicado: (2026)
Color When It Counts: Grayscale-Guided Online Triggering for Always-On Streaming Video Sensing
por: Cai, Weitong, et al.
Publicado: (2026)
por: Cai, Weitong, et al.
Publicado: (2026)
Benchmarking Egocentric Multimodal Goal Inference for Assistive Wearable Agents
por: Veerabadran, Vijay, et al.
Publicado: (2025)
por: Veerabadran, Vijay, et al.
Publicado: (2025)
HaWoR: World-Space Hand Motion Reconstruction from Egocentric Videos
por: Zhang, Jinglei, et al.
Publicado: (2025)
por: Zhang, Jinglei, et al.
Publicado: (2025)
Ego2Web: A Web Agent Benchmark Grounded in Egocentric Videos
por: Yu, Shoubin, et al.
Publicado: (2026)
por: Yu, Shoubin, et al.
Publicado: (2026)
An Egocentric Vision-Language Model based Portable Real-time Smart Assistant
por: Huang, Yifei, et al.
Publicado: (2025)
por: Huang, Yifei, et al.
Publicado: (2025)
LatSearch: Latent Reward-Guided Search for Faster Inference-Time Scaling in Video Diffusion
por: Zhao, Zengqun, et al.
Publicado: (2026)
por: Zhao, Zengqun, et al.
Publicado: (2026)
CoordSpeaker: Exploiting Gesture Captioning for Coordinated Caption-Empowered Co-Speech Gesture Generation
por: Fang, Fengyi, et al.
Publicado: (2025)
por: Fang, Fengyi, et al.
Publicado: (2025)
EgoLife: Towards Egocentric Life Assistant
por: Yang, Jingkang, et al.
Publicado: (2025)
por: Yang, Jingkang, et al.
Publicado: (2025)
VidEgoThink: Assessing Egocentric Video Understanding Capabilities for Embodied AI
por: Cheng, Sijie, et al.
Publicado: (2024)
por: Cheng, Sijie, et al.
Publicado: (2024)
Learning Precise Affordances from Egocentric Videos for Robotic Manipulation
por: Li, Gen, et al.
Publicado: (2024)
por: Li, Gen, et al.
Publicado: (2024)
Do You See What I Am Pointing At? Gesture-Based Egocentric Video Question Answering
por: Choi, Yura, et al.
Publicado: (2026)
por: Choi, Yura, et al.
Publicado: (2026)
Egocentric Vision Language Planning
por: Fang, Zhirui, et al.
Publicado: (2024)
por: Fang, Zhirui, et al.
Publicado: (2024)
EgoHandICL: Egocentric 3D Hand Reconstruction with In-Context Learning
por: Xie, Binzhu, et al.
Publicado: (2026)
por: Xie, Binzhu, et al.
Publicado: (2026)
ENACT: Evaluating Embodied Cognition with World Modeling of Egocentric Interaction
por: Wang, Qineng, et al.
Publicado: (2025)
por: Wang, Qineng, et al.
Publicado: (2025)
Egocentric Visibility-Aware Human Pose Estimation
por: Dai, Peng, et al.
Publicado: (2026)
por: Dai, Peng, et al.
Publicado: (2026)
Vinci: A Real-time Embodied Smart Assistant based on Egocentric Vision-Language Model
por: Huang, Yifei, et al.
Publicado: (2024)
por: Huang, Yifei, et al.
Publicado: (2024)
Retrieval-Augmented Egocentric Video Captioning
por: Xu, Jilan, et al.
Publicado: (2024)
por: Xu, Jilan, et al.
Publicado: (2024)
Proactive Assistant Dialogue Generation from Streaming Egocentric Videos
por: Zhang, Yichi, et al.
Publicado: (2025)
por: Zhang, Yichi, et al.
Publicado: (2025)
Fine-grained Spatiotemporal Grounding on Egocentric Videos
por: Liang, Shuo, et al.
Publicado: (2025)
por: Liang, Shuo, et al.
Publicado: (2025)
EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT
por: Pei, Baoqi, et al.
Publicado: (2025)
por: Pei, Baoqi, et al.
Publicado: (2025)
Listening with the Eyes: Benchmarking Egocentric Co-Speech Grounding across Space and Time
por: Zhou, Weijie, et al.
Publicado: (2026)
por: Zhou, Weijie, et al.
Publicado: (2026)
Egocentric Bias in Vision-Language Models
por: Wang, Maijunxian, et al.
Publicado: (2026)
por: Wang, Maijunxian, et al.
Publicado: (2026)
An Outlook into the Future of Egocentric Vision
por: Plizzari, Chiara, et al.
Publicado: (2023)
por: Plizzari, Chiara, et al.
Publicado: (2023)
FG-Portrait: 3D Flow Guided Editable Portrait Animation
por: Xu, Yating, et al.
Publicado: (2026)
por: Xu, Yating, et al.
Publicado: (2026)
Exo2EgoDVC: Dense Video Captioning of Egocentric Procedural Activities Using Web Instructional Videos
por: Ohkawa, Takehiko, et al.
Publicado: (2023)
por: Ohkawa, Takehiko, et al.
Publicado: (2023)
EgoAVU: Egocentric Audio-Visual Understanding
por: Seth, Ashish, et al.
Publicado: (2026)
por: Seth, Ashish, et al.
Publicado: (2026)
EgoGen: An Egocentric Synthetic Data Generator
por: Li, Gen, et al.
Publicado: (2024)
por: Li, Gen, et al.
Publicado: (2024)
TeleEgo: Benchmarking Egocentric AI Assistants in the Wild
por: Yan, Jiaqi, et al.
Publicado: (2025)
por: Yan, Jiaqi, et al.
Publicado: (2025)
Conversational Co-Speech Gesture Generation via Modeling Dialog Intention, Emotion, and Context with Diffusion Models
por: Xue, Haiwei, et al.
Publicado: (2023)
por: Xue, Haiwei, et al.
Publicado: (2023)
Towards Continual Egocentric Activity Recognition: A Multi-modal Egocentric Activity Dataset for Continual Learning
por: Xu, Linfeng, et al.
Publicado: (2023)
por: Xu, Linfeng, et al.
Publicado: (2023)
ARGaze: Autoregressive Transformers for Online Egocentric Gaze Estimation
por: Li, Jia, et al.
Publicado: (2026)
por: Li, Jia, et al.
Publicado: (2026)
Egocentric Human-Object Interaction Detection: A New Benchmark and Method
por: Deng, Kunyuan, et al.
Publicado: (2025)
por: Deng, Kunyuan, et al.
Publicado: (2025)
AI Guide Dog: Egocentric Path Prediction on Smartphone
por: Jadhav, Aishwarya, et al.
Publicado: (2025)
por: Jadhav, Aishwarya, et al.
Publicado: (2025)
Incentivizing Temporal-Awareness in Egocentric Video Understanding Models
por: Xu, Zhiyang, et al.
Publicado: (2026)
por: Xu, Zhiyang, et al.
Publicado: (2026)
PlayerOne: Egocentric World Simulator
por: Tu, Yuanpeng, et al.
Publicado: (2025)
por: Tu, Yuanpeng, et al.
Publicado: (2025)
Visual Intention Grounding for Egocentric Assistants
por: Sun, Pengzhan, et al.
Publicado: (2025)
por: Sun, Pengzhan, et al.
Publicado: (2025)
Mixed-Session Conversation with Egocentric Memory
por: Jang, Jihyoung, et al.
Publicado: (2024)
por: Jang, Jihyoung, et al.
Publicado: (2024)
Ejemplares similares
-
Plug-and-Play Clarifier: A Zero-Shot Multimodal Framework for Egocentric Intent Disambiguation
por: Yang, Sicheng, et al.
Publicado: (2025) -
Optimizing Multimodal LLMs for Egocentric Video Understanding: A Solution for the HD-EPIC VQA Challenge
por: Yang, Sicheng, et al.
Publicado: (2026) -
EgoGraph: Temporal Knowledge Graph for Egocentric Video Understanding
por: Sun, Shitong, et al.
Publicado: (2026) -
Color When It Counts: Grayscale-Guided Online Triggering for Always-On Streaming Video Sensing
por: Cai, Weitong, et al.
Publicado: (2026) -
Benchmarking Egocentric Multimodal Goal Inference for Assistive Wearable Agents
por: Veerabadran, Vijay, et al.
Publicado: (2025)