ClickAIXR: On-Device Multimodal Vision-Language Interaction with Real-World Objects in Extended Reality
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khan, Dawar, Kouyoumdjian, Alexandre, Liu, Xinyu, Mena, Omar, Engel, Dominik, Viola, Ivan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AIvaluateXR: An Evaluation Framework for on-Device AI in XR with Benchmarking Results
par: Khan, Dawar, et autres
Publié: (2025)
par: Khan, Dawar, et autres
Publié: (2025)
Dr. KID: Direct Remeshing and K-set Isometric Decomposition for Scalable Physicalization of Organic Shapes
par: Khan, Dawar, et autres
Publié: (2023)
par: Khan, Dawar, et autres
Publié: (2023)
EfficientMonoHair: Fast Strand-Level Reconstruction from Monocular Video via Multi-View Direction Fusion
par: Li, Da, et autres
Publié: (2026)
par: Li, Da, et autres
Publié: (2026)
ARCOL: Aspect Ratio Constrained Orthogonal Layout
par: Alsuwaykit, Zainab, et autres
Publié: (2026)
par: Alsuwaykit, Zainab, et autres
Publié: (2026)
MidSurfer: A Parameter-Free Approach for Mid-Surface Extraction from Segmented Volumetric Data
par: Boneš, Eva, et autres
Publié: (2024)
par: Boneš, Eva, et autres
Publié: (2024)
Chat Modeling: Interaction-Enhanced Agent Framework for Visualizing Literature-Grounded Biological Structures
par: Jia, Donggang, et autres
Publié: (2024)
par: Jia, Donggang, et autres
Publié: (2024)
GHAR: GeoPose-based Handheld Augmented Reality for Architectural Positioning, Manipulation and Visual Exploration
par: Israr, Sabahat, et autres
Publié: (2025)
par: Israr, Sabahat, et autres
Publié: (2025)
Leveraging Self-Supervised Vision Transformers for Segmentation-based Transfer Function Design
par: Engel, Dominik, et autres
Publié: (2023)
par: Engel, Dominik, et autres
Publié: (2023)
RaRa Clipper: A Clipper for Gaussian Splatting Based on Ray Tracer and Rasterizer
par: Li, Da, et autres
Publié: (2025)
par: Li, Da, et autres
Publié: (2025)
Reality Proxy: Fluid Interactions with Real-World Objects in MR via Abstract Representations
par: Liu, Xiaoan, et autres
Publié: (2025)
par: Liu, Xiaoan, et autres
Publié: (2025)
Biomedical Image Segmentation: A Systematic Literature Review of Deep Learning Based Object Detection Methods
par: Wahid, Fazli, et autres
Publié: (2024)
par: Wahid, Fazli, et autres
Publié: (2024)
Objects With Lighting: A Real-World Dataset for Evaluating Reconstruction and Rendering for Object Relighting
par: Ummenhofer, Benjamin, et autres
Publié: (2024)
par: Ummenhofer, Benjamin, et autres
Publié: (2024)
VOICE: Visual Oracle for Interaction, Conversation, and Explanation
par: Jia, Donggang, et autres
Publié: (2023)
par: Jia, Donggang, et autres
Publié: (2023)
Towards Extended Reality Intelligence for Monitoring and Predicting Patient Readmission Risks
par: Sanchez, Martin, et autres
Publié: (2026)
par: Sanchez, Martin, et autres
Publié: (2026)
Multimodal Feedback for Task Guidance in Augmented Reality
par: Guo, Hu, et autres
Publié: (2025)
par: Guo, Hu, et autres
Publié: (2025)
Perspective-Aware AI in Extended Reality
par: Platnick, Daniel, et autres
Publié: (2025)
par: Platnick, Daniel, et autres
Publié: (2025)
Assessing Photorealism of Rendered Objects in Real-World Images: A Transparent and Reproducible User Study
par: Kluge, Sven, et autres
Publié: (2024)
par: Kluge, Sven, et autres
Publié: (2024)
Ubiquitous Metadata: Design and Fabrication of Embedded Markers for Real-World Object Identification and Interaction
par: Dogan, Mustafa Doga
Publié: (2024)
par: Dogan, Mustafa Doga
Publié: (2024)
Exploring Interactive Simulation of Grass Display Color Characteristic Based on Real-World Conditions
par: Tanaka, Kojiro, et autres
Publié: (2025)
par: Tanaka, Kojiro, et autres
Publié: (2025)
WorldPlay: Towards Long-Term Geometric Consistency for Real-Time Interactive World Modeling
par: Sun, Wenqiang, et autres
Publié: (2025)
par: Sun, Wenqiang, et autres
Publié: (2025)
The Value of Extended Reality Techniques to Improve Remote Collaborative Maintenance Operations: A User Study
par: Coupry, Corentin, et autres
Publié: (2024)
par: Coupry, Corentin, et autres
Publié: (2024)
Stanford-ORB: A Real-World 3D Object Inverse Rendering Benchmark
par: Kuang, Zhengfei, et autres
Publié: (2023)
par: Kuang, Zhengfei, et autres
Publié: (2023)
Grasping Object: Challenges and Innovations in Robotics and Virtual Reality
par: Zhou, Mingzhao, et autres
Publié: (2024)
par: Zhou, Mingzhao, et autres
Publié: (2024)
A Collaborative Extended Reality Prototype for 3D Surgical Planning and Visualization
par: Qiu, Shi, et autres
Publié: (2026)
par: Qiu, Shi, et autres
Publié: (2026)
Click-Gaussian: Interactive Segmentation to Any 3D Gaussians
par: Choi, Seokhun, et autres
Publié: (2024)
par: Choi, Seokhun, et autres
Publié: (2024)
GausSim: Foreseeing Reality by Gaussian Simulator for Elastic Objects
par: Shao, Yidi, et autres
Publié: (2024)
par: Shao, Yidi, et autres
Publié: (2024)
Augmenting a Large Language Model with a Combination of Text and Visual Data for Conversational Visualization of Global Geospatial Data
par: Mena, Omar, et autres
Publié: (2025)
par: Mena, Omar, et autres
Publié: (2025)
SAGE: Semantic-Driven Adaptive Gaussian Splatting in Extended Reality
par: Schiavo, Chiara, et autres
Publié: (2025)
par: Schiavo, Chiara, et autres
Publié: (2025)
Advancing Extended Reality with 3D Gaussian Splatting: Innovations and Prospects
par: Qiu, Shi, et autres
Publié: (2024)
par: Qiu, Shi, et autres
Publié: (2024)
InterChat: Enhancing Generative Visual Analytics using Multimodal Interactions
par: Juntong Chen, et autres
Publié: (2025)
par: Juntong Chen, et autres
Publié: (2025)
Zero-Shot Human-Object Interaction Synthesis with Multimodal Priors
par: Lou, Yuke, et autres
Publié: (2025)
par: Lou, Yuke, et autres
Publié: (2025)
Stretch your reach: Studying Self-Avatar and Controller Misalignment in Virtual Reality Interaction
par: Ponton, Jose Luis, et autres
Publié: (2024)
par: Ponton, Jose Luis, et autres
Publié: (2024)
TangibleNet: Synchronous Network Data Storytelling through Tangible Interactions in Augmented Reality
par: Takahira, Kentaro, et autres
Publié: (2025)
par: Takahira, Kentaro, et autres
Publié: (2025)
Fast and Robust Mesh Simplification for Generated and Real-World 3D Assets
par: Bhosikar, Kunal, et autres
Publié: (2026)
par: Bhosikar, Kunal, et autres
Publié: (2026)
ViboPneumo: A Vibratory-Pneumatic Finger-Worn Haptic Device for Altering Perceived Texture Roughness in Mixed Reality
par: Cai, Shaoyu, et autres
Publié: (2024)
par: Cai, Shaoyu, et autres
Publié: (2024)
ProtEGOnist: Visual Analysis of Interactions in Small World Networks Using Ego‐graphs
par: N. Brich, et autres
Publié: (2024)
par: N. Brich, et autres
Publié: (2024)
TelePhysics: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
ClipGS-VR: Immersive and Interactive Cinematic Visualization of Volumetric Medical Data in Mobile Virtual Reality
par: Tong, Yuqi, et autres
Publié: (2026)
par: Tong, Yuqi, et autres
Publié: (2026)
IntrinsicReal: Adapting IntrinsicAnything from Synthetic to Real Objects
par: Wei, Xiaokang, et autres
Publié: (2025)
par: Wei, Xiaokang, et autres
Publié: (2025)
Hand-Object Interaction Controller (HOIC): Deep Reinforcement Learning for Reconstructing Interactions with Physics
par: Hu, Haoyu, et autres
Publié: (2024)
par: Hu, Haoyu, et autres
Publié: (2024)
Documents similaires
-
AIvaluateXR: An Evaluation Framework for on-Device AI in XR with Benchmarking Results
par: Khan, Dawar, et autres
Publié: (2025) -
Dr. KID: Direct Remeshing and K-set Isometric Decomposition for Scalable Physicalization of Organic Shapes
par: Khan, Dawar, et autres
Publié: (2023) -
EfficientMonoHair: Fast Strand-Level Reconstruction from Monocular Video via Multi-View Direction Fusion
par: Li, Da, et autres
Publié: (2026) -
ARCOL: Aspect Ratio Constrained Orthogonal Layout
par: Alsuwaykit, Zainab, et autres
Publié: (2026) -
MidSurfer: A Parameter-Free Approach for Mid-Surface Extraction from Segmented Volumetric Data
par: Boneš, Eva, et autres
Publié: (2024)