MM-Conv: A Multi-modal Conversational Dataset for Virtual Humans
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Deichler, Anna, O'Regan, Jim, Beskow, Jonas |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Incorporating Spatial Awareness in Data-Driven Gesture Generation for Virtual Agents
par: Deichler, Anna, et autres
Publié: (2024)
par: Deichler, Anna, et autres
Publié: (2024)
MM-Conv: A Multimodal Dataset and Benchmark for Context-Aware Grounding in 3D Dialogue
par: Deichler, Anna, et autres
Publié: (2026)
par: Deichler, Anna, et autres
Publié: (2026)
Fake it to make it: Using synthetic data to remedy the data shortage in joint multimodal speech-and-gesture synthesis
par: Mehta, Shivam, et autres
Publié: (2024)
par: Mehta, Shivam, et autres
Publié: (2024)
Towards Interactive Intelligence for Digital Humans
par: Cai, Yiyi, et autres
Publié: (2025)
par: Cai, Yiyi, et autres
Publié: (2025)
Virtual Memory for 3D Gaussian Splatting
par: Haberl, Jonathan, et autres
Publié: (2025)
par: Haberl, Jonathan, et autres
Publié: (2025)
Creating Virtual Environments with 3D Gaussian Splatting: A Comparative Study
par: Qiu, Shi, et autres
Publié: (2025)
par: Qiu, Shi, et autres
Publié: (2025)
Advancements and limitations of LLMs in replicating human color-word associations
par: Fukushima, Makoto, et autres
Publié: (2024)
par: Fukushima, Makoto, et autres
Publié: (2024)
EgoPoseFormer v2: Accurate Egocentric Human Motion Estimation for AR/VR
par: Li, Zhenyu, et autres
Publié: (2026)
par: Li, Zhenyu, et autres
Publié: (2026)
From Far and Near: Perceptual Evaluation of Crowd Representations Across Levels of Detail
par: Sun, Xiaohan, et autres
Publié: (2025)
par: Sun, Xiaohan, et autres
Publié: (2025)
EyeNavGS: A 6-DoF Navigation Dataset and Record-n-Replay Software for Real-World 3DGS Scenes in VR
par: Ding, Zihao, et autres
Publié: (2025)
par: Ding, Zihao, et autres
Publié: (2025)
A multidimensional measurement of photorealistic avatar quality of experience
par: Cutler, Ross, et autres
Publié: (2024)
par: Cutler, Ross, et autres
Publié: (2024)
Deep Sketch-Based 3D Modeling: A Survey
par: Tono, Alberto, et autres
Publié: (2026)
par: Tono, Alberto, et autres
Publié: (2026)
The evolution of volumetric video: A survey of smart transcoding and compression approaches
par: Kakkar, Preetish, et autres
Publié: (2024)
par: Kakkar, Preetish, et autres
Publié: (2024)
A VR Serious Game to Increase Empathy towards Students with Phonological Dyslexia
par: Alcalde-Llergo, José M., et autres
Publié: (2024)
par: Alcalde-Llergo, José M., et autres
Publié: (2024)
MAPWise: Evaluating Vision-Language Models for Advanced Map Queries
par: Mukhopadhyay, Srija, et autres
Publié: (2024)
par: Mukhopadhyay, Srija, et autres
Publié: (2024)
FruitNinja: 3D Object Interior Texture Generation with Gaussian Splatting
par: Wu, Fangyu, et autres
Publié: (2024)
par: Wu, Fangyu, et autres
Publié: (2024)
MIBURI: Towards Expressive Interactive Gesture Synthesis
par: Mughal, M. Hamza, et autres
Publié: (2026)
par: Mughal, M. Hamza, et autres
Publié: (2026)
3D Reconstruction by Looking: Instantaneous Blind Spot Detector for Indoor SLAM through Mixed Reality
par: Chang, Hanbeom, et autres
Publié: (2024)
par: Chang, Hanbeom, et autres
Publié: (2024)
PaintCopilot: Modeling Painting as Autonomous Artistic Continuation
par: Wen, Yunge, et autres
Publié: (2026)
par: Wen, Yunge, et autres
Publié: (2026)
CleAR: Robust Context-Guided Generative Lighting Estimation for Mobile Augmented Reality
par: Zhao, Yiqin, et autres
Publié: (2024)
par: Zhao, Yiqin, et autres
Publié: (2024)
Motion Generation Review: Exploring Deep Learning for Lifelike Animation with Manifold
par: Zhao, Jiayi, et autres
Publié: (2024)
par: Zhao, Jiayi, et autres
Publié: (2024)
Improving multidimensional projection quality with user-specific metrics and optimal scaling
par: Ibrahim, Maniru
Publié: (2024)
par: Ibrahim, Maniru
Publié: (2024)
Visualization of Age Distributions as Elements of Medical Data-Stories
par: Dowlatabadi, Sophia, et autres
Publié: (2024)
par: Dowlatabadi, Sophia, et autres
Publié: (2024)
Glyph-Based Uncertainty Visualization and Analysis of Time-Varying Vector Fields
par: Ouermi, Timbwaoga A. J., et autres
Publié: (2024)
par: Ouermi, Timbwaoga A. J., et autres
Publié: (2024)
MRUCT: Mixed Reality Assistance for Acupuncture Guided by Ultrasonic Computed Tomography
par: Wang, Xinkai, et autres
Publié: (2025)
par: Wang, Xinkai, et autres
Publié: (2025)
Blind Augmentation: Calibration-free Camera Distortion Model Estimation for Real-time Mixed-reality Consistency
par: Prakash, Siddhant, et autres
Publié: (2025)
par: Prakash, Siddhant, et autres
Publié: (2025)
NRXR-ID: Two-Factor Authentication (2FA) in VR Using Near-Range Extended Reality and Smartphones
par: Nanzatov, Aiur, et autres
Publié: (2025)
par: Nanzatov, Aiur, et autres
Publié: (2025)
Impact of Target and Tool Visualization on Depth Perception and Usability in Optical See-Through AR
par: Yang, Yue, et autres
Publié: (2025)
par: Yang, Yue, et autres
Publié: (2025)
Shadowless Projection Mapping for Tabletop Workspaces with Synthetic Aperture Projector
par: Okamoto, Takahiro, et autres
Publié: (2026)
par: Okamoto, Takahiro, et autres
Publié: (2026)
SemLayer: Semantic-aware Generative Segmentation and Layer Construction for Abstract Icons
par: Xu, Haiyang, et autres
Publié: (2026)
par: Xu, Haiyang, et autres
Publié: (2026)
Reasoning3D -- Grounding and Reasoning in 3D: Fine-Grained Zero-Shot Open-Vocabulary 3D Reasoning Part Segmentation via Large Vision-Language Models
par: Chen, Tianrun, et autres
Publié: (2024)
par: Chen, Tianrun, et autres
Publié: (2024)
Beware of Validation by Eye: Visual Validation of Linear Trends in Scatterplots
par: Braun, Daniel, et autres
Publié: (2024)
par: Braun, Daniel, et autres
Publié: (2024)
V-Hands: Touchscreen-based Hand Tracking for Remote Whiteboard Interaction
par: Liu, Xinshuang, et autres
Publié: (2024)
par: Liu, Xinshuang, et autres
Publié: (2024)
CADReasoner: Iterative Program Editing for CAD Reverse Engineering
par: Kabisov, Soslan, et autres
Publié: (2026)
par: Kabisov, Soslan, et autres
Publié: (2026)
ClickAIXR: On-Device Multimodal Vision-Language Interaction with Real-World Objects in Extended Reality
par: Khan, Dawar, et autres
Publié: (2026)
par: Khan, Dawar, et autres
Publié: (2026)
Advancing Extended Reality with 3D Gaussian Splatting: Innovations and Prospects
par: Qiu, Shi, et autres
Publié: (2024)
par: Qiu, Shi, et autres
Publié: (2024)
Training program on sign language: social inclusion through Virtual Reality in ISENSE project
par: Bisio, Alessia, et autres
Publié: (2024)
par: Bisio, Alessia, et autres
Publié: (2024)
Advancing Talking Head Generation: A Comprehensive Survey of Multi-Modal Methodologies, Datasets, Evaluation Metrics, and Loss Functions
par: Rakesh, Vineet Kumar, et autres
Publié: (2025)
par: Rakesh, Vineet Kumar, et autres
Publié: (2025)
Look and Tell: A Dataset for Multimodal Grounding Across Egocentric and Exocentric Views
par: Deichler, Anna, et autres
Publié: (2025)
par: Deichler, Anna, et autres
Publié: (2025)
SMPLest-X: Ultimate Scaling for Expressive Human Pose and Shape Estimation
par: Yin, Wanqi, et autres
Publié: (2025)
par: Yin, Wanqi, et autres
Publié: (2025)
Documents similaires
-
Incorporating Spatial Awareness in Data-Driven Gesture Generation for Virtual Agents
par: Deichler, Anna, et autres
Publié: (2024) -
MM-Conv: A Multimodal Dataset and Benchmark for Context-Aware Grounding in 3D Dialogue
par: Deichler, Anna, et autres
Publié: (2026) -
Fake it to make it: Using synthetic data to remedy the data shortage in joint multimodal speech-and-gesture synthesis
par: Mehta, Shivam, et autres
Publié: (2024) -
Towards Interactive Intelligence for Digital Humans
par: Cai, Yiyi, et autres
Publié: (2025) -
Virtual Memory for 3D Gaussian Splatting
par: Haberl, Jonathan, et autres
Publié: (2025)