The Audio-Visual BatVision Dataset for Research on Sight and Sound
Fuente:
arXiv
Salvato in:
| Autori principali: | Brunetto, Amandine, Hornauer, Sascha, Yu, Stella X., Moutarde, Fabien |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NeRAF: 3D Scene Infused Neural Radiance and Acoustic Fields
di: Brunetto, Amandine, et al.
Pubblicazione: (2024)
di: Brunetto, Amandine, et al.
Pubblicazione: (2024)
AVS-Net: Audio-Visual Scale Net for Self-supervised Monocular Metric Depth Estimation
di: Liu, Xiaohu, et al.
Pubblicazione: (2024)
di: Liu, Xiaohu, et al.
Pubblicazione: (2024)
Mesoscale Traffic Forecasting for Real-Time Bottleneck and Shockwave Prediction
di: Chekroun, Raphael, et al.
Pubblicazione: (2024)
di: Chekroun, Raphael, et al.
Pubblicazione: (2024)
Future-Interactions-Aware Trajectory Prediction via Braid Theory
di: Azevedo, Caio, et al.
Pubblicazione: (2026)
di: Azevedo, Caio, et al.
Pubblicazione: (2026)
HiER: Highlight Experience Replay for Boosting Off-Policy Reinforcement Learning Agents
di: Horváth, Dániel, et al.
Pubblicazione: (2023)
di: Horváth, Dániel, et al.
Pubblicazione: (2023)
LiDAS: Lighting-driven Dynamic Active Sensing for Nighttime Perception
di: de Moreau, Simon, et al.
Pubblicazione: (2025)
di: de Moreau, Simon, et al.
Pubblicazione: (2025)
Improving Consistency in Vehicle Trajectory Prediction Through Preference Optimization
di: Azevedo, Caio, et al.
Pubblicazione: (2025)
di: Azevedo, Caio, et al.
Pubblicazione: (2025)
VIGOR: Visual Goal-In-Context Inference for Unified Humanoid Fall Safety
di: Azulay, Osher, et al.
Pubblicazione: (2026)
di: Azulay, Osher, et al.
Pubblicazione: (2026)
Few-shot Acoustic Synthesis with Multimodal Flow Matching
di: Brunetto, Amandine
Pubblicazione: (2026)
di: Brunetto, Amandine
Pubblicazione: (2026)
LED: Light Enhanced Depth Estimation at Night
di: de Moreau, Simon, et al.
Pubblicazione: (2024)
di: de Moreau, Simon, et al.
Pubblicazione: (2024)
PneuGelSight: Soft Robotic Vision-Based Proprioception and Tactile Sensing
di: Zhang, Ruohan, et al.
Pubblicazione: (2025)
di: Zhang, Ruohan, et al.
Pubblicazione: (2025)
DOC-Depth: A novel approach for dense depth ground truth generation
di: de Moreau, Simon, et al.
Pubblicazione: (2025)
di: de Moreau, Simon, et al.
Pubblicazione: (2025)
Sight Guide: A Wearable Assistive Perception and Navigation System for the Vision Assistance Race in the Cybathlon 2024
di: Pfreundschuh, Patrick, et al.
Pubblicazione: (2025)
di: Pfreundschuh, Patrick, et al.
Pubblicazione: (2025)
A Modularized Design Approach for GelSight Family of Vision-based Tactile Sensors
di: Agarwal, Arpit, et al.
Pubblicazione: (2025)
di: Agarwal, Arpit, et al.
Pubblicazione: (2025)
Beyond Line-of-Sight: Cooperative Localization Using Vision and V2X Communication
di: Wong, Annika, et al.
Pubblicazione: (2025)
di: Wong, Annika, et al.
Pubblicazione: (2025)
Unified Humanoid Fall-Safety Policy from a Few Demonstrations
di: Xu, Zhengjie, et al.
Pubblicazione: (2025)
di: Xu, Zhengjie, et al.
Pubblicazione: (2025)
Audio-Visual Contact Classification for Tree Structures in Agriculture
di: Spears, Ryan, et al.
Pubblicazione: (2025)
di: Spears, Ryan, et al.
Pubblicazione: (2025)
The Role of Consequential and Functional Sound in Human-Robot Interaction: Toward Audio Augmented Reality Interfaces
di: Smith, Aliyah, et al.
Pubblicazione: (2025)
di: Smith, Aliyah, et al.
Pubblicazione: (2025)
Hierarchical Audio-Visual-Proprioceptive Fusion for Precise Robotic Manipulation
di: Li, Siyuan, et al.
Pubblicazione: (2026)
di: Li, Siyuan, et al.
Pubblicazione: (2026)
EyeSight Hand: Design of a Fully-Actuated Dexterous Robot Hand with Integrated Vision-Based Tactile Sensors and Compliant Actuation
di: Romero, Branden, et al.
Pubblicazione: (2024)
di: Romero, Branden, et al.
Pubblicazione: (2024)
Audio-VLA: Adding Contact Audio Perception to Vision-Language-Action Model for Robotic Manipulation
di: Wei, Xiangyi, et al.
Pubblicazione: (2025)
di: Wei, Xiangyi, et al.
Pubblicazione: (2025)
Audio-Visual Traffic Light State Detection for Urban Robots
di: Gupta, Sagar, et al.
Pubblicazione: (2024)
di: Gupta, Sagar, et al.
Pubblicazione: (2024)
OOSTraj: Out-of-Sight Trajectory Prediction With Vision-Positioning Denoising
di: Zhang, Haichao, et al.
Pubblicazione: (2024)
di: Zhang, Haichao, et al.
Pubblicazione: (2024)
NightSight: Passive Computation for Navigation in Dark Using Events
di: Singh, Deepak, et al.
Pubblicazione: (2026)
di: Singh, Deepak, et al.
Pubblicazione: (2026)
RoboBrain 2.5: Depth in Sight, Time in Mind
di: Tan, Huajie, et al.
Pubblicazione: (2026)
di: Tan, Huajie, et al.
Pubblicazione: (2026)
Let Humanoids Hike! Integrative Skill Development on Complex Trails
di: Lin, Kwan-Yee, et al.
Pubblicazione: (2025)
di: Lin, Kwan-Yee, et al.
Pubblicazione: (2025)
IN-Sight: Interactive Navigation through Sight
di: Schoch, Philipp, et al.
Pubblicazione: (2024)
di: Schoch, Philipp, et al.
Pubblicazione: (2024)
DENALI: A Dataset Enabling Non-Line-of-Sight Spatial Reasoning with Low-Cost LiDARs
di: Behari, Nikhil, et al.
Pubblicazione: (2026)
di: Behari, Nikhil, et al.
Pubblicazione: (2026)
A Case Study on Visual-Audio-Tactile Cross-Modal Retrieval
di: Wojcik, Jagoda, et al.
Pubblicazione: (2024)
di: Wojcik, Jagoda, et al.
Pubblicazione: (2024)
Object Recognition and Force Estimation with the GelSight Baby Fin Ray
di: Liu, Sandra Q., et al.
Pubblicazione: (2025)
di: Liu, Sandra Q., et al.
Pubblicazione: (2025)
BeadSight: An Inexpensive Tactile Sensor Using Hydro-Gel Beads
di: George, Abraham, et al.
Pubblicazione: (2024)
di: George, Abraham, et al.
Pubblicazione: (2024)
Decentralized Multi-Robot Line-of-Sight Connectivity Maintenance under Uncertainty
di: Yang, Yupeng, et al.
Pubblicazione: (2024)
di: Yang, Yupeng, et al.
Pubblicazione: (2024)
Advancing Audio-Visual Navigation Through Multi-Agent Collaboration in 3D Environments
di: Zhang, Hailong, et al.
Pubblicazione: (2025)
di: Zhang, Hailong, et al.
Pubblicazione: (2025)
VP-VLA: Visual Prompting as an Interface for Vision-Language-Action Models
di: Wang, Zixuan, et al.
Pubblicazione: (2026)
di: Wang, Zixuan, et al.
Pubblicazione: (2026)
AV-PedAware: Self-Supervised Audio-Visual Fusion for Dynamic Pedestrian Awareness
di: Yang, Yizhuo, et al.
Pubblicazione: (2024)
di: Yang, Yizhuo, et al.
Pubblicazione: (2024)
Line-of-Sight-Constrained Multi-Robot Mapless Navigation via Polygonal Visible Regions
di: Bai, Ruofei, et al.
Pubblicazione: (2026)
di: Bai, Ruofei, et al.
Pubblicazione: (2026)
Realm: Real-Time Line-of-Sight Maintenance in Multi-Robot Navigation with Unknown Obstacles
di: Bai, Ruofei, et al.
Pubblicazione: (2025)
di: Bai, Ruofei, et al.
Pubblicazione: (2025)
Audio-3DVG: Unified Audio -- Point Cloud Fusion for 3D Visual Grounding
di: Cao-Dinh, Duc, et al.
Pubblicazione: (2025)
di: Cao-Dinh, Duc, et al.
Pubblicazione: (2025)
The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative Audio
di: Wang, Renhao, et al.
Pubblicazione: (2025)
di: Wang, Renhao, et al.
Pubblicazione: (2025)
Residual Cross-Modal Fusion Networks for Audio-Visual Navigation
di: Wang, Yi, et al.
Pubblicazione: (2026)
di: Wang, Yi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
NeRAF: 3D Scene Infused Neural Radiance and Acoustic Fields
di: Brunetto, Amandine, et al.
Pubblicazione: (2024) -
AVS-Net: Audio-Visual Scale Net for Self-supervised Monocular Metric Depth Estimation
di: Liu, Xiaohu, et al.
Pubblicazione: (2024) -
Mesoscale Traffic Forecasting for Real-Time Bottleneck and Shockwave Prediction
di: Chekroun, Raphael, et al.
Pubblicazione: (2024) -
Future-Interactions-Aware Trajectory Prediction via Braid Theory
di: Azevedo, Caio, et al.
Pubblicazione: (2026) -
HiER: Highlight Experience Replay for Boosting Off-Policy Reinforcement Learning Agents
di: Horváth, Dániel, et al.
Pubblicazione: (2023)