Enregistré dans:
| Auteurs principaux: | He, Yuankai, Shi, Weisong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.10701 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Introspection in Learned Semantic Scene Graph Localisation
par: Bissessur, Manshika Charvi, et autres
Publié: (2025)
par: Bissessur, Manshika Charvi, et autres
Publié: (2025)
Is Single-View Mesh Reconstruction Ready for Robotics?
par: Nolte, Frederik, et autres
Publié: (2025)
par: Nolte, Frederik, et autres
Publié: (2025)
Evaluating the Impact of Synthetic Data on Object Detection Tasks in Autonomous Driving
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
AntiGrounding: Lifting Robotic Actions into VLM Representation Space for Decision Making
par: Li, Wenbo, et autres
Publié: (2025)
par: Li, Wenbo, et autres
Publié: (2025)
Systematic Comparison of Projection Methods for Monocular 3D Human Pose Estimation on Fisheye Images
par: Käs, Stephanie, et autres
Publié: (2025)
par: Käs, Stephanie, et autres
Publié: (2025)
Unveiling the Potential of iMarkers: Invisible Fiducial Markers for Advanced Robotics
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
SuperPoint-SLAM3: Augmenting ORB-SLAM3 with Deep Features, Adaptive NMS, and Learning-Based Loop Closure
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Large Language Models and 3D Vision for Intelligent Robotic Perception and Autonomy
par: Mehta, Vinit, et autres
Publié: (2025)
par: Mehta, Vinit, et autres
Publié: (2025)
vS-Graphs: Tightly Coupling Visual SLAM and 3D Scene Graphs Exploiting Hierarchical Scene Understanding
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
Temporally Consistent Object 6D Pose Estimation for Robot Control
par: Zorina, Kateryna, et autres
Publié: (2026)
par: Zorina, Kateryna, et autres
Publié: (2026)
SH17: A Dataset for Human Safety and Personal Protective Equipment Detection in Manufacturing Industry
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
NV3D: Leveraging Spatial Shape Through Normal Vector-based 3D Object Detection
par: Chaowakarn, Krittin, et autres
Publié: (2025)
par: Chaowakarn, Krittin, et autres
Publié: (2025)
Capacity Constraint Analysis Using Object Detection for Smart Manufacturing
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
par: Ahmad, Hafiz Mughees, et autres
Publié: (2024)
StemVLA:An Open-Source Vision-Language-Action Model with Future 3D Spatial Geometry Knowledge and 4D Historical Representation
par: Xiao, Jiasong, et autres
Publié: (2026)
par: Xiao, Jiasong, et autres
Publié: (2026)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
T-Rex: Task-Adaptive Spatial Representation Extraction for Robotic Manipulation with Vision-Language Models
par: Chen, Yiteng, et autres
Publié: (2025)
par: Chen, Yiteng, et autres
Publié: (2025)
Distributed Intelligent System Architecture for UAV-Assisted Monitoring of Wind Energy Infrastructure
par: Svystun, Serhii, et autres
Publié: (2024)
par: Svystun, Serhii, et autres
Publié: (2024)
From Photons to Physics: Autonomous Indoor Drones and the Future of Objective Property Assessment
par: Teikari, Petteri, et autres
Publié: (2025)
par: Teikari, Petteri, et autres
Publié: (2025)
Single-Shot Metric Depth from Focused Plenoptic Cameras
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
par: Lasheras-Hernandez, Blanca, et autres
Publié: (2024)
FACT: Multinomial Misalignment Classification for Point Cloud Registration
par: Dillén, Ludvig, et autres
Publié: (2025)
par: Dillén, Ludvig, et autres
Publié: (2025)
High-Frequency Semantics and Geometric Priors for End-to-End Detection Transformers in Challenging UAV Imagery
par: Peng, Hongxing, et autres
Publié: (2025)
par: Peng, Hongxing, et autres
Publié: (2025)
Thermal and RGB Images Work Better Together in Wind Turbine Damage Detection
par: Svystun, Serhii, et autres
Publié: (2024)
par: Svystun, Serhii, et autres
Publié: (2024)
How do Foundation Models Compare to Skeleton-Based Approaches for Gesture Recognition in Human-Robot Interaction?
par: Käs, Stephanie, et autres
Publié: (2025)
par: Käs, Stephanie, et autres
Publié: (2025)
Autonomous Underwater Cognitive System for Adaptive Navigation: A SLAM-Integrated Cognitive Architecture
par: Jayarathne, K. A. I. N, et autres
Publié: (2025)
par: Jayarathne, K. A. I. N, et autres
Publié: (2025)
Butter: Frequency Consistency and Hierarchical Fusion for Autonomous Driving Object Detection
par: Lin, Xiaojian, et autres
Publié: (2025)
par: Lin, Xiaojian, et autres
Publié: (2025)
Safe Road-Crossing by Autonomous Wheelchairs: a Novel Dataset and its Experimental Evaluation
par: Grigioni, Carlo, et autres
Publié: (2024)
par: Grigioni, Carlo, et autres
Publié: (2024)
Seeing Roads Through Words: A Language-Guided Framework for RGB-T Driving Scene Segmentation
par: Reddy, Ruturaj, et autres
Publié: (2026)
par: Reddy, Ruturaj, et autres
Publié: (2026)
Detecting AI-Generated Videos with Spiking Neural Networks
par: Jang, Minsuk, et autres
Publié: (2026)
par: Jang, Minsuk, et autres
Publié: (2026)
Deep Learning-based Depth Estimation Methods from Monocular Image and Videos: A Comprehensive Survey
par: Rajapaksha, Uchitha, et autres
Publié: (2024)
par: Rajapaksha, Uchitha, et autres
Publié: (2024)
CG-HOI: Contact-Guided 3D Human-Object Interaction Generation
par: Diller, Christian, et autres
Publié: (2023)
par: Diller, Christian, et autres
Publié: (2023)
TAG-Head: Time-Aligned Graph Head for Plug-and-Play Fine-grained Action Recognition
par: Hassan, Imtiaz Ul, et autres
Publié: (2026)
par: Hassan, Imtiaz Ul, et autres
Publié: (2026)
DejaVid: Encoder-Agnostic Learned Temporal Matching for Video Classification
par: Ho, Darryl, et autres
Publié: (2025)
par: Ho, Darryl, et autres
Publié: (2025)
PhysicsNeRF: Physics-Guided 3D Reconstruction from Sparse Views
par: Barhdadi, Mohamed Rayan, et autres
Publié: (2025)
par: Barhdadi, Mohamed Rayan, et autres
Publié: (2025)
CODEI: Resource-Efficient Task-Driven Co-Design of Perception and Decision Making for Mobile Robots Applied to Autonomous Vehicles
par: Milojevic, Dejan, et autres
Publié: (2025)
par: Milojevic, Dejan, et autres
Publié: (2025)
Decoupling Vision and Language: Codebook Anchored Visual Adaptation
par: Wu, Jason, et autres
Publié: (2026)
par: Wu, Jason, et autres
Publié: (2026)
SemanticFeels: Semantic Labeling during In-Hand Manipulation
par: Khalil, Anas Al Shikh, et autres
Publié: (2026)
par: Khalil, Anas Al Shikh, et autres
Publié: (2026)
Adapting SAM with Dynamic Similarity Graphs for Few-Shot Parameter-Efficient Small Dense Object Detection: A Case Study of Chickpea Pods in Field Conditions
par: Jiang, Xintong, et autres
Publié: (2025)
par: Jiang, Xintong, et autres
Publié: (2025)
Sign language recognition based on deep learning and low-cost handcrafted descriptors
par: Carneiro, Alvaro Leandro Cavalcante, et autres
Publié: (2024)
par: Carneiro, Alvaro Leandro Cavalcante, et autres
Publié: (2024)
Can Robots "Taste" Grapes? Estimating SSC with Simple RGB Sensors
par: Ciarfuglia, Thomas Alessandro, et autres
Publié: (2024)
par: Ciarfuglia, Thomas Alessandro, et autres
Publié: (2024)
Locate 3D: Real-World Object Localization via Self-Supervised Learning in 3D
par: Arnaud, Sergio, et autres
Publié: (2025)
par: Arnaud, Sergio, et autres
Publié: (2025)
Documents similaires
-
Introspection in Learned Semantic Scene Graph Localisation
par: Bissessur, Manshika Charvi, et autres
Publié: (2025) -
Is Single-View Mesh Reconstruction Ready for Robotics?
par: Nolte, Frederik, et autres
Publié: (2025) -
Evaluating the Impact of Synthetic Data on Object Detection Tasks in Autonomous Driving
par: Özeren, Enes, et autres
Publié: (2025) -
AntiGrounding: Lifting Robotic Actions into VLM Representation Space for Decision Making
par: Li, Wenbo, et autres
Publié: (2025) -
Systematic Comparison of Projection Methods for Monocular 3D Human Pose Estimation on Fisheye Images
par: Käs, Stephanie, et autres
Publié: (2025)