Enregistré dans:
| Auteur principal: | Perez, Borja Carrillo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2410.04946 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Synthetic-to-Real Domain Bridging for Single-View 3D Reconstruction of Ships for Maritime Monitoring
par: Carrillo-Perez, Borja, et autres
Publié: (2026)
par: Carrillo-Perez, Borja, et autres
Publié: (2026)
Real-Time Fusion of Visual and Chart Data for Enhanced Maritime Vision
par: Kreis, Marten, et autres
Publié: (2025)
par: Kreis, Marten, et autres
Publié: (2025)
Multi-Scale Correlation-Aware Transformer for Maritime Vessel Re-Identification
par: Liu, Yunhe
Publié: (2025)
par: Liu, Yunhe
Publié: (2025)
The Demon is in Ambiguity: Revisiting Situation Recognition with Single Positive Multi-Label Learning
par: Lin, Yiming, et autres
Publié: (2025)
par: Lin, Yiming, et autres
Publié: (2025)
STAR: A Benchmark for Situated Reasoning in Real-World Videos
par: Wu, Bo, et autres
Publié: (2024)
par: Wu, Bo, et autres
Publié: (2024)
Lightweight Multimodal Artificial Intelligence Framework for Maritime Multi-Scene Recognition
par: Xi, Xinyu, et autres
Publié: (2025)
par: Xi, Xinyu, et autres
Publié: (2025)
Situation Awareness for Driver-Centric Driving Style Adaptation
par: Haselberger, Johann, et autres
Publié: (2024)
par: Haselberger, Johann, et autres
Publié: (2024)
4th Workshop on Maritime Computer Vision (MaCVi): Challenge Overview
par: Kiefer, Benjamin, et autres
Publié: (2026)
par: Kiefer, Benjamin, et autres
Publié: (2026)
Aerial Maritime Vessel Detection and Identification
par: Kulas, Antonella Barisic, et autres
Publié: (2025)
par: Kulas, Antonella Barisic, et autres
Publié: (2025)
Large Multi-modal Model Cartographic Map Comprehension for Textual Locality Georeferencing
par: Wijegunarathna, Kalana, et autres
Publié: (2025)
par: Wijegunarathna, Kalana, et autres
Publié: (2025)
LiLa-Net: Lightweight Latent LiDAR Autoencoder for 3D Point Cloud Reconstruction
par: Resino, Mario, et autres
Publié: (2025)
par: Resino, Mario, et autres
Publié: (2025)
A Classification-Aware Super-Resolution Framework for Ship Targets in SAR Imagery
par: Awais, Ch Muhammad, et autres
Publié: (2025)
par: Awais, Ch Muhammad, et autres
Publié: (2025)
Situational Awareness Matters in 3D Vision Language Reasoning
par: Man, Yunze, et autres
Publié: (2024)
par: Man, Yunze, et autres
Publié: (2024)
Improved Vision-to-Chart Buoy Association with Learned World-to-Image Projection
par: Carrillo-Perez, Borja
Publié: (2026)
par: Carrillo-Perez, Borja
Publié: (2026)
MTReD: 3D Reconstruction Dataset for Fly-over Videos of Maritime Domain
par: Yong, Rui Yi, et autres
Publié: (2025)
par: Yong, Rui Yi, et autres
Publié: (2025)
3rd Workshop on Maritime Computer Vision (MaCVi) 2025: Challenge Results
par: Kiefer, Benjamin, et autres
Publié: (2025)
par: Kiefer, Benjamin, et autres
Publié: (2025)
Fast Real-Time Pipeline for Robust Arm Gesture Recognition
par: Bagladi, Milán Zsolt, et autres
Publié: (2025)
par: Bagladi, Milán Zsolt, et autres
Publié: (2025)
Action Recognition in Real-World Ambient Assisted Living Environment
par: Zakka, Vincent Gbouna, et autres
Publié: (2025)
par: Zakka, Vincent Gbouna, et autres
Publié: (2025)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
par: Lan, Long, et autres
Publié: (2024)
par: Lan, Long, et autres
Publié: (2024)
Robotic System with AI for Real Time Weed Detection, Canopy Aware Spraying, and Droplet Pattern Evaluation
par: Rasool, Inayat, et autres
Publié: (2025)
par: Rasool, Inayat, et autres
Publié: (2025)
Ordering Matters: Rank-Aware Selective Fusion for Blended Emotion Recognition
par: Lee, Junghyun, et autres
Publié: (2026)
par: Lee, Junghyun, et autres
Publié: (2026)
SalientFusion: Context-Aware Compositional Zero-Shot Food Recognition
par: Song, Jiajun, et autres
Publié: (2025)
par: Song, Jiajun, et autres
Publié: (2025)
Real-Time Manipulation Action Recognition with a Factorized Graph Sequence Encoder
par: Erdogan, Enes, et autres
Publié: (2025)
par: Erdogan, Enes, et autres
Publié: (2025)
Real-time Yemeni Currency Detection
par: AL-Edreesi, Edrees, et autres
Publié: (2024)
par: AL-Edreesi, Edrees, et autres
Publié: (2024)
Continual Multimodal Egocentric Activity Recognition via Modality-Aware Novel Detection
par: Lim, Wonseon, et autres
Publié: (2026)
par: Lim, Wonseon, et autres
Publié: (2026)
Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models
par: He, Hulingxiao, et autres
Publié: (2026)
par: He, Hulingxiao, et autres
Publié: (2026)
Enhancing Action Recognition by Leveraging the Hierarchical Structure of Actions and Textual Context
par: Benavent-Lledo, Manuel, et autres
Publié: (2024)
par: Benavent-Lledo, Manuel, et autres
Publié: (2024)
GreenEye: Development of Real-Time Traffic Signal Recognition System for Visual Impairments
par: Kim, Danu
Publié: (2024)
par: Kim, Danu
Publié: (2024)
Benchmarking Pretrained Attention-based Models for Real-Time Recognition in Robot-Assisted Esophagectomy
par: de Jong, Ronald L. P. D., et autres
Publié: (2024)
par: de Jong, Ronald L. P. D., et autres
Publié: (2024)
FOODER: Real-time Facial Authentication and Expression Recognition
par: Kahya, Sabri Mustafa, et autres
Publié: (2025)
par: Kahya, Sabri Mustafa, et autres
Publié: (2025)
Towards A Robust Group-level Emotion Recognition via Uncertainty-Aware Learning
par: Zhu, Qing, et autres
Publié: (2023)
par: Zhu, Qing, et autres
Publié: (2023)
Multi-modal Situated Reasoning in 3D Scenes
par: Linghu, Xiongkun, et autres
Publié: (2024)
par: Linghu, Xiongkun, et autres
Publié: (2024)
XHand: Real-time Expressive Hand Avatar
par: Gan, Qijun, et autres
Publié: (2024)
par: Gan, Qijun, et autres
Publié: (2024)
DESign: Dynamic Context-Aware Convolution and Efficient Subnet Regularization for Continuous Sign Language Recognition
par: Liu, Sheng, et autres
Publié: (2025)
par: Liu, Sheng, et autres
Publié: (2025)
Divide, Weight, and Route: Difficulty-Aware Optimization with Dynamic Expert Fusion for Long-tailed Recognition
par: Wei, Xiaolei, et autres
Publié: (2025)
par: Wei, Xiaolei, et autres
Publié: (2025)
DynamicPAE: Generating Scene-Aware Physical Adversarial Examples in Real-Time
par: Hu, Jin, et autres
Publié: (2024)
par: Hu, Jin, et autres
Publié: (2024)
Stitching Gaps: Fusing Situated Perceptual Knowledge with Vision Transformers for High-Level Image Classification
par: Pandiani, Delfina Sol Martinez, et autres
Publié: (2024)
par: Pandiani, Delfina Sol Martinez, et autres
Publié: (2024)
X-Ego: Acquiring Team-Level Tactical Situational Awareness via Cross-Egocentric Contrastive Video Representation Learning
par: Wang, Yunzhe, et autres
Publié: (2025)
par: Wang, Yunzhe, et autres
Publié: (2025)
MuST: Multi-Scale Transformers for Surgical Phase Recognition
par: Pérez, Alejandra, et autres
Publié: (2024)
par: Pérez, Alejandra, et autres
Publié: (2024)
DynaPURLS: Dynamic Refinement of Part-Aware Representations for Skeleton-Based Zero-Shot Action Recognition
par: Zhu, Jingmin, et autres
Publié: (2025)
par: Zhu, Jingmin, et autres
Publié: (2025)
Documents similaires
-
Synthetic-to-Real Domain Bridging for Single-View 3D Reconstruction of Ships for Maritime Monitoring
par: Carrillo-Perez, Borja, et autres
Publié: (2026) -
Real-Time Fusion of Visual and Chart Data for Enhanced Maritime Vision
par: Kreis, Marten, et autres
Publié: (2025) -
Multi-Scale Correlation-Aware Transformer for Maritime Vessel Re-Identification
par: Liu, Yunhe
Publié: (2025) -
The Demon is in Ambiguity: Revisiting Situation Recognition with Single Positive Multi-Label Learning
par: Lin, Yiming, et autres
Publié: (2025) -
STAR: A Benchmark for Situated Reasoning in Real-World Videos
par: Wu, Bo, et autres
Publié: (2024)