MARs: Multi-view Attention Regularizations for Patch-based Feature Recognition of Space Terrain
Fuente:
arXiv
Salvato in:
| Autori principali: | Chase Jr, Timothy, Dantu, Karthik |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Domain Adaptation and Multi-view Attention for Learnable Landmark Tracking with Sparse Data
di: Chase Jr, Timothy, et al.
Pubblicazione: (2025)
di: Chase Jr, Timothy, et al.
Pubblicazione: (2025)
You Only Crash Once v2: Perceptually Consistent Strong Features for One-Stage Domain Adaptive Detection of Space Terrain
di: Chase Jr, Timothy, et al.
Pubblicazione: (2025)
di: Chase Jr, Timothy, et al.
Pubblicazione: (2025)
Learning Visual Information Utility with PIXER
di: Turkar, Yash, et al.
Pubblicazione: (2024)
di: Turkar, Yash, et al.
Pubblicazione: (2024)
Lightweight Multimodal Artificial Intelligence Framework for Maritime Multi-Scene Recognition
di: Xi, Xinyu, et al.
Pubblicazione: (2025)
di: Xi, Xinyu, et al.
Pubblicazione: (2025)
MVSA-Net: Multi-View State-Action Recognition for Robust and Deployable Trajectory Generation
di: Asali, Ehsan, et al.
Pubblicazione: (2023)
di: Asali, Ehsan, et al.
Pubblicazione: (2023)
Render and Diffuse: Aligning Image and Action Spaces for Diffusion-based Behaviour Cloning
di: Vosylius, Vitalis, et al.
Pubblicazione: (2024)
di: Vosylius, Vitalis, et al.
Pubblicazione: (2024)
ARETE: Attention-based Rasterized Encoding for Topology Estimation using HSV-transformed Crowdsourced Vehicle Fleet Data
di: Fritz, Daniel, et al.
Pubblicazione: (2026)
di: Fritz, Daniel, et al.
Pubblicazione: (2026)
Infinite Leagues Under the Sea: Photorealistic 3D Underwater Terrain Generation by Latent Fractal Diffusion Models
di: Zhang, Tianyi, et al.
Pubblicazione: (2025)
di: Zhang, Tianyi, et al.
Pubblicazione: (2025)
ReCoRe: Regularized Contrastive Representation Learning of World Model
di: Poudel, Rudra P. K., et al.
Pubblicazione: (2023)
di: Poudel, Rudra P. K., et al.
Pubblicazione: (2023)
A Synthetic Dataset for Manometry Recognition in Robotic Applications
di: Saraiva, Pedro Antonio Rabelo, et al.
Pubblicazione: (2025)
di: Saraiva, Pedro Antonio Rabelo, et al.
Pubblicazione: (2025)
Redundancy-aware Action Spaces for Robot Learning
di: Mazzaglia, Pietro, et al.
Pubblicazione: (2024)
di: Mazzaglia, Pietro, et al.
Pubblicazione: (2024)
FALCON: Future-Aware Learning with Contextual Object-Centric Pretraining for UAV Action Recognition
di: Xian, Ruiqi, et al.
Pubblicazione: (2024)
di: Xian, Ruiqi, et al.
Pubblicazione: (2024)
Grounding Foundational Vision Models with 3D Human Poses for Robust Action Recognition
di: Babey, Nicholas, et al.
Pubblicazione: (2025)
di: Babey, Nicholas, et al.
Pubblicazione: (2025)
Low Cost, High Efficiency: LiDAR Place Recognition in Vineyards with Matryoshka Representation Learning
di: Vilella-Cantos, Judith, et al.
Pubblicazione: (2026)
di: Vilella-Cantos, Judith, et al.
Pubblicazione: (2026)
SkelVIT: Consensus of Vision Transformers for a Lightweight Skeleton-Based Action Recognition System
di: Karadag, Ozge Oztimur
Pubblicazione: (2023)
di: Karadag, Ozge Oztimur
Pubblicazione: (2023)
Eagle: Exploring The Design Space for Multimodal LLMs with Mixture of Encoders
di: Shi, Min, et al.
Pubblicazione: (2024)
di: Shi, Min, et al.
Pubblicazione: (2024)
Fast Feature Field ($\text{F}^3$): A Predictive Representation of Events
di: Das, Richeek, et al.
Pubblicazione: (2025)
di: Das, Richeek, et al.
Pubblicazione: (2025)
Learning Visual Feature-Based World Models via Residual Latent Action
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
TTF-VLA: Temporal Token Fusion via Pixel-Attention Integration for Vision-Language-Action Models
di: Liu, Chenghao, et al.
Pubblicazione: (2025)
di: Liu, Chenghao, et al.
Pubblicazione: (2025)
SlotLifter: Slot-guided Feature Lifting for Learning Object-centric Radiance Fields
di: Liu, Yu, et al.
Pubblicazione: (2024)
di: Liu, Yu, et al.
Pubblicazione: (2024)
HandDGP: Camera-Space Hand Mesh Prediction with Differentiable Global Positioning
di: Valassakis, Eugene, et al.
Pubblicazione: (2024)
di: Valassakis, Eugene, et al.
Pubblicazione: (2024)
Point Cloud Matters: Rethinking the Impact of Different Observation Spaces on Robot Learning
di: Zhu, Haoyi, et al.
Pubblicazione: (2024)
di: Zhu, Haoyi, et al.
Pubblicazione: (2024)
TempBEV: Improving Learned BEV Encoders with Combined Image and BEV Space Temporal Aggregation
di: Monninger, Thomas, et al.
Pubblicazione: (2024)
di: Monninger, Thomas, et al.
Pubblicazione: (2024)
Adaptive Diffusion Terrain Generator for Autonomous Uneven Terrain Navigation
di: Yu, Youwei, et al.
Pubblicazione: (2024)
di: Yu, Youwei, et al.
Pubblicazione: (2024)
PixTrack: Precise 6DoF Object Pose Tracking using NeRF Templates and Feature-metric Alignment
di: Chidananda, Prajwal, et al.
Pubblicazione: (2022)
di: Chidananda, Prajwal, et al.
Pubblicazione: (2022)
Spatio-Temporal Graph Dual-Attention Network for Multi-Agent Prediction and Tracking
di: Li, Jiachen, et al.
Pubblicazione: (2021)
di: Li, Jiachen, et al.
Pubblicazione: (2021)
TriBand-BEV: Real-Time LiDAR-Only 3D Pedestrian Detection via Height-Aware BEV and High-Resolution Feature Fusion
di: Khoshkdahan, Mohammad, et al.
Pubblicazione: (2026)
di: Khoshkdahan, Mohammad, et al.
Pubblicazione: (2026)
M2Distill: Multi-Modal Distillation for Lifelong Imitation Learning
di: Roy, Kaushik, et al.
Pubblicazione: (2024)
di: Roy, Kaushik, et al.
Pubblicazione: (2024)
Hierarchical Diffusion Policy for Kinematics-Aware Multi-Task Robotic Manipulation
di: Ma, Xiao, et al.
Pubblicazione: (2024)
di: Ma, Xiao, et al.
Pubblicazione: (2024)
MALLVI: A Multi-Agent Framework for Integrated Generalized Robotics Manipulation
di: Taji, Mehrshad, et al.
Pubblicazione: (2026)
di: Taji, Mehrshad, et al.
Pubblicazione: (2026)
unMORE: Unsupervised Multi-Object Segmentation via Center-Boundary Reasoning
di: Yang, Yafei, et al.
Pubblicazione: (2025)
di: Yang, Yafei, et al.
Pubblicazione: (2025)
Visual Sync: Multi-Camera Synchronization via Cross-View Object Motion
di: Liu, Shaowei, et al.
Pubblicazione: (2025)
di: Liu, Shaowei, et al.
Pubblicazione: (2025)
MESSI: A Multi-Elevation Semantic Segmentation Image Dataset of an Urban Environment
di: Pinkovich, Barak, et al.
Pubblicazione: (2025)
di: Pinkovich, Barak, et al.
Pubblicazione: (2025)
Context-aware Multi-Model Object Detection for Diversely Heterogeneous Compute Systems
di: Davis, Justin, et al.
Pubblicazione: (2024)
di: Davis, Justin, et al.
Pubblicazione: (2024)
ForecastOcc: Vision-based Semantic Occupancy Forecasting
di: Mohan, Riya, et al.
Pubblicazione: (2026)
di: Mohan, Riya, et al.
Pubblicazione: (2026)
Reconstruction by Generation: 3D Multi-Object Scene Reconstruction from Sparse Observations
di: Zadaianchuk, Andrii, et al.
Pubblicazione: (2026)
di: Zadaianchuk, Andrii, et al.
Pubblicazione: (2026)
SyncDiff: Synchronized Motion Diffusion for Multi-Body Human-Object Interaction Synthesis
di: He, Wenkun, et al.
Pubblicazione: (2024)
di: He, Wenkun, et al.
Pubblicazione: (2024)
SIMPL: A Simple and Efficient Multi-agent Motion Prediction Baseline for Autonomous Driving
di: Zhang, Lu, et al.
Pubblicazione: (2024)
di: Zhang, Lu, et al.
Pubblicazione: (2024)
GenSim2: Scaling Robot Data Generation with Multi-modal and Reasoning LLMs
di: Hua, Pu, et al.
Pubblicazione: (2024)
di: Hua, Pu, et al.
Pubblicazione: (2024)
Visual Perception Engine: Fast and Flexible Multi-Head Inference for Robotic Vision Tasks
di: Łucki, Jakub, et al.
Pubblicazione: (2025)
di: Łucki, Jakub, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Domain Adaptation and Multi-view Attention for Learnable Landmark Tracking with Sparse Data
di: Chase Jr, Timothy, et al.
Pubblicazione: (2025) -
You Only Crash Once v2: Perceptually Consistent Strong Features for One-Stage Domain Adaptive Detection of Space Terrain
di: Chase Jr, Timothy, et al.
Pubblicazione: (2025) -
Learning Visual Information Utility with PIXER
di: Turkar, Yash, et al.
Pubblicazione: (2024) -
Lightweight Multimodal Artificial Intelligence Framework for Maritime Multi-Scene Recognition
di: Xi, Xinyu, et al.
Pubblicazione: (2025) -
MVSA-Net: Multi-View State-Action Recognition for Robust and Deployable Trajectory Generation
di: Asali, Ehsan, et al.
Pubblicazione: (2023)