Research Experience of an Undergraduate Student in Computer Vision and Robotics
Fuente:
arXiv
Guardado en:
| Autores principales: | Gowda, Ayush V., Yepes, Juan D., Raviv, Daniel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OWL: A Novel Approach to Machine Perception During Motion
por: Raviv, Daniel, et al.
Publicado: (2026)
por: Raviv, Daniel, et al.
Publicado: (2026)
A Vision-Based Closed-Form Solution for Measuring the Rotation Rate of an Object by Tracking One Point
por: Raviv, Daniel, et al.
Publicado: (2025)
por: Raviv, Daniel, et al.
Publicado: (2025)
Show and Tell: Visually Explainable Deep Neural Nets via Spatially-Aware Concept Bottleneck Models
por: Benou, Itay, et al.
Publicado: (2025)
por: Benou, Itay, et al.
Publicado: (2025)
HyDA: Hypernetworks for Test Time Domain Adaptation in Medical Imaging Analysis
por: Serebro, Doron, et al.
Publicado: (2025)
por: Serebro, Doron, et al.
Publicado: (2025)
Synthetic Data Generation for 3D Myocardium Deformation Analysis
por: Zuler, Shahar, et al.
Publicado: (2024)
por: Zuler, Shahar, et al.
Publicado: (2024)
Cost Function Unrolling in Unsupervised Optical Flow
por: Lifshitz, Gal, et al.
Publicado: (2020)
por: Lifshitz, Gal, et al.
Publicado: (2020)
The State of Computer Vision Research in Africa
por: Omotayo, Abdul-Hakeem, et al.
Publicado: (2024)
por: Omotayo, Abdul-Hakeem, et al.
Publicado: (2024)
Decoding Functional Networks for Visual Categories via GNNs
por: Karmi, Shira, et al.
Publicado: (2026)
por: Karmi, Shira, et al.
Publicado: (2026)
Reimagining Reality: A Comprehensive Survey of Video Inpainting Techniques
por: Gowda, Shreyank N, et al.
Publicado: (2024)
por: Gowda, Shreyank N, et al.
Publicado: (2024)
Distribution-Based Masked Medical Vision-Language Model Using Structured Reports
por: Gowda, Shreyank N, et al.
Publicado: (2025)
por: Gowda, Shreyank N, et al.
Publicado: (2025)
TractoTransformer: Diffusion MRI Streamline Tractography using CNN and Transformer Networks
por: Waizman, Itzik, et al.
Publicado: (2025)
por: Waizman, Itzik, et al.
Publicado: (2025)
Boundary-Aware Instance Segmentation in Microscopy Imaging
por: Mendelson, Thomas, et al.
Publicado: (2026)
por: Mendelson, Thomas, et al.
Publicado: (2026)
DivAS: Interactive 3D Segmentation of NeRFs via Depth-Weighted Voxel Aggregation
por: Pande, Ayush
Publicado: (2026)
por: Pande, Ayush
Publicado: (2026)
Hazedefy: A Lightweight Real-Time Image and Video Dehazing Pipeline for Practical Deployment
por: Bhavsar, Ayush
Publicado: (2025)
por: Bhavsar, Ayush
Publicado: (2025)
CC-SAM: SAM with Cross-feature Attention and Context for Ultrasound Image Segmentation
por: Gowda, Shreyank N, et al.
Publicado: (2024)
por: Gowda, Shreyank N, et al.
Publicado: (2024)
Masks and Manuscripts: Advancing Medical Pre-training with End-to-End Masking and Narrative Structuring
por: Gowda, Shreyank N, et al.
Publicado: (2024)
por: Gowda, Shreyank N, et al.
Publicado: (2024)
Telling Stories for Common Sense Zero-Shot Action Recognition
por: Gowda, Shreyank N, et al.
Publicado: (2023)
por: Gowda, Shreyank N, et al.
Publicado: (2023)
Towards a Better Understanding of the Computer Vision Research Community in Africa
por: Omotayo, Abdul-Hakeem, et al.
Publicado: (2023)
por: Omotayo, Abdul-Hakeem, et al.
Publicado: (2023)
Prototype-Enhanced Confidence Modeling for Cross-Modal Medical Image-Report Retrieval
por: Gowda, Shreyank N, et al.
Publicado: (2025)
por: Gowda, Shreyank N, et al.
Publicado: (2025)
L-SR1: Learned Symmetric-Rank-One Preconditioning
por: Lifshitz, Gal, et al.
Publicado: (2025)
por: Lifshitz, Gal, et al.
Publicado: (2025)
Computational Imaging for Enhanced Computer Vision
por: Shaikh, Humera, et al.
Publicado: (2025)
por: Shaikh, Humera, et al.
Publicado: (2025)
Data Augmentation for NeRFs in the Low Data Limit
por: Gaggar, Ayush, et al.
Publicado: (2025)
por: Gaggar, Ayush, et al.
Publicado: (2025)
Point Prompting: Counterfactual Tracking with Video Diffusion Models
por: Shrivastava, Ayush, et al.
Publicado: (2025)
por: Shrivastava, Ayush, et al.
Publicado: (2025)
Self-Supervised Any-Point Tracking by Contrastive Random Walks
por: Shrivastava, Ayush, et al.
Publicado: (2024)
por: Shrivastava, Ayush, et al.
Publicado: (2024)
MimicGait: A Model Agnostic approach for Occluded Gait Recognition using Correlational Knowledge Distillation
por: Gupta, Ayush, et al.
Publicado: (2025)
por: Gupta, Ayush, et al.
Publicado: (2025)
Self-Supervised Spatial Correspondence Across Modalities
por: Shrivastava, Ayush, et al.
Publicado: (2025)
por: Shrivastava, Ayush, et al.
Publicado: (2025)
FE-Adapter: Adapting Image-based Emotion Classifiers to Videos
por: Gowda, Shreyank N, et al.
Publicado: (2024)
por: Gowda, Shreyank N, et al.
Publicado: (2024)
Continual Learning Improves Zero-Shot Action Recognition
por: Gowda, Shreyank N, et al.
Publicado: (2024)
por: Gowda, Shreyank N, et al.
Publicado: (2024)
Detecting Omissions in Geographic Maps through Computer Vision
por: Nguyen, Phuc D. A., et al.
Publicado: (2024)
por: Nguyen, Phuc D. A., et al.
Publicado: (2024)
Inclusive STEAM Education: A Framework for Teaching Cod-2 ing and Robotics to Students with Visually Impairment Using 3 Advanced Computer Vision
por: Hamash, Mahmoud, et al.
Publicado: (2025)
por: Hamash, Mahmoud, et al.
Publicado: (2025)
Computer Vision and Its Relationship to Cognitive Science: A perspective from Bayes Decision Theory
por: Yuille, Alan, et al.
Publicado: (2026)
por: Yuille, Alan, et al.
Publicado: (2026)
DIO: Dataset of 3D Mesh Models of Indoor Objects for Robotics and Computer Vision Applications
por: Nimal, Nillan, et al.
Publicado: (2024)
por: Nimal, Nillan, et al.
Publicado: (2024)
HyperFusion: A Hypernetwork Approach to Multimodal Integration of Tabular and Medical Imaging Data for Predictive Modeling
por: Duenias, Daniel, et al.
Publicado: (2024)
por: Duenias, Daniel, et al.
Publicado: (2024)
Jumpstarting Surgical Computer Vision
por: Alapatt, Deepak, et al.
Publicado: (2023)
por: Alapatt, Deepak, et al.
Publicado: (2023)
On the Transfer of Collinearity to Computer Vision
por: Beuth, Frederik, et al.
Publicado: (2026)
por: Beuth, Frederik, et al.
Publicado: (2026)
Research on Vision-Language Question Answering Models for Industrial Robots
por: Li, Ping, et al.
Publicado: (2026)
por: Li, Ping, et al.
Publicado: (2026)
Is Temporal Prompting All We Need For Limited Labeled Action Recognition?
por: Gowda, Shreyank N, et al.
Publicado: (2025)
por: Gowda, Shreyank N, et al.
Publicado: (2025)
Task-Aware Scanning Parameter Configuration for Robotic Inspection Using Vision Language Embeddings and Hyperdimensional Computing
por: Chen, Zhiling, et al.
Publicado: (2026)
por: Chen, Zhiling, et al.
Publicado: (2026)
CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval
por: Hossain, Md Aminur, et al.
Publicado: (2026)
por: Hossain, Md Aminur, et al.
Publicado: (2026)
HQ-UNet: A Hybrid Quantum-Classical U-Net with a Quantum Bottleneck for Remote Sensing Image Segmentation
por: Hossain, Md Aminur, et al.
Publicado: (2026)
por: Hossain, Md Aminur, et al.
Publicado: (2026)
Ejemplares similares
-
OWL: A Novel Approach to Machine Perception During Motion
por: Raviv, Daniel, et al.
Publicado: (2026) -
A Vision-Based Closed-Form Solution for Measuring the Rotation Rate of an Object by Tracking One Point
por: Raviv, Daniel, et al.
Publicado: (2025) -
Show and Tell: Visually Explainable Deep Neural Nets via Spatially-Aware Concept Bottleneck Models
por: Benou, Itay, et al.
Publicado: (2025) -
HyDA: Hypernetworks for Test Time Domain Adaptation in Medical Imaging Analysis
por: Serebro, Doron, et al.
Publicado: (2025) -
Synthetic Data Generation for 3D Myocardium Deformation Analysis
por: Zuler, Shahar, et al.
Publicado: (2024)