Leaf Angle Estimation using Mask R-CNN and LETR Vision Transformer
Fuente:
arXiv
Salvato in:
| Autori principali: | Margapuri, Venkat, Thapaliya, Prapti, Rife, Trevor |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Seed Kernel Counting using Domain Randomization and Object Tracking Neural Networks
di: Margapuri, Venkat, et al.
Pubblicazione: (2023)
di: Margapuri, Venkat, et al.
Pubblicazione: (2023)
Diagnosis and Severity Assessment of Ulcerative Colitis using Self Supervised Learning
di: Margapuri, Venkat
Pubblicazione: (2024)
di: Margapuri, Venkat
Pubblicazione: (2024)
VLSM-Adapter: Finetuning Vision-Language Segmentation Efficiently with Lightweight Blocks
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models
di: Poudel, Kanchan, et al.
Pubblicazione: (2023)
di: Poudel, Kanchan, et al.
Pubblicazione: (2023)
AI-Powered Deepfake Detection Using CNN and Vision Transformer Architectures
di: Urmi, Sifatullah Sheikh, et al.
Pubblicazione: (2026)
di: Urmi, Sifatullah Sheikh, et al.
Pubblicazione: (2026)
Semi-Supervised Masked Autoencoders: Unlocking Vision Transformer Potential with Limited Data
di: Faysal, Atik, et al.
Pubblicazione: (2026)
di: Faysal, Atik, et al.
Pubblicazione: (2026)
TeaLeafVision: An Explainable and Robust Deep Learning Framework for Tea Leaf Disease Classification
di: Ahamed, Rafi, et al.
Pubblicazione: (2026)
di: Ahamed, Rafi, et al.
Pubblicazione: (2026)
Flying By ML -- CNN Inversion of Affine Transforms
di: Van Warren, L.
Pubblicazione: (2023)
di: Van Warren, L.
Pubblicazione: (2023)
Fast Training of Diffusion Models with Masked Transformers
di: Zheng, Hongkai, et al.
Pubblicazione: (2023)
di: Zheng, Hongkai, et al.
Pubblicazione: (2023)
Efficient Medical Vision-Language Alignment Through Adapting Masked Vision Models
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
di: Lian, Chenyu, et al.
Pubblicazione: (2025)
Leaf diseases detection using deep learning methods
di: Fatimi, El Houcine El
Pubblicazione: (2024)
di: Fatimi, El Houcine El
Pubblicazione: (2024)
Masked Generative Nested Transformers with Decode Time Scaling
di: Goyal, Sahil, et al.
Pubblicazione: (2025)
di: Goyal, Sahil, et al.
Pubblicazione: (2025)
Accurate and Efficient World Modeling with Masked Latent Transformers
di: Burchi, Maxime, et al.
Pubblicazione: (2025)
di: Burchi, Maxime, et al.
Pubblicazione: (2025)
Masking Teacher and Reinforcing Student for Distilling Vision-Language Models
di: Lee, Byung-Kwan, et al.
Pubblicazione: (2025)
di: Lee, Byung-Kwan, et al.
Pubblicazione: (2025)
Placenta Accreta Spectrum Detection Using an MRI-based Hybrid CNN-Transformer Model
di: Ali, Sumaiya, et al.
Pubblicazione: (2025)
di: Ali, Sumaiya, et al.
Pubblicazione: (2025)
REOrdering Patches Improves Vision Models
di: Kutscher, Declan, et al.
Pubblicazione: (2025)
di: Kutscher, Declan, et al.
Pubblicazione: (2025)
ScribFormer: Transformer Makes CNN Work Better for Scribble-based Medical Image Segmentation
di: Li, Zihan, et al.
Pubblicazione: (2024)
di: Li, Zihan, et al.
Pubblicazione: (2024)
MuM: Multi-View Masked Image Modeling for 3D Vision
di: Nordström, David, et al.
Pubblicazione: (2025)
di: Nordström, David, et al.
Pubblicazione: (2025)
Adaptive Knowledge Distillation for Classification of Hand Images using Explainable Vision Transformers
di: Nguyen, Thanh Thi, et al.
Pubblicazione: (2024)
di: Nguyen, Thanh Thi, et al.
Pubblicazione: (2024)
LeafLife: An Explainable Deep Learning Framework with Robustness for Grape Leaf Disease Recognition
di: Alam, B. M. Shahria, et al.
Pubblicazione: (2026)
di: Alam, B. M. Shahria, et al.
Pubblicazione: (2026)
UNCAGE: Contrastive Attention Guidance for Masked Generative Transformers in Text-to-Image Generation
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
RS-CA-HSICT: A Residual and Spatial Channel Augmented CNN Transformer Framework for Monkeypox Detection
di: Iqbal, Rashid, et al.
Pubblicazione: (2025)
di: Iqbal, Rashid, et al.
Pubblicazione: (2025)
A Full Transformer-based Framework for Automatic Pain Estimation using Videos
di: Gkikas, Stefanos, et al.
Pubblicazione: (2024)
di: Gkikas, Stefanos, et al.
Pubblicazione: (2024)
D$^3$epth: Self-Supervised Depth Estimation with Dynamic Mask in Dynamic Scenes
di: Chen, Siyu, et al.
Pubblicazione: (2024)
di: Chen, Siyu, et al.
Pubblicazione: (2024)
Masked Self-Supervised Pre-Training for Text Recognition Transformers on Large-Scale Datasets
di: Kišš, Martin, et al.
Pubblicazione: (2025)
di: Kišš, Martin, et al.
Pubblicazione: (2025)
VisionTS: Visual Masked Autoencoders Are Free-Lunch Zero-Shot Time Series Forecasters
di: Chen, Mouxiang, et al.
Pubblicazione: (2024)
di: Chen, Mouxiang, et al.
Pubblicazione: (2024)
PETAR: Localized Findings Generation with Mask-Aware Vision-Language Modeling for PET Automated Reporting
di: Maqbool, Danyal, et al.
Pubblicazione: (2025)
di: Maqbool, Danyal, et al.
Pubblicazione: (2025)
Improving Interpretation Faithfulness for Vision Transformers
di: Hu, Lijie, et al.
Pubblicazione: (2023)
di: Hu, Lijie, et al.
Pubblicazione: (2023)
Block-Recurrent Dynamics in Vision Transformers
di: Jacobs, Mozes, et al.
Pubblicazione: (2025)
di: Jacobs, Mozes, et al.
Pubblicazione: (2025)
Construction Site Scaffolding Completeness Detection Based on Mask R-CNN and Hough Transform
di: Lin, Pei-Hsin, et al.
Pubblicazione: (2025)
di: Lin, Pei-Hsin, et al.
Pubblicazione: (2025)
VORTEX: Challenging CNNs at Texture Recognition by using Vision Transformers with Orderless and Randomized Token Encodings
di: Scabini, Leonardo, et al.
Pubblicazione: (2025)
di: Scabini, Leonardo, et al.
Pubblicazione: (2025)
WiTUnet: A U-Shaped Architecture Integrating CNN and Transformer for Improved Feature Alignment and Local Information Fusion
di: Wang, Bin, et al.
Pubblicazione: (2024)
di: Wang, Bin, et al.
Pubblicazione: (2024)
Building Efficient Lightweight CNN Models
di: Isong, Nathan
Pubblicazione: (2025)
di: Isong, Nathan
Pubblicazione: (2025)
ADAPT to Robustify Prompt Tuning Vision Transformers
di: Eskandar, Masih, et al.
Pubblicazione: (2024)
di: Eskandar, Masih, et al.
Pubblicazione: (2024)
Continual Adaptation of Vision Transformers for Federated Learning
di: Halbe, Shaunak, et al.
Pubblicazione: (2023)
di: Halbe, Shaunak, et al.
Pubblicazione: (2023)
Mechanisms of Non-Monotonic Scaling in Vision Transformers
di: Kumar, Anantha Padmanaban Krishna
Pubblicazione: (2025)
di: Kumar, Anantha Padmanaban Krishna
Pubblicazione: (2025)
Discovering Influential Neuron Path in Vision Transformers
di: Wang, Yifan, et al.
Pubblicazione: (2025)
di: Wang, Yifan, et al.
Pubblicazione: (2025)
DiffiT: Diffusion Vision Transformers for Image Generation
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2023)
di: Hatamizadeh, Ali, et al.
Pubblicazione: (2023)
Accelerating Vision Transformers with Adaptive Patch Sizes
di: Choudhury, Rohan, et al.
Pubblicazione: (2025)
di: Choudhury, Rohan, et al.
Pubblicazione: (2025)
Class-Discriminative Attention Maps for Vision Transformers
di: Brocki, Lennart, et al.
Pubblicazione: (2023)
di: Brocki, Lennart, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Seed Kernel Counting using Domain Randomization and Object Tracking Neural Networks
di: Margapuri, Venkat, et al.
Pubblicazione: (2023) -
Diagnosis and Severity Assessment of Ulcerative Colitis using Self Supervised Learning
di: Margapuri, Venkat
Pubblicazione: (2024) -
VLSM-Adapter: Finetuning Vision-Language Segmentation Efficiently with Lightweight Blocks
di: Dhakal, Manish, et al.
Pubblicazione: (2024) -
Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models
di: Poudel, Kanchan, et al.
Pubblicazione: (2023) -
AI-Powered Deepfake Detection Using CNN and Vision Transformer Architectures
di: Urmi, Sifatullah Sheikh, et al.
Pubblicazione: (2026)