Edge-Optimized Vision-Language Models for Underground Infrastructure Assessment
Fuente:
arXiv
Saved in:
| Main Authors: | Lopez, Johny J., Ferdaus, Md Meftahul, Abdelguerfi, Mahdi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DeltaSeg: Tiered Attention and Deep Delta Learning for Multi-Class Structural Defect Segmentation
by: Noguera, Enrique Hernandez, et al.
Published: (2026)
by: Noguera, Enrique Hernandez, et al.
Published: (2026)
EfficientPENet: Real-Time Depth Completion from Sparse LiDAR via Lightweight Multi-Modal Fusion
by: Lopez, Johny J., et al.
Published: (2026)
by: Lopez, Johny J., et al.
Published: (2026)
Attention-Enhanced Prototypical Learning for Few-Shot Infrastructure Defect Segmentation
by: Thrainer, Christina, et al.
Published: (2025)
by: Thrainer, Christina, et al.
Published: (2025)
Few-Shot Learning in Video and 3D Object Detection: A Survey
by: Ferdaus, Md Meftahul, et al.
Published: (2025)
by: Ferdaus, Md Meftahul, et al.
Published: (2025)
KARMA: Efficient Structural Defect Segmentation via Kolmogorov-Arnold Representation Learning
by: Ferdaus, Md Meftahul, et al.
Published: (2025)
by: Ferdaus, Md Meftahul, et al.
Published: (2025)
Imbalance-Aware Culvert-Sewer Defect Segmentation Using an Enhanced Feature Pyramid Network
by: Alshawi, Rasha, et al.
Published: (2024)
by: Alshawi, Rasha, et al.
Published: (2024)
VeloxNet: Efficient Spatial Gating for Lightweight Embedded Image Classification
by: Ferdaus, Md Meftahul, et al.
Published: (2026)
by: Ferdaus, Md Meftahul, et al.
Published: (2026)
SHARP-Net: A Refined Pyramid Network for Deficiency Segmentation in Culverts and Sewer Pipes
by: Alshawi, Rasha, et al.
Published: (2024)
by: Alshawi, Rasha, et al.
Published: (2024)
KANICE: Kolmogorov-Arnold Networks with Interactive Convolutional Elements
by: Ferdaus, Md Meftahul, et al.
Published: (2024)
by: Ferdaus, Md Meftahul, et al.
Published: (2024)
FORTRESS: Function-composition Optimized Real-Time Resilient Structural Segmentation via Kolmogorov-Arnold Enhanced Spatial Attention Networks
by: Thrainer, Christina, et al.
Published: (2025)
by: Thrainer, Christina, et al.
Published: (2025)
Enhancing Few-Shot Classification of Benchmark and Disaster Imagery with ABHFA-Net
by: Lee, Gao Yu, et al.
Published: (2025)
by: Lee, Gao Yu, et al.
Published: (2025)
DRACO-DehazeNet: An Efficient Image Dehazing Network Combining Detail Recovery and a Novel Contrastive Learning Paradigm
by: Lee, Gao Yu, et al.
Published: (2024)
by: Lee, Gao Yu, et al.
Published: (2024)
ANROT-HELANet: Adverserially and Naturally Robust Attention-Based Aggregation Network via The Hellinger Distance for Few-Shot Classification
by: Lee, Gao Yu, et al.
Published: (2025)
by: Lee, Gao Yu, et al.
Published: (2025)
Dehazing Remote Sensing and UAV Imagery: A Review of Deep Learning, Prior-based, and Hybrid Approaches
by: Lee, Gao Yu, et al.
Published: (2024)
by: Lee, Gao Yu, et al.
Published: (2024)
A Stochastic Geo-spatiotemporal Bipartite Network to Optimize GCOOS Sensor Placement Strategies
by: Holmberg, Ted Edward, et al.
Published: (2024)
by: Holmberg, Ted Edward, et al.
Published: (2024)
STROOBnet Optimization via GPU-Accelerated Proximal Recurrence Strategies
by: Holmberg, Ted Edward, et al.
Published: (2024)
by: Holmberg, Ted Edward, et al.
Published: (2024)
Extreme Model Compression for Edge Vision-Language Models: Sparse Temporal Token Fusion and Adaptive Neural Compression
by: Tanvir, Md Tasnin, et al.
Published: (2025)
by: Tanvir, Md Tasnin, et al.
Published: (2025)
EdgeFM: Efficient Edge Inference for Vision-Language Models
by: Deng, Mengling, et al.
Published: (2026)
by: Deng, Mengling, et al.
Published: (2026)
Explaining the Unseen: Multimodal Vision-Language Reasoning for Situational Awareness in Underground Mining Disasters
by: Jewel, Mizanur Rahman, et al.
Published: (2025)
by: Jewel, Mizanur Rahman, et al.
Published: (2025)
Towards Trustworthy AI: A Review of Ethical and Robust Large Language Models
by: Ferdaus, Md Meftahul, et al.
Published: (2024)
by: Ferdaus, Md Meftahul, et al.
Published: (2024)
Unleashing the Capabilities of Large Vision-Language Models for Intelligent Perception of Roadside Infrastructure
by: Fu, Luxuan, et al.
Published: (2026)
by: Fu, Luxuan, et al.
Published: (2026)
HeBA: Heterogeneous Bottleneck Adapters for Robust Vision-Language Models
by: Islam, Md Jahidul
Published: (2026)
by: Islam, Md Jahidul
Published: (2026)
Benchmarking and Mitigating MCQA Selection Bias of Large Vision-Language Models
by: Atabuzzaman, Md., et al.
Published: (2025)
by: Atabuzzaman, Md., et al.
Published: (2025)
Employing Vision-Language Models for Face Image Quality Assessment
by: Sarıtaş, Erdi, et al.
Published: (2026)
by: Sarıtaş, Erdi, et al.
Published: (2026)
HARMONY: Hidden Activation Representations and Model Output-Aware Uncertainty Estimation for Vision-Language Models
by: Mushtaq, Erum, et al.
Published: (2025)
by: Mushtaq, Erum, et al.
Published: (2025)
Collaborative Edge-to-Server Inference for Vision-Language Models
by: Song, Soochang, et al.
Published: (2025)
by: Song, Soochang, et al.
Published: (2025)
GLOV: Guided Large Language Models as Implicit Optimizers for Vision Language Models
by: Mirza, M. Jehanzeb, et al.
Published: (2024)
by: Mirza, M. Jehanzeb, et al.
Published: (2024)
Investigating Zero-Shot Diagnostic Pathology in Vision-Language Models with Efficient Prompt Design
by: Sharma, Vasudev, et al.
Published: (2025)
by: Sharma, Vasudev, et al.
Published: (2025)
Vision-Language Models for Automated Chest X-ray Interpretation: Leveraging ViT and GPT-2
by: Islam, Md. Rakibul, et al.
Published: (2025)
by: Islam, Md. Rakibul, et al.
Published: (2025)
Compositional Kronecker Context Optimization for Vision-Language Models
by: Ding, Kun, et al.
Published: (2024)
by: Ding, Kun, et al.
Published: (2024)
Vision-Language Foundation Models for Comprehensive Automated Pavement Condition Assessment
by: Kyem, Blessing Agyei, et al.
Published: (2026)
by: Kyem, Blessing Agyei, et al.
Published: (2026)
Vision Language Modeling of Content, Distortion and Appearance for Image Quality Assessment
by: Zhou, Fei, et al.
Published: (2024)
by: Zhou, Fei, et al.
Published: (2024)
IKIWISI: An Interactive Visual Pattern Generator for Evaluating the Reliability of Vision-Language Models Without Ground Truth
by: Islam, Md Touhidul, et al.
Published: (2025)
by: Islam, Md Touhidul, et al.
Published: (2025)
Zero-Shot Fine-Grained Image Classification Using Large Vision-Language Models
by: Atabuzzaman, Md., et al.
Published: (2025)
by: Atabuzzaman, Md., et al.
Published: (2025)
JaiLIP: Jailbreaking Vision-Language Models via Loss Guided Image Perturbation
by: Mia, Md Jueal, et al.
Published: (2025)
by: Mia, Md Jueal, et al.
Published: (2025)
Cracks in the Foundation: A Civil Infrastructure Dataset to Challenge Vision Foundation Models
by: Farronato, Nicola, et al.
Published: (2026)
by: Farronato, Nicola, et al.
Published: (2026)
Real-Time Multi-Modal Embedded Vision Framework for Object Detection Facial Emotion Recognition and Biometric Identification on Low-Power Edge Platforms
by: Zahid, S. M. Khalid Bin, et al.
Published: (2026)
by: Zahid, S. M. Khalid Bin, et al.
Published: (2026)
Edge-Enhanced Vision Transformer Framework for Accurate AI-Generated Image Detection
by: Das, Dabbrata, et al.
Published: (2025)
by: Das, Dabbrata, et al.
Published: (2025)
CAS-IQA: Teaching Vision-Language Models for Synthetic Angiography Quality Assessment
by: Wang, Bo, et al.
Published: (2025)
by: Wang, Bo, et al.
Published: (2025)
Building Reasonable Inference for Vision-Language Models in Blind Image Quality Assessment
by: Li, Yuan, et al.
Published: (2025)
by: Li, Yuan, et al.
Published: (2025)
Similar Items
-
DeltaSeg: Tiered Attention and Deep Delta Learning for Multi-Class Structural Defect Segmentation
by: Noguera, Enrique Hernandez, et al.
Published: (2026) -
EfficientPENet: Real-Time Depth Completion from Sparse LiDAR via Lightweight Multi-Modal Fusion
by: Lopez, Johny J., et al.
Published: (2026) -
Attention-Enhanced Prototypical Learning for Few-Shot Infrastructure Defect Segmentation
by: Thrainer, Christina, et al.
Published: (2025) -
Few-Shot Learning in Video and 3D Object Detection: A Survey
by: Ferdaus, Md Meftahul, et al.
Published: (2025) -
KARMA: Efficient Structural Defect Segmentation via Kolmogorov-Arnold Representation Learning
by: Ferdaus, Md Meftahul, et al.
Published: (2025)