Fine-Tuning Vision-Language Model for Automated Engineering Drawing Information Extraction
Fuente:
arXiv
Saved in:
| Main Authors: | Khan, Muhammad Tayyab, Chen, Lequn, Ng, Ye Han, Feng, Wenhe, Tan, Nicholas Yew Jin, Moon, Seung Ki |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Multi-Stage Hybrid Framework for Automated Interpretation of Multi-View Engineering Drawings Using Vision Language Model
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
Automated Parsing of Engineering Drawings for Structured Information Extraction Using a Fine-tuned Document Understanding Transformer
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
Leveraging Vision-Language Models for Manufacturing Feature Recognition in CAD Designs
by: Khan, Muhammad Tayyab, et al.
Published: (2024)
by: Khan, Muhammad Tayyab, et al.
Published: (2024)
Context-Aware Mapping of 2D Drawing Annotations to 3D CAD Features Using LLM-Assisted Reasoning for Manufacturing Automation
by: Khan, Muhammad Tayyab, et al.
Published: (2026)
by: Khan, Muhammad Tayyab, et al.
Published: (2026)
Automatic Feature Recognition and Dimensional Attributes Extraction From CAD Models for Hybrid Additive-Subtractive Manufacturing
by: Khan, Muhammad Tayyab, et al.
Published: (2024)
by: Khan, Muhammad Tayyab, et al.
Published: (2024)
From Drawings to Decisions: A Hybrid Vision-Language Framework for Parsing 2D Engineering Drawings into Structured Manufacturing Knowledge
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
Large Language Model Powered Decision Support for a Metal Additive Manufacturing Knowledge Graph
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
Multimodal sensor fusion for real-time location-dependent defect detection in laser-directed energy deposition
by: Chen, Lequn, et al.
Published: (2023)
by: Chen, Lequn, et al.
Published: (2023)
In-situ process monitoring and adaptive quality enhancement in laser additive manufacturing: a critical review
by: Chen, Lequn, et al.
Published: (2024)
by: Chen, Lequn, et al.
Published: (2024)
Audio-visual cross-modality knowledge transfer for machine learning-based in-situ monitoring in laser additive manufacturing
by: Xie, Jiarui, et al.
Published: (2024)
by: Xie, Jiarui, et al.
Published: (2024)
Rethinking the Capability of Fine-Tuned Language Models for Automated Vulnerability Repair
by: Han, Woorim, et al.
Published: (2025)
by: Han, Woorim, et al.
Published: (2025)
Multi-Task LLM with LoRA Fine-Tuning for Automated Cancer Staging and Biomarker Extraction
by: Shao, Jiahao, et al.
Published: (2026)
by: Shao, Jiahao, et al.
Published: (2026)
Foundation Model Driven Robotics: A Comprehensive Review
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
by: Khan, Muhammad Tayyab, et al.
Published: (2025)
Generalized autocorrelation function in the family of deterministic and stochastic anomalous diffusion processes
by: Tayyab, Muhammad
Published: (2024)
by: Tayyab, Muhammad
Published: (2024)
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
by: Sharifdeen, Ashshak, et al.
Published: (2025)
by: Sharifdeen, Ashshak, et al.
Published: (2025)
Fine-Tuning and Prompt Engineering for Large Language Models-based Code Review Automation
by: Pornprasit, Chanathip, et al.
Published: (2024)
by: Pornprasit, Chanathip, et al.
Published: (2024)
Reinforcing Spatial Reasoning in Vision-Language Models with Interwoven Thinking and Visual Drawing
by: Wu, Junfei, et al.
Published: (2025)
by: Wu, Junfei, et al.
Published: (2025)
Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success
by: Kim, Moo Jin, et al.
Published: (2025)
by: Kim, Moo Jin, et al.
Published: (2025)
Happiness—Concept, Measurement and Promotion
by: Ng, Yew-Kwang
Published: (2021)
by: Ng, Yew-Kwang
Published: (2021)
Happiness—Concept, Measurement and Promotion
by: Yew-Kwang Ng
by: Yew-Kwang Ng
Fertility Outcomes in Lohi Sheep: A Comparative Study of Laparoscopic Versus Trans‐Cervical AI With Frozen‐Thawed Semen Under Subtropical Conditions
by: Muhammad Tayyab Khan, et al.
Published: (2025)
by: Muhammad Tayyab Khan, et al.
Published: (2025)
SpiralMLP: A Lightweight Vision MLP Architecture
by: Mu, Haojie, et al.
Published: (2024)
by: Mu, Haojie, et al.
Published: (2024)
Chapter Automated Extraction of Bridge Gradient from Drawings Using Deep Learning
by: Bayer, Hakan, et al.
Published: (2024)
by: Bayer, Hakan, et al.
Published: (2024)
Towards Calibrated Robust Fine-Tuning of Vision-Language Models
by: Oh, Changdae, et al.
Published: (2023)
by: Oh, Changdae, et al.
Published: (2023)
Arabic-Nougat: Fine-Tuning Vision Transformers for Arabic OCR and Markdown Extraction
by: Rashad, Mohamed
Published: (2024)
by: Rashad, Mohamed
Published: (2024)
Seismostratigraphic Evaluation of Lower Cretaceous Unconventional Shelf‐Edge Rifting Indus Delta: Instantaneous Lateral Thickness and Gas Saturation‐Constrained Dynamical Simulations
by: Muhammad Tayyab Naseer
Published: (2026)
by: Muhammad Tayyab Naseer
Published: (2026)
Memory-Space Visual Prompting for Efficient Vision-Language Fine-Tuning
by: Jie, Shibo, et al.
Published: (2024)
by: Jie, Shibo, et al.
Published: (2024)
Generative AI-based Prompt Evolution Engineering Design Optimization With Vision-Language Model
by: Wong, Melvin, et al.
Published: (2024)
by: Wong, Melvin, et al.
Published: (2024)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
by: Tan, Huajie, et al.
Published: (2025)
by: Tan, Huajie, et al.
Published: (2025)
Towards Calibrating Prompt Tuning of Vision-Language Models
by: Sharifdeen, Ashshak, et al.
Published: (2026)
by: Sharifdeen, Ashshak, et al.
Published: (2026)
Exploring Parameter-Efficient Fine-Tuning of Large Language Model on Automated Program Repair
by: Li, Guochang, et al.
Published: (2024)
by: Li, Guochang, et al.
Published: (2024)
Fine-Tuning Vision-Language Models for Markdown Conversion of Financial Tables in Malaysian Audited Financial Reports
by: Tan, Jin Khye, et al.
Published: (2025)
by: Tan, Jin Khye, et al.
Published: (2025)
Self‐sensing piezoresistive aerospace composites based on CNTs and 2D material coated fabric sensors
by: Tayyab Khan, et al.
Published: (2024)
by: Tayyab Khan, et al.
Published: (2024)
Hierarchy-Aware Fine-Tuning of Vision-Language Models
by: Li, Jiayu, et al.
Published: (2025)
by: Li, Jiayu, et al.
Published: (2025)
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
by: Wang, Wenqing, et al.
Published: (2026)
by: Wang, Wenqing, et al.
Published: (2026)
Remodeling Semantic Relationships in Vision-Language Fine-Tuning
by: Wu, Xiangyang, et al.
Published: (2025)
by: Wu, Xiangyang, et al.
Published: (2025)
Orbital-Engineered Spin Asymmetry and Multifunctionality in Eu-Activated CaAlSiN$_3$: A First-Principles Roadmap to Optical-Thermoelectric Fusion
by: Tayyab, Muhammad, et al.
Published: (2025)
by: Tayyab, Muhammad, et al.
Published: (2025)
Automated Data Curation for Robust Language Model Fine-Tuning
by: Chen, Jiuhai, et al.
Published: (2024)
by: Chen, Jiuhai, et al.
Published: (2024)
DEFT: Decompositional Efficient Fine-Tuning for Text-to-Image Models
by: Kumar, Komal, et al.
Published: (2025)
by: Kumar, Komal, et al.
Published: (2025)
Prompting and Fine-Tuning Open-Sourced Large Language Models for Stance Classification
by: Cruickshank, Iain J., et al.
Published: (2023)
by: Cruickshank, Iain J., et al.
Published: (2023)
Similar Items
-
A Multi-Stage Hybrid Framework for Automated Interpretation of Multi-View Engineering Drawings Using Vision Language Model
by: Khan, Muhammad Tayyab, et al.
Published: (2025) -
Automated Parsing of Engineering Drawings for Structured Information Extraction Using a Fine-tuned Document Understanding Transformer
by: Khan, Muhammad Tayyab, et al.
Published: (2025) -
Leveraging Vision-Language Models for Manufacturing Feature Recognition in CAD Designs
by: Khan, Muhammad Tayyab, et al.
Published: (2024) -
Context-Aware Mapping of 2D Drawing Annotations to 3D CAD Features Using LLM-Assisted Reasoning for Manufacturing Automation
by: Khan, Muhammad Tayyab, et al.
Published: (2026) -
Automatic Feature Recognition and Dimensional Attributes Extraction From CAD Models for Hybrid Additive-Subtractive Manufacturing
by: Khan, Muhammad Tayyab, et al.
Published: (2024)