UniPCB: A Unified Vision-Language Benchmark for Open-Ended PCB Quality Inspection
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sun, Fuxiang, Jiang, Xi, Wu, Jiansheng, Zhang, Haigang, Zheng, Feng, Yang, Jinfeng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
UniPCB: A Generation-Assisted Detection Framework for PCB Defect Inspection
von: Zhang, Huan, et al.
Veröffentlicht: (2026)
von: Zhang, Huan, et al.
Veröffentlicht: (2026)
OmniSch: A Multimodal PCB Schematic Benchmark For Structured Diagram Visual Reasoning
von: Lu, Taiting, et al.
Veröffentlicht: (2026)
von: Lu, Taiting, et al.
Veröffentlicht: (2026)
PCB-RandNet: Rethinking Random Sampling for LIDAR Semantic Segmentation in Autonomous Driving Scene
von: Han, XianFeng, et al.
Veröffentlicht: (2022)
von: Han, XianFeng, et al.
Veröffentlicht: (2022)
PCB-Vision: A Multiscene RGB-Hyperspectral Benchmark Dataset of Printed Circuit Boards
von: Arbash, Elias, et al.
Veröffentlicht: (2024)
von: Arbash, Elias, et al.
Veröffentlicht: (2024)
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
von: Zhou, Hantao, et al.
Veröffentlicht: (2024)
von: Zhou, Hantao, et al.
Veröffentlicht: (2024)
CHIRP: A Fine-Grained Benchmark for Open-Ended Response Evaluation in Vision-Language Models
von: Roger, Alexis, et al.
Veröffentlicht: (2025)
von: Roger, Alexis, et al.
Veröffentlicht: (2025)
Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models
von: Zhang, Jinrui, et al.
Veröffentlicht: (2024)
von: Zhang, Jinrui, et al.
Veröffentlicht: (2024)
MRC-DETR: An Adaptive Multi-Residual Coupled Transformer for Bare Board PCB Defect Detection
von: Cao, Jiangzhong, et al.
Veröffentlicht: (2025)
von: Cao, Jiangzhong, et al.
Veröffentlicht: (2025)
Towards Safe Mobility: A Unified Transportation Foundation Model enabled by Open-Ended Vision-Language Dataset
von: Huang, Wenhui, et al.
Veröffentlicht: (2026)
von: Huang, Wenhui, et al.
Veröffentlicht: (2026)
Benchmarking Vision, Language, & Action Models in Procedurally Generated, Open Ended Action Environments
von: Guruprasad, Pranav, et al.
Veröffentlicht: (2025)
von: Guruprasad, Pranav, et al.
Veröffentlicht: (2025)
SME-YOLO: A Real-Time Detector for Tiny Defect Detection on PCB Surfaces
von: Han, Meng
Veröffentlicht: (2026)
von: Han, Meng
Veröffentlicht: (2026)
Application Research of a Deep Learning Model Integrating CycleGAN and YOLO in PCB Infrared Defect Detection
von: Yang, Chao, et al.
Veröffentlicht: (2026)
von: Yang, Chao, et al.
Veröffentlicht: (2026)
AutoEval-Video: An Automatic Benchmark for Assessing Large Vision Language Models in Open-Ended Video Question Answering
von: Chen, Xiuyuan, et al.
Veröffentlicht: (2023)
von: Chen, Xiuyuan, et al.
Veröffentlicht: (2023)
UniVid: The Open-Source Unified Video Model
von: Luo, Jiabin, et al.
Veröffentlicht: (2025)
von: Luo, Jiabin, et al.
Veröffentlicht: (2025)
Generative Region-Language Pretraining for Open-Ended Object Detection
von: Lin, Chuang, et al.
Veröffentlicht: (2024)
von: Lin, Chuang, et al.
Veröffentlicht: (2024)
UniCompress: Token Compression for Unified Vision-Language Understanding and Generation
von: Wang, Ziyao, et al.
Veröffentlicht: (2026)
von: Wang, Ziyao, et al.
Veröffentlicht: (2026)
Multi-Scale PCB Defect Detection with YOLOv8 Network Improved via Pruning and Lightweight Network
von: Pingzhen, Li, et al.
Veröffentlicht: (2025)
von: Pingzhen, Li, et al.
Veröffentlicht: (2025)
E.T. Bench: Towards Open-Ended Event-Level Video-Language Understanding
von: Liu, Ye, et al.
Veröffentlicht: (2024)
von: Liu, Ye, et al.
Veröffentlicht: (2024)
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
von: Wu, Size, et al.
Veröffentlicht: (2025)
von: Wu, Size, et al.
Veröffentlicht: (2025)
Efficient Pretraining Model based on Multi-Scale Local Visual Field Feature Reconstruction for PCB CT Image Element Segmentation
von: Chen, Chen, et al.
Veröffentlicht: (2024)
von: Chen, Chen, et al.
Veröffentlicht: (2024)
AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting
von: Zhou, Xiaoyu, et al.
Veröffentlicht: (2025)
von: Zhou, Xiaoyu, et al.
Veröffentlicht: (2025)
UniM: A Unified Any-to-Any Interleaved Multimodal Benchmark
von: Li, Yanlin, et al.
Veröffentlicht: (2026)
von: Li, Yanlin, et al.
Veröffentlicht: (2026)
UniViTAR: Unified Vision Transformer with Native Resolution
von: Qiao, Limeng, et al.
Veröffentlicht: (2025)
von: Qiao, Limeng, et al.
Veröffentlicht: (2025)
UniREditBench: A Unified Reasoning-based Image Editing Benchmark
von: Han, Feng, et al.
Veröffentlicht: (2025)
von: Han, Feng, et al.
Veröffentlicht: (2025)
Proxy Robustness in Vision Language Models is Effortlessly Transferable
von: Fu, Xiaowei, et al.
Veröffentlicht: (2026)
von: Fu, Xiaowei, et al.
Veröffentlicht: (2026)
VR-YOLO: Enhancing PCB Defect Detection with Viewpoint Robustness Based on YOLO
von: Zhu, Hengyi, et al.
Veröffentlicht: (2025)
von: Zhu, Hengyi, et al.
Veröffentlicht: (2025)
Uni-MMMU: A Massive Multi-discipline Multimodal Unified Benchmark
von: Zou, Kai, et al.
Veröffentlicht: (2025)
von: Zou, Kai, et al.
Veröffentlicht: (2025)
UniHM: Unified Dexterous Hand Manipulation with Vision Language Model
von: Zhang, Zhenhao, et al.
Veröffentlicht: (2026)
von: Zhang, Zhenhao, et al.
Veröffentlicht: (2026)
Open-Det: An Efficient Learning Framework for Open-Ended Detection
von: Cao, Guiping, et al.
Veröffentlicht: (2025)
von: Cao, Guiping, et al.
Veröffentlicht: (2025)
Ming-UniVision: Joint Image Understanding and Generation with a Unified Continuous Tokenizer
von: Huang, Ziyuan, et al.
Veröffentlicht: (2025)
von: Huang, Ziyuan, et al.
Veröffentlicht: (2025)
An Open-World, Diverse, Cross-Spatial-Temporal Benchmark for Dynamic Wild Person Re-Identification
von: Zhang, Lei, et al.
Veröffentlicht: (2024)
von: Zhang, Lei, et al.
Veröffentlicht: (2024)
Hierarchical Cross-modal Prompt Learning for Vision-Language Models
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
UniHDA: A Unified and Versatile Framework for Multi-Modal Hybrid Domain Adaptation
von: Li, Hengjia, et al.
Veröffentlicht: (2024)
von: Li, Hengjia, et al.
Veröffentlicht: (2024)
UniFashion: A Unified Vision-Language Model for Multimodal Fashion Retrieval and Generation
von: Zhao, Xiangyu, et al.
Veröffentlicht: (2024)
von: Zhao, Xiangyu, et al.
Veröffentlicht: (2024)
RefDiffNet: Learning to Expose Subtle PCB Defects Before Detection
von: Edula, Vinay, et al.
Veröffentlicht: (2026)
von: Edula, Vinay, et al.
Veröffentlicht: (2026)
UniVRSE: Unified Vision-conditioned Response Semantic Entropy for Hallucination Detection in Medical Vision-Language Models
von: Liao, Zehui, et al.
Veröffentlicht: (2025)
von: Liao, Zehui, et al.
Veröffentlicht: (2025)
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
von: Wang, Xiangchen, et al.
Veröffentlicht: (2025)
von: Wang, Xiangchen, et al.
Veröffentlicht: (2025)
Uni-Sign: Toward Unified Sign Language Understanding at Scale
von: Li, Zecheng, et al.
Veröffentlicht: (2025)
von: Li, Zecheng, et al.
Veröffentlicht: (2025)
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
von: Li, Yu, et al.
Veröffentlicht: (2025)
von: Li, Yu, et al.
Veröffentlicht: (2025)
IRIS: Intent Resolution via Inference-time Saccades for Open-Ended VQA in Large Vision-Language Models
von: Madinei, Parsa, et al.
Veröffentlicht: (2026)
von: Madinei, Parsa, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
UniPCB: A Generation-Assisted Detection Framework for PCB Defect Inspection
von: Zhang, Huan, et al.
Veröffentlicht: (2026) -
OmniSch: A Multimodal PCB Schematic Benchmark For Structured Diagram Visual Reasoning
von: Lu, Taiting, et al.
Veröffentlicht: (2026) -
PCB-RandNet: Rethinking Random Sampling for LIDAR Semantic Segmentation in Autonomous Driving Scene
von: Han, XianFeng, et al.
Veröffentlicht: (2022) -
PCB-Vision: A Multiscene RGB-Hyperspectral Benchmark Dataset of Printed Circuit Boards
von: Arbash, Elias, et al.
Veröffentlicht: (2024) -
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
von: Zhou, Hantao, et al.
Veröffentlicht: (2024)