DialBench: Towards Accurate Reading Recognition of Pointer Meter using Large Foundation Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Futian, Weng, Chaoliu, Wang, Xiao, Chen, Zhen, Zhao, Zhicheng, Tang, Jin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Read Pointer Meters in complex environments based on a Human-like Alignment and Recognition Algorithm
par: Shu, Yan, et autres
Publié: (2023)
par: Shu, Yan, et autres
Publié: (2023)
Spatio-Temporal Side Tuning Pre-trained Foundation Models for Video-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
SAM Guided Semantic and Motion Changed Region Mining for Remote Sensing Change Captioning
par: Wang, Futian, et autres
Publié: (2025)
par: Wang, Futian, et autres
Publié: (2025)
EventSTR: A Benchmark Dataset and Baselines for Event Stream based Scene Text Recognition
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Uncertainty-aware Bridge based Mobile-Former Network for Event-based Pattern Recognition
par: Yang, Haoxiang, et autres
Publié: (2024)
par: Yang, Haoxiang, et autres
Publié: (2024)
Spatio-temporal Graph Learning on Adaptive Mined Key Frames for High-performance Multi-Object Tracking
par: Wang, Futian, et autres
Publié: (2025)
par: Wang, Futian, et autres
Publié: (2025)
EvRainDrop: HyperGraph-guided Completion for Effective Frame and Event Stream Aggregation
par: Wang, Futian, et autres
Publié: (2025)
par: Wang, Futian, et autres
Publié: (2025)
VFM-Det: Towards High-Performance Vehicle Detection via Large Foundation Models
par: Wu, Wentao, et autres
Publié: (2024)
par: Wu, Wentao, et autres
Publié: (2024)
VisNumBench: Evaluating Number Sense of Multimodal Large Language Models
par: Weng, Tengjin, et autres
Publié: (2025)
par: Weng, Tengjin, et autres
Publié: (2025)
TFLOP: Table Structure Recognition Framework with Layout Pointer Mechanism
par: Khang, Minsoo, et autres
Publié: (2025)
par: Khang, Minsoo, et autres
Publié: (2025)
VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents
par: Liu, Xiao, et autres
Publié: (2024)
par: Liu, Xiao, et autres
Publié: (2024)
SelaVPR++: Towards Seamless Adaptation of Foundation Models for Efficient Place Recognition
par: Lu, Feng, et autres
Publié: (2025)
par: Lu, Feng, et autres
Publié: (2025)
ESTR-CoT: Towards Explainable and Accurate Event Stream based Scene Text Recognition with Chain-of-Thought Reasoning
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
ALow-Cost Real-Time Framework for Industrial Action Recognition Using Foundation Models
par: Wang, Zhicheng, et autres
Publié: (2024)
par: Wang, Zhicheng, et autres
Publié: (2024)
Towards Accurate Post-training Quantization for Diffusion Models
par: Wang, Changyuan, et autres
Publié: (2023)
par: Wang, Changyuan, et autres
Publié: (2023)
GlobalPointer: Large-Scale Plane Adjustment with Bi-Convex Relaxation
par: Liao, Bangyan, et autres
Publié: (2024)
par: Liao, Bangyan, et autres
Publié: (2024)
DehazeMamba: SAR-guided Optical Remote Sensing Image Dehazing with Adaptive State Space Model
par: Zhao, Zhicheng, et autres
Publié: (2025)
par: Zhao, Zhicheng, et autres
Publié: (2025)
Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces Selection
par: Qi, Dacheng, et autres
Publié: (2026)
par: Qi, Dacheng, et autres
Publié: (2026)
State Beyond Appearance: Diagnosing and Improving State Consistency in Dial-Based Measurement Reading
par: Hu, Yuanze, et autres
Publié: (2026)
par: Hu, Yuanze, et autres
Publié: (2026)
Towards More Accurate Diffusion Model Acceleration with A Timestep Tuner
par: Xia, Mengfei, et autres
Publié: (2023)
par: Xia, Mengfei, et autres
Publié: (2023)
Large Model for Small Data: Foundation Model for Cross-Modal RF Human Activity Recognition
par: Weng, Yuxuan, et autres
Publié: (2024)
par: Weng, Yuxuan, et autres
Publié: (2024)
Foundation Model for Skeleton-Based Human Action Understanding
par: Wang, Hongsong, et autres
Publié: (2025)
par: Wang, Hongsong, et autres
Publié: (2025)
OBSeg: Accurate and Fast Instance Segmentation Framework Using Segmentation Foundation Models with Oriented Bounding Box Prompts
par: Zhou, Zhen, et autres
Publié: (2024)
par: Zhou, Zhen, et autres
Publié: (2024)
OddGridBench: Exposing the Lack of Fine-Grained Visual Discrepancy Sensitivity in Multimodal Large Language Models
par: Weng, Tengjin, et autres
Publié: (2026)
par: Weng, Tengjin, et autres
Publié: (2026)
Towards Foundation Models for Cryo-ET Subtomogram Analysis
par: Jiang, Runmin, et autres
Publié: (2025)
par: Jiang, Runmin, et autres
Publié: (2025)
Parameter-efficient Tuning of Large-scale Multimodal Foundation Model
par: Wang, Haixin, et autres
Publié: (2023)
par: Wang, Haixin, et autres
Publié: (2023)
Multi-scale Activation, Refinement, and Aggregation: Exploring Diverse Cues for Fine-Grained Bird Recognition
par: Zhang, Zhicheng, et autres
Publié: (2025)
par: Zhang, Zhicheng, et autres
Publié: (2025)
One for All: Toward Unified Foundation Models for Earth Vision
par: Xiong, Zhitong, et autres
Publié: (2024)
par: Xiong, Zhitong, et autres
Publié: (2024)
Graph-based Semantic Calibration Network for Unaligned UAV RGBT Image Semantic Segmentation and A Large-scale Benchmark
par: Fan, Fangqiang, et autres
Publié: (2026)
par: Fan, Fangqiang, et autres
Publié: (2026)
Toward Robust Multimodal Learning using Multimodal Foundational Models
par: Zhao, Xianbing, et autres
Publié: (2024)
par: Zhao, Xianbing, et autres
Publié: (2024)
Towards Training-free Anomaly Detection with Vision and Language Foundation Models
par: Zhang, Jinjin, et autres
Publié: (2025)
par: Zhang, Jinjin, et autres
Publié: (2025)
KAConvNet: Kolmogorov-Arnold Convolutional Networks for Vision Recognition
par: Liu, Zhaoxiang, et autres
Publié: (2026)
par: Liu, Zhaoxiang, et autres
Publié: (2026)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
par: Luo, Yang, et autres
Publié: (2025)
par: Luo, Yang, et autres
Publié: (2025)
GenRec: Unifying Video Generation and Recognition with Diffusion Models
par: Weng, Zejia, et autres
Publié: (2024)
par: Weng, Zejia, et autres
Publié: (2024)
FlashEval: Towards Fast and Accurate Evaluation of Text-to-image Diffusion Generative Models
par: Zhao, Lin, et autres
Publié: (2024)
par: Zhao, Lin, et autres
Publié: (2024)
ConfusionBench: An Expert-Validated Benchmark for Confusion Recognition and Localization in Educational Videos
par: Dong, Lu, et autres
Publié: (2026)
par: Dong, Lu, et autres
Publié: (2026)
Accurate Segmentation of Optic Disc And Cup from Multiple Pseudo-labels by Noise-aware Learning
par: Weng, Tengjin, et autres
Publié: (2023)
par: Weng, Tengjin, et autres
Publié: (2023)
Towards Large-Scale Training of Pathology Foundation Models
par: ai, kaiko., et autres
Publié: (2024)
par: ai, kaiko., et autres
Publié: (2024)
Towards Robust Optical-SAR Object Detection under Missing Modalities: A Dynamic Quality-Aware Fusion Framework
par: Zhao, Zhicheng, et autres
Publié: (2025)
par: Zhao, Zhicheng, et autres
Publié: (2025)
Human Activity Recognition using RGB-Event based Sensors: A Multi-modal Heat Conduction Model and A Benchmark Dataset
par: Wang, Shiao, et autres
Publié: (2025)
par: Wang, Shiao, et autres
Publié: (2025)
Documents similaires
-
Read Pointer Meters in complex environments based on a Human-like Alignment and Recognition Algorithm
par: Shu, Yan, et autres
Publié: (2023) -
Spatio-Temporal Side Tuning Pre-trained Foundation Models for Video-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024) -
SAM Guided Semantic and Motion Changed Region Mining for Remote Sensing Change Captioning
par: Wang, Futian, et autres
Publié: (2025) -
EventSTR: A Benchmark Dataset and Baselines for Event Stream based Scene Text Recognition
par: Wang, Xiao, et autres
Publié: (2025) -
Uncertainty-aware Bridge based Mobile-Former Network for Event-based Pattern Recognition
par: Yang, Haoxiang, et autres
Publié: (2024)