Measuring Visual Understanding in Telecom domain: Performance Metrics for Image-to-UML conversion using VLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ranjani, HG, Prabhudesai, Rutuja |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Observations on LLMs for Telecom Domain: Capabilities and Limitations
par: Soman, Sumit, et autres
Publié: (2023)
par: Soman, Sumit, et autres
Publié: (2023)
Evaluation of RAG Metrics for Question Answering in the Telecom Domain
par: Roychowdhury, Sujoy, et autres
Publié: (2024)
par: Roychowdhury, Sujoy, et autres
Publié: (2024)
Knowledge Distillation of Domain-adapted LLMs for Question-Answering in Telecom
par: Sen, Rishika, et autres
Publié: (2025)
par: Sen, Rishika, et autres
Publié: (2025)
Investigating Distributions of Telecom Adapted Sentence Embeddings for Document Retrieval
par: Roychowdhury, Sujoy, et autres
Publié: (2024)
par: Roychowdhury, Sujoy, et autres
Publié: (2024)
Telecom Language Models: Must They Be Large?
par: Piovesan, Nicola, et autres
Publié: (2024)
par: Piovesan, Nicola, et autres
Publié: (2024)
TechING: Towards Real World Technical Image Understanding via VLMs
par: Nadeem, Tafazzul, et autres
Publié: (2026)
par: Nadeem, Tafazzul, et autres
Publié: (2026)
Understanding and Rectifying Safety Perception Distortion in VLMs
par: Zou, Xiaohan, et autres
Publié: (2025)
par: Zou, Xiaohan, et autres
Publié: (2025)
Do VLMs Truly "Read" Candlesticks? A Multi-Scale Benchmark for Visual Stock Price Forecasting
par: Hu, Kaiqi, et autres
Publié: (2026)
par: Hu, Kaiqi, et autres
Publié: (2026)
Do Multilingual VLMs Reason Equally? A Cross-Lingual Visual Reasoning Audit for Indian Languages
par: R, Swastik
Publié: (2026)
par: R, Swastik
Publié: (2026)
Visualizing Uncertainty in Translation Tasks: An Evaluation of LLM Performance and Confidence Metrics
par: Park, Jin Hyun, et autres
Publié: (2025)
par: Park, Jin Hyun, et autres
Publié: (2025)
Test Code Generation for Telecom Software Systems using Two-Stage Generative Model
par: Nabeel, Mohamad, et autres
Publié: (2024)
par: Nabeel, Mohamad, et autres
Publié: (2024)
Forecasting Downstream Performance of LLMs With Proxy Metrics
par: Patel, Arkil, et autres
Publié: (2026)
par: Patel, Arkil, et autres
Publié: (2026)
PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs
par: Nasiriany, Soroush, et autres
Publié: (2024)
par: Nasiriany, Soroush, et autres
Publié: (2024)
CEGI: Measuring the trade-off between efficiency and carbon emissions for SLMs and VLMs
par: Kumar, Abhas, et autres
Publié: (2024)
par: Kumar, Abhas, et autres
Publié: (2024)
Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs
par: Pan, Zhiyu, et autres
Publié: (2026)
par: Pan, Zhiyu, et autres
Publié: (2026)
Divergent Token Metrics: Measuring degradation to prune away LLM components -- and optimize quantization
par: Deiseroth, Björn, et autres
Publié: (2023)
par: Deiseroth, Björn, et autres
Publié: (2023)
Generalizing from SIMPLE to HARD Visual Reasoning: Can We Mitigate Modality Imbalance in VLMs?
par: Park, Simon, et autres
Publié: (2025)
par: Park, Simon, et autres
Publié: (2025)
PFDial: A Structured Dialogue Instruction Fine-tuning Method Based on UML Flowcharts
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
Document Understanding, Measurement, and Manipulation Using Category Theory
par: Claypoole, Jared, et autres
Publié: (2025)
par: Claypoole, Jared, et autres
Publié: (2025)
Prismatic VLMs: Investigating the Design Space of Visually-Conditioned Language Models
par: Karamcheti, Siddharth, et autres
Publié: (2024)
par: Karamcheti, Siddharth, et autres
Publié: (2024)
TeleTables: A Benchmark for Large Language Models in Telecom Table Interpretation
par: Ezzakri, Anas, et autres
Publié: (2025)
par: Ezzakri, Anas, et autres
Publié: (2025)
CoMuMDR: Code-mixed Multi-modal Multi-domain corpus for Discourse paRsing in conversations
par: Shukla, Divyaksh, et autres
Publié: (2025)
par: Shukla, Divyaksh, et autres
Publié: (2025)
Laying Anchors: Semantically Priming Numerals in Language Modeling
par: Sharma, Mandar, et autres
Publié: (2024)
par: Sharma, Mandar, et autres
Publié: (2024)
Have the VLMs Lost Confidence? A Study of Sycophancy in VLMs
par: Li, Shuo, et autres
Publié: (2024)
par: Li, Shuo, et autres
Publié: (2024)
Handling and extracting key entities from customer conversations using Speech recognition and Named Entity recognition
par: Endait, Sharvi, et autres
Publié: (2022)
par: Endait, Sharvi, et autres
Publié: (2022)
Reducing Text Bias in Synthetically Generated MCQAs for VLMs in Autonomous Driving
par: Kulgod, Sutej, et autres
Publié: (2026)
par: Kulgod, Sutej, et autres
Publié: (2026)
Does your data spark joy? Performance gains from domain upsampling at the end of training
par: Blakeney, Cody, et autres
Publié: (2024)
par: Blakeney, Cody, et autres
Publié: (2024)
Leveraging NTPs for Efficient Hallucination Detection in VLMs
par: Azachi, Ofir, et autres
Publié: (2025)
par: Azachi, Ofir, et autres
Publié: (2025)
Understanding the Performance Gap in Preference Learning: A Dichotomy of RLHF and DPO
par: Shi, Ruizhe, et autres
Publié: (2025)
par: Shi, Ruizhe, et autres
Publié: (2025)
From Feelings to Metrics: Understanding and Formalizing How Users Vibe-Test LLMs
par: Itzhak, Itay, et autres
Publié: (2026)
par: Itzhak, Itay, et autres
Publié: (2026)
SafeCOMM: A Study on Safety Degradation in Fine-Tuned Telecom Large Language Models
par: Djuhera, Aladin, et autres
Publié: (2025)
par: Djuhera, Aladin, et autres
Publié: (2025)
Sensitivity of Generative VLMs to Semantically and Lexically Altered Prompts
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
Can MLLMs Perform Text-to-Image In-Context Learning?
par: Zeng, Yuchen, et autres
Publié: (2024)
par: Zeng, Yuchen, et autres
Publié: (2024)
Linear representations in language models can change dramatically over a conversation
par: Lampinen, Andrew Kyle, et autres
Publié: (2026)
par: Lampinen, Andrew Kyle, et autres
Publié: (2026)
ColorBench: Can VLMs See and Understand the Colorful World? A Comprehensive Benchmark for Color Perception, Reasoning, and Robustness
par: Liang, Yijun, et autres
Publié: (2025)
par: Liang, Yijun, et autres
Publié: (2025)
Revisiting Hierarchical Text Classification: Inference and Metrics
par: Plaud, Roman, et autres
Publié: (2024)
par: Plaud, Roman, et autres
Publié: (2024)
Compared to What? Baselines and Metrics for Counterfactual Prompting
par: Yang, Zihao, et autres
Publié: (2026)
par: Yang, Zihao, et autres
Publié: (2026)
VisMin: Visual Minimal-Change Understanding
par: Awal, Rabiul, et autres
Publié: (2024)
par: Awal, Rabiul, et autres
Publié: (2024)
Unraveling the Truth: Do VLMs really Understand Charts? A Deep Dive into Consistency and Robustness
par: Mukhopadhyay, Srija, et autres
Publié: (2024)
par: Mukhopadhyay, Srija, et autres
Publié: (2024)
Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning
par: Shi, Chengshuai, et autres
Publié: (2026)
par: Shi, Chengshuai, et autres
Publié: (2026)
Documents similaires
-
Observations on LLMs for Telecom Domain: Capabilities and Limitations
par: Soman, Sumit, et autres
Publié: (2023) -
Evaluation of RAG Metrics for Question Answering in the Telecom Domain
par: Roychowdhury, Sujoy, et autres
Publié: (2024) -
Knowledge Distillation of Domain-adapted LLMs for Question-Answering in Telecom
par: Sen, Rishika, et autres
Publié: (2025) -
Investigating Distributions of Telecom Adapted Sentence Embeddings for Document Retrieval
par: Roychowdhury, Sujoy, et autres
Publié: (2024) -
Telecom Language Models: Must They Be Large?
par: Piovesan, Nicola, et autres
Publié: (2024)