Ukrainian Visual Word Sense Disambiguation Benchmark
Fuente:
arXiv
Salvato in:
| Autori principali: | Laba, Yurii, Mohytych, Yaryna, Rohulia, Ivanna, Kyryleyza, Halyna, Dydyk-Meush, Hanna, Dobosevych, Oles, Hryniv, Rostyslav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Global Motion Understanding in Large-Scale Video Object Segmentation
di: Fedynyak, Volodymyr, et al.
Pubblicazione: (2024)
di: Fedynyak, Volodymyr, et al.
Pubblicazione: (2024)
DeVOS: Flow-Guided Deformable Transformer for Video Object Segmentation
di: Fedynyak, Volodymyr, et al.
Pubblicazione: (2024)
di: Fedynyak, Volodymyr, et al.
Pubblicazione: (2024)
Self-Supervised Real-Time Tracking of Military Vehicles in Low-FPS UAV Footage
di: Kostiv, Markiyan, et al.
Pubblicazione: (2025)
di: Kostiv, Markiyan, et al.
Pubblicazione: (2025)
Bridging Lexical Ambiguity and Vision: A Mini Review on Visual Word Sense Disambiguation
di: Nilukshi, Shashini, et al.
Pubblicazione: (2026)
di: Nilukshi, Shashini, et al.
Pubblicazione: (2026)
Eye-Q: A Multilingual Benchmark for Visual Word Puzzle Solving and Image-to-Phrase Reasoning
di: Najar, Ali, et al.
Pubblicazione: (2026)
di: Najar, Ali, et al.
Pubblicazione: (2026)
Visual Words Meet BM25: Sparse Auto-Encoder Visual Word Scoring for Image Retrieval
di: Han, Donghoon, et al.
Pubblicazione: (2026)
di: Han, Donghoon, et al.
Pubblicazione: (2026)
SenseBench: A Benchmark for Remote Sensing Low-Level Visual Perception and Description in Large Vision-Language Models
di: Zhong, Chen, et al.
Pubblicazione: (2026)
di: Zhong, Chen, et al.
Pubblicazione: (2026)
Peter Parker or Spiderman? Disambiguating Multiple Class Labels
di: Mummani, Nuthan, et al.
Pubblicazione: (2024)
di: Mummani, Nuthan, et al.
Pubblicazione: (2024)
Sign Spotting Disambiguation using Large Language Models
di: Low, JianHe, et al.
Pubblicazione: (2025)
di: Low, JianHe, et al.
Pubblicazione: (2025)
Multi-modal Auto-regressive Modeling via Visual Words
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
Concept Visualization: Explaining the CLIP Multi-modal Embedding Using WordNet
di: Giulivi, Loris, et al.
Pubblicazione: (2024)
di: Giulivi, Loris, et al.
Pubblicazione: (2024)
Segmenting Visuals With Querying Words: Language Anchors For Semi-Supervised Image Segmentation
di: Nadeem, Numair, et al.
Pubblicazione: (2025)
di: Nadeem, Numair, et al.
Pubblicazione: (2025)
ARPA: A Novel Hybrid Model for Advancing Visual Word Disambiguation Using Large Language Models and Transformers
di: Papastavrou, Aristi, et al.
Pubblicazione: (2024)
di: Papastavrou, Aristi, et al.
Pubblicazione: (2024)
Beyond Words and Pixels: A Benchmark for Implicit World Knowledge Reasoning in Generative Models
di: Han, Tianyang, et al.
Pubblicazione: (2025)
di: Han, Tianyang, et al.
Pubblicazione: (2025)
Doppelgangers++: Improved Visual Disambiguation with Geometric 3D Features
di: Xiangli, Yuanbo, et al.
Pubblicazione: (2024)
di: Xiangli, Yuanbo, et al.
Pubblicazione: (2024)
Benchmarking Visual LLMs Resilience to Unanswerable Questions on Visually Rich Documents
di: Napolitano, Davide, et al.
Pubblicazione: (2025)
di: Napolitano, Davide, et al.
Pubblicazione: (2025)
VisualNeedle: Benchmarking Active Visual Search in Information-Dense Scenes
di: Chen, Jingru, et al.
Pubblicazione: (2026)
di: Chen, Jingru, et al.
Pubblicazione: (2026)
WordVIS: A Color Worth A Thousand Words
di: Khan, Umar, et al.
Pubblicazione: (2024)
di: Khan, Umar, et al.
Pubblicazione: (2024)
Benchmarking and Analyzing Generative Data for Visual Recognition
di: Li, Bo, et al.
Pubblicazione: (2023)
di: Li, Bo, et al.
Pubblicazione: (2023)
Designing Practical Models for Isolated Word Visual Speech Recognition
di: Panagos, Iason Ioannis, et al.
Pubblicazione: (2025)
di: Panagos, Iason Ioannis, et al.
Pubblicazione: (2025)
VLRS-Bench: A Vision-Language Reasoning Benchmark for Remote Sensing
di: Luo, Zhiming, et al.
Pubblicazione: (2026)
di: Luo, Zhiming, et al.
Pubblicazione: (2026)
Hydra-Bench: A Benchmark for Multi-Modal Leaf Wetness Sensing
di: Liu, Yimeng, et al.
Pubblicazione: (2025)
di: Liu, Yimeng, et al.
Pubblicazione: (2025)
VGLD: Visually-Guided Linguistic Disambiguation for Monocular Depth Scale Recovery
di: Wu, Bojin, et al.
Pubblicazione: (2025)
di: Wu, Bojin, et al.
Pubblicazione: (2025)
LithoBench: Benchmarking Large Multimodal Models for Remote-Sensing Lithology Interpretation
di: Wang, Jun, et al.
Pubblicazione: (2026)
di: Wang, Jun, et al.
Pubblicazione: (2026)
ATLAS: Agentic or Latent Visual Reasoning? One Word is Enough for Both
di: Guo, Ziyu, et al.
Pubblicazione: (2026)
di: Guo, Ziyu, et al.
Pubblicazione: (2026)
Continual Visual Anomaly Detection on the Edge: Benchmark and Efficient Solutions
di: Barusco, Manuel, et al.
Pubblicazione: (2026)
di: Barusco, Manuel, et al.
Pubblicazione: (2026)
TurtleBench: A Visual Programming Benchmark in Turtle Geometry
di: Rismanchian, Sina, et al.
Pubblicazione: (2024)
di: Rismanchian, Sina, et al.
Pubblicazione: (2024)
Towards Efficient Benchmarking of Foundation Models in Remote Sensing: A Capabilities Encoding Approach
di: Adorni, Pierre, et al.
Pubblicazione: (2025)
di: Adorni, Pierre, et al.
Pubblicazione: (2025)
Homogeneous Tokenizer Matters: Homogeneous Visual Tokenizer for Remote Sensing Image Understanding
di: Shao, Run, et al.
Pubblicazione: (2024)
di: Shao, Run, et al.
Pubblicazione: (2024)
A Benchmark for Ultra-High-Resolution Remote Sensing MLLMs
di: Dang, Yunkai, et al.
Pubblicazione: (2025)
di: Dang, Yunkai, et al.
Pubblicazione: (2025)
Moondream Segmentation: From Words to Masks
di: Reid, Ethan
Pubblicazione: (2026)
di: Reid, Ethan
Pubblicazione: (2026)
XBench: A Comprehensive Benchmark for Visual-Language Explanations in Chest Radiography
di: Luo, Haozhe, et al.
Pubblicazione: (2025)
di: Luo, Haozhe, et al.
Pubblicazione: (2025)
EMT: A Visual Multi-Task Benchmark Dataset for Autonomous Driving
di: Madjid, Nadya Abdel, et al.
Pubblicazione: (2025)
di: Madjid, Nadya Abdel, et al.
Pubblicazione: (2025)
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
Deep Semantic-Visual Alignment for Zero-Shot Remote Sensing Image Scene Classification
di: Xu, Wenjia, et al.
Pubblicazione: (2024)
di: Xu, Wenjia, et al.
Pubblicazione: (2024)
Direction-Oriented Visual-semantic Embedding Model for Remote Sensing Image-text Retrieval
di: Ma, Qing, et al.
Pubblicazione: (2023)
di: Ma, Qing, et al.
Pubblicazione: (2023)
Beyond Visual Fidelity: Benchmarking Super-Resolution Models for Large-Scale Remote Sensing Imagery via Downstream Task Integration
di: Li, Zhili, et al.
Pubblicazione: (2026)
di: Li, Zhili, et al.
Pubblicazione: (2026)
Can VLMs Truly Forget? Benchmarking Training-Free Visual Concept Unlearning
di: Tan, Zhangyun, et al.
Pubblicazione: (2026)
di: Tan, Zhangyun, et al.
Pubblicazione: (2026)
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
di: Cai, Jie, et al.
Pubblicazione: (2025)
di: Cai, Jie, et al.
Pubblicazione: (2025)
VisBrowse-Bench: Benchmarking Visual-Native Search for Multimodal Browsing Agents
di: Zhang, Zhengbo, et al.
Pubblicazione: (2026)
di: Zhang, Zhengbo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Global Motion Understanding in Large-Scale Video Object Segmentation
di: Fedynyak, Volodymyr, et al.
Pubblicazione: (2024) -
DeVOS: Flow-Guided Deformable Transformer for Video Object Segmentation
di: Fedynyak, Volodymyr, et al.
Pubblicazione: (2024) -
Self-Supervised Real-Time Tracking of Military Vehicles in Low-FPS UAV Footage
di: Kostiv, Markiyan, et al.
Pubblicazione: (2025) -
Bridging Lexical Ambiguity and Vision: A Mini Review on Visual Word Sense Disambiguation
di: Nilukshi, Shashini, et al.
Pubblicazione: (2026) -
Eye-Q: A Multilingual Benchmark for Visual Word Puzzle Solving and Image-to-Phrase Reasoning
di: Najar, Ali, et al.
Pubblicazione: (2026)