Toward Reliable VLM: A Fine-Grained Benchmark and Framework for Exposure, Bias, and Inference in Korean Street Views
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Xiaonan, Shao, Bo, Kim, Hansaem |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
por: Zhao, Yumiao, et al.
Publicado: (2025)
por: Zhao, Yumiao, et al.
Publicado: (2025)
CityPulse: Fine-Grained Assessment of Urban Change with Street View Time Series
por: Huang, Tianyuan, et al.
Publicado: (2024)
por: Huang, Tianyuan, et al.
Publicado: (2024)
Beyond Graph Model: Reliable VLM Fine-Tuning via Random Graph Adapter
por: Jiang, Bo, et al.
Publicado: (2025)
por: Jiang, Bo, et al.
Publicado: (2025)
StreetTree: A Large-Scale Global Benchmark for Fine-Grained Tree Species Classification
por: Li, Jiapeng, et al.
Publicado: (2026)
por: Li, Jiapeng, et al.
Publicado: (2026)
Fine-Grained Building Function Recognition from Street-View Images via Geometry-Aware Semi-Supervised Learning
por: Li, Weijia, et al.
Publicado: (2024)
por: Li, Weijia, et al.
Publicado: (2024)
JAMMEval: A Refined Collection of Japanese Benchmarks for Reliable VLM Evaluation
por: Sugiura, Issa, et al.
Publicado: (2026)
por: Sugiura, Issa, et al.
Publicado: (2026)
DOCR-Inspector: Fine-Grained and Automated Evaluation of Document Parsing with VLM
por: Zhang, Qintong, et al.
Publicado: (2025)
por: Zhang, Qintong, et al.
Publicado: (2025)
SVIA: A Street View Image Anonymization Framework for Self-Driving Applications
por: Liu, Dongyu, et al.
Publicado: (2025)
por: Liu, Dongyu, et al.
Publicado: (2025)
DeAR: Fine-Grained VLM Adaptation by Decomposing Attention Head Roles
por: Ma, Yiming, et al.
Publicado: (2026)
por: Ma, Yiming, et al.
Publicado: (2026)
HieroAction: Hierarchically Guided VLM for Fine-Grained Action Analysis
por: Wu, Junhao, et al.
Publicado: (2025)
por: Wu, Junhao, et al.
Publicado: (2025)
StreetCrafter: Street View Synthesis with Controllable Video Diffusion Models
por: Yan, Yunzhi, et al.
Publicado: (2024)
por: Yan, Yunzhi, et al.
Publicado: (2024)
FG$^2$: Fine-Grained Cross-View Localization by Fine-Grained Feature Matching
por: Xia, Zimin, et al.
Publicado: (2025)
por: Xia, Zimin, et al.
Publicado: (2025)
An Integrated Causal Inference Framework for Traffic Safety Modeling with Semantic Street-View Visual Features
por: Sun, Lishan, et al.
Publicado: (2026)
por: Sun, Lishan, et al.
Publicado: (2026)
Text2Street: Controllable Text-to-image Generation for Street Views
por: Su, Jinming, et al.
Publicado: (2024)
por: Su, Jinming, et al.
Publicado: (2024)
XR-VLM: Cross-Relationship Modeling with Multi-part Prompts and Visual Features for Fine-Grained Recognition
por: Wang, Chuanming, et al.
Publicado: (2025)
por: Wang, Chuanming, et al.
Publicado: (2025)
Seeing through Satellite Images at Street Views
por: Qian, Ming, et al.
Publicado: (2025)
por: Qian, Ming, et al.
Publicado: (2025)
Concept Drift and Long-Tailed Distribution in Fine-Grained Visual Categorization: Benchmark and Method
por: Ye, Shuo, et al.
Publicado: (2023)
por: Ye, Shuo, et al.
Publicado: (2023)
CrossViewDiff: A Cross-View Diffusion Model for Satellite-to-Street View Synthesis
por: Li, Weijia, et al.
Publicado: (2024)
por: Li, Weijia, et al.
Publicado: (2024)
Artifacts of Idiosyncracy in Global Street View Data
por: Alpherts, Tim, et al.
Publicado: (2025)
por: Alpherts, Tim, et al.
Publicado: (2025)
Human-Aligned MLLM Judges for Fine-Grained Image Editing Evaluation: A Benchmark, Framework, and Analysis
por: Liu, Runzhou, et al.
Publicado: (2026)
por: Liu, Runzhou, et al.
Publicado: (2026)
A Large-Scale Remote Sensing Dataset and VLM-based Algorithm for Fine-Grained Road Hierarchy Classification
por: Han, Ting, et al.
Publicado: (2026)
por: Han, Ting, et al.
Publicado: (2026)
SGD: Street View Synthesis with Gaussian Splatting and Diffusion Prior
por: Yu, Zhongrui, et al.
Publicado: (2024)
por: Yu, Zhongrui, et al.
Publicado: (2024)
Adapting Fine-Grained Cross-View Localization to Areas without Fine Ground Truth
por: Xia, Zimin, et al.
Publicado: (2024)
por: Xia, Zimin, et al.
Publicado: (2024)
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
por: Ji, Fengxian, et al.
Publicado: (2025)
por: Ji, Fengxian, et al.
Publicado: (2025)
Can LVLMs Obtain a Driver's License? A Benchmark Towards Reliable AGI for Autonomous Driving
por: Lu, Yuhang, et al.
Publicado: (2024)
por: Lu, Yuhang, et al.
Publicado: (2024)
RoboView-Bias: Benchmarking Visual Bias in Embodied Agents for Robotic Manipulation
por: Liu, Enguang, et al.
Publicado: (2025)
por: Liu, Enguang, et al.
Publicado: (2025)
m2sv: A Scalable Benchmark for Map-to-Street-View Spatial Reasoning
por: Shin, Yosub, et al.
Publicado: (2026)
por: Shin, Yosub, et al.
Publicado: (2026)
Street-View Image Generation from a Bird's-Eye View Layout
por: Swerdlow, Alexander, et al.
Publicado: (2023)
por: Swerdlow, Alexander, et al.
Publicado: (2023)
DamageArbiter: A CLIP-Enhanced Multimodal Arbitration Framework for Hurricane Damage Assessment from Street-View Imagery
por: Yang, Yifan, et al.
Publicado: (2026)
por: Yang, Yifan, et al.
Publicado: (2026)
ViSE: A Systematic Approach to Vision-Only Street-View Extrapolation
por: Tan, Kaiyuan, et al.
Publicado: (2025)
por: Tan, Kaiyuan, et al.
Publicado: (2025)
Spatially-Weighted CLIP for Street-View Geo-localization
por: Han, Ting, et al.
Publicado: (2026)
por: Han, Ting, et al.
Publicado: (2026)
SS3DM: Benchmarking Street-View Surface Reconstruction with a Synthetic 3D Mesh Dataset
por: Hu, Yubin, et al.
Publicado: (2024)
por: Hu, Yubin, et al.
Publicado: (2024)
Benchmarking and Enhancing VLM for Compressed Image Understanding
por: Zhang, Zifu, et al.
Publicado: (2025)
por: Zhang, Zifu, et al.
Publicado: (2025)
PresentBench: A Fine-Grained Rubric-Based Benchmark for Slide Generation
por: Chen, Xin-Sheng, et al.
Publicado: (2026)
por: Chen, Xin-Sheng, et al.
Publicado: (2026)
Plant Taxonomy Meets Plant Counting: A Fine-Grained, Taxonomic Dataset for Counting Hundreds of Plant Species
por: Xu, Jinyu, et al.
Publicado: (2026)
por: Xu, Jinyu, et al.
Publicado: (2026)
Cross-View Geo-Localization with Street-View and VHR Satellite Imagery in Decentrality Settings
por: Xia, Panwang, et al.
Publicado: (2024)
por: Xia, Panwang, et al.
Publicado: (2024)
Learning Fine-Grained Geometry for Sparse-View Splatting via Cascade Depth Loss
por: Lu, Wenjun, et al.
Publicado: (2025)
por: Lu, Wenjun, et al.
Publicado: (2025)
FineVAU: A Novel Human-Aligned Benchmark for Fine-Grained Video Anomaly Understanding
por: Pereira, João, et al.
Publicado: (2026)
por: Pereira, João, et al.
Publicado: (2026)
OpenFACADES: An Open Framework for Architectural Caption and Attribute Data Enrichment via Street View Imagery
por: Liang, Xiucheng, et al.
Publicado: (2025)
por: Liang, Xiucheng, et al.
Publicado: (2025)
LeafInst - Unified Instance Segmentation Network for Fine-Grained Forestry Leaf Phenotype Analysis: A New UAV based Benchmark
por: Luo, Taige, et al.
Publicado: (2026)
por: Luo, Taige, et al.
Publicado: (2026)
Ejemplares similares
-
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
por: Zhao, Yumiao, et al.
Publicado: (2025) -
CityPulse: Fine-Grained Assessment of Urban Change with Street View Time Series
por: Huang, Tianyuan, et al.
Publicado: (2024) -
Beyond Graph Model: Reliable VLM Fine-Tuning via Random Graph Adapter
por: Jiang, Bo, et al.
Publicado: (2025) -
StreetTree: A Large-Scale Global Benchmark for Fine-Grained Tree Species Classification
por: Li, Jiapeng, et al.
Publicado: (2026) -
Fine-Grained Building Function Recognition from Street-View Images via Geometry-Aware Semi-Supervised Learning
por: Li, Weijia, et al.
Publicado: (2024)