From Street View to Visual Network: Mapping the Visibility of Urban Landmarks with Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Zicheng, Fujiwara, Kunihiko, Liu, Pengyuan, Zhang, Fan, Biljecki, Filip |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ZenSVI: An Open-Source Software for the Integrated Acquisition, Processing and Analysis of Street View Imagery Towards Scalable Urban Science
di: Ito, Koichi, et al.
Pubblicazione: (2024)
di: Ito, Koichi, et al.
Pubblicazione: (2024)
OpenFACADES: An Open Framework for Architectural Caption and Attribute Data Enrichment via Street View Imagery
di: Liang, Xiucheng, et al.
Pubblicazione: (2025)
di: Liang, Xiucheng, et al.
Pubblicazione: (2025)
How does spatial structure affect psychological restoration? A method based on Graph Neural Networks and Street View Imagery
di: Ma, Haoran, et al.
Pubblicazione: (2023)
di: Ma, Haoran, et al.
Pubblicazione: (2023)
UrbanVGGT: Scalable Sidewalk Width Estimation from Street View Images
di: Tan, Kaizhen, et al.
Pubblicazione: (2026)
di: Tan, Kaizhen, et al.
Pubblicazione: (2026)
Coverage and Bias of Street View Imagery in Mapping the Urban Environment
di: Fan, Zicheng, et al.
Pubblicazione: (2024)
di: Fan, Zicheng, et al.
Pubblicazione: (2024)
Can a Large Language Model Assess Urban Design Quality? Evaluating Walkability Metrics Across Expertise Levels
di: Cai, Chenyi, et al.
Pubblicazione: (2025)
di: Cai, Chenyi, et al.
Pubblicazione: (2025)
The Spectrascapes Dataset: Street-view imagery beyond the visible captured using a mobile platform
di: Gupta, Akshit, et al.
Pubblicazione: (2026)
di: Gupta, Akshit, et al.
Pubblicazione: (2026)
NavAgent: Multi-scale Urban Street View Fusion For UAV Embodied Vision-and-Language Navigation
di: Liu, Youzhi, et al.
Pubblicazione: (2024)
di: Liu, Youzhi, et al.
Pubblicazione: (2024)
Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
Recov-Vision: Linking Street View Imagery and Vision-Language Models for Post-Disaster Recovery
di: Xiao, Yiming, et al.
Pubblicazione: (2025)
di: Xiao, Yiming, et al.
Pubblicazione: (2025)
Learning Street View Representations with Spatiotemporal Contrast
di: Li, Yong, et al.
Pubblicazione: (2025)
di: Li, Yong, et al.
Pubblicazione: (2025)
VAD-GS: Visibility-Aware Densification for 3D Gaussian Splatting in Dynamic Urban Scenes
di: Zhang, Yikang, et al.
Pubblicazione: (2025)
di: Zhang, Yikang, et al.
Pubblicazione: (2025)
Modeling Urban Food Insecurity with Google Street View Images
di: Li, David
Pubblicazione: (2025)
di: Li, David
Pubblicazione: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
Semantic-Aware Label Placement for Augmented Reality in Street View
di: Jia, Jianqing, et al.
Pubblicazione: (2019)
di: Jia, Jianqing, et al.
Pubblicazione: (2019)
Unsupervised Urban Land Use Mapping with Street View Contrastive Clustering and a Geographical Prior
di: Che, Lin, et al.
Pubblicazione: (2025)
di: Che, Lin, et al.
Pubblicazione: (2025)
OSMLoc: Single Image-Based Visual Localization in OpenStreetMap with Fused Geometric and Semantic Guidance
di: Liao, Youqi, et al.
Pubblicazione: (2024)
di: Liao, Youqi, et al.
Pubblicazione: (2024)
StreetView-Waste: A Multi-Task Dataset for Urban Waste Management
di: Paulo, Diogo J., et al.
Pubblicazione: (2025)
di: Paulo, Diogo J., et al.
Pubblicazione: (2025)
EVLM: An Efficient Vision-Language Model for Visual Understanding
di: Chen, Kaibing, et al.
Pubblicazione: (2024)
di: Chen, Kaibing, et al.
Pubblicazione: (2024)
StreetCrafter: Street View Synthesis with Controllable Video Diffusion Models
di: Yan, Yunzhi, et al.
Pubblicazione: (2024)
di: Yan, Yunzhi, et al.
Pubblicazione: (2024)
Eyes on the Streets: Leveraging Street-Level Imaging to Model Urban Crime Dynamics
di: Qi, Zhixuan, et al.
Pubblicazione: (2024)
di: Qi, Zhixuan, et al.
Pubblicazione: (2024)
ViPOcc: Leveraging Visual Priors from Vision Foundation Models for Single-View 3D Occupancy Prediction
di: Feng, Yi, et al.
Pubblicazione: (2024)
di: Feng, Yi, et al.
Pubblicazione: (2024)
CityPulse: Fine-Grained Assessment of Urban Change with Street View Time Series
di: Huang, Tianyuan, et al.
Pubblicazione: (2024)
di: Huang, Tianyuan, et al.
Pubblicazione: (2024)
Interpretable Multimodal Framework for Human-Centered Street Assessment: Integrating Visual-Language Models for Perceptual Urban Diagnostics
di: Lan, HaoTian
Pubblicazione: (2025)
di: Lan, HaoTian
Pubblicazione: (2025)
BuildingView: Constructing Urban Building Exteriors Databases with Street View Imagery and Multimodal Large Language Mode
di: Li, Zongrong, et al.
Pubblicazione: (2024)
di: Li, Zongrong, et al.
Pubblicazione: (2024)
ViSE: A Systematic Approach to Vision-Only Street-View Extrapolation
di: Tan, Kaiyuan, et al.
Pubblicazione: (2025)
di: Tan, Kaiyuan, et al.
Pubblicazione: (2025)
ConsensusDrop: Fusing Visual and Cross-Modal Saliency for Efficient Vision Language Models
di: Parikh, Dhruv, et al.
Pubblicazione: (2026)
di: Parikh, Dhruv, et al.
Pubblicazione: (2026)
RobustMat: Neural Diffusion for Street Landmark Patch Matching under Challenging Environments
di: She, Rui, et al.
Pubblicazione: (2023)
di: She, Rui, et al.
Pubblicazione: (2023)
GeoReasoner: Geo-localization with Reasoning in Street Views using a Large Vision-Language Model
di: Li, Ling, et al.
Pubblicazione: (2024)
di: Li, Ling, et al.
Pubblicazione: (2024)
How Well Do Vision--Language Models Understand Cities? A Comparative Study on Spatial Reasoning from Street-View Images
di: Ro, Juneyoung, et al.
Pubblicazione: (2025)
di: Ro, Juneyoung, et al.
Pubblicazione: (2025)
VOOM: Robust Visual Object Odometry and Mapping using Hierarchical Landmarks
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
VELMA: Verbalization Embodiment of LLM Agents for Vision and Language Navigation in Street View
di: Schumann, Raphael, et al.
Pubblicazione: (2023)
di: Schumann, Raphael, et al.
Pubblicazione: (2023)
Text2Street: Controllable Text-to-image Generation for Street Views
di: Su, Jinming, et al.
Pubblicazione: (2024)
di: Su, Jinming, et al.
Pubblicazione: (2024)
StreetSurfGS: Scalable Urban Street Surface Reconstruction with Planar-based Gaussian Splatting
di: Cui, Xiao, et al.
Pubblicazione: (2024)
di: Cui, Xiao, et al.
Pubblicazione: (2024)
CrossViewDiff: A Cross-View Diffusion Model for Satellite-to-Street View Synthesis
di: Li, Weijia, et al.
Pubblicazione: (2024)
di: Li, Weijia, et al.
Pubblicazione: (2024)
Diagnosing Urban Street Vitality via a Visual-Semantic and Spatiotemporal Framework for Street-Level Economics
di: Zhuo, Xinxin, et al.
Pubblicazione: (2026)
di: Zhuo, Xinxin, et al.
Pubblicazione: (2026)
Unsupervised Urban Tree Biodiversity Mapping from Street-Level Imagery Using Spatially-Aware Visual Clustering
di: Abuhani, Diaa Addeen, et al.
Pubblicazione: (2025)
di: Abuhani, Diaa Addeen, et al.
Pubblicazione: (2025)
UrbanCraft: Urban View Extrapolation via Hierarchical Sem-Geometric Priors
di: Wang, Tianhang, et al.
Pubblicazione: (2025)
di: Wang, Tianhang, et al.
Pubblicazione: (2025)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
di: li, Bonan, et al.
Pubblicazione: (2025)
di: li, Bonan, et al.
Pubblicazione: (2025)
Exploring Vision Transformers for 3D Human Motion-Language Models with Motion Patches
di: Yu, Qing, et al.
Pubblicazione: (2024)
di: Yu, Qing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ZenSVI: An Open-Source Software for the Integrated Acquisition, Processing and Analysis of Street View Imagery Towards Scalable Urban Science
di: Ito, Koichi, et al.
Pubblicazione: (2024) -
OpenFACADES: An Open Framework for Architectural Caption and Attribute Data Enrichment via Street View Imagery
di: Liang, Xiucheng, et al.
Pubblicazione: (2025) -
How does spatial structure affect psychological restoration? A method based on Graph Neural Networks and Street View Imagery
di: Ma, Haoran, et al.
Pubblicazione: (2023) -
UrbanVGGT: Scalable Sidewalk Width Estimation from Street View Images
di: Tan, Kaizhen, et al.
Pubblicazione: (2026) -
Coverage and Bias of Street View Imagery in Mapping the Urban Environment
di: Fan, Zicheng, et al.
Pubblicazione: (2024)