VectorLLM: Human-like Extraction of Structured Building Contours vis Multimodal LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Tao, Wei, Shiqing, Chen, Shihao, Yu, Wenling, Luo, Muying, Ji, Shunping |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
P2PFormer: A Primitive-to-polygon Method for Regular Building Contour Extraction from Remote Sensing Images
par: Zhang, Tao, et autres
Publié: (2024)
par: Zhang, Tao, et autres
Publié: (2024)
Are They the Same? Exploring Visual Correspondence Shortcomings of Multimodal LLMs
par: Zhou, Yikang, et autres
Publié: (2025)
par: Zhou, Yikang, et autres
Publié: (2025)
DeH4R: A Decoupled and Hybrid Method for Road Network Graph Extraction
par: Gong, Dengxian, et autres
Publié: (2025)
par: Gong, Dengxian, et autres
Publié: (2025)
Beyond Appearance: Geometric Cues for Robust Video Instance Segmentation
par: Niu, Quanzhu, et autres
Publié: (2025)
par: Niu, Quanzhu, et autres
Publié: (2025)
A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images
par: Yu, Dawen, et autres
Publié: (2024)
par: Yu, Dawen, et autres
Publié: (2024)
Reconstruction of Contour Lines During the Digitization of Contour Maps to Build a Digital Elevation Model
par: Subedi, Aroj, et autres
Publié: (2024)
par: Subedi, Aroj, et autres
Publié: (2024)
Pixel-SAIL: Single Transformer For Pixel-Grounded Understanding
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
SaSaSaSa2VA: 2nd Place of the 5th PVUW MeViS-Text Track
par: Gong, Dengxian, et autres
Publié: (2026)
par: Gong, Dengxian, et autres
Publié: (2026)
DVIS-DAQ: Improving Video Segmentation via Dynamic Anchor Queries
par: Zhou, Yikang, et autres
Publié: (2024)
par: Zhou, Yikang, et autres
Publié: (2024)
3D Gaussian Splatting for Large-scale Surface Reconstruction from Aerial Images
par: Wu, YuanZheng, et autres
Publié: (2024)
par: Wu, YuanZheng, et autres
Publié: (2024)
LLM-driven Multimodal Target Volume Contouring in Radiation Oncology
par: Oh, Yujin, et autres
Publié: (2023)
par: Oh, Yujin, et autres
Publié: (2023)
RoIPoly: Vectorized Building Outline Extraction Using Vertex and Logit Embeddings
par: Jiao, Weiqin, et autres
Publié: (2024)
par: Jiao, Weiqin, et autres
Publié: (2024)
Prompting DirectSAM for Semantic Contour Extraction in Remote Sensing Images
par: Miao, Shiyu, et autres
Publié: (2024)
par: Miao, Shiyu, et autres
Publié: (2024)
Contour Integration Underlies Human-Like Vision
par: Lonnqvist, Ben, et autres
Publié: (2025)
par: Lonnqvist, Ben, et autres
Publié: (2025)
Opt3DGS: Optimizing 3D Gaussian Splatting with Adaptive Exploration and Curvature-Aware Exploitation
par: Huang, Ziyang, et autres
Publié: (2025)
par: Huang, Ziyang, et autres
Publié: (2025)
Dense360: Dense Understanding from Omnidirectional Panoramas
par: Zhou, Yikang, et autres
Publié: (2025)
par: Zhou, Yikang, et autres
Publié: (2025)
The P$^3$ dataset: Pixels, Points and Polygons for Multimodal Building Vectorization
par: Sulzer, Raphael, et autres
Publié: (2025)
par: Sulzer, Raphael, et autres
Publié: (2025)
The 1st Solution for 7th LSVOS RVOS Track: SaSaSa2VA
par: Niu, Quanzhu, et autres
Publié: (2025)
par: Niu, Quanzhu, et autres
Publié: (2025)
Contour-Native Bridge Defect Detection and Compact Digital Archiving with Frequency-Supervised Fourier Contours
par: Liu, Jin, et autres
Publié: (2026)
par: Liu, Jin, et autres
Publié: (2026)
MERLIN: Building Low-SNR Robust Multimodal LLMs for Electromagnetic Signals
par: Shen, Junyu, et autres
Publié: (2026)
par: Shen, Junyu, et autres
Publié: (2026)
An Approach for Air Drawing Using Background Subtraction and Contour Extraction
par: Acharya, Ramkrishna
Publié: (2025)
par: Acharya, Ramkrishna
Publié: (2025)
ΩSFormer: Dual-Modal Ω-like Super-Resolution Transformer Network for Cross-scale and High-accuracy Terraced Field Vectorization Extraction
par: Li, Chang, et autres
Publié: (2024)
par: Li, Chang, et autres
Publié: (2024)
Aligning Multimodal LLM with Human Preference: A Survey
par: Yu, Tao, et autres
Publié: (2025)
par: Yu, Tao, et autres
Publié: (2025)
LLM-I: LLMs are Naturally Interleaved Multimodal Creators
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Deep ContourFlow: Advancing Active Contours with Deep Learning
par: Habis, Antoine, et autres
Publié: (2024)
par: Habis, Antoine, et autres
Publié: (2024)
An Active Contour Model for Silhouette Vectorization using Bézier Curves
par: Alvarez, Luis, et autres
Publié: (2025)
par: Alvarez, Luis, et autres
Publié: (2025)
Merlin:Empowering Multimodal LLMs with Foresight Minds
par: Yu, En, et autres
Publié: (2023)
par: Yu, En, et autres
Publié: (2023)
Building Extraction from Remote Sensing Imagery under Hazy and Low-light Conditions: Benchmark and Baseline
par: Sang, Feifei, et autres
Publié: (2026)
par: Sang, Feifei, et autres
Publié: (2026)
A Hybrid Generative and Discriminative PointNet on Unordered Point Sets
par: Ye, Yang, et autres
Publié: (2024)
par: Ye, Yang, et autres
Publié: (2024)
Silhouette-to-Contour Registration: Aligning Intraoral Scan Models with Cephalometric Radiographs
par: Miao, Yiyi, et autres
Publié: (2025)
par: Miao, Yiyi, et autres
Publié: (2025)
AdaContour: Adaptive Contour Descriptor with Hierarchical Representation
par: Ding, Tianyu, et autres
Publié: (2024)
par: Ding, Tianyu, et autres
Publié: (2024)
GaitContour: Efficient Gait Recognition based on a Contour-Pose Representation
par: Guo, Yuxiang, et autres
Publié: (2023)
par: Guo, Yuxiang, et autres
Publié: (2023)
SIU3R: Simultaneous Scene Understanding and 3D Reconstruction Beyond Feature Alignment
par: Xu, Qi, et autres
Publié: (2025)
par: Xu, Qi, et autres
Publié: (2025)
UniVector: Unified Vector Extraction via Instance-Geometry Interaction
par: Yan, Yinglong, et autres
Publié: (2025)
par: Yan, Yinglong, et autres
Publié: (2025)
MARL-MambaContour: Unleashing Multi-Agent Deep Reinforcement Learning for Active Contour Optimization in Medical Image Segmentation
par: Zhang, Ruicheng, et autres
Publié: (2025)
par: Zhang, Ruicheng, et autres
Publié: (2025)
Point Cloud Mamba: Point Cloud Learning via State Space Model
par: Zhang, Tao, et autres
Publié: (2024)
par: Zhang, Tao, et autres
Publié: (2024)
Path and Bone-Contour Regularized Unpaired MRI-to-CT Translation
par: Zhou, Teng, et autres
Publié: (2025)
par: Zhou, Teng, et autres
Publié: (2025)
Building a Mind Palace: Structuring Environment-Grounded Semantic Graphs for Effective Long Video Analysis with LLMs
par: Huang, Zeyi, et autres
Publié: (2025)
par: Huang, Zeyi, et autres
Publié: (2025)
Self-Supervised Dual Contouring
par: Sundararaman, Ramana, et autres
Publié: (2024)
par: Sundararaman, Ramana, et autres
Publié: (2024)
rFaceNet: An End-to-End Network for Enhanced Physiological Signal Extraction through Identity-Specific Facial Contours
par: Zhu, Dali, et autres
Publié: (2024)
par: Zhu, Dali, et autres
Publié: (2024)
Documents similaires
-
P2PFormer: A Primitive-to-polygon Method for Regular Building Contour Extraction from Remote Sensing Images
par: Zhang, Tao, et autres
Publié: (2024) -
Are They the Same? Exploring Visual Correspondence Shortcomings of Multimodal LLMs
par: Zhou, Yikang, et autres
Publié: (2025) -
DeH4R: A Decoupled and Hybrid Method for Road Network Graph Extraction
par: Gong, Dengxian, et autres
Publié: (2025) -
Beyond Appearance: Geometric Cues for Robust Video Instance Segmentation
par: Niu, Quanzhu, et autres
Publié: (2025) -
A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images
par: Yu, Dawen, et autres
Publié: (2024)