PlanGPT-VL: Enhancing Urban Planning with Domain-Specific Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, He, Su, Junyou, Chen, Minxin, Wang, Wen, Deng, Yijie, Chen, Guanhua, Zhang, Wenjia |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PlanGPT: Enhancing Urban Planning with Tailored Language Model and Efficient Retrieval
von: Zhu, He, et al.
Veröffentlicht: (2024)
von: Zhu, He, et al.
Veröffentlicht: (2024)
TAG-INSTRUCT: Controlled Instruction Complexity Enhancement through Structure-based Augmentation
von: Zhu, He, et al.
Veröffentlicht: (2025)
von: Zhu, He, et al.
Veröffentlicht: (2025)
FANNO: Augmenting High-Quality Instruction Data with Open-Sourced LLMs Only
von: Zhu, He, et al.
Veröffentlicht: (2024)
von: Zhu, He, et al.
Veröffentlicht: (2024)
Anchored Supervised Fine-Tuning
von: Zhu, He, et al.
Veröffentlicht: (2025)
von: Zhu, He, et al.
Veröffentlicht: (2025)
AgriGPT-VL: Agricultural Vision-Language Understanding Suite
von: Yang, Bo, et al.
Veröffentlicht: (2025)
von: Yang, Bo, et al.
Veröffentlicht: (2025)
Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
von: Lu, Jinghui, et al.
Veröffentlicht: (2026)
von: Lu, Jinghui, et al.
Veröffentlicht: (2026)
InstructDiff: Domain-Adaptive Data Selection via Differential Entropy for Efficient LLM Fine-Tuning
von: Su, Junyou, et al.
Veröffentlicht: (2026)
von: Su, Junyou, et al.
Veröffentlicht: (2026)
AKVQ-VL: Attention-Aware KV Cache Adaptive 2-Bit Quantization for Vision-Language Models
von: Su, Zunhai, et al.
Veröffentlicht: (2025)
von: Su, Zunhai, et al.
Veröffentlicht: (2025)
UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models
von: Zheng, Yu, et al.
Veröffentlicht: (2025)
von: Zheng, Yu, et al.
Veröffentlicht: (2025)
Vision Language Models Cannot Plan, but Can They Formalize?
von: He, Muyu, et al.
Veröffentlicht: (2025)
von: He, Muyu, et al.
Veröffentlicht: (2025)
GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and Beyond
von: Zheng, Shen, et al.
Veröffentlicht: (2023)
von: Zheng, Shen, et al.
Veröffentlicht: (2023)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
von: Wang, Peng, et al.
Veröffentlicht: (2024)
von: Wang, Peng, et al.
Veröffentlicht: (2024)
PharmaGPT: Domain-Specific Large Language Models for Bio-Pharmaceutical and Chemistry
von: Chen, Linqing, et al.
Veröffentlicht: (2024)
von: Chen, Linqing, et al.
Veröffentlicht: (2024)
VL-GenRM: Enhancing Vision-Language Verification via Vision Experts and Iterative Training
von: Zhang, Jipeng, et al.
Veröffentlicht: (2025)
von: Zhang, Jipeng, et al.
Veröffentlicht: (2025)
Qianfan-VL: Domain-Enhanced Universal Vision-Language Models
von: Dong, Daxiang, et al.
Veröffentlicht: (2025)
von: Dong, Daxiang, et al.
Veröffentlicht: (2025)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
von: Ruan, Zhiwen, et al.
Veröffentlicht: (2025)
von: Ruan, Zhiwen, et al.
Veröffentlicht: (2025)
REAP: Enhancing RAG with Recursive Evaluation and Adaptive Planning for Multi-Hop Question Answering
von: Zhu, Yijie, et al.
Veröffentlicht: (2025)
von: Zhu, Yijie, et al.
Veröffentlicht: (2025)
LayAlign: Enhancing Multilingual Reasoning in Large Language Models via Layer-Wise Adaptive Fusion and Alignment Strategy
von: Ruan, Zhiwen, et al.
Veröffentlicht: (2025)
von: Ruan, Zhiwen, et al.
Veröffentlicht: (2025)
BLADE: Enhancing Black-box Large Language Models with Small Domain-Specific Models
von: Li, Haitao, et al.
Veröffentlicht: (2024)
von: Li, Haitao, et al.
Veröffentlicht: (2024)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
von: Huang, Zhehao, et al.
Veröffentlicht: (2025)
von: Huang, Zhehao, et al.
Veröffentlicht: (2025)
MiningGPT -- A Domain-Specific Large Language Model for the Mining Industry
von: Demartini, Kurukulasooriya Fernando ana Gianluca
Veröffentlicht: (2024)
von: Demartini, Kurukulasooriya Fernando ana Gianluca
Veröffentlicht: (2024)
Roboflow100-VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models
von: Robicheaux, Peter, et al.
Veröffentlicht: (2025)
von: Robicheaux, Peter, et al.
Veröffentlicht: (2025)
Large Language Models as Planning Domain Generators
von: Oswald, James, et al.
Veröffentlicht: (2024)
von: Oswald, James, et al.
Veröffentlicht: (2024)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
von: Ruan, Zhiwen, et al.
Veröffentlicht: (2026)
von: Ruan, Zhiwen, et al.
Veröffentlicht: (2026)
Beyond Natural Language Plans: Structure-Aware Planning for Query-Focused Table Summarization
von: Zhang, Weijia, et al.
Veröffentlicht: (2025)
von: Zhang, Weijia, et al.
Veröffentlicht: (2025)
FlightGPT: Towards Generalizable and Interpretable UAV Vision-and-Language Navigation with Vision-Language Models
von: Cai, Hengxing, et al.
Veröffentlicht: (2025)
von: Cai, Hengxing, et al.
Veröffentlicht: (2025)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
von: Wang, Jun, et al.
Veröffentlicht: (2025)
von: Wang, Jun, et al.
Veröffentlicht: (2025)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
von: Chen, Jiaqi, et al.
Veröffentlicht: (2024)
von: Chen, Jiaqi, et al.
Veröffentlicht: (2024)
TravelPlanner: A Benchmark for Real-World Planning with Language Agents
von: Xie, Jian, et al.
Veröffentlicht: (2024)
von: Xie, Jian, et al.
Veröffentlicht: (2024)
Deliberate Planning in Language Models with Symbolic Representation
von: Xiong, Siheng, et al.
Veröffentlicht: (2025)
von: Xiong, Siheng, et al.
Veröffentlicht: (2025)
DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding
von: Wu, Zhiyu, et al.
Veröffentlicht: (2024)
von: Wu, Zhiyu, et al.
Veröffentlicht: (2024)
SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model
von: Zhang, Yongting, et al.
Veröffentlicht: (2024)
von: Zhang, Yongting, et al.
Veröffentlicht: (2024)
ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models
von: Chen, Guiming Hardy, et al.
Veröffentlicht: (2024)
von: Chen, Guiming Hardy, et al.
Veröffentlicht: (2024)
Enhancing Large Language Models with Domain-Specific Knowledge: The Case in Topological Materials
von: Xu, HuangChao, et al.
Veröffentlicht: (2024)
von: Xu, HuangChao, et al.
Veröffentlicht: (2024)
ArtGPT-4: Towards Artistic-understanding Large Vision-Language Models with Enhanced Adapter
von: Yuan, Zhengqing, et al.
Veröffentlicht: (2023)
von: Yuan, Zhengqing, et al.
Veröffentlicht: (2023)
Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone
von: Ye, Jiacheng, et al.
Veröffentlicht: (2025)
von: Ye, Jiacheng, et al.
Veröffentlicht: (2025)
Knowledge Planning in Large Language Models for Domain-Aligned Counseling Summarization
von: Srivastava, Aseem, et al.
Veröffentlicht: (2024)
von: Srivastava, Aseem, et al.
Veröffentlicht: (2024)
Query-Efficient Planning with Language Models
von: Gonzalez-Pumariega, Gonzalo, et al.
Veröffentlicht: (2024)
von: Gonzalez-Pumariega, Gonzalo, et al.
Veröffentlicht: (2024)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
von: An, Dong, et al.
Veröffentlicht: (2023)
von: An, Dong, et al.
Veröffentlicht: (2023)
Ask-before-Plan: Proactive Language Agents for Real-World Planning
von: Zhang, Xuan, et al.
Veröffentlicht: (2024)
von: Zhang, Xuan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
PlanGPT: Enhancing Urban Planning with Tailored Language Model and Efficient Retrieval
von: Zhu, He, et al.
Veröffentlicht: (2024) -
TAG-INSTRUCT: Controlled Instruction Complexity Enhancement through Structure-based Augmentation
von: Zhu, He, et al.
Veröffentlicht: (2025) -
FANNO: Augmenting High-Quality Instruction Data with Open-Sourced LLMs Only
von: Zhu, He, et al.
Veröffentlicht: (2024) -
Anchored Supervised Fine-Tuning
von: Zhu, He, et al.
Veröffentlicht: (2025) -
AgriGPT-VL: Agricultural Vision-Language Understanding Suite
von: Yang, Bo, et al.
Veröffentlicht: (2025)