PlanGPT-VL: Enhancing Urban Planning with Domain-Specific Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, He, Su, Junyou, Chen, Minxin, Wang, Wen, Deng, Yijie, Chen, Guanhua, Zhang, Wenjia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PlanGPT: Enhancing Urban Planning with Tailored Language Model and Efficient Retrieval
di: Zhu, He, et al.
Pubblicazione: (2024)
di: Zhu, He, et al.
Pubblicazione: (2024)
TAG-INSTRUCT: Controlled Instruction Complexity Enhancement through Structure-based Augmentation
di: Zhu, He, et al.
Pubblicazione: (2025)
di: Zhu, He, et al.
Pubblicazione: (2025)
FANNO: Augmenting High-Quality Instruction Data with Open-Sourced LLMs Only
di: Zhu, He, et al.
Pubblicazione: (2024)
di: Zhu, He, et al.
Pubblicazione: (2024)
Anchored Supervised Fine-Tuning
di: Zhu, He, et al.
Pubblicazione: (2025)
di: Zhu, He, et al.
Pubblicazione: (2025)
AgriGPT-VL: Agricultural Vision-Language Understanding Suite
di: Yang, Bo, et al.
Pubblicazione: (2025)
di: Yang, Bo, et al.
Pubblicazione: (2025)
Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
di: Lu, Jinghui, et al.
Pubblicazione: (2026)
di: Lu, Jinghui, et al.
Pubblicazione: (2026)
InstructDiff: Domain-Adaptive Data Selection via Differential Entropy for Efficient LLM Fine-Tuning
di: Su, Junyou, et al.
Pubblicazione: (2026)
di: Su, Junyou, et al.
Pubblicazione: (2026)
AKVQ-VL: Attention-Aware KV Cache Adaptive 2-Bit Quantization for Vision-Language Models
di: Su, Zunhai, et al.
Pubblicazione: (2025)
di: Su, Zunhai, et al.
Pubblicazione: (2025)
UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models
di: Zheng, Yu, et al.
Pubblicazione: (2025)
di: Zheng, Yu, et al.
Pubblicazione: (2025)
Vision Language Models Cannot Plan, but Can They Formalize?
di: He, Muyu, et al.
Pubblicazione: (2025)
di: He, Muyu, et al.
Pubblicazione: (2025)
GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and Beyond
di: Zheng, Shen, et al.
Pubblicazione: (2023)
di: Zheng, Shen, et al.
Pubblicazione: (2023)
Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution
di: Wang, Peng, et al.
Pubblicazione: (2024)
di: Wang, Peng, et al.
Pubblicazione: (2024)
PharmaGPT: Domain-Specific Large Language Models for Bio-Pharmaceutical and Chemistry
di: Chen, Linqing, et al.
Pubblicazione: (2024)
di: Chen, Linqing, et al.
Pubblicazione: (2024)
VL-GenRM: Enhancing Vision-Language Verification via Vision Experts and Iterative Training
di: Zhang, Jipeng, et al.
Pubblicazione: (2025)
di: Zhang, Jipeng, et al.
Pubblicazione: (2025)
Qianfan-VL: Domain-Enhanced Universal Vision-Language Models
di: Dong, Daxiang, et al.
Pubblicazione: (2025)
di: Dong, Daxiang, et al.
Pubblicazione: (2025)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
REAP: Enhancing RAG with Recursive Evaluation and Adaptive Planning for Multi-Hop Question Answering
di: Zhu, Yijie, et al.
Pubblicazione: (2025)
di: Zhu, Yijie, et al.
Pubblicazione: (2025)
LayAlign: Enhancing Multilingual Reasoning in Large Language Models via Layer-Wise Adaptive Fusion and Alignment Strategy
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
BLADE: Enhancing Black-box Large Language Models with Small Domain-Specific Models
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
di: Huang, Zhehao, et al.
Pubblicazione: (2025)
di: Huang, Zhehao, et al.
Pubblicazione: (2025)
MiningGPT -- A Domain-Specific Large Language Model for the Mining Industry
di: Demartini, Kurukulasooriya Fernando ana Gianluca
Pubblicazione: (2024)
di: Demartini, Kurukulasooriya Fernando ana Gianluca
Pubblicazione: (2024)
Roboflow100-VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models
di: Robicheaux, Peter, et al.
Pubblicazione: (2025)
di: Robicheaux, Peter, et al.
Pubblicazione: (2025)
Large Language Models as Planning Domain Generators
di: Oswald, James, et al.
Pubblicazione: (2024)
di: Oswald, James, et al.
Pubblicazione: (2024)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
di: Ruan, Zhiwen, et al.
Pubblicazione: (2026)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2026)
Beyond Natural Language Plans: Structure-Aware Planning for Query-Focused Table Summarization
di: Zhang, Weijia, et al.
Pubblicazione: (2025)
di: Zhang, Weijia, et al.
Pubblicazione: (2025)
FlightGPT: Towards Generalizable and Interpretable UAV Vision-and-Language Navigation with Vision-Language Models
di: Cai, Hengxing, et al.
Pubblicazione: (2025)
di: Cai, Hengxing, et al.
Pubblicazione: (2025)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
di: Wang, Jun, et al.
Pubblicazione: (2025)
di: Wang, Jun, et al.
Pubblicazione: (2025)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
TravelPlanner: A Benchmark for Real-World Planning with Language Agents
di: Xie, Jian, et al.
Pubblicazione: (2024)
di: Xie, Jian, et al.
Pubblicazione: (2024)
Deliberate Planning in Language Models with Symbolic Representation
di: Xiong, Siheng, et al.
Pubblicazione: (2025)
di: Xiong, Siheng, et al.
Pubblicazione: (2025)
DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding
di: Wu, Zhiyu, et al.
Pubblicazione: (2024)
di: Wu, Zhiyu, et al.
Pubblicazione: (2024)
SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model
di: Zhang, Yongting, et al.
Pubblicazione: (2024)
di: Zhang, Yongting, et al.
Pubblicazione: (2024)
ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models
di: Chen, Guiming Hardy, et al.
Pubblicazione: (2024)
di: Chen, Guiming Hardy, et al.
Pubblicazione: (2024)
Enhancing Large Language Models with Domain-Specific Knowledge: The Case in Topological Materials
di: Xu, HuangChao, et al.
Pubblicazione: (2024)
di: Xu, HuangChao, et al.
Pubblicazione: (2024)
ArtGPT-4: Towards Artistic-understanding Large Vision-Language Models with Enhanced Adapter
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone
di: Ye, Jiacheng, et al.
Pubblicazione: (2025)
di: Ye, Jiacheng, et al.
Pubblicazione: (2025)
Knowledge Planning in Large Language Models for Domain-Aligned Counseling Summarization
di: Srivastava, Aseem, et al.
Pubblicazione: (2024)
di: Srivastava, Aseem, et al.
Pubblicazione: (2024)
Query-Efficient Planning with Language Models
di: Gonzalez-Pumariega, Gonzalo, et al.
Pubblicazione: (2024)
di: Gonzalez-Pumariega, Gonzalo, et al.
Pubblicazione: (2024)
ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments
di: An, Dong, et al.
Pubblicazione: (2023)
di: An, Dong, et al.
Pubblicazione: (2023)
Ask-before-Plan: Proactive Language Agents for Real-World Planning
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PlanGPT: Enhancing Urban Planning with Tailored Language Model and Efficient Retrieval
di: Zhu, He, et al.
Pubblicazione: (2024) -
TAG-INSTRUCT: Controlled Instruction Complexity Enhancement through Structure-based Augmentation
di: Zhu, He, et al.
Pubblicazione: (2025) -
FANNO: Augmenting High-Quality Instruction Data with Open-Sourced LLMs Only
di: Zhu, He, et al.
Pubblicazione: (2024) -
Anchored Supervised Fine-Tuning
di: Zhu, He, et al.
Pubblicazione: (2025) -
AgriGPT-VL: Agricultural Vision-Language Understanding Suite
di: Yang, Bo, et al.
Pubblicazione: (2025)