URSimulator: Human-Perception-Driven Prompt Tuning for Enhanced Virtual Urban Renewal via Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Chuanbo, Jia, Shan, Li, Xin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Poetry in Pixels: Prompt Tuning for Poem Image Generation via Diffusion Models
di: Jamil, Sofia, et al.
Pubblicazione: (2025)
di: Jamil, Sofia, et al.
Pubblicazione: (2025)
FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models
di: Xu, Jinglin, et al.
Pubblicazione: (2024)
di: Xu, Jinglin, et al.
Pubblicazione: (2024)
Multimodal Large Language Models for Medical Report Generation via Customized Prompt Tuning
di: Li, Chunlei, et al.
Pubblicazione: (2025)
di: Li, Chunlei, et al.
Pubblicazione: (2025)
Simulating Post-Neoadjuvant Chemotherapy Breast Cancer MRI via Diffusion Model with Prompt Tuning
di: Kim, Jonghun, et al.
Pubblicazione: (2025)
di: Kim, Jonghun, et al.
Pubblicazione: (2025)
DetDiffusion: Synergizing Generative and Perceptive Models for Enhanced Data Generation and Perception
di: Wang, Yibo, et al.
Pubblicazione: (2024)
di: Wang, Yibo, et al.
Pubblicazione: (2024)
SEP: Self-Enhanced Prompt Tuning for Visual-Language Model
di: Yao, Hantao, et al.
Pubblicazione: (2024)
di: Yao, Hantao, et al.
Pubblicazione: (2024)
AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts
di: Liu, Yufan, et al.
Pubblicazione: (2025)
di: Liu, Yufan, et al.
Pubblicazione: (2025)
The devil is in the details: Enhancing Video Virtual Try-On via Keyframe-Driven Details Injection
di: He, Qingdong, et al.
Pubblicazione: (2025)
di: He, Qingdong, et al.
Pubblicazione: (2025)
Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision
di: Yan, Weicai, et al.
Pubblicazione: (2025)
di: Yan, Weicai, et al.
Pubblicazione: (2025)
LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models
di: Lian, Long, et al.
Pubblicazione: (2023)
di: Lian, Long, et al.
Pubblicazione: (2023)
MuGa-VTON: Multi-Garment Virtual Try-On via Diffusion Transformers with Prompt Customization
di: Deria, Ankan, et al.
Pubblicazione: (2025)
di: Deria, Ankan, et al.
Pubblicazione: (2025)
Debiased Prompt Tuning in Vision-Language Model without Annotations
di: Jiang, Chaoquan, et al.
Pubblicazione: (2025)
di: Jiang, Chaoquan, et al.
Pubblicazione: (2025)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
FLDM-VTON: Faithful Latent Diffusion Model for Virtual Try-on
di: Wang, Chenhui, et al.
Pubblicazione: (2024)
di: Wang, Chenhui, et al.
Pubblicazione: (2024)
Modeling Subjective Urban Perception with Human Gaze
di: Che, Lin, et al.
Pubblicazione: (2026)
di: Che, Lin, et al.
Pubblicazione: (2026)
VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning
di: Li, Xinhao, et al.
Pubblicazione: (2025)
di: Li, Xinhao, et al.
Pubblicazione: (2025)
SPIRiT-Diffusion: Self-Consistency Driven Diffusion Model for Accelerated MRI
di: Cui, Zhuo-Xu, et al.
Pubblicazione: (2023)
di: Cui, Zhuo-Xu, et al.
Pubblicazione: (2023)
TAME: Test-Time Adversarial Prompt Tuning via Mixture-of-Experts for Vision-Language Models
di: Wang, Xin, et al.
Pubblicazione: (2026)
di: Wang, Xin, et al.
Pubblicazione: (2026)
SDVPT: Semantic-Driven Visual Prompt Tuning for Open-World Object Counting
di: Zhao, Yiming, et al.
Pubblicazione: (2025)
di: Zhao, Yiming, et al.
Pubblicazione: (2025)
PromptEnhancer: A Simple Approach to Enhance Text-to-Image Models via Chain-of-Thought Prompt Rewriting
di: Wang, Linqing, et al.
Pubblicazione: (2025)
di: Wang, Linqing, et al.
Pubblicazione: (2025)
POET: Prompt Offset Tuning for Continual Human Action Adaptation
di: Garg, Prachi, et al.
Pubblicazione: (2025)
di: Garg, Prachi, et al.
Pubblicazione: (2025)
HAODiff: Human-Aware One-Step Diffusion via Dual-Prompt Guidance
di: Gong, Jue, et al.
Pubblicazione: (2025)
di: Gong, Jue, et al.
Pubblicazione: (2025)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
di: Zhang, Zhifang, et al.
Pubblicazione: (2024)
di: Zhang, Zhifang, et al.
Pubblicazione: (2024)
Urban Safety Perception Assessments via Integrating Multimodal Large Language Models with Street View Images
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
LGTM: Local-to-Global Text-Driven Human Motion Diffusion Model
di: Sun, Haowen, et al.
Pubblicazione: (2024)
di: Sun, Haowen, et al.
Pubblicazione: (2024)
RefHCM: A Unified Model for Referring Perceptions in Human-Centric Scenarios
di: Huang, Jie, et al.
Pubblicazione: (2024)
di: Huang, Jie, et al.
Pubblicazione: (2024)
Anatomy-Grounded Weakly Supervised Prompt Tuning for Chest X-ray Latent Diffusion Models
di: Vilouras, Konstantinos, et al.
Pubblicazione: (2025)
di: Vilouras, Konstantinos, et al.
Pubblicazione: (2025)
Vision-Driven 2D Supervised Fine-Tuning Framework for Bird's Eye View Perception
di: He, Lei, et al.
Pubblicazione: (2024)
di: He, Lei, et al.
Pubblicazione: (2024)
FreeNoise: Tuning-Free Longer Video Diffusion via Noise Rescheduling
di: Qiu, Haonan, et al.
Pubblicazione: (2023)
di: Qiu, Haonan, et al.
Pubblicazione: (2023)
DynRsl-VLM: Enhancing Autonomous Driving Perception with Dynamic Resolution Vision-Language Models
di: Zhou, Xirui, et al.
Pubblicazione: (2025)
di: Zhou, Xirui, et al.
Pubblicazione: (2025)
Adaptive Physical-Facial Representation Fusion via Subject-Invariant Cross-Modal Prompt Tuning for Video-Based Emotion Recognition
di: Luo, Xiwen, et al.
Pubblicazione: (2026)
di: Luo, Xiwen, et al.
Pubblicazione: (2026)
Self-NPO: Data-Free Diffusion Model Enhancement via Truncated Diffusion Fine-Tuning
di: Wang, Fu-Yun, et al.
Pubblicazione: (2025)
di: Wang, Fu-Yun, et al.
Pubblicazione: (2025)
Face-MLLM: A Large Face Perception Model
di: Sun, Haomiao, et al.
Pubblicazione: (2024)
di: Sun, Haomiao, et al.
Pubblicazione: (2024)
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
AoP-SAM: Automation of Prompts for Efficient Segmentation
di: Chen, Yi, et al.
Pubblicazione: (2025)
di: Chen, Yi, et al.
Pubblicazione: (2025)
Prompt-aligned Gradient for Prompt Tuning
di: Zhu, Beier, et al.
Pubblicazione: (2022)
di: Zhu, Beier, et al.
Pubblicazione: (2022)
Tokenize Anything via Prompting
di: Pan, Ting, et al.
Pubblicazione: (2023)
di: Pan, Ting, et al.
Pubblicazione: (2023)
Blind Bitstream-corrupted Video Recovery via Metadata-guided Diffusion Model
di: Wang, Shuyun, et al.
Pubblicazione: (2026)
di: Wang, Shuyun, et al.
Pubblicazione: (2026)
PROPEX-RAG: Enhanced GraphRAG using Prompt-Driven Prompt Execution
di: Sarnaik, Tejas, et al.
Pubblicazione: (2025)
di: Sarnaik, Tejas, et al.
Pubblicazione: (2025)
Generalizable Prompt Tuning for Vision-Language Models
di: Zhang, Qian
Pubblicazione: (2024)
di: Zhang, Qian
Pubblicazione: (2024)
Documenti analoghi
-
Poetry in Pixels: Prompt Tuning for Poem Image Generation via Diffusion Models
di: Jamil, Sofia, et al.
Pubblicazione: (2025) -
FinePOSE: Fine-Grained Prompt-Driven 3D Human Pose Estimation via Diffusion Models
di: Xu, Jinglin, et al.
Pubblicazione: (2024) -
Multimodal Large Language Models for Medical Report Generation via Customized Prompt Tuning
di: Li, Chunlei, et al.
Pubblicazione: (2025) -
Simulating Post-Neoadjuvant Chemotherapy Breast Cancer MRI via Diffusion Model with Prompt Tuning
di: Kim, Jonghun, et al.
Pubblicazione: (2025) -
DetDiffusion: Synergizing Generative and Perceptive Models for Enhanced Data Generation and Perception
di: Wang, Yibo, et al.
Pubblicazione: (2024)