Diffusion-Guided Semantic Consistency for Multimodal Heterogeneity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Jing, Guo, Zhengliang, Wang, Yan, Zhu, Xiaoguang, Du, Yao, Wang, Zehua, Leung, Victor C. M. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
D3S2: Diffusion-Guided Dataset Distillation for Semantic Segmentation
par: Zheng, Wenjie, et autres
Publié: (2026)
par: Zheng, Wenjie, et autres
Publié: (2026)
Harnessing Group-Oriented Consistency Constraints for Semi-Supervised Semantic Segmentation in CdZnTe Semiconductors
par: Li, Peihao, et autres
Publié: (2025)
par: Li, Peihao, et autres
Publié: (2025)
GarmentDiffusion: 3D Garment Sewing Pattern Generation with Multimodal Diffusion Transformers
par: Li, Xinyu, et autres
Publié: (2025)
par: Li, Xinyu, et autres
Publié: (2025)
Task-Oriented Real-time Visual Inference for IoVT Systems: A Co-design Framework of Neural Networks and Edge Deployment
par: Wu, Jiaqi, et autres
Publié: (2024)
par: Wu, Jiaqi, et autres
Publié: (2024)
POCI-Diff: Position Objects Consistently and Interactively with 3D-Layout Guided Diffusion
par: Rigo, Andrea, et autres
Publié: (2026)
par: Rigo, Andrea, et autres
Publié: (2026)
A Dual-way Enhanced Framework from Text Matching Point of View for Multimodal Entity Linking
par: Song, Shezheng, et autres
Publié: (2023)
par: Song, Shezheng, et autres
Publié: (2023)
CLIP-MUSED: CLIP-Guided Multi-Subject Visual Neural Information Semantic Decoding
par: Zhou, Qiongyi, et autres
Publié: (2024)
par: Zhou, Qiongyi, et autres
Publié: (2024)
Reward Guided Latent Consistency Distillation
par: Li, Jiachen, et autres
Publié: (2024)
par: Li, Jiachen, et autres
Publié: (2024)
SSMG: Spatial-Semantic Map Guided Diffusion Model for Free-form Layout-to-Image Generation
par: Jia, Chengyou, et autres
Publié: (2023)
par: Jia, Chengyou, et autres
Publié: (2023)
The Thinking Pixel: Recursive Sparse Reasoning in Multimodal Diffusion Latents
par: Sun, Yuwei, et autres
Publié: (2026)
par: Sun, Yuwei, et autres
Publié: (2026)
Homogeneous and Heterogeneous Consistency progressive Re-ranking for Visible-Infrared Person Re-identification
par: Wang, Yiming
Publié: (2026)
par: Wang, Yiming
Publié: (2026)
CLIPin: A Non-contrastive Plug-in to CLIP for Multimodal Semantic Alignment
par: Yang, Shengzhu, et autres
Publié: (2025)
par: Yang, Shengzhu, et autres
Publié: (2025)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
par: Li, Shuyang, et autres
Publié: (2025)
par: Li, Shuyang, et autres
Publié: (2025)
Multimodal LLM-Guided Semantic Correction in Text-to-Image Diffusion
par: Lv, Zheqi, et autres
Publié: (2025)
par: Lv, Zheqi, et autres
Publié: (2025)
PointGS: Semantic-Consistent Unsupervised 3D Point Cloud Segmentation with 3D Gaussian Splatting
par: Song, Yixiao, et autres
Publié: (2026)
par: Song, Yixiao, et autres
Publié: (2026)
Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation
par: Buburuzan, Alexandru
Publié: (2025)
par: Buburuzan, Alexandru
Publié: (2025)
SVGDreamer: Text Guided SVG Generation with Diffusion Model
par: Xing, Ximing, et autres
Publié: (2023)
par: Xing, Ximing, et autres
Publié: (2023)
Affinity-Graph-Guided Contractive Learning for Pretext-Free Medical Image Segmentation with Minimal Annotation
par: Cheng, Zehua, et autres
Publié: (2024)
par: Cheng, Zehua, et autres
Publié: (2024)
DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
par: He, Huiguo, et autres
Publié: (2024)
par: He, Huiguo, et autres
Publié: (2024)
Semantic Surgery: Zero-Shot Concept Erasure in Diffusion Models
par: Xiong, Lexiang, et autres
Publié: (2025)
par: Xiong, Lexiang, et autres
Publié: (2025)
Sam-Guided Enhanced Fine-Grained Encoding with Mixed Semantic Learning for Medical Image Captioning
par: Zhang, Zhenyu, et autres
Publié: (2023)
par: Zhang, Zhenyu, et autres
Publié: (2023)
Robust Polyp Detection and Diagnosis through Compositional Prompt-Guided Diffusion Models
par: Yu, Jia, et autres
Publié: (2025)
par: Yu, Jia, et autres
Publié: (2025)
Thinking Diffusion: Penalize and Guide Visual-Grounded Reasoning in Diffusion Multimodal Language Models
par: Kim, Keuntae, et autres
Publié: (2026)
par: Kim, Keuntae, et autres
Publié: (2026)
Morphable Diffusion: 3D-Consistent Diffusion for Single-image Avatar Creation
par: Chen, Xiyi, et autres
Publié: (2024)
par: Chen, Xiyi, et autres
Publié: (2024)
Timeline and Boundary Guided Diffusion Network for Video Shadow Detection
par: Zhou, Haipeng, et autres
Publié: (2024)
par: Zhou, Haipeng, et autres
Publié: (2024)
GS-ID: Illumination Decomposition on Gaussian Splatting via Adaptive Light Aggregation and Diffusion-Guided Material Priors
par: Du, Kang, et autres
Publié: (2024)
par: Du, Kang, et autres
Publié: (2024)
Text-Guided Layer Fusion Mitigates Hallucination in Multimodal LLMs
par: Lin, Chenchen, et autres
Publié: (2026)
par: Lin, Chenchen, et autres
Publié: (2026)
MCITlib: Multimodal Continual Instruction Tuning Library and Benchmark
par: Guo, Haiyang, et autres
Publié: (2025)
par: Guo, Haiyang, et autres
Publié: (2025)
MuDD: A Multimodal Deception Detection Dataset and GSR-Guided Progressive Distillation for Non-Contact Deception Detection
par: Jiang, Peiyuan, et autres
Publié: (2026)
par: Jiang, Peiyuan, et autres
Publié: (2026)
TGC-Net: A Structure-Aware and Semantically-Aligned Framework for Text-Guided Medical Image Segmentation
par: Lin, Gaoren, et autres
Publié: (2025)
par: Lin, Gaoren, et autres
Publié: (2025)
AnchorDS: Anchoring Dynamic Sources for Semantically Consistent Text-to-3D Generation
par: Zhu, Jiayin, et autres
Publié: (2025)
par: Zhu, Jiayin, et autres
Publié: (2025)
Task Consistent Prototype Learning for Incremental Few-shot Semantic Segmentation
par: Xu, Wenbo, et autres
Publié: (2024)
par: Xu, Wenbo, et autres
Publié: (2024)
Exploring Homogeneous and Heterogeneous Consistent Label Associations for Unsupervised Visible-Infrared Person ReID
par: He, Lingfeng, et autres
Publié: (2024)
par: He, Lingfeng, et autres
Publié: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
par: Wu, Jiulong, et autres
Publié: (2025)
par: Wu, Jiulong, et autres
Publié: (2025)
SAM Guided Semantic and Motion Changed Region Mining for Remote Sensing Change Captioning
par: Wang, Futian, et autres
Publié: (2025)
par: Wang, Futian, et autres
Publié: (2025)
Phys4D: Fine-Grained Physics-Consistent 4D Modeling from Video Diffusion
par: Lu, Haoran, et autres
Publié: (2026)
par: Lu, Haoran, et autres
Publié: (2026)
SemHiTok: A Unified Image Tokenizer via Semantic-Guided Hierarchical Codebook for Multimodal Understanding and Generation
par: Chen, Zisheng, et autres
Publié: (2025)
par: Chen, Zisheng, et autres
Publié: (2025)
Bringing Diversity from Diffusion Models to Semantic-Guided Face Asset Generation
par: Cai, Yunxuan, et autres
Publié: (2025)
par: Cai, Yunxuan, et autres
Publié: (2025)
DECADE: A Temporally-Consistent Unsupervised Diffusion Model for Enhanced Rb-82 Dynamic Cardiac PET Image Denoising
par: Zhou, Yinchi, et autres
Publié: (2026)
par: Zhou, Yinchi, et autres
Publié: (2026)
DiffSketcher: Text Guided Vector Sketch Synthesis through Latent Diffusion Models
par: Xing, Ximing, et autres
Publié: (2023)
par: Xing, Ximing, et autres
Publié: (2023)
Documents similaires
-
D3S2: Diffusion-Guided Dataset Distillation for Semantic Segmentation
par: Zheng, Wenjie, et autres
Publié: (2026) -
Harnessing Group-Oriented Consistency Constraints for Semi-Supervised Semantic Segmentation in CdZnTe Semiconductors
par: Li, Peihao, et autres
Publié: (2025) -
GarmentDiffusion: 3D Garment Sewing Pattern Generation with Multimodal Diffusion Transformers
par: Li, Xinyu, et autres
Publié: (2025) -
Task-Oriented Real-time Visual Inference for IoVT Systems: A Co-design Framework of Neural Networks and Edge Deployment
par: Wu, Jiaqi, et autres
Publié: (2024) -
POCI-Diff: Position Objects Consistently and Interactively with 3D-Layout Guided Diffusion
par: Rigo, Andrea, et autres
Publié: (2026)