Flexible Control of 3D CT Generation via Text and Semantically-Defined Segmentation Prompts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dai, Weicheng, Wang, Chenyu, Li, Andy, Ghosh, Shantanu, Batmanghelich, Kayhan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Fine-Grained Spatial Grounding in 3D CT Report Generation via Discriminative Guidance
par: Wang, Chenyu, et autres
Publié: (2026)
par: Wang, Chenyu, et autres
Publié: (2026)
Mammo-CLIP: A Vision Language Foundation Model to Enhance Data Efficiency and Robustness in Mammography
par: Ghosh, Shantanu, et autres
Publié: (2024)
par: Ghosh, Shantanu, et autres
Publié: (2024)
LADDER: Language-Driven Slice Discovery and Error Rectification in Vision Classifiers
par: Ghosh, Shantanu, et autres
Publié: (2024)
par: Ghosh, Shantanu, et autres
Publié: (2024)
VLM-UQBench: A Benchmark for Modality-Specific and Cross-Modality Uncertainties in Vision Language Models
par: Wang, Chenyu, et autres
Publié: (2026)
par: Wang, Chenyu, et autres
Publié: (2026)
Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination
par: Zhong, Xinliu, et autres
Publié: (2025)
par: Zhong, Xinliu, et autres
Publié: (2025)
MedSyn: Text-guided Anatomy-aware Synthesis of High-Fidelity 3D CT Images
par: Xu, Yanwu, et autres
Publié: (2023)
par: Xu, Yanwu, et autres
Publié: (2023)
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
par: Wang, Chenyu, et autres
Publié: (2024)
par: Wang, Chenyu, et autres
Publié: (2024)
Deep Learning for Semantic Segmentation of 3D Ultrasound Data
par: Liu, Chenyu, et autres
Publié: (2026)
par: Liu, Chenyu, et autres
Publié: (2026)
GenerateCT: Text-Conditional Generation of 3D Chest CT Volumes
par: Hamamci, Ibrahim Ethem, et autres
Publié: (2023)
par: Hamamci, Ibrahim Ethem, et autres
Publié: (2023)
Progressive3D: Progressively Local Editing for Text-to-3D Content Creation with Complex Semantic Prompts
par: Cheng, Xinhua, et autres
Publié: (2023)
par: Cheng, Xinhua, et autres
Publié: (2023)
Mammo-FM: Breast-specific foundational model for Integrated Mammographic Diagnosis, Prognosis, and Reporting
par: Ghosh, Shantanu, et autres
Publié: (2025)
par: Ghosh, Shantanu, et autres
Publié: (2025)
Text-guided Visual Prompt DINO for Generic Segmentation
par: Guan, Yuchen, et autres
Publié: (2025)
par: Guan, Yuchen, et autres
Publié: (2025)
DiffVP: Differential Visual Semantic Prompting for LLM-Based CT Report Generation
par: Tian, Yuhe, et autres
Publié: (2026)
par: Tian, Yuhe, et autres
Publié: (2026)
Controllable Text-to-Motion Generation via Modular Body-Part Phase Control
par: Dai, Minyue, et autres
Publié: (2026)
par: Dai, Minyue, et autres
Publié: (2026)
Image-Text Co-Decomposition for Text-Supervised Semantic Segmentation
par: Wu, Ji-Jia, et autres
Publié: (2024)
par: Wu, Ji-Jia, et autres
Publié: (2024)
Repurposing SAM for User-Defined Semantics Aware Segmentation
par: Kundu, Rohit, et autres
Publié: (2023)
par: Kundu, Rohit, et autres
Publié: (2023)
HOTS3D: Hyper-Spherical Optimal Transport for Semantic Alignment of Text-to-3D Generation
par: Li, Zezeng, et autres
Publié: (2024)
par: Li, Zezeng, et autres
Publié: (2024)
Controllable Text-to-3D Generation via Surface-Aligned Gaussian Splatting
par: Li, Zhiqi, et autres
Publié: (2024)
par: Li, Zhiqi, et autres
Publié: (2024)
SAMCT: Segment Any CT Allowing Labor-Free Task-Indicator Prompts
par: Lin, Xian, et autres
Publié: (2024)
par: Lin, Xian, et autres
Publié: (2024)
Open-Vocabulary 3D Semantic Segmentation with Text-to-Image Diffusion Models
par: Zhu, Xiaoyu, et autres
Publié: (2024)
par: Zhu, Xiaoyu, et autres
Publié: (2024)
VolumeDiffusion: Flexible Text-to-3D Generation with Efficient Volumetric Encoder
par: Tang, Zhicong, et autres
Publié: (2023)
par: Tang, Zhicong, et autres
Publié: (2023)
Chat-Edit-3D: Interactive 3D Scene Editing via Text Prompts
par: Fang, Shuangkang, et autres
Publié: (2024)
par: Fang, Shuangkang, et autres
Publié: (2024)
Semantic Score Distillation Sampling for Compositional Text-to-3D Generation
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
TV-3DG: Mastering Text-to-3D Customized Generation with Visual Prompt
par: Yang, Jiahui, et autres
Publié: (2024)
par: Yang, Jiahui, et autres
Publié: (2024)
Fast and Flexible Robustness Certificates for Semantic Segmentation
par: Massena, Thomas, et autres
Publié: (2025)
par: Massena, Thomas, et autres
Publié: (2025)
Can Better Text Semantics in Prompt Tuning Improve VLM Generalization?
par: Kuchibhotla, Hari Chandana, et autres
Publié: (2024)
par: Kuchibhotla, Hari Chandana, et autres
Publié: (2024)
ShareCMP: Polarization-Aware RGB-P Semantic Segmentation
par: Liu, Zhuoyan, et autres
Publié: (2023)
par: Liu, Zhuoyan, et autres
Publié: (2023)
Semantic-aware SAM for Point-Prompted Instance Segmentation
par: Wei, Zhaoyang, et autres
Publié: (2023)
par: Wei, Zhaoyang, et autres
Publié: (2023)
Cross-Modal Interactive Perception Network with Mamba for Lung Tumor Segmentation in PET-CT Images
par: Mei, Jie, et autres
Publié: (2025)
par: Mei, Jie, et autres
Publié: (2025)
TextMesh4D: Text-to-4D Mesh Generation via Jacobian Deformation Field
par: Dai, Sisi, et autres
Publié: (2025)
par: Dai, Sisi, et autres
Publié: (2025)
Powerful and Flexible: Personalized Text-to-Image Generation via Reinforcement Learning
par: Wei, Fanyue, et autres
Publié: (2024)
par: Wei, Fanyue, et autres
Publié: (2024)
FlexEControl: Flexible and Efficient Multimodal Control for Text-to-Image Generation
par: He, Xuehai, et autres
Publié: (2024)
par: He, Xuehai, et autres
Publié: (2024)
DriveGEN: Generalized and Robust 3D Detection in Driving via Controllable Text-to-Image Diffusion Generation
par: Lin, Hongbin, et autres
Publié: (2025)
par: Lin, Hongbin, et autres
Publié: (2025)
Cognition Transferring and Decoupling for Text-supervised Egocentric Semantic Segmentation
par: Shi, Zhaofeng, et autres
Publié: (2024)
par: Shi, Zhaofeng, et autres
Publié: (2024)
Image Augmentation with Controlled Diffusion for Weakly-Supervised Semantic Segmentation
par: Wu, Wangyu, et autres
Publié: (2023)
par: Wu, Wangyu, et autres
Publié: (2023)
DPSeg: Dual-Prompt Cost Volume Learning for Open-Vocabulary Semantic Segmentation
par: Zhao, Ziyu, et autres
Publié: (2025)
par: Zhao, Ziyu, et autres
Publié: (2025)
Dynamic Prompt Generation for Interactive 3D Medical Image Segmentation Training
par: Ndir, Tidiane Camaret, et autres
Publié: (2025)
par: Ndir, Tidiane Camaret, et autres
Publié: (2025)
Generalist Foundation Models from a Multimodal Dataset for 3D Computed Tomography
par: Hamamci, Ibrahim Ethem, et autres
Publié: (2024)
par: Hamamci, Ibrahim Ethem, et autres
Publié: (2024)
Text2Avatar: Text to 3D Human Avatar Generation with Codebook-Driven Body Controllable Attribute
par: Gong, Chaoqun, et autres
Publié: (2024)
par: Gong, Chaoqun, et autres
Publié: (2024)
Vision-Language Models as Differentiable Semantic and Spatial Rewards for Text-to-3D Generation
par: Bai, Weimin, et autres
Publié: (2025)
par: Bai, Weimin, et autres
Publié: (2025)
Documents similaires
-
Enhancing Fine-Grained Spatial Grounding in 3D CT Report Generation via Discriminative Guidance
par: Wang, Chenyu, et autres
Publié: (2026) -
Mammo-CLIP: A Vision Language Foundation Model to Enhance Data Efficiency and Robustness in Mammography
par: Ghosh, Shantanu, et autres
Publié: (2024) -
LADDER: Language-Driven Slice Discovery and Error Rectification in Vision Classifiers
par: Ghosh, Shantanu, et autres
Publié: (2024) -
VLM-UQBench: A Benchmark for Modality-Specific and Cross-Modality Uncertainties in Vision Language Models
par: Wang, Chenyu, et autres
Publié: (2026) -
Enhancing Biomedical Multi-modal Representation Learning with Multi-scale Pre-training and Perturbed Report Discrimination
par: Zhong, Xinliu, et autres
Publié: (2025)