DGSSM: Diffusion guided state-space models for multimodal salient object detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghosh, Suklav, Sur, Arijit, Mitra, Pinaki |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
C-LEAD: Contrastive Learning for Enhanced Adversarial Defense
par: Ghosh, Suklav, et autres
Publié: (2025)
par: Ghosh, Suklav, et autres
Publié: (2025)
Trans-defense: Transformer-based Denoiser for Adversarial Defense with Spatial-Frequency Domain Representation
par: Pramanick, Alik, et autres
Publié: (2025)
par: Pramanick, Alik, et autres
Publié: (2025)
Do multimodal models imagine electric sheep?
par: Ramakrishnan, Santhosh Kumar, et autres
Publié: (2026)
par: Ramakrishnan, Santhosh Kumar, et autres
Publié: (2026)
D4: Text-guided diffusion model-based domain adaptive data augmentation for vineyard shoot detection
par: Hirahara, Kentaro, et autres
Publié: (2024)
par: Hirahara, Kentaro, et autres
Publié: (2024)
SADA: Stability-guided Adaptive Diffusion Acceleration
par: Jiang, Ting, et autres
Publié: (2025)
par: Jiang, Ting, et autres
Publié: (2025)
Sketch-guided Image Inpainting with Partial Discrete Diffusion Process
par: Sharma, Nakul, et autres
Publié: (2024)
par: Sharma, Nakul, et autres
Publié: (2024)
Explaining latent representations of generative models with large multimodal models
par: Zhu, Mengdan, et autres
Publié: (2024)
par: Zhu, Mengdan, et autres
Publié: (2024)
Contrastive Denoising Score for Text-guided Latent Diffusion Image Editing
par: Nam, Hyelin, et autres
Publié: (2023)
par: Nam, Hyelin, et autres
Publié: (2023)
From classical techniques to convolution-based models: A review of object detection algorithms
par: Neha, Fnu, et autres
Publié: (2024)
par: Neha, Fnu, et autres
Publié: (2024)
Review of multimodal machine learning approaches in healthcare
par: Krones, Felix, et autres
Publié: (2024)
par: Krones, Felix, et autres
Publié: (2024)
Track4Gen: Teaching Video Diffusion Models to Track Points Improves Video Generation
par: Jeong, Hyeonho, et autres
Publié: (2024)
par: Jeong, Hyeonho, et autres
Publié: (2024)
DOSE3 : Diffusion-based Out-of-distribution detection on SE(3) trajectories
par: Cheng, Hongzhe, et autres
Publié: (2025)
par: Cheng, Hongzhe, et autres
Publié: (2025)
Autonomous state-space segmentation for Deep-RL sparse reward scenarios
par: Maselli, Gianluca, et autres
Publié: (2025)
par: Maselli, Gianluca, et autres
Publié: (2025)
Towards Physics-informed Diffusion for Anomaly Detection in Trajectories
par: Sharma, Arun, et autres
Publié: (2025)
par: Sharma, Arun, et autres
Publié: (2025)
Hybrid deep convolution model for lung cancer detection with transfer learning
par: Saxena, Sugandha, et autres
Publié: (2025)
par: Saxena, Sugandha, et autres
Publié: (2025)
MAN TruckScenes: A multimodal dataset for autonomous trucking in diverse conditions
par: Fent, Felix, et autres
Publié: (2024)
par: Fent, Felix, et autres
Publié: (2024)
Open-set object detection: towards unified problem formulation and benchmarking
par: Ammar, Hejer, et autres
Publié: (2024)
par: Ammar, Hejer, et autres
Publié: (2024)
Generating crossmodal gene expression from cancer histopathology improves multimodal AI predictions
par: Dey, Samiran, et autres
Publié: (2025)
par: Dey, Samiran, et autres
Publié: (2025)
What to align in multimodal contrastive learning?
par: Dufumier, Benoit, et autres
Publié: (2024)
par: Dufumier, Benoit, et autres
Publié: (2024)
Moving object detection from multi-depth images with an attention-enhanced CNN
par: Shibukawa, Masato, et autres
Publié: (2025)
par: Shibukawa, Masato, et autres
Publié: (2025)
FeatInv: Spatially resolved mapping from feature space to input space using conditional diffusion models
par: Neukirch, Nils, et autres
Publié: (2025)
par: Neukirch, Nils, et autres
Publié: (2025)
SELECTOR: Heterogeneous graph network with convolutional masked autoencoder for multimodal robust prediction of cancer survival
par: Pan, Liangrui, et autres
Publié: (2024)
par: Pan, Liangrui, et autres
Publié: (2024)
Deep Attention-guided Adaptive Subsampling
par: Shankaranarayana, Sharath M, et autres
Publié: (2025)
par: Shankaranarayana, Sharath M, et autres
Publié: (2025)
Self-learned representation-guided latent diffusion model for breast cancer classification in deep ultraviolet whole surface images
par: Afshin, Pouya, et autres
Publié: (2026)
par: Afshin, Pouya, et autres
Publié: (2026)
PBCAT: Patch-based composite adversarial training against physically realizable attacks on object detection
par: Li, Xiao, et autres
Publié: (2025)
par: Li, Xiao, et autres
Publié: (2025)
RQR3D: Reparametrizing the regression targets for BEV-based 3D object detection
par: Kilinc, Ozsel, et autres
Publié: (2025)
par: Kilinc, Ozsel, et autres
Publié: (2025)
Feedback-guided Data Synthesis for Imbalanced Classification
par: Hemmat, Reyhane Askari, et autres
Publié: (2023)
par: Hemmat, Reyhane Askari, et autres
Publié: (2023)
Enhancing multimodal cooperation via sample-level modality valuation
par: Wei, Yake, et autres
Publié: (2023)
par: Wei, Yake, et autres
Publié: (2023)
Human-like object concept representations emerge naturally in multimodal large language models
par: Du, Changde, et autres
Publié: (2024)
par: Du, Changde, et autres
Publié: (2024)
An attempt to generate new bridge types from latent space of denoising diffusion Implicit model
par: Zhang, Hongjun
Publié: (2024)
par: Zhang, Hongjun
Publié: (2024)
Learning Hyperspectral Images with Curated Text Prompts for Efficient Multimodal Alignment
par: Chatterjee, Abhiroop, et autres
Publié: (2025)
par: Chatterjee, Abhiroop, et autres
Publié: (2025)
Structured Unrestricted-Rank Matrices for Parameter Efficient Fine-tuning
par: Sehanobish, Arijit, et autres
Publié: (2024)
par: Sehanobish, Arijit, et autres
Publié: (2024)
CDAN: Convolutional dense attention-guided network for low-light image enhancement
par: Shakibania, Hossein, et autres
Publié: (2023)
par: Shakibania, Hossein, et autres
Publié: (2023)
Saliency-guided Emotion Modeling: Predicting Viewer Reactions from Video Stimuli
par: Yaragoppa, Akhila, et autres
Publié: (2025)
par: Yaragoppa, Akhila, et autres
Publié: (2025)
Enhancing kelp forest detection in remote sensing images using crowdsourced labels with Mixed Vision Transformers and ConvNeXt segmentation models
par: Nasios, Ioannis
Publié: (2025)
par: Nasios, Ioannis
Publié: (2025)
PIF: Anomaly detection via preference embedding
par: Leveni, Filippo, et autres
Publié: (2025)
par: Leveni, Filippo, et autres
Publié: (2025)
Defect detection using weakly supervised learning
par: Sevetlidis, Vasileios, et autres
Publié: (2023)
par: Sevetlidis, Vasileios, et autres
Publié: (2023)
Few-Shot Classification and Anatomical Localization of Tissues in SPECT Imaging
par: Khan, Mohammed Abdul Hafeez, et autres
Publié: (2025)
par: Khan, Mohammed Abdul Hafeez, et autres
Publié: (2025)
UPCMR: A Universal Prompt-guided Model for Random Sampling Cardiac MRI Reconstruction
par: Lyu, Donghang, et autres
Publié: (2025)
par: Lyu, Donghang, et autres
Publié: (2025)
DiffusionNFT: Online Diffusion Reinforcement with Forward Process
par: Zheng, Kaiwen, et autres
Publié: (2025)
par: Zheng, Kaiwen, et autres
Publié: (2025)
Documents similaires
-
C-LEAD: Contrastive Learning for Enhanced Adversarial Defense
par: Ghosh, Suklav, et autres
Publié: (2025) -
Trans-defense: Transformer-based Denoiser for Adversarial Defense with Spatial-Frequency Domain Representation
par: Pramanick, Alik, et autres
Publié: (2025) -
Do multimodal models imagine electric sheep?
par: Ramakrishnan, Santhosh Kumar, et autres
Publié: (2026) -
D4: Text-guided diffusion model-based domain adaptive data augmentation for vineyard shoot detection
par: Hirahara, Kentaro, et autres
Publié: (2024) -
SADA: Stability-guided Adaptive Diffusion Acceleration
par: Jiang, Ting, et autres
Publié: (2025)