Diff-VPS: Video Polyp Segmentation via a Multi-task Diffusion Network with Adversarial Temporal Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Yingling, Yang, Yijun, Xing, Zhaohu, Wang, Qiong, Zhu, Lei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EndoFinder: Online Image Retrieval for Explainable Colorectal Polyp Diagnosis
par: Yang, Ruijie, et autres
Publié: (2024)
par: Yang, Ruijie, et autres
Publié: (2024)
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
par: Tang, Hengzhu, et autres
Publié: (2025)
par: Tang, Hengzhu, et autres
Publié: (2025)
MealRec: Multi-granularity Sequential Modeling via Hierarchical Diffusion Models for Micro-Video Recommendation
par: Dong, Xinxin, et autres
Publié: (2026)
par: Dong, Xinxin, et autres
Publié: (2026)
CompoDiff: Versatile Composed Image Retrieval With Latent Diffusion
par: Gu, Geonmo, et autres
Publié: (2023)
par: Gu, Geonmo, et autres
Publié: (2023)
DiffMM: Multi-Modal Diffusion Model for Recommendation
par: Jiang, Yangqin, et autres
Publié: (2024)
par: Jiang, Yangqin, et autres
Publié: (2024)
Automated Information Flow Selection for Multi-scenario Multi-task Recommendation
par: Yang, Chaohua, et autres
Publié: (2025)
par: Yang, Chaohua, et autres
Publié: (2025)
InvDiff: Invariant Guidance for Bias Mitigation in Diffusion Models
par: Hou, Min, et autres
Publié: (2024)
par: Hou, Min, et autres
Publié: (2024)
Collaborative Knowledge Fusion: A Novel Approach for Multi-task Recommender Systems via LLMs
par: Zhao, Chuang, et autres
Publié: (2024)
par: Zhao, Chuang, et autres
Publié: (2024)
AdaTask: A Task-aware Adaptive Learning Rate Approach to Multi-task Learning
par: Yang, Enneng, et autres
Publié: (2022)
par: Yang, Enneng, et autres
Publié: (2022)
RANKVIDEO: Reasoning Reranking for Text-to-Video Retrieval
par: Skow, Tyler, et autres
Publié: (2026)
par: Skow, Tyler, et autres
Publié: (2026)
Towards A Tri-View Diffusion Framework for Recommendation
par: Chen, Ximing, et autres
Publié: (2025)
par: Chen, Ximing, et autres
Publié: (2025)
CoTMR: Chain-of-Thought Multi-Scale Reasoning for Training-Free Zero-Shot Composed Image Retrieval
par: Sun, Zelong, et autres
Publié: (2025)
par: Sun, Zelong, et autres
Publié: (2025)
Efficient Multi-task Prompt Tuning for Recommendation
par: Bai, Ting, et autres
Publié: (2024)
par: Bai, Ting, et autres
Publié: (2024)
Personalized Multi-task Training for Recommender System
par: Yang, Liangwei, et autres
Publié: (2024)
par: Yang, Liangwei, et autres
Publié: (2024)
S-Diff: An Anisotropic Diffusion Model for Collaborative Filtering in Spectral Domain
par: Xia, Rui, et autres
Publié: (2024)
par: Xia, Rui, et autres
Publié: (2024)
Video Editing for Video Retrieval
par: Zhu, Bin, et autres
Publié: (2024)
par: Zhu, Bin, et autres
Publié: (2024)
EndoFinder: Online Lesion Retrieval for Explainable Colorectal Polyp Diagnosis Leveraging Latent Scene Representations
par: Yang, Ruijie, et autres
Publié: (2025)
par: Yang, Ruijie, et autres
Publié: (2025)
Interactive Multi-Turn Retrieval for Health Videos
par: Wu, Chengzheng, et autres
Publié: (2026)
par: Wu, Chengzheng, et autres
Publié: (2026)
DiffHash: Text-Guided Targeted Attack via Diffusion Models against Deep Hashing Image Retrieval
par: Liu, Zechao, et autres
Publié: (2025)
par: Liu, Zechao, et autres
Publié: (2025)
Disentangled Cascaded Graph Convolution Networks for Multi-Behavior Recommendation
par: Cheng, Zhiyong, et autres
Publié: (2024)
par: Cheng, Zhiyong, et autres
Publié: (2024)
Prototype-Driven Structure Synergy Network for Remote Sensing Images Segmentation
par: Wang, Junyi, et autres
Publié: (2025)
par: Wang, Junyi, et autres
Publié: (2025)
Multi-task Cross-modal Learning for Chest X-ray Image Retrieval
par: Liang, Zhaohui, et autres
Publié: (2026)
par: Liang, Zhaohui, et autres
Publié: (2026)
TEMPO: A Realistic Multi-Domain Benchmark for Temporal Reasoning-Intensive Retrieval
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
par: Abdallah, Abdelrahman, et autres
Publié: (2026)
A Flexible and Scalable Framework for Video Moment Search
par: Zhang, Chongzhi, et autres
Publié: (2025)
par: Zhang, Chongzhi, et autres
Publié: (2025)
DiffATR: Diffusion-based Generative Modeling for Audio-Text Retrieval
par: Xin, Yifei, et autres
Publié: (2024)
par: Xin, Yifei, et autres
Publié: (2024)
DiffGRM: Diffusion-based Generative Recommendation Model
par: Liu, Zhao, et autres
Publié: (2025)
par: Liu, Zhao, et autres
Publié: (2025)
RecDiff: Diffusion Model for Social Recommendation
par: Li, Zongwei, et autres
Publié: (2024)
par: Li, Zongwei, et autres
Publié: (2024)
Modeling Long-term User Behaviors with Diffusion-driven Multi-interest Network for CTR Prediction
par: Lai, Weijiang, et autres
Publié: (2025)
par: Lai, Weijiang, et autres
Publié: (2025)
Vivim: a Video Vision Mamba for Medical Video Segmentation
par: Yang, Yijun, et autres
Publié: (2024)
par: Yang, Yijun, et autres
Publié: (2024)
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
par: Huang, Jinghao, et autres
Publié: (2025)
par: Huang, Jinghao, et autres
Publié: (2025)
Understanding Long Videos via LLM-Powered Entity Relation Graphs
par: Chu, Meng, et autres
Publié: (2025)
par: Chu, Meng, et autres
Publié: (2025)
Video-ColBERT: Contextualized Late Interaction for Text-to-Video Retrieval
par: Reddy, Arun, et autres
Publié: (2025)
par: Reddy, Arun, et autres
Publié: (2025)
NextAds: Towards Next-generation Personalized Video Advertising
par: Xu, Yiyan, et autres
Publié: (2026)
par: Xu, Yiyan, et autres
Publié: (2026)
LongVidSearch: An Agentic Benchmark for Multi-hop Evidence Retrieval Planning in Long Videos
par: Yu, Rongyi, et autres
Publié: (2026)
par: Yu, Rongyi, et autres
Publié: (2026)
TransientTables: Evaluating LLMs' Reasoning on Temporally Evolving Semi-structured Tables
par: Shankarampeta, Abhilash, et autres
Publié: (2025)
par: Shankarampeta, Abhilash, et autres
Publié: (2025)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2022)
par: Fang, Xiang, et autres
Publié: (2022)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
par: Li, Jun, et autres
Publié: (2026)
par: Li, Jun, et autres
Publié: (2026)
AI Powered High Quality Text to Video Generation with Enhanced Temporal Consistency
par: Patel, Piyushkumar
Publié: (2025)
par: Patel, Piyushkumar
Publié: (2025)
POBEVM: Real-time Video Matting via Progressively Optimize the Target Body and Edge
par: Xian, Jianming
Publié: (2024)
par: Xian, Jianming
Publié: (2024)
AdversarialCoT: Single-Document Retrieval Poisoning for LLM Reasoning
par: Song, Hongru, et autres
Publié: (2026)
par: Song, Hongru, et autres
Publié: (2026)
Documents similaires
-
EndoFinder: Online Image Retrieval for Explainable Colorectal Polyp Diagnosis
par: Yang, Ruijie, et autres
Publié: (2024) -
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
par: Tang, Hengzhu, et autres
Publié: (2025) -
MealRec: Multi-granularity Sequential Modeling via Hierarchical Diffusion Models for Micro-Video Recommendation
par: Dong, Xinxin, et autres
Publié: (2026) -
CompoDiff: Versatile Composed Image Retrieval With Latent Diffusion
par: Gu, Geonmo, et autres
Publié: (2023) -
DiffMM: Multi-Modal Diffusion Model for Recommendation
par: Jiang, Yangqin, et autres
Publié: (2024)