Prompt-Free Universal Region Proposal Network
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tang, Qihong, Liu, Changhan, Zhang, Shaofeng, Li, Wenbin, Fan, Qi, Gao, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning
par: Chen, Jiahua, et autres
Publié: (2026)
par: Chen, Jiahua, et autres
Publié: (2026)
Exploring Conditional Multi-Modal Prompts for Zero-shot HOI Detection
par: Lei, Ting, et autres
Publié: (2024)
par: Lei, Ting, et autres
Publié: (2024)
Annotation-Free Visual Reasoning for High-Resolution Large Multimodal Models via Reinforcement Learning
par: Yang, Jiacheng, et autres
Publié: (2026)
par: Yang, Jiacheng, et autres
Publié: (2026)
A Proposal-Free Query-Guided Network for Grounded Multimodal Named Entity Recognition
par: Li, Hongbing, et autres
Publié: (2026)
par: Li, Hongbing, et autres
Publié: (2026)
Selective, Regularized, and Calibrated: Harnessing Vision Foundation Models for Cross-Domain Few-Shot Semantic Segmentation
par: Ma, Junyuan, et autres
Publié: (2026)
par: Ma, Junyuan, et autres
Publié: (2026)
PointAlign: Feature-Level Alignment Regularization for 3D Vision-Language Models
par: Su, Yuanhao, et autres
Publié: (2026)
par: Su, Yuanhao, et autres
Publié: (2026)
Concept-to-Pixel: Prompt-Free Universal Medical Image Segmentation
par: Chen, Haoyun, et autres
Publié: (2026)
par: Chen, Haoyun, et autres
Publié: (2026)
Open-Vocabulary HOI Detection with Interaction-aware Prompt and Concept Calibration
par: Lei, Ting, et autres
Publié: (2025)
par: Lei, Ting, et autres
Publié: (2025)
DPStyler: Dynamic PromptStyler for Source-Free Domain Generalization
par: Tang, Yunlong, et autres
Publié: (2024)
par: Tang, Yunlong, et autres
Publié: (2024)
Adapting In-Domain Few-Shot Segmentation to New Domains without Source Domain Retraining
par: Fan, Qi, et autres
Publié: (2025)
par: Fan, Qi, et autres
Publié: (2025)
Label-Efficient Object Detection via Region Proposal Network Pre-Training
par: Dong, Nanqing, et autres
Publié: (2022)
par: Dong, Nanqing, et autres
Publié: (2022)
Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP
par: Li, Yayuan, et autres
Publié: (2024)
par: Li, Yayuan, et autres
Publié: (2024)
Prompt-Guided Mask Proposal for Two-Stage Open-Vocabulary Segmentation
par: Li, Yu-Jhe, et autres
Publié: (2024)
par: Li, Yu-Jhe, et autres
Publié: (2024)
Exploring the Potential of Large Foundation Models for Open-Vocabulary HOI Detection
par: Lei, Ting, et autres
Publié: (2024)
par: Lei, Ting, et autres
Publié: (2024)
SWIFT: Prompt-Adaptive Memory for Efficient Interactive Long Video Generation
par: Tan, Shanwen, et autres
Publié: (2026)
par: Tan, Shanwen, et autres
Publié: (2026)
DreamWorld: Unified World Modeling in Video Generation
par: Tan, Boming, et autres
Publié: (2026)
par: Tan, Boming, et autres
Publié: (2026)
ProS: Prompting-to-simulate Generalized knowledge for Universal Cross-Domain Retrieval
par: Fang, Kaipeng, et autres
Publié: (2023)
par: Fang, Kaipeng, et autres
Publié: (2023)
Image-to-Image Translation Framework Embedded with Rotation Symmetry Priors
par: Tan, Feiyu, et autres
Publié: (2026)
par: Tan, Feiyu, et autres
Publié: (2026)
Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing
par: Yang, Yitong, et autres
Publié: (2024)
par: Yang, Yitong, et autres
Publié: (2024)
Evolution-based Region Adversarial Prompt Learning for Robustness Enhancement in Vision-Language Models
par: Jia, Xiaojun, et autres
Publié: (2025)
par: Jia, Xiaojun, et autres
Publié: (2025)
WeakMedSAM: Weakly-Supervised Medical Image Segmentation via SAM with Sub-Class Exploration and Prompt Affinity Mining
par: Wang, Haoran, et autres
Publié: (2025)
par: Wang, Haoran, et autres
Publié: (2025)
Prompt to Restore, Restore to Prompt: Cyclic Prompting for Universal Adverse Weather Removal
par: Liao, Rongxin, et autres
Publié: (2025)
par: Liao, Rongxin, et autres
Publié: (2025)
Dolphin-v2: Universal Document Parsing via Scalable Anchor Prompting
par: Feng, Hao, et autres
Publié: (2026)
par: Feng, Hao, et autres
Publié: (2026)
Granular Computing-driven SAM: From Coarse-to-Fine Guidance for Prompt-Free Segmentation
par: Yu, Qiyang, et autres
Publié: (2025)
par: Yu, Qiyang, et autres
Publié: (2025)
Training-Free Video Editing via Optical Flow-Enhanced Score Distillation
par: Zhu, Lianghan, et autres
Publié: (2024)
par: Zhu, Lianghan, et autres
Publié: (2024)
ProSAM: Enhancing the Robustness of SAM-based Visual Reference Segmentation with Probabilistic Prompts
par: Wang, Xiaoqi, et autres
Publié: (2025)
par: Wang, Xiaoqi, et autres
Publié: (2025)
Neural Implicit Representation for Highly Dynamic LiDAR Mapping and Odometry
par: Zhang, Qi, et autres
Publié: (2024)
par: Zhang, Qi, et autres
Publié: (2024)
DiffStega: Towards Universal Training-Free Coverless Image Steganography with Diffusion Models
par: Yang, Yiwei, et autres
Publié: (2024)
par: Yang, Yiwei, et autres
Publié: (2024)
Anatomy-Guided Radiology Report Generation with Pathology-Aware Regional Prompts
par: Gao, Yijian, et autres
Publié: (2024)
par: Gao, Yijian, et autres
Publié: (2024)
Prototype-Based Image Prompting for Weakly Supervised Histopathological Image Segmentation
par: Tang, Qingchen, et autres
Publié: (2025)
par: Tang, Qingchen, et autres
Publié: (2025)
Hard Region Aware Network for Remote Sensing Change Detection
par: Li, Zhenglai, et autres
Publié: (2023)
par: Li, Zhenglai, et autres
Publié: (2023)
3D Aware Region Prompted Vision Language Model
par: Cheng, An-Chieh, et autres
Publié: (2025)
par: Cheng, An-Chieh, et autres
Publié: (2025)
Wave-Mamba: Wavelet State Space Model for Ultra-High-Definition Low-Light Image Enhancement
par: Zou, Wenbin, et autres
Publié: (2024)
par: Zou, Wenbin, et autres
Publié: (2024)
FreeKD: Knowledge Distillation via Semantic Frequency Prompt
par: Zhang, Yuan, et autres
Publié: (2023)
par: Zhang, Yuan, et autres
Publié: (2023)
Pathwise Test-Time Correction for Autoregressive Long Video Generation
par: Xiang, Xunzhi, et autres
Publié: (2026)
par: Xiang, Xunzhi, et autres
Publié: (2026)
Enhancing Infrared Vision: Progressive Prompt Fusion Network and Benchmark
par: Liu, Jinyuan, et autres
Publié: (2025)
par: Liu, Jinyuan, et autres
Publié: (2025)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
par: Gao, Jiayi, et autres
Publié: (2025)
par: Gao, Jiayi, et autres
Publié: (2025)
Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts
par: Ma, Yue, et autres
Publié: (2024)
par: Ma, Yue, et autres
Publié: (2024)
PPLLaVA: Varied Video Sequence Understanding With Prompt Guidance
par: Sun, Shangkun, et autres
Publié: (2024)
par: Sun, Shangkun, et autres
Publié: (2024)
Tunable Hybrid Proposal Networks for the Open World
par: Inkawhich, Matthew, et autres
Publié: (2022)
par: Inkawhich, Matthew, et autres
Publié: (2022)
Documents similaires
-
Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning
par: Chen, Jiahua, et autres
Publié: (2026) -
Exploring Conditional Multi-Modal Prompts for Zero-shot HOI Detection
par: Lei, Ting, et autres
Publié: (2024) -
Annotation-Free Visual Reasoning for High-Resolution Large Multimodal Models via Reinforcement Learning
par: Yang, Jiacheng, et autres
Publié: (2026) -
A Proposal-Free Query-Guided Network for Grounded Multimodal Named Entity Recognition
par: Li, Hongbing, et autres
Publié: (2026) -
Selective, Regularized, and Calibrated: Harnessing Vision Foundation Models for Cross-Domain Few-Shot Semantic Segmentation
par: Ma, Junyuan, et autres
Publié: (2026)