Tokenize Anything via Prompting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Ting, Tang, Lulu, Wang, Xinlong, Shan, Shiguang |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Anonymization Prompt Learning for Facial Privacy-Preserving Text-to-Image Generation
par: Shi, Liang, et autres
Publié: (2024)
par: Shi, Liang, et autres
Publié: (2024)
Autoregressive Video Generation without Vector Quantization
par: Deng, Haoge, et autres
Publié: (2024)
par: Deng, Haoge, et autres
Publié: (2024)
LINA: Linear Autoregressive Image Generative Models with Continuous Tokens
par: Wang, Jiahao, et autres
Publié: (2026)
par: Wang, Jiahao, et autres
Publié: (2026)
Segment Anything for Videos: A Systematic Survey
par: Zhang, Chunhui, et autres
Publié: (2024)
par: Zhang, Chunhui, et autres
Publié: (2024)
Generalized Face Liveness Detection via De-fake Face Generator
par: Long, Xingming, et autres
Publié: (2024)
par: Long, Xingming, et autres
Publié: (2024)
Contrastive Learning of Person-independent Representations for Facial Action Unit Detection
par: Li, Yong, et autres
Publié: (2024)
par: Li, Yong, et autres
Publié: (2024)
Uniform Discrete Diffusion with Metric Path for Video Generation
par: Deng, Haoge, et autres
Publié: (2025)
par: Deng, Haoge, et autres
Publié: (2025)
Register Anything: Estimating "Corresponding Prompts" for Segment Anything Model
par: Huang, Shiqi, et autres
Publié: (2025)
par: Huang, Shiqi, et autres
Publié: (2025)
Matcher: Segment Anything with One Shot Using All-Purpose Feature Matching
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Learning to Prompt Segment Anything Models
par: Huang, Jiaxing, et autres
Publié: (2024)
par: Huang, Jiaxing, et autres
Publié: (2024)
Leveraging Segment Anything Model for Source-Free Domain Adaptation via Dual Feature Guided Auto-Prompting
par: Huai, Zheang, et autres
Publié: (2025)
par: Huai, Zheang, et autres
Publié: (2025)
Towards Robust Semantic Segmentation against Patch-based Attack via Attention Refinement
par: Yuan, Zheng, et autres
Publié: (2024)
par: Yuan, Zheng, et autres
Publié: (2024)
EntropyScan: Towards Model-level Backdoor Detection in LVLMs via Visual Attention Entropy
par: Ge, Xuanyu, et autres
Publié: (2026)
par: Ge, Xuanyu, et autres
Publié: (2026)
Confidence Aware Learning for Reliable Face Anti-spoofing
par: Long, Xingming, et autres
Publié: (2024)
par: Long, Xingming, et autres
Publié: (2024)
MotionVerse: A Unified Multimodal Framework for Motion Comprehension, Generation and Editing
par: Hou, Ruibing, et autres
Publié: (2025)
par: Hou, Ruibing, et autres
Publié: (2025)
3D Segment Anything Model with Visual Mamba for Diagnosing Placenta Accreta Spectrum
par: Zhang, Yuliang, et autres
Publié: (2026)
par: Zhang, Yuliang, et autres
Publié: (2026)
Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting
par: Tang, Yunlong, et autres
Publié: (2025)
par: Tang, Yunlong, et autres
Publié: (2025)
OSI: One-step Inversion Excels in Extracting Diffusion Watermarks
par: Chen, Yuwei, et autres
Publié: (2026)
par: Chen, Yuwei, et autres
Publié: (2026)
Segment Anything in Light Fields for Real-Time Applications via Constrained Prompting
par: Goncharov, Nikolai, et autres
Publié: (2024)
par: Goncharov, Nikolai, et autres
Publié: (2024)
GLip: A Global-Local Integrated Progressive Framework for Robust Visual Speech Recognition
par: Wang, Tianyue, et autres
Publié: (2025)
par: Wang, Tianyue, et autres
Publié: (2025)
Dynamic Attention Analysis for Backdoor Detection in Text-to-Image Diffusion Models
par: Wang, Zhongqi, et autres
Publié: (2025)
par: Wang, Zhongqi, et autres
Publié: (2025)
T2IShield: Defending Against Backdoors on Text-to-Image Diffusion Models
par: Wang, Zhongqi, et autres
Publié: (2024)
par: Wang, Zhongqi, et autres
Publié: (2024)
Assimilation Matters: Model-level Backdoor Detection in Vision-Language Pretrained Models
par: Wang, Zhongqi, et autres
Publié: (2025)
par: Wang, Zhongqi, et autres
Publié: (2025)
Pre-trained Model Guided Fine-Tuning for Zero-Shot Adversarial Robustness
par: Wang, Sibo, et autres
Publié: (2024)
par: Wang, Sibo, et autres
Publié: (2024)
ACT Now: Preempting LVLM Hallucinations via Adaptive Context Integration
par: Yan, Bei, et autres
Publié: (2026)
par: Yan, Bei, et autres
Publié: (2026)
SAMIC: Segment Anything with In-Context Spatial Prompt Engineering
par: Nagendra, Savinay, et autres
Publié: (2024)
par: Nagendra, Savinay, et autres
Publié: (2024)
Benchmarking Human and Automated Prompting in the Segment Anything Model
par: Quesada, Jorge, et autres
Publié: (2024)
par: Quesada, Jorge, et autres
Publié: (2024)
Neural Gate: Mitigating Privacy Risks in LVLMs via Neuron-Level Gradient Gating
par: Cao, Xiangkui, et autres
Publié: (2026)
par: Cao, Xiangkui, et autres
Publié: (2026)
You See it, You Got it: Learning 3D Creation on Pose-Free Videos at Scale
par: Ma, Baorui, et autres
Publié: (2024)
par: Ma, Baorui, et autres
Publié: (2024)
UDD: Dataset Distillation via Mining Underutilized Regions
par: Wang, Shiguang, et autres
Publié: (2024)
par: Wang, Shiguang, et autres
Publié: (2024)
EP-SAM: Weakly Supervised Histopathology Segmentation via Enhanced Prompt with Segment Anything
par: Song, Joonhyeon, et autres
Publié: (2024)
par: Song, Joonhyeon, et autres
Publié: (2024)
SAM-REF: Introducing Image-Prompt Synergy during Interaction for Detail Enhancement in the Segment Anything Model
par: Yu, Chongkai, et autres
Publié: (2024)
par: Yu, Chongkai, et autres
Publié: (2024)
Segment and Caption Anything
par: Huang, Xiaoke, et autres
Publié: (2023)
par: Huang, Xiaoke, et autres
Publié: (2023)
Any to Full: Prompting Depth Anything for Depth Completion in One Stage
par: Zhou, Zhiyuan, et autres
Publié: (2026)
par: Zhou, Zhiyuan, et autres
Publié: (2026)
Teaching Tailored to Talent: Adverse Weather Restoration via Prompt Pool and Depth-Anything Constraint
par: Chen, Sixiang, et autres
Publié: (2024)
par: Chen, Sixiang, et autres
Publié: (2024)
Part-aware Prompted Segment Anything Model for Adaptive Segmentation
par: Zhao, Chenhui, et autres
Publié: (2024)
par: Zhao, Chenhui, et autres
Publié: (2024)
A Survey on Segment Anything Model (SAM): Vision Foundation Model Meets Prompt Engineering
par: Zhang, Chaoning, et autres
Publié: (2023)
par: Zhang, Chaoning, et autres
Publié: (2023)
CtrLoRA: An Extensible and Efficient Framework for Controllable Image Generation
par: Xu, Yifeng, et autres
Publié: (2024)
par: Xu, Yifeng, et autres
Publié: (2024)
Semantic or Covariate? A Study on the Intractable Case of Out-of-Distribution Detection
par: Long, Xingming, et autres
Publié: (2024)
par: Long, Xingming, et autres
Publié: (2024)
BIMM: Brain Inspired Masked Modeling for Video Representation Learning
par: Wan, Zhifan, et autres
Publié: (2024)
par: Wan, Zhifan, et autres
Publié: (2024)
Documents similaires
-
Anonymization Prompt Learning for Facial Privacy-Preserving Text-to-Image Generation
par: Shi, Liang, et autres
Publié: (2024) -
Autoregressive Video Generation without Vector Quantization
par: Deng, Haoge, et autres
Publié: (2024) -
LINA: Linear Autoregressive Image Generative Models with Continuous Tokens
par: Wang, Jiahao, et autres
Publié: (2026) -
Segment Anything for Videos: A Systematic Survey
par: Zhang, Chunhui, et autres
Publié: (2024) -
Generalized Face Liveness Detection via De-fake Face Generator
par: Long, Xingming, et autres
Publié: (2024)