Guardado en:
| Autores principales: | Deng, Jieren, Zhang, Haojian, Ding, Kun, Hu, Jianhua, Zhang, Xingxuan, Wang, Yunkuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2403.01680 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Compositional Kronecker Context Optimization for Vision-Language Models
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Smooth and Stepwise Self-Distillation for Object Detection
por: Deng, Jieren, et al.
Publicado: (2023)
por: Deng, Jieren, et al.
Publicado: (2023)
Towards Zero-shot Human-Object Interaction Detection via Vision-Language Integration
por: Xue, Weiying, et al.
Publicado: (2024)
por: Xue, Weiying, et al.
Publicado: (2024)
Generalizable Semantic Vision Query Generation for Zero-shot Panoptic and Semantic Segmentation
por: Chen, Jialei, et al.
Publicado: (2024)
por: Chen, Jialei, et al.
Publicado: (2024)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
por: Ding, Kun, et al.
Publicado: (2022)
por: Ding, Kun, et al.
Publicado: (2022)
RATE-Nav: Region-Aware Termination Enhancement for Zero-shot Object Navigation with Vision-Language Models
por: Li, Junjie, et al.
Publicado: (2025)
por: Li, Junjie, et al.
Publicado: (2025)
Learning Causal Features for Incremental Object Detection
por: He, Zhenwei, et al.
Publicado: (2024)
por: He, Zhenwei, et al.
Publicado: (2024)
A Survey of Low-shot Vision-Language Model Adaptation via Representer Theorem
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Gate-and-Merge: Zero-shot Compositional Personalization of Vision Language Models
por: Ding, Guodong, et al.
Publicado: (2026)
por: Ding, Guodong, et al.
Publicado: (2026)
Chain of Visual Perception: Harnessing Multimodal Large Language Models for Zero-shot Camouflaged Object Detection
por: Tang, Lv, et al.
Publicado: (2023)
por: Tang, Lv, et al.
Publicado: (2023)
ZING-3D: Zero-shot Incremental 3D Scene Graphs via Vision-Language Models
por: Saxena, Pranav, et al.
Publicado: (2025)
por: Saxena, Pranav, et al.
Publicado: (2025)
VisTa: Visual-contextual and Text-augmented Zero-shot Object-level OOD Detection
por: Zhang, Bin, et al.
Publicado: (2025)
por: Zhang, Bin, et al.
Publicado: (2025)
AnomalyCLIP: Object-agnostic Prompt Learning for Zero-shot Anomaly Detection
por: Zhou, Qihang, et al.
Publicado: (2023)
por: Zhou, Qihang, et al.
Publicado: (2023)
Task-Specific Zero-shot Quantization-Aware Training for Object Detection
por: Li, Changhao, et al.
Publicado: (2025)
por: Li, Changhao, et al.
Publicado: (2025)
Incremental Object Detection with CLIP
por: Huang, Ziyue, et al.
Publicado: (2023)
por: Huang, Ziyue, et al.
Publicado: (2023)
Zero-shot Object Counting with Good Exemplars
por: Zhu, Huilin, et al.
Publicado: (2024)
por: Zhu, Huilin, et al.
Publicado: (2024)
CASA: Class-Agnostic Shared Attributes in Vision-Language Models for Efficient Incremental Object Detection
por: Guo, Mingyi, et al.
Publicado: (2024)
por: Guo, Mingyi, et al.
Publicado: (2024)
Generalizable Prompt Tuning for Vision-Language Models
por: Zhang, Qian
Publicado: (2024)
por: Zhang, Qian
Publicado: (2024)
ArtiBench and ArtiBrain: Benchmarking Generalizable Vision-Language Articulated Object Manipulation
por: Wu, Yuhan, et al.
Publicado: (2025)
por: Wu, Yuhan, et al.
Publicado: (2025)
Exploring Fine-grained Retail Product Discrimination with Zero-shot Object Classification Using Vision-Language Models
por: Tur, Anil Osman, et al.
Publicado: (2024)
por: Tur, Anil Osman, et al.
Publicado: (2024)
GS-CLIP: Zero-shot 3D Anomaly Detection by Geometry-Aware Prompt and Synergistic View Representation Learning
por: Deng, Zehao, et al.
Publicado: (2026)
por: Deng, Zehao, et al.
Publicado: (2026)
ZeroComp: Zero-shot Object Compositing from Image Intrinsics via Diffusion
por: Zhang, Zitian, et al.
Publicado: (2024)
por: Zhang, Zitian, et al.
Publicado: (2024)
GlocalCLIP: Object-agnostic Global-Local Prompt Learning for Zero-shot Anomaly Detection
por: Ham, Jiyul, et al.
Publicado: (2024)
por: Ham, Jiyul, et al.
Publicado: (2024)
Zero-shot Action Localization via the Confidence of Large Vision-Language Models
por: Aklilu, Josiah, et al.
Publicado: (2024)
por: Aklilu, Josiah, et al.
Publicado: (2024)
CLIP-AD: A Language-Guided Staged Dual-Path Model for Zero-shot Anomaly Detection
por: Chen, Xuhai, et al.
Publicado: (2023)
por: Chen, Xuhai, et al.
Publicado: (2023)
Language-Inspired Relation Transfer for Few-shot Class-Incremental Learning
por: Zhao, Yifan, et al.
Publicado: (2025)
por: Zhao, Yifan, et al.
Publicado: (2025)
InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing
por: Zhang, Jinlu, et al.
Publicado: (2025)
por: Zhang, Jinlu, et al.
Publicado: (2025)
Agent3D-Zero: An Agent for Zero-shot 3D Understanding
por: Zhang, Sha, et al.
Publicado: (2024)
por: Zhang, Sha, et al.
Publicado: (2024)
Parameterized Prompt for Incremental Object Detection
por: An, Zijia, et al.
Publicado: (2025)
por: An, Zijia, et al.
Publicado: (2025)
BackdoorIDS: Zero-shot Backdoor Detection for Pretrained Vision Encoder
por: Huang, Siquan, et al.
Publicado: (2026)
por: Huang, Siquan, et al.
Publicado: (2026)
Generalizable Two-Branch Framework for Image Class-Incremental Learning
por: Wu, Chao, et al.
Publicado: (2024)
por: Wu, Chao, et al.
Publicado: (2024)
Dynamic Object Queries for Transformer-based Incremental Object Detection
por: Zhang, Jichuan, et al.
Publicado: (2024)
por: Zhang, Jichuan, et al.
Publicado: (2024)
MAKE: Multi-Aspect Knowledge-Enhanced Vision-Language Pretraining for Zero-shot Dermatological Assessment
por: Yan, Siyuan, et al.
Publicado: (2025)
por: Yan, Siyuan, et al.
Publicado: (2025)
VoroNav: Voronoi-based Zero-shot Object Navigation with Large Language Model
por: Wu, Pengying, et al.
Publicado: (2024)
por: Wu, Pengying, et al.
Publicado: (2024)
YOLO-IOD: Towards Real Time Incremental Object Detection
por: Zhang, Shizhou, et al.
Publicado: (2025)
por: Zhang, Shizhou, et al.
Publicado: (2025)
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
DCA: Dividing and Conquering Amnesia in Incremental Object Detection
por: Zhang, Aoting, et al.
Publicado: (2025)
por: Zhang, Aoting, et al.
Publicado: (2025)
GRSDet: Learning to Generate Local Reverse Samples for Few-shot Object Detection
por: Mei, Hefei, et al.
Publicado: (2023)
por: Mei, Hefei, et al.
Publicado: (2023)
Ejemplares similares
-
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
por: Ding, Kun, et al.
Publicado: (2024) -
Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
por: Ding, Kun, et al.
Publicado: (2024) -
Compositional Kronecker Context Optimization for Vision-Language Models
por: Ding, Kun, et al.
Publicado: (2024) -
Smooth and Stepwise Self-Distillation for Object Detection
por: Deng, Jieren, et al.
Publicado: (2023) -
Towards Zero-shot Human-Object Interaction Detection via Vision-Language Integration
por: Xue, Weiying, et al.
Publicado: (2024)