Incremental Object Detection with Prompt-based Methods
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Neuwirth-Trapp, Matthias, Bieshaar, Maarten, Paudel, Danda Pani, Van Gool, Luc |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RICO: Two Realistic Benchmarks and an In-Depth Analysis for Incremental Learning in Object Detection
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025)
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025)
MULTI: Disentangling Camera Lens, Sensor, View, and Domain for Novel Image Generation
par: Godavarthy, Sonali, et autres
Publié: (2026)
par: Godavarthy, Sonali, et autres
Publié: (2026)
EvenNICER-SLAM: Event-based Neural Implicit Encoding SLAM
par: Chen, Shi, et autres
Publié: (2024)
par: Chen, Shi, et autres
Publié: (2024)
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
par: Motamed, Saman, et autres
Publié: (2023)
par: Motamed, Saman, et autres
Publié: (2023)
Vision encoders should be image size agnostic and task driven
par: Prisadnikov, Nedyalko, et autres
Publié: (2025)
par: Prisadnikov, Nedyalko, et autres
Publié: (2025)
Implicit-Zoo: A Large-Scale Dataset of Neural Implicit Functions for 2D Images and 3D Scenes
par: Ma, Qi, et autres
Publié: (2024)
par: Ma, Qi, et autres
Publié: (2024)
Continuous Pose for Monocular Cameras in Neural Implicit Representation
par: Ma, Qi, et autres
Publié: (2023)
par: Ma, Qi, et autres
Publié: (2023)
From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation
par: Mahdi, Mohammad, et autres
Publié: (2026)
par: Mahdi, Mohammad, et autres
Publié: (2026)
Self-supervised pretraining for an iterative image size agnostic vision transformer
par: Prisadnikov, Nedyalko, et autres
Publié: (2026)
par: Prisadnikov, Nedyalko, et autres
Publié: (2026)
A Simple and Generalist Approach for Panoptic Segmentation
par: Prisadnikov, Nedyalko, et autres
Publié: (2024)
par: Prisadnikov, Nedyalko, et autres
Publié: (2024)
Inferring Compositional 4D Scenes without Ever Seeing One
par: Gokmen, Ahmet Berke, et autres
Publié: (2025)
par: Gokmen, Ahmet Berke, et autres
Publié: (2025)
Occam's LGS: An Efficient Approach for Language Gaussian Splatting
par: Cheng, Jiahuan, et autres
Publié: (2024)
par: Cheng, Jiahuan, et autres
Publié: (2024)
Taming CLIP for Fine-grained and Structured Visual Understanding of Museum Exhibits
par: Balauca, Ada-Astrid, et autres
Publié: (2024)
par: Balauca, Ada-Astrid, et autres
Publié: (2024)
SeasonScapes: Learning Large-scale Re-lightable 3D Landscapes with Seasonal Variation from Sparse Webcams
par: Kleger, Timo, et autres
Publié: (2026)
par: Kleger, Timo, et autres
Publié: (2026)
Ternary-Type Opacity and Hybrid Odometry for RGB NeRF-SLAM
par: Lin, Junru, et autres
Publié: (2023)
par: Lin, Junru, et autres
Publié: (2023)
Locate Anything on Earth: Advancing Open-Vocabulary Object Detection for Remote Sensing Community
par: Pan, Jiancheng, et autres
Publié: (2024)
par: Pan, Jiancheng, et autres
Publié: (2024)
Cross-View Multi-Modal Segmentation @ Ego-Exo4D Challenges 2025
par: Fu, Yuqian, et autres
Publié: (2025)
par: Fu, Yuqian, et autres
Publié: (2025)
ReVLA: Reverting Visual Domain Limitation of Robotic Foundation Models
par: Dey, Sombit, et autres
Publié: (2024)
par: Dey, Sombit, et autres
Publié: (2024)
Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation
par: Chen, Jialei, et autres
Publié: (2025)
par: Chen, Jialei, et autres
Publié: (2025)
Reducing Unimodal Bias in Multi-Modal Semantic Segmentation with Multi-Scale Functional Entropy Regularization
par: Zheng, Xu, et autres
Publié: (2025)
par: Zheng, Xu, et autres
Publié: (2025)
Exploration-Driven Generative Interactive Environments
par: Savov, Nedko, et autres
Publié: (2025)
par: Savov, Nedko, et autres
Publié: (2025)
BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation
par: Chen, Jialei, et autres
Publié: (2025)
par: Chen, Jialei, et autres
Publié: (2025)
Exo2EgoSyn: Unlocking Foundation Video Generation Models for Exocentric-to-Egocentric Video Synthesis
par: Mahdi, Mohammad, et autres
Publié: (2025)
par: Mahdi, Mohammad, et autres
Publié: (2025)
StateSpaceDiffuser: Bringing Long Context to Diffusion World Models
par: Savov, Nedko, et autres
Publié: (2025)
par: Savov, Nedko, et autres
Publié: (2025)
Rethinking Global Context in Crowd Counting
par: Sun, Guolei, et autres
Publié: (2021)
par: Sun, Guolei, et autres
Publié: (2021)
V$^{2}$-SAM: Marrying SAM2 with Multi-Prompt Experts for Cross-View Object Correspondence
par: Pan, Jiancheng, et autres
Publié: (2025)
par: Pan, Jiancheng, et autres
Publié: (2025)
FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle
par: Markov, Mario, et autres
Publié: (2025)
par: Markov, Mario, et autres
Publié: (2025)
B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation
par: Markov, Mario, et autres
Publié: (2026)
par: Markov, Mario, et autres
Publié: (2026)
Single-Model and Any-Modality for Video Object Tracking
par: Wu, Zongwei, et autres
Publié: (2023)
par: Wu, Zongwei, et autres
Publié: (2023)
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
par: Halacheva, Anna-Maria, et autres
Publié: (2025)
par: Halacheva, Anna-Maria, et autres
Publié: (2025)
From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding
par: Halacheva, Anna-Maria, et autres
Publié: (2025)
par: Halacheva, Anna-Maria, et autres
Publié: (2025)
OSMDA: OpenStreetMap-based Domain Adaptation for Remote Sensing VLMs
par: Ailuro, Stefan Maria, et autres
Publié: (2026)
par: Ailuro, Stefan Maria, et autres
Publié: (2026)
LangHOPS: Language Grounded Hierarchical Open-Vocabulary Part Segmentation
par: Miao, Yang, et autres
Publié: (2025)
par: Miao, Yang, et autres
Publié: (2025)
Event-Free Moving Object Segmentation from Moving Ego Vehicle
par: Zhou, Zhuyun, et autres
Publié: (2023)
par: Zhou, Zhuyun, et autres
Publié: (2023)
Learning Generative Interactive Environments By Trained Agent Exploration
par: Kazemi, Naser, et autres
Publié: (2024)
par: Kazemi, Naser, et autres
Publié: (2024)
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
par: Ma, Qi, et autres
Publié: (2025)
par: Ma, Qi, et autres
Publié: (2025)
ObjectRelator: Enabling Cross-View Object Relation Understanding Across Ego-Centric and Exo-Centric Perspectives
par: Fu, Yuqian, et autres
Publié: (2024)
par: Fu, Yuqian, et autres
Publié: (2024)
Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description
par: Halacheva, Anna-Maria, et autres
Publié: (2024)
par: Halacheva, Anna-Maria, et autres
Publié: (2024)
XTrack: Multimodal Training Boosts RGB-X Video Object Trackers
par: Tan, Yuedong, et autres
Publié: (2024)
par: Tan, Yuedong, et autres
Publié: (2024)
Domain-RAG: Retrieval-Guided Compositional Image Generation for Cross-Domain Few-Shot Object Detection
par: Li, Yu, et autres
Publié: (2025)
par: Li, Yu, et autres
Publié: (2025)
Documents similaires
-
RICO: Two Realistic Benchmarks and an In-Depth Analysis for Incremental Learning in Object Detection
par: Neuwirth-Trapp, Matthias, et autres
Publié: (2025) -
MULTI: Disentangling Camera Lens, Sensor, View, and Domain for Novel Image Generation
par: Godavarthy, Sonali, et autres
Publié: (2026) -
EvenNICER-SLAM: Event-based Neural Implicit Encoding SLAM
par: Chen, Shi, et autres
Publié: (2024) -
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
par: Motamed, Saman, et autres
Publié: (2023) -
Vision encoders should be image size agnostic and task driven
par: Prisadnikov, Nedyalko, et autres
Publié: (2025)