TALON: Test-time Adaptive Learning for On-the-Fly Category Discovery
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Yanan, Yan, Yuhan, Chen, Tailai, Chi, Zhixiang, Wu, ZiZhang, Jin, Yi, Wang, Yang, Li, Zhenbo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning through Creation: A Hash-Free Framework for On-the-Fly Category Discovery
par: Zhang, Bohan, et autres
Publié: (2026)
par: Zhang, Bohan, et autres
Publié: (2026)
PACO: Proxy-Task Alignment and Online Calibration for On-the-Fly Category Discovery
par: Tang, Weidong, et autres
Publié: (2026)
par: Tang, Weidong, et autres
Publié: (2026)
EV-CLIP: Efficient Visual Prompt Adaptation for CLIP in Few-shot Action Recognition under Visual Challenges
par: Jon, Hyo Jin, et autres
Publié: (2026)
par: Jon, Hyo Jin, et autres
Publié: (2026)
Gaussian-Constrained LeJEPA Representations for Unsupervised Scene Discovery and Pose Consistency
par: Mostafa, Mohsen
Publié: (2026)
par: Mostafa, Mohsen
Publié: (2026)
MotionFollower: Editing Video Motion via Lightweight Score-Guided Diffusion
par: Tu, Shuyuan, et autres
Publié: (2024)
par: Tu, Shuyuan, et autres
Publié: (2024)
Real-time Object and Event Detection Service through Computer Vision and Edge Computing
par: Mendes, Marcos, et autres
Publié: (2025)
par: Mendes, Marcos, et autres
Publié: (2025)
Large Language Models Powered Context-aware Motion Prediction in Autonomous Driving
par: Zheng, Xiaoji, et autres
Publié: (2024)
par: Zheng, Xiaoji, et autres
Publié: (2024)
PlaneSAM: Multimodal Plane Instance Segmentation Using the Segment Anything Model
par: Deng, Zhongchen, et autres
Publié: (2024)
par: Deng, Zhongchen, et autres
Publié: (2024)
Depth Priors in Removal Neural Radiance Fields
par: Guo, Zhihao, et autres
Publié: (2024)
par: Guo, Zhihao, et autres
Publié: (2024)
Motion Consistency Loss for Monocular Visual Odometry with Attention-Based Deep Learning
par: Françani, André O., et autres
Publié: (2024)
par: Françani, André O., et autres
Publié: (2024)
PAT-VCM: Plug-and-Play Auxiliary Tokens for Video Coding for Machines
par: Jiang, Wei, et autres
Publié: (2026)
par: Jiang, Wei, et autres
Publié: (2026)
Interactive Image Selection and Training for Brain Tumor Segmentation Network
par: Cerqueira, Matheus A., et autres
Publié: (2024)
par: Cerqueira, Matheus A., et autres
Publié: (2024)
MvBody: Multi-View-Based Hybrid Transformer Using Optical 3D Body Scan for Explainable Cesarean Section Prediction
par: Cheng, Ruting, et autres
Publié: (2025)
par: Cheng, Ruting, et autres
Publié: (2025)
Performance Decay in Deepfake Detection: The Limitations of Training on Outdated Data
par: Richings, Jack, et autres
Publié: (2025)
par: Richings, Jack, et autres
Publié: (2025)
When Less is Enough: Adaptive Token Reduction for Efficient Image Representation
par: Allakhverdov, Eduard, et autres
Publié: (2025)
par: Allakhverdov, Eduard, et autres
Publié: (2025)
RefineFormer3D: Efficient 3D Medical Image Segmentation via Adaptive Multi-Scale Transformer with Cross Attention Fusion
par: Tyagi, Kavyansh, et autres
Publié: (2026)
par: Tyagi, Kavyansh, et autres
Publié: (2026)
Sequence Transferability and Task Order Selection in Continual Learning
par: Nguyen, Thinh, et autres
Publié: (2025)
par: Nguyen, Thinh, et autres
Publié: (2025)
How Well Do Vision-Language Models Understand Sequential Driving Scenes? A Sensitivity Study
par: Brusnicki, Roberto, et autres
Publié: (2026)
par: Brusnicki, Roberto, et autres
Publié: (2026)
An Individual Identity-Driven Framework for Animal Re-Identification
par: Wu, Yihao, et autres
Publié: (2024)
par: Wu, Yihao, et autres
Publié: (2024)
Single-Scanline Relative Pose Estimation for Rolling Shutter Cameras
par: Hruby, Petr, et autres
Publié: (2025)
par: Hruby, Petr, et autres
Publié: (2025)
Efficient Solution of Point-Line Absolute Pose
par: Hruby, Petr, et autres
Publié: (2024)
par: Hruby, Petr, et autres
Publié: (2024)
Minimal Solvers for Full DoF Motion Estimation from Asynchronous Tracks
par: Hruby, Petr, et autres
Publié: (2025)
par: Hruby, Petr, et autres
Publié: (2025)
CylinderPlane: Nested Cylinder Representation for 3D-aware Image Generation
par: Jia, Ru, et autres
Publié: (2025)
par: Jia, Ru, et autres
Publié: (2025)
SealD-NeRF: Interactive Pixel-Level Editing for Dynamic Scenes by Neural Radiance Fields
par: Huang, Zhentao, et autres
Publié: (2024)
par: Huang, Zhentao, et autres
Publié: (2024)
An inpainting approach to manipulate asymmetry in pre-operative breast images
par: Montenegro, Helena, et autres
Publié: (2025)
par: Montenegro, Helena, et autres
Publié: (2025)
Less Detail, Better Answers: Degradation-Driven Prompting for VQA
par: Han, Haoxuan, et autres
Publié: (2026)
par: Han, Haoxuan, et autres
Publié: (2026)
QCFace: Image Quality Control for boosting Face Representation & Recognition
par: Doan-Ngo, Duc-Phuong, et autres
Publié: (2025)
par: Doan-Ngo, Duc-Phuong, et autres
Publié: (2025)
Not all Views are Created Equal: Analyzing Viewpoint Instabilities in Vision Foundation Models
par: Michalkiewicz, Mateusz, et autres
Publié: (2024)
par: Michalkiewicz, Mateusz, et autres
Publié: (2024)
Representation Paradigms in AI-based 3D Radiological Image Reconstruction: A Systematic Review
par: Yang, Yuezhe, et autres
Publié: (2025)
par: Yang, Yuezhe, et autres
Publié: (2025)
Bench2FreeAD: A Benchmark for Vision-based End-to-end Navigation in Unstructured Robotic Environments
par: Peng, Yuhang, et autres
Publié: (2025)
par: Peng, Yuhang, et autres
Publié: (2025)
Z-Order Transformer for Feed-Forward Gaussian Splatting
par: Wang, Can, et autres
Publié: (2026)
par: Wang, Can, et autres
Publié: (2026)
EatGAN: An Edge-Attention Guided Generative Adversarial Network for Single Image Super-Resolution
par: Rao, Penghao, et autres
Publié: (2025)
par: Rao, Penghao, et autres
Publié: (2025)
TWIG: Two-Step Image Generation using Segmentation Masks in Diffusion Models
par: Rakib, Mazharul Islam, et autres
Publié: (2025)
par: Rakib, Mazharul Islam, et autres
Publié: (2025)
Isolated Sign Language Recognition with Segmentation and Pose Estimation
par: Perkins, Daniel, et autres
Publié: (2025)
par: Perkins, Daniel, et autres
Publié: (2025)
Robust Perspective Correction for Real-World Crack Evolution Tracking in Image-Based Structural Health Monitoring
par: Sun, Xinxin, et autres
Publié: (2025)
par: Sun, Xinxin, et autres
Publié: (2025)
SurgVLM: A Large Vision-Language Model and Systematic Evaluation Benchmark for Surgical Intelligence
par: Zeng, Zhitao, et autres
Publié: (2025)
par: Zeng, Zhitao, et autres
Publié: (2025)
Towards Optimal Convolutional Transfer Learning Architectures for Breast Lesion Classification and ACL Tear Detection
par: Frees, Daniel, et autres
Publié: (2025)
par: Frees, Daniel, et autres
Publié: (2025)
SPARF: Large-Scale Learning of 3D Sparse Radiance Fields from Few Input Images
par: Hamdi, Abdullah, et autres
Publié: (2022)
par: Hamdi, Abdullah, et autres
Publié: (2022)
OpenFusion++: An Open-vocabulary Real-time Scene Understanding System
par: Jin, Xiaofeng, et autres
Publié: (2025)
par: Jin, Xiaofeng, et autres
Publié: (2025)
ResPlan: A Large-Scale Vector-Graph Dataset of 17,000 Residential Floor Plans
par: Abouagour, Mohamed, et autres
Publié: (2025)
par: Abouagour, Mohamed, et autres
Publié: (2025)
Documents similaires
-
Learning through Creation: A Hash-Free Framework for On-the-Fly Category Discovery
par: Zhang, Bohan, et autres
Publié: (2026) -
PACO: Proxy-Task Alignment and Online Calibration for On-the-Fly Category Discovery
par: Tang, Weidong, et autres
Publié: (2026) -
EV-CLIP: Efficient Visual Prompt Adaptation for CLIP in Few-shot Action Recognition under Visual Challenges
par: Jon, Hyo Jin, et autres
Publié: (2026) -
Gaussian-Constrained LeJEPA Representations for Unsupervised Scene Discovery and Pose Consistency
par: Mostafa, Mohsen
Publié: (2026) -
MotionFollower: Editing Video Motion via Lightweight Score-Guided Diffusion
par: Tu, Shuyuan, et autres
Publié: (2024)