Bayesian Test-time Adaptation for Object Recognition and Detection with Vision-language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Lihua, Ye, Mao, Li, Shuaifeng, Li, Nianxin, Wu, Jinlin, Zhu, Xiatian, Deng, Lei, Liu, Hongbin, Luo, Jiebo, Lei, Zhen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Bayesian Test-Time Adaptation for Vision-Language Models
by: Zhou, Lihua, et al.
Published: (2025)
by: Zhou, Lihua, et al.
Published: (2025)
Reward-Guided Semantic Evolution for Test-time Adaptive Object Detection
by: Zhou, Lihua, et al.
Published: (2026)
by: Zhou, Lihua, et al.
Published: (2026)
Text-Driven Causal Representation Learning for Source-Free Domain Generalization
by: Zhou, Lihua, et al.
Published: (2025)
by: Zhou, Lihua, et al.
Published: (2025)
Multimodal Causal-Driven Representation Learning for Generalizable Medical Image Segmentation
by: Liang, Xusheng, et al.
Published: (2025)
by: Liang, Xusheng, et al.
Published: (2025)
FACTOR: Counterfactual Training-Free Test-Time Adaptation for Open-Vocabulary Object Detection
by: Zhao, Kaixiang, et al.
Published: (2026)
by: Zhao, Kaixiang, et al.
Published: (2026)
Fully Test-Time Adaptation for Monocular 3D Object Detection
by: Lin, Hongbin, et al.
Published: (2024)
by: Lin, Hongbin, et al.
Published: (2024)
SurgLLM: A Versatile Large Multimodal Model with Spatial Focus and Temporal Awareness for Surgical Video Understanding
by: Chen, Zhen, et al.
Published: (2025)
by: Chen, Zhen, et al.
Published: (2025)
Bayesian Detector Combination for Object Detection with Crowdsourced Annotations
by: Tan, Zhi Qin, et al.
Published: (2024)
by: Tan, Zhi Qin, et al.
Published: (2024)
Source-Free Domain Adaptation with Vision-Language Prior
by: Tang, Song, et al.
Published: (2026)
by: Tang, Song, et al.
Published: (2026)
Source-Free Domain Adaptation with Frozen Multimodal Foundation Model
by: Tang, Song, et al.
Published: (2023)
by: Tang, Song, et al.
Published: (2023)
NeuroABench: A Multimodal Evaluation Benchmark for Neurosurgical Anatomy Identification
by: Song, Ziyang, et al.
Published: (2025)
by: Song, Ziyang, et al.
Published: (2025)
Anatomy-R1: Enhancing Anatomy Reasoning in Multimodal Large Language Models via Anatomical Similarity Curriculum and Group Diversity Augmentation
by: Song, Ziyang, et al.
Published: (2025)
by: Song, Ziyang, et al.
Published: (2025)
Source-Free Domain Adaptive Object Detection with Semantics Compensation
by: Tang, Song, et al.
Published: (2024)
by: Tang, Song, et al.
Published: (2024)
Unified Source-Free Domain Adaptation
by: Tang, Song, et al.
Published: (2024)
by: Tang, Song, et al.
Published: (2024)
Training all-mechanical neural networks for task learning through in situ backpropagation
by: Li, Shuaifeng, et al.
Published: (2024)
by: Li, Shuaifeng, et al.
Published: (2024)
Topological mechanical neural networks as classifiers through in situ backpropagation learning
by: Li, Shuaifeng, et al.
Published: (2025)
by: Li, Shuaifeng, et al.
Published: (2025)
PCaM: A Progressive Focus Attention-Based Information Fusion Method for Improving Vision Transformer Domain Adaptation
by: Zang, Zelin, et al.
Published: (2025)
by: Zang, Zelin, et al.
Published: (2025)
Transforming Surgical Interventions with Embodied Intelligence for Ultrasound Robotics
by: Xu, Huan, et al.
Published: (2024)
by: Xu, Huan, et al.
Published: (2024)
Enhancing Surgical Robots with Embodied Intelligence for Autonomous Ultrasound Scanning
by: Xu, Huan, et al.
Published: (2024)
by: Xu, Huan, et al.
Published: (2024)
Universal Domain Adaptive Object Detection via Dual Probabilistic Alignment
by: Zheng, Yuanfan, et al.
Published: (2024)
by: Zheng, Yuanfan, et al.
Published: (2024)
Proxy Denoising for Source-Free Domain Adaptation
by: Tang, Song, et al.
Published: (2024)
by: Tang, Song, et al.
Published: (2024)
Towards Realistic Hand-Object Interaction with Gravity-Field Based Diffusion Bridge
by: Xu, Miao, et al.
Published: (2025)
by: Xu, Miao, et al.
Published: (2025)
Weakly Supervised Object Detection for Automatic Tooth-marked Tongue Recognition
by: Zhang, Yongcun, et al.
Published: (2024)
by: Zhang, Yongcun, et al.
Published: (2024)
SurgPLAN++: Universal Surgical Phase Localization Network for Online and Offline Inference
by: Chen, Zhen, et al.
Published: (2024)
by: Chen, Zhen, et al.
Published: (2024)
Robust Low-Light Human Pose Estimation through Illumination-Texture Modulation
by: Zhang, Feng, et al.
Published: (2025)
by: Zhang, Feng, et al.
Published: (2025)
UniDA3D: A Unified Domain-Adaptive Framework for Multi-View 3D Object Detection
by: Wu, Hongjing, et al.
Published: (2026)
by: Wu, Hongjing, et al.
Published: (2026)
In-context Prompt Learning for Test-time Vision Recognition with Frozen Vision-language Model
by: Yin, Junhui, et al.
Published: (2024)
by: Yin, Junhui, et al.
Published: (2024)
LMAD: Integrated End-to-End Vision-Language Model for Explainable Autonomous Driving
by: Song, Nan, et al.
Published: (2025)
by: Song, Nan, et al.
Published: (2025)
SurgTrack: CAD-Free 3D Tracking of Real-world Surgical Instruments
by: Guo, Wenwu, et al.
Published: (2024)
by: Guo, Wenwu, et al.
Published: (2024)
Weakly Supervised YOLO Network for Surgical Instrument Localization in Endoscopic Videos
by: Wei, Rongfeng, et al.
Published: (2023)
by: Wei, Rongfeng, et al.
Published: (2023)
Inference for Synthetic Controls via Refined Placebo Tests
by: Lei, Lihua, et al.
Published: (2024)
by: Lei, Lihua, et al.
Published: (2024)
DPO: Dual-Perturbation Optimization for Test-time Adaptation in 3D Object Detection
by: Chen, Zhuoxiao, et al.
Published: (2024)
by: Chen, Zhuoxiao, et al.
Published: (2024)
VS-Assistant: Versatile Surgery Assistant on the Demand of Surgeons
by: Chen, Zhen, et al.
Published: (2024)
by: Chen, Zhen, et al.
Published: (2024)
FreqTrack: Frequency Learning based Vision Transformer for RGB-Event Object Tracking
by: You, Jinlin, et al.
Published: (2026)
by: You, Jinlin, et al.
Published: (2026)
The Docking Game: Loop Self-Play for Fast, Dynamic, and Accurate Prediction of Flexible Protein-Ligand Binding
by: Zhang, Youzhi, et al.
Published: (2025)
by: Zhang, Youzhi, et al.
Published: (2025)
Test-time Vocabulary Adaptation for Language-driven Object Detection
by: Liu, Mingxuan, et al.
Published: (2025)
by: Liu, Mingxuan, et al.
Published: (2025)
DriveFlow: Rectified Flow Adaptation for Robust 3D Object Detection in Autonomous Driving
by: Lin, Hongbin, et al.
Published: (2025)
by: Lin, Hongbin, et al.
Published: (2025)
RCTrans: Radar-Camera Transformer via Radar Densifier and Sequential Decoder for 3D Object Detection
by: Li, Yiheng, et al.
Published: (2024)
by: Li, Yiheng, et al.
Published: (2024)
scHelix: Asymmetric Dual-Stream Integration via Explicit Gene-Level Disentanglement
by: Yan, Xichen, et al.
Published: (2026)
by: Yan, Xichen, et al.
Published: (2026)
Assessing Color Vision Test in Large Vision-language Models
by: Ye, Hongfei, et al.
Published: (2025)
by: Ye, Hongfei, et al.
Published: (2025)
Similar Items
-
Bayesian Test-Time Adaptation for Vision-Language Models
by: Zhou, Lihua, et al.
Published: (2025) -
Reward-Guided Semantic Evolution for Test-time Adaptive Object Detection
by: Zhou, Lihua, et al.
Published: (2026) -
Text-Driven Causal Representation Learning for Source-Free Domain Generalization
by: Zhou, Lihua, et al.
Published: (2025) -
Multimodal Causal-Driven Representation Learning for Generalizable Medical Image Segmentation
by: Liang, Xusheng, et al.
Published: (2025) -
FACTOR: Counterfactual Training-Free Test-Time Adaptation for Open-Vocabulary Object Detection
by: Zhao, Kaixiang, et al.
Published: (2026)