Discover Your Neighbors: Advanced Stable Test-Time Adaptation in Dynamic World
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Qinting, Ye, Chuyang, Wei, Dongyan, Xue, Yuan, Jiang, Jingyan, Wang, Zhi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Feature-Based Instance Neighbor Discovery: Advanced Stable Test-Time Adaptation in Dynamic World
par: Jiang, Qinting, et autres
Publié: (2025)
par: Jiang, Qinting, et autres
Publié: (2025)
COSMIC: Clique-Oriented Semantic Multi-space Integration for Robust CLIP Test-Time Adaptation
par: Huang, Fanding, et autres
Publié: (2025)
par: Huang, Fanding, et autres
Publié: (2025)
Test-Time Distillation for Continual Model Adaptation
par: Chen, Xiao, et autres
Publié: (2025)
par: Chen, Xiao, et autres
Publié: (2025)
Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation
par: Zhang, Zhicheng, et autres
Publié: (2026)
par: Zhang, Zhicheng, et autres
Publié: (2026)
POINTS: Improving Your Vision-language Model with Affordable Strategies
par: Liu, Yuan, et autres
Publié: (2024)
par: Liu, Yuan, et autres
Publié: (2024)
MoETTA: Test-Time Adaptation Under Mixed Distribution Shifts with MoE-LayerNorm
par: Fan, Xiao, et autres
Publié: (2025)
par: Fan, Xiao, et autres
Publié: (2025)
Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models
par: Zhao, Shuai, et autres
Publié: (2023)
par: Zhao, Shuai, et autres
Publié: (2023)
Knowledge-enhanced Multi-perspective Video Representation Learning for Scene Recognition
par: Yu, Xuzheng, et autres
Publié: (2024)
par: Yu, Xuzheng, et autres
Publié: (2024)
Seeing World Dynamics in a Nutshell
par: Shen, Qiuhong, et autres
Publié: (2025)
par: Shen, Qiuhong, et autres
Publié: (2025)
Can I Trust Your Answer? Visually Grounded Video Question Answering
par: Xiao, Junbin, et autres
Publié: (2023)
par: Xiao, Junbin, et autres
Publié: (2023)
Learning Segment Similarity and Alignment in Large-Scale Content Based Video Retrieval
par: Jiang, Chen, et autres
Publié: (2023)
par: Jiang, Chen, et autres
Publié: (2023)
Fine-grained Image Retrieval via Dual-Vision Adaptation
par: Jiang, Xin, et autres
Publié: (2025)
par: Jiang, Xin, et autres
Publié: (2025)
Regularizing Subspace Redundancy of Low-Rank Adaptation
par: Zhu, Yue, et autres
Publié: (2025)
par: Zhu, Yue, et autres
Publié: (2025)
Interactive Video Generation via Domain Adaptation
par: Rawal, Ishaan, et autres
Publié: (2025)
par: Rawal, Ishaan, et autres
Publié: (2025)
DyRoNet: Dynamic Routing and Low-Rank Adapters for Autonomous Driving Streaming Perception
par: Huang, Xiang, et autres
Publié: (2024)
par: Huang, Xiang, et autres
Publié: (2024)
TimeSuite: Improving MLLMs for Long Video Understanding via Grounded Tuning
par: Zeng, Xiangyu, et autres
Publié: (2024)
par: Zeng, Xiangyu, et autres
Publié: (2024)
Exposure Completing for Temporally Consistent Neural High Dynamic Range Video Rendering
par: Cui, Jiahao, et autres
Publié: (2024)
par: Cui, Jiahao, et autres
Publié: (2024)
Layer-wise Model Merging for Unsupervised Domain Adaptation in Segmentation Tasks
par: Alcover-Couso, Roberto, et autres
Publié: (2024)
par: Alcover-Couso, Roberto, et autres
Publié: (2024)
Let Your Video Listen to Your Music!
par: Zhang, Xinyu, et autres
Publié: (2025)
par: Zhang, Xinyu, et autres
Publié: (2025)
MotionScape: A Large-Scale Real-World Highly Dynamic UAV Video Dataset for World Models
par: Guo, Zile, et autres
Publié: (2026)
par: Guo, Zile, et autres
Publié: (2026)
VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing
par: Gu, Jing, et autres
Publié: (2024)
par: Gu, Jing, et autres
Publié: (2024)
DVF: Advancing Robust and Accurate Fine-Grained Image Retrieval with Retrieval Guidelines
par: Jiang, Xin, et autres
Publié: (2024)
par: Jiang, Xin, et autres
Publié: (2024)
Advance Fake Video Detection via Vision Transformers
par: Battocchio, Joy, et autres
Publié: (2025)
par: Battocchio, Joy, et autres
Publié: (2025)
Q-Ponder: A Unified Training Pipeline for Reasoning-based Visual Quality Assessment
par: Cai, Zhuoxuan, et autres
Publié: (2025)
par: Cai, Zhuoxuan, et autres
Publié: (2025)
Unify-Agent: A Unified Multimodal Agent for World-Grounded Image Synthesis
par: Chen, Shuang, et autres
Publié: (2026)
par: Chen, Shuang, et autres
Publié: (2026)
Dynamic Resolution Guidance for Facial Expression Recognition
par: Wang, Songpan, et autres
Publié: (2024)
par: Wang, Songpan, et autres
Publié: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
Phi-Ground Tech Report: Advancing Perception in GUI Grounding
par: Zhang, Miaosen, et autres
Publié: (2025)
par: Zhang, Miaosen, et autres
Publié: (2025)
Gorgeous: Create Your Desired Character Facial Makeup from Any Ideas
par: Sii, Jia Wei, et autres
Publié: (2024)
par: Sii, Jia Wei, et autres
Publié: (2024)
SIDA: Synthetic Image Driven Zero-shot Domain Adaptation
par: Kim, Ye-Chan, et autres
Publié: (2025)
par: Kim, Ye-Chan, et autres
Publié: (2025)
Pre-Trained LLM is a Semantic-Aware and Generalizable Segmentation Booster
par: Tang, Fenghe, et autres
Publié: (2025)
par: Tang, Fenghe, et autres
Publié: (2025)
SOSControl: Enhancing Human Motion Generation through Saliency-Aware Symbolic Orientation and Timing Control
par: Au, Ho Yin, et autres
Publié: (2025)
par: Au, Ho Yin, et autres
Publié: (2025)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
par: Zhang, Jiaxu, et autres
Publié: (2025)
par: Zhang, Jiaxu, et autres
Publié: (2025)
When Synthetic Traces Hide Real Content: Analysis of Stable Diffusion Image Laundering
par: Mandelli, Sara, et autres
Publié: (2024)
par: Mandelli, Sara, et autres
Publié: (2024)
IVAC-P2L: Leveraging Irregular Repetition Priors for Improving Video Action Counting
par: Wang, Hang, et autres
Publié: (2024)
par: Wang, Hang, et autres
Publié: (2024)
Vlogger: Make Your Dream A Vlog
par: Zhuang, Shaobin, et autres
Publié: (2024)
par: Zhuang, Shaobin, et autres
Publié: (2024)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
par: Wang, Xue, et autres
Publié: (2026)
par: Wang, Xue, et autres
Publié: (2026)
From Satellite to Street: A Hybrid Framework Integrating Stable Diffusion and PanoGAN for Consistent Cross-View Synthesis
par: Bajbaa, Khawlah, et autres
Publié: (2025)
par: Bajbaa, Khawlah, et autres
Publié: (2025)
Tiny Inference-Time Scaling with Latent Verifiers
par: Bucciarelli, Davide, et autres
Publié: (2026)
par: Bucciarelli, Davide, et autres
Publié: (2026)
CLIP-PING: Boosting Lightweight Vision-Language Models with Proximus Intrinsic Neighbors Guidance
par: Thwal, Chu Myaet, et autres
Publié: (2024)
par: Thwal, Chu Myaet, et autres
Publié: (2024)
Documents similaires
-
Feature-Based Instance Neighbor Discovery: Advanced Stable Test-Time Adaptation in Dynamic World
par: Jiang, Qinting, et autres
Publié: (2025) -
COSMIC: Clique-Oriented Semantic Multi-space Integration for Robust CLIP Test-Time Adaptation
par: Huang, Fanding, et autres
Publié: (2025) -
Test-Time Distillation for Continual Model Adaptation
par: Chen, Xiao, et autres
Publié: (2025) -
Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation
par: Zhang, Zhicheng, et autres
Publié: (2026) -
POINTS: Improving Your Vision-language Model with Affordable Strategies
par: Liu, Yuan, et autres
Publié: (2024)