Audio-Visual Continual Test-Time Adaptation without Forgetting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Maharana, Sarthak Kumar, Mehra, Akshay, Ramakrishna, Bhavya, Guo, Yunhui, Su, Guan-Ming |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
$\texttt{AVROBUSTBENCH}$: Benchmarking the Robustness of Audio-Visual Recognition Models at Test-Time
par: Maharana, Sarthak Kumar, et autres
Publié: (2025)
par: Maharana, Sarthak Kumar, et autres
Publié: (2025)
PALM: Pushing Adaptive Learning Rate Mechanisms for Continual Test-Time Adaptation
par: Maharana, Sarthak Kumar, et autres
Publié: (2024)
par: Maharana, Sarthak Kumar, et autres
Publié: (2024)
DHAuDS: A Dynamic and Heterogeneous Audio Benchmark for Test-Time Adaptation
par: Shao, Weichuang, et autres
Publié: (2025)
par: Shao, Weichuang, et autres
Publié: (2025)
Continual Audio-Visual Sound Separation
par: Pian, Weiguo, et autres
Publié: (2024)
par: Pian, Weiguo, et autres
Publié: (2024)
Acoustic-to-articulatory inversion for dysarthric speech: Are pre-trained self-supervised representations favorable?
par: Maharana, Sarthak Kumar, et autres
Publié: (2023)
par: Maharana, Sarthak Kumar, et autres
Publié: (2023)
Do Audio-Visual Segmentation Models Truly Segment Sounding Objects?
par: Li, Jia, et autres
Publié: (2025)
par: Li, Jia, et autres
Publié: (2025)
Semantic-Aware Confidence Calibration for Automated Audio Captioning
par: Dunker, Lucas, et autres
Publié: (2025)
par: Dunker, Lucas, et autres
Publié: (2025)
PACE: Pretrained Audio Continual Learning
par: Li, Chang, et autres
Publié: (2026)
par: Li, Chang, et autres
Publié: (2026)
An Investigation of Test-time Adaptation for Audio Classification under Background Noise
par: Shao, Weichuang, et autres
Publié: (2025)
par: Shao, Weichuang, et autres
Publié: (2025)
OT-VP: Optimal Transport-guided Visual Prompting for Test-Time Adaptation
par: Zhang, Yunbei, et autres
Publié: (2024)
par: Zhang, Yunbei, et autres
Publié: (2024)
Advancing Test-Time Adaptation in Wild Acoustic Test Settings
par: Liu, Hongfu, et autres
Publié: (2023)
par: Liu, Hongfu, et autres
Publié: (2023)
Exploring Audio Cues for Enhanced Test-Time Video Model Adaptation
par: Zeng, Runhao, et autres
Publié: (2025)
par: Zeng, Runhao, et autres
Publié: (2025)
Not Just Change the Labels, Learn the Features: Watermarking Deep Neural Networks with Multi-View Data
par: Li, Yuxuan, et autres
Publié: (2024)
par: Li, Yuxuan, et autres
Publié: (2024)
Test-Time Adaptation for Speech Emotion Recognition
par: Dong, Jiaheng, et autres
Publié: (2026)
par: Dong, Jiaheng, et autres
Publié: (2026)
DeCoR: Defy Knowledge Forgetting by Predicting Earlier Audio Codes
par: Jiang, Xilin, et autres
Publié: (2023)
par: Jiang, Xilin, et autres
Publié: (2023)
DPCore: Dynamic Prompt Coreset for Continual Test-Time Adaptation
par: Zhang, Yunbei, et autres
Publié: (2024)
par: Zhang, Yunbei, et autres
Publié: (2024)
Real-Time Voicemail Detection in Telephony Audio Using Temporal Speech Activity Features
par: Saurav, Kumar
Publié: (2026)
par: Saurav, Kumar
Publié: (2026)
Coherent Audio-Visual Editing via Conditional Audio Generation Following Video Edits
par: Ishii, Masato, et autres
Publié: (2025)
par: Ishii, Masato, et autres
Publié: (2025)
Audio-to-Image Bird Species Retrieval without Audio-Image Pairs via Text Distillation
par: Moummad, Ilyass, et autres
Publié: (2026)
par: Moummad, Ilyass, et autres
Publié: (2026)
Knowing When to Answer: Adaptive Confidence Refinement for Reliable Audio-Visual Question Answering
par: Tran, Dinh Phu, et autres
Publié: (2026)
par: Tran, Dinh Phu, et autres
Publié: (2026)
Boosting ASR Robustness via Test-Time Reinforcement Learning with Audio-Text Semantic Rewards
par: Fang, Linghan, et autres
Publié: (2026)
par: Fang, Linghan, et autres
Publié: (2026)
Time-Varying Audio Effect Modeling by End-to-End Adversarial Training
par: Bourdin, Yann, et autres
Publié: (2025)
par: Bourdin, Yann, et autres
Publié: (2025)
EmoHRNet: High-Resolution Neural Network Based Speech Emotion Recognition
par: Muppidi, Akshay, et autres
Publié: (2025)
par: Muppidi, Akshay, et autres
Publié: (2025)
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
par: Xiao, Yixuan, et autres
Publié: (2026)
par: Xiao, Yixuan, et autres
Publié: (2026)
ADNAC: Audio Denoiser using Neural Audio Codec
par: Jimon, Daniel, et autres
Publié: (2025)
par: Jimon, Daniel, et autres
Publié: (2025)
LipsAM: Lipschitz-Continuous Amplitude Modifier for Audio Signal Processing and its Application to Plug-and-Play Dereverberation
par: Matsumoto, Kazuki, et autres
Publié: (2026)
par: Matsumoto, Kazuki, et autres
Publié: (2026)
Echo: Towards Advanced Audio Comprehension via Audio-Interleaved Reasoning
par: Wu, Daiqing, et autres
Publié: (2026)
par: Wu, Daiqing, et autres
Publié: (2026)
SEE: Signal Embedding Energy for Quantifying Noise Interference in Large Audio Language Models
par: Zhang, Yuanhe, et autres
Publié: (2026)
par: Zhang, Yuanhe, et autres
Publié: (2026)
What Does an Audio Deepfake Detector Focus on? A Study in the Time Domain
par: Grinberg, Petr, et autres
Publié: (2025)
par: Grinberg, Petr, et autres
Publié: (2025)
E-BATS: Efficient Backpropagation-Free Test-Time Adaptation for Speech Foundation Models
par: Dong, Jiaheng, et autres
Publié: (2025)
par: Dong, Jiaheng, et autres
Publié: (2025)
Virtual Consistency for Audio Editing
par: Cervera, Matthieu, et autres
Publié: (2025)
par: Cervera, Matthieu, et autres
Publié: (2025)
Thinking While Listening: Simple Test Time Scaling For Audio Classification
par: Verma, Prateek, et autres
Publié: (2025)
par: Verma, Prateek, et autres
Publié: (2025)
Segmentwise Pruning in Audio-Language Models
par: Gibier, Marcel, et autres
Publié: (2025)
par: Gibier, Marcel, et autres
Publié: (2025)
Adapting Neural Audio Codecs to EEG
par: Kastrati, Ard, et autres
Publié: (2025)
par: Kastrati, Ard, et autres
Publié: (2025)
Examining Test-Time Adaptation for Personalized Child Speech Recognition
par: Shi, Zhonghao, et autres
Publié: (2024)
par: Shi, Zhonghao, et autres
Publié: (2024)
An Unsupervised Domain Adaptation Method for Locating Manipulated Region in partially fake Audio
par: Zeng, Siding, et autres
Publié: (2024)
par: Zeng, Siding, et autres
Publié: (2024)
APEX: Audio Prototype EXplanations for Classification Tasks
par: Kawa, Piotr, et autres
Publié: (2026)
par: Kawa, Piotr, et autres
Publié: (2026)
Investigating Modality Contribution in Audio LLMs for Music
par: Morais, Giovana, et autres
Publié: (2025)
par: Morais, Giovana, et autres
Publié: (2025)
Audio Super-Resolution with Latent Bridge Models
par: Li, Chang, et autres
Publié: (2025)
par: Li, Chang, et autres
Publié: (2025)
Training-Free Multimodal Guidance for Video to Audio Generation
par: Grassucci, Eleonora, et autres
Publié: (2025)
par: Grassucci, Eleonora, et autres
Publié: (2025)
Documents similaires
-
$\texttt{AVROBUSTBENCH}$: Benchmarking the Robustness of Audio-Visual Recognition Models at Test-Time
par: Maharana, Sarthak Kumar, et autres
Publié: (2025) -
PALM: Pushing Adaptive Learning Rate Mechanisms for Continual Test-Time Adaptation
par: Maharana, Sarthak Kumar, et autres
Publié: (2024) -
DHAuDS: A Dynamic and Heterogeneous Audio Benchmark for Test-Time Adaptation
par: Shao, Weichuang, et autres
Publié: (2025) -
Continual Audio-Visual Sound Separation
par: Pian, Weiguo, et autres
Publié: (2024) -
Acoustic-to-articulatory inversion for dysarthric speech: Are pre-trained self-supervised representations favorable?
par: Maharana, Sarthak Kumar, et autres
Publié: (2023)