Role of the Pretraining and the Adaptation data sizes for low-resource real-time MRI video segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Tholan, Masoud Thajudeen, Hegde, Vinayaka, Sharma, Chetan, Ghosh, Prasanta Kumar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bottleneck Transformer-Based Approach for Improved Automatic STOI Score Prediction
di: Amartyaveer, et al.
Pubblicazione: (2026)
di: Amartyaveer, et al.
Pubblicazione: (2026)
A Generalized Weighted Overlap-Add (WOLA) Filter Bank for Improved Subband System Identification
di: Sharma, Mohit, et al.
Pubblicazione: (2025)
di: Sharma, Mohit, et al.
Pubblicazione: (2025)
Modeling and Link Budget Feasibility Analysis of Secure LoRa-Based Peer-to-Peer Communication for Short-Range Tactical Networks
di: Agrawal, Ayush Kumar, et al.
Pubblicazione: (2026)
di: Agrawal, Ayush Kumar, et al.
Pubblicazione: (2026)
SyncNet: correlating objective for time delay estimation in audio signals
di: Raina, Akshay, et al.
Pubblicazione: (2022)
di: Raina, Akshay, et al.
Pubblicazione: (2022)
Multimodal sensor fusion for real-time location-dependent defect detection in laser-directed energy deposition
di: Chen, Lequn, et al.
Pubblicazione: (2023)
di: Chen, Lequn, et al.
Pubblicazione: (2023)
Benchmarking multi-component signal processing methods in the time-frequency plane
di: Miramont, Juan M., et al.
Pubblicazione: (2024)
di: Miramont, Juan M., et al.
Pubblicazione: (2024)
Cross-Talk Reduction
di: Wang, Zhong-Qiu, et al.
Pubblicazione: (2024)
di: Wang, Zhong-Qiu, et al.
Pubblicazione: (2024)
DeWinder: Single-Channel Wind Noise Reduction using Ultrasound Sensing
di: Yuan, Kuang, et al.
Pubblicazione: (2024)
di: Yuan, Kuang, et al.
Pubblicazione: (2024)
SuperM2M: Supervised and Mixture-to-Mixture Co-Learning for Speech Enhancement and Noise-Robust ASR
di: Wang, Zhong-Qiu
Pubblicazione: (2024)
di: Wang, Zhong-Qiu
Pubblicazione: (2024)
Joint Spectrogram Separation and TDOA Estimation using Optimal Transport
di: Fabiani, Linda, et al.
Pubblicazione: (2025)
di: Fabiani, Linda, et al.
Pubblicazione: (2025)
Harmonics to the Rescue: Why Voiced Speech is Not a Wss Process
di: Bologni, Giovanni, et al.
Pubblicazione: (2025)
di: Bologni, Giovanni, et al.
Pubblicazione: (2025)
Parameter-Efficient Fine-Tuning of Foundation Models for CLP Speech Classification
di: Bhattacharjee, Susmita, et al.
Pubblicazione: (2025)
di: Bhattacharjee, Susmita, et al.
Pubblicazione: (2025)
RIR-Mega: a large-scale simulated room impulse response dataset for machine learning and room acoustics modeling
di: Goswami, Mandip
Pubblicazione: (2025)
di: Goswami, Mandip
Pubblicazione: (2025)
SUNAC: Source-aware Unified Neural Audio Codec
di: Aihara, Ryo, et al.
Pubblicazione: (2025)
di: Aihara, Ryo, et al.
Pubblicazione: (2025)
Semi-Blind Channel Estimation and Hybrid Receiver Beamforming in the Tera-Hertz Multi-User Massive MIMO Uplink
di: Garg, Abhisha, et al.
Pubblicazione: (2026)
di: Garg, Abhisha, et al.
Pubblicazione: (2026)
Unsupervised Face-Masked Speech Enhancement Using Generative Adversarial Networks With Human-in-the-Loop Assessment Metrics
di: Wang, Syu-Siang, et al.
Pubblicazione: (2024)
di: Wang, Syu-Siang, et al.
Pubblicazione: (2024)
Efficient Personalization of Amplification in Hearing Aids via Multi-band Bayesian Machine Learning
di: Ni, Aoxin, et al.
Pubblicazione: (2024)
di: Ni, Aoxin, et al.
Pubblicazione: (2024)
ERes2NetV2: Boosting Short-Duration Speaker Verification Performance with Computational Efficiency
di: Chen, Yafeng, et al.
Pubblicazione: (2024)
di: Chen, Yafeng, et al.
Pubblicazione: (2024)
Classification of Adventitious Sounds Combining Cochleogram and Vision Transformers
di: Mang, Loredana Daria, et al.
Pubblicazione: (2024)
di: Mang, Loredana Daria, et al.
Pubblicazione: (2024)
Advanced Signal Analysis in Detecting Replay Attacks for Automatic Speaker Verification Systems
di: Kuang, Lee Shih
Pubblicazione: (2024)
di: Kuang, Lee Shih
Pubblicazione: (2024)
Cough-E: A multimodal, privacy-preserving cough detection algorithm for the edge
di: Albini, Stefano, et al.
Pubblicazione: (2024)
di: Albini, Stefano, et al.
Pubblicazione: (2024)
Cyclic Multichannel Wiener Filter for Acoustic Beamforming
di: Bologni, Giovanni, et al.
Pubblicazione: (2025)
di: Bologni, Giovanni, et al.
Pubblicazione: (2025)
Variational Inference of Structured Line Spectra Exploiting Group-Sparsity
di: Möderl, Jakob, et al.
Pubblicazione: (2023)
di: Möderl, Jakob, et al.
Pubblicazione: (2023)
Cross-Linguistic Rhythmic and Spectral Feature-Based Analysis of Nyishi and Adi: Two Under-Resourced Languages of Arunachal Pradesh
di: Gogoi, Deepshikha, et al.
Pubblicazione: (2026)
di: Gogoi, Deepshikha, et al.
Pubblicazione: (2026)
Benchmarking Audio Deepfake Detection Robustness in Real-world Communication Scenarios
di: Shi, Haohan, et al.
Pubblicazione: (2025)
di: Shi, Haohan, et al.
Pubblicazione: (2025)
Hybrid SMI Realization via Matrix Completion and Riemannian Manifold Optimization on Narrowband Sub-Array Based Architectures
di: Cousik, Tarun Suman, et al.
Pubblicazione: (2026)
di: Cousik, Tarun Suman, et al.
Pubblicazione: (2026)
Speakers Localization Using Batch EM In Unfolding Neural Network
di: Veler, Rina, et al.
Pubblicazione: (2026)
di: Veler, Rina, et al.
Pubblicazione: (2026)
A Zero-Shot Physics-Informed Dictionary Learning Approach for Sound Field Reconstruction
di: Damiano, Stefano, et al.
Pubblicazione: (2024)
di: Damiano, Stefano, et al.
Pubblicazione: (2024)
A Neural Denoising Vocoder for Clean Waveform Generation from Noisy Mel-Spectrogram based on Amplitude and Phase Predictions
di: Du, Hui-Peng, et al.
Pubblicazione: (2024)
di: Du, Hui-Peng, et al.
Pubblicazione: (2024)
Incremental Averaging Method to Improve Graph-Based Time-Difference-of-Arrival Estimation
di: Brümann, Klaus, et al.
Pubblicazione: (2025)
di: Brümann, Klaus, et al.
Pubblicazione: (2025)
Self-Boosted Weight-Constrained FxLMS: A Robustness Distributed Active Noise Control Algorithm Without Internode Communication
di: Ji, Junwei, et al.
Pubblicazione: (2025)
di: Ji, Junwei, et al.
Pubblicazione: (2025)
SELM: Speech Enhancement Using Discrete Tokens and Language Models
di: Wang, Ziqian, et al.
Pubblicazione: (2023)
di: Wang, Ziqian, et al.
Pubblicazione: (2023)
Auditory Attention Decoding from Ear-EEG Signals: A Dataset with Dynamic Attention Switching and Rigorous Cross-Validation
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
Unsupervised Variational Acoustic Clustering
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
Brain-Informed Speech Separation for Cochlear Implants
di: Gajecki, Tom, et al.
Pubblicazione: (2026)
di: Gajecki, Tom, et al.
Pubblicazione: (2026)
FUN-SSL: Full-band Layer Followed by U-Net with Narrow-band Layers for Multiple Moving Sound Source Localization
di: Choi, Yuseon, et al.
Pubblicazione: (2025)
di: Choi, Yuseon, et al.
Pubblicazione: (2025)
On fusing active and passive acoustic sensing for simultaneous localization and mapping
di: Bradley, Aidan J., et al.
Pubblicazione: (2024)
di: Bradley, Aidan J., et al.
Pubblicazione: (2024)
BanglaNum -- A Public Dataset for Bengali Digit Recognition from Speech
di: Mohammad, Mir Sayeed, et al.
Pubblicazione: (2024)
di: Mohammad, Mir Sayeed, et al.
Pubblicazione: (2024)
Independent Feature Enhanced Crossmodal Fusion for Match-Mismatch Classification of Speech Stimulus and EEG Response
di: Fan, Shitong, et al.
Pubblicazione: (2024)
di: Fan, Shitong, et al.
Pubblicazione: (2024)
On the Invariance of Cross-Correlation Peak Positions Under Monotonic Signal Transformations, with Application to Fast Time Difference Estimation
di: Ueno, Natsuki, et al.
Pubblicazione: (2025)
di: Ueno, Natsuki, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bottleneck Transformer-Based Approach for Improved Automatic STOI Score Prediction
di: Amartyaveer, et al.
Pubblicazione: (2026) -
A Generalized Weighted Overlap-Add (WOLA) Filter Bank for Improved Subband System Identification
di: Sharma, Mohit, et al.
Pubblicazione: (2025) -
Modeling and Link Budget Feasibility Analysis of Secure LoRa-Based Peer-to-Peer Communication for Short-Range Tactical Networks
di: Agrawal, Ayush Kumar, et al.
Pubblicazione: (2026) -
SyncNet: correlating objective for time delay estimation in audio signals
di: Raina, Akshay, et al.
Pubblicazione: (2022) -
Multimodal sensor fusion for real-time location-dependent defect detection in laser-directed energy deposition
di: Chen, Lequn, et al.
Pubblicazione: (2023)