Frequency-Domain Decomposition and Recomposition for Robust Audio-Visual Segmentation
Fuente:
arXiv
Saved in:
| Main Authors: | Shen, Yunzhe, Peng, Kai, Liu, Leiye, Ji, Wei, Li, Jingjing, Zhang, Miao, Piao, Yongri, Lu, Huchuan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Selective Noise Suppression and Discriminative Mutual Interaction for Robust Audio-Visual Segmentation
by: Peng, Kai, et al.
Published: (2026)
by: Peng, Kai, et al.
Published: (2026)
DefMamba: Deformable Visual State Space Model
by: Liu, Leiye, et al.
Published: (2025)
by: Liu, Leiye, et al.
Published: (2025)
CriDiff: Criss-cross Injection Diffusion Framework via Generative Pre-train for Prostate Segmentation
by: Liu, Tingwei, et al.
Published: (2024)
by: Liu, Tingwei, et al.
Published: (2024)
CNN-Transformer Rectified Collaborative Learning for Medical Image Segmentation
by: Wu, Lanhu, et al.
Published: (2024)
by: Wu, Lanhu, et al.
Published: (2024)
P3Net: Progressive and Periodic Perturbation for Semi-Supervised Medical Image Segmentation
by: Yao, Zhenyan, et al.
Published: (2025)
by: Yao, Zhenyan, et al.
Published: (2025)
SAM3-I: Segment Anything with Instructions
by: Li, Jingjing, et al.
Published: (2025)
by: Li, Jingjing, et al.
Published: (2025)
Complementary and Contrastive Learning for Audio-Visual Segmentation
by: Gong, Sitong, et al.
Published: (2025)
by: Gong, Sitong, et al.
Published: (2025)
AVS-Mamba: Exploring Temporal and Multi-modal Mamba for Audio-Visual Segmentation
by: Gong, Sitong, et al.
Published: (2025)
by: Gong, Sitong, et al.
Published: (2025)
Robust Audio-Visual Segmentation via Audio-Guided Visual Convergent Alignment
by: Liu, Chen, et al.
Published: (2025)
by: Liu, Chen, et al.
Published: (2025)
Implicit Counterfactual Learning for Audio-Visual Segmentation
by: Zha, Mingfeng, et al.
Published: (2025)
by: Zha, Mingfeng, et al.
Published: (2025)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
by: Li, Xin, et al.
Published: (2024)
by: Li, Xin, et al.
Published: (2024)
Efficient Motion Prompt Learning for Robust Visual Tracking
by: Zhao, Jie, et al.
Published: (2025)
by: Zhao, Jie, et al.
Published: (2025)
Object-Scene-Camera Decomposition and Recomposition for Data-Efficient Monocular 3D Object Detection
by: Kuang, Zhaonian, et al.
Published: (2026)
by: Kuang, Zhaonian, et al.
Published: (2026)
High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study
by: Chang, Shijie, et al.
Published: (2024)
by: Chang, Shijie, et al.
Published: (2024)
ConMo: Controllable Motion Disentanglement and Recomposition for Zero-Shot Motion Transfer
by: Gao, Jiayi, et al.
Published: (2025)
by: Gao, Jiayi, et al.
Published: (2025)
MARBLE: Material Recomposition and Blending in CLIP-Space
by: Cheng, Ta-Ying, et al.
Published: (2025)
by: Cheng, Ta-Ying, et al.
Published: (2025)
HFP-SAM: Hierarchical Frequency Prompted SAM for Efficient Marine Animal Segmentation
by: Zhang, Pingping, et al.
Published: (2026)
by: Zhang, Pingping, et al.
Published: (2026)
Learning Visual Affordance from Audio
by: Lu, Lidong, et al.
Published: (2025)
by: Lu, Lidong, et al.
Published: (2025)
Frequency Domain Unlocks New Perspectives for Abdominal Medical Image Segmentation
by: Han, Kai, et al.
Published: (2025)
by: Han, Kai, et al.
Published: (2025)
Reinforcing Video Reasoning Segmentation to Think Before It Segments
by: Gong, Sitong, et al.
Published: (2025)
by: Gong, Sitong, et al.
Published: (2025)
Audio Frequency-Time Dual Domain Evaluation on Depression Diagnosis
by: Luo, Yu, et al.
Published: (2025)
by: Luo, Yu, et al.
Published: (2025)
Fantastic Animals and Where to Find Them: Segment Any Marine Animal with Dual SAM
by: Zhang, Pingping, et al.
Published: (2024)
by: Zhang, Pingping, et al.
Published: (2024)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
by: Huang, Yu, et al.
Published: (2025)
by: Huang, Yu, et al.
Published: (2025)
Modular Embedding Recomposition for Incremental Learning
by: Panariello, Aniello, et al.
Published: (2025)
by: Panariello, Aniello, et al.
Published: (2025)
LightAVSeg: Lightweight Audio-Visual Segmentation
by: Zhong, Qing, et al.
Published: (2026)
by: Zhong, Qing, et al.
Published: (2026)
Learning Motion and Temporal Cues for Unsupervised Video Object Segmentation
by: Zhuge, Yunzhi, et al.
Published: (2025)
by: Zhuge, Yunzhi, et al.
Published: (2025)
QDFormer: Towards Robust Audiovisual Segmentation in Complex Environments with Quantization-based Semantic Decomposition
by: Li, Xiang, et al.
Published: (2023)
by: Li, Xiang, et al.
Published: (2023)
Pulling Target to Source: A New Perspective on Domain Adaptive Semantic Segmentation
by: Wang, Haochen, et al.
Published: (2023)
by: Wang, Haochen, et al.
Published: (2023)
Open-Vocabulary Camouflaged Object Segmentation
by: Pang, Youwei, et al.
Published: (2023)
by: Pang, Youwei, et al.
Published: (2023)
Referring Remote Sensing Image Segmentation with Cross-view Semantics Interaction Network
by: Yang, Jiaxing, et al.
Published: (2025)
by: Yang, Jiaxing, et al.
Published: (2025)
Spatial-Temporal Multi-level Association for Video Object Segmentation
by: Miao, Deshui, et al.
Published: (2024)
by: Miao, Deshui, et al.
Published: (2024)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
by: Chen, Xin, et al.
Published: (2023)
by: Chen, Xin, et al.
Published: (2023)
Spider: A Unified Framework for Context-dependent Concept Segmentation
by: Zhao, Xiaoqi, et al.
Published: (2024)
by: Zhao, Xiaoqi, et al.
Published: (2024)
Multi-view Aggregation Network for Dichotomous Image Segmentation
by: Yu, Qian, et al.
Published: (2024)
by: Yu, Qian, et al.
Published: (2024)
Bootstrapping Audio-Visual Segmentation by Strengthening Audio Cues
by: Chen, Tianxiang, et al.
Published: (2024)
by: Chen, Tianxiang, et al.
Published: (2024)
Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
by: Huang, Shaofei, et al.
Published: (2025)
by: Huang, Shaofei, et al.
Published: (2025)
Beyond Mask: Rethinking Guidance Types in Few-shot Segmentation
by: Chang, Shijie, et al.
Published: (2024)
by: Chang, Shijie, et al.
Published: (2024)
Multi-Scale and Detail-Enhanced Segment Anything Model for Salient Object Detection
by: Gao, Shixuan, et al.
Published: (2024)
by: Gao, Shixuan, et al.
Published: (2024)
Unveiling and Mitigating Bias in Audio Visual Segmentation
by: Sun, Peiwen, et al.
Published: (2024)
by: Sun, Peiwen, et al.
Published: (2024)
Style Content Decomposition-based Data Augmentation for Domain Generalizable Medical Image Segmentation
by: Shen, Zhiqiang, et al.
Published: (2025)
by: Shen, Zhiqiang, et al.
Published: (2025)
Similar Items
-
Selective Noise Suppression and Discriminative Mutual Interaction for Robust Audio-Visual Segmentation
by: Peng, Kai, et al.
Published: (2026) -
DefMamba: Deformable Visual State Space Model
by: Liu, Leiye, et al.
Published: (2025) -
CriDiff: Criss-cross Injection Diffusion Framework via Generative Pre-train for Prostate Segmentation
by: Liu, Tingwei, et al.
Published: (2024) -
CNN-Transformer Rectified Collaborative Learning for Medical Image Segmentation
by: Wu, Lanhu, et al.
Published: (2024) -
P3Net: Progressive and Periodic Perturbation for Semi-Supervised Medical Image Segmentation
by: Yao, Zhenyan, et al.
Published: (2025)