Implicit Counterfactual Learning for Audio-Visual Segmentation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zha, Mingfeng, Li, Tianyu, Wang, Guoqing, Wang, Peng, Wu, Yangyang, Yang, Yang, Shen, Heng Tao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Hierarchical Consistency Learning for Test-time Adaptation in Camouflage Perception
von: Zha, Mingfeng, et al.
Veröffentlicht: (2026)
von: Zha, Mingfeng, et al.
Veröffentlicht: (2026)
Region-aware Distribution Contrast: A Novel Approach to Multi-Task Partially Supervised Learning
von: Li, Meixuan, et al.
Veröffentlicht: (2024)
von: Li, Meixuan, et al.
Veröffentlicht: (2024)
JoReS-Diff: Joint Retinex and Semantic Priors in Diffusion Model for Low-light Image Enhancement
von: Wu, Yuhui, et al.
Veröffentlicht: (2023)
von: Wu, Yuhui, et al.
Veröffentlicht: (2023)
New Dataset and Methods for Fine-Grained Compositional Referring Expression Comprehension via Specialist-MLLM Collaboration
von: Yang, Xuzheng, et al.
Veröffentlicht: (2025)
von: Yang, Xuzheng, et al.
Veröffentlicht: (2025)
Robust Audio-Visual Segmentation via Audio-Guided Visual Convergent Alignment
von: Liu, Chen, et al.
Veröffentlicht: (2025)
von: Liu, Chen, et al.
Veröffentlicht: (2025)
Learning What is Worth Learning: Active and Sequential Domain Adaptation for Multi-modal Gross Tumor Volume Segmentation
von: Yang, Jingyun, et al.
Veröffentlicht: (2025)
von: Yang, Jingyun, et al.
Veröffentlicht: (2025)
UAV as Urban Construction Change Monitor: A New Benchmark and Change Captioning Model
von: Gao, Yupeng, et al.
Veröffentlicht: (2026)
von: Gao, Yupeng, et al.
Veröffentlicht: (2026)
GeoPurify: A Data-Efficient Geometric Distillation Framework for Open-Vocabulary 3D Segmentation
von: Dou, Weijia, et al.
Veröffentlicht: (2025)
von: Dou, Weijia, et al.
Veröffentlicht: (2025)
Adapting Foundation Models for Few-Shot Medical Image Segmentation: Actively and Sequentially
von: Yang, Jingyun, et al.
Veröffentlicht: (2025)
von: Yang, Jingyun, et al.
Veröffentlicht: (2025)
DiffSal: Joint Audio and Video Learning for Diffusion Saliency Prediction
von: Xiong, Junwen, et al.
Veröffentlicht: (2024)
von: Xiong, Junwen, et al.
Veröffentlicht: (2024)
Frequency-Domain Decomposition and Recomposition for Robust Audio-Visual Segmentation
von: Shen, Yunzhe, et al.
Veröffentlicht: (2025)
von: Shen, Yunzhe, et al.
Veröffentlicht: (2025)
AVESFormer: Efficient Transformer Design for Real-Time Audio-Visual Segmentation
von: Wang, Zili, et al.
Veröffentlicht: (2024)
von: Wang, Zili, et al.
Veröffentlicht: (2024)
Exploring Kernel Transformations for Implicit Neural Representations
von: Zheng, Sheng, et al.
Veröffentlicht: (2025)
von: Zheng, Sheng, et al.
Veröffentlicht: (2025)
Complementary and Contrastive Learning for Audio-Visual Segmentation
von: Gong, Sitong, et al.
Veröffentlicht: (2025)
von: Gong, Sitong, et al.
Veröffentlicht: (2025)
Taming Modality Entanglement in Continual Audio-Visual Segmentation
von: Hong, Yuyang, et al.
Veröffentlicht: (2025)
von: Hong, Yuyang, et al.
Veröffentlicht: (2025)
Selective Noise Suppression and Discriminative Mutual Interaction for Robust Audio-Visual Segmentation
von: Peng, Kai, et al.
Veröffentlicht: (2026)
von: Peng, Kai, et al.
Veröffentlicht: (2026)
Dynamic Derivation and Elimination: Audio Visual Segmentation with Enhanced Audio Semantics
von: Liu, Chen, et al.
Veröffentlicht: (2025)
von: Liu, Chen, et al.
Veröffentlicht: (2025)
D$^2$Turb: Depth-Aware Simulation and Decoupled Learning for Single-Frame Atmospheric Turbulence Mitigation
von: Hu, Zixiao, et al.
Veröffentlicht: (2026)
von: Hu, Zixiao, et al.
Veröffentlicht: (2026)
Learning Weakly Supervised Audio-Visual Violence Detection in Hyperbolic Space
von: Peng, Xiaogang, et al.
Veröffentlicht: (2023)
von: Peng, Xiaogang, et al.
Veröffentlicht: (2023)
Beyond Boundary Frames: Context-Centric Video Interpolation with Audio-Visual Semantics
von: Deng, Yuchen, et al.
Veröffentlicht: (2025)
von: Deng, Yuchen, et al.
Veröffentlicht: (2025)
Visual-Geometric Collaborative Guidance for Affordance Learning
von: Luo, Hongchen, et al.
Veröffentlicht: (2024)
von: Luo, Hongchen, et al.
Veröffentlicht: (2024)
Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
von: Huang, Shaofei, et al.
Veröffentlicht: (2025)
von: Huang, Shaofei, et al.
Veröffentlicht: (2025)
LightAVSeg: Lightweight Audio-Visual Segmentation
von: Zhong, Qing, et al.
Veröffentlicht: (2026)
von: Zhong, Qing, et al.
Veröffentlicht: (2026)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
von: Xu, Zhihua, et al.
Veröffentlicht: (2025)
von: Xu, Zhihua, et al.
Veröffentlicht: (2025)
An Error-Matching Exclusion Method for Accelerating Visual SLAM
von: Zhang, Shaojie, et al.
Veröffentlicht: (2024)
von: Zhang, Shaojie, et al.
Veröffentlicht: (2024)
Counterfactual Explanations for Face Forgery Detection via Adversarial Removal of Artifacts
von: Li, Yang, et al.
Veröffentlicht: (2024)
von: Li, Yang, et al.
Veröffentlicht: (2024)
TAViS: Text-bridged Audio-Visual Segmentation with Foundation Models
von: Luo, Ziyang, et al.
Veröffentlicht: (2025)
von: Luo, Ziyang, et al.
Veröffentlicht: (2025)
A Joint Learning Framework with Feature Reconstruction and Prediction for Incomplete Satellite Image Time Series in Agricultural Semantic Segmentation
von: Wang, Yuze, et al.
Veröffentlicht: (2025)
von: Wang, Yuze, et al.
Veröffentlicht: (2025)
Unsupervised Audio-Visual Segmentation with Modality Alignment
von: Bhosale, Swapnil, et al.
Veröffentlicht: (2024)
von: Bhosale, Swapnil, et al.
Veröffentlicht: (2024)
Hierarchical Feature Learning for Medical Point Clouds via State Space Model
von: Zhang, Guoqing, et al.
Veröffentlicht: (2025)
von: Zhang, Guoqing, et al.
Veröffentlicht: (2025)
SAM Meets UAP: Attacking Segment Anything Model With Universal Adversarial Perturbation
von: Han, Dongshen, et al.
Veröffentlicht: (2023)
von: Han, Dongshen, et al.
Veröffentlicht: (2023)
Fast SAM2 with Text-Driven Token Pruning
von: Mandal, Avilasha, et al.
Veröffentlicht: (2025)
von: Mandal, Avilasha, et al.
Veröffentlicht: (2025)
Selecting the Best Sequential Transfer Path for Medical Image Segmentation with Limited Labeled Data
von: Yang, Jingyun, et al.
Veröffentlicht: (2024)
von: Yang, Jingyun, et al.
Veröffentlicht: (2024)
AVS-Mamba: Exploring Temporal and Multi-modal Mamba for Audio-Visual Segmentation
von: Gong, Sitong, et al.
Veröffentlicht: (2025)
von: Gong, Sitong, et al.
Veröffentlicht: (2025)
From Waveforms to Pixels: A Survey on Audio-Visual Segmentation
von: Li, Jia, et al.
Veröffentlicht: (2025)
von: Li, Jia, et al.
Veröffentlicht: (2025)
Bootstrapping Audio-Visual Segmentation by Strengthening Audio Cues
von: Chen, Tianxiang, et al.
Veröffentlicht: (2024)
von: Chen, Tianxiang, et al.
Veröffentlicht: (2024)
Native Audio-Visual Alignment for Generation
von: Ji, Longbin, et al.
Veröffentlicht: (2026)
von: Ji, Longbin, et al.
Veröffentlicht: (2026)
Unveiling and Mitigating Bias in Audio Visual Segmentation
von: Sun, Peiwen, et al.
Veröffentlicht: (2024)
von: Sun, Peiwen, et al.
Veröffentlicht: (2024)
Implicit and Explicit Language Guidance for Diffusion-based Visual Perception
von: Wang, Hefeng, et al.
Veröffentlicht: (2024)
von: Wang, Hefeng, et al.
Veröffentlicht: (2024)
SAM2-LOVE: Segment Anything Model 2 in Language-aided Audio-Visual Scenes
von: Wang, Yuji, et al.
Veröffentlicht: (2025)
von: Wang, Yuji, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Hierarchical Consistency Learning for Test-time Adaptation in Camouflage Perception
von: Zha, Mingfeng, et al.
Veröffentlicht: (2026) -
Region-aware Distribution Contrast: A Novel Approach to Multi-Task Partially Supervised Learning
von: Li, Meixuan, et al.
Veröffentlicht: (2024) -
JoReS-Diff: Joint Retinex and Semantic Priors in Diffusion Model for Low-light Image Enhancement
von: Wu, Yuhui, et al.
Veröffentlicht: (2023) -
New Dataset and Methods for Fine-Grained Compositional Referring Expression Comprehension via Specialist-MLLM Collaboration
von: Yang, Xuzheng, et al.
Veröffentlicht: (2025) -
Robust Audio-Visual Segmentation via Audio-Guided Visual Convergent Alignment
von: Liu, Chen, et al.
Veröffentlicht: (2025)