Unveiling and Mitigating Bias in Audio Visual Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Peiwen, Zhang, Honggang, Hu, Di |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
Can Textual Semantics Mitigate Sounding Object Segmentation Preference?
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
Stepping Stones: A Progressive Training Strategy for Audio-Visual Semantic Segmentation
di: Ma, Juncheng, et al.
Pubblicazione: (2024)
di: Ma, Juncheng, et al.
Pubblicazione: (2024)
MAVias: Mitigate any Visual Bias
di: Sarridis, Ioannis, et al.
Pubblicazione: (2024)
di: Sarridis, Ioannis, et al.
Pubblicazione: (2024)
Complementary and Contrastive Learning for Audio-Visual Segmentation
di: Gong, Sitong, et al.
Pubblicazione: (2025)
di: Gong, Sitong, et al.
Pubblicazione: (2025)
ViG-Bias: Visually Grounded Bias Discovery and Mitigation
di: Marani, Badr-Eddine, et al.
Pubblicazione: (2024)
di: Marani, Badr-Eddine, et al.
Pubblicazione: (2024)
Both Ears Wide Open: Towards Language-Driven Spatial Audio Generation
di: Sun, Peiwen, et al.
Pubblicazione: (2024)
di: Sun, Peiwen, et al.
Pubblicazione: (2024)
Revisiting Audio-Visual Segmentation with Vision-Centric Transformer
di: Huang, Shaofei, et al.
Pubblicazione: (2025)
di: Huang, Shaofei, et al.
Pubblicazione: (2025)
Unveiling the Backbone-Optimizer Coupling Bias in Visual Representation Learning
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
VB-Mitigator: An Open-source Framework for Evaluating and Advancing Visual Bias Mitigation
di: Sarridis, Ioannis, et al.
Pubblicazione: (2025)
di: Sarridis, Ioannis, et al.
Pubblicazione: (2025)
LightAVSeg: Lightweight Audio-Visual Segmentation
di: Zhong, Qing, et al.
Pubblicazione: (2026)
di: Zhong, Qing, et al.
Pubblicazione: (2026)
Implicit Counterfactual Learning for Audio-Visual Segmentation
di: Zha, Mingfeng, et al.
Pubblicazione: (2025)
di: Zha, Mingfeng, et al.
Pubblicazione: (2025)
Robust Audio-Visual Segmentation via Audio-Guided Visual Convergent Alignment
di: Liu, Chen, et al.
Pubblicazione: (2025)
di: Liu, Chen, et al.
Pubblicazione: (2025)
Mitigating Query Selection Bias in Referring Video Object Segmentation
di: Zhang, Dingwei, et al.
Pubblicazione: (2025)
di: Zhang, Dingwei, et al.
Pubblicazione: (2025)
Frequency-Domain Decomposition and Recomposition for Robust Audio-Visual Segmentation
di: Shen, Yunzhe, et al.
Pubblicazione: (2025)
di: Shen, Yunzhe, et al.
Pubblicazione: (2025)
Crab: A Unified Audio-Visual Scene Understanding Model with Explicit Cooperation
di: Du, Henghui, et al.
Pubblicazione: (2025)
di: Du, Henghui, et al.
Pubblicazione: (2025)
Extending Segment Anything Model into Auditory and Temporal Dimensions for Audio-Visual Segmentation
di: Seon, Juhyeong, et al.
Pubblicazione: (2024)
di: Seon, Juhyeong, et al.
Pubblicazione: (2024)
AVS-Mamba: Exploring Temporal and Multi-modal Mamba for Audio-Visual Segmentation
di: Gong, Sitong, et al.
Pubblicazione: (2025)
di: Gong, Sitong, et al.
Pubblicazione: (2025)
Mitigating Objectness Bias and Region-to-Text Misalignment for Open-Vocabulary Panoptic Segmentation
di: Kormushev, Nikolay, et al.
Pubblicazione: (2026)
di: Kormushev, Nikolay, et al.
Pubblicazione: (2026)
Unraveling Instance Associations: A Closer Look for Audio-Visual Segmentation
di: Chen, Yuanhong, et al.
Pubblicazione: (2023)
di: Chen, Yuanhong, et al.
Pubblicazione: (2023)
PRIMED: Adaptive Modality Suppression for Referring Audio-Visual Segmentation via Biased Competition
di: He, Yuchen, et al.
Pubblicazione: (2026)
di: He, Yuchen, et al.
Pubblicazione: (2026)
From Waveforms to Pixels: A Survey on Audio-Visual Segmentation
di: Li, Jia, et al.
Pubblicazione: (2025)
di: Li, Jia, et al.
Pubblicazione: (2025)
TAViS: Text-bridged Audio-Visual Segmentation with Foundation Models
di: Luo, Ziyang, et al.
Pubblicazione: (2025)
di: Luo, Ziyang, et al.
Pubblicazione: (2025)
Towards Omnimodal Expressions and Reasoning in Referring Audio-Visual Segmentation
di: Ying, Kaining, et al.
Pubblicazione: (2025)
di: Ying, Kaining, et al.
Pubblicazione: (2025)
Selective Noise Suppression and Discriminative Mutual Interaction for Robust Audio-Visual Segmentation
di: Peng, Kai, et al.
Pubblicazione: (2026)
di: Peng, Kai, et al.
Pubblicazione: (2026)
BAdd: Bias Mitigation through Bias Addition
di: Sarridis, Ioannis, et al.
Pubblicazione: (2024)
di: Sarridis, Ioannis, et al.
Pubblicazione: (2024)
SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
Audio Visual Segmentation Through Text Embeddings
di: Lee, Kyungbok, et al.
Pubblicazione: (2025)
di: Lee, Kyungbok, et al.
Pubblicazione: (2025)
AVESFormer: Efficient Transformer Design for Real-Time Audio-Visual Segmentation
di: Wang, Zili, et al.
Pubblicazione: (2024)
di: Wang, Zili, et al.
Pubblicazione: (2024)
SimToken: A Simple Baseline for Referring Audio-Visual Segmentation
di: Jin, Dian, et al.
Pubblicazione: (2025)
di: Jin, Dian, et al.
Pubblicazione: (2025)
SOUPLE: Enhancing Audio-Visual Localization and Segmentation with Learnable Prompt Contexts
di: Nguyen, Khanh Binh, et al.
Pubblicazione: (2026)
di: Nguyen, Khanh Binh, et al.
Pubblicazione: (2026)
AVCD: Mitigating Hallucinations in Audio-Visual Large Language Models through Contrastive Decoding
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
Audio-Synchronized Visual Animation
di: Zhang, Lin, et al.
Pubblicazione: (2024)
di: Zhang, Lin, et al.
Pubblicazione: (2024)
Native Audio-Visual Alignment for Generation
di: Ji, Longbin, et al.
Pubblicazione: (2026)
di: Ji, Longbin, et al.
Pubblicazione: (2026)
Unveiling the "Fairness Seesaw": Discovering and Mitigating Gender and Race Bias in Vision-Language Models
di: Lan, Jian, et al.
Pubblicazione: (2025)
di: Lan, Jian, et al.
Pubblicazione: (2025)
Unsupervised Audio-Visual Segmentation with Modality Alignment
di: Bhosale, Swapnil, et al.
Pubblicazione: (2024)
di: Bhosale, Swapnil, et al.
Pubblicazione: (2024)
SeaVIS: Sound-Enhanced Association for Online Audio-Visual Instance Segmentation
di: Zhu, Yingjian, et al.
Pubblicazione: (2026)
di: Zhu, Yingjian, et al.
Pubblicazione: (2026)
Scaling Up Audio-Synchronized Visual Animation: An Efficient Training Paradigm
di: Zhang, Lin, et al.
Pubblicazione: (2025)
di: Zhang, Lin, et al.
Pubblicazione: (2025)
CAE-AV: Improving Audio-Visual Learning via Cross-modal Interactive Enrichment
di: Hu, Yunzuo, et al.
Pubblicazione: (2026)
di: Hu, Yunzuo, et al.
Pubblicazione: (2026)
GradBias: Unveiling Word Influence on Bias in Text-to-Image Generative Models
di: D'Incà, Moreno, et al.
Pubblicazione: (2024)
di: D'Incà, Moreno, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
di: Wang, Yaoting, et al.
Pubblicazione: (2024) -
Can Textual Semantics Mitigate Sounding Object Segmentation Preference?
di: Wang, Yaoting, et al.
Pubblicazione: (2024) -
Stepping Stones: A Progressive Training Strategy for Audio-Visual Semantic Segmentation
di: Ma, Juncheng, et al.
Pubblicazione: (2024) -
MAVias: Mitigate any Visual Bias
di: Sarridis, Ioannis, et al.
Pubblicazione: (2024) -
Complementary and Contrastive Learning for Audio-Visual Segmentation
di: Gong, Sitong, et al.
Pubblicazione: (2025)