Stepping Stones: A Progressive Training Strategy for Audio-Visual Semantic Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Juncheng, Sun, Peiwen, Wang, Yaoting, Hu, Di |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
Can Textual Semantics Mitigate Sounding Object Segmentation Preference?
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
di: Wang, Yaoting, et al.
Pubblicazione: (2024)
Unveiling and Mitigating Bias in Audio Visual Segmentation
di: Sun, Peiwen, et al.
Pubblicazione: (2024)
di: Sun, Peiwen, et al.
Pubblicazione: (2024)
AVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
di: Li, Guangyao, et al.
Pubblicazione: (2024)
di: Li, Guangyao, et al.
Pubblicazione: (2024)
Progressive Confident Masking Attention Network for Audio-Visual Segmentation
di: Wang, Yuxuan, et al.
Pubblicazione: (2024)
di: Wang, Yuxuan, et al.
Pubblicazione: (2024)
Query-centric Audio-Visual Cognition Network for Moment Retrieval, Segmentation and Step-Captioning
di: Tu, Yunbin, et al.
Pubblicazione: (2024)
di: Tu, Yunbin, et al.
Pubblicazione: (2024)
How Do Optical Flow and Textual Prompts Collaborate to Assist in Audio-Visual Semantic Segmentation?
di: Lee, Yujian, et al.
Pubblicazione: (2026)
di: Lee, Yujian, et al.
Pubblicazione: (2026)
Unsupervised Audio-Visual Segmentation with Modality Alignment
di: Bhosale, Swapnil, et al.
Pubblicazione: (2024)
di: Bhosale, Swapnil, et al.
Pubblicazione: (2024)
Audit After Segmentation: Reference-Free Mask Quality Assessment for Language-Referred Audio-Visual Segmentation
di: Zhou, Jinxing, et al.
Pubblicazione: (2026)
di: Zhou, Jinxing, et al.
Pubblicazione: (2026)
Advancing Brain Imaging Analysis Step-by-step via Progressive Self-paced Learning
di: Yang, Yanwu, et al.
Pubblicazione: (2024)
di: Yang, Yanwu, et al.
Pubblicazione: (2024)
Taming Modality Entanglement in Continual Audio-Visual Segmentation
di: Hong, Yuyang, et al.
Pubblicazione: (2025)
di: Hong, Yuyang, et al.
Pubblicazione: (2025)
Audio Visual Segmentation Through Text Embeddings
di: Lee, Kyungbok, et al.
Pubblicazione: (2025)
di: Lee, Kyungbok, et al.
Pubblicazione: (2025)
Audio-Guided Visual Perception for Audio-Visual Navigation
di: Wang, Yi, et al.
Pubblicazione: (2025)
di: Wang, Yi, et al.
Pubblicazione: (2025)
LarvSeg: Exploring Image Classification Data For Large Vocabulary Semantic Segmentation via Category-wise Attentive Classifier
di: Yu, Haojun, et al.
Pubblicazione: (2025)
di: Yu, Haojun, et al.
Pubblicazione: (2025)
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
di: Yin, Jiong, et al.
Pubblicazione: (2025)
di: Yin, Jiong, et al.
Pubblicazione: (2025)
video-SALMONN S: Memory-Enhanced Streaming Audio-Visual LLM
di: Sun, Guangzhi, et al.
Pubblicazione: (2025)
di: Sun, Guangzhi, et al.
Pubblicazione: (2025)
Multimodal SAM-adapter for Semantic Segmentation
di: Curti, Iacopo, et al.
Pubblicazione: (2025)
di: Curti, Iacopo, et al.
Pubblicazione: (2025)
Pre-Trained LLM is a Semantic-Aware and Generalizable Segmentation Booster
di: Tang, Fenghe, et al.
Pubblicazione: (2025)
di: Tang, Fenghe, et al.
Pubblicazione: (2025)
Revisiting Network Perturbation for Semi-Supervised Semantic Segmentation
di: Li, Sien, et al.
Pubblicazione: (2024)
di: Li, Sien, et al.
Pubblicazione: (2024)
XAI-Enhanced Semantic Segmentation Models for Visual Quality Inspection
di: Clement, Tobias, et al.
Pubblicazione: (2024)
di: Clement, Tobias, et al.
Pubblicazione: (2024)
Language-Driven Visual Consensus for Zero-Shot Semantic Segmentation
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
Semantic Localization Guiding Segment Anything Model For Reference Remote Sensing Image Segmentation
di: Li, Shuyang, et al.
Pubblicazione: (2025)
di: Li, Shuyang, et al.
Pubblicazione: (2025)
Text2Seg: Remote Sensing Image Semantic Segmentation via Text-Guided Visual Foundation Models
di: Zhang, Jielu, et al.
Pubblicazione: (2023)
di: Zhang, Jielu, et al.
Pubblicazione: (2023)
One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion
di: Lu, Haoang, et al.
Pubblicazione: (2025)
di: Lu, Haoang, et al.
Pubblicazione: (2025)
Semantic Segmentation by Semantic Proportions
di: Aysel, Halil Ibrahim, et al.
Pubblicazione: (2023)
di: Aysel, Halil Ibrahim, et al.
Pubblicazione: (2023)
Audio-Infused Automatic Image Colorization by Exploiting Audio Scene Semantics
di: Zhao, Pengcheng, et al.
Pubblicazione: (2024)
di: Zhao, Pengcheng, et al.
Pubblicazione: (2024)
Crab$^{+}$: A Scalable and Unified Audio-Visual Scene Understanding Model with Explicit Cooperation
di: Cai, Dongnuan, et al.
Pubblicazione: (2026)
di: Cai, Dongnuan, et al.
Pubblicazione: (2026)
Integrating Semi-Supervised and Active Learning for Semantic Segmentation
di: Ma, Wanli, et al.
Pubblicazione: (2025)
di: Ma, Wanli, et al.
Pubblicazione: (2025)
Visual Prompt Selection for In-Context Learning Segmentation
di: Suo, Wei, et al.
Pubblicazione: (2024)
di: Suo, Wei, et al.
Pubblicazione: (2024)
D3S2: Diffusion-Guided Dataset Distillation for Semantic Segmentation
di: Zheng, Wenjie, et al.
Pubblicazione: (2026)
di: Zheng, Wenjie, et al.
Pubblicazione: (2026)
Improved Kidney Stone Recognition Through Attention and Multi-View Feature Fusion Strategies
di: Villalvazo-Avila, Elias, et al.
Pubblicazione: (2022)
di: Villalvazo-Avila, Elias, et al.
Pubblicazione: (2022)
Fighting Fire with Fire (F3): A Training-free and Efficient Visual Adversarial Example Purification Method in LVLMs
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
Representation Separation for Semantic Segmentation with Vision Transformers
di: Hong, Yuanduo, et al.
Pubblicazione: (2022)
di: Hong, Yuanduo, et al.
Pubblicazione: (2022)
Open-Vocabulary Remote Sensing Image Semantic Segmentation
di: Cao, Qinglong, et al.
Pubblicazione: (2024)
di: Cao, Qinglong, et al.
Pubblicazione: (2024)
Evading Visual Aphasia: Contrastive Adaptive Semantic Token Pruning for Vision-Language Models
di: Ma, Jie, et al.
Pubblicazione: (2026)
di: Ma, Jie, et al.
Pubblicazione: (2026)
Semi-Supervised Semantic Segmentation using Redesigned Self-Training for White Blood Cells
di: Luu, Vinh Quoc, et al.
Pubblicazione: (2024)
di: Luu, Vinh Quoc, et al.
Pubblicazione: (2024)
GAIS: Frame-Level Gated Audio-Visual Integration with Semantic Variance-Scaled Perturbation for Text-Video Retrieval
di: Yang, Bowen, et al.
Pubblicazione: (2025)
di: Yang, Bowen, et al.
Pubblicazione: (2025)
Progressive Language-guided Visual Learning for Multi-Task Visual Grounding
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
Vision-Language Model Purified Semi-Supervised Semantic Segmentation for Remote Sensing Images
di: Wang, Shanwen, et al.
Pubblicazione: (2026)
di: Wang, Shanwen, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
di: Wang, Yaoting, et al.
Pubblicazione: (2024) -
Can Textual Semantics Mitigate Sounding Object Segmentation Preference?
di: Wang, Yaoting, et al.
Pubblicazione: (2024) -
Unveiling and Mitigating Bias in Audio Visual Segmentation
di: Sun, Peiwen, et al.
Pubblicazione: (2024) -
AVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025) -
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
di: Li, Guangyao, et al.
Pubblicazione: (2024)