MAGIC: Map-Guided Few-Shot Audio-Visual Acoustics Modeling
Fuente:
arXiv
Saved in:
| Main Authors: | Huang, Diwei, Lin, Kunyang, Chen, Peihao, Du, Qing, Tan, Mingkui |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Zero-Shot Skeleton-Based Action Recognition With Prototype-Guided Feature Alignment
by: Zhou, Kai, et al.
Published: (2025)
by: Zhou, Kai, et al.
Published: (2025)
Sensitivity-Aware Post-Training Quantization for Deep Neural Networks
by: Zheng, Zekang, et al.
Published: (2025)
by: Zheng, Zekang, et al.
Published: (2025)
MAGIC: Few-Shot Mask-Guided Anomaly Inpainting with Prompt Perturbation, Spatially Adaptive Guidance, and Context Awareness
by: Choi, JaeHyuck, et al.
Published: (2025)
by: Choi, JaeHyuck, et al.
Published: (2025)
MSGCoOp: Multiple Semantic-Guided Context Optimization for Few-Shot Learning
by: Wang, Zhaolong, et al.
Published: (2025)
by: Wang, Zhaolong, et al.
Published: (2025)
LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences
by: Zhi, Hongyan, et al.
Published: (2024)
by: Zhi, Hongyan, et al.
Published: (2024)
Language-Guided Joint Audio-Visual Editing via One-Shot Adaptation
by: Liang, Susan, et al.
Published: (2024)
by: Liang, Susan, et al.
Published: (2024)
3DFlowAction: Learning Cross-Embodiment Manipulation from 3D Flow World Model
by: Zhi, Hongyan, et al.
Published: (2025)
by: Zhi, Hongyan, et al.
Published: (2025)
SpurAudio: A Benchmark for Studying Shortcut Learning in Few-Shot Audio Classification
by: Ayoub, Giries Abu, et al.
Published: (2026)
by: Ayoub, Giries Abu, et al.
Published: (2026)
The Devil is in the Few Shots: Iterative Visual Knowledge Completion for Few-shot Learning
by: Li, Yaohui, et al.
Published: (2024)
by: Li, Yaohui, et al.
Published: (2024)
Exploiting Temporal Audio-Visual Correlation Embedding for Audio-Driven One-Shot Talking Head Animation
by: Xu, Zhihua, et al.
Published: (2025)
by: Xu, Zhihua, et al.
Published: (2025)
MindAdapter: Few-Shot Parameter-Efficient Residual Calibration of Cross-Subject Brain-to-Visual Decoding Models
by: Liu, Jiaxiang, et al.
Published: (2026)
by: Liu, Jiaxiang, et al.
Published: (2026)
Multiplane Prior Guided Few-Shot Aerial Scene Rendering
by: Gao, Zihan, et al.
Published: (2024)
by: Gao, Zihan, et al.
Published: (2024)
Few-Shot Generalized Category Discovery With Retrieval-Guided Decision Boundary Enhancement
by: Ren, Yunhan, et al.
Published: (2025)
by: Ren, Yunhan, et al.
Published: (2025)
Video-to-Task Learning via Motion-Guided Attention for Few-Shot Action Recognition
by: Guo, Hanyu, et al.
Published: (2024)
by: Guo, Hanyu, et al.
Published: (2024)
Multi-Text Guided Few-Shot Semantic Segmentation
by: Jiao, Qiang, et al.
Published: (2025)
by: Jiao, Qiang, et al.
Published: (2025)
Lane2Seq: Towards Unified Lane Detection via Sequence Generation
by: Zhou, Kunyang
Published: (2024)
by: Zhou, Kunyang
Published: (2024)
Generative Compositor for Few-Shot Visual Information Extraction
by: Yang, Zhibo, et al.
Published: (2025)
by: Yang, Zhibo, et al.
Published: (2025)
AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion Model
by: Hu, Teng, et al.
Published: (2023)
by: Hu, Teng, et al.
Published: (2023)
Detail Reinforcement Diffusion Model: Augmentation Fine-Grained Visual Categorization in Few-Shot Conditions
by: Wu, Tianxu, et al.
Published: (2023)
by: Wu, Tianxu, et al.
Published: (2023)
VietMEAgent: Culturally-Aware Few-Shot Multimodal Explanation for Vietnamese Visual Question Answering
by: Nguyen, Hai-Dang, et al.
Published: (2025)
by: Nguyen, Hai-Dang, et al.
Published: (2025)
NYC-Indoor-VPR: A Long-Term Indoor Visual Place Recognition Dataset with Semi-Automatic Annotation
by: Sheng, Diwei, et al.
Published: (2024)
by: Sheng, Diwei, et al.
Published: (2024)
DiffusionLane: Diffusion Model for Lane Detection
by: Zhou, Kunyang, et al.
Published: (2025)
by: Zhou, Kunyang, et al.
Published: (2025)
A Cross-Domain Few-Shot Learning Method Based on Domain Knowledge Mapping
by: Chen, Jiajun, et al.
Published: (2025)
by: Chen, Jiajun, et al.
Published: (2025)
A Unified Reasoning Framework for Holistic Zero-Shot Video Anomaly Analysis
by: Lin, Dongheng, et al.
Published: (2025)
by: Lin, Dongheng, et al.
Published: (2025)
Vision-Language In-Context Learning Driven Few-Shot Visual Inspection Model
by: Ueno, Shiryu, et al.
Published: (2025)
by: Ueno, Shiryu, et al.
Published: (2025)
Robust Audio-Visual Segmentation via Audio-Guided Visual Convergent Alignment
by: Liu, Chen, et al.
Published: (2025)
by: Liu, Chen, et al.
Published: (2025)
MOVE: Motion-Guided Few-Shot Video Object Segmentation
by: Ying, Kaining, et al.
Published: (2025)
by: Ying, Kaining, et al.
Published: (2025)
Robust Lane Detection with Wavelet-Enhanced Context Modeling and Adaptive Sampling
by: Li, Kunyang, et al.
Published: (2025)
by: Li, Kunyang, et al.
Published: (2025)
Eliminating Feature Ambiguity for Few-Shot Segmentation
by: Xu, Qianxiong, et al.
Published: (2024)
by: Xu, Qianxiong, et al.
Published: (2024)
Beyond Visual Cues: Leveraging General Semantics as Support for Few-Shot Segmentation
by: Wang, Jin, et al.
Published: (2025)
by: Wang, Jin, et al.
Published: (2025)
CoNav: A Benchmark for Human-Centered Collaborative Navigation
by: Li, Changhao, et al.
Published: (2024)
by: Li, Changhao, et al.
Published: (2024)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
by: Nazarieh, Fatemeh, et al.
Published: (2025)
by: Nazarieh, Fatemeh, et al.
Published: (2025)
Dual-View Data Hallucination with Semantic Relation Guidance for Few-Shot Image Recognition
by: Wu, Hefeng, et al.
Published: (2024)
by: Wu, Hefeng, et al.
Published: (2024)
Few-Shot Relation Extraction with Hybrid Visual Evidence
by: Gong, Jiaying, et al.
Published: (2024)
by: Gong, Jiaying, et al.
Published: (2024)
LightAVSeg: Lightweight Audio-Visual Segmentation
by: Zhong, Qing, et al.
Published: (2026)
by: Zhong, Qing, et al.
Published: (2026)
CASP: Few-Shot Class-Incremental Learning with CLS Token Attention Steering Prompts
by: Huang, Shuai, et al.
Published: (2026)
by: Huang, Shuai, et al.
Published: (2026)
Consistency-Guided Asynchronous Contrastive Tuning for Few-Shot Class-Incremental Tuning of Foundation Models
by: Roy, Shuvendu, et al.
Published: (2024)
by: Roy, Shuvendu, et al.
Published: (2024)
Cluster-Aware Prompt Ensemble Learning for Few-Shot Vision-Language Model Adaptation
by: Chen, Zhi, et al.
Published: (2025)
by: Chen, Zhi, et al.
Published: (2025)
Enhanced Few-Shot Class-Incremental Learning via Ensemble Models
by: Zhu, Mingli, et al.
Published: (2024)
by: Zhu, Mingli, et al.
Published: (2024)
Hybrid Mamba for Few-Shot Segmentation
by: Xu, Qianxiong, et al.
Published: (2024)
by: Xu, Qianxiong, et al.
Published: (2024)
Similar Items
-
Zero-Shot Skeleton-Based Action Recognition With Prototype-Guided Feature Alignment
by: Zhou, Kai, et al.
Published: (2025) -
Sensitivity-Aware Post-Training Quantization for Deep Neural Networks
by: Zheng, Zekang, et al.
Published: (2025) -
MAGIC: Few-Shot Mask-Guided Anomaly Inpainting with Prompt Perturbation, Spatially Adaptive Guidance, and Context Awareness
by: Choi, JaeHyuck, et al.
Published: (2025) -
MSGCoOp: Multiple Semantic-Guided Context Optimization for Few-Shot Learning
by: Wang, Zhaolong, et al.
Published: (2025) -
LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences
by: Zhi, Hongyan, et al.
Published: (2024)