SemAug: Semantically Meaningful Image Augmentations for Object Detection Through Language Grounding
Fuente:
arXiv
Guardado en:
| Autores principales: | Heisler, Morgan, Banitalebi-Dehkordi, Amin, Zhang, Yong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Scalable and Realistic Virtual Try-on Application for Foundation Makeup with Kubelka-Munk Theory
por: Pang, Hui, et al.
Publicado: (2025)
por: Pang, Hui, et al.
Publicado: (2025)
Discovering Meaningful Units with Visually Grounded Semantics from Image Captions
por: Behjati, Melika, et al.
Publicado: (2025)
por: Behjati, Melika, et al.
Publicado: (2025)
MediAug: Exploring Visual Augmentation in Medical Imaging
por: Qi, Xuyin, et al.
Publicado: (2025)
por: Qi, Xuyin, et al.
Publicado: (2025)
Parameter-Efficient Semantic Augmentation for Enhancing Open-Vocabulary Object Detection
por: Cao, Weihao, et al.
Publicado: (2026)
por: Cao, Weihao, et al.
Publicado: (2026)
PairAug: What Can Augmented Image-Text Pairs Do for Radiology?
por: Xie, Yutong, et al.
Publicado: (2024)
por: Xie, Yutong, et al.
Publicado: (2024)
SemOD: Semantic Enabled Object Detection Network under Various Weather Conditions
por: Zuo, Aiyinsi, et al.
Publicado: (2025)
por: Zuo, Aiyinsi, et al.
Publicado: (2025)
SemPT: Semantic Prompt Tuning for Vision-Language Models
por: Shi, Xiao, et al.
Publicado: (2025)
por: Shi, Xiao, et al.
Publicado: (2025)
SemLT3D: Semantic-Guided Expert Distillation for Camera-only Long-Tailed 3D Object Detection
por: Vo, Hao, et al.
Publicado: (2026)
por: Vo, Hao, et al.
Publicado: (2026)
SemAlign3D: Semantic Correspondence between RGB-Images through Aligning 3D Object-Class Representations
por: Wandel, Krispin, et al.
Publicado: (2025)
por: Wandel, Krispin, et al.
Publicado: (2025)
Intelligent Railroad Grade Crossing: Leveraging Semantic Segmentation and Object Detection for Enhanced Safety
por: Amin, Al, et al.
Publicado: (2024)
por: Amin, Al, et al.
Publicado: (2024)
HolisticSemGes: Semantic Grounding of Holistic Co-Speech Gesture Generation with Contrastive Flow-Matching
por: Liu, Lanmiao, et al.
Publicado: (2026)
por: Liu, Lanmiao, et al.
Publicado: (2026)
SpecSem-Net: Integrating Spectral and Semantic Features for Robust AI-generated Video Detection
por: Wei, Zixi, et al.
Publicado: (2026)
por: Wei, Zixi, et al.
Publicado: (2026)
SemFlow: Binding Semantic Segmentation and Image Synthesis via Rectified Flow
por: Wang, Chaoyang, et al.
Publicado: (2024)
por: Wang, Chaoyang, et al.
Publicado: (2024)
HiSem: Hierarchical Semantic Disentangling for Remote Sensing Image Change Captioning
por: Wang, Man, et al.
Publicado: (2026)
por: Wang, Man, et al.
Publicado: (2026)
Grounding-IQA: Grounding Multimodal Language Model for Image Quality Assessment
por: Chen, Zheng, et al.
Publicado: (2024)
por: Chen, Zheng, et al.
Publicado: (2024)
Language-guided Learning for Object Detection Tackling Multiple Variations in Aerial Images
por: Park, Sungjune, et al.
Publicado: (2025)
por: Park, Sungjune, et al.
Publicado: (2025)
Memory-Augmented Vision-Language Agents for Persistent and Semantically Consistent Object Captioning
por: Galliena, Tommaso, et al.
Publicado: (2026)
por: Galliena, Tommaso, et al.
Publicado: (2026)
UniSem: Generalizable Semantic 3D Reconstruction from Sparse Unposed Images
por: Liao, Guibiao, et al.
Publicado: (2026)
por: Liao, Guibiao, et al.
Publicado: (2026)
PhysAug: A Physical-guided and Frequency-based Data Augmentation for Single-Domain Generalized Object Detection
por: Xu, Xiaoran, et al.
Publicado: (2024)
por: Xu, Xiaoran, et al.
Publicado: (2024)
AugRefer: Advancing 3D Visual Grounding via Cross-Modal Augmentation and Spatial Relation-based Referring
por: Wang, Xinyi, et al.
Publicado: (2025)
por: Wang, Xinyi, et al.
Publicado: (2025)
Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection
por: Liu, Shilong, et al.
Publicado: (2023)
por: Liu, Shilong, et al.
Publicado: (2023)
Language-Grounded Multi-Domain Image Translation via Semantic Difference Guidance
por: Ryu, Jongwon, et al.
Publicado: (2026)
por: Ryu, Jongwon, et al.
Publicado: (2026)
Are Vision Transformer Representations Semantically Meaningful? A Case Study in Medical Imaging
por: Shams, Montasir, et al.
Publicado: (2025)
por: Shams, Montasir, et al.
Publicado: (2025)
Robust Grounding with MLLMs Against Occlusion and Small Objects via Language-Guided Semantic Cues
por: Park, Beomchan, et al.
Publicado: (2026)
por: Park, Beomchan, et al.
Publicado: (2026)
DenseGrounding: Improving Dense Language-Vision Semantics for Ego-Centric 3D Visual Grounding
por: Zheng, Henry, et al.
Publicado: (2025)
por: Zheng, Henry, et al.
Publicado: (2025)
Beyond Single Images: Retrieval Self-Augmented Unsupervised Camouflaged Object Detection
por: Du, Ji, et al.
Publicado: (2025)
por: Du, Ji, et al.
Publicado: (2025)
SemCity: Semantic Scene Generation with Triplane Diffusion
por: Lee, Jumin, et al.
Publicado: (2024)
por: Lee, Jumin, et al.
Publicado: (2024)
ReCon: Region-Controllable Data Augmentation with Rectification and Alignment for Object Detection
por: Zhu, Haowei, et al.
Publicado: (2025)
por: Zhu, Haowei, et al.
Publicado: (2025)
Enhancing Ground-to-Aerial Image Matching for Visual Misinformation Detection Using Semantic Segmentation
por: Mule, Emanuele, et al.
Publicado: (2025)
por: Mule, Emanuele, et al.
Publicado: (2025)
Automatic Prompt Generation and Grounding Object Detection for Zero-Shot Image Anomaly Detection
por: Cheung, Tsun-Hin, et al.
Publicado: (2024)
por: Cheung, Tsun-Hin, et al.
Publicado: (2024)
SemIRNet: A Semantic Irony Recognition Network for Multimodal Sarcasm Detection
por: Zhou, Jingxuan, et al.
Publicado: (2025)
por: Zhou, Jingxuan, et al.
Publicado: (2025)
Semantically Grounded QFormer for Efficient Vision Language Understanding
por: Choraria, Moulik, et al.
Publicado: (2023)
por: Choraria, Moulik, et al.
Publicado: (2023)
ShapeAug: Occlusion Augmentation for Event Camera Data
por: Bendig, Katharina, et al.
Publicado: (2024)
por: Bendig, Katharina, et al.
Publicado: (2024)
Augmented Commonsense Knowledge for Remote Object Grounding
por: Mohammadi, Bahram, et al.
Publicado: (2024)
por: Mohammadi, Bahram, et al.
Publicado: (2024)
Unified and Semantically Grounded Domain Adaptation for Medical Image Segmentation
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
Diverse Generation while Maintaining Semantic Coordination: A Diffusion-Based Data Augmentation Method for Object Detection
por: Nie, Sen, et al.
Publicado: (2024)
por: Nie, Sen, et al.
Publicado: (2024)
SemTalk: Holistic Co-speech Motion Generation with Frame-level Semantic Emphasis
por: Zhang, Xiangyue, et al.
Publicado: (2024)
por: Zhang, Xiangyue, et al.
Publicado: (2024)
An Open and Comprehensive Pipeline for Unified Object Grounding and Detection
por: Zhao, Xiangyu, et al.
Publicado: (2024)
por: Zhao, Xiangyu, et al.
Publicado: (2024)
Retrieval-Augmented Open-Vocabulary Object Detection
por: Kim, Jooyeon, et al.
Publicado: (2024)
por: Kim, Jooyeon, et al.
Publicado: (2024)
Floating No More: Object-Ground Reconstruction from a Single Image
por: Man, Yunze, et al.
Publicado: (2024)
por: Man, Yunze, et al.
Publicado: (2024)
Ejemplares similares
-
Scalable and Realistic Virtual Try-on Application for Foundation Makeup with Kubelka-Munk Theory
por: Pang, Hui, et al.
Publicado: (2025) -
Discovering Meaningful Units with Visually Grounded Semantics from Image Captions
por: Behjati, Melika, et al.
Publicado: (2025) -
MediAug: Exploring Visual Augmentation in Medical Imaging
por: Qi, Xuyin, et al.
Publicado: (2025) -
Parameter-Efficient Semantic Augmentation for Enhancing Open-Vocabulary Object Detection
por: Cao, Weihao, et al.
Publicado: (2026) -
PairAug: What Can Augmented Image-Text Pairs Do for Radiology?
por: Xie, Yutong, et al.
Publicado: (2024)