Event-Enriched Image Analysis Grand Challenge at ACM Multimedia 2025
Fuente:
arXiv
Guardado en:
| Autores principales: | Tran, Thien-Phuc, Nguyen, Minh-Quang, Tran, Minh-Triet, Nguyen, Tam V., Do, Trong-Le, Ly, Duy-Nam, Huynh, Viet-Tham, Le, Khanh-Duy, Tran, Mai-Khiem, Le, Trung-Nghia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ARtVista: Gateway To Empower Anyone Into Artist
por: Hoang, Trong-Vu, et al.
Publicado: (2024)
por: Hoang, Trong-Vu, et al.
Publicado: (2024)
Graphilosophy: Graph-Based Digital Humanities Computing with The Four Books
por: Do, Minh-Thu, et al.
Publicado: (2026)
por: Do, Minh-Thu, et al.
Publicado: (2026)
iCONTRA: Toward Thematic Collection Design Via Interactive Concept Transfer
por: Vo, Dinh-Khoi, et al.
Publicado: (2024)
por: Vo, Dinh-Khoi, et al.
Publicado: (2024)
OpenEvents V1: Large-Scale Benchmark Dataset for Multimodal Event Grounding
por: Nguyen, Hieu, et al.
Publicado: (2025)
por: Nguyen, Hieu, et al.
Publicado: (2025)
Interactive Interface For Semantic Segmentation Dataset Synthesis
por: Tran, Ngoc-Do, et al.
Publicado: (2025)
por: Tran, Ngoc-Do, et al.
Publicado: (2025)
Automated Image Recognition Framework
por: Nguyen, Quang-Binh, et al.
Publicado: (2025)
por: Nguyen, Quang-Binh, et al.
Publicado: (2025)
TaleForge: Interactive Multimodal System for Personalized Story Creation
por: Nguyen, Minh-Loi, et al.
Publicado: (2025)
por: Nguyen, Minh-Loi, et al.
Publicado: (2025)
GenKOL: Modular Generative AI Framework For Scalable Virtual KOL Generation
por: To, Tan-Hiep, et al.
Publicado: (2025)
por: To, Tan-Hiep, et al.
Publicado: (2025)
ACM Multimedia Grand Challenge on ENT Endoscopy Analysis
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
EventCap
por: Nguyen, Phuc-Tan, et al.
Publicado: (2024)
por: Nguyen, Phuc-Tan, et al.
Publicado: (2024)
GenFlow: Interactive Modular System for Image Generation
por: Nguyen, Duc-Hung, et al.
Publicado: (2025)
por: Nguyen, Duc-Hung, et al.
Publicado: (2025)
CamoFA: A Learnable Fourier-based Augmentation for Camouflage Segmentation
por: Le, Minh-Quan, et al.
Publicado: (2023)
por: Le, Minh-Quan, et al.
Publicado: (2023)
ShowFlow: From Robust Single Concept to Condition-Free Multi-Concept Generation
por: Hoang, Trong-Vu, et al.
Publicado: (2025)
por: Hoang, Trong-Vu, et al.
Publicado: (2025)
GUNNEL: Guided Mixup Augmentation and Multi-Model Fusion for Aquatic Animal Segmentation
por: Le, Minh-Quan, et al.
Publicado: (2021)
por: Le, Minh-Quan, et al.
Publicado: (2021)
MaskDiff: Modeling Mask Distribution with Diffusion Probabilistic Model for Few-Shot Instance Segmentation
por: Le, Minh-Quan, et al.
Publicado: (2023)
por: Le, Minh-Quan, et al.
Publicado: (2023)
Efficient 3D Brain Tumor Segmentation with Axial-Coronal-Sagittal Embedding
por: Huynh, Tuan-Luc, et al.
Publicado: (2025)
por: Huynh, Tuan-Luc, et al.
Publicado: (2025)
Shape2Animal: Creative Animal Generation from Natural Silhouettes
por: Tran, Quoc-Duy, et al.
Publicado: (2025)
por: Tran, Quoc-Duy, et al.
Publicado: (2025)
MasHeNe: A Benchmark for Head and Neck CT Mass Segmentation using Window-Enhanced Mamba with Frequency-Domain Integration
por: Dao, Thao Thi Phuong, et al.
Publicado: (2025)
por: Dao, Thao Thi Phuong, et al.
Publicado: (2025)
Toward Content-based Indexing and Retrieval of Head and Neck CT with Abscess Segmentation
por: Dao, Thao Thi Phuong, et al.
Publicado: (2025)
por: Dao, Thao Thi Phuong, et al.
Publicado: (2025)
Robust Deepfake Detection: Mitigating Spatial Attention Drift via Calibrated Complementary Ensembles
por: Le-Phan, Minh-Khoa, et al.
Publicado: (2026)
por: Le-Phan, Minh-Khoa, et al.
Publicado: (2026)
EDGER: EDge-Guided with HEatmap Refinement for Generalizable Image Forgery Localization
por: Le-Phan, Minh-Khoa, et al.
Publicado: (2026)
por: Le-Phan, Minh-Khoa, et al.
Publicado: (2026)
CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing
por: Vo, Dinh-Khoi, et al.
Publicado: (2025)
por: Vo, Dinh-Khoi, et al.
Publicado: (2025)
PANDORA: Pixel-wise Attention Dissolution and Latent Guidance for Zero-Shot Object Removal
por: Vo, Dinh-Khoi, et al.
Publicado: (2026)
por: Vo, Dinh-Khoi, et al.
Publicado: (2026)
SVM On Trees
por: Tran, Cong-Huan, et al.
Publicado: (2026)
por: Tran, Cong-Huan, et al.
Publicado: (2026)
SAMURAI: Shape-Aware Multimodal Retrieval for 3D Object Identification
por: Vo, Dinh-Khoi, et al.
Publicado: (2025)
por: Vo, Dinh-Khoi, et al.
Publicado: (2025)
EVENT-Retriever: Event-Aware Multimodal Image Retrieval for Realistic Captions
por: Vo, Dinh-Khoi, et al.
Publicado: (2025)
por: Vo, Dinh-Khoi, et al.
Publicado: (2025)
Ensemble Learning for Vietnamese Scene Text Spotting in Urban Environments
por: Nguyen, Hieu, et al.
Publicado: (2024)
por: Nguyen, Hieu, et al.
Publicado: (2024)
KiseKloset for Fashion Retrieval and Recommendation
por: Phan-Nguyen, Thanh-Tung, et al.
Publicado: (2025)
por: Phan-Nguyen, Thanh-Tung, et al.
Publicado: (2025)
FaR: Enhancing Multi-Concept Text-to-Image Diffusion via Concept Fusion and Localized Refinement
por: Tran, Gia-Nghia, et al.
Publicado: (2025)
por: Tran, Gia-Nghia, et al.
Publicado: (2025)
TF-SASM: Training-free Spatial-aware Sparse Memory for Multi-object Tracking
por: Nguyen-Quang, Thuc, et al.
Publicado: (2024)
por: Nguyen-Quang, Thuc, et al.
Publicado: (2024)
VisionGuard: Synergistic Framework for Helmet Violation Detection
por: Nguyen, Lam-Huy, et al.
Publicado: (2025)
por: Nguyen, Lam-Huy, et al.
Publicado: (2025)
ReCap: Event-Aware Image Captioning with Article Retrieval and Semantic Gaussian Normalization
por: Nguyen, Thinh-Phuc, et al.
Publicado: (2025)
por: Nguyen, Thinh-Phuc, et al.
Publicado: (2025)
SHREC 2025: Retrieval of Optimal Objects for Multi-modal Enhanced Language and Spatial Assistance (ROOMELSA)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
por: Nguyen, Trong-Thuan, et al.
Publicado: (2025)
Perceptions of Modernized Anatomy Teaching Tools and Methods: A Mixed Method Study Among Medical, Nursing Students and Faculty
por: Quang Thanh Nguyen, et al.
Publicado: (2025)
por: Quang Thanh Nguyen, et al.
Publicado: (2025)
Revisiting Kernel Attention with Correlated Gaussian Process Representation
por: Bui, Long Minh, et al.
Publicado: (2025)
por: Bui, Long Minh, et al.
Publicado: (2025)
A Comprehensive Digital Workflow for the Treatment of Excessive Gingival Display Caused by Altered Passive Eruption: A Prospective Case Series
por: Nguyen Trong Tinh, et al.
Publicado: (2026)
por: Nguyen Trong Tinh, et al.
Publicado: (2026)
Enhancing Video Summarization with Context Awareness
por: Huynh-Lam, Hai-Dang, et al.
Publicado: (2024)
por: Huynh-Lam, Hai-Dang, et al.
Publicado: (2024)
Cluster-based Video Summarization with Temporal Context Awareness
por: Huynh-Lam, Hai-Dang, et al.
Publicado: (2024)
por: Huynh-Lam, Hai-Dang, et al.
Publicado: (2024)
Beyond Vision: Contextually Enriched Image Captioning with Multi-Modal Retrieval
por: Quy, Nguyen Lam Phu, et al.
Publicado: (2025)
por: Quy, Nguyen Lam Phu, et al.
Publicado: (2025)
KAT: Dependency-aware Automated API Testing with Large Language Models
por: Le, Tri, et al.
Publicado: (2024)
por: Le, Tri, et al.
Publicado: (2024)
Ejemplares similares
-
ARtVista: Gateway To Empower Anyone Into Artist
por: Hoang, Trong-Vu, et al.
Publicado: (2024) -
Graphilosophy: Graph-Based Digital Humanities Computing with The Four Books
por: Do, Minh-Thu, et al.
Publicado: (2026) -
iCONTRA: Toward Thematic Collection Design Via Interactive Concept Transfer
por: Vo, Dinh-Khoi, et al.
Publicado: (2024) -
OpenEvents V1: Large-Scale Benchmark Dataset for Multimodal Event Grounding
por: Nguyen, Hieu, et al.
Publicado: (2025) -
Interactive Interface For Semantic Segmentation Dataset Synthesis
por: Tran, Ngoc-Do, et al.
Publicado: (2025)