Salvato in:
| Autori principali: | Chiang, Chia-Yen, Fathy, Yasmin, Slabaugh, Gregory, Jaber, Mona |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2410.13039 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Valeo Near-Field: a novel dataset for pedestrian intent detection
di: Musabini, Antonyo, et al.
Pubblicazione: (2025)
di: Musabini, Antonyo, et al.
Pubblicazione: (2025)
FOAA: Flattened Outer Arithmetic Attention For Multimodal Tumor Classification
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
SuperCap: Multi-resolution Superpixel-based Image Captioning
di: Senior, Henry, et al.
Pubblicazione: (2025)
di: Senior, Henry, et al.
Pubblicazione: (2025)
RoGUENeRF: A Robust Geometry-Consistent Universal Enhancer for NeRF
di: Catley-Chandar, Sibi, et al.
Pubblicazione: (2024)
di: Catley-Chandar, Sibi, et al.
Pubblicazione: (2024)
Graph Neural Networks in Vision-Language Image Understanding: A Survey
di: Senior, Henry, et al.
Pubblicazione: (2023)
di: Senior, Henry, et al.
Pubblicazione: (2023)
CAMS: Convolution and Attention-Free Mamba-based Cardiac Image Segmentation
di: Khan, Abbas, et al.
Pubblicazione: (2024)
di: Khan, Abbas, et al.
Pubblicazione: (2024)
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
di: Yang, Xiaohang, et al.
Pubblicazione: (2025)
di: Yang, Xiaohang, et al.
Pubblicazione: (2025)
MOAB: Multi-Modal Outer Arithmetic Block For Fusion Of Histopathological Images And Genetic Data For Brain Tumor Grading
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
di: Fu, Qifan, et al.
Pubblicazione: (2024)
di: Fu, Qifan, et al.
Pubblicazione: (2024)
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
di: Fu, Qifan, et al.
Pubblicazione: (2025)
di: Fu, Qifan, et al.
Pubblicazione: (2025)
CoLoRSMamba: Conditional LoRA-Steered Mamba for Supervised Multimodal Violence Detection
di: Senadeera, Damith Chamalke, et al.
Pubblicazione: (2026)
di: Senadeera, Damith Chamalke, et al.
Pubblicazione: (2026)
Exploring contextual modeling with linear complexity for point cloud segmentation
di: Chng, Yong Xien, et al.
Pubblicazione: (2024)
di: Chng, Yong Xien, et al.
Pubblicazione: (2024)
ViDAR: Video Diffusion-Aware 4D Reconstruction From Monocular Inputs
di: Nazarczuk, Michal, et al.
Pubblicazione: (2025)
di: Nazarczuk, Michal, et al.
Pubblicazione: (2025)
CUE-Net: Violence Detection Video Analytics with Spatial Cropping, Enhanced UniformerV2 and Modified Efficient Additive Attention
di: Senadeera, Damith Chamalke, et al.
Pubblicazione: (2024)
di: Senadeera, Damith Chamalke, et al.
Pubblicazione: (2024)
Compositional Segmentation of Cardiac Images Leveraging Metadata
di: Khan, Abbas, et al.
Pubblicazione: (2024)
di: Khan, Abbas, et al.
Pubblicazione: (2024)
Multi-view Cardiac Image Segmentation via Trans-Dimensional Priors
di: Khan, Abbas, et al.
Pubblicazione: (2024)
di: Khan, Abbas, et al.
Pubblicazione: (2024)
Crop and Couple: cardiac image segmentation using interlinked specialist networks
di: Khan, Abbas, et al.
Pubblicazione: (2024)
di: Khan, Abbas, et al.
Pubblicazione: (2024)
IJmond Industrial Smoke Segmentation Dataset
di: Hsu, Yen-Chia, et al.
Pubblicazione: (2026)
di: Hsu, Yen-Chia, et al.
Pubblicazione: (2026)
A lightweight YOLOv5-FFM model for occlusion pedestrian detection
di: Luo, Xiangjie, et al.
Pubblicazione: (2024)
di: Luo, Xiangjie, et al.
Pubblicazione: (2024)
A multimodal ensemble approach for clear cell renal cell carcinoma treatment outcome prediction
di: Chen, Meixu, et al.
Pubblicazione: (2024)
di: Chen, Meixu, et al.
Pubblicazione: (2024)
Improving Interpretability and Robustness for the Detection of AI-Generated Images
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
Multimodal Outer Arithmetic Block Dual Fusion of Whole Slide Images and Omics Data for Precision Oncology
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
HandSCS: Structural Coordinate Space for Animatable Hand Gaussian Splatting
di: Dong, Yilan, et al.
Pubblicazione: (2025)
di: Dong, Yilan, et al.
Pubblicazione: (2025)
Bridging Synthetic and Real-World Domains: A Human-in-the-Loop Weakly-Supervised Framework for Industrial Toxic Emission Segmentation
di: Tao, Yida, et al.
Pubblicazione: (2025)
di: Tao, Yida, et al.
Pubblicazione: (2025)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
OpenUS: A Fully Open-Source Foundation Model for Ultrasound Image Analysis via Self-Adaptive Masked Contrastive Learning
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
Deep learning-based approach for tomato classification in complex scenes
di: Mousse, Mikael A., et al.
Pubblicazione: (2024)
di: Mousse, Mikael A., et al.
Pubblicazione: (2024)
An ensemble deep learning approach to detect tumors on Mohs micrographic surgery slides
di: Yilmaz, Abdurrahim, et al.
Pubblicazione: (2025)
di: Yilmaz, Abdurrahim, et al.
Pubblicazione: (2025)
Exploring CNN-based models for image's aesthetic score prediction with using ensemble
di: Dai, Ying
Pubblicazione: (2022)
di: Dai, Ying
Pubblicazione: (2022)
FlexHDR: Modelling Alignment and Exposure Uncertainties for Flexible HDR Imaging
di: Catley-Chandar, Sibi, et al.
Pubblicazione: (2022)
di: Catley-Chandar, Sibi, et al.
Pubblicazione: (2022)
Dual Branch VideoMamba with Gated Class Token Fusion for Violence Detection
di: Senadeera, Damith Chamalke, et al.
Pubblicazione: (2025)
di: Senadeera, Damith Chamalke, et al.
Pubblicazione: (2025)
ProtoPathway: Biologically Structured Prototype-Pathway Fusion for Multimodal Cancer Survival Prediction
di: Gallagher-Syed, Amaya, et al.
Pubblicazione: (2026)
di: Gallagher-Syed, Amaya, et al.
Pubblicazione: (2026)
Learning better representations for crowded pedestrians in offboard LiDAR-camera 3D tracking-by-detection
di: Li, Shichao, et al.
Pubblicazione: (2025)
di: Li, Shichao, et al.
Pubblicazione: (2025)
ISLA: A U-Net for MRI-based acute ischemic stroke lesion segmentation with deep supervision, attention, domain adaptation, and ensemble learning
di: Roca, Vincent, et al.
Pubblicazione: (2026)
di: Roca, Vincent, et al.
Pubblicazione: (2026)
Global Context Modeling in YOLOv8 for Pediatric Wrist Fracture Detection
di: Ju, Rui-Yang, et al.
Pubblicazione: (2024)
di: Ju, Rui-Yang, et al.
Pubblicazione: (2024)
Efficient auto-labeling of large-scale poultry datasets (ALPD) using an ensemble model with self- and active-learning approaches
di: Bist, Ramesh Bahadur, et al.
Pubblicazione: (2025)
di: Bist, Ramesh Bahadur, et al.
Pubblicazione: (2025)
DanceChat: Large Language Model-Guided Music-to-Dance Generation
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
PHATNet: A Physics-guided Haze Transfer Network for Domain-adaptive Real-world Image Dehazing
di: Tsai, Fu-Jen, et al.
Pubblicazione: (2025)
di: Tsai, Fu-Jen, et al.
Pubblicazione: (2025)
DVD: A Comprehensive Dataset for Advancing Violence Detection in Real-World Scenarios
di: Kollias, Dimitrios, et al.
Pubblicazione: (2025)
di: Kollias, Dimitrios, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Valeo Near-Field: a novel dataset for pedestrian intent detection
di: Musabini, Antonyo, et al.
Pubblicazione: (2025) -
FOAA: Flattened Outer Arithmetic Attention For Multimodal Tumor Classification
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024) -
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024) -
SuperCap: Multi-resolution Superpixel-based Image Captioning
di: Senior, Henry, et al.
Pubblicazione: (2025) -
RoGUENeRF: A Robust Geometry-Consistent Universal Enhancer for NeRF
di: Catley-Chandar, Sibi, et al.
Pubblicazione: (2024)