Enregistré dans:
| Auteurs principaux: | Wu, Yihao, Zhao, Di, Zhang, Jingfeng, Koh, Yun Sing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2410.22927 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MetaWild: A Multimodal Dataset for Animal Re-Identification with Environmental Metadata
par: Li, Yuzhuo, et autres
Publié: (2025)
par: Li, Yuzhuo, et autres
Publié: (2025)
Animal Re-Identification on Microcontrollers
par: Chen, Yubo, et autres
Publié: (2025)
par: Chen, Yubo, et autres
Publié: (2025)
Sequence Transferability and Task Order Selection in Continual Learning
par: Nguyen, Thinh, et autres
Publié: (2025)
par: Nguyen, Thinh, et autres
Publié: (2025)
Knowledge-Guided Failure Prediction: Detecting When Object Detectors Miss Safety-Critical Objects
par: Zimmermann, Jakob Paul, et autres
Publié: (2026)
par: Zimmermann, Jakob Paul, et autres
Publié: (2026)
Identity documents recognition and detection using semantic segmentation with convolutional neural network
par: Kozlenko, Mykola, et autres
Publié: (2025)
par: Kozlenko, Mykola, et autres
Publié: (2025)
SPARF: Large-Scale Learning of 3D Sparse Radiance Fields from Few Input Images
par: Hamdi, Abdullah, et autres
Publié: (2022)
par: Hamdi, Abdullah, et autres
Publié: (2022)
Towards Optimal Convolutional Transfer Learning Architectures for Breast Lesion Classification and ACL Tear Detection
par: Frees, Daniel, et autres
Publié: (2025)
par: Frees, Daniel, et autres
Publié: (2025)
Harmony: A Joint Self-Supervised and Weakly-Supervised Framework for Learning General Purpose Visual Representations
par: Baharoon, Mohammed, et autres
Publié: (2024)
par: Baharoon, Mohammed, et autres
Publié: (2024)
CNNtention: Can CNNs do better with Attention?
par: Kapila, Nikhil, et autres
Publié: (2024)
par: Kapila, Nikhil, et autres
Publié: (2024)
Explainable Image Similarity: Integrating Siamese Networks and Grad-CAM
par: Livieris, Ioannis E., et autres
Publié: (2023)
par: Livieris, Ioannis E., et autres
Publié: (2023)
Spatial-ViLT: Enhancing Visual Spatial Reasoning through Multi-Task Learning
par: Islam, Chashi Mahiul, et autres
Publié: (2025)
par: Islam, Chashi Mahiul, et autres
Publié: (2025)
A review of Recent Techniques for Person Re-Identification
par: Asperti, Andrea, et autres
Publié: (2025)
par: Asperti, Andrea, et autres
Publié: (2025)
RefineFormer3D: Efficient 3D Medical Image Segmentation via Adaptive Multi-Scale Transformer with Cross Attention Fusion
par: Tyagi, Kavyansh, et autres
Publié: (2026)
par: Tyagi, Kavyansh, et autres
Publié: (2026)
Less Detail, Better Answers: Degradation-Driven Prompting for VQA
par: Han, Haoxuan, et autres
Publié: (2026)
par: Han, Haoxuan, et autres
Publié: (2026)
Search Multilayer Perceptron-Based Fusion for Efficient and Accurate Siamese Tracking
par: Shen, Tianqi, et autres
Publié: (2026)
par: Shen, Tianqi, et autres
Publié: (2026)
SegQC: a segmentation network-based framework for multi-metric segmentation quality control and segmentation error detection in volumetric medical images
par: Specktor-Fadida, Bella, et autres
Publié: (2024)
par: Specktor-Fadida, Bella, et autres
Publié: (2024)
3D Reconstruction from Sketches
par: Talwar, Abhimanyu, et autres
Publié: (2025)
par: Talwar, Abhimanyu, et autres
Publié: (2025)
Instance Segmentation for Point Sets
par: Talwar, Abhimanyu, et autres
Publié: (2025)
par: Talwar, Abhimanyu, et autres
Publié: (2025)
Overcoming Catastrophic Forgetting in Federated Class-Incremental Learning via Federated Global Twin Generator
par: Nguyen, Thinh, et autres
Publié: (2024)
par: Nguyen, Thinh, et autres
Publié: (2024)
LayerAct: Advanced Activation Mechanism for Robust Inference of CNNs
par: Yoon, Kihyuk, et autres
Publié: (2023)
par: Yoon, Kihyuk, et autres
Publié: (2023)
Fast Data Aware Neural Architecture Search via Supernet Accelerated Evaluation
par: Njor, Emil, et autres
Publié: (2025)
par: Njor, Emil, et autres
Publié: (2025)
Model-agnostic Adversarial Attack and Defense for Vision-Language-Action Models
par: Xu, Haochuan, et autres
Publié: (2025)
par: Xu, Haochuan, et autres
Publié: (2025)
TALON: Test-time Adaptive Learning for On-the-Fly Category Discovery
par: Wu, Yanan, et autres
Publié: (2026)
par: Wu, Yanan, et autres
Publié: (2026)
Privacy-Preserving Low-Rank Adaptation against Membership Inference Attacks for Latent Diffusion Models
par: Luo, Zihao, et autres
Publié: (2024)
par: Luo, Zihao, et autres
Publié: (2024)
Modular Deep Learning Framework for Assistive Perception: Gaze, Affect, and Speaker Identification
par: Anchan, Akshit Pramod, et autres
Publié: (2025)
par: Anchan, Akshit Pramod, et autres
Publié: (2025)
LADI v2: Multi-label Dataset and Classifiers for Low-Altitude Disaster Imagery
par: Scheele, Samuel, et autres
Publié: (2024)
par: Scheele, Samuel, et autres
Publié: (2024)
Classifying Healthy and Defective Fruits with a Multi-Input Architecture and CNN Models
par: Chuquimarca, Luis, et autres
Publié: (2024)
par: Chuquimarca, Luis, et autres
Publié: (2024)
Enhancing Apple's Defect Classification: Insights from Visible Spectrum and Narrow Spectral Band Imaging
par: Coello, Omar, et autres
Publié: (2024)
par: Coello, Omar, et autres
Publié: (2024)
Unsupervised Anomaly Detection Using Diffusion Trend Analysis for Display Inspection
par: Kim, Eunwoo, et autres
Publié: (2024)
par: Kim, Eunwoo, et autres
Publié: (2024)
On the Inherent Robustness of One-Stage Object Detection against Out-of-Distribution Data
par: Martinez-Seras, Aitor, et autres
Publié: (2024)
par: Martinez-Seras, Aitor, et autres
Publié: (2024)
Nearest Neighbor Projection Removal Adversarial Training
par: Singh, Himanshu, et autres
Publié: (2025)
par: Singh, Himanshu, et autres
Publié: (2025)
MotionFollower: Editing Video Motion via Lightweight Score-Guided Diffusion
par: Tu, Shuyuan, et autres
Publié: (2024)
par: Tu, Shuyuan, et autres
Publié: (2024)
Inclusive AI for Group Interactions: Predicting Gaze-Direction Behaviors in People with Intellectual and Developmental Disabilities
par: Huang, Giulia, et autres
Publié: (2026)
par: Huang, Giulia, et autres
Publié: (2026)
AMANet: Advancing SAR Ship Detection with Adaptive Multi-Hierarchical Attention Network
par: Ma, Xiaolin, et autres
Publié: (2024)
par: Ma, Xiaolin, et autres
Publié: (2024)
MvBody: Multi-View-Based Hybrid Transformer Using Optical 3D Body Scan for Explainable Cesarean Section Prediction
par: Cheng, Ruting, et autres
Publié: (2025)
par: Cheng, Ruting, et autres
Publié: (2025)
OptiRoulette Optimizer: A New Stochastic Meta-Optimizer for up to 5.3x Faster Convergence
par: Mastromichalakis, Stamatis
Publié: (2026)
par: Mastromichalakis, Stamatis
Publié: (2026)
Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models
par: Li, Jinhao, et autres
Publié: (2024)
par: Li, Jinhao, et autres
Publié: (2024)
The MSR-Video to Text Dataset with Clean Annotations
par: Chen, Haoran, et autres
Publié: (2021)
par: Chen, Haoran, et autres
Publié: (2021)
Large Language Models Powered Context-aware Motion Prediction in Autonomous Driving
par: Zheng, Xiaoji, et autres
Publié: (2024)
par: Zheng, Xiaoji, et autres
Publié: (2024)
Towards Multilingual Audio-Visual Question Answering
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Documents similaires
-
MetaWild: A Multimodal Dataset for Animal Re-Identification with Environmental Metadata
par: Li, Yuzhuo, et autres
Publié: (2025) -
Animal Re-Identification on Microcontrollers
par: Chen, Yubo, et autres
Publié: (2025) -
Sequence Transferability and Task Order Selection in Continual Learning
par: Nguyen, Thinh, et autres
Publié: (2025) -
Knowledge-Guided Failure Prediction: Detecting When Object Detectors Miss Safety-Critical Objects
par: Zimmermann, Jakob Paul, et autres
Publié: (2026) -
Identity documents recognition and detection using semantic segmentation with convolutional neural network
par: Kozlenko, Mykola, et autres
Publié: (2025)