ShellfishNet: A Domain-Specific Benchmark for Visual Recognition of Marine Molluscs
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhou, Ziheng, Wang, Yang, Wang, Nan, Wu, Chengliang, Yan, Jun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
InfoSyncNet: Information Synchronization Temporal Convolutional Network for Visual Speech Recognition
von: Xue, Junxiao, et al.
Veröffentlicht: (2025)
von: Xue, Junxiao, et al.
Veröffentlicht: (2025)
VideoNet: A Large-Scale Dataset for Domain-Specific Action Recognition
von: Yadav, Tanush, et al.
Veröffentlicht: (2026)
von: Yadav, Tanush, et al.
Veröffentlicht: (2026)
OptiSAR-Net++: A Large-Scale Benchmark and Transformer-Free Framework for Cross-Domain Remote Sensing Visual Grounding
von: Tang, Xiaoyu, et al.
Veröffentlicht: (2026)
von: Tang, Xiaoyu, et al.
Veröffentlicht: (2026)
AVAR-Net: A Lightweight Audio-Visual Anomaly Recognition Framework with a Benchmark Dataset
von: Ali, Amjid, et al.
Veröffentlicht: (2025)
von: Ali, Amjid, et al.
Veröffentlicht: (2025)
Visual Instruction Pretraining for Domain-Specific Foundation Models
von: Li, Yuxuan, et al.
Veröffentlicht: (2025)
von: Li, Yuxuan, et al.
Veröffentlicht: (2025)
Visual Question Answering Instruction: Unlocking Multimodal Large Language Model To Domain-Specific Visual Multitasks
von: Lee, Jusung, et al.
Veröffentlicht: (2024)
von: Lee, Jusung, et al.
Veröffentlicht: (2024)
MFH: Marrying Frequency Domain with Handwritten Mathematical Expression Recognition
von: Yang, Huanxin, et al.
Veröffentlicht: (2025)
von: Yang, Huanxin, et al.
Veröffentlicht: (2025)
MMDG-Bench: A Benchmark for Multimodal Domain Generalization
von: Zhan, Qianshan, et al.
Veröffentlicht: (2026)
von: Zhan, Qianshan, et al.
Veröffentlicht: (2026)
4Seasons: Benchmarking Visual SLAM and Long-Term Localization for Autonomous Driving in Challenging Conditions
von: Wenzel, Patrick, et al.
Veröffentlicht: (2022)
von: Wenzel, Patrick, et al.
Veröffentlicht: (2022)
MolParser: End-to-end Visual Recognition of Molecule Structures in the Wild
von: Fang, Xi, et al.
Veröffentlicht: (2024)
von: Fang, Xi, et al.
Veröffentlicht: (2024)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
von: Zhang, Xiaoman, et al.
Veröffentlicht: (2023)
von: Zhang, Xiaoman, et al.
Veröffentlicht: (2023)
Virtual Classification: Modulating Domain-Specific Knowledge for Multidomain Crowd Counting
von: Guo, Mingyue, et al.
Veröffentlicht: (2024)
von: Guo, Mingyue, et al.
Veröffentlicht: (2024)
A$^{3}$lign-DFER: Pioneering Comprehensive Dynamic Affective Alignment for Dynamic Facial Expression Recognition with CLIP
von: Tao, Zeng, et al.
Veröffentlicht: (2024)
von: Tao, Zeng, et al.
Veröffentlicht: (2024)
OphNet: A Large-Scale Video Benchmark for Ophthalmic Surgical Workflow Understanding
von: Hu, Ming, et al.
Veröffentlicht: (2024)
von: Hu, Ming, et al.
Veröffentlicht: (2024)
Unsupervised Domain Adaptation with Dynamic Clustering and Contrastive Refinement for Gait Recognition
von: Liu, Xiaolei, et al.
Veröffentlicht: (2025)
von: Liu, Xiaolei, et al.
Veröffentlicht: (2025)
BizGenEval: A Systematic Benchmark for Commercial Visual Content Generation
von: Li, Yan, et al.
Veröffentlicht: (2026)
von: Li, Yan, et al.
Veröffentlicht: (2026)
Benchmarking Micro-action Recognition: Dataset, Methods, and Applications
von: Guo, Dan, et al.
Veröffentlicht: (2024)
von: Guo, Dan, et al.
Veröffentlicht: (2024)
U-Bench: A Comprehensive Understanding of U-Net through 100-Variant Benchmarking
von: Tang, Fenghe, et al.
Veröffentlicht: (2025)
von: Tang, Fenghe, et al.
Veröffentlicht: (2025)
MoiréNet: A Compact Dual-Domain Network for Image Demoiréing
von: Guo, Shuwei, et al.
Veröffentlicht: (2025)
von: Guo, Shuwei, et al.
Veröffentlicht: (2025)
From Generalist to Specialist: Adapting Vision Language Models via Task-Specific Visual Instruction Tuning
von: Bai, Yang, et al.
Veröffentlicht: (2024)
von: Bai, Yang, et al.
Veröffentlicht: (2024)
VicKAM: Visual Conceptual Knowledge Guided Action Map for Weakly Supervised Group Activity Recognition
von: Wang, Zhuming, et al.
Veröffentlicht: (2025)
von: Wang, Zhuming, et al.
Veröffentlicht: (2025)
ActionAtlas: A VideoQA Benchmark for Domain-specialized Action Recognition
von: Salehi, Mohammadreza, et al.
Veröffentlicht: (2024)
von: Salehi, Mohammadreza, et al.
Veröffentlicht: (2024)
On the Estimation of Image-matching Uncertainty in Visual Place Recognition
von: Zaffar, Mubariz, et al.
Veröffentlicht: (2024)
von: Zaffar, Mubariz, et al.
Veröffentlicht: (2024)
Cascade-Free Mandarin Visual Speech Recognition via Semantic-Guided Cross-Representation Alignment
von: Yang, Lei, et al.
Veröffentlicht: (2026)
von: Yang, Lei, et al.
Veröffentlicht: (2026)
Region-aware Spatiotemporal Modeling with Collaborative Domain Generalization for Cross-Subject EEG Emotion Recognition
von: Wu, Weiwei, et al.
Veröffentlicht: (2026)
von: Wu, Weiwei, et al.
Veröffentlicht: (2026)
Ghost-dil-NetVLAD: A Lightweight Neural Network for Visual Place Recognition
von: Gong, Qingyuan, et al.
Veröffentlicht: (2021)
von: Gong, Qingyuan, et al.
Veröffentlicht: (2021)
A Survey on Interpretability in Visual Recognition
von: Wan, Qiyang, et al.
Veröffentlicht: (2025)
von: Wan, Qiyang, et al.
Veröffentlicht: (2025)
Bridging Domain Generalization to Multimodal Domain Generalization via Unified Representations
von: Huang, Hai, et al.
Veröffentlicht: (2025)
von: Huang, Hai, et al.
Veröffentlicht: (2025)
Chimera: Improving Generalist Model with Domain-Specific Experts
von: Peng, Tianshuo, et al.
Veröffentlicht: (2024)
von: Peng, Tianshuo, et al.
Veröffentlicht: (2024)
Knowledge-Aligned Counterfactual-Enhancement Diffusion Perception for Unsupervised Cross-Domain Visual Emotion Recognition
von: Yin, Wen, et al.
Veröffentlicht: (2025)
von: Yin, Wen, et al.
Veröffentlicht: (2025)
Deep Learning for Cross-Domain Few-Shot Visual Recognition: A Survey
von: Xu, Huali, et al.
Veröffentlicht: (2023)
von: Xu, Huali, et al.
Veröffentlicht: (2023)
OmniEval: A Benchmark for Evaluating Omni-modal Models with Visual, Auditory, and Textual Inputs
von: Zhang, Yiman, et al.
Veröffentlicht: (2025)
von: Zhang, Yiman, et al.
Veröffentlicht: (2025)
Certified L2-Norm Robustness of 3D Point Cloud Recognition in the Frequency Domain
von: Zhou, Liang, et al.
Veröffentlicht: (2025)
von: Zhou, Liang, et al.
Veröffentlicht: (2025)
Camera-LiDAR Cross-modality Gait Recognition
von: Guo, Wenxuan, et al.
Veröffentlicht: (2024)
von: Guo, Wenxuan, et al.
Veröffentlicht: (2024)
ChartAct: A Benchmark for Dynamic Chart Understanding
von: Huang, Muye, et al.
Veröffentlicht: (2026)
von: Huang, Muye, et al.
Veröffentlicht: (2026)
Optimizing Domain-Specific Image Retrieval: A Benchmark of FAISS and Annoy with Fine-Tuned Features
von: Rahman, MD Shaikh, et al.
Veröffentlicht: (2024)
von: Rahman, MD Shaikh, et al.
Veröffentlicht: (2024)
Understanding Dataset Bias in Medical Imaging: A Case Study on Chest X-rays
von: Dack, Ethan, et al.
Veröffentlicht: (2025)
von: Dack, Ethan, et al.
Veröffentlicht: (2025)
Evaluating Few-Shot Pill Recognition Under Visual Domain Shift
von: Chu, W. I., et al.
Veröffentlicht: (2026)
von: Chu, W. I., et al.
Veröffentlicht: (2026)
A Visual Self-attention Mechanism Facial Expression Recognition Network beyond Convnext
von: Nan, Bingyu, et al.
Veröffentlicht: (2025)
von: Nan, Bingyu, et al.
Veröffentlicht: (2025)
EraW-Net: Enhance-Refine-Align W-Net for Scene-Associated Driver Attention Estimation
von: Zhou, Jun, et al.
Veröffentlicht: (2024)
von: Zhou, Jun, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
InfoSyncNet: Information Synchronization Temporal Convolutional Network for Visual Speech Recognition
von: Xue, Junxiao, et al.
Veröffentlicht: (2025) -
VideoNet: A Large-Scale Dataset for Domain-Specific Action Recognition
von: Yadav, Tanush, et al.
Veröffentlicht: (2026) -
OptiSAR-Net++: A Large-Scale Benchmark and Transformer-Free Framework for Cross-Domain Remote Sensing Visual Grounding
von: Tang, Xiaoyu, et al.
Veröffentlicht: (2026) -
AVAR-Net: A Lightweight Audio-Visual Anomaly Recognition Framework with a Benchmark Dataset
von: Ali, Amjid, et al.
Veröffentlicht: (2025) -
Visual Instruction Pretraining for Domain-Specific Foundation Models
von: Li, Yuxuan, et al.
Veröffentlicht: (2025)