Insect-Foundation: A Foundation Model and Large-scale 1M Dataset for Visual Insect Understanding
Fuente:
arXiv
Saved in:
| Main Authors: | Nguyen, Hoang-Quan, Truong, Thanh-Dat, Nguyen, Xuan Bac, Dowling, Ashley, Li, Xin, Luu, Khoa |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding
by: Truong, Thanh-Dat, et al.
Published: (2025)
by: Truong, Thanh-Dat, et al.
Published: (2025)
BRAIN: Bias-Mitigation Continual Learning Approach to Vision-Brain Understanding
by: Nguyen, Xuan-Bac, et al.
Published: (2025)
by: Nguyen, Xuan-Bac, et al.
Published: (2025)
Multi-view Action Recognition via Directed Gromov-Wasserstein Discrepancy
by: Nguyen, Hoang-Quan, et al.
Published: (2024)
by: Nguyen, Hoang-Quan, et al.
Published: (2024)
Cross-view Action Recognition Understanding From Exocentric to Egocentric Perspective
by: Truong, Thanh-Dat, et al.
Published: (2023)
by: Truong, Thanh-Dat, et al.
Published: (2023)
ED-SAM: An Efficient Diffusion Sampling Approach to Domain Generalization in Vision-Language Foundation Models
by: Truong, Thanh-Dat, et al.
Published: (2024)
by: Truong, Thanh-Dat, et al.
Published: (2024)
Hierarchical Quantum Control Gates for Functional MRI Understanding
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
Quantum Visual Feature Encoding Revisited
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
QClusformer: A Quantum Transformer-based Framework for Unsupervised Visual Clustering
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
Brainformer: Mimic Human Visual Brain Functions to Machine Vision Models via fMRI
by: Nguyen, Xuan-Bac, et al.
Published: (2023)
by: Nguyen, Xuan-Bac, et al.
Published: (2023)
BIMA: Bijective Maximum Likelihood Learning Approach to Hallucination Prediction and Mitigation in Large Vision-Language Models
by: Tran, Huu-Thien, et al.
Published: (2025)
by: Tran, Huu-Thien, et al.
Published: (2025)
Quantum-Brain: Quantum-Inspired Neural Network Approach to Vision-Brain Understanding
by: Nguyen, Hoang-Quan, et al.
Published: (2024)
by: Nguyen, Hoang-Quan, et al.
Published: (2024)
A Novel Dataset for Video-Based Neurodivergent Classification Leveraging Extra-Stimulatory Behavior
by: Serna-Aguilera, Manuel, et al.
Published: (2024)
by: Serna-Aguilera, Manuel, et al.
Published: (2024)
QuPAINT: Physics-Aware Instruction Tuning Approach to Quantum Material Discovery
by: Nguyen, Xuan-Bac, et al.
Published: (2026)
by: Nguyen, Xuan-Bac, et al.
Published: (2026)
OpenQlaw: An Agentic AI Assistant for Analysis of 2D Quantum Materials
by: Pandey, Sankalp, et al.
Published: (2026)
by: Pandey, Sankalp, et al.
Published: (2026)
QMoE: A Quantum Mixture of Experts Framework for Scalable Quantum Neural Networks
by: Nguyen, Hoang-Quan, et al.
Published: (2025)
by: Nguyen, Hoang-Quan, et al.
Published: (2025)
FALCON: Fairness Learning via Contrastive Attention Approach to Continual Semantic Scene Understanding
by: Truong, Thanh-Dat, et al.
Published: (2023)
by: Truong, Thanh-Dat, et al.
Published: (2023)
BRACTIVE: A Brain Activation Approach to Human Visual Brain Learning
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
$φ$-Adapt: A Physics-Informed Adaptation Learning Approach to 2D Quantum Material Discovery
by: Nguyen, Hoang-Quan, et al.
Published: (2025)
by: Nguyen, Hoang-Quan, et al.
Published: (2025)
QLAM: A Quantum Long-Attention Memory Approach to Long-Sequence Token Modeling
by: Nguyen, Hoang-Quan, et al.
Published: (2026)
by: Nguyen, Hoang-Quan, et al.
Published: (2026)
MANGO: Multimodal Attention-based Normalizing Flow Approach to Fusion Learning
by: Truong, Thanh-Dat, et al.
Published: (2025)
by: Truong, Thanh-Dat, et al.
Published: (2025)
COBRA: A Continual Learning Approach to Vision-Brain Understanding
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
by: Nguyen, Xuan-Bac, et al.
Published: (2024)
DEFEND: A Large-scale 1M Dataset and Foundation Model for Tobacco Addiction Prevention
by: Chappa, Naga VS Raviteja, et al.
Published: (2025)
by: Chappa, Naga VS Raviteja, et al.
Published: (2025)
CONDA: Continual Unsupervised Domain Adaptation Learning in Visual Perception for Self-Driving Cars
by: Truong, Thanh-Dat, et al.
Published: (2022)
by: Truong, Thanh-Dat, et al.
Published: (2022)
Quantum Vision Clustering
by: Nguyen, Xuan Bac, et al.
Published: (2023)
by: Nguyen, Xuan Bac, et al.
Published: (2023)
Directed-Tokens: A Robust Multi-Modality Alignment Approach to Large Language-Vision Models
by: Truong, Thanh-Dat, et al.
Published: (2025)
by: Truong, Thanh-Dat, et al.
Published: (2025)
$ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models
by: Truong, Thanh-Dat, et al.
Published: (2026)
by: Truong, Thanh-Dat, et al.
Published: (2026)
CLIFF: Continual Learning for Incremental Flake Features in 2D Material Identification
by: Pandey, Sankalp, et al.
Published: (2025)
by: Pandey, Sankalp, et al.
Published: (2025)
Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation
by: Nguyen, Huu Tien, et al.
Published: (2025)
by: Nguyen, Huu Tien, et al.
Published: (2025)
HIG: Hierarchical Interlacement Graph Approach to Scene Graph Generation in Video Understanding
by: Nguyen, Trong-Thuan, et al.
Published: (2023)
by: Nguyen, Trong-Thuan, et al.
Published: (2023)
EAGLE: Efficient Adaptive Geometry-based Learning in Cross-view Understanding
by: Truong, Thanh-Dat, et al.
Published: (2024)
by: Truong, Thanh-Dat, et al.
Published: (2024)
Deep-Wide Learning Assistance for Insect Pest Classification
by: Nguyen, Toan, et al.
Published: (2024)
by: Nguyen, Toan, et al.
Published: (2024)
Seeing Through the Tool: A Controlled Benchmark for Occlusion Robustness in Foundation Segmentation Models
by: Ho, Nhan, et al.
Published: (2026)
by: Ho, Nhan, et al.
Published: (2026)
CT to PET Translation: A Large-scale Dataset and Domain-Knowledge-Guided Diffusion Approach
by: Nguyen, Dac Thai, et al.
Published: (2024)
by: Nguyen, Dac Thai, et al.
Published: (2024)
Towards Robust and Fair Vision Learning in Open-World Environments
by: Truong, Thanh-Dat
Published: (2024)
by: Truong, Thanh-Dat
Published: (2024)
ViOCRVQA: Novel Benchmark Dataset and Vision Reader for Visual Question Answering by Understanding Vietnamese Text in Images
by: Pham, Huy Quang, et al.
Published: (2024)
by: Pham, Huy Quang, et al.
Published: (2024)
Sampling Foundational Transformer: A Theoretical Perspective
by: Nguyen, Viet Anh, et al.
Published: (2024)
by: Nguyen, Viet Anh, et al.
Published: (2024)
Guiding Noisy Label Conditional Diffusion Models with Score-based Discriminator Correction
by: Cong, Dat Nguyen, et al.
Published: (2025)
by: Cong, Dat Nguyen, et al.
Published: (2025)
Towards multi-modal forgery representation learning for AI-generated video detection and localization
by: Le, Dat, et al.
Published: (2026)
by: Le, Dat, et al.
Published: (2026)
ViConsFormer: Constituting Meaningful Phrases of Scene Texts using Transformer-based Method in Vietnamese Text-based Visual Question Answering
by: Nguyen, Nghia Hieu, et al.
Published: (2024)
by: Nguyen, Nghia Hieu, et al.
Published: (2024)
VirDA: Reusing Backbone for Unsupervised Domain Adaptation with Visual Reprogramming
by: Nguyen, Duy, et al.
Published: (2025)
by: Nguyen, Duy, et al.
Published: (2025)
Similar Items
-
Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding
by: Truong, Thanh-Dat, et al.
Published: (2025) -
BRAIN: Bias-Mitigation Continual Learning Approach to Vision-Brain Understanding
by: Nguyen, Xuan-Bac, et al.
Published: (2025) -
Multi-view Action Recognition via Directed Gromov-Wasserstein Discrepancy
by: Nguyen, Hoang-Quan, et al.
Published: (2024) -
Cross-view Action Recognition Understanding From Exocentric to Egocentric Perspective
by: Truong, Thanh-Dat, et al.
Published: (2023) -
ED-SAM: An Efficient Diffusion Sampling Approach to Domain Generalization in Vision-Language Foundation Models
by: Truong, Thanh-Dat, et al.
Published: (2024)