A Visual RAG Pipeline for Few-Shot Fine-Grained Product Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lamm, Bianca, Keuper, Janis |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can Visual Language Models Replace OCR-Based Visual Question Answering Pipelines in Production? A Case Study in Retail
par: Lamm, Bianca, et autres
Publié: (2024)
par: Lamm, Bianca, et autres
Publié: (2024)
Retail-786k: a Large-Scale Dataset for Visual Entity Matching
par: Lamm, Bianca, et autres
Publié: (2023)
par: Lamm, Bianca, et autres
Publié: (2023)
Deepfakes: we need to re-think the concept of "real" images
par: Keuper, Janis, et autres
Publié: (2025)
par: Keuper, Janis, et autres
Publié: (2025)
As large as it gets: Learning infinitely large Filters via Neural Implicit Functions in the Fourier Domain
par: Grabinski, Julia, et autres
Publié: (2023)
par: Grabinski, Julia, et autres
Publié: (2023)
A New Kind of Network? Review and Reference Implementation of Neural Cellular Automata
par: Spitznagel, Martin, et autres
Publié: (2026)
par: Spitznagel, Martin, et autres
Publié: (2026)
Unfolding Local Growth Rate Estimates for (Almost) Perfect Adversarial Detection
par: Lorenz, Peter, et autres
Publié: (2022)
par: Lorenz, Peter, et autres
Publié: (2022)
Frequency-Enhanced Dual-Subspace Networks for Few-Shot Fine-Grained Image Classification
par: Wang, Meijia, et autres
Publié: (2026)
par: Wang, Meijia, et autres
Publié: (2026)
Hybrid Feature Collaborative Reconstruction Network for Few-Shot Fine-Grained Image Classification
par: Qiu, Shulei, et autres
Publié: (2024)
par: Qiu, Shulei, et autres
Publié: (2024)
UltraAD: Fine-Grained Ultrasound Anomaly Classification via Few-Shot CLIP Adaptation
par: Zhou, Yue, et autres
Publié: (2025)
par: Zhou, Yue, et autres
Publié: (2025)
Hierarchical Mask-Enhanced Dual Reconstruction Network for Few-Shot Fine-Grained Image Classification
par: Luo, Ning, et autres
Publié: (2025)
par: Luo, Ning, et autres
Publié: (2025)
CausalFSFG: Rethinking Few-Shot Fine-Grained Visual Categorization from Causal Perspective
par: Yang, Zhiwen, et autres
Publié: (2025)
par: Yang, Zhiwen, et autres
Publié: (2025)
Detail Reinforcement Diffusion Model: Augmentation Fine-Grained Visual Categorization in Few-Shot Conditions
par: Wu, Tianxu, et autres
Publié: (2023)
par: Wu, Tianxu, et autres
Publié: (2023)
Fine-Grained Prototypes Distillation for Few-Shot Object Detection
par: Wang, Zichen, et autres
Publié: (2024)
par: Wang, Zichen, et autres
Publié: (2024)
PhysicsGen: Can Generative Models Learn from Images to Predict Complex Physical Relations?
par: Spitznagel, Martin, et autres
Publié: (2025)
par: Spitznagel, Martin, et autres
Publié: (2025)
Assessing Foundation Models for Mold Colony Detection with Limited Training Data
par: Pichler, Henrik, et autres
Publié: (2025)
par: Pichler, Henrik, et autres
Publié: (2025)
Is RobustBench/AutoAttack a suitable Benchmark for Adversarial Robustness?
par: Lorenz, Peter, et autres
Publié: (2021)
par: Lorenz, Peter, et autres
Publié: (2021)
Transfer Learning and Mixup for Fine-Grained Few-Shot Fungi Classification
par: Tam, Jason Kahei, et autres
Publié: (2025)
par: Tam, Jason Kahei, et autres
Publié: (2025)
Benchmarking Document Parsers on Mathematical Formula Extraction from PDFs
par: Horn, Pius, et autres
Publié: (2025)
par: Horn, Pius, et autres
Publié: (2025)
Can Biases in ImageNet Models Explain Generalization?
par: Gavrikov, Paul, et autres
Publié: (2024)
par: Gavrikov, Paul, et autres
Publié: (2024)
Urban Sound Propagation: a Benchmark for 1-Step Generative Modeling of Complex Physical Systems
par: Spitznagel, Martin, et autres
Publié: (2024)
par: Spitznagel, Martin, et autres
Publié: (2024)
Beyond String Matching: Semantic Evaluation of PDF Table Extraction
par: Horn, Pius, et autres
Publié: (2026)
par: Horn, Pius, et autres
Publié: (2026)
CoFi: A Fast Coarse-to-Fine Few-Shot Pipeline for Glomerular Basement Membrane Segmentation
par: Fang, Hongjin, et autres
Publié: (2025)
par: Fang, Hongjin, et autres
Publié: (2025)
Fix your downsampling ASAP! Be natively more robust via Aliasing and Spectral Artifact free Pooling
par: Grabinski, Julia, et autres
Publié: (2023)
par: Grabinski, Julia, et autres
Publié: (2023)
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
par: Fan, Yuanting, et autres
Publié: (2025)
par: Fan, Yuanting, et autres
Publié: (2025)
Few-Shot Learning Pipeline for Monkeypox Skin Disease Classification Using CNN Feature Extractors
par: Rashid, Md. Safirur, et autres
Publié: (2026)
par: Rashid, Md. Safirur, et autres
Publié: (2026)
Detecting AutoAttack Perturbations in the Frequency Domain
par: Lorenz, Peter, et autres
Publié: (2021)
par: Lorenz, Peter, et autres
Publié: (2021)
How Do Training Methods Influence the Utilization of Vision Models?
par: Gavrikov, Paul, et autres
Publié: (2024)
par: Gavrikov, Paul, et autres
Publié: (2024)
A streamlined Approach to Multimodal Few-Shot Class Incremental Learning for Fine-Grained Datasets
par: Doan, Thang, et autres
Publié: (2024)
par: Doan, Thang, et autres
Publié: (2024)
Shallow Deep Learning Can Still Excel in Fine-Grained Few-Shot Learning
par: Qi, Chaofei, et autres
Publié: (2025)
par: Qi, Chaofei, et autres
Publié: (2025)
Real-time Prediction of Urban Sound Propagation with Conditioned Normalizing Flows
par: Eckerle, Achim, et autres
Publié: (2025)
par: Eckerle, Achim, et autres
Publié: (2025)
Adversarial Examples are Misaligned in Diffusion Model Manifolds
par: Lorenz, Peter, et autres
Publié: (2024)
par: Lorenz, Peter, et autres
Publié: (2024)
Top-GAP: Integrating Size Priors in CNNs for more Interpretability, Robustness, and Bias Mitigation
par: Nieradzik, Lars, et autres
Publié: (2024)
par: Nieradzik, Lars, et autres
Publié: (2024)
Ambiguous Annotations: When is a Pedestrian not a Pedestrian?
par: Schwirten, Luisa, et autres
Publié: (2024)
par: Schwirten, Luisa, et autres
Publié: (2024)
Exploration of Class Center for Fine-Grained Visual Classification
par: Yao, Hang, et autres
Publié: (2024)
par: Yao, Hang, et autres
Publié: (2024)
Object-Centric Cropping for Visual Few-Shot Classification
par: Abdali, Aymane, et autres
Publié: (2025)
par: Abdali, Aymane, et autres
Publié: (2025)
Beware of Aliases -- Signal Preservation is Crucial for Robust Image Restoration
par: Agnihotri, Shashank, et autres
Publié: (2024)
par: Agnihotri, Shashank, et autres
Publié: (2024)
Zero-Shot Prompting and Few-Shot Fine-Tuning: Revisiting Document Image Classification Using Large Language Models
par: Scius-Bertrand, Anna, et autres
Publié: (2024)
par: Scius-Bertrand, Anna, et autres
Publié: (2024)
Foundation Models For Seismic Data Processing: An Extensive Review
par: Fuchs, Fabian, et autres
Publié: (2025)
par: Fuchs, Fabian, et autres
Publié: (2025)
Reliable Evaluation of Attribution Maps in CNNs: A Perturbation-Based Approach
par: Nieradzik, Lars, et autres
Publié: (2024)
par: Nieradzik, Lars, et autres
Publié: (2024)
FiLo++: Zero-/Few-Shot Anomaly Detection by Fused Fine-Grained Descriptions and Deformable Localization
par: Gu, Zhaopeng, et autres
Publié: (2025)
par: Gu, Zhaopeng, et autres
Publié: (2025)
Documents similaires
-
Can Visual Language Models Replace OCR-Based Visual Question Answering Pipelines in Production? A Case Study in Retail
par: Lamm, Bianca, et autres
Publié: (2024) -
Retail-786k: a Large-Scale Dataset for Visual Entity Matching
par: Lamm, Bianca, et autres
Publié: (2023) -
Deepfakes: we need to re-think the concept of "real" images
par: Keuper, Janis, et autres
Publié: (2025) -
As large as it gets: Learning infinitely large Filters via Neural Implicit Functions in the Fourier Domain
par: Grabinski, Julia, et autres
Publié: (2023) -
A New Kind of Network? Review and Reference Implementation of Neural Cellular Automata
par: Spitznagel, Martin, et autres
Publié: (2026)