CM1 -- A Dataset for Evaluating Few-Shot Information Extraction with Large Vision Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wolf, Fabian, Tüselmann, Oliver, Matei, Arthur, Hennies, Lukas, Rass, Christoph, Fink, Gernot A. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Self-Supervised Vision Transformers for Writer Retrieval
por: Raven, Tim, et al.
Publicado: (2024)
por: Raven, Tim, et al.
Publicado: (2024)
Exploring Architectures for CNN-Based Word Spotting
por: Rusakov, Eugen, et al.
Publicado: (2018)
por: Rusakov, Eugen, et al.
Publicado: (2018)
Boosting Few-Shot Detection with Large Language Models and Layout-to-Image Synthesis
por: Abdullah, Ahmed, et al.
Publicado: (2024)
por: Abdullah, Ahmed, et al.
Publicado: (2024)
A Closer Look at the Few-Shot Adaptation of Large Vision-Language Models
por: Silva-Rodríguez, Julio, et al.
Publicado: (2023)
por: Silva-Rodríguez, Julio, et al.
Publicado: (2023)
Generative Compositor for Few-Shot Visual Information Extraction
por: Yang, Zhibo, et al.
Publicado: (2025)
por: Yang, Zhibo, et al.
Publicado: (2025)
Semi-Supervised Few-Shot Adaptation of Vision-Language Models
por: Silva-Rodríguez, Julio, et al.
Publicado: (2026)
por: Silva-Rodríguez, Julio, et al.
Publicado: (2026)
Low-Rank Few-Shot Adaptation of Vision-Language Models
por: Zanella, Maxime, et al.
Publicado: (2024)
por: Zanella, Maxime, et al.
Publicado: (2024)
Revisiting Few-Shot Object Detection with Vision-Language Models
por: Madan, Anish, et al.
Publicado: (2023)
por: Madan, Anish, et al.
Publicado: (2023)
Calibrated Cache Model for Few-Shot Vision-Language Model Adaptation
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Few-Shot Adaptation Benchmark for Remote Sensing Vision-Language Models
por: Khoury, Karim El, et al.
Publicado: (2025)
por: Khoury, Karim El, et al.
Publicado: (2025)
Auxiliary Descriptive Knowledge for Few-Shot Adaptation of Vision-Language Model
por: Lee, SuBeen, et al.
Publicado: (2025)
por: Lee, SuBeen, et al.
Publicado: (2025)
Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features
por: Mitra, Chancharik, et al.
Publicado: (2024)
por: Mitra, Chancharik, et al.
Publicado: (2024)
Efficient Few-Shot Continual Learning in Vision-Language Models
por: Panos, Aristeidis, et al.
Publicado: (2025)
por: Panos, Aristeidis, et al.
Publicado: (2025)
Benchmarking Vision-Language and Multimodal Large Language Models in Zero-shot and Few-shot Scenarios: A study on Christian Iconography
por: Spinaci, Gianmarco, et al.
Publicado: (2025)
por: Spinaci, Gianmarco, et al.
Publicado: (2025)
FSDAM: Few-Shot Driving Attention Modeling via Vision-Language Coupling
por: Hamid, Kaiser, et al.
Publicado: (2025)
por: Hamid, Kaiser, et al.
Publicado: (2025)
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
por: Li, Xudong, et al.
Publicado: (2024)
por: Li, Xudong, et al.
Publicado: (2024)
Vision-Language In-Context Learning Driven Few-Shot Visual Inspection Model
por: Ueno, Shiryu, et al.
Publicado: (2025)
por: Ueno, Shiryu, et al.
Publicado: (2025)
Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
por: Ali, Eman, et al.
Publicado: (2023)
por: Ali, Eman, et al.
Publicado: (2023)
ContextVLM: Zero-Shot and Few-Shot Context Understanding for Autonomous Driving using Vision Language Models
por: Sural, Shounak, et al.
Publicado: (2024)
por: Sural, Shounak, et al.
Publicado: (2024)
Cluster-Aware Prompt Ensemble Learning for Few-Shot Vision-Language Model Adaptation
por: Chen, Zhi, et al.
Publicado: (2025)
por: Chen, Zhi, et al.
Publicado: (2025)
Complementary Subspace Low-Rank Adaptation of Vision-Language Models for Few-Shot Classification
por: Wang, Zhongqi, et al.
Publicado: (2025)
por: Wang, Zhongqi, et al.
Publicado: (2025)
Pre-trained Vision and Language Transformers Are Few-Shot Incremental Learners
por: Park, Keon-Hee, et al.
Publicado: (2024)
por: Park, Keon-Hee, et al.
Publicado: (2024)
LLaFS: When Large Language Models Meet Few-Shot Segmentation
por: Zhu, Lanyun, et al.
Publicado: (2023)
por: Zhu, Lanyun, et al.
Publicado: (2023)
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
por: Farina, Matteo, et al.
Publicado: (2025)
por: Farina, Matteo, et al.
Publicado: (2025)
Preserve and Sculpt: Manifold-Aligned Fine-tuning of Vision-Language Models for Few-Shot Learning
por: Chen, Dexia, et al.
Publicado: (2025)
por: Chen, Dexia, et al.
Publicado: (2025)
Few-Shot Learning from Gigapixel Images via Hierarchical Vision-Language Alignment and Modeling
por: Wong, Bryan, et al.
Publicado: (2025)
por: Wong, Bryan, et al.
Publicado: (2025)
Few-Shot Image Classification and Segmentation as Visual Question Answering Using Vision-Language Models
por: Meng, Tian, et al.
Publicado: (2024)
por: Meng, Tian, et al.
Publicado: (2024)
DDFAV: Remote Sensing Large Vision Language Models Dataset and Evaluation Benchmark
por: Li, Haodong, et al.
Publicado: (2024)
por: Li, Haodong, et al.
Publicado: (2024)
Enhancing Vision-Language Few-Shot Adaptation with Negative Learning
por: Zhang, Ce, et al.
Publicado: (2024)
por: Zhang, Ce, et al.
Publicado: (2024)
Language-Aware Information Maximization for Transductive Few-Shot CLIP
por: Baklouti, Ghassen, et al.
Publicado: (2025)
por: Baklouti, Ghassen, et al.
Publicado: (2025)
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
por: P, Jishnu Jaykumar, et al.
Publicado: (2023)
por: P, Jishnu Jaykumar, et al.
Publicado: (2023)
Few-Shot Vision-Language Reasoning for Satellite Imagery via Verifiable Rewards
por: Koksal, Aybora, et al.
Publicado: (2025)
por: Koksal, Aybora, et al.
Publicado: (2025)
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
por: Fan, Yuanting, et al.
Publicado: (2025)
por: Fan, Yuanting, et al.
Publicado: (2025)
Efficient Few-Shot Learning in Remote Sensing: Fusing Vision and Vision-Language Models
por: Chua, Jia Yun, et al.
Publicado: (2025)
por: Chua, Jia Yun, et al.
Publicado: (2025)
Few-Shot Adversarial Prompt Learning on Vision-Language Models
por: Zhou, Yiwei, et al.
Publicado: (2024)
por: Zhou, Yiwei, et al.
Publicado: (2024)
ProKeR: A Kernel Perspective on Few-Shot Adaptation of Large Vision-Language Models
por: Bendou, Yassir, et al.
Publicado: (2025)
por: Bendou, Yassir, et al.
Publicado: (2025)
Making Large Vision Language Models to be Good Few-shot Learners
por: Liu, Fan, et al.
Publicado: (2024)
por: Liu, Fan, et al.
Publicado: (2024)
Mechanistic Finetuning of Vision-Language-Action Models via Few-Shot Demonstrations
por: Mitra, Chancharik, et al.
Publicado: (2025)
por: Mitra, Chancharik, et al.
Publicado: (2025)
Few-Shot Relation Extraction with Hybrid Visual Evidence
por: Gong, Jiaying, et al.
Publicado: (2024)
por: Gong, Jiaying, et al.
Publicado: (2024)
Towards Efficient and General-Purpose Few-Shot Misclassification Detection for Vision-Language Models
por: Zeng, Fanhu, et al.
Publicado: (2025)
por: Zeng, Fanhu, et al.
Publicado: (2025)
Ejemplares similares
-
Self-Supervised Vision Transformers for Writer Retrieval
por: Raven, Tim, et al.
Publicado: (2024) -
Exploring Architectures for CNN-Based Word Spotting
por: Rusakov, Eugen, et al.
Publicado: (2018) -
Boosting Few-Shot Detection with Large Language Models and Layout-to-Image Synthesis
por: Abdullah, Ahmed, et al.
Publicado: (2024) -
A Closer Look at the Few-Shot Adaptation of Large Vision-Language Models
por: Silva-Rodríguez, Julio, et al.
Publicado: (2023) -
Generative Compositor for Few-Shot Visual Information Extraction
por: Yang, Zhibo, et al.
Publicado: (2025)