Enhancing Visual In-Context Learning by Multi-Faceted Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Liao, Wenwen, Yu, Jianbo, Wang, Yuansong, Jiang, Qingchao, Yang, Xiaofeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
InfoSculpt: Sculpting the Latent Space for Generalized Category Discovery
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
Beyond Single Prompts: Synergistic Fusion and Arrangement for VICL
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
EfficientFSL: Enhancing Few-Shot Classification via Query-Only Tuning in Vision Transformers
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
IPEC: Test-Time Incremental Prototype Enhancement Classifier for Few-Shot Learning
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
di: Liao, Wenwen, et al.
Pubblicazione: (2026)
Adapting a Pre-trained Single-Cell Foundation Model to Spatial Gene Expression Generation from Histology Images
di: Fang, Donghai, et al.
Pubblicazione: (2026)
di: Fang, Donghai, et al.
Pubblicazione: (2026)
ICM-Fusion: In-Context Meta-Optimized LoRA Fusion for Multi-Task Adaptation
di: Shao, Yihua, et al.
Pubblicazione: (2025)
di: Shao, Yihua, et al.
Pubblicazione: (2025)
Enhancing Visual Forced Alignment with Local Context-Aware Feature Extraction and Multi-Task Learning
di: He, Yi, et al.
Pubblicazione: (2025)
di: He, Yi, et al.
Pubblicazione: (2025)
PromptHub: Enhancing Multi-Prompt Visual In-Context Learning with Locality-Aware Fusion, Concentration and Alignment
di: Luo, Tianci, et al.
Pubblicazione: (2026)
di: Luo, Tianci, et al.
Pubblicazione: (2026)
Model Discrepancy Learning: Synthetic Faces Detection Based on Multi-Reconstruction
di: Jiang, Qingchao, et al.
Pubblicazione: (2025)
di: Jiang, Qingchao, et al.
Pubblicazione: (2025)
State and Scene Enhanced Prototypes for Weakly Supervised Open-Vocabulary Object Detection
di: Zhou, Jiaying, et al.
Pubblicazione: (2025)
di: Zhou, Jiaying, et al.
Pubblicazione: (2025)
Progressive trajectory matching for medical dataset distillation
di: Yu, Zhen, et al.
Pubblicazione: (2024)
di: Yu, Zhen, et al.
Pubblicazione: (2024)
An Exploratory Study on Abstract Images and Visual Representations Learned from Them
di: Li, Haotian, et al.
Pubblicazione: (2025)
di: Li, Haotian, et al.
Pubblicazione: (2025)
What Can We Learn from Harry Potter? An Exploratory Study of Visual Representation Learning from Atypical Videos
di: Sun, Qiyue, et al.
Pubblicazione: (2025)
di: Sun, Qiyue, et al.
Pubblicazione: (2025)
RayFusion: Ray Fusion Enhanced Collaborative Visual Perception
di: Wang, Shaohong, et al.
Pubblicazione: (2025)
di: Wang, Shaohong, et al.
Pubblicazione: (2025)
ResVG: Enhancing Relation and Semantic Understanding in Multiple Instances for Visual Grounding
di: Zheng, Minghang, et al.
Pubblicazione: (2024)
di: Zheng, Minghang, et al.
Pubblicazione: (2024)
Enhancing Human Motion Prediction via Multi-range Decoupling Decoding with Gating-adjusting Aggregation
di: Wang, Jiexin, et al.
Pubblicazione: (2025)
di: Wang, Jiexin, et al.
Pubblicazione: (2025)
FusionSAM: Visual Multi-Modal Learning with Segment Anything
di: Li, Daixun, et al.
Pubblicazione: (2024)
di: Li, Daixun, et al.
Pubblicazione: (2024)
Analogist: Out-of-the-box Visual In-Context Learning with Image Diffusion Model
di: Gu, Zheng, et al.
Pubblicazione: (2024)
di: Gu, Zheng, et al.
Pubblicazione: (2024)
3D MRI Image Pretraining via Controllable 2D Slice Navigation Task
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
R1-Track: Direct Application of MLLMs to Visual Object Tracking via Reinforcement Learning
di: Wang, Biao, et al.
Pubblicazione: (2025)
di: Wang, Biao, et al.
Pubblicazione: (2025)
Leveraging Visual Tokens for Extended Text Contexts in Multi-Modal Learning
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2024)
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2024)
E-InMeMo: Enhanced Prompting for Visual In-Context Learning
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
VSFormer: Visual-Spatial Fusion Transformer for Correspondence Pruning
di: Liao, Tangfei, et al.
Pubblicazione: (2023)
di: Liao, Tangfei, et al.
Pubblicazione: (2023)
Efficient Multi-Slide Visual-Language Feature Fusion for Placental Disease Classification
di: Guo, Hang, et al.
Pubblicazione: (2025)
di: Guo, Hang, et al.
Pubblicazione: (2025)
MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification
di: Qiao, Yang, et al.
Pubblicazione: (2025)
di: Qiao, Yang, et al.
Pubblicazione: (2025)
AlignedCut: Visual Concepts Discovery on Brain-Guided Universal Feature Space
di: Yang, Huzheng, et al.
Pubblicazione: (2024)
di: Yang, Huzheng, et al.
Pubblicazione: (2024)
Context Matters: Learning Global Semantics via Object-Centric Representation
di: Zhong, Jike, et al.
Pubblicazione: (2025)
di: Zhong, Jike, et al.
Pubblicazione: (2025)
Asynchronous Remote Sensing Time-Series Fusion for Cloud Removal and Anytime Reconstruction
di: Fallah, Forouzan, et al.
Pubblicazione: (2026)
di: Fallah, Forouzan, et al.
Pubblicazione: (2026)
The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
di: Koushik, Girish A., et al.
Pubblicazione: (2025)
ContextFusion and Bootstrap: An Effective Approach to Improve Slot Attention-Based Object-Centric Learning
di: Tian, Pinzhuo, et al.
Pubblicazione: (2025)
di: Tian, Pinzhuo, et al.
Pubblicazione: (2025)
Multi-Level Feature Fusion for Continual Learning in Visual Quality Inspection
di: Bauer, Johannes C., et al.
Pubblicazione: (2026)
di: Bauer, Johannes C., et al.
Pubblicazione: (2026)
DPVO-QAT++: Heterogeneous QAT and CUDA Kernel Fusion for High-Performance Deep Patch Visual Odometry
di: Liao, Cheng
Pubblicazione: (2025)
di: Liao, Cheng
Pubblicazione: (2025)
Efficient Large Multi-modal Models via Visual Context Compression
di: Chen, Jieneng, et al.
Pubblicazione: (2024)
di: Chen, Jieneng, et al.
Pubblicazione: (2024)
FusionSORT: Fusion Methods for Online Multi-object Visual Tracking
di: Baisa, Nathanael L.
Pubblicazione: (2025)
di: Baisa, Nathanael L.
Pubblicazione: (2025)
OED: Towards One-stage End-to-End Dynamic Scene Graph Generation
di: Wang, Guan, et al.
Pubblicazione: (2024)
di: Wang, Guan, et al.
Pubblicazione: (2024)
RTGMFF: Enhanced fMRI-based Brain Disorder Diagnosis via ROI-driven Text Generation and Multimodal Feature Fusion
di: Jia, Junhao, et al.
Pubblicazione: (2025)
di: Jia, Junhao, et al.
Pubblicazione: (2025)
Decoupling Scene Perception and Ego Status: A Multi-Context Fusion Approach for Enhanced Generalization in End-to-End Autonomous Driving
di: Tang, Jiacheng, et al.
Pubblicazione: (2025)
di: Tang, Jiacheng, et al.
Pubblicazione: (2025)
GMC: A General Framework of Multi-stage Context Learning and Utilization for Visual Detection Tasks
di: Wang, Xuan, et al.
Pubblicazione: (2024)
di: Wang, Xuan, et al.
Pubblicazione: (2024)
Artifacts and Attention Sinks: Structured Approximations for Efficient Vision Transformers
di: Lu, Andrew, et al.
Pubblicazione: (2025)
di: Lu, Andrew, et al.
Pubblicazione: (2025)
Multi-Teacher Knowledge Distillation with Reinforcement Learning for Visual Recognition
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
di: Yang, Chuanguang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
InfoSculpt: Sculpting the Latent Space for Generalized Category Discovery
di: Liao, Wenwen, et al.
Pubblicazione: (2026) -
Beyond Single Prompts: Synergistic Fusion and Arrangement for VICL
di: Liao, Wenwen, et al.
Pubblicazione: (2026) -
EfficientFSL: Enhancing Few-Shot Classification via Query-Only Tuning in Vision Transformers
di: Liao, Wenwen, et al.
Pubblicazione: (2026) -
IPEC: Test-Time Incremental Prototype Enhancement Classifier for Few-Shot Learning
di: Liao, Wenwen, et al.
Pubblicazione: (2026) -
Adapting a Pre-trained Single-Cell Foundation Model to Spatial Gene Expression Generation from Histology Images
di: Fang, Donghai, et al.
Pubblicazione: (2026)