Encapsulating Knowledge in One Prompt
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Qi, Yu, Runpeng, Wang, Xinchao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Attention Prompting on Image for Large Vision-Language Models
par: Yu, Runpeng, et autres
Publié: (2024)
par: Yu, Runpeng, et autres
Publié: (2024)
Neural Lineage
par: Yu, Runpeng, et autres
Publié: (2024)
par: Yu, Runpeng, et autres
Publié: (2024)
Vid-SME: Membership Inference Attacks against Large Video Understanding Models
par: Li, Qi, et autres
Publié: (2025)
par: Li, Qi, et autres
Publié: (2025)
Dimple: Discrete Diffusion Multimodal Large Language Model with Parallel Decoding
par: Yu, Runpeng, et autres
Publié: (2025)
par: Yu, Runpeng, et autres
Publié: (2025)
Introducing Visual Perception Token into Multimodal Large Language Model
par: Yu, Runpeng, et autres
Publié: (2025)
par: Yu, Runpeng, et autres
Publié: (2025)
NoLan: Mitigating Object Hallucinations in Large Vision-Language Models via Dynamic Suppression of Language Priors
par: Ren, Lingfeng, et autres
Publié: (2026)
par: Ren, Lingfeng, et autres
Publié: (2026)
Sponge Tool Attack: Stealthy Denial-of-Efficiency against Tool-Augmented Agentic Reasoning
par: Li, Qi, et autres
Publié: (2026)
par: Li, Qi, et autres
Publié: (2026)
ViMU: Benchmarking Video Metaphorical Understanding
par: Li, Qi, et autres
Publié: (2026)
par: Li, Qi, et autres
Publié: (2026)
Anatomy of a Lie: A Multi-Stage Diagnostic Framework for Tracing Hallucinations in Vision-Language Models
par: Xiong, Lexiang, et autres
Publié: (2026)
par: Xiong, Lexiang, et autres
Publié: (2026)
One-shot Federated Learning via Synthetic Distiller-Distillate Communication
par: Zhang, Junyuan, et autres
Publié: (2024)
par: Zhang, Junyuan, et autres
Publié: (2024)
Global Prompt Refinement with Non-Interfering Attention Masking for One-Shot Federated Learning
par: Qi, Zhuang, et autres
Publié: (2025)
par: Qi, Zhuang, et autres
Publié: (2025)
Hash3D: Training-free Acceleration for 3D Generation
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Language Model as Visual Explainer
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Compositional Video Generation as Flow Equalization
par: Yang, Xingyi, et autres
Publié: (2024)
par: Yang, Xingyi, et autres
Publié: (2024)
Domain-Adaptive 2D Human Pose Estimation via Dual Teachers in Extremely Low-Light Conditions
par: Ai, Yihao, et autres
Publié: (2024)
par: Ai, Yihao, et autres
Publié: (2024)
From Two-Stream to One-Stream: Efficient RGB-T Tracking via Mutual Prompt Learning and Knowledge Distillation
par: Luo, Yang, et autres
Publié: (2024)
par: Luo, Yang, et autres
Publié: (2024)
Medical Knowledge Intervention Prompt Tuning for Medical Image Classification
par: Du, Ye, et autres
Publié: (2025)
par: Du, Ye, et autres
Publié: (2025)
AutoMIA: Improved Baselines for Membership Inference Attack via Agentic Self-Exploration
par: Liu, Ruhao, et autres
Publié: (2026)
par: Liu, Ruhao, et autres
Publié: (2026)
Teddy: Efficient Large-Scale Dataset Distillation via Taylor-Approximated Matching
par: Yu, Ruonan, et autres
Publié: (2024)
par: Yu, Ruonan, et autres
Publié: (2024)
Ultra-Resolution Adaptation with Ease
par: Yu, Ruonan, et autres
Publié: (2025)
par: Yu, Ruonan, et autres
Publié: (2025)
PE3R: Perception-Efficient 3D Reconstruction
par: Hu, Jie, et autres
Publié: (2025)
par: Hu, Jie, et autres
Publié: (2025)
Learning Knowledge-based Prompts for Robust 3D Mask Presentation Attack Detection
par: Jiang, Fangling, et autres
Publié: (2025)
par: Jiang, Fangling, et autres
Publié: (2025)
Unsegment Anything by Simulating Deformation
par: Lu, Jiahao, et autres
Publié: (2024)
par: Lu, Jiahao, et autres
Publié: (2024)
Relation Rectification in Diffusion Model
par: Wu, Yinwei, et autres
Publié: (2024)
par: Wu, Yinwei, et autres
Publié: (2024)
CLEAR: Conv-Like Linearization Revs Pre-Trained Diffusion Transformers Up
par: Liu, Songhua, et autres
Publié: (2024)
par: Liu, Songhua, et autres
Publié: (2024)
Efficient Gaussian Splatting for Monocular Dynamic Scene Rendering via Sparse Time-Variant Attribute Modeling
par: Kong, Hanyang, et autres
Publié: (2025)
par: Kong, Hanyang, et autres
Publié: (2025)
CoDA: From Text-to-Image Diffusion Models to Training-Free Dataset Distillation
par: Zhou, Letian, et autres
Publié: (2025)
par: Zhou, Letian, et autres
Publié: (2025)
Focus on Neighbors and Know the Whole: Towards Consistent Dense Multiview Text-to-Image Generator for 3D Creation
par: Li, Bonan, et autres
Publié: (2024)
par: Li, Bonan, et autres
Publié: (2024)
Control and Realism: Best of Both Worlds in Layout-to-Image without Training
par: Li, Bonan, et autres
Publié: (2025)
par: Li, Bonan, et autres
Publié: (2025)
MambaOut: Do We Really Need Mamba for Vision?
par: Yu, Weihao, et autres
Publié: (2024)
par: Yu, Weihao, et autres
Publié: (2024)
One-Shot Knowledge Transfer for Scalable Person Re-Identification
par: Li, Longhua, et autres
Publié: (2025)
par: Li, Longhua, et autres
Publié: (2025)
Ungeneralizable Examples
par: Ye, Jingwen, et autres
Publié: (2024)
par: Ye, Jingwen, et autres
Publié: (2024)
Heavy Labels Out! Dataset Distillation with Label Space Lightening
par: Yu, Ruonan, et autres
Publié: (2024)
par: Yu, Ruonan, et autres
Publié: (2024)
ViFeEdit: A Video-Free Tuner of Your Video Diffusion Transformer
par: Yu, Ruonan, et autres
Publié: (2026)
par: Yu, Ruonan, et autres
Publié: (2026)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
par: li, Bonan, et autres
Publié: (2025)
par: li, Bonan, et autres
Publié: (2025)
KAnoCLIP: Zero-Shot Anomaly Detection through Knowledge-Driven Prompt Learning and Enhanced Cross-Modal Integration
par: Li, Chengyuan, et autres
Publié: (2025)
par: Li, Chengyuan, et autres
Publié: (2025)
IOTA: Corrective Knowledge-Guided Prompt Learning via Black-White Box Framework
par: Wang, Shaokun, et autres
Publié: (2026)
par: Wang, Shaokun, et autres
Publié: (2026)
All-in-One Image Restoration via Causal-Deconfounding Wavelet-Disentangled Prompt Network
par: Wang, Bingnan, et autres
Publié: (2026)
par: Wang, Bingnan, et autres
Publié: (2026)
Test-Time Personalization with Meta Prompt for Gaze Estimation
par: Liu, Huan, et autres
Publié: (2024)
par: Liu, Huan, et autres
Publié: (2024)
Beyond Sole Strength: Customized Ensembles for Generalized Vision-Language Models
par: Lu, Zhihe, et autres
Publié: (2023)
par: Lu, Zhihe, et autres
Publié: (2023)
Documents similaires
-
Attention Prompting on Image for Large Vision-Language Models
par: Yu, Runpeng, et autres
Publié: (2024) -
Neural Lineage
par: Yu, Runpeng, et autres
Publié: (2024) -
Vid-SME: Membership Inference Attacks against Large Video Understanding Models
par: Li, Qi, et autres
Publié: (2025) -
Dimple: Discrete Diffusion Multimodal Large Language Model with Parallel Decoding
par: Yu, Runpeng, et autres
Publié: (2025) -
Introducing Visual Perception Token into Multimodal Large Language Model
par: Yu, Runpeng, et autres
Publié: (2025)