Coherent Zero-Shot Visual Instruction Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Phung, Quynh, Ge, Songwei, Huang, Jia-Bin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ViGoR-Bench: How Far Are Visual Generative Models From Zero-Shot Visual Reasoners?
di: Han, Haonan, et al.
Pubblicazione: (2026)
di: Han, Haonan, et al.
Pubblicazione: (2026)
Data Distribution Distilled Generative Model for Generalized Zero-Shot Recognition
di: Wang, Yijie, et al.
Pubblicazione: (2024)
di: Wang, Yijie, et al.
Pubblicazione: (2024)
VIGC: Visual Instruction Generation and Correction
di: Wang, Bin, et al.
Pubblicazione: (2023)
di: Wang, Bin, et al.
Pubblicazione: (2023)
Dream to Generalize: Zero-Shot Model-Based Reinforcement Learning for Unseen Visual Distractions
di: Ha, Jeongsoo, et al.
Pubblicazione: (2025)
di: Ha, Jeongsoo, et al.
Pubblicazione: (2025)
ZEBRA: Towards Zero-Shot Cross-Subject Generalization for Universal Brain Visual Decoding
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
Transductive Zero-Shot and Few-Shot CLIP
di: Martin, Ségolène, et al.
Pubblicazione: (2024)
di: Martin, Ségolène, et al.
Pubblicazione: (2024)
Language-Driven Visual Consensus for Zero-Shot Semantic Segmentation
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
Test-Time-Scaling for Zero-Shot Diagnosis with Visual-Language Reasoning
di: Byun, Ji Young, et al.
Pubblicazione: (2025)
di: Byun, Ji Young, et al.
Pubblicazione: (2025)
Think, Act, Build: An Agentic Framework with Vision Language Models for Zero-Shot 3D Visual Grounding
di: Wang, Haibo, et al.
Pubblicazione: (2026)
di: Wang, Haibo, et al.
Pubblicazione: (2026)
Context-Aware Pseudo-Label Scoring for Zero-Shot Video Summarization
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
di: Wu, Yuanli, et al.
Pubblicazione: (2025)
Efficient Zero-Shot AI-Generated Image Detection
di: Sonoda, Ryosuke, et al.
Pubblicazione: (2026)
di: Sonoda, Ryosuke, et al.
Pubblicazione: (2026)
PostEdit: Posterior Sampling for Efficient Zero-Shot Image Editing
di: Tian, Feng, et al.
Pubblicazione: (2024)
di: Tian, Feng, et al.
Pubblicazione: (2024)
Ontology-Guided Diffusion for Zero-Shot Visual Sim2Real Transfer
di: Youssef, Mohamed, et al.
Pubblicazione: (2026)
di: Youssef, Mohamed, et al.
Pubblicazione: (2026)
Improving Zero-Shot Object-Level Change Detection by Incorporating Visual Correspondence
di: Nguyen, Hung Huy, et al.
Pubblicazione: (2025)
di: Nguyen, Hung Huy, et al.
Pubblicazione: (2025)
SSVP: Synergistic Semantic-Visual Prompting for Industrial Zero-Shot Anomaly Detection
di: Fu, Chenhao, et al.
Pubblicazione: (2026)
di: Fu, Chenhao, et al.
Pubblicazione: (2026)
Zero-to-Hero: Zero-Shot Initialization Empowering Reference-Based Video Appearance Editing
di: Su, Tongtong, et al.
Pubblicazione: (2025)
di: Su, Tongtong, et al.
Pubblicazione: (2025)
Deep Semantic-Visual Alignment for Zero-Shot Remote Sensing Image Scene Classification
di: Xu, Wenjia, et al.
Pubblicazione: (2024)
di: Xu, Wenjia, et al.
Pubblicazione: (2024)
Synthetic Data is Sufficient for Zero-Shot Visual Generalization from Offline Data
di: Güzel, Ahmet H., et al.
Pubblicazione: (2025)
di: Güzel, Ahmet H., et al.
Pubblicazione: (2025)
In-Video Instructions: Visual Signals as Generative Control
di: Fang, Gongfan, et al.
Pubblicazione: (2025)
di: Fang, Gongfan, et al.
Pubblicazione: (2025)
SKALD: Learning-Based Shot Assembly for Coherent Multi-Shot Video Creation
di: Lu, Chen Yi, et al.
Pubblicazione: (2025)
di: Lu, Chen Yi, et al.
Pubblicazione: (2025)
Bridging the Semantic Chasm: Synergistic Conceptual Anchoring for Generalized Few-Shot and Zero-Shot OOD Perception
di: Christoforos, Alexandros, et al.
Pubblicazione: (2026)
di: Christoforos, Alexandros, et al.
Pubblicazione: (2026)
Spatio-Temporal Context Prompting for Zero-Shot Action Detection
di: Huang, Wei-Jhe, et al.
Pubblicazione: (2024)
di: Huang, Wei-Jhe, et al.
Pubblicazione: (2024)
VideoPoet: A Large Language Model for Zero-Shot Video Generation
di: Kondratyuk, Dan, et al.
Pubblicazione: (2023)
di: Kondratyuk, Dan, et al.
Pubblicazione: (2023)
Zero-Shot Industrial Anomaly Segmentation with Image-Aware Prompt Generation
di: Park, SoYoung, et al.
Pubblicazione: (2025)
di: Park, SoYoung, et al.
Pubblicazione: (2025)
AG-VAS: Anchor-Guided Zero-Shot Visual Anomaly Segmentation with Large Multimodal Models
di: Qu, Zhen, et al.
Pubblicazione: (2026)
di: Qu, Zhen, et al.
Pubblicazione: (2026)
LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment
di: Hu, Junyi, et al.
Pubblicazione: (2026)
di: Hu, Junyi, et al.
Pubblicazione: (2026)
RSVG-ZeroOV: Exploring a Training-Free Framework for Zero-Shot Open-Vocabulary Visual Grounding in Remote Sensing Images
di: Li, Ke, et al.
Pubblicazione: (2025)
di: Li, Ke, et al.
Pubblicazione: (2025)
Visual Language Models as Zero-Shot Deepfake Detectors
di: Pirogov, Viacheslav
Pubblicazione: (2025)
di: Pirogov, Viacheslav
Pubblicazione: (2025)
Evian: Towards Explainable Visual Instruction-tuning Data Auditing
di: Jia, Zimu, et al.
Pubblicazione: (2026)
di: Jia, Zimu, et al.
Pubblicazione: (2026)
Few-Shot Anomaly-Driven Generation for Anomaly Classification and Segmentation
di: Gui, Guan, et al.
Pubblicazione: (2025)
di: Gui, Guan, et al.
Pubblicazione: (2025)
Binary Verification for Zero-Shot Vision
di: Hu, Rongbin, et al.
Pubblicazione: (2025)
di: Hu, Rongbin, et al.
Pubblicazione: (2025)
Negative-Guided Subject Fidelity Optimization for Zero-Shot Subject-Driven Generation
di: Shin, Chaehun, et al.
Pubblicazione: (2025)
di: Shin, Chaehun, et al.
Pubblicazione: (2025)
A Framework for Evaluating Zero-Shot Image Generation in Concept-based Explainability
di: Astolfi, Giacomo, et al.
Pubblicazione: (2026)
di: Astolfi, Giacomo, et al.
Pubblicazione: (2026)
ViP$^2$-CLIP: Visual-Perception Prompting with Unified Alignment for Zero-Shot Anomaly Detection
di: Yang, Ziteng, et al.
Pubblicazione: (2025)
di: Yang, Ziteng, et al.
Pubblicazione: (2025)
Towards Visual-Prompt Temporal Answering Grounding in Medical Instructional Video
di: Li, Bin, et al.
Pubblicazione: (2022)
di: Li, Bin, et al.
Pubblicazione: (2022)
Click to Grasp: Zero-Shot Precise Manipulation via Visual Diffusion Descriptors
di: Tsagkas, Nikolaos, et al.
Pubblicazione: (2024)
di: Tsagkas, Nikolaos, et al.
Pubblicazione: (2024)
Robotic Visual Instruction
di: Li, Yanbang, et al.
Pubblicazione: (2025)
di: Li, Yanbang, et al.
Pubblicazione: (2025)
RARE: Refine Any Registration of Pairwise Point Clouds via Zero-Shot Learning
di: Zheng, Chengyu, et al.
Pubblicazione: (2025)
di: Zheng, Chengyu, et al.
Pubblicazione: (2025)
VersusDebias: Universal Zero-Shot Debiasing for Text-to-Image Models via SLM-Based Prompt Engineering and Generative Adversary
di: Luo, Hanjun, et al.
Pubblicazione: (2024)
di: Luo, Hanjun, et al.
Pubblicazione: (2024)
On The Coherence of Quantitative Evaluation of Visual Explanations
di: Vandersmissen, Benjamin, et al.
Pubblicazione: (2023)
di: Vandersmissen, Benjamin, et al.
Pubblicazione: (2023)
Documenti analoghi
-
ViGoR-Bench: How Far Are Visual Generative Models From Zero-Shot Visual Reasoners?
di: Han, Haonan, et al.
Pubblicazione: (2026) -
Data Distribution Distilled Generative Model for Generalized Zero-Shot Recognition
di: Wang, Yijie, et al.
Pubblicazione: (2024) -
VIGC: Visual Instruction Generation and Correction
di: Wang, Bin, et al.
Pubblicazione: (2023) -
Dream to Generalize: Zero-Shot Model-Based Reinforcement Learning for Unseen Visual Distractions
di: Ha, Jeongsoo, et al.
Pubblicazione: (2025) -
ZEBRA: Towards Zero-Shot Cross-Subject Generalization for Universal Brain Visual Decoding
di: Wang, Haonan, et al.
Pubblicazione: (2025)