Visually Dehallucinative Instruction Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cha, Sungguk, Lee, Jusung, Lee, Younghyun, Yang, Cheoljong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Visually Dehallucinative Instruction Generation: Know What You Don't Know
par: Cha, Sungguk, et autres
Publié: (2024)
par: Cha, Sungguk, et autres
Publié: (2024)
Visual Question Answering Instruction: Unlocking Multimodal Large Language Model To Domain-Specific Visual Multitasks
par: Lee, Jusung, et autres
Publié: (2024)
par: Lee, Jusung, et autres
Publié: (2024)
PTQ4VM: Post-Training Quantization for Visual Mamba
par: Cho, Younghyun, et autres
Publié: (2024)
par: Cho, Younghyun, et autres
Publié: (2024)
ReinPool: Reinforcement Learning Pooling Multi-Vector Embeddings for Retrieval System
par: Cha, Sungguk, et autres
Publié: (2026)
par: Cha, Sungguk, et autres
Publié: (2026)
Discovering and Mitigating Visual Biases through Keyword Explanation
par: Kim, Younghyun, et autres
Publié: (2023)
par: Kim, Younghyun, et autres
Publié: (2023)
DiffuseSlide: Training-Free High Frame Rate Video Generation Diffusion
par: Hwang, Geunmin, et autres
Publié: (2025)
par: Hwang, Geunmin, et autres
Publié: (2025)
VARCO-VISION-2.0 Technical Report
par: Cha, Young-rok, et autres
Publié: (2025)
par: Cha, Young-rok, et autres
Publié: (2025)
Speaking Beyond Language: A Large-Scale Multimodal Dataset for Learning Nonverbal Cues from Video-Grounded Dialogues
par: Kim, Youngmin, et autres
Publié: (2025)
par: Kim, Youngmin, et autres
Publié: (2025)
PERSE: Personalized 3D Generative Avatars from A Single Portrait
par: Cha, Hyunsoo, et autres
Publié: (2024)
par: Cha, Hyunsoo, et autres
Publié: (2024)
Annotation-Free Reinforcement Learning Query Rewriting via Verifiable Search Reward
par: Cha, Sungguk, et autres
Publié: (2025)
par: Cha, Sungguk, et autres
Publié: (2025)
Generative Visual Instruction Tuning
par: Hernandez, Jefferson, et autres
Publié: (2024)
par: Hernandez, Jefferson, et autres
Publié: (2024)
StarFT: Robust Fine-tuning of Zero-shot Models via Spuriosity Alignment
par: Kim, Younghyun, et autres
Publié: (2025)
par: Kim, Younghyun, et autres
Publié: (2025)
OASIS: Online Sample Selection for Continual Visual Instruction Tuning
par: Lee, Minjae, et autres
Publié: (2025)
par: Lee, Minjae, et autres
Publié: (2025)
ATTIQA: Generalizable Image Quality Feature Extractor using Attribute-aware Pretraining
par: Kwon, Daekyu, et autres
Publié: (2024)
par: Kwon, Daekyu, et autres
Publié: (2024)
DiffuseHigh: Training-free Progressive High-Resolution Image Synthesis through Structure Guidance
par: Kim, Younghyun, et autres
Publié: (2024)
par: Kim, Younghyun, et autres
Publié: (2024)
From Adaptation to Generalization: Adaptive Visual Prompting for Medical Image Segmentation
par: Çetinkaya, Evren, et autres
Publié: (2026)
par: Çetinkaya, Evren, et autres
Publié: (2026)
Images in Sentences: Scaling Interleaved Instructions for Unified Visual Generation
par: Zhang, Yabo, et autres
Publié: (2026)
par: Zhang, Yabo, et autres
Publié: (2026)
ADAPT: Attention Driven Adaptive Prompt Scheduling and InTerpolating Orthogonal Complements for Rare Concepts Generation
par: Lee, Kwanyoung, et autres
Publié: (2026)
par: Lee, Kwanyoung, et autres
Publié: (2026)
Accelerating Image Super-Resolution Networks with Pixel-Level Classification
par: Jeong, Jinho, et autres
Publié: (2024)
par: Jeong, Jinho, et autres
Publié: (2024)
DySurface: Consistent 4D Surface Reconstruction via Bridging Explicit Gaussians and Implicit Functions
par: Kim, Minje, et autres
Publié: (2026)
par: Kim, Minje, et autres
Publié: (2026)
Improving Medical Visual Representations via Radiology Report Generation
par: Quigley, Keegan, et autres
Publié: (2023)
par: Quigley, Keegan, et autres
Publié: (2023)
What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction Tuning
par: Du, Yifan, et autres
Publié: (2023)
par: Du, Yifan, et autres
Publié: (2023)
Adaptive Auxiliary Prompt Blending for Target-Faithful Diffusion Generation
par: Lee, Kwanyoung, et autres
Publié: (2026)
par: Lee, Kwanyoung, et autres
Publié: (2026)
ShowHowTo: Generating Scene-Conditioned Step-by-Step Visual Instructions
par: Souček, Tomáš, et autres
Publié: (2024)
par: Souček, Tomáš, et autres
Publié: (2024)
VII: Visual Instruction Injection for Jailbreaking Image-to-Video Generation Models
par: Zheng, Bowen, et autres
Publié: (2026)
par: Zheng, Bowen, et autres
Publié: (2026)
VIGC: Visual Instruction Generation and Correction
par: Wang, Bin, et autres
Publié: (2023)
par: Wang, Bin, et autres
Publié: (2023)
Personalized Visual Instruction Tuning
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
Comparison Visual Instruction Tuning
par: Lin, Wei, et autres
Publié: (2024)
par: Lin, Wei, et autres
Publié: (2024)
MotiMotion: Motion-Controlled Video Generation with Visual Reasoning
par: Hsin-Ying, Lee, et autres
Publié: (2026)
par: Hsin-Ying, Lee, et autres
Publié: (2026)
Generalizable Slum Detection from Satellite Imagery with Mixture-of-Experts
par: Lee, Sumin, et autres
Publié: (2025)
par: Lee, Sumin, et autres
Publié: (2025)
CoCoGaussian: Leveraging Circle of Confusion for Gaussian Splatting from Defocused Images
par: Lee, Jungho, et autres
Publié: (2024)
par: Lee, Jungho, et autres
Publié: (2024)
Improving Weakly-Supervised Object Localization Using Adversarial Erasing and Pseudo Label
par: Kang, Byeongkeun, et autres
Publié: (2024)
par: Kang, Byeongkeun, et autres
Publié: (2024)
CoT-Pose: Chain-of-Thought Reasoning for 3D Pose Generation from Abstract Prompts
par: Cha, Junuk, et autres
Publié: (2025)
par: Cha, Junuk, et autres
Publié: (2025)
Panther: Illuminate the Sight of Multimodal LLMs with Instruction-Guided Visual Prompts
par: Li, Honglin, et autres
Publié: (2024)
par: Li, Honglin, et autres
Publié: (2024)
Visual Instruction Pretraining for Domain-Specific Foundation Models
par: Li, Yuxuan, et autres
Publié: (2025)
par: Li, Yuxuan, et autres
Publié: (2025)
LEGO: Learning EGOcentric Action Frame Generation via Visual Instruction Tuning
par: Lai, Bolin, et autres
Publié: (2023)
par: Lai, Bolin, et autres
Publié: (2023)
Spanning Tree Autoregressive Visual Generation
par: Lee, Sangkyu, et autres
Publié: (2025)
par: Lee, Sangkyu, et autres
Publié: (2025)
COCO is "ALL'' You Need for Visual Instruction Fine-tuning
par: Han, Xiaotian, et autres
Publié: (2024)
par: Han, Xiaotian, et autres
Publié: (2024)
Improved Baselines with Visual Instruction Tuning
par: Liu, Haotian, et autres
Publié: (2023)
par: Liu, Haotian, et autres
Publié: (2023)
Hierarchical Information-sharing Convolutional Neural Network for the Prediction of Arctic Sea Ice Concentration and Velocity
par: Koo, Younghyun, et autres
Publié: (2023)
par: Koo, Younghyun, et autres
Publié: (2023)
Documents similaires
-
Visually Dehallucinative Instruction Generation: Know What You Don't Know
par: Cha, Sungguk, et autres
Publié: (2024) -
Visual Question Answering Instruction: Unlocking Multimodal Large Language Model To Domain-Specific Visual Multitasks
par: Lee, Jusung, et autres
Publié: (2024) -
PTQ4VM: Post-Training Quantization for Visual Mamba
par: Cho, Younghyun, et autres
Publié: (2024) -
ReinPool: Reinforcement Learning Pooling Multi-Vector Embeddings for Retrieval System
par: Cha, Sungguk, et autres
Publié: (2026) -
Discovering and Mitigating Visual Biases through Keyword Explanation
par: Kim, Younghyun, et autres
Publié: (2023)