LLaVA-Docent: Instruction Tuning with Multimodal Large Language Model to Support Art Appreciation Education
Fuente:
arXiv
Guardado en:
| Autores principales: | Lee, Unggi, Jeon, Minji, Lee, Yunseo, Byun, Gyuri, Son, Yoorim, Shin, Jaeyoon, Ko, Hongkyu, Kim, Hyeoncheol |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Llama-Polya: Instruction Tuning for Large Language Model based on Polya's Problem-solving
por: Lee, Unggi, et al.
Publicado: (2026)
por: Lee, Unggi, et al.
Publicado: (2026)
How Can Video Generative AI Transform K-12 Education? Examining Teachers' Perspectives through TPACK and TAM
por: Lee, Unggi, et al.
Publicado: (2025)
por: Lee, Unggi, et al.
Publicado: (2025)
Echo-Teddy: Preliminary Design and Development of Large Language Model-based Social Robot for Autistic Students
por: Lee, Unggi, et al.
Publicado: (2025)
por: Lee, Unggi, et al.
Publicado: (2025)
I See You: Teacher Analytics with GPT-4 Vision-Powered Observational Assessment
por: Lee, Unggi, et al.
Publicado: (2024)
por: Lee, Unggi, et al.
Publicado: (2024)
From Prediction to Application: Language Model-based Code Knowledge Tracing with Domain Adaptive Pre-Training and Automatic Feedback System with Pedagogical Prompting for Comprehensive Programming Education
por: Lee, Unggi, et al.
Publicado: (2024)
por: Lee, Unggi, et al.
Publicado: (2024)
LLaVA-Video: Video Instruction Tuning With Synthetic Data
por: Zhang, Yuanhan, et al.
Publicado: (2024)
por: Zhang, Yuanhan, et al.
Publicado: (2024)
LLaVA-c: Continual Improved Visual Instruction Tuning
por: Liu, Wenzhuo, et al.
Publicado: (2025)
por: Liu, Wenzhuo, et al.
Publicado: (2025)
MG-LLaVA: Towards Multi-Granularity Visual Instruction Tuning
por: Zhao, Xiangyu, et al.
Publicado: (2024)
por: Zhao, Xiangyu, et al.
Publicado: (2024)
Dr-LLaVA: Visual Instruction Tuning with Symbolic Clinical Grounding
por: Sun, Shenghuan, et al.
Publicado: (2024)
por: Sun, Shenghuan, et al.
Publicado: (2024)
Face-LLaVA: Facial Expression and Attribute Understanding through Instruction Tuning
por: Chaubey, Ashutosh, et al.
Publicado: (2025)
por: Chaubey, Ashutosh, et al.
Publicado: (2025)
Continual LLaVA: Continual Instruction Tuning in Large Vision-Language Models
por: Cao, Meng, et al.
Publicado: (2024)
por: Cao, Meng, et al.
Publicado: (2024)
HiDe-LLaVA: Hierarchical Decoupling for Continual Instruction Tuning of Multimodal Large Language Model
por: Guo, Haiyang, et al.
Publicado: (2025)
por: Guo, Haiyang, et al.
Publicado: (2025)
Cosmos-LLaVA: Chatting with the Visual Cosmos-LLaVA: Görselle Sohbet Etmek
por: Zeer, Ahmed, et al.
Publicado: (2024)
por: Zeer, Ahmed, et al.
Publicado: (2024)
TG-LLaVA: Text Guided LLaVA via Learnable Latent Embeddings
por: Yan, Dawei, et al.
Publicado: (2024)
por: Yan, Dawei, et al.
Publicado: (2024)
Exploring the Role of Automated Feedback in Programming Education: A Systematic Literature Review
por: Jung, Yeonji, et al.
Publicado: (2026)
por: Jung, Yeonji, et al.
Publicado: (2026)
LLaVA-Critic: Learning to Evaluate Multimodal Models
por: Xiong, Tianyi, et al.
Publicado: (2024)
por: Xiong, Tianyi, et al.
Publicado: (2024)
LLaVAC: Fine-tuning LLaVA as a Multimodal Sentiment Classifier
por: Chay-intr, T., et al.
Publicado: (2025)
por: Chay-intr, T., et al.
Publicado: (2025)
Amharic LLaMA and LLaVA: Multimodal LLMs for Low Resource Languages
por: Andersland, Michael
Publicado: (2024)
por: Andersland, Michael
Publicado: (2024)
LLaVA-PruMerge: Adaptive Token Reduction for Efficient Large Multimodal Models
por: Shang, Yuzhang, et al.
Publicado: (2024)
por: Shang, Yuzhang, et al.
Publicado: (2024)
Math-LLaVA: Bootstrapping Mathematical Reasoning for Multimodal Large Language Models
por: Shi, Wenhao, et al.
Publicado: (2024)
por: Shi, Wenhao, et al.
Publicado: (2024)
LLaVA-MoD: Making LLaVA Tiny via MoE Knowledge Distillation
por: Shu, Fangxun, et al.
Publicado: (2024)
por: Shu, Fangxun, et al.
Publicado: (2024)
LLaVA-MORE: A Comparative Study of LLMs and Visual Backbones for Enhanced Visual Instruction Tuning
por: Cocchi, Federico, et al.
Publicado: (2025)
por: Cocchi, Federico, et al.
Publicado: (2025)
LLaVA-Pose: Enhancing Human Pose and Action Understanding via Keypoint-Integrated Instruction Tuning
por: Zhang, Dewen, et al.
Publicado: (2025)
por: Zhang, Dewen, et al.
Publicado: (2025)
LLaVA-SLT: Visual Language Tuning for Sign Language Translation
por: Liang, Han, et al.
Publicado: (2024)
por: Liang, Han, et al.
Publicado: (2024)
ES-KT-24: A Multimodal Knowledge Tracing Benchmark Dataset with Educational Game Playing Video and Synthetic Text Generation
por: Kim, Dohee, et al.
Publicado: (2024)
por: Kim, Dohee, et al.
Publicado: (2024)
Wiki-LLaVA: Hierarchical Retrieval-Augmented Generation for Multimodal LLMs
por: Caffagni, Davide, et al.
Publicado: (2024)
por: Caffagni, Davide, et al.
Publicado: (2024)
LLaVA-Read: Enhancing Reading Ability of Multimodal Language Models
por: Zhang, Ruiyi, et al.
Publicado: (2024)
por: Zhang, Ruiyi, et al.
Publicado: (2024)
ViP-LLaVA: Making Large Multimodal Models Understand Arbitrary Visual Prompts
por: Cai, Mu, et al.
Publicado: (2023)
por: Cai, Mu, et al.
Publicado: (2023)
Quilt-LLaVA: Visual Instruction Tuning by Extracting Localized Narratives from Open-Source Histopathology Videos
por: Seyfioglu, Mehmet Saygin, et al.
Publicado: (2023)
por: Seyfioglu, Mehmet Saygin, et al.
Publicado: (2023)
LLaVA Steering: Visual Instruction Tuning with 500x Fewer Parameters through Modality Linear Representation-Steering
por: Bi, Jinhe, et al.
Publicado: (2024)
por: Bi, Jinhe, et al.
Publicado: (2024)
Beyond LLaVA-HD: Diving into High-Resolution Large Multimodal Models
por: Zhang, Yi-Fan, et al.
Publicado: (2024)
por: Zhang, Yi-Fan, et al.
Publicado: (2024)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
por: Lan, Zhibin, et al.
Publicado: (2024)
por: Lan, Zhibin, et al.
Publicado: (2024)
LLaVA-KD: A Framework of Distilling Multimodal Large Language Models
por: Cai, Yuxuan, et al.
Publicado: (2024)
por: Cai, Yuxuan, et al.
Publicado: (2024)
LLaVA-FA: Learning Fourier Approximation for Compressing Large Multimodal Models
por: Zheng, Pengcheng, et al.
Publicado: (2026)
por: Zheng, Pengcheng, et al.
Publicado: (2026)
Purrfessor: A Fine-tuned Multimodal LLaVA Diet Health Chatbot
por: Lu, Linqi, et al.
Publicado: (2024)
por: Lu, Linqi, et al.
Publicado: (2024)
LLaVA-Octopus: Unlocking Instruction-Driven Adaptive Projector Fusion for Video Understanding
por: Sun, Boyuan, et al.
Publicado: (2025)
por: Sun, Boyuan, et al.
Publicado: (2025)
X-LLaVA: Optimizing Bilingual Large Vision-Language Alignment
por: Shin, Dongjae, et al.
Publicado: (2024)
por: Shin, Dongjae, et al.
Publicado: (2024)
ISD-Agent-Bench: A Comprehensive Benchmark for Evaluating LLM-based Instructional Design Agents
por: Jeon, YoungHoon, et al.
Publicado: (2026)
por: Jeon, YoungHoon, et al.
Publicado: (2026)
TILDE-Q: A Transformation Invariant Loss Function for Time-Series Forecasting
por: Lee, Hyunwook, et al.
Publicado: (2022)
por: Lee, Hyunwook, et al.
Publicado: (2022)
LLaVA-4D: Embedding SpatioTemporal Prompt into LMMs for 4D Scene Understanding
por: Zhou, Hanyu, et al.
Publicado: (2025)
por: Zhou, Hanyu, et al.
Publicado: (2025)
Ejemplares similares
-
Llama-Polya: Instruction Tuning for Large Language Model based on Polya's Problem-solving
por: Lee, Unggi, et al.
Publicado: (2026) -
How Can Video Generative AI Transform K-12 Education? Examining Teachers' Perspectives through TPACK and TAM
por: Lee, Unggi, et al.
Publicado: (2025) -
Echo-Teddy: Preliminary Design and Development of Large Language Model-based Social Robot for Autistic Students
por: Lee, Unggi, et al.
Publicado: (2025) -
I See You: Teacher Analytics with GPT-4 Vision-Powered Observational Assessment
por: Lee, Unggi, et al.
Publicado: (2024) -
From Prediction to Application: Language Model-based Code Knowledge Tracing with Domain Adaptive Pre-Training and Automatic Feedback System with Pedagogical Prompting for Comprehensive Programming Education
por: Lee, Unggi, et al.
Publicado: (2024)