EmoVIT: Revolutionizing Emotion Insights with Visual Instruction Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Hongxia, Peng, Chu-Jun, Tseng, Yu-Wen, Chen, Hung-Jen, Hsu, Chan-Feng, Shuai, Hong-Han, Cheng, Wen-Huang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Future Sight and Tough Fights: Revolutionizing Sequential Recommendation with FENRec
par: Huang, Yu-Hsuan, et autres
Publié: (2024)
par: Huang, Yu-Hsuan, et autres
Publié: (2024)
EmoArt: A Multidimensional Dataset for Emotion-Aware Artistic Generation
par: Zhang, Cheng, et autres
Publié: (2025)
par: Zhang, Cheng, et autres
Publié: (2025)
Perspective-Aware Teaching: Adapting Knowledge for Heterogeneous Distillation
par: Lin, Jhe-Hao, et autres
Publié: (2025)
par: Lin, Jhe-Hao, et autres
Publié: (2025)
Foreground Focus: Enhancing Coherence and Fidelity in Camouflaged Image Generation
par: Chen, Pei-Chi, et autres
Publié: (2025)
par: Chen, Pei-Chi, et autres
Publié: (2025)
NUS-Emo at SemEval-2024 Task 3: Instruction-Tuning LLM for Multimodal Emotion-Cause Analysis in Conversations
par: Luo, Meng, et autres
Publié: (2024)
par: Luo, Meng, et autres
Publié: (2024)
EL-VIT: Probing Vision Transformer with Interactive Visualization
par: Zhou, Hong, et autres
Publié: (2024)
par: Zhou, Hong, et autres
Publié: (2024)
EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis
par: Guo, Yijie, et autres
Publié: (2025)
par: Guo, Yijie, et autres
Publié: (2025)
The Fabrication of Reality and Fantasy: Scene Generation with LLM-Assisted Prompt Interpretation
par: Yao, Yi, et autres
Publié: (2024)
par: Yao, Yi, et autres
Publié: (2024)
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
par: Cheng, Zebang, et autres
Publié: (2024)
par: Cheng, Zebang, et autres
Publié: (2024)
Visual Instruction Tuning with Chain of Region-of-Interest
par: Chen, Yixin, et autres
Publié: (2025)
par: Chen, Yixin, et autres
Publié: (2025)
RecipeGen: A Step-Aligned Multimodal Benchmark for Real-World Recipe Generation
par: Zhang, Ruoxuan, et autres
Publié: (2025)
par: Zhang, Ruoxuan, et autres
Publié: (2025)
Attribute-Grounded Selective Reasoning for Artwork Emotion Understanding with Multimodal Large Language Models
par: Zhang, Cheng, et autres
Publié: (2026)
par: Zhang, Cheng, et autres
Publié: (2026)
Emo-Tune: Harnessing Emotion-based Music for Patient Wellness
par: N Jothy, et autres
Publié: (2026)
par: N Jothy, et autres
Publié: (2026)
EmoAssist: Emotional Assistant for Visual Impairment Community
par: Qi, Xingyu, et autres
Publié: (2025)
par: Qi, Xingyu, et autres
Publié: (2025)
Learning to Instruct for Visual Instruction Tuning
par: Zhou, Zhihan, et autres
Publié: (2025)
par: Zhou, Zhihan, et autres
Publié: (2025)
Emo-bias: A Large Scale Evaluation of Social Bias on Speech Emotion Recognition
par: Lin, Yi-Cheng, et autres
Publié: (2024)
par: Lin, Yi-Cheng, et autres
Publié: (2024)
MemEmo: Evaluating Emotion in Memory Systems of Agents
par: Liu, Peng, et autres
Publié: (2026)
par: Liu, Peng, et autres
Publié: (2026)
A Dataset and Baselines for Measuring and Predicting the Music Piece Memorability
par: Tseng, Li-Yang, et autres
Publié: (2024)
par: Tseng, Li-Yang, et autres
Publié: (2024)
EmoGist: Efficient In-Context Learning for Visual Emotion Understanding
par: Seoh, Ronald, et autres
Publié: (2025)
par: Seoh, Ronald, et autres
Publié: (2025)
EmoSEM: Segment and Explain Emotion Stimuli in Visual Art
par: Zhang, Jing, et autres
Publié: (2025)
par: Zhang, Jing, et autres
Publié: (2025)
Single Document Image Highlight Removal via A Large-Scale Real-World Dataset and A Location-Aware Network
par: Pan, Lu, et autres
Publié: (2025)
par: Pan, Lu, et autres
Publié: (2025)
What Makes for Good Visual Instructions? Synthesizing Complex Visual Reasoning Instructions for Visual Instruction Tuning
par: Du, Yifan, et autres
Publié: (2023)
par: Du, Yifan, et autres
Publié: (2023)
Synergistic Effects of Interfacial Electric Fields and Cryogenic Temperatures on the Performance of Li‐Ion Electronic Synapses
par: Chao‐Hung Wang, et autres
Publié: (2025)
par: Chao‐Hung Wang, et autres
Publié: (2025)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
par: Zhang, Bingyuan, et autres
Publié: (2024)
par: Zhang, Bingyuan, et autres
Publié: (2024)
LLaDA-V: Large Language Diffusion Models with Visual Instruction Tuning
par: You, Zebin, et autres
Publié: (2025)
par: You, Zebin, et autres
Publié: (2025)
EmoEdit: Evoking Emotions through Image Manipulation
par: Yang, Jingyuan, et autres
Publié: (2024)
par: Yang, Jingyuan, et autres
Publié: (2024)
Seismocardiography for Emotion Recognition: A Study on EmoWear with Insights from DEAP
par: Rahmani, Mohammad Hasan, et autres
Publié: (2024)
par: Rahmani, Mohammad Hasan, et autres
Publié: (2024)
CrossVIT-augmented Geospatial-Intelligence Visualization System for Tracking Economic Development Dynamics
par: Bai, Yanbing, et autres
Publié: (2024)
par: Bai, Yanbing, et autres
Publié: (2024)
CookAnything: A Framework for Flexible and Consistent Multi-Step Recipe Image Generation
par: Zhang, Ruoxuan, et autres
Publié: (2025)
par: Zhang, Ruoxuan, et autres
Publié: (2025)
VoxEmo: Benchmarking Speech Emotion Recognition with Speech LLMs
par: Zhang, Hezhao, et autres
Publié: (2026)
par: Zhang, Hezhao, et autres
Publié: (2026)
AV-EmoDialog: Chat with Audio-Visual Users Leveraging Emotional Cues
par: Park, Se Jin, et autres
Publié: (2024)
par: Park, Se Jin, et autres
Publié: (2024)
Transforming Redaction: How AI is Revolutionizing Data Protection
par: Peng, Sida, et autres
Publié: (2024)
par: Peng, Sida, et autres
Publié: (2024)
A DeNoising FPN With Transformer R-CNN for Tiny Object Detection
par: Liu, Hou-I, et autres
Publié: (2024)
par: Liu, Hou-I, et autres
Publié: (2024)
Personalized Visual Instruction Tuning
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
EmoVoice: LLM-based Emotional Text-To-Speech Model with Freestyle Text Prompting
par: Yang, Guanrou, et autres
Publié: (2025)
par: Yang, Guanrou, et autres
Publié: (2025)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
par: He, Junwen, et autres
Publié: (2024)
par: He, Junwen, et autres
Publié: (2024)
EmoAttack: Utilizing Emotional Voice Conversion for Speech Backdoor Attacks on Deep Speech Classification Models
par: Yao, Wenhan, et autres
Publié: (2024)
par: Yao, Wenhan, et autres
Publié: (2024)
Video-LaVIT: Unified Video-Language Pre-training with Decoupled Visual-Motional Tokenization
par: Jin, Yang, et autres
Publié: (2024)
par: Jin, Yang, et autres
Publié: (2024)
Real‐World Evidence That Non‐Smokers With High PD‐L1 Non‐Squamous NSCLC Have Poorer Outcomes With Immune Checkpoint Inhibitors
par: Yu‐Chu Kuo, et autres
Publié: (2025)
par: Yu‐Chu Kuo, et autres
Publié: (2025)
EmoPrefer: Can Large Language Models Understand Human Emotion Preferences?
par: Lian, Zheng, et autres
Publié: (2025)
par: Lian, Zheng, et autres
Publié: (2025)
Documents similaires
-
Future Sight and Tough Fights: Revolutionizing Sequential Recommendation with FENRec
par: Huang, Yu-Hsuan, et autres
Publié: (2024) -
EmoArt: A Multidimensional Dataset for Emotion-Aware Artistic Generation
par: Zhang, Cheng, et autres
Publié: (2025) -
Perspective-Aware Teaching: Adapting Knowledge for Heterogeneous Distillation
par: Lin, Jhe-Hao, et autres
Publié: (2025) -
Foreground Focus: Enhancing Coherence and Fidelity in Camouflaged Image Generation
par: Chen, Pei-Chi, et autres
Publié: (2025) -
NUS-Emo at SemEval-2024 Task 3: Instruction-Tuning LLM for Multimodal Emotion-Cause Analysis in Conversations
par: Luo, Meng, et autres
Publié: (2024)