Compound Expression Recognition via Large Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yu, Jun, Lu, Xilong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Compound Expression Recognition via Multi Model Ensemble
von: Yu, Jun, et al.
Veröffentlicht: (2024)
von: Yu, Jun, et al.
Veröffentlicht: (2024)
Towards Fine-Grained Recognition with Large Visual Language Models: Benchmark and Optimization Strategies
von: Pang, Cong, et al.
Veröffentlicht: (2025)
von: Pang, Cong, et al.
Veröffentlicht: (2025)
Attention Prompting on Image for Large Vision-Language Models
von: Yu, Runpeng, et al.
Veröffentlicht: (2024)
von: Yu, Runpeng, et al.
Veröffentlicht: (2024)
Exploring Facial Expression Recognition through Semi-Supervised Pretraining and Temporal Modeling
von: Yu, Jun, et al.
Veröffentlicht: (2024)
von: Yu, Jun, et al.
Veröffentlicht: (2024)
Semi-Supervised Facial Expression Recognition based on Dynamic Threshold and Negative Learning
von: Cai, Zhongpeng, et al.
Veröffentlicht: (2026)
von: Cai, Zhongpeng, et al.
Veröffentlicht: (2026)
Prescribing the Right Remedy: Mitigating Hallucinations in Large Vision-Language Models via Targeted Instruction Tuning
von: Hu, Rui, et al.
Veröffentlicht: (2024)
von: Hu, Rui, et al.
Veröffentlicht: (2024)
ArtVLM: Attribute Recognition Through Vision-Based Prefix Language Modeling
von: Zhu, William Yicheng, et al.
Veröffentlicht: (2024)
von: Zhu, William Yicheng, et al.
Veröffentlicht: (2024)
ArchiLense: A Framework for Quantitative Analysis of Architectural Styles Based on Vision Large Language Models
von: Zhong, Jing, et al.
Veröffentlicht: (2025)
von: Zhong, Jing, et al.
Veröffentlicht: (2025)
UrbanSense:A Framework for Quantitative Analysis of Urban Streetscapes leveraging Vision Large Language Models
von: Yin, Jun, et al.
Veröffentlicht: (2025)
von: Yin, Jun, et al.
Veröffentlicht: (2025)
Representing Online Handwriting for Recognition in Large Vision-Language Models
von: Fadeeva, Anastasiia, et al.
Veröffentlicht: (2024)
von: Fadeeva, Anastasiia, et al.
Veröffentlicht: (2024)
Temporal Label Hierachical Network for Compound Emotion Recognition
von: Li, Sunan, et al.
Veröffentlicht: (2024)
von: Li, Sunan, et al.
Veröffentlicht: (2024)
Conformal Predictions for Human Action Recognition with Vision-Language Models
von: Tim, Bary, et al.
Veröffentlicht: (2025)
von: Tim, Bary, et al.
Veröffentlicht: (2025)
Enhancing Medical Large Vision-Language Models via Alignment Distillation
von: Chang, Aofei, et al.
Veröffentlicht: (2025)
von: Chang, Aofei, et al.
Veröffentlicht: (2025)
CoFi-Dec: Hallucination-Resistant Decoding via Coarse-to-Fine Generative Feedback in Large Vision-Language Models
von: Cao, Zongsheng, et al.
Veröffentlicht: (2025)
von: Cao, Zongsheng, et al.
Veröffentlicht: (2025)
Beyond Vision: How Large Language Models Interpret Facial Expressions from Valence-Arousal Values
von: Mehra, Vaibhav, et al.
Veröffentlicht: (2025)
von: Mehra, Vaibhav, et al.
Veröffentlicht: (2025)
Using Vision Language Models to Detect Students' Academic Emotion through Facial Expressions
von: Wang, Deliang, et al.
Veröffentlicht: (2025)
von: Wang, Deliang, et al.
Veröffentlicht: (2025)
Generalizable Facial Expression Recognition
von: Zhang, Yuhang, et al.
Veröffentlicht: (2024)
von: Zhang, Yuhang, et al.
Veröffentlicht: (2024)
NoLan: Mitigating Object Hallucinations in Large Vision-Language Models via Dynamic Suppression of Language Priors
von: Ren, Lingfeng, et al.
Veröffentlicht: (2026)
von: Ren, Lingfeng, et al.
Veröffentlicht: (2026)
Technical Approach for the EMI Challenge in the 8th Affective Behavior Analysis in-the-Wild Competition
von: Yu, Jun, et al.
Veröffentlicht: (2025)
von: Yu, Jun, et al.
Veröffentlicht: (2025)
Beyond Recognition: Evaluating Visual Perspective Taking in Vision Language Models
von: Góral, Gracjan, et al.
Veröffentlicht: (2025)
von: Góral, Gracjan, et al.
Veröffentlicht: (2025)
VLM-PAR: A Vision Language Model for Pedestrian Attribute Recognition
von: Sellam, Abdellah Zakaria, et al.
Veröffentlicht: (2025)
von: Sellam, Abdellah Zakaria, et al.
Veröffentlicht: (2025)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
von: Wang, Xiao, et al.
Veröffentlicht: (2023)
von: Wang, Xiao, et al.
Veröffentlicht: (2023)
LL-ICM: Image Compression for Low-level Machine Vision via Large Vision-Language Model
von: Xue, Yuan, et al.
Veröffentlicht: (2024)
von: Xue, Yuan, et al.
Veröffentlicht: (2024)
Mitigating Object Hallucinations in Large Vision-Language Models via Attention Calibration
von: Zhu, Younan, et al.
Veröffentlicht: (2025)
von: Zhu, Younan, et al.
Veröffentlicht: (2025)
Probing Perceptual Constancy in Large Vision-Language Models
von: Sun, Haoran, et al.
Veröffentlicht: (2025)
von: Sun, Haoran, et al.
Veröffentlicht: (2025)
HealthGPT: A Medical Large Vision-Language Model for Unifying Comprehension and Generation via Heterogeneous Knowledge Adaptation
von: Lin, Tianwei, et al.
Veröffentlicht: (2025)
von: Lin, Tianwei, et al.
Veröffentlicht: (2025)
Complex Mathematical Expression Recognition: Benchmark, Large-Scale Dataset and Strong Baseline
von: Bai, Weikang, et al.
Veröffentlicht: (2025)
von: Bai, Weikang, et al.
Veröffentlicht: (2025)
Referring Expressions as a Lens into Spatial Language Grounding in Vision-Language Models
von: Tumu, Akshar, et al.
Veröffentlicht: (2025)
von: Tumu, Akshar, et al.
Veröffentlicht: (2025)
PIP: Detecting Adversarial Examples in Large Vision-Language Models via Attention Patterns of Irrelevant Probe Questions
von: Zhang, Yudong, et al.
Veröffentlicht: (2024)
von: Zhang, Yudong, et al.
Veröffentlicht: (2024)
Trustworthy Large Models in Vision: A Survey
von: Guo, Ziyan, et al.
Veröffentlicht: (2023)
von: Guo, Ziyan, et al.
Veröffentlicht: (2023)
Bidirectional Trained Tree-Structured Decoder for Handwritten Mathematical Expression Recognition
von: Cheng, Hanbo, et al.
Veröffentlicht: (2023)
von: Cheng, Hanbo, et al.
Veröffentlicht: (2023)
Modeling Cultural Bias in Facial Expression Recognition with Adaptive Agents
von: Freire-Obregón, David, et al.
Veröffentlicht: (2025)
von: Freire-Obregón, David, et al.
Veröffentlicht: (2025)
QAVA: Query-Agnostic Visual Attack to Large Vision-Language Models
von: Zhang, Yudong, et al.
Veröffentlicht: (2025)
von: Zhang, Yudong, et al.
Veröffentlicht: (2025)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
von: Zhan, Yufei, et al.
Veröffentlicht: (2025)
von: Zhan, Yufei, et al.
Veröffentlicht: (2025)
Look, Compare, Decide: Alleviating Hallucination in Large Vision-Language Models via Multi-View Multi-Path Reasoning
von: Qu, Xiaoye, et al.
Veröffentlicht: (2024)
von: Qu, Xiaoye, et al.
Veröffentlicht: (2024)
TAG: Thinking with Action Unit Grounding for Facial Expression Recognition
von: Lin, Haobo, et al.
Veröffentlicht: (2026)
von: Lin, Haobo, et al.
Veröffentlicht: (2026)
White-box Multimodal Jailbreaks Against Large Vision-Language Models
von: Wang, Ruofan, et al.
Veröffentlicht: (2024)
von: Wang, Ruofan, et al.
Veröffentlicht: (2024)
LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models
von: Wang, Jingyi, et al.
Veröffentlicht: (2024)
von: Wang, Jingyi, et al.
Veröffentlicht: (2024)
V-DPO: Mitigating Hallucination in Large Vision Language Models via Vision-Guided Direct Preference Optimization
von: Xie, Yuxi, et al.
Veröffentlicht: (2024)
von: Xie, Yuxi, et al.
Veröffentlicht: (2024)
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
von: Li, Shiyao, et al.
Veröffentlicht: (2024)
von: Li, Shiyao, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Compound Expression Recognition via Multi Model Ensemble
von: Yu, Jun, et al.
Veröffentlicht: (2024) -
Towards Fine-Grained Recognition with Large Visual Language Models: Benchmark and Optimization Strategies
von: Pang, Cong, et al.
Veröffentlicht: (2025) -
Attention Prompting on Image for Large Vision-Language Models
von: Yu, Runpeng, et al.
Veröffentlicht: (2024) -
Exploring Facial Expression Recognition through Semi-Supervised Pretraining and Temporal Modeling
von: Yu, Jun, et al.
Veröffentlicht: (2024) -
Semi-Supervised Facial Expression Recognition based on Dynamic Threshold and Negative Learning
von: Cai, Zhongpeng, et al.
Veröffentlicht: (2026)