Enregistré dans:
| Auteurs principaux: | Vedernikov, Alexander, Kumar, Puneet, Chen, Haoyu, Seppänen, Tapio, Li, Xiaobai |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.14749 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TCCT-Net: Two-Stream Network Architecture for Fast and Efficient Engagement Estimation via Behavioral Feature Signals
par: Vedernikov, Alexander, et autres
Publié: (2024)
par: Vedernikov, Alexander, et autres
Publié: (2024)
Analyzing Participants' Engagement during Online Meetings Using Unsupervised Remote Photoplethysmography with Behavioral Features
par: Vedernikov, Alexander, et autres
Publié: (2024)
par: Vedernikov, Alexander, et autres
Publié: (2024)
Not Every Subject Should Stay: Machine Unlearning for Noisy Engagement Recognition
par: Vedernikov, Alexander
Publié: (2026)
par: Vedernikov, Alexander
Publié: (2026)
PriorNet: Prior-Guided Engagement Estimation from Face Video
par: Vedernikov, Alexander
Publié: (2026)
par: Vedernikov, Alexander
Publié: (2026)
VisioPhysioENet: Visual Physiological Engagement Detection Network
par: Singh, Alakhsimar, et autres
Publié: (2024)
par: Singh, Alakhsimar, et autres
Publié: (2024)
GAViD: A Large-Scale Multimodal Dataset for Context-Aware Group Affect Recognition from Videos
par: Kumar, Deepak, et autres
Publié: (2026)
par: Kumar, Deepak, et autres
Publié: (2026)
VISTANet: VIsual Spoken Textual Additive Net for Interpretable Multimodal Emotion Recognition
par: Kumar, Puneet, et autres
Publié: (2022)
par: Kumar, Puneet, et autres
Publié: (2022)
Computational Analysis of Stress, Depression and Engagement in Mental Health: A Survey
par: Kumar, Puneet, et autres
Publié: (2024)
par: Kumar, Puneet, et autres
Publié: (2024)
Lightweight Regression Model with Prediction Interval Estimation for Computer Vision-based Winter Road Surface Condition Monitoring
par: Ojala, Risto, et autres
Publié: (2023)
par: Ojala, Risto, et autres
Publié: (2023)
A Dual-Domain Convolutional Network for Hyperspectral Single-Image Super-Resolution
par: Karayaka, Murat, et autres
Publié: (2025)
par: Karayaka, Murat, et autres
Publié: (2025)
OmniFD: A Unified Model for Versatile Face Forgery Detection
par: Liu, Haotian, et autres
Publié: (2025)
par: Liu, Haotian, et autres
Publié: (2025)
CodePhys: Robust Video-based Remote Physiological Measurement through Latent Codebook Querying
par: Chu, Shuyang, et autres
Publié: (2025)
par: Chu, Shuyang, et autres
Publié: (2025)
Making Large Vision Language Models to be Good Few-shot Learners
par: Liu, Fan, et autres
Publié: (2024)
par: Liu, Fan, et autres
Publié: (2024)
Mitigating Cache Noise in Test-Time Adaptation for Large Vision-Language Models
par: Zhai, Haotian, et autres
Publié: (2025)
par: Zhai, Haotian, et autres
Publié: (2025)
Contrast-Phys: Unsupervised Video-based Remote Physiological Measurement via Spatiotemporal Contrast
par: Sun, Zhaodong, et autres
Publié: (2022)
par: Sun, Zhaodong, et autres
Publié: (2022)
Contrast-Phys+: Unsupervised and Weakly-supervised Video-based Remote Physiological Measurement via Spatiotemporal Contrast
par: Sun, Zhaodong, et autres
Publié: (2023)
par: Sun, Zhaodong, et autres
Publié: (2023)
Rethinking Noise-Robust Training for Frozen Vision Foundation Models: A Cross-Dataset Benchmark with a Case Study of Small-Loss Failure
par: Li, Zitong, et autres
Publié: (2026)
par: Li, Zitong, et autres
Publié: (2026)
Are Large Vision Language Models Good Game Players?
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
MVRD-Bench: Multi-View Learning and Benchmarking for Dynamic Remote Photoplethysmography under Occlusion
par: He, Zuxian, et autres
Publié: (2026)
par: He, Zuxian, et autres
Publié: (2026)
HalluCXR: Benchmarking and Mitigating Hallucinations in Medical Vision-Language Models for Chest Radiograph Interpretation
par: Wang, Haoyu, et autres
Publié: (2026)
par: Wang, Haoyu, et autres
Publié: (2026)
Are Multimodal Large Language Models Good Annotators for Image Tagging?
par: Xie, Ming-Kun, et autres
Publié: (2026)
par: Xie, Ming-Kun, et autres
Publié: (2026)
Structural Graph Probing of Vision-Language Models
par: He, Haoyu, et autres
Publié: (2026)
par: He, Haoyu, et autres
Publié: (2026)
Extending Large Vision-Language Model for Diverse Interactive Tasks in Autonomous Driving
par: Zhao, Zongchuang, et autres
Publié: (2025)
par: Zhao, Zongchuang, et autres
Publié: (2025)
What Makes Good Few-shot Examples for Vision-Language Models?
par: Guo, Zhaojun, et autres
Publié: (2024)
par: Guo, Zhaojun, et autres
Publié: (2024)
What Makes "Good" Distractors for Object Hallucination Evaluation in Large Vision-Language Models?
par: Xie, Ming-Kun, et autres
Publié: (2025)
par: Xie, Ming-Kun, et autres
Publié: (2025)
Multi-Echo Denoising in Adverse Weather
par: Seppänen, Alvari, et autres
Publié: (2023)
par: Seppänen, Alvari, et autres
Publié: (2023)
Learner Attentiveness and Engagement Analysis in Online Education Using Computer Vision
par: Gogawale, Sharva, et autres
Publié: (2024)
par: Gogawale, Sharva, et autres
Publié: (2024)
Intrinsic Gradient Suppression for Label-Noise Prompt Tuning in Vision-Language Models
par: Li, Jiayu, et autres
Publié: (2026)
par: Li, Jiayu, et autres
Publié: (2026)
Noise is an Efficient Learner for Zero-Shot Vision-Language Models
par: Imam, Raza, et autres
Publié: (2025)
par: Imam, Raza, et autres
Publié: (2025)
Unboxing Engagement in YouTube Influencer Videos: An Attention-Based Approach
par: Rajaram, Prashant, et autres
Publié: (2020)
par: Rajaram, Prashant, et autres
Publié: (2020)
Joint Vision-Language Social Bias Removal for CLIP
par: Zhang, Haoyu, et autres
Publié: (2024)
par: Zhang, Haoyu, et autres
Publié: (2024)
Enhance Vision-Language Alignment with Noise
par: Huang, Sida, et autres
Publié: (2024)
par: Huang, Sida, et autres
Publié: (2024)
MTT-Bench: Predicting Social Dominance in Mice via Multimodal Large Language Models
par: Chen, Yunquan, et autres
Publié: (2026)
par: Chen, Yunquan, et autres
Publié: (2026)
Interpretable Image Emotion Recognition: A Domain Adaptation Approach Using Facial Expressions
par: Kumar, Puneet, et autres
Publié: (2020)
par: Kumar, Puneet, et autres
Publié: (2020)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
par: Gao, Yansheng, et autres
Publié: (2025)
par: Gao, Yansheng, et autres
Publié: (2025)
Variation-aware Vision Token Dropping for Faster Large Vision-Language Models
par: Chen, Junjie, et autres
Publié: (2025)
par: Chen, Junjie, et autres
Publié: (2025)
Beyond Human Performance: A Vision-Language Multi-Agent Approach for Quality Control in Pharmaceutical Manufacturing
par: Mandal, Subhra Jyoti, et autres
Publié: (2026)
par: Mandal, Subhra Jyoti, et autres
Publié: (2026)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
par: Chen, Jiawei, et autres
Publié: (2024)
par: Chen, Jiawei, et autres
Publié: (2024)
A Comprehensive Analysis for Visual Object Hallucination in Large Vision-Language Models
par: Jing, Liqiang, et autres
Publié: (2025)
par: Jing, Liqiang, et autres
Publié: (2025)
Are We on the Right Way for Evaluating Large Vision-Language Models?
par: Chen, Lin, et autres
Publié: (2024)
par: Chen, Lin, et autres
Publié: (2024)
Documents similaires
-
TCCT-Net: Two-Stream Network Architecture for Fast and Efficient Engagement Estimation via Behavioral Feature Signals
par: Vedernikov, Alexander, et autres
Publié: (2024) -
Analyzing Participants' Engagement during Online Meetings Using Unsupervised Remote Photoplethysmography with Behavioral Features
par: Vedernikov, Alexander, et autres
Publié: (2024) -
Not Every Subject Should Stay: Machine Unlearning for Noisy Engagement Recognition
par: Vedernikov, Alexander
Publié: (2026) -
PriorNet: Prior-Guided Engagement Estimation from Face Video
par: Vedernikov, Alexander
Publié: (2026) -
VisioPhysioENet: Visual Physiological Engagement Detection Network
par: Singh, Alakhsimar, et autres
Publié: (2024)