Multimodal Methods for Analyzing Learning and Training Environments: A Systematic Literature Review
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cohn, Clayton, Davalos, Eduardo, Vatral, Caleb, Fonteles, Joyce Horn, Wang, Hanchen David, Coursey, Austin, Rayala, Surya, S, Ashwin T, Ma, Meiyi, Biswas, Gautam |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A multimodal approach to support teacher, researcher and AI collaboration in STEM +C learning environments
par: Clayton Cohn, et autres
Publié: (2024)
par: Clayton Cohn, et autres
Publié: (2024)
A Theory of Adaptive Scaffolding for LLM-Based Pedagogical Agents
par: Cohn, Clayton, et autres
Publié: (2025)
par: Cohn, Clayton, et autres
Publié: (2025)
Analyzing Recursiveness in Multimodal Generative Artificial Intelligence: Stability or Divergence?
par: Conde, Javier, et autres
Publié: (2024)
par: Conde, Javier, et autres
Publié: (2024)
OpenVNA: A Framework for Analyzing the Behavior of Multimodal Language Understanding System under Noisy Scenarios
par: Yuan, Ziqi, et autres
Publié: (2024)
par: Yuan, Ziqi, et autres
Publié: (2024)
Personalizing Student-Agent Interactions Using Log-Contextualized Retrieval-Augmented Generation (RAG)
par: Cohn, Clayton, et autres
Publié: (2025)
par: Cohn, Clayton, et autres
Publié: (2025)
FLARE: Full-Modality Long-Video Audiovisual Retrieval Benchmark with User-Simulated Queries
par: You, Qijie, et autres
Publié: (2026)
par: You, Qijie, et autres
Publié: (2026)
BEAGLE: Behavior-Enforced Agent for Grounded Learner Emulation
par: Wang, Hanchen David, et autres
Publié: (2026)
par: Wang, Hanchen David, et autres
Publié: (2026)
CoTAL: Human-in-the-Loop Prompt Engineering for Generalizable Formative Assessment Scoring
par: Cohn, Clayton, et autres
Publié: (2025)
par: Cohn, Clayton, et autres
Publié: (2025)
Video-Based Performance Evaluation for ECR Drills in Synthetic Training Environments
par: Rayala, Surya, et autres
Publié: (2025)
par: Rayala, Surya, et autres
Publié: (2025)
Loss-tolerant neural video codec aware congestion control for real time video communication
par: Xia, Zhengxu, et autres
Publié: (2024)
par: Xia, Zhengxu, et autres
Publié: (2024)
3D Gaze Tracking for Studying Collaborative Interactions in Mixed-Reality Environments
par: Davalos, Eduardo, et autres
Publié: (2024)
par: Davalos, Eduardo, et autres
Publié: (2024)
AI-Assisted Competency Assessment from Egocentric Video in Simulation-Based Nursing Education
par: Wang, Hanchen David, et autres
Publié: (2026)
par: Wang, Hanchen David, et autres
Publié: (2026)
On the Design of Safe Continual RL Methods for Control of Nonlinear Systems
par: Coursey, Austin, et autres
Publié: (2025)
par: Coursey, Austin, et autres
Publié: (2025)
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023)
par: Wang, Tianshi, et autres
Publié: (2023)
GalleryGPT: Analyzing Paintings with Large Multimodal Models
par: Bin, Yi, et autres
Publié: (2024)
par: Bin, Yi, et autres
Publié: (2024)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
par: Zhao, Yu, et autres
Publié: (2025)
par: Zhao, Yu, et autres
Publié: (2025)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
par: Dai, Weichen, et autres
Publié: (2024)
par: Dai, Weichen, et autres
Publié: (2024)
Hyperbolic Multimodal Generative Representation Learning for Generalized Zero-Shot Multimodal Information Extraction
par: Zhou, Baohang, et autres
Publié: (2026)
par: Zhou, Baohang, et autres
Publié: (2026)
Multimodal Graph-Based Variational Mixture of Experts Network for Zero-Shot Multimodal Information Extraction
par: Zhou, Baohang, et autres
Publié: (2025)
par: Zhou, Baohang, et autres
Publié: (2025)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
par: Yang, Xiaocui, et autres
Publié: (2024)
par: Yang, Xiaocui, et autres
Publié: (2024)
Subjective and Objective Quality Assessment Methods of Stereoscopic Videos with Visibility Affecting Distortions
par: Biswas, Sria, et autres
Publié: (2024)
par: Biswas, Sria, et autres
Publié: (2024)
From Multimodal Signals to Adaptive XR Experiences for De-escalation Training
par: Nierula, Birgit, et autres
Publié: (2026)
par: Nierula, Birgit, et autres
Publié: (2026)
Exploring the Role of Audio in Multimodal Misinformation Detection
par: Liu, Moyang, et autres
Publié: (2024)
par: Liu, Moyang, et autres
Publié: (2024)
Towards Multimodal Emotional Support Conversation Systems
par: Chu, Yuqi, et autres
Publié: (2024)
par: Chu, Yuqi, et autres
Publié: (2024)
Multimodal Emotion Recognition with Large Language Models
par: Zhang, Hongrui, et autres
Publié: (2026)
par: Zhang, Hongrui, et autres
Publié: (2026)
An Efficient Digital Watermarking Technique for Small Scale devices
par: Talathi, Kaushik, et autres
Publié: (2025)
par: Talathi, Kaushik, et autres
Publié: (2025)
Contrastive Knowledge Distillation for Robust Multimodal Sentiment Analysis
par: Sang, Zhongyi, et autres
Publié: (2024)
par: Sang, Zhongyi, et autres
Publié: (2024)
Multimodal LLM-based Query Paraphrasing for Video Search
par: Wu, Jiaxin, et autres
Publié: (2024)
par: Wu, Jiaxin, et autres
Publié: (2024)
From Natural Alignment to Conditional Controllability in Multimodal Dialogue
par: Jin, Zeyu, et autres
Publié: (2026)
par: Jin, Zeyu, et autres
Publié: (2026)
Training Data Efficiency in Multimodal Process Reward Models
par: Li, Jinyuan, et autres
Publié: (2026)
par: Li, Jinyuan, et autres
Publié: (2026)
A Multimodal Framework for Explainable Evaluation of Soft Skills in Educational Environments
par: Guerrero-Sosa, Jared D. T., et autres
Publié: (2025)
par: Guerrero-Sosa, Jared D. T., et autres
Publié: (2025)
Subjective Quality Assessment of Dynamic 3D Meshes in Virtual Reality Environment
par: Nguyen, Duc V., et autres
Publié: (2026)
par: Nguyen, Duc V., et autres
Publié: (2026)
Virbo: Multimodal Multilingual Avatar Video Generation in Digital Marketing
par: Zhang, Juan, et autres
Publié: (2024)
par: Zhang, Juan, et autres
Publié: (2024)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
Learning Shared Sentiment Prototypes for Adaptive Multimodal Sentiment Analysis
par: Su, Chen, et autres
Publié: (2026)
par: Su, Chen, et autres
Publié: (2026)
Retrieval Augmented Verification for Zero-Shot Detection of Multimodal Disinformation
par: Dey, Arka Ujjal, et autres
Publié: (2024)
par: Dey, Arka Ujjal, et autres
Publié: (2024)
Differential Mental Disorder Detection with Psychology-Inspired Multimodal Stimuli
par: Zhou, Zhiyuan, et autres
Publié: (2026)
par: Zhou, Zhiyuan, et autres
Publié: (2026)
EmpathyEar: An Open-source Avatar Multimodal Empathetic Chatbot
par: Fei, Hao, et autres
Publié: (2024)
par: Fei, Hao, et autres
Publié: (2024)
Multimodal Semantic Communication for Generative Audio-Driven Video Conferencing
par: Tong, Haonan, et autres
Publié: (2024)
par: Tong, Haonan, et autres
Publié: (2024)
Documents similaires
-
A multimodal approach to support teacher, researcher and AI collaboration in STEM +C learning environments
par: Clayton Cohn, et autres
Publié: (2024) -
A Theory of Adaptive Scaffolding for LLM-Based Pedagogical Agents
par: Cohn, Clayton, et autres
Publié: (2025) -
Analyzing Recursiveness in Multimodal Generative Artificial Intelligence: Stability or Divergence?
par: Conde, Javier, et autres
Publié: (2024) -
OpenVNA: A Framework for Analyzing the Behavior of Multimodal Language Understanding System under Noisy Scenarios
par: Yuan, Ziqi, et autres
Publié: (2024) -
Personalizing Student-Agent Interactions Using Log-Contextualized Retrieval-Augmented Generation (RAG)
par: Cohn, Clayton, et autres
Publié: (2025)