A Unified Evaluation Framework for Multi-Annotator Tendency Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Liyun, Liu, Fengkai, Sha, Xuanmeng, Wang, Bowen, Liu, Hong, Lian, Zheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QuMAB: Query-based Multi-Annotator Behavior Modeling with Reliability under Sparse Labels
par: Zhang, Liyun, et autres
Publié: (2025)
par: Zhang, Liyun, et autres
Publié: (2025)
AcoustEmo: Open-Vocabulary Emotion Reasoning via Utterance-Aware Acoustic Q-Former
par: Zhang, Liyun, et autres
Publié: (2026)
par: Zhang, Liyun, et autres
Publié: (2026)
SimLabel: Similarity-Weighted Iterative Framework for Multi-annotator Learning with Missing Annotations
par: Zhang, Liyun, et autres
Publié: (2025)
par: Zhang, Liyun, et autres
Publié: (2025)
QuMATL: Query-based Multi-annotator Tendency Learning
par: Zhang, Liyun, et autres
Publié: (2025)
par: Zhang, Liyun, et autres
Publié: (2025)
3DFacePolicy: Audio-Driven 3D Facial Animation Based on Action Control
par: Sha, Xuanmeng, et autres
Publié: (2024)
par: Sha, Xuanmeng, et autres
Publié: (2024)
3DGesPolicy: Phoneme-Aware Holistic Co-Speech Gesture Generation Based on Action Control
par: Sha, Xuanmeng, et autres
Publié: (2026)
par: Sha, Xuanmeng, et autres
Publié: (2026)
Harmony: A Unified Framework for Modality Incremental Learning
par: Song, Yaguang, et autres
Publié: (2025)
par: Song, Yaguang, et autres
Publié: (2025)
HeLo: Heterogeneous Multi-Modal Fusion with Label Correlation for Emotion Distribution Learning
par: Zheng, Chuhang, et autres
Publié: (2025)
par: Zheng, Chuhang, et autres
Publié: (2025)
LayerT2V: A Unified Multi-Layer Video Generation Framework
par: Li, Guangzhao, et autres
Publié: (2025)
par: Li, Guangzhao, et autres
Publié: (2025)
FISHER: A Foundation Model for Multi-Modal Industrial Signal Comprehensive Representation
par: Fan, Pingyi, et autres
Publié: (2025)
par: Fan, Pingyi, et autres
Publié: (2025)
SABR: A Stable Adaptive Bitrate Framework Using Behavior Cloning Pretraining and Reinforcement Learning Fine-Tuning
par: Luo, Pengcheng, et autres
Publié: (2025)
par: Luo, Pengcheng, et autres
Publié: (2025)
MixEval-X: Any-to-Any Evaluations from Real-World Data Mixtures
par: Ni, Jinjie, et autres
Publié: (2024)
par: Ni, Jinjie, et autres
Publié: (2024)
Cross-Space Synergy: A Unified Framework for Multimodal Emotion Recognition in Conversation
par: Lyu, Xiaosen, et autres
Publié: (2025)
par: Lyu, Xiaosen, et autres
Publié: (2025)
Sample then Identify: A General Framework for Risk Control and Assessment in Multimodal Large Language Models
par: Wang, Qingni, et autres
Publié: (2024)
par: Wang, Qingni, et autres
Publié: (2024)
Detecting Multimedia Generated by Large AI Models: A Survey
par: Lin, Li, et autres
Publié: (2024)
par: Lin, Li, et autres
Publié: (2024)
Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts
par: Liu, Yi, et autres
Publié: (2024)
par: Liu, Yi, et autres
Publié: (2024)
AI-Integrated Decision Support System for Real-Time Market Growth Forecasting and Multi-Source Content Diffusion Analytics
par: Yin, Ziqing, et autres
Publié: (2025)
par: Yin, Ziqing, et autres
Publié: (2025)
MultiMedEdit: A Scenario-Aware Benchmark for Evaluating Knowledge Editing in Medical VQA
par: Wen, Shengtao, et autres
Publié: (2025)
par: Wen, Shengtao, et autres
Publié: (2025)
OmniMER: Auxiliary-Enhanced LLM Adaptation for Indonesian Multimodal Emotion Recognition
par: Yan, Xueming, et autres
Publié: (2025)
par: Yan, Xueming, et autres
Publié: (2025)
Unveiling Covert Toxicity in Multimodal Data via Toxicity Association Graphs: A Graph-Based Metric and Interpretable Detection Framework
par: Wu, Guanzong, et autres
Publié: (2026)
par: Wu, Guanzong, et autres
Publié: (2026)
A review on Machine Learning based User-Centric Multimedia Streaming Techniques
par: Ghosh, Monalisa, et autres
Publié: (2024)
par: Ghosh, Monalisa, et autres
Publié: (2024)
Time-RA: Towards Time Series Reasoning for Anomaly Diagnosis with LLM Feedback
par: Yang, Yiyuan, et autres
Publié: (2025)
par: Yang, Yiyuan, et autres
Publié: (2025)
Identifying Multi-modal Knowledge Neurons in Pretrained Transformers via Two-stage Filtering
par: Sato, Yugen, et autres
Publié: (2025)
par: Sato, Yugen, et autres
Publié: (2025)
EquiAV: Leveraging Equivariance for Audio-Visual Contrastive Learning
par: Kim, Jongsuk, et autres
Publié: (2024)
par: Kim, Jongsuk, et autres
Publié: (2024)
Decoding the Hook: A Multimodal LLM Framework for Analyzing the Hooking Period of Video Ads
par: Zhang, Kunpeng, et autres
Publié: (2026)
par: Zhang, Kunpeng, et autres
Publié: (2026)
Enhancing Modality Representation and Alignment for Multimodal Cold-start Active Learning
par: Shen, Meng, et autres
Publié: (2024)
par: Shen, Meng, et autres
Publié: (2024)
Continuity, Piecewise Corrections, and Functor Models in Function-Based Learning
par: Harby, John
Publié: (2026)
par: Harby, John
Publié: (2026)
Harmful Visual Content Manipulation Matters in Misinformation Detection Under Multimedia Scenarios
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Unleashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph Completion
par: Zhang, Yichi, et autres
Publié: (2024)
par: Zhang, Yichi, et autres
Publié: (2024)
FedNano: Toward Lightweight Federated Tuning for Pretrained Multimodal Large Language Models
par: Zhang, Yao, et autres
Publié: (2025)
par: Zhang, Yao, et autres
Publié: (2025)
CFAE Framework Specification — ABO (Archetypal Behavior Ontology): Predictive Priors & Active Inference Seeding Layer - version: v0.1
par: Brown, Cameron
Publié: (2026)
par: Brown, Cameron
Publié: (2026)
GTA-HDR: A Large-Scale Synthetic Dataset for HDR Image Reconstruction
par: Barua, Hrishav Bakul, et autres
Publié: (2024)
par: Barua, Hrishav Bakul, et autres
Publié: (2024)
Doctor Sun: A Bilingual Multimodal Large Language Model for Biomedical AI
par: Xue, Dong, et autres
Publié: (2025)
par: Xue, Dong, et autres
Publié: (2025)
MCIGLE: Multimodal Exemplar-Free Class-Incremental Graph Learning
par: You, Haochen, et autres
Publié: (2025)
par: You, Haochen, et autres
Publié: (2025)
Adaptive Social Metaverse Streaming based on Federated Multi-Agent Deep Reinforcement Learning
par: Long, Zijian, et autres
Publié: (2025)
par: Long, Zijian, et autres
Publié: (2025)
MotionCtrl: A Unified and Flexible Motion Controller for Video Generation
par: Wang, Zhouxia, et autres
Publié: (2023)
par: Wang, Zhouxia, et autres
Publié: (2023)
BI-MDRG: Bridging Image History in Multimodal Dialogue Response Generation
par: Yoon, Hee Suk, et autres
Publié: (2024)
par: Yoon, Hee Suk, et autres
Publié: (2024)
Rethinking Prompting Strategies for Multi-Label Recognition with Partial Annotations
par: Rawlekar, Samyak, et autres
Publié: (2024)
par: Rawlekar, Samyak, et autres
Publié: (2024)
GRAFT: GRaPH and Table Reasoning for Textual Alignment -- A Benchmark for Structured Instruction Following and Visual Reasoning
par: Verma, Abhigya, et autres
Publié: (2025)
par: Verma, Abhigya, et autres
Publié: (2025)
Unified Hallucination Detection for Multimodal Large Language Models
par: Chen, Xiang, et autres
Publié: (2024)
par: Chen, Xiang, et autres
Publié: (2024)
Documents similaires
-
QuMAB: Query-based Multi-Annotator Behavior Modeling with Reliability under Sparse Labels
par: Zhang, Liyun, et autres
Publié: (2025) -
AcoustEmo: Open-Vocabulary Emotion Reasoning via Utterance-Aware Acoustic Q-Former
par: Zhang, Liyun, et autres
Publié: (2026) -
SimLabel: Similarity-Weighted Iterative Framework for Multi-annotator Learning with Missing Annotations
par: Zhang, Liyun, et autres
Publié: (2025) -
QuMATL: Query-based Multi-annotator Tendency Learning
par: Zhang, Liyun, et autres
Publié: (2025) -
3DFacePolicy: Audio-Driven 3D Facial Animation Based on Action Control
par: Sha, Xuanmeng, et autres
Publié: (2024)