IDNet: A Novel Dataset for Identity Document Analysis and Fraud Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guan, Hong, Wang, Yancheng, Xie, Lulu, Nag, Soham, Goel, Rajeev, Swamy, Niranjan Erappa Narayana, Yang, Yingzhen, Xiao, Chaowei, Prisby, Jonathan, Maciejewski, Ross, Zou, Jia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TeleAntiFraud-28k: An Audio-Text Slow-Thinking Dataset for Telecom Fraud Detection
par: Ma, Zhiming, et autres
Publié: (2025)
par: Ma, Zhiming, et autres
Publié: (2025)
EV-NVC: Efficient Variable bitrate Neural Video Compression
par: Hu, Yongcun, et autres
Publié: (2025)
par: Hu, Yongcun, et autres
Publié: (2025)
EMID: An Emotional Aligned Dataset in Audio-Visual Modality
par: Zou, Jialing, et autres
Publié: (2023)
par: Zou, Jialing, et autres
Publié: (2023)
MuDoC: An Interactive Multimodal Document-grounded Conversational AI System
par: Taneja, Karan, et autres
Publié: (2025)
par: Taneja, Karan, et autres
Publié: (2025)
High Capacity Reversible Data Hiding for Encrypted 3D Mesh Models Based on Topology
par: Tang, Yun, et autres
Publié: (2022)
par: Tang, Yun, et autres
Publié: (2022)
Capturing Cancer as Music: Cancer Mechanisms Expressed through Musification
par: Hnatyshyn, Rostyslav, et autres
Publié: (2024)
par: Hnatyshyn, Rostyslav, et autres
Publié: (2024)
CAMERA: Adapting to Semantic Camouflage in Unsupervised Text-Attributed Graph Fraud Detection
par: Pan, Junjun, et autres
Publié: (2026)
par: Pan, Junjun, et autres
Publié: (2026)
Identity-Driven Multimedia Forgery Detection via Reference Assistance
par: Xu, Junhao, et autres
Publié: (2024)
par: Xu, Junhao, et autres
Publié: (2024)
Comparative Study of Subjective Video Quality Assessment Test Methods in Crowdsourcing for Varied Use Cases
par: Naderi, Babak, et autres
Publié: (2025)
par: Naderi, Babak, et autres
Publié: (2025)
Identity-Aware Vision-Language Model for Explainable Face Forgery Detection
par: Xu, Junhao, et autres
Publié: (2025)
par: Xu, Junhao, et autres
Publié: (2025)
SVD: Spatial Video Dataset
par: Izadimehr, M. H., et autres
Publié: (2025)
par: Izadimehr, M. H., et autres
Publié: (2025)
Physics-Aware Novel-View Acoustic Synthesis with Vision-Language Priors and 3D Acoustic Environment Modeling
par: Fan, Congyi, et autres
Publié: (2026)
par: Fan, Congyi, et autres
Publié: (2026)
Solving Copyright Infringement on Short Video Platforms: Novel Datasets and an Audio Restoration Deep Learning Pipeline
par: Oh, Minwoo, et autres
Publié: (2025)
par: Oh, Minwoo, et autres
Publié: (2025)
Reply with Sticker: New Dataset and Model for Sticker Retrieval
par: Liang, Bin, et autres
Publié: (2024)
par: Liang, Bin, et autres
Publié: (2024)
EmotionTalk: An Interactive Chinese Multimodal Emotion Dataset With Rich Annotations
par: Sun, Haoqin, et autres
Publié: (2025)
par: Sun, Haoqin, et autres
Publié: (2025)
Feature Coding in the Era of Large Models: Dataset, Test Conditions, and Benchmark
par: Gao, Changsheng, et autres
Publié: (2024)
par: Gao, Changsheng, et autres
Publié: (2024)
SpeechEE: A Novel Benchmark for Speech Event Extraction
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
SACRED: A Faithful Annotated Multimedia Multimodal Multilingual Dataset for Classifying Connectedness Types in Online Spirituality
par: Guan, Qinghao, et autres
Publié: (2026)
par: Guan, Qinghao, et autres
Publié: (2026)
SFQA: A Comprehensive Perceptual Quality Assessment Dataset for Singing Face Generation
par: Gao, Zhilin, et autres
Publié: (2026)
par: Gao, Zhilin, et autres
Publié: (2026)
Muse: A Multimodal Conversational Recommendation Dataset with Scenario-Grounded User Profiles
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
Harmony-Aware Music-driven Motion Synthesis with Perceptual Constraint on UGC Datasets
par: Wu, Xinyi, et autres
Publié: (2025)
par: Wu, Xinyi, et autres
Publié: (2025)
A Large-scale Dataset with Behavior, Attributes, and Content of Mobile Short-video Platform
par: Shang, Yu, et autres
Publié: (2025)
par: Shang, Yu, et autres
Publié: (2025)
FineBadminton: A Multi-Level Dataset for Fine-Grained Badminton Video Understanding
par: He, Xusheng, et autres
Publié: (2025)
par: He, Xusheng, et autres
Publié: (2025)
AFL-Net: Integrating Audio, Facial, and Lip Modalities with a Two-step Cross-attention for Robust Speaker Diarization in the Wild
par: Yin, Yongkang, et autres
Publié: (2023)
par: Yin, Yongkang, et autres
Publié: (2023)
Towards Identity-Aware Cross-Modal Retrieval: a Dataset and a Baseline
par: Messina, Nicola, et autres
Publié: (2024)
par: Messina, Nicola, et autres
Publié: (2024)
Ges-QA: A Multidimensional Quality Assessment Dataset for Audio-to-3D Gesture Generation
par: Gao, Zhilin, et autres
Publié: (2025)
par: Gao, Zhilin, et autres
Publié: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
par: Ma, Chenghao, et autres
Publié: (2025)
par: Ma, Chenghao, et autres
Publié: (2025)
Towards Real-World Stickers Use: A New Dataset for Multi-Tag Sticker Recognition
par: Wang, Bingbing, et autres
Publié: (2024)
par: Wang, Bingbing, et autres
Publié: (2024)
Challenging Dataset and Multi-modal Gated Mixture of Experts Model for Remote Sensing Copy-Move Forgery Understanding
par: Zhang, Ze, et autres
Publié: (2025)
par: Zhang, Ze, et autres
Publié: (2025)
SRA: Semantic Relation-Aware Flowchart Question Answering
par: Li, Xinyu, et autres
Publié: (2026)
par: Li, Xinyu, et autres
Publié: (2026)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
Self-Training Boosted Multi-Factor Matching Network for Composed Image Retrieval
par: Wen, Haokun, et autres
Publié: (2023)
par: Wen, Haokun, et autres
Publié: (2023)
PC-JND: Subjective Study and Dataset on Just Noticeable Difference for Point Clouds in 6DoF Virtual Reality
par: Fan, Chunling, et autres
Publié: (2025)
par: Fan, Chunling, et autres
Publié: (2025)
A Near-Raw Talking-Head Video Dataset for Various Computer Vision Tasks
par: Naderi, Babak, et autres
Publié: (2026)
par: Naderi, Babak, et autres
Publié: (2026)
StreamOptix: A Cross-layer Adaptive Video Delivery Scheme
par: Liu, Mufan, et autres
Publié: (2024)
par: Liu, Mufan, et autres
Publié: (2024)
Deep Mamba Multi-modal Learning
par: Zhu, Jian, et autres
Publié: (2024)
par: Zhu, Jian, et autres
Publié: (2024)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
par: Ma, Hongjian, et autres
Publié: (2026)
par: Ma, Hongjian, et autres
Publié: (2026)
Cross-Modality and Within-Modality Regularization for Audio-Visual DeepFake Detection
par: Zou, Heqing, et autres
Publié: (2024)
par: Zou, Heqing, et autres
Publié: (2024)
MMED: A Multimodal Micro-Expression Dataset based on Audio-Visual Fusion
par: Wang, Junbo, et autres
Publié: (2025)
par: Wang, Junbo, et autres
Publié: (2025)
Documents similaires
-
TeleAntiFraud-28k: An Audio-Text Slow-Thinking Dataset for Telecom Fraud Detection
par: Ma, Zhiming, et autres
Publié: (2025) -
EV-NVC: Efficient Variable bitrate Neural Video Compression
par: Hu, Yongcun, et autres
Publié: (2025) -
EMID: An Emotional Aligned Dataset in Audio-Visual Modality
par: Zou, Jialing, et autres
Publié: (2023) -
MuDoC: An Interactive Multimodal Document-grounded Conversational AI System
par: Taneja, Karan, et autres
Publié: (2025) -
High Capacity Reversible Data Hiding for Encrypted 3D Mesh Models Based on Topology
par: Tang, Yun, et autres
Publié: (2022)