Faceptor: A Generalist Model for Face Perception
Fuente:
arXiv
Saved in:
| Main Authors: | Qin, Lixiong, Wang, Mei, Liu, Xuannan, Zhang, Yuhang, Deng, Wei, Song, Xiaoshuai, Xu, Weiran, Deng, Weihong |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Open-Set Facial Expression Recognition
by: Zhang, Yuhang, et al.
Published: (2024)
by: Zhang, Yuhang, et al.
Published: (2024)
Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
by: Qin, Lixiong, et al.
Published: (2025)
by: Qin, Lixiong, et al.
Published: (2025)
Fake-in-Facext: Towards Fine-Grained Explainable DeepFake Analysis
by: Qin, Lixiong, et al.
Published: (2025)
by: Qin, Lixiong, et al.
Published: (2025)
Oracle-MNIST: a Dataset of Oracle Characters for Benchmarking Machine Learning Algorithms
by: Wang, Mei, et al.
Published: (2022)
by: Wang, Mei, et al.
Published: (2022)
Towards Interactive Deepfake Analysis
by: Qin, Lixiong, et al.
Published: (2025)
by: Qin, Lixiong, et al.
Published: (2025)
Enhancing Generalization of Invisible Facial Privacy Cloak via Gradient Accumulation
by: Liu, Xuannan, et al.
Published: (2024)
by: Liu, Xuannan, et al.
Published: (2024)
Depth Map Denoising Network and Lightweight Fusion Network for Enhanced 3D Face Recognition
by: Xu, Ruizhuo, et al.
Published: (2024)
by: Xu, Ruizhuo, et al.
Published: (2024)
Confidence-Aware RGB-D Face Recognition via Virtual Depth Synthesis
by: Chen, Zijian, et al.
Published: (2024)
by: Chen, Zijian, et al.
Published: (2024)
Skeleton2vec: A Self-supervised Learning Framework with Contextualized Target Representations for Skeleton Sequence
by: Xu, Ruizhuo, et al.
Published: (2024)
by: Xu, Ruizhuo, et al.
Published: (2024)
A Generalist FaceX via Learning Unified Facial Representation
by: Han, Yue, et al.
Published: (2023)
by: Han, Yue, et al.
Published: (2023)
Marginal Debiased Network for Fair Visual Recognition
by: Wang, Mei, et al.
Published: (2024)
by: Wang, Mei, et al.
Published: (2024)
Unsupervised Attention Regularization Based Domain Adaptation for Oracle Character Recognition
by: Wang, Mei, et al.
Published: (2024)
by: Wang, Mei, et al.
Published: (2024)
UMind-VL: A Generalist Ultrasound Vision-Language Model for Unified Grounded Perception and Comprehensive Interpretation
by: Chen, Dengbo, et al.
Published: (2025)
by: Chen, Dengbo, et al.
Published: (2025)
MMFakeBench: A Mixed-Source Multimodal Misinformation Detection Benchmark for LVLMs
by: Liu, Xuannan, et al.
Published: (2024)
by: Liu, Xuannan, et al.
Published: (2024)
Deep Face Restoration: A Survey
by: Wang, Tao, et al.
Published: (2022)
by: Wang, Tao, et al.
Published: (2022)
Efficient Face Super-Resolution via Wavelet-based Feature Enhancement Network
by: Li, Wenjie, et al.
Published: (2024)
by: Li, Wenjie, et al.
Published: (2024)
Generalizable Facial Expression Recognition
by: Zhang, Yuhang, et al.
Published: (2024)
by: Zhang, Yuhang, et al.
Published: (2024)
Enhancing Zero-shot Personalized Image Aesthetics Assessment with Profile-aware Multimodal LLM
by: Wang, Chun, et al.
Published: (2026)
by: Wang, Chun, et al.
Published: (2026)
Taming Transformer for Emotion-Controllable Talking Face Generation
by: Zhang, Ziqi, et al.
Published: (2025)
by: Zhang, Ziqi, et al.
Published: (2025)
Face-MLLM: A Large Face Perception Model
by: Sun, Haomiao, et al.
Published: (2024)
by: Sun, Haomiao, et al.
Published: (2024)
Scale-Aware Pre-Training for Human-Centric Visual Perception: Enabling Lightweight and Generalizable Models
by: Wang, Xuanhan, et al.
Published: (2025)
by: Wang, Xuanhan, et al.
Published: (2025)
FaceInsight: A Multimodal Large Language Model for Face Perception
by: Li, Jingzhi, et al.
Published: (2025)
by: Li, Jingzhi, et al.
Published: (2025)
BRIGHT: A Collaborative Generalist-Specialist Foundation Model for Breast Pathology
by: Guo, Xiaojing, et al.
Published: (2026)
by: Guo, Xiaojing, et al.
Published: (2026)
3-Tracer: A Tri-level Temporal-Aware Framework for Audio Forgery Detection and Localization
by: Xia, Shuhan, et al.
Published: (2025)
by: Xia, Shuhan, et al.
Published: (2025)
Enhanced Sample Selection with Confidence Tracking: Identifying Correctly Labeled yet Hard-to-Learn Samples in Noisy Data
by: Pan, Weiran, et al.
Published: (2025)
by: Pan, Weiran, et al.
Published: (2025)
WaveFace: Authentic Face Restoration with Efficient Frequency Recovery
by: Miao, Yunqi, et al.
Published: (2024)
by: Miao, Yunqi, et al.
Published: (2024)
Vision Generalist Model: A Survey
by: Wang, Ziyi, et al.
Published: (2025)
by: Wang, Ziyi, et al.
Published: (2025)
Arc2Face: A Foundation Model for ID-Consistent Human Faces
by: Papantoniou, Foivos Paraperas, et al.
Published: (2024)
by: Papantoniou, Foivos Paraperas, et al.
Published: (2024)
Hierarchical Dual-Subspace Decoupling for Continual Learning in Vision-Language Models
by: Qin, Mengxin, et al.
Published: (2026)
by: Qin, Mengxin, et al.
Published: (2026)
Sage Deer: A Super-Aligned Driving Generalist Is Your Copilot
by: Lu, Hao, et al.
Published: (2025)
by: Lu, Hao, et al.
Published: (2025)
A Bridge from Audio to Video: Phoneme-Viseme Alignment Allows Every Face to Speak Multiple Languages
by: Su, Zibo, et al.
Published: (2025)
by: Su, Zibo, et al.
Published: (2025)
DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models
by: Qin, Mengxin, et al.
Published: (2026)
by: Qin, Mengxin, et al.
Published: (2026)
UMG-CLIP: A Unified Multi-Granularity Vision Generalist for Open-World Understanding
by: Shi, Bowen, et al.
Published: (2024)
by: Shi, Bowen, et al.
Published: (2024)
3D-LLaVA: Towards Generalist 3D LMMs with Omni Superpoint Transformer
by: Deng, Jiajun, et al.
Published: (2025)
by: Deng, Jiajun, et al.
Published: (2025)
Chimera: Improving Generalist Model with Domain-Specific Experts
by: Peng, Tianshuo, et al.
Published: (2024)
by: Peng, Tianshuo, et al.
Published: (2024)
OctoNav: Towards Generalist Embodied Navigation
by: Gao, Chen, et al.
Published: (2025)
by: Gao, Chen, et al.
Published: (2025)
DiffusionFace: Towards a Comprehensive Dataset for Diffusion-Based Face Forgery Analysis
by: Chen, Zhongxi, et al.
Published: (2024)
by: Chen, Zhongxi, et al.
Published: (2024)
LAST: LeArning to Think in Space and Time for Generalist Vision-Language Models
by: Wang, Shuai, et al.
Published: (2025)
by: Wang, Shuai, et al.
Published: (2025)
Perceive, Verify and Understand Long Video: Multi-Granular Perception and Active Verification via Interactive Agents
by: Li, Jiahua, et al.
Published: (2025)
by: Li, Jiahua, et al.
Published: (2025)
FaceScore: Benchmarking and Enhancing Face Quality in Human Generation
by: Liao, Zhenyi, et al.
Published: (2024)
by: Liao, Zhenyi, et al.
Published: (2024)
Similar Items
-
Open-Set Facial Expression Recognition
by: Zhang, Yuhang, et al.
Published: (2024) -
Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
by: Qin, Lixiong, et al.
Published: (2025) -
Fake-in-Facext: Towards Fine-Grained Explainable DeepFake Analysis
by: Qin, Lixiong, et al.
Published: (2025) -
Oracle-MNIST: a Dataset of Oracle Characters for Benchmarking Machine Learning Algorithms
by: Wang, Mei, et al.
Published: (2022) -
Towards Interactive Deepfake Analysis
by: Qin, Lixiong, et al.
Published: (2025)