Faceptor: A Generalist Model for Face Perception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qin, Lixiong, Wang, Mei, Liu, Xuannan, Zhang, Yuhang, Deng, Wei, Song, Xiaoshuai, Xu, Weiran, Deng, Weihong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Open-Set Facial Expression Recognition
par: Zhang, Yuhang, et autres
Publié: (2024)
par: Zhang, Yuhang, et autres
Publié: (2024)
Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
par: Qin, Lixiong, et autres
Publié: (2025)
par: Qin, Lixiong, et autres
Publié: (2025)
Fake-in-Facext: Towards Fine-Grained Explainable DeepFake Analysis
par: Qin, Lixiong, et autres
Publié: (2025)
par: Qin, Lixiong, et autres
Publié: (2025)
Oracle-MNIST: a Dataset of Oracle Characters for Benchmarking Machine Learning Algorithms
par: Wang, Mei, et autres
Publié: (2022)
par: Wang, Mei, et autres
Publié: (2022)
Towards Interactive Deepfake Analysis
par: Qin, Lixiong, et autres
Publié: (2025)
par: Qin, Lixiong, et autres
Publié: (2025)
Enhancing Generalization of Invisible Facial Privacy Cloak via Gradient Accumulation
par: Liu, Xuannan, et autres
Publié: (2024)
par: Liu, Xuannan, et autres
Publié: (2024)
Depth Map Denoising Network and Lightweight Fusion Network for Enhanced 3D Face Recognition
par: Xu, Ruizhuo, et autres
Publié: (2024)
par: Xu, Ruizhuo, et autres
Publié: (2024)
Confidence-Aware RGB-D Face Recognition via Virtual Depth Synthesis
par: Chen, Zijian, et autres
Publié: (2024)
par: Chen, Zijian, et autres
Publié: (2024)
Skeleton2vec: A Self-supervised Learning Framework with Contextualized Target Representations for Skeleton Sequence
par: Xu, Ruizhuo, et autres
Publié: (2024)
par: Xu, Ruizhuo, et autres
Publié: (2024)
A Generalist FaceX via Learning Unified Facial Representation
par: Han, Yue, et autres
Publié: (2023)
par: Han, Yue, et autres
Publié: (2023)
Marginal Debiased Network for Fair Visual Recognition
par: Wang, Mei, et autres
Publié: (2024)
par: Wang, Mei, et autres
Publié: (2024)
Unsupervised Attention Regularization Based Domain Adaptation for Oracle Character Recognition
par: Wang, Mei, et autres
Publié: (2024)
par: Wang, Mei, et autres
Publié: (2024)
UMind-VL: A Generalist Ultrasound Vision-Language Model for Unified Grounded Perception and Comprehensive Interpretation
par: Chen, Dengbo, et autres
Publié: (2025)
par: Chen, Dengbo, et autres
Publié: (2025)
MMFakeBench: A Mixed-Source Multimodal Misinformation Detection Benchmark for LVLMs
par: Liu, Xuannan, et autres
Publié: (2024)
par: Liu, Xuannan, et autres
Publié: (2024)
Deep Face Restoration: A Survey
par: Wang, Tao, et autres
Publié: (2022)
par: Wang, Tao, et autres
Publié: (2022)
Efficient Face Super-Resolution via Wavelet-based Feature Enhancement Network
par: Li, Wenjie, et autres
Publié: (2024)
par: Li, Wenjie, et autres
Publié: (2024)
Generalizable Facial Expression Recognition
par: Zhang, Yuhang, et autres
Publié: (2024)
par: Zhang, Yuhang, et autres
Publié: (2024)
Enhancing Zero-shot Personalized Image Aesthetics Assessment with Profile-aware Multimodal LLM
par: Wang, Chun, et autres
Publié: (2026)
par: Wang, Chun, et autres
Publié: (2026)
Taming Transformer for Emotion-Controllable Talking Face Generation
par: Zhang, Ziqi, et autres
Publié: (2025)
par: Zhang, Ziqi, et autres
Publié: (2025)
Face-MLLM: A Large Face Perception Model
par: Sun, Haomiao, et autres
Publié: (2024)
par: Sun, Haomiao, et autres
Publié: (2024)
Scale-Aware Pre-Training for Human-Centric Visual Perception: Enabling Lightweight and Generalizable Models
par: Wang, Xuanhan, et autres
Publié: (2025)
par: Wang, Xuanhan, et autres
Publié: (2025)
FaceInsight: A Multimodal Large Language Model for Face Perception
par: Li, Jingzhi, et autres
Publié: (2025)
par: Li, Jingzhi, et autres
Publié: (2025)
BRIGHT: A Collaborative Generalist-Specialist Foundation Model for Breast Pathology
par: Guo, Xiaojing, et autres
Publié: (2026)
par: Guo, Xiaojing, et autres
Publié: (2026)
3-Tracer: A Tri-level Temporal-Aware Framework for Audio Forgery Detection and Localization
par: Xia, Shuhan, et autres
Publié: (2025)
par: Xia, Shuhan, et autres
Publié: (2025)
Enhanced Sample Selection with Confidence Tracking: Identifying Correctly Labeled yet Hard-to-Learn Samples in Noisy Data
par: Pan, Weiran, et autres
Publié: (2025)
par: Pan, Weiran, et autres
Publié: (2025)
WaveFace: Authentic Face Restoration with Efficient Frequency Recovery
par: Miao, Yunqi, et autres
Publié: (2024)
par: Miao, Yunqi, et autres
Publié: (2024)
Vision Generalist Model: A Survey
par: Wang, Ziyi, et autres
Publié: (2025)
par: Wang, Ziyi, et autres
Publié: (2025)
Arc2Face: A Foundation Model for ID-Consistent Human Faces
par: Papantoniou, Foivos Paraperas, et autres
Publié: (2024)
par: Papantoniou, Foivos Paraperas, et autres
Publié: (2024)
Hierarchical Dual-Subspace Decoupling for Continual Learning in Vision-Language Models
par: Qin, Mengxin, et autres
Publié: (2026)
par: Qin, Mengxin, et autres
Publié: (2026)
Sage Deer: A Super-Aligned Driving Generalist Is Your Copilot
par: Lu, Hao, et autres
Publié: (2025)
par: Lu, Hao, et autres
Publié: (2025)
A Bridge from Audio to Video: Phoneme-Viseme Alignment Allows Every Face to Speak Multiple Languages
par: Su, Zibo, et autres
Publié: (2025)
par: Su, Zibo, et autres
Publié: (2025)
DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models
par: Qin, Mengxin, et autres
Publié: (2026)
par: Qin, Mengxin, et autres
Publié: (2026)
UMG-CLIP: A Unified Multi-Granularity Vision Generalist for Open-World Understanding
par: Shi, Bowen, et autres
Publié: (2024)
par: Shi, Bowen, et autres
Publié: (2024)
3D-LLaVA: Towards Generalist 3D LMMs with Omni Superpoint Transformer
par: Deng, Jiajun, et autres
Publié: (2025)
par: Deng, Jiajun, et autres
Publié: (2025)
Chimera: Improving Generalist Model with Domain-Specific Experts
par: Peng, Tianshuo, et autres
Publié: (2024)
par: Peng, Tianshuo, et autres
Publié: (2024)
OctoNav: Towards Generalist Embodied Navigation
par: Gao, Chen, et autres
Publié: (2025)
par: Gao, Chen, et autres
Publié: (2025)
DiffusionFace: Towards a Comprehensive Dataset for Diffusion-Based Face Forgery Analysis
par: Chen, Zhongxi, et autres
Publié: (2024)
par: Chen, Zhongxi, et autres
Publié: (2024)
LAST: LeArning to Think in Space and Time for Generalist Vision-Language Models
par: Wang, Shuai, et autres
Publié: (2025)
par: Wang, Shuai, et autres
Publié: (2025)
Perceive, Verify and Understand Long Video: Multi-Granular Perception and Active Verification via Interactive Agents
par: Li, Jiahua, et autres
Publié: (2025)
par: Li, Jiahua, et autres
Publié: (2025)
FaceScore: Benchmarking and Enhancing Face Quality in Human Generation
par: Liao, Zhenyi, et autres
Publié: (2024)
par: Liao, Zhenyi, et autres
Publié: (2024)
Documents similaires
-
Open-Set Facial Expression Recognition
par: Zhang, Yuhang, et autres
Publié: (2024) -
Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
par: Qin, Lixiong, et autres
Publié: (2025) -
Fake-in-Facext: Towards Fine-Grained Explainable DeepFake Analysis
par: Qin, Lixiong, et autres
Publié: (2025) -
Oracle-MNIST: a Dataset of Oracle Characters for Benchmarking Machine Learning Algorithms
par: Wang, Mei, et autres
Publié: (2022) -
Towards Interactive Deepfake Analysis
par: Qin, Lixiong, et autres
Publié: (2025)