Transforming faces into video stories -- VideoFace2.0
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Brkljač, Branko, Kalušev, Vladimir, Popović, Branislav, Sečujski, Milan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Person detection and re-identification in open-world settings of retail stores and public spaces
par: Brkljač, Branko, et autres
Publié: (2025)
par: Brkljač, Branko, et autres
Publié: (2025)
Named entity recognition for Serbian legal documents: Design, methodology and dataset development
par: Kalušev, Vladimir, et autres
Publié: (2025)
par: Kalušev, Vladimir, et autres
Publié: (2025)
Multi-Agent Object Detection Framework Based on Raspberry Pi YOLO Detector and Slack-Ollama Natural Language Interface
par: Kalušev, Vladimir, et autres
Publié: (2026)
par: Kalušev, Vladimir, et autres
Publié: (2026)
Fairness Without Labels: Pseudo-Balancing for Bias Mitigation in Face Gender Classification
par: Dong, Haohua, et autres
Publié: (2025)
par: Dong, Haohua, et autres
Publié: (2025)
Polarization-Based Eye Tracking with Personalized Siamese Architectures
par: Kalkanli, Beyza, et autres
Publié: (2026)
par: Kalkanli, Beyza, et autres
Publié: (2026)
Deep Learning-Based Multi-Object Tracking: A Comprehensive Survey from Foundations to State-of-the-Art
par: Adžemović, Momir
Publié: (2025)
par: Adžemović, Momir
Publié: (2025)
TerraSeg: Self-Supervised Ground Segmentation for Any LiDAR
par: Lentsch, Ted, et autres
Publié: (2026)
par: Lentsch, Ted, et autres
Publié: (2026)
UNION: Unsupervised 3D Object Detection using Object Appearance-based Pseudo-Classes
par: Lentsch, Ted, et autres
Publié: (2024)
par: Lentsch, Ted, et autres
Publié: (2024)
MVTamperBench: Evaluating Robustness of Vision-Language Models
par: Agarwal, Amit, et autres
Publié: (2024)
par: Agarwal, Amit, et autres
Publié: (2024)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
AQFusionNet: Multimodal Deep Learning for Air Quality Index Prediction with Imagery and Sensor Data
par: Kushal, Koushik Ahmed, et autres
Publié: (2025)
par: Kushal, Koushik Ahmed, et autres
Publié: (2025)
ARTPS: Depth-Enhanced Hybrid Anomaly Detection and Learnable Curiosity Score for Autonomous Rover Target Prioritization
par: Baydemir, Poyraz
Publié: (2025)
par: Baydemir, Poyraz
Publié: (2025)
TRACES: Temporal Recall with Contextual Embeddings for Real-Time Video Anomaly Detection
par: Siddiqui, Yousuf Ahmed, et autres
Publié: (2025)
par: Siddiqui, Yousuf Ahmed, et autres
Publié: (2025)
YOLO Ensemble for UAV-based Multispectral Defect Detection in Wind Turbine Components
par: Svystun, Serhii, et autres
Publié: (2025)
par: Svystun, Serhii, et autres
Publié: (2025)
Enhancing Maritime Object Detection in Real-Time with RT-DETR and Data Augmentation
par: Nemati, Nader
Publié: (2025)
par: Nemati, Nader
Publié: (2025)
Wafer Map Defect Classification Using Autoencoder-Based Data Augmentation and Convolutional Neural Network
par: Bao, Yin-Yin, et autres
Publié: (2024)
par: Bao, Yin-Yin, et autres
Publié: (2024)
ISO/IEC-Compliant Match-on-Card Face Verification with Short Binary Templates
par: Ganmati, Abdelilah, et autres
Publié: (2025)
par: Ganmati, Abdelilah, et autres
Publié: (2025)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
par: Gad, Eyad, et autres
Publié: (2025)
par: Gad, Eyad, et autres
Publié: (2025)
TowerVision: Understanding and Improving Multilinguality in Vision-Language Models
par: Viveiros, André G., et autres
Publié: (2025)
par: Viveiros, André G., et autres
Publié: (2025)
Data Augmentation and Resolution Enhancement using GANs and Diffusion Models for Tree Segmentation
par: Ferreira, Alessandro dos Santos, et autres
Publié: (2025)
par: Ferreira, Alessandro dos Santos, et autres
Publié: (2025)
Parameter-efficient fine-tuning (PEFT) of Vision Foundation Models for Atypical Mitotic Figure Classification
par: Ramchandani, Lavish, et autres
Publié: (2025)
par: Ramchandani, Lavish, et autres
Publié: (2025)
HieraEdgeNet: A Multi-Scale Edge-Enhanced Framework for Automated Pollen Recognition
par: Long, Yuchong, et autres
Publié: (2025)
par: Long, Yuchong, et autres
Publié: (2025)
Corn Ear Detection and Orientation Estimation Using Deep Learning
par: Sprague, Nathan, et autres
Publié: (2024)
par: Sprague, Nathan, et autres
Publié: (2024)
Gr-IoU: Ground-Intersection over Union for Robust Multi-Object Tracking with 3D Geometric Constraints
par: Toida, Keisuke, et autres
Publié: (2024)
par: Toida, Keisuke, et autres
Publié: (2024)
See What You Need: Query-Aware Visual Intelligence through Reasoning-Perception Loops
par: Dong, Zixuan, et autres
Publié: (2025)
par: Dong, Zixuan, et autres
Publié: (2025)
Heart Failure Prediction using Modal Decomposition and Masked Autoencoders for Scarce Echocardiography Databases
par: Bell-Navas, Andrés, et autres
Publié: (2025)
par: Bell-Navas, Andrés, et autres
Publié: (2025)
A deep learning approach to track eye movements based on events
par: Seth, Chirag, et autres
Publié: (2025)
par: Seth, Chirag, et autres
Publié: (2025)
CaLoRAify: Calorie Estimation with Visual-Text Pairing and LoRA-Driven Visual Language Models
par: Yao, Dongyu, et autres
Publié: (2024)
par: Yao, Dongyu, et autres
Publié: (2024)
WildfireVLM: AI-powered Analysis for Early Wildfire Detection and Risk Assessment Using Satellite Imagery
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
par: Ayanzadeh, Aydin, et autres
Publié: (2026)
AVATAAR: Agentic Video Answering via Temporal Adaptive Alignment and Reasoning
par: Patel, Urjitkumar, et autres
Publié: (2025)
par: Patel, Urjitkumar, et autres
Publié: (2025)
Hierarchical Point-Patch Fusion with Adaptive Patch Codebook for 3D Shape Anomaly Detection
par: Kang, Xueyang, et autres
Publié: (2026)
par: Kang, Xueyang, et autres
Publié: (2026)
VALE: A Multimodal Visual and Language Explanation Framework for Image Classifiers using eXplainable AI and Language Models
par: Natarajan, Purushothaman, et autres
Publié: (2024)
par: Natarajan, Purushothaman, et autres
Publié: (2024)
Attenuation-adjusted deep learning of pore defects in 2D radiographs of additive manufacturing powders
par: Bjerregaard, Andreas, et autres
Publié: (2024)
par: Bjerregaard, Andreas, et autres
Publié: (2024)
Learning Association via Track-Detection Matching for Multi-Object Tracking
par: Adžemović, Momir
Publié: (2025)
par: Adžemović, Momir
Publié: (2025)
ROI-GS: Interest-based Local Quality 3D Gaussian Splatting
par: Bui, Quoc-Anh, et autres
Publié: (2025)
par: Bui, Quoc-Anh, et autres
Publié: (2025)
ROI-NeRFs: Hi-Fi Visualization of Objects of Interest within a Scene by NeRFs Composition
par: Bui, Quoc-Anh, et autres
Publié: (2025)
par: Bui, Quoc-Anh, et autres
Publié: (2025)
VQToken: Neural Discrete Token Representation Learning for Extreme Token Reduction in Video Large Language Models
par: Zhang, Haichao, et autres
Publié: (2025)
par: Zhang, Haichao, et autres
Publié: (2025)
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
par: Qesaraku, Bjorna, et autres
Publié: (2025)
par: Qesaraku, Bjorna, et autres
Publié: (2025)
LRCP: Low-Rank Compressibility Guided Visual Token Pruning for Efficient LVLMs
par: Lu, Hongyu, et autres
Publié: (2026)
par: Lu, Hongyu, et autres
Publié: (2026)
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
par: Kazemi, Amir, et autres
Publié: (2024)
par: Kazemi, Amir, et autres
Publié: (2024)
Documents similaires
-
Person detection and re-identification in open-world settings of retail stores and public spaces
par: Brkljač, Branko, et autres
Publié: (2025) -
Named entity recognition for Serbian legal documents: Design, methodology and dataset development
par: Kalušev, Vladimir, et autres
Publié: (2025) -
Multi-Agent Object Detection Framework Based on Raspberry Pi YOLO Detector and Slack-Ollama Natural Language Interface
par: Kalušev, Vladimir, et autres
Publié: (2026) -
Fairness Without Labels: Pseudo-Balancing for Bias Mitigation in Face Gender Classification
par: Dong, Haohua, et autres
Publié: (2025) -
Polarization-Based Eye Tracking with Personalized Siamese Architectures
par: Kalkanli, Beyza, et autres
Publié: (2026)