DAViD: Data-efficient and Accurate Vision Models from Synthetic Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saleh, Fatemeh, Aliakbarian, Sadegh, Hewitt, Charlie, Petikam, Lohit, Xiao-Xian, Criminisi, Antonio, Cashman, Thomas J., Baltrušaitis, Tadas |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Eyelid Fold Consistency in Facial Modeling
par: Petikam, Lohit, et autres
Publié: (2024)
par: Petikam, Lohit, et autres
Publié: (2024)
Look Ma, no markers: holistic performance capture without the hassle
par: Hewitt, Charlie, et autres
Publié: (2024)
par: Hewitt, Charlie, et autres
Publié: (2024)
SimpleEgo: Predicting Probabilistic Body Pose from Egocentric Cameras
par: Cuevas-Velasquez, Hanz, et autres
Publié: (2024)
par: Cuevas-Velasquez, Hanz, et autres
Publié: (2024)
DAViD: Modeling Dynamic Affordance of 3D Objects Using Pre-trained Video Diffusion Models
par: Kim, Hyeonwoo, et autres
Publié: (2025)
par: Kim, Hyeonwoo, et autres
Publié: (2025)
Differentially Private Synthetic Data via APIs 3: Using Simulators Instead of Foundation Model
par: Lin, Zinan, et autres
Publié: (2025)
par: Lin, Zinan, et autres
Publié: (2025)
Hairmony: Fairness-aware hairstyle classification
par: Meishvili, Givi, et autres
Publié: (2024)
par: Meishvili, Givi, et autres
Publié: (2024)
VoluMe -- Authentic 3D Video Calls from Live Gaussian Splat Prediction
par: de La Gorce, Martin, et autres
Publié: (2025)
par: de La Gorce, Martin, et autres
Publié: (2025)
GASP: Gaussian Avatars with Synthetic Priors
par: Saunders, Jack, et autres
Publié: (2024)
par: Saunders, Jack, et autres
Publié: (2024)
GeoGen: Geometry-Aware Generative Modeling via Signed Distance Functions
par: Esposito, Salvatore, et autres
Publié: (2024)
par: Esposito, Salvatore, et autres
Publié: (2024)
3DiFACE: Synthesizing and Editing Holistic 3D Facial Animation
par: Thambiraja, Balamurugan, et autres
Publié: (2025)
par: Thambiraja, Balamurugan, et autres
Publié: (2025)
SympCam: Remote Optical Measurement of Sympathetic Arousal
par: Braun, Björn, et autres
Publié: (2024)
par: Braun, Björn, et autres
Publié: (2024)
SemiDAViL: Semi-supervised Domain Adaptation with Vision-Language Guidance for Semantic Segmentation
par: Basak, Hritam, et autres
Publié: (2025)
par: Basak, Hritam, et autres
Publié: (2025)
3D Vision and Language Pretraining with Large-Scale Synthetic Data
par: Yang, Dejie, et autres
Publié: (2024)
par: Yang, Dejie, et autres
Publié: (2024)
Total-Editing: Head Avatar with Editable Appearance, Motion, and Lighting
par: Zhao, Yizhou, et autres
Publié: (2025)
par: Zhao, Yizhou, et autres
Publié: (2025)
Scaling Up Forest Vision with Synthetic Data
par: She, Yihang, et autres
Publié: (2025)
par: She, Yihang, et autres
Publié: (2025)
Enhancing Vision-Language Compositional Understanding with Multimodal Synthetic Data
par: Li, Haoxin, et autres
Publié: (2025)
par: Li, Haoxin, et autres
Publié: (2025)
Nods of Agreement: Webcam-Driven Avatars Improve Meeting Outcomes and Avatar Satisfaction Over Audio-Driven or Static Avatars in All-Avatar Work Videoconferencing
par: Ma, Fang, et autres
Publié: (2024)
par: Ma, Fang, et autres
Publié: (2024)
Data-efficient Large Vision Models through Sequential Autoregression
par: Guo, Jianyuan, et autres
Publié: (2024)
par: Guo, Jianyuan, et autres
Publié: (2024)
Train a Unified Multimodal Data Quality Classifier with Synthetic Data
par: Wang, Weizhi, et autres
Publié: (2025)
par: Wang, Weizhi, et autres
Publié: (2025)
Synthetic Data is an Elegant GIFT for Continual Vision-Language Models
par: Wu, Bin, et autres
Publié: (2025)
par: Wu, Bin, et autres
Publié: (2025)
Vision-Language Synthetic Data Enhances Echocardiography Downstream Tasks
par: Ashrafian, Pooria, et autres
Publié: (2024)
par: Ashrafian, Pooria, et autres
Publié: (2024)
Fake & Square: Training Self-Supervised Vision Transformers with Synthetic Data and Synthetic Hard Negatives
par: Giakoumoglou, Nikolaos, et autres
Publié: (2025)
par: Giakoumoglou, Nikolaos, et autres
Publié: (2025)
Auto-Vocabulary 3D Object Detection
par: Zhang, Haomeng, et autres
Publié: (2025)
par: Zhang, Haomeng, et autres
Publié: (2025)
Few-Shot Synthetic Data Generation with Diffusion Models for Downstream Vision Tasks
par: Dushenev, Daniil, et autres
Publié: (2026)
par: Dushenev, Daniil, et autres
Publié: (2026)
SARFormer -- An Acquisition Parameter Aware Vision Transformer for Synthetic Aperture Radar Data
par: Prexl, Jonathan, et autres
Publié: (2025)
par: Prexl, Jonathan, et autres
Publié: (2025)
Synthetic Data for Robust Runway Detection
par: Chigot, Estelle, et autres
Publié: (2025)
par: Chigot, Estelle, et autres
Publié: (2025)
Synth-Align: Improving Trustworthiness in Vision-Language Model with Synthetic Preference Data Alignment
par: Wijaya, Robert, et autres
Publié: (2024)
par: Wijaya, Robert, et autres
Publié: (2024)
Can Medical Vision-Language Pre-training Succeed with Purely Synthetic Data?
par: Liu, Che, et autres
Publié: (2024)
par: Liu, Che, et autres
Publié: (2024)
SpaRE: Enhancing Spatial Reasoning in Vision-Language Models with Synthetic Data
par: Ogezi, Michael, et autres
Publié: (2025)
par: Ogezi, Michael, et autres
Publié: (2025)
Understanding Counting Mechanisms in Large Language and Vision-Language Models
par: Hasani, Hosein, et autres
Publié: (2025)
par: Hasani, Hosein, et autres
Publié: (2025)
SynFER: Towards Boosting Facial Expression Recognition with Synthetic Data
par: He, Xilin, et autres
Publié: (2024)
par: He, Xilin, et autres
Publié: (2024)
Learning Keypoints for Robotic Cloth Manipulation using Synthetic Data
par: Lips, Thomas, et autres
Publié: (2024)
par: Lips, Thomas, et autres
Publié: (2024)
Transferring Relative Monocular Depth to Surgical Vision with Temporal Consistency
par: Budd, Charlie, et autres
Publié: (2024)
par: Budd, Charlie, et autres
Publié: (2024)
SEED4D: A Synthetic Ego--Exo Dynamic 4D Data Generator, Driving Dataset and Benchmark
par: Kästingschäfer, Marius, et autres
Publié: (2024)
par: Kästingschäfer, Marius, et autres
Publié: (2024)
AnySynth: Harnessing the Power of Image Synthetic Data Generation for Generalized Vision-Language Tasks
par: Li, You, et autres
Publié: (2024)
par: Li, You, et autres
Publié: (2024)
Synthetic Data Generation for 3D Myocardium Deformation Analysis
par: Zuler, Shahar, et autres
Publié: (2024)
par: Zuler, Shahar, et autres
Publié: (2024)
Enhancing 3D LiDAR Segmentation by Shaping Dense and Accurate 2D Semantic Predictions
par: Dong, Xiaoyu, et autres
Publié: (2026)
par: Dong, Xiaoyu, et autres
Publié: (2026)
SynGen-Vision: Synthetic Data Generation for training industrial vision models
par: Dubey, Alpana, et autres
Publié: (2025)
par: Dubey, Alpana, et autres
Publié: (2025)
3DArticCyclists: Generating Synthetic Articulated 8D Pose-Controllable Cyclist Data for Computer Vision Applications
par: Corral-Soto, Eduardo R., et autres
Publié: (2024)
par: Corral-Soto, Eduardo R., et autres
Publié: (2024)
Pre-training with 3D Synthetic Data: Learning 3D Point Cloud Instance Segmentation from 3D Synthetic Scenes
par: Otsuka, Daichi, et autres
Publié: (2025)
par: Otsuka, Daichi, et autres
Publié: (2025)
Documents similaires
-
Eyelid Fold Consistency in Facial Modeling
par: Petikam, Lohit, et autres
Publié: (2024) -
Look Ma, no markers: holistic performance capture without the hassle
par: Hewitt, Charlie, et autres
Publié: (2024) -
SimpleEgo: Predicting Probabilistic Body Pose from Egocentric Cameras
par: Cuevas-Velasquez, Hanz, et autres
Publié: (2024) -
DAViD: Modeling Dynamic Affordance of 3D Objects Using Pre-trained Video Diffusion Models
par: Kim, Hyeonwoo, et autres
Publié: (2025) -
Differentially Private Synthetic Data via APIs 3: Using Simulators Instead of Foundation Model
par: Lin, Zinan, et autres
Publié: (2025)