3D-COCO: extension of MS-COCO dataset for image detection and 3D reconstruction modules
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bideaux, Maxence, Phe, Alice, Chaouch, Mohamed, Luvison, Bertrand, Pham, Quoc-Cuong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Controllable Generation: Faster Training and Better Performance via $x_0$-Supervision
par: Sangare, Amadou S., et autres
Publié: (2026)
par: Sangare, Amadou S., et autres
Publié: (2026)
From COCO to COCO-FP: A Deep Dive into Background False Positives for COCO Detectors
par: Liu, Longfei, et autres
Publié: (2024)
par: Liu, Longfei, et autres
Publié: (2024)
RoCOCO: Robustness Benchmark of MS-COCO to Stress-test Image-Text Matching Models
par: Park, Seulki, et autres
Publié: (2023)
par: Park, Seulki, et autres
Publié: (2023)
COCONut: Modernizing COCO Segmentation
par: Deng, Xueqing, et autres
Publié: (2024)
par: Deng, Xueqing, et autres
Publié: (2024)
Stable Diffusion for Data Augmentation in COCO and Weed Datasets
par: Deng, Boyang
Publié: (2023)
par: Deng, Boyang
Publié: (2023)
ECCV Caption: Correcting False Negatives by Collecting Machine-and-Human-verified Image-Caption Associations for MS-COCO
par: Chun, Sanghyuk, et autres
Publié: (2022)
par: Chun, Sanghyuk, et autres
Publié: (2022)
COCO is "ALL'' You Need for Visual Instruction Fine-tuning
par: Han, Xiaotian, et autres
Publié: (2024)
par: Han, Xiaotian, et autres
Publié: (2024)
Benchmarking Object Detectors with COCO: A New Path Forward
par: Singh, Shweta, et autres
Publié: (2024)
par: Singh, Shweta, et autres
Publié: (2024)
Valeo Near-Field: a novel dataset for pedestrian intent detection
par: Musabini, Antonyo, et autres
Publié: (2025)
par: Musabini, Antonyo, et autres
Publié: (2025)
ALPI: Auto-Labeller with Proxy Injection for 3D Object Detection using 2D Labels Only
par: Lahlali, Saad, et autres
Publié: (2024)
par: Lahlali, Saad, et autres
Publié: (2024)
COCO-OLAC: A Benchmark for Occluded Panoptic Segmentation and Image Understanding
par: Wei, Wenbo, et autres
Publié: (2024)
par: Wei, Wenbo, et autres
Publié: (2024)
MVAT: Multi-View Aware Teacher for Weakly Supervised 3D Object Detection
par: Lahlali, Saad, et autres
Publié: (2025)
par: Lahlali, Saad, et autres
Publié: (2025)
xMOD: Cross-Modal Distillation for 2D/3D Multi-Object Discovery from 2D motion
par: Lahlali, Saad, et autres
Publié: (2025)
par: Lahlali, Saad, et autres
Publié: (2025)
COCO-Tree: Compositional Hierarchical Concept Trees for Enhanced Reasoning in Vision Language Models
par: Sinha, Sanchit, et autres
Publié: (2025)
par: Sinha, Sanchit, et autres
Publié: (2025)
Any3DIS: Class-Agnostic 3D Instance Segmentation by 2D Mask Tracking
par: Nguyen, Phuc, et autres
Publié: (2024)
par: Nguyen, Phuc, et autres
Publié: (2024)
Fine-Tuning Without Forgetting: Adaptation of YOLOv8 Preserves COCO Performance
par: Gandhi, Vishal, et autres
Publié: (2025)
par: Gandhi, Vishal, et autres
Publié: (2025)
COCO-Inpaint: A Benchmark for Detecting and Localizing Inpainting-Based Image Manipulations
par: Yan, Haozhen, et autres
Publié: (2025)
par: Yan, Haozhen, et autres
Publié: (2025)
HuSc3D: Human Sculpture dataset for 3D object reconstruction
par: Smolak-Dyżewska, Weronika, et autres
Publié: (2025)
par: Smolak-Dyżewska, Weronika, et autres
Publié: (2025)
A COCO-Formatted Instance-Level Dataset for Plasmodium Falciparum Detection in Giemsa-Stained Blood Smears
par: Wilm, Frauke, et autres
Publié: (2025)
par: Wilm, Frauke, et autres
Publié: (2025)
Learning Feature Inversion for Multi-class Anomaly Detection under General-purpose COCO-AD Benchmark
par: Zhang, Jiangning, et autres
Publié: (2024)
par: Zhang, Jiangning, et autres
Publié: (2024)
Semantic BIM enrichment for firefighting assets: Fire-ART dataset and panoramic image-based 3D reconstruction
par: Wen, Ya, et autres
Publié: (2025)
par: Wen, Ya, et autres
Publié: (2025)
ARM3D: Attention-based relation module for indoor 3D object detection
par: Lan, Yuqing, et autres
Publié: (2022)
par: Lan, Yuqing, et autres
Publié: (2022)
Open3DIS: Open-Vocabulary 3D Instance Segmentation with 2D Mask Guidance
par: Nguyen, Phuc D. A., et autres
Publié: (2023)
par: Nguyen, Phuc D. A., et autres
Publié: (2023)
Pix2Cap-COCO: Advancing Visual Comprehension via Pixel-Level Captioning
par: You, Zuyao, et autres
Publié: (2025)
par: You, Zuyao, et autres
Publié: (2025)
Reliable and Reproducible Demographic Inference for Fairness in Face Analysis
par: Fournier-Montgieux, Alexandre, et autres
Publié: (2025)
par: Fournier-Montgieux, Alexandre, et autres
Publié: (2025)
EFHQ: Multi-purpose ExtremePose-Face-HQ dataset
par: Dao, Trung Tuan, et autres
Publié: (2023)
par: Dao, Trung Tuan, et autres
Publié: (2023)
OE3DIS: Open-Ended 3D Point Cloud Instance Segmentation
par: Nguyen, Phuc D. A., et autres
Publié: (2024)
par: Nguyen, Phuc D. A., et autres
Publié: (2024)
Benchmarking Adversarial Robustness and Adversarial Training Strategies for Object Detection
par: Winter, Alexis, et autres
Publié: (2026)
par: Winter, Alexis, et autres
Publié: (2026)
RealSynCol: a high-fidelity synthetic colon dataset for 3D reconstruction applications
par: Lena, Chiara, et autres
Publié: (2026)
par: Lena, Chiara, et autres
Publié: (2026)
Pose Matters: Evaluating Vision Transformers and CNNs for Human Action Recognition on Small COCO Subsets
par: Tang, MingZe, et autres
Publié: (2025)
par: Tang, MingZe, et autres
Publié: (2025)
Fairer Analysis and Demographically Balanced Face Generation for Fairer Face Verification
par: Fournier-Montgieux, Alexandre, et autres
Publié: (2024)
par: Fournier-Montgieux, Alexandre, et autres
Publié: (2024)
Toward Fairer Face Recognition Datasets
par: Fournier-Montgieux, Alexandre, et autres
Publié: (2024)
par: Fournier-Montgieux, Alexandre, et autres
Publié: (2024)
Joint stereo 3D object detection and implicit surface reconstruction
par: Li, Shichao, et autres
Publié: (2021)
par: Li, Shichao, et autres
Publié: (2021)
AppleGrowthVision: A large-scale stereo dataset for phenological analysis, fruit detection, and 3D reconstruction in apple orchards
par: von Hirschhausen, Laura-Sophia, et autres
Publié: (2025)
par: von Hirschhausen, Laura-Sophia, et autres
Publié: (2025)
Flow Matching for Probabilistic Monocular 3D Human Pose Estimation
par: Le, Cuong, et autres
Publié: (2026)
par: Le, Cuong, et autres
Publié: (2026)
UniDet3D: Multi-dataset Indoor 3D Object Detection
par: Kolodiazhnyi, Maksim, et autres
Publié: (2024)
par: Kolodiazhnyi, Maksim, et autres
Publié: (2024)
COCO-Urdu: A Large-Scale Urdu Image-Caption Dataset with Multimodal Quality Estimation
par: Hassan, Umair
Publié: (2025)
par: Hassan, Umair
Publié: (2025)
HICO-DET-SG and V-COCO-SG: New Data Splits for Evaluating the Systematic Generalization Performance of Human-Object Interaction Detection Models
par: Takemoto, Kentaro, et autres
Publié: (2023)
par: Takemoto, Kentaro, et autres
Publié: (2023)
Transformer-based stereo-aware 3D object detection from binocular images
par: Sun, Hanqing, et autres
Publié: (2023)
par: Sun, Hanqing, et autres
Publié: (2023)
PLANesT-3D: A new annotated dataset for segmentation of 3D plant point clouds
par: Mertoğlu, Kerem, et autres
Publié: (2024)
par: Mertoğlu, Kerem, et autres
Publié: (2024)
Documents similaires
-
Improving Controllable Generation: Faster Training and Better Performance via $x_0$-Supervision
par: Sangare, Amadou S., et autres
Publié: (2026) -
From COCO to COCO-FP: A Deep Dive into Background False Positives for COCO Detectors
par: Liu, Longfei, et autres
Publié: (2024) -
RoCOCO: Robustness Benchmark of MS-COCO to Stress-test Image-Text Matching Models
par: Park, Seulki, et autres
Publié: (2023) -
COCONut: Modernizing COCO Segmentation
par: Deng, Xueqing, et autres
Publié: (2024) -
Stable Diffusion for Data Augmentation in COCO and Weed Datasets
par: Deng, Boyang
Publié: (2023)