Object Counting with GPT-4o and GPT-5: A Comparative Study
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Füzesséry, Richard, Saleh, Kaziwa, Szénási, Sándor, Vámossy, Zoltán |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GPT-4 for Occlusion Order Recovery
par: Saleh, Kaziwa, et autres
Publié: (2025)
par: Saleh, Kaziwa, et autres
Publié: (2025)
Mask Guided Gated Convolution for Amodal Content Completion
par: Saleh, Kaziwa, et autres
Publié: (2024)
par: Saleh, Kaziwa, et autres
Publié: (2024)
PointRegGPT: Boosting 3D Point Cloud Registration using Generative Point-Cloud Pairs for Training
par: Chen, Suyi, et autres
Publié: (2024)
par: Chen, Suyi, et autres
Publié: (2024)
POC-SLT: Partial Object Completion with SDF Latent Transformers
par: Zakeri, Faezeh, et autres
Publié: (2024)
par: Zakeri, Faezeh, et autres
Publié: (2024)
Geo4D: Leveraging Video Generators for Geometric 4D Scene Reconstruction
par: Jiang, Zeren, et autres
Publié: (2025)
par: Jiang, Zeren, et autres
Publié: (2025)
Physics-Inspired Gaussian Kolmogorov-Arnold Networks for X-ray Scatter Correction in Cone-Beam CT
par: Jiang, Xu, et autres
Publié: (2025)
par: Jiang, Xu, et autres
Publié: (2025)
Neural 4D Evolution under Large Topological Changes from 2D Images
par: Razlighi, AmirHossein Naghi, et autres
Publié: (2024)
par: Razlighi, AmirHossein Naghi, et autres
Publié: (2024)
DNRSelect: Active Best View Selection for Deferred Neural Rendering
par: Wu, Dongli, et autres
Publié: (2025)
par: Wu, Dongli, et autres
Publié: (2025)
Saliency-Aware Diffusion Reconstruction for Effective Invisible Watermark Removal
par: Alam, Inzamamul, et autres
Publié: (2025)
par: Alam, Inzamamul, et autres
Publié: (2025)
ODHSR: Online Dense 3D Reconstruction of Humans and Scenes from Monocular Videos
par: Zhang, Zetong, et autres
Publié: (2025)
par: Zhang, Zetong, et autres
Publié: (2025)
AnimatableDreamer: Text-Guided Non-rigid 3D Model Generation and Reconstruction with Canonical Score Distillation
par: Wang, Xinzhou, et autres
Publié: (2023)
par: Wang, Xinzhou, et autres
Publié: (2023)
Data-Efficient Limited-Angle CT Using Deep Priors and Regularization
par: Vahteristo, Ilmari, et autres
Publié: (2025)
par: Vahteristo, Ilmari, et autres
Publié: (2025)
Points2Surf: Learning Implicit Surfaces from Point Cloud Patches
par: Erler, Philipp, et autres
Publié: (2020)
par: Erler, Philipp, et autres
Publié: (2020)
On Scaling Up 3D Gaussian Splatting Training
par: Zhao, Hexu, et autres
Publié: (2024)
par: Zhao, Hexu, et autres
Publié: (2024)
Scale-Invariant Monocular Depth Estimation via SSI Depth
par: Miangoleh, S. Mahdi H., et autres
Publié: (2024)
par: Miangoleh, S. Mahdi H., et autres
Publié: (2024)
Deep Learning for Sea Surface Temperature Reconstruction under Cloud Occlusion
par: Asperti, Andrea, et autres
Publié: (2024)
par: Asperti, Andrea, et autres
Publié: (2024)
Gaussian Herding across Pens: An Optimal Transport Perspective on Global Gaussian Reduction for 3DGS
par: Wang, Tao, et autres
Publié: (2025)
par: Wang, Tao, et autres
Publié: (2025)
SimCol3D -- 3D Reconstruction during Colonoscopy Challenge
par: Rau, Anita, et autres
Publié: (2023)
par: Rau, Anita, et autres
Publié: (2023)
Digging into contrastive learning for robust depth estimation with diffusion models
par: Wang, Jiyuan, et autres
Publié: (2024)
par: Wang, Jiyuan, et autres
Publié: (2024)
PPSURF: Combining Patches and Point Convolutions for Detailed Surface Reconstruction
par: Erler, Philipp, et autres
Publié: (2024)
par: Erler, Philipp, et autres
Publié: (2024)
Single-Scanline Relative Pose Estimation for Rolling Shutter Cameras
par: Hruby, Petr, et autres
Publié: (2025)
par: Hruby, Petr, et autres
Publié: (2025)
Efficient Solution of Point-Line Absolute Pose
par: Hruby, Petr, et autres
Publié: (2024)
par: Hruby, Petr, et autres
Publié: (2024)
Minimal Solvers for Full DoF Motion Estimation from Asynchronous Tracks
par: Hruby, Petr, et autres
Publié: (2025)
par: Hruby, Petr, et autres
Publié: (2025)
CylinderPlane: Nested Cylinder Representation for 3D-aware Image Generation
par: Jia, Ru, et autres
Publié: (2025)
par: Jia, Ru, et autres
Publié: (2025)
Joint Neural Networks for One-shot Object Recognition and Detection
par: Vargas, Camilo J., et autres
Publié: (2024)
par: Vargas, Camilo J., et autres
Publié: (2024)
SPEAK: Speech-Driven Pose and Emotion-Adjustable Talking Head Generation
par: Cai, Changpeng, et autres
Publié: (2024)
par: Cai, Changpeng, et autres
Publié: (2024)
Gaussian Alignment for Relative Camera Pose Estimation via Single-View Reconstruction
par: Li, Yumin, et autres
Publié: (2025)
par: Li, Yumin, et autres
Publié: (2025)
Relightable and Dynamic Gaussian Avatar Reconstruction from Monocular Video
par: Choi, Seonghwa, et autres
Publié: (2025)
par: Choi, Seonghwa, et autres
Publié: (2025)
Web-Scale Collection of Video Data for 4D Animal Reconstruction
par: Zhao, Brian Nlong, et autres
Publié: (2025)
par: Zhao, Brian Nlong, et autres
Publié: (2025)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
A Probabilistic Formulation of LiDAR Mapping with Neural Radiance Fields
par: McDermott, Matthew, et autres
Publié: (2024)
par: McDermott, Matthew, et autres
Publié: (2024)
Illumination and Shadows in Head Rotation: experiments with Denoising Diffusion Models
par: Asperti, Andrea, et autres
Publié: (2023)
par: Asperti, Andrea, et autres
Publié: (2023)
PU-Ray: Domain-Independent Point Cloud Upsampling via Ray Marching on Neural Implicit Surface
par: Lim, Sangwon, et autres
Publié: (2023)
par: Lim, Sangwon, et autres
Publié: (2023)
Attention-guided reference point shifting for Gaussian-mixture-based partial point set registration
par: Kikkawa, Mizuki, et autres
Publié: (2025)
par: Kikkawa, Mizuki, et autres
Publié: (2025)
Generative 3D Gaussians with Learned Density Control
par: Yan, Runjie, et autres
Publié: (2026)
par: Yan, Runjie, et autres
Publié: (2026)
Discontinuity-preserving Normal Integration with Auxiliary Edges
par: Kim, Hyomin, et autres
Publié: (2024)
par: Kim, Hyomin, et autres
Publié: (2024)
Neural Fields for 3D Tracking of Anatomy and Surgical Instruments in Monocular Laparoscopic Video Clips
par: Gerats, Beerend G. A., et autres
Publié: (2024)
par: Gerats, Beerend G. A., et autres
Publié: (2024)
LESV: Language Embedded Sparse Voxel Fusion for Open-Vocabulary 3D Scene Understanding
par: Wang, Fusang, et autres
Publié: (2026)
par: Wang, Fusang, et autres
Publié: (2026)
Flexible-weighted Chamfer Distance: Enhanced Objective Function for Point Cloud Completion
par: Li, Jie, et autres
Publié: (2025)
par: Li, Jie, et autres
Publié: (2025)
VIAFormer: Voxel-Image Alignment Transformer for High-Fidelity Voxel Refinement
par: Fang, Tiancheng, et autres
Publié: (2026)
par: Fang, Tiancheng, et autres
Publié: (2026)
Documents similaires
-
GPT-4 for Occlusion Order Recovery
par: Saleh, Kaziwa, et autres
Publié: (2025) -
Mask Guided Gated Convolution for Amodal Content Completion
par: Saleh, Kaziwa, et autres
Publié: (2024) -
PointRegGPT: Boosting 3D Point Cloud Registration using Generative Point-Cloud Pairs for Training
par: Chen, Suyi, et autres
Publié: (2024) -
POC-SLT: Partial Object Completion with SDF Latent Transformers
par: Zakeri, Faezeh, et autres
Publié: (2024) -
Geo4D: Leveraging Video Generators for Geometric 4D Scene Reconstruction
par: Jiang, Zeren, et autres
Publié: (2025)