Vision-Based Approach for Food Weight Estimation from 2D Images
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wimalasiri, Chathura, Sahoo, Prasan Kumar |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Task-Aligned Self-Supervised Learning for Medical Image Analysis: A Systematic Review and Practical Design Guidelines
par: Wimalasiri, Chathura
Publié: (2026)
par: Wimalasiri, Chathura
Publié: (2026)
Artificial Intelligence in the Food Industry: Food Waste Estimation based on Computer Vision, a Brief Case Study in a University Dining Hall
par: Rokhva, Shayan, et autres
Publié: (2025)
par: Rokhva, Shayan, et autres
Publié: (2025)
An Object-Based Deep Learning Approach for Building Height Estimation from Single SAR Images
par: Memar, Babak, et autres
Publié: (2025)
par: Memar, Babak, et autres
Publié: (2025)
Swin-TUNA : A Novel PEFT Approach for Accurate Food Image Segmentation
par: Chen, Haotian, et autres
Publié: (2025)
par: Chen, Haotian, et autres
Publié: (2025)
Vision-Based Water Level and Flow Estimation
par: Sun, ZhiXin
Publié: (2026)
par: Sun, ZhiXin
Publié: (2026)
Extending 6D Object Pose Estimators for Stereo Vision
par: Pöllabauer, Thomas, et autres
Publié: (2024)
par: Pöllabauer, Thomas, et autres
Publié: (2024)
Are Vision-Language Models Ready for Dietary Assessment? Exploring the Next Frontier in AI-Powered Food Image Recognition
par: Romero-Tapiador, Sergio, et autres
Publié: (2025)
par: Romero-Tapiador, Sergio, et autres
Publié: (2025)
Boosting 3D Neuron Segmentation with 2D Vision Transformer Pre-trained on Natural Images
par: Cheng, Yik San, et autres
Publié: (2024)
par: Cheng, Yik San, et autres
Publié: (2024)
Connecting Vision and Emissions: A Behavioural AI Approach to Carbon Estimation in Road Design
par: Mhdawi, Ammar K Al, et autres
Publié: (2025)
par: Mhdawi, Ammar K Al, et autres
Publié: (2025)
Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding
par: Clark, Christopher, et autres
Publié: (2026)
par: Clark, Christopher, et autres
Publié: (2026)
GaussianVision: Vision-Language Alignment from Compressed Image Representations using 2D Gaussian Splatting
par: Omri, Yasmine, et autres
Publié: (2025)
par: Omri, Yasmine, et autres
Publié: (2025)
How Much You Ate? Food Portion Estimation on Spoons
par: Sharma, Aaryam, et autres
Publié: (2024)
par: Sharma, Aaryam, et autres
Publié: (2024)
Depth Estimation using Weighted-loss and Transfer Learning
par: Hafeez, Muhammad Adeel, et autres
Publié: (2024)
par: Hafeez, Muhammad Adeel, et autres
Publié: (2024)
VFM-VLM: Vision Foundation Model and Vision Language Model based Visual Comparison for 3D Pose Estimation
par: Sarowar, Md Selim, et autres
Publié: (2025)
par: Sarowar, Md Selim, et autres
Publié: (2025)
Safe Vision-Language Models via Unsafe Weights Manipulation
par: D'Incà, Moreno, et autres
Publié: (2025)
par: D'Incà, Moreno, et autres
Publié: (2025)
Lost in OCR Translation? Vision-Based Approaches to Robust Document Retrieval
par: Most, Alexander, et autres
Publié: (2025)
par: Most, Alexander, et autres
Publié: (2025)
Robust Conformal Volume Estimation in 3D Medical Images
par: Lambert, Benjamin, et autres
Publié: (2024)
par: Lambert, Benjamin, et autres
Publié: (2024)
A Generative Approach to High Fidelity 3D Reconstruction from Text Data
par: R, Venkat Kumar, et autres
Publié: (2025)
par: R, Venkat Kumar, et autres
Publié: (2025)
Triad: Vision Foundation Model for 3D Magnetic Resonance Imaging
par: Wang, Shansong, et autres
Publié: (2025)
par: Wang, Shansong, et autres
Publié: (2025)
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
par: Qi, Huiyan, et autres
Publié: (2025)
par: Qi, Huiyan, et autres
Publié: (2025)
RDPN6D: Residual-based Dense Point-wise Network for 6Dof Object Pose Estimation Based on RGB-D Images
par: Hong, Zong-Wei, et autres
Publié: (2024)
par: Hong, Zong-Wei, et autres
Publié: (2024)
Texture Image Synthesis Using Spatial GAN Based on Vision Transformers
par: Salari, Elahe, et autres
Publié: (2025)
par: Salari, Elahe, et autres
Publié: (2025)
A Tiered GAN Approach for Monet-Style Image Generation
par: Neha, FNU, et autres
Publié: (2024)
par: Neha, FNU, et autres
Publié: (2024)
Detecting Korean Food Using Image using Hierarchical Model
par: Lam, Hoang Khanh, et autres
Publié: (2024)
par: Lam, Hoang Khanh, et autres
Publié: (2024)
Size Matters: Reconstructing Real-Scale 3D Models from Monocular Images for Food Portion Estimation
par: Vinod, Gautham, et autres
Publié: (2026)
par: Vinod, Gautham, et autres
Publié: (2026)
IWP: Token Pruning as Implicit Weight Pruning in Large Vision Language Models
par: Lee, Dong-Jae, et autres
Publié: (2026)
par: Lee, Dong-Jae, et autres
Publié: (2026)
Generalized Single-Image-Based Morphing Attack Detection Using Deep Representations from Vision Transformer
par: Zhang, Haoyu, et autres
Publié: (2025)
par: Zhang, Haoyu, et autres
Publié: (2025)
Semantic Causality-Aware Vision-Based 3D Occupancy Prediction
par: Chen, Dubing, et autres
Publié: (2025)
par: Chen, Dubing, et autres
Publié: (2025)
VLM6D: VLM based 6Dof Pose Estimation based on RGB-D Images
par: Sarowar, Md Selim, et autres
Publié: (2025)
par: Sarowar, Md Selim, et autres
Publié: (2025)
Polyp detection in colonoscopy images using YOLOv11
par: Sahoo, Alok Ranjan, et autres
Publié: (2025)
par: Sahoo, Alok Ranjan, et autres
Publié: (2025)
Vision without Images: End-to-End Computer Vision from Single Compressive Measurements
par: Pan, Fengpu, et autres
Publié: (2025)
par: Pan, Fengpu, et autres
Publié: (2025)
I Detect What I Don't Know: Incremental Anomaly Learning with Stochastic Weight Averaging-Gaussian for Oracle-Free Medical Imaging
par: Yadav, Nand Kumar, et autres
Publié: (2025)
par: Yadav, Nand Kumar, et autres
Publié: (2025)
KeepOriginalAugment: Single Image-based Better Information-Preserving Data Augmentation Approach
par: Kumar, Teerath, et autres
Publié: (2024)
par: Kumar, Teerath, et autres
Publié: (2024)
Feature-Enhanced TResNet for Fine-Grained Food Image Classification
par: Liu, Lulu, et autres
Publié: (2025)
par: Liu, Lulu, et autres
Publié: (2025)
TernaryCLIP: Efficiently Compressing Vision-Language Models with Ternary Weights and Distilled Knowledge
par: Zhang, Shu-Hao, et autres
Publié: (2025)
par: Zhang, Shu-Hao, et autres
Publié: (2025)
Image2Struct: Benchmarking Structure Extraction for Vision-Language Models
par: Roberts, Josselin Somerville, et autres
Publié: (2024)
par: Roberts, Josselin Somerville, et autres
Publié: (2024)
Hybrid Transformer for Early Alzheimer's Detection: Integration of Handwriting-Based 2D Images and 1D Signal Features
par: Gong, Changqing, et autres
Publié: (2024)
par: Gong, Changqing, et autres
Publié: (2024)
Are General-Purpose Vision Models All We Need for 2D Medical Image Segmentation? A Cross-Dataset Empirical Study
par: Borst, Vanessa, et autres
Publié: (2026)
par: Borst, Vanessa, et autres
Publié: (2026)
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
par: Kaduri, Omri, et autres
Publié: (2024)
par: Kaduri, Omri, et autres
Publié: (2024)
CheXmix: Unified Generative Pretraining for Vision Language Models in Medical Imaging
par: Kumar, Ashwin, et autres
Publié: (2026)
par: Kumar, Ashwin, et autres
Publié: (2026)
Documents similaires
-
Task-Aligned Self-Supervised Learning for Medical Image Analysis: A Systematic Review and Practical Design Guidelines
par: Wimalasiri, Chathura
Publié: (2026) -
Artificial Intelligence in the Food Industry: Food Waste Estimation based on Computer Vision, a Brief Case Study in a University Dining Hall
par: Rokhva, Shayan, et autres
Publié: (2025) -
An Object-Based Deep Learning Approach for Building Height Estimation from Single SAR Images
par: Memar, Babak, et autres
Publié: (2025) -
Swin-TUNA : A Novel PEFT Approach for Accurate Food Image Segmentation
par: Chen, Haotian, et autres
Publié: (2025) -
Vision-Based Water Level and Flow Estimation
par: Sun, ZhiXin
Publié: (2026)