DietDelta: A Vision-Language Approach for Dietary Assessment via Before-and-After Images
Fuente:
arXiv
Saved in:
| Main Authors: | Vinod, Gautham, Raghavan, Siddeshwar, Coburn, Bruce, Zhu, Fengqing |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception
by: Vinod, Gautham, et al.
Published: (2026)
by: Vinod, Gautham, et al.
Published: (2026)
Food Portion Estimation: From Pixels to Calories
by: Vinod, Gautham, et al.
Published: (2026)
by: Vinod, Gautham, et al.
Published: (2026)
Size Matters: Reconstructing Real-Scale 3D Models from Monocular Images for Food Portion Estimation
by: Vinod, Gautham, et al.
Published: (2026)
by: Vinod, Gautham, et al.
Published: (2026)
Food Portion Estimation via 3D Object Scaling
by: Vinod, Gautham, et al.
Published: (2024)
by: Vinod, Gautham, et al.
Published: (2024)
MFP3D: Monocular Food Portion Estimation Leveraging 3D Point Clouds
by: Ma, Jinge, et al.
Published: (2024)
by: Ma, Jinge, et al.
Published: (2024)
PANDA -- Patch And Distribution-Aware Augmentation for Long-Tailed Exemplar-Free Continual Learning
by: Raghavan, Siddeshwar, et al.
Published: (2025)
by: Raghavan, Siddeshwar, et al.
Published: (2025)
Can You Hear, Localize, and Segment Continually? An Exemplar-Free Continual Learning Benchmark for Audio-Visual Segmentation
by: Raghavan, Siddeshwar, et al.
Published: (2026)
by: Raghavan, Siddeshwar, et al.
Published: (2026)
Enhanced Dermatology Image Quality Assessment via Cross-Domain Training
by: Montilla, Ignacio Hernández, et al.
Published: (2025)
by: Montilla, Ignacio Hernández, et al.
Published: (2025)
Sliced Maximal Information Coefficient: A Training-Free Approach for Image Quality Assessment Enhancement
by: Xiao, Kang, et al.
Published: (2024)
by: Xiao, Kang, et al.
Published: (2024)
Surveillance Facial Image Quality Assessment: A Multi-dimensional Dataset and Lightweight Model
by: Jiang, Yanwei, et al.
Published: (2026)
by: Jiang, Yanwei, et al.
Published: (2026)
Fine-grained Image Quality Assessment for Perceptual Image Restoration
by: Sheng, Xiangfei, et al.
Published: (2025)
by: Sheng, Xiangfei, et al.
Published: (2025)
Perceptual Depth Quality Assessment of Stereoscopic Omnidirectional Images
by: Zhou, Wei, et al.
Published: (2024)
by: Zhou, Wei, et al.
Published: (2024)
Image Quality Assessment: From Human to Machine Preference
by: Li, Chunyi, et al.
Published: (2025)
by: Li, Chunyi, et al.
Published: (2025)
Enhanced Quality Aware-Scalable Underwater Image Compression
by: Zhu, Linwei, et al.
Published: (2025)
by: Zhu, Linwei, et al.
Published: (2025)
Off-the-shelf Vision Models Benefit Image Manipulation Localization
by: Zhang, Zhengxuan, et al.
Published: (2026)
by: Zhang, Zhengxuan, et al.
Published: (2026)
Ultrasound-QBench: Can LLMs Aid in Quality Assessment of Ultrasound Imaging?
by: Miao, Hongyi, et al.
Published: (2025)
by: Miao, Hongyi, et al.
Published: (2025)
Perceptual Video Quality Assessment: A Survey
by: Min, Xiongkuo, et al.
Published: (2024)
by: Min, Xiongkuo, et al.
Published: (2024)
Context and Pixel Aware Large Language Model for Video Quality Assessment
by: Wen, Wen, et al.
Published: (2025)
by: Wen, Wen, et al.
Published: (2025)
LAR-IQA: A Lightweight, Accurate, and Robust No-Reference Image Quality Assessment Model
by: Avanaki, Nasim Jamshidi, et al.
Published: (2024)
by: Avanaki, Nasim Jamshidi, et al.
Published: (2024)
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
by: Sheng, Xiangfei, et al.
Published: (2025)
by: Sheng, Xiangfei, et al.
Published: (2025)
Opinion-Unaware Blind Image Quality Assessment using Multi-Scale Deep Feature Statistics
by: Ni, Zhangkai, et al.
Published: (2024)
by: Ni, Zhangkai, et al.
Published: (2024)
ARIQA-3DS: A Stereoscopic Image Quality Assessment Dataset for Realistic Augmented Reality
by: Sekhri, Aymen, et al.
Published: (2026)
by: Sekhri, Aymen, et al.
Published: (2026)
MS-SCANet: A Multiscale Transformer-Based Architecture with Dual Attention for No-Reference Image Quality Assessment
by: Mithila, Mayesha Maliha R., et al.
Published: (2026)
by: Mithila, Mayesha Maliha R., et al.
Published: (2026)
MarsSQE: Stereo Quality Enhancement for Martian Images Using Bi-level Cross-view Attention
by: Xu, Mai, et al.
Published: (2024)
by: Xu, Mai, et al.
Published: (2024)
Toward Scalable Image Feature Compression: A Content-Adaptive and Diffusion-Based Approach
by: Guo, Sha, et al.
Published: (2024)
by: Guo, Sha, et al.
Published: (2024)
Exploiting Frequency Correlation for Hyperspectral Image Reconstruction
by: Yan, Muge, et al.
Published: (2024)
by: Yan, Muge, et al.
Published: (2024)
TVMC: Time-Varying Mesh Compression via Multi-Stage Anchor Mesh Generation
by: Huang, He, et al.
Published: (2025)
by: Huang, He, et al.
Published: (2025)
GScomp-QA: A Subjective Dataset for Quality Assessment of Compressed Gaussian Splatting
by: Martin, Pedro, et al.
Published: (2026)
by: Martin, Pedro, et al.
Published: (2026)
Enhancing Learned Image Compression via Cross Window-based Attention
by: Mudgal, Priyanka, et al.
Published: (2024)
by: Mudgal, Priyanka, et al.
Published: (2024)
AIM 2024 Challenge on Compressed Video Quality Assessment: Methods and Results
by: Smirnov, Maksim, et al.
Published: (2024)
by: Smirnov, Maksim, et al.
Published: (2024)
SatFusion: A Unified Framework for Enhancing Remote Sensing Images via Multi-Frame and Multi-Source Images Fusion
by: Tong, Yufei, et al.
Published: (2025)
by: Tong, Yufei, et al.
Published: (2025)
Perceptual Learned Image Compression via End-to-End JND-Based Optimization
by: Pakdaman, Farhad, et al.
Published: (2024)
by: Pakdaman, Farhad, et al.
Published: (2024)
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
by: Xiong, Haoxuan, et al.
Published: (2026)
by: Xiong, Haoxuan, et al.
Published: (2026)
Variable Rate Image Compression via N-Gram Context based Swin-transformer
by: Mudgal, Priyanka
Published: (2025)
by: Mudgal, Priyanka
Published: (2025)
ML-CLIPSim: Multi-Layer CLIP Similarity for Machine-Oriented Image Quality
by: Ding, Feng, et al.
Published: (2026)
by: Ding, Feng, et al.
Published: (2026)
AIM 2024 Challenge on Video Super-Resolution Quality Assessment: Methods and Results
by: Molodetskikh, Ivan, et al.
Published: (2024)
by: Molodetskikh, Ivan, et al.
Published: (2024)
Adaptive Wireless Image Semantic Transmission and Over-The-Air Testing
by: Ding, Jiarun, et al.
Published: (2024)
by: Ding, Jiarun, et al.
Published: (2024)
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
by: Zhang, Haoshuo, et al.
Published: (2025)
by: Zhang, Haoshuo, et al.
Published: (2025)
Unified ROI-based Image Compression Paradigm with Generalized Gaussian Model
by: Hu, Kai, et al.
Published: (2026)
by: Hu, Kai, et al.
Published: (2026)
Combined Channel and Spatial Attention-based Stereo Endoscopic Image Super-Resolution
by: Hayat, Mansoor, et al.
Published: (2023)
by: Hayat, Mansoor, et al.
Published: (2023)
Similar Items
-
Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception
by: Vinod, Gautham, et al.
Published: (2026) -
Food Portion Estimation: From Pixels to Calories
by: Vinod, Gautham, et al.
Published: (2026) -
Size Matters: Reconstructing Real-Scale 3D Models from Monocular Images for Food Portion Estimation
by: Vinod, Gautham, et al.
Published: (2026) -
Food Portion Estimation via 3D Object Scaling
by: Vinod, Gautham, et al.
Published: (2024) -
MFP3D: Monocular Food Portion Estimation Leveraging 3D Point Clouds
by: Ma, Jinge, et al.
Published: (2024)