OmniFood8K: Single-Image Nutrition Estimation via Hierarchical Frequency-Aligned Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Dongjian, Min, Weiqing, Jiang, Qian, Lin, Xing, Jin, Xin, Jiang, Shuqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Synthesizing Knowledge-enhanced Features for Real-world Zero-shot Food Detection
di: Zhou, Pengfei, et al.
Pubblicazione: (2024)
di: Zhou, Pengfei, et al.
Pubblicazione: (2024)
FoodSky: A Food-oriented Large Language Model that Passes the Chef and Dietetic Examination
di: Zhou, Pengfei, et al.
Pubblicazione: (2024)
di: Zhou, Pengfei, et al.
Pubblicazione: (2024)
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
di: Qi, Huiyan, et al.
Pubblicazione: (2025)
di: Qi, Huiyan, et al.
Pubblicazione: (2025)
ReflexSplit: Single Image Reflection Separation via Layer Fusion-Separation
di: Lee, Chia-Ming, et al.
Pubblicazione: (2026)
di: Lee, Chia-Ming, et al.
Pubblicazione: (2026)
Butter: Frequency Consistency and Hierarchical Fusion for Autonomous Driving Object Detection
di: Lin, Xiaojian, et al.
Pubblicazione: (2025)
di: Lin, Xiaojian, et al.
Pubblicazione: (2025)
Speed of Random Walks in Dirichlet Environment on a Galton-Watson Tree
di: Qian, Dongjian, et al.
Pubblicazione: (2024)
di: Qian, Dongjian, et al.
Pubblicazione: (2024)
Scaling limit of the random walk on a Galton-Watson tree with regular varying offspring distribution
di: Qian, Dongjian, et al.
Pubblicazione: (2023)
di: Qian, Dongjian, et al.
Pubblicazione: (2023)
FUSE: Label-Free Image-Event Joint Monocular Depth Estimation via Frequency-Decoupled Alignment and Degradation-Robust Fusion
di: Sun, Pihai, et al.
Pubblicazione: (2025)
di: Sun, Pihai, et al.
Pubblicazione: (2025)
AlignMamba-2: Enhancing Multimodal Fusion and Sentiment Analysis with Modality-Aware Mamba
di: Li, Yan, et al.
Pubblicazione: (2026)
di: Li, Yan, et al.
Pubblicazione: (2026)
DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model
di: Jin, Yang, et al.
Pubblicazione: (2024)
di: Jin, Yang, et al.
Pubblicazione: (2024)
MaeFuse: Transferring Omni Features with Pretrained Masked Autoencoders for Infrared and Visible Image Fusion via Guided Training
di: Li, Jiayang, et al.
Pubblicazione: (2024)
di: Li, Jiayang, et al.
Pubblicazione: (2024)
EM-DARTS: Hierarchical Differentiable Architecture Search for Eye Movement Recognition
di: Qin, Huafeng, et al.
Pubblicazione: (2024)
di: Qin, Huafeng, et al.
Pubblicazione: (2024)
Multilingual Text-to-Image Person Retrieval via Bidirectional Relation Reasoning and Aligning
di: Cao, Min, et al.
Pubblicazione: (2025)
di: Cao, Min, et al.
Pubblicazione: (2025)
OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation
di: Wang, Junke, et al.
Pubblicazione: (2024)
di: Wang, Junke, et al.
Pubblicazione: (2024)
Regular subspaces of symmetric stable processes
di: Qian, Dongjian, et al.
Pubblicazione: (2022)
di: Qian, Dongjian, et al.
Pubblicazione: (2022)
Critical Self-Similar Markov Trees
di: Curien, Nicolas, et al.
Pubblicazione: (2026)
di: Curien, Nicolas, et al.
Pubblicazione: (2026)
MFDNet: Multi-Frequency Deflare Network for Efficient Nighttime Flare Removal
di: Jiang, Yiguo, et al.
Pubblicazione: (2024)
di: Jiang, Yiguo, et al.
Pubblicazione: (2024)
From Specific-MLLMs to Omni-MLLMs: A Survey on MLLMs Aligned with Multi-modalities
di: Jiang, Shixin, et al.
Pubblicazione: (2024)
di: Jiang, Shixin, et al.
Pubblicazione: (2024)
Holistic Dynamic Frequency Transformer for Image Fusion and Exposure Correction
di: Shang, Xiaoke, et al.
Pubblicazione: (2023)
di: Shang, Xiaoke, et al.
Pubblicazione: (2023)
Omni-Fusion of Spatial and Spectral for Hyperspectral Image Segmentation
di: Zhang, Qing, et al.
Pubblicazione: (2025)
di: Zhang, Qing, et al.
Pubblicazione: (2025)
OmniGen2: Towards Instruction-Aligned Multimodal Generation
di: Wu, Chenyuan, et al.
Pubblicazione: (2025)
di: Wu, Chenyuan, et al.
Pubblicazione: (2025)
PhaSR: Generalized Image Shadow Removal with Physically Aligned Priors
di: Lee, Chia-Ming, et al.
Pubblicazione: (2026)
di: Lee, Chia-Ming, et al.
Pubblicazione: (2026)
Oscillations-Aware Frequency Security Assessment via Efficient Worst-Case Frequency Nadir Computation
di: Jiang, Yan, et al.
Pubblicazione: (2024)
di: Jiang, Yan, et al.
Pubblicazione: (2024)
OmniFusion: Simultaneous Multilingual Multimodal Translations via Modular Fusion
di: Koneru, Sai, et al.
Pubblicazione: (2025)
di: Koneru, Sai, et al.
Pubblicazione: (2025)
Frequency-Domain Fusion Transformer for Image Inpainting
di: He, Sijin, et al.
Pubblicazione: (2025)
di: He, Sijin, et al.
Pubblicazione: (2025)
Improved Few-Shot Jailbreaking Can Circumvent Aligned Language Models and Their Defenses
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
HumanMaterial: Human Material Estimation from a Single Image via Progressive Training
di: Jiang, Yu, et al.
Pubblicazione: (2025)
di: Jiang, Yu, et al.
Pubblicazione: (2025)
Financial Modeling and Predictive Innovation in the Food-Tech Industry: Aligning Profitability with Nutritional Sustainability
di: Audu, Mariam Sha
Pubblicazione: (2025)
di: Audu, Mariam Sha
Pubblicazione: (2025)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
di: Qian, Chengxuan, et al.
Pubblicazione: (2025)
di: Qian, Chengxuan, et al.
Pubblicazione: (2025)
Uncertainty-aware Spatial-Frequency Registration and Fusion for Infrared and Visible Images
di: Li, Xingyuan, et al.
Pubblicazione: (2026)
di: Li, Xingyuan, et al.
Pubblicazione: (2026)
EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM
di: Zong, Zhuofan, et al.
Pubblicazione: (2024)
di: Zong, Zhuofan, et al.
Pubblicazione: (2024)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
di: Cui, Mingxuan, et al.
Pubblicazione: (2026)
di: Cui, Mingxuan, et al.
Pubblicazione: (2026)
Neural Dynamics-Informed Pre-trained Framework for Personalized Brain Functional Network Construction
di: Jiang, Hongjie, et al.
Pubblicazione: (2026)
di: Jiang, Hongjie, et al.
Pubblicazione: (2026)
Boosting Adversarial Transferability via High-Frequency Augmentation and Hierarchical-Gradient Fusion
di: Zheng, Yayin, et al.
Pubblicazione: (2025)
di: Zheng, Yayin, et al.
Pubblicazione: (2025)
Omni-Referring Image Segmentation
di: Zheng, Qiancheng, et al.
Pubblicazione: (2025)
di: Zheng, Qiancheng, et al.
Pubblicazione: (2025)
Residual Prior-driven Frequency-aware Network for Image Fusion
di: Zheng, Guan, et al.
Pubblicazione: (2025)
di: Zheng, Guan, et al.
Pubblicazione: (2025)
OmniFusion Technical Report
di: Goncharova, Elizaveta, et al.
Pubblicazione: (2024)
di: Goncharova, Elizaveta, et al.
Pubblicazione: (2024)
Aligned Divergent Pathways for Omni-Domain Generalized Person Re-Identification
di: Ang, Eugene P. W., et al.
Pubblicazione: (2024)
di: Ang, Eugene P. W., et al.
Pubblicazione: (2024)
Omni-Captioner: Data Pipeline, Models, and Benchmark for Omni Detailed Perception
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization
di: Han, Minghao, et al.
Pubblicazione: (2026)
di: Han, Minghao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Synthesizing Knowledge-enhanced Features for Real-world Zero-shot Food Detection
di: Zhou, Pengfei, et al.
Pubblicazione: (2024) -
FoodSky: A Food-oriented Large Language Model that Passes the Chef and Dietetic Examination
di: Zhou, Pengfei, et al.
Pubblicazione: (2024) -
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
di: Qi, Huiyan, et al.
Pubblicazione: (2025) -
ReflexSplit: Single Image Reflection Separation via Layer Fusion-Separation
di: Lee, Chia-Ming, et al.
Pubblicazione: (2026) -
Butter: Frequency Consistency and Hierarchical Fusion for Autonomous Driving Object Detection
di: Lin, Xiaojian, et al.
Pubblicazione: (2025)