Enhancing Action and Ingredient Modeling for Semantically Grounded Recipe Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Guoshan, Zhu, Bin, Li, Yian, Chen, Jingjing, Ngo, Chong-Wah, Jiang, Yu-Gang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Retrieval Augmented Recipe Generation
par: Liu, Guoshan, et autres
Publié: (2024)
par: Liu, Guoshan, et autres
Publié: (2024)
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
par: Qi, Huiyan, et autres
Publié: (2025)
par: Qi, Huiyan, et autres
Publié: (2025)
From Holistic to Localized: Local Enhanced Adapters for Efficient Visual Instruction Fine-Tuning
par: Jiao, Pengkun, et autres
Publié: (2024)
par: Jiao, Pengkun, et autres
Publié: (2024)
Efficient Test-Time Retrieval Augmented Generation
par: Yin, Hailong, et autres
Publié: (2025)
par: Yin, Hailong, et autres
Publié: (2025)
Don't Deceive Me: Mitigating Gaslighting through Attention Reallocation in LMMs
par: Jiao, Pengkun, et autres
Publié: (2025)
par: Jiao, Pengkun, et autres
Publié: (2025)
From Canteen Food to Daily Meals: Generalizing Food Recognition to More Practical Scenarios
par: Liu, Guoshan, et autres
Publié: (2024)
par: Liu, Guoshan, et autres
Publié: (2024)
RoDE: Linear Rectified Mixture of Diverse Experts for Food Large Multi-Modal Models
par: Jiao, Pengkun, et autres
Publié: (2024)
par: Jiao, Pengkun, et autres
Publié: (2024)
A Highly Clean Recipe Dataset with Ingredient States Annotation for State Probing Task
par: Toyooka, Mashiro, et autres
Publié: (2025)
par: Toyooka, Mashiro, et autres
Publié: (2025)
Efficient Prompt Tuning for Hierarchical Ingredient Recognition
par: Gui, Yinxuan, et autres
Publié: (2025)
par: Gui, Yinxuan, et autres
Publié: (2025)
Seeing Culture: A Benchmark for Visual Reasoning and Grounding
par: Satar, Burak, et autres
Publié: (2025)
par: Satar, Burak, et autres
Publié: (2025)
OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and General Recipe
par: Zhang, Kaichen, et autres
Publié: (2025)
par: Zhang, Kaichen, et autres
Publié: (2025)
Rethinking Data Synthesis: A Teacher Model Training Recipe with Interpretation
par: Chen, Yifang, et autres
Publié: (2024)
par: Chen, Yifang, et autres
Publié: (2024)
Enhancing Large Language Models for Mobility Analytics with Semantic Location Tokenization
par: Chen, Yile, et autres
Publié: (2025)
par: Chen, Yile, et autres
Publié: (2025)
Actor-Critic for Continuous Action Chunks: A Reinforcement Learning Framework for Long-Horizon Robotic Manipulation with Sparse Reward
par: Yang, Jiarui, et autres
Publié: (2025)
par: Yang, Jiarui, et autres
Publié: (2025)
Fine-tuning Language Models for Recipe Generation: A Comparative Analysis and Benchmark Study
par: Vij, Anneketh, et autres
Publié: (2025)
par: Vij, Anneketh, et autres
Publié: (2025)
GroundAct: Can LLM Agents Ground Actions in Environmental States?
par: Wang, Zixuan, et autres
Publié: (2025)
par: Wang, Zixuan, et autres
Publié: (2025)
InfiR2: A Comprehensive FP8 Training Recipe for Reasoning-Enhanced Language Models
par: Wang, Wenjun, et autres
Publié: (2025)
par: Wang, Wenjun, et autres
Publié: (2025)
Modeling Unified Semantic Discourse Structure for High-quality Headline Generation
par: Xu, Minghui, et autres
Publié: (2024)
par: Xu, Minghui, et autres
Publié: (2024)
MAMM-Refine: A Recipe for Improving Faithfulness in Generation with Multi-Agent Collaboration
par: Wan, David, et autres
Publié: (2025)
par: Wan, David, et autres
Publié: (2025)
Source-Grounded Semantic Reinforcement Learning for Low-Resource Target-Language Generation
par: Su, Zeli, et autres
Publié: (2026)
par: Su, Zeli, et autres
Publié: (2026)
Improving Neural Topic Modeling with Semantically-Grounded Soft Label Distributions
par: Li, Raymond, et autres
Publié: (2026)
par: Li, Raymond, et autres
Publié: (2026)
Losses that Cook: Topological Optimal Transport for Structured Recipe Generation
par: Ottoborgo, Mattia, et autres
Publié: (2026)
par: Ottoborgo, Mattia, et autres
Publié: (2026)
ReasonGRM: Enhancing Generative Reward Models through Large Reasoning Models
par: Chen, Bin, et autres
Publié: (2025)
par: Chen, Bin, et autres
Publié: (2025)
LongSkywork: A Training Recipe for Efficiently Extending Context Length in Large Language Models
par: Zhao, Liang, et autres
Publié: (2024)
par: Zhao, Liang, et autres
Publié: (2024)
Creating an AI Observer: Generative Semantic Workspaces
par: Holur, Pavan, et autres
Publié: (2024)
par: Holur, Pavan, et autres
Publié: (2024)
Ratchet: A Minimal Hygiene Recipe for Self-Evolving LLM Agents
par: Zhang, Xing, et autres
Publié: (2026)
par: Zhang, Xing, et autres
Publié: (2026)
CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification
par: Wang, Yian, et autres
Publié: (2026)
par: Wang, Yian, et autres
Publié: (2026)
"Understanding AI": Semantic Grounding in Large Language Models
par: Lyre, Holger
Publié: (2024)
par: Lyre, Holger
Publié: (2024)
Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe
par: Li, Yaxuan, et autres
Publié: (2026)
par: Li, Yaxuan, et autres
Publié: (2026)
Vero: An Open RL Recipe for General Visual Reasoning
par: Sarch, Gabriel, et autres
Publié: (2026)
par: Sarch, Gabriel, et autres
Publié: (2026)
Monte Carlo Tree Search for Recipe Generation using GPT-2
par: Taneja, Karan, et autres
Publié: (2024)
par: Taneja, Karan, et autres
Publié: (2024)
Enhancing Cross-Document Event Coreference Resolution by Discourse Structure and Semantic Information
par: Gao, Qiang, et autres
Publié: (2024)
par: Gao, Qiang, et autres
Publié: (2024)
Enhancing Uncertainty Modeling with Semantic Graph for Hallucination Detection
par: Chen, Kedi, et autres
Publié: (2025)
par: Chen, Kedi, et autres
Publié: (2025)
DataChef: Cooking Up Optimal Data Recipes for LLM Adaptation via Reinforcement Learning
par: Chen, Yicheng, et autres
Publié: (2026)
par: Chen, Yicheng, et autres
Publié: (2026)
Benchmarking Gaslighting Negation Attacks Against Multimodal Large Language Models
par: Zhu, Bin, et autres
Publié: (2025)
par: Zhu, Bin, et autres
Publié: (2025)
Language Models can Infer Action Semantics for Symbolic Planners from Environment Feedback
par: Zhu, Wang, et autres
Publié: (2024)
par: Zhu, Wang, et autres
Publié: (2024)
FinRAG-12B: A Production-Validated Recipe for Grounded Question Answering in Banking
par: Katerenchuk, Denys, et autres
Publié: (2026)
par: Katerenchuk, Denys, et autres
Publié: (2026)
Identifying and Decomposing Compound Ingredients in Meal Plans Using Large Language Models
par: Kopitar, Leon, et autres
Publié: (2024)
par: Kopitar, Leon, et autres
Publié: (2024)
Merge-of-Thought Distillation
par: Shen, Zhanming, et autres
Publié: (2025)
par: Shen, Zhanming, et autres
Publié: (2025)
FrameNet Semantic Role Classification by Analogy
par: Ngo, Van-Duy, et autres
Publié: (2026)
par: Ngo, Van-Duy, et autres
Publié: (2026)
Documents similaires
-
Retrieval Augmented Recipe Generation
par: Liu, Guoshan, et autres
Publié: (2024) -
Advancing Food Nutrition Estimation via Visual-Ingredient Feature Fusion
par: Qi, Huiyan, et autres
Publié: (2025) -
From Holistic to Localized: Local Enhanced Adapters for Efficient Visual Instruction Fine-Tuning
par: Jiao, Pengkun, et autres
Publié: (2024) -
Efficient Test-Time Retrieval Augmented Generation
par: Yin, Hailong, et autres
Publié: (2025) -
Don't Deceive Me: Mitigating Gaslighting through Attention Reallocation in LMMs
par: Jiao, Pengkun, et autres
Publié: (2025)