AiGen-FoodReview: A Multimodal Dataset of Machine-Generated Restaurant Reviews and Images on Social Media
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gambetti, Alessandro, Han, Qiwei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AiSciVision: A Framework for Specializing Large Multimodal Models in Scientific Image Classification
par: Hogan, Brendan, et autres
Publié: (2024)
par: Hogan, Brendan, et autres
Publié: (2024)
DialectGen: Benchmarking and Improving Dialect Robustness in Multimodal Generation
par: Zhou, Yu, et autres
Publié: (2025)
par: Zhou, Yu, et autres
Publié: (2025)
Text-to-Image Cross-Modal Generation: A Systematic Review
par: Żelaszczyk, Maciej, et autres
Publié: (2024)
par: Żelaszczyk, Maciej, et autres
Publié: (2024)
Brazilian Portuguese Image Captioning with Transformers: A Study on Cross-Native-Translated Dataset
par: Bromonschenkel, Gabriel, et autres
Publié: (2026)
par: Bromonschenkel, Gabriel, et autres
Publié: (2026)
Generative Technology for Human Emotion Recognition: A Scope Review
par: Ma, Fei, et autres
Publié: (2024)
par: Ma, Fei, et autres
Publié: (2024)
BanglishRev: A Large-Scale Bangla-English and Code-mixed Dataset of Product Reviews in E-Commerce
par: Shamael, Mohammad Nazmush, et autres
Publié: (2024)
par: Shamael, Mohammad Nazmush, et autres
Publié: (2024)
MJ-Bench: Is Your Multimodal Reward Model Really a Good Judge for Text-to-Image Generation?
par: Chen, Zhaorun, et autres
Publié: (2024)
par: Chen, Zhaorun, et autres
Publié: (2024)
Implicit Multimodal Alignment: On the Generalization of Frozen LLMs to Multimodal Inputs
par: Shukor, Mustafa, et autres
Publié: (2024)
par: Shukor, Mustafa, et autres
Publié: (2024)
JPEG-LM: LLMs as Image Generators with Canonical Codec Representations
par: Han, Xiaochuang, et autres
Publié: (2024)
par: Han, Xiaochuang, et autres
Publié: (2024)
ImageChain: Advancing Sequential Image-to-Text Reasoning in Multimodal Large Language Models
par: Villegas, Danae Sánchez, et autres
Publié: (2025)
par: Villegas, Danae Sánchez, et autres
Publié: (2025)
Advanced Multimodal Deep Learning Architecture for Image-Text Matching
par: Wang, Jinyin, et autres
Publié: (2024)
par: Wang, Jinyin, et autres
Publié: (2024)
From Pixels to Prose: A Large Dataset of Dense Image Captions
par: Singla, Vasu, et autres
Publié: (2024)
par: Singla, Vasu, et autres
Publié: (2024)
Improving Resnet-9 Generalization Trained on Small Datasets
par: Awad, Omar Mohamed, et autres
Publié: (2023)
par: Awad, Omar Mohamed, et autres
Publié: (2023)
Modeling Multimodal Social Interactions: New Challenges and Baselines with Densely Aligned Representations
par: Lee, Sangmin, et autres
Publié: (2024)
par: Lee, Sangmin, et autres
Publié: (2024)
GenSim: Generating Robotic Simulation Tasks via Large Language Models
par: Wang, Lirui, et autres
Publié: (2023)
par: Wang, Lirui, et autres
Publié: (2023)
Multimodal Adaptive Inference for Document Image Classification with Anytime Early Exiting
par: Hamed, Omar, et autres
Publié: (2024)
par: Hamed, Omar, et autres
Publié: (2024)
MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image
par: Arazi, Alan, et autres
Publié: (2026)
par: Arazi, Alan, et autres
Publié: (2026)
Exploring Compositional Generalization of Multimodal LLMs for Medical Imaging
par: Cai, Zhenyang, et autres
Publié: (2024)
par: Cai, Zhenyang, et autres
Publié: (2024)
Neural-Symbolic Recursive Machine for Systematic Generalization
par: Li, Qing, et autres
Publié: (2022)
par: Li, Qing, et autres
Publié: (2022)
Enhanced Sentiment Analysis of Iranian Restaurant Reviews Utilizing Sentiment Intensity Analyzer & Fuzzy Logic
par: Rokhva, Shayan, et autres
Publié: (2025)
par: Rokhva, Shayan, et autres
Publié: (2025)
Generative Artificial Intelligence: A Systematic Review and Applications
par: Sengar, Sandeep Singh, et autres
Publié: (2024)
par: Sengar, Sandeep Singh, et autres
Publié: (2024)
Dual-Process Image Generation
par: Luo, Grace, et autres
Publié: (2025)
par: Luo, Grace, et autres
Publié: (2025)
Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Image Editing
par: Qian, Yusu, et autres
Publié: (2025)
par: Qian, Yusu, et autres
Publié: (2025)
The Cost of Context: Mitigating Textual Bias in Multimodal Retrieval-Augmented Generation
par: Jung, Hoin, et autres
Publié: (2026)
par: Jung, Hoin, et autres
Publié: (2026)
CoGen: Learning from Feedback with Coupled Comprehension and Generation
par: Gul, Mustafa Omer, et autres
Publié: (2024)
par: Gul, Mustafa Omer, et autres
Publié: (2024)
MultiDelete for Multimodal Machine Unlearning
par: Cheng, Jiali, et autres
Publié: (2023)
par: Cheng, Jiali, et autres
Publié: (2023)
Enhancing Visual Question Answering through Ranking-Based Hybrid Training and Multimodal Fusion
par: Chen, Peiyuan, et autres
Publié: (2024)
par: Chen, Peiyuan, et autres
Publié: (2024)
A Review of Multimodal Explainable Artificial Intelligence: Past, Present and Future
par: Sun, Shilin, et autres
Publié: (2024)
par: Sun, Shilin, et autres
Publié: (2024)
RA-RRG: Multimodal Retrieval-Augmented Radiology Report Generation with Key Phrase Extraction
par: Park, Jonggwon, et autres
Publié: (2025)
par: Park, Jonggwon, et autres
Publié: (2025)
InSight-o3: Empowering Multimodal Foundation Models with Generalized Visual Search
par: Li, Kaican, et autres
Publié: (2025)
par: Li, Kaican, et autres
Publié: (2025)
DreamLLM: Synergistic Multimodal Comprehension and Creation
par: Dong, Runpei, et autres
Publié: (2023)
par: Dong, Runpei, et autres
Publié: (2023)
IMAGINE-E: Image Generation Intelligence Evaluation of State-of-the-art Text-to-Image Models
par: Lei, Jiayi, et autres
Publié: (2025)
par: Lei, Jiayi, et autres
Publié: (2025)
SurGen: Text-Guided Diffusion Model for Surgical Video Generation
par: Cho, Joseph, et autres
Publié: (2024)
par: Cho, Joseph, et autres
Publié: (2024)
LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multimodal Large Language Models
par: Zhu, Mengdan, et autres
Publié: (2024)
par: Zhu, Mengdan, et autres
Publié: (2024)
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
Image-Caption Encoding for Improving Zero-Shot Generalization
par: Yu, Eric Yang, et autres
Publié: (2024)
par: Yu, Eric Yang, et autres
Publié: (2024)
LMFusion: Adapting Pretrained Language Models for Multimodal Generation
par: Shi, Weijia, et autres
Publié: (2024)
par: Shi, Weijia, et autres
Publié: (2024)
A Multimodal, Multitask System for Generating E Commerce Text Listings from Images
par: Singh, Nayan Kumar
Publié: (2025)
par: Singh, Nayan Kumar
Publié: (2025)
LLMs as Visual Explainers: Advancing Image Classification with Evolving Visual Descriptions
par: Han, Songhao, et autres
Publié: (2023)
par: Han, Songhao, et autres
Publié: (2023)
D3G: Diverse Demographic Data Generation Increases Zero-Shot Image Classification Accuracy within Multimodal Models
par: Hickmon, Javon
Publié: (2025)
par: Hickmon, Javon
Publié: (2025)
Documents similaires
-
AiSciVision: A Framework for Specializing Large Multimodal Models in Scientific Image Classification
par: Hogan, Brendan, et autres
Publié: (2024) -
DialectGen: Benchmarking and Improving Dialect Robustness in Multimodal Generation
par: Zhou, Yu, et autres
Publié: (2025) -
Text-to-Image Cross-Modal Generation: A Systematic Review
par: Żelaszczyk, Maciej, et autres
Publié: (2024) -
Brazilian Portuguese Image Captioning with Transformers: A Study on Cross-Native-Translated Dataset
par: Bromonschenkel, Gabriel, et autres
Publié: (2026) -
Generative Technology for Human Emotion Recognition: A Scope Review
par: Ma, Fei, et autres
Publié: (2024)