DialogGen: Multi-modal Interactive Dialogue System for Multi-turn Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Minbin, Long, Yanxin, Deng, Xinchi, Chu, Ruihang, Xiong, Jiangfeng, Liang, Xiaodan, Cheng, Hong, Lu, Qinglin, Liu, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TheaterGen: Character Management with LLM for Consistent Multi-turn Image Generation
di: Cheng, Junhao, et al.
Pubblicazione: (2024)
di: Cheng, Junhao, et al.
Pubblicazione: (2024)
Rethinking Patient Education as Multi-turn Multi-modal Interaction
di: Yao, Zonghai, et al.
Pubblicazione: (2026)
di: Yao, Zonghai, et al.
Pubblicazione: (2026)
AutoStudio: Crafting Consistent Subjects in Multi-turn Interactive Image Generation
di: Cheng, Junhao, et al.
Pubblicazione: (2024)
di: Cheng, Junhao, et al.
Pubblicazione: (2024)
InteractiveOmni: A Unified Omni-modal Model for Audio-Visual Multi-turn Dialogue
di: Tong, Wenwen, et al.
Pubblicazione: (2025)
di: Tong, Wenwen, et al.
Pubblicazione: (2025)
AgenticAI-DialogGen: Topic-Guided Conversation Generation for Fine-Tuning and Evaluating Short- and Long-Term Memories of LLMs
di: Perera, Manoj Madushanka, et al.
Pubblicazione: (2026)
di: Perera, Manoj Madushanka, et al.
Pubblicazione: (2026)
Answer-Consistent Chain-of-thought Reinforcement Learning For Multi-modal Large Langauge Models
di: Huang, Minbin, et al.
Pubblicazione: (2025)
di: Huang, Minbin, et al.
Pubblicazione: (2025)
Measuring Sycophancy of Language Models in Multi-turn Dialogues
di: Hong, Jiseung, et al.
Pubblicazione: (2025)
di: Hong, Jiseung, et al.
Pubblicazione: (2025)
Efficient Multi-modal Large Language Models via Visual Token Grouping
di: Huang, Minbin, et al.
Pubblicazione: (2024)
di: Huang, Minbin, et al.
Pubblicazione: (2024)
DialNav: Multi-turn Dialog Navigation with a Remote Guide
di: Han, Leekyeung, et al.
Pubblicazione: (2025)
di: Han, Leekyeung, et al.
Pubblicazione: (2025)
MMDU: A Multi-Turn Multi-Image Dialog Understanding Benchmark and Instruction-Tuning Dataset for LVLMs
di: Liu, Ziyu, et al.
Pubblicazione: (2024)
di: Liu, Ziyu, et al.
Pubblicazione: (2024)
Multi-turn Consistent Image Editing
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
IVCR-200K: A Large-Scale Multi-turn Dialogue Benchmark for Interactive Video Corpus Retrieval
di: Han, Ning, et al.
Pubblicazione: (2025)
di: Han, Ning, et al.
Pubblicazione: (2025)
Data Selection for Multi-turn Dialogue Instruction Tuning
di: Li, Bo, et al.
Pubblicazione: (2026)
di: Li, Bo, et al.
Pubblicazione: (2026)
Ask-to-Clarify: Resolving Instruction Ambiguity through Multi-turn Dialogue
di: Lin, Xingyao, et al.
Pubblicazione: (2025)
di: Lin, Xingyao, et al.
Pubblicazione: (2025)
ContextGen: Contextual Layout Anchoring for Identity-Consistent Multi-Instance Generation
di: Xu, Ruihang, et al.
Pubblicazione: (2025)
di: Xu, Ruihang, et al.
Pubblicazione: (2025)
ReSURE: Regularizing Supervision Unreliability for Multi-turn Dialogue Fine-tuning
di: Du, Yiming, et al.
Pubblicazione: (2025)
di: Du, Yiming, et al.
Pubblicazione: (2025)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
di: Abdulhai, Marwa, et al.
Pubblicazione: (2025)
di: Abdulhai, Marwa, et al.
Pubblicazione: (2025)
CRAG-MM: Multi-modal Multi-turn Comprehensive RAG Benchmark
di: Wang, Jiaqi, et al.
Pubblicazione: (2025)
di: Wang, Jiaqi, et al.
Pubblicazione: (2025)
Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models
di: Li, Yanwei, et al.
Pubblicazione: (2024)
di: Li, Yanwei, et al.
Pubblicazione: (2024)
How Social is It? A Benchmark for LLMs' Capabilities in Multi-user Multi-turn Social Agent Tasks
di: Wu, Yusen, et al.
Pubblicazione: (2025)
di: Wu, Yusen, et al.
Pubblicazione: (2025)
Improving Multi-turn Dialogue Consistency with Self-Recall Thinking
di: Pang, Renning, et al.
Pubblicazione: (2026)
di: Pang, Renning, et al.
Pubblicazione: (2026)
Rethinking Text-to-SQL: Dynamic Multi-turn SQL Interaction for Real-world Database Exploration
di: Sun, Linzhuang, et al.
Pubblicazione: (2025)
di: Sun, Linzhuang, et al.
Pubblicazione: (2025)
MARS-Bench: A Multi-turn Athletic Real-world Scenario Benchmark for Dialogue Evaluation
di: Yang, Chenghao, et al.
Pubblicazione: (2025)
di: Yang, Chenghao, et al.
Pubblicazione: (2025)
MORTAR: Multi-turn Metamorphic Testing for LLM-based Dialogue Systems
di: Guo, Guoxiang, et al.
Pubblicazione: (2024)
di: Guo, Guoxiang, et al.
Pubblicazione: (2024)
Steering Dialogue Dynamics for Robustness against Multi-turn Jailbreaking Attacks
di: Hu, Hanjiang, et al.
Pubblicazione: (2025)
di: Hu, Hanjiang, et al.
Pubblicazione: (2025)
An End-to-End Model for Photo-Sharing Multi-modal Dialogue Generation
di: Guo, Peiming, et al.
Pubblicazione: (2024)
di: Guo, Peiming, et al.
Pubblicazione: (2024)
Enhancing the Preference Extractor in Multi-turn Dialogues: From Annotating Disasters to Accurate Preference Extraction
di: Wang, Cheng, et al.
Pubblicazione: (2025)
di: Wang, Cheng, et al.
Pubblicazione: (2025)
MM-Interleaved: Interleaved Image-Text Generative Modeling via Multi-modal Feature Synchronizer
di: Tian, Changyao, et al.
Pubblicazione: (2024)
di: Tian, Changyao, et al.
Pubblicazione: (2024)
Multi-Granularity and Multi-modal Feature Interaction Approach for Text Video Retrieval
di: Li, Wenjun, et al.
Pubblicazione: (2024)
di: Li, Wenjun, et al.
Pubblicazione: (2024)
TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild
di: Li, Huayang, et al.
Pubblicazione: (2023)
di: Li, Huayang, et al.
Pubblicazione: (2023)
UniGenBench++: A Unified Semantic Evaluation Benchmark for Text-to-Image Generation
di: Wang, Yibin, et al.
Pubblicazione: (2025)
di: Wang, Yibin, et al.
Pubblicazione: (2025)
DialogCC: An Automated Pipeline for Creating High-Quality Multi-Modal Dialogue Dataset
di: Lee, Young-Jun, et al.
Pubblicazione: (2022)
di: Lee, Young-Jun, et al.
Pubblicazione: (2022)
MMMModal -- Multi-Images Multi-Audio Multi-turn Multi-Modal
di: Zolkepli, Husein, et al.
Pubblicazione: (2024)
di: Zolkepli, Husein, et al.
Pubblicazione: (2024)
Confidence Estimation for LLMs in Multi-turn Interactions
di: Zhang, Caiqi, et al.
Pubblicazione: (2026)
di: Zhang, Caiqi, et al.
Pubblicazione: (2026)
Evaluating Multi-turn Human-AI Interaction
di: Ding, Shi, et al.
Pubblicazione: (2026)
di: Ding, Shi, et al.
Pubblicazione: (2026)
An LLM Benchmark for Addressee Recognition in Multi-modal Multi-party Dialogue
di: Inoue, Koji, et al.
Pubblicazione: (2025)
di: Inoue, Koji, et al.
Pubblicazione: (2025)
CIRCLED: A Multi-turn CIR Dataset with Consistent Dialogues across Domains
di: Takeda, Tomohisa, et al.
Pubblicazione: (2026)
di: Takeda, Tomohisa, et al.
Pubblicazione: (2026)
FairMT-Bench: Benchmarking Fairness for Multi-turn Dialogue in Conversational LLMs
di: Fan, Zhiting, et al.
Pubblicazione: (2024)
di: Fan, Zhiting, et al.
Pubblicazione: (2024)
Crisp: Cognitive Restructuring of Negative Thoughts through Multi-turn Supportive Dialogues
di: Zhou, Jinfeng, et al.
Pubblicazione: (2025)
di: Zhou, Jinfeng, et al.
Pubblicazione: (2025)
A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems
di: Yi, Zihao, et al.
Pubblicazione: (2024)
di: Yi, Zihao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
TheaterGen: Character Management with LLM for Consistent Multi-turn Image Generation
di: Cheng, Junhao, et al.
Pubblicazione: (2024) -
Rethinking Patient Education as Multi-turn Multi-modal Interaction
di: Yao, Zonghai, et al.
Pubblicazione: (2026) -
AutoStudio: Crafting Consistent Subjects in Multi-turn Interactive Image Generation
di: Cheng, Junhao, et al.
Pubblicazione: (2024) -
InteractiveOmni: A Unified Omni-modal Model for Audio-Visual Multi-turn Dialogue
di: Tong, Wenwen, et al.
Pubblicazione: (2025) -
AgenticAI-DialogGen: Topic-Guided Conversation Generation for Fine-Tuning and Evaluating Short- and Long-Term Memories of LLMs
di: Perera, Manoj Madushanka, et al.
Pubblicazione: (2026)