Detecting Referring Expressions in Visually Grounded Dialogue with Autoregressive Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Willemsen, Bram, Skantze, Gabriel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Referring Expression Generation in Visually Grounded Dialogue with Discourse-aware Comprehension Guiding
por: Willemsen, Bram, et al.
Publicado: (2024)
por: Willemsen, Bram, et al.
Publicado: (2024)
Joint Learning of Context and Feedback Embeddings in Spoken Dialogue
por: Qian, Livia, et al.
Publicado: (2024)
por: Qian, Livia, et al.
Publicado: (2024)
Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning
por: Qian, Livia, et al.
Publicado: (2026)
por: Qian, Livia, et al.
Publicado: (2026)
An Analysis of User Behaviors for Objectively Evaluating Spoken Dialogue Systems
por: Inoue, Koji, et al.
Publicado: (2024)
por: Inoue, Koji, et al.
Publicado: (2024)
CoT Referring: Improving Referring Expression Tasks with Grounded Reasoning
por: Dong, Qihua, et al.
Publicado: (2025)
por: Dong, Qihua, et al.
Publicado: (2025)
Referring Expressions as a Lens into Spatial Language Grounding in Vision-Language Models
por: Tumu, Akshar, et al.
Publicado: (2025)
por: Tumu, Akshar, et al.
Publicado: (2025)
Exploring Spatial Language Grounding Through Referring Expressions
por: Tumu, Akshar, et al.
Publicado: (2025)
por: Tumu, Akshar, et al.
Publicado: (2025)
Representation of perceived prosodic similarity of conversational feedback
por: Qian, Livia, et al.
Publicado: (2025)
por: Qian, Livia, et al.
Publicado: (2025)
Personalized Topic Selection Model for Topic-Grounded Dialogue
por: Fan, Shixuan, et al.
Publicado: (2024)
por: Fan, Shixuan, et al.
Publicado: (2024)
DRAGON: A Dialogue-Based Robot for Assistive Navigation with Visual Language Grounding
por: Liu, Shuijing, et al.
Publicado: (2023)
por: Liu, Shuijing, et al.
Publicado: (2023)
Reference-free Hallucination Detection for Large Vision-Language Models
por: Li, Qing, et al.
Publicado: (2024)
por: Li, Qing, et al.
Publicado: (2024)
SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
por: Kautsar, Muhammad Dehan Al, et al.
Publicado: (2025)
por: Kautsar, Muhammad Dehan Al, et al.
Publicado: (2025)
GPT-SW3: An Autoregressive Language Model for the Nordic Languages
por: Ekgren, Ariel, et al.
Publicado: (2023)
por: Ekgren, Ariel, et al.
Publicado: (2023)
Improving the Robustness of Knowledge-Grounded Dialogue via Contrastive Learning
por: Wang, Jiaan, et al.
Publicado: (2024)
por: Wang, Jiaan, et al.
Publicado: (2024)
Differences in Text Generated by Diffusion and Autoregressive Language Models
por: Zhang, Zeyang, et al.
Publicado: (2026)
por: Zhang, Zeyang, et al.
Publicado: (2026)
RecycleGPT: An Autoregressive Language Model with Recyclable Module
por: Jiang, Yufan, et al.
Publicado: (2023)
por: Jiang, Yufan, et al.
Publicado: (2023)
Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
por: Dong, Qihua, et al.
Publicado: (2026)
por: Dong, Qihua, et al.
Publicado: (2026)
Red Teaming Language Models for Processing Contradictory Dialogues
por: Wen, Xiaofei, et al.
Publicado: (2024)
por: Wen, Xiaofei, et al.
Publicado: (2024)
Continuous Autoregressive Language Models
por: Shao, Chenze, et al.
Publicado: (2025)
por: Shao, Chenze, et al.
Publicado: (2025)
Sequence-Level Certainty Reduces Hallucination In Knowledge-Grounded Dialogue Generation
por: Wan, Yixin, et al.
Publicado: (2023)
por: Wan, Yixin, et al.
Publicado: (2023)
LLMs and Cultural Values: the Impact of Prompt Language and Explicit Cultural Framing
por: Bulté, Bram, et al.
Publicado: (2025)
por: Bulté, Bram, et al.
Publicado: (2025)
From Bytes to Ideas: Language Modeling with Autoregressive U-Nets
por: Videau, Mathurin, et al.
Publicado: (2025)
por: Videau, Mathurin, et al.
Publicado: (2025)
Beyond Single-User Dialogue: Assessing Multi-User Dialogue State Tracking Capabilities of Large Language Models
por: Song, Sangmin, et al.
Publicado: (2025)
por: Song, Sangmin, et al.
Publicado: (2025)
Chronological Thinking in Full-Duplex Spoken Dialogue Language Models
por: Wu, Donghang, et al.
Publicado: (2025)
por: Wu, Donghang, et al.
Publicado: (2025)
Empathy by Design: Aligning Large Language Models for Healthcare Dialogue
por: Umucu, Emre, et al.
Publicado: (2025)
por: Umucu, Emre, et al.
Publicado: (2025)
Empirical Analysis of Dialogue Relation Extraction with Large Language Models
por: Li, Guozheng, et al.
Publicado: (2024)
por: Li, Guozheng, et al.
Publicado: (2024)
DFlow: Diverse Dialogue Flow Simulation with Large Language Models
por: Du, Wanyu, et al.
Publicado: (2024)
por: Du, Wanyu, et al.
Publicado: (2024)
Circuit Complexity Bounds for Visual Autoregressive Model
por: Ke, Yekun, et al.
Publicado: (2025)
por: Ke, Yekun, et al.
Publicado: (2025)
Transcoders Trace Visual Grounding and Hallucinations in Vision-Language Models
por: Damianos, Dimitrios, et al.
Publicado: (2026)
por: Damianos, Dimitrios, et al.
Publicado: (2026)
Lexicon-Level Contrastive Visual-Grounding Improves Language Modeling
por: Zhuang, Chengxu, et al.
Publicado: (2024)
por: Zhuang, Chengxu, et al.
Publicado: (2024)
Grounded Misunderstandings in Asymmetric Dialogue: A Perspectivist Annotation Scheme for MapTask
por: Li, Nan, et al.
Publicado: (2025)
por: Li, Nan, et al.
Publicado: (2025)
Simulated Annealing Enhances Theory-of-Mind Reasoning in Autoregressive Language Models
por: Hu, Xucong, et al.
Publicado: (2026)
por: Hu, Xucong, et al.
Publicado: (2026)
STRIDE-ED: A Strategy-Grounded Stepwise Reasoning Framework for Empathetic Dialogue Systems
por: Ji, Hongru, et al.
Publicado: (2026)
por: Ji, Hongru, et al.
Publicado: (2026)
SAM4MLLM: Enhance Multi-Modal Large Language Model for Referring Expression Segmentation
por: Chen, Yi-Chia, et al.
Publicado: (2024)
por: Chen, Yi-Chia, et al.
Publicado: (2024)
Why Diffusion Language Models Struggle with Truly Parallel (Non-Autoregressive) Decoding?
por: Li, Pengxiang, et al.
Publicado: (2026)
por: Li, Pengxiang, et al.
Publicado: (2026)
A Survey of the Evolution of Language Model-Based Dialogue Systems: Data, Task and Models
por: Wang, Hongru, et al.
Publicado: (2023)
por: Wang, Hongru, et al.
Publicado: (2023)
Hexa: Self-Improving for Knowledge-Grounded Dialogue System
por: Jo, Daejin, et al.
Publicado: (2023)
por: Jo, Daejin, et al.
Publicado: (2023)
Context Dependence and Reliability in Autoregressive Language Models
por: Sengupta, Poushali, et al.
Publicado: (2026)
por: Sengupta, Poushali, et al.
Publicado: (2026)
From Medical Records to Diagnostic Dialogues: A Clinical-Grounded Approach and Dataset for Psychiatric Comorbidity
por: Wan, Tianxi, et al.
Publicado: (2025)
por: Wan, Tianxi, et al.
Publicado: (2025)
Longitudinal Abuse and Sentiment Analysis of Hollywood Movie Dialogues using Language Models
por: Chandra, Rohitash, et al.
Publicado: (2025)
por: Chandra, Rohitash, et al.
Publicado: (2025)
Ejemplares similares
-
Referring Expression Generation in Visually Grounded Dialogue with Discourse-aware Comprehension Guiding
por: Willemsen, Bram, et al.
Publicado: (2024) -
Joint Learning of Context and Feedback Embeddings in Spoken Dialogue
por: Qian, Livia, et al.
Publicado: (2024) -
Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning
por: Qian, Livia, et al.
Publicado: (2026) -
An Analysis of User Behaviors for Objectively Evaluating Spoken Dialogue Systems
por: Inoue, Koji, et al.
Publicado: (2024) -
CoT Referring: Improving Referring Expression Tasks with Grounded Reasoning
por: Dong, Qihua, et al.
Publicado: (2025)