DRE: An Effective Dual-Refined Method for Integrating Small and Large Language Models in Open-Domain Dialogue Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Kun, Yang, Bohao, Tang, Chen, Dai, Siyuan, Tang, Haoteng, Lin, Chenghua, Zhan, Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SLIDE: A Framework Integrating Small and Large Language Models for Open-Domain Dialogues Evaluation
par: Zhao, Kun, et autres
Publié: (2024)
par: Zhao, Kun, et autres
Publié: (2024)
Emphasising Structured Information: Integrating Abstract Meaning Representation into LLMs for Enhanced Open-Domain Dialogue Evaluation
par: Yang, Bohao, et autres
Publié: (2024)
par: Yang, Bohao, et autres
Publié: (2024)
Effective Distillation of Table-based Reasoning Ability from LLMs
par: Yang, Bohao, et autres
Publié: (2023)
par: Yang, Bohao, et autres
Publié: (2023)
X-ray Made Simple: Lay Radiology Report Generation and Robust Evaluation
par: Zhao, Kun, et autres
Publié: (2024)
par: Zhao, Kun, et autres
Publié: (2024)
CADGE: Context-Aware Dialogue Generation Enhanced with Graph-Structured Knowledge Aggregation
par: Zhang, Hongbo, et autres
Publié: (2023)
par: Zhang, Hongbo, et autres
Publié: (2023)
BioMNER: A Dataset for Biomedical Method Entity Recognition
par: Tang, Chen, et autres
Publié: (2024)
par: Tang, Chen, et autres
Publié: (2024)
Aligning Findings with Diagnosis: A Self-Consistent Reinforcement Learning Framework for Trustworthy Radiology Reporting
par: Zhao, Kun, et autres
Publié: (2026)
par: Zhao, Kun, et autres
Publié: (2026)
Constrained Multiview Representation for Self-supervised Contrastive Learning
par: Dai, Siyuan, et autres
Publié: (2024)
par: Dai, Siyuan, et autres
Publié: (2024)
An Open Source Data Contamination Report for Large Language Models
par: Li, Yucheng, et autres
Publié: (2023)
par: Li, Yucheng, et autres
Publié: (2023)
Crafting Customisable Characters with LLMs: A Persona-Driven Role-Playing Agent Framework
par: Yang, Bohao, et autres
Publié: (2024)
par: Yang, Bohao, et autres
Publié: (2024)
Small Language Models as Effective Guides for Large Language Models in Chinese Relation Extraction
par: Tang, Xuemei, et autres
Publié: (2024)
par: Tang, Xuemei, et autres
Publié: (2024)
On the Benchmarking of LLMs for Open-Domain Dialogue Evaluation
par: Mendonça, John, et autres
Publié: (2024)
par: Mendonça, John, et autres
Publié: (2024)
Zeus: Zero-shot LLM Instruction for Union Segmentation in Multimodal Medical Imaging
par: Dai, Siyuan, et autres
Publié: (2025)
par: Dai, Siyuan, et autres
Publié: (2025)
On the Effectiveness of Integration Methods for Multimodal Dialogue Response Retrieval
par: Jang, Seongbo, et autres
Publié: (2025)
par: Jang, Seongbo, et autres
Publié: (2025)
R-GenIMA: Integrating Neuroimaging and Genetics with Interpretable Multimodal AI for Alzheimer's Disease Progression
par: Zhao, Kun, et autres
Publié: (2025)
par: Zhao, Kun, et autres
Publié: (2025)
ODUTQA-MDC: A Task for Open-Domain Underspecified Tabular QA with Multi-turn Dialogue-based Clarification
par: Wang, Zhensheng, et autres
Publié: (2026)
par: Wang, Zhensheng, et autres
Publié: (2026)
DuetSim: Building User Simulator with Dual Large Language Models for Task-Oriented Dialogues
par: Luo, Xiang, et autres
Publié: (2024)
par: Luo, Xiang, et autres
Publié: (2024)
Zero-Shot Cross-Domain Dialogue State Tracking via Dual Low-Rank Adaptation
par: Luo, Xiang, et autres
Publié: (2024)
par: Luo, Xiang, et autres
Publié: (2024)
Train & Constrain: Phonologically Informed Tongue-Twister Generation from Topics and Paraphrases
par: Loakman, Tyler, et autres
Publié: (2024)
par: Loakman, Tyler, et autres
Publié: (2024)
Soda-Eval: Open-Domain Dialogue Evaluation in the age of LLMs
par: Mendonça, John, et autres
Publié: (2024)
par: Mendonça, John, et autres
Publié: (2024)
Evaluating Large Language Models for Generalization and Robustness via Data Compression
par: Li, Yucheng, et autres
Publié: (2024)
par: Li, Yucheng, et autres
Publié: (2024)
A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue Evaluators
par: Zhang, Chen, et autres
Publié: (2023)
par: Zhang, Chen, et autres
Publié: (2023)
MoL for LLMs: Dual-Loss Optimization to Enhance Domain Expertise While Preserving General Capabilities
par: Chen, Jingxue, et autres
Publié: (2025)
par: Chen, Jingxue, et autres
Publié: (2025)
Does Table Source Matter? Benchmarking and Improving Multimodal Scientific Table Understanding and Reasoning
par: Yang, Bohao, et autres
Publié: (2025)
par: Yang, Bohao, et autres
Publié: (2025)
Leveraging Large Language Models for Zero-shot Lay Summarisation in Biomedicine and Beyond
par: Goldsack, Tomas, et autres
Publié: (2025)
par: Goldsack, Tomas, et autres
Publié: (2025)
Controllable and Diverse Data Augmentation with Large Language Model for Low-Resource Open-Domain Dialogue Generation
par: Liu, Zhenhua, et autres
Publié: (2024)
par: Liu, Zhenhua, et autres
Publié: (2024)
With Ears to See and Eyes to Hear: Sound Symbolism Experiments with Multimodal Large Language Models
par: Loakman, Tyler, et autres
Publié: (2024)
par: Loakman, Tyler, et autres
Publié: (2024)
LVPruning: An Effective yet Simple Language-Guided Vision Token Pruning Approach for Multi-modal Large Language Models
par: Sun, Yizheng, et autres
Publié: (2025)
par: Sun, Yizheng, et autres
Publié: (2025)
Rethinking Response Evaluation from Interlocutor's Eye for Open-Domain Dialogue Systems
par: Tsuta, Yuma, et autres
Publié: (2024)
par: Tsuta, Yuma, et autres
Publié: (2024)
MEDAL: A Framework for Benchmarking LLMs as Multilingual Open-Domain Dialogue Evaluators
par: Mendonça, John, et autres
Publié: (2025)
par: Mendonça, John, et autres
Publié: (2025)
Small Language Model Makes an Effective Long Text Extractor
par: Chen, Yelin, et autres
Publié: (2025)
par: Chen, Yelin, et autres
Publié: (2025)
Facilitating Pornographic Text Detection for Open-Domain Dialogue Systems via Knowledge Distillation of Large Language Models
par: Qiu, Huachuan, et autres
Publié: (2024)
par: Qiu, Huachuan, et autres
Publié: (2024)
ReproHum #0087-01: Human Evaluation Reproduction Report for Generating Fact Checking Explanations
par: Loakman, Tyler, et autres
Publié: (2024)
par: Loakman, Tyler, et autres
Publié: (2024)
Integrating Domain Knowledge into Large Language Models for Enhanced Fashion Recommendations
par: Shi, Zhan, et autres
Publié: (2025)
par: Shi, Zhan, et autres
Publié: (2025)
An Interpretable and Crosslingual Method for Evaluating Second-Language Dialogues
par: Gao, Rena, et autres
Publié: (2024)
par: Gao, Rena, et autres
Publié: (2024)
Natural Language Generation
par: van Miltenburg, Emiel, et autres
Publié: (2025)
par: van Miltenburg, Emiel, et autres
Publié: (2025)
EvolvTrip: Enhancing Literary Character Understanding with Temporal Theory-of-Mind Graphs
par: Yang, Bohao, et autres
Publié: (2025)
par: Yang, Bohao, et autres
Publié: (2025)
ITINERA: Integrating Spatial Optimization with Large Language Models for Open-domain Urban Itinerary Planning
par: Tang, Yihong, et autres
Publié: (2024)
par: Tang, Yihong, et autres
Publié: (2024)
EduDial: Constructing a Large-scale Multi-turn Teacher-Student Dialogue Corpus
par: Wei, Shouang, et autres
Publié: (2025)
par: Wei, Shouang, et autres
Publié: (2025)
DialogBench: Evaluating LLMs as Human-like Dialogue Systems
par: Ou, Jiao, et autres
Publié: (2023)
par: Ou, Jiao, et autres
Publié: (2023)
Documents similaires
-
SLIDE: A Framework Integrating Small and Large Language Models for Open-Domain Dialogues Evaluation
par: Zhao, Kun, et autres
Publié: (2024) -
Emphasising Structured Information: Integrating Abstract Meaning Representation into LLMs for Enhanced Open-Domain Dialogue Evaluation
par: Yang, Bohao, et autres
Publié: (2024) -
Effective Distillation of Table-based Reasoning Ability from LLMs
par: Yang, Bohao, et autres
Publié: (2023) -
X-ray Made Simple: Lay Radiology Report Generation and Robust Evaluation
par: Zhao, Kun, et autres
Publié: (2024) -
CADGE: Context-Aware Dialogue Generation Enhanced with Graph-Structured Knowledge Aggregation
par: Zhang, Hongbo, et autres
Publié: (2023)