TransferTOD: A Generalizable Chinese Multi-Domain Task-Oriented Dialogue System with Transfer Capabilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Ming, Huang, Caishuang, Wu, Yilong, Liu, Shichun, Zheng, Huiyuan, Dong, Yurui, Shen, Yujiong, Dou, Shihan, Zhao, Jun, Ye, Junjie, Zhang, Qi, Gui, Tao, Huang, Xuanjing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world Scenarios
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024)
par: Lv, Huijie, et autres
Publié: (2024)
DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training
par: Zhu, Dingwei, et autres
Publié: (2026)
par: Zhu, Dingwei, et autres
Publié: (2026)
PyTOD: Programmable Task-Oriented Dialogue with Execution Feedback
par: Coca, Alexandru, et autres
Publié: (2025)
par: Coca, Alexandru, et autres
Publié: (2025)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
RoTBench: A Multi-Level Benchmark for Evaluating the Robustness of Large Language Models in Tool Learning
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
FinToolSyn: A forward synthesis Framework for Financial Tool-Use Dialogue Data with Dynamic Tool Retrieval
par: Huang, Caishuang, et autres
Publié: (2026)
par: Huang, Caishuang, et autres
Publié: (2026)
LLMEval-Logic: A Solver-Verified Chinese Benchmark for Logical Reasoning of LLMs with Adversarial Hardening
par: Zhang, Ming, et autres
Publié: (2026)
par: Zhang, Ming, et autres
Publié: (2026)
HR-MultiWOZ: A Task Oriented Dialogue (TOD) Dataset for HR LLM Agent
par: Xu, Weijie, et autres
Publié: (2024)
par: Xu, Weijie, et autres
Publié: (2024)
TOD-ProcBench: Benchmarking Complex Instruction-Following in Task-Oriented Dialogues
par: Ghazarian, Sarik, et autres
Publié: (2025)
par: Ghazarian, Sarik, et autres
Publié: (2025)
HierTOD: A Task-Oriented Dialogue System Driven by Hierarchical Goals
par: Mo, Lingbo, et autres
Publié: (2024)
par: Mo, Lingbo, et autres
Publié: (2024)
DivTOD: Unleashing the Power of LLMs for Diversifying Task-Oriented Dialogue Representations
par: Zeng, Weihao, et autres
Publié: (2024)
par: Zeng, Weihao, et autres
Publié: (2024)
PFDial: A Structured Dialogue Instruction Fine-tuning Method Based on UML Flowcharts
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
HR-Agent: A Task-Oriented Dialogue (TOD) LLM Agent Tailored for HR Applications
par: Xu, Weijie, et autres
Publié: (2024)
par: Xu, Weijie, et autres
Publié: (2024)
SafeAligner: Safety Alignment against Jailbreak Attacks via Response Disparity Guidance
par: Huang, Caishuang, et autres
Publié: (2024)
par: Huang, Caishuang, et autres
Publié: (2024)
EvaLearn: Quantifying the Learning Capability and Efficiency of LLMs via Sequential Problem Solving
par: Dou, Shihan, et autres
Publié: (2025)
par: Dou, Shihan, et autres
Publié: (2025)
Beyond Scaling: Measuring and Predicting the Upper Bound of Knowledge Retention in Language Model Pre-Training
par: Jiang, Changhao, et autres
Publié: (2025)
par: Jiang, Changhao, et autres
Publié: (2025)
Spec-TOD: A Specialized Instruction-Tuned LLM Framework for Efficient Task-Oriented Dialogue Systems
par: Nguyen, Quang-Vinh, et autres
Publié: (2025)
par: Nguyen, Quang-Vinh, et autres
Publié: (2025)
PicPersona-TOD : A Dataset for Personalizing Utterance Style in Task-Oriented Dialogue with Image Persona
par: Lee, Jihyun, et autres
Publié: (2025)
par: Lee, Jihyun, et autres
Publié: (2025)
Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity Recognition
par: Yang, Yuming, et autres
Publié: (2024)
par: Yang, Yuming, et autres
Publié: (2024)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
DVPO: Distributional Value Modeling-based Policy Optimization for LLM Post-Training
par: Zhu, Dingwei, et autres
Publié: (2025)
par: Zhu, Dingwei, et autres
Publié: (2025)
Transferability-Guided Cross-Domain Cross-Task Transfer Learning
par: Tan, Yang, et autres
Publié: (2022)
par: Tan, Yang, et autres
Publié: (2022)
JFTA-Bench: Evaluate LLM's Ability of Tracking and Analyzing Malfunctions Using Fault Trees
par: Wang, Yuhui, et autres
Publié: (2026)
par: Wang, Yuhui, et autres
Publié: (2026)
LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models
par: Zhang, Ming, et autres
Publié: (2025)
par: Zhang, Ming, et autres
Publié: (2025)
VRPO: Rethinking Value Modeling for Robust RL Training under Noisy Supervision
par: Zhu, Dingwei, et autres
Publié: (2025)
par: Zhu, Dingwei, et autres
Publié: (2025)
Improving RL Exploration for LLM Reasoning through Retrospective Replay
par: Dou, Shihan, et autres
Publié: (2025)
par: Dou, Shihan, et autres
Publié: (2025)
Domain Generalizable Portrait Style Transfer
par: Wang, Xinbo, et autres
Publié: (2025)
par: Wang, Xinbo, et autres
Publié: (2025)
BootTOD: Bootstrap Task-oriented Dialogue Representations by Aligning Diverse Responses
par: Zeng, Weihao, et autres
Publié: (2024)
par: Zeng, Weihao, et autres
Publié: (2024)
CCTU: A Benchmark for Tool Use under Complex Constraints
par: Ye, Junjie, et autres
Publié: (2026)
par: Ye, Junjie, et autres
Publié: (2026)
Measuring Data Diversity for Instruction Tuning: A Systematic Analysis and A Reliable Metric
par: Yang, Yuming, et autres
Publié: (2025)
par: Yang, Yuming, et autres
Publié: (2025)
MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models
par: Ye, Junjie, et autres
Publié: (2025)
par: Ye, Junjie, et autres
Publié: (2025)
An Efficient Task-Oriented Dialogue Policy: Evolutionary Reinforcement Learning Injected by Elite Individuals
par: Zhao, Yangyang, et autres
Publié: (2025)
par: Zhao, Yangyang, et autres
Publié: (2025)
Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
par: Lin, Jiahang, et autres
Publié: (2026)
par: Lin, Jiahang, et autres
Publié: (2026)
CMDAR: A Chinese Multi-scene Dynamic Audio Reasoning Benchmark with Diverse Challenges
par: Li, Hui, et autres
Publié: (2025)
par: Li, Hui, et autres
Publié: (2025)
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
par: Dou, Shihan, et autres
Publié: (2024)
par: Dou, Shihan, et autres
Publié: (2024)
FoundationGrasp: Generalizable Task-Oriented Grasping with Foundation Models
par: Tang, Chao, et autres
Publié: (2024)
par: Tang, Chao, et autres
Publié: (2024)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
Documents similaires
-
ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world Scenarios
par: Ye, Junjie, et autres
Publié: (2024) -
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024) -
DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training
par: Zhu, Dingwei, et autres
Publié: (2026) -
PyTOD: Programmable Task-Oriented Dialogue with Execution Feedback
par: Coca, Alexandru, et autres
Publié: (2025) -
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
par: Ye, Junjie, et autres
Publié: (2024)