Learning to Interrupt in Language-based Multi-agent Communication
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Danqing, Yin, Da, Desai, Ruta, Li, Lei, Celikyilmaz, Asli, Ni, Ansong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
von: Yang, Kevin, et al.
Veröffentlicht: (2023)
von: Yang, Kevin, et al.
Veröffentlicht: (2023)
Open-Domain Text Evaluation via Contrastive Distribution Methods
von: Lu, Sidi, et al.
Veröffentlicht: (2023)
von: Lu, Sidi, et al.
Veröffentlicht: (2023)
Matrix: Peer-to-Peer Multi-Agent Synthetic Data Generation Framework
von: Wang, Dong, et al.
Veröffentlicht: (2025)
von: Wang, Dong, et al.
Veröffentlicht: (2025)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
von: Saha, Swarnadeep, et al.
Veröffentlicht: (2023)
von: Saha, Swarnadeep, et al.
Veröffentlicht: (2023)
Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models
von: Riddell, Martin, et al.
Veröffentlicht: (2024)
von: Riddell, Martin, et al.
Veröffentlicht: (2024)
Resprompt: Residual Connection Prompting Advances Multi-Step Reasoning in Large Language Models
von: Jiang, Song, et al.
Veröffentlicht: (2023)
von: Jiang, Song, et al.
Veröffentlicht: (2023)
The Majority is not always right: RL training for solution aggregation
von: Zhao, Wenting, et al.
Veröffentlicht: (2025)
von: Zhao, Wenting, et al.
Veröffentlicht: (2025)
reWordBench: Benchmarking and Improving the Robustness of Reward Models with Transformed Inputs
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2025)
von: Wu, Zhaofeng, et al.
Veröffentlicht: (2025)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
von: Wang, Danqing, et al.
Veröffentlicht: (2024)
von: Wang, Danqing, et al.
Veröffentlicht: (2024)
NExT: Teaching Large Language Models to Reason about Code Execution
von: Ni, Ansong, et al.
Veröffentlicht: (2024)
von: Ni, Ansong, et al.
Veröffentlicht: (2024)
CRAB-Bench: Evaluating LLM Agents under Complex Task Dependencies and Human-aligned User Simulation
von: Wang, Danqing, et al.
Veröffentlicht: (2026)
von: Wang, Danqing, et al.
Veröffentlicht: (2026)
Adaptive Decoding via Latent Preference Optimization
von: Dhuliawala, Shehzaad, et al.
Veröffentlicht: (2024)
von: Dhuliawala, Shehzaad, et al.
Veröffentlicht: (2024)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
von: Wang, Danqing, et al.
Veröffentlicht: (2024)
von: Wang, Danqing, et al.
Veröffentlicht: (2024)
Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding
von: Liu, Jiacheng, et al.
Veröffentlicht: (2023)
von: Liu, Jiacheng, et al.
Veröffentlicht: (2023)
Towards Safety and Helpfulness Balanced Responses via Controllable Large Language Models
von: Tuan, Yi-Lin, et al.
Veröffentlicht: (2024)
von: Tuan, Yi-Lin, et al.
Veröffentlicht: (2024)
Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning
von: Sclar, Melanie, et al.
Veröffentlicht: (2024)
von: Sclar, Melanie, et al.
Veröffentlicht: (2024)
Strategic Planning and Rationalizing on Trees Make LLMs Better Debaters
von: Wang, Danqing, et al.
Veröffentlicht: (2025)
von: Wang, Danqing, et al.
Veröffentlicht: (2025)
Learning Personalized Alignment for Evaluating Open-ended Text Generation
von: Wang, Danqing, et al.
Veröffentlicht: (2023)
von: Wang, Danqing, et al.
Veröffentlicht: (2023)
Efficient Tool Use with Chain-of-Abstraction Reasoning
von: Gao, Silin, et al.
Veröffentlicht: (2024)
von: Gao, Silin, et al.
Veröffentlicht: (2024)
Focus Directions Make Your Language Models Pay More Attention to Relevant Contexts
von: Zhu, Youxiang, et al.
Veröffentlicht: (2025)
von: Zhu, Youxiang, et al.
Veröffentlicht: (2025)
Interplay of Semantic Communication and Knowledge Learning
von: Ni, Fei, et al.
Veröffentlicht: (2024)
von: Ni, Fei, et al.
Veröffentlicht: (2024)
ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator
von: Zhu, Junda, et al.
Veröffentlicht: (2024)
von: Zhu, Junda, et al.
Veröffentlicht: (2024)
Predicting Lung Cancer Patient Prognosis with Large Language Models
von: Hu, Danqing, et al.
Veröffentlicht: (2024)
von: Hu, Danqing, et al.
Veröffentlicht: (2024)
Are Large Reasoning Models Interruptible?
von: Wu, Tsung-Han, et al.
Veröffentlicht: (2025)
von: Wu, Tsung-Han, et al.
Veröffentlicht: (2025)
Training Language Models to Critique With Multi-agent Feedback
von: Lan, Tian, et al.
Veröffentlicht: (2024)
von: Lan, Tian, et al.
Veröffentlicht: (2024)
Scaling LLM Inference with Optimized Sample Compute Allocation
von: Zhang, Kexun, et al.
Veröffentlicht: (2024)
von: Zhang, Kexun, et al.
Veröffentlicht: (2024)
Controlling Performance and Budget of a Centralized Multi-agent LLM System with Reinforcement Learning
von: Jin, Bowen, et al.
Veröffentlicht: (2025)
von: Jin, Bowen, et al.
Veröffentlicht: (2025)
Language Evolution for Evading Social Media Regulation via LLM-based Multi-agent Simulation
von: Cai, Jinyu, et al.
Veröffentlicht: (2024)
von: Cai, Jinyu, et al.
Veröffentlicht: (2024)
Improving Faithfulness of Abstractive Summarization by Controlling Confounding Effect of Irrelevant Sentences
von: Ghoshal, Asish, et al.
Veröffentlicht: (2022)
von: Ghoshal, Asish, et al.
Veröffentlicht: (2022)
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
von: Wang, Ziyan, et al.
Veröffentlicht: (2024)
von: Wang, Ziyan, et al.
Veröffentlicht: (2024)
The Impact of Background Speech on Interruption Detection in Collaborative Groups
von: Bradford, Mariah, et al.
Veröffentlicht: (2025)
von: Bradford, Mariah, et al.
Veröffentlicht: (2025)
Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks
von: Zhao, Songwen, et al.
Veröffentlicht: (2025)
von: Zhao, Songwen, et al.
Veröffentlicht: (2025)
Cold-Start Personalization via Training-Free Priors from Structured World Models
von: Bose, Avinandan, et al.
Veröffentlicht: (2026)
von: Bose, Avinandan, et al.
Veröffentlicht: (2026)
HorizonBench: Long-Horizon Personalization with Evolving Preferences
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2026)
von: Li, Shuyue Stella, et al.
Veröffentlicht: (2026)
When Users Change Their Mind: Evaluating Interruptible Agents in Long-Horizon Web Navigation
von: Zou, Henry Peng, et al.
Veröffentlicht: (2026)
von: Zou, Henry Peng, et al.
Veröffentlicht: (2026)
CrossTune: Black-Box Few-Shot Classification with Label Enhancement
von: Luo, Danqing, et al.
Veröffentlicht: (2024)
von: Luo, Danqing, et al.
Veröffentlicht: (2024)
A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks
von: Ni, Xuanfan, et al.
Veröffentlicht: (2024)
von: Ni, Xuanfan, et al.
Veröffentlicht: (2024)
RARE: Retrieval-Aware Robustness Evaluation for Retrieval-Augmented Generation Systems
von: Zeng, Yixiao, et al.
Veröffentlicht: (2025)
von: Zeng, Yixiao, et al.
Veröffentlicht: (2025)
Unveiling the Achilles' Heel of NLG Evaluators: A Unified Adversarial Framework Driven by Large Language Models
von: Chen, Yiming, et al.
Veröffentlicht: (2024)
von: Chen, Yiming, et al.
Veröffentlicht: (2024)
Towards Detecting LLMs Hallucination via Markov Chain-based Multi-agent Debate Framework
von: Sun, Xiaoxi, et al.
Veröffentlicht: (2024)
von: Sun, Xiaoxi, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
von: Yang, Kevin, et al.
Veröffentlicht: (2023) -
Open-Domain Text Evaluation via Contrastive Distribution Methods
von: Lu, Sidi, et al.
Veröffentlicht: (2023) -
Matrix: Peer-to-Peer Multi-Agent Synthetic Data Generation Framework
von: Wang, Dong, et al.
Veröffentlicht: (2025) -
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
von: Saha, Swarnadeep, et al.
Veröffentlicht: (2023) -
Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models
von: Riddell, Martin, et al.
Veröffentlicht: (2024)