Let Models Speak Ciphers: Multiagent Debate through Embeddings
Fuente:
arXiv
Salvato in:
| Autori principali: | Pham, Chau, Liu, Boyi, Yang, Yingxiang, Chen, Zhengyu, Liu, Tianyi, Yuan, Jianbo, Plummer, Bryan A., Wang, Zhaoran, Yang, Hongxia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
$\mathbf{(N,K)}$-Puzzle: A Cost-Efficient Testbed for Benchmarking Reinforcement Learning Algorithms in Generative Language Model
di: Zhang, Yufeng, et al.
Pubblicazione: (2024)
di: Zhang, Yufeng, et al.
Pubblicazione: (2024)
Let LLMs Speak Embedding Languages: Generative Text Embeddings via Iterative Contrastive Refinement
di: Tsai, Yu-Che, et al.
Pubblicazione: (2025)
di: Tsai, Yu-Che, et al.
Pubblicazione: (2025)
DSTC: Direct Preference Learning with Only Self-Generated Tests and Code to Improve Code LMs
di: Liu, Zhihan, et al.
Pubblicazione: (2024)
di: Liu, Zhihan, et al.
Pubblicazione: (2024)
Enhancing Feature Diversity Boosts Channel-Adaptive Vision Transformers
di: Pham, Chau, et al.
Pubblicazione: (2024)
di: Pham, Chau, et al.
Pubblicazione: (2024)
How Can LLM Guide RL? A Value-Based Approach
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
Can LLMs Speak For Diverse People? Tuning LLMs via Debate to Generate Controllable Controversial Statements
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
DavIR: Data Selection via Implicit Reward for Large Language Models
di: Zhou, Haotian, et al.
Pubblicazione: (2023)
di: Zhou, Haotian, et al.
Pubblicazione: (2023)
Let the Results Speak: A Replication-First Paradigm for LLM Behavioral Benchmarking
di: Yuming, et al.
Pubblicazione: (2026)
di: Yuming, et al.
Pubblicazione: (2026)
Argument Collapse: LLMs Flatten Long-Form Public Debate
di: Kim, Yekyung, et al.
Pubblicazione: (2026)
di: Kim, Yekyung, et al.
Pubblicazione: (2026)
BabelBench: An Omni Benchmark for Code-Driven Analysis of Multimodal and Multistructured Data
di: Wang, Xuwu, et al.
Pubblicazione: (2024)
di: Wang, Xuwu, et al.
Pubblicazione: (2024)
Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning
di: Wang, Yiqi, et al.
Pubblicazione: (2024)
di: Wang, Yiqi, et al.
Pubblicazione: (2024)
Provably Mitigating Overoptimization in RLHF: Your SFT Loss is Implicitly an Adversarial Regularizer
di: Liu, Zhihan, et al.
Pubblicazione: (2024)
di: Liu, Zhihan, et al.
Pubblicazione: (2024)
Reward-Augmented Data Enhances Direct Preference Alignment of LLMs
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
R-Debater: Retrieval-Augmented Debate Generation through Argumentative Memory
di: Li, Maoyuan, et al.
Pubblicazione: (2025)
di: Li, Maoyuan, et al.
Pubblicazione: (2025)
Leveraging Large Language Models for Suicide Detection on Social Media with Limited Labels
di: Nguyen, Vy, et al.
Pubblicazione: (2024)
di: Nguyen, Vy, et al.
Pubblicazione: (2024)
MOSLIM:Align with diverse preferences in prompts through reward classification
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Infi-MMR: Curriculum-based Unlocking Multimodal Reasoning via Phased Reinforcement Learning in Multimodal Small Language Models
di: Liu, Zeyu, et al.
Pubblicazione: (2025)
di: Liu, Zeyu, et al.
Pubblicazione: (2025)
LLM2: Let Large Language Models Harness System 2 Reasoning
di: Yang, Cheng, et al.
Pubblicazione: (2024)
di: Yang, Cheng, et al.
Pubblicazione: (2024)
An Expert is Worth One Token: Synergizing Multiple Expert LLMs as Generalist via Expert Token Routing
di: Chai, Ziwei, et al.
Pubblicazione: (2024)
di: Chai, Ziwei, et al.
Pubblicazione: (2024)
An Empirical Analysis on Large Language Models in Debate Evaluation
di: Liu, Xinyi, et al.
Pubblicazione: (2024)
di: Liu, Xinyi, et al.
Pubblicazione: (2024)
Let the Fuzzy Rule Speak: Enhancing In-context Learning Debiasing with Interpretability
di: Lin, Ruixi, et al.
Pubblicazione: (2024)
di: Lin, Ruixi, et al.
Pubblicazione: (2024)
Normalization through Fine-tuning: Understanding Wav2vec 2.0 Embeddings for Phonetic Analysis
di: Wang, Yiming, et al.
Pubblicazione: (2025)
di: Wang, Yiming, et al.
Pubblicazione: (2025)
Towards Explainable Harmful Meme Detection through Multimodal Debate between Large Language Models
di: Lin, Hongzhan, et al.
Pubblicazione: (2024)
di: Lin, Hongzhan, et al.
Pubblicazione: (2024)
GroupDebate: Enhancing the Efficiency of Multi-Agent Debate Using Group Discussion
di: Liu, Tongxuan, et al.
Pubblicazione: (2024)
di: Liu, Tongxuan, et al.
Pubblicazione: (2024)
BRiTE: Bootstrapping Reinforced Thinking Process to Enhance Language Model Reasoning
di: Zhong, Han, et al.
Pubblicazione: (2025)
di: Zhong, Han, et al.
Pubblicazione: (2025)
Conan-Embedding-v2: Training an LLM from Scratch for Text Embeddings
di: Li, Shiyu, et al.
Pubblicazione: (2025)
di: Li, Shiyu, et al.
Pubblicazione: (2025)
Multiple LLM Agents Debate for Equitable Cultural Alignment
di: Ki, Dayeon, et al.
Pubblicazione: (2025)
di: Ki, Dayeon, et al.
Pubblicazione: (2025)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
di: Xie, Congkai, et al.
Pubblicazione: (2025)
di: Xie, Congkai, et al.
Pubblicazione: (2025)
Memento-Skills: Let Agents Design Agents
di: Zhou, Huichi, et al.
Pubblicazione: (2026)
di: Zhou, Huichi, et al.
Pubblicazione: (2026)
InfiGUI-G1: Advancing GUI Grounding with Adaptive Exploration Policy Optimization
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
Conversation for Non-verifiable Learning: Self-Evolving LLMs through Meta-Evaluation
di: Sui, Yuan, et al.
Pubblicazione: (2026)
di: Sui, Yuan, et al.
Pubblicazione: (2026)
InfiMed-Foundation: Pioneering Advanced Multimodal Medical Models with Compute-Efficient Pre-Training and Multi-Stage Fine-Tuning
di: Zhu, Guanghao, et al.
Pubblicazione: (2025)
di: Zhu, Guanghao, et al.
Pubblicazione: (2025)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
Human-Instruction-Free LLM Self-Alignment with Limited Samples
di: Guo, Hongyi, et al.
Pubblicazione: (2024)
di: Guo, Hongyi, et al.
Pubblicazione: (2024)
Empowering Large Language Model Agents through Action Learning
di: Zhao, Haiteng, et al.
Pubblicazione: (2024)
di: Zhao, Haiteng, et al.
Pubblicazione: (2024)
Understanding Privacy Risks of Embeddings Induced by Large Language Models
di: Zhu, Zhihao, et al.
Pubblicazione: (2024)
di: Zhu, Zhihao, et al.
Pubblicazione: (2024)
Large Language Model Unlearning via Embedding-Corrupted Prompts
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
Self-Infilling Code Generation
di: Zheng, Lin, et al.
Pubblicazione: (2023)
di: Zheng, Lin, et al.
Pubblicazione: (2023)
All Code, No Thought: Current Language Models Struggle to Reason in Ciphered Language
di: Guo, Shiyuan, et al.
Pubblicazione: (2025)
di: Guo, Shiyuan, et al.
Pubblicazione: (2025)
Back to Basics: Let Conversational Agents Remember with Just Retrieval and Generation
di: Wu, Yuqian, et al.
Pubblicazione: (2026)
di: Wu, Yuqian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
$\mathbf{(N,K)}$-Puzzle: A Cost-Efficient Testbed for Benchmarking Reinforcement Learning Algorithms in Generative Language Model
di: Zhang, Yufeng, et al.
Pubblicazione: (2024) -
Let LLMs Speak Embedding Languages: Generative Text Embeddings via Iterative Contrastive Refinement
di: Tsai, Yu-Che, et al.
Pubblicazione: (2025) -
DSTC: Direct Preference Learning with Only Self-Generated Tests and Code to Improve Code LMs
di: Liu, Zhihan, et al.
Pubblicazione: (2024) -
Enhancing Feature Diversity Boosts Channel-Adaptive Vision Transformers
di: Pham, Chau, et al.
Pubblicazione: (2024) -
How Can LLM Guide RL? A Value-Based Approach
di: Zhang, Shenao, et al.
Pubblicazione: (2024)