Cattle Trade: A Multi-Agent Benchmark for LLM Bluffing, Bidding, and Bargaining
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Müller, Robert, Müller, Clemens |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Analysis of Bluffing by DQN and CFR in Leduc Hold'em Poker
par: Zaciragic, Tarik, et autres
Publié: (2025)
par: Zaciragic, Tarik, et autres
Publié: (2025)
Evaluating Multi-Turn Bargain Skills in LLM-Based Seller Agent
par: Wang, Issue Yishu, et autres
Publié: (2025)
par: Wang, Issue Yishu, et autres
Publié: (2025)
FishBargain: An LLM-Empowered Bargaining Agent for Online Fleamarket Platform Sellers
par: Kong, Dexin, et autres
Publié: (2025)
par: Kong, Dexin, et autres
Publié: (2025)
RTBAgent: A LLM-based Agent System for Real-Time Bidding
par: Cai, Leng, et autres
Publié: (2025)
par: Cai, Leng, et autres
Publié: (2025)
POLAR-Bench: A Diagnostic Benchmark for Privacy-Utility Trade-offs in LLM Agents
par: Zheng, Qiaoyuan, et autres
Publié: (2026)
par: Zheng, Qiaoyuan, et autres
Publié: (2026)
MERIT Feedback Elicits Better Bargaining in LLM Negotiators
par: Oh, Jihwan, et autres
Publié: (2026)
par: Oh, Jihwan, et autres
Publié: (2026)
A Bargaining-based Approach for Feature Trading in Vertical Federated Learning
par: Cui, Yue, et autres
Publié: (2024)
par: Cui, Yue, et autres
Publié: (2024)
Dynamic Reinsurance Treaty Bidding via Multi-Agent Reinforcement Learning
par: Dong, Stella C., et autres
Publié: (2025)
par: Dong, Stella C., et autres
Publié: (2025)
EU-Agent-Bench: Measuring Illegal Behavior of LLM Agents Under EU Law
par: Lichkovski, Ilija, et autres
Publié: (2025)
par: Lichkovski, Ilija, et autres
Publié: (2025)
TradeTrap: Are LLM-based Trading Agents Truly Reliable and Faithful?
par: Yan, Lewen, et autres
Publié: (2025)
par: Yan, Lewen, et autres
Publié: (2025)
TradingAgents: Multi-Agents LLM Financial Trading Framework
par: Xiao, Yijia, et autres
Publié: (2024)
par: Xiao, Yijia, et autres
Publié: (2024)
LLM Rationalis? Measuring Bargaining Capabilities of AI Negotiators
par: Shah, Cheril, et autres
Publié: (2025)
par: Shah, Cheril, et autres
Publié: (2025)
Strategic Tradeoffs Between Humans and AI in Multi-Agent Bargaining
par: Qian, Crystal, et autres
Publié: (2025)
par: Qian, Crystal, et autres
Publié: (2025)
From Knowing to Doing: A Memory-Controlled Benchmark for LLM Trading Agents on Stock Markets
par: Zhu, Taojie, et autres
Publié: (2026)
par: Zhu, Taojie, et autres
Publié: (2026)
TradingGroup: A Multi-Agent Trading System with Self-Reflection and Data-Synthesis
par: Tian, Feng, et autres
Publié: (2025)
par: Tian, Feng, et autres
Publié: (2025)
Harnessing Language for Coordination: A Framework and Benchmark for LLM-Driven Multi-Agent Control
par: Anne, Timothée, et autres
Publié: (2024)
par: Anne, Timothée, et autres
Publié: (2024)
Is Your LLM Really Mastering the Concept? A Multi-Agent Benchmark
par: Xu, Shuhang, et autres
Publié: (2025)
par: Xu, Shuhang, et autres
Publié: (2025)
Agentic Trading: When LLM Agents Meet Financial Markets
par: Xia, Yihan, et autres
Publié: (2026)
par: Xia, Yihan, et autres
Publié: (2026)
Hierarchical Multi-agent Meta-Reinforcement Learning for Cross-channel Bidding
par: He, Shenghong, et autres
Publié: (2024)
par: He, Shenghong, et autres
Publié: (2024)
Beyond the Strongest LLM: Multi-Turn Multi-Agent Orchestration vs. Single LLMs on Benchmarks
par: Tian, Aaron Xuxiang, et autres
Publié: (2025)
par: Tian, Aaron Xuxiang, et autres
Publié: (2025)
ATLAS: Adaptive Trading with LLM AgentS Through Dynamic Prompt Optimization and Multi-Agent Coordination
par: Papadakis, Charidimos, et autres
Publié: (2025)
par: Papadakis, Charidimos, et autres
Publié: (2025)
Bid2X: Revealing Dynamics of Bidding Environment in Online Advertising from A Foundation Model Lens
par: Ji, Jiahao, et autres
Publié: (2025)
par: Ji, Jiahao, et autres
Publié: (2025)
TAMAS: Benchmarking Adversarial Risks in Multi-Agent LLM Systems
par: Kavathekar, Ishan, et autres
Publié: (2025)
par: Kavathekar, Ishan, et autres
Publié: (2025)
The Language of Bargaining: Linguistic Effects in LLM Negotiations
par: Sinha, Stuti, et autres
Publié: (2026)
par: Sinha, Stuti, et autres
Publié: (2026)
Semantic Context for Tool Orchestration
par: Müller, Robert
Publié: (2025)
par: Müller, Robert
Publié: (2025)
MSCoRe: A Benchmark for Multi-Stage Collaborative Reasoning in LLM Agents
par: Lei, Yuzhen, et autres
Publié: (2025)
par: Lei, Yuzhen, et autres
Publié: (2025)
Language of Bargaining
par: Heddaya, Mourad, et autres
Publié: (2023)
par: Heddaya, Mourad, et autres
Publié: (2023)
Benchmarking LLM Agents for Wealth-Management Workflows
par: Milsom, Rory
Publié: (2025)
par: Milsom, Rory
Publié: (2025)
AgentLAB: Benchmarking LLM Agents against Long-Horizon Attacks
par: Jiang, Tanqiu, et autres
Publié: (2026)
par: Jiang, Tanqiu, et autres
Publié: (2026)
Normative Common Ground Replication (NormCoRe): Replication-by-Translation for Studying Norms in Multi-Agent AI
par: Deck, Luca, et autres
Publié: (2026)
par: Deck, Luca, et autres
Publié: (2026)
PTCG-Bench: Can LLM Agents Master Pokémon Trading Card Game?
par: Hua, Dongdong, et autres
Publié: (2026)
par: Hua, Dongdong, et autres
Publié: (2026)
RoleCDE:Benchmarking and Mitigating Role-Alignment Trade-offs in Role-Playing Agents
par: Lai, Huayi, et autres
Publié: (2026)
par: Lai, Huayi, et autres
Publié: (2026)
AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks
par: Jorf, Baraa Al, et autres
Publié: (2026)
par: Jorf, Baraa Al, et autres
Publié: (2026)
CalBench: Evaluating Coordination-Privacy Trade-offs in Multi-Agent LLMs
par: Zou, Chelsea, et autres
Publié: (2026)
par: Zou, Chelsea, et autres
Publié: (2026)
Evaluation and Benchmarking of LLM Agents: A Survey
par: Mohammadi, Mahmoud, et autres
Publié: (2025)
par: Mohammadi, Mahmoud, et autres
Publié: (2025)
Toward Expert Investment Teams:A Multi-Agent LLM System with Fine-Grained Trading Tasks
par: Miyazaki, Kunihiro, et autres
Publié: (2026)
par: Miyazaki, Kunihiro, et autres
Publié: (2026)
Generative Auto-Bidding with Unified Modeling and Exploration
par: Zhang, Mingming, et autres
Publié: (2026)
par: Zhang, Mingming, et autres
Publié: (2026)
COMMA: A Communicative Multimodal Multi-Agent Benchmark
par: Ossowski, Timothy, et autres
Publié: (2024)
par: Ossowski, Timothy, et autres
Publié: (2024)
RewardHackingAgents: Benchmarking Evaluation Integrity for LLM ML-Engineering Agents
par: Atinafu, Yonas, et autres
Publié: (2026)
par: Atinafu, Yonas, et autres
Publié: (2026)
Thought Virus: Viral Misalignment via Subliminal Prompting in Multi-Agent Systems
par: Weckbecker, Moritz, et autres
Publié: (2026)
par: Weckbecker, Moritz, et autres
Publié: (2026)
Documents similaires
-
Analysis of Bluffing by DQN and CFR in Leduc Hold'em Poker
par: Zaciragic, Tarik, et autres
Publié: (2025) -
Evaluating Multi-Turn Bargain Skills in LLM-Based Seller Agent
par: Wang, Issue Yishu, et autres
Publié: (2025) -
FishBargain: An LLM-Empowered Bargaining Agent for Online Fleamarket Platform Sellers
par: Kong, Dexin, et autres
Publié: (2025) -
RTBAgent: A LLM-based Agent System for Real-Time Bidding
par: Cai, Leng, et autres
Publié: (2025) -
POLAR-Bench: A Diagnostic Benchmark for Privacy-Utility Trade-offs in LLM Agents
par: Zheng, Qiaoyuan, et autres
Publié: (2026)