Enregistré dans:
| Auteurs principaux: | Liu, Xianyang, Gu, Shangding, Song, Dawn |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.06008 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Long Context, Less Focus: A Scaling Gap in LLMs Revealed through Privacy and Personalization
par: Gu, Shangding
Publié: (2026)
par: Gu, Shangding
Publié: (2026)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
par: Yang, Yingxuan, et autres
Publié: (2026)
par: Yang, Yingxuan, et autres
Publié: (2026)
Agentic Web: Weaving the Next Web with AI Agents
par: Yang, Yingxuan, et autres
Publié: (2025)
par: Yang, Yingxuan, et autres
Publié: (2025)
Data Uniformity Improves Training Efficiency and More, with a Convergence Framework Beyond the NTK Regime
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
par: Gu, Shangding, et autres
Publié: (2024)
par: Gu, Shangding, et autres
Publié: (2024)
What Makes a Sale? Rethinking End-to-End Seller--Buyer Retail Dynamics with LLM Agents
par: Choi, Jeonghwan, et autres
Publié: (2026)
par: Choi, Jeonghwan, et autres
Publié: (2026)
MemFail: Stress-Testing Failure Modes of LLM Memory Systems
par: Garg, Ishir, et autres
Publié: (2026)
par: Garg, Ishir, et autres
Publié: (2026)
Paying Less Generalization Tax: A Cross-Domain Generalization Study of RL Training for LLM Agents
par: Liu, Zhihan, et autres
Publié: (2026)
par: Liu, Zhihan, et autres
Publié: (2026)
LLMs Should Express Uncertainty Explicitly
par: Guo, Junyu, et autres
Publié: (2026)
par: Guo, Junyu, et autres
Publié: (2026)
StyleBench: Evaluating thinking styles in Large Language Models
par: Guo, Junyu, et autres
Publié: (2025)
par: Guo, Junyu, et autres
Publié: (2025)
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
par: Gu, Shangding, et autres
Publié: (2022)
par: Gu, Shangding, et autres
Publié: (2022)
Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation
par: Gu, Shangding, et autres
Publié: (2024)
par: Gu, Shangding, et autres
Publié: (2024)
AgentFlux: Decoupled Fine-Tuning & Inference for On-Device Agentic Systems
par: Kadekodi, Rohan, et autres
Publié: (2025)
par: Kadekodi, Rohan, et autres
Publié: (2025)
When Do Multi-Agent Systems Outperform? Analysing the Learning Efficiency of Agentic Systems
par: Su, Junwei, et autres
Publié: (2026)
par: Su, Junwei, et autres
Publié: (2026)
LeakAgent: RL-based Red-teaming Agent for LLM Privacy Leakage
par: Nie, Yuzhou, et autres
Publié: (2024)
par: Nie, Yuzhou, et autres
Publié: (2024)
Agentic Unlearning: When LLM Agent Meets Machine Unlearning
par: Wang, Bin, et autres
Publié: (2026)
par: Wang, Bin, et autres
Publié: (2026)
Safe Multi-Agent Reinforcement Learning with Bilevel Optimization in Autonomous Driving
par: Zheng, Zhi, et autres
Publié: (2024)
par: Zheng, Zhi, et autres
Publié: (2024)
Hybrid Agentic AI and Multi-Agent Systems in Smart Manufacturing
par: Farahani, Mojtaba A., et autres
Publié: (2025)
par: Farahani, Mojtaba A., et autres
Publié: (2025)
A Benchmark for Multi-Party Negotiation Games from Real Negotiation Data
par: Benac, Leo, et autres
Publié: (2026)
par: Benac, Leo, et autres
Publié: (2026)
Contextual Dynamic Pricing with Strategic Buyers
par: Liu, Pangpang, et autres
Publié: (2023)
par: Liu, Pangpang, et autres
Publié: (2023)
Robust Gymnasium: A Unified Modular Benchmark for Robust Reinforcement Learning
par: Gu, Shangding, et autres
Publié: (2025)
par: Gu, Shangding, et autres
Publié: (2025)
[Re] Benchmarking LLM Capabilities in Negotiation through Scoreable Games
par: Pollo, Jorge Carrasco, et autres
Publié: (2026)
par: Pollo, Jorge Carrasco, et autres
Publié: (2026)
When Reasoning Models Hurt Behavioral Simulation: A Solver-Sampler Mismatch in Multi-Agent LLM Negotiation
par: Andric, Sandro
Publié: (2026)
par: Andric, Sandro
Publié: (2026)
ARM: Discovering Agentic Reasoning Modules for Generalizable Multi-Agent Systems
par: Yao, Bohan, et autres
Publié: (2025)
par: Yao, Bohan, et autres
Publié: (2025)
Game-theoretic LLM: Agent Workflow for Negotiation Games
par: Hua, Wenyue, et autres
Publié: (2024)
par: Hua, Wenyue, et autres
Publié: (2024)
dLLM: Simple Diffusion Language Modeling
par: Zhou, Zhanhui, et autres
Publié: (2026)
par: Zhou, Zhanhui, et autres
Publié: (2026)
What Limits Agentic Systems Efficiency?
par: Bian, Song, et autres
Publié: (2025)
par: Bian, Song, et autres
Publié: (2025)
GoAgent: Group-of-Agents Communication Topology Generation for LLM-based Multi-Agent Systems
par: Chen, Hongjiang, et autres
Publié: (2026)
par: Chen, Hongjiang, et autres
Publié: (2026)
Multi-Agent Debate: A Unified Agentic Framework for Tabular Anomaly Detection
par: Wang, Pinqiao, et autres
Publié: (2026)
par: Wang, Pinqiao, et autres
Publié: (2026)
MASPO: Joint Prompt Optimization for LLM-based Multi-Agent Systems
par: Wang, Zhexuan, et autres
Publié: (2026)
par: Wang, Zhexuan, et autres
Publié: (2026)
Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems
par: Feng, Lang, et autres
Publié: (2026)
par: Feng, Lang, et autres
Publié: (2026)
On the Importance of Task Complexity in Evaluating LLM-Based Multi-Agent Systems
par: Tang, Bohan, et autres
Publié: (2025)
par: Tang, Bohan, et autres
Publié: (2025)
Multi-View Encoders for Performance Prediction in LLM-Based Agentic Workflows
par: Trirat, Patara, et autres
Publié: (2025)
par: Trirat, Patara, et autres
Publié: (2025)
Harnessing Agentic Evolution
par: Zhang, Jiayi, et autres
Publié: (2026)
par: Zhang, Jiayi, et autres
Publié: (2026)
GSM-Agent: Understanding Agentic Reasoning Using Controllable Environments
par: Zhu, Hanlin, et autres
Publié: (2025)
par: Zhu, Hanlin, et autres
Publié: (2025)
Scaling Graph Chain-of-Thought Reasoning: A Multi-Agent Framework with Efficient LLM Serving
par: Huan, Chengying, et autres
Publié: (2025)
par: Huan, Chengying, et autres
Publié: (2025)
Fed-SE: Federated Self-Evolution for Privacy-Constrained Multi-Environment LLM Agents
par: Chen, Xiang, et autres
Publié: (2025)
par: Chen, Xiang, et autres
Publié: (2025)
Agentic Neural Networks: Self-Evolving Multi-Agent Systems via Textual Backpropagation
par: Ma, Xiaowen, et autres
Publié: (2025)
par: Ma, Xiaowen, et autres
Publié: (2025)
Pay Attention to Small Weights
par: Zhou, Chao, et autres
Publié: (2025)
par: Zhou, Chao, et autres
Publié: (2025)
Temporal-Aware Graph Attention Network for Cryptocurrency Transaction Fraud Detection
par: Zheng, Zhi, et autres
Publié: (2025)
par: Zheng, Zhi, et autres
Publié: (2025)
Documents similaires
-
Long Context, Less Focus: A Scaling Gap in LLMs Revealed through Privacy and Personalization
par: Gu, Shangding
Publié: (2026) -
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
par: Yang, Yingxuan, et autres
Publié: (2026) -
Agentic Web: Weaving the Next Web with AI Agents
par: Yang, Yingxuan, et autres
Publié: (2025) -
Data Uniformity Improves Training Efficiency and More, with a Convergence Framework Beyond the NTK Regime
par: Wang, Yuqing, et autres
Publié: (2025) -
Safe and Balanced: A Framework for Constrained Multi-Objective Reinforcement Learning
par: Gu, Shangding, et autres
Publié: (2024)