AgentSafe: Safeguarding Large Language Model-based Multi-agent Systems via Hierarchical Data Management
Fuente:
arXiv
Salvato in:
| Autori principali: | Mao, Junyuan, Meng, Fanci, Duan, Yifan, Yu, Miao, Jia, Xiaojun, Fang, Junfeng, Liang, Yuxuan, Wang, Kun, Wen, Qingsong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mind Scramble: Unveiling Large Language Model Psychology Via Typoglycemia
di: Yu, Miao, et al.
Pubblicazione: (2024)
di: Yu, Miao, et al.
Pubblicazione: (2024)
NetSafe: Exploring the Topological Safety of Multi-agent Networks
di: Yu, Miao, et al.
Pubblicazione: (2024)
di: Yu, Miao, et al.
Pubblicazione: (2024)
A Survey on Trustworthy LLM Agents: Threats and Countermeasures
di: Yu, Miao, et al.
Pubblicazione: (2025)
di: Yu, Miao, et al.
Pubblicazione: (2025)
G-Safeguard: A Topology-Guided Security Lens and Treatment on LLM-based Multi-agent Systems
di: Wang, Shilong, et al.
Pubblicazione: (2025)
di: Wang, Shilong, et al.
Pubblicazione: (2025)
Mem-W: Latent Memory-Native GUI Agents
di: Zhang, Guibin, et al.
Pubblicazione: (2026)
di: Zhang, Guibin, et al.
Pubblicazione: (2026)
LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models
di: Yu, Miao, et al.
Pubblicazione: (2024)
di: Yu, Miao, et al.
Pubblicazione: (2024)
Multi-scale Temporal Prediction via Incremental Generation and Multi-agent Collaboration
di: Zeng, Zhitao, et al.
Pubblicazione: (2025)
di: Zeng, Zhitao, et al.
Pubblicazione: (2025)
Safe Reinforcement Learning via Hierarchical Adaptive Chance-Constraint Safeguards
di: Chen, Zhaorun, et al.
Pubblicazione: (2023)
di: Chen, Zhaorun, et al.
Pubblicazione: (2023)
SafeAgent: Safeguarding LLM Agents via an Automated Risk Simulator
di: Zhou, Xueyang, et al.
Pubblicazione: (2025)
di: Zhou, Xueyang, et al.
Pubblicazione: (2025)
SafeSieve: From Heuristics to Experience in Progressive Pruning for LLM-based Multi-Agent Communication
di: Zhang, Ruijia, et al.
Pubblicazione: (2025)
di: Zhang, Ruijia, et al.
Pubblicazione: (2025)
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
di: Wang, Le, et al.
Pubblicazione: (2025)
di: Wang, Le, et al.
Pubblicazione: (2025)
Predicting Parking Availability in Singapore with Cross-Domain Data: A New Dataset and A Data-Driven Approach
di: Zhang, Huaiwu, et al.
Pubblicazione: (2024)
di: Zhang, Huaiwu, et al.
Pubblicazione: (2024)
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
di: Wang, Ziyan, et al.
Pubblicazione: (2024)
di: Wang, Ziyan, et al.
Pubblicazione: (2024)
SafeSeek: Universal Attribution of Safety Circuits in Language Models
di: Yu, Miao, et al.
Pubblicazione: (2026)
di: Yu, Miao, et al.
Pubblicazione: (2026)
SafeMLRM: Demystifying Safety in Multi-modal Large Reasoning Models
di: Fang, Junfeng, et al.
Pubblicazione: (2025)
di: Fang, Junfeng, et al.
Pubblicazione: (2025)
GuardAgent: Safeguard LLM Agents by a Guard Agent via Knowledge-Enabled Reasoning
di: Xiang, Zhen, et al.
Pubblicazione: (2024)
di: Xiang, Zhen, et al.
Pubblicazione: (2024)
InfoSeeker: A Scalable Hierarchical Parallel Agent Framework for Web Information Seeking
di: Lee, Ka Yiu, et al.
Pubblicazione: (2026)
di: Lee, Ka Yiu, et al.
Pubblicazione: (2026)
VeriSafe Agent: Safeguarding Mobile GUI Agent via Logic-based Action Verification
di: Lee, Jungjae, et al.
Pubblicazione: (2025)
di: Lee, Jungjae, et al.
Pubblicazione: (2025)
Optimizing Multispectral Object Detection: A Bag of Tricks and Comprehensive Benchmarks
di: Zhou, Chen, et al.
Pubblicazione: (2024)
di: Zhou, Chen, et al.
Pubblicazione: (2024)
Perceive, Route and Modulate: Dynamic Pattern Recalibration for Time Series Forecasting
di: Zhong, Siru, et al.
Pubblicazione: (2026)
di: Zhong, Siru, et al.
Pubblicazione: (2026)
EEG-MedRAG: Enhancing EEG-based Clinical Decision-Making via Hierarchical Hypergraph Retrieval-Augmented Generation
di: Wang, Yi, et al.
Pubblicazione: (2025)
di: Wang, Yi, et al.
Pubblicazione: (2025)
A Cascading Cooperative Multi-agent Framework for On-ramp Merging Control Integrating Large Language Models
di: Zhang, Miao, et al.
Pubblicazione: (2025)
di: Zhang, Miao, et al.
Pubblicazione: (2025)
Position: What Can Large Language Models Tell Us about Time Series Analysis
di: Jin, Ming, et al.
Pubblicazione: (2024)
di: Jin, Ming, et al.
Pubblicazione: (2024)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
SafeNeuron: Neuron-Level Safety Alignment for Large Language Models
di: Wang, Zhaoxin, et al.
Pubblicazione: (2026)
di: Wang, Zhaoxin, et al.
Pubblicazione: (2026)
SARSteer: Safeguarding Large Audio-Language Models via Safe-Ablated Refusal Steering
di: Lin, Weilin, et al.
Pubblicazione: (2025)
di: Lin, Weilin, et al.
Pubblicazione: (2025)
An AI Agent Execution Environment to Safeguard User Data
di: Stanley, Robert, et al.
Pubblicazione: (2026)
di: Stanley, Robert, et al.
Pubblicazione: (2026)
Multi-agent Architecture Search via Agentic Supernet
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
di: Zhang, Guibin, et al.
Pubblicazione: (2025)
UrbanVLP: Multi-Granularity Vision-Language Pretraining for Urban Socioeconomic Indicator Prediction
di: Hao, Xixuan, et al.
Pubblicazione: (2024)
di: Hao, Xixuan, et al.
Pubblicazione: (2024)
Progressive Safeguards for Safe and Model-Agnostic Reinforcement Learning
di: Omi, Nabil, et al.
Pubblicazione: (2024)
di: Omi, Nabil, et al.
Pubblicazione: (2024)
MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models
di: Zhang, Yin, et al.
Pubblicazione: (2026)
di: Zhang, Yin, et al.
Pubblicazione: (2026)
Knowledge Tagging with Large Language Model based Multi-Agent System
di: Li, Hang, et al.
Pubblicazione: (2024)
di: Li, Hang, et al.
Pubblicazione: (2024)
DynST: Dynamic Sparse Training for Resource-Constrained Spatio-Temporal Forecasting
di: Wu, Hao, et al.
Pubblicazione: (2024)
di: Wu, Hao, et al.
Pubblicazione: (2024)
CaT-GNN: Enhancing Credit Card Fraud Detection via Causal Temporal Graph Neural Networks
di: Duan, Yifan, et al.
Pubblicazione: (2024)
di: Duan, Yifan, et al.
Pubblicazione: (2024)
GeoShield: Safeguarding Geolocation Privacy from Vision-Language Models via Adversarial Perturbations
di: Liu, Xinwei, et al.
Pubblicazione: (2025)
di: Liu, Xinwei, et al.
Pubblicazione: (2025)
G-Designer: Architecting Multi-agent Communication Topologies via Graph Neural Networks
di: Zhang, Guibin, et al.
Pubblicazione: (2024)
di: Zhang, Guibin, et al.
Pubblicazione: (2024)
Multi-Order Wavelet Derivative Transform for Deep Time Series Forecasting
di: Zhou, Ziyu, et al.
Pubblicazione: (2025)
di: Zhou, Ziyu, et al.
Pubblicazione: (2025)
TwinS: Revisiting Non-Stationarity in Multivariate Time Series Forecasting
di: Hu, Jiaxi, et al.
Pubblicazione: (2024)
di: Hu, Jiaxi, et al.
Pubblicazione: (2024)
Time-FFM: Towards LM-Empowered Federated Foundation Model for Time Series Forecasting
di: Liu, Qingxiang, et al.
Pubblicazione: (2024)
di: Liu, Qingxiang, et al.
Pubblicazione: (2024)
Toward Physics-guided Time Series Embedding
di: Hu, Jiaxi, et al.
Pubblicazione: (2024)
di: Hu, Jiaxi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Mind Scramble: Unveiling Large Language Model Psychology Via Typoglycemia
di: Yu, Miao, et al.
Pubblicazione: (2024) -
NetSafe: Exploring the Topological Safety of Multi-agent Networks
di: Yu, Miao, et al.
Pubblicazione: (2024) -
A Survey on Trustworthy LLM Agents: Threats and Countermeasures
di: Yu, Miao, et al.
Pubblicazione: (2025) -
G-Safeguard: A Topology-Guided Security Lens and Treatment on LLM-based Multi-agent Systems
di: Wang, Shilong, et al.
Pubblicazione: (2025) -
Mem-W: Latent Memory-Native GUI Agents
di: Zhang, Guibin, et al.
Pubblicazione: (2026)