Goal-Aware Identification and Rectification of Misinformation in Multi-Agent Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Zherui, Mi, Yan, Zhou, Zhenhong, Jiang, Houcheng, Zhang, Guibin, Wang, Kun, Fang, Junfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reinforced Lifelong Editing for Language Models
par: Li, Zherui, et autres
Publié: (2025)
par: Li, Zherui, et autres
Publié: (2025)
CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models
par: Zhou, Zhenhong, et autres
Publié: (2025)
par: Zhou, Zhenhong, et autres
Publié: (2025)
MemEvolve: Meta-Evolution of Agent Memory Systems
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation
par: Zhang, Yuanhe, et autres
Publié: (2025)
par: Zhang, Yuanhe, et autres
Publié: (2025)
Multi-agent Architecture Search via Agentic Supernet
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
Neuron-Level Sequential Editing for Large Language Models
par: Jiang, Houcheng, et autres
Publié: (2024)
par: Jiang, Houcheng, et autres
Publié: (2024)
G-Memory: Tracing Hierarchical Memory for Multi-Agent Systems
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment
par: Wang, Kun, et autres
Publié: (2026)
par: Wang, Kun, et autres
Publié: (2026)
LatentEvolve: Self-Evolving Test-Time Scaling in Latent Space
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
par: Zhou, Zhenhong, et autres
Publié: (2024)
par: Zhou, Zhenhong, et autres
Publié: (2024)
SOD: Step-wise On-policy Distillation for Small Language Model Agents
par: Zhong, Qiyong, et autres
Publié: (2026)
par: Zhong, Qiyong, et autres
Publié: (2026)
UniVLR: Unifying Text and Vision in Visual Latent Reasoning for Multimodal LLMs
par: Jiang, Houcheng, et autres
Publié: (2026)
par: Jiang, Houcheng, et autres
Publié: (2026)
AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models
par: Fang, Junfeng, et autres
Publié: (2024)
par: Fang, Junfeng, et autres
Publié: (2024)
LeechHijack: Covert Computational Resource Exploitation in Intelligent Agent Systems
par: Zhang, Yuanhe, et autres
Publié: (2025)
par: Zhang, Yuanhe, et autres
Publié: (2025)
AgenTracer: Who Is Inducing Failure in the LLM Agentic Systems?
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
Mem-W: Latent Memory-Native GUI Agents
par: Zhang, Guibin, et autres
Publié: (2026)
par: Zhang, Guibin, et autres
Publié: (2026)
MemGen: Weaving Generative Latent Memory for Self-Evolving Agents
par: Zhang, Guibin, et autres
Publié: (2025)
par: Zhang, Guibin, et autres
Publié: (2025)
DualEdit: Mitigating Safety Fallback in LLM Backdoor Editing via Affirmation-Refusal Regulation
par: Jiang, Houcheng, et autres
Publié: (2025)
par: Jiang, Houcheng, et autres
Publié: (2025)
AnyEdit: Edit Any Knowledge Encoded in Language Models
par: Jiang, Houcheng, et autres
Publié: (2025)
par: Jiang, Houcheng, et autres
Publié: (2025)
HarnessForge: Joint Harness and Policy Evolution for Adaptive Agent Systems
par: Chen, Mingju, et autres
Publié: (2026)
par: Chen, Mingju, et autres
Publié: (2026)
DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models
par: Li, Zherui, et autres
Publié: (2025)
par: Li, Zherui, et autres
Publié: (2025)
MAS$^2$: Self-Generative, Self-Configuring, Self-Rectifying Multi-Agent Systems
par: Wang, Kun, et autres
Publié: (2025)
par: Wang, Kun, et autres
Publié: (2025)
Contrastive Weak-to-strong Generalization
par: Jiang, Houcheng, et autres
Publié: (2025)
par: Jiang, Houcheng, et autres
Publié: (2025)
CSSBench: Evaluating the Safety of Lightweight LLMs against Chinese-Specific Adversarial Patterns
par: Zhou, Zhenhong, et autres
Publié: (2026)
par: Zhou, Zhenhong, et autres
Publié: (2026)
CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards
par: Xue, Xiangyuan, et autres
Publié: (2025)
par: Xue, Xiangyuan, et autres
Publié: (2025)
CoTGuard: Using Chain-of-Thought Triggering for Copyright Protection in Multi-Agent LLM Systems
par: Wen, Yan, et autres
Publié: (2025)
par: Wen, Yan, et autres
Publié: (2025)
UniErase: Towards Balanced and Precise Unlearning in Language Models
par: Yu, Miao, et autres
Publié: (2025)
par: Yu, Miao, et autres
Publié: (2025)
EvoRoute: Experience-Driven Self-Routing LLM Agent Systems
par: Zhang, Guibin, et autres
Publié: (2026)
par: Zhang, Guibin, et autres
Publié: (2026)
TodoEvolve: Learning to Architect Agent Planning Systems
par: Liu, Jiaxi, et autres
Publié: (2026)
par: Liu, Jiaxi, et autres
Publié: (2026)
Diagnose, Localize, Align: A Full-Stack Framework for Reliable LLM Multi-Agent Systems under Instruction Conflicts
par: Wan, Guancheng, et autres
Publié: (2025)
par: Wan, Guancheng, et autres
Publié: (2025)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
par: Zhang, Wei, et autres
Publié: (2025)
par: Zhang, Wei, et autres
Publié: (2025)
RAMA: Retrieval-Augmented Multi-Agent Framework for Misinformation Detection in Multimodal Fact-Checking
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
Multi-Agent Retrieval-Augmented Framework for Evidence-Based Counterspeech Against Health Misinformation
par: Anik, Anirban Saha, et autres
Publié: (2025)
par: Anik, Anirban Saha, et autres
Publié: (2025)
SpeechAgents: Human-Communication Simulation with Multi-Modal Multi-Agent Systems
par: Zhang, Dong, et autres
Publié: (2024)
par: Zhang, Dong, et autres
Publié: (2024)
On the Role of Attention Heads in Large Language Model Safety
par: Zhou, Zhenhong, et autres
Publié: (2024)
par: Zhou, Zhenhong, et autres
Publié: (2024)
Latent Causal Void: Explicit Missing-Context Reconstruction for Misinformation Detection
par: Li, Hui, et autres
Publié: (2026)
par: Li, Hui, et autres
Publié: (2026)
Automotive-ENV: Benchmarking Multimodal Agents in Vehicle Interface Systems
par: Yan, Junfeng, et autres
Publié: (2025)
par: Yan, Junfeng, et autres
Publié: (2025)
TDAG: A Multi-Agent Framework based on Dynamic Task Decomposition and Agent Generation
par: Wang, Yaoxiang, et autres
Publié: (2024)
par: Wang, Yaoxiang, et autres
Publié: (2024)
Reasoning About the Unsaid: Misinformation Detection with Omission-Aware Graph Inference
par: Wang, Zhengjia, et autres
Publié: (2025)
par: Wang, Zhengjia, et autres
Publié: (2025)
An Explainable Framework for Misinformation Identification via Critical Question Answering
par: Ruiz-Dolz, Ramon, et autres
Publié: (2025)
par: Ruiz-Dolz, Ramon, et autres
Publié: (2025)
Documents similaires
-
Reinforced Lifelong Editing for Language Models
par: Li, Zherui, et autres
Publié: (2025) -
CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models
par: Zhou, Zhenhong, et autres
Publié: (2025) -
MemEvolve: Meta-Evolution of Agent Memory Systems
par: Zhang, Guibin, et autres
Publié: (2025) -
Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation
par: Zhang, Yuanhe, et autres
Publié: (2025) -
Multi-agent Architecture Search via Agentic Supernet
par: Zhang, Guibin, et autres
Publié: (2025)