OptArgus: A Multi-Agent System to Detect Hallucinations in LLM-based Optimization Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Zhong, Guo, Zihan, Lu, Xiaohan, Wang, Juntao, Song, Jie, Shen, Chao, Wu, Jiageng, Sun, Mingyang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLM-DMD: Large Language Model-based Power System Dynamic Model Discovery
por: Shen, Chao, et al.
Publicado: (2026)
por: Shen, Chao, et al.
Publicado: (2026)
Argus: Token Aware Distributed LLM Inference Optimization
por: Wu, Panlong, et al.
Publicado: (2025)
por: Wu, Panlong, et al.
Publicado: (2025)
LLM-Guided Safe Reinforcement Learning for Energy System Topology Reconfiguration
por: Zhang, Zongyan, et al.
Publicado: (2026)
por: Zhang, Zongyan, et al.
Publicado: (2026)
ProOPF: Benchmarking and Improving LLMs for Professional-Grade Power Systems Optimization Modeling
por: Shen, Chao, et al.
Publicado: (2026)
por: Shen, Chao, et al.
Publicado: (2026)
Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection
por: Liang, Zi, et al.
Publicado: (2026)
por: Liang, Zi, et al.
Publicado: (2026)
Variance-Driven Mean Temperature Reduction in Nonuniformly Heated Radiative-Conductive Systems
por: Lu, Juntao, et al.
Publicado: (2026)
por: Lu, Juntao, et al.
Publicado: (2026)
Argus: A Multi-Agent Sensitive Information Leakage Detection Framework Based on Hierarchical Reference Relationships
por: Wang, Bin, et al.
Publicado: (2025)
por: Wang, Bin, et al.
Publicado: (2025)
OptAgent: Optimizing Query Rewriting for E-commerce via Multi-Agent Simulation
por: Handa, Divij, et al.
Publicado: (2025)
por: Handa, Divij, et al.
Publicado: (2025)
Who Deserves the Reward? SHARP: Shapley Credit-based Optimization for Multi-Agent System
por: Li, Yanming, et al.
Publicado: (2026)
por: Li, Yanming, et al.
Publicado: (2026)
AccelOpt: A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization
por: Zhang, Genghan, et al.
Publicado: (2025)
por: Zhang, Genghan, et al.
Publicado: (2025)
SemanticOpt: Towards LLM-Based Semantic Black-Box Optimization
por: Meindl, Jamison, et al.
Publicado: (2025)
por: Meindl, Jamison, et al.
Publicado: (2025)
LLM-CoOpt: A Co-Design and Optimization Framework for Efficient LLM Inference on Heterogeneous Platforms
por: Kong, Jie, et al.
Publicado: (2026)
por: Kong, Jie, et al.
Publicado: (2026)
AgentOpt v0.1 Technical Report: Client-Side Optimization for LLM-Based Agent
por: Hua, Wenyue, et al.
Publicado: (2026)
por: Hua, Wenyue, et al.
Publicado: (2026)
Argus: Evidence Assembly for Scalable Deep Research Agents
por: Zhang, Zhen, et al.
Publicado: (2026)
por: Zhang, Zhen, et al.
Publicado: (2026)
MASPO: Joint Prompt Optimization for LLM-based Multi-Agent Systems
por: Wang, Zhexuan, et al.
Publicado: (2026)
por: Wang, Zhexuan, et al.
Publicado: (2026)
DPEPO: Diverse Parallel Exploration Policy Optimization for LLM-based Agents
por: Zhang, Junshuo, et al.
Publicado: (2026)
por: Zhang, Junshuo, et al.
Publicado: (2026)
LLM Hallucination Detection: HSAD
por: Li, JinXin, et al.
Publicado: (2025)
por: Li, JinXin, et al.
Publicado: (2025)
Cowpox: Towards the Immunity of VLM-based Multi-Agent Systems
por: Wu, Yutong, et al.
Publicado: (2025)
por: Wu, Yutong, et al.
Publicado: (2025)
SentinelAgent: Graph-based Anomaly Detection in Multi-Agent Systems
por: He, Xu, et al.
Publicado: (2025)
por: He, Xu, et al.
Publicado: (2025)
Universal Transient Stability Analysis: A Pre-trained Generative Transformer-Enabled Power System Dynamics Prediction Framework
por: Shen, Chao, et al.
Publicado: (2025)
por: Shen, Chao, et al.
Publicado: (2025)
MARCH: Multi-Agent Reinforced Self-Check for LLM Hallucination
por: Li, Zhuo, et al.
Publicado: (2026)
por: Li, Zhuo, et al.
Publicado: (2026)
SrSv: Integrating Sequential Rollouts with Sequential Value Estimation for Multi-agent Reinforcement Learning
por: Wan, Xu, et al.
Publicado: (2025)
por: Wan, Xu, et al.
Publicado: (2025)
Alleviating LLM-based Generative Retrieval Hallucination in Alipay Search
por: Shen, Yedan, et al.
Publicado: (2025)
por: Shen, Yedan, et al.
Publicado: (2025)
MIRAGE-Bench: LLM Agent is Hallucinating and Where to Find Them
por: Zhang, Weichen, et al.
Publicado: (2025)
por: Zhang, Weichen, et al.
Publicado: (2025)
Parallelized Planning-Acting for Efficient LLM-based Multi-Agent Systems in Minecraft
por: Li, Yaoru, et al.
Publicado: (2025)
por: Li, Yaoru, et al.
Publicado: (2025)
Towards Detecting LLMs Hallucination via Markov Chain-based Multi-agent Debate Framework
por: Sun, Xiaoxi, et al.
Publicado: (2024)
por: Sun, Xiaoxi, et al.
Publicado: (2024)
ResMAS: Resilience Optimization in LLM-based Multi-agent Systems
por: Zhou, Zhilun, et al.
Publicado: (2026)
por: Zhou, Zhilun, et al.
Publicado: (2026)
OptPipe: Memory- and Scheduling-Optimized Pipeline Parallelism for LLM Training
por: Li, Hongpei, et al.
Publicado: (2025)
por: Li, Hongpei, et al.
Publicado: (2025)
Watch Out for Your Agents! Investigating Backdoor Threats to LLM-Based Agents
por: Yang, Wenkai, et al.
Publicado: (2024)
por: Yang, Wenkai, et al.
Publicado: (2024)
Guiding Clinical Reasoning with Large Language Models via Knowledge Seeds
por: WU, Jiageng, et al.
Publicado: (2024)
por: WU, Jiageng, et al.
Publicado: (2024)
LLM-based Agents Suffer from Hallucinations: A Survey of Taxonomy, Methods, and Directions
por: Lin, Xixun, et al.
Publicado: (2025)
por: Lin, Xixun, et al.
Publicado: (2025)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
por: Wei, Yongxian, et al.
Publicado: (2025)
por: Wei, Yongxian, et al.
Publicado: (2025)
MOC: Multi-Order Communication in LLM-based Multi-Agent Systems
por: Guan, Yao, et al.
Publicado: (2026)
por: Guan, Yao, et al.
Publicado: (2026)
AgentHallu: Benchmarking Automated Hallucination Attribution of LLM-based Agents
por: Liu, Xuannan, et al.
Publicado: (2026)
por: Liu, Xuannan, et al.
Publicado: (2026)
OptMATH: A Scalable Bidirectional Data Synthesis Framework for Optimization Modeling
por: Lu, Hongliang, et al.
Publicado: (2025)
por: Lu, Hongliang, et al.
Publicado: (2025)
SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling
por: Zhang, Yansen, et al.
Publicado: (2025)
por: Zhang, Yansen, et al.
Publicado: (2025)
Argus Inspection: Do Multimodal Large Language Models Possess the Eye of Panoptes?
por: Yao, Yang, et al.
Publicado: (2025)
por: Yao, Yang, et al.
Publicado: (2025)
On the Approximation Ratio of the $k$-Opt and Lin-Kernighan Algorithm
por: Zhong, Xianghui
Publicado: (2019)
por: Zhong, Xianghui
Publicado: (2019)
SemOpt: LLM-Driven Code Optimization via Rule-Based Analysis
por: Zhao, Yuwei, et al.
Publicado: (2025)
por: Zhao, Yuwei, et al.
Publicado: (2025)
Autonomous Detection and Coverage of Unknown Target Areas by Multi-Agent Systems
por: Song, Jie, et al.
Publicado: (2025)
por: Song, Jie, et al.
Publicado: (2025)
Ejemplares similares
-
LLM-DMD: Large Language Model-based Power System Dynamic Model Discovery
por: Shen, Chao, et al.
Publicado: (2026) -
Argus: Token Aware Distributed LLM Inference Optimization
por: Wu, Panlong, et al.
Publicado: (2025) -
LLM-Guided Safe Reinforcement Learning for Energy System Topology Reconfiguration
por: Zhang, Zongyan, et al.
Publicado: (2026) -
ProOPF: Benchmarking and Improving LLMs for Professional-Grade Power Systems Optimization Modeling
por: Shen, Chao, et al.
Publicado: (2026) -
Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection
por: Liang, Zi, et al.
Publicado: (2026)