Securing the Floor and Raising the Ceiling: A Merging-based Paradigm for Multi-modal Search Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Zhixiang, Xu, Jingxuan, Chen, Dajun, Wu, Yunfang, Jiang, Wei, Li, Yong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Optimal Brain Iterative Merging: Mitigating Interference in LLM Merging
von: Wang, Zhixiang, et al.
Veröffentlicht: (2025)
von: Wang, Zhixiang, et al.
Veröffentlicht: (2025)
EGSS: Entropy-guided Stepwise Scaling for Reliable Software Engineering
von: Mao, Chenhui, et al.
Veröffentlicht: (2026)
von: Mao, Chenhui, et al.
Veröffentlicht: (2026)
Learning Adaptive Parallel Execution for Efficient Code Localization
von: Xu, Ke, et al.
Veröffentlicht: (2026)
von: Xu, Ke, et al.
Veröffentlicht: (2026)
MetaAgent-X : Breaking the Ceiling of Automatic Multi-Agent Systems via End-to-End Reinforcement Learning
von: Zhang, Yaolun, et al.
Veröffentlicht: (2026)
von: Zhang, Yaolun, et al.
Veröffentlicht: (2026)
ProBench: Benchmarking GUI Agents with Accurate Process Information
von: Yang, Leyang, et al.
Veröffentlicht: (2025)
von: Yang, Leyang, et al.
Veröffentlicht: (2025)
MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate
von: Wang, Jianze, et al.
Veröffentlicht: (2026)
von: Wang, Jianze, et al.
Veröffentlicht: (2026)
Beyond Demonstrations: Dynamic Vector Construction from Latent Representations
von: Cai, Wang, et al.
Veröffentlicht: (2025)
von: Cai, Wang, et al.
Veröffentlicht: (2025)
SVRepair: Structured Visual Reasoning for Automated Program Repair
von: Tang, Xiaoxuan, et al.
Veröffentlicht: (2026)
von: Tang, Xiaoxuan, et al.
Veröffentlicht: (2026)
Progent: Securing AI Agents with Privilege Control
von: Shi, Tianneng, et al.
Veröffentlicht: (2025)
von: Shi, Tianneng, et al.
Veröffentlicht: (2025)
Towards Scalable Lightweight GUI Agents via Multi-role Orchestration
von: Wang, Ziwei, et al.
Veröffentlicht: (2026)
von: Wang, Ziwei, et al.
Veröffentlicht: (2026)
History-Aware Reasoning for GUI Agents
von: Wang, Ziwei, et al.
Veröffentlicht: (2025)
von: Wang, Ziwei, et al.
Veröffentlicht: (2025)
MIM: Multi-modal Content Interest Modeling Paradigm for User Behavior Modeling
von: Yan, Bencheng, et al.
Veröffentlicht: (2025)
von: Yan, Bencheng, et al.
Veröffentlicht: (2025)
A Framework for Formalizing LLM Agent Security
von: Siu, Vincent, et al.
Veröffentlicht: (2026)
von: Siu, Vincent, et al.
Veröffentlicht: (2026)
MedAgent-Pro: Towards Evidence-based Multi-modal Medical Diagnosis via Reasoning Agentic Workflow
von: Wang, Ziyue, et al.
Veröffentlicht: (2025)
von: Wang, Ziyue, et al.
Veröffentlicht: (2025)
A Survey of LLM-based Deep Search Agents: Paradigm, Optimization, Evaluation, and Challenges
von: Xi, Yunjia, et al.
Veröffentlicht: (2025)
von: Xi, Yunjia, et al.
Veröffentlicht: (2025)
EcoThink: A Green Adaptive Inference Framework for Sustainable and Accessible Agents
von: Li, Linxiao, et al.
Veröffentlicht: (2026)
von: Li, Linxiao, et al.
Veröffentlicht: (2026)
MMedAgent: Learning to Use Medical Tools with Multi-modal Agent
von: Li, Binxu, et al.
Veröffentlicht: (2024)
von: Li, Binxu, et al.
Veröffentlicht: (2024)
A Survey of Data Agents: Emerging Paradigm or Overstated Hype?
von: Zhu, Yizhang, et al.
Veröffentlicht: (2025)
von: Zhu, Yizhang, et al.
Veröffentlicht: (2025)
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
von: Wang, Guoqing, et al.
Veröffentlicht: (2025)
von: Wang, Guoqing, et al.
Veröffentlicht: (2025)
Scaling Retrieval-Augmented Reasoning with Parallel Search and Explicit Merging
von: Liu, Jiabei, et al.
Veröffentlicht: (2026)
von: Liu, Jiabei, et al.
Veröffentlicht: (2026)
Towards AI Search Paradigm
von: Li, Yuchen, et al.
Veröffentlicht: (2025)
von: Li, Yuchen, et al.
Veröffentlicht: (2025)
Memory-Augmented LLM-based Multi-Agent System for Automated Feature Generation on Tabular Data
von: Dong, Fengxian, et al.
Veröffentlicht: (2026)
von: Dong, Fengxian, et al.
Veröffentlicht: (2026)
DynaDebate: Breaking Homogeneity in Multi-Agent Debate with Dynamic Path Generation
von: Li, Zhenghao, et al.
Veröffentlicht: (2026)
von: Li, Zhenghao, et al.
Veröffentlicht: (2026)
Tree Search for LLM Agent Reinforcement Learning
von: Ji, Yuxiang, et al.
Veröffentlicht: (2025)
von: Ji, Yuxiang, et al.
Veröffentlicht: (2025)
MMAC-Copilot: Multi-modal Agent Collaboration Operating Copilot
von: Song, Zirui, et al.
Veröffentlicht: (2024)
von: Song, Zirui, et al.
Veröffentlicht: (2024)
Large Model Based Agents: State-of-the-Art, Cooperation Paradigms, Security and Privacy, and Future Trends
von: Wang, Yuntao, et al.
Veröffentlicht: (2024)
von: Wang, Yuntao, et al.
Veröffentlicht: (2024)
Multi-Agent Systems: From Classical Paradigms to Large Foundation Model-Enabled Futures
von: Wang, Zixiang, et al.
Veröffentlicht: (2026)
von: Wang, Zixiang, et al.
Veröffentlicht: (2026)
Agent4S: The Transformation of Research Paradigms from the Perspective of Large Language Models
von: Zheng, Boyuan, et al.
Veröffentlicht: (2025)
von: Zheng, Boyuan, et al.
Veröffentlicht: (2025)
Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion
von: Huang, ShiYing, et al.
Veröffentlicht: (2026)
von: Huang, ShiYing, et al.
Veröffentlicht: (2026)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
von: Wu, Jiaxin, et al.
Veröffentlicht: (2025)
von: Wu, Jiaxin, et al.
Veröffentlicht: (2025)
To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models
von: Wang, Haoqing, et al.
Veröffentlicht: (2026)
von: Wang, Haoqing, et al.
Veröffentlicht: (2026)
InquireMobile: Teaching VLM-based Mobile Agent to Request Human Assistance via Reinforcement Fine-Tuning
von: Ai, Qihang, et al.
Veröffentlicht: (2025)
von: Ai, Qihang, et al.
Veröffentlicht: (2025)
SentinelAgent: Graph-based Anomaly Detection in Multi-Agent Systems
von: He, Xu, et al.
Veröffentlicht: (2025)
von: He, Xu, et al.
Veröffentlicht: (2025)
Privacy-Enhancing Paradigms within Federated Multi-Agent Systems
von: Shi, Zitong, et al.
Veröffentlicht: (2025)
von: Shi, Zitong, et al.
Veröffentlicht: (2025)
QuarkMedSearch: A Long-Horizon Deep Search Agent for Exploring Medical Intelligence
von: Lin, Zhichao, et al.
Veröffentlicht: (2026)
von: Lin, Zhichao, et al.
Veröffentlicht: (2026)
Multi-modal Reasoning with LLMs for Visual Semantic Arithmetic
von: Xu, Chuou, et al.
Veröffentlicht: (2026)
von: Xu, Chuou, et al.
Veröffentlicht: (2026)
Multi-Level Collaboration in Model Merging
von: Li, Qi, et al.
Veröffentlicht: (2025)
von: Li, Qi, et al.
Veröffentlicht: (2025)
MES-RAG: Bringing Multi-modal, Entity-Storage, and Secure Enhancements to RAG
von: Wu, Pingyu, et al.
Veröffentlicht: (2025)
von: Wu, Pingyu, et al.
Veröffentlicht: (2025)
Repurposing Synthetic Data for Fine-grained Search Agent Supervision
von: Zhao, Yida, et al.
Veröffentlicht: (2025)
von: Zhao, Yida, et al.
Veröffentlicht: (2025)
Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment
von: Xie, Yuchong, et al.
Veröffentlicht: (2025)
von: Xie, Yuchong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Optimal Brain Iterative Merging: Mitigating Interference in LLM Merging
von: Wang, Zhixiang, et al.
Veröffentlicht: (2025) -
EGSS: Entropy-guided Stepwise Scaling for Reliable Software Engineering
von: Mao, Chenhui, et al.
Veröffentlicht: (2026) -
Learning Adaptive Parallel Execution for Efficient Code Localization
von: Xu, Ke, et al.
Veröffentlicht: (2026) -
MetaAgent-X : Breaking the Ceiling of Automatic Multi-Agent Systems via End-to-End Reinforcement Learning
von: Zhang, Yaolun, et al.
Veröffentlicht: (2026) -
ProBench: Benchmarking GUI Agents with Accurate Process Information
von: Yang, Leyang, et al.
Veröffentlicht: (2025)