Guardado en:
| Autores principales: | Jiang, Tanqiu, Wang, Yuhui, Liang, Jiacheng, Wang, Ting |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.16901 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MAGE: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory
por: Wang, Yuhui, et al.
Publicado: (2026)
por: Wang, Yuhui, et al.
Publicado: (2026)
RobustKV: Defending Large Language Models against Jailbreak Attacks via KV Eviction
por: Jiang, Tanqiu, et al.
Publicado: (2024)
por: Jiang, Tanqiu, et al.
Publicado: (2024)
RASA: Routing-Aware Safety Alignment for Mixture-of-Experts Models
por: Liang, Jiacheng, et al.
Publicado: (2026)
por: Liang, Jiacheng, et al.
Publicado: (2026)
GraphRAG under Fire
por: Liang, Jiacheng, et al.
Publicado: (2025)
por: Liang, Jiacheng, et al.
Publicado: (2025)
Your Agent Can Defend Itself against Backdoor Attacks
por: Changjiang, Li, et al.
Publicado: (2025)
por: Changjiang, Li, et al.
Publicado: (2025)
UltraHorizon: Benchmarking Agent Capabilities in Ultra Long-Horizon Scenarios
por: Luo, Haotian, et al.
Publicado: (2025)
por: Luo, Haotian, et al.
Publicado: (2025)
HiMem: Hierarchical Long-Term Memory for LLM Long-Horizon Agents
por: Zhang, Ningning, et al.
Publicado: (2026)
por: Zhang, Ningning, et al.
Publicado: (2026)
Can LLM Agents Be CFOs? Benchmarking Long-Horizon Resource Allocation in an Uncertain Enterprise Environment
por: Han, Yi, et al.
Publicado: (2026)
por: Han, Yi, et al.
Publicado: (2026)
AgentProg: Empowering Long-Horizon GUI Agents with Program-Guided Context Management
por: Tian, Shizuo, et al.
Publicado: (2025)
por: Tian, Shizuo, et al.
Publicado: (2025)
Cross-Modal Content Optimization for Steering Web Agent Preferences
por: Jiang, Tanqiu, et al.
Publicado: (2025)
por: Jiang, Tanqiu, et al.
Publicado: (2025)
Can LLM Agents Sustain Long-Horizon Organizational Dynamics?
por: Zhu, Xuancheng, et al.
Publicado: (2026)
por: Zhu, Xuancheng, et al.
Publicado: (2026)
Parallel Context Compaction for Long-Horizon LLM Agent Serving
por: Cim, Musa, et al.
Publicado: (2026)
por: Cim, Musa, et al.
Publicado: (2026)
Hindsight Credit Assignment for Long-Horizon LLM Agents
por: Tan, Hui-Ze, et al.
Publicado: (2026)
por: Tan, Hui-Ze, et al.
Publicado: (2026)
Continuum Memory Architectures for Long-Horizon LLM Agents
por: Logan, Joe
Publicado: (2026)
por: Logan, Joe
Publicado: (2026)
Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
por: Zhang, Hanrong, et al.
Publicado: (2024)
por: Zhang, Hanrong, et al.
Publicado: (2024)
Reinforcement Learning for Long-Horizon Interactive LLM Agents
por: Chen, Kevin, et al.
Publicado: (2025)
por: Chen, Kevin, et al.
Publicado: (2025)
A Subgoal-driven Framework for Improving Long-Horizon LLM Agents
por: Wang, Taiyi, et al.
Publicado: (2026)
por: Wang, Taiyi, et al.
Publicado: (2026)
CheatAgent: Attacking LLM-Empowered Recommender Systems via LLM Agent
por: Ning, Liang-bo, et al.
Publicado: (2025)
por: Ning, Liang-bo, et al.
Publicado: (2025)
Self-Improving Model Steering
por: Zhu, Rongyi, et al.
Publicado: (2025)
por: Zhu, Rongyi, et al.
Publicado: (2025)
Reasoning or Retrieval? A Study of Answer Attribution on Large Reasoning Models
por: Wang, Yuhui, et al.
Publicado: (2025)
por: Wang, Yuhui, et al.
Publicado: (2025)
LongSeeker: Elastic Context Orchestration for Long-Horizon Search Agents
por: Lu, Yijun, et al.
Publicado: (2026)
por: Lu, Yijun, et al.
Publicado: (2026)
ColorBench: Benchmarking Mobile Agents with Graph-Structured Framework for Complex Long-Horizon Tasks
por: Song, Yuanyi, et al.
Publicado: (2025)
por: Song, Yuanyi, et al.
Publicado: (2025)
TRIP-Bench: A Benchmark for Long-Horizon Interactive Agents in Real-World Scenarios
por: Shen, Yuanzhe, et al.
Publicado: (2026)
por: Shen, Yuanzhe, et al.
Publicado: (2026)
LongDA: Benchmarking LLM Agents for Long-Document Data Analysis
por: Li, Yiyang, et al.
Publicado: (2026)
por: Li, Yiyang, et al.
Publicado: (2026)
The Tool Decathlon: Benchmarking Language Agents for Diverse, Realistic, and Long-Horizon Task Execution
por: Li, Junlong, et al.
Publicado: (2025)
por: Li, Junlong, et al.
Publicado: (2025)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
por: Ye, Rui, et al.
Publicado: (2025)
por: Ye, Rui, et al.
Publicado: (2025)
CoMIC: Collaborative Memory and Insights Circulation for Long-Horizon LLM Agents in Cloud-Edge Systems
por: Wang, Yannan, et al.
Publicado: (2026)
por: Wang, Yannan, et al.
Publicado: (2026)
Co-Evolving LLM Decision and Skill Bank Agents for Long-Horizon Tasks
por: Wu, Xiyang, et al.
Publicado: (2026)
por: Wu, Xiyang, et al.
Publicado: (2026)
Causal Intervention-Based Memory Selection for Long-Horizon LLM Agents
por: Srivastava, Saksham Sahai
Publicado: (2026)
por: Srivastava, Saksham Sahai
Publicado: (2026)
The Cognitive Bandwidth Bottleneck: Shifting Long-Horizon Agent from Planning with Actions to Planning with Schemas
por: Xu, Baixuan, et al.
Publicado: (2025)
por: Xu, Baixuan, et al.
Publicado: (2025)
TRACE: Trajectory Risk-Aware Compression for Long-Horizon Agent Safety
por: Hong, Zhepei, et al.
Publicado: (2026)
por: Hong, Zhepei, et al.
Publicado: (2026)
AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning
por: Hu, Yuyang, et al.
Publicado: (2026)
por: Hu, Yuyang, et al.
Publicado: (2026)
SAM: State-Adaptive Memory for Long-Horizon Reasoning Agent
por: Hu, Yuyang, et al.
Publicado: (2026)
por: Hu, Yuyang, et al.
Publicado: (2026)
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
por: Gao, Heyang, et al.
Publicado: (2025)
por: Gao, Heyang, et al.
Publicado: (2025)
When the Specification Emerges: Benchmarking Faithfulness Loss in Long-Horizon Coding Agents
por: Yan, Lu, et al.
Publicado: (2026)
por: Yan, Lu, et al.
Publicado: (2026)
AgentCPM-Explore: Realizing Long-Horizon Deep Exploration for Edge-Scale Agents
por: Chen, Haotian, et al.
Publicado: (2026)
por: Chen, Haotian, et al.
Publicado: (2026)
Aeon: High-Performance Neuro-Symbolic Memory Management for Long-Horizon LLM Agents
por: Arslan, Mustafa
Publicado: (2026)
por: Arslan, Mustafa
Publicado: (2026)
Beyond pass@1: A Reliability Science Framework for Long-Horizon LLM Agents
por: Khanal, Aaditya, et al.
Publicado: (2026)
por: Khanal, Aaditya, et al.
Publicado: (2026)
LoCoBench-Agent: An Interactive Benchmark for LLM Agents in Long-Context Software Engineering
por: Qiu, Jielin, et al.
Publicado: (2025)
por: Qiu, Jielin, et al.
Publicado: (2025)
AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents
por: Feng, Zhaopeng, et al.
Publicado: (2026)
por: Feng, Zhaopeng, et al.
Publicado: (2026)
Ejemplares similares
-
MAGE: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory
por: Wang, Yuhui, et al.
Publicado: (2026) -
RobustKV: Defending Large Language Models against Jailbreak Attacks via KV Eviction
por: Jiang, Tanqiu, et al.
Publicado: (2024) -
RASA: Routing-Aware Safety Alignment for Mixture-of-Experts Models
por: Liang, Jiacheng, et al.
Publicado: (2026) -
GraphRAG under Fire
por: Liang, Jiacheng, et al.
Publicado: (2025) -
Your Agent Can Defend Itself against Backdoor Attacks
por: Changjiang, Li, et al.
Publicado: (2025)