World-Model-Augmented Web Agents with Action Correction
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Zhouzhou, Hu, Xueyu, Li, Xiyun, Fang, Tianqing, Li, Juncheng, Zhang, Shengyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HarmonyGuard: Toward Safety and Utility in Web Agents via Adaptive Policy Enhancement and Dual-Objective Optimization
di: Chen, Yurun, et al.
Pubblicazione: (2025)
di: Chen, Yurun, et al.
Pubblicazione: (2025)
OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization
di: He, Hongliang, et al.
Pubblicazione: (2024)
di: He, Hongliang, et al.
Pubblicazione: (2024)
WebRollback: Enhancing Web Agents with Explicit Rollback Mechanisms
di: Zhang, Zhisong, et al.
Pubblicazione: (2025)
di: Zhang, Zhisong, et al.
Pubblicazione: (2025)
SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning
di: Zheng, Tianshi, et al.
Pubblicazione: (2026)
di: Zheng, Tianshi, et al.
Pubblicazione: (2026)
MadaKV: Adaptive Modality-Perception KV Cache Eviction for Efficient Multimodal Long-Context Inference
di: Li, Kunxi, et al.
Pubblicazione: (2025)
di: Li, Kunxi, et al.
Pubblicazione: (2025)
Preemptive Detection and Correction of Misaligned Actions in LLM Agents
di: Fang, Haishuo, et al.
Pubblicazione: (2024)
di: Fang, Haishuo, et al.
Pubblicazione: (2024)
BrowserAgent: Building Web Agents with Human-Inspired Web Browsing Actions
di: Yu, Tao, et al.
Pubblicazione: (2025)
di: Yu, Tao, et al.
Pubblicazione: (2025)
Cognitive Kernel-Pro: A Framework for Deep Research Agents and Agent Foundation Models Training
di: Fang, Tianqing, et al.
Pubblicazione: (2025)
di: Fang, Tianqing, et al.
Pubblicazione: (2025)
The Cognitive Bandwidth Bottleneck: Shifting Long-Horizon Agent from Planning with Actions to Planning with Schemas
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
InfiGUIAgent: A Multimodal Generalist GUI Agent with Native Reasoning and Reflection
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
On-the-fly Denoising for Data Augmentation in Natural Language Understanding
di: Fang, Tianqing, et al.
Pubblicazione: (2022)
di: Fang, Tianqing, et al.
Pubblicazione: (2022)
CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
Can Agent Conquer Web? Exploring the Frontiers of ChatGPT Atlas Agent in Web Games
di: Zhang, Jingran, et al.
Pubblicazione: (2025)
di: Zhang, Jingran, et al.
Pubblicazione: (2025)
WebSailor: Navigating Super-human Reasoning for Web Agent
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
PatchWorld: Gradient-Free Optimization of Executable World Models
di: Bai, Jiaxin, et al.
Pubblicazione: (2026)
di: Bai, Jiaxin, et al.
Pubblicazione: (2026)
SafePred: A Predictive Guardrail for Computer-Using Agents via World Models
di: Chen, Yurun, et al.
Pubblicazione: (2026)
di: Chen, Yurun, et al.
Pubblicazione: (2026)
Large Language Models Empowered Personalized Web Agents
di: Cai, Hongru, et al.
Pubblicazione: (2024)
di: Cai, Hongru, et al.
Pubblicazione: (2024)
Acquiring and Modelling Abstract Commonsense Knowledge via Conceptualization
di: He, Mutian, et al.
Pubblicazione: (2022)
di: He, Mutian, et al.
Pubblicazione: (2022)
DynaWeb: Model-Based Reinforcement Learning of Web Agents
di: Ding, Hang, et al.
Pubblicazione: (2026)
di: Ding, Hang, et al.
Pubblicazione: (2026)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
di: Xiong, Tao, et al.
Pubblicazione: (2025)
di: Xiong, Tao, et al.
Pubblicazione: (2025)
Web World Models
di: Feng, Jichen, et al.
Pubblicazione: (2025)
di: Feng, Jichen, et al.
Pubblicazione: (2025)
Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
Cascaded Self-Evaluation Augmented Training for Lightweight Multimodal LLMs
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
WebCoach: Self-Evolving Web Agents with Cross-Session Memory Guidance
di: Liu, Genglin, et al.
Pubblicazione: (2025)
di: Liu, Genglin, et al.
Pubblicazione: (2025)
GroundAct: Can LLM Agents Ground Actions in Environmental States?
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
WebOperator: Action-Aware Tree Search for Autonomous Agents in Web Environment
di: Dihan, Mahir Labib, et al.
Pubblicazione: (2025)
di: Dihan, Mahir Labib, et al.
Pubblicazione: (2025)
InfiGUI-R1: Advancing Multimodal GUI Agents from Reactive Actors to Deliberative Reasoners
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
COMAP: Co-Evolving World Models and Agent Policies for LLM Agents
di: Liu, Youwei, et al.
Pubblicazione: (2026)
di: Liu, Youwei, et al.
Pubblicazione: (2026)
WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models
di: He, Hongliang, et al.
Pubblicazione: (2024)
di: He, Hongliang, et al.
Pubblicazione: (2024)
WebXSkill: Skill Learning for Autonomous Web Agents
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
SWE-AGILE: A Software Agent Framework for Efficiently Managing Dynamic Reasoning Context
di: Lian, Shuquan, et al.
Pubblicazione: (2026)
di: Lian, Shuquan, et al.
Pubblicazione: (2026)
WindowsWorld: A Process-Centric Benchmark of Autonomous GUI Agents in Professional Cross-Application Environments
di: Li, Jinchao, et al.
Pubblicazione: (2026)
di: Li, Jinchao, et al.
Pubblicazione: (2026)
Cognitive Duality for Adaptive Web Agents
di: Liu, Jiarun, et al.
Pubblicazione: (2025)
di: Liu, Jiarun, et al.
Pubblicazione: (2025)
Concept-Reversed Winograd Schema Challenge: Evaluating and Improving Robust Reasoning in Large Language Models via Abstraction
di: Han, Kaiqiao, et al.
Pubblicazione: (2024)
di: Han, Kaiqiao, et al.
Pubblicazione: (2024)
Avenir-Web: Human-Experience-Imitating Multimodal Web Agents with Mixture of Grounding Experts
di: Li, Aiden Yiliu, et al.
Pubblicazione: (2026)
di: Li, Aiden Yiliu, et al.
Pubblicazione: (2026)
ExpSeek: Self-Triggered Experience Seeking for Web Agents
di: Zhang, Wenyuan, et al.
Pubblicazione: (2026)
di: Zhang, Wenyuan, et al.
Pubblicazione: (2026)
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
di: Fang, Tianqing, et al.
Pubblicazione: (2024)
di: Fang, Tianqing, et al.
Pubblicazione: (2024)
ConstraintChecker: A Plugin for Large Language Models to Reason on Commonsense Knowledge Bases
di: Do, Quyet V., et al.
Pubblicazione: (2024)
di: Do, Quyet V., et al.
Pubblicazione: (2024)
InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
Can LLM Agents Generate Real-World Evidence? Evaluating Observational Studies in Medical Databases
di: Li, Dubai, et al.
Pubblicazione: (2026)
di: Li, Dubai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
HarmonyGuard: Toward Safety and Utility in Web Agents via Adaptive Policy Enhancement and Dual-Objective Optimization
di: Chen, Yurun, et al.
Pubblicazione: (2025) -
OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization
di: He, Hongliang, et al.
Pubblicazione: (2024) -
WebRollback: Enhancing Web Agents with Explicit Rollback Mechanisms
di: Zhang, Zhisong, et al.
Pubblicazione: (2025) -
SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning
di: Zheng, Tianshi, et al.
Pubblicazione: (2026) -
MadaKV: Adaptive Modality-Perception KV Cache Eviction for Efficient Multimodal Long-Context Inference
di: Li, Kunxi, et al.
Pubblicazione: (2025)