Is Your LLM Secretly a World Model of the Internet? Model-Based Planning for Web Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Gu, Yu, Zhang, Kai, Ning, Yuting, Zheng, Boyuan, Gou, Boyu, Xue, Tianci, Chang, Cheng, Srivastava, Sanjari, Xie, Yanan, Qi, Peng, Sun, Huan, Su, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GPT-4V(ision) is a Generalist Web Agent, if Grounded
di: Zheng, Boyuan, et al.
Pubblicazione: (2024)
di: Zheng, Boyuan, et al.
Pubblicazione: (2024)
Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents
di: Gou, Boyu, et al.
Pubblicazione: (2024)
di: Gou, Boyu, et al.
Pubblicazione: (2024)
An Illusion of Progress? Assessing the Current State of Web Agents
di: Xue, Tianci, et al.
Pubblicazione: (2025)
di: Xue, Tianci, et al.
Pubblicazione: (2025)
Mind2Web 2: Evaluating Agentic Search with Agent-as-a-Judge
di: Gou, Boyu, et al.
Pubblicazione: (2025)
di: Gou, Boyu, et al.
Pubblicazione: (2025)
Explorer: Scaling Exploration-driven Web Trajectory Synthesis for Multimodal Web Agents
di: Pahuja, Vardaan, et al.
Pubblicazione: (2025)
di: Pahuja, Vardaan, et al.
Pubblicazione: (2025)
QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks
di: Xie, Jian, et al.
Pubblicazione: (2026)
di: Xie, Jian, et al.
Pubblicazione: (2026)
Autonomous Continual Learning for Environment Adaptation of Computer-Use Agents
di: Xue, Tianci, et al.
Pubblicazione: (2026)
di: Xue, Tianci, et al.
Pubblicazione: (2026)
RedTeamCUA: Realistic Adversarial Testing of Computer-Use Agents in Hybrid Web-OS Environments
di: Liao, Zeyi, et al.
Pubblicazione: (2025)
di: Liao, Zeyi, et al.
Pubblicazione: (2025)
WebGuard: Building a Generalizable Guardrail for Web Agents
di: Zheng, Boyuan, et al.
Pubblicazione: (2025)
di: Zheng, Boyuan, et al.
Pubblicazione: (2025)
AgentSociety Challenge: Designing LLM Agents for User Modeling and Recommendation on Web Platforms
di: Yan, Yuwei, et al.
Pubblicazione: (2025)
di: Yan, Yuwei, et al.
Pubblicazione: (2025)
ChemToolAgent: The Impact of Tools on Language Agents for Chemistry Problem Solving
di: Yu, Botao, et al.
Pubblicazione: (2024)
di: Yu, Botao, et al.
Pubblicazione: (2024)
Your Mixture-of-Experts LLM Is Secretly an Embedding Model For Free
di: Li, Ziyue, et al.
Pubblicazione: (2024)
di: Li, Ziyue, et al.
Pubblicazione: (2024)
WebEvolver: Enhancing Web Agent Self-Improvement with Coevolving World Model
di: Fang, Tianqing, et al.
Pubblicazione: (2025)
di: Fang, Tianqing, et al.
Pubblicazione: (2025)
WebWorld: A Large-Scale World Model for Web Agent Training
di: Xiao, Zikai, et al.
Pubblicazione: (2026)
di: Xiao, Zikai, et al.
Pubblicazione: (2026)
Model‐Guided Rational Construction of Escherichia coli Synthetic Consortia for Enhanced 2‐Methylbutyric Acid Production
di: Yu Liu, et al.
Pubblicazione: (2025)
di: Yu Liu, et al.
Pubblicazione: (2025)
Beyond Pairs: Your Language Model is Secretly Optimizing a Preference Graph
di: Liu, Ning, et al.
Pubblicazione: (2026)
di: Liu, Ning, et al.
Pubblicazione: (2026)
Your Diffusion Model is Secretly a Certifiably Robust Classifier
di: Chen, Huanran, et al.
Pubblicazione: (2024)
di: Chen, Huanran, et al.
Pubblicazione: (2024)
WARC-Bench: Web Archive Based Benchmark for GUI Subtask Executions
di: Srivastava, Sanjari, et al.
Pubblicazione: (2025)
di: Srivastava, Sanjari, et al.
Pubblicazione: (2025)
How to Train Your LLM Web Agent: A Statistical Diagnosis
di: Vattikonda, Dheeraj, et al.
Pubblicazione: (2025)
di: Vattikonda, Dheeraj, et al.
Pubblicazione: (2025)
Your ViT is Secretly an Image Segmentation Model
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills
di: Zheng, Boyuan, et al.
Pubblicazione: (2025)
di: Zheng, Boyuan, et al.
Pubblicazione: (2025)
Thinking as Compression: Your Reasoning Model is Secretly a Context Compressor
di: Ma, Guoxin, et al.
Pubblicazione: (2026)
di: Ma, Guoxin, et al.
Pubblicazione: (2026)
Web Agents with World Models: Learning and Leveraging Environment Dynamics in Web Navigation
di: Chae, Hyungjoo, et al.
Pubblicazione: (2024)
di: Chae, Hyungjoo, et al.
Pubblicazione: (2024)
Reinforcement World Model Learning for LLM-based Agents
di: Yu, Xiao, et al.
Pubblicazione: (2026)
di: Yu, Xiao, et al.
Pubblicazione: (2026)
A Trembling House of Cards? Mapping Adversarial Attacks against Language Agents
di: Mo, Lingbo, et al.
Pubblicazione: (2024)
di: Mo, Lingbo, et al.
Pubblicazione: (2024)
Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data
di: Ou, Jingyang, et al.
Pubblicazione: (2024)
di: Ou, Jingyang, et al.
Pubblicazione: (2024)
EdgeLLM: A Highly Efficient CPU-FPGA Heterogeneous Edge Accelerator for Large Language Models
di: Huang, Mingqiang, et al.
Pubblicazione: (2024)
di: Huang, Mingqiang, et al.
Pubblicazione: (2024)
TravelPlanner: A Benchmark for Real-World Planning with Language Agents
di: Xie, Jian, et al.
Pubblicazione: (2024)
di: Xie, Jian, et al.
Pubblicazione: (2024)
Your Language Model Secretly Contains Personality Subnetworks
di: Ye, Ruimeng, et al.
Pubblicazione: (2026)
di: Ye, Ruimeng, et al.
Pubblicazione: (2026)
Agent Learning via Early Experience
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
VeriTrip: A Verifiable Benchmark for Travel Planning Agents over Unstructured Web Corpora
di: Xu, Yuting, et al.
Pubblicazione: (2026)
di: Xu, Yuting, et al.
Pubblicazione: (2026)
TrojanStego: Your Language Model Can Secretly Be A Steganographic Privacy Leaking Agent
di: Meier, Dominik, et al.
Pubblicazione: (2025)
di: Meier, Dominik, et al.
Pubblicazione: (2025)
HiPlan: Hierarchical Planning for LLM-Based Agents with Adaptive Global-Local Guidance
di: Li, Ziyue, et al.
Pubblicazione: (2025)
di: Li, Ziyue, et al.
Pubblicazione: (2025)
LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model
di: Wang, Xiyao, et al.
Pubblicazione: (2025)
di: Wang, Xiyao, et al.
Pubblicazione: (2025)
PlanTwin: Privacy-Preserving Planning Abstractions for Cloud-Assisted LLM Agents
di: Yu, Guangsheng, et al.
Pubblicazione: (2026)
di: Yu, Guangsheng, et al.
Pubblicazione: (2026)
LargePiG: Your Large Language Model is Secretly a Pointer Generator
di: Sun, Zhongxiang, et al.
Pubblicazione: (2024)
di: Sun, Zhongxiang, et al.
Pubblicazione: (2024)
Latent Thinking Optimization: Your Latent Reasoning Language Model Secretly Encodes Reward Signals in Its Latent Thoughts
di: Du, Hanwen, et al.
Pubblicazione: (2025)
di: Du, Hanwen, et al.
Pubblicazione: (2025)
Your Weak LLM is Secretly a Strong Teacher for Alignment
di: Tao, Leitian, et al.
Pubblicazione: (2024)
di: Tao, Leitian, et al.
Pubblicazione: (2024)
Your Pre-trained LLM is Secretly an Unsupervised Confidence Calibrator
di: Luo, Beier, et al.
Pubblicazione: (2025)
di: Luo, Beier, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GPT-4V(ision) is a Generalist Web Agent, if Grounded
di: Zheng, Boyuan, et al.
Pubblicazione: (2024) -
Navigating the Digital World as Humans Do: Universal Visual Grounding for GUI Agents
di: Gou, Boyu, et al.
Pubblicazione: (2024) -
An Illusion of Progress? Assessing the Current State of Web Agents
di: Xue, Tianci, et al.
Pubblicazione: (2025) -
Mind2Web 2: Evaluating Agentic Search with Agent-as-a-Judge
di: Gou, Boyu, et al.
Pubblicazione: (2025) -
Explorer: Scaling Exploration-driven Web Trajectory Synthesis for Multimodal Web Agents
di: Pahuja, Vardaan, et al.
Pubblicazione: (2025)