The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplace Scenarios
Fuente:
arXiv
Guardado en:
| Autores principales: | Fu, Daocheng, Mei, Jianbiao, Wu, Rong, Yang, Xuemeng, Xu, Jia, Wang, Ding, Cai, Pinlong, Liu, Yong, Wen, Licheng, Shi, Botian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
KG-TRACES: Enhancing Large Language Models with Knowledge Graph-constrained Trajectory Reasoning and Attribution Supervision
por: Wu, Rong, et al.
Publicado: (2025)
por: Wu, Rong, et al.
Publicado: (2025)
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
por: Wu, Rong, et al.
Publicado: (2025)
por: Wu, Rong, et al.
Publicado: (2025)
Learning on the Job: An Experience-Driven Self-Evolving Agent for Long-Horizon Tasks
por: Yang, Cheng, et al.
Publicado: (2025)
por: Yang, Cheng, et al.
Publicado: (2025)
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
por: Mei, Jianbiao, et al.
Publicado: (2025)
por: Mei, Jianbiao, et al.
Publicado: (2025)
UR-Bench: A Benchmark for Multi-Hop Reasoning over Ultra-High-Resolution Images
por: Li, Siqi, et al.
Publicado: (2025)
por: Li, Siqi, et al.
Publicado: (2025)
TrafficMCTS: A Closed-Loop Traffic Flow Generation Framework with Group-Based Monte Carlo Tree Search
por: Fu, Ze, et al.
Publicado: (2023)
por: Fu, Ze, et al.
Publicado: (2023)
RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
por: Fu, Daocheng, et al.
Publicado: (2025)
por: Fu, Daocheng, et al.
Publicado: (2025)
Continuously Learning, Adapting, and Improving: A Dual-Process Approach to Autonomous Driving
por: Mei, Jianbiao, et al.
Publicado: (2024)
por: Mei, Jianbiao, et al.
Publicado: (2024)
DriveArena: A Closed-loop Generative Simulation Platform for Autonomous Driving
por: Yang, Xuemeng, et al.
Publicado: (2024)
por: Yang, Xuemeng, et al.
Publicado: (2024)
Vision-Centric 4D Occupancy Forecasting and Planning via Implicit Residual World Models
por: Mei, Jianbiao, et al.
Publicado: (2025)
por: Mei, Jianbiao, et al.
Publicado: (2025)
LimSim Series: An Autonomous Driving Simulation Platform for Validation and Enhancement
por: Fu, Daocheng, et al.
Publicado: (2025)
por: Fu, Daocheng, et al.
Publicado: (2025)
LimSim++: A Closed-Loop Platform for Deploying Multimodal LLMs in Autonomous Driving
por: Fu, Daocheng, et al.
Publicado: (2024)
por: Fu, Daocheng, et al.
Publicado: (2024)
MemVerse: Multimodal Memory for Lifelong Learning Agents
por: Liu, Junming, et al.
Publicado: (2025)
por: Liu, Junming, et al.
Publicado: (2025)
LiCROcc: Teach Radar for Accurate Semantic Occupancy Prediction using LiDAR and Camera
por: Ma, Yukai, et al.
Publicado: (2024)
por: Ma, Yukai, et al.
Publicado: (2024)
LeapVAD: A Leap in Autonomous Driving via Cognitive Perception and Dual-Process Thinking
por: Ma, Yukai, et al.
Publicado: (2025)
por: Ma, Yukai, et al.
Publicado: (2025)
DiLu: A Knowledge-Driven Approach to Autonomous Driving with Large Language Models
por: Wen, Licheng, et al.
Publicado: (2023)
por: Wen, Licheng, et al.
Publicado: (2023)
DreamForge: Motion-Aware Autoregressive Video Generation for Multi-View Driving Scenes
por: Mei, Jianbiao, et al.
Publicado: (2024)
por: Mei, Jianbiao, et al.
Publicado: (2024)
SymDrive: Realistic and Controllable Driving Simulator via Symmetric Auto-regressive Online Restoration
por: Liu, Zhiyuan, et al.
Publicado: (2025)
por: Liu, Zhiyuan, et al.
Publicado: (2025)
SPIRAL: Self-Evolving Action-Conditioned Video Generation via Reflective Planning Agents
por: Yang, Yu, et al.
Publicado: (2026)
por: Yang, Yu, et al.
Publicado: (2026)
OASim: an Open and Adaptive Simulator based on Neural Rendering for Autonomous Driving
por: Yan, Guohang, et al.
Publicado: (2024)
por: Yan, Guohang, et al.
Publicado: (2024)
LeanRAG: Knowledge-Graph-Based Generation with Semantic Aggregation and Hierarchical Retrieval
por: Zhang, Yaoze, et al.
Publicado: (2025)
por: Zhang, Yaoze, et al.
Publicado: (2025)
KoMA: Knowledge-driven Multi-agent Framework for Autonomous Driving with Large Language Models
por: Jiang, Kemou, et al.
Publicado: (2024)
por: Jiang, Kemou, et al.
Publicado: (2024)
DeepWriter: A Fact-Grounded Multimodal Writing Assistant Based On Offline Knowledge Base
por: Mao, Song, et al.
Publicado: (2025)
por: Mao, Song, et al.
Publicado: (2025)
IWR-Bench: Can LVLMs reconstruct interactive webpage from a user interaction video?
por: Chen, Yang, et al.
Publicado: (2025)
por: Chen, Yang, et al.
Publicado: (2025)
GDI-Bench: A Benchmark for General Document Intelligence with Vision and Reasoning Decoupling
por: Li, Siqi, et al.
Publicado: (2025)
por: Li, Siqi, et al.
Publicado: (2025)
From Ranking to Selection: A Simple but Efficient Dynamic Passage Selector for Retrieval Augmented Generation
por: Meng, Siyuan, et al.
Publicado: (2025)
por: Meng, Siyuan, et al.
Publicado: (2025)
RAKG:Document-level Retrieval Augmented Knowledge Graph Construction
por: Zhang, Hairong, et al.
Publicado: (2025)
por: Zhang, Hairong, et al.
Publicado: (2025)
Text2Scenario: Text-Driven Scenario Generation for Autonomous Driving Test
por: Cai, Xuan, et al.
Publicado: (2025)
por: Cai, Xuan, et al.
Publicado: (2025)
HetaRAG: Hybrid Deep Retrieval-Augmented Generation across Heterogeneous Data Stores
por: Yan, Guohang, et al.
Publicado: (2025)
por: Yan, Guohang, et al.
Publicado: (2025)
AgentIF-OneDay: A Task-level Instruction-Following Benchmark for General AI Agents in Daily Scenarios
por: Chen, Kaiyuan, et al.
Publicado: (2026)
por: Chen, Kaiyuan, et al.
Publicado: (2026)
Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning
por: Liu, Junming, et al.
Publicado: (2025)
por: Liu, Junming, et al.
Publicado: (2025)
Preliminary Analysis of Prostate Cancer Screening Results and Exploration of Screening Model for Elderly Males in Rural Areas of Songjiang District, Shanghai
por: Daocheng Fang, et al.
Publicado: (2025)
por: Daocheng Fang, et al.
Publicado: (2025)
DocGenome: An Open Large-scale Scientific Document Benchmark for Training and Testing Multi-modal Large Language Models
por: Xia, Renqiu, et al.
Publicado: (2024)
por: Xia, Renqiu, et al.
Publicado: (2024)
Investigating Redundancy in Multimodal Large Language Models with Multiple Vision Encoders
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
Research Progress on Load Forecasting and Scheduling Optimization for New Power Systems
por: Yong Wang, et al.
Publicado: (2026)
por: Yong Wang, et al.
Publicado: (2026)
The Days On Days Off Scheduling Problem
por: Nießen, Fabien, et al.
Publicado: (2024)
por: Nießen, Fabien, et al.
Publicado: (2024)
Safety-Critical Traffic Simulation with Adversarial Transfer of Driving Intentions
por: Huang, Zherui, et al.
Publicado: (2025)
por: Huang, Zherui, et al.
Publicado: (2025)
Adapting Knowledge Prompt Tuning for Enhanced Automated Program Repair
por: Cai, Xuemeng, et al.
Publicado: (2025)
por: Cai, Xuemeng, et al.
Publicado: (2025)
MGA: Memory-Driven GUI Agent for Observation-Centric Interaction
por: Cheng, Weihua, et al.
Publicado: (2025)
por: Cheng, Weihua, et al.
Publicado: (2025)
A Coarse-to-Fine Place Recognition Approach using Attention-guided Descriptors and Overlap Estimation
por: Fu, Chencan, et al.
Publicado: (2023)
por: Fu, Chencan, et al.
Publicado: (2023)
Ejemplares similares
-
KG-TRACES: Enhancing Large Language Models with Knowledge Graph-constrained Trajectory Reasoning and Attribution Supervision
por: Wu, Rong, et al.
Publicado: (2025) -
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
por: Wu, Rong, et al.
Publicado: (2025) -
Learning on the Job: An Experience-Driven Self-Evolving Agent for Long-Horizon Tasks
por: Yang, Cheng, et al.
Publicado: (2025) -
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
por: Mei, Jianbiao, et al.
Publicado: (2025) -
UR-Bench: A Benchmark for Multi-Hop Reasoning over Ultra-High-Resolution Images
por: Li, Siqi, et al.
Publicado: (2025)