TimeArena: Shaping Efficient Multitasking Language Agents in a Time-Aware Simulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yikai, Yuan, Siyu, Hu, Caiyu, Richardson, Kyle, Xiao, Yanghua, Chen, Jiangjie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SelfGoal: Your Language Agents Already Know How to Achieve High-level Goals
di: Yang, Ruihan, et al.
Pubblicazione: (2024)
di: Yang, Ruihan, et al.
Pubblicazione: (2024)
Enhancing Language Agent Strategic Reasoning through Self-Play in Adversarial Games
di: Zhang, Yikai, et al.
Pubblicazione: (2025)
di: Zhang, Yikai, et al.
Pubblicazione: (2025)
ARIA: Training Language Agents with Intention-Driven Reward Aggregation
di: Yang, Ruihan, et al.
Pubblicazione: (2025)
di: Yang, Ruihan, et al.
Pubblicazione: (2025)
Revealing the Barriers of Language Agents in Planning
di: Xie, Jian, et al.
Pubblicazione: (2024)
di: Xie, Jian, et al.
Pubblicazione: (2024)
Put Your Money Where Your Mouth Is: Evaluating Strategic Planning and Execution of LLM Agents in an Auction Arena
di: Chen, Jiangjie, et al.
Pubblicazione: (2023)
di: Chen, Jiangjie, et al.
Pubblicazione: (2023)
MCiteBench: A Multimodal Benchmark for Generating Text with Citations
di: Hu, Caiyu, et al.
Pubblicazione: (2025)
di: Hu, Caiyu, et al.
Pubblicazione: (2025)
From AI Assistant to AI Scientist: Autonomous Discovery of LLM-RL Algorithms with LLM Agents
di: Xia, Sirui, et al.
Pubblicazione: (2026)
di: Xia, Sirui, et al.
Pubblicazione: (2026)
DEEPER Insight into Your User: Directed Persona Refinement for Dynamic Persona Modeling
di: Chen, Aili, et al.
Pubblicazione: (2025)
di: Chen, Aili, et al.
Pubblicazione: (2025)
From Persona to Personalization: A Survey on Role-Playing Language Agents
di: Chen, Jiangjie, et al.
Pubblicazione: (2024)
di: Chen, Jiangjie, et al.
Pubblicazione: (2024)
ANALOGYKB: Unlocking Analogical Reasoning of Language Models with A Million-scale Knowledge Base
di: Yuan, Siyu, et al.
Pubblicazione: (2023)
di: Yuan, Siyu, et al.
Pubblicazione: (2023)
Can LLMs Learn to Map the World from Local Descriptions?
di: Xia, Sirui, et al.
Pubblicazione: (2025)
di: Xia, Sirui, et al.
Pubblicazione: (2025)
Light Up the Shadows: Enhance Long-Tailed Entity Grounding with Concept-Guided Vision-Language Models
di: Zhang, Yikai, et al.
Pubblicazione: (2024)
di: Zhang, Yikai, et al.
Pubblicazione: (2024)
CODA: Difficulty-Aware Compute Allocation for Adaptive Reasoning
di: Wu, Siye, et al.
Pubblicazione: (2026)
di: Wu, Siye, et al.
Pubblicazione: (2026)
TravelAgent: An AI Assistant for Personalized Travel Planning
di: Chen, Aili, et al.
Pubblicazione: (2024)
di: Chen, Aili, et al.
Pubblicazione: (2024)
SurveyAgent: A Conversational System for Personalized and Efficient Research Survey
di: Wang, Xintao, et al.
Pubblicazione: (2024)
di: Wang, Xintao, et al.
Pubblicazione: (2024)
Past Meets Present: Creating Historical Analogy with Large Language Models
di: Li, Nianqi, et al.
Pubblicazione: (2024)
di: Li, Nianqi, et al.
Pubblicazione: (2024)
TravelPlanner: A Benchmark for Real-World Planning with Language Agents
di: Xie, Jian, et al.
Pubblicazione: (2024)
di: Xie, Jian, et al.
Pubblicazione: (2024)
GumbelSoft: Diversified Language Model Watermarking via the GumbelMax-trick
di: Fu, Jiayi, et al.
Pubblicazione: (2024)
di: Fu, Jiayi, et al.
Pubblicazione: (2024)
How Easily do Irrelevant Inputs Skew the Responses of Large Language Models?
di: Wu, Siye, et al.
Pubblicazione: (2024)
di: Wu, Siye, et al.
Pubblicazione: (2024)
Curse of Knowledge: When Complex Evaluation Context Benefits yet Biases LLM Judges
di: Li, Weiyuan, et al.
Pubblicazione: (2025)
di: Li, Weiyuan, et al.
Pubblicazione: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models
di: He, Qianyu, et al.
Pubblicazione: (2025)
di: He, Qianyu, et al.
Pubblicazione: (2025)
CoSER: A Comprehensive Literary Dataset and Framework for Training and Evaluating LLM Role-Playing and Persona Simulation
di: Wang, Xintao, et al.
Pubblicazione: (2025)
di: Wang, Xintao, et al.
Pubblicazione: (2025)
InCharacter: Evaluating Personality Fidelity in Role-Playing Agents through Psychological Interviews
di: Wang, Xintao, et al.
Pubblicazione: (2023)
di: Wang, Xintao, et al.
Pubblicazione: (2023)
PowerAttention: Exponentially Scaling of Receptive Fields for Effective Sparse Attention
di: Chen, Lida, et al.
Pubblicazione: (2025)
di: Chen, Lida, et al.
Pubblicazione: (2025)
Recent Advancement of Emotion Cognition in Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Piecing Together Clues: A Benchmark for Evaluating the Detective Skills of Large Language Models
di: Gu, Zhouhong, et al.
Pubblicazione: (2023)
di: Gu, Zhouhong, et al.
Pubblicazione: (2023)
EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction
di: Yuan, Siyu, et al.
Pubblicazione: (2024)
di: Yuan, Siyu, et al.
Pubblicazione: (2024)
ARM: Adaptive Reasoning Model
di: Wu, Siye, et al.
Pubblicazione: (2025)
di: Wu, Siye, et al.
Pubblicazione: (2025)
Evaluating Character Understanding of Large Language Models via Character Profiling from Fictional Works
di: Yuan, Xinfeng, et al.
Pubblicazione: (2024)
di: Yuan, Xinfeng, et al.
Pubblicazione: (2024)
Haste Makes Waste: Evaluating Planning Abilities of LLMs for Efficient and Feasible Multitasking with Time Constraints Between Actions
di: Wu, Zirui, et al.
Pubblicazione: (2025)
di: Wu, Zirui, et al.
Pubblicazione: (2025)
The Lighthouse of Language: Enhancing LLM Agents via Critique-Guided Improvement
di: Yang, Ruihan, et al.
Pubblicazione: (2025)
di: Yang, Ruihan, et al.
Pubblicazione: (2025)
ITFormer: Bridging Time Series and Natural Language for Multi-Modal QA with Large-Scale Multitask Dataset
di: Wang, Yilin, et al.
Pubblicazione: (2025)
di: Wang, Yilin, et al.
Pubblicazione: (2025)
RECKON: Large-scale Reference-based Efficient Knowledge Evaluation for Large Language Model
di: Zhang, Lin, et al.
Pubblicazione: (2025)
di: Zhang, Lin, et al.
Pubblicazione: (2025)
MultiLingPoT: Enhancing Mathematical Reasoning with Multilingual Program Fine-tuning
di: Li, Nianqi, et al.
Pubblicazione: (2024)
di: Li, Nianqi, et al.
Pubblicazione: (2024)
AgentGroupChat: An Interactive Group Chat Simulacra For Better Eliciting Emergent Behavior
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
SEGMENT+: Long Text Processing with Short-Context Language Models
di: Shi, Wei, et al.
Pubblicazione: (2024)
di: Shi, Wei, et al.
Pubblicazione: (2024)
Aligning Machiavellian Agents: Behavior Steering via Test-Time Policy Shaping
di: Mujtaba, Dena, et al.
Pubblicazione: (2025)
di: Mujtaba, Dena, et al.
Pubblicazione: (2025)
Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models
di: Feng, Wenfeng, et al.
Pubblicazione: (2024)
di: Feng, Wenfeng, et al.
Pubblicazione: (2024)
Restoring Ancient Ideograph: A Multimodal Multitask Neural Network Approach
di: Duan, Siyu, et al.
Pubblicazione: (2024)
di: Duan, Siyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SelfGoal: Your Language Agents Already Know How to Achieve High-level Goals
di: Yang, Ruihan, et al.
Pubblicazione: (2024) -
Enhancing Language Agent Strategic Reasoning through Self-Play in Adversarial Games
di: Zhang, Yikai, et al.
Pubblicazione: (2025) -
ARIA: Training Language Agents with Intention-Driven Reward Aggregation
di: Yang, Ruihan, et al.
Pubblicazione: (2025) -
Revealing the Barriers of Language Agents in Planning
di: Xie, Jian, et al.
Pubblicazione: (2024) -
Put Your Money Where Your Mouth Is: Evaluating Strategic Planning and Execution of LLM Agents in an Auction Arena
di: Chen, Jiangjie, et al.
Pubblicazione: (2023)