MagicAgent: Towards Generalized Agent Planning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ren, Xuhui, Dong, Shaokang, Yang, Chen, Gao, Qing, Zhao, Yunbin, Liu, Yongsheng, Geng, Xinwei, Li, Xiang, Yan, Demei, Li, Yanqing, Huang, Chenhao, Zhu, Dingwei, Ye, Junjie, Yue, Boxuan, Fu, Yingnan, Lv, Mengzhe, Feng, Zezeng, Zhou, Boshen, Wang, Bocheng, Huang, Xuanjing, Jiang, Yu-Gang, Gui, Tao, Zhang, Qi, Zhang, Yunke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MagicGUI: A Foundational Mobile GUI Agent with Scalable Data Pipeline and Reinforcement Fine-tuning
di: Tang, Liujian, et al.
Pubblicazione: (2025)
di: Tang, Liujian, et al.
Pubblicazione: (2025)
Towards Real-time Adaptation of Embodied Agent in Human-Robot Collaboration
di: Liu, Shipeng, et al.
Pubblicazione: (2024)
di: Liu, Shipeng, et al.
Pubblicazione: (2024)
TASO: Task-Aligned Sparse Optimization for Parameter-Efficient Model Adaptation
di: Miao, Daiye, et al.
Pubblicazione: (2025)
di: Miao, Daiye, et al.
Pubblicazione: (2025)
DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training
di: Zhu, Dingwei, et al.
Pubblicazione: (2026)
di: Zhu, Dingwei, et al.
Pubblicazione: (2026)
Entropy Polarity in Reinforcement Fine-Tuning: Direction, Asymmetry, and Control
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
TRACES: Proactive Safety Auditing for Multi-Turn LLM Agents via Trajectory-State Modeling
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
Rethinking Multi-Agent Intelligence Through the Lens of Small-World Networks
di: Wang, Boxuan, et al.
Pubblicazione: (2025)
di: Wang, Boxuan, et al.
Pubblicazione: (2025)
AgentV-RL: Scaling Reward Modeling with Agentic Verifier
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
Do Female Directors Protect Employee Pension Benefits? Evidence on the Nexus Between Pensions and Dividends
di: Zezeng Li, et al.
Pubblicazione: (2026)
di: Zezeng Li, et al.
Pubblicazione: (2026)
Dive into Ambiguity: A*-Inspired Multi-Agents Commonsense Obfuscation Attack on LLM Prompts
di: Wang, Boxuan, et al.
Pubblicazione: (2026)
di: Wang, Boxuan, et al.
Pubblicazione: (2026)
CCTU: A Benchmark for Tool Use under Complex Constraints
di: Ye, Junjie, et al.
Pubblicazione: (2026)
di: Ye, Junjie, et al.
Pubblicazione: (2026)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
DVPO: Distributional Value Modeling-based Policy Optimization for LLM Post-Training
di: Zhu, Dingwei, et al.
Pubblicazione: (2025)
di: Zhu, Dingwei, et al.
Pubblicazione: (2025)
Dive into the Agent Matrix: A Realistic Evaluation of Self-Replication Risk in LLM Agents
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Identity-Driven Hierarchical Role-Playing Agents
di: Sun, Libo, et al.
Pubblicazione: (2024)
di: Sun, Libo, et al.
Pubblicazione: (2024)
Unveiling the Truth and Facilitating Change: Towards Agent-based Large-scale Social Movement Simulation
di: Mou, Xinyi, et al.
Pubblicazione: (2024)
di: Mou, Xinyi, et al.
Pubblicazione: (2024)
Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity Recognition
di: Yang, Yuming, et al.
Pubblicazione: (2024)
di: Yang, Yuming, et al.
Pubblicazione: (2024)
VRPO: Rethinking Value Modeling for Robust RL Training under Noisy Supervision
di: Zhu, Dingwei, et al.
Pubblicazione: (2025)
di: Zhu, Dingwei, et al.
Pubblicazione: (2025)
AgentPRM: Process Reward Models for LLM Agents via Step-Wise Promise and Progress
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems
di: Zhang, Boxuan, et al.
Pubblicazione: (2026)
di: Zhang, Boxuan, et al.
Pubblicazione: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
Unveiling Linguistic Regions in Large Language Models
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
Fractal Graph Contrastive Learning
di: Li, Nero Z., et al.
Pubblicazione: (2025)
di: Li, Nero Z., et al.
Pubblicazione: (2025)
MagicWand: A Universal Agent for Generation and Evaluation Aligned with User Preference
di: Xu, Zitong, et al.
Pubblicazione: (2025)
di: Xu, Zitong, et al.
Pubblicazione: (2025)
Query-centric Audio-Visual Cognition Network for Moment Retrieval, Segmentation and Step-Captioning
di: Tu, Yunbin, et al.
Pubblicazione: (2024)
di: Tu, Yunbin, et al.
Pubblicazione: (2024)
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
RoTBench: A Multi-Level Benchmark for Evaluating the Robustness of Large Language Models in Tool Learning
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
di: Lv, Huijie, et al.
Pubblicazione: (2024)
di: Lv, Huijie, et al.
Pubblicazione: (2024)
SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents
di: Shen, Yujiong, et al.
Pubblicazione: (2026)
di: Shen, Yujiong, et al.
Pubblicazione: (2026)
Can RL Improve Generalization of LLM Agents? An Empirical Study
di: Xi, Zhiheng, et al.
Pubblicazione: (2026)
di: Xi, Zhiheng, et al.
Pubblicazione: (2026)
Synergistic Multi-Agent Framework with Trajectory Learning for Knowledge-Intensive Tasks
di: Yue, Shengbin, et al.
Pubblicazione: (2024)
di: Yue, Shengbin, et al.
Pubblicazione: (2024)
Could the Altmetric Score Be an Alternative Approach to Traditional Bibliometrics for Evaluating Influential Articles in Pediatric Robotic Surgery?
di: Boshen Shu
Pubblicazione: (2025)
di: Boshen Shu
Pubblicazione: (2025)
What Makes a Good Speech Tokenizer for LLM-Centric Speech Generation? A Systematic Study
di: Fan, Xiaoran, et al.
Pubblicazione: (2025)
di: Fan, Xiaoran, et al.
Pubblicazione: (2025)
Benchmark Self-Evolving: A Multi-Agent Framework for Dynamic LLM Evaluation
di: Wang, Siyuan, et al.
Pubblicazione: (2024)
di: Wang, Siyuan, et al.
Pubblicazione: (2024)
EcoLANG: Efficient and Effective Agent Communication Language Induction for Social Simulation
di: Mou, Xinyi, et al.
Pubblicazione: (2025)
di: Mou, Xinyi, et al.
Pubblicazione: (2025)
Discovery of New CDDO‐Imidazole Derivatives as Potential Antitumor Agents
di: Yanqing Li, et al.
Pubblicazione: (2026)
di: Yanqing Li, et al.
Pubblicazione: (2026)
SpeechRole: A Large-Scale Dataset and Benchmark for Evaluating Speech Role-Playing Agents
di: Jiang, Changhao, et al.
Pubblicazione: (2025)
di: Jiang, Changhao, et al.
Pubblicazione: (2025)
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
di: Ding, Keyan, et al.
Pubblicazione: (2025)
di: Ding, Keyan, et al.
Pubblicazione: (2025)
60 Data Points are Sufficient to Fine-Tune LLMs for Question-Answering
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MagicGUI: A Foundational Mobile GUI Agent with Scalable Data Pipeline and Reinforcement Fine-tuning
di: Tang, Liujian, et al.
Pubblicazione: (2025) -
Towards Real-time Adaptation of Embodied Agent in Human-Robot Collaboration
di: Liu, Shipeng, et al.
Pubblicazione: (2024) -
TASO: Task-Aligned Sparse Optimization for Parameter-Efficient Model Adaptation
di: Miao, Daiye, et al.
Pubblicazione: (2025) -
DFPO: Scaling Value Modeling via Distributional Flow towards Robust and Generalizable LLM Post-Training
di: Zhu, Dingwei, et al.
Pubblicazione: (2026) -
Entropy Polarity in Reinforcement Fine-Tuning: Direction, Asymmetry, and Control
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)