Youtu-Agent: Scaling Agent Productivity with Automated Generation and Hybrid Policy Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Shi, Yuchen, Cai, Yuzheng, Cai, Siqi, Xu, Zihan, Chen, Lichao, Qin, Yulei, Zhou, Zhijian, Fei, Xiang, Qiu, Chaofan, Tan, Xiaoyu, Li, Gang, Li, Zongyi, Lin, Haojia, Cai, Guocan, Mao, Yong, Wu, Yunsheng, Li, Ke, Sun, Xing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Training-Free Group Relative Policy Optimization
by: Cai, Yuzheng, et al.
Published: (2025)
by: Cai, Yuzheng, et al.
Published: (2025)
SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents
by: Cai, Shaofei, et al.
Published: (2025)
by: Cai, Shaofei, et al.
Published: (2025)
CUARewardBench: A Benchmark for Evaluating Reward Models on Computer-using Agent
by: Lin, Haojia, et al.
Published: (2025)
by: Lin, Haojia, et al.
Published: (2025)
Learn the Ropes, Then Trust the Wins: Self-imitation with Progressive Exploration for Agentic Reinforcement Learning
by: Qin, Yulei, et al.
Published: (2025)
by: Qin, Yulei, et al.
Published: (2025)
FlowAgent: Achieving Compliance and Flexibility for Workflow Agents
by: Shi, Yuchen, et al.
Published: (2025)
by: Shi, Yuchen, et al.
Published: (2025)
Youtu-GraphRAG: Vertically Unified Agents for Graph Retrieval-Augmented Complex Reasoning
by: Dong, Junnan, et al.
Published: (2025)
by: Dong, Junnan, et al.
Published: (2025)
Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models
by: Qin, Yulei, et al.
Published: (2025)
by: Qin, Yulei, et al.
Published: (2025)
Youtu-Parsing: Perception, Structuring and Recognition via High-Parallelism Decoding
by: Yin, Kun, et al.
Published: (2026)
by: Yin, Kun, et al.
Published: (2026)
Youtu-VL: Unleashing Visual Potential via Unified Vision-Language Supervision
by: Wei, Zhixiang, et al.
Published: (2026)
by: Wei, Zhixiang, et al.
Published: (2026)
Youtu-LLM: Unlocking the Native Agentic Potential for Lightweight Large Language Models
by: Lu, Junru, et al.
Published: (2025)
by: Lu, Junru, et al.
Published: (2025)
RoRecomp: Enhancing Reasoning Efficiency via Rollout Response Recomposition in Reinforcement Learning
by: Li, Gang, et al.
Published: (2025)
by: Li, Gang, et al.
Published: (2025)
AgentEscapeBench: Evaluating Out-of-Domain Tool-Grounded Reasoning in LLM Agents
by: Guo, Zhengkang, et al.
Published: (2026)
by: Guo, Zhengkang, et al.
Published: (2026)
LUCY: Linguistic Understanding and Control Yielding Early Stage of Her
by: Gao, Heting, et al.
Published: (2025)
by: Gao, Heting, et al.
Published: (2025)
Unleashing the Power of Data Tsunami: A Comprehensive Survey on Data Assessment and Selection for Instruction Tuning of Language Models
by: Qin, Yulei, et al.
Published: (2024)
by: Qin, Yulei, et al.
Published: (2024)
MetaAgents: Large Language Model Based Agents for Decision-Making on Teaming
by: Li, Yuan, et al.
Published: (2023)
by: Li, Yuan, et al.
Published: (2023)
Knowledge Augmented Finetuning Matters in both RAG and Agent Based Dialog Systems
by: Cai, Yucheng, et al.
Published: (2025)
by: Cai, Yucheng, et al.
Published: (2025)
Entriever: Energy-based Retriever for Knowledge-Grounded Dialog Systems
by: Cai, Yucheng, et al.
Published: (2025)
by: Cai, Yucheng, et al.
Published: (2025)
Large Language Models Empowered Personalized Web Agents
by: Cai, Hongru, et al.
Published: (2024)
by: Cai, Hongru, et al.
Published: (2024)
Count Counts: Motivating Exploration in LLM Reasoning with Count-based Intrinsic Rewards
by: Zhang, Xuan, et al.
Published: (2025)
by: Zhang, Xuan, et al.
Published: (2025)
Filtered Approximate Nearest Neighbor Search: A Unified Benchmark and Systematic Experimental Study [Experiment, Analysis & Benchmark]
by: Shi, Jiayang, et al.
Published: (2025)
by: Shi, Jiayang, et al.
Published: (2025)
LTD-Bench: Evaluating Large Language Models by Letting Them Draw
by: Lin, Liuhao, et al.
Published: (2025)
by: Lin, Liuhao, et al.
Published: (2025)
Environmental Injection Attacks against GUI Agents in Realistic Dynamic Environments
by: Zhang, Yitong, et al.
Published: (2025)
by: Zhang, Yitong, et al.
Published: (2025)
Decoding Listeners Identity: Person Identification from EEG Signals Using a Lightweight Spiking Transformer
by: Lin, Zheyuan, et al.
Published: (2025)
by: Lin, Zheyuan, et al.
Published: (2025)
Enhancing Automated Paper Reproduction via Prompt-Free Collaborative Agents
by: Lin, Zijie, et al.
Published: (2025)
by: Lin, Zijie, et al.
Published: (2025)
Cutscene Agent: An LLM Agent Framework for Automated 3D Cutscene Generation
by: He, Lanshan, et al.
Published: (2026)
by: He, Lanshan, et al.
Published: (2026)
DEpiABS: Differentiable Epidemic Agent-Based Simulator
by: Gao, Zhijian, et al.
Published: (2026)
by: Gao, Zhijian, et al.
Published: (2026)
Pre‐sodiation Technology for Interface Engineering in Sodium‐ion Batteries: Progress, Challenges, and Future Directions
by: Zhenyu Li, et al.
Published: (2025)
by: Zhenyu Li, et al.
Published: (2025)
EPS-MoE: Expert Pipeline Scheduler for Cost-Efficient MoE Inference
by: Qian, Yulei, et al.
Published: (2024)
by: Qian, Yulei, et al.
Published: (2024)
Scaling Behavior of Single LLM-Driven Multi-Agent Systems
by: Li, Jialing, et al.
Published: (2026)
by: Li, Jialing, et al.
Published: (2026)
Toward a Community Roadmap for High Energy Physics and Artificial Intelligence in China and Beyond
by: Cai, Tianji, et al.
Published: (2026)
by: Cai, Tianji, et al.
Published: (2026)
Counterfactual LLM-based Framework for Measuring Rhetorical Style
by: Qiu, Jingyi, et al.
Published: (2025)
by: Qiu, Jingyi, et al.
Published: (2025)
WebFactory: Automated Compression of Foundational Language Intelligence into Grounded Web Agents
by: Fan, Sicheng, et al.
Published: (2026)
by: Fan, Sicheng, et al.
Published: (2026)
Discrete Infinite‐Agent Cucker–Smale Flocking Under Fixed and Switching Digraphs
by: Lining Ru, et al.
Published: (2026)
by: Lining Ru, et al.
Published: (2026)
Leveraging Open Knowledge for Advancing Task Expertise in Large Language Models
by: Yang, Yuncheng, et al.
Published: (2024)
by: Yang, Yuncheng, et al.
Published: (2024)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
by: Du, Haikuo, et al.
Published: (2025)
by: Du, Haikuo, et al.
Published: (2025)
LogiAgent: Automated Logical Testing for REST Systems with LLM-Based Multi-Agents
by: Zhang, Ke, et al.
Published: (2025)
by: Zhang, Ke, et al.
Published: (2025)
From Words to Wheels: Automated Style-Customized Policy Generation for Autonomous Driving
by: Han, Xu, et al.
Published: (2024)
by: Han, Xu, et al.
Published: (2024)
LifelongAgentBench: Evaluating LLM Agents as Lifelong Learners
by: Zheng, Junhao, et al.
Published: (2025)
by: Zheng, Junhao, et al.
Published: (2025)
Are First-Order Diffusion Samplers Really Slower? A Fast Forward-Value Approach
by: Jiao, Yuchen, et al.
Published: (2025)
by: Jiao, Yuchen, et al.
Published: (2025)
An Improved Multi-Agent Algorithm for Cooperative and Competitive Environments by Identifying and Encouraging Cooperation among Agents
by: Qi, Junjie, et al.
Published: (2025)
by: Qi, Junjie, et al.
Published: (2025)
Similar Items
-
Training-Free Group Relative Policy Optimization
by: Cai, Yuzheng, et al.
Published: (2025) -
SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents
by: Cai, Shaofei, et al.
Published: (2025) -
CUARewardBench: A Benchmark for Evaluating Reward Models on Computer-using Agent
by: Lin, Haojia, et al.
Published: (2025) -
Learn the Ropes, Then Trust the Wins: Self-imitation with Progressive Exploration for Agentic Reinforcement Learning
by: Qin, Yulei, et al.
Published: (2025) -
FlowAgent: Achieving Compliance and Flexibility for Workflow Agents
by: Shi, Yuchen, et al.
Published: (2025)