ParaVT: Taming the Tool Prior Paradox for Parallel Tool Use in Agentic Video Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Zuhao, Zhang, Kaichen, Wang, Sudong, Wu, Keming, Yang, Zhongyu, Li, Bo, Qi, Xiaojuan, Lu, Shijian, Li, Xingxuan, Bing, Lidong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LongVT: Incentivizing "Thinking with Long Videos" via Native Tool Calling
por: Yang, Zuhao, et al.
Publicado: (2025)
por: Yang, Zuhao, et al.
Publicado: (2025)
OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and General Recipe
por: Zhang, Kaichen, et al.
Publicado: (2025)
por: Zhang, Kaichen, et al.
Publicado: (2025)
ParaICL: Towards Parallel In-Context Learning
por: Li, Xingxuan, et al.
Publicado: (2024)
por: Li, Xingxuan, et al.
Publicado: (2024)
Multi-Agent Tool-Integrated Policy Optimization
por: Mo, Zhanfeng, et al.
Publicado: (2025)
por: Mo, Zhanfeng, et al.
Publicado: (2025)
Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling
por: Wu, Keming, et al.
Publicado: (2026)
por: Wu, Keming, et al.
Publicado: (2026)
ToolRM: Towards Agentic Tool-Use Reward Modeling
por: Li, Renhao, et al.
Publicado: (2025)
por: Li, Renhao, et al.
Publicado: (2025)
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
por: Jiang, Dongfu, et al.
Publicado: (2025)
por: Jiang, Dongfu, et al.
Publicado: (2025)
Controllable and Verifiable Tool-Use Data Synthesis for Agentic Reinforcement Learning
por: Xu, Siyuan, et al.
Publicado: (2026)
por: Xu, Siyuan, et al.
Publicado: (2026)
Tool-R1: Sample-Efficient Reinforcement Learning for Agentic Tool Use
por: Zhang, Yabo, et al.
Publicado: (2025)
por: Zhang, Yabo, et al.
Publicado: (2025)
Deep Video Discovery: Agentic Search with Tool Use for Long-form Video Understanding
por: Zhang, Xiaoyi, et al.
Publicado: (2025)
por: Zhang, Xiaoyi, et al.
Publicado: (2025)
TimeExpert: An Expert-Guided Video LLM for Video Temporal Grounding
por: Yang, Zuhao, et al.
Publicado: (2025)
por: Yang, Zuhao, et al.
Publicado: (2025)
Evaluating Psychological Safety of Large Language Models
por: Li, Xingxuan, et al.
Publicado: (2022)
por: Li, Xingxuan, et al.
Publicado: (2022)
Versatile Transition Generation with Image-to-Video Diffusion
por: Yang, Zuhao, et al.
Publicado: (2025)
por: Yang, Zuhao, et al.
Publicado: (2025)
AdaTooler-V: Adaptive Tool-Use for Images and Videos
por: Wang, Chaoyang, et al.
Publicado: (2025)
por: Wang, Chaoyang, et al.
Publicado: (2025)
MCPVerse: An Expansive, Real-World Benchmark for Agentic Tool Use
por: Lei, Fei, et al.
Publicado: (2025)
por: Lei, Fei, et al.
Publicado: (2025)
SVAgent: Storyline-Guided Long Video Understanding via Cross-Modal Multi-Agent Collaboration
por: Yang, Zhongyu, et al.
Publicado: (2026)
por: Yang, Zhongyu, et al.
Publicado: (2026)
Reducing Cognitive Overhead in Tool Use via Multi-Small-Agent Reinforcement Learning
por: Wang, Dayu, et al.
Publicado: (2025)
por: Wang, Dayu, et al.
Publicado: (2025)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
por: Li, Duo, et al.
Publicado: (2025)
por: Li, Duo, et al.
Publicado: (2025)
A Comprehensive Study on Visual Token Redundancy for Discrete Diffusion-based Multimodal Large Language Models
por: Li, Duo, et al.
Publicado: (2025)
por: Li, Duo, et al.
Publicado: (2025)
Can We Further Elicit Reasoning in LLMs? Critic-Guided Planning with Retrieval-Augmentation for Solving Challenging Tasks
por: Li, Xingxuan, et al.
Publicado: (2024)
por: Li, Xingxuan, et al.
Publicado: (2024)
ToolBrain: A Flexible Reinforcement Learning Framework for Agentic Tools
por: Le, Quy Minh, et al.
Publicado: (2025)
por: Le, Quy Minh, et al.
Publicado: (2025)
GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning
por: Wu, Jiaqi, et al.
Publicado: (2025)
por: Wu, Jiaqi, et al.
Publicado: (2025)
TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
por: He, Pengfei, et al.
Publicado: (2025)
por: He, Pengfei, et al.
Publicado: (2025)
Agentic Tool Use in Large Language Models
por: Hu, Jinchao, et al.
Publicado: (2026)
por: Hu, Jinchao, et al.
Publicado: (2026)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
por: Lu, Meng, et al.
Publicado: (2025)
por: Lu, Meng, et al.
Publicado: (2025)
ToolScope: An Agentic Framework for Vision-Guided and Long-Horizon Tool Use
por: Deng, Mengjie, et al.
Publicado: (2025)
por: Deng, Mengjie, et al.
Publicado: (2025)
iTool: Reinforced Fine-Tuning with Dynamic Deficiency Calibration for Advanced Tool Use
por: Zeng, Yirong, et al.
Publicado: (2025)
por: Zeng, Yirong, et al.
Publicado: (2025)
Code-in-the-Loop Forensics: Agentic Tool Use for Image Forgery Detection
por: Zhang, Fanrui, et al.
Publicado: (2025)
por: Zhang, Fanrui, et al.
Publicado: (2025)
VideoThinker: Building Agentic VideoLLMs with LLM-Guided Tool Reasoning
por: Li, Chenglin, et al.
Publicado: (2026)
por: Li, Chenglin, et al.
Publicado: (2026)
In-the-Flow Agentic System Optimization for Effective Planning and Tool Use
por: Li, Zhuofeng, et al.
Publicado: (2025)
por: Li, Zhuofeng, et al.
Publicado: (2025)
Tool-Augmented Policy Optimization: Synergizing Reasoning and Adaptive Tool Use with Reinforcement Learning
por: Wu, Wenxun, et al.
Publicado: (2025)
por: Wu, Wenxun, et al.
Publicado: (2025)
A Benchmark and Agentic Framework for Omni-Modal Reasoning and Tool Use in Long Videos
por: Kurpath, Mohammed Irfan, et al.
Publicado: (2025)
por: Kurpath, Mohammed Irfan, et al.
Publicado: (2025)
Unlocking Temporal Question Answering for Large Language Models with Tailor-Made Reasoning Logic
por: Li, Xingxuan, et al.
Publicado: (2023)
por: Li, Xingxuan, et al.
Publicado: (2023)
ReTool: Reinforcement Learning for Strategic Tool Use in LLMs
por: Feng, Jiazhan, et al.
Publicado: (2025)
por: Feng, Jiazhan, et al.
Publicado: (2025)
AgriAgent: Contract-Driven Planning and Capability-Aware Tool Orchestration in Real-World Agriculture
por: Yang, Bo, et al.
Publicado: (2026)
por: Yang, Bo, et al.
Publicado: (2026)
Which Tool Response Should I Trust? Tool-Expertise-Aware Chest X-ray Agent with Multimodal Agentic Learning
por: Huai, Zheang, et al.
Publicado: (2026)
por: Huai, Zheang, et al.
Publicado: (2026)
ParaTool: Shifting Tool Representations from Context to Parameters
por: Yu, Zekai, et al.
Publicado: (2026)
por: Yu, Zekai, et al.
Publicado: (2026)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
por: Zou, Jiaru, et al.
Publicado: (2025)
por: Zou, Jiaru, et al.
Publicado: (2025)
SoK: Agentic Skills -- Beyond Tool Use in LLM Agents
por: Jiang, Yanna, et al.
Publicado: (2026)
por: Jiang, Yanna, et al.
Publicado: (2026)
6GAgentGym: Tool Use, Data Synthesis, and Agentic Learning for Network Management
por: Chen, Jiao, et al.
Publicado: (2026)
por: Chen, Jiao, et al.
Publicado: (2026)
Ejemplares similares
-
LongVT: Incentivizing "Thinking with Long Videos" via Native Tool Calling
por: Yang, Zuhao, et al.
Publicado: (2025) -
OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and General Recipe
por: Zhang, Kaichen, et al.
Publicado: (2025) -
ParaICL: Towards Parallel In-Context Learning
por: Li, Xingxuan, et al.
Publicado: (2024) -
Multi-Agent Tool-Integrated Policy Optimization
por: Mo, Zhanfeng, et al.
Publicado: (2025) -
Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling
por: Wu, Keming, et al.
Publicado: (2026)