FunReason-MT Technical Report: Advanced Data Synthesis Solution for Real-world Multi-Turn Tool-use
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Zengzhuang, Hao, Bingguang, Wang, Zechuan, Wen, Yuntao, Xu, Xinyi, Liu, Yang, Chen, Long, Wang, Dong, Wang, Maolin, Zhao, Tong, Chen, Yicheng, Peng, Cunyin, Gu, Jinjie, Gan, Leilei, Zhao, Xiangyu, Zhuang, Chenyi, Gu, Shi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement
di: Hao, Bingguang, et al.
Pubblicazione: (2025)
di: Hao, Bingguang, et al.
Pubblicazione: (2025)
Reasoning through Exploration: A Reinforcement Learning Framework for Robust Function Calling
di: Hao, Bingguang, et al.
Pubblicazione: (2025)
di: Hao, Bingguang, et al.
Pubblicazione: (2025)
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
di: Hao, Bingguang, et al.
Pubblicazione: (2026)
di: Hao, Bingguang, et al.
Pubblicazione: (2026)
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
di: Chen, Jikai, et al.
Pubblicazione: (2026)
di: Chen, Jikai, et al.
Pubblicazione: (2026)
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
di: Chen, Jikai, et al.
Pubblicazione: (2025)
di: Chen, Jikai, et al.
Pubblicazione: (2025)
SQLCritic: Correcting Text-to-SQL Generation via Clause-wise Critic
di: Chen, Jikai, et al.
Pubblicazione: (2025)
di: Chen, Jikai, et al.
Pubblicazione: (2025)
Don't Just Fine-tune the Agent, Tune the Environment
di: Lu, Siyuan, et al.
Pubblicazione: (2025)
di: Lu, Siyuan, et al.
Pubblicazione: (2025)
Large Multimodal Model Compression via Efficient Pruning and Distillation at AntGroup
di: Wang, Maolin, et al.
Pubblicazione: (2023)
di: Wang, Maolin, et al.
Pubblicazione: (2023)
DNS-Rec: Data-aware Neural Architecture Search for Recommender Systems
di: Zhang, Sheng, et al.
Pubblicazione: (2024)
di: Zhang, Sheng, et al.
Pubblicazione: (2024)
Recon-Act: A Self-Evolving Multi-Agent Browser-Use System via Web Reconnaissance, Tool Generation, and Task Execution
di: He, Kaiwen, et al.
Pubblicazione: (2025)
di: He, Kaiwen, et al.
Pubblicazione: (2025)
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation Accuracy
di: Zhao, Yao, et al.
Pubblicazione: (2023)
di: Zhao, Yao, et al.
Pubblicazione: (2023)
CSR:Achieving 1 Bit Key-Value Cache via Sparse Representation
di: Zhang, Hongxuan, et al.
Pubblicazione: (2024)
di: Zhang, Hongxuan, et al.
Pubblicazione: (2024)
CharPoet: A Chinese Classical Poetry Generation System Based on Token-free LLM
di: Yu, Chengyue, et al.
Pubblicazione: (2024)
di: Yu, Chengyue, et al.
Pubblicazione: (2024)
Tensorized Hypergraph Neural Networks
di: Wang, Maolin, et al.
Pubblicazione: (2023)
di: Wang, Maolin, et al.
Pubblicazione: (2023)
StressWeb: A Diagnostic Benchmark for Web Agent Robustness under Realistic Interaction Variability
di: Bai, Haoyue, et al.
Pubblicazione: (2026)
di: Bai, Haoyue, et al.
Pubblicazione: (2026)
LiveAgentBench: Comprehensive Benchmarking of Agentic Systems Across 104 Real-World Challenges
di: Li, Hao, et al.
Pubblicazione: (2026)
di: Li, Hao, et al.
Pubblicazione: (2026)
MetaLoRA: Tensor-Enhanced Adaptive Low-Rank Fine-tuning
di: Wang, Maolin, et al.
Pubblicazione: (2025)
di: Wang, Maolin, et al.
Pubblicazione: (2025)
Mitigate Position Bias with Coupled Ranking Bias on CTR Prediction
di: Zhao, Yao, et al.
Pubblicazione: (2024)
di: Zhao, Yao, et al.
Pubblicazione: (2024)
Fast Chain-of-Thought: A Glance of Future from Parallel Decoding Leads to Answers Faster
di: Zhang, Hongxuan, et al.
Pubblicazione: (2023)
di: Zhang, Hongxuan, et al.
Pubblicazione: (2023)
Fun-ASR Technical Report
di: An, Keyu, et al.
Pubblicazione: (2025)
di: An, Keyu, et al.
Pubblicazione: (2025)
Profile-Aware Maneuvering: A Dynamic Multi-Agent System for Robust GAIA Problem Solving by AWorld
di: Xie, Zhitian, et al.
Pubblicazione: (2025)
di: Xie, Zhitian, et al.
Pubblicazione: (2025)
Fun-Audio-Chat Technical Report
di: Tongyi Fun Team, et al.
Pubblicazione: (2025)
di: Tongyi Fun Team, et al.
Pubblicazione: (2025)
Explainable Behavior Cloning: Teaching Large Language Model Agents through Learning by Demonstration
di: Guan, Yanchu, et al.
Pubblicazione: (2024)
di: Guan, Yanchu, et al.
Pubblicazione: (2024)
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
di: Tan, Zhiwen, et al.
Pubblicazione: (2025)
di: Tan, Zhiwen, et al.
Pubblicazione: (2025)
Privacy-Preserving EHR Data Transformation via Geometric Operators: A Human-AI Co-Design Technical Report
di: Wang, Maolin, et al.
Pubblicazione: (2026)
di: Wang, Maolin, et al.
Pubblicazione: (2026)
HY-MT1.5 Technical Report
di: Zheng, Mao, et al.
Pubblicazione: (2025)
di: Zheng, Mao, et al.
Pubblicazione: (2025)
MoDE: A Mixture-of-Experts Model with Mutual Distillation among the Experts
di: Xie, Zhitian, et al.
Pubblicazione: (2024)
di: Xie, Zhitian, et al.
Pubblicazione: (2024)
Reply
di: Chen Dong, et al.
Pubblicazione: (2024)
di: Chen Dong, et al.
Pubblicazione: (2024)
Halogen Anion Management in Solution‐Processed Perovskite Films for Efficient Solar Cells
di: Leilei Gu, et al.
Pubblicazione: (2024)
di: Leilei Gu, et al.
Pubblicazione: (2024)
Empowering Denoising Sequential Recommendation with Large Language Model Embeddings
di: Wu, Tongzhou, et al.
Pubblicazione: (2025)
di: Wu, Tongzhou, et al.
Pubblicazione: (2025)
Large π‐Conjugated Structure Strategy for Optimizing Polyimide Film‐Forming Properties and Developing Gas Fluorescence Sensors
di: Xuecheng Wang, et al.
Pubblicazione: (2024)
di: Xuecheng Wang, et al.
Pubblicazione: (2024)
PARL-MT: Learning to Call Functions in Multi-Turn Conversation with Progress Awareness
di: Chai, Huacan, et al.
Pubblicazione: (2025)
di: Chai, Huacan, et al.
Pubblicazione: (2025)
Hunyuan-MT Technical Report
di: Zheng, Mao, et al.
Pubblicazione: (2025)
di: Zheng, Mao, et al.
Pubblicazione: (2025)
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
di: Chen, Boyuan, et al.
Pubblicazione: (2025)
di: Chen, Boyuan, et al.
Pubblicazione: (2025)
An Open and Comprehensive Pipeline for Unified Object Grounding and Detection
di: Zhao, Xiangyu, et al.
Pubblicazione: (2024)
di: Zhao, Xiangyu, et al.
Pubblicazione: (2024)
Design, Modeling and Direction Control of a Wire-Driven Robotic Fish Based on a 2-DoF Crank-Slider Mechanism
di: Wang, Yita, et al.
Pubblicazione: (2026)
di: Wang, Yita, et al.
Pubblicazione: (2026)
MedMT-Bench: Can LLMs Memorize and Understand Long Multi-Turn Conversations in Medical Scenarios?
di: Yang, Lin, et al.
Pubblicazione: (2026)
di: Yang, Lin, et al.
Pubblicazione: (2026)
A Visual Reinforcement Learning-Based Separate Primitive Policy for Peg-in-Hole Tasks
di: Xu, Zichun, et al.
Pubblicazione: (2025)
di: Xu, Zichun, et al.
Pubblicazione: (2025)
Efficient and accurate analysis of oscillation dynamics for dissipative cavity solitons based on the artificial neural network
di: Wang, Maolin, et al.
Pubblicazione: (2025)
di: Wang, Maolin, et al.
Pubblicazione: (2025)
MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching
di: Huang, Jiahui, et al.
Pubblicazione: (2026)
di: Huang, Jiahui, et al.
Pubblicazione: (2026)
Documenti analoghi
-
FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement
di: Hao, Bingguang, et al.
Pubblicazione: (2025) -
Reasoning through Exploration: A Reinforcement Learning Framework for Robust Function Calling
di: Hao, Bingguang, et al.
Pubblicazione: (2025) -
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
di: Hao, Bingguang, et al.
Pubblicazione: (2026) -
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
di: Chen, Jikai, et al.
Pubblicazione: (2026) -
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
di: Chen, Jikai, et al.
Pubblicazione: (2025)