FunReason-MT Technical Report: Advanced Data Synthesis Solution for Real-world Multi-Turn Tool-use
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Zengzhuang, Hao, Bingguang, Wang, Zechuan, Wen, Yuntao, Xu, Xinyi, Liu, Yang, Chen, Long, Wang, Dong, Wang, Maolin, Zhao, Tong, Chen, Yicheng, Peng, Cunyin, Gu, Jinjie, Gan, Leilei, Zhao, Xiangyu, Zhuang, Chenyi, Gu, Shi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement
por: Hao, Bingguang, et al.
Publicado: (2025)
por: Hao, Bingguang, et al.
Publicado: (2025)
Reasoning through Exploration: A Reinforcement Learning Framework for Robust Function Calling
por: Hao, Bingguang, et al.
Publicado: (2025)
por: Hao, Bingguang, et al.
Publicado: (2025)
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
por: Hao, Bingguang, et al.
Publicado: (2026)
por: Hao, Bingguang, et al.
Publicado: (2026)
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
por: Chen, Jikai, et al.
Publicado: (2026)
por: Chen, Jikai, et al.
Publicado: (2026)
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
por: Chen, Jikai, et al.
Publicado: (2025)
por: Chen, Jikai, et al.
Publicado: (2025)
SQLCritic: Correcting Text-to-SQL Generation via Clause-wise Critic
por: Chen, Jikai, et al.
Publicado: (2025)
por: Chen, Jikai, et al.
Publicado: (2025)
Don't Just Fine-tune the Agent, Tune the Environment
por: Lu, Siyuan, et al.
Publicado: (2025)
por: Lu, Siyuan, et al.
Publicado: (2025)
Large Multimodal Model Compression via Efficient Pruning and Distillation at AntGroup
por: Wang, Maolin, et al.
Publicado: (2023)
por: Wang, Maolin, et al.
Publicado: (2023)
DNS-Rec: Data-aware Neural Architecture Search for Recommender Systems
por: Zhang, Sheng, et al.
Publicado: (2024)
por: Zhang, Sheng, et al.
Publicado: (2024)
Recon-Act: A Self-Evolving Multi-Agent Browser-Use System via Web Reconnaissance, Tool Generation, and Task Execution
por: He, Kaiwen, et al.
Publicado: (2025)
por: He, Kaiwen, et al.
Publicado: (2025)
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation Accuracy
por: Zhao, Yao, et al.
Publicado: (2023)
por: Zhao, Yao, et al.
Publicado: (2023)
CSR:Achieving 1 Bit Key-Value Cache via Sparse Representation
por: Zhang, Hongxuan, et al.
Publicado: (2024)
por: Zhang, Hongxuan, et al.
Publicado: (2024)
CharPoet: A Chinese Classical Poetry Generation System Based on Token-free LLM
por: Yu, Chengyue, et al.
Publicado: (2024)
por: Yu, Chengyue, et al.
Publicado: (2024)
Tensorized Hypergraph Neural Networks
por: Wang, Maolin, et al.
Publicado: (2023)
por: Wang, Maolin, et al.
Publicado: (2023)
StressWeb: A Diagnostic Benchmark for Web Agent Robustness under Realistic Interaction Variability
por: Bai, Haoyue, et al.
Publicado: (2026)
por: Bai, Haoyue, et al.
Publicado: (2026)
LiveAgentBench: Comprehensive Benchmarking of Agentic Systems Across 104 Real-World Challenges
por: Li, Hao, et al.
Publicado: (2026)
por: Li, Hao, et al.
Publicado: (2026)
MetaLoRA: Tensor-Enhanced Adaptive Low-Rank Fine-tuning
por: Wang, Maolin, et al.
Publicado: (2025)
por: Wang, Maolin, et al.
Publicado: (2025)
Mitigate Position Bias with Coupled Ranking Bias on CTR Prediction
por: Zhao, Yao, et al.
Publicado: (2024)
por: Zhao, Yao, et al.
Publicado: (2024)
Fast Chain-of-Thought: A Glance of Future from Parallel Decoding Leads to Answers Faster
por: Zhang, Hongxuan, et al.
Publicado: (2023)
por: Zhang, Hongxuan, et al.
Publicado: (2023)
Fun-ASR Technical Report
por: An, Keyu, et al.
Publicado: (2025)
por: An, Keyu, et al.
Publicado: (2025)
Profile-Aware Maneuvering: A Dynamic Multi-Agent System for Robust GAIA Problem Solving by AWorld
por: Xie, Zhitian, et al.
Publicado: (2025)
por: Xie, Zhitian, et al.
Publicado: (2025)
Fun-Audio-Chat Technical Report
por: Tongyi Fun Team, et al.
Publicado: (2025)
por: Tongyi Fun Team, et al.
Publicado: (2025)
Explainable Behavior Cloning: Teaching Large Language Model Agents through Learning by Demonstration
por: Guan, Yanchu, et al.
Publicado: (2024)
por: Guan, Yanchu, et al.
Publicado: (2024)
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
por: Tan, Zhiwen, et al.
Publicado: (2025)
por: Tan, Zhiwen, et al.
Publicado: (2025)
Privacy-Preserving EHR Data Transformation via Geometric Operators: A Human-AI Co-Design Technical Report
por: Wang, Maolin, et al.
Publicado: (2026)
por: Wang, Maolin, et al.
Publicado: (2026)
HY-MT1.5 Technical Report
por: Zheng, Mao, et al.
Publicado: (2025)
por: Zheng, Mao, et al.
Publicado: (2025)
MoDE: A Mixture-of-Experts Model with Mutual Distillation among the Experts
por: Xie, Zhitian, et al.
Publicado: (2024)
por: Xie, Zhitian, et al.
Publicado: (2024)
Reply
por: Chen Dong, et al.
Publicado: (2024)
por: Chen Dong, et al.
Publicado: (2024)
Halogen Anion Management in Solution‐Processed Perovskite Films for Efficient Solar Cells
por: Leilei Gu, et al.
Publicado: (2024)
por: Leilei Gu, et al.
Publicado: (2024)
Empowering Denoising Sequential Recommendation with Large Language Model Embeddings
por: Wu, Tongzhou, et al.
Publicado: (2025)
por: Wu, Tongzhou, et al.
Publicado: (2025)
Large π‐Conjugated Structure Strategy for Optimizing Polyimide Film‐Forming Properties and Developing Gas Fluorescence Sensors
por: Xuecheng Wang, et al.
Publicado: (2024)
por: Xuecheng Wang, et al.
Publicado: (2024)
PARL-MT: Learning to Call Functions in Multi-Turn Conversation with Progress Awareness
por: Chai, Huacan, et al.
Publicado: (2025)
por: Chai, Huacan, et al.
Publicado: (2025)
Hunyuan-MT Technical Report
por: Zheng, Mao, et al.
Publicado: (2025)
por: Zheng, Mao, et al.
Publicado: (2025)
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
por: Chen, Boyuan, et al.
Publicado: (2025)
por: Chen, Boyuan, et al.
Publicado: (2025)
An Open and Comprehensive Pipeline for Unified Object Grounding and Detection
por: Zhao, Xiangyu, et al.
Publicado: (2024)
por: Zhao, Xiangyu, et al.
Publicado: (2024)
Design, Modeling and Direction Control of a Wire-Driven Robotic Fish Based on a 2-DoF Crank-Slider Mechanism
por: Wang, Yita, et al.
Publicado: (2026)
por: Wang, Yita, et al.
Publicado: (2026)
MedMT-Bench: Can LLMs Memorize and Understand Long Multi-Turn Conversations in Medical Scenarios?
por: Yang, Lin, et al.
Publicado: (2026)
por: Yang, Lin, et al.
Publicado: (2026)
A Visual Reinforcement Learning-Based Separate Primitive Policy for Peg-in-Hole Tasks
por: Xu, Zichun, et al.
Publicado: (2025)
por: Xu, Zichun, et al.
Publicado: (2025)
Efficient and accurate analysis of oscillation dynamics for dissipative cavity solitons based on the artificial neural network
por: Wang, Maolin, et al.
Publicado: (2025)
por: Wang, Maolin, et al.
Publicado: (2025)
MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching
por: Huang, Jiahui, et al.
Publicado: (2026)
por: Huang, Jiahui, et al.
Publicado: (2026)
Ejemplares similares
-
FunReason: Enhancing Large Language Models' Function Calling via Self-Refinement Multiscale Loss and Automated Data Refinement
por: Hao, Bingguang, et al.
Publicado: (2025) -
Reasoning through Exploration: A Reinforcement Learning Framework for Robust Function Calling
por: Hao, Bingguang, et al.
Publicado: (2025) -
From Failure to Mastery: Generating Hard Samples for Tool-use Agents
por: Hao, Bingguang, et al.
Publicado: (2026) -
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
por: Chen, Jikai, et al.
Publicado: (2026) -
V2P: Visual Attention Calibration for GUI Grounding via Background Suppression and Center Peaking
por: Chen, Jikai, et al.
Publicado: (2025)