Efficient Multi-Agent System Training with Data Influence-Oriented Tree Search
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shi, Wentao, Yu, Zichun, Feng, Fuli, He, Xiangnan, Xiong, Chenyan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MATES: Model-Aware Data Selection for Efficient Pretraining with Data Influence Models
von: Yu, Zichun, et al.
Veröffentlicht: (2024)
von: Yu, Zichun, et al.
Veröffentlicht: (2024)
RePro: Training Language Models to Faithfully Recycle the Web for Pretraining
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
Generating Pretraining Tokens from Organic Data for Data-Bound Scaling
von: Yu, Zichun, et al.
Veröffentlicht: (2026)
von: Yu, Zichun, et al.
Veröffentlicht: (2026)
Montessori-Instruct: Generate Influential Training Data Tailored for Student Learning
von: Li, Xiaochuan, et al.
Veröffentlicht: (2024)
von: Li, Xiaochuan, et al.
Veröffentlicht: (2024)
FLAME-MoE: A Transparent End-to-End Research Platform for Mixture-of-Experts Language Models
von: Kang, Hao, et al.
Veröffentlicht: (2025)
von: Kang, Hao, et al.
Veröffentlicht: (2025)
Group-Level Data Selection for Efficient Pretraining
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
PithTrain: A Compact and Agent-Native MoE Training System
von: Lai, Ruihang, et al.
Veröffentlicht: (2026)
von: Lai, Ruihang, et al.
Veröffentlicht: (2026)
Craw4LLM: Efficient Web Crawling for LLM Pretraining
von: Yu, Shi, et al.
Veröffentlicht: (2025)
von: Yu, Shi, et al.
Veröffentlicht: (2025)
Direct Multi-Turn Preference Optimization for Language Agents
von: Shi, Wentao, et al.
Veröffentlicht: (2024)
von: Shi, Wentao, et al.
Veröffentlicht: (2024)
AppAgent-Pro: A Proactive GUI Agent System for Multidomain Information Integration and User Assistance
von: Zhao, Yuyang, et al.
Veröffentlicht: (2025)
von: Zhao, Yuyang, et al.
Veröffentlicht: (2025)
Less is More: Improving LLM Alignment via Preference Data Selection
von: Deng, Xun, et al.
Veröffentlicht: (2025)
von: Deng, Xun, et al.
Veröffentlicht: (2025)
Large Language Models are Learnable Planners for Long-Term Recommendation
von: Shi, Wentao, et al.
Veröffentlicht: (2024)
von: Shi, Wentao, et al.
Veröffentlicht: (2024)
ResearchArena: Benchmarking Large Language Models' Ability to Collect and Organize Information as Research Agents
von: Kang, Hao, et al.
Veröffentlicht: (2024)
von: Kang, Hao, et al.
Veröffentlicht: (2024)
A Survey of Generative Search and Recommendation in the Era of Large Language Models
von: Li, Yongqi, et al.
Veröffentlicht: (2024)
von: Li, Yongqi, et al.
Veröffentlicht: (2024)
VisualTrap: A Stealthy Backdoor Attack on GUI Agents via Visual Grounding Manipulation
von: Ye, Ziang, et al.
Veröffentlicht: (2025)
von: Ye, Ziang, et al.
Veröffentlicht: (2025)
Look Before You Leap: Autonomous Exploration for LLM Agents
von: Ye, Ziang, et al.
Veröffentlicht: (2026)
von: Ye, Ziang, et al.
Veröffentlicht: (2026)
Train Yourself as an LLM: Exploring Effects of AI Literacy on Persuasion via Role-playing LLM Training
von: Fan, Qihui, et al.
Veröffentlicht: (2026)
von: Fan, Qihui, et al.
Veröffentlicht: (2026)
RAGViz: Diagnose and Visualize Retrieval-Augmented Generation
von: Wang, Tevin, et al.
Veröffentlicht: (2024)
von: Wang, Tevin, et al.
Veröffentlicht: (2024)
On the Feasibility of In-Context Probing for Data Attribution
von: Jiao, Cathy, et al.
Veröffentlicht: (2024)
von: Jiao, Cathy, et al.
Veröffentlicht: (2024)
Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation
von: Wang, Chengbing, et al.
Veröffentlicht: (2025)
von: Wang, Chengbing, et al.
Veröffentlicht: (2025)
Fairshare Data Pricing via Data Valuation for Large Language Models
von: Zhang, Luyang, et al.
Veröffentlicht: (2025)
von: Zhang, Luyang, et al.
Veröffentlicht: (2025)
Teaching LLM to Reason: Reinforcement Learning from Algorithmic Problems without Code
von: Bao, Keqin, et al.
Veröffentlicht: (2025)
von: Bao, Keqin, et al.
Veröffentlicht: (2025)
TacoMAS: Test-Time Co-Evolution of Topology and Capability in LLM-based Multi-Agent Systems
von: Xu, Chen, et al.
Veröffentlicht: (2026)
von: Xu, Chen, et al.
Veröffentlicht: (2026)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
von: Li, Moxin, et al.
Veröffentlicht: (2025)
von: Li, Moxin, et al.
Veröffentlicht: (2025)
Prospect Personalized Recommendation on Large Language Model-based Agent Platform
von: Zhang, Jizhi, et al.
Veröffentlicht: (2024)
von: Zhang, Jizhi, et al.
Veröffentlicht: (2024)
Midtraining Bridges Pretraining and Posttraining Distributions
von: Liu, Emmy, et al.
Veröffentlicht: (2025)
von: Liu, Emmy, et al.
Veröffentlicht: (2025)
R^2-Mem: Reflective Experience for Memory Search
von: Wang, Xinyuan, et al.
Veröffentlicht: (2026)
von: Wang, Xinyuan, et al.
Veröffentlicht: (2026)
AutoRule: Reasoning Chain-of-thought Extracted Rule-based Rewards Improve Preference Learning
von: Wang, Tevin, et al.
Veröffentlicht: (2025)
von: Wang, Tevin, et al.
Veröffentlicht: (2025)
VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs
von: Lu, Keer, et al.
Veröffentlicht: (2024)
von: Lu, Keer, et al.
Veröffentlicht: (2024)
BEATS: Optimizing LLM Mathematical Capabilities with BackVerify and Adaptive Disambiguate based Efficient Tree Search
von: Sun, Linzhuang, et al.
Veröffentlicht: (2024)
von: Sun, Linzhuang, et al.
Veröffentlicht: (2024)
Say More with Less: Understanding Prompt Learning Behaviors through Gist Compression
von: Li, Xinze, et al.
Veröffentlicht: (2024)
von: Li, Xinze, et al.
Veröffentlicht: (2024)
Fact-Aware Multimodal Retrieval Augmentation for Accurate Medical Radiology Report Generation
von: Sun, Liwen, et al.
Veröffentlicht: (2024)
von: Sun, Liwen, et al.
Veröffentlicht: (2024)
DimMem: Dimensional Structuring for Efficient Long-Term Agent Memory
von: Qiu, Wentao, et al.
Veröffentlicht: (2026)
von: Qiu, Wentao, et al.
Veröffentlicht: (2026)
DARD: A Multi-Agent Approach for Task-Oriented Dialog Systems
von: Gupta, Aman, et al.
Veröffentlicht: (2024)
von: Gupta, Aman, et al.
Veröffentlicht: (2024)
Multi-Agent Sampling: Scaling Inference Compute for Data Synthesis with Tree Search-Based Agentic Collaboration
von: Ye, Hai, et al.
Veröffentlicht: (2024)
von: Ye, Hai, et al.
Veröffentlicht: (2024)
Grammar Search for Multi-Agent Systems
von: Singh, Mayank, et al.
Veröffentlicht: (2025)
von: Singh, Mayank, et al.
Veröffentlicht: (2025)
DeepDive: Advancing Deep Search Agents with Knowledge Graphs and Multi-Turn RL
von: Lu, Rui, et al.
Veröffentlicht: (2025)
von: Lu, Rui, et al.
Veröffentlicht: (2025)
CodeTree: Agent-guided Tree Search for Code Generation with Large Language Models
von: Li, Jierui, et al.
Veröffentlicht: (2024)
von: Li, Jierui, et al.
Veröffentlicht: (2024)
On Training Data Influence of GPT Models
von: Chai, Yekun, et al.
Veröffentlicht: (2024)
von: Chai, Yekun, et al.
Veröffentlicht: (2024)
AlpsBench: An LLM Personalization Benchmark for Real-Dialogue Memorization and Preference Alignment
von: Xiao, Jianfei, et al.
Veröffentlicht: (2026)
von: Xiao, Jianfei, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
MATES: Model-Aware Data Selection for Efficient Pretraining with Data Influence Models
von: Yu, Zichun, et al.
Veröffentlicht: (2024) -
RePro: Training Language Models to Faithfully Recycle the Web for Pretraining
von: Yu, Zichun, et al.
Veröffentlicht: (2025) -
Generating Pretraining Tokens from Organic Data for Data-Bound Scaling
von: Yu, Zichun, et al.
Veröffentlicht: (2026) -
Montessori-Instruct: Generate Influential Training Data Tailored for Student Learning
von: Li, Xiaochuan, et al.
Veröffentlicht: (2024) -
FLAME-MoE: A Transparent End-to-End Research Platform for Mixture-of-Experts Language Models
von: Kang, Hao, et al.
Veröffentlicht: (2025)