FT-Dojo: Towards Autonomous LLM Fine-Tuning with Language Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Qizheng, Zhang, Yifei, Yang, Xiao, Yang, Xu, Wang, Zhuo, Liu, Weiqing, Bian, Jiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search
von: Zhang, Yifei, et al.
Veröffentlicht: (2026)
von: Zhang, Yifei, et al.
Veröffentlicht: (2026)
R&D-Agent: An LLM-Agent Framework Towards Autonomous Data Science
von: Yang, Xu, et al.
Veröffentlicht: (2025)
von: Yang, Xu, et al.
Veröffentlicht: (2025)
Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning
von: Liu, Siyuan, et al.
Veröffentlicht: (2026)
von: Liu, Siyuan, et al.
Veröffentlicht: (2026)
Agent^2 RL-Bench: Can LLM Agents Engineer Agentic RL Post-Training?
von: Chen, Wanyi, et al.
Veröffentlicht: (2026)
von: Chen, Wanyi, et al.
Veröffentlicht: (2026)
R&D-Agent-Quant: A Multi-Agent Framework for Data-Centric Factors and Model Joint Optimization
von: Li, Yuante, et al.
Veröffentlicht: (2025)
von: Li, Yuante, et al.
Veröffentlicht: (2025)
S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity
von: Yang, Xinyu, et al.
Veröffentlicht: (2024)
von: Yang, Xinyu, et al.
Veröffentlicht: (2024)
ADReFT: Adaptive Decision Repair for Safe Autonomous Driving via Reinforcement Fine-Tuning
von: Cheng, Mingfei, et al.
Veröffentlicht: (2025)
von: Cheng, Mingfei, et al.
Veröffentlicht: (2025)
BPQP: A Differentiable Convex Optimization Framework for Efficient End-to-End Learning
von: Pan, Jianming, et al.
Veröffentlicht: (2024)
von: Pan, Jianming, et al.
Veröffentlicht: (2024)
From Parameter Dynamics to Risk Scoring : Quantifying Sample-Level Safety Degradation in LLM Fine-tuning
von: Wang, Xiao, et al.
Veröffentlicht: (2026)
von: Wang, Xiao, et al.
Veröffentlicht: (2026)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
von: Gu, Zhuohan, et al.
Veröffentlicht: (2026)
von: Gu, Zhuohan, et al.
Veröffentlicht: (2026)
BeamDojo: Learning Agile Humanoid Locomotion on Sparse Footholds
von: Wang, Huayi, et al.
Veröffentlicht: (2025)
von: Wang, Huayi, et al.
Veröffentlicht: (2025)
FedTreeLoRA: Reconciling Statistical and Functional Heterogeneity in Federated LoRA Fine-Tuning
von: Bian, Jieming, et al.
Veröffentlicht: (2026)
von: Bian, Jieming, et al.
Veröffentlicht: (2026)
DipLLM: Fine-Tuning LLM for Strategic Decision-making in Diplomacy
von: Xu, Kaixuan, et al.
Veröffentlicht: (2025)
von: Xu, Kaixuan, et al.
Veröffentlicht: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
MG-TSD: Multi-Granularity Time Series Diffusion Models with Guided Learning Process
von: Fan, Xinyao, et al.
Veröffentlicht: (2024)
von: Fan, Xinyao, et al.
Veröffentlicht: (2024)
Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning
von: Cong, Peizhuang, et al.
Veröffentlicht: (2025)
von: Cong, Peizhuang, et al.
Veröffentlicht: (2025)
Safeguarding LLM Fine-tuning via Push-Pull Distributional Alignment
von: Wang, Haozhong, et al.
Veröffentlicht: (2026)
von: Wang, Haozhong, et al.
Veröffentlicht: (2026)
A Survey on Parameter-Efficient Fine-Tuning for Foundation Models in Federated Learning
von: Bian, Jieming, et al.
Veröffentlicht: (2025)
von: Bian, Jieming, et al.
Veröffentlicht: (2025)
Implicit Federated In-context Learning For Task-Specific LLM Fine-Tuning
von: Li, Dongcheng, et al.
Veröffentlicht: (2025)
von: Li, Dongcheng, et al.
Veröffentlicht: (2025)
Nested-ReFT: Efficient Reinforcement Learning for Large Language Model Fine-Tuning via Off-Policy Rollouts
von: Heuillet, Maxime, et al.
Veröffentlicht: (2025)
von: Heuillet, Maxime, et al.
Veröffentlicht: (2025)
RoRA: Efficient Fine-Tuning of LLM with Reliability Optimization for Rank Adaptation
von: Liu, Jun, et al.
Veröffentlicht: (2025)
von: Liu, Jun, et al.
Veröffentlicht: (2025)
Alignment Dynamics in LLM Fine-Tuning
von: Huang, Yuhan, et al.
Veröffentlicht: (2026)
von: Huang, Yuhan, et al.
Veröffentlicht: (2026)
APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents
von: Li, Yibo, et al.
Veröffentlicht: (2026)
von: Li, Yibo, et al.
Veröffentlicht: (2026)
Goal-Conditioned Supervised Learning for LLM Fine-Tuning
von: Li, Shijun, et al.
Veröffentlicht: (2026)
von: Li, Shijun, et al.
Veröffentlicht: (2026)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)
von: Zhou, Jiajun, et al.
Veröffentlicht: (2025)
Towards Fine-Tuning-Based Site Calibration for Knowledge-Guided Machine Learning: A Summary of Results
von: Zeng, Ruolei, et al.
Veröffentlicht: (2025)
von: Zeng, Ruolei, et al.
Veröffentlicht: (2025)
Towards Understanding the Fragility of Multilingual LLMs against Fine-Tuning Attacks
von: Poppi, Samuele, et al.
Veröffentlicht: (2024)
von: Poppi, Samuele, et al.
Veröffentlicht: (2024)
FL-TAC: Enhanced Fine-Tuning in Federated Learning via Low-Rank, Task-Specific Adapter Clustering
von: Ping, Siqi, et al.
Veröffentlicht: (2024)
von: Ping, Siqi, et al.
Veröffentlicht: (2024)
A Bayesian Hybrid Parameter-Efficient Fine-Tuning Method for Large Language Models
von: Chai, Yidong, et al.
Veröffentlicht: (2025)
von: Chai, Yidong, et al.
Veröffentlicht: (2025)
Understanding and Preserving Safety in Fine-Tuned LLMs
von: Zhang, Jiawen, et al.
Veröffentlicht: (2026)
von: Zhang, Jiawen, et al.
Veröffentlicht: (2026)
FineFT: Efficient and Risk-Aware Ensemble Reinforcement Learning for Futures Trading
von: Qin, Molei, et al.
Veröffentlicht: (2025)
von: Qin, Molei, et al.
Veröffentlicht: (2025)
Sparsity-Aware Low-Rank Representation for Efficient Fine-Tuning of Large Language Models
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
von: Zhang, Longteng, et al.
Veröffentlicht: (2026)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
von: Ma, Hao, et al.
Veröffentlicht: (2026)
von: Ma, Hao, et al.
Veröffentlicht: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
FedALT: Federated Fine-Tuning through Adaptive Local Training with Rest-of-World LoRA
von: Bian, Jieming, et al.
Veröffentlicht: (2025)
von: Bian, Jieming, et al.
Veröffentlicht: (2025)
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
von: Yang, Shiyi, et al.
Veröffentlicht: (2025)
von: Yang, Shiyi, et al.
Veröffentlicht: (2025)
Adaptive Ensembles of Fine-Tuned Transformers for LLM-Generated Text Detection
von: Lai, Zhixin, et al.
Veröffentlicht: (2024)
von: Lai, Zhixin, et al.
Veröffentlicht: (2024)
FAQ: Mitigating Quantization Error via Regenerating Calibration Data with Family-Aware Quantization
von: Xiao, Haiyang, et al.
Veröffentlicht: (2026)
von: Xiao, Haiyang, et al.
Veröffentlicht: (2026)
NextMem: Towards Latent Factual Memory for LLM-based Agents
von: Zhang, Zeyu, et al.
Veröffentlicht: (2026)
von: Zhang, Zeyu, et al.
Veröffentlicht: (2026)
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
von: Zhang, Zhen, et al.
Veröffentlicht: (2025)
von: Zhang, Zhen, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search
von: Zhang, Yifei, et al.
Veröffentlicht: (2026) -
R&D-Agent: An LLM-Agent Framework Towards Autonomous Data Science
von: Yang, Xu, et al.
Veröffentlicht: (2025) -
Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning
von: Liu, Siyuan, et al.
Veröffentlicht: (2026) -
Agent^2 RL-Bench: Can LLM Agents Engineer Agentic RL Post-Training?
von: Chen, Wanyi, et al.
Veröffentlicht: (2026) -
R&D-Agent-Quant: A Multi-Agent Framework for Data-Centric Factors and Model Joint Optimization
von: Li, Yuante, et al.
Veröffentlicht: (2025)