ATLaS: Agent Tuning via Learning Critical Steps
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Zhixun, Li, Ming, Huang, Yuxuan, Du, Yali, Fang, Meng, Zhou, Tianyi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
All Language Models Large and Small
von: Chen, Zhixun, et al.
Veröffentlicht: (2024)
von: Chen, Zhixun, et al.
Veröffentlicht: (2024)
Can LLMs Speak For Diverse People? Tuning LLMs via Debate to Generate Controllable Controversial Statements
von: Li, Ming, et al.
Veröffentlicht: (2024)
von: Li, Ming, et al.
Veröffentlicht: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
von: Li, Ming, et al.
Veröffentlicht: (2024)
von: Li, Ming, et al.
Veröffentlicht: (2024)
Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?
von: Fan, Chenrui, et al.
Veröffentlicht: (2025)
von: Fan, Chenrui, et al.
Veröffentlicht: (2025)
A Joint Learning Model with Variational Interaction for Multilingual Program Translation
von: Du, Yali, et al.
Veröffentlicht: (2024)
von: Du, Yali, et al.
Veröffentlicht: (2024)
Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents
von: Li, Xirui, et al.
Veröffentlicht: (2026)
von: Li, Xirui, et al.
Veröffentlicht: (2026)
Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement
von: Xiong, Weimin, et al.
Veröffentlicht: (2024)
von: Xiong, Weimin, et al.
Veröffentlicht: (2024)
What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective
von: Li, Ming, et al.
Veröffentlicht: (2024)
von: Li, Ming, et al.
Veröffentlicht: (2024)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
von: Liu, Wei, et al.
Veröffentlicht: (2025)
von: Liu, Wei, et al.
Veröffentlicht: (2025)
Contrastive Instruction Tuning
von: Yan, Tianyi Lorena, et al.
Veröffentlicht: (2024)
von: Yan, Tianyi Lorena, et al.
Veröffentlicht: (2024)
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
von: Meng, Haoming, et al.
Veröffentlicht: (2026)
von: Meng, Haoming, et al.
Veröffentlicht: (2026)
Memento-Skills: Let Agents Design Agents
von: Zhou, Huichi, et al.
Veröffentlicht: (2026)
von: Zhou, Huichi, et al.
Veröffentlicht: (2026)
How Instruction and Reasoning Data shape Post-Training: Data Quality through the Lens of Layer-wise Gradients
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
STeCa: Step-level Trajectory Calibration for LLM Agent Learning
von: Wang, Hanlin, et al.
Veröffentlicht: (2025)
von: Wang, Hanlin, et al.
Veröffentlicht: (2025)
Each Graph is a New Language: Graph Learning with LLMs
von: Zhou, Huachi, et al.
Veröffentlicht: (2025)
von: Zhou, Huachi, et al.
Veröffentlicht: (2025)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
von: Li, Junsong, et al.
Veröffentlicht: (2025)
von: Li, Junsong, et al.
Veröffentlicht: (2025)
RuleR: Improving LLM Controllability by Rule-based Data Recycling
von: Li, Ming, et al.
Veröffentlicht: (2024)
von: Li, Ming, et al.
Veröffentlicht: (2024)
One Model for All: Multi-Objective Controllable Language Models
von: He, Qiang, et al.
Veröffentlicht: (2026)
von: He, Qiang, et al.
Veröffentlicht: (2026)
Enhancing In-context Learning via Linear Probe Calibration
von: Abbas, Momin, et al.
Veröffentlicht: (2024)
von: Abbas, Momin, et al.
Veröffentlicht: (2024)
Fine-Tuning Language Models with Reward Learning on Policy
von: Lang, Hao, et al.
Veröffentlicht: (2024)
von: Lang, Hao, et al.
Veröffentlicht: (2024)
PAT: Pruning-Aware Tuning for Large Language Models
von: Liu, Yijiang, et al.
Veröffentlicht: (2024)
von: Liu, Yijiang, et al.
Veröffentlicht: (2024)
Schoenfeld's Anatomy of Mathematical Reasoning by Language Models
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
von: Guo, Siyuan, et al.
Veröffentlicht: (2026)
von: Guo, Siyuan, et al.
Veröffentlicht: (2026)
TrajAgent: An LLM-Agent Framework for Trajectory Modeling via Large-and-Small Model Collaboration
von: Du, Yuwei, et al.
Veröffentlicht: (2024)
von: Du, Yuwei, et al.
Veröffentlicht: (2024)
Agent Learning via Early Experience
von: Zhang, Kai, et al.
Veröffentlicht: (2025)
von: Zhang, Kai, et al.
Veröffentlicht: (2025)
Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective
von: Fernando, Heshan, et al.
Veröffentlicht: (2024)
von: Fernando, Heshan, et al.
Veröffentlicht: (2024)
RuAG: Learned-rule-augmented Generation for Large Language Models
von: Zhang, Yudi, et al.
Veröffentlicht: (2024)
von: Zhang, Yudi, et al.
Veröffentlicht: (2024)
EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models
von: Pan, Xuchen, et al.
Veröffentlicht: (2024)
von: Pan, Xuchen, et al.
Veröffentlicht: (2024)
TRIM: Hybrid Inference via Targeted Stepwise Routing in Multi-Step Reasoning Tasks
von: Kapoor, Vansh, et al.
Veröffentlicht: (2026)
von: Kapoor, Vansh, et al.
Veröffentlicht: (2026)
Transformers Learn Low Sensitivity Functions: Investigations and Implications
von: Vasudeva, Bhavya, et al.
Veröffentlicht: (2024)
von: Vasudeva, Bhavya, et al.
Veröffentlicht: (2024)
Enhancing the General Agent Capabilities of Low-Parameter LLMs through Tuning and Multi-Branch Reasoning
von: Zhou, Qinhao, et al.
Veröffentlicht: (2024)
von: Zhou, Qinhao, et al.
Veröffentlicht: (2024)
Verbal Process Supervision Elicits Better Coding Agents
von: Chen, Hao-Yuan, et al.
Veröffentlicht: (2025)
von: Chen, Hao-Yuan, et al.
Veröffentlicht: (2025)
Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together
von: Soylu, Dilara, et al.
Veröffentlicht: (2024)
von: Soylu, Dilara, et al.
Veröffentlicht: (2024)
ComPO: Preference Alignment via Comparison Oracles
von: Chen, Peter, et al.
Veröffentlicht: (2025)
von: Chen, Peter, et al.
Veröffentlicht: (2025)
Learning to Generalize Unseen Domains via Multi-Source Meta Learning for Text Classification
von: Hu, Yuxuan, et al.
Veröffentlicht: (2024)
von: Hu, Yuxuan, et al.
Veröffentlicht: (2024)
Adaptive Social Learning via Mode Policy Optimization for Language Agents
von: Wang, Minzheng, et al.
Veröffentlicht: (2025)
von: Wang, Minzheng, et al.
Veröffentlicht: (2025)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
von: Xi, Zhiheng, et al.
Veröffentlicht: (2025)
von: Xi, Zhiheng, et al.
Veröffentlicht: (2025)
Spiral of Silence in Large Language Model Agents
von: Zhong, Mingze, et al.
Veröffentlicht: (2025)
von: Zhong, Mingze, et al.
Veröffentlicht: (2025)
Towards Understanding Fine-Tuning Mechanisms of LLMs via Circuit Analysis
von: Wang, Xu, et al.
Veröffentlicht: (2025)
von: Wang, Xu, et al.
Veröffentlicht: (2025)
MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining
von: Chen, Zhixun, et al.
Veröffentlicht: (2025)
von: Chen, Zhixun, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
All Language Models Large and Small
von: Chen, Zhixun, et al.
Veröffentlicht: (2024) -
Can LLMs Speak For Diverse People? Tuning LLMs via Debate to Generate Controllable Controversial Statements
von: Li, Ming, et al.
Veröffentlicht: (2024) -
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
von: Li, Ming, et al.
Veröffentlicht: (2024) -
Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?
von: Fan, Chenrui, et al.
Veröffentlicht: (2025) -
A Joint Learning Model with Variational Interaction for Multilingual Program Translation
von: Du, Yali, et al.
Veröffentlicht: (2024)