Enregistré dans:
| Auteurs principaux: | Gong, Dihong, Lu, Pu, Wang, Zelong, Zhou, Meng, He, Xiuqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2411.19547 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pre-trained Large Language Models for Financial Sentiment Analysis
par: Luo, Wei, et autres
Publié: (2024)
par: Luo, Wei, et autres
Publié: (2024)
Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
AutoFlow: Automated Workflow Generation for Large Language Model Agents
par: Li, Zelong, et autres
Publié: (2024)
par: Li, Zelong, et autres
Publié: (2024)
Formal-LLM: Integrating Formal Language and Natural Language for Controllable LLM-based Agents
par: Li, Zelong, et autres
Publié: (2024)
par: Li, Zelong, et autres
Publié: (2024)
Adapting LLM Agents with Universal Feedback in Communication
par: Wang, Kuan, et autres
Publié: (2023)
par: Wang, Kuan, et autres
Publié: (2023)
Legal Documents Drafting with Fine-Tuned Pre-Trained Large Language Model
par: Lin, Chun-Hsien, et autres
Publié: (2024)
par: Lin, Chun-Hsien, et autres
Publié: (2024)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
par: van Niekerk, Carel, et autres
Publié: (2025)
par: van Niekerk, Carel, et autres
Publié: (2025)
AgentStealth: Reinforcing Large Language Model for Anonymizing User-generated Text
par: Shao, Chenyang, et autres
Publié: (2025)
par: Shao, Chenyang, et autres
Publié: (2025)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
par: Zhang, Jun, et autres
Publié: (2025)
par: Zhang, Jun, et autres
Publié: (2025)
Spiral of Silence in Large Language Model Agents
par: Zhong, Mingze, et autres
Publié: (2025)
par: Zhong, Mingze, et autres
Publié: (2025)
Efficient Post-Training Refinement of Latent Reasoning in Large Language Models
par: Wang, Xinyuan, et autres
Publié: (2025)
par: Wang, Xinyuan, et autres
Publié: (2025)
AIOS Compiler: LLM as Interpreter for Natural Language Programming and Flow Programming of AI Agents
par: Xu, Shuyuan, et autres
Publié: (2024)
par: Xu, Shuyuan, et autres
Publié: (2024)
Align Anything: Training All-Modality Models to Follow Instructions with Language Feedback
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
Escaping Collapse: The Strength of Weak Data for Large Language Model Training
par: Amin, Kareem, et autres
Publié: (2025)
par: Amin, Kareem, et autres
Publié: (2025)
Aligning Large Language Models from Self-Reference AI Feedback with one General Principle
par: Bao, Rong, et autres
Publié: (2024)
par: Bao, Rong, et autres
Publié: (2024)
Training Language Models with Language Feedback at Scale
par: Scheurer, Jérémy, et autres
Publié: (2023)
par: Scheurer, Jérémy, et autres
Publié: (2023)
Evolving Subnetwork Training for Large Language Models
par: Li, Hanqi, et autres
Publié: (2024)
par: Li, Hanqi, et autres
Publié: (2024)
Training Language Models to Generate Quality Code with Program Analysis Feedback
par: Yao, Feng, et autres
Publié: (2025)
par: Yao, Feng, et autres
Publié: (2025)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
par: Dong, Guanting, et autres
Publié: (2024)
par: Dong, Guanting, et autres
Publié: (2024)
Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models
par: Jiang, Haitao, et autres
Publié: (2026)
par: Jiang, Haitao, et autres
Publié: (2026)
Refining Transcripts With TV Subtitles by Prompt-Based Weakly Supervised Training of ASR
par: Zhao, Xinnian, et autres
Publié: (2025)
par: Zhao, Xinnian, et autres
Publié: (2025)
Incentivizing Strong Reasoning from Weak Supervision
par: Yuan, Yige, et autres
Publié: (2025)
par: Yuan, Yige, et autres
Publié: (2025)
Aggressive Post-Training Compression on Extremely Large Language Models
par: Zhang, Zining, et autres
Publié: (2024)
par: Zhang, Zining, et autres
Publié: (2024)
Structured Agent Distillation for Large Language Model
par: Liu, Jun, et autres
Publié: (2025)
par: Liu, Jun, et autres
Publié: (2025)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
par: Dong, Guanting, et autres
Publié: (2023)
par: Dong, Guanting, et autres
Publié: (2023)
Reviewing Clinical Knowledge in Medical Large Language Models: Training and Beyond
par: Li, Qiyuan, et autres
Publié: (2025)
par: Li, Qiyuan, et autres
Publié: (2025)
CoSearchAgent: A Lightweight Collaborative Search Agent with Large Language Models
par: Gong, Peiyuan, et autres
Publié: (2024)
par: Gong, Peiyuan, et autres
Publié: (2024)
Political Actor Agent: Simulating Legislative System for Roll Call Votes Prediction with Large Language Models
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
Knowledge-Driven Agentic Scientific Corpus Distillation Framework for Biomedical Large Language Models Training
par: Xiao, Meng, et autres
Publié: (2025)
par: Xiao, Meng, et autres
Publié: (2025)
Controlled Low-Rank Adaptation with Subspace Regularization for Continued Training on Large Language Models
par: Lu, Yuheng, et autres
Publié: (2024)
par: Lu, Yuheng, et autres
Publié: (2024)
Debate, Reflect, and Distill: Multi-Agent Feedback with Tree-Structured Preference Optimization for Efficient Language Model Enhancement
par: Zhou, Xiaofeng, et autres
Publié: (2025)
par: Zhou, Xiaofeng, et autres
Publié: (2025)
AgentGym: Evolving Large Language Model-based Agents across Diverse Environments
par: Xi, Zhiheng, et autres
Publié: (2024)
par: Xi, Zhiheng, et autres
Publié: (2024)
Enhancing Tool Retrieval with Iterative Feedback from Large Language Models
par: Xu, Qiancheng, et autres
Publié: (2024)
par: Xu, Qiancheng, et autres
Publié: (2024)
RAGs to Riches: RAG-like Few-shot Learning for Large Language Model Role-playing
par: Rupprecht, Timothy, et autres
Publié: (2025)
par: Rupprecht, Timothy, et autres
Publié: (2025)
AdaRefiner: Refining Decisions of Language Models with Adaptive Feedback
par: Zhang, Wanpeng, et autres
Publié: (2023)
par: Zhang, Wanpeng, et autres
Publié: (2023)
Learning Dynamics in Continual Pre-Training for Large Language Models
par: Wang, Xingjin, et autres
Publié: (2025)
par: Wang, Xingjin, et autres
Publié: (2025)
Weakly Supervised Gaussian Contrastive Grounding with Large Multimodal Models for Video Question Answering
par: Wang, Haibo, et autres
Publié: (2024)
par: Wang, Haibo, et autres
Publié: (2024)
Assessing Robustness to Spurious Correlations in Post-Training Language Models
par: Shuieh, Julia, et autres
Publié: (2025)
par: Shuieh, Julia, et autres
Publié: (2025)
Online Intrinsic Rewards for Decision Making Agents from Large Language Model Feedback
par: Zheng, Qinqing, et autres
Publié: (2024)
par: Zheng, Qinqing, et autres
Publié: (2024)
Documents similaires
-
Pre-trained Large Language Models for Financial Sentiment Analysis
par: Luo, Wei, et autres
Publié: (2024) -
Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning
par: Gao, Kuofeng, et autres
Publié: (2024) -
AutoFlow: Automated Workflow Generation for Large Language Model Agents
par: Li, Zelong, et autres
Publié: (2024) -
Formal-LLM: Integrating Formal Language and Natural Language for Controllable LLM-based Agents
par: Li, Zelong, et autres
Publié: (2024) -
Adapting LLM Agents with Universal Feedback in Communication
par: Wang, Kuan, et autres
Publié: (2023)