Post-Completion Learning for Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Fei, Xiang, Wang, Siqi, Wei, Shu, Nie, Yuxiang, Shi, Wei, Feng, Hao, Feng, Chao, Huang, Can |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Advancing Sequential Numerical Prediction in Autoregressive Models
von: Fei, Xiang, et al.
Veröffentlicht: (2025)
von: Fei, Xiang, et al.
Veröffentlicht: (2025)
KICGPT: Large Language Model with Knowledge in Context for Knowledge Graph Completion
von: Wei, Yanbin, et al.
Veröffentlicht: (2024)
von: Wei, Yanbin, et al.
Veröffentlicht: (2024)
FactAlign: Long-form Factuality Alignment of Large Language Models
von: Huang, Chao-Wei, et al.
Veröffentlicht: (2024)
von: Huang, Chao-Wei, et al.
Veröffentlicht: (2024)
Flexora: Flexible Low Rank Adaptation for Large Language Models
von: Wei, Chenxing, et al.
Veröffentlicht: (2024)
von: Wei, Chenxing, et al.
Veröffentlicht: (2024)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
von: Wang, Siwei, et al.
Veröffentlicht: (2024)
von: Wang, Siwei, et al.
Veröffentlicht: (2024)
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
von: Wang, Siwei, et al.
Veröffentlicht: (2025)
von: Wang, Siwei, et al.
Veröffentlicht: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
von: Tang, Jiabin, et al.
Veröffentlicht: (2023)
von: Tang, Jiabin, et al.
Veröffentlicht: (2023)
Fine-Tuning Language Models with Reward Learning on Policy
von: Lang, Hao, et al.
Veröffentlicht: (2024)
von: Lang, Hao, et al.
Veröffentlicht: (2024)
Finetuning Generative Large Language Models with Discrimination Instructions for Knowledge Graph Completion
von: Liu, Yang, et al.
Veröffentlicht: (2024)
von: Liu, Yang, et al.
Veröffentlicht: (2024)
The Era of Agentic Organization: Learning to Organize with Language Models
von: Chi, Zewen, et al.
Veröffentlicht: (2025)
von: Chi, Zewen, et al.
Veröffentlicht: (2025)
SSL-SSAW: Self-Supervised Learning with Sigmoid Self-Attention Weighting for Question-Based Sign Language Translation
von: Liu, Zekang, et al.
Veröffentlicht: (2025)
von: Liu, Zekang, et al.
Veröffentlicht: (2025)
Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models
von: Feng, Wenfeng, et al.
Veröffentlicht: (2024)
von: Feng, Wenfeng, et al.
Veröffentlicht: (2024)
Peer-Predictive Self-Training for Language Model Reasoning
von: Feng, Shi, et al.
Veröffentlicht: (2026)
von: Feng, Shi, et al.
Veröffentlicht: (2026)
Optimising Language Models for Downstream Tasks: A Post-Training Perspective
von: Shi, Zhengyan
Veröffentlicht: (2025)
von: Shi, Zhengyan
Veröffentlicht: (2025)
SAFER: Probing Safety in Reward Models with Sparse Autoencoder
von: Shi, Wei, et al.
Veröffentlicht: (2025)
von: Shi, Wei, et al.
Veröffentlicht: (2025)
On Leveraging Large Language Models for Enhancing Entity Resolution: A Cost-efficient Approach
von: Li, Huahang, et al.
Veröffentlicht: (2024)
von: Li, Huahang, et al.
Veröffentlicht: (2024)
CLLMs: Consistency Large Language Models
von: Kou, Siqi, et al.
Veröffentlicht: (2024)
von: Kou, Siqi, et al.
Veröffentlicht: (2024)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
AdaCuRL: Adaptive Curriculum Reinforcement Learning with Invalid Sample Mitigation and Historical Revisiting
von: Li, Renda, et al.
Veröffentlicht: (2025)
von: Li, Renda, et al.
Veröffentlicht: (2025)
Retrieval is Not Enough: Enhancing RAG Reasoning through Test-Time Critique and Optimization
von: Wei, Jiaqi, et al.
Veröffentlicht: (2025)
von: Wei, Jiaqi, et al.
Veröffentlicht: (2025)
fMRI-LM: Towards a Universal Foundation Model for Language-Aligned fMRI Understanding
von: Wei, Yuxiang, et al.
Veröffentlicht: (2025)
von: Wei, Yuxiang, et al.
Veröffentlicht: (2025)
Mis-prompt: Benchmarking Large Language Models for Proactive Error Handling
von: Zeng, Jiayi, et al.
Veröffentlicht: (2025)
von: Zeng, Jiayi, et al.
Veröffentlicht: (2025)
Improving Language Model Reasoning with Self-motivated Learning
von: Feng, Yunlong, et al.
Veröffentlicht: (2024)
von: Feng, Yunlong, et al.
Veröffentlicht: (2024)
How to Retrieve Examples in In-context Learning to Improve Conversational Emotion Recognition using Large Language Models?
von: Wang, Mengqi, et al.
Veröffentlicht: (2025)
von: Wang, Mengqi, et al.
Veröffentlicht: (2025)
Deferred Commitment Decoding for Diffusion Language Models
von: Shu, Yingte, et al.
Veröffentlicht: (2026)
von: Shu, Yingte, et al.
Veröffentlicht: (2026)
DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models
von: Zhu, Yakun, et al.
Veröffentlicht: (2025)
von: Zhu, Yakun, et al.
Veröffentlicht: (2025)
Active Use of Latent Constituency Representation in both Humans and Large Language Models
von: Liu, Wei, et al.
Veröffentlicht: (2024)
von: Liu, Wei, et al.
Veröffentlicht: (2024)
A Bounding Box is Worth One Token: Interleaving Layout and Text in a Large Language Model for Document Understanding
von: Lu, Jinghui, et al.
Veröffentlicht: (2024)
von: Lu, Jinghui, et al.
Veröffentlicht: (2024)
SpeakRL: Synergizing Reasoning, Speaking, and Acting in Language Models with Reinforcement Learning
von: Acikgoz, Emre Can, et al.
Veröffentlicht: (2025)
von: Acikgoz, Emre Can, et al.
Veröffentlicht: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
von: Ding, Jing, et al.
Veröffentlicht: (2025)
von: Ding, Jing, et al.
Veröffentlicht: (2025)
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
von: Yu, Erxin, et al.
Veröffentlicht: (2024)
von: Yu, Erxin, et al.
Veröffentlicht: (2024)
DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression
von: Huang, Wei, et al.
Veröffentlicht: (2025)
von: Huang, Wei, et al.
Veröffentlicht: (2025)
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
von: Huang, Lei, et al.
Veröffentlicht: (2024)
von: Huang, Lei, et al.
Veröffentlicht: (2024)
SMAR: Soft Modality-Aware Routing Strategy for MoE-based Multimodal Large Language Models Preserving Language Capabilities
von: Xia, Guoyang, et al.
Veröffentlicht: (2025)
von: Xia, Guoyang, et al.
Veröffentlicht: (2025)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
von: Liu, Yu, et al.
Veröffentlicht: (2025)
von: Liu, Yu, et al.
Veröffentlicht: (2025)
Evaluating the Translation Performance of Large Language Models Based on Euas-20
von: Huang, Yan, et al.
Veröffentlicht: (2024)
von: Huang, Yan, et al.
Veröffentlicht: (2024)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
von: Feng, Yijun
Veröffentlicht: (2025)
von: Feng, Yijun
Veröffentlicht: (2025)
RoCar: A Relationship Network-based Evaluation Method for Large Language Models
von: Wang, Ming, et al.
Veröffentlicht: (2023)
von: Wang, Ming, et al.
Veröffentlicht: (2023)
Falcon: Faster and Parallel Inference of Large Language Models through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding Tree
von: Gao, Xiangxiang, et al.
Veröffentlicht: (2024)
von: Gao, Xiangxiang, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Advancing Sequential Numerical Prediction in Autoregressive Models
von: Fei, Xiang, et al.
Veröffentlicht: (2025) -
KICGPT: Large Language Model with Knowledge in Context for Knowledge Graph Completion
von: Wei, Yanbin, et al.
Veröffentlicht: (2024) -
FactAlign: Long-form Factuality Alignment of Large Language Models
von: Huang, Chao-Wei, et al.
Veröffentlicht: (2024) -
Flexora: Flexible Low Rank Adaptation for Large Language Models
von: Wei, Chenxing, et al.
Veröffentlicht: (2024) -
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
von: Wang, Siwei, et al.
Veröffentlicht: (2024)