Post-Completion Learning for Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Fei, Xiang, Wang, Siqi, Wei, Shu, Nie, Yuxiang, Shi, Wei, Feng, Hao, Feng, Chao, Huang, Can |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Advancing Sequential Numerical Prediction in Autoregressive Models
por: Fei, Xiang, et al.
Publicado: (2025)
por: Fei, Xiang, et al.
Publicado: (2025)
KICGPT: Large Language Model with Knowledge in Context for Knowledge Graph Completion
por: Wei, Yanbin, et al.
Publicado: (2024)
por: Wei, Yanbin, et al.
Publicado: (2024)
FactAlign: Long-form Factuality Alignment of Large Language Models
por: Huang, Chao-Wei, et al.
Publicado: (2024)
por: Huang, Chao-Wei, et al.
Publicado: (2024)
Flexora: Flexible Low Rank Adaptation for Large Language Models
por: Wei, Chenxing, et al.
Publicado: (2024)
por: Wei, Chenxing, et al.
Publicado: (2024)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
por: Wang, Siwei, et al.
Publicado: (2024)
por: Wang, Siwei, et al.
Publicado: (2024)
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
por: Wang, Siwei, et al.
Publicado: (2025)
por: Wang, Siwei, et al.
Publicado: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
por: Tang, Jiabin, et al.
Publicado: (2023)
por: Tang, Jiabin, et al.
Publicado: (2023)
Fine-Tuning Language Models with Reward Learning on Policy
por: Lang, Hao, et al.
Publicado: (2024)
por: Lang, Hao, et al.
Publicado: (2024)
Finetuning Generative Large Language Models with Discrimination Instructions for Knowledge Graph Completion
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
The Era of Agentic Organization: Learning to Organize with Language Models
por: Chi, Zewen, et al.
Publicado: (2025)
por: Chi, Zewen, et al.
Publicado: (2025)
SSL-SSAW: Self-Supervised Learning with Sigmoid Self-Attention Weighting for Question-Based Sign Language Translation
por: Liu, Zekang, et al.
Publicado: (2025)
por: Liu, Zekang, et al.
Publicado: (2025)
Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models
por: Feng, Wenfeng, et al.
Publicado: (2024)
por: Feng, Wenfeng, et al.
Publicado: (2024)
Peer-Predictive Self-Training for Language Model Reasoning
por: Feng, Shi, et al.
Publicado: (2026)
por: Feng, Shi, et al.
Publicado: (2026)
Optimising Language Models for Downstream Tasks: A Post-Training Perspective
por: Shi, Zhengyan
Publicado: (2025)
por: Shi, Zhengyan
Publicado: (2025)
SAFER: Probing Safety in Reward Models with Sparse Autoencoder
por: Shi, Wei, et al.
Publicado: (2025)
por: Shi, Wei, et al.
Publicado: (2025)
On Leveraging Large Language Models for Enhancing Entity Resolution: A Cost-efficient Approach
por: Li, Huahang, et al.
Publicado: (2024)
por: Li, Huahang, et al.
Publicado: (2024)
CLLMs: Consistency Large Language Models
por: Kou, Siqi, et al.
Publicado: (2024)
por: Kou, Siqi, et al.
Publicado: (2024)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
por: Zhao, Jun, et al.
Publicado: (2024)
por: Zhao, Jun, et al.
Publicado: (2024)
AdaCuRL: Adaptive Curriculum Reinforcement Learning with Invalid Sample Mitigation and Historical Revisiting
por: Li, Renda, et al.
Publicado: (2025)
por: Li, Renda, et al.
Publicado: (2025)
Retrieval is Not Enough: Enhancing RAG Reasoning through Test-Time Critique and Optimization
por: Wei, Jiaqi, et al.
Publicado: (2025)
por: Wei, Jiaqi, et al.
Publicado: (2025)
fMRI-LM: Towards a Universal Foundation Model for Language-Aligned fMRI Understanding
por: Wei, Yuxiang, et al.
Publicado: (2025)
por: Wei, Yuxiang, et al.
Publicado: (2025)
Mis-prompt: Benchmarking Large Language Models for Proactive Error Handling
por: Zeng, Jiayi, et al.
Publicado: (2025)
por: Zeng, Jiayi, et al.
Publicado: (2025)
Improving Language Model Reasoning with Self-motivated Learning
por: Feng, Yunlong, et al.
Publicado: (2024)
por: Feng, Yunlong, et al.
Publicado: (2024)
How to Retrieve Examples in In-context Learning to Improve Conversational Emotion Recognition using Large Language Models?
por: Wang, Mengqi, et al.
Publicado: (2025)
por: Wang, Mengqi, et al.
Publicado: (2025)
Deferred Commitment Decoding for Diffusion Language Models
por: Shu, Yingte, et al.
Publicado: (2026)
por: Shu, Yingte, et al.
Publicado: (2026)
DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models
por: Zhu, Yakun, et al.
Publicado: (2025)
por: Zhu, Yakun, et al.
Publicado: (2025)
Active Use of Latent Constituency Representation in both Humans and Large Language Models
por: Liu, Wei, et al.
Publicado: (2024)
por: Liu, Wei, et al.
Publicado: (2024)
A Bounding Box is Worth One Token: Interleaving Layout and Text in a Large Language Model for Document Understanding
por: Lu, Jinghui, et al.
Publicado: (2024)
por: Lu, Jinghui, et al.
Publicado: (2024)
SpeakRL: Synergizing Reasoning, Speaking, and Acting in Language Models with Reinforcement Learning
por: Acikgoz, Emre Can, et al.
Publicado: (2025)
por: Acikgoz, Emre Can, et al.
Publicado: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
por: Ding, Jing, et al.
Publicado: (2025)
por: Ding, Jing, et al.
Publicado: (2025)
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
por: Yu, Erxin, et al.
Publicado: (2024)
por: Yu, Erxin, et al.
Publicado: (2024)
DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression
por: Huang, Wei, et al.
Publicado: (2025)
por: Huang, Wei, et al.
Publicado: (2025)
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
por: Huang, Lei, et al.
Publicado: (2024)
por: Huang, Lei, et al.
Publicado: (2024)
SMAR: Soft Modality-Aware Routing Strategy for MoE-based Multimodal Large Language Models Preserving Language Capabilities
por: Xia, Guoyang, et al.
Publicado: (2025)
por: Xia, Guoyang, et al.
Publicado: (2025)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
por: Liu, Yu, et al.
Publicado: (2025)
por: Liu, Yu, et al.
Publicado: (2025)
Evaluating the Translation Performance of Large Language Models Based on Euas-20
por: Huang, Yan, et al.
Publicado: (2024)
por: Huang, Yan, et al.
Publicado: (2024)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
por: Wang, Jingyuan, et al.
Publicado: (2025)
por: Wang, Jingyuan, et al.
Publicado: (2025)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
por: Feng, Yijun
Publicado: (2025)
por: Feng, Yijun
Publicado: (2025)
RoCar: A Relationship Network-based Evaluation Method for Large Language Models
por: Wang, Ming, et al.
Publicado: (2023)
por: Wang, Ming, et al.
Publicado: (2023)
Falcon: Faster and Parallel Inference of Large Language Models through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding Tree
por: Gao, Xiangxiang, et al.
Publicado: (2024)
por: Gao, Xiangxiang, et al.
Publicado: (2024)
Ejemplares similares
-
Advancing Sequential Numerical Prediction in Autoregressive Models
por: Fei, Xiang, et al.
Publicado: (2025) -
KICGPT: Large Language Model with Knowledge in Context for Knowledge Graph Completion
por: Wei, Yanbin, et al.
Publicado: (2024) -
FactAlign: Long-form Factuality Alignment of Large Language Models
por: Huang, Chao-Wei, et al.
Publicado: (2024) -
Flexora: Flexible Low Rank Adaptation for Large Language Models
por: Wei, Chenxing, et al.
Publicado: (2024) -
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
por: Wang, Siwei, et al.
Publicado: (2024)