Online Training of Large Language Models: Learn while chatting
Fuente:
arXiv
Salvato in:
| Autori principali: | Liang, Juhao, Wang, Ziwei, Ma, Zhuoheng, Li, Jianquan, Zhang, Zhiyi, Wu, Xiangbo, Wang, Benyou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models
di: Chen, Guiming Hardy, et al.
Pubblicazione: (2024)
di: Chen, Guiming Hardy, et al.
Pubblicazione: (2024)
Exploring the traditional NMT model and Large Language Model for chat translation
di: Yang, Jinlong, et al.
Pubblicazione: (2024)
di: Yang, Jinlong, et al.
Pubblicazione: (2024)
Robust Search with Uncertainty-Aware Value Models for Language Model Reasoning
di: Yu, Fei, et al.
Pubblicazione: (2025)
di: Yu, Fei, et al.
Pubblicazione: (2025)
Smurfs: Multi-Agent System using Context-Efficient DFSDT for Tool Planning
di: Chen, Junzhi, et al.
Pubblicazione: (2024)
di: Chen, Junzhi, et al.
Pubblicazione: (2024)
CMB: A Comprehensive Medical Benchmark in Chinese
di: Wang, Xidong, et al.
Pubblicazione: (2023)
di: Wang, Xidong, et al.
Pubblicazione: (2023)
Evolving Subnetwork Training for Large Language Models
di: Li, Hanqi, et al.
Pubblicazione: (2024)
di: Li, Hanqi, et al.
Pubblicazione: (2024)
Assessing Large Language Models for Online Extremism Research: Identification, Explanation, and New Knowledge
di: Dong, Beidi, et al.
Pubblicazione: (2024)
di: Dong, Beidi, et al.
Pubblicazione: (2024)
Roadmap towards Superhuman Speech Understanding using Large Language Models
di: Bu, Fan, et al.
Pubblicazione: (2024)
di: Bu, Fan, et al.
Pubblicazione: (2024)
OVM, Outcome-supervised Value Models for Planning in Mathematical Reasoning
di: Yu, Fei, et al.
Pubblicazione: (2023)
di: Yu, Fei, et al.
Pubblicazione: (2023)
Apollo: A Lightweight Multilingual Medical LLM towards Democratizing Medical AI to 6B People
di: Wang, Xidong, et al.
Pubblicazione: (2024)
di: Wang, Xidong, et al.
Pubblicazione: (2024)
Deploying Multi-task Online Server with Large Language Model
di: Qu, Yincen, et al.
Pubblicazione: (2024)
di: Qu, Yincen, et al.
Pubblicazione: (2024)
Large Language Model Sourcing: A Survey
di: Pang, Liang, et al.
Pubblicazione: (2025)
di: Pang, Liang, et al.
Pubblicazione: (2025)
LLMs for Mathematical Modeling: Towards Bridging the Gap between Natural and Mathematical Languages
di: Huang, Xuhan, et al.
Pubblicazione: (2024)
di: Huang, Xuhan, et al.
Pubblicazione: (2024)
EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
di: Zhang, Yuhao, et al.
Pubblicazione: (2025)
Learning Dynamics in Continual Pre-Training for Large Language Models
di: Wang, Xingjin, et al.
Pubblicazione: (2025)
di: Wang, Xingjin, et al.
Pubblicazione: (2025)
A Study on Training and Developing Large Language Models for Behavior Tree Generation
di: Li, Fu, et al.
Pubblicazione: (2024)
di: Li, Fu, et al.
Pubblicazione: (2024)
Delusions of Large Language Models
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
di: Liang, Haijian, et al.
Pubblicazione: (2026)
di: Liang, Haijian, et al.
Pubblicazione: (2026)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
LLM-KT: Aligning Large Language Models with Knowledge Tracing using a Plug-and-Play Instruction
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
HuatuoGPT-II, One-stage Training for Medical Adaption of LLMs
di: Chen, Junying, et al.
Pubblicazione: (2023)
di: Chen, Junying, et al.
Pubblicazione: (2023)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Quantifying Self-diagnostic Atomic Knowledge in Chinese Medical Foundation Model: A Computational Analysis
di: Fan, Yaxin, et al.
Pubblicazione: (2023)
di: Fan, Yaxin, et al.
Pubblicazione: (2023)
LongSkywork: A Training Recipe for Efficiently Extending Context Length in Large Language Models
di: Zhao, Liang, et al.
Pubblicazione: (2024)
di: Zhao, Liang, et al.
Pubblicazione: (2024)
Data Management For Training Large Language Models: A Survey
di: Wang, Zige, et al.
Pubblicazione: (2023)
di: Wang, Zige, et al.
Pubblicazione: (2023)
Efficiently Democratizing Medical LLMs for 50 Languages via a Mixture of Language Family Experts
di: Zheng, Guorui, et al.
Pubblicazione: (2024)
di: Zheng, Guorui, et al.
Pubblicazione: (2024)
From Word to World: Evaluate and Mitigate Culture Bias in LLMs via Word Association Test
di: Dai, Xunlian, et al.
Pubblicazione: (2025)
di: Dai, Xunlian, et al.
Pubblicazione: (2025)
Learning Evolving Tools for Large Language Models
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
EyeGPT: Ophthalmic Assistant with Large Language Models
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
di: Chen, Xiaolan, et al.
Pubblicazione: (2024)
Teaching Language Models to Reason with Tools
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
di: Li, Yibo, et al.
Pubblicazione: (2025)
di: Li, Yibo, et al.
Pubblicazione: (2025)
Extracting Training Dialogue Data from Large Language Model based Task Bots
di: Zhang, Shuo, et al.
Pubblicazione: (2026)
di: Zhang, Shuo, et al.
Pubblicazione: (2026)
ORLM: A Customizable Framework in Training Large Models for Automated Optimization Modeling
di: Huang, Chenyu, et al.
Pubblicazione: (2024)
di: Huang, Chenyu, et al.
Pubblicazione: (2024)
Consistency Training while Mitigating Obfuscation via Rate Matching
di: Imran, Sohaib, et al.
Pubblicazione: (2026)
di: Imran, Sohaib, et al.
Pubblicazione: (2026)
ANAH: Analytical Annotation of Hallucinations in Large Language Models
di: Ji, Ziwei, et al.
Pubblicazione: (2024)
di: Ji, Ziwei, et al.
Pubblicazione: (2024)
Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models
di: Jiang, Haitao, et al.
Pubblicazione: (2026)
di: Jiang, Haitao, et al.
Pubblicazione: (2026)
Boosting Protein Language Models with Negative Sample Mining
di: Xu, Yaoyao, et al.
Pubblicazione: (2024)
di: Xu, Yaoyao, et al.
Pubblicazione: (2024)
Neural Probe-Based Hallucination Detection for Large Language Models
di: Liang, Shize, et al.
Pubblicazione: (2025)
di: Liang, Shize, et al.
Pubblicazione: (2025)
Fine-tuning Large Language Models for Multigenerator, Multidomain, and Multilingual Machine-Generated Text Detection
di: Xiong, Feng, et al.
Pubblicazione: (2024)
di: Xiong, Feng, et al.
Pubblicazione: (2024)
A Survey on Model Compression for Large Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
Documenti analoghi
-
ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models
di: Chen, Guiming Hardy, et al.
Pubblicazione: (2024) -
Exploring the traditional NMT model and Large Language Model for chat translation
di: Yang, Jinlong, et al.
Pubblicazione: (2024) -
Robust Search with Uncertainty-Aware Value Models for Language Model Reasoning
di: Yu, Fei, et al.
Pubblicazione: (2025) -
Smurfs: Multi-Agent System using Context-Efficient DFSDT for Tool Planning
di: Chen, Junzhi, et al.
Pubblicazione: (2024) -
CMB: A Comprehensive Medical Benchmark in Chinese
di: Wang, Xidong, et al.
Pubblicazione: (2023)