Don't Throw Away Your Pretrained Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Feng, Shangbin, Yu, Wenhao, Wang, Yike, Zhang, Hongming, Tsvetkov, Yulia, Yu, Dong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Don't Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration
por: Feng, Shangbin, et al.
Publicado: (2024)
por: Feng, Shangbin, et al.
Publicado: (2024)
ScienceMeter: Tracking Scientific Knowledge Updates in Language Models
por: Wang, Yike, et al.
Publicado: (2025)
por: Wang, Yike, et al.
Publicado: (2025)
The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems
por: Feng, Shangbin, et al.
Publicado: (2026)
por: Feng, Shangbin, et al.
Publicado: (2026)
Don't Throw Away Data: Better Sequence Knowledge Distillation
por: Wang, Jun, et al.
Publicado: (2024)
por: Wang, Jun, et al.
Publicado: (2024)
Data Swarms: Optimizable Generation of Synthetic Evaluation Data
por: Feng, Shangbin, et al.
Publicado: (2025)
por: Feng, Shangbin, et al.
Publicado: (2025)
Don't Throw Away Your Beams: Improving Consistency-based Uncertainties in LLMs via Beam Search
por: Fadeeva, Ekaterina, et al.
Publicado: (2025)
por: Fadeeva, Ekaterina, et al.
Publicado: (2025)
MentorCollab: Selective Large-to-Small Inference-Time Guidance for Efficient Reasoning
por: Wang, Haojin, et al.
Publicado: (2026)
por: Wang, Haojin, et al.
Publicado: (2026)
Small Reward Models via Backward Inference
por: Wang, Yike, et al.
Publicado: (2026)
por: Wang, Yike, et al.
Publicado: (2026)
Resolving Knowledge Conflicts in Large Language Models
por: Wang, Yike, et al.
Publicado: (2023)
por: Wang, Yike, et al.
Publicado: (2023)
Among Us: Measuring and Mitigating Malicious Contributions in Model Collaboration Systems
por: Yang, Ziyuan, et al.
Publicado: (2026)
por: Yang, Ziyuan, et al.
Publicado: (2026)
Don't Throw Away the cookies!
por: Rebecca Weaver
Publicado: (2024)
por: Rebecca Weaver
Publicado: (2024)
Know Your Limits: A Survey of Abstention in Large Language Models
por: Wen, Bingbing, et al.
Publicado: (2024)
por: Wen, Bingbing, et al.
Publicado: (2024)
SPARTA ALIGNMENT: Collectively Aligning Multiple Language Models through Combat
por: Jiang, Yuru, et al.
Publicado: (2025)
por: Jiang, Yuru, et al.
Publicado: (2025)
What Does the Bot Say? Opportunities and Risks of Large Language Models in Social Media Bot Detection
por: Feng, Shangbin, et al.
Publicado: (2024)
por: Feng, Shangbin, et al.
Publicado: (2024)
Knowledge Card: Filling LLMs' Knowledge Gaps with Plug-in Specialized Language Models
por: Feng, Shangbin, et al.
Publicado: (2023)
por: Feng, Shangbin, et al.
Publicado: (2023)
Can Language Models Solve Graph Problems in Natural Language?
por: Wang, Heng, et al.
Publicado: (2023)
por: Wang, Heng, et al.
Publicado: (2023)
GuessBench: Sensemaking Multimodal Creativity in the Wild
por: Zhu, Zifeng, et al.
Publicado: (2025)
por: Zhu, Zifeng, et al.
Publicado: (2025)
Varying Shades of Wrong: Aligning LLMs with Wrong Answers Only
por: Yao, Jihan, et al.
Publicado: (2024)
por: Yao, Jihan, et al.
Publicado: (2024)
DELL: Generating Reactions and Explanations for LLM-Based Misinformation Detection
por: Wan, Herun, et al.
Publicado: (2024)
por: Wan, Herun, et al.
Publicado: (2024)
Heterogeneous Swarms: Jointly Optimizing Model Roles and Weights for Multi-LLM Systems
por: Feng, Shangbin, et al.
Publicado: (2025)
por: Feng, Shangbin, et al.
Publicado: (2025)
FACTS&EVIDENCE: An Interactive Tool for Transparent Fine-Grained Factual Verification of Machine-Generated Text
por: Boonsanong, Varich, et al.
Publicado: (2025)
por: Boonsanong, Varich, et al.
Publicado: (2025)
Teaching LLMs to Abstain across Languages via Multilingual Feedback
por: Feng, Shangbin, et al.
Publicado: (2024)
por: Feng, Shangbin, et al.
Publicado: (2024)
KGQuiz: Evaluating the Generalization of Encoded Knowledge in Large Language Models
por: Bai, Yuyang, et al.
Publicado: (2023)
por: Bai, Yuyang, et al.
Publicado: (2023)
Model Swarms: Collaborative Search to Adapt LLM Experts via Swarm Intelligence
por: Feng, Shangbin, et al.
Publicado: (2024)
por: Feng, Shangbin, et al.
Publicado: (2024)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
por: Zhang, Yizhuo, et al.
Publicado: (2025)
por: Zhang, Yizhuo, et al.
Publicado: (2025)
Knowledge Crosswords: Geometric Knowledge Reasoning with Large Language Models
por: Ding, Wenxuan, et al.
Publicado: (2023)
por: Ding, Wenxuan, et al.
Publicado: (2023)
Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models
por: Parmar, Jupinder, et al.
Publicado: (2024)
por: Parmar, Jupinder, et al.
Publicado: (2024)
Can LLM Graph Reasoning Generalize beyond Pattern Memorization?
por: Zhang, Yizhuo, et al.
Publicado: (2024)
por: Zhang, Yizhuo, et al.
Publicado: (2024)
P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models
por: Liu, Yuhan, et al.
Publicado: (2023)
por: Liu, Yuhan, et al.
Publicado: (2023)
Modular Pluralism: Pluralistic Alignment via Multi-LLM Collaboration
por: Feng, Shangbin, et al.
Publicado: (2024)
por: Feng, Shangbin, et al.
Publicado: (2024)
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
por: Mao, Xin, et al.
Publicado: (2024)
por: Mao, Xin, et al.
Publicado: (2024)
Revise, Don't Freeze: Sampler-Matched Training for Self-Correcting Masked Diffusion Language Models
por: Yu, Longxuan, et al.
Publicado: (2026)
por: Yu, Longxuan, et al.
Publicado: (2026)
When One LLM Drools, Multi-LLM Collaboration Rules
por: Feng, Shangbin, et al.
Publicado: (2025)
por: Feng, Shangbin, et al.
Publicado: (2025)
Stumbling Blocks: Stress Testing the Robustness of Machine-Generated Text Detectors Under Attacks
por: Wang, Yichen, et al.
Publicado: (2024)
por: Wang, Yichen, et al.
Publicado: (2024)
Finding Flawed Fictions: Evaluating Complex Reasoning in Language Models via Plot Hole Detection
por: Ahuja, Kabir, et al.
Publicado: (2025)
por: Ahuja, Kabir, et al.
Publicado: (2025)
sDPO: Don't Use Your Data All at Once
por: Kim, Dahyun, et al.
Publicado: (2024)
por: Kim, Dahyun, et al.
Publicado: (2024)
Don't Pay Attention, PLANT It: Pretraining Attention via Learning-to-Rank
por: Roy, Debjyoti Saha, et al.
Publicado: (2024)
por: Roy, Debjyoti Saha, et al.
Publicado: (2024)
OpenCharacter: Training Customizable Role-Playing LLMs with Large-Scale Synthetic Personas
por: Wang, Xiaoyang, et al.
Publicado: (2025)
por: Wang, Xiaoyang, et al.
Publicado: (2025)
Chain-of-Note: Enhancing Robustness in Retrieval-Augmented Language Models
por: Yu, Wenhao, et al.
Publicado: (2023)
por: Yu, Wenhao, et al.
Publicado: (2023)
Fine-Tune, Don't Prompt, Your Language Model to Identify Biased Language in Clinical Notes
por: Landi, Isotta, et al.
Publicado: (2026)
por: Landi, Isotta, et al.
Publicado: (2026)
Ejemplares similares
-
Don't Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration
por: Feng, Shangbin, et al.
Publicado: (2024) -
ScienceMeter: Tracking Scientific Knowledge Updates in Language Models
por: Wang, Yike, et al.
Publicado: (2025) -
The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems
por: Feng, Shangbin, et al.
Publicado: (2026) -
Don't Throw Away Data: Better Sequence Knowledge Distillation
por: Wang, Jun, et al.
Publicado: (2024) -
Data Swarms: Optimizable Generation of Synthetic Evaluation Data
por: Feng, Shangbin, et al.
Publicado: (2025)