Instruction-tuned Language Models are Better Knowledge Learners
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Jiang, Zhengbao, Sun, Zhiqing, Shi, Weijia, Rodriguez, Pedro, Zhou, Chunting, Neubig, Graham, Lin, Xi Victoria, Yih, Wen-tau, Iyer, Srinivasan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
von: Liang, Weixin, et al.
Veröffentlicht: (2024)
von: Liang, Weixin, et al.
Veröffentlicht: (2024)
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
von: Ma, Xueguang, et al.
Veröffentlicht: (2025)
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025)
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025)
Procedural Knowledge at Scale Improves Reasoning
von: Wu, Di, et al.
Veröffentlicht: (2026)
von: Wu, Di, et al.
Veröffentlicht: (2026)
LMFusion: Adapting Pretrained Language Models for Multimodal Generation
von: Shi, Weijia, et al.
Veröffentlicht: (2024)
von: Shi, Weijia, et al.
Veröffentlicht: (2024)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
Nearest Neighbor Speculative Decoding for LLM Generation and Attribution
von: Li, Minghan, et al.
Veröffentlicht: (2024)
von: Li, Minghan, et al.
Veröffentlicht: (2024)
An Incomplete Loop: Instruction Inference, Instruction Following, and In-context Learning in Language Models
von: Liu, Emmy, et al.
Veröffentlicht: (2024)
von: Liu, Emmy, et al.
Veröffentlicht: (2024)
Better Instruction-Following Through Minimum Bayes Risk
von: Wu, Ian, et al.
Veröffentlicht: (2024)
von: Wu, Ian, et al.
Veröffentlicht: (2024)
In-context Pretraining: Language Modeling Beyond Document Boundaries
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
von: Shi, Weijia, et al.
Veröffentlicht: (2023)
RA-DIT: Retrieval-Augmented Dual Instruction Tuning
von: Lin, Xi Victoria, et al.
Veröffentlicht: (2023)
von: Lin, Xi Victoria, et al.
Veröffentlicht: (2023)
SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning
von: Zhao, Chenyang, et al.
Veröffentlicht: (2024)
von: Zhao, Chenyang, et al.
Veröffentlicht: (2024)
FLAME: Factuality-Aware Alignment for Large Language Models
von: Lin, Sheng-Chieh, et al.
Veröffentlicht: (2024)
von: Lin, Sheng-Chieh, et al.
Veröffentlicht: (2024)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
von: Chuang, Yung-Sung, et al.
Veröffentlicht: (2025)
von: Chuang, Yung-Sung, et al.
Veröffentlicht: (2025)
Design and Optimization of Wearables for Human Motion Energy Harvesting
von: Peng, Weijia, et al.
Veröffentlicht: (2025)
von: Peng, Weijia, et al.
Veröffentlicht: (2025)
Checklists Are Better Than Reward Models For Aligning Language Models
von: Viswanathan, Vijay, et al.
Veröffentlicht: (2025)
von: Viswanathan, Vijay, et al.
Veröffentlicht: (2025)
Byte Latent Transformer: Patches Scale Better Than Tokens
von: Pagnoni, Artidoro, et al.
Veröffentlicht: (2024)
von: Pagnoni, Artidoro, et al.
Veröffentlicht: (2024)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
von: He, Jacqueline, et al.
Veröffentlicht: (2026)
von: He, Jacqueline, et al.
Veröffentlicht: (2026)
Towards Automatic Evaluation for Image Transcreation
von: Khanuja, Simran, et al.
Veröffentlicht: (2024)
von: Khanuja, Simran, et al.
Veröffentlicht: (2024)
BehaviorBox: Automated Discovery of Fine-Grained Performance Differences Between Language Models
von: Tjuatja, Lindia, et al.
Veröffentlicht: (2025)
von: Tjuatja, Lindia, et al.
Veröffentlicht: (2025)
Reliable, Adaptable, and Attributable Language Models with Retrieval
von: Asai, Akari, et al.
Veröffentlicht: (2024)
von: Asai, Akari, et al.
Veröffentlicht: (2024)
Better Synthetic Data by Retrieving and Transforming Existing Datasets
von: Gandhi, Saumya, et al.
Veröffentlicht: (2024)
von: Gandhi, Saumya, et al.
Veröffentlicht: (2024)
Supervised Knowledge Makes Large Language Models Better In-context Learners
von: Yang, Linyi, et al.
Veröffentlicht: (2023)
von: Yang, Linyi, et al.
Veröffentlicht: (2023)
Multi-Dimensional Evaluation of Text Summarization with In-Context Learning
von: Jain, Sameer, et al.
Veröffentlicht: (2023)
von: Jain, Sameer, et al.
Veröffentlicht: (2023)
Group-Level Data Selection for Efficient Pretraining
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
von: Yu, Zichun, et al.
Veröffentlicht: (2025)
HoneyBee: Data Recipes for Vision-Language Reasoners
von: Bansal, Hritik, et al.
Veröffentlicht: (2025)
von: Bansal, Hritik, et al.
Veröffentlicht: (2025)
Language Modeling with Editable External Knowledge
von: Li, Belinda Z., et al.
Veröffentlicht: (2024)
von: Li, Belinda Z., et al.
Veröffentlicht: (2024)
Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM
von: Sukhbaatar, Sainbayar, et al.
Veröffentlicht: (2024)
von: Sukhbaatar, Sainbayar, et al.
Veröffentlicht: (2024)
Speechworthy Instruction-tuned Language Models
von: Cho, Hyundong, et al.
Veröffentlicht: (2024)
von: Cho, Hyundong, et al.
Veröffentlicht: (2024)
Memory Layers at Scale
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024)
von: Berges, Vincent-Pierre, et al.
Veröffentlicht: (2024)
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
von: Zhang, Charlie, et al.
Veröffentlicht: (2025)
von: Zhang, Charlie, et al.
Veröffentlicht: (2025)
Go-Browse: Training Web Agents with Structured Exploration
von: Gandhi, Apurva, et al.
Veröffentlicht: (2025)
von: Gandhi, Apurva, et al.
Veröffentlicht: (2025)
Effective Strategies for Asynchronous Software Engineering Agents
von: Geng, Jiayi, et al.
Veröffentlicht: (2026)
von: Geng, Jiayi, et al.
Veröffentlicht: (2026)
Improving Factuality with Explicit Working Memory
von: Chen, Mingda, et al.
Veröffentlicht: (2024)
von: Chen, Mingda, et al.
Veröffentlicht: (2024)
Decision Boundary-aware Knowledge Consolidation Generates Better Instance-Incremental Learner
von: Nie, Qiang, et al.
Veröffentlicht: (2024)
von: Nie, Qiang, et al.
Veröffentlicht: (2024)
Grounding Multilingual Multimodal LLMs With Cultural Knowledge
von: Nyandwi, Jean de Dieu, et al.
Veröffentlicht: (2025)
von: Nyandwi, Jean de Dieu, et al.
Veröffentlicht: (2025)
ReasonIR: Training Retrievers for Reasoning Tasks
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
Knowledge Extraction on Semi-Structured Content: Does It Remain Relevant for Question Answering in the Era of LLMs?
von: Sun, Kai, et al.
Veröffentlicht: (2025)
von: Sun, Kai, et al.
Veröffentlicht: (2025)
Prompt-MII: Meta-Learning Instruction Induction for LLMs
von: Xiao, Emily, et al.
Veröffentlicht: (2025)
von: Xiao, Emily, et al.
Veröffentlicht: (2025)
CyberLLM-FINDS 2025: Instruction-Tuned Fine-tuning of Domain-Specific LLMs with Retrieval-Augmented Generation and Graph Integration for MITRE Evaluation
von: Iyer, Vasanth, et al.
Veröffentlicht: (2026)
von: Iyer, Vasanth, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
von: Liang, Weixin, et al.
Veröffentlicht: (2024) -
DRAMA: Diverse Augmentation from Large Language Models to Smaller Dense Retrievers
von: Ma, Xueguang, et al.
Veröffentlicht: (2025) -
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
von: Zhang, Wenzheng, et al.
Veröffentlicht: (2025) -
Procedural Knowledge at Scale Improves Reasoning
von: Wu, Di, et al.
Veröffentlicht: (2026) -
LMFusion: Adapting Pretrained Language Models for Multimodal Generation
von: Shi, Weijia, et al.
Veröffentlicht: (2024)