Training Task Experts through Retrieval Based Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ge, Jiaxin, Jia, Xueying, Viswanathan, Vijay, Luo, Hongyin, Neubig, Graham |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning
par: Zhao, Chenyang, et autres
Publié: (2024)
par: Zhao, Chenyang, et autres
Publié: (2024)
Better Synthetic Data by Retrieving and Transforming Existing Datasets
par: Gandhi, Saumya, et autres
Publié: (2024)
par: Gandhi, Saumya, et autres
Publié: (2024)
ClusterFusion: Hybrid Clustering with Embedding Guidance and LLM Adaptation
par: Xu, Yiming, et autres
Publié: (2025)
par: Xu, Yiming, et autres
Publié: (2025)
Go-Browse: Training Web Agents with Structured Exploration
par: Gandhi, Apurva, et autres
Publié: (2025)
par: Gandhi, Apurva, et autres
Publié: (2025)
Checklists Are Better Than Reward Models For Aligning Language Models
par: Viswanathan, Vijay, et autres
Publié: (2025)
par: Viswanathan, Vijay, et autres
Publié: (2025)
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
par: Zhang, Charlie, et autres
Publié: (2025)
par: Zhang, Charlie, et autres
Publié: (2025)
Asking What Matters: Reward-Driven Clarification for Software Engineering Tasks
par: Vijayvargiya, Sanidhya, et autres
Publié: (2026)
par: Vijayvargiya, Sanidhya, et autres
Publié: (2026)
Reranking Passages with Coarse-to-Fine Neural Retriever Enhanced by List-Context Information
par: Zhu, Hongyin
Publié: (2023)
par: Zhu, Hongyin
Publié: (2023)
Synthetic Multimodal Question Generation
par: Wu, Ian, et autres
Publié: (2024)
par: Wu, Ian, et autres
Publié: (2024)
Solving NLP Problems through Human-System Collaboration: A Discussion-based Approach
par: Kaneko, Masahiro, et autres
Publié: (2023)
par: Kaneko, Masahiro, et autres
Publié: (2023)
Inducing Programmatic Skills for Agentic Tasks
par: Wang, Zora Zhiruo, et autres
Publié: (2025)
par: Wang, Zora Zhiruo, et autres
Publié: (2025)
BehaviorBox: Automated Discovery of Fine-Grained Performance Differences Between Language Models
par: Tjuatja, Lindia, et autres
Publié: (2025)
par: Tjuatja, Lindia, et autres
Publié: (2025)
Training Versatile Coding Agents in Synthetic Environments
par: Zhu, Yiqi, et autres
Publié: (2025)
par: Zhu, Yiqi, et autres
Publié: (2025)
Evaluating Language Models as Synthetic Data Generators
par: Kim, Seungone, et autres
Publié: (2024)
par: Kim, Seungone, et autres
Publié: (2024)
Effective Strategies for Asynchronous Software Engineering Agents
par: Geng, Jiayi, et autres
Publié: (2026)
par: Geng, Jiayi, et autres
Publié: (2026)
CAIRe: Cultural Attribution of Images by Retrieval-Augmented Evaluation
par: Yayavaram, Arnav, et autres
Publié: (2025)
par: Yayavaram, Arnav, et autres
Publié: (2025)
Addition is All You Need for Energy-efficient Language Models
par: Luo, Hongyin, et autres
Publié: (2024)
par: Luo, Hongyin, et autres
Publié: (2024)
An Incomplete Loop: Instruction Inference, Instruction Following, and In-context Learning in Language Models
par: Liu, Emmy, et autres
Publié: (2024)
par: Liu, Emmy, et autres
Publié: (2024)
What Is Missing in Multilingual Visual Reasoning and How to Fix It
par: Song, Yueqi, et autres
Publié: (2024)
par: Song, Yueqi, et autres
Publié: (2024)
Midtraining Bridges Pretraining and Posttraining Distributions
par: Liu, Emmy, et autres
Publié: (2025)
par: Liu, Emmy, et autres
Publié: (2025)
Beyond Browsing: API-Based Web Agents
par: Song, Yueqi, et autres
Publié: (2024)
par: Song, Yueqi, et autres
Publié: (2024)
CMULAB: An Open-Source Framework for Training and Deployment of Natural Language Processing Models
par: Sheikh, Zaid, et autres
Publié: (2024)
par: Sheikh, Zaid, et autres
Publié: (2024)
Industry Risk Assessment via Hierarchical Financial Data Using Stock Market Sentiment Indicators
par: Zhu, Hongyin
Publié: (2023)
par: Zhu, Hongyin
Publié: (2023)
Hybrid-Gym: Training Coding Agents to Generalize Across Tasks
par: Xie, Yiqing, et autres
Publié: (2026)
par: Xie, Yiqing, et autres
Publié: (2026)
ALR$^2$: A Retrieve-then-Reason Framework for Long-context Question Answering
par: Li, Huayang, et autres
Publié: (2024)
par: Li, Huayang, et autres
Publié: (2024)
RAGGED: Towards Informed Design of Scalable and Stable RAG Systems
par: Hsia, Jennifer, et autres
Publié: (2024)
par: Hsia, Jennifer, et autres
Publié: (2024)
What Goes Into a LM Acceptability Judgment? Rethinking the Impact of Frequency and Length
par: Tjuatja, Lindia, et autres
Publié: (2024)
par: Tjuatja, Lindia, et autres
Publié: (2024)
RQ-RAG: Learning to Refine Queries for Retrieval Augmented Generation
par: Chan, Chi-Min, et autres
Publié: (2024)
par: Chan, Chi-Min, et autres
Publié: (2024)
Leveraging Large Language Models for Enhanced NLP Task Performance through Knowledge Distillation and Optimized Training Strategies
par: Huang, Yining, et autres
Publié: (2024)
par: Huang, Yining, et autres
Publié: (2024)
Challenges and Responses in the Practice of Large Language Models
par: Zhu, Hongyin
Publié: (2024)
par: Zhu, Hongyin
Publié: (2024)
Architectural Foundations for the Large Language Model Infrastructures
par: Zhu, Hongyin
Publié: (2024)
par: Zhu, Hongyin
Publié: (2024)
Unifying Ontology Construction and Semantic Alignment for Deterministic Enterprise Reasoning at Scale
par: Zhu, Hongyin
Publié: (2026)
par: Zhu, Hongyin
Publié: (2026)
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
par: Zhang, Tianhua, et autres
Publié: (2024)
par: Zhang, Tianhua, et autres
Publié: (2024)
Training Software Engineering Agents and Verifiers with SWE-Gym
par: Pan, Jiayi, et autres
Publié: (2024)
par: Pan, Jiayi, et autres
Publié: (2024)
ROVER: Recursive Reasoning Over Videos with Vision-Language Models for Embodied Tasks
par: Schroeder, Philip, et autres
Publié: (2025)
par: Schroeder, Philip, et autres
Publié: (2025)
Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains
par: Li, Kun, et autres
Publié: (2024)
par: Li, Kun, et autres
Publié: (2024)
Agent Workflow Memory
par: Wang, Zora Zhiruo, et autres
Publié: (2024)
par: Wang, Zora Zhiruo, et autres
Publié: (2024)
Visual Program Distillation: Distilling Tools and Programmatic Reasoning into Vision-Language Models
par: Hu, Yushi, et autres
Publié: (2023)
par: Hu, Yushi, et autres
Publié: (2023)
Natural Language Embedded Programs for Hybrid Language Symbolic Reasoning
par: Zhang, Tianhua, et autres
Publié: (2023)
par: Zhang, Tianhua, et autres
Publié: (2023)
Towards Automatic Evaluation for Image Transcreation
par: Khanuja, Simran, et autres
Publié: (2024)
par: Khanuja, Simran, et autres
Publié: (2024)
Documents similaires
-
SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning
par: Zhao, Chenyang, et autres
Publié: (2024) -
Better Synthetic Data by Retrieving and Transforming Existing Datasets
par: Gandhi, Saumya, et autres
Publié: (2024) -
ClusterFusion: Hybrid Clustering with Embedding Guidance and LLM Adaptation
par: Xu, Yiming, et autres
Publié: (2025) -
Go-Browse: Training Web Agents with Structured Exploration
par: Gandhi, Apurva, et autres
Publié: (2025) -
Checklists Are Better Than Reward Models For Aligning Language Models
par: Viswanathan, Vijay, et autres
Publié: (2025)