UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Haoyu, Wang, Shuo, Yan, Yukun, Wang, Xujia, Yang, Zhiyu, Xu, Yuzhuang, Liu, Zhenghao, Yang, Liner, Ding, Ning, Han, Xu, Liu, Zhiyuan, Sun, Maosong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
Delta-CoMe: Training-Free Delta-Compression with Mixed-Precision for Large Language Models
di: Ping, Bowen, et al.
Pubblicazione: (2024)
di: Ping, Bowen, et al.
Pubblicazione: (2024)
LegalDuet: Learning Fine-grained Representations for Legal Judgment Prediction via a Dual-View Contrastive Learning
di: Xu, Buqiang, et al.
Pubblicazione: (2024)
di: Xu, Buqiang, et al.
Pubblicazione: (2024)
Monocle: Hybrid Local-Global In-Context Evaluation for Long-Text Generation with Uncertainty-Based Active Learning
di: Wang, Xiaorong, et al.
Pubblicazione: (2025)
di: Wang, Xiaorong, et al.
Pubblicazione: (2025)
RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework
di: Zhu, Kunlun, et al.
Pubblicazione: (2024)
di: Zhu, Kunlun, et al.
Pubblicazione: (2024)
KG-Infused RAG: Augmenting Corpus-Based RAG with External Knowledge Graphs
di: Wu, Dingjun, et al.
Pubblicazione: (2025)
di: Wu, Dingjun, et al.
Pubblicazione: (2025)
Toolink: Linking Toolkit Creation and Using through Chain-of-Solving on Open-Source Model
di: Qian, Cheng, et al.
Pubblicazione: (2023)
di: Qian, Cheng, et al.
Pubblicazione: (2023)
MCTS: A Multi-Reference Chinese Text Simplification Dataset
di: Chong, Ruining, et al.
Pubblicazione: (2023)
di: Chong, Ruining, et al.
Pubblicazione: (2023)
KBAlign: Efficient Self Adaptation on Specific Knowledge Bases
di: Zeng, Zheni, et al.
Pubblicazione: (2024)
di: Zeng, Zheni, et al.
Pubblicazione: (2024)
MatPlotAgent: Method and Evaluation for LLM-Based Agentic Scientific Data Visualization
di: Yang, Zhiyu, et al.
Pubblicazione: (2024)
di: Yang, Zhiyu, et al.
Pubblicazione: (2024)
OneBit: Towards Extremely Low-bit Large Language Models
di: Xu, Yuzhuang, et al.
Pubblicazione: (2024)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2024)
MALoRA: Mixture of Asymmetric Low-Rank Adaptation for Enhanced Multi-Task Learning
di: Wang, Xujia, et al.
Pubblicazione: (2024)
di: Wang, Xujia, et al.
Pubblicazione: (2024)
VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents
di: Yu, Shi, et al.
Pubblicazione: (2024)
di: Yu, Shi, et al.
Pubblicazione: (2024)
Pluggable Neural Machine Translation Models via Memory-augmented Adapters
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
DeepNote: Note-Centric Deep Retrieval-Augmented Generation
di: Wang, Ruobing, et al.
Pubblicazione: (2024)
di: Wang, Ruobing, et al.
Pubblicazione: (2024)
A*-Thought: Efficient Reasoning via Bidirectional Compression for Low-Resource Settings
di: Xu, Xiaoang, et al.
Pubblicazione: (2025)
di: Xu, Xiaoang, et al.
Pubblicazione: (2025)
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
Why Stop at One Error? Benchmarking LLMs as Data Science Code Debuggers for Multi-Hop and Multi-Bug Errors
di: Yang, Zhiyu, et al.
Pubblicazione: (2025)
di: Yang, Zhiyu, et al.
Pubblicazione: (2025)
LoSiA: Efficient High-Rank Fine-Tuning via Subnet Localization and Optimization
di: Wang, Xujia, et al.
Pubblicazione: (2025)
di: Wang, Xujia, et al.
Pubblicazione: (2025)
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
On LLM-Based Scientific Inductive Reasoning Beyond Equations
di: Lin, Brian S., et al.
Pubblicazione: (2025)
di: Lin, Brian S., et al.
Pubblicazione: (2025)
Empirical Analysis of Decoding Biases in Masked Diffusion Models
di: Huang, Pengcheng, et al.
Pubblicazione: (2025)
di: Huang, Pengcheng, et al.
Pubblicazione: (2025)
AgentCPM-Report: Interleaving Drafting and Deepening for Open-Ended Deep Research
di: Li, Yishan, et al.
Pubblicazione: (2026)
di: Li, Yishan, et al.
Pubblicazione: (2026)
MetaMem: Evolving Meta-Memory for Knowledge Utilization through Self-Reflective Symbolic Optimization
di: Xin, Haidong, et al.
Pubblicazione: (2026)
di: Xin, Haidong, et al.
Pubblicazione: (2026)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
di: Zhang, Yuanchi, et al.
Pubblicazione: (2024)
di: Zhang, Yuanchi, et al.
Pubblicazione: (2024)
Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
Packing Analysis: Packing Is More Appropriate for Large Models or Datasets in Supervised Fine-tuning
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
Are LLMs Effective Backbones for Fine-tuning? An Experimental Investigation of Supervised LLMs on Chinese Short Text Matching
di: Liu, Shulin, et al.
Pubblicazione: (2024)
di: Liu, Shulin, et al.
Pubblicazione: (2024)
INTERVENOR: Prompting the Coding Ability of Large Language Models with the Interactive Chain of Repair
di: Wang, Hanbin, et al.
Pubblicazione: (2023)
di: Wang, Hanbin, et al.
Pubblicazione: (2023)
Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains
di: Xiong, Yuqi, et al.
Pubblicazione: (2026)
di: Xiong, Yuqi, et al.
Pubblicazione: (2026)
Mixture-of-Retrieval Experts for Reasoning-Guided Multimodal Knowledge Exploitation
di: Peng, Chunyi, et al.
Pubblicazione: (2025)
di: Peng, Chunyi, et al.
Pubblicazione: (2025)
PersLLM: A Personified Training Approach for Large Language Models
di: Zeng, Zheni, et al.
Pubblicazione: (2024)
di: Zeng, Zheni, et al.
Pubblicazione: (2024)
VisRAG 2.0: Evidence-Guided Multi-Image Reasoning in Visual Retrieval-Augmented Generation
di: Sun, Yubo, et al.
Pubblicazione: (2025)
di: Sun, Yubo, et al.
Pubblicazione: (2025)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models
di: An, Jiyuan, et al.
Pubblicazione: (2026)
di: An, Jiyuan, et al.
Pubblicazione: (2026)
Finding What Matters: Anchoring Context Knowledge with Evolving Indices for Iterative Retrieval
di: Wu, Mingyan, et al.
Pubblicazione: (2026)
di: Wu, Mingyan, et al.
Pubblicazione: (2026)
COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis
di: Yang, Weiqing, et al.
Pubblicazione: (2024)
di: Yang, Weiqing, et al.
Pubblicazione: (2024)
Cleaner Pretraining Corpus Curation with Neural Web Scraping
di: Xu, Zhipeng, et al.
Pubblicazione: (2024)
di: Xu, Zhipeng, et al.
Pubblicazione: (2024)
Long-Chain Reasoning Distillation via Adaptive Prefix Alignment
di: Liu, Zhenghao, et al.
Pubblicazione: (2026)
di: Liu, Zhenghao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
di: Liu, Yang, et al.
Pubblicazione: (2024) -
Delta-CoMe: Training-Free Delta-Compression with Mixed-Precision for Large Language Models
di: Ping, Bowen, et al.
Pubblicazione: (2024) -
LegalDuet: Learning Fine-grained Representations for Legal Judgment Prediction via a Dual-View Contrastive Learning
di: Xu, Buqiang, et al.
Pubblicazione: (2024) -
Monocle: Hybrid Local-Global In-Context Evaluation for Long-Text Generation with Uncertainty-Based Active Learning
di: Wang, Xiaorong, et al.
Pubblicazione: (2025) -
RAGEval: Scenario Specific RAG Evaluation Dataset Generation Framework
di: Zhu, Kunlun, et al.
Pubblicazione: (2024)