BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dong, Guosheng, Pan, Da, Sun, Yiding, Zhang, Shusen, Liang, Zheng, Wu, Xin, Shen, Yanjun, Yang, Fan, Sun, Haoze, Li, Tianpeng, Lin, Mingan, Xu, Jianhua, Zhang, Yufan, Nie, Xiaonan, Su, Lei, Wang, Bingning, Zhang, Wentao, Mao, Jiaxin, Zhou, Zenan, Chen, Weipeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
par: Li, Tianpeng, et autres
Publié: (2025)
par: Li, Tianpeng, et autres
Publié: (2025)
Baichuan Alignment Technical Report
par: Lin, Mingan, et autres
Publié: (2024)
par: Lin, Mingan, et autres
Publié: (2024)
Baichuan-Omni Technical Report
par: Li, Yadong, et autres
Publié: (2024)
par: Li, Yadong, et autres
Publié: (2024)
Baichuan 2: Open Large-scale Language Models
par: Yang, Aiyuan, et autres
Publié: (2023)
par: Yang, Aiyuan, et autres
Publié: (2023)
PAS: Data-Efficient Plug-and-Play Prompt Augmentation System
par: Zheng, Miao, et autres
Publié: (2024)
par: Zheng, Miao, et autres
Publié: (2024)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
par: Chen, Mingyang, et autres
Publié: (2024)
par: Chen, Mingyang, et autres
Publié: (2024)
DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning
par: Lu, Keer, et autres
Publié: (2024)
par: Lu, Keer, et autres
Publié: (2024)
Baichuan-Omni-1.5 Technical Report
par: Li, Yadong, et autres
Publié: (2025)
par: Li, Yadong, et autres
Publié: (2025)
MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts
par: Liang, Hao, et autres
Publié: (2024)
par: Liang, Hao, et autres
Publié: (2024)
SysBench: Can Large Language Models Follow System Messages?
par: Qin, Yanzhao, et autres
Publié: (2024)
par: Qin, Yanzhao, et autres
Publié: (2024)
Baichuan-M2: Scaling Medical Capability with Large Verifier System
par: M2 Team, et autres
Publié: (2025)
par: M2 Team, et autres
Publié: (2025)
Baichuan-M1: Pushing the Medical Capability of Large Language Models
par: Wang, Bingning, et autres
Publié: (2025)
par: Wang, Bingning, et autres
Publié: (2025)
CFBench: A Comprehensive Constraints-Following Benchmark for LLMs
par: Zhang, Tao, et autres
Publié: (2024)
par: Zhang, Tao, et autres
Publié: (2024)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
par: Li, Youquan, et autres
Publié: (2024)
par: Li, Youquan, et autres
Publié: (2024)
Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making
par: M3 Team, et autres
Publié: (2026)
par: M3 Team, et autres
Publié: (2026)
S2SBench: A Benchmark for Quantifying Intelligence Degradation in Speech-to-Speech Large Language Models
par: Fang, Yuanbo, et autres
Publié: (2025)
par: Fang, Yuanbo, et autres
Publié: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
par: Chen, Mingyang, et autres
Publié: (2025)
par: Chen, Mingyang, et autres
Publié: (2025)
MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification
par: Sun, Linzhuang, et autres
Publié: (2025)
par: Sun, Linzhuang, et autres
Publié: (2025)
Baichuan4-Finance Technical Report
par: Zhang, Hanyu, et autres
Publié: (2024)
par: Zhang, Hanyu, et autres
Publié: (2024)
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
par: Zhao, Yaqi, et autres
Publié: (2024)
par: Zhao, Yaqi, et autres
Publié: (2024)
Ocean-OCR: Towards General OCR Application via a Vision-Language Model
par: Chen, Song, et autres
Publié: (2025)
par: Chen, Song, et autres
Publié: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
par: Liu, Han, et autres
Publié: (2024)
par: Liu, Han, et autres
Publié: (2024)
K12Vista: Exploring the Boundaries of MLLMs in K-12 Education
par: Li, Chong, et autres
Publié: (2025)
par: Li, Chong, et autres
Publié: (2025)
EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique
par: Zhu, Chenglin, et autres
Publié: (2025)
par: Zhu, Chenglin, et autres
Publié: (2025)
MetaGPT: Merging Large Language Models Using Model Exclusive Task Arithmetic
par: Zhou, Yuyan, et autres
Publié: (2024)
par: Zhou, Yuyan, et autres
Publié: (2024)
KV Shifting Attention Enhances Language Modeling
par: Xu, Mingyu, et autres
Publié: (2024)
par: Xu, Mingyu, et autres
Publié: (2024)
Baichuan2-Sum: Instruction Finetune Baichuan2-7B Model for Dialogue Summarization
par: Xiao, Jianfei, et autres
Publié: (2024)
par: Xiao, Jianfei, et autres
Publié: (2024)
Data Proportion Detection for Optimized Data Management for Large Language Models
par: Liang, Hao, et autres
Publié: (2024)
par: Liang, Hao, et autres
Publié: (2024)
Alzheimer's Disease Common Data Element Ontology for Clinical Trials (AD-CDO)
par: Sun, Zenan
Publié: (2026)
par: Sun, Zenan
Publié: (2026)
Complex Dynamical Analysis of Two Prey‐One Predator Model in a Patch Environment Utilizing Spectral Bound
par: Min Zhang, et autres
Publié: (2025)
par: Min Zhang, et autres
Publié: (2025)
Synthesis of Bishomocubanone Derivatives via Visible‐Light‐Induced Intramolecular [2+2] Cycloaddition Reaction
par: Bingning Yan, et autres
Publié: (2025)
par: Bingning Yan, et autres
Publié: (2025)
Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine
par: Lu, Keer, et autres
Publié: (2025)
par: Lu, Keer, et autres
Publié: (2025)
BugLens: Leveraging Bisection for Lightweight Compiler Bug Deduplication
par: Zhou, Xintong, et autres
Publié: (2025)
par: Zhou, Xintong, et autres
Publié: (2025)
Stack Trace-Based Crash Deduplication with Transformer Adaptation
par: Mamun, Md Afif Al, et autres
Publié: (2025)
par: Mamun, Md Afif Al, et autres
Publié: (2025)
Base of RoPE Bounds Context Length
par: Men, Xin, et autres
Publié: (2024)
par: Men, Xin, et autres
Publié: (2024)
Unveiling the Flaws: Exploring Imperfections in Synthetic Data and Mitigation Strategies for Large Language Models
par: Chen, Jie, et autres
Publié: (2024)
par: Chen, Jie, et autres
Publié: (2024)
Regression Analysis of the Generalized Accelerated Hazards Models With Interval‐Censored Data Under Case‐Cohort Studies
par: Haiyu Niu, et autres
Publié: (2024)
par: Haiyu Niu, et autres
Publié: (2024)
Piecewise constant tuning gain based singularity-free MRAC with application to aircraft control systems
par: Zhang, Zhipeng, et autres
Publié: (2024)
par: Zhang, Zhipeng, et autres
Publié: (2024)
VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs
par: Lu, Keer, et autres
Publié: (2024)
par: Lu, Keer, et autres
Publié: (2024)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
par: Zhang, Jiaxu, et autres
Publié: (2025)
par: Zhang, Jiaxu, et autres
Publié: (2025)
Documents similaires
-
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
par: Li, Tianpeng, et autres
Publié: (2025) -
Baichuan Alignment Technical Report
par: Lin, Mingan, et autres
Publié: (2024) -
Baichuan-Omni Technical Report
par: Li, Yadong, et autres
Publié: (2024) -
Baichuan 2: Open Large-scale Language Models
par: Yang, Aiyuan, et autres
Publié: (2023) -
PAS: Data-Efficient Plug-and-Play Prompt Augmentation System
par: Zheng, Miao, et autres
Publié: (2024)