BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
Fuente:
arXiv
Saved in:
| Main Authors: | Dong, Guosheng, Pan, Da, Sun, Yiding, Zhang, Shusen, Liang, Zheng, Wu, Xin, Shen, Yanjun, Yang, Fan, Sun, Haoze, Li, Tianpeng, Lin, Mingan, Xu, Jianhua, Zhang, Yufan, Nie, Xiaonan, Su, Lei, Wang, Bingning, Zhang, Wentao, Mao, Jiaxin, Zhou, Zenan, Chen, Weipeng |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
by: Li, Tianpeng, et al.
Published: (2025)
by: Li, Tianpeng, et al.
Published: (2025)
Baichuan Alignment Technical Report
by: Lin, Mingan, et al.
Published: (2024)
by: Lin, Mingan, et al.
Published: (2024)
Baichuan-Omni Technical Report
by: Li, Yadong, et al.
Published: (2024)
by: Li, Yadong, et al.
Published: (2024)
Baichuan 2: Open Large-scale Language Models
by: Yang, Aiyuan, et al.
Published: (2023)
by: Yang, Aiyuan, et al.
Published: (2023)
PAS: Data-Efficient Plug-and-Play Prompt Augmentation System
by: Zheng, Miao, et al.
Published: (2024)
by: Zheng, Miao, et al.
Published: (2024)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
by: Chen, Mingyang, et al.
Published: (2024)
by: Chen, Mingyang, et al.
Published: (2024)
DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning
by: Lu, Keer, et al.
Published: (2024)
by: Lu, Keer, et al.
Published: (2024)
Baichuan-Omni-1.5 Technical Report
by: Li, Yadong, et al.
Published: (2025)
by: Li, Yadong, et al.
Published: (2025)
MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts
by: Liang, Hao, et al.
Published: (2024)
by: Liang, Hao, et al.
Published: (2024)
SysBench: Can Large Language Models Follow System Messages?
by: Qin, Yanzhao, et al.
Published: (2024)
by: Qin, Yanzhao, et al.
Published: (2024)
Baichuan-M2: Scaling Medical Capability with Large Verifier System
by: M2 Team, et al.
Published: (2025)
by: M2 Team, et al.
Published: (2025)
Baichuan-M1: Pushing the Medical Capability of Large Language Models
by: Wang, Bingning, et al.
Published: (2025)
by: Wang, Bingning, et al.
Published: (2025)
CFBench: A Comprehensive Constraints-Following Benchmark for LLMs
by: Zhang, Tao, et al.
Published: (2024)
by: Zhang, Tao, et al.
Published: (2024)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
by: Li, Youquan, et al.
Published: (2024)
by: Li, Youquan, et al.
Published: (2024)
Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making
by: M3 Team, et al.
Published: (2026)
by: M3 Team, et al.
Published: (2026)
S2SBench: A Benchmark for Quantifying Intelligence Degradation in Speech-to-Speech Large Language Models
by: Fang, Yuanbo, et al.
Published: (2025)
by: Fang, Yuanbo, et al.
Published: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
by: Chen, Mingyang, et al.
Published: (2025)
by: Chen, Mingyang, et al.
Published: (2025)
MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification
by: Sun, Linzhuang, et al.
Published: (2025)
by: Sun, Linzhuang, et al.
Published: (2025)
Baichuan4-Finance Technical Report
by: Zhang, Hanyu, et al.
Published: (2024)
by: Zhang, Hanyu, et al.
Published: (2024)
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
by: Zhao, Yaqi, et al.
Published: (2024)
by: Zhao, Yaqi, et al.
Published: (2024)
Ocean-OCR: Towards General OCR Application via a Vision-Language Model
by: Chen, Song, et al.
Published: (2025)
by: Chen, Song, et al.
Published: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
by: Liu, Han, et al.
Published: (2024)
by: Liu, Han, et al.
Published: (2024)
K12Vista: Exploring the Boundaries of MLLMs in K-12 Education
by: Li, Chong, et al.
Published: (2025)
by: Li, Chong, et al.
Published: (2025)
EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique
by: Zhu, Chenglin, et al.
Published: (2025)
by: Zhu, Chenglin, et al.
Published: (2025)
MetaGPT: Merging Large Language Models Using Model Exclusive Task Arithmetic
by: Zhou, Yuyan, et al.
Published: (2024)
by: Zhou, Yuyan, et al.
Published: (2024)
KV Shifting Attention Enhances Language Modeling
by: Xu, Mingyu, et al.
Published: (2024)
by: Xu, Mingyu, et al.
Published: (2024)
Baichuan2-Sum: Instruction Finetune Baichuan2-7B Model for Dialogue Summarization
by: Xiao, Jianfei, et al.
Published: (2024)
by: Xiao, Jianfei, et al.
Published: (2024)
Data Proportion Detection for Optimized Data Management for Large Language Models
by: Liang, Hao, et al.
Published: (2024)
by: Liang, Hao, et al.
Published: (2024)
Alzheimer's Disease Common Data Element Ontology for Clinical Trials (AD-CDO)
by: Sun, Zenan
Published: (2026)
by: Sun, Zenan
Published: (2026)
Complex Dynamical Analysis of Two Prey‐One Predator Model in a Patch Environment Utilizing Spectral Bound
by: Min Zhang, et al.
Published: (2025)
by: Min Zhang, et al.
Published: (2025)
Synthesis of Bishomocubanone Derivatives via Visible‐Light‐Induced Intramolecular [2+2] Cycloaddition Reaction
by: Bingning Yan, et al.
Published: (2025)
by: Bingning Yan, et al.
Published: (2025)
Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine
by: Lu, Keer, et al.
Published: (2025)
by: Lu, Keer, et al.
Published: (2025)
BugLens: Leveraging Bisection for Lightweight Compiler Bug Deduplication
by: Zhou, Xintong, et al.
Published: (2025)
by: Zhou, Xintong, et al.
Published: (2025)
Stack Trace-Based Crash Deduplication with Transformer Adaptation
by: Mamun, Md Afif Al, et al.
Published: (2025)
by: Mamun, Md Afif Al, et al.
Published: (2025)
Base of RoPE Bounds Context Length
by: Men, Xin, et al.
Published: (2024)
by: Men, Xin, et al.
Published: (2024)
Unveiling the Flaws: Exploring Imperfections in Synthetic Data and Mitigation Strategies for Large Language Models
by: Chen, Jie, et al.
Published: (2024)
by: Chen, Jie, et al.
Published: (2024)
Regression Analysis of the Generalized Accelerated Hazards Models With Interval‐Censored Data Under Case‐Cohort Studies
by: Haiyu Niu, et al.
Published: (2024)
by: Haiyu Niu, et al.
Published: (2024)
Piecewise constant tuning gain based singularity-free MRAC with application to aircraft control systems
by: Zhang, Zhipeng, et al.
Published: (2024)
by: Zhang, Zhipeng, et al.
Published: (2024)
VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs
by: Lu, Keer, et al.
Published: (2024)
by: Lu, Keer, et al.
Published: (2024)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
by: Zhang, Jiaxu, et al.
Published: (2025)
by: Zhang, Jiaxu, et al.
Published: (2025)
Similar Items
-
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
by: Li, Tianpeng, et al.
Published: (2025) -
Baichuan Alignment Technical Report
by: Lin, Mingan, et al.
Published: (2024) -
Baichuan-Omni Technical Report
by: Li, Yadong, et al.
Published: (2024) -
Baichuan 2: Open Large-scale Language Models
by: Yang, Aiyuan, et al.
Published: (2023) -
PAS: Data-Efficient Plug-and-Play Prompt Augmentation System
by: Zheng, Miao, et al.
Published: (2024)