Baichuan-Omni Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Yadong, Sun, Haoze, Lin, Mingan, Li, Tianpeng, Dong, Guosheng, Zhang, Tao, Ding, Bowen, Song, Wei, Cheng, Zhenglin, Huo, Yuqi, Chen, Song, Li, Xu, Pan, Da, Zhang, Shusen, Wu, Xin, Liang, Zheng, Liu, Jun, Lu, Keer, Zhao, Yaqi, Shen, Yanjun, Yang, Fan, Yu, Kaicheng, Lin, Tao, Xu, Jianhua, Zhou, Zenan, Chen, Weipeng |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
by: Li, Tianpeng, et al.
Published: (2025)
by: Li, Tianpeng, et al.
Published: (2025)
Baichuan Alignment Technical Report
by: Lin, Mingan, et al.
Published: (2024)
by: Lin, Mingan, et al.
Published: (2024)
Baichuan-Omni-1.5 Technical Report
by: Li, Yadong, et al.
Published: (2025)
by: Li, Yadong, et al.
Published: (2025)
BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
by: Dong, Guosheng, et al.
Published: (2024)
by: Dong, Guosheng, et al.
Published: (2024)
Ocean-OCR: Towards General OCR Application via a Vision-Language Model
by: Chen, Song, et al.
Published: (2025)
by: Chen, Song, et al.
Published: (2025)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
by: Chen, Mingyang, et al.
Published: (2024)
by: Chen, Mingyang, et al.
Published: (2024)
PAS: Data-Efficient Plug-and-Play Prompt Augmentation System
by: Zheng, Miao, et al.
Published: (2024)
by: Zheng, Miao, et al.
Published: (2024)
Baichuan 2: Open Large-scale Language Models
by: Yang, Aiyuan, et al.
Published: (2023)
by: Yang, Aiyuan, et al.
Published: (2023)
K12Vista: Exploring the Boundaries of MLLMs in K-12 Education
by: Li, Chong, et al.
Published: (2025)
by: Li, Chong, et al.
Published: (2025)
EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique
by: Zhu, Chenglin, et al.
Published: (2025)
by: Zhu, Chenglin, et al.
Published: (2025)
CFBench: A Comprehensive Constraints-Following Benchmark for LLMs
by: Zhang, Tao, et al.
Published: (2024)
by: Zhang, Tao, et al.
Published: (2024)
DualToken: Towards Unifying Visual Understanding and Generation with Dual Visual Vocabularies
by: Song, Wei, et al.
Published: (2025)
by: Song, Wei, et al.
Published: (2025)
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
by: Zhao, Yaqi, et al.
Published: (2024)
by: Zhao, Yaqi, et al.
Published: (2024)
S2SBench: A Benchmark for Quantifying Intelligence Degradation in Speech-to-Speech Large Language Models
by: Fang, Yuanbo, et al.
Published: (2025)
by: Fang, Yuanbo, et al.
Published: (2025)
DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning
by: Lu, Keer, et al.
Published: (2024)
by: Lu, Keer, et al.
Published: (2024)
SysBench: Can Large Language Models Follow System Messages?
by: Qin, Yanzhao, et al.
Published: (2024)
by: Qin, Yanzhao, et al.
Published: (2024)
MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts
by: Liang, Hao, et al.
Published: (2024)
by: Liang, Hao, et al.
Published: (2024)
Baichuan-M1: Pushing the Medical Capability of Large Language Models
by: Wang, Bingning, et al.
Published: (2025)
by: Wang, Bingning, et al.
Published: (2025)
Baichuan-M2: Scaling Medical Capability with Large Verifier System
by: M2 Team, et al.
Published: (2025)
by: M2 Team, et al.
Published: (2025)
TwinFlow: Realizing One-step Generation on Large Models with Self-adversarial Flows
by: Cheng, Zhenglin, et al.
Published: (2025)
by: Cheng, Zhenglin, et al.
Published: (2025)
MetricHMSR:Metric Human Mesh and Scene Recovery from Monocular Images
by: Song, Chentao, et al.
Published: (2025)
by: Song, Chentao, et al.
Published: (2025)
Baichuan4-Finance Technical Report
by: Zhang, Hanyu, et al.
Published: (2024)
by: Zhang, Hanyu, et al.
Published: (2024)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
by: Zhang, Jiaxu, et al.
Published: (2025)
by: Zhang, Jiaxu, et al.
Published: (2025)
OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model
by: Li, Maomao, et al.
Published: (2026)
by: Li, Maomao, et al.
Published: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
by: Chen, Mingyang, et al.
Published: (2025)
by: Chen, Mingyang, et al.
Published: (2025)
Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making
by: M3 Team, et al.
Published: (2026)
by: M3 Team, et al.
Published: (2026)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
by: Li, Youquan, et al.
Published: (2024)
by: Li, Youquan, et al.
Published: (2024)
Spatial Computing Communications for Multi-User Virtual Reality in Distributed Mobile Edge Computing Network
by: Xu, Caolu, et al.
Published: (2025)
by: Xu, Caolu, et al.
Published: (2025)
OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation
by: Lin, Yuchen, et al.
Published: (2025)
by: Lin, Yuchen, et al.
Published: (2025)
Frenet Immersed Finite Element Spaces on Triangular Meshes
by: Lin, Yuanhui, et al.
Published: (2025)
by: Lin, Yuanhui, et al.
Published: (2025)
The optical conductivity of the 2D $t-J$ model and the origin of electron incoherence in the high-T$_{c}$ cuprate superconductors: a variational study
by: Yang, Jianhua, et al.
Published: (2023)
by: Yang, Jianhua, et al.
Published: (2023)
Strong relevance of Zinc impurity in the spin-$\frac{1}{2}$ Kagome quantum antiferromagnets: a variational study
by: Yang, Jianhua, et al.
Published: (2023)
by: Yang, Jianhua, et al.
Published: (2023)
A tale of two pairs: on the origin of the pseudogap end point in the high-T$_{c}$ cuprate superconductors
by: Yang, Jianhua, et al.
Published: (2024)
by: Yang, Jianhua, et al.
Published: (2024)
Instability of the $U(1)$ spin liquid with a large spinon Fermi surface in the Heisenberg-ring exchange model on the triangular lattice
by: Yang, Jianhua, et al.
Published: (2023)
by: Yang, Jianhua, et al.
Published: (2023)
Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine
by: Lu, Keer, et al.
Published: (2025)
by: Lu, Keer, et al.
Published: (2025)
Megrez-Omni Technical Report
by: Li, Boxun, et al.
Published: (2025)
by: Li, Boxun, et al.
Published: (2025)
Molecular Landscape and Predictive Significance of Programmed Cell Death‐Related Genes in Sepsis
by: Shiqiang Min, et al.
Published: (2026)
by: Shiqiang Min, et al.
Published: (2026)
Baichuan2-Sum: Instruction Finetune Baichuan2-7B Model for Dialogue Summarization
by: Xiao, Jianfei, et al.
Published: (2024)
by: Xiao, Jianfei, et al.
Published: (2024)
GMem: A Modular Approach for Ultra-Efficient Generative Models
by: Tang, Yi, et al.
Published: (2024)
by: Tang, Yi, et al.
Published: (2024)
Domain-Adaptive Communication-Rate Optimization for Sim-to-Real Humanoid-Robot Wireless XR Teleoperation
by: Xu, Caolu, et al.
Published: (2026)
by: Xu, Caolu, et al.
Published: (2026)
Similar Items
-
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
by: Li, Tianpeng, et al.
Published: (2025) -
Baichuan Alignment Technical Report
by: Lin, Mingan, et al.
Published: (2024) -
Baichuan-Omni-1.5 Technical Report
by: Li, Yadong, et al.
Published: (2025) -
BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
by: Dong, Guosheng, et al.
Published: (2024) -
Ocean-OCR: Towards General OCR Application via a Vision-Language Model
by: Chen, Song, et al.
Published: (2025)