Baichuan-Omni Technical Report
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yadong, Sun, Haoze, Lin, Mingan, Li, Tianpeng, Dong, Guosheng, Zhang, Tao, Ding, Bowen, Song, Wei, Cheng, Zhenglin, Huo, Yuqi, Chen, Song, Li, Xu, Pan, Da, Zhang, Shusen, Wu, Xin, Liang, Zheng, Liu, Jun, Lu, Keer, Zhao, Yaqi, Shen, Yanjun, Yang, Fan, Yu, Kaicheng, Lin, Tao, Xu, Jianhua, Zhou, Zenan, Chen, Weipeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
di: Li, Tianpeng, et al.
Pubblicazione: (2025)
di: Li, Tianpeng, et al.
Pubblicazione: (2025)
Baichuan Alignment Technical Report
di: Lin, Mingan, et al.
Pubblicazione: (2024)
di: Lin, Mingan, et al.
Pubblicazione: (2024)
Baichuan-Omni-1.5 Technical Report
di: Li, Yadong, et al.
Pubblicazione: (2025)
di: Li, Yadong, et al.
Pubblicazione: (2025)
BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
di: Dong, Guosheng, et al.
Pubblicazione: (2024)
di: Dong, Guosheng, et al.
Pubblicazione: (2024)
Ocean-OCR: Towards General OCR Application via a Vision-Language Model
di: Chen, Song, et al.
Pubblicazione: (2025)
di: Chen, Song, et al.
Pubblicazione: (2025)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
di: Chen, Mingyang, et al.
Pubblicazione: (2024)
di: Chen, Mingyang, et al.
Pubblicazione: (2024)
PAS: Data-Efficient Plug-and-Play Prompt Augmentation System
di: Zheng, Miao, et al.
Pubblicazione: (2024)
di: Zheng, Miao, et al.
Pubblicazione: (2024)
Baichuan 2: Open Large-scale Language Models
di: Yang, Aiyuan, et al.
Pubblicazione: (2023)
di: Yang, Aiyuan, et al.
Pubblicazione: (2023)
K12Vista: Exploring the Boundaries of MLLMs in K-12 Education
di: Li, Chong, et al.
Pubblicazione: (2025)
di: Li, Chong, et al.
Pubblicazione: (2025)
EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique
di: Zhu, Chenglin, et al.
Pubblicazione: (2025)
di: Zhu, Chenglin, et al.
Pubblicazione: (2025)
CFBench: A Comprehensive Constraints-Following Benchmark for LLMs
di: Zhang, Tao, et al.
Pubblicazione: (2024)
di: Zhang, Tao, et al.
Pubblicazione: (2024)
DualToken: Towards Unifying Visual Understanding and Generation with Dual Visual Vocabularies
di: Song, Wei, et al.
Pubblicazione: (2025)
di: Song, Wei, et al.
Pubblicazione: (2025)
Beyond Sight: Towards Cognitive Alignment in LVLM via Enriched Visual Knowledge
di: Zhao, Yaqi, et al.
Pubblicazione: (2024)
di: Zhao, Yaqi, et al.
Pubblicazione: (2024)
S2SBench: A Benchmark for Quantifying Intelligence Degradation in Speech-to-Speech Large Language Models
di: Fang, Yuanbo, et al.
Pubblicazione: (2025)
di: Fang, Yuanbo, et al.
Pubblicazione: (2025)
DataSculpt: Crafting Data Landscapes for Long-Context LLMs through Multi-Objective Partitioning
di: Lu, Keer, et al.
Pubblicazione: (2024)
di: Lu, Keer, et al.
Pubblicazione: (2024)
SysBench: Can Large Language Models Follow System Messages?
di: Qin, Yanzhao, et al.
Pubblicazione: (2024)
di: Qin, Yanzhao, et al.
Pubblicazione: (2024)
MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts
di: Liang, Hao, et al.
Pubblicazione: (2024)
di: Liang, Hao, et al.
Pubblicazione: (2024)
Baichuan-M1: Pushing the Medical Capability of Large Language Models
di: Wang, Bingning, et al.
Pubblicazione: (2025)
di: Wang, Bingning, et al.
Pubblicazione: (2025)
Baichuan-M2: Scaling Medical Capability with Large Verifier System
di: M2 Team, et al.
Pubblicazione: (2025)
di: M2 Team, et al.
Pubblicazione: (2025)
TwinFlow: Realizing One-step Generation on Large Models with Self-adversarial Flows
di: Cheng, Zhenglin, et al.
Pubblicazione: (2025)
di: Cheng, Zhenglin, et al.
Pubblicazione: (2025)
MetricHMSR:Metric Human Mesh and Scene Recovery from Monocular Images
di: Song, Chentao, et al.
Pubblicazione: (2025)
di: Song, Chentao, et al.
Pubblicazione: (2025)
Baichuan4-Finance Technical Report
di: Zhang, Hanyu, et al.
Pubblicazione: (2024)
di: Zhang, Hanyu, et al.
Pubblicazione: (2024)
Bridging Your Imagination with Audio-Video Generation via a Unified Director
di: Zhang, Jiaxu, et al.
Pubblicazione: (2025)
di: Zhang, Jiaxu, et al.
Pubblicazione: (2025)
OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model
di: Li, Maomao, et al.
Pubblicazione: (2026)
di: Li, Maomao, et al.
Pubblicazione: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making
di: M3 Team, et al.
Pubblicazione: (2026)
di: M3 Team, et al.
Pubblicazione: (2026)
FB-Bench: A Fine-Grained Multi-Task Benchmark for Evaluating LLMs' Responsiveness to Human Feedback
di: Li, Youquan, et al.
Pubblicazione: (2024)
di: Li, Youquan, et al.
Pubblicazione: (2024)
Spatial Computing Communications for Multi-User Virtual Reality in Distributed Mobile Edge Computing Network
di: Xu, Caolu, et al.
Pubblicazione: (2025)
di: Xu, Caolu, et al.
Pubblicazione: (2025)
OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation
di: Lin, Yuchen, et al.
Pubblicazione: (2025)
di: Lin, Yuchen, et al.
Pubblicazione: (2025)
Frenet Immersed Finite Element Spaces on Triangular Meshes
di: Lin, Yuanhui, et al.
Pubblicazione: (2025)
di: Lin, Yuanhui, et al.
Pubblicazione: (2025)
The optical conductivity of the 2D $t-J$ model and the origin of electron incoherence in the high-T$_{c}$ cuprate superconductors: a variational study
di: Yang, Jianhua, et al.
Pubblicazione: (2023)
di: Yang, Jianhua, et al.
Pubblicazione: (2023)
Strong relevance of Zinc impurity in the spin-$\frac{1}{2}$ Kagome quantum antiferromagnets: a variational study
di: Yang, Jianhua, et al.
Pubblicazione: (2023)
di: Yang, Jianhua, et al.
Pubblicazione: (2023)
A tale of two pairs: on the origin of the pseudogap end point in the high-T$_{c}$ cuprate superconductors
di: Yang, Jianhua, et al.
Pubblicazione: (2024)
di: Yang, Jianhua, et al.
Pubblicazione: (2024)
Instability of the $U(1)$ spin liquid with a large spinon Fermi surface in the Heisenberg-ring exchange model on the triangular lattice
di: Yang, Jianhua, et al.
Pubblicazione: (2023)
di: Yang, Jianhua, et al.
Pubblicazione: (2023)
Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine
di: Lu, Keer, et al.
Pubblicazione: (2025)
di: Lu, Keer, et al.
Pubblicazione: (2025)
Megrez-Omni Technical Report
di: Li, Boxun, et al.
Pubblicazione: (2025)
di: Li, Boxun, et al.
Pubblicazione: (2025)
Molecular Landscape and Predictive Significance of Programmed Cell Death‐Related Genes in Sepsis
di: Shiqiang Min, et al.
Pubblicazione: (2026)
di: Shiqiang Min, et al.
Pubblicazione: (2026)
Baichuan2-Sum: Instruction Finetune Baichuan2-7B Model for Dialogue Summarization
di: Xiao, Jianfei, et al.
Pubblicazione: (2024)
di: Xiao, Jianfei, et al.
Pubblicazione: (2024)
GMem: A Modular Approach for Ultra-Efficient Generative Models
di: Tang, Yi, et al.
Pubblicazione: (2024)
di: Tang, Yi, et al.
Pubblicazione: (2024)
Domain-Adaptive Communication-Rate Optimization for Sim-to-Real Humanoid-Robot Wireless XR Teleoperation
di: Xu, Caolu, et al.
Pubblicazione: (2026)
di: Xu, Caolu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Baichuan-Audio: A Unified Framework for End-to-End Speech Interaction
di: Li, Tianpeng, et al.
Pubblicazione: (2025) -
Baichuan Alignment Technical Report
di: Lin, Mingan, et al.
Pubblicazione: (2024) -
Baichuan-Omni-1.5 Technical Report
di: Li, Yadong, et al.
Pubblicazione: (2025) -
BaichuanSEED: Sharing the Potential of ExtensivE Data Collection and Deduplication by Introducing a Competitive Large Language Model Baseline
di: Dong, Guosheng, et al.
Pubblicazione: (2024) -
Ocean-OCR: Towards General OCR Application via a Vision-Language Model
di: Chen, Song, et al.
Pubblicazione: (2025)