SAIL-Embedding Technical Report: Omni-modal Embedding Foundation Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Lin, Long, Jiefeng, Wan, Zhihe, Wang, Yuchi, Yang, Dingkang, Yang, Shuang, Yao, Yueyang, Chen, Xu, Guo, Zirui, Li, Shengqiang, Li, Weiran, Li, Hanyu, Mou, Yaling, Qiu, Yan, Yu, Haiyang, Liang, Xiao, Li, Hongsheng, Feng, Chao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MMEmb-R1: Reasoning-Enhanced Multimodal Embedding with Pair-Aware Selection and Adaptive Control
par: Wang, Yuchi, et autres
Publié: (2026)
par: Wang, Yuchi, et autres
Publié: (2026)
SAIL-VL2 Technical Report
par: Yin, Weijie, et autres
Publié: (2025)
par: Yin, Weijie, et autres
Publié: (2025)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
par: Zhang, Yanzhao, et autres
Publié: (2025)
par: Zhang, Yanzhao, et autres
Publié: (2025)
Megrez-Omni Technical Report
par: Li, Boxun, et autres
Publié: (2025)
par: Li, Boxun, et autres
Publié: (2025)
e5-omni: Explicit Cross-modal Alignment for Omni-modal Embeddings
par: Chen, Haonan, et autres
Publié: (2026)
par: Chen, Haonan, et autres
Publié: (2026)
HOMIE: Histopathology Omni-modal Embedding for Pathology Composed Retrieval
par: Zhou, Qifeng, et autres
Publié: (2025)
par: Zhou, Qifeng, et autres
Publié: (2025)
Interfacing Foundation Models' Embeddings
par: Zou, Xueyan, et autres
Publié: (2023)
par: Zou, Xueyan, et autres
Publié: (2023)
Baichuan-Omni Technical Report
par: Li, Yadong, et autres
Publié: (2024)
par: Li, Yadong, et autres
Publié: (2024)
OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
par: Xi, Dianbing, et autres
Publié: (2025)
par: Xi, Dianbing, et autres
Publié: (2025)
OmniSelect: Dynamic Modality-Aware Token Compression for Efficient Omni-modal Large Language Models
par: Yang, Morunliu, et autres
Publié: (2026)
par: Yang, Morunliu, et autres
Publié: (2026)
ThinkOmni: Lifting Textual Reasoning to Omni-modal Scenarios via Guidance Decoding
par: Guan, Yiran, et autres
Publié: (2026)
par: Guan, Yiran, et autres
Publié: (2026)
OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models
par: Ding, Yue, et autres
Publié: (2026)
par: Ding, Yue, et autres
Publié: (2026)
Kling-Omni Technical Report
par: Kling Team, et autres
Publié: (2025)
par: Kling Team, et autres
Publié: (2025)
Logics-Parsing-Omni Technical Report
par: An, Xin, et autres
Publié: (2026)
par: An, Xin, et autres
Publié: (2026)
L-CLIPScore: a Lightweight Embedding-based Captioning Metric for Evaluating and Training
par: Li, Li, et autres
Publié: (2025)
par: Li, Li, et autres
Publié: (2025)
Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle
par: Liu, Keliang, et autres
Publié: (2025)
par: Liu, Keliang, et autres
Publié: (2025)
LIVE: Learnable Monotonic Vertex Embedding for Efficient Exact Subgraph Matching (Technical Report)
par: Ye, Yutong, et autres
Publié: (2026)
par: Ye, Yutong, et autres
Publié: (2026)
OmniFysics: Towards Physical Intelligence Evolution via Omni-Modal Signal Processing and Network Optimization
par: Han, Minghao, et autres
Publié: (2026)
par: Han, Minghao, et autres
Publié: (2026)
SAIL: Scene-aware Adaptive Iterative Learning for Long-Tail Trajectory Prediction in Autonomous Vehicles
par: Rao, Bin, et autres
Publié: (2026)
par: Rao, Bin, et autres
Publié: (2026)
UNO-Bench: A Unified Benchmark for Exploring the Compositional Law Between Uni-modal and Omni-modal in Omni Models
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
DanmakuTPPBench: A Multi-modal Benchmark for Temporal Point Process Modeling and Understanding
par: Jiang, Yue, et autres
Publié: (2025)
par: Jiang, Yue, et autres
Publié: (2025)
EmbedGenius: Towards Automated Software Development for Generic Embedded IoT Systems
par: Yang, Huanqi, et autres
Publié: (2024)
par: Yang, Huanqi, et autres
Publié: (2024)
AnyCap Project: A Unified Framework, Dataset, and Benchmark for Controllable Omni-modal Captioning
par: Ren, Yiming, et autres
Publié: (2025)
par: Ren, Yiming, et autres
Publié: (2025)
DocMMIR: A Framework for Document Multi-modal Information Retrieval
par: Li, Zirui, et autres
Publié: (2025)
par: Li, Zirui, et autres
Publié: (2025)
Context Unrolling in Omni Models
par: Yang, Ceyuan, et autres
Publié: (2026)
par: Yang, Ceyuan, et autres
Publié: (2026)
Letter: Incidence and Predictors of Major Gastrointestinal Bleeding in Patients on Aspirin, Low‐Dose Rivaroxaban or the Combination: Secondary Analysis of the COMPASS Randomised Controlled Trial
par: Yu Yang, et autres
Publié: (2024)
par: Yu Yang, et autres
Publié: (2024)
Explore the Limits of Omni-modal Pretraining at Scale
par: Zhang, Yiyuan, et autres
Publié: (2024)
par: Zhang, Yiyuan, et autres
Publié: (2024)
Baichuan-Omni-1.5 Technical Report
par: Li, Yadong, et autres
Publié: (2025)
par: Li, Yadong, et autres
Publié: (2025)
Pixel-SAIL: Single Transformer For Pixel-Grounded Understanding
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
MAGMaR Shared Task System Description: Video Retrieval with OmniEmbed
par: Zhan, Jiaqi Samantha, et autres
Publié: (2025)
par: Zhan, Jiaqi Samantha, et autres
Publié: (2025)
Embedded Majorana Islands
par: Hou, Jin-Xing, et autres
Publié: (2024)
par: Hou, Jin-Xing, et autres
Publié: (2024)
OmniGenBench: Automating Large-scale in-silico Benchmarking for Genomic Foundation Models
par: Yang, Heng, et autres
Publié: (2024)
par: Yang, Heng, et autres
Publié: (2024)
OCGEC: One-class Graph Embedding Classification for DNN Backdoor Detection
par: Jiang, Haoyu, et autres
Publié: (2023)
par: Jiang, Haoyu, et autres
Publié: (2023)
TimeWalker: Personalized Neural Space for Lifelong Head Avatars
par: Pan, Dongwei, et autres
Publié: (2024)
par: Pan, Dongwei, et autres
Publié: (2024)
LongCat-Flash-Omni Technical Report
par: Meituan LongCat Team, et autres
Publié: (2025)
par: Meituan LongCat Team, et autres
Publié: (2025)
Revealing the Numeracy Gap: An Empirical Investigation of Text Embedding Models
par: Deng, Ningyuan, et autres
Publié: (2025)
par: Deng, Ningyuan, et autres
Publié: (2025)
HiT-JEPA: A Hierarchical Self-supervised Trajectory Embedding Framework for Similarity Computation
par: Li, Lihuan, et autres
Publié: (2025)
par: Li, Lihuan, et autres
Publié: (2025)
OmniGenBench: A Modular Platform for Reproducible Genomic Foundation Models Benchmarking
par: Yang, Heng, et autres
Publié: (2025)
par: Yang, Heng, et autres
Publié: (2025)
InteractiveOmni: A Unified Omni-modal Model for Audio-Visual Multi-turn Dialogue
par: Tong, Wenwen, et autres
Publié: (2025)
par: Tong, Wenwen, et autres
Publié: (2025)
Omni-Embed-Audio: Leveraging Multimodal LLMs for Robust Audio-Text Retrieval
par: Yoo, HaeJun, et autres
Publié: (2026)
par: Yoo, HaeJun, et autres
Publié: (2026)
Documents similaires
-
MMEmb-R1: Reasoning-Enhanced Multimodal Embedding with Pair-Aware Selection and Adaptive Control
par: Wang, Yuchi, et autres
Publié: (2026) -
SAIL-VL2 Technical Report
par: Yin, Weijie, et autres
Publié: (2025) -
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
par: Zhang, Yanzhao, et autres
Publié: (2025) -
Megrez-Omni Technical Report
par: Li, Boxun, et autres
Publié: (2025) -
e5-omni: Explicit Cross-modal Alignment for Omni-modal Embeddings
par: Chen, Haonan, et autres
Publié: (2026)