OneVision: An End-to-End Generative Framework for Multi-view E-commerce Vision Search
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zheng, Zexin, Dai, Huangyu, Mao, Lingtao, Sun, Xinyu, Liang, Zihan, Chen, Ben, Ding, Yuqing, Lei, Chenyi, Ou, Wenwu, Li, Han, Gai, Kun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
par: Sun, Xinyu, et autres
Publié: (2026)
par: Sun, Xinyu, et autres
Publié: (2026)
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
par: Mao, Lingtao, et autres
Publié: (2026)
par: Mao, Lingtao, et autres
Publié: (2026)
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
par: Nan, Xinyu, et autres
Publié: (2025)
par: Nan, Xinyu, et autres
Publié: (2025)
OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search
par: Chen, Ben, et autres
Publié: (2025)
par: Chen, Ben, et autres
Publié: (2025)
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
par: Ma, Yufei, et autres
Publié: (2026)
par: Ma, Yufei, et autres
Publié: (2026)
IG-Search: Step-Level Information Gain Rewards for Search-Augmented Reasoning
par: Liang, Zihan, et autres
Publié: (2026)
par: Liang, Zihan, et autres
Publié: (2026)
OneSug: The Unified End-to-End Generative Framework for E-commerce Query Suggestion
par: Guo, Xian, et autres
Publié: (2025)
par: Guo, Xian, et autres
Publié: (2025)
InfoGain-RAG: Boosting Retrieval-Augmented Generation via Document Information Gain-based Reranking and Filtering
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
H-PRM: A Pluggable Hotword Pre-Retrieval Module for Various Speech Recognition Systems
par: Dai, Huangyu, et autres
Publié: (2025)
par: Dai, Huangyu, et autres
Publié: (2025)
OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Framework
par: Chen, Ben, et autres
Publié: (2026)
par: Chen, Ben, et autres
Publié: (2026)
Towards Context-aware Reasoning-enhanced Generative Searching in E-commerce
par: Liu, Zhiding, et autres
Publié: (2025)
par: Liu, Zhiding, et autres
Publié: (2025)
Search-E1: Self-Distillation Drives Self-Evolution in Search-Augmented Reasoning
par: Liang, Zihan, et autres
Publié: (2026)
par: Liang, Zihan, et autres
Publié: (2026)
UniECS: Unified Multimodal E-Commerce Search Framework with Gated Cross-modal Fusion
par: Liang, Zihan, et autres
Publié: (2025)
par: Liang, Zihan, et autres
Publié: (2025)
Plan Before Search: Search Agents Need Plan
par: Qian, Zhipeng, et autres
Publié: (2026)
par: Qian, Zhipeng, et autres
Publié: (2026)
LLaVA-OneVision: Easy Visual Task Transfer
par: Li, Bo, et autres
Publié: (2024)
par: Li, Bo, et autres
Publié: (2024)
OneMall: One Architecture, More Scenarios -- End-to-End Generative Recommender Family at Kuaishou E-Commerce
par: Zhang, Kun, et autres
Publié: (2026)
par: Zhang, Kun, et autres
Publié: (2026)
LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training
par: An, Xiang, et autres
Publié: (2025)
par: An, Xiang, et autres
Publié: (2025)
LLaVA-OneVision-2: Towards Next-Generation Perceptual Intelligence
par: An, Xiang, et autres
Publié: (2026)
par: An, Xiang, et autres
Publié: (2026)
OneVision-Encoder: Codec-Aligned Sparsity as a Foundational Principle for Multimodal Intelligence
par: Tang, Feilong, et autres
Publié: (2026)
par: Tang, Feilong, et autres
Publié: (2026)
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
par: Li, Yupeng, et autres
Publié: (2026)
par: Li, Yupeng, et autres
Publié: (2026)
Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization
par: Jin, Yang, et autres
Publié: (2023)
par: Jin, Yang, et autres
Publié: (2023)
End-to-End Vision Tokenizer Tuning
par: Wang, Wenxuan, et autres
Publié: (2025)
par: Wang, Wenxuan, et autres
Publié: (2025)
Light-weight End-to-End Graph Interest Network for CTR Prediction in E-commerce Search
par: Peng, Pipi, et autres
Publié: (2024)
par: Peng, Pipi, et autres
Publié: (2024)
COINS: SemantiC Ids Enhanced COLd Item RepresentatioN for Click-through Rate Prediction in E-commerce Search
par: Zhao, Qihang, et autres
Publié: (2025)
par: Zhao, Qihang, et autres
Publié: (2025)
An End-to-End Multi-objective Ensemble Ranking Framework for Video Recommendation
par: He, Tiantian, et autres
Publié: (2025)
par: He, Tiantian, et autres
Publié: (2025)
Vision Transformers for End-to-End Vision-Based Quadrotor Obstacle Avoidance
par: Bhattacharya, Anish, et autres
Publié: (2024)
par: Bhattacharya, Anish, et autres
Publié: (2024)
MindDrive: An All-in-One Framework Bridging World Models and Vision-Language Model for End-to-End Autonomous Driving
par: Sun, Bin, et autres
Publié: (2025)
par: Sun, Bin, et autres
Publié: (2025)
End-Cloud Collaboration Framework for Advanced AI Customer Service in E-commerce
par: Teng, Liangyu, et autres
Publié: (2024)
par: Teng, Liangyu, et autres
Publié: (2024)
OCRVerse: Towards Holistic OCR in End-to-End Vision-Language Models
par: Zhong, Yufeng, et autres
Publié: (2026)
par: Zhong, Yufeng, et autres
Publié: (2026)
ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation
par: Fu, Haoyu, et autres
Publié: (2025)
par: Fu, Haoyu, et autres
Publié: (2025)
Vision without Images: End-to-End Computer Vision from Single Compressive Measurements
par: Pan, Fengpu, et autres
Publié: (2025)
par: Pan, Fengpu, et autres
Publié: (2025)
Training Multi-Image Vision Agents via End2End Reinforcement Learning
par: Dong, Chengqi, et autres
Publié: (2025)
par: Dong, Chengqi, et autres
Publié: (2025)
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
par: Qian, Zhipeng, et autres
Publié: (2026)
par: Qian, Zhipeng, et autres
Publié: (2026)
VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks
par: Wu, Jiannan, et autres
Publié: (2024)
par: Wu, Jiannan, et autres
Publié: (2024)
Visions of the End in Medieval Spain
par: Williams, John
Publié: (2018)
par: Williams, John
Publié: (2018)
Visions of the End in Medieval Spain
par: Williams, John, et autres
Publié: (2025)
par: Williams, John, et autres
Publié: (2025)
VLM-3D:End-to-End Vision-Language Models for Open-World 3D Perception
par: Chang, Fuhao, et autres
Publié: (2025)
par: Chang, Fuhao, et autres
Publié: (2025)
AIGQ: An End-to-End Hybrid Generative Architecture for E-commerce Query Recommendation
par: Xu, Jingcao, et autres
Publié: (2026)
par: Xu, Jingcao, et autres
Publié: (2026)
ViLaD: A Large Vision Language Diffusion Framework for End-to-End Autonomous Driving
par: Cui, Can, et autres
Publié: (2025)
par: Cui, Can, et autres
Publié: (2025)
GutenOCR: A Grounded Vision-Language Front-End for Documents
par: Heidenreich, Hunter, et autres
Publié: (2026)
par: Heidenreich, Hunter, et autres
Publié: (2026)
Documents similaires
-
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
par: Sun, Xinyu, et autres
Publié: (2026) -
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
par: Mao, Lingtao, et autres
Publié: (2026) -
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
par: Nan, Xinyu, et autres
Publié: (2025) -
OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search
par: Chen, Ben, et autres
Publié: (2025) -
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
par: Ma, Yufei, et autres
Publié: (2026)