OneVision: An End-to-End Generative Framework for Multi-view E-commerce Vision Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Zexin, Dai, Huangyu, Mao, Lingtao, Sun, Xinyu, Liang, Zihan, Chen, Ben, Ding, Yuqing, Lei, Chenyi, Ou, Wenwu, Li, Han, Gai, Kun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
di: Sun, Xinyu, et al.
Pubblicazione: (2026)
di: Sun, Xinyu, et al.
Pubblicazione: (2026)
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
di: Mao, Lingtao, et al.
Pubblicazione: (2026)
di: Mao, Lingtao, et al.
Pubblicazione: (2026)
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
di: Nan, Xinyu, et al.
Pubblicazione: (2025)
di: Nan, Xinyu, et al.
Pubblicazione: (2025)
OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search
di: Chen, Ben, et al.
Pubblicazione: (2025)
di: Chen, Ben, et al.
Pubblicazione: (2025)
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
di: Ma, Yufei, et al.
Pubblicazione: (2026)
di: Ma, Yufei, et al.
Pubblicazione: (2026)
IG-Search: Step-Level Information Gain Rewards for Search-Augmented Reasoning
di: Liang, Zihan, et al.
Pubblicazione: (2026)
di: Liang, Zihan, et al.
Pubblicazione: (2026)
OneSug: The Unified End-to-End Generative Framework for E-commerce Query Suggestion
di: Guo, Xian, et al.
Pubblicazione: (2025)
di: Guo, Xian, et al.
Pubblicazione: (2025)
InfoGain-RAG: Boosting Retrieval-Augmented Generation via Document Information Gain-based Reranking and Filtering
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
H-PRM: A Pluggable Hotword Pre-Retrieval Module for Various Speech Recognition Systems
di: Dai, Huangyu, et al.
Pubblicazione: (2025)
di: Dai, Huangyu, et al.
Pubblicazione: (2025)
OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Framework
di: Chen, Ben, et al.
Pubblicazione: (2026)
di: Chen, Ben, et al.
Pubblicazione: (2026)
Towards Context-aware Reasoning-enhanced Generative Searching in E-commerce
di: Liu, Zhiding, et al.
Pubblicazione: (2025)
di: Liu, Zhiding, et al.
Pubblicazione: (2025)
Search-E1: Self-Distillation Drives Self-Evolution in Search-Augmented Reasoning
di: Liang, Zihan, et al.
Pubblicazione: (2026)
di: Liang, Zihan, et al.
Pubblicazione: (2026)
UniECS: Unified Multimodal E-Commerce Search Framework with Gated Cross-modal Fusion
di: Liang, Zihan, et al.
Pubblicazione: (2025)
di: Liang, Zihan, et al.
Pubblicazione: (2025)
Plan Before Search: Search Agents Need Plan
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
LLaVA-OneVision: Easy Visual Task Transfer
di: Li, Bo, et al.
Pubblicazione: (2024)
di: Li, Bo, et al.
Pubblicazione: (2024)
OneMall: One Architecture, More Scenarios -- End-to-End Generative Recommender Family at Kuaishou E-Commerce
di: Zhang, Kun, et al.
Pubblicazione: (2026)
di: Zhang, Kun, et al.
Pubblicazione: (2026)
LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training
di: An, Xiang, et al.
Pubblicazione: (2025)
di: An, Xiang, et al.
Pubblicazione: (2025)
LLaVA-OneVision-2: Towards Next-Generation Perceptual Intelligence
di: An, Xiang, et al.
Pubblicazione: (2026)
di: An, Xiang, et al.
Pubblicazione: (2026)
OneVision-Encoder: Codec-Aligned Sparsity as a Foundational Principle for Multimodal Intelligence
di: Tang, Feilong, et al.
Pubblicazione: (2026)
di: Tang, Feilong, et al.
Pubblicazione: (2026)
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
di: Li, Yupeng, et al.
Pubblicazione: (2026)
di: Li, Yupeng, et al.
Pubblicazione: (2026)
Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization
di: Jin, Yang, et al.
Pubblicazione: (2023)
di: Jin, Yang, et al.
Pubblicazione: (2023)
End-to-End Vision Tokenizer Tuning
di: Wang, Wenxuan, et al.
Pubblicazione: (2025)
di: Wang, Wenxuan, et al.
Pubblicazione: (2025)
Light-weight End-to-End Graph Interest Network for CTR Prediction in E-commerce Search
di: Peng, Pipi, et al.
Pubblicazione: (2024)
di: Peng, Pipi, et al.
Pubblicazione: (2024)
COINS: SemantiC Ids Enhanced COLd Item RepresentatioN for Click-through Rate Prediction in E-commerce Search
di: Zhao, Qihang, et al.
Pubblicazione: (2025)
di: Zhao, Qihang, et al.
Pubblicazione: (2025)
An End-to-End Multi-objective Ensemble Ranking Framework for Video Recommendation
di: He, Tiantian, et al.
Pubblicazione: (2025)
di: He, Tiantian, et al.
Pubblicazione: (2025)
Vision Transformers for End-to-End Vision-Based Quadrotor Obstacle Avoidance
di: Bhattacharya, Anish, et al.
Pubblicazione: (2024)
di: Bhattacharya, Anish, et al.
Pubblicazione: (2024)
MindDrive: An All-in-One Framework Bridging World Models and Vision-Language Model for End-to-End Autonomous Driving
di: Sun, Bin, et al.
Pubblicazione: (2025)
di: Sun, Bin, et al.
Pubblicazione: (2025)
End-Cloud Collaboration Framework for Advanced AI Customer Service in E-commerce
di: Teng, Liangyu, et al.
Pubblicazione: (2024)
di: Teng, Liangyu, et al.
Pubblicazione: (2024)
OCRVerse: Towards Holistic OCR in End-to-End Vision-Language Models
di: Zhong, Yufeng, et al.
Pubblicazione: (2026)
di: Zhong, Yufeng, et al.
Pubblicazione: (2026)
ORION: A Holistic End-to-End Autonomous Driving Framework by Vision-Language Instructed Action Generation
di: Fu, Haoyu, et al.
Pubblicazione: (2025)
di: Fu, Haoyu, et al.
Pubblicazione: (2025)
Vision without Images: End-to-End Computer Vision from Single Compressive Measurements
di: Pan, Fengpu, et al.
Pubblicazione: (2025)
di: Pan, Fengpu, et al.
Pubblicazione: (2025)
Training Multi-Image Vision Agents via End2End Reinforcement Learning
di: Dong, Chengqi, et al.
Pubblicazione: (2025)
di: Dong, Chengqi, et al.
Pubblicazione: (2025)
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks
di: Wu, Jiannan, et al.
Pubblicazione: (2024)
di: Wu, Jiannan, et al.
Pubblicazione: (2024)
Visions of the End in Medieval Spain
di: Williams, John
Pubblicazione: (2018)
di: Williams, John
Pubblicazione: (2018)
Visions of the End in Medieval Spain
di: Williams, John, et al.
Pubblicazione: (2025)
di: Williams, John, et al.
Pubblicazione: (2025)
VLM-3D:End-to-End Vision-Language Models for Open-World 3D Perception
di: Chang, Fuhao, et al.
Pubblicazione: (2025)
di: Chang, Fuhao, et al.
Pubblicazione: (2025)
AIGQ: An End-to-End Hybrid Generative Architecture for E-commerce Query Recommendation
di: Xu, Jingcao, et al.
Pubblicazione: (2026)
di: Xu, Jingcao, et al.
Pubblicazione: (2026)
ViLaD: A Large Vision Language Diffusion Framework for End-to-End Autonomous Driving
di: Cui, Can, et al.
Pubblicazione: (2025)
di: Cui, Can, et al.
Pubblicazione: (2025)
GutenOCR: A Grounded Vision-Language Front-End for Documents
di: Heidenreich, Hunter, et al.
Pubblicazione: (2026)
di: Heidenreich, Hunter, et al.
Pubblicazione: (2026)
Documenti analoghi
-
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
di: Sun, Xinyu, et al.
Pubblicazione: (2026) -
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
di: Mao, Lingtao, et al.
Pubblicazione: (2026) -
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
di: Nan, Xinyu, et al.
Pubblicazione: (2025) -
OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search
di: Chen, Ben, et al.
Pubblicazione: (2025) -
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
di: Ma, Yufei, et al.
Pubblicazione: (2026)