Adapting Vision-Language Models for E-commerce Understanding at Scale
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nulli, Matteo, Orshulevich, Vladimir, Bazazo, Tala, Herold, Christian, Kozielski, Michael, Mazur, Marcin, Tuzel, Szymon, Snoek, Cees G. M., Hashemi, Seyyed Hadi, Javed, Omar, Versley, Yannick, Khadivi, Shahram |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Domain Adaptation of Foundation LLMs for e-Commerce
par: Herold, Christian, et autres
Publié: (2025)
par: Herold, Christian, et autres
Publié: (2025)
Vocabulary Customization for Efficient Domain-Specific LLM Deployment
par: Herold, Christian, et autres
Publié: (2025)
par: Herold, Christian, et autres
Publié: (2025)
LiLiuM: eBay's Large Language Models for e-commerce
par: Herold, Christian, et autres
Publié: (2024)
par: Herold, Christian, et autres
Publié: (2024)
ClusComp: A Simple Paradigm for Model Compression and Efficient Finetuning
par: Liao, Baohao, et autres
Publié: (2025)
par: Liao, Baohao, et autres
Publié: (2025)
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
par: Vasilev, Stefan, et autres
Publié: (2025)
par: Vasilev, Stefan, et autres
Publié: (2025)
Meeting SLOs, Slashing Hours: Automated Enterprise LLM Optimization with OptiKIT
par: Santavas, Nicholas, et autres
Publié: (2026)
par: Santavas, Nicholas, et autres
Publié: (2026)
ITEm: Unsupervised Image-Text Embedding Learning for eCommerce
par: Liao, Baohao, et autres
Publié: (2023)
par: Liao, Baohao, et autres
Publié: (2023)
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
IKUN for WMT24 General MT Task: LLMs Are here for Multilingual Machine Translation
par: Liao, Baohao, et autres
Publié: (2024)
par: Liao, Baohao, et autres
Publié: (2024)
Beyond Model Adaptation at Test Time: A Survey
par: Xiao, Zehao, et autres
Publié: (2024)
par: Xiao, Zehao, et autres
Publié: (2024)
CONGRAD:Conflicting Gradient Filtering for Multilingual Preference Alignment
par: Li, Jiangnan, et autres
Publié: (2025)
par: Li, Jiangnan, et autres
Publié: (2025)
Analgesic Efficacy of Bromelain and Bromelain Plus Turmeric for Pain Control After Orthodontic Separator Placement: A Triple‐Blind Randomized Clinical Trial
par: Shabnam Ajami, et autres
Publié: (2025)
par: Shabnam Ajami, et autres
Publié: (2025)
Roadmap to Precision 3D Printing of Cellulose: Rheology‐Guided Formulation, Fidelity Assessment, and Application Horizons (Adv. Mater. Technol. 8/2026)
par: Majed Amini, et autres
Publié: (2026)
par: Majed Amini, et autres
Publié: (2026)
Low-Resource Vision Challenges for Foundation Models
par: Zhang, Yunhua, et autres
Publié: (2024)
par: Zhang, Yunhua, et autres
Publié: (2024)
Commonsense Video Question Answering through Video-Grounded Entailment Tree Reasoning
par: Liu, Huabin, et autres
Publié: (2025)
par: Liu, Huabin, et autres
Publié: (2025)
IPO: Interpretable Prompt Optimization for Vision-Language Models
par: Du, Yingjun, et autres
Publié: (2024)
par: Du, Yingjun, et autres
Publié: (2024)
Learn to Categorize or Categorize to Learn? Self-Coding for Generalized Category Discovery
par: Rastegar, Sarah, et autres
Publié: (2023)
par: Rastegar, Sarah, et autres
Publié: (2023)
A Survey of Visual Attention Models
par: Seyyed Mohammad Reza Hashemi
Publié: (2015)
par: Seyyed Mohammad Reza Hashemi
Publié: (2015)
LocoMotion: Learning Motion-Focused Video-Language Representations
par: Doughty, Hazel, et autres
Publié: (2024)
par: Doughty, Hazel, et autres
Publié: (2024)
'Explaining RL Decisions with Trajectories': A Reproducibility Study
par: Sadek, Karim Abdel, et autres
Publié: (2024)
par: Sadek, Karim Abdel, et autres
Publié: (2024)
GeneralizeFormer: Layer-Adaptive Model Generation across Test-Time Distribution Shifts
par: Ambekar, Sameer, et autres
Publié: (2025)
par: Ambekar, Sameer, et autres
Publié: (2025)
Dual Guidance Semi-Supervised Action Detection
par: Singh, Ankit, et autres
Publié: (2025)
par: Singh, Ankit, et autres
Publié: (2025)
SuperDisco: Super-Class Discovery Improves Visual Recognition for the Long-Tail
par: Du, Yingjun, et autres
Publié: (2023)
par: Du, Yingjun, et autres
Publié: (2023)
GateRA: Token-Aware Modulation for Parameter-Efficient Fine-Tuning
par: Ou, Jie, et autres
Publié: (2025)
par: Ou, Jie, et autres
Publié: (2025)
Beyond Coarse-Grained Matching in Video-Text Retrieval
par: Chen, Aozhu, et autres
Publié: (2024)
par: Chen, Aozhu, et autres
Publié: (2024)
SimPLR: A Simple and Plain Transformer for Efficient Object Detection and Segmentation
par: Nguyen, Duy-Kien, et autres
Publié: (2023)
par: Nguyen, Duy-Kien, et autres
Publié: (2023)
The Sound of Water: Inferring Physical Properties from Pouring Liquids
par: Bagad, Piyush, et autres
Publié: (2024)
par: Bagad, Piyush, et autres
Publié: (2024)
In-Context Learning Improves Compositional Understanding of Vision-Language Models
par: Nulli, Matteo, et autres
Publié: (2024)
par: Nulli, Matteo, et autres
Publié: (2024)
Active Continual Learning: On Balancing Knowledge Retention and Learnability
par: Vu, Thuy-Trang, et autres
Publié: (2023)
par: Vu, Thuy-Trang, et autres
Publié: (2023)
El uso de las redes sociales y la cultura popular para una mejor comprensión intercultural
par: Sait Tuzel
Publié: (2017)
par: Sait Tuzel
Publié: (2017)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
par: Abolghasemi, Amin, et autres
Publié: (2024)
par: Abolghasemi, Amin, et autres
Publié: (2024)
What Layers When: Learning to Skip Compute in LLMs with Residual Gates
par: Laitenberger, Filipe, et autres
Publié: (2025)
par: Laitenberger, Filipe, et autres
Publié: (2025)
Segment Any 3D-Part in a Scene from a Sentence
par: Wu, Hongyu, et autres
Publié: (2025)
par: Wu, Hongyu, et autres
Publié: (2025)
Union-over-Intersections: Object Detection beyond Winner-Takes-All
par: Bhowmik, Aritra, et autres
Publié: (2023)
par: Bhowmik, Aritra, et autres
Publié: (2023)
PIN: Positional Insert Unlocks Object Localisation Abilities in VLMs
par: Dorkenwald, Michael, et autres
Publié: (2024)
par: Dorkenwald, Michael, et autres
Publié: (2024)
NeoBabel: A Multilingual Open Tower for Visual Generation
par: Derakhshani, Mohammad Mahdi, et autres
Publié: (2025)
par: Derakhshani, Mohammad Mahdi, et autres
Publié: (2025)
Dynamic Vocabulary Pruning in Early-Exit LLMs
par: Vincenti, Jort, et autres
Publié: (2024)
par: Vincenti, Jort, et autres
Publié: (2024)
Towards consistency of rule-based explainer and black box model -- fusion of rule induction and XAI-based feature importance
par: Kozielski, Michał, et autres
Publié: (2024)
par: Kozielski, Michał, et autres
Publié: (2024)
Atomistic investigation of deformation and fracture of individual structural components of metal matrix composites
par: Maździarz, Marcin, et autres
Publié: (2024)
par: Maździarz, Marcin, et autres
Publié: (2024)
PrAViC: Probabilistic Adaptation Framework for Real-Time Video Classification
par: Trędowicz, Magdalena, et autres
Publié: (2024)
par: Trędowicz, Magdalena, et autres
Publié: (2024)
Documents similaires
-
Domain Adaptation of Foundation LLMs for e-Commerce
par: Herold, Christian, et autres
Publié: (2025) -
Vocabulary Customization for Efficient Domain-Specific LLM Deployment
par: Herold, Christian, et autres
Publié: (2025) -
LiLiuM: eBay's Large Language Models for e-commerce
par: Herold, Christian, et autres
Publié: (2024) -
ClusComp: A Simple Paradigm for Model Compression and Efficient Finetuning
par: Liao, Baohao, et autres
Publié: (2025) -
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
par: Vasilev, Stefan, et autres
Publié: (2025)