EComStage: Stage-wise and Orientation-specific Benchmarking for Large Language Models in E-commerce
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Kaiyan, Meng, Zijie, Xie, Zheyong, Duan, Jin, Hu, Yao, Liu, Zuozhu, Cao, Shaosheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Benchmarking Machine Translation on Chinese Social Media Texts
di: Zhao, Kaiyan, et al.
Pubblicazione: (2026)
di: Zhao, Kaiyan, et al.
Pubblicazione: (2026)
Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
di: Li, Shengrui, et al.
Pubblicazione: (2026)
di: Li, Shengrui, et al.
Pubblicazione: (2026)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
GCAgent: Enhancing Group Chat Communication through Dialogue Agents System
di: Meng, Zijie, et al.
Pubblicazione: (2026)
di: Meng, Zijie, et al.
Pubblicazione: (2026)
Towards Comprehensive Stage-wise Benchmarking of Large Language Models in Fact-Checking
di: Lin, Hongzhan, et al.
Pubblicazione: (2026)
di: Lin, Hongzhan, et al.
Pubblicazione: (2026)
ECom-Bench: Can LLM Agent Resolve Real-World E-commerce Customer Support Issues?
di: Wang, Haoxin, et al.
Pubblicazione: (2025)
di: Wang, Haoxin, et al.
Pubblicazione: (2025)
Balancing Understanding and Generation in Discrete Diffusion Models
di: Liu, Yue, et al.
Pubblicazione: (2026)
di: Liu, Yue, et al.
Pubblicazione: (2026)
EC-Guide: A Comprehensive E-Commerce Guide for Instruction Tuning and Quantization
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
DentalBench: Benchmarking and Advancing LLMs Capability for Bilingual Dentistry Understanding
di: Zhu, Hengchuan, et al.
Pubblicazione: (2025)
di: Zhu, Hengchuan, et al.
Pubblicazione: (2025)
Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification
di: Huang, Wenxuan, et al.
Pubblicazione: (2024)
di: Huang, Wenxuan, et al.
Pubblicazione: (2024)
ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
DCR: Divide-and-Conquer Reasoning for Multi-choice Question Answering with LLMs
di: Meng, Zijie, et al.
Pubblicazione: (2024)
di: Meng, Zijie, et al.
Pubblicazione: (2024)
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
di: Huang, Wenxuan, et al.
Pubblicazione: (2025)
di: Huang, Wenxuan, et al.
Pubblicazione: (2025)
Head-wise Shareable Attention for Large Language Models
di: Cao, Zouying, et al.
Pubblicazione: (2024)
di: Cao, Zouying, et al.
Pubblicazione: (2024)
RMPL: Relation-aware Multi-task Progressive Learning with Stage-wise Training for Multimedia Event Extraction
di: Jin, Yongkang, et al.
Pubblicazione: (2026)
di: Jin, Yongkang, et al.
Pubblicazione: (2026)
Stage-wise Fine-tuning for Graph-to-Text Generation
di: Wang, Qingyun, et al.
Pubblicazione: (2021)
di: Wang, Qingyun, et al.
Pubblicazione: (2021)
RedOne 2.0: Rethinking Domain-specific LLM Post-Training in Social Networking Services
di: Zhao, Fei, et al.
Pubblicazione: (2025)
di: Zhao, Fei, et al.
Pubblicazione: (2025)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
di: Wei, Jianhui, et al.
Pubblicazione: (2025)
ChineseEcomQA: A Scalable E-commerce Concept Evaluation Benchmark for Large Language Models
di: Chen, Haibin, et al.
Pubblicazione: (2025)
di: Chen, Haibin, et al.
Pubblicazione: (2025)
Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language Models
di: Lian, Haoran, et al.
Pubblicazione: (2024)
di: Lian, Haoran, et al.
Pubblicazione: (2024)
Redefining Machine Translation on Social Network Services with Large Language Models
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
MSCoRe: A Benchmark for Multi-Stage Collaborative Reasoning in LLM Agents
di: Lei, Yuzhen, et al.
Pubblicazione: (2025)
di: Lei, Yuzhen, et al.
Pubblicazione: (2025)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
Classifying Cancer Stage with Open-Source Clinical Large Language Models
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
Optimizing RLHF Training for Large Language Models with Stage Fusion
di: Zhong, Yinmin, et al.
Pubblicazione: (2024)
di: Zhong, Yinmin, et al.
Pubblicazione: (2024)
MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2025)
Ladder: A Model-Agnostic Framework Boosting LLM-based Machine Translation to the Next Level
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2024)
Self-Improving for Zero-Shot Named Entity Recognition with Large Language Models
di: Xie, Tingyu, et al.
Pubblicazione: (2023)
di: Xie, Tingyu, et al.
Pubblicazione: (2023)
Modeling Stage-wise Evolution of User Interests for News Recommendation
di: Cheng, Zhiyong, et al.
Pubblicazione: (2026)
di: Cheng, Zhiyong, et al.
Pubblicazione: (2026)
Improving Arithmetic Reasoning Ability of Large Language Models through Relation Tuples, Verification and Dynamic Feedback
di: Miao, Zhongtao, et al.
Pubblicazione: (2024)
di: Miao, Zhongtao, et al.
Pubblicazione: (2024)
Towards Democratizing Multilingual Large Language Models For Medicine Through A Two-Stage Instruction Fine-tuning Approach
di: Zhou, Meng, et al.
Pubblicazione: (2024)
di: Zhou, Meng, et al.
Pubblicazione: (2024)
EcomScriptBench: A Multi-task Benchmark for E-commerce Script Planning via Step-wise Intention-Driven Product Association
di: Wang, Weiqi, et al.
Pubblicazione: (2025)
di: Wang, Weiqi, et al.
Pubblicazione: (2025)
In-Context Former: Lightning-fast Compressing Context for Large Language Model
di: Wang, Xiangfeng, et al.
Pubblicazione: (2024)
di: Wang, Xiangfeng, et al.
Pubblicazione: (2024)
FairMT-Bench: Benchmarking Fairness for Multi-turn Dialogue in Conversational LLMs
di: Fan, Zhiting, et al.
Pubblicazione: (2024)
di: Fan, Zhiting, et al.
Pubblicazione: (2024)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
di: Fan, Zhiting, et al.
Pubblicazione: (2025)
di: Fan, Zhiting, et al.
Pubblicazione: (2025)
STEP: Staged Parameter-Efficient Pre-training for Large Language Models
di: Yano, Kazuki, et al.
Pubblicazione: (2025)
di: Yano, Kazuki, et al.
Pubblicazione: (2025)
OmniV-Med: Scaling Medical Vision-Language Model for Universal Visual Understanding
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Benchmarking Machine Translation on Chinese Social Media Texts
di: Zhao, Kaiyan, et al.
Pubblicazione: (2026) -
Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025) -
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
di: Li, Shengrui, et al.
Pubblicazione: (2026) -
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
di: Zhang, Zihou, et al.
Pubblicazione: (2026) -
SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)