DeepShop: A Benchmark for Deep Research Shopping Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Lyu, Yougang, Zhang, Xiaoyu, Yan, Lingyong, de Rijke, Maarten, Ren, Zhaochun, Chen, Xiuying |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Cognitive Biases in Large Language Models for News Recommendation
by: Lyu, Yougang, et al.
Published: (2024)
by: Lyu, Yougang, et al.
Published: (2024)
Towards Empathetic Conversational Recommender Systems
by: Zhang, Xiaoyu, et al.
Published: (2024)
by: Zhang, Xiaoyu, et al.
Published: (2024)
AgenticShop: Benchmarking Agentic Product Curation for Personalized Web Shopping
by: Kim, Sunghwan, et al.
Published: (2026)
by: Kim, Sunghwan, et al.
Published: (2026)
A Cooperative Multi-Agent Framework for Zero-Shot Named Entity Recognition
by: Wang, Zihan, et al.
Published: (2025)
by: Wang, Zihan, et al.
Published: (2025)
Generative Retrieval as Multi-Vector Dense Retrieval
by: Wu, Shiguang, et al.
Published: (2024)
by: Wu, Shiguang, et al.
Published: (2024)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
by: Shi, Zhengliang, et al.
Published: (2025)
by: Shi, Zhengliang, et al.
Published: (2025)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
by: Lyu, Yougang, et al.
Published: (2024)
by: Lyu, Yougang, et al.
Published: (2024)
Orcheo: A Modular Full-Stack Platform for Conversational Search
by: Jiang, Shaojie, et al.
Published: (2026)
by: Jiang, Shaojie, et al.
Published: (2026)
Deep Research: A Systematic Survey
by: Shi, Zhengliang, et al.
Published: (2025)
by: Shi, Zhengliang, et al.
Published: (2025)
Enriching User Shopping History: Empowering E-commerce with a Hierarchical Recommendation System
by: Islek, Irem, et al.
Published: (2024)
by: Islek, Irem, et al.
Published: (2024)
Style4Rec: Enhancing Transformer-based E-commerce Recommendation Systems with Style and Shopping Cart Information
by: Ugurlu, Berke, et al.
Published: (2025)
by: Ugurlu, Berke, et al.
Published: (2025)
SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval
by: Petcu, Roxana, et al.
Published: (2026)
by: Petcu, Roxana, et al.
Published: (2026)
Self-Optimizing Multi-Agent Systems for Deep Research
by: Câmara, Arthur, et al.
Published: (2026)
by: Câmara, Arthur, et al.
Published: (2026)
Unbiased Learning to Rank Meets Reality: Lessons from Baidu's Large-Scale Search Dataset
by: Hager, Philipp, et al.
Published: (2024)
by: Hager, Philipp, et al.
Published: (2024)
OrLog: Resolving Complex Queries with LLMs and Probabilistic Reasoning
by: Hoveyda, Mohanna, et al.
Published: (2026)
by: Hoveyda, Mohanna, et al.
Published: (2026)
Direct Retrieval-augmented Optimization: Synergizing Knowledge Selection and Language Models
by: Shi, Zhengliang, et al.
Published: (2025)
by: Shi, Zhengliang, et al.
Published: (2025)
Information Discovery in e-Commerce
by: Ren, Zhaochun, et al.
Published: (2024)
by: Ren, Zhaochun, et al.
Published: (2024)
Towards Personalized Deep Research: Benchmarks and Evaluations
by: Liang, Yuan, et al.
Published: (2025)
by: Liang, Yuan, et al.
Published: (2025)
A Reproducibility Study of Product-side Fairness in Bundle Recommendation
by: Nguyen, Huy-Son, et al.
Published: (2025)
by: Nguyen, Huy-Son, et al.
Published: (2025)
ChatShopBuddy: Towards Reliable Conversational Shopping Agents via Reinforcement Learning
by: Cheng, Yiruo, et al.
Published: (2026)
by: Cheng, Yiruo, et al.
Published: (2026)
AGENT-CQ: Automatic Generation and Evaluation of Clarifying Questions for Conversational Search with LLMs
by: Siro, Clemencia, et al.
Published: (2024)
by: Siro, Clemencia, et al.
Published: (2024)
Benchmark Granularity and Model Robustness for Image-Text Retrieval
by: Hendriksen, Mariya, et al.
Published: (2024)
by: Hendriksen, Mariya, et al.
Published: (2024)
Tutorial on Reasoning for IR & IR for Reasoning
by: Hoveyda, Mohanna, et al.
Published: (2026)
by: Hoveyda, Mohanna, et al.
Published: (2026)
Argus: Evidence Assembly for Scalable Deep Research Agents
by: Zhang, Zhen, et al.
Published: (2026)
by: Zhang, Zhen, et al.
Published: (2026)
Cold-Starts in Generative Recommendation: A Reproducibility Study
by: Zhang, Zhen, et al.
Published: (2026)
by: Zhang, Zhen, et al.
Published: (2026)
FedSlate:A Federated Deep Reinforcement Learning Recommender System
by: Deng, Yongxin, et al.
Published: (2024)
by: Deng, Yongxin, et al.
Published: (2024)
AgentSearchBench: A Benchmark for AI Agent Search in the Wild
by: Wu, Bin, et al.
Published: (2026)
by: Wu, Bin, et al.
Published: (2026)
Disentangling ID and Modality Effects for Session-based Recommendation
by: Zhang, Xiaokun, et al.
Published: (2024)
by: Zhang, Xiaokun, et al.
Published: (2024)
ERASE: Benchmarking Feature Selection Methods for Deep Recommender Systems
by: Jia, Pengyue, et al.
Published: (2024)
by: Jia, Pengyue, et al.
Published: (2024)
Benchmarking Deep Neural Networks for Modern Recommendation Systems
by: Bahi, Abderaouf, et al.
Published: (2025)
by: Bahi, Abderaouf, et al.
Published: (2025)
Fusion Matters: Learning Fusion in Deep Click-through Rate Prediction Models
by: Zhang, Kexin, et al.
Published: (2024)
by: Zhang, Kexin, et al.
Published: (2024)
ExcluIR: Exclusionary Neural Information Retrieval
by: Zhang, Wenhao, et al.
Published: (2024)
by: Zhang, Wenhao, et al.
Published: (2024)
AgentRecBench: Benchmarking LLM Agent-based Personalized Recommender Systems
by: Shang, Yu, et al.
Published: (2025)
by: Shang, Yu, et al.
Published: (2025)
Learning to Comparison-Shop
by: Tang, Jie, et al.
Published: (2025)
by: Tang, Jie, et al.
Published: (2025)
Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation
by: Ye, Fangda, et al.
Published: (2026)
by: Ye, Fangda, et al.
Published: (2026)
A Multi-Agent Conversational Recommender System
by: Fang, Jiabao, et al.
Published: (2024)
by: Fang, Jiabao, et al.
Published: (2024)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
by: Lyu, Yougang, et al.
Published: (2024)
by: Lyu, Yougang, et al.
Published: (2024)
Constrained Auto-Regressive Decoding Constrains Generative Retrieval
by: Wu, Shiguang, et al.
Published: (2025)
by: Wu, Shiguang, et al.
Published: (2025)
Reinforcement Learning Foundations for Deep Research Systems: A Survey
by: Li, Wenjun, et al.
Published: (2025)
by: Li, Wenjun, et al.
Published: (2025)
AgentSelect: Benchmark for Narrative Query-to-Agent Recommendation
by: Shi, Yunxiao, et al.
Published: (2026)
by: Shi, Yunxiao, et al.
Published: (2026)
Similar Items
-
Cognitive Biases in Large Language Models for News Recommendation
by: Lyu, Yougang, et al.
Published: (2024) -
Towards Empathetic Conversational Recommender Systems
by: Zhang, Xiaoyu, et al.
Published: (2024) -
AgenticShop: Benchmarking Agentic Product Curation for Personalized Web Shopping
by: Kim, Sunghwan, et al.
Published: (2026) -
A Cooperative Multi-Agent Framework for Zero-Shot Named Entity Recognition
by: Wang, Zihan, et al.
Published: (2025) -
Generative Retrieval as Multi-Vector Dense Retrieval
by: Wu, Shiguang, et al.
Published: (2024)