Quality Over Clicks: Intrinsic Quality-Driven Iterative Reinforcement Learning for Cold-Start E-Commerce Query Suggestion
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Qi, Xiao, Kejun, Zhao, Huaipeng, Luo, Tao, Zeng, Xiaoyi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Shopping Companion: Benchmarking and Training LLM Agents for Long-Horizon Preference-Grounded E-Commerce Tasks
por: Yu, Zijian, et al.
Publicado: (2026)
por: Yu, Zijian, et al.
Publicado: (2026)
ProductResearch: Training E-Commerce Deep Research Agents via Multi-Agent Synthetic Trajectory Distillation
por: Wang, Jiangyuan, et al.
Publicado: (2026)
por: Wang, Jiangyuan, et al.
Publicado: (2026)
ShoppingBench: A Real-World Intent-Grounded Shopping Benchmark for LLM-based Agents
por: Wang, Jiangyuan, et al.
Publicado: (2025)
por: Wang, Jiangyuan, et al.
Publicado: (2025)
Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start
por: Wei, Lai, et al.
Publicado: (2025)
por: Wei, Lai, et al.
Publicado: (2025)
From Clicks to Preference: A Multi-stage Alignment Framework for Generative Query Suggestion in Conversational System
por: Yin, Junhao, et al.
Publicado: (2025)
por: Yin, Junhao, et al.
Publicado: (2025)
Better Datasets Start From RefineLab: Automatic Optimization for High-Quality Dataset Refinement
por: Luo, Xiaonan, et al.
Publicado: (2025)
por: Luo, Xiaonan, et al.
Publicado: (2025)
Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning
por: Chen, Shuang, et al.
Publicado: (2025)
por: Chen, Shuang, et al.
Publicado: (2025)
Identifying High Consideration E-Commerce Search Queries
por: Chen, Zhiyu, et al.
Publicado: (2024)
por: Chen, Zhiyu, et al.
Publicado: (2024)
Query Suggestion for Retrieval-Augmented Generation via Dynamic In-Context Learning
por: Spaeh, Fabian, et al.
Publicado: (2026)
por: Spaeh, Fabian, et al.
Publicado: (2026)
Context Over Compute Human-in-the-Loop Outperforms Iterative Chain-of-Thought Prompting in Interview Answer Quality
por: Zhu, Kewen, et al.
Publicado: (2026)
por: Zhu, Kewen, et al.
Publicado: (2026)
Modeling Data Diversity for Joint Instance and Verbalizer Selection in Cold-Start Scenarios
por: Chakraborty, Mohna, et al.
Publicado: (2025)
por: Chakraborty, Mohna, et al.
Publicado: (2025)
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
por: Wang, Xiaohua, et al.
Publicado: (2024)
por: Wang, Xiaohua, et al.
Publicado: (2024)
RouteProfile: Graph-Based Profiling for Cold-Start LLM Routing
por: Xu, Jingjun, et al.
Publicado: (2026)
por: Xu, Jingjun, et al.
Publicado: (2026)
CSRM-LLM: Embracing Multilingual LLMs for Cold-Start Relevance Matching in Emerging E-commerce Markets
por: Wang, Yujing, et al.
Publicado: (2025)
por: Wang, Yujing, et al.
Publicado: (2025)
RIVAL: Reinforcement Learning with Iterative and Adversarial Optimization for Machine Translation
por: Li, Tianjiao, et al.
Publicado: (2025)
por: Li, Tianjiao, et al.
Publicado: (2025)
Examples as the Prompt: A Scalable Approach for Efficient LLM Adaptation in E-Commerce
por: Zeng, Jingying, et al.
Publicado: (2025)
por: Zeng, Jingying, et al.
Publicado: (2025)
LLaSA: Large Language and E-Commerce Shopping Assistant
por: Zhang, Shuo, et al.
Publicado: (2024)
por: Zhang, Shuo, et al.
Publicado: (2024)
From Zero to Hero: Cold-Start Anomaly Detection
por: Reiss, Tal, et al.
Publicado: (2024)
por: Reiss, Tal, et al.
Publicado: (2024)
LocalSUG: City-Preference-Enhanced LLM for Query Suggestion in Local-Life Services
por: Chen, Jinwen, et al.
Publicado: (2026)
por: Chen, Jinwen, et al.
Publicado: (2026)
QCQA: Quality and Capacity-aware grouped Query Attention
por: Joshi, Vinay, et al.
Publicado: (2024)
por: Joshi, Vinay, et al.
Publicado: (2024)
Metis-SPECS: Decoupling Multimodal Learning via Self-distilled Preference-based Cold Start
por: Chen, Kun, et al.
Publicado: (2025)
por: Chen, Kun, et al.
Publicado: (2025)
STENCIL: Submodular Mutual Information Based Weak Supervision for Cold-Start Active Learning
por: Beck, Nathan, et al.
Publicado: (2024)
por: Beck, Nathan, et al.
Publicado: (2024)
Curriculum Learning with Quality-Driven Data Selection
por: Wu, Biao, et al.
Publicado: (2024)
por: Wu, Biao, et al.
Publicado: (2024)
LLM-Driven E-Commerce Marketing Content Optimization: Balancing Creativity and Conversion
por: Yang, Haowei, et al.
Publicado: (2025)
por: Yang, Haowei, et al.
Publicado: (2025)
EPM-RL: Reinforcement Learning for On-Premise Product Mapping in E-Commerce
por: Yu, Minhyeong, et al.
Publicado: (2026)
por: Yu, Minhyeong, et al.
Publicado: (2026)
RAGSys: Item-Cold-Start Recommender as RAG System
por: Contal, Emile, et al.
Publicado: (2024)
por: Contal, Emile, et al.
Publicado: (2024)
Preserving Multilingual Quality While Tuning Query Encoder on English Only
por: Vasilyev, Oleg, et al.
Publicado: (2024)
por: Vasilyev, Oleg, et al.
Publicado: (2024)
QCRD: Quality-guided Contrastive Rationale Distillation for Large Language Models
por: Wang, Wei, et al.
Publicado: (2024)
por: Wang, Wei, et al.
Publicado: (2024)
PRIME: Policy-Reinforced Iterative Multi-agent Execution for Algorithmic Reasoning in Large Language Models
por: Xu, Jiawei, et al.
Publicado: (2026)
por: Xu, Jiawei, et al.
Publicado: (2026)
When to Trust LLMs: Aligning Confidence with Response Quality
por: Tao, Shuchang, et al.
Publicado: (2024)
por: Tao, Shuchang, et al.
Publicado: (2024)
Thinking Broad, Acting Fast: Latent Reasoning Distillation from Multi-Perspective Chain-of-Thought for E-Commerce Relevance
por: Qiu, Baopu, et al.
Publicado: (2026)
por: Qiu, Baopu, et al.
Publicado: (2026)
Hybrid Querying Over Relational Databases and Large Language Models
por: Zhao, Fuheng, et al.
Publicado: (2024)
por: Zhao, Fuheng, et al.
Publicado: (2024)
No Free Lunch in Active Learning: LLM Embedding Quality Dictates Query Strategy Success
por: Rauch, Lukas, et al.
Publicado: (2025)
por: Rauch, Lukas, et al.
Publicado: (2025)
Cold-Start Personalization via Training-Free Priors from Structured World Models
por: Bose, Avinandan, et al.
Publicado: (2026)
por: Bose, Avinandan, et al.
Publicado: (2026)
MemOrb: A Plug-and-Play Verbal-Reinforcement Memory Layer for E-Commerce Customer Service
por: Huang, Yizhe, et al.
Publicado: (2025)
por: Huang, Yizhe, et al.
Publicado: (2025)
Improving Content Recommendation: Knowledge Graph-Based Semantic Contrastive Learning for Diversity and Cold-Start Users
por: Kim, Yejin, et al.
Publicado: (2024)
por: Kim, Yejin, et al.
Publicado: (2024)
Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing
por: Ding, Dujian, et al.
Publicado: (2024)
por: Ding, Dujian, et al.
Publicado: (2024)
Towards Cold-Start Drafting and Continual Refining: A Value-Driven Memory Approach with Application to NPU Kernel Synthesis
por: Zheng, Yujie, et al.
Publicado: (2026)
por: Zheng, Yujie, et al.
Publicado: (2026)
Curiosity-Driven Reinforcement Learning from Human Feedback
por: Sun, Haoran, et al.
Publicado: (2025)
por: Sun, Haoran, et al.
Publicado: (2025)
Beyond Scalar Scores: Reinforcement Learning for Error-Aware Quality Estimation of Machine Translation
por: Sindhujan, Archchana, et al.
Publicado: (2026)
por: Sindhujan, Archchana, et al.
Publicado: (2026)
Ejemplares similares
-
Shopping Companion: Benchmarking and Training LLM Agents for Long-Horizon Preference-Grounded E-Commerce Tasks
por: Yu, Zijian, et al.
Publicado: (2026) -
ProductResearch: Training E-Commerce Deep Research Agents via Multi-Agent Synthetic Trajectory Distillation
por: Wang, Jiangyuan, et al.
Publicado: (2026) -
ShoppingBench: A Real-World Intent-Grounded Shopping Benchmark for LLM-based Agents
por: Wang, Jiangyuan, et al.
Publicado: (2025) -
Advancing Multimodal Reasoning via Reinforcement Learning with Cold Start
por: Wei, Lai, et al.
Publicado: (2025) -
From Clicks to Preference: A Multi-stage Alignment Framework for Generative Query Suggestion in Conversational System
por: Yin, Junhao, et al.
Publicado: (2025)