Pantheon: Personalized Multi-objective Ensemble Sort via Iterative Pareto Policy Optimization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Cao, Jiangxia, Xu, Pengbo, Cheng, Yin, Guo, Kaiwei, Tang, Jian, Wang, Shijun, Leng, Dewei, Yang, Shuang, Liu, Zhaojie, Niu, Yanan, Zhou, Guorui, Gai, Kun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MaRI: Accelerating Ranking Model Inference via Structural Re-parameterization in Large Scale Recommendation System
von: Huang, Yusheng, et al.
Veröffentlicht: (2026)
von: Huang, Yusheng, et al.
Veröffentlicht: (2026)
LLM-Alignment Live-Streaming Recommendation
von: Liu, Yueyang, et al.
Veröffentlicht: (2025)
von: Liu, Yueyang, et al.
Veröffentlicht: (2025)
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
von: Wang, Xu, et al.
Veröffentlicht: (2024)
von: Wang, Xu, et al.
Veröffentlicht: (2024)
A Unified Framework for Cross-Domain Recommendation
von: Cao, Jiangxia, et al.
Veröffentlicht: (2024)
von: Cao, Jiangxia, et al.
Veröffentlicht: (2024)
Moment&Cross: Next-Generation Real-Time Cross-Domain CTR Prediction for Live-Streaming Recommendation at Kuaishou
von: Cao, Jiangxia, et al.
Veröffentlicht: (2024)
von: Cao, Jiangxia, et al.
Veröffentlicht: (2024)
Break the Inaccessible Boundary: Distilling Post-Conversion Content for User Retention Modeling
von: Ma, Tianbao, et al.
Veröffentlicht: (2026)
von: Ma, Tianbao, et al.
Veröffentlicht: (2026)
KuaiFormer: Transformer-Based Retrieval at Kuaishou
von: Liu, Chi, et al.
Veröffentlicht: (2024)
von: Liu, Chi, et al.
Veröffentlicht: (2024)
OneLive: Dynamically Unified Generative Framework for Live-Streaming Recommendation
von: Wang, Shen, et al.
Veröffentlicht: (2026)
von: Wang, Shen, et al.
Veröffentlicht: (2026)
Rethinking Token-Level Policy Optimization for Multimodal Chain-of-Thought
von: Li, Yunheng, et al.
Veröffentlicht: (2026)
von: Li, Yunheng, et al.
Veröffentlicht: (2026)
CRM: Retrieval Model with Controllable Condition
von: Liu, Chi, et al.
Veröffentlicht: (2024)
von: Liu, Chi, et al.
Veröffentlicht: (2024)
PushGen: Push Notifications Generation with LLM
von: Bie, Shifu, et al.
Veröffentlicht: (2025)
von: Bie, Shifu, et al.
Veröffentlicht: (2025)
ChorusCVR: Chorus Supervision for Entire Space Post-Click Conversion Rate Modeling
von: Cheng, Wei, et al.
Veröffentlicht: (2025)
von: Cheng, Wei, et al.
Veröffentlicht: (2025)
Selection and Exploitation of High-Quality Knowledge from Large Language Models for Recommendation
von: Wang, Guanchen, et al.
Veröffentlicht: (2025)
von: Wang, Guanchen, et al.
Veröffentlicht: (2025)
Challenges and Innovations With Spent Battery Sorting
von: Umut Kar, et al.
Veröffentlicht: (2025)
von: Umut Kar, et al.
Veröffentlicht: (2025)
Foresight Prediction Enhanced Live-Streaming Recommendation
von: Cao, Jiangxia, et al.
Veröffentlicht: (2025)
von: Cao, Jiangxia, et al.
Veröffentlicht: (2025)
MARM: Unlocking the Future of Recommendation Systems through Memory Augmentation and Scalable Complexity
von: Lv, Xiao, et al.
Veröffentlicht: (2024)
von: Lv, Xiao, et al.
Veröffentlicht: (2024)
CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
MPFormer: Adaptive Framework for Industrial Multi-Task Personalized Sequential Retriever
von: Sun, Yijia, et al.
Veröffentlicht: (2025)
von: Sun, Yijia, et al.
Veröffentlicht: (2025)
LiveForesighter: Generating Future Information for Live-Streaming Recommendations at Kuaishou
von: Lu, Yucheng, et al.
Veröffentlicht: (2025)
von: Lu, Yucheng, et al.
Veröffentlicht: (2025)
From Agnostic to Specific: Latent Preference Diffusion for Multi-Behavior Sequential Recommendation
von: Yang, Ruochen, et al.
Veröffentlicht: (2026)
von: Yang, Ruochen, et al.
Veröffentlicht: (2026)
Harmonizing Generative Retrieval and Ranking in Chain-of-Recommendation
von: Liu, Yu, et al.
Veröffentlicht: (2026)
von: Liu, Yu, et al.
Veröffentlicht: (2026)
Klear-Reasoner: Advancing Reasoning Capability via Gradient-Preserving Clipping Policy Optimization
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
TWIN V2: Scaling Ultra-Long User Behavior Sequence Modeling for Enhanced CTR Prediction at Kuaishou
von: Si, Zihua, et al.
Veröffentlicht: (2024)
von: Si, Zihua, et al.
Veröffentlicht: (2024)
Agentic Entropy-Balanced Policy Optimization
von: Dong, Guanting, et al.
Veröffentlicht: (2025)
von: Dong, Guanting, et al.
Veröffentlicht: (2025)
GRank: Towards Target-Aware and Streamlined Industrial Retrieval with a Generate-Rank Framework
von: Sun, Yijia, et al.
Veröffentlicht: (2025)
von: Sun, Yijia, et al.
Veröffentlicht: (2025)
Compositional Value Iteration with Pareto Caching
von: Watanabe, Kazuki, et al.
Veröffentlicht: (2024)
von: Watanabe, Kazuki, et al.
Veröffentlicht: (2024)
ParetoEnsembles.jl: A Julia Package for Multiobjective Parameter Estimation Using Pareto Optimal Ensemble Techniques
von: Varner, Jeffrey D.
Veröffentlicht: (2026)
von: Varner, Jeffrey D.
Veröffentlicht: (2026)
Sorting cells by Raman fingerprint
von: Jian Xu, et al.
Veröffentlicht: (2025)
von: Jian Xu, et al.
Veröffentlicht: (2025)
UniMixer: A Unified Architecture for Scaling Laws in Recommendation Systems
von: Ha, Mingming, et al.
Veröffentlicht: (2026)
von: Ha, Mingming, et al.
Veröffentlicht: (2026)
SARM: LLM-Augmented Semantic Anchor for End-to-End Live-Streaming Ranking
von: Yang, Ruochen, et al.
Veröffentlicht: (2026)
von: Yang, Ruochen, et al.
Veröffentlicht: (2026)
UniSAR: Modeling User Transition Behaviors between Search and Recommendation
von: Shi, Teng, et al.
Veröffentlicht: (2024)
von: Shi, Teng, et al.
Veröffentlicht: (2024)
State Regularized Policy Optimization on Data with Dynamics Shift
von: Xue, Zhenghai, et al.
Veröffentlicht: (2023)
von: Xue, Zhenghai, et al.
Veröffentlicht: (2023)
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
von: Qiu, Shuang, et al.
Veröffentlicht: (2024)
von: Qiu, Shuang, et al.
Veröffentlicht: (2024)
An Exact Theory of Causal Emergence for Linear Stochastic Iteration Systems
von: Liu, Kaiwei, et al.
Veröffentlicht: (2024)
von: Liu, Kaiwei, et al.
Veröffentlicht: (2024)
FARM: Frequency-Aware Model for Cross-Domain Live-Streaming Recommendation
von: Li, Xiaodong, et al.
Veröffentlicht: (2025)
von: Li, Xiaodong, et al.
Veröffentlicht: (2025)
QARM: Quantitative Alignment Multi-Modal Recommendation at Kuaishou
von: Luo, Xinchen, et al.
Veröffentlicht: (2024)
von: Luo, Xinchen, et al.
Veröffentlicht: (2024)
Multiplicative Turing Ensembles, Pareto's Law, and Creativity
von: Kolpakov, Alexander, et al.
Veröffentlicht: (2025)
von: Kolpakov, Alexander, et al.
Veröffentlicht: (2025)
Testing cosmic anisotropy with Pade approximation and Pantheon+ sample
von: Hu, Jianping, et al.
Veröffentlicht: (2024)
von: Hu, Jianping, et al.
Veröffentlicht: (2024)
Anisotropy in Pantheon+ supernovae
von: Sah, Animesh, et al.
Veröffentlicht: (2024)
von: Sah, Animesh, et al.
Veröffentlicht: (2024)
Il piccolo Pantheon
von: INNOCENTI, BARBARA
Veröffentlicht: (2022)
von: INNOCENTI, BARBARA
Veröffentlicht: (2022)
Ähnliche Einträge
-
MaRI: Accelerating Ranking Model Inference via Structural Re-parameterization in Large Scale Recommendation System
von: Huang, Yusheng, et al.
Veröffentlicht: (2026) -
LLM-Alignment Live-Streaming Recommendation
von: Liu, Yueyang, et al.
Veröffentlicht: (2025) -
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
von: Wang, Xu, et al.
Veröffentlicht: (2024) -
A Unified Framework for Cross-Domain Recommendation
von: Cao, Jiangxia, et al.
Veröffentlicht: (2024) -
Moment&Cross: Next-Generation Real-Time Cross-Domain CTR Prediction for Live-Streaming Recommendation at Kuaishou
von: Cao, Jiangxia, et al.
Veröffentlicht: (2024)