Pantheon: Personalized Multi-objective Ensemble Sort via Iterative Pareto Policy Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Cao, Jiangxia, Xu, Pengbo, Cheng, Yin, Guo, Kaiwei, Tang, Jian, Wang, Shijun, Leng, Dewei, Yang, Shuang, Liu, Zhaojie, Niu, Yanan, Zhou, Guorui, Gai, Kun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MaRI: Accelerating Ranking Model Inference via Structural Re-parameterization in Large Scale Recommendation System
by: Huang, Yusheng, et al.
Published: (2026)
by: Huang, Yusheng, et al.
Published: (2026)
LLM-Alignment Live-Streaming Recommendation
by: Liu, Yueyang, et al.
Published: (2025)
by: Liu, Yueyang, et al.
Published: (2025)
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
by: Wang, Xu, et al.
Published: (2024)
by: Wang, Xu, et al.
Published: (2024)
A Unified Framework for Cross-Domain Recommendation
by: Cao, Jiangxia, et al.
Published: (2024)
by: Cao, Jiangxia, et al.
Published: (2024)
Moment&Cross: Next-Generation Real-Time Cross-Domain CTR Prediction for Live-Streaming Recommendation at Kuaishou
by: Cao, Jiangxia, et al.
Published: (2024)
by: Cao, Jiangxia, et al.
Published: (2024)
Break the Inaccessible Boundary: Distilling Post-Conversion Content for User Retention Modeling
by: Ma, Tianbao, et al.
Published: (2026)
by: Ma, Tianbao, et al.
Published: (2026)
KuaiFormer: Transformer-Based Retrieval at Kuaishou
by: Liu, Chi, et al.
Published: (2024)
by: Liu, Chi, et al.
Published: (2024)
OneLive: Dynamically Unified Generative Framework for Live-Streaming Recommendation
by: Wang, Shen, et al.
Published: (2026)
by: Wang, Shen, et al.
Published: (2026)
Rethinking Token-Level Policy Optimization for Multimodal Chain-of-Thought
by: Li, Yunheng, et al.
Published: (2026)
by: Li, Yunheng, et al.
Published: (2026)
CRM: Retrieval Model with Controllable Condition
by: Liu, Chi, et al.
Published: (2024)
by: Liu, Chi, et al.
Published: (2024)
PushGen: Push Notifications Generation with LLM
by: Bie, Shifu, et al.
Published: (2025)
by: Bie, Shifu, et al.
Published: (2025)
ChorusCVR: Chorus Supervision for Entire Space Post-Click Conversion Rate Modeling
by: Cheng, Wei, et al.
Published: (2025)
by: Cheng, Wei, et al.
Published: (2025)
Selection and Exploitation of High-Quality Knowledge from Large Language Models for Recommendation
by: Wang, Guanchen, et al.
Published: (2025)
by: Wang, Guanchen, et al.
Published: (2025)
Challenges and Innovations With Spent Battery Sorting
by: Umut Kar, et al.
Published: (2025)
by: Umut Kar, et al.
Published: (2025)
Foresight Prediction Enhanced Live-Streaming Recommendation
by: Cao, Jiangxia, et al.
Published: (2025)
by: Cao, Jiangxia, et al.
Published: (2025)
MARM: Unlocking the Future of Recommendation Systems through Memory Augmentation and Scalable Complexity
by: Lv, Xiao, et al.
Published: (2024)
by: Lv, Xiao, et al.
Published: (2024)
CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
by: Su, Zhenpeng, et al.
Published: (2025)
by: Su, Zhenpeng, et al.
Published: (2025)
MPFormer: Adaptive Framework for Industrial Multi-Task Personalized Sequential Retriever
by: Sun, Yijia, et al.
Published: (2025)
by: Sun, Yijia, et al.
Published: (2025)
LiveForesighter: Generating Future Information for Live-Streaming Recommendations at Kuaishou
by: Lu, Yucheng, et al.
Published: (2025)
by: Lu, Yucheng, et al.
Published: (2025)
From Agnostic to Specific: Latent Preference Diffusion for Multi-Behavior Sequential Recommendation
by: Yang, Ruochen, et al.
Published: (2026)
by: Yang, Ruochen, et al.
Published: (2026)
Harmonizing Generative Retrieval and Ranking in Chain-of-Recommendation
by: Liu, Yu, et al.
Published: (2026)
by: Liu, Yu, et al.
Published: (2026)
Klear-Reasoner: Advancing Reasoning Capability via Gradient-Preserving Clipping Policy Optimization
by: Su, Zhenpeng, et al.
Published: (2025)
by: Su, Zhenpeng, et al.
Published: (2025)
TWIN V2: Scaling Ultra-Long User Behavior Sequence Modeling for Enhanced CTR Prediction at Kuaishou
by: Si, Zihua, et al.
Published: (2024)
by: Si, Zihua, et al.
Published: (2024)
Agentic Entropy-Balanced Policy Optimization
by: Dong, Guanting, et al.
Published: (2025)
by: Dong, Guanting, et al.
Published: (2025)
GRank: Towards Target-Aware and Streamlined Industrial Retrieval with a Generate-Rank Framework
by: Sun, Yijia, et al.
Published: (2025)
by: Sun, Yijia, et al.
Published: (2025)
Compositional Value Iteration with Pareto Caching
by: Watanabe, Kazuki, et al.
Published: (2024)
by: Watanabe, Kazuki, et al.
Published: (2024)
ParetoEnsembles.jl: A Julia Package for Multiobjective Parameter Estimation Using Pareto Optimal Ensemble Techniques
by: Varner, Jeffrey D.
Published: (2026)
by: Varner, Jeffrey D.
Published: (2026)
Sorting cells by Raman fingerprint
by: Jian Xu, et al.
Published: (2025)
by: Jian Xu, et al.
Published: (2025)
UniMixer: A Unified Architecture for Scaling Laws in Recommendation Systems
by: Ha, Mingming, et al.
Published: (2026)
by: Ha, Mingming, et al.
Published: (2026)
SARM: LLM-Augmented Semantic Anchor for End-to-End Live-Streaming Ranking
by: Yang, Ruochen, et al.
Published: (2026)
by: Yang, Ruochen, et al.
Published: (2026)
UniSAR: Modeling User Transition Behaviors between Search and Recommendation
by: Shi, Teng, et al.
Published: (2024)
by: Shi, Teng, et al.
Published: (2024)
State Regularized Policy Optimization on Data with Dynamics Shift
by: Xue, Zhenghai, et al.
Published: (2023)
by: Xue, Zhenghai, et al.
Published: (2023)
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
by: Qiu, Shuang, et al.
Published: (2024)
by: Qiu, Shuang, et al.
Published: (2024)
An Exact Theory of Causal Emergence for Linear Stochastic Iteration Systems
by: Liu, Kaiwei, et al.
Published: (2024)
by: Liu, Kaiwei, et al.
Published: (2024)
FARM: Frequency-Aware Model for Cross-Domain Live-Streaming Recommendation
by: Li, Xiaodong, et al.
Published: (2025)
by: Li, Xiaodong, et al.
Published: (2025)
QARM: Quantitative Alignment Multi-Modal Recommendation at Kuaishou
by: Luo, Xinchen, et al.
Published: (2024)
by: Luo, Xinchen, et al.
Published: (2024)
Multiplicative Turing Ensembles, Pareto's Law, and Creativity
by: Kolpakov, Alexander, et al.
Published: (2025)
by: Kolpakov, Alexander, et al.
Published: (2025)
Testing cosmic anisotropy with Pade approximation and Pantheon+ sample
by: Hu, Jianping, et al.
Published: (2024)
by: Hu, Jianping, et al.
Published: (2024)
Anisotropy in Pantheon+ supernovae
by: Sah, Animesh, et al.
Published: (2024)
by: Sah, Animesh, et al.
Published: (2024)
Il piccolo Pantheon
by: INNOCENTI, BARBARA
Published: (2022)
by: INNOCENTI, BARBARA
Published: (2022)
Similar Items
-
MaRI: Accelerating Ranking Model Inference via Structural Re-parameterization in Large Scale Recommendation System
by: Huang, Yusheng, et al.
Published: (2026) -
LLM-Alignment Live-Streaming Recommendation
by: Liu, Yueyang, et al.
Published: (2025) -
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
by: Wang, Xu, et al.
Published: (2024) -
A Unified Framework for Cross-Domain Recommendation
by: Cao, Jiangxia, et al.
Published: (2024) -
Moment&Cross: Next-Generation Real-Time Cross-Domain CTR Prediction for Live-Streaming Recommendation at Kuaishou
by: Cao, Jiangxia, et al.
Published: (2024)