VAO: Validation-Aligned Optimization for Cross-Task Generative Auto-Bidding
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lv, Yiqin, Mou, Zhiyu, Xu, Miao, Chen, Jinghao, Wang, Qi, Mao, Yixiu, Qu, Yun, Bai, Rongquan, Yu, Chuan, Xu, Jian, Zheng, Bo, Ji, Xiangyang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Enhancing Generative Auto-bidding with Offline Reward Evaluation and Policy Search
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
Large-Scale Auto-bidding with Nash Equilibrium Constraints
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025)
Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
von: Wang, Cheems, et al.
Veröffentlicht: (2024)
von: Wang, Cheems, et al.
Veröffentlicht: (2024)
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
von: Qu, Yun, et al.
Veröffentlicht: (2025)
von: Qu, Yun, et al.
Veröffentlicht: (2025)
Model Predictive Task Sampling for Efficient and Robust Adaptation
von: Wang, Qi, et al.
Veröffentlicht: (2025)
von: Wang, Qi, et al.
Veröffentlicht: (2025)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
von: Mao, Yixiu, et al.
Veröffentlicht: (2025)
von: Mao, Yixiu, et al.
Veröffentlicht: (2025)
MEBS: Multi-task End-to-end Bid Shading for Multi-slot Display Advertising
von: Gong, Zhen, et al.
Veröffentlicht: (2024)
von: Gong, Zhen, et al.
Veröffentlicht: (2024)
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
von: Mao, Yixiu, et al.
Veröffentlicht: (2026)
von: Mao, Yixiu, et al.
Veröffentlicht: (2026)
Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression
von: Mao, Yixiu, et al.
Veröffentlicht: (2024)
von: Mao, Yixiu, et al.
Veröffentlicht: (2024)
RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning
von: Mao, Yixiu, et al.
Veröffentlicht: (2026)
von: Mao, Yixiu, et al.
Veröffentlicht: (2026)
Doubly Mild Generalization for Offline Reinforcement Learning
von: Mao, Yixiu, et al.
Veröffentlicht: (2024)
von: Mao, Yixiu, et al.
Veröffentlicht: (2024)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
von: Zou, Heming, et al.
Veröffentlicht: (2025)
von: Zou, Heming, et al.
Veröffentlicht: (2025)
HOB: A Holistically Optimized Bidding Strategy under Heterogeneous Auction Mechanisms with Organic Traffic
von: Li, Qi, et al.
Veröffentlicht: (2025)
von: Li, Qi, et al.
Veröffentlicht: (2025)
Can Prompt Difficulty be Online Predicted for Accelerating RL Finetuning of Reasoning Models?
von: Qu, Yun, et al.
Veröffentlicht: (2025)
von: Qu, Yun, et al.
Veröffentlicht: (2025)
An Adaptable Budget Planner for Enhancing Budget-Constrained Auto-Bidding in Online Advertising
von: Duan, Zhijian, et al.
Veröffentlicht: (2025)
von: Duan, Zhijian, et al.
Veröffentlicht: (2025)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
von: Qu, Yun, et al.
Veröffentlicht: (2024)
von: Qu, Yun, et al.
Veröffentlicht: (2024)
Bid2X: Revealing Dynamics of Bidding Environment in Online Advertising from A Foundation Model Lens
von: Ji, Jiahao, et al.
Veröffentlicht: (2025)
von: Ji, Jiahao, et al.
Veröffentlicht: (2025)
Generative Auto-Bidding with Value-Guided Explorations
von: Gao, Jingtong, et al.
Veröffentlicht: (2025)
von: Gao, Jingtong, et al.
Veröffentlicht: (2025)
On the Existence and Nonexistence of Splitter Sets
von: Yuan, Zhiyu, et al.
Veröffentlicht: (2025)
von: Yuan, Zhiyu, et al.
Veröffentlicht: (2025)
Expert-Guided Diffusion Planner for Auto-Bidding
von: Peng, Yunshan, et al.
Veröffentlicht: (2025)
von: Peng, Yunshan, et al.
Veröffentlicht: (2025)
HALO: Hindsight-Augmented Learning for Online Auto-Bidding
von: Dong, Pusen, et al.
Veröffentlicht: (2025)
von: Dong, Pusen, et al.
Veröffentlicht: (2025)
JD-BP: A Joint-Decision Generative Framework for Auto-Bidding and Pricing
von: Meng, Linghui, et al.
Veröffentlicht: (2026)
von: Meng, Linghui, et al.
Veröffentlicht: (2026)
Small Generalizable Prompt Predictive Models Can Steer Efficient RL Post-Training of Large Reasoning Models
von: Qu, Yun, et al.
Veröffentlicht: (2026)
von: Qu, Yun, et al.
Veröffentlicht: (2026)
AHBid: An Adaptable Hierarchical Bidding Framework for Cross-Channel Advertising
von: Yang, Xinxin, et al.
Veröffentlicht: (2026)
von: Yang, Xinxin, et al.
Veröffentlicht: (2026)
Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration
von: Qu, Yun, et al.
Veröffentlicht: (2024)
von: Qu, Yun, et al.
Veröffentlicht: (2024)
Generative Auto-Bidding in Large-Scale Competitive Auctions via Diffusion Completer-Aligner
von: Li, Yewen, et al.
Veröffentlicht: (2025)
von: Li, Yewen, et al.
Veröffentlicht: (2025)
On the Role of Language Representations in Auto-Bidding: Findings and Implications
von: Zhu, Guanyu, et al.
Veröffentlicht: (2026)
von: Zhu, Guanyu, et al.
Veröffentlicht: (2026)
STAIR: Addressing Stage Misalignment through Temporal-Aligned Preference Reinforcement Learning
von: Luan, Yao, et al.
Veröffentlicht: (2025)
von: Luan, Yao, et al.
Veröffentlicht: (2025)
AutoMixAlign: Adaptive Data Mixing for Multi-Task Preference Optimization in LLMs
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2025)
von: Corrado, Nicholas E., et al.
Veröffentlicht: (2025)
Listwise Policy Optimization: Group-based RLVR as Target-Projection on the LLM Response Simplex
von: Qu, Yun, et al.
Veröffentlicht: (2026)
von: Qu, Yun, et al.
Veröffentlicht: (2026)
LBM: Hierarchical Large Auto-Bidding Model via Reasoning and Acting
von: Li, Yewen, et al.
Veröffentlicht: (2026)
von: Li, Yewen, et al.
Veröffentlicht: (2026)
HiBid: A Cross-Channel Constrained Bidding System with Budget Allocation by Hierarchical Offline Deep Reinforcement Learning
von: Wang, Hao, et al.
Veröffentlicht: (2023)
von: Wang, Hao, et al.
Veröffentlicht: (2023)
Generative Auto-Bidding with Unified Modeling and Exploration
von: Zhang, Mingming, et al.
Veröffentlicht: (2026)
von: Zhang, Mingming, et al.
Veröffentlicht: (2026)
Bidding-Aware Retrieval for Multi-Stage Consistency in Online Advertising
von: Liu, Bin, et al.
Veröffentlicht: (2025)
von: Liu, Bin, et al.
Veröffentlicht: (2025)
Beyond Advertising: Mechanism Design for Platform-Wide Marketing Service "QuanZhanTui"
von: Li, Ningyuan, et al.
Veröffentlicht: (2025)
von: Li, Ningyuan, et al.
Veröffentlicht: (2025)
Efficiency of Proportional Mechanisms in Online Auto-Bidding Advertising
von: Thang, Nguyen Kim
Veröffentlicht: (2026)
von: Thang, Nguyen Kim
Veröffentlicht: (2026)
Constrained Auto-Bidding via Generative Response Modeling
von: Yang, Eunseok, et al.
Veröffentlicht: (2026)
von: Yang, Eunseok, et al.
Veröffentlicht: (2026)
Theoretical Investigations and Practical Enhancements on Tail Task Risk Minimization in Meta Learning
von: Lv, Yiqin, et al.
Veröffentlicht: (2024)
von: Lv, Yiqin, et al.
Veröffentlicht: (2024)
A multimodal personality prediction framework based on adaptive graph transformer network and multi‐task learning
von: Rongquan Wang, et al.
Veröffentlicht: (2025)
von: Rongquan Wang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Enhancing Generative Auto-bidding with Offline Reward Evaluation and Policy Search
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025) -
Permutation Equivariant Model-based Offline Reinforcement Learning for Auto-bidding
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025) -
Large-Scale Auto-bidding with Nash Equilibrium Constraints
von: Mou, Zhiyu, et al.
Veröffentlicht: (2025) -
Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
von: Wang, Cheems, et al.
Veröffentlicht: (2024) -
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
von: Qu, Yun, et al.
Veröffentlicht: (2025)