RPS: Information Elicitation with Reinforcement Prompt Selection
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Tao, Lu, Jingyao, Wang, Xibo, Huang, Haonan, Yao, Su, Hu, Zhiqiang, Chen, Xingyan, Diao, Enmao |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FedOBP: Federated Optimal Brain Personalization through Cloud-Edge Element-wise Decoupling
by: Chen, Xingyan, et al.
Published: (2026)
by: Chen, Xingyan, et al.
Published: (2026)
Toward Unifying Group Fairness Evaluation from a Sparsity Perspective
by: Sheng, Zhecheng, et al.
Published: (2025)
by: Sheng, Zhecheng, et al.
Published: (2025)
Graph Tokenization for Bridging Graphs and Transformers
by: Guo, Zeyuan, et al.
Published: (2026)
by: Guo, Zeyuan, et al.
Published: (2026)
VFL-RPS: Relevant Participant Selection in Vertical Federated Learning
by: Khan, Afsana, et al.
Published: (2025)
by: Khan, Afsana, et al.
Published: (2025)
DynamicFL: Federated Learning with Dynamic Communication Resource Allocation
by: Le, Qi, et al.
Published: (2024)
by: Le, Qi, et al.
Published: (2024)
Learning to Think: Information-Theoretic Reinforcement Fine-Tuning for LLMs
by: Wang, Jingyao, et al.
Published: (2025)
by: Wang, Jingyao, et al.
Published: (2025)
ColA: Collaborative Adaptation with Gradient Learning
by: Diao, Enmao, et al.
Published: (2024)
by: Diao, Enmao, et al.
Published: (2024)
Probe Pruning: Accelerating LLMs through Dynamic Pruning via Model-Probing
by: Le, Qi, et al.
Published: (2025)
by: Le, Qi, et al.
Published: (2025)
Robust Score-Based Quickest Change Detection
by: Moushegian, Sean, et al.
Published: (2024)
by: Moushegian, Sean, et al.
Published: (2024)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
by: Wang, Ziyan, et al.
Published: (2025)
by: Wang, Ziyan, et al.
Published: (2025)
Design-MLLM: A Reinforcement Alignment Framework for Verifiable and Aesthetic Interior Design
by: Yang, Yuxuan, et al.
Published: (2026)
by: Yang, Yuxuan, et al.
Published: (2026)
Transformers Are Born Biased: Structural Inductive Biases at Random Initialization and Their Practical Consequences
by: Li, Siquan, et al.
Published: (2026)
by: Li, Siquan, et al.
Published: (2026)
Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
by: Li, Haolin, et al.
Published: (2026)
by: Li, Haolin, et al.
Published: (2026)
GAR: Generative Adversarial Reinforcement Learning for Formal Theorem Proving
by: Wang, Ruida, et al.
Published: (2025)
by: Wang, Ruida, et al.
Published: (2025)
Decision Mamba: Reinforcement Learning via Hybrid Selective Sequence Modeling
by: Huang, Sili, et al.
Published: (2024)
by: Huang, Sili, et al.
Published: (2024)
Reinforced Compressive Neural Architecture Search for Versatile Adversarial Robustness
by: Wang, Dingrong, et al.
Published: (2024)
by: Wang, Dingrong, et al.
Published: (2024)
Preference Elicitation for Offline Reinforcement Learning
by: Pace, Alizée, et al.
Published: (2024)
by: Pace, Alizée, et al.
Published: (2024)
FIPO: Eliciting Deep Reasoning with Future-KL Influenced Policy Optimization
by: Ma, Chiyu, et al.
Published: (2026)
by: Ma, Chiyu, et al.
Published: (2026)
A Kinetic Energy Perspective of Flow Matching
by: Li, Ziyun, et al.
Published: (2026)
by: Li, Ziyun, et al.
Published: (2026)
Verbal Process Supervision Elicits Better Coding Agents
by: Chen, Hao-Yuan, et al.
Published: (2025)
by: Chen, Hao-Yuan, et al.
Published: (2025)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
by: Wang, Ziyan, et al.
Published: (2025)
by: Wang, Ziyan, et al.
Published: (2025)
Embedding by Elicitation: Dynamic Representations for Bayesian Optimization of System Prompts
by: Lin, Zhiyuan Jerry, et al.
Published: (2026)
by: Lin, Zhiyuan Jerry, et al.
Published: (2026)
Evolving Prompts In-Context: An Open-ended, Self-replicating Perspective
by: Wang, Jianyu, et al.
Published: (2025)
by: Wang, Jianyu, et al.
Published: (2025)
FedAL: Black-Box Federated Knowledge Distillation Enabled by Adversarial Learning
by: Han, Pengchao, et al.
Published: (2023)
by: Han, Pengchao, et al.
Published: (2023)
Efficient Swap Multicalibration of Elicitable Properties
by: Hu, Lunjia, et al.
Published: (2025)
by: Hu, Lunjia, et al.
Published: (2025)
Eliciting Behaviors in Multi-Turn Conversations
by: Huang, Jing, et al.
Published: (2025)
by: Huang, Jing, et al.
Published: (2025)
Eliciting Risk Aversion with Inverse Reinforcement Learning via Interactive Questioning
by: Cheng, Ziteng, et al.
Published: (2023)
by: Cheng, Ziteng, et al.
Published: (2023)
A Generalized Learning Framework for Self-Supervised Contrastive Learning
by: Si, Lingyu, et al.
Published: (2025)
by: Si, Lingyu, et al.
Published: (2025)
Each Prompt Matters: Scaling Reinforcement Learning Without Wasting Rollouts on Hundred-Billion-Scale MoE
by: Zeng, Anxiang, et al.
Published: (2025)
by: Zeng, Anxiang, et al.
Published: (2025)
Rethinking the Role of Dynamic Sparse Training for Scalable Deep Reinforcement Learning
by: Ma, Guozheng, et al.
Published: (2025)
by: Ma, Guozheng, et al.
Published: (2025)
Adaptive Elicitation of Latent Information Using Natural Language
by: Wang, Jimmy, et al.
Published: (2025)
by: Wang, Jimmy, et al.
Published: (2025)
TabSieve: Explicit In-Table Evidence Selection for Tabular Prediction
by: Wang, Yongyao, et al.
Published: (2026)
by: Wang, Yongyao, et al.
Published: (2026)
S$^2$R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning
by: Ma, Ruotian, et al.
Published: (2025)
by: Ma, Ruotian, et al.
Published: (2025)
Eliciting Chain-of-Thought Reasoning for Time Series Analysis using Reinforcement Learning
by: Parker, Felix, et al.
Published: (2025)
by: Parker, Felix, et al.
Published: (2025)
Accelerating Large-Scale Regularized High-Order Tensor Recovery
by: Qin, Wenjin, et al.
Published: (2025)
by: Qin, Wenjin, et al.
Published: (2025)
Sequential Knockoffs for Variable Selection in Reinforcement Learning
by: Ma, Tao, et al.
Published: (2023)
by: Ma, Tao, et al.
Published: (2023)
MAP: Multi-Human-Value Alignment Palette
by: Wang, Xinran, et al.
Published: (2024)
by: Wang, Xinran, et al.
Published: (2024)
Rethinking Plasticity in Deep Reinforcement Learning
by: He, Zhiqiang
Published: (2026)
by: He, Zhiqiang
Published: (2026)
Principled Data Selection for Alignment: The Hidden Risks of Difficult Examples
by: Gao, Chengqian, et al.
Published: (2025)
by: Gao, Chengqian, et al.
Published: (2025)
LLM-Prior: A Framework for Knowledge-Driven Prior Elicitation and Aggregation
by: Huang, Yongchao
Published: (2025)
by: Huang, Yongchao
Published: (2025)
Similar Items
-
FedOBP: Federated Optimal Brain Personalization through Cloud-Edge Element-wise Decoupling
by: Chen, Xingyan, et al.
Published: (2026) -
Toward Unifying Group Fairness Evaluation from a Sparsity Perspective
by: Sheng, Zhecheng, et al.
Published: (2025) -
Graph Tokenization for Bridging Graphs and Transformers
by: Guo, Zeyuan, et al.
Published: (2026) -
VFL-RPS: Relevant Participant Selection in Vertical Federated Learning
by: Khan, Afsana, et al.
Published: (2025) -
DynamicFL: Federated Learning with Dynamic Communication Resource Allocation
by: Le, Qi, et al.
Published: (2024)