Search Results - Poupart, Pascal
- Showing 1 - 20 results of 29
- Go to Next Page
-
1
Why Online Reinforcement Learning is Causal Autoría: Schulte, Oliver, Poupart, Pascal
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
2
FedLog: Personalized Federated Classification with Less Communication and More Flexibility Autoría: Yu, Haolin, Zhang, Guojun, Poupart, Pascal
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
3
Basis Transformers for Multi-Task Tabular Regression Autoría: Loh, Wei Min, Shang, Jiaqi, Poupart, Pascal
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
4
Measures of Variability for Risk-averse Policy Gradient Autoría: Luo, Yudong, Pan, Yangchen, Tan, Jiaqi, Poupart, Pascal
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
5
Time Is Effort: Estimating Human Post-Editing Time for Grammar Error Correction Tool Evaluation Autoría: Vadehra, Ankit, Johnson, Bill, Saunders, Gene, Poupart, Pascal
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
6
Learning to Negotiate via Voluntary Commitment Autoría: Zhu, Shuhui, Wang, Baoxiang, Subramanian, Sriram Ganapathi, Poupart, Pascal
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
7
Preventing Arbitrarily High Confidence on Far-Away Data in Point-Estimated Discriminative Neural Networks Autoría: Rashid, Ahmad, Hacker, Serena, Zhang, Guojun, Kristiadi, Agustinus, Poupart, Pascal
Published 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
8
Calibrated One Round Federated Learning with Bayesian Inference in the Predictive Space Autoría: Hasan, Mohsin, Zhang, Guojun, Guo, Kaiyang, Chen, Xi, Poupart, Pascal
Published 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
9
A Simple Mixture Policy Parameterization for Improving Sample Efficiency of CVaR Optimization Autoría: Luo, Yudong, Pan, Yangchen, Wang, Han, Torr, Philip, Poupart, Pascal
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
10
A Critical Look At Tokenwise Reward-Guided Text Generation Autoría: Rashid, Ahmad, Wu, Ruotian, Grosse, Julia, Kristiadi, Agustinus, Poupart, Pascal
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
11
Reflect-then-Plan: Offline Model-Based Planning through a Doubly Bayesian Lens Autoría: Jeong, Jihwan, Wang, Xiaoyu, Wang, Jingmin, Sanner, Scott, Poupart, Pascal
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
12
Image-POSER: Reflective RL for Multi-Expert Image Generation and Editing Autoría: Mohebbi, Hossein, Abdulrahman, Mohammed, Miao, Yanting, Poupart, Pascal, Kothawade, Suraj
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
13
A Practical Algorithm for Feature-Rich, Non-Stationary Bandit Problems Autoría: Loh, Wei Min, Sinha, Sajib Kumer, Agarwal, Ankur, Poupart, Pascal
Published 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
14
Confidence Aware Inverse Constrained Reinforcement Learning Autoría: Subramanian, Sriram Ganapathi, Liu, Guiliang, Elmahgiubi, Mohammed, Rezaee, Kasra, Poupart, Pascal
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
15
Subject-driven Text-to-Image Generation via Preference-based Reinforcement Learning Autoría: Miao, Yanting, Loh, William, Kothawade, Suraj, Poupart, Pascal, Rashwan, Abdullah, Li, Yeqing
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
16
Towards Cost-Effective Reward Guided Text Generation Autoría: Rashid, Ahmad, Wu, Ruotian, Fan, Rongqi, Li, Hongliang, Kristiadi, Agustinus, Poupart, Pascal
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
17
A Comprehensive Survey on Inverse Constrained Reinforcement Learning: Definitions, Progress and Challenges Autoría: Liu, Guiliang, Xu, Sheng, Liu, Shicheng, Gaurav, Ashish, Subramanian, Sriram Ganapathi, Poupart, Pascal
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
18
A Sober Look at LLMs for Material Discovery: Are They Actually Good for Bayesian Optimization Over Molecules? Autoría: Kristiadi, Agustinus, Strieth-Kalthoff, Felix, Skreta, Marta, Poupart, Pascal, Aspuru-Guzik, Alán, Pleiss, Geoff
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
19
How Useful is Intermittent, Asynchronous Expert Feedback for Bayesian Optimization? Autoría: Kristiadi, Agustinus, Strieth-Kalthoff, Felix, Subramanian, Sriram Ganapathi, Fortuin, Vincent, Poupart, Pascal, Pleiss, Geoff
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
20
Uncertainty-Guided Likelihood Tree Search Autoría: Grosse, Julia, Wu, Ruotian, Rashid, Ahmad, Zhang, Cheng, Hennig, Philipp, Poupart, Pascal, Kristiadi, Agustinus
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso