Resultados de búsqueda - Lin, F.
- Mostrando 1 - 20 Resultados de 73
- Ir a la Siguiente Página
-
1
Winning Gold at IMO 2025 with a Model-Agnostic Verification-and-Refinement Pipeline por Huang, Yichen, Yang, Lin F.
Publicado 2025Enlace del recurso
Preprint -
2
-
3
Sample Complexity Bounds for Linear Constrained MDPs with a Generative Model por Liu, Xingtu, Yang, Lin F., Vaswani, Sharan
Publicado 2025Enlace del recurso
Preprint -
4
Near-Optimal Sample Complexity Bounds for Constrained Average-Reward MDPs por Wei, Yukuan, Li, Xudong, Yang, Lin F.
Publicado 2025Enlace del recurso
Preprint -
5
Near-Optimal Sample Complexity for Online Constrained MDPs por Liu, Chang, Li, Yunfan, Yang, Lin F.
Publicado 2026Enlace del recurso
Preprint -
6
-
7
-
8
Uniform Last-Iterate Guarantee for Bandits and Reinforcement Learning por Liu, Junyan, Li, Yunfan, Wang, Ruosong, Yang, Lin F.
Publicado 2024Enlace del recurso
Preprint -
9
Learning for Bandits under Action Erasures por Hanna, Osama, Karakas, Merve, Yang, Lin F., Fragouli, Christina
Publicado 2024Enlace del recurso
Preprint -
10
Does Feedback Help in Bandits with Arm Erasures? por Karakas, Merve, Hanna, Osama, Yang, Lin F., Fragouli, Christina
Publicado 2025Enlace del recurso
Preprint -
11
On the optimal regret of collaborative personalized linear bandits por Huang, Bruce, Zhou, Ruida, Yang, Lin F., Diggavi, Suhas
Publicado 2025Enlace del recurso
Preprint -
12
Best-Arm Identification with Noisy Actuation por Karakas, Merve, Hanna, Osama, Yang, Lin F., Fragouli, Christina
Publicado 2026Enlace del recurso
Preprint -
13
-
14
Don't Forget to Connect! Improving RAG with Graph-based Reranking por Dong, Jialin, Fatemi, Bahare, Perozzi, Bryan, Yang, Lin F., Tsitsulin, Anton
Publicado 2024Enlace del recurso
Preprint -
15
-
16
-
17
-
18
-
19
-
20
LACONIC: Length-Aware Constrained Reinforcement Learning for LLM por Liu, Chang, Zhao, Yiran, Liu, Lawrence, Ye, Yaoqi, Szepesvári, Csaba, Yang, Lin F.
Publicado 2026Enlace del recurso
Preprint