Search Results - Lin, F.
- Showing 1 - 20 results of 73
- Go to Next Page
-
1
Winning Gold at IMO 2025 with a Model-Agnostic Verification-and-Refinement Pipeline Autoría: Huang, Yichen, Yang, Lin F.
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
2
Confident Natural Policy Gradient for Local Planning in $q_π$-realizable Constrained MDPs Autoría: Tian, Tian, Yang, Lin F., Szepesvári, Csaba
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
3
Sample Complexity Bounds for Linear Constrained MDPs with a Generative Model Autoría: Liu, Xingtu, Yang, Lin F., Vaswani, Sharan
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
4
Near-Optimal Sample Complexity Bounds for Constrained Average-Reward MDPs Autoría: Wei, Yukuan, Li, Xudong, Yang, Lin F.
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
5
Near-Optimal Sample Complexity for Online Constrained MDPs Autoría: Liu, Chang, Li, Yunfan, Yang, Lin F.
Published 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
6
Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error Autoría: Du, Ally Yalei, Yang, Lin F., Wang, Ruosong
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
7
Tackling Heavy-Tailed Rewards in Reinforcement Learning with Function Approximation: Minimax Optimal and Instance-Dependent Regret Bounds Autoría: Huang, Jiayi, Zhong, Han, Wang, Liwei, Yang, Lin F.
Published 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
8
Uniform Last-Iterate Guarantee for Bandits and Reinforcement Learning Autoría: Liu, Junyan, Li, Yunfan, Wang, Ruosong, Yang, Lin F.
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
9
Learning for Bandits under Action Erasures Autoría: Hanna, Osama, Karakas, Merve, Yang, Lin F., Fragouli, Christina
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
10
Does Feedback Help in Bandits with Arm Erasures? Autoría: Karakas, Merve, Hanna, Osama, Yang, Lin F., Fragouli, Christina
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
11
On the optimal regret of collaborative personalized linear bandits Autoría: Huang, Bruce, Zhou, Ruida, Yang, Lin F., Diggavi, Suhas
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
12
Best-Arm Identification with Noisy Actuation Autoría: Karakas, Merve, Hanna, Osama, Yang, Lin F., Fragouli, Christina
Published 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
13
Multi-Agent Bandit Learning through Heterogeneous Action Erasure Channels Autoría: Hanna, Osama A., Karakas, Merve, Yang, Lin F., Fragouli, Christina
Published 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
14
Don't Forget to Connect! Improving RAG with Graph-based Reranking Autoría: Dong, Jialin, Fatemi, Bahare, Perozzi, Bryan, Yang, Lin F., Tsitsulin, Anton
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
15
ARMOR: High-Performance Semi-Structured Pruning via Adaptive Matrix Factorization Autoría: Liu, Lawrence, Liu, Alexander, Wang, Mengdi, Zhao, Tuo, Yang, Lin F.
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
16
A geometric distortion solution specifically for historical observations and its implementation Autoría: Lin, F. R., Peng, Q. Y., Zheng, Z. J., Guo, B. F.
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
17
Precision premium transformation -- a high-precision astrometric solution based on the precision premium curve Autoría: Zheng, Z. J., Peng, Q. Y., Lin, F. R., Li, D., Zheng, Y.
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
18
Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement Learning Autoría: Wang, Yiran, Liu, Chenshu, Li, Yunfan, Amani, Sanae, Zhou, Bolei, Yang, Lin F.
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
19
NoWag: A Unified Framework for Shape Preserving Compression of Large Language Models Autoría: Liu, Lawrence, Chakrabarti, Inesh, Li, Yixiao, Wang, Mengdi, Zhao, Tuo, Yang, Lin F.
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
20
LACONIC: Length-Aware Constrained Reinforcement Learning for LLM Autoría: Liu, Chang, Zhao, Yiran, Liu, Lawrence, Ye, Yaoqi, Szepesvári, Csaba, Yang, Lin F.
Published 2026Fuente: arXivTipo de material: PreprintAcceso al recurso