Guardado en:
| Autores principales: | Xi, Jiachen, Garcia, Alfredo, Momcilovic, Petar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2401.15196 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error
por: Du, Ally Yalei, et al.
Publicado: (2024)
por: Du, Ally Yalei, et al.
Publicado: (2024)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
por: Gu, Jingwen, et al.
Publicado: (2025)
por: Gu, Jingwen, et al.
Publicado: (2025)
Periodic Regularized Q-Learning
por: Yang, Hyukjun, et al.
Publicado: (2026)
por: Yang, Hyukjun, et al.
Publicado: (2026)
Graph Q-Learning for Combinatorial Optimization
por: Dax, Victoria M., et al.
Publicado: (2024)
por: Dax, Victoria M., et al.
Publicado: (2024)
Towards Assurance of LLM Adversarial Robustness using Ontology-Driven Argumentation
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
Extreme Values in Closed Networks
por: Jelenkovic, Predrag, et al.
Publicado: (2025)
por: Jelenkovic, Predrag, et al.
Publicado: (2025)
Towards Assuring EU AI Act Compliance and Adversarial Robustness of LLMs
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
OntoGSN: An Ontology-Based Framework for Semantic Management and Extension of Assurance Cases
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2025)
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2025)
The Role of Inherent Bellman Error in Offline Reinforcement Learning with Linear Function Approximation
por: Golowich, Noah, et al.
Publicado: (2024)
por: Golowich, Noah, et al.
Publicado: (2024)
Analysis of Off-Policy $n$-Step TD-Learning with Linear Function Approximation
por: Lim, Han-Dong, et al.
Publicado: (2025)
por: Lim, Han-Dong, et al.
Publicado: (2025)
Fitted Q-Iteration via Max-Plus-Linear Approximation
por: Liu, Y., et al.
Publicado: (2024)
por: Liu, Y., et al.
Publicado: (2024)
Developing Assurance Cases for Adversarial Robustness and Regulatory Compliance in LLMs
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
Unbiased Online Curvature Approximation for Regularized Graph Continual Learning
por: Yin, Jie, et al.
Publicado: (2025)
por: Yin, Jie, et al.
Publicado: (2025)
Variance-Covariance Regularization Improves Representation Learning
por: Zhu, Jiachen, et al.
Publicado: (2023)
por: Zhu, Jiachen, et al.
Publicado: (2023)
Knowledge-Augmented Reasoning for EUAIA Compliance and Adversarial Robustness of LLMs
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
por: Liu, Haolin, et al.
Publicado: (2026)
por: Liu, Haolin, et al.
Publicado: (2026)
Learning Distinguishable Representations in Deep Q-Networks for Linear Transfer
por: Sathish, Sooraj, et al.
Publicado: (2025)
por: Sathish, Sooraj, et al.
Publicado: (2025)
Micromobility Flow Prediction: A Bike Sharing Station-level Study via Multi-level Spatial-Temporal Attention Neural Network
por: Yang, Xi, et al.
Publicado: (2025)
por: Yang, Xi, et al.
Publicado: (2025)
Universal Approximation Theorem of Deep Q-Networks
por: Qi, Qian
Publicado: (2025)
por: Qi, Qian
Publicado: (2025)
Universal Approximation Theorem for Deep Q-Learning via FBSDE System
por: Qi, Qian
Publicado: (2025)
por: Qi, Qian
Publicado: (2025)
The Spike, the Sparse and the Sink: Anatomy of Massive Activations and Attention Sinks
por: Sun, Shangwen, et al.
Publicado: (2026)
por: Sun, Shangwen, et al.
Publicado: (2026)
EquiReg: Equivariance Regularized Diffusion for Inverse Problems
por: Tolooshams, Bahareh, et al.
Publicado: (2025)
por: Tolooshams, Bahareh, et al.
Publicado: (2025)
rQdia: Regularizing Q-Value Distributions With Image Augmentation
por: Lerman, Sam, et al.
Publicado: (2025)
por: Lerman, Sam, et al.
Publicado: (2025)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
por: Tang, Cheng, et al.
Publicado: (2024)
por: Tang, Cheng, et al.
Publicado: (2024)
Mining Generalizable Activation Functions
por: Vitvitskyi, Alex, et al.
Publicado: (2026)
por: Vitvitskyi, Alex, et al.
Publicado: (2026)
AGaLiTe: Approximate Gated Linear Transformers for Online Reinforcement Learning
por: Pramanik, Subhojeet, et al.
Publicado: (2023)
por: Pramanik, Subhojeet, et al.
Publicado: (2023)
Tighter Value-Function Approximations for POMDPs
por: Krale, Merlijn, et al.
Publicado: (2025)
por: Krale, Merlijn, et al.
Publicado: (2025)
Learning Regularizers: Learning Optimizers that can Regularize
por: Sahoo, Suraj Kumar, et al.
Publicado: (2025)
por: Sahoo, Suraj Kumar, et al.
Publicado: (2025)
Towards Differentially Private Reinforcement Learning with General Function Approximation
por: He, Yi, et al.
Publicado: (2026)
por: He, Yi, et al.
Publicado: (2026)
STAR: Similarity-guided Teacher-Assisted Refinement for Super-Tiny Function Calling Models
por: Ni, Jiliang, et al.
Publicado: (2026)
por: Ni, Jiliang, et al.
Publicado: (2026)
Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set
por: Liu, Xinyu, et al.
Publicado: (2025)
por: Liu, Xinyu, et al.
Publicado: (2025)
Uncertainty Quantification in Probabilistic Machine Learning Models: Theory, Methods, and Insights
por: Ajirak, Marzieh, et al.
Publicado: (2025)
por: Ajirak, Marzieh, et al.
Publicado: (2025)
Learning Linearity in Audio Consistency Autoencoders via Implicit Regularization
por: Torres, Bernardo, et al.
Publicado: (2025)
por: Torres, Bernardo, et al.
Publicado: (2025)
GlowQ: Group-Shared LOw-Rank Approximation for Quantized LLMs
por: An, Selim, et al.
Publicado: (2026)
por: An, Selim, et al.
Publicado: (2026)
On Limitation of Transformer for Learning HMMs
por: Hu, Jiachen, et al.
Publicado: (2024)
por: Hu, Jiachen, et al.
Publicado: (2024)
Experiment Planning with Function Approximation
por: Pacchiano, Aldo, et al.
Publicado: (2024)
por: Pacchiano, Aldo, et al.
Publicado: (2024)
A* Search Without Expansions: Learning Heuristic Functions with Deep Q-Networks
por: Agostinelli, Forest, et al.
Publicado: (2021)
por: Agostinelli, Forest, et al.
Publicado: (2021)
Local Reinforcement Learning with Action-Conditioned Root Mean Squared Q-Functions
por: Wu, Frank, et al.
Publicado: (2025)
por: Wu, Frank, et al.
Publicado: (2025)
Visual Inception: Compromising Long-term Planning in Agentic Recommenders via Multimodal Memory Poisoning
por: Qian, Jiachen
Publicado: (2026)
por: Qian, Jiachen
Publicado: (2026)
In-Context Learning for Non-Stationary MIMO Equalization
por: Jiang, Jiachen, et al.
Publicado: (2025)
por: Jiang, Jiachen, et al.
Publicado: (2025)
Ejemplares similares
-
Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error
por: Du, Ally Yalei, et al.
Publicado: (2024) -
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
por: Gu, Jingwen, et al.
Publicado: (2025) -
Periodic Regularized Q-Learning
por: Yang, Hyukjun, et al.
Publicado: (2026) -
Graph Q-Learning for Combinatorial Optimization
por: Dax, Victoria M., et al.
Publicado: (2024) -
Towards Assurance of LLM Adversarial Robustness using Ontology-Driven Argumentation
por: Momcilovic, Tomas Bueno, et al.
Publicado: (2024)