Salvato in:
| Autori principali: | Xi, Jiachen, Garcia, Alfredo, Momcilovic, Petar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2401.15196 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error
di: Du, Ally Yalei, et al.
Pubblicazione: (2024)
di: Du, Ally Yalei, et al.
Pubblicazione: (2024)
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
di: Gu, Jingwen, et al.
Pubblicazione: (2025)
di: Gu, Jingwen, et al.
Pubblicazione: (2025)
Periodic Regularized Q-Learning
di: Yang, Hyukjun, et al.
Pubblicazione: (2026)
di: Yang, Hyukjun, et al.
Pubblicazione: (2026)
Graph Q-Learning for Combinatorial Optimization
di: Dax, Victoria M., et al.
Pubblicazione: (2024)
di: Dax, Victoria M., et al.
Pubblicazione: (2024)
Towards Assurance of LLM Adversarial Robustness using Ontology-Driven Argumentation
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
Extreme Values in Closed Networks
di: Jelenkovic, Predrag, et al.
Pubblicazione: (2025)
di: Jelenkovic, Predrag, et al.
Pubblicazione: (2025)
Towards Assuring EU AI Act Compliance and Adversarial Robustness of LLMs
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
OntoGSN: An Ontology-Based Framework for Semantic Management and Extension of Assurance Cases
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2025)
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2025)
The Role of Inherent Bellman Error in Offline Reinforcement Learning with Linear Function Approximation
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
Analysis of Off-Policy $n$-Step TD-Learning with Linear Function Approximation
di: Lim, Han-Dong, et al.
Pubblicazione: (2025)
di: Lim, Han-Dong, et al.
Pubblicazione: (2025)
Fitted Q-Iteration via Max-Plus-Linear Approximation
di: Liu, Y., et al.
Pubblicazione: (2024)
di: Liu, Y., et al.
Pubblicazione: (2024)
Developing Assurance Cases for Adversarial Robustness and Regulatory Compliance in LLMs
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
Unbiased Online Curvature Approximation for Regularized Graph Continual Learning
di: Yin, Jie, et al.
Pubblicazione: (2025)
di: Yin, Jie, et al.
Pubblicazione: (2025)
Variance-Covariance Regularization Improves Representation Learning
di: Zhu, Jiachen, et al.
Pubblicazione: (2023)
di: Zhu, Jiachen, et al.
Pubblicazione: (2023)
Knowledge-Augmented Reasoning for EUAIA Compliance and Adversarial Robustness of LLMs
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)
On the Complexity of Offline Reinforcement Learning with $Q^\star$-Approximation and Partial Coverage
di: Liu, Haolin, et al.
Pubblicazione: (2026)
di: Liu, Haolin, et al.
Pubblicazione: (2026)
Learning Distinguishable Representations in Deep Q-Networks for Linear Transfer
di: Sathish, Sooraj, et al.
Pubblicazione: (2025)
di: Sathish, Sooraj, et al.
Pubblicazione: (2025)
Micromobility Flow Prediction: A Bike Sharing Station-level Study via Multi-level Spatial-Temporal Attention Neural Network
di: Yang, Xi, et al.
Pubblicazione: (2025)
di: Yang, Xi, et al.
Pubblicazione: (2025)
Universal Approximation Theorem of Deep Q-Networks
di: Qi, Qian
Pubblicazione: (2025)
di: Qi, Qian
Pubblicazione: (2025)
Universal Approximation Theorem for Deep Q-Learning via FBSDE System
di: Qi, Qian
Pubblicazione: (2025)
di: Qi, Qian
Pubblicazione: (2025)
The Spike, the Sparse and the Sink: Anatomy of Massive Activations and Attention Sinks
di: Sun, Shangwen, et al.
Pubblicazione: (2026)
di: Sun, Shangwen, et al.
Pubblicazione: (2026)
EquiReg: Equivariance Regularized Diffusion for Inverse Problems
di: Tolooshams, Bahareh, et al.
Pubblicazione: (2025)
di: Tolooshams, Bahareh, et al.
Pubblicazione: (2025)
rQdia: Regularizing Q-Value Distributions With Image Augmentation
di: Lerman, Sam, et al.
Pubblicazione: (2025)
di: Lerman, Sam, et al.
Pubblicazione: (2025)
Robust Offline Reinforcement Learning with Linearly Structured f-Divergence Regularization
di: Tang, Cheng, et al.
Pubblicazione: (2024)
di: Tang, Cheng, et al.
Pubblicazione: (2024)
Mining Generalizable Activation Functions
di: Vitvitskyi, Alex, et al.
Pubblicazione: (2026)
di: Vitvitskyi, Alex, et al.
Pubblicazione: (2026)
AGaLiTe: Approximate Gated Linear Transformers for Online Reinforcement Learning
di: Pramanik, Subhojeet, et al.
Pubblicazione: (2023)
di: Pramanik, Subhojeet, et al.
Pubblicazione: (2023)
Tighter Value-Function Approximations for POMDPs
di: Krale, Merlijn, et al.
Pubblicazione: (2025)
di: Krale, Merlijn, et al.
Pubblicazione: (2025)
Learning Regularizers: Learning Optimizers that can Regularize
di: Sahoo, Suraj Kumar, et al.
Pubblicazione: (2025)
di: Sahoo, Suraj Kumar, et al.
Pubblicazione: (2025)
Towards Differentially Private Reinforcement Learning with General Function Approximation
di: He, Yi, et al.
Pubblicazione: (2026)
di: He, Yi, et al.
Pubblicazione: (2026)
STAR: Similarity-guided Teacher-Assisted Refinement for Super-Tiny Function Calling Models
di: Ni, Jiliang, et al.
Pubblicazione: (2026)
di: Ni, Jiliang, et al.
Pubblicazione: (2026)
Linear $Q$-Learning Does Not Diverge in $L^2$: Convergence Rates to a Bounded Set
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
Uncertainty Quantification in Probabilistic Machine Learning Models: Theory, Methods, and Insights
di: Ajirak, Marzieh, et al.
Pubblicazione: (2025)
di: Ajirak, Marzieh, et al.
Pubblicazione: (2025)
Learning Linearity in Audio Consistency Autoencoders via Implicit Regularization
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
di: Torres, Bernardo, et al.
Pubblicazione: (2025)
GlowQ: Group-Shared LOw-Rank Approximation for Quantized LLMs
di: An, Selim, et al.
Pubblicazione: (2026)
di: An, Selim, et al.
Pubblicazione: (2026)
On Limitation of Transformer for Learning HMMs
di: Hu, Jiachen, et al.
Pubblicazione: (2024)
di: Hu, Jiachen, et al.
Pubblicazione: (2024)
Experiment Planning with Function Approximation
di: Pacchiano, Aldo, et al.
Pubblicazione: (2024)
di: Pacchiano, Aldo, et al.
Pubblicazione: (2024)
A* Search Without Expansions: Learning Heuristic Functions with Deep Q-Networks
di: Agostinelli, Forest, et al.
Pubblicazione: (2021)
di: Agostinelli, Forest, et al.
Pubblicazione: (2021)
Local Reinforcement Learning with Action-Conditioned Root Mean Squared Q-Functions
di: Wu, Frank, et al.
Pubblicazione: (2025)
di: Wu, Frank, et al.
Pubblicazione: (2025)
Visual Inception: Compromising Long-term Planning in Agentic Recommenders via Multimodal Memory Poisoning
di: Qian, Jiachen
Pubblicazione: (2026)
di: Qian, Jiachen
Pubblicazione: (2026)
In-Context Learning for Non-Stationary MIMO Equalization
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
di: Jiang, Jiachen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Misspecified $Q$-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error
di: Du, Ally Yalei, et al.
Pubblicazione: (2024) -
Policy Regularized Distributionally Robust Markov Decision Processes with Linear Function Approximation
di: Gu, Jingwen, et al.
Pubblicazione: (2025) -
Periodic Regularized Q-Learning
di: Yang, Hyukjun, et al.
Pubblicazione: (2026) -
Graph Q-Learning for Combinatorial Optimization
di: Dax, Victoria M., et al.
Pubblicazione: (2024) -
Towards Assurance of LLM Adversarial Robustness using Ontology-Driven Argumentation
di: Momcilovic, Tomas Bueno, et al.
Pubblicazione: (2024)