Limits of Convergence-Rate Control for Open-Weight Safety
Fuente:
arXiv
Salvato in:
| Autori principali: | Rosati, Domenic, Zeng, Xijie, Huang, Hong, Dionicio, Sebastian, Majumdar, Subhabrata, Rudzicz, Frank, Sajjad, Hassan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating Defences against Unsafe Feedback in RLHF
di: Rosati, Domenic, et al.
Pubblicazione: (2024)
di: Rosati, Domenic, et al.
Pubblicazione: (2024)
Open Problem: Anytime Convergence Rate of Gradient Descent
di: Kornowski, Guy, et al.
Pubblicazione: (2024)
di: Kornowski, Guy, et al.
Pubblicazione: (2024)
Rates of Convergence in the Central Limit Theorem for Markov Chains, with an Application to TD Learning
di: Srikant, R.
Pubblicazione: (2024)
di: Srikant, R.
Pubblicazione: (2024)
Convergence Rate Analysis of LION
di: Dong, Yiming, et al.
Pubblicazione: (2024)
di: Dong, Yiming, et al.
Pubblicazione: (2024)
MAP Estimation with Denoisers: Convergence Rates and Guarantees
di: Pesme, Scott, et al.
Pubblicazione: (2025)
di: Pesme, Scott, et al.
Pubblicazione: (2025)
Krylov Cubic Regularized Newton: A Subspace Second-Order Method with Dimension-Free Convergence Rate
di: Jiang, Ruichen, et al.
Pubblicazione: (2024)
di: Jiang, Ruichen, et al.
Pubblicazione: (2024)
Robust Sublinear Convergence Rates for Iterative Bregman Projections
di: Peyré, Gabriel
Pubblicazione: (2026)
di: Peyré, Gabriel
Pubblicazione: (2026)
Improved Convergence Rates of Muon Optimizer for Nonconvex Optimization
di: Nagashima, Shuntaro, et al.
Pubblicazione: (2026)
di: Nagashima, Shuntaro, et al.
Pubblicazione: (2026)
Implicit Bias and Fast Convergence Rates for Self-attention
di: Vasudeva, Bhavya, et al.
Pubblicazione: (2024)
di: Vasudeva, Bhavya, et al.
Pubblicazione: (2024)
Convergence Rate of the Last Iterate of Stochastic Proximal Algorithms
di: Vaidyan, Kevin Kurian Thomas, et al.
Pubblicazione: (2026)
di: Vaidyan, Kevin Kurian Thomas, et al.
Pubblicazione: (2026)
Incremental Gauss--Newton Methods with Superlinear Convergence Rates
di: Zhou, Zhiling, et al.
Pubblicazione: (2024)
di: Zhou, Zhiling, et al.
Pubblicazione: (2024)
Nonsmooth Implicit Differentiation: Deterministic and Stochastic Convergence Rates
di: Grazzi, Riccardo, et al.
Pubblicazione: (2024)
di: Grazzi, Riccardo, et al.
Pubblicazione: (2024)
Reusing Historical Trajectories in Natural Policy Gradient via Importance Sampling: Convergence and Convergence Rate
di: Lin, Yifan, et al.
Pubblicazione: (2024)
di: Lin, Yifan, et al.
Pubblicazione: (2024)
Adaptive Algorithms with Sharp Convergence Rates for Stochastic Hierarchical Optimization
di: Gong, Xiaochuan, et al.
Pubblicazione: (2025)
di: Gong, Xiaochuan, et al.
Pubblicazione: (2025)
Adam-HNAG: A Convergent Reformulation of Adam with Accelerated Rate
di: Yu, Yaxin, et al.
Pubblicazione: (2026)
di: Yu, Yaxin, et al.
Pubblicazione: (2026)
Sharper Convergence Rates for Nonconvex Optimisation via Reduction Mappings
di: Markou, Evan, et al.
Pubblicazione: (2025)
di: Markou, Evan, et al.
Pubblicazione: (2025)
Theoretical Analysis on how Learning Rate Warmup Accelerates Convergence
di: Liu, Yuxing, et al.
Pubblicazione: (2025)
di: Liu, Yuxing, et al.
Pubblicazione: (2025)
Incremental Quasi-Newton Methods with Faster Superlinear Convergence Rates
di: Liu, Zhuanghua, et al.
Pubblicazione: (2024)
di: Liu, Zhuanghua, et al.
Pubblicazione: (2024)
Representation Noising: A Defence Mechanism Against Harmful Finetuning
di: Rosati, Domenic, et al.
Pubblicazione: (2024)
di: Rosati, Domenic, et al.
Pubblicazione: (2024)
Controlling the Flow: Stability and Convergence for Stochastic Gradient Descent with Decaying Regularization
di: Kassing, Sebastian, et al.
Pubblicazione: (2025)
di: Kassing, Sebastian, et al.
Pubblicazione: (2025)
Convergence Rates for Gradient Descent on the Edge of Stability in Overparametrised Least Squares
di: MacDonald, Lachlan Ewen, et al.
Pubblicazione: (2025)
di: MacDonald, Lachlan Ewen, et al.
Pubblicazione: (2025)
Adaptive SGD with Line-Search and Polyak Stepsizes: Nonconvex Convergence and Accelerated Rates
di: Wu, Haotian
Pubblicazione: (2025)
di: Wu, Haotian
Pubblicazione: (2025)
Revisiting Convergence of AdaGrad with Relaxed Assumptions
di: Hong, Yusu, et al.
Pubblicazione: (2024)
di: Hong, Yusu, et al.
Pubblicazione: (2024)
Less is More: Convergence Benefits of Fewer Data Weight Updates over Longer Horizon
di: Das, Rudrajit, et al.
Pubblicazione: (2026)
di: Das, Rudrajit, et al.
Pubblicazione: (2026)
On Convergence of Adam for Stochastic Optimization under Relaxed Assumptions
di: Hong, Yusu, et al.
Pubblicazione: (2024)
di: Hong, Yusu, et al.
Pubblicazione: (2024)
Convergence Rate in Nonlinear Two-Time-Scale Stochastic Approximation with State (Time)-Dependence
di: Chen, Zixi, et al.
Pubblicazione: (2025)
di: Chen, Zixi, et al.
Pubblicazione: (2025)
Almost Sure Convergence Rates and Concentration of Stochastic Approximation and Reinforcement Learning with Markovian Noise
di: Qian, Xiaochi, et al.
Pubblicazione: (2024)
di: Qian, Xiaochi, et al.
Pubblicazione: (2024)
Learning Provably Improves the Convergence of Gradient Descent
di: Song, Qingyu, et al.
Pubblicazione: (2025)
di: Song, Qingyu, et al.
Pubblicazione: (2025)
Non-Parametric Learning of Stochastic Differential Equations with Non-asymptotic Fast Rates of Convergence
di: Bonalli, Riccardo, et al.
Pubblicazione: (2023)
di: Bonalli, Riccardo, et al.
Pubblicazione: (2023)
GANs as Gradient Flows that Converge
di: Huang, Yu-Jui, et al.
Pubblicazione: (2022)
di: Huang, Yu-Jui, et al.
Pubblicazione: (2022)
Convergence of Sharpness-Aware Minimization Algorithms using Increasing Batch Size and Decaying Learning Rate
di: Harada, Hinata, et al.
Pubblicazione: (2024)
di: Harada, Hinata, et al.
Pubblicazione: (2024)
Optimal Local Convergence Rates of Stochastic First-Order Methods under Local $α$-PL
di: Masiha, Saeed, et al.
Pubblicazione: (2024)
di: Masiha, Saeed, et al.
Pubblicazione: (2024)
A Systems-Theoretic View on the Convergence of Algorithms under Disturbances
di: Er, Guner Dilsad, et al.
Pubblicazione: (2025)
di: Er, Guner Dilsad, et al.
Pubblicazione: (2025)
On Convergence of Incremental Gradient for Non-Convex Smooth Functions
di: Koloskova, Anastasia, et al.
Pubblicazione: (2023)
di: Koloskova, Anastasia, et al.
Pubblicazione: (2023)
Convergence Rate Analysis of the AdamW-Style Shampoo: Unifying One-Sided and Two-Sided Preconditioning
di: Li, Huan, et al.
Pubblicazione: (2026)
di: Li, Huan, et al.
Pubblicazione: (2026)
Almost Sure Convergence Rates of Stochastic Approximation and Reinforcement Learning via a Poisson-Moreau Drift
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
Solving Inverse Problems with Deep Linear Neural Networks: Global Convergence Guarantees for Gradient Descent with Weight Decay
di: Laus, Hannah, et al.
Pubblicazione: (2025)
di: Laus, Hannah, et al.
Pubblicazione: (2025)
Model-Free Learning for the Linear Quadratic Regulator over Rate-Limited Channels
di: Ye, Lintao, et al.
Pubblicazione: (2024)
di: Ye, Lintao, et al.
Pubblicazione: (2024)
Tight Rates for Bandit Control Beyond Quadratics
di: Sun, Y. Jennifer, et al.
Pubblicazione: (2024)
di: Sun, Y. Jennifer, et al.
Pubblicazione: (2024)
Linear Convergence of the Frank-Wolfe Algorithm over Product Polytopes
di: Iommazzo, Gabriele, et al.
Pubblicazione: (2025)
di: Iommazzo, Gabriele, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Evaluating Defences against Unsafe Feedback in RLHF
di: Rosati, Domenic, et al.
Pubblicazione: (2024) -
Open Problem: Anytime Convergence Rate of Gradient Descent
di: Kornowski, Guy, et al.
Pubblicazione: (2024) -
Rates of Convergence in the Central Limit Theorem for Markov Chains, with an Application to TD Learning
di: Srikant, R.
Pubblicazione: (2024) -
Convergence Rate Analysis of LION
di: Dong, Yiming, et al.
Pubblicazione: (2024) -
MAP Estimation with Denoisers: Convergence Rates and Guarantees
di: Pesme, Scott, et al.
Pubblicazione: (2025)