Enregistré dans:
| Auteurs principaux: | Adewuyi, Israel, Okibe, Solomon, Ivanov, Vladmir |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.01599 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Sparsity of the Strong Lottery Ticket Hypothesis
par: Natale, Emanuele, et autres
Publié: (2024)
par: Natale, Emanuele, et autres
Publié: (2024)
The Strong Lottery Ticket Hypothesis for Multi-Head Attention Mechanisms
par: Otsuka, Hikari, et autres
Publié: (2025)
par: Otsuka, Hikari, et autres
Publié: (2025)
Investigating the Lottery Ticket Hypothesis for Variational Quantum Circuits
par: Kölle, Michael, et autres
Publié: (2025)
par: Kölle, Michael, et autres
Publié: (2025)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
par: Balashov, Andrii
Publié: (2025)
par: Balashov, Andrii
Publié: (2025)
Partially Frozen Random Networks Contain Compact Strong Lottery Tickets
par: Otsuka, Hikari, et autres
Publié: (2024)
par: Otsuka, Hikari, et autres
Publié: (2024)
Instilling Inductive Biases with Subnetworks
par: Zhang, Enyan, et autres
Publié: (2023)
par: Zhang, Enyan, et autres
Publié: (2023)
Model Parallelism With Subnetwork Data Parallelism
par: Singh, Vaibhav, et autres
Publié: (2025)
par: Singh, Vaibhav, et autres
Publié: (2025)
IRDS: Interpretable RLVR Data Selection via Verifier-Coupled Sparse Autoencoder Coverage
par: Li, Yuhan, et autres
Publié: (2026)
par: Li, Yuhan, et autres
Publié: (2026)
SSFL: Discovering Sparse Unified Subnetworks at Initialization for Efficient Federated Learning
par: Ohib, Riyasat, et autres
Publié: (2024)
par: Ohib, Riyasat, et autres
Publié: (2024)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
par: Xu, Jing, et autres
Publié: (2024)
par: Xu, Jing, et autres
Publié: (2024)
LLM-Generated Explanations Do Not Suffice for Ultra-Strong Machine Learning
par: Ai, Lun, et autres
Publié: (2025)
par: Ai, Lun, et autres
Publié: (2025)
Memory Constrained Dynamic Subnetwork Update for Transfer Learning
par: Quélennec, Aël, et autres
Publié: (2025)
par: Quélennec, Aël, et autres
Publié: (2025)
Linear Bellman Completeness Suffices for Efficient Online Reinforcement Learning with Few Actions
par: Golowich, Noah, et autres
Publié: (2024)
par: Golowich, Noah, et autres
Publié: (2024)
Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimization
par: Fang, Zheng, et autres
Publié: (2026)
par: Fang, Zheng, et autres
Publié: (2026)
A Combinatorial Theory of Dropout: Subnetworks, Graph Geometry, and Generalization
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
FedSI: Federated Subnetwork Inference for Efficient Uncertainty Quantification
par: Chen, Hui, et autres
Publié: (2024)
par: Chen, Hui, et autres
Publié: (2024)
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
par: Meng, Haoming, et autres
Publié: (2026)
par: Meng, Haoming, et autres
Publié: (2026)
Quantifying Empirical Compute-Supervision Tradeoffs in RLVR
par: Mitsuhashi, Ryo, et autres
Publié: (2026)
par: Mitsuhashi, Ryo, et autres
Publié: (2026)
VL Norm: Rethink Loss Aggregation in RLVR
par: He, Zhiyuan, et autres
Publié: (2025)
par: He, Zhiyuan, et autres
Publié: (2025)
Spurious Rewards: Rethinking Training Signals in RLVR
par: Shao, Rulin, et autres
Publié: (2025)
par: Shao, Rulin, et autres
Publié: (2025)
Grokking as Structural Inference: Transformers Need Bayesian Lottery Tickets
par: Hidajat, Kai, et autres
Publié: (2026)
par: Hidajat, Kai, et autres
Publié: (2026)
Continual Deep Learning on the Edge via Stochastic Local Competition among Subnetworks
par: Christophides, Theodoros, et autres
Publié: (2024)
par: Christophides, Theodoros, et autres
Publié: (2024)
Discovering Knowledge-Critical Subnetworks in Pretrained Language Models
par: Bayazit, Deniz, et autres
Publié: (2023)
par: Bayazit, Deniz, et autres
Publié: (2023)
On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation
par: Huang, Kexin, et autres
Publié: (2026)
par: Huang, Kexin, et autres
Publié: (2026)
On the Implicit Reward Overfitting and the Low-rank Dynamics in RLVR
par: Ye, Hao, et autres
Publié: (2026)
par: Ye, Hao, et autres
Publié: (2026)
The Path Not Taken: RLVR Provably Learns Off the Principals
par: Zhu, Hanqing, et autres
Publié: (2025)
par: Zhu, Hanqing, et autres
Publié: (2025)
RLVR-World: Training World Models with Reinforcement Learning
par: Wu, Jialong, et autres
Publié: (2025)
par: Wu, Jialong, et autres
Publié: (2025)
Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective
par: Hao, Zhezheng, et autres
Publié: (2025)
par: Hao, Zhezheng, et autres
Publié: (2025)
Quantile Advantage Estimation: Stabilizing RLVR for LLM Reasoning
par: Wu, Junkang, et autres
Publié: (2025)
par: Wu, Junkang, et autres
Publié: (2025)
Task-specific Subnetwork Discovery in Reinforcement Learning for Autonomous Underwater Navigation
par: Liu, Yi-Ling, et autres
Publié: (2026)
par: Liu, Yi-Ling, et autres
Publié: (2026)
Uncovering a Winning Lottery Ticket with Continuously Relaxed Bernoulli Gates
par: Tsayag, Itamar, et autres
Publié: (2026)
par: Tsayag, Itamar, et autres
Publié: (2026)
Exploring Subnetwork Interactions in Heterogeneous Brain Network via Prior-Informed Graph Learning
par: Liu, Siyu, et autres
Publié: (2026)
par: Liu, Siyu, et autres
Publié: (2026)
Stochastic Collapse: How Gradient Noise Attracts SGD Dynamics Towards Simpler Subnetworks
par: Chen, Feng, et autres
Publié: (2023)
par: Chen, Feng, et autres
Publié: (2023)
Controllable Exploration in Hybrid-Policy RLVR for Multi-Modal Reasoning
par: Huang, Zhuoxu, et autres
Publié: (2026)
par: Huang, Zhuoxu, et autres
Publié: (2026)
LLMs Gaming Verifiers: RLVR can Lead to Reward Hacking
par: Helff, Lukas, et autres
Publié: (2026)
par: Helff, Lukas, et autres
Publié: (2026)
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
par: Zhang, Jiaying, et autres
Publié: (2026)
par: Zhang, Jiaying, et autres
Publié: (2026)
Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR
par: Mou, Chaoli, et autres
Publié: (2026)
par: Mou, Chaoli, et autres
Publié: (2026)
Learning Rate Matters: Vanilla LoRA May Suffice for LLM Fine-tuning
par: Lee, Yu-Ang, et autres
Publié: (2026)
par: Lee, Yu-Ang, et autres
Publié: (2026)
Routing the Lottery: Adaptive Subnetworks for Heterogeneous Data
par: Stefanski, Grzegorz, et autres
Publié: (2026)
par: Stefanski, Grzegorz, et autres
Publié: (2026)
Do Sparse Subnetworks Exhibit Cognitively Aligned Attention? Effects of Pruning on Saliency Map Fidelity, Sparsity, and Concept Coherence
par: Suwal, Sanish, et autres
Publié: (2025)
par: Suwal, Sanish, et autres
Publié: (2025)
Documents similaires
-
On the Sparsity of the Strong Lottery Ticket Hypothesis
par: Natale, Emanuele, et autres
Publié: (2024) -
The Strong Lottery Ticket Hypothesis for Multi-Head Attention Mechanisms
par: Otsuka, Hikari, et autres
Publié: (2025) -
Investigating the Lottery Ticket Hypothesis for Variational Quantum Circuits
par: Kölle, Michael, et autres
Publié: (2025) -
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
par: Balashov, Andrii
Publié: (2025) -
Partially Frozen Random Networks Contain Compact Strong Lottery Tickets
par: Otsuka, Hikari, et autres
Publié: (2024)