Salvato in:
| Autori principali: | Adewuyi, Israel, Okibe, Solomon, Ivanov, Vladmir |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.01599 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Sparsity of the Strong Lottery Ticket Hypothesis
di: Natale, Emanuele, et al.
Pubblicazione: (2024)
di: Natale, Emanuele, et al.
Pubblicazione: (2024)
The Strong Lottery Ticket Hypothesis for Multi-Head Attention Mechanisms
di: Otsuka, Hikari, et al.
Pubblicazione: (2025)
di: Otsuka, Hikari, et al.
Pubblicazione: (2025)
Investigating the Lottery Ticket Hypothesis for Variational Quantum Circuits
di: Kölle, Michael, et al.
Pubblicazione: (2025)
di: Kölle, Michael, et al.
Pubblicazione: (2025)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
di: Balashov, Andrii
Pubblicazione: (2025)
di: Balashov, Andrii
Pubblicazione: (2025)
Partially Frozen Random Networks Contain Compact Strong Lottery Tickets
di: Otsuka, Hikari, et al.
Pubblicazione: (2024)
di: Otsuka, Hikari, et al.
Pubblicazione: (2024)
Instilling Inductive Biases with Subnetworks
di: Zhang, Enyan, et al.
Pubblicazione: (2023)
di: Zhang, Enyan, et al.
Pubblicazione: (2023)
Model Parallelism With Subnetwork Data Parallelism
di: Singh, Vaibhav, et al.
Pubblicazione: (2025)
di: Singh, Vaibhav, et al.
Pubblicazione: (2025)
IRDS: Interpretable RLVR Data Selection via Verifier-Coupled Sparse Autoencoder Coverage
di: Li, Yuhan, et al.
Pubblicazione: (2026)
di: Li, Yuhan, et al.
Pubblicazione: (2026)
SSFL: Discovering Sparse Unified Subnetworks at Initialization for Efficient Federated Learning
di: Ohib, Riyasat, et al.
Pubblicazione: (2024)
di: Ohib, Riyasat, et al.
Pubblicazione: (2024)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
di: Xu, Jing, et al.
Pubblicazione: (2024)
di: Xu, Jing, et al.
Pubblicazione: (2024)
LLM-Generated Explanations Do Not Suffice for Ultra-Strong Machine Learning
di: Ai, Lun, et al.
Pubblicazione: (2025)
di: Ai, Lun, et al.
Pubblicazione: (2025)
Memory Constrained Dynamic Subnetwork Update for Transfer Learning
di: Quélennec, Aël, et al.
Pubblicazione: (2025)
di: Quélennec, Aël, et al.
Pubblicazione: (2025)
Linear Bellman Completeness Suffices for Efficient Online Reinforcement Learning with Few Actions
di: Golowich, Noah, et al.
Pubblicazione: (2024)
di: Golowich, Noah, et al.
Pubblicazione: (2024)
Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimization
di: Fang, Zheng, et al.
Pubblicazione: (2026)
di: Fang, Zheng, et al.
Pubblicazione: (2026)
A Combinatorial Theory of Dropout: Subnetworks, Graph Geometry, and Generalization
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2025)
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2025)
FedSI: Federated Subnetwork Inference for Efficient Uncertainty Quantification
di: Chen, Hui, et al.
Pubblicazione: (2024)
di: Chen, Hui, et al.
Pubblicazione: (2024)
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
di: Meng, Haoming, et al.
Pubblicazione: (2026)
di: Meng, Haoming, et al.
Pubblicazione: (2026)
Quantifying Empirical Compute-Supervision Tradeoffs in RLVR
di: Mitsuhashi, Ryo, et al.
Pubblicazione: (2026)
di: Mitsuhashi, Ryo, et al.
Pubblicazione: (2026)
VL Norm: Rethink Loss Aggregation in RLVR
di: He, Zhiyuan, et al.
Pubblicazione: (2025)
di: He, Zhiyuan, et al.
Pubblicazione: (2025)
Spurious Rewards: Rethinking Training Signals in RLVR
di: Shao, Rulin, et al.
Pubblicazione: (2025)
di: Shao, Rulin, et al.
Pubblicazione: (2025)
Grokking as Structural Inference: Transformers Need Bayesian Lottery Tickets
di: Hidajat, Kai, et al.
Pubblicazione: (2026)
di: Hidajat, Kai, et al.
Pubblicazione: (2026)
Continual Deep Learning on the Edge via Stochastic Local Competition among Subnetworks
di: Christophides, Theodoros, et al.
Pubblicazione: (2024)
di: Christophides, Theodoros, et al.
Pubblicazione: (2024)
Discovering Knowledge-Critical Subnetworks in Pretrained Language Models
di: Bayazit, Deniz, et al.
Pubblicazione: (2023)
di: Bayazit, Deniz, et al.
Pubblicazione: (2023)
On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation
di: Huang, Kexin, et al.
Pubblicazione: (2026)
di: Huang, Kexin, et al.
Pubblicazione: (2026)
On the Implicit Reward Overfitting and the Low-rank Dynamics in RLVR
di: Ye, Hao, et al.
Pubblicazione: (2026)
di: Ye, Hao, et al.
Pubblicazione: (2026)
The Path Not Taken: RLVR Provably Learns Off the Principals
di: Zhu, Hanqing, et al.
Pubblicazione: (2025)
di: Zhu, Hanqing, et al.
Pubblicazione: (2025)
RLVR-World: Training World Models with Reinforcement Learning
di: Wu, Jialong, et al.
Pubblicazione: (2025)
di: Wu, Jialong, et al.
Pubblicazione: (2025)
Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective
di: Hao, Zhezheng, et al.
Pubblicazione: (2025)
di: Hao, Zhezheng, et al.
Pubblicazione: (2025)
Quantile Advantage Estimation: Stabilizing RLVR for LLM Reasoning
di: Wu, Junkang, et al.
Pubblicazione: (2025)
di: Wu, Junkang, et al.
Pubblicazione: (2025)
Task-specific Subnetwork Discovery in Reinforcement Learning for Autonomous Underwater Navigation
di: Liu, Yi-Ling, et al.
Pubblicazione: (2026)
di: Liu, Yi-Ling, et al.
Pubblicazione: (2026)
Uncovering a Winning Lottery Ticket with Continuously Relaxed Bernoulli Gates
di: Tsayag, Itamar, et al.
Pubblicazione: (2026)
di: Tsayag, Itamar, et al.
Pubblicazione: (2026)
Exploring Subnetwork Interactions in Heterogeneous Brain Network via Prior-Informed Graph Learning
di: Liu, Siyu, et al.
Pubblicazione: (2026)
di: Liu, Siyu, et al.
Pubblicazione: (2026)
Stochastic Collapse: How Gradient Noise Attracts SGD Dynamics Towards Simpler Subnetworks
di: Chen, Feng, et al.
Pubblicazione: (2023)
di: Chen, Feng, et al.
Pubblicazione: (2023)
Controllable Exploration in Hybrid-Policy RLVR for Multi-Modal Reasoning
di: Huang, Zhuoxu, et al.
Pubblicazione: (2026)
di: Huang, Zhuoxu, et al.
Pubblicazione: (2026)
LLMs Gaming Verifiers: RLVR can Lead to Reward Hacking
di: Helff, Lukas, et al.
Pubblicazione: (2026)
di: Helff, Lukas, et al.
Pubblicazione: (2026)
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
di: Zhang, Jiaying, et al.
Pubblicazione: (2026)
di: Zhang, Jiaying, et al.
Pubblicazione: (2026)
Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR
di: Mou, Chaoli, et al.
Pubblicazione: (2026)
di: Mou, Chaoli, et al.
Pubblicazione: (2026)
Learning Rate Matters: Vanilla LoRA May Suffice for LLM Fine-tuning
di: Lee, Yu-Ang, et al.
Pubblicazione: (2026)
di: Lee, Yu-Ang, et al.
Pubblicazione: (2026)
Routing the Lottery: Adaptive Subnetworks for Heterogeneous Data
di: Stefanski, Grzegorz, et al.
Pubblicazione: (2026)
di: Stefanski, Grzegorz, et al.
Pubblicazione: (2026)
Do Sparse Subnetworks Exhibit Cognitively Aligned Attention? Effects of Pruning on Saliency Map Fidelity, Sparsity, and Concept Coherence
di: Suwal, Sanish, et al.
Pubblicazione: (2025)
di: Suwal, Sanish, et al.
Pubblicazione: (2025)
Documenti analoghi
-
On the Sparsity of the Strong Lottery Ticket Hypothesis
di: Natale, Emanuele, et al.
Pubblicazione: (2024) -
The Strong Lottery Ticket Hypothesis for Multi-Head Attention Mechanisms
di: Otsuka, Hikari, et al.
Pubblicazione: (2025) -
Investigating the Lottery Ticket Hypothesis for Variational Quantum Circuits
di: Kölle, Michael, et al.
Pubblicazione: (2025) -
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
di: Balashov, Andrii
Pubblicazione: (2025) -
Partially Frozen Random Networks Contain Compact Strong Lottery Tickets
di: Otsuka, Hikari, et al.
Pubblicazione: (2024)