Adaptive Regularization for Large-Scale Sparse Feature Embedding Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Mang, Lyu, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Proximal Projection for Doubly Sparse Regularized Models
di: He, Jia Wei, et al.
Pubblicazione: (2026)
di: He, Jia Wei, et al.
Pubblicazione: (2026)
Tree-Regularized Tabular Embeddings
di: Li, Xuan, et al.
Pubblicazione: (2024)
di: Li, Xuan, et al.
Pubblicazione: (2024)
SAE-FD: Sparse Autoencoder Feature Distillation for Continual Learning of Large Language Models
di: Zhang, Mingxu, et al.
Pubblicazione: (2026)
di: Zhang, Mingxu, et al.
Pubblicazione: (2026)
Adaptive Block Sparse Regularization under Arbitrary Linear Transform
di: Furuhashi, Takanobu, et al.
Pubblicazione: (2024)
di: Furuhashi, Takanobu, et al.
Pubblicazione: (2024)
Adaptive Sparse Allocation with Mutual Choice & Feature Choice Sparse Autoencoders
di: Ayonrinde, Kola
Pubblicazione: (2024)
di: Ayonrinde, Kola
Pubblicazione: (2024)
Evaluating Model Robustness Using Adaptive Sparse L0 Regularization
di: Liu, Weiyou, et al.
Pubblicazione: (2024)
di: Liu, Weiyou, et al.
Pubblicazione: (2024)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
di: Deng, Boyi, et al.
Pubblicazione: (2026)
di: Deng, Boyi, et al.
Pubblicazione: (2026)
Efficient Graph Encoder Embedding for Large Sparse Graphs in Python
di: Qin, Xihan, et al.
Pubblicazione: (2024)
di: Qin, Xihan, et al.
Pubblicazione: (2024)
Efficient Traffic Forecasting on Large-Scale Road Network by Regularized Adaptive Graph Convolution
di: Wu, Kaiqi, et al.
Pubblicazione: (2025)
di: Wu, Kaiqi, et al.
Pubblicazione: (2025)
Dual Feature Reduction for the Sparse-group Lasso and its Adaptive Variant
di: Feser, Fabio, et al.
Pubblicazione: (2024)
di: Feser, Fabio, et al.
Pubblicazione: (2024)
Embedded Federated Feature Selection with Dynamic Sparse Training: Balancing Accuracy-Cost Tradeoffs
di: Mahanipour, Afsaneh, et al.
Pubblicazione: (2025)
di: Mahanipour, Afsaneh, et al.
Pubblicazione: (2025)
Route Sparse Autoencoder to Interpret Large Language Models
di: Shi, Wei, et al.
Pubblicazione: (2025)
di: Shi, Wei, et al.
Pubblicazione: (2025)
On the SDEs and Scaling Rules for Adaptive Gradient Algorithms
di: Malladi, Sadhika, et al.
Pubblicazione: (2022)
di: Malladi, Sadhika, et al.
Pubblicazione: (2022)
Scaling Embeddings Outperforms Scaling Experts in Language Models
di: Liu, Hong, et al.
Pubblicazione: (2026)
di: Liu, Hong, et al.
Pubblicazione: (2026)
Enhanced High-Dimensional Data Visualization through Adaptive Multi-Scale Manifold Embedding
di: Ni, Tianhao, et al.
Pubblicazione: (2025)
di: Ni, Tianhao, et al.
Pubblicazione: (2025)
CAFE: Towards Compact, Adaptive, and Fast Embedding for Large-scale Recommendation Models
di: Zhang, Hailin, et al.
Pubblicazione: (2023)
di: Zhang, Hailin, et al.
Pubblicazione: (2023)
Dynamic Reserve Price Design with Distributed Solving Algorithm
di: Li, Mang
Pubblicazione: (2022)
di: Li, Mang
Pubblicazione: (2022)
Accelerating Large-Scale Regularized High-Order Tensor Recovery
di: Qin, Wenjin, et al.
Pubblicazione: (2025)
di: Qin, Wenjin, et al.
Pubblicazione: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
di: Ansell, Alan, et al.
Pubblicazione: (2024)
di: Ansell, Alan, et al.
Pubblicazione: (2024)
Generalizing Scaling Laws for Dense and Sparse Large Language Models
di: Hossain, Md Arafat, et al.
Pubblicazione: (2025)
di: Hossain, Md Arafat, et al.
Pubblicazione: (2025)
Sparse Deep Learning Models with the $\ell_1$ Regularization
di: Shen, Lixin, et al.
Pubblicazione: (2024)
di: Shen, Lixin, et al.
Pubblicazione: (2024)
NuTime: Numerically Multi-Scaled Embedding for Large-Scale Time-Series Pretraining
di: Lin, Chenguo, et al.
Pubblicazione: (2023)
di: Lin, Chenguo, et al.
Pubblicazione: (2023)
Stable and Steerable Sparse Autoencoders with Weight Regularization
di: Jedryszek, Piotr, et al.
Pubblicazione: (2026)
di: Jedryszek, Piotr, et al.
Pubblicazione: (2026)
Multi-Probe Zero Collision Hash (MPZCH): Mitigating Embedding Collisions and Enhancing Model Freshness in Large-Scale Recommenders
di: Zhao, Ziliang, et al.
Pubblicazione: (2026)
di: Zhao, Ziliang, et al.
Pubblicazione: (2026)
Q-Sparse: All Large Language Models can be Fully Sparsely-Activated
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
Row-wise Fusion Regularization: An Interpretable Personalized Federated Learning Framework in Large-Scale Scenarios
di: Zhou, Runlin, et al.
Pubblicazione: (2025)
di: Zhou, Runlin, et al.
Pubblicazione: (2025)
Disentangling Dense Embeddings with Sparse Autoencoders
di: O'Neill, Charles, et al.
Pubblicazione: (2024)
di: O'Neill, Charles, et al.
Pubblicazione: (2024)
Kernel Learning with Adversarial Features: Numerical Efficiency and Adaptive Regularization
di: Ribeiro, Antônio H., et al.
Pubblicazione: (2025)
di: Ribeiro, Antônio H., et al.
Pubblicazione: (2025)
Asymmetric Scaling Laws from Sparse Features
di: Sous, John, et al.
Pubblicazione: (2026)
di: Sous, John, et al.
Pubblicazione: (2026)
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
di: Zhao, Yilong, et al.
Pubblicazione: (2025)
di: Zhao, Yilong, et al.
Pubblicazione: (2025)
Supporting Evidence for the Adaptive Feature Program across Diverse Models
di: Li, Yicheng, et al.
Pubblicazione: (2025)
di: Li, Yicheng, et al.
Pubblicazione: (2025)
Time-Aware Feature Selection: Adaptive Temporal Masking for Stable Sparse Autoencoder Training
di: Li, T. Ed, et al.
Pubblicazione: (2025)
di: Li, T. Ed, et al.
Pubblicazione: (2025)
Adaptive Divergence Regularized Policy Optimization for Fine-tuning Generative Models
di: Fan, Jiajun, et al.
Pubblicazione: (2025)
di: Fan, Jiajun, et al.
Pubblicazione: (2025)
Do Sparse Autoencoders Identify Reasoning Features in Language Models?
di: Ma, George, et al.
Pubblicazione: (2026)
di: Ma, George, et al.
Pubblicazione: (2026)
Diagonal Over-parameterization in Reproducing Kernel Hilbert Spaces as an Adaptive Feature Model: Generalization and Adaptivity
di: Li, Yicheng, et al.
Pubblicazione: (2025)
di: Li, Yicheng, et al.
Pubblicazione: (2025)
Sparse Partial Optimal Transport via Quadratic Regularization
di: Tran, Khang, et al.
Pubblicazione: (2025)
di: Tran, Khang, et al.
Pubblicazione: (2025)
Sparsity via Sparse Group $k$-max Regularization
di: Tao, Qinghua, et al.
Pubblicazione: (2024)
di: Tao, Qinghua, et al.
Pubblicazione: (2024)
Sparse NMF with Archetypal Regularization: Computational and Robustness Properties
di: Behdin, Kayhan, et al.
Pubblicazione: (2021)
di: Behdin, Kayhan, et al.
Pubblicazione: (2021)
Mixture of Scales: Memory-Efficient Token-Adaptive Binarization for Large Language Models
di: Jo, Dongwon, et al.
Pubblicazione: (2024)
di: Jo, Dongwon, et al.
Pubblicazione: (2024)
MLKV: Efficiently Scaling up Large Embedding Model Training with Disk-based Key-Value Storage
di: He, Yongjun, et al.
Pubblicazione: (2025)
di: He, Yongjun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Proximal Projection for Doubly Sparse Regularized Models
di: He, Jia Wei, et al.
Pubblicazione: (2026) -
Tree-Regularized Tabular Embeddings
di: Li, Xuan, et al.
Pubblicazione: (2024) -
SAE-FD: Sparse Autoencoder Feature Distillation for Continual Learning of Large Language Models
di: Zhang, Mingxu, et al.
Pubblicazione: (2026) -
Adaptive Block Sparse Regularization under Arbitrary Linear Transform
di: Furuhashi, Takanobu, et al.
Pubblicazione: (2024) -
Adaptive Sparse Allocation with Mutual Choice & Feature Choice Sparse Autoencoders
di: Ayonrinde, Kola
Pubblicazione: (2024)