Enregistré dans:
| Auteurs principaux: | Tseng, Albert, De Sa, Christopher |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.21461 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Model-Preserving Adaptive Rounding
par: Tseng, Albert, et autres
Publié: (2025)
par: Tseng, Albert, et autres
Publié: (2025)
QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks
par: Tseng, Albert, et autres
Publié: (2024)
par: Tseng, Albert, et autres
Publié: (2024)
LOOKAT: Lookup-Optimized Key-Attention for Memory-Efficient Transformers
par: Karmore, Aryan
Publié: (2026)
par: Karmore, Aryan
Publié: (2026)
Lookup multivariate Kolmogorov-Arnold Networks
par: Pozdnyakov, Sergey, et autres
Publié: (2025)
par: Pozdnyakov, Sergey, et autres
Publié: (2025)
From Arithmetic to Logic: The Resilience of Logic and Lookup-Based Neural Networks Under Parameter Bit-Flips
par: Bacellar, Alan T. L., et autres
Publié: (2026)
par: Bacellar, Alan T. L., et autres
Publié: (2026)
ModuLoRA: Finetuning 2-Bit LLMs on Consumer GPUs by Integrating with Modular Quantizers
par: Yin, Junjie, et autres
Publié: (2023)
par: Yin, Junjie, et autres
Publié: (2023)
LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator
par: Li, Guoyu, et autres
Publié: (2025)
par: Li, Guoyu, et autres
Publié: (2025)
LookupViT: Compressing visual information to a limited number of tokens
par: Koner, Rajat, et autres
Publié: (2024)
par: Koner, Rajat, et autres
Publié: (2024)
Pixel Embedding: Fully Quantized Convolutional Neural Network with Differentiable Lookup Table
par: Tokunaga, Hiroyuki, et autres
Publié: (2024)
par: Tokunaga, Hiroyuki, et autres
Publié: (2024)
STAT: Shrinking Transformers After Training
par: Flynn, Megan, et autres
Publié: (2024)
par: Flynn, Megan, et autres
Publié: (2024)
Compute-Optimal LLMs Provably Generalize Better With Scale
par: Finzi, Marc, et autres
Publié: (2025)
par: Finzi, Marc, et autres
Publié: (2025)
QTIP: Quantization with Trellises and Incoherence Processing
par: Tseng, Albert, et autres
Publié: (2024)
par: Tseng, Albert, et autres
Publié: (2024)
SG-XDEAT: Sparsity-Guided Cross-Dimensional and Cross-Encoding Attention with Target-Aware Conditioning in Tabular Learning
par: Cheng, Chih-Chuan, et autres
Publié: (2025)
par: Cheng, Chih-Chuan, et autres
Publié: (2025)
On the Limits of Layer Pruning for Generative Reasoning in Large Language Models
par: Shrestha, Safal, et autres
Publié: (2026)
par: Shrestha, Safal, et autres
Publié: (2026)
Outlier-Efficient Hopfield Layers for Large Transformer-Based Models
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
Golden Layers and Where to Find Them: Improved Knowledge Editing for Large Language Models Via Layer Gradient Analysis
par: Datta, Shrestha, et autres
Publié: (2026)
par: Datta, Shrestha, et autres
Publié: (2026)
The Structural Scalpel: Automated Contiguous Layer Pruning for Large Language Models
par: Lu, Yao, et autres
Publié: (2025)
par: Lu, Yao, et autres
Publié: (2025)
LayerIF: Estimating Layer Quality for Large Language Models using Influence Functions
par: Askari, Hadi, et autres
Publié: (2025)
par: Askari, Hadi, et autres
Publié: (2025)
Hierarchically branched diffusion models leverage dataset structure for class-conditional generation
par: Tseng, Alex M., et autres
Publié: (2022)
par: Tseng, Alex M., et autres
Publié: (2022)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
par: Xu, Yichen, et autres
Publié: (2026)
par: Xu, Yichen, et autres
Publié: (2026)
Multimodal Survival Analysis with Locally Deployable Large Language Models
par: Gögl, Moritz, et autres
Publié: (2026)
par: Gögl, Moritz, et autres
Publié: (2026)
ECG-Soup: Harnessing Multi-Layer Synergy for ECG Foundation Models
par: Nguyen, Phu X., et autres
Publié: (2025)
par: Nguyen, Phu X., et autres
Publié: (2025)
CUDA-L2: Surpassing cuBLAS Performance for Matrix Multiplication through Reinforcement Learning
par: Su, Songqiao, et autres
Publié: (2025)
par: Su, Songqiao, et autres
Publié: (2025)
MID-L: Matrix-Interpolated Dropout Layer with Layer-wise Neuron Selection
par: Shaeri, Pouya, et autres
Publié: (2025)
par: Shaeri, Pouya, et autres
Publié: (2025)
L3Ms -- Lagrange Large Language Models
par: Dhillon, Guneet S., et autres
Publié: (2024)
par: Dhillon, Guneet S., et autres
Publié: (2024)
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
par: Guo, Wentao, et autres
Publié: (2024)
par: Guo, Wentao, et autres
Publié: (2024)
How to Measure the Intelligence of Large Language Models?
par: Körber, Nils, et autres
Publié: (2024)
par: Körber, Nils, et autres
Publié: (2024)
Ablate and Rescue: A Causal Analysis of Residual Stream Hyper-Connections
par: Peng, William, et autres
Publié: (2026)
par: Peng, William, et autres
Publié: (2026)
Towards Evolutionary-based Automated Machine Learning for Small Molecule Pharmacokinetic Prediction
par: de Sá, Alex G. C., et autres
Publié: (2024)
par: de Sá, Alex G. C., et autres
Publié: (2024)
TEON: Tensorized Orthonormalization Beyond Layer-Wise Muon for Large Language Model Pre-Training
par: Zhang, Ruijie, et autres
Publié: (2026)
par: Zhang, Ruijie, et autres
Publié: (2026)
One Permutation Is All You Need: Fast, Reliable Variable Importance and Model Stress-Testing
par: Dorador, Albert
Publié: (2025)
par: Dorador, Albert
Publié: (2025)
RACE Attention: A Strictly Linear-Time Attention Layer for Training on Outrageously Large Contexts
par: Joshi, Sahil, et autres
Publié: (2025)
par: Joshi, Sahil, et autres
Publié: (2025)
CALR: Corrective Adaptive Low-Rank Decomposition for Efficient Large Language Model Layer Compression
par: Kautsar, Muchammad Daniyal, et autres
Publié: (2025)
par: Kautsar, Muchammad Daniyal, et autres
Publié: (2025)
Quantifying Empirical Compute-Supervision Tradeoffs in RLVR
par: Mitsuhashi, Ryo, et autres
Publié: (2026)
par: Mitsuhashi, Ryo, et autres
Publié: (2026)
Can Go AIs be adversarially robust?
par: Tseng, Tom, et autres
Publié: (2024)
par: Tseng, Tom, et autres
Publié: (2024)
Shadow Cones: A Generalized Framework for Partial Order Embeddings
par: Yu, Tao, et autres
Publié: (2023)
par: Yu, Tao, et autres
Publié: (2023)
On the Nonlinearity of Layer Normalization
par: Ni, Yunhao, et autres
Publié: (2024)
par: Ni, Yunhao, et autres
Publié: (2024)
Machine learning based radiative parameterization scheme and its performance in operational reforecast experiments
par: Jing, Hao, et autres
Publié: (2026)
par: Jing, Hao, et autres
Publié: (2026)
Arbitrariness and Social Prediction: The Confounding Role of Variance in Fair Classification
par: Cooper, A. Feder, et autres
Publié: (2023)
par: Cooper, A. Feder, et autres
Publié: (2023)
Not Only the Last-Layer Features for Spurious Correlations: All Layer Deep Feature Reweighting
par: Hameed, Humza Wajid, et autres
Publié: (2024)
par: Hameed, Humza Wajid, et autres
Publié: (2024)
Documents similaires
-
Model-Preserving Adaptive Rounding
par: Tseng, Albert, et autres
Publié: (2025) -
QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks
par: Tseng, Albert, et autres
Publié: (2024) -
LOOKAT: Lookup-Optimized Key-Attention for Memory-Efficient Transformers
par: Karmore, Aryan
Publié: (2026) -
Lookup multivariate Kolmogorov-Arnold Networks
par: Pozdnyakov, Sergey, et autres
Publié: (2025) -
From Arithmetic to Logic: The Resilience of Logic and Lookup-Based Neural Networks Under Parameter Bit-Flips
par: Bacellar, Alan T. L., et autres
Publié: (2026)