SeedLM: Compressing LLM Weights into Seeds of Pseudo-Random Generators
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shafipour, Rasoul, Harrison, David, Horton, Maxwell, Marker, Jeffrey, Bedayat, Houman, Mehta, Sachin, Rastegari, Mohammad, Najibi, Mahyar, Naderiparizi, Saman |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LazyLLM: Dynamic Token Pruning for Efficient Long Context LLM Inference
par: Fu, Qichen, et autres
Publié: (2024)
par: Fu, Qichen, et autres
Publié: (2024)
CatLIP: CLIP-level Visual Recognition Accuracy with 2.7x Faster Pre-training on Web-scale Image-Text Data
par: Mehta, Sachin, et autres
Publié: (2024)
par: Mehta, Sachin, et autres
Publié: (2024)
Bytes Are All You Need: Transformers Operating Directly On File Bytes
par: Horton, Maxwell, et autres
Publié: (2023)
par: Horton, Maxwell, et autres
Publié: (2023)
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
par: Mozaffari, Mohammad, et autres
Publié: (2026)
par: Mozaffari, Mohammad, et autres
Publié: (2026)
Diffusion Models as Masked Audio-Video Learners
par: Nunez, Elvis, et autres
Publié: (2023)
par: Nunez, Elvis, et autres
Publié: (2023)
CtrlSynth: Controllable Image Text Synthesis for Data-Efficient Multimodal Learning
par: Cao, Qingqing, et autres
Publié: (2024)
par: Cao, Qingqing, et autres
Publié: (2024)
Superposition Prompting: Improving and Accelerating Retrieval-Augmented Generation
par: Merth, Thomas, et autres
Publié: (2024)
par: Merth, Thomas, et autres
Publié: (2024)
OpenELM: An Efficient Language Model Family with Open Training and Inference Framework
par: Mehta, Sachin, et autres
Publié: (2024)
par: Mehta, Sachin, et autres
Publié: (2024)
Speculative Streaming: Fast LLM Inference without Auxiliary Models
par: Bhendawade, Nikhil, et autres
Publié: (2024)
par: Bhendawade, Nikhil, et autres
Publié: (2024)
KV Prediction for Improved Time to First Token
par: Horton, Maxwell, et autres
Publié: (2024)
par: Horton, Maxwell, et autres
Publié: (2024)
From Dense to Dynamic: Token-Difficulty Driven MoEfication of Pre-Trained LLMs
par: Nishu, Kumari, et autres
Publié: (2025)
par: Nishu, Kumari, et autres
Publié: (2025)
Efficient Vision-Language Models by Summarizing Visual Tokens into Compact Registers
par: Wen, Yuxin, et autres
Publié: (2024)
par: Wen, Yuxin, et autres
Publié: (2024)
A Novel Approach for Pseudo-Random Seed Generation
par: Sacha Pelaiz
Publié: (2013)
par: Sacha Pelaiz
Publié: (2013)
SeedAIchemy: LLM-Driven Seed Corpus Generation for Fuzzing
par: Wen, Aidan, et autres
Publié: (2025)
par: Wen, Aidan, et autres
Publié: (2025)
Seed Hijacking of LLM Sampling and Quantum Random Number Defense
par: You, Ziyang, et autres
Publié: (2026)
par: You, Ziyang, et autres
Publié: (2026)
Knowledge Transfer from Vision Foundation Models for Efficient Training of Small Task-specific Models
par: Vemulapalli, Raviteja, et autres
Publié: (2023)
par: Vemulapalli, Raviteja, et autres
Publié: (2023)
Seed-to-Seed: Image Translation in Diffusion Seed Space
par: Greenberg, Or, et autres
Publié: (2024)
par: Greenberg, Or, et autres
Publié: (2024)
All Seeds Are Not Equal: Enhancing Compositional Text-to-Image Generation with Reliable Random Seeds
par: Li, Shuangqi, et autres
Publié: (2024)
par: Li, Shuangqi, et autres
Publié: (2024)
KV-Runahead: Scalable Causal LLM Inference by Parallel Key-Value Cache Generation
par: Cho, Minsik, et autres
Publié: (2024)
par: Cho, Minsik, et autres
Publié: (2024)
M2R2: Mixture of Multi-Rate Residuals for Efficient Transformer Inference
par: Bhendawade, Nikhil, et autres
Publié: (2025)
par: Bhendawade, Nikhil, et autres
Publié: (2025)
Heterotypic Seeding Generates Mixed Amyloid Polymorphs
par: Siddhartha Banerjee, et autres
Publié: (2024)
par: Siddhartha Banerjee, et autres
Publié: (2024)
Growth of Light Seed Black Holes in the Early Universe
par: Mehta, Daxal H., et autres
Publié: (2026)
par: Mehta, Daxal H., et autres
Publié: (2026)
TiC-LM: A Web-Scale Benchmark for Time-Continual LLM Pretraining
par: Li, Jeffrey, et autres
Publié: (2025)
par: Li, Jeffrey, et autres
Publié: (2025)
QuantSpec: Self-Speculative Decoding with Hierarchical Quantized KV Cache
par: Tiwari, Rishabh, et autres
Publié: (2025)
par: Tiwari, Rishabh, et autres
Publié: (2025)
Transcranial Direct Current Stimulation and Mindfulness for Cognitive and Mood Recovery in Stroke Survivors: A Pilot Randomized Controlled Study
par: Atekeh Mosannaei Najibi, et autres
Publié: (2025)
par: Atekeh Mosannaei Najibi, et autres
Publié: (2025)
Seeds
Publié: (2023)
Publié: (2023)
The Instability of Safety: How Random Seeds and Temperature Expose Inconsistent LLM Refusal Behavior
par: Larsen, Erik
Publié: (2025)
par: Larsen, Erik
Publié: (2025)
Convergence of Random Products of Countably Infinitely Many Projections
par: Eskandari, Rasoul, et autres
Publié: (2024)
par: Eskandari, Rasoul, et autres
Publié: (2024)
Evaluating the Impact of Seed‐Borne Mycoflora on Seed Quality and Health of Various Oryza sativa Varieties
par: Mohammad Waris Haider, et autres
Publié: (2024)
par: Mohammad Waris Haider, et autres
Publié: (2024)
Rethinking Weight Tying: Pseudo-Inverse Tying for LM Stable Training and Updates
par: Gu, Jian, et autres
Publié: (2026)
par: Gu, Jian, et autres
Publié: (2026)
Random Quantum Circuits as Seeds for Continuous Generative Models
par: Hirviniemi, Olli, et autres
Publié: (2026)
par: Hirviniemi, Olli, et autres
Publié: (2026)
Seed Based Approach for Near Lossless to Lossless Image Compression
par: Tanuja R. Patil, et autres
Publié: (2021)
par: Tanuja R. Patil, et autres
Publié: (2021)
Growth of Light-Seed Black Holes in Gas-Rich Galaxies at High Redshift
par: Mehta, Daxal, et autres
Publié: (2024)
par: Mehta, Daxal, et autres
Publié: (2024)
Seed-Guided Topic Discovery with Out-of-Vocabulary Seeds
par: Zhang, Yu, et autres
Publié: (2022)
par: Zhang, Yu, et autres
Publié: (2022)
Nearly-Linear Time Seeded Extractors with Short Seeds
par: Doron, Dean, et autres
Publié: (2024)
par: Doron, Dean, et autres
Publié: (2024)
Annual Legume Seedbank Management Involves Compromises Between Feeding Value to Sheep and the Impact of Seed Mass and Dormancy on Survival of Ingested Seeds
par: Hayley C. Norman, et autres
Publié: (2026)
par: Hayley C. Norman, et autres
Publié: (2026)
Documents similaires
-
LazyLLM: Dynamic Token Pruning for Efficient Long Context LLM Inference
par: Fu, Qichen, et autres
Publié: (2024) -
CatLIP: CLIP-level Visual Recognition Accuracy with 2.7x Faster Pre-training on Web-scale Image-Text Data
par: Mehta, Sachin, et autres
Publié: (2024) -
Bytes Are All You Need: Transformers Operating Directly On File Bytes
par: Horton, Maxwell, et autres
Publié: (2023) -
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
par: Mozaffari, Mohammad, et autres
Publié: (2026) -
Diffusion Models as Masked Audio-Video Learners
par: Nunez, Elvis, et autres
Publié: (2023)