Language Models as Zero-shot Lossless Gradient Compressors: Towards General Neural Parameter Prior Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Hui-Po, Fritz, Mario |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PriorZero: Bridging Language Priors and World Models for Decision Making
di: Xiong, Junyu, et al.
Pubblicazione: (2026)
di: Xiong, Junyu, et al.
Pubblicazione: (2026)
Flora: Low-Rank Adapters Are Secretly Gradient Compressors
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models
di: Wu, Shutong, et al.
Pubblicazione: (2025)
di: Wu, Shutong, et al.
Pubblicazione: (2025)
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
Lossless Compression: A New Benchmark for Time Series Model Evaluation
di: Wan, Meng, et al.
Pubblicazione: (2025)
di: Wan, Meng, et al.
Pubblicazione: (2025)
MC#: Mixture Compressor for Mixture-of-Experts Large Models
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
Towards Efficient Few-shot Graph Neural Architecture Search via Partitioning Gradient Contribution
di: Song, Wenhao, et al.
Pubblicazione: (2025)
di: Song, Wenhao, et al.
Pubblicazione: (2025)
Zero-shot Multivariate Time Series Forecasting Using Tabular Prior Fitted Networks
di: Jayawardhana, Mayuka, et al.
Pubblicazione: (2026)
di: Jayawardhana, Mayuka, et al.
Pubblicazione: (2026)
Low-Resource Crop Classification from Multi-Spectral Time Series Using Lossless Compressors
di: Cheng, Wei, et al.
Pubblicazione: (2024)
di: Cheng, Wei, et al.
Pubblicazione: (2024)
VLAD-Grasp: Zero-shot Grasp Detection via Vision-Language Models
di: Kulshrestha, Manav, et al.
Pubblicazione: (2025)
di: Kulshrestha, Manav, et al.
Pubblicazione: (2025)
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation Accuracy
di: Zhao, Yao, et al.
Pubblicazione: (2023)
di: Zhao, Yao, et al.
Pubblicazione: (2023)
OTTER: Effortless Label Distribution Adaptation of Zero-shot Models
di: Shin, Changho, et al.
Pubblicazione: (2024)
di: Shin, Changho, et al.
Pubblicazione: (2024)
A Foundation Model for Zero-shot Logical Query Reasoning
di: Galkin, Mikhail, et al.
Pubblicazione: (2024)
di: Galkin, Mikhail, et al.
Pubblicazione: (2024)
Lossless Vocabulary Reduction for Auto-Regressive Language Models
di: Chijiwa, Daiki, et al.
Pubblicazione: (2025)
di: Chijiwa, Daiki, et al.
Pubblicazione: (2025)
ProgFed: Effective, Communication, and Computation Efficient Federated Learning by Progressive Training
di: Wang, Hui-Po, et al.
Pubblicazione: (2021)
di: Wang, Hui-Po, et al.
Pubblicazione: (2021)
Reverso: Efficient Time Series Foundation Models for Zero-shot Forecasting
di: Fu, Xinghong, et al.
Pubblicazione: (2026)
di: Fu, Xinghong, et al.
Pubblicazione: (2026)
NeuralPrefix: A Zero-shot Sensory Data Imputation Plugin
di: Khamis, Abdelwahed, et al.
Pubblicazione: (2025)
di: Khamis, Abdelwahed, et al.
Pubblicazione: (2025)
Small Models, Strong Priors: Architectural Inductive Bias for Parameter-Efficient Neural PDE Solvers
di: Sankaran, Shyam, et al.
Pubblicazione: (2026)
di: Sankaran, Shyam, et al.
Pubblicazione: (2026)
One-shot World Models Using a Transformer Trained on a Synthetic Prior
di: Ferreira, Fabio, et al.
Pubblicazione: (2024)
di: Ferreira, Fabio, et al.
Pubblicazione: (2024)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
AnomalyGFM: Graph Foundation Model for Zero/Few-shot Anomaly Detection
di: Qiao, Hezhe, et al.
Pubblicazione: (2025)
di: Qiao, Hezhe, et al.
Pubblicazione: (2025)
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks
di: Labrak, Yanis, et al.
Pubblicazione: (2023)
di: Labrak, Yanis, et al.
Pubblicazione: (2023)
Towards Few-shot Self-explaining Graph Neural Networks
di: Peng, Jingyu, et al.
Pubblicazione: (2024)
di: Peng, Jingyu, et al.
Pubblicazione: (2024)
Zero-shot Concept Bottleneck Models
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2025)
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2025)
Zero-shot Load Forecasting for Integrated Energy Systems: A Large Language Model-based Framework with Multi-task Learning
di: Li, Jiaheng, et al.
Pubblicazione: (2025)
di: Li, Jiaheng, et al.
Pubblicazione: (2025)
Inductive Biases for Zero-shot Systematic Generalization in Language-informed Reinforcement Learning
di: Dijujin, Negin Hashemi, et al.
Pubblicazione: (2025)
di: Dijujin, Negin Hashemi, et al.
Pubblicazione: (2025)
Large Language Models are Few-shot Multivariate Time Series Classifiers
di: Chen, Yakun, et al.
Pubblicazione: (2025)
di: Chen, Yakun, et al.
Pubblicazione: (2025)
FoMo-0D: A Foundation Model for Zero-shot Tabular Outlier Detection
di: Shen, Yuchen, et al.
Pubblicazione: (2024)
di: Shen, Yuchen, et al.
Pubblicazione: (2024)
BiTA: Bi-Directional Tuning for Lossless Acceleration in Large Language Models
di: Lin, Feng, et al.
Pubblicazione: (2024)
di: Lin, Feng, et al.
Pubblicazione: (2024)
Zero-shot LLM-guided Counterfactual Generation: A Case Study on NLP Model Evaluation
di: Bhattacharjee, Amrita, et al.
Pubblicazione: (2024)
di: Bhattacharjee, Amrita, et al.
Pubblicazione: (2024)
Human-like Category Learning by Injecting Ecological Priors from Large Language Models into Neural Networks
di: Jagadish, Akshay K., et al.
Pubblicazione: (2024)
di: Jagadish, Akshay K., et al.
Pubblicazione: (2024)
Gradient Inversion Transcript: Leveraging Robust Generative Priors to Reconstruct Training Data from Gradient Leakage
di: Chen, Xinping, et al.
Pubblicazione: (2025)
di: Chen, Xinping, et al.
Pubblicazione: (2025)
Reimagining Parameter Space Exploration with Diffusion Models
di: Zhang, Lijun, et al.
Pubblicazione: (2025)
di: Zhang, Lijun, et al.
Pubblicazione: (2025)
Cooperative Open-ended Learning Framework for Zero-shot Coordination
di: Li, Yang, et al.
Pubblicazione: (2023)
di: Li, Yang, et al.
Pubblicazione: (2023)
STRCMP: Integrating Graph Structural Priors with Language Models for Combinatorial Optimization
di: Li, Xijun, et al.
Pubblicazione: (2025)
di: Li, Xijun, et al.
Pubblicazione: (2025)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio
di: Long, Phillip, et al.
Pubblicazione: (2026)
di: Long, Phillip, et al.
Pubblicazione: (2026)
Masked Generative Priors Improve World Models Sequence Modelling Capabilities
di: Meo, Cristian, et al.
Pubblicazione: (2024)
di: Meo, Cristian, et al.
Pubblicazione: (2024)
Towards General Continuous Memory for Vision-Language Models
di: Wu, Wenyi, et al.
Pubblicazione: (2025)
di: Wu, Wenyi, et al.
Pubblicazione: (2025)
Scaling Recurrent Neural Networks to a Billion Parameters with Zero-Order Optimization
di: Chaubard, Francois, et al.
Pubblicazione: (2025)
di: Chaubard, Francois, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PriorZero: Bridging Language Priors and World Models for Decision Making
di: Xiong, Junyu, et al.
Pubblicazione: (2026) -
Flora: Low-Rank Adapters Are Secretly Gradient Compressors
di: Hao, Yongchang, et al.
Pubblicazione: (2024) -
Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models
di: Wu, Shutong, et al.
Pubblicazione: (2025) -
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
di: Chen, Yuanteng, et al.
Pubblicazione: (2025) -
Lossless Compression: A New Benchmark for Time Series Model Evaluation
di: Wan, Meng, et al.
Pubblicazione: (2025)