Accumulator-Aware Post-Training Quantization for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Colbert, Ian, Franco, Giuseppe, Grob, Fabian, Zhang, Jinjie, Saab, Rayan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Qronos: Correcting the Past by Shaping the Future... in Post-Training Quantization
di: Zhang, Shihao, et al.
Pubblicazione: (2025)
di: Zhang, Shihao, et al.
Pubblicazione: (2025)
Gödel Test: Can Large Language Models Solve Easy Conjectures?
di: Feldman, Moran, et al.
Pubblicazione: (2025)
di: Feldman, Moran, et al.
Pubblicazione: (2025)
Beacon: Post-Training Quantization with Integrated Grid Selection
di: Zhang, Shihao, et al.
Pubblicazione: (2025)
di: Zhang, Shihao, et al.
Pubblicazione: (2025)
Provable Post-Training Quantization: Theoretical Analysis of OPTQ and Qronos
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
Finding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search
di: Mehrabian, Abbas, et al.
Pubblicazione: (2023)
di: Mehrabian, Abbas, et al.
Pubblicazione: (2023)
A Fair Post-Processing Method based on the MADD Metric for Predictive Student Models
di: Verger, Mélina, et al.
Pubblicazione: (2024)
di: Verger, Mélina, et al.
Pubblicazione: (2024)
A Diffusion Model Framework for Unsupervised Neural Combinatorial Optimization
di: Sanokowski, Sebastian, et al.
Pubblicazione: (2024)
di: Sanokowski, Sebastian, et al.
Pubblicazione: (2024)
On Training-Test (Mis)alignment in Unsupervised Combinatorial Optimization: Observation, Empirical Exploration, and Analysis
di: Bu, Fanchen, et al.
Pubblicazione: (2025)
di: Bu, Fanchen, et al.
Pubblicazione: (2025)
Plum: Prompt Learning using Metaheuristic
di: Pan, Rui, et al.
Pubblicazione: (2023)
di: Pan, Rui, et al.
Pubblicazione: (2023)
Improving Quantization with Post-Training Model Expansion
di: Franco, Giuseppe, et al.
Pubblicazione: (2025)
di: Franco, Giuseppe, et al.
Pubblicazione: (2025)
Transition Graph Properties of Target Class Classification
di: Aslanyan, Levon, et al.
Pubblicazione: (2024)
di: Aslanyan, Levon, et al.
Pubblicazione: (2024)
Structural perspective on constraint-based learning of Markov networks
di: Korhonen, Tuukka, et al.
Pubblicazione: (2024)
di: Korhonen, Tuukka, et al.
Pubblicazione: (2024)
Soft-ECM: An extension of Evidential C-Means for complex data
di: Soubeiga, Armel, et al.
Pubblicazione: (2025)
di: Soubeiga, Armel, et al.
Pubblicazione: (2025)
ReLU Networks for Exact Generation of Similar Graphs
di: Ghafoor, Mamoona, et al.
Pubblicazione: (2026)
di: Ghafoor, Mamoona, et al.
Pubblicazione: (2026)
Neural Lattice Reduction: A Self-Supervised Geometric Deep Learning Approach
di: Marchetti, Giovanni Luca, et al.
Pubblicazione: (2023)
di: Marchetti, Giovanni Luca, et al.
Pubblicazione: (2023)
Learning with the $p$-adics
di: Martins, André F. T.
Pubblicazione: (2025)
di: Martins, André F. T.
Pubblicazione: (2025)
Aspects of Artificial Intelligence: Transforming Machine Learning Systems Naturally
di: Guo, Xiuzhan
Pubblicazione: (2025)
di: Guo, Xiuzhan
Pubblicazione: (2025)
Trees and Graphs with Non Log-concave Dominating Set Sequence via AI Tools
di: Du, Alina, et al.
Pubblicazione: (2026)
di: Du, Alina, et al.
Pubblicazione: (2026)
Multi-Path Long-Term Vessel Trajectories Forecasting with Probabilistic Feature Fusion for Problem Shifting
di: Spadon, Gabriel, et al.
Pubblicazione: (2023)
di: Spadon, Gabriel, et al.
Pubblicazione: (2023)
An AI enhanced approach to the tree unimodality conjecture
di: Ramos, Eric, et al.
Pubblicazione: (2025)
di: Ramos, Eric, et al.
Pubblicazione: (2025)
Pushing the Limits of Block Rotations in Post-Training Quantization
di: Sanjeet, Sai, et al.
Pubblicazione: (2026)
di: Sanjeet, Sai, et al.
Pubblicazione: (2026)
GraphOmni: A Comprehensive and Extensible Benchmark Framework for Large Language Models on Graph-theoretic Tasks
di: Xu, Hao, et al.
Pubblicazione: (2025)
di: Xu, Hao, et al.
Pubblicazione: (2025)
Federated Combinatorial Multi-Agent Multi-Armed Bandits
di: Fourati, Fares, et al.
Pubblicazione: (2024)
di: Fourati, Fares, et al.
Pubblicazione: (2024)
Fair Clustering for Data Summarization: Improved Approximation Algorithms and Complexity Insights
di: Gadekar, Ameet, et al.
Pubblicazione: (2024)
di: Gadekar, Ameet, et al.
Pubblicazione: (2024)
Analysis of Corrected Graph Convolutions
di: Wang, Robert, et al.
Pubblicazione: (2024)
di: Wang, Robert, et al.
Pubblicazione: (2024)
Multi-Excitation Projective Simulation with a Many-Body Physics Inspired Inductive Bias
di: LeMaitre, Philip A., et al.
Pubblicazione: (2024)
di: LeMaitre, Philip A., et al.
Pubblicazione: (2024)
Reward Generalization in RLHF: A Topological Perspective
di: Qiu, Tianyi, et al.
Pubblicazione: (2024)
di: Qiu, Tianyi, et al.
Pubblicazione: (2024)
Unrealized Expectations: Comparing AI Methods vs Classical Algorithms for Maximum Independent Set
di: Wu, Yikai, et al.
Pubblicazione: (2025)
di: Wu, Yikai, et al.
Pubblicazione: (2025)
Learning to Prune Instances of Steiner Tree Problem in Graphs
di: Zhang, Jiwei, et al.
Pubblicazione: (2022)
di: Zhang, Jiwei, et al.
Pubblicazione: (2022)
Approximately Optimal Search on a Higher-dimensional Sliding Puzzle
di: Merleau, Nono SC, et al.
Pubblicazione: (2024)
di: Merleau, Nono SC, et al.
Pubblicazione: (2024)
Future Directions in the Theory of Graph Machine Learning
di: Morris, Christopher, et al.
Pubblicazione: (2024)
di: Morris, Christopher, et al.
Pubblicazione: (2024)
Items or Relations -- what do Artificial Neural Networks learn?
di: Krause, Renate, et al.
Pubblicazione: (2024)
di: Krause, Renate, et al.
Pubblicazione: (2024)
The Parameterized Complexity of Computing the VC-Dimension
di: Foucaud, Florent, et al.
Pubblicazione: (2025)
di: Foucaud, Florent, et al.
Pubblicazione: (2025)
Critical attention scaling in long-context transformers
di: Chen, Shi, et al.
Pubblicazione: (2025)
di: Chen, Shi, et al.
Pubblicazione: (2025)
Graph Normalization: Fast Binarizing Dynamics for Differentiable MWIS
di: Guigues, Laurent
Pubblicazione: (2026)
di: Guigues, Laurent
Pubblicazione: (2026)
Are Graph Neural Networks Optimal Approximation Algorithms?
di: Yau, Morris, et al.
Pubblicazione: (2023)
di: Yau, Morris, et al.
Pubblicazione: (2023)
Box Facets and Cut Facets of Lifted Multicut Polytopes
di: Naumann, Lucas Fabian, et al.
Pubblicazione: (2024)
di: Naumann, Lucas Fabian, et al.
Pubblicazione: (2024)
Cautious Optimizers: Improving Training with One Line of Code
di: Liang, Kaizhao, et al.
Pubblicazione: (2024)
di: Liang, Kaizhao, et al.
Pubblicazione: (2024)
Feature-Aware (Hyper)graph Generation via Next-Scale Prediction
di: Gailhard, Dorian, et al.
Pubblicazione: (2025)
di: Gailhard, Dorian, et al.
Pubblicazione: (2025)
HyP-ASO: A Hybrid Policy-based Adaptive Search Optimization Framework for Large-Scale Integer Linear Programs
di: Xu, Ning, et al.
Pubblicazione: (2025)
di: Xu, Ning, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Qronos: Correcting the Past by Shaping the Future... in Post-Training Quantization
di: Zhang, Shihao, et al.
Pubblicazione: (2025) -
Gödel Test: Can Large Language Models Solve Easy Conjectures?
di: Feldman, Moran, et al.
Pubblicazione: (2025) -
Beacon: Post-Training Quantization with Integrated Grid Selection
di: Zhang, Shihao, et al.
Pubblicazione: (2025) -
Provable Post-Training Quantization: Theoretical Analysis of OPTQ and Qronos
di: Zhang, Haoyu, et al.
Pubblicazione: (2025) -
Finding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search
di: Mehrabian, Abbas, et al.
Pubblicazione: (2023)