Efficient Mixed Precision Quantization in Graph Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Moustafa, Samir, Kriege, Nils M., Gansterer, Wilfried N. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Crossfire: An Elastic Defense Framework for Graph Neural Networks Under Bit Flip Attacks
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)
On the Two Sides of Redundancy in Graph Neural Networks
di: Bause, Franka, et al.
Pubblicazione: (2023)
di: Bause, Franka, et al.
Pubblicazione: (2023)
Visualization and Analysis of the Loss Landscape in Graph Neural Networks
di: Moustafa, Samir, et al.
Pubblicazione: (2025)
di: Moustafa, Samir, et al.
Pubblicazione: (2025)
Attacking Graph Neural Networks with Bit Flips: Weisfeiler and Lehman Go Indifferent
di: Kummer, Lorenz, et al.
Pubblicazione: (2023)
di: Kummer, Lorenz, et al.
Pubblicazione: (2023)
On the Relationship Between Robustness and Expressivity of Graph Neural Networks
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)
Weisfeiler and Leman Go Gambling: Why Expressive Lottery Tickets Win
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)
Boosting Graph Neural Network Expressivity with Learnable Lanczos Constraints
di: Azizi, Niloofar, et al.
Pubblicazione: (2024)
di: Azizi, Niloofar, et al.
Pubblicazione: (2024)
Preventing Representational Rank Collapse in MPNNs by Splitting the Computational Graph
di: Roth, Andreas, et al.
Pubblicazione: (2024)
di: Roth, Andreas, et al.
Pubblicazione: (2024)
Joint Pruning and Channel-wise Mixed-Precision Quantization for Efficient Deep Neural Networks
di: Motetti, Beatrice Alessandra, et al.
Pubblicazione: (2024)
di: Motetti, Beatrice Alessandra, et al.
Pubblicazione: (2024)
Accelerating Graph Neural Networks with a Novel Matrix Compression Format
di: Alves, João N. F., et al.
Pubblicazione: (2024)
di: Alves, João N. F., et al.
Pubblicazione: (2024)
On-Chip Hardware-Aware Quantization for Mixed Precision Neural Networks
di: Huang, Wei, et al.
Pubblicazione: (2023)
di: Huang, Wei, et al.
Pubblicazione: (2023)
XIMP: Cross Graph Inter-Message Passing for Molecular Property Prediction
di: Ehrlich, Anatol, et al.
Pubblicazione: (2026)
di: Ehrlich, Anatol, et al.
Pubblicazione: (2026)
Efficient and Effective Methods for Mixed Precision Neural Network Quantization for Faster, Energy-efficient Inference
di: Bablani, Deepika, et al.
Pubblicazione: (2023)
di: Bablani, Deepika, et al.
Pubblicazione: (2023)
OMPQ: Orthogonal Mixed Precision Quantization
di: Ma, Yuexiao, et al.
Pubblicazione: (2021)
di: Ma, Yuexiao, et al.
Pubblicazione: (2021)
FlexiQ: Adaptive Mixed-Precision Quantization for Latency/Accuracy Trade-Offs in Deep Neural Networks
di: Kim, Jaemin, et al.
Pubblicazione: (2025)
di: Kim, Jaemin, et al.
Pubblicazione: (2025)
DyBit: Dynamic Bit-Precision Numbers for Efficient Quantized Neural Network Inference
di: Zhou, Jiajun, et al.
Pubblicazione: (2023)
di: Zhou, Jiajun, et al.
Pubblicazione: (2023)
Mixed-Precision Quantization for Language Models: Techniques and Prospects
di: Rakka, Mariam, et al.
Pubblicazione: (2025)
di: Rakka, Mariam, et al.
Pubblicazione: (2025)
MicroMix: Efficient Mixed-Precision Quantization with Microscaling Formats for Large Language Models
di: Liu, Wenyuan, et al.
Pubblicazione: (2025)
di: Liu, Wenyuan, et al.
Pubblicazione: (2025)
MoPEQ: Mixture of Mixed Precision Quantized Experts
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
Pruning and Quantization Impact on Graph Neural Networks
di: Khedri, Khatoon, et al.
Pubblicazione: (2025)
di: Khedri, Khatoon, et al.
Pubblicazione: (2025)
AMED: Automatic Mixed-Precision Quantization for Edge Devices
di: Kimhi, Moshe, et al.
Pubblicazione: (2022)
di: Kimhi, Moshe, et al.
Pubblicazione: (2022)
RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference
di: Gautam, Arpit Singh, et al.
Pubblicazione: (2026)
di: Gautam, Arpit Singh, et al.
Pubblicazione: (2026)
Dual Precision Quantization for Efficient and Accurate Deep Neural Networks Inference
di: Gafni, Tomer, et al.
Pubblicazione: (2025)
di: Gafni, Tomer, et al.
Pubblicazione: (2025)
Quantized SO(3)-Equivariant Graph Neural Networks for Efficient Molecular Property Prediction
di: Zhou, Haoyu, et al.
Pubblicazione: (2026)
di: Zhou, Haoyu, et al.
Pubblicazione: (2026)
AMPLE: Event-Driven Accelerator for Mixed-Precision Inference of Graph Neural Networks
di: Gimenes, Pedro, et al.
Pubblicazione: (2025)
di: Gimenes, Pedro, et al.
Pubblicazione: (2025)
Graph Mixing Additive Networks
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2025)
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2025)
STaMP: Sequence Transformation and Mixed Precision for Low-Precision Activation Quantization
di: Federici, Marco, et al.
Pubblicazione: (2025)
di: Federici, Marco, et al.
Pubblicazione: (2025)
InfoQ: Mixed-Precision Quantization via Global Information Flow
di: Akbulut, Mehmet Emre, et al.
Pubblicazione: (2025)
di: Akbulut, Mehmet Emre, et al.
Pubblicazione: (2025)
Precision Neural Networks: Joint Graph And Relational Learning
di: Cavallo, Andrea, et al.
Pubblicazione: (2025)
di: Cavallo, Andrea, et al.
Pubblicazione: (2025)
DyMoE: Dynamic Expert Orchestration with Mixed-Precision Quantization for Efficient MoE Inference on Edge
di: Huang, Yuegui, et al.
Pubblicazione: (2026)
di: Huang, Yuegui, et al.
Pubblicazione: (2026)
AutoQRA: Joint Optimization of Mixed-Precision Quantization and Low-rank Adapters for Efficient LLM Fine-Tuning
di: Zhou, Changhai, et al.
Pubblicazione: (2026)
di: Zhou, Changhai, et al.
Pubblicazione: (2026)
Flexible Mixed Precision Quantization for Learned Image Compression
di: Hossain, Md Adnan Faisal, et al.
Pubblicazione: (2025)
di: Hossain, Md Adnan Faisal, et al.
Pubblicazione: (2025)
APreQEL: Adaptive Mixed Precision Quantization For Edge LLMs
di: Bouzouad, Meriem, et al.
Pubblicazione: (2026)
di: Bouzouad, Meriem, et al.
Pubblicazione: (2026)
Where and How to Enhance: Discovering Bit-Width Contribution for Mixed Precision Quantization
di: Kang, Haidong, et al.
Pubblicazione: (2025)
di: Kang, Haidong, et al.
Pubblicazione: (2025)
CoopQ: Cooperative Game Inspired Layerwise Mixed Precision Quantization for LLMs
di: Zhao, Junchen, et al.
Pubblicazione: (2025)
di: Zhao, Junchen, et al.
Pubblicazione: (2025)
LoRAQuant: Mixed-Precision Quantization of LoRA to Ultra-Low Bits
di: Mirzaei, Amir Reza, et al.
Pubblicazione: (2025)
di: Mirzaei, Amir Reza, et al.
Pubblicazione: (2025)
MixDiT: Accelerating Image Diffusion Transformer Inference with Mixed-Precision MX Quantization
di: Kim, Daeun, et al.
Pubblicazione: (2025)
di: Kim, Daeun, et al.
Pubblicazione: (2025)
MPQ-Diff: Mixed Precision Quantization for Diffusion Models
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
di: Maruzzelli, Rocco Manz, et al.
Pubblicazione: (2024)
MetaMix: Meta-state Precision Searcher for Mixed-precision Activation Quantization
di: Kim, Han-Byul, et al.
Pubblicazione: (2023)
di: Kim, Han-Byul, et al.
Pubblicazione: (2023)
True 4-Bit Quantized Convolutional Neural Network Training on CPU: Achieving Full-Precision Parity
di: Tathe, Shivnath
Pubblicazione: (2026)
di: Tathe, Shivnath
Pubblicazione: (2026)
Documenti analoghi
-
Crossfire: An Elastic Defense Framework for Graph Neural Networks Under Bit Flip Attacks
di: Kummer, Lorenz, et al.
Pubblicazione: (2025) -
On the Two Sides of Redundancy in Graph Neural Networks
di: Bause, Franka, et al.
Pubblicazione: (2023) -
Visualization and Analysis of the Loss Landscape in Graph Neural Networks
di: Moustafa, Samir, et al.
Pubblicazione: (2025) -
Attacking Graph Neural Networks with Bit Flips: Weisfeiler and Lehman Go Indifferent
di: Kummer, Lorenz, et al.
Pubblicazione: (2023) -
On the Relationship Between Robustness and Expressivity of Graph Neural Networks
di: Kummer, Lorenz, et al.
Pubblicazione: (2025)