Enhancing Trustworthiness with Mixed Precision: Benchmarks, Opportunities, and Challenges
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Guanxi, Chen, Hao Mark, Que, Zhiqiang, Luk, Wayne, Fan, Hongxiang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FastTTS: Accelerating Test-Time Scaling for Edge LLM Reasoning
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
MetaML-Pro: Cross-Stage Design Flow Automation for Efficient Deep Learning Acceleration
par: Que, Zhiqiang, et autres
Publié: (2025)
par: Que, Zhiqiang, et autres
Publié: (2025)
Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
par: Zhang, Zehuan, et autres
Publié: (2024)
par: Zhang, Zehuan, et autres
Publié: (2024)
Enhancing Dropout-based Bayesian Neural Networks with Multi-Exit on FPGA
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
AdaBlock-dLLM: Semantic-Aware Diffusion LLM Inference via Adaptive Block Size
par: Lu, Guanxi, et autres
Publié: (2025)
par: Lu, Guanxi, et autres
Publié: (2025)
Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
LL-GNN: Low Latency Graph Neural Networks on FPGAs for High Energy Physics
par: Que, Zhiqiang, et autres
Publié: (2022)
par: Que, Zhiqiang, et autres
Publié: (2022)
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
Progressive Mixed-Precision Decoding for Efficient LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
da4ml: Distributed Arithmetic for Real-time Neural Networks on FPGAs
par: Sun, Chang, et autres
Publié: (2025)
par: Sun, Chang, et autres
Publié: (2025)
Hardware-Aware Parallel Prompt Decoding for Memory-Efficient Acceleration of LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
HGQ: High Granularity Quantization for Real-time Neural Networks on FPGAs
par: Sun, Chang, et autres
Publié: (2024)
par: Sun, Chang, et autres
Publié: (2024)
Dynamic Expert Sharing: Decoupling Memory from Parallelism in Mixture-of-Experts Diffusion LLMs
par: Chen, Hao Mark, et autres
Publié: (2026)
par: Chen, Hao Mark, et autres
Publié: (2026)
Algorithm and Hardware Co-Design for Efficient Complex-Valued Uncertainty Estimation
par: Zhang, Zehuan, et autres
Publié: (2026)
par: Zhang, Zehuan, et autres
Publié: (2026)
HGQ-LUT: Fast LUT-Aware Training and Efficient Architectures for DNN Inference
par: Sun, Chang, et autres
Publié: (2026)
par: Sun, Chang, et autres
Publié: (2026)
Enhancing LLM-based Quantum Code Generation with Multi-Agent Optimization and Quantum Error Correction
par: Campbell, Charlie, et autres
Publié: (2025)
par: Campbell, Charlie, et autres
Publié: (2025)
Low-Precision Training of Large Language Models: Methods, Challenges, and Opportunities
par: Hao, Zhiwei, et autres
Publié: (2025)
par: Hao, Zhiwei, et autres
Publié: (2025)
JetFormer: A Scalable and Efficient Transformer for Jet Tagging from Offline Analysis to FPGA Triggers
par: Zheng, Ruoqing, et autres
Publié: (2026)
par: Zheng, Ruoqing, et autres
Publié: (2026)
Exploring Code Language Models for Automated HLS-based Hardware Generation: Benchmark, Infrastructure and Analysis
par: Gai, Jiahao, et autres
Publié: (2025)
par: Gai, Jiahao, et autres
Publié: (2025)
Sub-microsecond Transformers for Jet Tagging on FPGAs
par: Laatu, Lauri, et autres
Publié: (2025)
par: Laatu, Lauri, et autres
Publié: (2025)
GNN-Transformer Cooperative Architecture for Trustworthy Graph Contrastive Learning
par: Liang, Jianqing, et autres
Publié: (2024)
par: Liang, Jianqing, et autres
Publié: (2024)
Scalable Time-Series Causal Discovery with Approximate Causal Ordering
par: Jiao, Ziyang, et autres
Publié: (2024)
par: Jiao, Ziyang, et autres
Publié: (2024)
VCDF: A Validated Consensus-Driven Framework for Time Series Causal Discovery
par: Yu, Gene, et autres
Publié: (2026)
par: Yu, Gene, et autres
Publié: (2026)
JEDI-linear: Fast and Efficient Graph Neural Networks for Jet Tagging on FPGAs
par: Que, Zhiqiang, et autres
Publié: (2025)
par: Que, Zhiqiang, et autres
Publié: (2025)
Mixed-Precision Conjugate Gradient Solvers with RL-Driven Precision Tuning
par: Chen, Xinye
Publié: (2025)
par: Chen, Xinye
Publié: (2025)
Graph Foundation Models: Concepts, Opportunities and Challenges
par: Liu, Jiawei, et autres
Publié: (2023)
par: Liu, Jiawei, et autres
Publié: (2023)
Exploring FPGA designs for MX and beyond
par: Samson, Ebby, et autres
Publié: (2024)
par: Samson, Ebby, et autres
Publié: (2024)
Robust Time Series Causal Discovery for Agent-Based Model Validation
par: Yu, Gene, et autres
Publié: (2024)
par: Yu, Gene, et autres
Publié: (2024)
MixKVQ: Query-Aware Mixed-Precision KV Cache Quantization for Long-Context Reasoning
par: Zhang, Tao, et autres
Publié: (2025)
par: Zhang, Tao, et autres
Publié: (2025)
Accelerating 3D Gaussian Splatting with Neural Sorting and Axis-Oriented Rasterization
par: Wang, Zhican, et autres
Publié: (2025)
par: Wang, Zhican, et autres
Publié: (2025)
Blockchain-enabled Trustworthy Federated Unlearning
par: Lin, Yijing, et autres
Publié: (2024)
par: Lin, Yijing, et autres
Publié: (2024)
SAE: Single Architecture Ensemble Neural Networks
par: Ferianc, Martin, et autres
Publié: (2024)
par: Ferianc, Martin, et autres
Publié: (2024)
Open Challenges and Opportunities in Federated Foundation Models Towards Biomedical Healthcare
par: Li, Xingyu, et autres
Publié: (2024)
par: Li, Xingyu, et autres
Publié: (2024)
Context Memorization for Efficient Long Context Generation
par: Okoshi, Yasuyuki, et autres
Publié: (2026)
par: Okoshi, Yasuyuki, et autres
Publié: (2026)
Where and How to Enhance: Discovering Bit-Width Contribution for Mixed Precision Quantization
par: Kang, Haidong, et autres
Publié: (2025)
par: Kang, Haidong, et autres
Publié: (2025)
Identifying Trustworthiness Challenges in Deep Learning Models for Continental-Scale Water Quality Prediction
par: Xia, Xiaobo, et autres
Publié: (2025)
par: Xia, Xiaobo, et autres
Publié: (2025)
Trustworthy Artificial Intelligence in the Context of Metrology
par: Adel, Tameem, et autres
Publié: (2024)
par: Adel, Tameem, et autres
Publié: (2024)
ASPO: Constraint-Aware Bayesian Optimization for FPGA-based Soft Processors
par: Wu, Haoran, et autres
Publié: (2025)
par: Wu, Haoran, et autres
Publié: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
par: Wang, Jiapeng, et autres
Publié: (2026)
par: Wang, Jiapeng, et autres
Publié: (2026)
Internet of Things-Based Smart Precision Farming in Soilless Agriculture: Opportunities and Challenges for Global Food Security
par: Dutta, Monica, et autres
Publié: (2025)
par: Dutta, Monica, et autres
Publié: (2025)
Documents similaires
-
FastTTS: Accelerating Test-Time Scaling for Edge LLM Reasoning
par: Chen, Hao Mark, et autres
Publié: (2025) -
MetaML-Pro: Cross-Stage Design Flow Automation for Efficient Deep Learning Acceleration
par: Que, Zhiqiang, et autres
Publié: (2025) -
Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
par: Zhang, Zehuan, et autres
Publié: (2024) -
Enhancing Dropout-based Bayesian Neural Networks with Multi-Exit on FPGA
par: Chen, Hao Mark, et autres
Publié: (2024) -
AdaBlock-dLLM: Semantic-Aware Diffusion LLM Inference via Adaptive Block Size
par: Lu, Guanxi, et autres
Publié: (2025)