Using MLIR Transform to Design Sliced Convolution Algorithm
Fuente:
arXiv
Guardado en:
| Autores principales: | Ferrari, Victor, Pereira, Marcio, Alvarenga, Lucas, Leite, Gustavo, Araujo, Guido |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ConvBench: A Comprehensive Benchmark for 2D Convolution Primitive Evaluation
por: Alvarenga, Lucas, et al.
Publicado: (2024)
por: Alvarenga, Lucas, et al.
Publicado: (2024)
A Study on Inference Latency for Vision Transformers on Mobile Devices
por: Li, Zhuojin, et al.
Publicado: (2025)
por: Li, Zhuojin, et al.
Publicado: (2025)
Minuet: Accelerating 3D Sparse Convolutions on GPUs
por: Yang, Jiacheng, et al.
Publicado: (2023)
por: Yang, Jiacheng, et al.
Publicado: (2023)
ProfilingAgent: Profiling-Guided Agentic Reasoning for Adaptive Model Optimization
por: Jafari, Sadegh, et al.
Publicado: (2025)
por: Jafari, Sadegh, et al.
Publicado: (2025)
PEVLM: Parallel Encoding for Vision-Language Models
por: Kang, Letian, et al.
Publicado: (2025)
por: Kang, Letian, et al.
Publicado: (2025)
CRAM: Large-scale Video Continual Learning with Bootstrapped Compression
por: Mall, Shivani, et al.
Publicado: (2025)
por: Mall, Shivani, et al.
Publicado: (2025)
Optimizing Methane Detection On Board Satellites: Speed, Accuracy, and Low-Power Solutions for Resource-Constrained Hardware
por: Herec, Jonáš, et al.
Publicado: (2025)
por: Herec, Jonáš, et al.
Publicado: (2025)
A Hitchhiker's Guide to Understanding Performances of Two-Class Classifiers
por: Halin, Anaïs, et al.
Publicado: (2024)
por: Halin, Anaïs, et al.
Publicado: (2024)
Foundations of the Theory of Performance-Based Ranking
por: Piérard, Sébastien, et al.
Publicado: (2024)
por: Piérard, Sébastien, et al.
Publicado: (2024)
The Tile: A 2D Map of Ranking Scores for Two-Class Classification
por: Piérard, Sébastien, et al.
Publicado: (2024)
por: Piérard, Sébastien, et al.
Publicado: (2024)
Learning Using Privileged Information for Litter Detection
por: Bartolo, Matthias, et al.
Publicado: (2025)
por: Bartolo, Matthias, et al.
Publicado: (2025)
FastCache: Fast Caching for Diffusion Transformer Through Learnable Linear Approximation
por: Liu, Dong, et al.
Publicado: (2025)
por: Liu, Dong, et al.
Publicado: (2025)
Model Quantization and Hardware Acceleration for Vision Transformers: A Comprehensive Survey
por: Du, Dayou, et al.
Publicado: (2024)
por: Du, Dayou, et al.
Publicado: (2024)
LP-GEMM: Integrating Layout Propagation into GEMM Operations
por: Carneiro, César Guedes, et al.
Publicado: (2026)
por: Carneiro, César Guedes, et al.
Publicado: (2026)
Adaptive Iterative Compression for High-Resolution Files: an Approach Focused on Preserving Visual Quality in Cinematic Workflows
por: Melo, Leonardo, et al.
Publicado: (2025)
por: Melo, Leonardo, et al.
Publicado: (2025)
Fast-SEnSeI: Lightweight Sensor-Independent Cloud Masking for On-board Multispectral Sensors
por: Kněžík, Jan, et al.
Publicado: (2025)
por: Kněžík, Jan, et al.
Publicado: (2025)
Zero-Shot, But at What Cost? Unveiling the Hidden Overhead of MILS's LLM-CLIP Framework for Image Captioning
por: Benhammou, Yassir, et al.
Publicado: (2025)
por: Benhammou, Yassir, et al.
Publicado: (2025)
NeRFlex: Resource-aware Real-time High-quality Rendering of Complex Scenes on Mobile Devices
por: Wang, Zhe, et al.
Publicado: (2025)
por: Wang, Zhe, et al.
Publicado: (2025)
Spatially-Aware Evaluation of Segmentation Uncertainty
por: Zeevi, Tal, et al.
Publicado: (2025)
por: Zeevi, Tal, et al.
Publicado: (2025)
VLM in a flash: I/O-Efficient Sparsification of Vision-Language Model via Neuron Chunking
por: Yang, Kichang, et al.
Publicado: (2025)
por: Yang, Kichang, et al.
Publicado: (2025)
Multi-domain performance analysis with scores tailored to user preferences
por: Piérard, Sébastien, et al.
Publicado: (2025)
por: Piérard, Sébastien, et al.
Publicado: (2025)
SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
por: Zhang, Jintao, et al.
Publicado: (2025)
por: Zhang, Jintao, et al.
Publicado: (2025)
What Is the Optimal Ranking Score Between Precision and Recall? We Can Always Find It and It Is Rarely $F_1$
por: Piérard, Sébastien, et al.
Publicado: (2025)
por: Piérard, Sébastien, et al.
Publicado: (2025)
SnapGen-V: Generating a Five-Second Video within Five Seconds on a Mobile Device
por: Wu, Yushu, et al.
Publicado: (2024)
por: Wu, Yushu, et al.
Publicado: (2024)
Revisiting 16-bit Neural Network Training: A Practical Approach for Resource-Limited Learning
por: Yun, Juyoung, et al.
Publicado: (2023)
por: Yun, Juyoung, et al.
Publicado: (2023)
A Closer Look at Data Augmentation Strategies for Finetuning-Based Low/Few-Shot Object Detection
por: Li, Vladislav, et al.
Publicado: (2024)
por: Li, Vladislav, et al.
Publicado: (2024)
Neural Architecture Search of Hybrid Models for NPU-CIM Heterogeneous AR/VR Devices
por: Zhao, Yiwei, et al.
Publicado: (2024)
por: Zhao, Yiwei, et al.
Publicado: (2024)
Implications of Noise in Resistive Memory on Deep Neural Networks for Image Classification
por: Emonds, Yannick, et al.
Publicado: (2024)
por: Emonds, Yannick, et al.
Publicado: (2024)
Dual-Signal Adaptive KV-Cache Optimization for Long-Form Video Understanding in Vision-Language Models
por: Sai, Vishnu, et al.
Publicado: (2026)
por: Sai, Vishnu, et al.
Publicado: (2026)
Class Confidence Aware Reweighting for Long Tailed Learning
por: Jagati, Brainard Philemon, et al.
Publicado: (2026)
por: Jagati, Brainard Philemon, et al.
Publicado: (2026)
On Latency Predictors for Neural Architecture Search
por: Akhauri, Yash, et al.
Publicado: (2024)
por: Akhauri, Yash, et al.
Publicado: (2024)
TakuNet: an Energy-Efficient CNN for Real-Time Inference on Embedded UAV systems in Emergency Response Scenarios
por: Rossi, Daniel, et al.
Publicado: (2025)
por: Rossi, Daniel, et al.
Publicado: (2025)
Smartphone-based Eye Tracking System using Edge Intelligence and Model Optimisation
por: Gunawardena, Nishan, et al.
Publicado: (2024)
por: Gunawardena, Nishan, et al.
Publicado: (2024)
Realtime Facial Expression Recognition: Neuromorphic Hardware vs. Edge AI Accelerators
por: Smith, Heath, et al.
Publicado: (2024)
por: Smith, Heath, et al.
Publicado: (2024)
Slicing Vision Transformer for Flexible Inference
por: Zhang, Yitian, et al.
Publicado: (2024)
por: Zhang, Yitian, et al.
Publicado: (2024)
Performance is not All You Need: Sustainability Considerations for Algorithms
por: Li, Xiang, et al.
Publicado: (2025)
por: Li, Xiang, et al.
Publicado: (2025)
R2 Loss: Range Restriction Loss for Model Compression and Quantization
por: Kundu, Arnav, et al.
Publicado: (2023)
por: Kundu, Arnav, et al.
Publicado: (2023)
Towards a Proactive Autoscaling Framework for Data Stream Processing at the Edge using GRU and Transfer Learning
por: Armah, Eugene, et al.
Publicado: (2025)
por: Armah, Eugene, et al.
Publicado: (2025)
SageAttention3: Microscaling FP4 Attention for Inference and An Exploration of 8-Bit Training
por: Zhang, Jintao, et al.
Publicado: (2025)
por: Zhang, Jintao, et al.
Publicado: (2025)
Characterizing Accuracy Trade-offs of EEG Applications on Embedded HMPs
por: Taufique, Zain, et al.
Publicado: (2024)
por: Taufique, Zain, et al.
Publicado: (2024)
Ejemplares similares
-
ConvBench: A Comprehensive Benchmark for 2D Convolution Primitive Evaluation
por: Alvarenga, Lucas, et al.
Publicado: (2024) -
A Study on Inference Latency for Vision Transformers on Mobile Devices
por: Li, Zhuojin, et al.
Publicado: (2025) -
Minuet: Accelerating 3D Sparse Convolutions on GPUs
por: Yang, Jiacheng, et al.
Publicado: (2023) -
ProfilingAgent: Profiling-Guided Agentic Reasoning for Adaptive Model Optimization
por: Jafari, Sadegh, et al.
Publicado: (2025) -
PEVLM: Parallel Encoding for Vision-Language Models
por: Kang, Letian, et al.
Publicado: (2025)