Tri-Accel: Curvature-Aware Precision-Adaptive and Memory-Elastic Optimization for Efficient GPU Usage
Fuente:
arXiv
Guardado en:
| Autores principales: | Sheibanian, Mohsen, Shaeri, Pouya, Beigi, Alimohammad, Woo, Ryan T., Keluskar, Aryan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Semi-supervised Fake News Detection using Sentiment Encoding and LSTM with Self-Attention
por: Shaeri, Pouya, et al.
Publicado: (2024)
por: Shaeri, Pouya, et al.
Publicado: (2024)
Evaluating Adaptive Personalization of Educational Readings with Simulated Learners
por: Woo, Ryan T., et al.
Publicado: (2026)
por: Woo, Ryan T., et al.
Publicado: (2026)
MID-L: Matrix-Interpolated Dropout Layer with Layer-wise Neuron Selection
por: Shaeri, Pouya, et al.
Publicado: (2025)
por: Shaeri, Pouya, et al.
Publicado: (2025)
Explainable Human-in-the-Loop Segmentation via Critic Feedback Signals
por: Shaeri, Pouya, et al.
Publicado: (2025)
por: Shaeri, Pouya, et al.
Publicado: (2025)
Sentiment and Social Signals in the Climate Crisis: A Survey on Analyzing Social Media Responses to Extreme Weather Events
por: Shaeri, Pouya, et al.
Publicado: (2025)
por: Shaeri, Pouya, et al.
Publicado: (2025)
LOOKAT: Lookup-Optimized Key-Attention for Memory-Efficient Transformers
por: Karmore, Aryan
Publicado: (2026)
por: Karmore, Aryan
Publicado: (2026)
MNIST-Gen: A Modular MNIST-Style Dataset Generation Using Hierarchical Semantics, Reinforcement Learning, and Category Theory
por: Shaeri, Pouya, et al.
Publicado: (2025)
por: Shaeri, Pouya, et al.
Publicado: (2025)
Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering
por: Keluskar, Aryan, et al.
Publicado: (2024)
por: Keluskar, Aryan, et al.
Publicado: (2024)
LLMem: Estimating GPU Memory Usage for Fine-Tuning Pre-Trained LLMs
por: Kim, Taeho, et al.
Publicado: (2024)
por: Kim, Taeho, et al.
Publicado: (2024)
CurvZO: Adaptive Curvature-Guided Sparse Zeroth-Order Optimization for Efficient LLM Fine-Tuning
por: Wang, Shuo, et al.
Publicado: (2026)
por: Wang, Shuo, et al.
Publicado: (2026)
Llamas on the Web: Memory-Efficient, Performance-Portable, and Multi-Precision LLM Inference with WebGPU
por: Levine, Reese, et al.
Publicado: (2026)
por: Levine, Reese, et al.
Publicado: (2026)
Memory-Efficient Sequential Pattern Mining with Hybrid Tries
por: Hosseininasab, Amin, et al.
Publicado: (2022)
por: Hosseininasab, Amin, et al.
Publicado: (2022)
Sample-Efficient Bayesian Optimization with Transfer Learning for Heterogeneous Search Spaces
por: Deshwal, Aryan, et al.
Publicado: (2024)
por: Deshwal, Aryan, et al.
Publicado: (2024)
CoMERA: Computing- and Memory-Efficient Training via Rank-Adaptive Tensor Optimization
por: Yang, Zi, et al.
Publicado: (2024)
por: Yang, Zi, et al.
Publicado: (2024)
Efficient Arbitrary Precision Acceleration for Large Language Models on GPU Tensor Cores
por: Ma, Shaobo, et al.
Publicado: (2024)
por: Ma, Shaobo, et al.
Publicado: (2024)
Efficient Edge LLMs Deployment via HessianAware Quantization and CPU GPU Collaborative
por: Zhang, Tuo, et al.
Publicado: (2025)
por: Zhang, Tuo, et al.
Publicado: (2025)
COM-BOM: Bayesian Exemplar Search for Efficiently Exploring the Accuracy-Calibration Pareto Frontier
por: Luo, Gaoxiang, et al.
Publicado: (2025)
por: Luo, Gaoxiang, et al.
Publicado: (2025)
CurvaDion: Curvature-Adaptive Distributed Orthonormalization
por: Kumar, Bhavesh, et al.
Publicado: (2025)
por: Kumar, Bhavesh, et al.
Publicado: (2025)
CUROCKET: Optimizing ROCKET for GPU
por: Stüven, Ole, et al.
Publicado: (2026)
por: Stüven, Ole, et al.
Publicado: (2026)
GPU Memory Requirement Prediction for Deep Learning Task Based on Bidirectional Gated Recurrent Unit Optimization Transformer
por: Wang, Chao, et al.
Publicado: (2025)
por: Wang, Chao, et al.
Publicado: (2025)
FlashOptim: Optimizers for Memory-Efficient Training
por: Ortiz, Jose Javier Gonzalez, et al.
Publicado: (2026)
por: Ortiz, Jose Javier Gonzalez, et al.
Publicado: (2026)
Dynamic Memory Based Adaptive Optimization
por: Szegedy, Balázs, et al.
Publicado: (2024)
por: Szegedy, Balázs, et al.
Publicado: (2024)
Scale When Needed: Adaptive Neuron-level Mixed Precision Quantization Aware Training
por: Varshney, Ayush K., et al.
Publicado: (2026)
por: Varshney, Ayush K., et al.
Publicado: (2026)
RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference
por: Gautam, Arpit Singh, et al.
Publicado: (2026)
por: Gautam, Arpit Singh, et al.
Publicado: (2026)
AgentKernelArena: Generalization-Aware Benchmarking of GPU Kernel Optimization Agents
por: Younesian, Sharareh, et al.
Publicado: (2026)
por: Younesian, Sharareh, et al.
Publicado: (2026)
Towards Optimizing the Costs of LLM Usage
por: Shekhar, Shivanshu, et al.
Publicado: (2024)
por: Shekhar, Shivanshu, et al.
Publicado: (2024)
Bayesian Optimization for Function-Valued Responses under Min-Max Criteria
por: Ahadi, Pouya, et al.
Publicado: (2025)
por: Ahadi, Pouya, et al.
Publicado: (2025)
Geometry-Aware Backdoor Attacks: Leveraging Curvature in Hyperbolic Embeddings
por: Baheri, Ali
Publicado: (2025)
por: Baheri, Ali
Publicado: (2025)
ButterflyMoE: Sub-Linear Ternary Experts via Structured Butterfly Orbits
por: Karmore, Aryan
Publicado: (2026)
por: Karmore, Aryan
Publicado: (2026)
Tri-MTL: A Triple Multitask Learning Approach for Respiratory Disease Diagnosis
por: Kim, June-Woo, et al.
Publicado: (2025)
por: Kim, June-Woo, et al.
Publicado: (2025)
SMMF: Square-Matricized Momentum Factorization for Memory-Efficient Optimization
por: Park, Kwangryeol, et al.
Publicado: (2024)
por: Park, Kwangryeol, et al.
Publicado: (2024)
Harnessing Optimization Dynamics for Curvature-Informed Model Merging
por: Mahdavinia, Pouria, et al.
Publicado: (2025)
por: Mahdavinia, Pouria, et al.
Publicado: (2025)
Curvature-Aware Optimization for High-Accuracy Physics-Informed Neural Networks
por: Jnini, Anas, et al.
Publicado: (2026)
por: Jnini, Anas, et al.
Publicado: (2026)
CA-HFP: Curvature-Aware Heterogeneous Federated Pruning with Model Reconstruction
por: Hu, Gang, et al.
Publicado: (2026)
por: Hu, Gang, et al.
Publicado: (2026)
Carnatic Raga Identification System using Rigorous Time-Delay Neural Network
por: Natesan, Sanjay, et al.
Publicado: (2024)
por: Natesan, Sanjay, et al.
Publicado: (2024)
Efficient Skill Discovery via Regret-Aware Optimization
por: Zhang, He, et al.
Publicado: (2025)
por: Zhang, He, et al.
Publicado: (2025)
Online GPU Energy Optimization with Switching-Aware Bandits
por: Xu, Xiongxiao, et al.
Publicado: (2024)
por: Xu, Xiongxiao, et al.
Publicado: (2024)
Can LLMs Improve Multimodal Fact-Checking by Asking Relevant Questions?
por: Beigi, Alimohammad, et al.
Publicado: (2024)
por: Beigi, Alimohammad, et al.
Publicado: (2024)
MISA: Memory-Efficient LLMs Optimization with Module-wise Importance Sampling
por: Liu, Yuxi, et al.
Publicado: (2025)
por: Liu, Yuxi, et al.
Publicado: (2025)
Memory-Efficient Gradient Unrolling for Large-Scale Bi-level Optimization
por: Shen, Qianli, et al.
Publicado: (2024)
por: Shen, Qianli, et al.
Publicado: (2024)
Ejemplares similares
-
A Semi-supervised Fake News Detection using Sentiment Encoding and LSTM with Self-Attention
por: Shaeri, Pouya, et al.
Publicado: (2024) -
Evaluating Adaptive Personalization of Educational Readings with Simulated Learners
por: Woo, Ryan T., et al.
Publicado: (2026) -
MID-L: Matrix-Interpolated Dropout Layer with Layer-wise Neuron Selection
por: Shaeri, Pouya, et al.
Publicado: (2025) -
Explainable Human-in-the-Loop Segmentation via Critic Feedback Signals
por: Shaeri, Pouya, et al.
Publicado: (2025) -
Sentiment and Social Signals in the Climate Crisis: A Survey on Analyzing Social Media Responses to Extreme Weather Events
por: Shaeri, Pouya, et al.
Publicado: (2025)