Accelerating Nonlinear Time-History Analysis with Complex Constitutive Laws via Heterogeneous Memory Management: From 3D Seismic Simulation to Neural Network Training
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ichimura, Tsuyoshi, Fujita, Kohei, Ito, Hideaki, Hori, Muneo, Maddegedara, Lalith |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Low-ordered Orthogonal Voxel Finite Element with INT8 Tensor Cores for GPU-based Explicit Elastic Wave Propagation Analysis
von: Ichimura, Tsuyoshi, et al.
Veröffentlicht: (2024)
von: Ichimura, Tsuyoshi, et al.
Veröffentlicht: (2024)
Development of an Estimation Method for the Seismic Motion Reproducibility of a Three-dimensional Ground Structure Model by combining Surface-observed Seismic Motion and Three-dimensional Seismic Motion Analysis
von: Ichimura, Tsuyoshi, et al.
Veröffentlicht: (2024)
von: Ichimura, Tsuyoshi, et al.
Veröffentlicht: (2024)
Accelerating Large Language Model Training with 4D Parallelism and Memory Consumption Estimator
von: Fujii, Kazuki, et al.
Veröffentlicht: (2024)
von: Fujii, Kazuki, et al.
Veröffentlicht: (2024)
Jenga: Effective Memory Management for Serving LLM with Heterogeneity
von: Zhang, Chen, et al.
Veröffentlicht: (2025)
von: Zhang, Chen, et al.
Veröffentlicht: (2025)
RIMMS: Runtime Integrated Memory Management System for Heterogeneous Computing
von: Gener, Serhan, et al.
Veröffentlicht: (2025)
von: Gener, Serhan, et al.
Veröffentlicht: (2025)
Union: An Automatic Workload Manager for Accelerating Network Simulation
von: Wang, Xin, et al.
Veröffentlicht: (2024)
von: Wang, Xin, et al.
Veröffentlicht: (2024)
Accelerating Microswimmer Simulations via a Heterogeneous Pipelined Parallel-in-Time Framework
von: Huang, Ruixiang, et al.
Veröffentlicht: (2026)
von: Huang, Ruixiang, et al.
Veröffentlicht: (2026)
Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters
von: Chang, Zihan, et al.
Veröffentlicht: (2024)
von: Chang, Zihan, et al.
Veröffentlicht: (2024)
AcOrch: Accelerating Sampling-based GNN Training under CPU-NPU Heterogeneous Environments
von: Chen, Kefu, et al.
Veröffentlicht: (2026)
von: Chen, Kefu, et al.
Veröffentlicht: (2026)
GPU Memory and Utilization Estimation for Training-Aware Resource Management: Opportunities and Limitations
von: Yousefzadeh-Asl-Miandoab, Ehsan, et al.
Veröffentlicht: (2026)
von: Yousefzadeh-Asl-Miandoab, Ehsan, et al.
Veröffentlicht: (2026)
PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training
von: Fang, Jiahao, et al.
Veröffentlicht: (2024)
von: Fang, Jiahao, et al.
Veröffentlicht: (2024)
On the Bit Complexity of Iterated Memory
von: Toyos-Marfurt, Guillermo, et al.
Veröffentlicht: (2024)
von: Toyos-Marfurt, Guillermo, et al.
Veröffentlicht: (2024)
HetCCL: Accelerating LLM Training with Heterogeneous GPUs
von: Kim, Heehoon, et al.
Veröffentlicht: (2026)
von: Kim, Heehoon, et al.
Veröffentlicht: (2026)
AME: An Efficient Heterogeneous Agentic Memory Engine for Smartphones
von: Zhao, Xinkui, et al.
Veröffentlicht: (2025)
von: Zhao, Xinkui, et al.
Veröffentlicht: (2025)
Coordinated Power Management on Heterogeneous Systems
von: Zheng, Zhong, et al.
Veröffentlicht: (2025)
von: Zheng, Zhong, et al.
Veröffentlicht: (2025)
Accelerating Heterogeneous Tensor Parallelism via Flexible Workload Control
von: Wang, Zhigang, et al.
Veröffentlicht: (2024)
von: Wang, Zhigang, et al.
Veröffentlicht: (2024)
Accelerating Decision Diagram-based Multi-node Quantum Simulation with Ring Communication and Automatic SWAP Insertion
von: Kimura, Yusuke, et al.
Veröffentlicht: (2024)
von: Kimura, Yusuke, et al.
Veröffentlicht: (2024)
Mapping Large Memory-constrained Workflows onto Heterogeneous Platforms
von: Kulagina, Svetlana, et al.
Veröffentlicht: (2024)
von: Kulagina, Svetlana, et al.
Veröffentlicht: (2024)
Memory-aware Adaptive Scheduling of Scientific Workflows on Heterogeneous Architectures
von: Kulagina, Svetlana, et al.
Veröffentlicht: (2025)
von: Kulagina, Svetlana, et al.
Veröffentlicht: (2025)
Bridging Memory Gaps: Scaling Federated Learning for Heterogeneous Clients
von: Wu, Yebo, et al.
Veröffentlicht: (2024)
von: Wu, Yebo, et al.
Veröffentlicht: (2024)
A Unified Programming Model for Heterogeneous Computing with CPU and Accelerator Technologies
von: Xiong, Yuqing
Veröffentlicht: (2022)
von: Xiong, Yuqing
Veröffentlicht: (2022)
SPIN: Accelerating Large Language Model Inference with Heterogeneous Speculative Models
von: Chen, Fahao, et al.
Veröffentlicht: (2025)
von: Chen, Fahao, et al.
Veröffentlicht: (2025)
Accelerating Compound LLM Training Workloads with Maestro
von: Yuan, Xiulong, et al.
Veröffentlicht: (2026)
von: Yuan, Xiulong, et al.
Veröffentlicht: (2026)
PRISM: Processing-In-Memory Sparse MTTKRP for Tensor Decomposition Acceleration
von: Pacheco, Daniel, et al.
Veröffentlicht: (2026)
von: Pacheco, Daniel, et al.
Veröffentlicht: (2026)
PilotANN: Memory-Bounded GPU Acceleration for Vector Search
von: Gui, Yuntao, et al.
Veröffentlicht: (2025)
von: Gui, Yuntao, et al.
Veröffentlicht: (2025)
Addressing Variable Heterogeneity in Distributed Multimodal Training with Entrain
von: Jang, Insu, et al.
Veröffentlicht: (2026)
von: Jang, Insu, et al.
Veröffentlicht: (2026)
Heta: Distributed Training of Heterogeneous Graph Neural Networks
von: Zhong, Yuchen, et al.
Veröffentlicht: (2024)
von: Zhong, Yuchen, et al.
Veröffentlicht: (2024)
Marionette: Data Structure Description and Management for Heterogeneous Computing
von: Fernandes, Nuno dos Santos, et al.
Veröffentlicht: (2025)
von: Fernandes, Nuno dos Santos, et al.
Veröffentlicht: (2025)
Federated Learning within Global Energy Budget over Heterogeneous Edge Accelerators
von: Banerjee, Roopkatha, et al.
Veröffentlicht: (2025)
von: Banerjee, Roopkatha, et al.
Veröffentlicht: (2025)
PULSE: Accelerating Distributed Pointer-Traversals on Disaggregated Memory (Extended Version)
von: Tang, Yupeng, et al.
Veröffentlicht: (2023)
von: Tang, Yupeng, et al.
Veröffentlicht: (2023)
DistTrain: Addressing Model and Data Heterogeneity with Disaggregated Training for Multimodal Large Language Models
von: Zhang, Zili, et al.
Veröffentlicht: (2024)
von: Zhang, Zili, et al.
Veröffentlicht: (2024)
Accelerating Distributed MoE Training and Inference with Lina
von: Li, Jiamin, et al.
Veröffentlicht: (2022)
von: Li, Jiamin, et al.
Veröffentlicht: (2022)
Heterogeneity-Aware Memory Efficient Federated Learning via Progressive Layer Freezing
von: Yebo, Wu, et al.
Veröffentlicht: (2024)
von: Yebo, Wu, et al.
Veröffentlicht: (2024)
Breaking the Memory Wall for Heterogeneous Federated Learning via Progressive Training
von: Wu, Yebo, et al.
Veröffentlicht: (2024)
von: Wu, Yebo, et al.
Veröffentlicht: (2024)
Training DNN Models over Heterogeneous Clusters with Optimal Performance
von: Nie, Chengyi, et al.
Veröffentlicht: (2024)
von: Nie, Chengyi, et al.
Veröffentlicht: (2024)
Cephalo: Harnessing Heterogeneous GPU Clusters for Training Transformer Models
von: Guo, Runsheng Benson, et al.
Veröffentlicht: (2024)
von: Guo, Runsheng Benson, et al.
Veröffentlicht: (2024)
HARP: Orchestrating Automated Parallel Training on Heterogeneous GPU Clusters
von: Liang, Antian, et al.
Veröffentlicht: (2025)
von: Liang, Antian, et al.
Veröffentlicht: (2025)
Zorse: Optimizing LLM Training Efficiency on Heterogeneous GPU Clusters
von: Guo, Runsheng Benson, et al.
Veröffentlicht: (2025)
von: Guo, Runsheng Benson, et al.
Veröffentlicht: (2025)
DRackSim: Simulator for Rack-scale Memory Disaggregation
von: Puri, Amit, et al.
Veröffentlicht: (2023)
von: Puri, Amit, et al.
Veröffentlicht: (2023)
SYMPHONY: Improving Memory Management for LLM Inference Workloads
von: Agarwal, Saurabh, et al.
Veröffentlicht: (2024)
von: Agarwal, Saurabh, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Low-ordered Orthogonal Voxel Finite Element with INT8 Tensor Cores for GPU-based Explicit Elastic Wave Propagation Analysis
von: Ichimura, Tsuyoshi, et al.
Veröffentlicht: (2024) -
Development of an Estimation Method for the Seismic Motion Reproducibility of a Three-dimensional Ground Structure Model by combining Surface-observed Seismic Motion and Three-dimensional Seismic Motion Analysis
von: Ichimura, Tsuyoshi, et al.
Veröffentlicht: (2024) -
Accelerating Large Language Model Training with 4D Parallelism and Memory Consumption Estimator
von: Fujii, Kazuki, et al.
Veröffentlicht: (2024) -
Jenga: Effective Memory Management for Serving LLM with Heterogeneity
von: Zhang, Chen, et al.
Veröffentlicht: (2025) -
RIMMS: Runtime Integrated Memory Management System for Heterogeneous Computing
von: Gener, Serhan, et al.
Veröffentlicht: (2025)