When Servers Meet Species: A Fab-to-Grave Lens on Computing's Biodiversity Impact
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Tianyao, Kumar, Ritbik, Hua, Inez, Ding, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Not All Water Consumption Is Equal: A Water Stress Weighted Metric for Sustainable Computing
par: Wu, Yanran, et autres
Publié: (2025)
par: Wu, Yanran, et autres
Publié: (2025)
GreenLLM: Disaggregating Large Language Model Serving on Heterogeneous GPUs for Lower Carbon Emissions
par: Shi, Tianyao, et autres
Publié: (2024)
par: Shi, Tianyao, et autres
Publié: (2024)
Cache Your Prompt When It's Green: Carbon-Aware Caching for Large Language Model Serving
par: Tian, Yuyang, et autres
Publié: (2025)
par: Tian, Yuyang, et autres
Publié: (2025)
Systematic Characterization of LLM Quantization: A Performance, Energy, and Quality Perspective
par: Shi, Tianyao, et autres
Publié: (2025)
par: Shi, Tianyao, et autres
Publié: (2025)
Revisiting Computational Storage for Data Integrity and Security
par: Shi, Chao, et autres
Publié: (2025)
par: Shi, Chao, et autres
Publié: (2025)
CCSS: Hardware-Accelerated RTL Simulation with Fast Combinational Logic Computing and Sequential Logic Synchronization
par: Feng, Weigang, et autres
Publié: (2025)
par: Feng, Weigang, et autres
Publié: (2025)
Memory-Centric Computing: Solving Computing's Memory Problem
par: Mutlu, Onur, et autres
Publié: (2025)
par: Mutlu, Onur, et autres
Publié: (2025)
Towards Compute-Aware In-Switch Computing for LLMs Tensor-Parallelism on Multi-GPU Systems
par: Zhang, Chen, et autres
Publié: (2026)
par: Zhang, Chen, et autres
Publié: (2026)
Optimizing Task Scheduling in Fog Computing with Deadline Awareness
par: Sirjani, Mohammad Sadegh, et autres
Publié: (2025)
par: Sirjani, Mohammad Sadegh, et autres
Publié: (2025)
Memory-Centric Computing: Recent Advances in Processing-in-DRAM
par: Mutlu, Onur, et autres
Publié: (2024)
par: Mutlu, Onur, et autres
Publié: (2024)
Optimizing Distributed ML Communication with Fused Computation-Collective Operations
par: Punniyamurthy, Kishore, et autres
Publié: (2023)
par: Punniyamurthy, Kishore, et autres
Publié: (2023)
Optimizing ML Concurrent Computation and Communication with GPU DMA Engines
par: Agrawal, Anirudha, et autres
Publié: (2024)
par: Agrawal, Anirudha, et autres
Publié: (2024)
Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs
par: Zhang, Qijun, et autres
Publié: (2026)
par: Zhang, Qijun, et autres
Publié: (2026)
Knowledge-Guided Attention-Inspired Learning for Task Offloading in Vehicle Edge Computing
par: Ma, Ke, et autres
Publié: (2025)
par: Ma, Ke, et autres
Publié: (2025)
BlockAMC: Scalable In-Memory Analog Matrix Computing for Solving Linear Systems
par: Pan, Lunshuai, et autres
Publié: (2024)
par: Pan, Lunshuai, et autres
Publié: (2024)
Deep Learning and Machine Learning with GPGPU and CUDA: Unlocking the Power of Parallel Computing
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
How Fast Can Graph Computations Go on Fine-grained Parallel Architectures
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
UniFormer: Unified and Efficient Transformer for Reasoning Across General and Custom Computing
par: Ran, Zhuoheng, et autres
Publié: (2025)
par: Ran, Zhuoheng, et autres
Publié: (2025)
RapidOMS: FPGA-based Open Modification Spectral Library Searching with HD Computing
par: Pinge, Sumukh, et autres
Publié: (2024)
par: Pinge, Sumukh, et autres
Publié: (2024)
FpgaHub: Fpga-centric Hyper-heterogeneous Computing Platform for Big Data Analytics
par: Wang, Zeke, et autres
Publié: (2025)
par: Wang, Zeke, et autres
Publié: (2025)
PULSAR: Simultaneous Many-Row Activation for Reliable and High-Performance Computing in Off-the-Shelf DRAM Chips
par: Yuksel, Ismail Emir, et autres
Publié: (2023)
par: Yuksel, Ismail Emir, et autres
Publié: (2023)
Next-generation Probabilistic Computing Hardware with 3D MOSAICs, Illusion Scale-up, and Co-design
par: Srimani, Tathagata, et autres
Publié: (2024)
par: Srimani, Tathagata, et autres
Publié: (2024)
Conduit: Programmer-Transparent Near-Data Processing Using Multiple Compute-Capable Resources in Solid State Drives
par: Nadig, Rakesh, et autres
Publié: (2026)
par: Nadig, Rakesh, et autres
Publié: (2026)
WWW: What, When, Where to Compute-in-Memory
par: Sharma, Tanvi, et autres
Publié: (2023)
par: Sharma, Tanvi, et autres
Publié: (2023)
Torrent: A Distributed DMA for Efficient and Flexible Point-to-Multipoint Data Movement
par: Deng, Yunhao, et autres
Publié: (2025)
par: Deng, Yunhao, et autres
Publié: (2025)
XDMA: A Distributed, Extensible DMA Architecture for Layout-Flexible Data Movements in Heterogeneous Multi-Accelerator SoCs
par: Kong, Fanchen, et autres
Publié: (2025)
par: Kong, Fanchen, et autres
Publié: (2025)
EDEA: Efficient Dual-Engine Accelerator for Depthwise Separable Convolution with Direct Data Transfer
par: Chen, Yi, et autres
Publié: (2025)
par: Chen, Yi, et autres
Publié: (2025)
FlexVector: A SpMM Vector Processor with Flexible VRF for GCNs on Varying-Sparsity Graphs
par: Li, Bohan, et autres
Publié: (2026)
par: Li, Bohan, et autres
Publié: (2026)
Data-aware Dynamic Execution of Irregular Workloads on Heterogeneous Systems
par: Bai, Zhenyu, et autres
Publié: (2025)
par: Bai, Zhenyu, et autres
Publié: (2025)
MLDSE: Scaling Design Space Exploration Infrastructure for Multi-Level Hardware
par: Qu, Huanyu, et autres
Publié: (2025)
par: Qu, Huanyu, et autres
Publié: (2025)
CMDS: Cross-layer Dataflow Optimization for DNN Accelerators Exploiting Multi-bank Memories
par: Shi, Man, et autres
Publié: (2024)
par: Shi, Man, et autres
Publié: (2024)
Exploring energy consumption of AI frameworks on a 64-core RV64 Server CPU
par: Malenza, Giulio, et autres
Publié: (2025)
par: Malenza, Giulio, et autres
Publié: (2025)
Pooling Engram Conditional Memory in Large Language Models using CXL
par: Ma, Ruiyang, et autres
Publié: (2026)
par: Ma, Ruiyang, et autres
Publié: (2026)
Adaptive Multi-Objective Tiered Storage Configuration for KV Cache in LLM Service
par: Zheng, Xianzhe, et autres
Publié: (2026)
par: Zheng, Xianzhe, et autres
Publié: (2026)
TT-Edge: A Hardware-Software Co-Design for Energy-Efficient Tensor-Train Decomposition on Edge AI
par: Kwak, Hyunseok, et autres
Publié: (2025)
par: Kwak, Hyunseok, et autres
Publié: (2025)
The DEEP-ER project: I/O and resiliency extensions for the Cluster-Booster architecture
par: Kreuzer, Anke, et autres
Publié: (2019)
par: Kreuzer, Anke, et autres
Publié: (2019)
An Evaluation and Comparison of GPU Hardware and Solver Libraries for Accelerating the OPM Flow Reservoir Simulator
par: Qiu, Tong Dong, et autres
Publié: (2023)
par: Qiu, Tong Dong, et autres
Publié: (2023)
SLIM: A Heterogeneous Accelerator for Edge Inference of Sparse Large Language Model via Adaptive Thresholding
par: Xu, Weihong, et autres
Publié: (2025)
par: Xu, Weihong, et autres
Publié: (2025)
COMET: A Framework for Modeling Compound Operation Dataflows with Explicit Collectives
par: Negi, Shubham, et autres
Publié: (2025)
par: Negi, Shubham, et autres
Publié: (2025)
MVDRAM: Enabling GeMV Execution in Unmodified DRAM for Low-Bit LLM Acceleration
par: Kubo, Tatsuya, et autres
Publié: (2025)
par: Kubo, Tatsuya, et autres
Publié: (2025)
Documents similaires
-
Not All Water Consumption Is Equal: A Water Stress Weighted Metric for Sustainable Computing
par: Wu, Yanran, et autres
Publié: (2025) -
GreenLLM: Disaggregating Large Language Model Serving on Heterogeneous GPUs for Lower Carbon Emissions
par: Shi, Tianyao, et autres
Publié: (2024) -
Cache Your Prompt When It's Green: Carbon-Aware Caching for Large Language Model Serving
par: Tian, Yuyang, et autres
Publié: (2025) -
Systematic Characterization of LLM Quantization: A Performance, Energy, and Quality Perspective
par: Shi, Tianyao, et autres
Publié: (2025) -
Revisiting Computational Storage for Data Integrity and Security
par: Shi, Chao, et autres
Publié: (2025)