Enregistré dans:
| Auteurs principaux: | Lansiaux, Edouard, Azzouz, Ramy, Chazard, Emmanuel, Vromant, Amélie, Wiel, Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2507.01080 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SwiftEmbed: Ultra-Fast Text Embeddings via Static Token Lookup for Real-Time Applications
par: Lansiaux, Edouard, et autres
Publié: (2025)
par: Lansiaux, Edouard, et autres
Publié: (2025)
Emergency Department Patient Flow Optimization with an Alternative Care Threshold Policy
par: Baniasadi, Sahba, et autres
Publié: (2026)
par: Baniasadi, Sahba, et autres
Publié: (2026)
Zero-Knowledge Federated Learning with Lattice-Based Hybrid Encryption for Quantum-Resilient Medical AI
par: Lansiaux, Edouard
Publié: (2026)
par: Lansiaux, Edouard
Publié: (2026)
Building an Accelerated OpenFOAM Proof-of-Concept Application using Modern C++
par: Malenza, Giulio, et autres
Publié: (2025)
par: Malenza, Giulio, et autres
Publié: (2025)
Artificial Intelligence and its Impact on Academic Performance of students with Disabilities in Nasarawa State University, Keffi
par: Osita, Emmanuel Izuchukwu, et autres
Publié: (2026)
par: Osita, Emmanuel Izuchukwu, et autres
Publié: (2026)
Impact of AI-Triage on Radiologist Report Turnaround Time: Real-World Time-Savings and Insights from Model Predictions
par: Thompson, Yee Lam Elim, et autres
Publié: (2025)
par: Thompson, Yee Lam Elim, et autres
Publié: (2025)
Understanding and Benchmarking Artificial Intelligence: OpenAI's o3 Is Not AGI
par: Pfister, Rolf, et autres
Publié: (2025)
par: Pfister, Rolf, et autres
Publié: (2025)
Impact of Data-Oriented and Object-Oriented Design on Performance and Cache Utilization with Artificial Intelligence Algorithms in Multi-Threaded CPUs
par: Arantes, Gabriel M., et autres
Publié: (2025)
par: Arantes, Gabriel M., et autres
Publié: (2025)
Support Systems of Clinical Decisions in the Triage of the Emergency Department Using Artificial Intelligence: The Efficiency to Support Triage
par: Eleni Karlafti
Publié: (2023)
par: Eleni Karlafti
Publié: (2023)
OrthoAI v2: From Single-Agent Segmentation to Dual-Agent Treatment Planning for Clear Aligners
par: Edouard, Lansiaux, et autres
Publié: (2026)
par: Edouard, Lansiaux, et autres
Publié: (2026)
Achieving Consistent and Comparable CPU Evaluation
par: Wang, Chenxi, et autres
Publié: (2024)
par: Wang, Chenxi, et autres
Publié: (2024)
GreenLLM: SLO-Aware Dynamic Frequency Scaling for Energy-Efficient LLM Serving
par: Liu, Qunyou, et autres
Publié: (2025)
par: Liu, Qunyou, et autres
Publié: (2025)
Characterizing WebGPU Dispatch Overhead for LLM Inference Across Four GPU Vendors, Three Backends, and Three Browsers
par: Maczan, Jędrzej
Publié: (2026)
par: Maczan, Jędrzej
Publié: (2026)
msf-CNN: Patch-based Multi-Stage Fusion with Convolutional Neural Networks for TinyML
par: Huang, Zhaolan, et autres
Publié: (2025)
par: Huang, Zhaolan, et autres
Publié: (2025)
COMPASS: A Unified Decision-Intelligence System for Navigating Performance Trade-off in HPC
par: Lahiry, Ankur, et autres
Publié: (2026)
par: Lahiry, Ankur, et autres
Publié: (2026)
Statistical Modeling and Uncertainty Estimation of LLM Inference Systems
par: Ray, Kaustabha, et autres
Publié: (2025)
par: Ray, Kaustabha, et autres
Publié: (2025)
BurstGPT: A Real-world Workload Dataset to Optimize LLM Serving Systems
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
High-Performance Portable GPU Primitives for Arbitrary Types and Operators in Julia
par: Pilliat, Emmanuel
Publié: (2026)
par: Pilliat, Emmanuel
Publié: (2026)
Characterize LSM-tree Compaction Performance via On-Device LLM Inference
par: Ding, Jiabiao, et autres
Publié: (2026)
par: Ding, Jiabiao, et autres
Publié: (2026)
Towards Computational Performance Engineering for Unsupervised Concept Drift Detection -- Complexities, Benchmarking, Performance Analysis
par: Werner, Elias, et autres
Publié: (2023)
par: Werner, Elias, et autres
Publié: (2023)
SparseInfer: Training-free Prediction of Activation Sparsity for Fast LLM Inference
par: Shin, Jiho, et autres
Publié: (2024)
par: Shin, Jiho, et autres
Publié: (2024)
SparseX: Efficient Segment-Level KV Cache Sharing for Interleaved LLM Serving
par: Zhang, Quqing, et autres
Publié: (2026)
par: Zhang, Quqing, et autres
Publié: (2026)
Architectural Trade-offs in the Energy-Efficient Era: A Comparative Study of power-capping NVIDIA H100 and H200
par: Ujeniya, Aditya, et autres
Publié: (2026)
par: Ujeniya, Aditya, et autres
Publié: (2026)
A Tale of Three Location Trackers: AirTag, SmartTag, and Tile
par: Jang, HyunSeok Daniel, et autres
Publié: (2025)
par: Jang, HyunSeok Daniel, et autres
Publié: (2025)
U-TOE: Universal TinyML On-board Evaluation Toolkit for Low-Power IoT
par: Huang, Zhaolan, et autres
Publié: (2023)
par: Huang, Zhaolan, et autres
Publié: (2023)
H2EAL: Hybrid-Bonding Architecture with Hybrid Sparse Attention for Efficient Long-Context LLM Inference
par: Fu, Zizhuo, et autres
Publié: (2025)
par: Fu, Zizhuo, et autres
Publié: (2025)
Examem: Low-Overhead Memory Instrumentation for Intelligent Memory Systems
par: Poduval, Ashwin, et autres
Publié: (2024)
par: Poduval, Ashwin, et autres
Publié: (2024)
Optimas: An Intelligent Analytics-Informed Generative AI Framework for Performance Optimization
par: Zaeed, Mohammad, et autres
Publié: (2026)
par: Zaeed, Mohammad, et autres
Publié: (2026)
A Comparative Study and Implementation of Key Derivation Functions Standardized by NIST and IEEE
par: Chen, Abel C. H.
Publié: (2025)
par: Chen, Abel C. H.
Publié: (2025)
Growth performance of Trichogaster pectoralis Regan in intensively cultivated rice fields / N. Vromant
par: Vromant, N
Publié: (2001)
par: Vromant, N
Publié: (2001)
An Interpretable Latency Model for Speculative Decoding in LLM Serving
par: Kong, Linghao, et autres
Publié: (2026)
par: Kong, Linghao, et autres
Publié: (2026)
An Inquiry into Datacenter TCO for LLM Inference with FP8
par: Kim, Jiwoo, et autres
Publié: (2025)
par: Kim, Jiwoo, et autres
Publié: (2025)
Intelligent Green Efficiency for Intrusion Detection
par: Pereira, Pedro, et autres
Publié: (2024)
par: Pereira, Pedro, et autres
Publié: (2024)
When Scanners Lie: Evaluator Instability in LLM Red-Teaming
par: Erez, Lidor, et autres
Publié: (2026)
par: Erez, Lidor, et autres
Publié: (2026)
CEBench: A Benchmarking Toolkit for the Cost-Effectiveness of LLM Pipelines
par: Sun, Wenbo, et autres
Publié: (2024)
par: Sun, Wenbo, et autres
Publié: (2024)
FACT: Compositional Kernel Synthesis with a Three-Stage Agentic Workflow
par: Heidari, Sina, et autres
Publié: (2026)
par: Heidari, Sina, et autres
Publié: (2026)
SweetSpot: An Analytical Model for Predicting Energy Efficiency of LLM Inference
par: Cavagna, Hiari Pizzini, et autres
Publié: (2026)
par: Cavagna, Hiari Pizzini, et autres
Publié: (2026)
TakuNet: an Energy-Efficient CNN for Real-Time Inference on Embedded UAV systems in Emergency Response Scenarios
par: Rossi, Daniel, et autres
Publié: (2025)
par: Rossi, Daniel, et autres
Publié: (2025)
A relação entre a «performance» social e a «performance» económico-financeira
par: Daniel Taborda
Publié: (2007)
par: Daniel Taborda
Publié: (2007)
ZKProphet: Understanding Performance of Zero-Knowledge Proofs on GPUs
par: Verma, Tarunesh, et autres
Publié: (2025)
par: Verma, Tarunesh, et autres
Publié: (2025)
Documents similaires
-
SwiftEmbed: Ultra-Fast Text Embeddings via Static Token Lookup for Real-Time Applications
par: Lansiaux, Edouard, et autres
Publié: (2025) -
Emergency Department Patient Flow Optimization with an Alternative Care Threshold Policy
par: Baniasadi, Sahba, et autres
Publié: (2026) -
Zero-Knowledge Federated Learning with Lattice-Based Hybrid Encryption for Quantum-Resilient Medical AI
par: Lansiaux, Edouard
Publié: (2026) -
Building an Accelerated OpenFOAM Proof-of-Concept Application using Modern C++
par: Malenza, Giulio, et autres
Publié: (2025) -
Artificial Intelligence and its Impact on Academic Performance of students with Disabilities in Nasarawa State University, Keffi
par: Osita, Emmanuel Izuchukwu, et autres
Publié: (2026)