ECCO: Evidence-Driven Causal Reasoning for Compiler Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Haolin, Huang, Lianghong, Dong, Jinyuan, Xing, Mingjie, Wu, Yanjun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AwareCompiler: Agentic Context-Aware Compiler Optimization via a Synergistic Knowledge-Data Driven Framework
par: Lin, Hongyu, et autres
Publié: (2025)
par: Lin, Hongyu, et autres
Publié: (2025)
LOOPerSet: A Large-Scale Dataset for Data-Driven Polyhedral Compiler Optimization
par: Merouani, Massinissa, et autres
Publié: (2025)
par: Merouani, Massinissa, et autres
Publié: (2025)
Behavioral Embeddings of Programs: A Quasi-Dynamic Approach for Optimization Prediction
par: Pan, Haolin, et autres
Publié: (2025)
par: Pan, Haolin, et autres
Publié: (2025)
The Next 700 ML-Enabled Compiler Optimizations
par: VenkataKeerthy, S., et autres
Publié: (2023)
par: VenkataKeerthy, S., et autres
Publié: (2023)
Worst-Case Convergence Time of ML Algorithms via Extreme Value Theory
par: Tizpaz-Niari, Saeid, et autres
Publié: (2024)
par: Tizpaz-Niari, Saeid, et autres
Publié: (2024)
AutoLALA: Automatic Loop Algebraic Locality Analysis for AI and HPC Kernels
par: Zhu, Yifan, et autres
Publié: (2026)
par: Zhu, Yifan, et autres
Publié: (2026)
Compiler-R1: Towards Agentic Compiler Auto-tuning with Reinforcement Learning
par: Pan, Haolin, et autres
Publié: (2025)
par: Pan, Haolin, et autres
Publié: (2025)
Data Efficacy for Language Model Training
par: Dai, Yalun, et autres
Publié: (2025)
par: Dai, Yalun, et autres
Publié: (2025)
Flex Attention: A Programming Model for Generating Optimized Attention Kernels
par: Dong, Juechu, et autres
Publié: (2024)
par: Dong, Juechu, et autres
Publié: (2024)
ACPO: AI-Enabled Compiler Framework
par: Ashouri, Amir H., et autres
Publié: (2023)
par: Ashouri, Amir H., et autres
Publié: (2023)
Enhancing Inference Efficiency of Large Language Models: Investigating Optimization Strategies and Architectural Innovations
par: Tyukin, Georgy
Publié: (2024)
par: Tyukin, Georgy
Publié: (2024)
LiteCoOp: Lightweight Multi-LLM Shared-Tree Reasoning for Model-Serving Compiler Optimizations
par: Tang, Annabelle Sujun, et autres
Publié: (2026)
par: Tang, Annabelle Sujun, et autres
Publié: (2026)
Library Liberation: Competitive Performance Matmul Through Compiler-composed Nanokernels
par: Thangamani, Arun, et autres
Publié: (2025)
par: Thangamani, Arun, et autres
Publié: (2025)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
par: Zheng, Wenhao, et autres
Publié: (2025)
par: Zheng, Wenhao, et autres
Publié: (2025)
Protean Compiler: An Agile Framework to Drive Fine-grain Phase Ordering
par: Ashouri, Amir H., et autres
Publié: (2026)
par: Ashouri, Amir H., et autres
Publié: (2026)
OMPILOT: Harnessing Transformer Models for Auto Parallelization to Shared Memory Computing Paradigms
par: Bhattacharjee, Arijit, et autres
Publié: (2025)
par: Bhattacharjee, Arijit, et autres
Publié: (2025)
Quamba2: A Robust and Scalable Post-training Quantization Framework for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2025)
par: Chiang, Hung-Yueh, et autres
Publié: (2025)
MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
par: Zhao, Qihao, et autres
Publié: (2024)
par: Zhao, Qihao, et autres
Publié: (2024)
LLMSYS-HPOBench: Hyperparameter Optimization Benchmark Suite for Real-World LLM Systems
par: Wu, Siyu, et autres
Publié: (2026)
par: Wu, Siyu, et autres
Publié: (2026)
RelayLLM: Efficient Reasoning via Collaborative Decoding
par: Huang, Chengsong, et autres
Publié: (2026)
par: Huang, Chengsong, et autres
Publié: (2026)
Magellan: Autonomous Discovery of Novel Compiler Optimization Heuristics with AlphaEvolve
par: Chen, Hongzheng, et autres
Publié: (2026)
par: Chen, Hongzheng, et autres
Publié: (2026)
Throughput Optimization as a Strategic Lever in Large-Scale AI Systems: Evidence from Dataloader and Memory Profiling Innovations
par: Jha, Mayank
Publié: (2026)
par: Jha, Mayank
Publié: (2026)
REAM: Merging Improves Pruning of Experts in LLMs
par: Jha, Saurav, et autres
Publié: (2026)
par: Jha, Saurav, et autres
Publié: (2026)
Energy-Aware LLMs: A step towards sustainable AI for downstream applications
par: Tran, Nguyen Phuc, et autres
Publié: (2025)
par: Tran, Nguyen Phuc, et autres
Publié: (2025)
QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving
par: Lin, Yujun, et autres
Publié: (2024)
par: Lin, Yujun, et autres
Publié: (2024)
QJL: 1-Bit Quantized JL Transform for KV Cache Quantization with Zero Overhead
par: Zandieh, Amir, et autres
Publié: (2024)
par: Zandieh, Amir, et autres
Publié: (2024)
Evaluating the Efficacy of Foundational Models: Advancing Benchmarking Practices to Enhance Fine-Tuning Decision-Making
par: Amujo, Oluyemi Enoch, et autres
Publié: (2024)
par: Amujo, Oluyemi Enoch, et autres
Publié: (2024)
Bench360: Benchmarking Local LLM Inference from 360 Degrees
par: Stuhlmann, Linus, et autres
Publié: (2025)
par: Stuhlmann, Linus, et autres
Publié: (2025)
Morpheme Boundary Detection & Grammatical Feature Prediction for Gujarati : Dataset & Model
par: Baxi, Jatayu, et autres
Publié: (2021)
par: Baxi, Jatayu, et autres
Publié: (2021)
An energy-based comparative analysis of common approaches to text classification in the Legal domain
par: Gultekin, Sinan, et autres
Publié: (2023)
par: Gultekin, Sinan, et autres
Publié: (2023)
OptiSeq: Ordering Examples On-The-Fly for In-Context Learning
par: Bhope, Rahul Atul, et autres
Publié: (2025)
par: Bhope, Rahul Atul, et autres
Publié: (2025)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
par: Israel, Daniel, et autres
Publié: (2025)
par: Israel, Daniel, et autres
Publié: (2025)
Model Compression and Efficient Inference for Large Language Models: A Survey
par: Wang, Wenxiao, et autres
Publié: (2024)
par: Wang, Wenxiao, et autres
Publié: (2024)
CDS4RAG: Cyclic Dual-Sequential Hyperparameter Optimization for RAG
par: Chen, Pengzhou, et autres
Publié: (2026)
par: Chen, Pengzhou, et autres
Publié: (2026)
VecTrans: Enhancing Compiler Auto-Vectorization through LLM-Assisted Code Transformations
par: Zheng, Zhongchun, et autres
Publié: (2025)
par: Zheng, Zhongchun, et autres
Publié: (2025)
Evaluating Compiler Optimization Impacts on zkVM Performance
par: Gassmann, Thomas, et autres
Publié: (2025)
par: Gassmann, Thomas, et autres
Publié: (2025)
PassNet: Scaling Large Language Models for Graph Compiler Pass Generation
par: Liu, Yiqun, et autres
Publié: (2026)
par: Liu, Yiqun, et autres
Publié: (2026)
Optimization of Armv9 architecture general large language model inference performance based on Llama.cpp
par: Chen, Longhao, et autres
Publié: (2024)
par: Chen, Longhao, et autres
Publié: (2024)
DaCe AD: Unifying High-Performance Automatic Differentiation for Machine Learning and Scientific Computing
par: Boudaoud, Afif, et autres
Publié: (2025)
par: Boudaoud, Afif, et autres
Publié: (2025)
Integration of a systolic array based hardware accelerator into a DNN operator auto-tuning framework
par: Peccia, F. N., et autres
Publié: (2022)
par: Peccia, F. N., et autres
Publié: (2022)
Documents similaires
-
AwareCompiler: Agentic Context-Aware Compiler Optimization via a Synergistic Knowledge-Data Driven Framework
par: Lin, Hongyu, et autres
Publié: (2025) -
LOOPerSet: A Large-Scale Dataset for Data-Driven Polyhedral Compiler Optimization
par: Merouani, Massinissa, et autres
Publié: (2025) -
Behavioral Embeddings of Programs: A Quasi-Dynamic Approach for Optimization Prediction
par: Pan, Haolin, et autres
Publié: (2025) -
The Next 700 ML-Enabled Compiler Optimizations
par: VenkataKeerthy, S., et autres
Publié: (2023) -
Worst-Case Convergence Time of ML Algorithms via Extreme Value Theory
par: Tizpaz-Niari, Saeid, et autres
Publié: (2024)