Guardado en:
| Autores principales: | Qu, Qiuyi, Sui, Yicheng, Sun, Yufei, Chen, Rui, Zhang, Xiaofei, Zhang, Yuzhi, Wang, Haofeng, Lan, Ge |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2601.12698 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLM-Oriented Retrieval Tuner
por: Sun, Si, et al.
Publicado: (2024)
por: Sun, Si, et al.
Publicado: (2024)
Semantic Convergence: Harmonizing Recommender Systems via Two-Stage Alignment and Behavioral Semantic Tokenization
por: Li, Guanghan, et al.
Publicado: (2024)
por: Li, Guanghan, et al.
Publicado: (2024)
Transformer Based Linear Attention with Optimized GPU Kernel Implementation
por: Gerami, Armin, et al.
Publicado: (2025)
por: Gerami, Armin, et al.
Publicado: (2025)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
por: Lu, Jialin, et al.
Publicado: (2026)
por: Lu, Jialin, et al.
Publicado: (2026)
FastKernels: Benchmarking GPU Kernel Generation in Production
por: Oliaro, Gabriele, et al.
Publicado: (2026)
por: Oliaro, Gabriele, et al.
Publicado: (2026)
Insum: Sparse GPU Kernels Simplified and Optimized with Indirect Einsums
por: Won, Jaeyeon, et al.
Publicado: (2025)
por: Won, Jaeyeon, et al.
Publicado: (2025)
AgentKernelArena: Generalization-Aware Benchmarking of GPU Kernel Optimization Agents
por: Younesian, Sharareh, et al.
Publicado: (2026)
por: Younesian, Sharareh, et al.
Publicado: (2026)
Advances in Semantic Patching for HPC-oriented Refactorings with Coccinelle
por: Martone, Michele, et al.
Publicado: (2025)
por: Martone, Michele, et al.
Publicado: (2025)
RPTS: Tree-Structured Reasoning Process Scoring for Faithful Multimodal Evaluation
por: Wang, Haofeng, et al.
Publicado: (2025)
por: Wang, Haofeng, et al.
Publicado: (2025)
Skill-as-Pseudocode: Refactoring Skill Libraries to Pseudocode for LLM Agents
por: Li, Xinze, et al.
Publicado: (2026)
por: Li, Xinze, et al.
Publicado: (2026)
Equivalence Checking of ML GPU Kernels
por: Dubey, Kshitij, et al.
Publicado: (2025)
por: Dubey, Kshitij, et al.
Publicado: (2025)
Kernel-Smith: A Unified Recipe for Evolutionary Kernel Optimization
por: Du, He, et al.
Publicado: (2026)
por: Du, He, et al.
Publicado: (2026)
Astra: A Multi-Agent System for GPU Kernel Performance Optimization
por: Wei, Anjiang, et al.
Publicado: (2025)
por: Wei, Anjiang, et al.
Publicado: (2025)
AGFT: An Adaptive GPU Frequency Tuner for Real-Time LLM Inference Optimization
por: Ye, Zicong, et al.
Publicado: (2025)
por: Ye, Zicong, et al.
Publicado: (2025)
Code Generation for Cryptographic Kernels using Multi-word Modular Arithmetic on GPU
por: Zhang, Naifeng, et al.
Publicado: (2025)
por: Zhang, Naifeng, et al.
Publicado: (2025)
SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling
por: Zhang, Yansen, et al.
Publicado: (2025)
por: Zhang, Yansen, et al.
Publicado: (2025)
Unlocking Insights: Semantic Search in Jupyter Notebooks
por: Li, Lan, et al.
Publicado: (2024)
por: Li, Lan, et al.
Publicado: (2024)
Optimizing Datalog for the GPU
por: Sun, Yihao, et al.
Publicado: (2023)
por: Sun, Yihao, et al.
Publicado: (2023)
KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads
por: Guan, Yue, et al.
Publicado: (2025)
por: Guan, Yue, et al.
Publicado: (2025)
ACR: Adaptive Context Refactoring via Context Refactoring Operators for Multi-Turn Dialogue
por: Shen, Jiawei, et al.
Publicado: (2026)
por: Shen, Jiawei, et al.
Publicado: (2026)
Optimizing Instruction Synthesis: Effective Exploration of Evolutionary Space with Tree Search
por: Li, Chenglin, et al.
Publicado: (2024)
por: Li, Chenglin, et al.
Publicado: (2024)
Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory
por: Xu, Derong, et al.
Publicado: (2026)
por: Xu, Derong, et al.
Publicado: (2026)
Leveraging LLMs to Automate Energy-Aware Refactoring of Parallel Scientific Codes
por: Dearing, Matthew T., et al.
Publicado: (2025)
por: Dearing, Matthew T., et al.
Publicado: (2025)
Towards Better Multi-task Learning: A Framework for Optimizing Dataset Combinations in Large Language Models
por: Zhan, Zaifu, et al.
Publicado: (2024)
por: Zhan, Zaifu, et al.
Publicado: (2024)
ChatCFD: An LLM-Driven Agent for End-to-End CFD Automation with Structured Knowledge and Reasoning
por: Fan, E, et al.
Publicado: (2025)
por: Fan, E, et al.
Publicado: (2025)
ConfTuner: Training Large Language Models to Express Their Confidence Verbally
por: Li, Yibo, et al.
Publicado: (2025)
por: Li, Yibo, et al.
Publicado: (2025)
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2025)
por: Xi, Zhiheng, et al.
Publicado: (2025)
QiMeng-Kernel: Macro-Thinking Micro-Coding Paradigm for LLM-Based High-Performance GPU Kernel Generation
por: Zhu, Xinguo, et al.
Publicado: (2025)
por: Zhu, Xinguo, et al.
Publicado: (2025)
Mamba for Streaming ASR Combined with Unimodal Aggregation
por: Fang, Ying, et al.
Publicado: (2024)
por: Fang, Ying, et al.
Publicado: (2024)
Semantic Search Evaluation
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
Two-Stage Regularization-Based Structured Pruning for LLMs
por: Feng, Mingkuan, et al.
Publicado: (2025)
por: Feng, Mingkuan, et al.
Publicado: (2025)
Comateformer: Combined Attention Transformer for Semantic Sentence Matching
por: Li, Bo, et al.
Publicado: (2024)
por: Li, Bo, et al.
Publicado: (2024)
SeCon-RAG: A Two-Stage Semantic Filtering and Conflict-Free Framework for Trustworthy RAG
por: Si, Xiaonan, et al.
Publicado: (2025)
por: Si, Xiaonan, et al.
Publicado: (2025)
ReGAL: Refactoring Programs to Discover Generalizable Abstractions
por: Stengel-Eskin, Elias, et al.
Publicado: (2024)
por: Stengel-Eskin, Elias, et al.
Publicado: (2024)
PivotAttack: Rethinking the Search Trajectory in Hard-Label Text Attacks via Pivot Words
por: Liang, Yuzhi, et al.
Publicado: (2026)
por: Liang, Yuzhi, et al.
Publicado: (2026)
Can Knowledge Graphs Make Large Language Models More Trustworthy? An Empirical Study Over Open-ended Question Answering
por: Sui, Yuan, et al.
Publicado: (2024)
por: Sui, Yuan, et al.
Publicado: (2024)
A Two-Stage Multimodal Emotion Recognition Model Based on Graph Contrastive Learning
por: Ai, Wei, et al.
Publicado: (2024)
por: Ai, Wei, et al.
Publicado: (2024)
Plug-and-Play Training Framework for Preference Optimization
por: Ma, Jingyuan, et al.
Publicado: (2024)
por: Ma, Jingyuan, et al.
Publicado: (2024)
Nautilus: An Auto-Scheduling Tensor Compiler for Efficient Tiled GPU Kernels
por: Zhao, Yifan, et al.
Publicado: (2026)
por: Zhao, Yifan, et al.
Publicado: (2026)
Dynamic Optimizations of LLM Ensembles with Two-Stage Reinforcement Learning Agents
por: Tekin, Selim Furkan, et al.
Publicado: (2025)
por: Tekin, Selim Furkan, et al.
Publicado: (2025)
Ejemplares similares
-
LLM-Oriented Retrieval Tuner
por: Sun, Si, et al.
Publicado: (2024) -
Semantic Convergence: Harmonizing Recommender Systems via Two-Stage Alignment and Behavioral Semantic Tokenization
por: Li, Guanghan, et al.
Publicado: (2024) -
Transformer Based Linear Attention with Optimized GPU Kernel Implementation
por: Gerami, Armin, et al.
Publicado: (2025) -
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
por: Lu, Jialin, et al.
Publicado: (2026) -
FastKernels: Benchmarking GPU Kernel Generation in Production
por: Oliaro, Gabriele, et al.
Publicado: (2026)