Guardado en:
| Autores principales: | Park, Jiyoung, Jang, Hankyu, Song, Changseok, Jung, Wookeun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.05145 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WebLLM: A High-Performance In-Browser LLM Inference Engine
por: Ruan, Charlie F., et al.
Publicado: (2024)
por: Ruan, Charlie F., et al.
Publicado: (2024)
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
por: Wen, Zhuofan, et al.
Publicado: (2024)
por: Wen, Zhuofan, et al.
Publicado: (2024)
TIDE: Every Layer Knows the Token Beneath the Context
por: Jaiswal, Ajay, et al.
Publicado: (2026)
por: Jaiswal, Ajay, et al.
Publicado: (2026)
SpoT-Mamba: Learning Long-Range Dependency on Spatio-Temporal Graphs with Selective State Spaces
por: Choi, Jinhyeok, et al.
Publicado: (2024)
por: Choi, Jinhyeok, et al.
Publicado: (2024)
Structural Reasoning Improves Molecular Understanding of LLM
por: Jang, Yunhui, et al.
Publicado: (2024)
por: Jang, Yunhui, et al.
Publicado: (2024)
Exploring and Improving Drafts in Blockwise Parallel Decoding
por: Kim, Taehyeon, et al.
Publicado: (2024)
por: Kim, Taehyeon, et al.
Publicado: (2024)
PRISM: Parametrically Refactoring Inference for Speculative Sampling Draft Models
por: Wang, Xuliang, et al.
Publicado: (2026)
por: Wang, Xuliang, et al.
Publicado: (2026)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
por: Oh, Hyunwoo, et al.
Publicado: (2026)
por: Oh, Hyunwoo, et al.
Publicado: (2026)
Balancing Graph Embedding Smoothness in Self-Supervised Learning via Information-Theoretic Decomposition
por: Jung, Heesoo, et al.
Publicado: (2025)
por: Jung, Heesoo, et al.
Publicado: (2025)
P-EAGLE: Parallel-Drafting EAGLE with Scalable Training
por: Hui, Mude, et al.
Publicado: (2026)
por: Hui, Mude, et al.
Publicado: (2026)
Temporal Imbalance of Positive and Negative Supervision in Class-Incremental Learning
por: Ma, Jinge, et al.
Publicado: (2026)
por: Ma, Jinge, et al.
Publicado: (2026)
KITS: Inductive Spatio-Temporal Kriging with Increment Training Strategy
por: Xu, Qianxiong, et al.
Publicado: (2023)
por: Xu, Qianxiong, et al.
Publicado: (2023)
Temporal Alignment Guidance: On-Manifold Sampling in Diffusion Models
por: Park, Youngrok, et al.
Publicado: (2025)
por: Park, Youngrok, et al.
Publicado: (2025)
Multi-LLM Adaptive Conformal Inference for Reliable LLM Responses
por: Noh, Kangjun, et al.
Publicado: (2026)
por: Noh, Kangjun, et al.
Publicado: (2026)
FlashInfer: Efficient and Customizable Attention Engine for LLM Inference Serving
por: Ye, Zihao, et al.
Publicado: (2025)
por: Ye, Zihao, et al.
Publicado: (2025)
Decocted Experience Improves Test-Time Inference in LLM Agents
por: Shen, Maohao, et al.
Publicado: (2026)
por: Shen, Maohao, et al.
Publicado: (2026)
Expanding Foundational Language Capabilities in Open-Source LLMs through a Korean Case Study
por: Lim, Junghwan, et al.
Publicado: (2025)
por: Lim, Junghwan, et al.
Publicado: (2025)
Time Series Imputation with Multivariate Radial Basis Function Neural Network
por: Jung, Chanyoung, et al.
Publicado: (2024)
por: Jung, Chanyoung, et al.
Publicado: (2024)
MicroFlow: An Efficient Rust-Based Inference Engine for TinyML
por: Carnelos, Matteo, et al.
Publicado: (2024)
por: Carnelos, Matteo, et al.
Publicado: (2024)
Improving Instruction Following in Language Models through Proxy-Based Uncertainty Estimation
por: Lee, JoonHo, et al.
Publicado: (2024)
por: Lee, JoonHo, et al.
Publicado: (2024)
Fair Class-Incremental Learning using Sample Weighting
por: Park, Jaeyoung, et al.
Publicado: (2024)
por: Park, Jaeyoung, et al.
Publicado: (2024)
Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification
por: Liang, Zhenwen, et al.
Publicado: (2024)
por: Liang, Zhenwen, et al.
Publicado: (2024)
Experiential Reflective Learning for Self-Improving LLM Agents
por: Allard, Marc-Antoine, et al.
Publicado: (2026)
por: Allard, Marc-Antoine, et al.
Publicado: (2026)
Unifying Inductive, Cross-Domain, and Multimodal Learning for Robust and Generalizable Recommendation
por: Chung, Chanyoung, et al.
Publicado: (2025)
por: Chung, Chanyoung, et al.
Publicado: (2025)
Self-Supervised Pre-Training for Precipitation Post-Processor
por: An, Sojung, et al.
Publicado: (2023)
por: An, Sojung, et al.
Publicado: (2023)
CSAttention: Centroid-Scoring Attention for Accelerating LLM Inference
por: Song, Chuxu, et al.
Publicado: (2026)
por: Song, Chuxu, et al.
Publicado: (2026)
Evaluating Temporal Plasticity in Foundation Time Series Models for Incremental Fine-tuning
por: Liu, Jia, et al.
Publicado: (2025)
por: Liu, Jia, et al.
Publicado: (2025)
Enhancing Federated Class-Incremental Learning via Spatial-Temporal Statistics Aggregation
por: Guan, Zenghao, et al.
Publicado: (2025)
por: Guan, Zenghao, et al.
Publicado: (2025)
A Slices Perspective for Incremental Nonparametric Inference in High Dimensional State Spaces
por: Shienman, Moshe, et al.
Publicado: (2024)
por: Shienman, Moshe, et al.
Publicado: (2024)
DEER: Draft with Diffusion, Verify with Autoregressive Models
por: Cheng, Zicong, et al.
Publicado: (2025)
por: Cheng, Zicong, et al.
Publicado: (2025)
Can We Rely on LLM Agents to Draft Long-Horizon Plans? Let's Take TravelPlanner as an Example
por: Chen, Yanan, et al.
Publicado: (2024)
por: Chen, Yanan, et al.
Publicado: (2024)
Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding
por: Park, Jihoon, et al.
Publicado: (2025)
por: Park, Jihoon, et al.
Publicado: (2025)
Carbon Intensity-Aware Adaptive Inference of DNNs
por: Jung, Jiwan
Publicado: (2024)
por: Jung, Jiwan
Publicado: (2024)
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
por: Zhao, Yilong, et al.
Publicado: (2025)
por: Zhao, Yilong, et al.
Publicado: (2025)
TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference
por: Dzikanyanga, Gradwell, et al.
Publicado: (2026)
por: Dzikanyanga, Gradwell, et al.
Publicado: (2026)
Generative Representation Learning on Hyper-relational Knowledge Graphs via Masked Discrete Diffusion
por: Lee, Jaejun, et al.
Publicado: (2026)
por: Lee, Jaejun, et al.
Publicado: (2026)
PAC-Bayesian Generalization Bounds for Knowledge Graph Representation Learning
por: Lee, Jaejun, et al.
Publicado: (2024)
por: Lee, Jaejun, et al.
Publicado: (2024)
Representation Learning on Hyper-Relational and Numeric Knowledge Graphs with Transformers
por: Chung, Chanyoung, et al.
Publicado: (2023)
por: Chung, Chanyoung, et al.
Publicado: (2023)
Direct Alignment of Draft Model for Speculative Decoding with Chat-Fine-Tuned LLMs
por: Goel, Raghavv, et al.
Publicado: (2024)
por: Goel, Raghavv, et al.
Publicado: (2024)
Scaling Laws Meet Model Architecture: Toward Inference-Efficient LLMs
por: Bian, Song, et al.
Publicado: (2025)
por: Bian, Song, et al.
Publicado: (2025)
Ejemplares similares
-
WebLLM: A High-Performance In-Browser LLM Inference Engine
por: Ruan, Charlie F., et al.
Publicado: (2024) -
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
por: Wen, Zhuofan, et al.
Publicado: (2024) -
TIDE: Every Layer Knows the Token Beneath the Context
por: Jaiswal, Ajay, et al.
Publicado: (2026) -
SpoT-Mamba: Learning Long-Range Dependency on Spatio-Temporal Graphs with Selective State Spaces
por: Choi, Jinhyeok, et al.
Publicado: (2024) -
Structural Reasoning Improves Molecular Understanding of LLM
por: Jang, Yunhui, et al.
Publicado: (2024)