KCM: KAN-Based Collaboration Models Enhance Pretrained Large Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dai, Guangyu, Tang, Siliang, Zhuang, Yueting |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Large Models with Small models: Lower Costs and Better Performance
par: Chen, Dong, et autres
Publié: (2024)
par: Chen, Dong, et autres
Publié: (2024)
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
par: Dai, Guangyu, et autres
Publié: (2025)
par: Dai, Guangyu, et autres
Publié: (2025)
HiPPO-KAN: Efficient KAN Model for Time Series Analysis
par: Lee, SangJong, et autres
Publié: (2024)
par: Lee, SangJong, et autres
Publié: (2024)
STEP: Enhancing Video-LLMs' Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
par: Qiu, Haiyi, et autres
Publié: (2024)
par: Qiu, Haiyi, et autres
Publié: (2024)
Model Comparisons: XNet Outperforms KAN
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
Beyond Tree Models: A Hybrid Model of KAN and gMLP for Large-Scale Financial Tabular Data
par: Zhang, Mingming, et autres
Publié: (2024)
par: Zhang, Mingming, et autres
Publié: (2024)
Enhancing Multilingual LLM Pretraining with Model-Based Data Selection
par: Messmer, Bettina, et autres
Publié: (2025)
par: Messmer, Bettina, et autres
Publié: (2025)
Benchmarking Optimizers for Large Language Model Pretraining
par: Semenov, Andrei, et autres
Publié: (2025)
par: Semenov, Andrei, et autres
Publié: (2025)
TPLLM: A Traffic Prediction Framework Based on Pretrained Large Language Models
par: Ren, Yilong, et autres
Publié: (2024)
par: Ren, Yilong, et autres
Publié: (2024)
From KAN to GR-KAN: Advancing Speech Enhancement with KAN-Based Methodology
par: Li, Haoyang, et autres
Publié: (2024)
par: Li, Haoyang, et autres
Publié: (2024)
KAN KAN Buff Signed Graph Neural Networks?
par: Shebaro, Muhieddine, et autres
Publié: (2025)
par: Shebaro, Muhieddine, et autres
Publié: (2025)
CORE: Code-based Inverse Self-Training Framework with Graph Expansion for Virtual Agents
par: Wang, Keyu, et autres
Publié: (2026)
par: Wang, Keyu, et autres
Publié: (2026)
KAN based Autoencoders for Factor Models
par: Wang, Tianqi, et autres
Publié: (2024)
par: Wang, Tianqi, et autres
Publié: (2024)
GraphCLIP: Enhancing Transferability in Graph Foundation Models for Text-Attributed Graphs
par: Zhu, Yun, et autres
Publié: (2024)
par: Zhu, Yun, et autres
Publié: (2024)
LUT-KAN: Segment-wise LUT Quantization for Fast KAN Inference
par: Kuznetsov, Oleksandr
Publié: (2026)
par: Kuznetsov, Oleksandr
Publié: (2026)
Dynamic Loss-Based Sample Reweighting for Improved Large Language Model Pretraining
par: Sow, Daouda, et autres
Publié: (2025)
par: Sow, Daouda, et autres
Publié: (2025)
Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models
par: Tang, Yuanbo, et autres
Publié: (2025)
par: Tang, Yuanbo, et autres
Publié: (2025)
SurvKAN: A Fully Parametric Survival Model Based on Kolmogorov-Arnold Networks
par: Mastroleo, Marina, et autres
Publié: (2026)
par: Mastroleo, Marina, et autres
Publié: (2026)
DAE-KAN: A Kolmogorov-Arnold Network Model for High-Index Differential-Algebraic Equations
par: Luo, Kai, et autres
Publié: (2025)
par: Luo, Kai, et autres
Publié: (2025)
GraphControl: Adding Conditional Control to Universal Graph Pre-trained Models for Graph Domain Transfer Learning
par: Zhu, Yun, et autres
Publié: (2023)
par: Zhu, Yun, et autres
Publié: (2023)
Enhancing Neural Function Approximation: The XNet Outperforming KAN
par: Li, Xin, et autres
Publié: (2025)
par: Li, Xin, et autres
Publié: (2025)
AmorLIP: Efficient Language-Image Pretraining via Amortization
par: Sun, Haotian, et autres
Publié: (2025)
par: Sun, Haotian, et autres
Publié: (2025)
AdaGC: Improving Training Stability for Large Language Model Pretraining
par: Wang, Guoxia, et autres
Publié: (2025)
par: Wang, Guoxia, et autres
Publié: (2025)
Pretraining Large Language Models with NVFP4
par: NVIDIA, et autres
Publié: (2025)
par: NVIDIA, et autres
Publié: (2025)
RecBase: Generative Foundation Model Pretraining for Zero-Shot Recommendation
par: Zhou, Sashuai, et autres
Publié: (2025)
par: Zhou, Sashuai, et autres
Publié: (2025)
Enhancing Post-Training Quantization via Future Activation Awareness
par: Lv, Zheqi, et autres
Publié: (2026)
par: Lv, Zheqi, et autres
Publié: (2026)
2.5 Years in Class: A Multimodal Textbook for Vision-Language Pretraining
par: Zhang, Wenqi, et autres
Publié: (2025)
par: Zhang, Wenqi, et autres
Publié: (2025)
A Structured Nonparametric Framework for Nonlinear Accelerated Failure Time Models (KAN-AFT)
par: Jose, Mebin, et autres
Publié: (2025)
par: Jose, Mebin, et autres
Publié: (2025)
Magnitude Pruning of Large Pretrained Transformer Models with a Mixture Gaussian Prior
par: Zhang, Mingxuan, et autres
Publié: (2024)
par: Zhang, Mingxuan, et autres
Publié: (2024)
Large Cognition Model: Towards Pretrained EEG Foundation Model
par: Chen, Chi-Sheng, et autres
Publié: (2025)
par: Chen, Chi-Sheng, et autres
Publié: (2025)
Understanding and Enhancing Mask-Based Pretraining towards Universal Representations
par: Dong, Mingze, et autres
Publié: (2025)
par: Dong, Mingze, et autres
Publié: (2025)
Strong Teacher Not Needed? On Distillation in LLM Pretraining
par: Lu, Taiming, et autres
Publié: (2026)
par: Lu, Taiming, et autres
Publié: (2026)
EFKAN: A KAN-Integrated Neural Operator For Efficient Magnetotelluric Forward Modeling
par: Wang, Feng, et autres
Publié: (2025)
par: Wang, Feng, et autres
Publié: (2025)
Exploration-Driven Optimization for Test-Time Large Language Model Reasoning
par: Li, Changhao, et autres
Publié: (2026)
par: Li, Changhao, et autres
Publié: (2026)
Boosting Statistic Learning with Synthetic Data from Pretrained Large Models
par: Jiang, Jialong, et autres
Publié: (2025)
par: Jiang, Jialong, et autres
Publié: (2025)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
par: Ruis, Laura, et autres
Publié: (2024)
par: Ruis, Laura, et autres
Publié: (2024)
Physics Informed Kolmogorov-Arnold Neural Networks for Dynamical Analysis via Efficent-KAN and WAV-KAN
par: Patra, Subhajit, et autres
Publié: (2024)
par: Patra, Subhajit, et autres
Publié: (2024)
Particle Dynamics for Latent-Variable Energy-Based Models
par: Tang, Shiqin, et autres
Publié: (2025)
par: Tang, Shiqin, et autres
Publié: (2025)
Enhancing Pretrained Model-based Continual Representation Learning via Guided Random Projection
par: Li, Ruilin, et autres
Publié: (2026)
par: Li, Ruilin, et autres
Publié: (2026)
Collaborative Learning of On-Device Small Model and Cloud-Based Large Model: Advances and Future Directions
par: Niu, Chaoyue, et autres
Publié: (2025)
par: Niu, Chaoyue, et autres
Publié: (2025)
Documents similaires
-
Improving Large Models with Small models: Lower Costs and Better Performance
par: Chen, Dong, et autres
Publié: (2024) -
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
par: Dai, Guangyu, et autres
Publié: (2025) -
HiPPO-KAN: Efficient KAN Model for Time Series Analysis
par: Lee, SangJong, et autres
Publié: (2024) -
STEP: Enhancing Video-LLMs' Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
par: Qiu, Haiyi, et autres
Publié: (2024) -
Model Comparisons: XNet Outperforms KAN
par: Li, Xin, et autres
Publié: (2024)