KCM: KAN-Based Collaboration Models Enhance Pretrained Large Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Dai, Guangyu, Tang, Siliang, Zhuang, Yueting |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Large Models with Small models: Lower Costs and Better Performance
di: Chen, Dong, et al.
Pubblicazione: (2024)
di: Chen, Dong, et al.
Pubblicazione: (2024)
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
di: Dai, Guangyu, et al.
Pubblicazione: (2025)
di: Dai, Guangyu, et al.
Pubblicazione: (2025)
HiPPO-KAN: Efficient KAN Model for Time Series Analysis
di: Lee, SangJong, et al.
Pubblicazione: (2024)
di: Lee, SangJong, et al.
Pubblicazione: (2024)
STEP: Enhancing Video-LLMs' Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
di: Qiu, Haiyi, et al.
Pubblicazione: (2024)
di: Qiu, Haiyi, et al.
Pubblicazione: (2024)
Model Comparisons: XNet Outperforms KAN
di: Li, Xin, et al.
Pubblicazione: (2024)
di: Li, Xin, et al.
Pubblicazione: (2024)
Beyond Tree Models: A Hybrid Model of KAN and gMLP for Large-Scale Financial Tabular Data
di: Zhang, Mingming, et al.
Pubblicazione: (2024)
di: Zhang, Mingming, et al.
Pubblicazione: (2024)
Enhancing Multilingual LLM Pretraining with Model-Based Data Selection
di: Messmer, Bettina, et al.
Pubblicazione: (2025)
di: Messmer, Bettina, et al.
Pubblicazione: (2025)
Benchmarking Optimizers for Large Language Model Pretraining
di: Semenov, Andrei, et al.
Pubblicazione: (2025)
di: Semenov, Andrei, et al.
Pubblicazione: (2025)
TPLLM: A Traffic Prediction Framework Based on Pretrained Large Language Models
di: Ren, Yilong, et al.
Pubblicazione: (2024)
di: Ren, Yilong, et al.
Pubblicazione: (2024)
From KAN to GR-KAN: Advancing Speech Enhancement with KAN-Based Methodology
di: Li, Haoyang, et al.
Pubblicazione: (2024)
di: Li, Haoyang, et al.
Pubblicazione: (2024)
KAN KAN Buff Signed Graph Neural Networks?
di: Shebaro, Muhieddine, et al.
Pubblicazione: (2025)
di: Shebaro, Muhieddine, et al.
Pubblicazione: (2025)
CORE: Code-based Inverse Self-Training Framework with Graph Expansion for Virtual Agents
di: Wang, Keyu, et al.
Pubblicazione: (2026)
di: Wang, Keyu, et al.
Pubblicazione: (2026)
KAN based Autoencoders for Factor Models
di: Wang, Tianqi, et al.
Pubblicazione: (2024)
di: Wang, Tianqi, et al.
Pubblicazione: (2024)
GraphCLIP: Enhancing Transferability in Graph Foundation Models for Text-Attributed Graphs
di: Zhu, Yun, et al.
Pubblicazione: (2024)
di: Zhu, Yun, et al.
Pubblicazione: (2024)
LUT-KAN: Segment-wise LUT Quantization for Fast KAN Inference
di: Kuznetsov, Oleksandr
Pubblicazione: (2026)
di: Kuznetsov, Oleksandr
Pubblicazione: (2026)
Dynamic Loss-Based Sample Reweighting for Improved Large Language Model Pretraining
di: Sow, Daouda, et al.
Pubblicazione: (2025)
di: Sow, Daouda, et al.
Pubblicazione: (2025)
Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models
di: Tang, Yuanbo, et al.
Pubblicazione: (2025)
di: Tang, Yuanbo, et al.
Pubblicazione: (2025)
SurvKAN: A Fully Parametric Survival Model Based on Kolmogorov-Arnold Networks
di: Mastroleo, Marina, et al.
Pubblicazione: (2026)
di: Mastroleo, Marina, et al.
Pubblicazione: (2026)
DAE-KAN: A Kolmogorov-Arnold Network Model for High-Index Differential-Algebraic Equations
di: Luo, Kai, et al.
Pubblicazione: (2025)
di: Luo, Kai, et al.
Pubblicazione: (2025)
GraphControl: Adding Conditional Control to Universal Graph Pre-trained Models for Graph Domain Transfer Learning
di: Zhu, Yun, et al.
Pubblicazione: (2023)
di: Zhu, Yun, et al.
Pubblicazione: (2023)
Enhancing Neural Function Approximation: The XNet Outperforming KAN
di: Li, Xin, et al.
Pubblicazione: (2025)
di: Li, Xin, et al.
Pubblicazione: (2025)
AmorLIP: Efficient Language-Image Pretraining via Amortization
di: Sun, Haotian, et al.
Pubblicazione: (2025)
di: Sun, Haotian, et al.
Pubblicazione: (2025)
AdaGC: Improving Training Stability for Large Language Model Pretraining
di: Wang, Guoxia, et al.
Pubblicazione: (2025)
di: Wang, Guoxia, et al.
Pubblicazione: (2025)
Pretraining Large Language Models with NVFP4
di: NVIDIA, et al.
Pubblicazione: (2025)
di: NVIDIA, et al.
Pubblicazione: (2025)
RecBase: Generative Foundation Model Pretraining for Zero-Shot Recommendation
di: Zhou, Sashuai, et al.
Pubblicazione: (2025)
di: Zhou, Sashuai, et al.
Pubblicazione: (2025)
Enhancing Post-Training Quantization via Future Activation Awareness
di: Lv, Zheqi, et al.
Pubblicazione: (2026)
di: Lv, Zheqi, et al.
Pubblicazione: (2026)
2.5 Years in Class: A Multimodal Textbook for Vision-Language Pretraining
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
A Structured Nonparametric Framework for Nonlinear Accelerated Failure Time Models (KAN-AFT)
di: Jose, Mebin, et al.
Pubblicazione: (2025)
di: Jose, Mebin, et al.
Pubblicazione: (2025)
Magnitude Pruning of Large Pretrained Transformer Models with a Mixture Gaussian Prior
di: Zhang, Mingxuan, et al.
Pubblicazione: (2024)
di: Zhang, Mingxuan, et al.
Pubblicazione: (2024)
Large Cognition Model: Towards Pretrained EEG Foundation Model
di: Chen, Chi-Sheng, et al.
Pubblicazione: (2025)
di: Chen, Chi-Sheng, et al.
Pubblicazione: (2025)
Understanding and Enhancing Mask-Based Pretraining towards Universal Representations
di: Dong, Mingze, et al.
Pubblicazione: (2025)
di: Dong, Mingze, et al.
Pubblicazione: (2025)
Strong Teacher Not Needed? On Distillation in LLM Pretraining
di: Lu, Taiming, et al.
Pubblicazione: (2026)
di: Lu, Taiming, et al.
Pubblicazione: (2026)
EFKAN: A KAN-Integrated Neural Operator For Efficient Magnetotelluric Forward Modeling
di: Wang, Feng, et al.
Pubblicazione: (2025)
di: Wang, Feng, et al.
Pubblicazione: (2025)
Exploration-Driven Optimization for Test-Time Large Language Model Reasoning
di: Li, Changhao, et al.
Pubblicazione: (2026)
di: Li, Changhao, et al.
Pubblicazione: (2026)
Boosting Statistic Learning with Synthetic Data from Pretrained Large Models
di: Jiang, Jialong, et al.
Pubblicazione: (2025)
di: Jiang, Jialong, et al.
Pubblicazione: (2025)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
di: Ruis, Laura, et al.
Pubblicazione: (2024)
di: Ruis, Laura, et al.
Pubblicazione: (2024)
Physics Informed Kolmogorov-Arnold Neural Networks for Dynamical Analysis via Efficent-KAN and WAV-KAN
di: Patra, Subhajit, et al.
Pubblicazione: (2024)
di: Patra, Subhajit, et al.
Pubblicazione: (2024)
Particle Dynamics for Latent-Variable Energy-Based Models
di: Tang, Shiqin, et al.
Pubblicazione: (2025)
di: Tang, Shiqin, et al.
Pubblicazione: (2025)
Enhancing Pretrained Model-based Continual Representation Learning via Guided Random Projection
di: Li, Ruilin, et al.
Pubblicazione: (2026)
di: Li, Ruilin, et al.
Pubblicazione: (2026)
Collaborative Learning of On-Device Small Model and Cloud-Based Large Model: Advances and Future Directions
di: Niu, Chaoyue, et al.
Pubblicazione: (2025)
di: Niu, Chaoyue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Improving Large Models with Small models: Lower Costs and Better Performance
di: Chen, Dong, et al.
Pubblicazione: (2024) -
GMFVAD: Using Grained Multi-modal Feature to Improve Video Anomaly Detection
di: Dai, Guangyu, et al.
Pubblicazione: (2025) -
HiPPO-KAN: Efficient KAN Model for Time Series Analysis
di: Lee, SangJong, et al.
Pubblicazione: (2024) -
STEP: Enhancing Video-LLMs' Compositional Reasoning by Spatio-Temporal Graph-guided Self-Training
di: Qiu, Haiyi, et al.
Pubblicazione: (2024) -
Model Comparisons: XNet Outperforms KAN
di: Li, Xin, et al.
Pubblicazione: (2024)