Chain-of-Model Learning for Language Model
Fuente:
arXiv
Saved in:
| Main Authors: | Song, Kaitao, Wang, Xiaohua, Tan, Xu, Jiang, Huiqiang, Zhang, Chengruidong, Shen, Yongliang, LU, Cen, Li, Zihao, Song, Zifan, Shan, Caihua, Wang, Yansen, Ren, Kan, Zheng, Xiaoqing, Qin, Tao, Yang, Yuqing, Li, Dongsheng, Qiu, Lili |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EEGFormer: Towards Transferable and Interpretable Large-Scale EEG Foundation Model
by: Chen, Yuqi, et al.
Published: (2024)
by: Chen, Yuqi, et al.
Published: (2024)
MTraining: Distributed Dynamic Sparse Attention for Efficient Ultra-Long Context Training
by: Li, Wenxuan, et al.
Published: (2025)
by: Li, Wenxuan, et al.
Published: (2025)
Kuramoto Oscillatory Phase Encoding: Neuro-inspired Synchronization for Improved Learning Efficiency
by: Xiao, Mingqing, et al.
Published: (2026)
by: Xiao, Mingqing, et al.
Published: (2026)
Accelerating Prefilling via Decoding-time Contribution Sparsity
by: He, Zhiyuan, et al.
Published: (2025)
by: He, Zhiyuan, et al.
Published: (2025)
LeanK: Learnable K Cache Channel Pruning for Efficient Decoding
by: Zhang, Yike, et al.
Published: (2025)
by: Zhang, Yike, et al.
Published: (2025)
Trade in Minutes! Rationality-Driven Agentic System for Quantitative Financial Trading
by: Song, Zifan, et al.
Published: (2025)
by: Song, Zifan, et al.
Published: (2025)
TaskBench: Benchmarking Large Language Models for Task Automation
by: Shen, Yongliang, et al.
Published: (2023)
by: Shen, Yongliang, et al.
Published: (2023)
SortedRL: Accelerating RL Training for LLMs through Online Length-Aware Scheduling
by: Zhang, Yiqi, et al.
Published: (2026)
by: Zhang, Yiqi, et al.
Published: (2026)
EASYTOOL: Enhancing LLM-based Agents with Concise Tool Instruction
by: Yuan, Siyu, et al.
Published: (2024)
by: Yuan, Siyu, et al.
Published: (2024)
MMInference: Accelerating Pre-filling for Long-Context VLMs via Modality-Aware Permutation Sparse Attention
by: Li, Yucheng, et al.
Published: (2025)
by: Li, Yucheng, et al.
Published: (2025)
SCBench: A KV Cache-Centric Analysis of Long-Context Methods
by: Li, Yucheng, et al.
Published: (2024)
by: Li, Yucheng, et al.
Published: (2024)
Enhancing User Engagement in Socially-Driven Dialogue through Interactive LLM Alignments
by: Wang, Jiashuo, et al.
Published: (2025)
by: Wang, Jiashuo, et al.
Published: (2025)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
by: He, Zhiyuan, et al.
Published: (2024)
by: He, Zhiyuan, et al.
Published: (2024)
Linking Process to Outcome: Conditional Reward Modeling for LLM Reasoning
by: Zhang, Zheng, et al.
Published: (2025)
by: Zhang, Zheng, et al.
Published: (2025)
Advancing Spiking Neural Networks for Sequential Modeling with Central Pattern Generators
by: Lv, Changze, et al.
Published: (2024)
by: Lv, Changze, et al.
Published: (2024)
ContiFormer: Continuous-Time Transformer for Irregular Time Series Modeling
by: Chen, Yuqi, et al.
Published: (2024)
by: Chen, Yuqi, et al.
Published: (2024)
MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention
by: Jiang, Huiqiang, et al.
Published: (2024)
by: Jiang, Huiqiang, et al.
Published: (2024)
LongLLMLingua: Accelerating and Enhancing LLMs in Long Context Scenarios via Prompt Compression
by: Jiang, Huiqiang, et al.
Published: (2023)
by: Jiang, Huiqiang, et al.
Published: (2023)
Mitigate Position Bias in Large Language Models via Scaling a Single Dimension
by: Yu, Yijiong, et al.
Published: (2024)
by: Yu, Yijiong, et al.
Published: (2024)
Efficient and Effective Time-Series Forecasting with Spiking Neural Networks
by: Lv, Changze, et al.
Published: (2024)
by: Lv, Changze, et al.
Published: (2024)
Automated Contrastive Learning Strategy Search for Time Series
by: Jing, Baoyu, et al.
Published: (2024)
by: Jing, Baoyu, et al.
Published: (2024)
Translating Mental Imaginations into Characters with Codebooks and Dynamics-Enhanced Decoding
by: Li, Jingyuan, et al.
Published: (2024)
by: Li, Jingyuan, et al.
Published: (2024)
Improving Large Language Models in Event Relation Logical Prediction
by: Chen, Meiqi, et al.
Published: (2023)
by: Chen, Meiqi, et al.
Published: (2023)
Can Graph Learning Improve Planning in LLM-based Agents?
by: Wu, Xixi, et al.
Published: (2024)
by: Wu, Xixi, et al.
Published: (2024)
NeuroLM: A Universal Multi-task Foundation Model for Bridging the Gap between Language and EEG Signals
by: Jiang, Wei-Bang, et al.
Published: (2024)
by: Jiang, Wei-Bang, et al.
Published: (2024)
EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms
by: Yuan, Siyu, et al.
Published: (2024)
by: Yuan, Siyu, et al.
Published: (2024)
LSPT: Long-term Spatial Prompt Tuning for Visual Representation Learning
by: Mo, Shentong, et al.
Published: (2024)
by: Mo, Shentong, et al.
Published: (2024)
A Large-scale Medical Visual Task Adaptation Benchmark
by: Mo, Shentong, et al.
Published: (2024)
by: Mo, Shentong, et al.
Published: (2024)
Parrot: Efficient Serving of LLM-based Applications with Semantic Variable
by: Lin, Chaofan, et al.
Published: (2024)
by: Lin, Chaofan, et al.
Published: (2024)
Region-Adaptive Sampling for Diffusion Transformers
by: Liu, Ziming, et al.
Published: (2025)
by: Liu, Ziming, et al.
Published: (2025)
Toward Relative Positional Encoding in Spiking Transformers
by: Lv, Changze, et al.
Published: (2025)
by: Lv, Changze, et al.
Published: (2025)
SecurityLingua: Efficient Defense of LLM Jailbreak Attacks via Security-Aware Prompt Compression
by: Li, Yucheng, et al.
Published: (2025)
by: Li, Yucheng, et al.
Published: (2025)
EEGChaT: A Transformer-Based Modular Channel Selector for SEEG Analysis
by: Wang, Chen, et al.
Published: (2025)
by: Wang, Chen, et al.
Published: (2025)
MLCopilot: Unleashing the Power of Large Language Models in Solving Machine Learning Tasks
by: Zhang, Lei, et al.
Published: (2023)
by: Zhang, Lei, et al.
Published: (2023)
Omni-DNA: A Unified Genomic Foundation Model for Cross-Modal and Multi-Task Learning
by: Li, Zehui, et al.
Published: (2025)
by: Li, Zehui, et al.
Published: (2025)
Revisiting the Graph Reasoning Ability of Large Language Models: Case Studies in Translation, Connectivity and Shortest Path
by: Dai, Xinnan, et al.
Published: (2024)
by: Dai, Xinnan, et al.
Published: (2024)
P‐3.9: The Influence of Parallax and Shape Type Factors on the Perception of AR Equipment in Dark Environment
by: Huiqiang Xia, et al.
Published: (2024)
by: Huiqiang Xia, et al.
Published: (2024)
Resurrecting Label Propagation for Graphs with Heterophily and Label Noise
by: Cheng, Yao, et al.
Published: (2023)
by: Cheng, Yao, et al.
Published: (2023)
Dynamic Degradation Decomposition Network for All-in-One Image Restoration
by: Wang, Huiqiang, et al.
Published: (2025)
by: Wang, Huiqiang, et al.
Published: (2025)
Towards Graph Foundation Models: Training on Knowledge Graphs Enables Transferability to General Graphs
by: Wang, Kai, et al.
Published: (2024)
by: Wang, Kai, et al.
Published: (2024)
Similar Items
-
EEGFormer: Towards Transferable and Interpretable Large-Scale EEG Foundation Model
by: Chen, Yuqi, et al.
Published: (2024) -
MTraining: Distributed Dynamic Sparse Attention for Efficient Ultra-Long Context Training
by: Li, Wenxuan, et al.
Published: (2025) -
Kuramoto Oscillatory Phase Encoding: Neuro-inspired Synchronization for Improved Learning Efficiency
by: Xiao, Mingqing, et al.
Published: (2026) -
Accelerating Prefilling via Decoding-time Contribution Sparsity
by: He, Zhiyuan, et al.
Published: (2025) -
LeanK: Learnable K Cache Channel Pruning for Efficient Decoding
by: Zhang, Yike, et al.
Published: (2025)