Towards Robust Knowledge Tracing Models via k-Sparse Attention
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Shuyan, Liu, Zitao, Zhao, Xiangyu, Luo, Weiqi, Weng, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Low-Resource Knowledge Tracing Tasks by Supervised Pre-training and Importance Mechanism Fine-tuning
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024)
What Are Step-Level Reward Models Rewarding? Counterintuitive Findings from MCTS-Boosted Mathematical Reasoning
di: Ma, Yiran, et al.
Pubblicazione: (2024)
di: Ma, Yiran, et al.
Pubblicazione: (2024)
Personalized Knowledge Tracing through Student Representation Reconstruction and Class Imbalance Mitigation
di: Chen, Zhiyu, et al.
Pubblicazione: (2024)
di: Chen, Zhiyu, et al.
Pubblicazione: (2024)
A Question-centric Multi-experts Contrastive Learning Framework for Improving the Accuracy and Interpretability of Deep Sequential Knowledge Tracing Models
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024)
A Mathematical Theory of Top-$k$ Sparse Attention via Total Variation Distance
di: Tzachristas, Georgios, et al.
Pubblicazione: (2025)
di: Tzachristas, Georgios, et al.
Pubblicazione: (2025)
Domain Generalizable Knowledge Tracing via Concept Aggregation and Relation-Based Attention
di: Xie, Yuquan, et al.
Pubblicazione: (2024)
di: Xie, Yuquan, et al.
Pubblicazione: (2024)
Sparse Attention Decomposition Applied to Circuit Tracing
di: Franco, Gabriel, et al.
Pubblicazione: (2024)
di: Franco, Gabriel, et al.
Pubblicazione: (2024)
Improving Sparse Autoencoder with Dynamic Attention
di: Wang, Dongsheng, et al.
Pubblicazione: (2026)
di: Wang, Dongsheng, et al.
Pubblicazione: (2026)
Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention
di: Yuan, Jingyang, et al.
Pubblicazione: (2025)
di: Yuan, Jingyang, et al.
Pubblicazione: (2025)
NOSA: Native and Offloadable Sparse Attention
di: Huang, Yuxiang, et al.
Pubblicazione: (2025)
di: Huang, Yuxiang, et al.
Pubblicazione: (2025)
GRASP: group-Shapley feature selection for patients
di: Luo, Yuheng, et al.
Pubblicazione: (2026)
di: Luo, Yuheng, et al.
Pubblicazione: (2026)
S2O: Early Stopping for Sparse Attention via Online Permutation
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Nonlinearity, Feedback and Uniform Consistency in Causal Structural Learning
di: Wang, Shuyan
Pubblicazione: (2023)
di: Wang, Shuyan
Pubblicazione: (2023)
vAttention: Verified Sparse Attention
di: Desai, Aditya, et al.
Pubblicazione: (2025)
di: Desai, Aditya, et al.
Pubblicazione: (2025)
Intrinsically Interpretable Attention via Sparse Post-Training
di: Draye, Florent, et al.
Pubblicazione: (2025)
di: Draye, Florent, et al.
Pubblicazione: (2025)
Advancing Personalized Learning Analysis via an Innovative Domain Knowledge Informed Attention-based Knowledge Tracing Method
di: Kose, Shubham, et al.
Pubblicazione: (2025)
di: Kose, Shubham, et al.
Pubblicazione: (2025)
SparseDM: Toward Sparse Efficient Diffusion Models
di: Wang, Kafeng, et al.
Pubblicazione: (2024)
di: Wang, Kafeng, et al.
Pubblicazione: (2024)
How Sparse Attention Approximates Exact Attention? Your Attention is Naturally $n^C$-Sparse
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
Towards Robust Multi-Modal Reasoning via Model Selection
di: Liu, Xiangyan, et al.
Pubblicazione: (2023)
di: Liu, Xiangyan, et al.
Pubblicazione: (2023)
Stem: Rethinking Causal Information Flow in Sparse Attention
di: Niu, Lin, et al.
Pubblicazione: (2026)
di: Niu, Lin, et al.
Pubblicazione: (2026)
Trainable Dynamic Mask Sparse Attention
di: Shi, Jingze, et al.
Pubblicazione: (2025)
di: Shi, Jingze, et al.
Pubblicazione: (2025)
Cumulative Distribution Function based General Temporal Point Processes
di: Wang, Maolin, et al.
Pubblicazione: (2024)
di: Wang, Maolin, et al.
Pubblicazione: (2024)
FedSKD: Aggregation-free Model-heterogeneous Federated Learning via Multi-dimensional Similarity Knowledge Distillation for Medical Image Classification
di: Weng, Ziqiao, et al.
Pubblicazione: (2025)
di: Weng, Ziqiao, et al.
Pubblicazione: (2025)
Improving Robustness In Sparse Autoencoders via Masked Regularization
di: Narayanaswamy, Vivek, et al.
Pubblicazione: (2026)
di: Narayanaswamy, Vivek, et al.
Pubblicazione: (2026)
Robust and Efficient Zeroth-Order LLM Fine-Tuning via Adaptive Bayesian Subspace Optimizer
di: Feng, Jian, et al.
Pubblicazione: (2026)
di: Feng, Jian, et al.
Pubblicazione: (2026)
SeerAttention-R: Sparse Attention Adaptation for Long Reasoning
di: Gao, Yizhao, et al.
Pubblicazione: (2025)
di: Gao, Yizhao, et al.
Pubblicazione: (2025)
Self-Indexing KVCache: Predicting Sparse Attention from Compressed Keys
di: Yang, Xu, et al.
Pubblicazione: (2026)
di: Yang, Xu, et al.
Pubblicazione: (2026)
LLM DNA: Tracing Model Evolution via Functional Representations
di: Wu, Zhaomin, et al.
Pubblicazione: (2025)
di: Wu, Zhaomin, et al.
Pubblicazione: (2025)
ZETA: Leveraging Z-order Curves for Efficient Top-k Attention
di: Zeng, Qiuhao, et al.
Pubblicazione: (2025)
di: Zeng, Qiuhao, et al.
Pubblicazione: (2025)
Double-P: Hierarchical Top-P Sparse Attention for Long-Context LLMs
di: Ni, Wentao, et al.
Pubblicazione: (2026)
di: Ni, Wentao, et al.
Pubblicazione: (2026)
HSR-Enhanced Sparse Attention Acceleration
di: Chen, Bo, et al.
Pubblicazione: (2024)
di: Chen, Bo, et al.
Pubblicazione: (2024)
Robust Knowledge Transfer in Tiered Reinforcement Learning
di: Huang, Jiawei, et al.
Pubblicazione: (2023)
di: Huang, Jiawei, et al.
Pubblicazione: (2023)
Towards Interpretable Adversarial Examples via Sparse Adversarial Attack
di: Lin, Fudong, et al.
Pubblicazione: (2025)
di: Lin, Fudong, et al.
Pubblicazione: (2025)
DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention
di: Huang, Yuxiang, et al.
Pubblicazione: (2026)
di: Huang, Yuxiang, et al.
Pubblicazione: (2026)
Safe-SAIL: Towards a Fine-grained Safety Landscape of Large Language Models via Sparse Autoencoder Interpretation Framework
di: Weng, Jiaqi, et al.
Pubblicazione: (2025)
di: Weng, Jiaqi, et al.
Pubblicazione: (2025)
Towards Graph Foundation Models: Training on Knowledge Graphs Enables Transferability to General Graphs
di: Wang, Kai, et al.
Pubblicazione: (2024)
di: Wang, Kai, et al.
Pubblicazione: (2024)
SparseBalance: Load-Balanced Long Context Training with Dynamic Sparse Attention
di: Xu, Hongtao, et al.
Pubblicazione: (2026)
di: Xu, Hongtao, et al.
Pubblicazione: (2026)
Circuit Complexity of Hierarchical Knowledge Tracing and Implications for Log-Precision Transformers
di: Liu, Naiming, et al.
Pubblicazione: (2026)
di: Liu, Naiming, et al.
Pubblicazione: (2026)
Towards Robust Knowledge Unlearning: An Adversarial Framework for Assessing and Improving Unlearning Robustness in Large Language Models
di: Yuan, Hongbang, et al.
Pubblicazione: (2024)
di: Yuan, Hongbang, et al.
Pubblicazione: (2024)
From Sparsity to Simplicity: Enabling Simpler Sequential Replacements via Sparse Attention Distillation
di: Ren, Yuxin, et al.
Pubblicazione: (2026)
di: Ren, Yuxin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Improving Low-Resource Knowledge Tracing Tasks by Supervised Pre-training and Importance Mechanism Fine-tuning
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024) -
What Are Step-Level Reward Models Rewarding? Counterintuitive Findings from MCTS-Boosted Mathematical Reasoning
di: Ma, Yiran, et al.
Pubblicazione: (2024) -
Personalized Knowledge Tracing through Student Representation Reconstruction and Class Imbalance Mitigation
di: Chen, Zhiyu, et al.
Pubblicazione: (2024) -
A Question-centric Multi-experts Contrastive Learning Framework for Improving the Accuracy and Interpretability of Deep Sequential Knowledge Tracing Models
di: Zhang, Hengyuan, et al.
Pubblicazione: (2024) -
A Mathematical Theory of Top-$k$ Sparse Attention via Total Variation Distance
di: Tzachristas, Georgios, et al.
Pubblicazione: (2025)