Enregistré dans:
| Auteurs principaux: | Chen, Yang, Fang, Cong, Lin, Zhouchen, Liu, Bing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2406.11249 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DIGIC: Domain Generalizable Imitation Learning by Causal Discovery
par: Chen, Yang, et autres
Publié: (2024)
par: Chen, Yang, et autres
Publié: (2024)
Conda: Column-Normalized Adam for Training Large Language Models Faster
par: Wang, Junjie, et autres
Publié: (2025)
par: Wang, Junjie, et autres
Publié: (2025)
On the Limitations and Capabilities of Position Embeddings for Length Generalization
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
Improving Model Representation and Reducing KV Cache via Skip Connections with First Value Heads
par: Wu, Zhoutong, et autres
Publié: (2025)
par: Wu, Zhoutong, et autres
Publié: (2025)
Attention Sinks Induce Gradient Sinks: Massive Activations as Gradient Regulators in Transformers
par: Chen, Yihong, et autres
Publié: (2026)
par: Chen, Yihong, et autres
Publié: (2026)
Training-Free Message Passing for Learning on Hypergraphs
par: Tang, Bohan, et autres
Publié: (2024)
par: Tang, Bohan, et autres
Publié: (2024)
On the Learn-to-Optimize Capabilities of Transformers in In-Context Sparse Recovery
par: Liu, Renpu, et autres
Publié: (2024)
par: Liu, Renpu, et autres
Publié: (2024)
Quadratic Direct Forecast for Training Multi-Step Time-Series Forecast Models
par: Wang, Hao, et autres
Publié: (2025)
par: Wang, Hao, et autres
Publié: (2025)
Generalist++: A Meta-learning Framework for Mitigating Trade-off in Adversarial Training
par: Wang, Yisen, et autres
Publié: (2025)
par: Wang, Yisen, et autres
Publié: (2025)
Link Prediction with Relational Hypergraphs
par: Huang, Xingyue, et autres
Publié: (2024)
par: Huang, Xingyue, et autres
Publié: (2024)
Proximity Matters: Local Proximity Enhanced Balancing for Treatment Effect Estimation
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Hyperbolic Hypergraph Neural Networks for Multi-Relational Knowledge Hypergraph Representation
par: Li, Mengfan, et autres
Publié: (2024)
par: Li, Mengfan, et autres
Publié: (2024)
Protecting Copyright of Medical Pre-trained Language Models: Training-Free Backdoor Model Watermarking
par: Kong, Cong, et autres
Publié: (2024)
par: Kong, Cong, et autres
Publié: (2024)
Online Pseudo-Zeroth-Order Training of Neuromorphic Spiking Neural Networks
par: Xiao, Mingqing, et autres
Publié: (2024)
par: Xiao, Mingqing, et autres
Publié: (2024)
FedAdamW: A Communication-Efficient Optimizer with Convergence and Generalization Guarantees for Federated Large Models
par: Liu, Junkang, et autres
Publié: (2025)
par: Liu, Junkang, et autres
Publié: (2025)
Simple Convergence Proof of Adam From a Sign-like Descent Perspective
par: Peng, Hanyang, et autres
Publié: (2025)
par: Peng, Hanyang, et autres
Publié: (2025)
Enhanced Atrial Fibrillation Prediction in ESUS Patients with Hypergraph-based Pre-training
par: Xie, Yuzhang, et autres
Publié: (2026)
par: Xie, Yuzhang, et autres
Publié: (2026)
Contrastive Language-Image Pre-Training Model based Semantic Communication Performance Optimization
par: Yang, Shaoran, et autres
Publié: (2025)
par: Yang, Shaoran, et autres
Publié: (2025)
Task-Aware Parameter-Efficient Fine-Tuning of Large Pre-Trained Models at the Edge
par: Hu, Senkang, et autres
Publié: (2025)
par: Hu, Senkang, et autres
Publié: (2025)
PTMs-TSCIL Pre-Trained Models Based Class-Incremental Learning
par: Wu, Yuanlong, et autres
Publié: (2025)
par: Wu, Yuanlong, et autres
Publié: (2025)
Theoretical Perspectives on Data Quality and Synergistic Effects in Pre- and Post-Training Reasoning Models
par: Javanmard, Adel, et autres
Publié: (2026)
par: Javanmard, Adel, et autres
Publié: (2026)
CyclicFL: A Cyclic Model Pre-Training Approach to Efficient Federated Learning
par: Zhang, Pengyu, et autres
Publié: (2023)
par: Zhang, Pengyu, et autres
Publié: (2023)
A Survey on Time-Series Pre-Trained Models
par: Ma, Qianli, et autres
Publié: (2023)
par: Ma, Qianli, et autres
Publié: (2023)
ADORA: Training Reasoning Models with Dynamic Advantage Estimation on Reinforcement Learning
par: Ren, Qingnan, et autres
Publié: (2026)
par: Ren, Qingnan, et autres
Publié: (2026)
HypergraphFormer: Learning Hypergraphs from LLMs for Editable Floor Plan Generation
par: Klimenko, Nikita, et autres
Publié: (2026)
par: Klimenko, Nikita, et autres
Publié: (2026)
Hebbian Learning based Orthogonal Projection for Continual Learning of Spiking Neural Networks
par: Xiao, Mingqing, et autres
Publié: (2024)
par: Xiao, Mingqing, et autres
Publié: (2024)
On the Learnability of Test-Time Adaptation: A Recovery Complexity Perspective
par: Zhou, Zhi, et autres
Publié: (2026)
par: Zhou, Zhi, et autres
Publié: (2026)
Reinforcement Learning on Pre-Training Data
par: Li, Siheng, et autres
Publié: (2025)
par: Li, Siheng, et autres
Publié: (2025)
On the Surprising Efficacy of Distillation as an Alternative to Pre-Training Small Models
par: Farhat, Sean, et autres
Publié: (2024)
par: Farhat, Sean, et autres
Publié: (2024)
Implicit Hypergraph Neural Networks: A Stable Framework for Higher-Order Relational Learning with Provable Guarantees
par: Li, Xiaoyu, et autres
Publié: (2025)
par: Li, Xiaoyu, et autres
Publié: (2025)
How Particle System Theory Enhances Hypergraph Message Passing
par: Ma, Yixuan, et autres
Publié: (2025)
par: Ma, Yixuan, et autres
Publié: (2025)
Combining Pre-Trained Models for Enhanced Feature Representation in Reinforcement Learning
par: Piccoli, Elia, et autres
Publié: (2025)
par: Piccoli, Elia, et autres
Publié: (2025)
Single Parent Family: A Spectrum of Family Members from a Single Pre-Trained Foundation Model
par: Hajimolahoseini, Habib, et autres
Publié: (2024)
par: Hajimolahoseini, Habib, et autres
Publié: (2024)
A Survey of Few-Shot Learning on Graphs: from Meta-Learning to Pre-Training and Prompt Learning
par: Yu, Xingtong, et autres
Publié: (2024)
par: Yu, Xingtong, et autres
Publié: (2024)
Ensemble of Pre-Trained Models for Long-Tailed Trajectory Prediction
par: Thuremella, Divya, et autres
Publié: (2025)
par: Thuremella, Divya, et autres
Publié: (2025)
CHGNN: A Semi-Supervised Contrastive Hypergraph Learning Network
par: Song, Yumeng, et autres
Publié: (2023)
par: Song, Yumeng, et autres
Publié: (2023)
SeqFusion: Sequential Fusion of Pre-Trained Models for Zero-Shot Time-Series Forecasting
par: Huang, Ting-Ji, et autres
Publié: (2025)
par: Huang, Ting-Ji, et autres
Publié: (2025)
A2PO: Towards Effective Offline Reinforcement Learning from an Advantage-aware Perspective
par: Qing, Yunpeng, et autres
Publié: (2024)
par: Qing, Yunpeng, et autres
Publié: (2024)
On the Cause of Unfairness: A Training Sample Perspective
par: Yao, Yuanshun, et autres
Publié: (2023)
par: Yao, Yuanshun, et autres
Publié: (2023)
On the Adversarial Transferability of Generalized "Skip Connections"
par: Wang, Yisen, et autres
Publié: (2024)
par: Wang, Yisen, et autres
Publié: (2024)
Documents similaires
-
DIGIC: Domain Generalizable Imitation Learning by Causal Discovery
par: Chen, Yang, et autres
Publié: (2024) -
Conda: Column-Normalized Adam for Training Large Language Models Faster
par: Wang, Junjie, et autres
Publié: (2025) -
On the Limitations and Capabilities of Position Embeddings for Length Generalization
par: Chen, Yang, et autres
Publié: (2025) -
Improving Model Representation and Reducing KV Cache via Skip Connections with First Value Heads
par: Wu, Zhoutong, et autres
Publié: (2025) -
Attention Sinks Induce Gradient Sinks: Massive Activations as Gradient Regulators in Transformers
par: Chen, Yihong, et autres
Publié: (2026)