Transformers as Multi-task Learners: Decoupling Features in Hidden Markov Models
Fuente:
arXiv
Saved in:
| Main Authors: | Hao, Yifan, Ye, Chenlu, Han, Chi, Zhang, Tong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Adaptive Layerwise Perturbation: Unifying Off-Policy Corrections for LLM RL
by: Ye, Chenlu, et al.
Published: (2026)
by: Ye, Chenlu, et al.
Published: (2026)
Learning Hidden Markov Models Using Conditional Samples
by: Kakade, Sham M., et al.
Published: (2023)
by: Kakade, Sham M., et al.
Published: (2023)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
by: Yang, Tong, et al.
Published: (2023)
by: Yang, Tong, et al.
Published: (2023)
Ensemble Methods for Sequence Classification with Hidden Markov Models
by: Kawawa-Beaudan, Maxime, et al.
Published: (2024)
by: Kawawa-Beaudan, Maxime, et al.
Published: (2024)
Self-rewarding correction for mathematical reasoning
by: Xiong, Wei, et al.
Published: (2025)
by: Xiong, Wei, et al.
Published: (2025)
A Markov Categorical Framework for Language Modeling
by: Zhang, Yifan
Published: (2025)
by: Zhang, Yifan
Published: (2025)
Beyond Correctness: Harmonizing Process and Outcome Rewards through RL Training
by: Ye, Chenlu, et al.
Published: (2025)
by: Ye, Chenlu, et al.
Published: (2025)
Detecting Hidden Triggers: Mapping Non-Markov Reward Functions to Markov
by: Hyde, Gregory, et al.
Published: (2024)
by: Hyde, Gregory, et al.
Published: (2024)
Iterative Preference Learning from Human Feedback: Bridging Theory and Practice for RLHF under KL-Constraint
by: Xiong, Wei, et al.
Published: (2023)
by: Xiong, Wei, et al.
Published: (2023)
Pre-trained Large Language Models Learn Hidden Markov Models In-context
by: Dai, Yijia, et al.
Published: (2025)
by: Dai, Yijia, et al.
Published: (2025)
Causal Learner: A Toolbox for Causal Structure and Markov Blanket Learning
by: Ling, Zhaolong, et al.
Published: (2021)
by: Ling, Zhaolong, et al.
Published: (2021)
Robust Basis Spline Decoupling for the Compression of Transformer Models
by: De Jonghe, Joppe, et al.
Published: (2026)
by: De Jonghe, Joppe, et al.
Published: (2026)
The Recurrent Sticky Hierarchical Dirichlet Process Hidden Markov Model
by: Słupiński, Mikołaj, et al.
Published: (2024)
by: Słupiński, Mikołaj, et al.
Published: (2024)
Shared-unique Features and Task-aware Prioritized Sampling on Multi-task Reinforcement Learning
by: Lin, Po-Shao, et al.
Published: (2024)
by: Lin, Po-Shao, et al.
Published: (2024)
Transformer Is Inherently a Causal Learner
by: Wang, Xinyue, et al.
Published: (2026)
by: Wang, Xinyue, et al.
Published: (2026)
Towards Unified Multi-task EEG Analysis with Low-Rank Adaptation
by: Dai, Sicheng, et al.
Published: (2026)
by: Dai, Sicheng, et al.
Published: (2026)
Hidden Heroes and Gradient Bloats: Layer-Wise Redundancy Inverts Attribution in Transformers
by: Ye, Donald
Published: (2026)
by: Ye, Donald
Published: (2026)
Constraint Decoupled Latent Diffusion for Protein Backmapping
by: Han, Xu, et al.
Published: (2024)
by: Han, Xu, et al.
Published: (2024)
Hierarchical Transformers are Efficient Meta-Reinforcement Learners
by: Shala, Gresa, et al.
Published: (2024)
by: Shala, Gresa, et al.
Published: (2024)
Deciphering Invariant Feature Decoupling in Source-free Time Series Forecasting with Proxy Denoising
by: Yan, Kangjia, et al.
Published: (2025)
by: Yan, Kangjia, et al.
Published: (2025)
Collaborative Cognitive Diagnosis with Disentangled Representation Learning for Learner Modeling
by: Gao, Weibo, et al.
Published: (2024)
by: Gao, Weibo, et al.
Published: (2024)
Large Transformers are Better EEG Learners
by: Wang, Bingxin, et al.
Published: (2023)
by: Wang, Bingxin, et al.
Published: (2023)
Mixture of Experts based Multi-task Supervise Learning from Crowds
by: Han, Tao, et al.
Published: (2024)
by: Han, Tao, et al.
Published: (2024)
Multi-task Domain Adaptation for Computation Offloading in Edge-intelligence Networks
by: Han, Runxin, et al.
Published: (2025)
by: Han, Runxin, et al.
Published: (2025)
Decoupled Graph Energy-based Model for Node Out-of-Distribution Detection on Heterophilic Graphs
by: Chen, Yuhan, et al.
Published: (2025)
by: Chen, Yuhan, et al.
Published: (2025)
Towards Better Generalization via Distributional Input Projection Network
by: Hao, Yifan, et al.
Published: (2025)
by: Hao, Yifan, et al.
Published: (2025)
Decoupling Exploration and Exploitation for Unsupervised Pre-training with Successor Features
by: Kim, JaeYoon, et al.
Published: (2024)
by: Kim, JaeYoon, et al.
Published: (2024)
Incentivize without Bonus: Provably Efficient Model-based Online Multi-agent RL for Markov Games
by: Yang, Tong, et al.
Published: (2025)
by: Yang, Tong, et al.
Published: (2025)
Zero-shot Load Forecasting for Integrated Energy Systems: A Large Language Model-based Framework with Multi-task Learning
by: Li, Jiaheng, et al.
Published: (2025)
by: Li, Jiaheng, et al.
Published: (2025)
On the Role of Hidden States of Modern Hopfield Network in Transformer
by: Masumura, Tsubasa, et al.
Published: (2025)
by: Masumura, Tsubasa, et al.
Published: (2025)
Are Large Language Models In-Context Graph Learners?
by: Li, Jintang, et al.
Published: (2025)
by: Li, Jintang, et al.
Published: (2025)
Rethinking Importance Sampling in LLM Policy Optimization: A Cumulative Token Perspective
by: Zhang, Yuheng, et al.
Published: (2026)
by: Zhang, Yuheng, et al.
Published: (2026)
GPMFS: Global Foundation and Personalized Optimization for Multi-Label Feature Selection
by: Cao, Yifan, et al.
Published: (2025)
by: Cao, Yifan, et al.
Published: (2025)
EnECG: Efficient Ensemble Learning for Electrocardiogram Multi-task Foundation Model
by: Xu, Yuhao, et al.
Published: (2025)
by: Xu, Yuhao, et al.
Published: (2025)
Multi-task GINN-LP for Multi-target Symbolic Regression
by: Rajabu, Hussein, et al.
Published: (2025)
by: Rajabu, Hussein, et al.
Published: (2025)
T-REX: Mixture-of-Rank-One-Experts with Semantic-aware Intuition for Multi-task Large Language Model Finetuning
by: Zhang, Rongyu, et al.
Published: (2024)
by: Zhang, Rongyu, et al.
Published: (2024)
Handling Label Noise via Instance-Level Difficulty Modeling and Dynamic Optimization
by: Zhang, Kuan, et al.
Published: (2025)
by: Zhang, Kuan, et al.
Published: (2025)
The Illusion of Certainty: Decoupling Capability and Calibration in On-Policy Distillation
by: Zhang, Jiaxin, et al.
Published: (2026)
by: Zhang, Jiaxin, et al.
Published: (2026)
TSRBench: A Comprehensive Multi-task Multi-modal Time Series Reasoning Benchmark for Generalist Models
by: Yu, Fangxu, et al.
Published: (2026)
by: Yu, Fangxu, et al.
Published: (2026)
Decoupled and Divergence-Conditioned Prompt for Multi-domain Dynamic Graph Foundation Models
by: Yuan, Haonan, et al.
Published: (2026)
by: Yuan, Haonan, et al.
Published: (2026)
Similar Items
-
Adaptive Layerwise Perturbation: Unifying Off-Policy Corrections for LLM RL
by: Ye, Chenlu, et al.
Published: (2026) -
Learning Hidden Markov Models Using Conditional Samples
by: Kakade, Sham M., et al.
Published: (2023) -
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
by: Yang, Tong, et al.
Published: (2023) -
Ensemble Methods for Sequence Classification with Hidden Markov Models
by: Kawawa-Beaudan, Maxime, et al.
Published: (2024) -
Self-rewarding correction for mathematical reasoning
by: Xiong, Wei, et al.
Published: (2025)