A Transformer-based Autoregressive Decoder Architecture for Hierarchical Text Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yousef, Younes, Galke, Lukas, Scherp, Ansgar |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
POWN: Prototypical Open-World Node Classification
par: Hoffmann, Marcel, et autres
Publié: (2024)
par: Hoffmann, Marcel, et autres
Publié: (2024)
Gumbel-MPNN: Graph Rewiring with Gumbel-Softmax
par: Hoffmann, Marcel, et autres
Publié: (2025)
par: Hoffmann, Marcel, et autres
Publié: (2025)
Text Role Classification in Scientific Charts Using Multimodal Transformers
par: Kim, Hye Jin, et autres
Publié: (2024)
par: Kim, Hye Jin, et autres
Publié: (2024)
Active Few-Shot Learning for Vertex Classification Starting from an Unlabeled Dataset
par: Burr, Felix, et autres
Publié: (2025)
par: Burr, Felix, et autres
Publié: (2025)
Edge-Splitting MLP: Node Classification on Homophilic and Heterophilic Graphs without Message Passing
par: Kohn, Matthias, et autres
Publié: (2024)
par: Kohn, Matthias, et autres
Publié: (2024)
iN2V: Bringing Transductive Node Embeddings to Inductive Graphs
par: Lell, Nicolas, et autres
Publié: (2025)
par: Lell, Nicolas, et autres
Publié: (2025)
HyperAggregation: Aggregating over Graph Edges with Hypernetworks
par: Lell, Nicolas, et autres
Publié: (2024)
par: Lell, Nicolas, et autres
Publié: (2024)
Isotropy Matters: Soft-ZCA Whitening of Embeddings for Semantic Code Search
par: Diera, Andor, et autres
Publié: (2024)
par: Diera, Andor, et autres
Publié: (2024)
GLaMoR: Consistency Checking of OWL Ontologies using Graph Language Models
par: Mücke, Justin, et autres
Publié: (2025)
par: Mücke, Justin, et autres
Publié: (2025)
Efficient Continual Learning for Small Language Models with a Discrete Key-Value Bottleneck
par: Diera, Andor, et autres
Publié: (2024)
par: Diera, Andor, et autres
Publié: (2024)
LossVal: Efficient Data Valuation for Neural Networks
par: Wibiral, Tim, et autres
Publié: (2024)
par: Wibiral, Tim, et autres
Publié: (2024)
Lifelong Graph Learning for Graph Summarization
par: Frank, Jonatan, et autres
Publié: (2024)
par: Frank, Jonatan, et autres
Publié: (2024)
Are We Really Making Much Progress in Text Classification? A Comparative Review
par: Galke, Lukas, et autres
Publié: (2022)
par: Galke, Lukas, et autres
Publié: (2022)
Your Extreme Multi-label Classifier is Secretly a Hierarchical Text Classifier for Free
par: Bertalis, Nerijus, et autres
Publié: (2024)
par: Bertalis, Nerijus, et autres
Publié: (2024)
When are 1.58 bits enough? A Bottom-up Exploration of BitNet Quantization
par: Nielsen, Jacob, et autres
Publié: (2024)
par: Nielsen, Jacob, et autres
Publié: (2024)
Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?
par: Nielsen, Jacob, et autres
Publié: (2025)
par: Nielsen, Jacob, et autres
Publié: (2025)
Hierarchical Autoregressive Transformers: Combining Byte- and Word-Level Processing for Robust, Adaptable Language Models
par: Neitemeier, Pit, et autres
Publié: (2025)
par: Neitemeier, Pit, et autres
Publié: (2025)
From Muscle to Text with MyoText: sEMG to Text via Finger Classification and Transformer-Based Decoding
par: Chowdhury, Meghna Roy, et autres
Publié: (2026)
par: Chowdhury, Meghna Roy, et autres
Publié: (2026)
End-to-End Modeling Hierarchical Time Series Using Autoregressive Transformer and Conditional Normalizing Flow based Reconciliation
par: Wang, Shiyu, et autres
Publié: (2022)
par: Wang, Shiyu, et autres
Publié: (2022)
Explanation of Dynamic Physical Field Predictions using WassersteinGrad: Application to Autoregressive Weather Forecasting
par: Essafouri, Younes, et autres
Publié: (2026)
par: Essafouri, Younes, et autres
Publié: (2026)
AutoHFormer: Efficient Hierarchical Autoregressive Transformer for Time Series Prediction
par: Zhang, Qianru, et autres
Publié: (2025)
par: Zhang, Qianru, et autres
Publié: (2025)
Revisiting Hierarchical Text Classification: Inference and Metrics
par: Plaud, Roman, et autres
Publié: (2024)
par: Plaud, Roman, et autres
Publié: (2024)
Towards Robust Few-Shot Text Classification Using Transformer Architectures and Dual Loss Strategies
par: Han, Xu, et autres
Publié: (2025)
par: Han, Xu, et autres
Publié: (2025)
Hierarchic-EEG2Text: Assessing EEG-To-Text Decoding across Hierarchical Abstraction Levels
par: Sharma, Anupam, et autres
Publié: (2026)
par: Sharma, Anupam, et autres
Publié: (2026)
HCFT: Hierarchical Convolutional Fusion Transformer for EEG Decoding
par: Zhang, Haodong, et autres
Publié: (2026)
par: Zhang, Haodong, et autres
Publié: (2026)
Rethinking Graph Transformer Architecture Design for Node Classification
par: Zhou, Jiajun, et autres
Publié: (2024)
par: Zhou, Jiajun, et autres
Publié: (2024)
Transformer Neural Autoregressive Flows
par: Patacchiola, Massimiliano, et autres
Publié: (2024)
par: Patacchiola, Massimiliano, et autres
Publié: (2024)
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
par: Gu, Jiatao, et autres
Publié: (2024)
par: Gu, Jiatao, et autres
Publié: (2024)
FlexMoRE: A Flexible Mixture of Rank-heterogeneous Experts for Efficient Federatedly-trained Large Language Models
par: Pirchert, Annemette Brok, et autres
Publié: (2026)
par: Pirchert, Annemette Brok, et autres
Publié: (2026)
An Efficient Private GPT Never Autoregressively Decodes
par: Li, Zhengyi, et autres
Publié: (2025)
par: Li, Zhengyi, et autres
Publié: (2025)
Autoregressive Visual Decoding from EEG Signals
par: Dai, Sicheng, et autres
Publié: (2026)
par: Dai, Sicheng, et autres
Publié: (2026)
DeToNATION: Decoupled Torch Network-Aware Training on Interlinked Online Nodes
par: From, Mogens Henrik, et autres
Publié: (2025)
par: From, Mogens Henrik, et autres
Publié: (2025)
Autoregressive Diffusion Transformer for Text-to-Speech Synthesis
par: Liu, Zhijun, et autres
Publié: (2024)
par: Liu, Zhijun, et autres
Publié: (2024)
CRAWLDoc: A Dataset for Robust Ranking of Bibliographic Documents
par: Karl, Fabian, et autres
Publié: (2025)
par: Karl, Fabian, et autres
Publié: (2025)
Enhancing Text-Based Hierarchical Multilabel Classification for Mobile Applications via Contrastive Learning
par: Guo, Jiawei, et autres
Publié: (2025)
par: Guo, Jiawei, et autres
Publié: (2025)
Arch-VQ: Discrete Architecture Representation Learning with Autoregressive Priors
par: Poddenige, Deshani Geethika, et autres
Publié: (2025)
par: Poddenige, Deshani Geethika, et autres
Publié: (2025)
Efficient Autoregressive Inference for Transformer Probabilistic Models
par: Hassan, Conor, et autres
Publié: (2025)
par: Hassan, Conor, et autres
Publié: (2025)
Do Language Models Encode Semantic Relations? Probing and Sparse Feature Analysis
par: Diera, Andor, et autres
Publié: (2026)
par: Diera, Andor, et autres
Publié: (2026)
Transformer-based EEG Decoding: A Survey
par: Zhang, Haodong, et autres
Publié: (2025)
par: Zhang, Haodong, et autres
Publié: (2025)
Quantization-Free Autoregressive Action Transformer
par: Sheebaelhamd, Ziyad, et autres
Publié: (2025)
par: Sheebaelhamd, Ziyad, et autres
Publié: (2025)
Documents similaires
-
POWN: Prototypical Open-World Node Classification
par: Hoffmann, Marcel, et autres
Publié: (2024) -
Gumbel-MPNN: Graph Rewiring with Gumbel-Softmax
par: Hoffmann, Marcel, et autres
Publié: (2025) -
Text Role Classification in Scientific Charts Using Multimodal Transformers
par: Kim, Hye Jin, et autres
Publié: (2024) -
Active Few-Shot Learning for Vertex Classification Starting from an Unlabeled Dataset
par: Burr, Felix, et autres
Publié: (2025) -
Edge-Splitting MLP: Node Classification on Homophilic and Heterophilic Graphs without Message Passing
par: Kohn, Matthias, et autres
Publié: (2024)