A Transformer-based Autoregressive Decoder Architecture for Hierarchical Text Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Yousef, Younes, Galke, Lukas, Scherp, Ansgar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
POWN: Prototypical Open-World Node Classification
di: Hoffmann, Marcel, et al.
Pubblicazione: (2024)
di: Hoffmann, Marcel, et al.
Pubblicazione: (2024)
Gumbel-MPNN: Graph Rewiring with Gumbel-Softmax
di: Hoffmann, Marcel, et al.
Pubblicazione: (2025)
di: Hoffmann, Marcel, et al.
Pubblicazione: (2025)
Text Role Classification in Scientific Charts Using Multimodal Transformers
di: Kim, Hye Jin, et al.
Pubblicazione: (2024)
di: Kim, Hye Jin, et al.
Pubblicazione: (2024)
Active Few-Shot Learning for Vertex Classification Starting from an Unlabeled Dataset
di: Burr, Felix, et al.
Pubblicazione: (2025)
di: Burr, Felix, et al.
Pubblicazione: (2025)
Edge-Splitting MLP: Node Classification on Homophilic and Heterophilic Graphs without Message Passing
di: Kohn, Matthias, et al.
Pubblicazione: (2024)
di: Kohn, Matthias, et al.
Pubblicazione: (2024)
iN2V: Bringing Transductive Node Embeddings to Inductive Graphs
di: Lell, Nicolas, et al.
Pubblicazione: (2025)
di: Lell, Nicolas, et al.
Pubblicazione: (2025)
HyperAggregation: Aggregating over Graph Edges with Hypernetworks
di: Lell, Nicolas, et al.
Pubblicazione: (2024)
di: Lell, Nicolas, et al.
Pubblicazione: (2024)
Isotropy Matters: Soft-ZCA Whitening of Embeddings for Semantic Code Search
di: Diera, Andor, et al.
Pubblicazione: (2024)
di: Diera, Andor, et al.
Pubblicazione: (2024)
GLaMoR: Consistency Checking of OWL Ontologies using Graph Language Models
di: Mücke, Justin, et al.
Pubblicazione: (2025)
di: Mücke, Justin, et al.
Pubblicazione: (2025)
Efficient Continual Learning for Small Language Models with a Discrete Key-Value Bottleneck
di: Diera, Andor, et al.
Pubblicazione: (2024)
di: Diera, Andor, et al.
Pubblicazione: (2024)
LossVal: Efficient Data Valuation for Neural Networks
di: Wibiral, Tim, et al.
Pubblicazione: (2024)
di: Wibiral, Tim, et al.
Pubblicazione: (2024)
Lifelong Graph Learning for Graph Summarization
di: Frank, Jonatan, et al.
Pubblicazione: (2024)
di: Frank, Jonatan, et al.
Pubblicazione: (2024)
Are We Really Making Much Progress in Text Classification? A Comparative Review
di: Galke, Lukas, et al.
Pubblicazione: (2022)
di: Galke, Lukas, et al.
Pubblicazione: (2022)
Your Extreme Multi-label Classifier is Secretly a Hierarchical Text Classifier for Free
di: Bertalis, Nerijus, et al.
Pubblicazione: (2024)
di: Bertalis, Nerijus, et al.
Pubblicazione: (2024)
When are 1.58 bits enough? A Bottom-up Exploration of BitNet Quantization
di: Nielsen, Jacob, et al.
Pubblicazione: (2024)
di: Nielsen, Jacob, et al.
Pubblicazione: (2024)
Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?
di: Nielsen, Jacob, et al.
Pubblicazione: (2025)
di: Nielsen, Jacob, et al.
Pubblicazione: (2025)
Hierarchical Autoregressive Transformers: Combining Byte- and Word-Level Processing for Robust, Adaptable Language Models
di: Neitemeier, Pit, et al.
Pubblicazione: (2025)
di: Neitemeier, Pit, et al.
Pubblicazione: (2025)
From Muscle to Text with MyoText: sEMG to Text via Finger Classification and Transformer-Based Decoding
di: Chowdhury, Meghna Roy, et al.
Pubblicazione: (2026)
di: Chowdhury, Meghna Roy, et al.
Pubblicazione: (2026)
End-to-End Modeling Hierarchical Time Series Using Autoregressive Transformer and Conditional Normalizing Flow based Reconciliation
di: Wang, Shiyu, et al.
Pubblicazione: (2022)
di: Wang, Shiyu, et al.
Pubblicazione: (2022)
Explanation of Dynamic Physical Field Predictions using WassersteinGrad: Application to Autoregressive Weather Forecasting
di: Essafouri, Younes, et al.
Pubblicazione: (2026)
di: Essafouri, Younes, et al.
Pubblicazione: (2026)
AutoHFormer: Efficient Hierarchical Autoregressive Transformer for Time Series Prediction
di: Zhang, Qianru, et al.
Pubblicazione: (2025)
di: Zhang, Qianru, et al.
Pubblicazione: (2025)
Revisiting Hierarchical Text Classification: Inference and Metrics
di: Plaud, Roman, et al.
Pubblicazione: (2024)
di: Plaud, Roman, et al.
Pubblicazione: (2024)
Towards Robust Few-Shot Text Classification Using Transformer Architectures and Dual Loss Strategies
di: Han, Xu, et al.
Pubblicazione: (2025)
di: Han, Xu, et al.
Pubblicazione: (2025)
Hierarchic-EEG2Text: Assessing EEG-To-Text Decoding across Hierarchical Abstraction Levels
di: Sharma, Anupam, et al.
Pubblicazione: (2026)
di: Sharma, Anupam, et al.
Pubblicazione: (2026)
HCFT: Hierarchical Convolutional Fusion Transformer for EEG Decoding
di: Zhang, Haodong, et al.
Pubblicazione: (2026)
di: Zhang, Haodong, et al.
Pubblicazione: (2026)
Rethinking Graph Transformer Architecture Design for Node Classification
di: Zhou, Jiajun, et al.
Pubblicazione: (2024)
di: Zhou, Jiajun, et al.
Pubblicazione: (2024)
Transformer Neural Autoregressive Flows
di: Patacchiola, Massimiliano, et al.
Pubblicazione: (2024)
di: Patacchiola, Massimiliano, et al.
Pubblicazione: (2024)
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
FlexMoRE: A Flexible Mixture of Rank-heterogeneous Experts for Efficient Federatedly-trained Large Language Models
di: Pirchert, Annemette Brok, et al.
Pubblicazione: (2026)
di: Pirchert, Annemette Brok, et al.
Pubblicazione: (2026)
An Efficient Private GPT Never Autoregressively Decodes
di: Li, Zhengyi, et al.
Pubblicazione: (2025)
di: Li, Zhengyi, et al.
Pubblicazione: (2025)
Autoregressive Visual Decoding from EEG Signals
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
DeToNATION: Decoupled Torch Network-Aware Training on Interlinked Online Nodes
di: From, Mogens Henrik, et al.
Pubblicazione: (2025)
di: From, Mogens Henrik, et al.
Pubblicazione: (2025)
Autoregressive Diffusion Transformer for Text-to-Speech Synthesis
di: Liu, Zhijun, et al.
Pubblicazione: (2024)
di: Liu, Zhijun, et al.
Pubblicazione: (2024)
CRAWLDoc: A Dataset for Robust Ranking of Bibliographic Documents
di: Karl, Fabian, et al.
Pubblicazione: (2025)
di: Karl, Fabian, et al.
Pubblicazione: (2025)
Enhancing Text-Based Hierarchical Multilabel Classification for Mobile Applications via Contrastive Learning
di: Guo, Jiawei, et al.
Pubblicazione: (2025)
di: Guo, Jiawei, et al.
Pubblicazione: (2025)
Arch-VQ: Discrete Architecture Representation Learning with Autoregressive Priors
di: Poddenige, Deshani Geethika, et al.
Pubblicazione: (2025)
di: Poddenige, Deshani Geethika, et al.
Pubblicazione: (2025)
Efficient Autoregressive Inference for Transformer Probabilistic Models
di: Hassan, Conor, et al.
Pubblicazione: (2025)
di: Hassan, Conor, et al.
Pubblicazione: (2025)
Do Language Models Encode Semantic Relations? Probing and Sparse Feature Analysis
di: Diera, Andor, et al.
Pubblicazione: (2026)
di: Diera, Andor, et al.
Pubblicazione: (2026)
Transformer-based EEG Decoding: A Survey
di: Zhang, Haodong, et al.
Pubblicazione: (2025)
di: Zhang, Haodong, et al.
Pubblicazione: (2025)
Quantization-Free Autoregressive Action Transformer
di: Sheebaelhamd, Ziyad, et al.
Pubblicazione: (2025)
di: Sheebaelhamd, Ziyad, et al.
Pubblicazione: (2025)
Documenti analoghi
-
POWN: Prototypical Open-World Node Classification
di: Hoffmann, Marcel, et al.
Pubblicazione: (2024) -
Gumbel-MPNN: Graph Rewiring with Gumbel-Softmax
di: Hoffmann, Marcel, et al.
Pubblicazione: (2025) -
Text Role Classification in Scientific Charts Using Multimodal Transformers
di: Kim, Hye Jin, et al.
Pubblicazione: (2024) -
Active Few-Shot Learning for Vertex Classification Starting from an Unlabeled Dataset
di: Burr, Felix, et al.
Pubblicazione: (2025) -
Edge-Splitting MLP: Node Classification on Homophilic and Heterophilic Graphs without Message Passing
di: Kohn, Matthias, et al.
Pubblicazione: (2024)