Fine-grained Attention in Hierarchical Transformers for Tabular Time-series
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Azorin, Raphael, Houidi, Zied Ben, Gallo, Massimo, Finamore, Alessandro, Michiardi, Pietro |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Just In Time Transformers
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024)
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024)
Chunked TabPFN: Exact Training-Free In-Context Learning for Long-Context Tabular Data
par: Sergazinov, Renat, et autres
Publié: (2025)
par: Sergazinov, Renat, et autres
Publié: (2025)
Fusing Rewards and Preferences in Reinforcement Learning
par: Khorasani, Sadegh, et autres
Publié: (2025)
par: Khorasani, Sadegh, et autres
Publié: (2025)
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
par: Atad, Ido Andrew, et autres
Publié: (2026)
par: Atad, Ido Andrew, et autres
Publié: (2026)
Hierarchical Reinforcement Learning with Targeted Causal Interventions
par: Khorasani, Sadegh, et autres
Publié: (2025)
par: Khorasani, Sadegh, et autres
Publié: (2025)
ArrowFlow: Hierarchical Machine Learning in the Space of Permutations
par: Yilmaz, Ozgur
Publié: (2026)
par: Yilmaz, Ozgur
Publié: (2026)
Boosting gets full Attention for Relational Learning
par: Guillame-Bert, Mathieu, et autres
Publié: (2024)
par: Guillame-Bert, Mathieu, et autres
Publié: (2024)
Real-Time Pulsatile Flow Prediction for Realistic, Diverse Intracranial Aneurysm Morphologies using a Graph Transformer and Steady-Flow Data Augmentation
par: Sheng, Yiying, et autres
Publié: (2026)
par: Sheng, Yiying, et autres
Publié: (2026)
Transformers Boost the Performance of Decision Trees on Tabular Data across Sample Sizes
par: Jayawardhana, Mayuka, et autres
Publié: (2025)
par: Jayawardhana, Mayuka, et autres
Publié: (2025)
RXNRECer Enables Fine-grained Enzymatic Function Annotation through Active Learning and Protein Language Models
par: Shi, Zhenkun, et autres
Publié: (2026)
par: Shi, Zhenkun, et autres
Publié: (2026)
Versatile Ordering Network: An Attention-based Neural Network for Ordering Across Scales and Quality Metrics
par: Yu, Zehua, et autres
Publié: (2024)
par: Yu, Zehua, et autres
Publié: (2024)
Understanding the Limits of Deep Tabular Methods with Temporal Shift
par: Cai, Hao-Run, et autres
Publié: (2025)
par: Cai, Hao-Run, et autres
Publié: (2025)
TimeCatcher: A Variational Framework for Volatility-Aware Forecasting of Non-Stationary Time Series
par: Chen, Zhiyu, et autres
Publié: (2026)
par: Chen, Zhiyu, et autres
Publié: (2026)
MotherNet: Fast Training and Inference via Hyper-Network Transformers
par: Müller, Andreas, et autres
Publié: (2023)
par: Müller, Andreas, et autres
Publié: (2023)
HAPEns: Hardware-Aware Post-Hoc Ensembling for Tabular Data
par: Maier, Jannis, et autres
Publié: (2026)
par: Maier, Jannis, et autres
Publié: (2026)
Feature-aware Modulation for Learning from Temporal Tabular Data
par: Cai, Hao-Run, et autres
Publié: (2025)
par: Cai, Hao-Run, et autres
Publié: (2025)
Adaptive$^2$: Adaptive Domain Mining for Fine-grained Domain Adaptation Modeling
par: Sun, Wenxuan, et autres
Publié: (2024)
par: Sun, Wenxuan, et autres
Publié: (2024)
AGOP-IxG: A Gradient Covariance Filter for Local Feature Attribution on Tabular Data, with a Controlled Benchmark
par: Katakam, Raj Kiran Gupta
Publié: (2026)
par: Katakam, Raj Kiran Gupta
Publié: (2026)
Deep Memory Search: A Metaheuristic Approach for Optimizing Heuristic Search
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)
par: Hedar, Abdel-Rahman, et autres
Publié: (2024)
Attention in SRAM on Tenstorrent Grayskull
par: Thüning, Moritz
Publié: (2024)
par: Thüning, Moritz
Publié: (2024)
Normalization Layer Per-Example Gradients are Sufficient to Predict Gradient Noise Scale in Transformers
par: Gray, Gavia, et autres
Publié: (2024)
par: Gray, Gavia, et autres
Publié: (2024)
Tabby: A Language Model Architecture for Tabular and Structured Data Synthesis
par: Cromp, Sonia, et autres
Publié: (2025)
par: Cromp, Sonia, et autres
Publié: (2025)
Recurrent Memory-Augmented Transformers with Chunked Attention for Long-Context Language Modeling
par: Kashyap, Ankit
Publié: (2025)
par: Kashyap, Ankit
Publié: (2025)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
par: Ye, Hua, et autres
Publié: (2025)
par: Ye, Hua, et autres
Publié: (2025)
Inference-Time Machine Unlearning via Gated Activation Redirection
par: Turani, Vinícius Conte, et autres
Publié: (2026)
par: Turani, Vinícius Conte, et autres
Publié: (2026)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
NoRIN: Backbone-Adaptive Reversible Normalization for Time-Series Forecasting
par: Zhang, Shun, et autres
Publié: (2026)
par: Zhang, Shun, et autres
Publié: (2026)
Symbol-Temporal Consistency Self-supervised Learning for Robust Time Series Classification
par: Garcia, Kevin, et autres
Publié: (2025)
par: Garcia, Kevin, et autres
Publié: (2025)
Why LoRA Resists Label Noise: A Theoretical Framework for Noise-Robust Parameter-Efficient Fine-Tuning
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
xLSTM-Mixer: Multivariate Time Series Forecasting by Mixing via Scalar Memories
par: Kraus, Maurice, et autres
Publié: (2024)
par: Kraus, Maurice, et autres
Publié: (2024)
Revisiting LRP: Positional Attribution as the Missing Ingredient for Transformer Explainability
par: Bakish, Yarden, et autres
Publié: (2025)
par: Bakish, Yarden, et autres
Publié: (2025)
Drift-Resilient TabPFN: In-Context Learning Temporal Distribution Shifts on Tabular Data
par: Helli, Kai, et autres
Publié: (2024)
par: Helli, Kai, et autres
Publié: (2024)
Sensorformer: Cross-patch attention with global-patch compression is effective for high-dimensional multivariate time series forecasting
par: Qin, Liyang, et autres
Publié: (2025)
par: Qin, Liyang, et autres
Publié: (2025)
Generative Pretrained Embedding and Hierarchical Irregular Time Series Representation for Daily Living Activity Recognition
par: Bouchabou, Damien, et autres
Publié: (2024)
par: Bouchabou, Damien, et autres
Publié: (2024)
Variance Is Not Importance: Structural Analysis of Transformer Compressibility Across Model Scales
par: Salfati, Samuel
Publié: (2026)
par: Salfati, Samuel
Publié: (2026)
QuAnTS: Question Answering on Time Series
par: Divo, Felix, et autres
Publié: (2025)
par: Divo, Felix, et autres
Publié: (2025)
Transformer Scalability Crisis: The First Comprehensive Empirical Analysis of Performance Walls in Modern Language Models
par: Moghadasi, Mahdi Naser, et autres
Publié: (2026)
par: Moghadasi, Mahdi Naser, et autres
Publié: (2026)
COMET: Codebook-based Online-adaptive Multi-scale Embedding for Time-series Anomaly Detection
par: Park, Jinwoo, et autres
Publié: (2026)
par: Park, Jinwoo, et autres
Publié: (2026)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
par: Yousaf, Iqra
Publié: (2024)
par: Yousaf, Iqra
Publié: (2024)
Prior-Aligned Data Cleaning for Tabular Foundation Models
par: Berti-Equille, Laure
Publié: (2026)
par: Berti-Equille, Laure
Publié: (2026)
Documents similaires
-
Just In Time Transformers
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024) -
Chunked TabPFN: Exact Training-Free In-Context Learning for Long-Context Tabular Data
par: Sergazinov, Renat, et autres
Publié: (2025) -
Fusing Rewards and Preferences in Reinforcement Learning
par: Khorasani, Sadegh, et autres
Publié: (2025) -
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
par: Atad, Ido Andrew, et autres
Publié: (2026) -
Hierarchical Reinforcement Learning with Targeted Causal Interventions
par: Khorasani, Sadegh, et autres
Publié: (2025)