Dropout Robustness and Cognitive Profiling of Transformer Models via Stochastic Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Caiado, Antônio Junior Alves, Hahsler, Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AI Content Self-Detection for Transformer-based Large Language Models
par: Caiado, Antônio Junior Alves, et autres
Publié: (2023)
par: Caiado, Antônio Junior Alves, et autres
Publié: (2023)
Scale-Dropout: Estimating Uncertainty in Deep Neural Networks Using Stochastic Scale
par: Ahmed, Soyed Tuhin, et autres
Publié: (2023)
par: Ahmed, Soyed Tuhin, et autres
Publié: (2023)
Time Series Clustering with General State Space Models via Stochastic Variational Inference
par: Ishizuka, Ryoichi, et autres
Publié: (2024)
par: Ishizuka, Ryoichi, et autres
Publié: (2024)
Localising Dropout Variance in Twin Networks
par: Doyle, Cooper
Publié: (2025)
par: Doyle, Cooper
Publié: (2025)
A Mathematical Framework for Temporal Modeling and Counterfactual Policy Simulation of Student Dropout
par: da Silva, Rafael, et autres
Publié: (2026)
par: da Silva, Rafael, et autres
Publié: (2026)
Tracing the Path to Grokking: Embeddings, Dropout, and Network Activation
par: Salah, Ahmed, et autres
Publié: (2025)
par: Salah, Ahmed, et autres
Publié: (2025)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
par: Kumar, Ramnath, et autres
Publié: (2023)
par: Kumar, Ramnath, et autres
Publié: (2023)
A Combinatorial Theory of Dropout: Subnetworks, Graph Geometry, and Generalization
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
Toward Efficient Influence Function: Dropout as a Compression Tool
par: Zhang, Yuchen, et autres
Publié: (2025)
par: Zhang, Yuchen, et autres
Publié: (2025)
LoRA Dropout as a Sparsity Regularizer for Overfitting Control
par: Lin, Yang, et autres
Publié: (2024)
par: Lin, Yang, et autres
Publié: (2024)
Hybrid LSTM-Transformer Models for Profiling Highway-Railway Grade Crossings
par: Chatterjee, Kaustav, et autres
Publié: (2025)
par: Chatterjee, Kaustav, et autres
Publié: (2025)
Active Inference with Reusable State-Dependent Value Profiles
par: Poschl, Jacob
Publié: (2025)
par: Poschl, Jacob
Publié: (2025)
Eliciting Fine-Tuned Transformer Capabilities via Inference-Time Techniques
par: Sharma, Asankhaya
Publié: (2025)
par: Sharma, Asankhaya
Publié: (2025)
MCQ Difficulty Prediction via Modeling Learner Heterogeneity Using Data-Driven Cognitive Profiling
par: Krishnan, Dhriti, et autres
Publié: (2026)
par: Krishnan, Dhriti, et autres
Publié: (2026)
DynamicGate MLP Conditional Computation via Learned Structural Dropout and Input Dependent Gating for Functional Plasticity
par: Choi, Yong Il
Publié: (2026)
par: Choi, Yong Il
Publié: (2026)
Beating Transformers using Synthetic Cognition
par: Ibias, Alfredo, et autres
Publié: (2025)
par: Ibias, Alfredo, et autres
Publié: (2025)
Are Transformers More Robust? Towards Exact Robustness Verification for Transformers
par: Liao, Brian Hsuan-Cheng, et autres
Publié: (2022)
par: Liao, Brian Hsuan-Cheng, et autres
Publié: (2022)
Robust Simulation-Based Inference under Missing Data via Neural Processes
par: Verma, Yogesh, et autres
Publié: (2025)
par: Verma, Yogesh, et autres
Publié: (2025)
DeltaDQ: Ultra-High Delta Compression for Fine-Tuned LLMs via Group-wise Dropout and Separate Quantization
par: Jiang, Yanfeng, et autres
Publié: (2024)
par: Jiang, Yanfeng, et autres
Publié: (2024)
Robust Basis Spline Decoupling for the Compression of Transformer Models
par: De Jonghe, Joppe, et autres
Publié: (2026)
par: De Jonghe, Joppe, et autres
Publié: (2026)
Robust Stochastic Graph Generator for Counterfactual Explanations
par: Prado-Romero, Mario Alfonso, et autres
Publié: (2023)
par: Prado-Romero, Mario Alfonso, et autres
Publié: (2023)
Bayesian Inverse Problems Meet Flow Matching: Efficient and Flexible Inference via Transformers
par: Sherki, Daniil, et autres
Publié: (2025)
par: Sherki, Daniil, et autres
Publié: (2025)
CBMAS: Cognitive Behavioral Modeling via Activation Steering
par: Ismail, Ahmed H., et autres
Publié: (2026)
par: Ismail, Ahmed H., et autres
Publié: (2026)
Few-Shot Class Incremental Learning via Robust Transformer Approach
par: Paeedeh, Naeem, et autres
Publié: (2024)
par: Paeedeh, Naeem, et autres
Publié: (2024)
New probabilistic interest measures for association rules
par: Hahsler, Michael, et autres
Publié: (2008)
par: Hahsler, Michael, et autres
Publié: (2008)
Towards an Understanding of Stepwise Inference in Transformers: A Synthetic Graph Navigation Model
par: Khona, Mikail, et autres
Publié: (2024)
par: Khona, Mikail, et autres
Publié: (2024)
Partially Observable Gaussian Process Network and Doubly Stochastic Variational Inference
par: Kiroriwal, Saksham, et autres
Publié: (2025)
par: Kiroriwal, Saksham, et autres
Publié: (2025)
Scalable Bayesian Low-Rank Adaptation of Large Language Models via Stochastic Variational Subspace Inference
par: Samplawski, Colin, et autres
Publié: (2025)
par: Samplawski, Colin, et autres
Publié: (2025)
Uncertainty-Aware Decision Transformer for Stochastic Driving Environments
par: Li, Zenan, et autres
Publié: (2023)
par: Li, Zenan, et autres
Publié: (2023)
Cognitive Load-Aware Inference: A Neuro-Symbolic Framework for Optimizing the Token Economy of Large Language Models
par: Zhang, Yilun
Publié: (2025)
par: Zhang, Yilun
Publié: (2025)
Theoretical Insights in Model Inversion Robustness and Conditional Entropy Maximization for Collaborative Inference Systems
par: Xia, Song, et autres
Publié: (2025)
par: Xia, Song, et autres
Publié: (2025)
Adversarially Robust Decision Transformer
par: Tang, Xiaohang, et autres
Publié: (2024)
par: Tang, Xiaohang, et autres
Publié: (2024)
Accelerating Transformer Inference for Translation via Parallel Decoding
par: Santilli, Andrea, et autres
Publié: (2023)
par: Santilli, Andrea, et autres
Publié: (2023)
Motion Code: Robust Time Series Classification and Forecasting via Sparse Variational Multi-Stochastic Processes Learning
par: Bajaj, Chandrajit, et autres
Publié: (2024)
par: Bajaj, Chandrajit, et autres
Publié: (2024)
Learning with Embedded Linear Equality Constraints via Variational Bayesian Inference
par: Marsh, Matthew, et autres
Publié: (2026)
par: Marsh, Matthew, et autres
Publié: (2026)
Provably Robust and Plausible Counterfactual Explanations for Neural Networks via Robust Optimisation
par: Jiang, Junqi, et autres
Publié: (2023)
par: Jiang, Junqi, et autres
Publié: (2023)
NeuFair: Neural Network Fairness Repair with Dropout
par: Dasu, Vishnu Asutosh, et autres
Publié: (2024)
par: Dasu, Vishnu Asutosh, et autres
Publié: (2024)
Residual Koopman Spectral Profiling for Predicting and Preventing Transformer Training Instability
par: Kim, Bum Jun, et autres
Publié: (2026)
par: Kim, Bum Jun, et autres
Publié: (2026)
Activation by Interval-wise Dropout: A Simple Way to Prevent Neural Networks from Plasticity Loss
par: Park, Sangyeon, et autres
Publié: (2025)
par: Park, Sangyeon, et autres
Publié: (2025)
Transformer-Based Representation Learning for Robust Gene Expression Modeling and Cancer Prognosis
par: Jiang, Shuai, et autres
Publié: (2025)
par: Jiang, Shuai, et autres
Publié: (2025)
Documents similaires
-
AI Content Self-Detection for Transformer-based Large Language Models
par: Caiado, Antônio Junior Alves, et autres
Publié: (2023) -
Scale-Dropout: Estimating Uncertainty in Deep Neural Networks Using Stochastic Scale
par: Ahmed, Soyed Tuhin, et autres
Publié: (2023) -
Time Series Clustering with General State Space Models via Stochastic Variational Inference
par: Ishizuka, Ryoichi, et autres
Publié: (2024) -
Localising Dropout Variance in Twin Networks
par: Doyle, Cooper
Publié: (2025) -
A Mathematical Framework for Temporal Modeling and Counterfactual Policy Simulation of Student Dropout
par: da Silva, Rafael, et autres
Publié: (2026)