Improving Uncertainty Estimation through Semantically Diverse Language Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Aichberger, Lukas, Schweighofer, Kajetan, Ielanskyi, Mykyta, Hochreiter, Sepp |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Addressing Pitfalls in the Evaluation of Uncertainty Estimation Methods for Natural Language Generation
par: Ielanskyi, Mykyta, et autres
Publié: (2025)
par: Ielanskyi, Mykyta, et autres
Publié: (2025)
On Information-Theoretic Measures of Predictive Uncertainty
par: Schweighofer, Kajetan, et autres
Publié: (2024)
par: Schweighofer, Kajetan, et autres
Publié: (2024)
Rethinking Uncertainty Estimation in LLMs: A Principled Single-Sequence Measure
par: Aichberger, Lukas, et autres
Publié: (2024)
par: Aichberger, Lukas, et autres
Publié: (2024)
The Disparate Benefits of Deep Ensembles
par: Schweighofer, Kajetan, et autres
Publié: (2024)
par: Schweighofer, Kajetan, et autres
Publié: (2024)
Unlocking the Working Memory of Large Language Models for Latent Reasoning
par: Aichberger, Lukas, et autres
Publié: (2026)
par: Aichberger, Lukas, et autres
Publié: (2026)
Uncertainty Quantification for Regression using Proper Scoring Rules
par: Fishkov, Alexander, et autres
Publié: (2025)
par: Fishkov, Alexander, et autres
Publié: (2025)
xLSTM Scaling Laws: Competitive Performance with Linear Time-Complexity
par: Beck, Maximilian, et autres
Publié: (2025)
par: Beck, Maximilian, et autres
Publié: (2025)
Efficient Pre-Training of LLMs through Truncated SVD Layers
par: Kamali, Kaivan, et autres
Publié: (2026)
par: Kamali, Kaivan, et autres
Publié: (2026)
MolecularIQ: Characterizing Chemical Reasoning Capabilities Through Symbolic Verification on Molecular Graphs
par: Bartmann, Christoph, et autres
Publié: (2026)
par: Bartmann, Christoph, et autres
Publié: (2026)
Overcoming Forgetting in LLM Fine-Tuning with Evolution Strategies
par: Schweighofer, Kajetan, et autres
Publié: (2026)
par: Schweighofer, Kajetan, et autres
Publié: (2026)
FlashRNN: I/O-Aware Optimization of Traditional RNNs on modern hardware
par: Pöppel, Korbinian, et autres
Publié: (2024)
par: Pöppel, Korbinian, et autres
Publié: (2024)
Rethinking Losses for Diffusion Bridge Samplers
par: Sanokowski, Sebastian, et autres
Publié: (2025)
par: Sanokowski, Sebastian, et autres
Publié: (2025)
Safe and Certifiable AI Systems: Concepts, Challenges, and Lessons Learned
par: Schweighofer, Kajetan, et autres
Publié: (2025)
par: Schweighofer, Kajetan, et autres
Publié: (2025)
A Diffusion Model Framework for Unsupervised Neural Combinatorial Optimization
par: Sanokowski, Sebastian, et autres
Publié: (2024)
par: Sanokowski, Sebastian, et autres
Publié: (2024)
MIM-Refiner: A Contrastive Learning Boost from Intermediate Pre-Trained Representations
par: Alkin, Benedikt, et autres
Publié: (2024)
par: Alkin, Benedikt, et autres
Publié: (2024)
Contrastive Abstraction for Reinforcement Learning
par: Patil, Vihang, et autres
Publié: (2024)
par: Patil, Vihang, et autres
Publié: (2024)
Tiled Flash Linear Attention: More Efficient Linear RNN and xLSTM Kernels
par: Beck, Maximilian, et autres
Publié: (2025)
par: Beck, Maximilian, et autres
Publié: (2025)
Large Language Models Can Self-Improve At Web Agent Tasks
par: Patel, Ajay, et autres
Publié: (2024)
par: Patel, Ajay, et autres
Publié: (2024)
Parameter Efficient Fine-tuning via Explained Variance Adaptation
par: Paischer, Fabian, et autres
Publié: (2024)
par: Paischer, Fabian, et autres
Publié: (2024)
Vision-LSTM: xLSTM as Generic Vision Backbone
par: Alkin, Benedikt, et autres
Publié: (2024)
par: Alkin, Benedikt, et autres
Publié: (2024)
Retrieval-Augmented Decision Transformer: External Memory for In-context RL
par: Schmied, Thomas, et autres
Publié: (2024)
par: Schmied, Thomas, et autres
Publié: (2024)
VN-EGNN: E(3)-Equivariant Graph Neural Networks with Virtual Nodes Enhance Protein Binding Site Identification
par: Sestak, Florian, et autres
Publié: (2024)
par: Sestak, Florian, et autres
Publié: (2024)
Improving Instruction Following in Language Models through Proxy-Based Uncertainty Estimation
par: Lee, JoonHo, et autres
Publié: (2024)
par: Lee, JoonHo, et autres
Publié: (2024)
Improving Uncertainty Quantification in Large Language Models via Semantic Embeddings
par: Grewal, Yashvir S., et autres
Publié: (2024)
par: Grewal, Yashvir S., et autres
Publié: (2024)
REPEAT: Improving Uncertainty Estimation in Representation Learning Explainability
par: Wickstrøm, Kristoffer K., et autres
Publié: (2024)
par: Wickstrøm, Kristoffer K., et autres
Publié: (2024)
From Entropy to Calibrated Uncertainty: Training Language Models to Reason About Uncertainty
par: Jenane, Azza, et autres
Publié: (2026)
par: Jenane, Azza, et autres
Publié: (2026)
A Large Recurrent Action Model: xLSTM enables Fast Inference for Robotics Tasks
par: Schmied, Thomas, et autres
Publié: (2024)
par: Schmied, Thomas, et autres
Publié: (2024)
xLSTM: Extended Long Short-Term Memory
par: Beck, Maximilian, et autres
Publié: (2024)
par: Beck, Maximilian, et autres
Publié: (2024)
Bio-xLSTM: Generative modeling, representation and in-context learning of biological and chemical sequences
par: Schmidinger, Niklas, et autres
Publié: (2024)
par: Schmidinger, Niklas, et autres
Publié: (2024)
SymbolicAI: A framework for logic-based approaches combining generative models and solvers
par: Dinu, Marius-Constantin, et autres
Publié: (2024)
par: Dinu, Marius-Constantin, et autres
Publié: (2024)
Improving Counterfactual Truthfulness for Molecular Property Prediction through Uncertainty Quantification
par: Teufel, Jonas, et autres
Publié: (2025)
par: Teufel, Jonas, et autres
Publié: (2025)
General Uncertainty Estimation with Delta Variances
par: Schmitt, Simon, et autres
Publié: (2025)
par: Schmitt, Simon, et autres
Publié: (2025)
Scalable Discrete Diffusion Samplers: Combinatorial Optimization and Statistical Physics
par: Sanokowski, Sebastian, et autres
Publié: (2025)
par: Sanokowski, Sebastian, et autres
Publié: (2025)
Generalised Probabilistic Modelling and Improved Uncertainty Estimation in Comparative LLM-as-a-judge
par: Fathullah, Yassir, et autres
Publié: (2025)
par: Fathullah, Yassir, et autres
Publié: (2025)
xLSTM 7B: A Recurrent LLM for Fast and Efficient Inference
par: Beck, Maximilian, et autres
Publié: (2025)
par: Beck, Maximilian, et autres
Publié: (2025)
Learning Expressive Priors for Generalization and Uncertainty Estimation in Neural Networks
par: Schnaus, Dominik, et autres
Publié: (2023)
par: Schnaus, Dominik, et autres
Publié: (2023)
Overcoming Saturation in Density Ratio Estimation by Iterated Regularization
par: Gruber, Lukas, et autres
Publié: (2024)
par: Gruber, Lukas, et autres
Publié: (2024)
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
par: Park, Seonghyeon, et autres
Publié: (2026)
par: Park, Seonghyeon, et autres
Publié: (2026)
Entropy-Guided Loop: Achieving Reasoning through Uncertainty-Aware Generation
par: Correa, Andrew G. A., et autres
Publié: (2025)
par: Correa, Andrew G. A., et autres
Publié: (2025)
FFHFlow: Diverse and Uncertainty-Aware Dexterous Grasp Generation via Flow Variational Inference
par: Feng, Qian, et autres
Publié: (2024)
par: Feng, Qian, et autres
Publié: (2024)
Documents similaires
-
Addressing Pitfalls in the Evaluation of Uncertainty Estimation Methods for Natural Language Generation
par: Ielanskyi, Mykyta, et autres
Publié: (2025) -
On Information-Theoretic Measures of Predictive Uncertainty
par: Schweighofer, Kajetan, et autres
Publié: (2024) -
Rethinking Uncertainty Estimation in LLMs: A Principled Single-Sequence Measure
par: Aichberger, Lukas, et autres
Publié: (2024) -
The Disparate Benefits of Deep Ensembles
par: Schweighofer, Kajetan, et autres
Publié: (2024) -
Unlocking the Working Memory of Large Language Models for Latent Reasoning
par: Aichberger, Lukas, et autres
Publié: (2026)