Twin-Boot: Uncertainty-Aware Optimization via Online Two-Sample Bootstrapping
Fuente:
arXiv
Salvato in:
| Autore principale: | Brito, Carlos Stein |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Direct Learning of Calibration-Aware Uncertainty for Neural PDE Surrogates
di: Brito, Carlos Stein
Pubblicazione: (2026)
di: Brito, Carlos Stein
Pubblicazione: (2026)
Scaling of learning time for high dimensional inputs
di: Brito, Carlos Stein
Pubblicazione: (2026)
di: Brito, Carlos Stein
Pubblicazione: (2026)
Precise Bayesian Neural Networks
di: Brito, Carlos Stein
Pubblicazione: (2025)
di: Brito, Carlos Stein
Pubblicazione: (2025)
Bootstrapping LLMs via Preference-Based Policy Optimization
di: Jia, Chen
Pubblicazione: (2025)
di: Jia, Chen
Pubblicazione: (2025)
VADE: Variance-Aware Dynamic Sampling via Online Sample-Level Difficulty Estimation for Multimodal RL
di: Hu, Zengjie, et al.
Pubblicazione: (2025)
di: Hu, Zengjie, et al.
Pubblicazione: (2025)
UCPO: Uncertainty-Aware Policy Optimization
di: Zeng, Xianzhou, et al.
Pubblicazione: (2026)
di: Zeng, Xianzhou, et al.
Pubblicazione: (2026)
Cross-regularization: Adaptive Model Complexity through Validation Gradients
di: Brito, Carlos Stein
Pubblicazione: (2025)
di: Brito, Carlos Stein
Pubblicazione: (2025)
Trustworthy Summarization via Uncertainty Quantification and Risk Awareness in Large Language Models
di: Pan, Shuaidong, et al.
Pubblicazione: (2025)
di: Pan, Shuaidong, et al.
Pubblicazione: (2025)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
POETS: Uncertainty-Aware LLM Optimization via Compute-Efficient Policy Ensembles
di: Menet, Nicolas, et al.
Pubblicazione: (2026)
di: Menet, Nicolas, et al.
Pubblicazione: (2026)
Sample-Efficient Online Learning in LM Agents via Hindsight Trajectory Rewriting
di: Hu, Michael Y., et al.
Pubblicazione: (2025)
di: Hu, Michael Y., et al.
Pubblicazione: (2025)
Majority of the Bests: Improving Best-of-N via Bootstrapping
di: Rakhsha, Amin, et al.
Pubblicazione: (2025)
di: Rakhsha, Amin, et al.
Pubblicazione: (2025)
Alignment through Meta-Weighted Online Sampling: Bridging the Gap between Data Generation and Preference Optimization
di: Yang, Junming, et al.
Pubblicazione: (2025)
di: Yang, Junming, et al.
Pubblicazione: (2025)
BootSeer: Analyzing and Mitigating Initialization Bottlenecks in Large-Scale LLM Training
di: Li, Rui, et al.
Pubblicazione: (2025)
di: Li, Rui, et al.
Pubblicazione: (2025)
Uncertainty-Aware Decoding with Minimum Bayes Risk
di: Daheim, Nico, et al.
Pubblicazione: (2025)
di: Daheim, Nico, et al.
Pubblicazione: (2025)
Estimation of Concept Explanations Should be Uncertainty Aware
di: Piratla, Vihari, et al.
Pubblicazione: (2023)
di: Piratla, Vihari, et al.
Pubblicazione: (2023)
How Uncertainty Estimation Scales with Sampling in Reasoning Models
di: Del, Maksym, et al.
Pubblicazione: (2026)
di: Del, Maksym, et al.
Pubblicazione: (2026)
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
BNEM: A Boltzmann Sampler Based on Bootstrapped Noised Energy Matching
di: OuYang, RuiKang, et al.
Pubblicazione: (2024)
di: OuYang, RuiKang, et al.
Pubblicazione: (2024)
Smart Sampling: Self-Attention and Bootstrapping for Improved Ensembled Q-Learning
di: Khan, Muhammad Junaid, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Junaid, et al.
Pubblicazione: (2024)
WIMLE: Uncertainty-Aware World Models with IMLE for Sample-Efficient Continuous Control
di: Aghabozorgi, Mehran, et al.
Pubblicazione: (2026)
di: Aghabozorgi, Mehran, et al.
Pubblicazione: (2026)
Uncertainty-Aware Testing-Time Optimization for 3D Human Pose Estimation
di: Wang, Ti, et al.
Pubblicazione: (2024)
di: Wang, Ti, et al.
Pubblicazione: (2024)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
di: Qi, Biqing, et al.
Pubblicazione: (2024)
di: Qi, Biqing, et al.
Pubblicazione: (2024)
Learning Scenario Reduction for Two-Stage Robust Optimization with Discrete Uncertainty
di: Lin, Tianjue, et al.
Pubblicazione: (2026)
di: Lin, Tianjue, et al.
Pubblicazione: (2026)
Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs
di: Wang, Yinong Oliver, et al.
Pubblicazione: (2025)
di: Wang, Yinong Oliver, et al.
Pubblicazione: (2025)
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
di: Yao, Jiarui, et al.
Pubblicazione: (2025)
di: Yao, Jiarui, et al.
Pubblicazione: (2025)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
di: Yuan, Zhihang, et al.
Pubblicazione: (2026)
di: Yuan, Zhihang, et al.
Pubblicazione: (2026)
RewardUQ: A Unified Framework for Uncertainty-Aware Reward Models
di: Yang, Daniel, et al.
Pubblicazione: (2026)
di: Yang, Daniel, et al.
Pubblicazione: (2026)
Manifold Sampling via Entropy Maximization
di: Braun, Cornelius V., et al.
Pubblicazione: (2026)
di: Braun, Cornelius V., et al.
Pubblicazione: (2026)
Dynamic Environment Responsive Online Meta-Learning with Fairness Awareness
di: Zhao, Chen, et al.
Pubblicazione: (2024)
di: Zhao, Chen, et al.
Pubblicazione: (2024)
TharuChat: Bootstrapping Large Language Models for a Low-Resource Language via Synthetic Data and Human Validation
di: Panth, Prajwal, et al.
Pubblicazione: (2026)
di: Panth, Prajwal, et al.
Pubblicazione: (2026)
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
di: Huang, Chengyu, et al.
Pubblicazione: (2025)
di: Huang, Chengyu, et al.
Pubblicazione: (2025)
Uncertainty-Aware Fusion: An Ensemble Framework for Mitigating Hallucinations in Large Language Models
di: Dey, Prasenjit, et al.
Pubblicazione: (2025)
di: Dey, Prasenjit, et al.
Pubblicazione: (2025)
Fast Calibrated Explanations: Efficient and Uncertainty-Aware Explanations for Machine Learning Models
di: Löfström, Tuwe, et al.
Pubblicazione: (2024)
di: Löfström, Tuwe, et al.
Pubblicazione: (2024)
Uncertainty Aware Neural Network from Similarity and Sensitivity
di: Kabir, H M Dipu, et al.
Pubblicazione: (2023)
di: Kabir, H M Dipu, et al.
Pubblicazione: (2023)
Optimizing Decoding Paths in Masked Diffusion Models by Quantifying Uncertainty
di: Chen, Ziyu, et al.
Pubblicazione: (2025)
di: Chen, Ziyu, et al.
Pubblicazione: (2025)
GIFT: Bootstrapping Image-to-CAD Program Synthesis via Geometric Feedback
di: Giannone, Giorgio, et al.
Pubblicazione: (2026)
di: Giannone, Giorgio, et al.
Pubblicazione: (2026)
Online GPU Energy Optimization with Switching-Aware Bandits
di: Xu, Xiongxiao, et al.
Pubblicazione: (2024)
di: Xu, Xiongxiao, et al.
Pubblicazione: (2024)
LLM-Guided Semantic Bootstrapping for Interpretable Text Classification with Tsetlin Machines
di: Gao, Jiechao, et al.
Pubblicazione: (2026)
di: Gao, Jiechao, et al.
Pubblicazione: (2026)
Uncertainty-Aware Explainable Federated Learning
di: Zhang, Yanci, et al.
Pubblicazione: (2025)
di: Zhang, Yanci, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Direct Learning of Calibration-Aware Uncertainty for Neural PDE Surrogates
di: Brito, Carlos Stein
Pubblicazione: (2026) -
Scaling of learning time for high dimensional inputs
di: Brito, Carlos Stein
Pubblicazione: (2026) -
Precise Bayesian Neural Networks
di: Brito, Carlos Stein
Pubblicazione: (2025) -
Bootstrapping LLMs via Preference-Based Policy Optimization
di: Jia, Chen
Pubblicazione: (2025) -
VADE: Variance-Aware Dynamic Sampling via Online Sample-Level Difficulty Estimation for Multimodal RL
di: Hu, Zengjie, et al.
Pubblicazione: (2025)