Beyond Surprise: Improving Exploration Through Surprise Novelty
Fuente:
arXiv
Saved in:
| Main Authors: | Le, Hung, Do, Kien, Nguyen, Dung, Venkatesh, Svetha |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Stable Hadamard Memory: Revitalizing Memory-Augmented Agents for Reinforcement Learning
by: Le, Hung, et al.
Published: (2024)
by: Le, Hung, et al.
Published: (2024)
Enhancing Length Extrapolation in Sequential Models with Pointer-Augmented Neural Memory
by: Le, Hung, et al.
Published: (2024)
by: Le, Hung, et al.
Published: (2024)
Reasoning Under 1 Billion: Memory-Augmented Reinforcement Learning for Large Language Models
by: Le, Hung, et al.
Published: (2025)
by: Le, Hung, et al.
Published: (2025)
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
by: Nguyen, Manh, et al.
Published: (2025)
by: Nguyen, Manh, et al.
Published: (2025)
Multi-Reference Preference Optimization for Large Language Models
by: Le, Hung, et al.
Published: (2024)
by: Le, Hung, et al.
Published: (2024)
Variable-Agnostic Causal Exploration for Reinforcement Learning
by: Nguyen, Minh Hoang, et al.
Published: (2024)
by: Nguyen, Minh Hoang, et al.
Published: (2024)
Revisiting the Dataset Bias Problem from a Statistical Perspective
by: Do, Kien, et al.
Published: (2024)
by: Do, Kien, et al.
Published: (2024)
SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
by: Do, Dai, et al.
Published: (2025)
by: Do, Dai, et al.
Published: (2025)
Continual Fine-Tuning of Large Language Models via Program Memory
by: Le, Hung, et al.
Published: (2026)
by: Le, Hung, et al.
Published: (2026)
Generating Realistic Tabular Data with Large Language Models
by: Nguyen, Dang, et al.
Published: (2024)
by: Nguyen, Dang, et al.
Published: (2024)
Reviving Error Correction in Modern Deep Time-Series Forecasting
by: Nguyen, Minh Hoang, et al.
Published: (2026)
by: Nguyen, Minh Hoang, et al.
Published: (2026)
Large Language Models for Imbalanced Classification: Diversity makes the difference
by: Nguyen, Dang, et al.
Published: (2025)
by: Nguyen, Dang, et al.
Published: (2025)
Finding the Trigger: Causal Abductive Reasoning on Video Events
by: Le, Thao Minh, et al.
Published: (2025)
by: Le, Thao Minh, et al.
Published: (2025)
Variational Flow Models: Flowing in Your Style
by: Do, Kien, et al.
Published: (2024)
by: Do, Kien, et al.
Published: (2024)
Bayesian Optimistic Optimisation with Exponentially Decaying Regret
by: Tran-The, Hung, et al.
Published: (2021)
by: Tran-The, Hung, et al.
Published: (2021)
Trading Convergence Rate with Computational Budget in High Dimensional Bayesian Optimization
by: Tran-The, Hung, et al.
Published: (2019)
by: Tran-The, Hung, et al.
Published: (2019)
Surprisal-Rényi Free Energy
by: Matsumoto, Shion, et al.
Published: (2026)
by: Matsumoto, Shion, et al.
Published: (2026)
Federated Domain Generalization with Latent Space Inversion
by: Palakkadavath, Ragja, et al.
Published: (2025)
by: Palakkadavath, Ragja, et al.
Published: (2025)
Regret Bounds for Expected Improvement Algorithms in Gaussian Process Bandit Optimization
by: Tran-The, Hung, et al.
Published: (2022)
by: Tran-The, Hung, et al.
Published: (2022)
Autolearn: Learn by Surprise, Commit by Proof
by: Choi, Kang-Sin
Published: (2026)
by: Choi, Kang-Sin
Published: (2026)
Novel Kernel Models and Exact Representor Theory for Neural Networks Beyond the Over-Parameterized Regime
by: Shilton, Alistair, et al.
Published: (2024)
by: Shilton, Alistair, et al.
Published: (2024)
Score-based Integrated Gradient for Root Cause Explanations of Outliers
by: Nguyen, Phuoc, et al.
Published: (2026)
by: Nguyen, Phuoc, et al.
Published: (2026)
Predicting the Reliability of an Image Classifier under Image Distortion
by: Nguyen, Dang, et al.
Published: (2024)
by: Nguyen, Dang, et al.
Published: (2024)
SuS: Strategy-aware Surprise for Intrinsic Exploration
by: Kashirskiy, Mark, et al.
Published: (2026)
by: Kashirskiy, Mark, et al.
Published: (2026)
Surprisingly Strong Performance Prediction with Neural Graph Features
by: Kadlecová, Gabriela, et al.
Published: (2024)
by: Kadlecová, Gabriela, et al.
Published: (2024)
Sub-linear Regret Bounds for Bayesian Optimisation in Unknown Search Spaces
by: Tran-The, Hung, et al.
Published: (2020)
by: Tran-The, Hung, et al.
Published: (2020)
Hear Both Sides: Efficient Multi-Agent Debate via Diversity-Aware Message Retention
by: Nguyen, Manh, et al.
Published: (2026)
by: Nguyen, Manh, et al.
Published: (2026)
Visually Prompted Benchmarks Are Surprisingly Fragile
by: Feng, Haiwen, et al.
Published: (2025)
by: Feng, Haiwen, et al.
Published: (2025)
The Surprising Effectiveness of Skip-Tuning in Diffusion Sampling
by: Ma, Jiajun, et al.
Published: (2024)
by: Ma, Jiajun, et al.
Published: (2024)
On Surprising Effectiveness of Masking Updates in Adaptive Optimizers
by: Joo, Taejong, et al.
Published: (2026)
by: Joo, Taejong, et al.
Published: (2026)
World Model Robustness via Surprise Recognition
by: Zollicoffer, Geigh, et al.
Published: (2025)
by: Zollicoffer, Geigh, et al.
Published: (2025)
The Surprising Effectiveness of Negative Reinforcement in LLM Reasoning
by: Zhu, Xinyu, et al.
Published: (2025)
by: Zhu, Xinyu, et al.
Published: (2025)
The Surprising Harmfulness of Benign Overfitting for Adversarial Robustness
by: Hao, Yifan, et al.
Published: (2024)
by: Hao, Yifan, et al.
Published: (2024)
Surprise Potential as a Measure of Interactivity in Driving Scenarios
by: Ding, Wenhao, et al.
Published: (2025)
by: Ding, Wenhao, et al.
Published: (2025)
Mutual Information Surprise: Rethinking Unexpectedness in Autonomous Systems
by: Wang, Yinsong, et al.
Published: (2025)
by: Wang, Yinsong, et al.
Published: (2025)
Surprise-Adaptive Intrinsic Motivation for Unsupervised Reinforcement Learning
by: Hugessen, Adriana, et al.
Published: (2024)
by: Hugessen, Adriana, et al.
Published: (2024)
ChargeFlow: Flow-Matching Refinement of Charge-Conditioned Electron Densities
by: Nguyen, Tri Minh, et al.
Published: (2026)
by: Nguyen, Tri Minh, et al.
Published: (2026)
Accelerating Long-Term Molecular Dynamics with Physics-Informed Time-Series Forecasting
by: Le, Hung, et al.
Published: (2025)
by: Le, Hung, et al.
Published: (2025)
Using Surprise Index for Competency Assessment in Autonomous Decision-Making
by: Ratheesh, Akash, et al.
Published: (2023)
by: Ratheesh, Akash, et al.
Published: (2023)
Surprisal Driven $k$-NN for Robust and Interpretable Nonparametric Learning
by: Banerjee, Amartya, et al.
Published: (2023)
by: Banerjee, Amartya, et al.
Published: (2023)
Similar Items
-
Stable Hadamard Memory: Revitalizing Memory-Augmented Agents for Reinforcement Learning
by: Le, Hung, et al.
Published: (2024) -
Enhancing Length Extrapolation in Sequential Models with Pointer-Augmented Neural Memory
by: Le, Hung, et al.
Published: (2024) -
Reasoning Under 1 Billion: Memory-Augmented Reinforcement Learning for Large Language Models
by: Le, Hung, et al.
Published: (2025) -
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
by: Nguyen, Manh, et al.
Published: (2025) -
Multi-Reference Preference Optimization for Large Language Models
by: Le, Hung, et al.
Published: (2024)