Epistemically-guided forward-backward exploration
Fuente:
arXiv
Salvato in:
| Autori principali: | Urpí, Núria Armengol, Vlastelica, Marin, Martius, Georg, Coros, Stelian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Causal Action Influence Aware Counterfactual Data Augmentation
di: Urpí, Núria Armengol, et al.
Pubblicazione: (2024)
di: Urpí, Núria Armengol, et al.
Pubblicazione: (2024)
Maximum Entropy Behavior Exploration for Sim2Real Zero-Shot Reinforcement Learning
di: Hu, Jiajun, et al.
Pubblicazione: (2026)
di: Hu, Jiajun, et al.
Pubblicazione: (2026)
Dual-Force: Enhanced Offline Diversity Maximization under Imitation Constraints
di: Kolev, Pavel, et al.
Pubblicazione: (2025)
di: Kolev, Pavel, et al.
Pubblicazione: (2025)
Offline Diversity Maximization Under Imitation Constraints
di: Vlastelica, Marin, et al.
Pubblicazione: (2023)
di: Vlastelica, Marin, et al.
Pubblicazione: (2023)
CAIMAN: Causal Action Influence Detection for Sample-efficient Loco-manipulation
di: Yuan, Yuanchen, et al.
Pubblicazione: (2025)
di: Yuan, Yuanchen, et al.
Pubblicazione: (2025)
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
Beyond Binary: Sim-to-Real Dexterous Manipulation with Physics-Grounded Contact Representation
di: Pan, Jiahe, et al.
Pubblicazione: (2026)
di: Pan, Jiahe, et al.
Pubblicazione: (2026)
RobotKeyframing: Learning Locomotion with High-Level Objectives via Mixture of Dense and Sparse Rewards
di: Zargarbashi, Fatemeh, et al.
Pubblicazione: (2024)
di: Zargarbashi, Fatemeh, et al.
Pubblicazione: (2024)
Preferential subspace identification (PSID) with forward-backward smoothing
di: Sani, Omid G., et al.
Pubblicazione: (2025)
di: Sani, Omid G., et al.
Pubblicazione: (2025)
Simulation Priors for Data-Efficient Deep Learning
di: Treven, Lenart, et al.
Pubblicazione: (2025)
di: Treven, Lenart, et al.
Pubblicazione: (2025)
Safe Exploration via Policy Priors
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
Momentum-Conserving Graph Neural Networks for Deformable Objects
di: Wang, Jiahong, et al.
Pubblicazione: (2026)
di: Wang, Jiahong, et al.
Pubblicazione: (2026)
Differentiation of Blackbox Combinatorial Solvers
di: Vlastelica, Marin, et al.
Pubblicazione: (2019)
di: Vlastelica, Marin, et al.
Pubblicazione: (2019)
Deep-layer limit and stability analysis of the basic forward-backward-splitting induced network (II): learning problems
di: Lin, Xuan, et al.
Pubblicazione: (2026)
di: Lin, Xuan, et al.
Pubblicazione: (2026)
Offline vs. Online Learning in Model-based RL: Lessons for Data Collection Strategies
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
di: Chen, Jiaqi, et al.
Pubblicazione: (2025)
FLoRA: Fused forward-backward adapters for parameter efficient fine-tuning and reducing inference-time latencies of LLMs
di: Gowda, Dhananjaya, et al.
Pubblicazione: (2025)
di: Gowda, Dhananjaya, et al.
Pubblicazione: (2025)
VQ-Style: Disentangling Style and Content in Motion with Residual Quantized Representations
di: Zargarbashi, Fatemeh, et al.
Pubblicazione: (2026)
di: Zargarbashi, Fatemeh, et al.
Pubblicazione: (2026)
Forecasting in Offline Reinforcement Learning for Non-stationary Environments
di: Ada, Suzan Ece, et al.
Pubblicazione: (2025)
di: Ada, Suzan Ece, et al.
Pubblicazione: (2025)
Optimizing Rank-based Metrics with Blackbox Differentiation
di: Rolínek, Michal, et al.
Pubblicazione: (2019)
di: Rolínek, Michal, et al.
Pubblicazione: (2019)
Early prediction of the risk of ICU mortality with Deep Federated Learning
di: Randl, Korbinian, et al.
Pubblicazione: (2022)
di: Randl, Korbinian, et al.
Pubblicazione: (2022)
Scaling Laws and Tradeoffs in Recurrent Networks of Expressive Neurons
di: Spieler, Aaron, et al.
Pubblicazione: (2026)
di: Spieler, Aaron, et al.
Pubblicazione: (2026)
Backpropagation through Combinatorial Algorithms: Identity with Projection Works
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2022)
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2022)
Learning 3D-Gaussian Simulators from RGB Videos
di: Zhobro, Mikel, et al.
Pubblicazione: (2025)
di: Zhobro, Mikel, et al.
Pubblicazione: (2025)
Quagmires in SFT-RL Post-Training: When High SFT Scores Mislead and What to Use Instead
di: Kang, Feiyang, et al.
Pubblicazione: (2025)
di: Kang, Feiyang, et al.
Pubblicazione: (2025)
Entropy-guided sequence weighting for efficient exploration in RL-based LLM fine-tuning
di: Vanlioglu, Abdullah
Pubblicazione: (2025)
di: Vanlioglu, Abdullah
Pubblicazione: (2025)
Multi-View Causal Representation Learning with Partial Observability
di: Yao, Dingling, et al.
Pubblicazione: (2023)
di: Yao, Dingling, et al.
Pubblicazione: (2023)
Problem Space Transformations for Out-of-Distribution Generalisation in Behavioural Cloning
di: Doshi, Kiran, et al.
Pubblicazione: (2024)
di: Doshi, Kiran, et al.
Pubblicazione: (2024)
Mixed precision accumulation for neural network inference guided by componentwise forward error analysis
di: Arar, El-Mehdi El, et al.
Pubblicazione: (2025)
di: Arar, El-Mehdi El, et al.
Pubblicazione: (2025)
The Expressive Leaky Memory Neuron: an Efficient and Expressive Phenomenological Neuron Model Can Solve Long-Horizon Tasks
di: Spieler, Aaron, et al.
Pubblicazione: (2023)
di: Spieler, Aaron, et al.
Pubblicazione: (2023)
Temporally Consistent Object-Centric Learning by Contrasting Slots
di: Manasyan, Anna, et al.
Pubblicazione: (2024)
di: Manasyan, Anna, et al.
Pubblicazione: (2024)
Quantifying Epistemic Uncertainty in Diffusion Models
di: Gupta, Aditi, et al.
Pubblicazione: (2026)
di: Gupta, Aditi, et al.
Pubblicazione: (2026)
Epistemic Uncertainty for Test-Time Discovery
di: Riaz, Kainat, et al.
Pubblicazione: (2026)
di: Riaz, Kainat, et al.
Pubblicazione: (2026)
Epistemic Monte Carlo Tree Search
di: Oren, Yaniv, et al.
Pubblicazione: (2022)
di: Oren, Yaniv, et al.
Pubblicazione: (2022)
Soft-Label Training Preserves Epistemic Uncertainty
di: Singh, Agamdeep, et al.
Pubblicazione: (2025)
di: Singh, Agamdeep, et al.
Pubblicazione: (2025)
Decomposing Epistemic Uncertainty for Causal Decision Making
di: Rahman, Md Musfiqur, et al.
Pubblicazione: (2026)
di: Rahman, Md Musfiqur, et al.
Pubblicazione: (2026)
Ensured: Explanations for Decreasing the Epistemic Uncertainty in Predictions
di: Löfström, Helena, et al.
Pubblicazione: (2024)
di: Löfström, Helena, et al.
Pubblicazione: (2024)
The Propensity for Density in Feed-forward Models
di: Schoots, Nandi, et al.
Pubblicazione: (2024)
di: Schoots, Nandi, et al.
Pubblicazione: (2024)
Advancing Out-of-Distribution Detection via Local Neuroplasticity
di: Canevaro, Alessandro, et al.
Pubblicazione: (2025)
di: Canevaro, Alessandro, et al.
Pubblicazione: (2025)
Systematic Relational Reasoning With Epistemic Graph Neural Networks
di: Khalid, Irtaza, et al.
Pubblicazione: (2024)
di: Khalid, Irtaza, et al.
Pubblicazione: (2024)
On the Epistemic Uncertainty of Overparametrized Neural Networks
di: Rügamer, David
Pubblicazione: (2026)
di: Rügamer, David
Pubblicazione: (2026)
Documenti analoghi
-
Causal Action Influence Aware Counterfactual Data Augmentation
di: Urpí, Núria Armengol, et al.
Pubblicazione: (2024) -
Maximum Entropy Behavior Exploration for Sim2Real Zero-Shot Reinforcement Learning
di: Hu, Jiajun, et al.
Pubblicazione: (2026) -
Dual-Force: Enhanced Offline Diversity Maximization under Imitation Constraints
di: Kolev, Pavel, et al.
Pubblicazione: (2025) -
Offline Diversity Maximization Under Imitation Constraints
di: Vlastelica, Marin, et al.
Pubblicazione: (2023) -
CAIMAN: Causal Action Influence Detection for Sample-efficient Loco-manipulation
di: Yuan, Yuanchen, et al.
Pubblicazione: (2025)