Transductive Active Learning: Theory and Applications
Fuente:
arXiv
Salvato in:
| Autori principali: | Hübotter, Jonas, Sukhija, Bhavya, Treven, Lenart, As, Yarden, Krause, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Active Few-Shot Fine-Tuning
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
Simulation Priors for Data-Efficient Deep Learning
di: Treven, Lenart, et al.
Pubblicazione: (2025)
di: Treven, Lenart, et al.
Pubblicazione: (2025)
Sample-efficient and Scalable Exploration in Continuous-Time RL
di: Iten, Klemens, et al.
Pubblicazione: (2025)
di: Iten, Klemens, et al.
Pubblicazione: (2025)
Safe Exploration Using Bayesian World Models and Log-Barrier Optimization
di: As, Yarden, et al.
Pubblicazione: (2024)
di: As, Yarden, et al.
Pubblicazione: (2024)
ActSafe: Active Exploration with Safety Constraints for Reinforcement Learning
di: As, Yarden, et al.
Pubblicazione: (2024)
di: As, Yarden, et al.
Pubblicazione: (2024)
When to Sense and Control? A Time-adaptive Approach for Continuous-Time RL
di: Treven, Lenart, et al.
Pubblicazione: (2024)
di: Treven, Lenart, et al.
Pubblicazione: (2024)
NeoRL: Efficient Exploration for Nonepisodic RL
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
Bridging the Sim-to-Real Gap with Bayesian Inference
di: Rothfuss, Jonas, et al.
Pubblicazione: (2024)
di: Rothfuss, Jonas, et al.
Pubblicazione: (2024)
Model-Based Reinforcement Learning for Control under Time-Varying Dynamics
di: Iten, Klemens, et al.
Pubblicazione: (2026)
di: Iten, Klemens, et al.
Pubblicazione: (2026)
Probabilistic Artificial Intelligence
di: Krause, Andreas, et al.
Pubblicazione: (2025)
di: Krause, Andreas, et al.
Pubblicazione: (2025)
Efficiently Learning at Test-Time: Active Fine-Tuning of LLMs
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
SOMBRL: Scalable and Optimistic Model-Based RL
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2024)
Local Mixtures of Experts: Essentially Free Test-Time Training via Model Merging
di: Bertolissi, Ryo, et al.
Pubblicazione: (2025)
di: Bertolissi, Ryo, et al.
Pubblicazione: (2025)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
Learning Safety Constraints for Large Language Models
di: Chen, Xin, et al.
Pubblicazione: (2025)
di: Chen, Xin, et al.
Pubblicazione: (2025)
Learning on the Job: Test-Time Curricula for Targeted Reinforcement Learning
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
TARC: Time-Adaptive Robotic Control
di: Sukhija, Arnav, et al.
Pubblicazione: (2025)
di: Sukhija, Arnav, et al.
Pubblicazione: (2025)
Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning
di: Bhardwaj, Arjun, et al.
Pubblicazione: (2023)
di: Bhardwaj, Arjun, et al.
Pubblicazione: (2023)
Specialization after Generalization: Towards Understanding Test-Time Training in Foundation Models
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
Symmetry-Guided Memory Augmentation for Efficient Locomotion Learning
di: Bao, Kaixi, et al.
Pubblicazione: (2025)
di: Bao, Kaixi, et al.
Pubblicazione: (2025)
Aligning Language Models from User Interactions
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2026)
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2026)
Learning Soft Robotic Dynamics with Active Exploration
di: Zheng, Hehui, et al.
Pubblicazione: (2025)
di: Zheng, Hehui, et al.
Pubblicazione: (2025)
Active Fine-Tuning of Multi-Task Policies
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
Reinforcement Learning via Self-Distillation
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
Sampling-Based Safe Reinforcement Learning
di: Vignola, Luca, et al.
Pubblicazione: (2026)
di: Vignola, Luca, et al.
Pubblicazione: (2026)
Safe Exploration via Policy Priors
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
Transductive Reward Inference on Graph
di: Qu, Bohao, et al.
Pubblicazione: (2024)
di: Qu, Bohao, et al.
Pubblicazione: (2024)
ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning
di: Melikidze, Davit, et al.
Pubblicazione: (2026)
di: Melikidze, Davit, et al.
Pubblicazione: (2026)
Maximizing Prefix-Confidence at Test-Time Efficiently Improves Mathematical Reasoning
di: Otth, Matthias, et al.
Pubblicazione: (2025)
di: Otth, Matthias, et al.
Pubblicazione: (2025)
What Does Flow Matching Bring To TD Learning?
di: Agrawalla, Bhavya, et al.
Pubblicazione: (2026)
di: Agrawalla, Bhavya, et al.
Pubblicazione: (2026)
Test-time Offline Reinforcement Learning on Goal-related Experience
di: Bagatella, Marco, et al.
Pubblicazione: (2025)
di: Bagatella, Marco, et al.
Pubblicazione: (2025)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
di: Song, Yeda, et al.
Pubblicazione: (2024)
di: Song, Yeda, et al.
Pubblicazione: (2024)
LITE: Efficiently Estimating Gaussian Probability of Maximality
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
di: Menet, Nicolas, et al.
Pubblicazione: (2025)
When Does Non-Uniform Replay Matter in Reinforcement Learning?
di: Korniak, Michal, et al.
Pubblicazione: (2026)
di: Korniak, Michal, et al.
Pubblicazione: (2026)
Transduction is All You Need for Structured Data Workflows
di: Gliozzo, Alfio, et al.
Pubblicazione: (2025)
di: Gliozzo, Alfio, et al.
Pubblicazione: (2025)
ALVIN: Active Learning Via INterpolation
di: Korakakis, Michalis, et al.
Pubblicazione: (2024)
di: Korakakis, Michalis, et al.
Pubblicazione: (2024)
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
di: Li, Chenhao, et al.
Pubblicazione: (2025)
di: Li, Chenhao, et al.
Pubblicazione: (2025)
Transductive Confidence Machine and its application to Medical Data Sets
di: Lindsay, David
Pubblicazione: (2024)
di: Lindsay, David
Pubblicazione: (2024)
Learning Safety Constraints from Demonstrations with Unknown Rewards
di: Lindner, David, et al.
Pubblicazione: (2023)
di: Lindner, David, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Active Few-Shot Fine-Tuning
di: Hübotter, Jonas, et al.
Pubblicazione: (2024) -
Simulation Priors for Data-Efficient Deep Learning
di: Treven, Lenart, et al.
Pubblicazione: (2025) -
Sample-efficient and Scalable Exploration in Continuous-Time RL
di: Iten, Klemens, et al.
Pubblicazione: (2025) -
Safe Exploration Using Bayesian World Models and Log-Barrier Optimization
di: As, Yarden, et al.
Pubblicazione: (2024) -
ActSafe: Active Exploration with Safety Constraints for Reinforcement Learning
di: As, Yarden, et al.
Pubblicazione: (2024)