Adaptive Rational Activations to Boost Deep Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Delfosse, Quentin, Schramowski, Patrick, Mundt, Martin, Molina, Alejandro, Kersting, Kristian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2021
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HackAtari: Atari Learning Environments for Robust and Continual Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
Deep Classifier Mimicry without Data Access
di: Braun, Steven, et al.
Pubblicazione: (2023)
di: Braun, Steven, et al.
Pubblicazione: (2023)
Deep Reinforcement Learning via Object-Centric Attention
di: Blüml, Jannis, et al.
Pubblicazione: (2025)
di: Blüml, Jannis, et al.
Pubblicazione: (2025)
Boosting Object Representation Learning via Motion and Object Continuity
di: Delfosse, Quentin, et al.
Pubblicazione: (2022)
di: Delfosse, Quentin, et al.
Pubblicazione: (2022)
Interpretable and Editable Programmatic Tree Policies for Reinforcement Learning
di: Kohler, Hector, et al.
Pubblicazione: (2024)
di: Kohler, Hector, et al.
Pubblicazione: (2024)
Interpretable Concept Bottlenecks to Align Reinforcement Learning Agents
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
Boosting deep Reinforcement Learning using pretraining with Logical Options
di: Ye, Zihan, et al.
Pubblicazione: (2026)
di: Ye, Zihan, et al.
Pubblicazione: (2026)
OCAtari: Object-Centric Atari 2600 Reinforcement Learning Environments
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)
BlendRL: A Framework for Merging Symbolic and Neural Policy Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
LLMs Gaming Verifiers: RLVR can Lead to Reward Hacking
di: Helff, Lukas, et al.
Pubblicazione: (2026)
di: Helff, Lukas, et al.
Pubblicazione: (2026)
Deep Reinforcement Learning Agents are not even close to Human Intelligence
di: Delfosse, Quentin, et al.
Pubblicazione: (2025)
di: Delfosse, Quentin, et al.
Pubblicazione: (2025)
A Typology for Exploring the Mitigation of Shortcut Behavior
di: Friedrich, Felix, et al.
Pubblicazione: (2022)
di: Friedrich, Felix, et al.
Pubblicazione: (2022)
Self-Expanding Neural Networks
di: Mitchell, Rupert, et al.
Pubblicazione: (2023)
di: Mitchell, Rupert, et al.
Pubblicazione: (2023)
Pix2Code: Learning to Compose Neural Visual Concepts as Programs
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
Interpretable end-to-end Neurosymbolic Reinforcement Learning agents
di: Grandien, Nils, et al.
Pubblicazione: (2024)
di: Grandien, Nils, et al.
Pubblicazione: (2024)
SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
T-FREE: Subword Tokenizer-Free Generative LLMs via Sparse Representations for Memory-Efficient Embeddings
di: Deiseroth, Björn, et al.
Pubblicazione: (2024)
di: Deiseroth, Björn, et al.
Pubblicazione: (2024)
No Safe Dose: How Training Data Drives Unsafe Image Generation
di: Friedrich, Felix, et al.
Pubblicazione: (2026)
di: Friedrich, Felix, et al.
Pubblicazione: (2026)
ActivationReasoning: Logical Reasoning in Latent Activation Spaces
di: Helff, Lukas, et al.
Pubblicazione: (2025)
di: Helff, Lukas, et al.
Pubblicazione: (2025)
Tractable Representation Learning with Probabilistic Circuits
di: Braun, Steven, et al.
Pubblicazione: (2025)
di: Braun, Steven, et al.
Pubblicazione: (2025)
BOWL: A Deceptively Simple Open World Learner
di: Kamath, Roshni . R., et al.
Pubblicazione: (2024)
di: Kamath, Roshni . R., et al.
Pubblicazione: (2024)
Masked Autoencoders are Efficient Continual Federated Learners
di: Paul, Subarnaduti, et al.
Pubblicazione: (2023)
di: Paul, Subarnaduti, et al.
Pubblicazione: (2023)
Core Tokensets for Data-efficient Sequential Training of Transformers
di: Paul, Subarnaduti, et al.
Pubblicazione: (2024)
di: Paul, Subarnaduti, et al.
Pubblicazione: (2024)
LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models
di: Helff, Lukas, et al.
Pubblicazione: (2024)
di: Helff, Lukas, et al.
Pubblicazione: (2024)
OCALM: Object-Centric Assessment with Language Models
di: Kaufmann, Timo, et al.
Pubblicazione: (2024)
di: Kaufmann, Timo, et al.
Pubblicazione: (2024)
Beyond Overcorrection: Evaluating Diversity in T2I Models with DivBench
di: Friedrich, Felix, et al.
Pubblicazione: (2025)
di: Friedrich, Felix, et al.
Pubblicazione: (2025)
AtMan: Understanding Transformer Predictions Through Memory Efficient Attention Manipulation
di: Deiseroth, Björn, et al.
Pubblicazione: (2023)
di: Deiseroth, Björn, et al.
Pubblicazione: (2023)
Better Decisions through the Right Causal World Model
di: Dillies, Elisabeth, et al.
Pubblicazione: (2025)
di: Dillies, Elisabeth, et al.
Pubblicazione: (2025)
Where is the Truth? The Risk of Getting Confounded in a Continual World
di: Busch, Florian Peter, et al.
Pubblicazione: (2024)
di: Busch, Florian Peter, et al.
Pubblicazione: (2024)
Kintsugi: Learning Policies by Repairing Executable Knowledge Bases
di: Cao, Teng, et al.
Pubblicazione: (2026)
di: Cao, Teng, et al.
Pubblicazione: (2026)
Does CLIP Know My Face?
di: Hintersdorf, Dominik, et al.
Pubblicazione: (2022)
di: Hintersdorf, Dominik, et al.
Pubblicazione: (2022)
Scaling Probabilistic Circuits via Data Partitioning
di: Seng, Jonas, et al.
Pubblicazione: (2025)
di: Seng, Jonas, et al.
Pubblicazione: (2025)
Divergent Token Metrics: Measuring degradation to prune away LLM components -- and optimize quantization
di: Deiseroth, Björn, et al.
Pubblicazione: (2023)
di: Deiseroth, Björn, et al.
Pubblicazione: (2023)
Exploiting Cultural Biases via Homoglyphs in Text-to-Image Synthesis
di: Struppek, Lukas, et al.
Pubblicazione: (2022)
di: Struppek, Lukas, et al.
Pubblicazione: (2022)
DeiSAM: Segment Anything with Deictic Prompting
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
Multilingual Text-to-Image Generation Magnifies Gender Stereotypes and Prompt Engineering May Not Help You
di: Friedrich, Felix, et al.
Pubblicazione: (2024)
di: Friedrich, Felix, et al.
Pubblicazione: (2024)
How to Train your Text-to-Image Model: Evaluating Design Choices for Synthetic Training Captions
di: Brack, Manuel, et al.
Pubblicazione: (2025)
di: Brack, Manuel, et al.
Pubblicazione: (2025)
ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming
di: Tedeschi, Simone, et al.
Pubblicazione: (2024)
di: Tedeschi, Simone, et al.
Pubblicazione: (2024)
Human-Allied Relational Reinforcement Learning
di: Darvishvand, Fateme Golivand, et al.
Pubblicazione: (2025)
di: Darvishvand, Fateme Golivand, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HackAtari: Atari Learning Environments for Robust and Continual Reinforcement Learning
di: Delfosse, Quentin, et al.
Pubblicazione: (2024) -
GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2026) -
Deep Classifier Mimicry without Data Access
di: Braun, Steven, et al.
Pubblicazione: (2023) -
Deep Reinforcement Learning via Object-Centric Attention
di: Blüml, Jannis, et al.
Pubblicazione: (2025) -
Boosting Object Representation Learning via Motion and Object Continuity
di: Delfosse, Quentin, et al.
Pubblicazione: (2022)