Variable-Agnostic Causal Exploration for Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Nguyen, Minh Hoang, Le, Hung, Venkatesh, Svetha |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
por: Do, Dai, et al.
Publicado: (2025)
por: Do, Dai, et al.
Publicado: (2025)
Hybrid Cross-domain Robust Reinforcement Learning
por: Van, Linh Le Pham, et al.
Publicado: (2025)
por: Van, Linh Le Pham, et al.
Publicado: (2025)
DmC: Nearest Neighbor Guidance Diffusion Model for Offline Cross-domain Reinforcement Learning
por: Van, Linh Le Pham, et al.
Publicado: (2025)
por: Van, Linh Le Pham, et al.
Publicado: (2025)
Score-based Integrated Gradient for Root Cause Explanations of Outliers
por: Nguyen, Phuoc, et al.
Publicado: (2026)
por: Nguyen, Phuoc, et al.
Publicado: (2026)
Federated Domain Generalization with Latent Space Inversion
por: Palakkadavath, Ragja, et al.
Publicado: (2025)
por: Palakkadavath, Ragja, et al.
Publicado: (2025)
Beyond Surprise: Improving Exploration Through Surprise Novelty
por: Le, Hung, et al.
Publicado: (2023)
por: Le, Hung, et al.
Publicado: (2023)
Generating Realistic Tabular Data with Large Language Models
por: Nguyen, Dang, et al.
Publicado: (2024)
por: Nguyen, Dang, et al.
Publicado: (2024)
Causal-Aware Generative Adversarial Networks with Reinforcement Learning
por: Nguyen, Tu Anh Hoang, et al.
Publicado: (2025)
por: Nguyen, Tu Anh Hoang, et al.
Publicado: (2025)
Spectral Text Fusion: A Frequency-Aware Approach to Multimodal Time-Series Forecasting
por: Nguyen, Huu Hiep, et al.
Publicado: (2026)
por: Nguyen, Huu Hiep, et al.
Publicado: (2026)
Reasoning Under 1 Billion: Memory-Augmented Reinforcement Learning for Large Language Models
por: Le, Hung, et al.
Publicado: (2025)
por: Le, Hung, et al.
Publicado: (2025)
Causal Graph Learning via Distributional Invariance of Cause-Effect Relationship
por: Nguyen, Nang Hung, et al.
Publicado: (2026)
por: Nguyen, Nang Hung, et al.
Publicado: (2026)
Continual Fine-Tuning of Large Language Models via Program Memory
por: Le, Hung, et al.
Publicado: (2026)
por: Le, Hung, et al.
Publicado: (2026)
Adaptive Acquisition Selection for Bayesian Optimization with Large Language Models
por: Ngo, Giang, et al.
Publicado: (2026)
por: Ngo, Giang, et al.
Publicado: (2026)
Novel Kernel Models and Exact Representor Theory for Neural Networks Beyond the Over-Parameterized Regime
por: Shilton, Alistair, et al.
Publicado: (2024)
por: Shilton, Alistair, et al.
Publicado: (2024)
Stable Hadamard Memory: Revitalizing Memory-Augmented Agents for Reinforcement Learning
por: Le, Hung, et al.
Publicado: (2024)
por: Le, Hung, et al.
Publicado: (2024)
Large Language Models for Imbalanced Classification: Diversity makes the difference
por: Nguyen, Dang, et al.
Publicado: (2025)
por: Nguyen, Dang, et al.
Publicado: (2025)
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
por: Nguyen, Manh, et al.
Publicado: (2025)
por: Nguyen, Manh, et al.
Publicado: (2025)
Boosting Efficiency in Task-Agnostic Exploration through Causal Knowledge
por: Yang, Yupei, et al.
Publicado: (2024)
por: Yang, Yupei, et al.
Publicado: (2024)
Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
Learning Reconfigurable Representations for Multimodal Federated Learning with Missing Data
por: Nguyen, Duong M., et al.
Publicado: (2025)
por: Nguyen, Duong M., et al.
Publicado: (2025)
Learning Structural Causal Models from Ordering: Identifiable Flow Models
por: Le, Minh Khoa, et al.
Publicado: (2024)
por: Le, Minh Khoa, et al.
Publicado: (2024)
Agnostic Reinforcement Learning: Foundations and Algorithms
por: Li, Gene
Publicado: (2025)
por: Li, Gene
Publicado: (2025)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
por: Doan, Duc Kien, et al.
Publicado: (2025)
por: Doan, Duc Kien, et al.
Publicado: (2025)
Toward Cost-efficient Adaptive Clinical Trials in Knee Osteoarthritis with Reinforcement Learning
por: Nguyen, Khanh, et al.
Publicado: (2024)
por: Nguyen, Khanh, et al.
Publicado: (2024)
Efficient Identification of Direct Causal Parents via Invariance and Minimum Error Testing
por: Nguyen, Minh, et al.
Publicado: (2024)
por: Nguyen, Minh, et al.
Publicado: (2024)
Decoupled Continuous-Time Reinforcement Learning via Hamiltonian Flow
por: Nguyen, Minh
Publicado: (2026)
por: Nguyen, Minh
Publicado: (2026)
Model-Based Reinforcement Learning Under Confounding
por: Venkatesh, Nishanth, et al.
Publicado: (2025)
por: Venkatesh, Nishanth, et al.
Publicado: (2025)
The Role of Environment Access in Agnostic Reinforcement Learning
por: Krishnamurthy, Akshay, et al.
Publicado: (2025)
por: Krishnamurthy, Akshay, et al.
Publicado: (2025)
Scalable Variational Causal Discovery Unconstrained by Acyclicity
por: Hoang, Nu, et al.
Publicado: (2024)
por: Hoang, Nu, et al.
Publicado: (2024)
Enabling Causal Discovery in Post-Nonlinear Models with Normalizing Flows
por: Hoang, Nu, et al.
Publicado: (2024)
por: Hoang, Nu, et al.
Publicado: (2024)
Learning Probabilistic Symmetrization for Architecture Agnostic Equivariance
por: Kim, Jinwoo, et al.
Publicado: (2023)
por: Kim, Jinwoo, et al.
Publicado: (2023)
A Differential and Pointwise Control Approach to Reinforcement Learning
por: Nguyen, Minh, et al.
Publicado: (2024)
por: Nguyen, Minh, et al.
Publicado: (2024)
Causality-Aware Local Interpretable Model-Agnostic Explanations
por: Cinquini, Martina, et al.
Publicado: (2022)
por: Cinquini, Martina, et al.
Publicado: (2022)
Confounded Causal Imitation Learning with Instrumental Variables
por: Zeng, Yan, et al.
Publicado: (2025)
por: Zeng, Yan, et al.
Publicado: (2025)
In-context Exploration-Exploitation for Reinforcement Learning
por: Dai, Zhenwen, et al.
Publicado: (2024)
por: Dai, Zhenwen, et al.
Publicado: (2024)
Satisficing Exploration for Deep Reinforcement Learning
por: Arumugam, Dilip, et al.
Publicado: (2024)
por: Arumugam, Dilip, et al.
Publicado: (2024)
Reinforcement Learning by Guided Safe Exploration
por: Yang, Qisong, et al.
Publicado: (2023)
por: Yang, Qisong, et al.
Publicado: (2023)
SEval-NAS: A Search-Agnostic Evaluation for Neural Architecture Search
por: Mih, Atah Nuh, et al.
Publicado: (2026)
por: Mih, Atah Nuh, et al.
Publicado: (2026)
Large Language Models Prompting With Episodic Memory
por: Do, Dai, et al.
Publicado: (2024)
por: Do, Dai, et al.
Publicado: (2024)
Spectral Flattening Is All Muon Needs: How Orthogonalization Controls Learning Rate and Convergence
por: Nguyen, Tien-Phat, et al.
Publicado: (2026)
por: Nguyen, Tien-Phat, et al.
Publicado: (2026)
Ejemplares similares
-
SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
por: Do, Dai, et al.
Publicado: (2025) -
Hybrid Cross-domain Robust Reinforcement Learning
por: Van, Linh Le Pham, et al.
Publicado: (2025) -
DmC: Nearest Neighbor Guidance Diffusion Model for Offline Cross-domain Reinforcement Learning
por: Van, Linh Le Pham, et al.
Publicado: (2025) -
Score-based Integrated Gradient for Root Cause Explanations of Outliers
por: Nguyen, Phuoc, et al.
Publicado: (2026) -
Federated Domain Generalization with Latent Space Inversion
por: Palakkadavath, Ragja, et al.
Publicado: (2025)