Enregistré dans:
| Auteurs principaux: | Yoo, Jaesung, de la Torre, Fernanda, Yang, Guangyu Robert |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2306.04440 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Semantics-Aware Generative Latent Data Augmentation for Learning in Low-Resource Domains
par: Bae, Jaesung, et autres
Publié: (2026)
par: Bae, Jaesung, et autres
Publié: (2026)
Something from Nothing: Data Augmentation for Robust Severity Level Estimation of Dysarthric Speech
par: Bae, Jaesung, et autres
Publié: (2026)
par: Bae, Jaesung, et autres
Publié: (2026)
On Evaluation of Unsupervised Feature Selection for Pattern Classification
par: Kim, Gyu-Il, et autres
Publié: (2026)
par: Kim, Gyu-Il, et autres
Publié: (2026)
ODIM: Outlier Detection via Likelihood of Under-Fitted Generative Models
par: Kim, Dongha, et autres
Publié: (2023)
par: Kim, Dongha, et autres
Publié: (2023)
Primal-Dual Spectral Representation for Off-policy Evaluation
par: Hu, Yang, et autres
Publié: (2024)
par: Hu, Yang, et autres
Publié: (2024)
Review learning: Real world validation of privacy preserving continual learning across medical institutions
par: Yoo, Jaesung, et autres
Publié: (2022)
par: Yoo, Jaesung, et autres
Publié: (2022)
What type of inference is planning?
par: Lázaro-Gredilla, Miguel, et autres
Publié: (2024)
par: Lázaro-Gredilla, Miguel, et autres
Publié: (2024)
Value-guided action planning with JEPA world models
par: Destrade, Matthieu, et autres
Publié: (2025)
par: Destrade, Matthieu, et autres
Publié: (2025)
Advanced Torrential Loss Function for Precipitation Forecasting
par: Choi, Jaeho, et autres
Publié: (2025)
par: Choi, Jaeho, et autres
Publié: (2025)
Fast and Effective On-policy Distillation from Reasoning Prefixes
par: Zhang, Dongxu, et autres
Publié: (2026)
par: Zhang, Dongxu, et autres
Publié: (2026)
Implicit Hypergraph Neural Networks: A Stable Framework for Higher-Order Relational Learning with Provable Guarantees
par: Li, Xiaoyu, et autres
Publié: (2025)
par: Li, Xiaoyu, et autres
Publié: (2025)
Automating proton PBS treatment planning for head and neck cancers using policy gradient-based deep reinforcement learning
par: Wang, Qingqing, et autres
Publié: (2024)
par: Wang, Qingqing, et autres
Publié: (2024)
Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models
par: Ortega, Fernando, et autres
Publié: (2026)
par: Ortega, Fernando, et autres
Publié: (2026)
Global Spatio-Temporal Fusion-based Traffic Prediction Algorithm with Anomaly Aware
par: Liu, Chaoqun, et autres
Publié: (2024)
par: Liu, Chaoqun, et autres
Publié: (2024)
Preserve Support, Not Correspondence: Dynamic Routing for Offline Reinforcement Learning
par: Mu, Zhancun, et autres
Publié: (2026)
par: Mu, Zhancun, et autres
Publié: (2026)
Using large language models for embodied planning introduces systematic safety risks
par: Zhang, Tao, et autres
Publié: (2026)
par: Zhang, Tao, et autres
Publié: (2026)
Epic-Sounds: A Large-scale Dataset of Actions That Sound
par: Huh, Jaesung, et autres
Publié: (2023)
par: Huh, Jaesung, et autres
Publié: (2023)
ExO-PPO: an Extended Off-policy Proximal Policy Optimization Algorithm
par: Wang, Hanyong, et autres
Publié: (2026)
par: Wang, Hanyong, et autres
Publié: (2026)
Retro-fallback: retrosynthetic planning in an uncertain world
par: Tripp, Austin, et autres
Publié: (2023)
par: Tripp, Austin, et autres
Publié: (2023)
Rubric-based On-policy Distillation
par: Fang, Junfeng, et autres
Publié: (2026)
par: Fang, Junfeng, et autres
Publié: (2026)
MambaSL: Exploring Single-Layer Mamba for Time Series Classification
par: Jung, Yoo-Min, et autres
Publié: (2026)
par: Jung, Yoo-Min, et autres
Publié: (2026)
A Flat Minima Perspective on Understanding Augmentations and Model Robustness
par: Yoo, Weebum, et autres
Publié: (2025)
par: Yoo, Weebum, et autres
Publié: (2025)
ORBIT: On-policy Exploration-Exploitation for Controllable Multi-Budget Reasoning
par: Liang, Kun, et autres
Publié: (2026)
par: Liang, Kun, et autres
Publié: (2026)
Physics-informed self-supervised learning for predictive modeling of coronary artery digital twins
par: Sun, Xiaowu, et autres
Publié: (2025)
par: Sun, Xiaowu, et autres
Publié: (2025)
DeepLogit: A sequentially constrained explainable deep learning modeling approach for transport policy analysis
par: Oon, Jeremy, et autres
Publié: (2025)
par: Oon, Jeremy, et autres
Publié: (2025)
2DXformer: Dual Transformers for Wind Power Forecasting with Dual Exogenous Variables
par: Zhang, Yajuan, et autres
Publié: (2025)
par: Zhang, Yajuan, et autres
Publié: (2025)
Markov flow policy -- deep MC
par: Soffair, Nitsan, et autres
Publié: (2024)
par: Soffair, Nitsan, et autres
Publié: (2024)
Semantic Geometry for policy-constrained interpretation
par: Phadke, Nikit
Publié: (2025)
par: Phadke, Nikit
Publié: (2025)
Dynamic planning in hierarchical active inference
par: Priorelli, Matteo, et autres
Publié: (2024)
par: Priorelli, Matteo, et autres
Publié: (2024)
ReDi: Rectified Discrete Flow
par: Yoo, Jaehoon, et autres
Publié: (2025)
par: Yoo, Jaehoon, et autres
Publié: (2025)
Offline Policy Learning via Skill-step Abstraction for Long-horizon Goal-Conditioned Tasks
par: Kim, Donghoon, et autres
Publié: (2024)
par: Kim, Donghoon, et autres
Publié: (2024)
NSNQuant: A Double Normalization Approach for Calibration-Free Low-Bit Vector Quantization of KV Cache
par: Son, Donghyun, et autres
Publié: (2025)
par: Son, Donghyun, et autres
Publié: (2025)
PIMSM: Physics-Informed Multi-Scale Mamba for Stable Neural Representations under Distribution Shift
par: Bae, Sangyoon, et autres
Publié: (2026)
par: Bae, Sangyoon, et autres
Publié: (2026)
Sophisticated Learning: A novel algorithm for active learning during model-based planning
par: Hodson, Rowan, et autres
Publié: (2023)
par: Hodson, Rowan, et autres
Publié: (2023)
Multiple-policy Evaluation via Density Estimation
par: Chen, Yilei, et autres
Publié: (2024)
par: Chen, Yilei, et autres
Publié: (2024)
That's Deprecated! Understanding, Detecting, and Steering Knowledge Conflicts in Language Models for Code Generation
par: Bae, Jaesung, et autres
Publié: (2025)
par: Bae, Jaesung, et autres
Publié: (2025)
Explainable deep learning improves human mental models of self-driving cars
par: Kenny, Eoin M., et autres
Publié: (2024)
par: Kenny, Eoin M., et autres
Publié: (2024)
What's the plan? Metrics for implicit planning in LLMs and their application to rhyme generation and question answering
par: Maar, Jim, et autres
Publié: (2026)
par: Maar, Jim, et autres
Publié: (2026)
Improving planning and MBRL with temporally-extended actions
par: Chatterjee, Palash, et autres
Publié: (2025)
par: Chatterjee, Palash, et autres
Publié: (2025)
On Predictive planning and counterfactual learning in active inference
par: Paul, Aswin, et autres
Publié: (2024)
par: Paul, Aswin, et autres
Publié: (2024)
Documents similaires
-
Semantics-Aware Generative Latent Data Augmentation for Learning in Low-Resource Domains
par: Bae, Jaesung, et autres
Publié: (2026) -
Something from Nothing: Data Augmentation for Robust Severity Level Estimation of Dysarthric Speech
par: Bae, Jaesung, et autres
Publié: (2026) -
On Evaluation of Unsupervised Feature Selection for Pattern Classification
par: Kim, Gyu-Il, et autres
Publié: (2026) -
ODIM: Outlier Detection via Likelihood of Under-Fitted Generative Models
par: Kim, Dongha, et autres
Publié: (2023) -
Primal-Dual Spectral Representation for Off-policy Evaluation
par: Hu, Yang, et autres
Publié: (2024)