Preprints and Working papers
Publications
Multistep Predecessor Models and Mitigating Errors due to Hallucinated Value in Dyna-Style Planning
PDF ·
Position Paper: Limitations of and Alternatives to Benchmarking in Reinforcement Learning Research
PDF ·
Exploiting Action Impact Regularity and Exogenous State Variables for Offline Reinforcement Learning
PDF ·
Asymptotically Unbiased Off-Policy Policy Evaluation when Reusing Old Data in Nonstationary Environments
Greedification Operators for Policy Optimization: Investigating Forward and Reverse KL Divergences
PDF ·
No More Pesky Hyperparameters: Offline Hyperparameter Tuning for RL
A Generalized Projected Bellman Error for Off-policy Value Estimation in Reinforcement Learning
PDF ·
Learning Macroscopic Brain Connectomes via Group-Sparse Factorization
Reinforcement Learning with Function-Valued Action Spaces for Partial Differential Equation Control
PDF ·
Organizing experience: a deeper look at replay mechanisms for sample-based planning in continuous state domains
PDF ·
Comparing Direct and Indirect Temporal-Difference Methods for Estimating the Variance of the Return
PDF ·
Optimal Reverse Prediction: A Unified Perspective on Supervised, Unsupervised and Semi-supervised Learning
PDF ·