Batch Reinforcement Learning With a Nonparametric Off-Policy Policy Gradient

Explore this paper's citation graph

Type
preprint
Published
2020-10-27
Cited by
8
References
66
Access
Open access

Keywords

Reinforcement learning, Inefficiency, Variance (accounting), Computer science, Nonparametric statistics

References

Cited by

Related papers