AI 뉴스로 돌아가기

Variance reduction for policy gradient with action-dependent factorized baselines

2018.03.2010원문 보기
Variance reduction for policy gradient with action-dependent factorized baselines