Variance reduction for policy gradient with action-dependent factorized baselines
Variance reduction for policy gradient with action-dependent factorized baselines. OpenAI News - artificial intelligence news.
🔗 Read full article on OpenAI News →
Source: OpenAI News — Published — Category: Models
⚡ Popular — 51 views