Variance reduction for policy gradient with action-dependent factorized baselines

Variance reduction for policy gradient with action-dependent factorized baselines. OpenAI News - artificial intelligence news.

Source: OpenAI News β€” Published β€” Category: Models

πŸ”— Read full article on OpenAI News β†’