Variance reduction for policy gradient with action-dependent factorized baselines

Variance reduction for policy gradient with action-dependent factorized baselines. OpenAI News - artificial intelligence news.

Source: OpenAI News — Published — Category: Models

🔗 Read full article on OpenAI News →
⚡ Popular — 51 views