Учебный ресурс OpenAI по глубокому обучению с подкреплением
Введение в RL: ключевые понятия, виды алгоритмов, основы оптимизации политик. Документированные реализации VPG, TRPO, PPO, DDPG, TD3 и Soft Actor-Critic, инструменты для запуска экспериментов, вывода результатов и построения графиков, подборка ключевых статей и раздел «Spinning Up as a Deep RL Researcher».
| Тип | Курс |
| Категория | Обучение / Обучение с подкреплением |
| Цена | бесплатно |
| Платформа | Только веб |
| Для кого | Тем, кто хочет стать исследователем в области глубокого RL. |
| Язык сайта | en |
| Вендор | OpenAI |