DRL Course 2023 | Policy Gradient. Off-Policy Algorithms
DRL Course 2023 | Policy Gradient. Off-Policy Algorithms
Курс Deep Reinforcement Learning 2023: https://ods.ai/tracks/drlcourse23 Сезон курсов :https://ods.ai/events/course_season_autumn_23 В седьмой лекции: Продолжаем рассматривать MDP с бесконечным пространством состояний и действий Обсуждается Deterministic Policy Gradient теорему и выводим DDPG и TD3 Рассматриваем Soft Policy Iteration и выводим SAC Автор курса: Антон Плаксин, исследователь в группе Yandex.Research и доцент Уральского федерального университета. Наши соц.сети: Telegram: https://t.me/datafest Вконтакте: https://vk.com/datafest Канал с вакансиями в telegram: https://t.me/odsjobs Канал с апдейтами по курсам: https://t.me/odscourses Как попасть в чат сообщества ODS Mattermost: https://ods.ai/tracks/mattermost