Знакомство с RL. Классические алгоритмы SARSA и Q-learning // Курс «Reinforcement Learning»
Знакомство с RL. Классические алгоритмы SARSA и Q-learning // Курс «Reinforcement Learning»
На занятии вы познакомитесь с базовыми алгоритмами обучения с подкрепления. Вы узнаете о трех парадигмах машинного обучения и поймете, чем обучение с подкреплением отличается от остальных. Разберетесь с основными понятиями этой области, такими как окружение, агент, награда, политика. Поймете, чем марковский процесс принятия решений отличается от случайного поиска и как на его основе обучить агента действовать в незнакомой среде и получать максимальную награду. Так же вы разберете два базовых алгоритма обучения с подкреплением SARSA и Q-learning и поймете почему они лежат в основе всех современных алгоритмов. «Reinforcement Learning» - https://otus.pw/ehxr/ Преподаватель: Игорь Стурейко - Teamlead, главный инженер в FinTech