Миронов А.М. - Машинное обучение с подкреплением - 3. Уравнения Беллмана и динам. программирование
Миронов А.М. - Машинное обучение с подкреплением - 3. Уравнения Беллмана и динам. программирование
Уравнения Беллмана и динамическое программирование Миронов Андрей Михайлович 00:16 Повторение: марковский процесс принятия решений (MDP) 15:08 Повторение: уравнения Беллмана 30:05 Решение уравнения Беллмана (существование оптимальной политики) 01:01:07 ε-жадная политика Ссылка на плейлист Teach-In: https://teach-in.ru/course/reinforcement-learning Ссылка на плейлист YouTube: https://www.youtube.com/playlist?list=PLcsjsqLLSfNBlD-_pB_YGAVNNOu1BKHPW Ссылка на плейлист VK: https://vkvideo.ru/playlist/-176441665_867 Ссылка на плейлист RuTube: https://rutube.ru/plst/1513664 #teach_in #мгу #msu #мехмат #mechanics_and_mathematics #лекции #lectures #Пчелин #Pchelin #Миронов #Mironov #машинное_обучение #machine_learning #обучение_с_подкреплением #reinforcement_learning #RL #MDP #уравнения_Беллмана #Bellman_equations