Пчелин К.К. - Машинное обучение с подкреплением - 10. Мультиагентные LLM-системы: паттерны, ловушки
Пчелин К.К. - Машинное обучение с подкреплением - 10. Мультиагентные LLM-системы: паттерны, ловушки
Мультиагентные LLM-системы: паттерны, ловушки, коллективное обучение Пчелин Константин Константинович 00:16 Введение 04:07 Мотивация и постановка 09:30 Паттерны разработки: команды из одиночных LLM 19:19 Формализм: Dec-POMDP и Markov Game 28:55 Ловушки независимого обучения 39:07 Коллективное обучение: VDN, QMIX, COMA 52:21 MAPPO и переход к LLM-командам 57:27 Открытые вопросы и итог Ссылка на плейлист Teach-In: https://teach-in.ru/course/reinforcement-learning Ссылка на плейлист YouTube: https://www.youtube.com/playlist?list=PLcsjsqLLSfNBlD-_pB_YGAVNNOu1BKHPW Ссылка на плейлист VK: https://vkvideo.ru/playlist/-176441665_867 Ссылка на плейлист RuTube: https://rutube.ru/plst/1513664 #teach_in #мгу #msu #мехмат #mechanics_and_mathematics #лекции #lectures #Пчелин #Pchelin #Миронов #Mironov #машинное_обучение #machine_learning #обучение_с_подкреплением #reinforcement_learning #RL #мультиагентные_LLM_системы #multi_agent_LLMs #MAD #MoA #Dec_POMDP #Markov_game #марковская_игра #IQL #IPPO #VDN #QMIX #COMA #QTRAN #MAPPO