Чем отличаются DQN, PPO, SAC, AlphaZero и другие модели reinforcement learning друг от друга? В этой статье я простым языком разберу основные алгоритмы обучения с подкреплением и покажу на одной карте, как они связаны между собой. Читать далее
Таксономия методов Reinforcement Learning: как не потеряться между DQN, PPO, SAC и Dreamer
Это краткое изложение. Полный текст материала доступен на сайте источника.