Описание
Начните внедрять Q-обучение в средах класса grid world, обучите вашего агента торговать на бирже, узнайте, как модели обработки естественного языка привели к взрывному распространению чат-ботов.
В этой книге
• Вы узнаете, какое место в контексте DL занимают методы RL, реализуете сложные модели глубокого обучения
• Освоите базовый уровень RL: марковские процессы принятия решений
• Оцените различные методы RL, в частности кросс-энтропию, DQN, модель актора-критика, TRPO, PPO, DDPG, D4PG и др.
• Узнаете, как работать с дискретными и непрерывными пространствами действий в различных средах
• Научитесь побеждать в аркадных играх Atari, используя обучение с подкреплением
• Создадите собственную среду по модели OpenAI Gym для обучения биржевого агента
• Научите вашего агента играть в Connect4, воспользовавшись методом AlphaGo Zero
• Познакомитесь с новейшими исследованиями в области глубокого обучения, касающимися разработки чат-ботов.
Отзывы
Отзывов пока нет.