... /

Глубокое обучение с подкреплением. AlphaGo и другие технологии

Лапань Максим

Код товара: 4062515

(0 оценок)Оценить

ОтзывНаписать отзыв

ВопросЗадать вопрос

1 / 8

PDF

1 / 8

Нет в наличии

Доставим в

г. Химки, Московская обл.

Курьером

бесплатно от 10 000 ₽

В пункт выдачи

от 155 ₽

бесплатно от 10 000 ₽

Точная стоимость доставки рассчитывается при оформлении заказа

Издательство:

Питер

Оригинальное название:

DEEP REINFORCEMENT LEARNING HANDS-ON

Год издания:

Cерия:

Переводчики:

Редактор:

Описание

Характеристики

Эта книга — подробное руководство по новейшим инструментам глубокого обучения с подкреплением и их ограничениям. Мы реализуем и проверим на практике методы кросс-энтропии и итерации по ценностям (Q-learning), а также градиенты по стратегиям. Для экспериментов используются самые разные среды обучения с подкреплением (RL), начиная с классических CartPole и GridWorld и заканчивая эмуляторами Atari и средами непрерывного управления (на основе PyBullet и RoboSchool). Множество примеров основано на нестандартных средах, в которых мы с нуля разработаем модель окружения.
В этой книге:
- Вы узнаете, какое место в контексте глубокого обучения занимают методы RL, реализуете сложные модели глубокого обучения.
- Изучите основу RL: марковские процессы принятия решений.
- Рассмотрите примеры реализации методов RL: метод кросс-энтропии, DQN, A3C, TRPO, PPO, DDPG, D4PG и других.
- Узнаете, как работать с дискретными и непрерывными пространствами действий в различных средах.
- Увидите, как разработать систему, обучающуюся играм Atari, используя обучение с подкреплением.
- Создадите собственную среду по модели OpenAI Gym для обучения биржевого агента.
- Реализуете метод AlphaGo Zero для игры в Connect4.
- Познакомитесь с применением RL в обработке речи: узнаете, как обучить диалогового бота на фразах из кинофильмов.

код в Майшоп

4062515

возрастная категория

16+

количество томов

количество страниц

496 стр.

размеры

232x165x22 мм

страна изготовления

Россия

формат

70x100/16 (170x240) мм

ISBN

978-5-4461-1079-7

тип бумаги

офсетная (60-220 г/м2)

цвет

Голубой

тираж

700

стандарт

8 шт.

вес

640 г

язык

русский

переплёт

Мягкая обложка

Содержание

Об авторе
О редакторах
Предисловие к русскоязычному изданию
Предисловие
Глава 1. Что такое обучение с подкреплением
Глава 2. OpenAI Gym
Глава 3. Глубокое обучение с помощью PyTorch
Глава 4. Метод кросс-энтропии
Глава 5. Динамическое программирование и уравнение Беллмана
Глава 6. Глубокие Q-сети
Глава 7. Расширения для DQN
Глава 8. Торговля акциями с использованием обучения с подкреплением
Глава 9. Градиенты по стратегиям
Глава 10. Метод актора-критика
Глава 11. Асинхронный метод актора-критика
Глава 12. Тренировка чат-ботов с помощью обучения с подкреплением
Глава 13. Веб-навигация
Глава 14. Непрерывное пространство действий
Глава 15. Доверительные области - TRPO, PPO и ACKTR
Глава 16. Оптимизация методом черного ящика в RL
Глава 17. Методы, основанные на моделях среды: воображение
Глава 18. AlphaGo Zero
Заключение

Отзывы

Вопросы

Поделитесь своим мнением об этом товаре с другими покупателями — будьте первыми!

Дарим бонусы за отзывы!

За какие отзывы можно получить бонусы?

За уникальные, информативные отзывы, прошедшие модерацию

Как получить больше бонусов за отзыв?

Публикуйте фото или видео к отзыву
Пишите отзывы на товары с меткой "Бонусы за отзыв"

Правила начисления бонусов

Задайте вопрос, чтобы узнать больше о товаре

Товары издательства "Питер"

-15%

3 4304 035

Python для сетевых инженеров. Автоматизация сети, программирование и DevOps

Чоу Эрик

-15%

408480

Почему мне так хреново, хотя вроде бы всё нормально

Павлова Елизавета

-15%

632743

Система Сосновского. 30 советов

Сосновский Александр

-15%

830976

Герои

Ревякина Анна Николаевна

-15%

352413

Все дети - зас..нцы. И это не ваша вина

Ладитан Банми

-15%

459539

Воскресшие на Третьей мировой. Антология военной поэзии 2014 - 2022 гг.

Алейников Владимир Дмитриевич

-15%

754886

PRO копирайтинг. Как продать кота

Кот Дмитрий Геннадьевич

Если вы обнаружили ошибку в описании товара «Глубокое обучение с подкреплением. AlphaGo и другие технологии» (авторы: Лапань Максим), то выделите её мышкой и нажмите Ctrl+Enter. Спасибо, что помогаете нам стать лучше!