- Регистрация
- 8 Сен 2016
- Сообщения
- 561.110
- Реакции
- 269.199
Вам необходимо зарегистрироваться для просмотра скрытого контента
Книга посвящена промышленно-ориентированному применению обучения с подкреплением (Reinforcement Learning, RL). Объяснено, как обучать промышленные и научные системы решению любых пошаговых задач методом проб и ошибок – без подготовки узкоспециализированных учебных множеств данных и без риска переобучить или переусложнить алгоритм. Рассмотрены марковские процессы принятия решений, глубокие Q-сети, градиенты политик и их вычисление, методы устранения энтропии и...
Вам необходимо зарегистрироваться для просмотра скрытого контента
- ПРОДАЖНИКСКАЧАТЬ
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Зависимые отношения. Выход [Лилия Король]
- Яблоки в корзине акварелью [lectoroom] [Елена Базанова]
- Курс по подготовке к ШАДу [Тариф Мидл ШАД] [Профиматика] [Максим Горбачев]
- [Куклы] Заинька [Tata-school] [Наталья Лебедева]
- Domestika Plus — подписка на творческие онлайн-курсы [№1 на 1 месяц] [domestika.org]
- [Вязание] Мужской свитер интересной конструкции Notebook Mono Sweater Man, вязаный спицами сверху [Вяжи.ру] [Odd Row]
- Рельефное тело. Месяц тренировок без единого тренажера [Мария Легенькая]
- Роу говорит ч.1 [Роуз Лоуренс]