Kors
Администратор
- Регистрация
- 12 Дек 2014
- Сообщения
- 195.102
- Реакции
- 246.029
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на skladchikx.com
Книга посвящена промышленно-ориентированному применению обучения с подкреплением (Reinforcement Learning, RL). Объяснено, как обучать промышленные и научные системы решению любых пошаговых задач методом проб и ошибок – без подготовки узкоспециализированных учебных множеств данных и без риска переобучить или переусложнить алгоритм. Рассмотрены марковские процессы принятия решений, глубокие Q-сети, градиенты политик и их вычисление, методы устранения энтропии и...
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на skladchikx.com
- ПРОДАЖНИКСКАЧАТЬ
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Ланчбоксы: идеи блюд на 30 дней [Klaudia Tobiasz] + Ланчбоксы: 60 новых рецептов для ланчбокса [Joanna Anger, Anna Piszczek]
- Практик трансформационных гипнотических путешествий, часть 01 из 10 (2026) [Игорь Ледоховский]
- Практик трансформационных гипнотических путешествий, часть 02 из 10 (2026) [Игорь Ледоховский]
- Практик трансформационных гипнотических путешествий, часть 03 из 10 (2026) [Игорь Ледоховский]
- Практик трансформационных гипнотических путешествий, часть 04 из 10 (2026) [Игорь Ледоховский]
- Практик трансформационных гипнотических путешествий, часть 05 из 10 (2026) [Игорь Ледоховский]