Vendetta
Администратор
- Регистрация
- 16 Сен 2015
- Сообщения
- 247.174
- Реакции
- 426.072
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на Big-Money.net
Книга посвящена промышленно-ориентированному применению обучения с подкреплением (Reinforcement Learning, RL). Объяснено, как обучать промышленные и научные системы решению любых пошаговых задач методом проб и ошибок – без подготовки узкоспециализированных учебных множеств данных и без риска переобучить или переусложнить алгоритм. Рассмотрены марковские процессы принятия решений, глубокие Q-сети, градиенты политик и их вычисление, методы устранения энтропии и...
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на Big-Money.net
- ПРОДАЖНИКСКАЧАТЬ
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Избранный (перевод) [Роуз Лоуренс]
- Клуб Зеленой Свиньи (28 октября 2026 - 1 декабря 2026) [Тариф Клубная карточка] [Олег Макаренко, Кримсональтер]
- YouTubeDocu AI — фабрика вирусных видео: 2 софта автосборки + курс
- Ланчбоксы: идеи блюд на 30 дней [Klaudia Tobiasz] + Ланчбоксы: 60 новых рецептов для ланчбокса [Joanna Anger, Anna Piszczek]
- Роуз говорит ч.1 (перевод) [Роуз Лоуренс]
- Worksheet The Dare (B2/C1) [Елена Сарнавская]
- Все хорошо (перевод) [Роуз Лоуренс]
- Lingvo AI — личный AI-тренажёр иностранного языка: курс из Ваших слов, разговор с AI голосом, карточки FSRS, чтение книг.