Vendetta
Администратор
- Регистрация
- 16 Сен 2015
- Сообщения
- 239.243
- Реакции
- 426.072
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на Big-Money.net
Книга посвящена промышленно-ориентированному применению обучения с подкреплением (Reinforcement Learning, RL). Объяснено, как обучать промышленные и научные системы решению любых пошаговых задач методом проб и ошибок – без подготовки узкоспециализированных учебных множеств данных и без риска переобучить или переусложнить алгоритм. Рассмотрены марковские процессы принятия решений, глубокие Q-сети, градиенты политик и их вычисление, методы устранения энтропии и...
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на Big-Money.net
- ПРОДАЖНИКСКАЧАТЬ
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Рецепты азорской кухни + Рецепты аймарской кухни [Наталья Смакова]
- Как увеличить выручку своей доставки еды на 50% [Альфа Курс] [Леонид Хуополайнен]
- Закрытый клуб Волшебники (ноябрь 2026) [Марина Майская]
- [Куклы] Заинька [Tata-school] [Наталья Лебедева]
- Управление командой [Альфа Курс] [Елена Биткина, Марат Исмагулов]
- Архитектура движения: подробный анализ уроков Фельденкрайз для практикующих и новичков [Центр Практика] [Свен Эрик]
- Невыпечной малиновый чизкейк [Coup de Coeur] [Елена Скрыган] [Повтор]
- LangChain: создание ИИ агентов для бизнеса на Python [Stepik] [Никита Шультайс]