Vendetta
Администратор
- Регистрация
- 16 Сен 2015
- Сообщения
- 240.644
- Реакции
- 426.072
Усиленное обучение [Джеймс Девис]
Данное руководство по усиленному обучению (Reinforcement Learning, RL), охватывает теоретические основы, практические применения и современные достижения. В начале дается определение RL, его исторический контекст и ключевые отличия от других видов машинного обучения. Примеры применения RL охватывают игры, робототехнику, финансовые рынки и управление ресурсами. Математические основы включают марковские процессы принятия решений, состояния, действия, награды и политики, а также Беллмановские уравнения и итерацию ценности. Основные алгоритмы RL, такие как метод Монте-Карло, Q-Learning, SARSA, методы градиента политики, REINFORCE и Actor-Critic, рассматриваются вместе с моделями на основе планирования и глубокого усиленного обучения (DQN, DDPG, A3C). Практическая часть книги включает использование OpenAI Gym и других сред, настройку и тестирование моделей, а также примеры кода на Python с использованием библиотек TensorFlow и PyTorch.
Цена 690 руб.
epub, fb2, fb3, ios.epub, mobi, pdf, txt, zip
Данное руководство по усиленному обучению (Reinforcement Learning, RL), охватывает теоретические основы, практические применения и современные достижения. В начале дается определение RL, его исторический контекст и ключевые отличия от других видов машинного обучения. Примеры применения RL охватывают игры, робототехнику, финансовые рынки и управление ресурсами. Математические основы включают марковские процессы принятия решений, состояния, действия, награды и политики, а также Беллмановские уравнения и итерацию ценности. Основные алгоритмы RL, такие как метод Монте-Карло, Q-Learning, SARSA, методы градиента политики, REINFORCE и Actor-Critic, рассматриваются вместе с моделями на основе планирования и глубокого усиленного обучения (DQN, DDPG, A3C). Практическая часть книги включает использование OpenAI Gym и других сред, настройку и тестирование моделей, а также примеры кода на Python с использованием библиотек TensorFlow и PyTorch.
Цена 690 руб.
epub, fb2, fb3, ios.epub, mobi, pdf, txt, zip
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- [Вязание] Фактурный кардиган рельефным узором Puro [Вяжи.ру] [Jenny Ansah]
- 86 английских глаголов мышления и принятия решений: Think, Decide, Consider. Шпаргалка [Сергей Рыбников]
- Финансовые открытия + Денежная азбука [Светлана Шаромова]
- Что такое теория поколений и для чего она нужна [Альфа Курс]
- Поисковое продвижение для бизнеса [Альфа Курс] [Игорь Бурдуков]
- Не правильное питание – паста & пицца. Самые популярные и любимые блюда мировой кухни [Илья Лазерсон, Аркадий Грицевский]
- Бум на СДВГ (онлайн-конференция) [PRO трек] [Сад] [Женя Янке, Михаил Пошибайлов]
- Работа с формулами суммы в Excel [Альфа Курс]