Vendetta
Администратор
- Регистрация
- 16 Сен 2015
- Сообщения
- 246.762
- Реакции
- 426.072
Парсинг сайтов. Scrapy, Splash, Selenium, requests, bs4
Чему вы научитесь
Этот курс предназначен для тех, кто хочет научиться автоматизированному сбору информации с различных сайтов, то есть парсингу. Для прохождения курса требуются базовые знания питона.
На лекциях будут рассмотрены основные подходы к сбору данных с использованием таких библиотек, как requests, beautifulsoup4 и splash, а также фреймворков Scrapy и Selenium.
В этом курсе рассматриваются основные базовые подходы к сбору данных, а также затрагивается вопрос этичного парсинга. По итогам курса студенты будут иметь базовое представление о том, как парсить различные сайты, используя Python.
Этот курс будет не очень интересен тем, кто уже имеет базовое представление о том, что такое парсинг и как создавать скрипты для автоматизированного сбора данных.
После прохождения курса студенты будут знать:
СКАЧАТЬ
Чему вы научитесь
- Сбор данных с различных сайтов, используя различные библиотеки и фреймворки Python
- Получение HTML страницы с помощью requests и beautifulsoup4
- Парсинг многостраничных сайтов с использованием Scrapy
- Авторизация на сайте и сбор данных при помощи Selenium
- Базовые знания Python
- Знания HTML разметки
Этот курс предназначен для тех, кто хочет научиться автоматизированному сбору информации с различных сайтов, то есть парсингу. Для прохождения курса требуются базовые знания питона.
На лекциях будут рассмотрены основные подходы к сбору данных с использованием таких библиотек, как requests, beautifulsoup4 и splash, а также фреймворков Scrapy и Selenium.
В этом курсе рассматриваются основные базовые подходы к сбору данных, а также затрагивается вопрос этичного парсинга. По итогам курса студенты будут иметь базовое представление о том, как парсить различные сайты, используя Python.
Этот курс будет не очень интересен тем, кто уже имеет базовое представление о том, что такое парсинг и как создавать скрипты для автоматизированного сбора данных.
После прохождения курса студенты будут знать:
- Как найти и установить необходимые библиотеки для парсинга данных.
- Что такое этичный парсинг, как не нарушить права и закон при парсинге данных.
- Для чего нужен файл robots.txt.
- Каким образом получать HTML сайта для извлечения необходимой информации.
- Как пользоваться xpath для указания точного расположения элементов на странице.
- Как переходить по страницам на многостраничном сайте.
- Как создавать проект и запускать «пауков» Scrapy.
- Как парсить всю информацию о каждом товаре на сайте.
- Как осуществлять переход на страницу каждого товара.
- Каким образом парсить сайты, использующие JavaScript при загрузке.
- Как авторизовываться на сайте, используя фреймворк Selenium.
- Как парсить сайты с бесконечной прокруткой, имитируя действия пользователя на странице.
- Начинающие разработчики Python с интересом к сбору и обработке данных
Зарегистрируйтесь или войдите в свой аккаунт для просмотра данного контента на Big-Money.net
СКАЧАТЬ
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Базовый курс Таро [Тариф Я сам] [Ксения Золотницкая]
- [Шитье] Клуб шитья и рукоделия (ноябрь 2026) [Ирина Коновал]
- Групповой коллаж для детского сада "Новогодний 2027" [nezabudka]
- [Вязание] Пуловер с V-горловиной и красивыми разрезами Quiet Moments, вязаный спицами сверху [Вяжи.ру] [Nina Kjær]
- Тренды и бизнес-модели каждую неделю [№11 на 1 месяц с 27.10.2026] [tweekly.ru] [Алексей Черняк]
- [ИИ] Грок - нейросеть от xAI: чат-бот, автоматизация, генерации текста и изображений [№17 на 1 месяц по 10 человек с 02.10.2026] [grok.com]
- Подписка на контент (октябрь 2026) [Тариф Университет Антонова] [Алексей Антонов]
- [Вязание] Топ Бриллиант (погон, пайетки) [Avgustina_knit] [Юлия Шкляр]