Обучение веб-парсингу (Web-Scraping) на Python. Учимся обходить обнаружение автоматизации на сайтах и собирать нужные данные.
📗 Все ссылки на полезные материалы находятся ниже 📗
В данном видео мы рассмотрим технологию, которая позволяет парсить данные без обнаружений на сайтах. Использовать мы будем Selenium Stealth, который служит оболочкой над Selenium и предоставляет нам удобный интерфейс.
⭐ Все наши Python курсы: https://stepik.org/users/267872376/teach
⭐ Канал Телеграмм: https://t.me/codeblog8
📁 Github: https://github.com/Zproger
📁 Все плейлисты с уроками: https://bit.ly/39GaY89
📁 Связаться со мной: [email protected]
📁 Поддержать канал: https://www.donationalerts.com/r/zproger
📁 Поддержать криптовалютой: https://github.com/Zproger/donate
Тайм-коды:
0:00 - Рассматриваем задание по парсингу
1:15 - Установка библиотек и настройка проекта Selenium
3:07 - Установка драйвера для браузера (Chromedriver)
4:35 - Защищаем Selenium от обнаружений сайтами
5:53 - Изучаем html структуру сайта
7:10 - Парсим все блоки сайта
9:21 - Извлекаем название и цену каждой записи
12:25 - Парсим размер каждой группы
13:20 - Ошибка поиска, разбираем причину и собираем данные в словарь
15:10 - Не получается найти идентификатор на сайте, решение проблемы
17:17 - Парсим все изображения на сайте
19:35 - Записываем результат в json файл
#scraping #webscraping #парсинг #python