Навчальний проєкт: парсер, який збирає дані про книги з сайту books.toscrape.com — сайту, спеціально створеного для практики веб-скрапінгу.
- Проходить по кількох сторінках каталогу (пагінація)
- Для кожної книги збирає: назву, ціну, наявність на складі, рейтинг (1-5)
- Зберігає результат у зручний Excel-файл з форматуванням
requests— завантаження HTML-сторінокBeautifulSoup4— парсинг HTML і витягування данихopenpyxl— створення та форматування Excel-файлу
pip install -r requirements.txt
python parser.pyПісля запуску створюється файл books.xlsx з усіма зібраними даними.
Цей самий підхід (запит → парсинг HTML → збереження в Excel/CSV) використовується для парсингу:
- цін конкурентів в інтернет-магазинах
- оголошень з дошок оголошень (OLX, Rieltor тощо)
- вакансій з сайтів пошуку роботи
- будь-яких структурованих даних з публічних сайтів
Готовий адаптувати скрипт під конкретний сайт та формат вихідних даних.