Разработал настраиваемый парсер открытых товарных каталогов на Python.
Парсер извлекает данные через CSS-селекторы и JSON-LD, переходит по страницам каталога, нормализует цены и наличие, удаляет дубли. Результат сохраняется в CSV и JSON, история изменений — в SQLite.
Добавлены журнал запусков, тайм-ауты, повторные попытки и ограничение частоты запросов. Проверен сбор 40 карточек из открытого каталога Books to Scrape.
Стек: Python, httpx, BeautifulSoup, SQLite, CSV/JSON. Кейс показывает автоматизацию сбора и подготовки данных для дальнейшей работы в таблицах.