image image
Разработал настраиваемый парсер открытых товарных каталогов на Python. Парсер извлекает данные через CSS-селекторы и JSON-LD, переходит по страницам каталога, нормализует цены и наличие, удаляет дубли. Результат сохраняется в CSV и JSON, история изменений — в SQLite. Добавлены журнал запусков, тайм-ауты, повторные попытки и ограничение частоты запросов. Проверен сбор 40 карточек из открытого каталога Books to Scrape. Стек: Python, httpx, BeautifulSoup, SQLite, CSV/JSON. Кейс показывает автоматизацию сбора и подготовки данных для дальнейшей работы в таблицах.