сайт
Необходимо научится получать все доступные данные о вакансиях из списка вакансий (без рекурсивного обхода по страницам вакансий, только список)
Данные для извлечения и модель
Параметры запроса
ключевое слово из списка вынести в config
{младший, ученик, junior, intern, trainee, интерн, начинающий, стажер, студент, ассистент, практикант}
искать текст только в названии (&profession_only=1)
период обновления 24 часа (.=1)
город из списка (нас интересуют только вакансии в 7 городах) вынести в config
Екатеринбург, Новосибирск, Краснодар, Ростов-на-Дону, Казань, Нижний Новгород , Саратов
Информация для извлечения (извлекаем заполняем модель pydantic см файл)
название вакансии → position
ссылка → link
город → city
И так далее
Другие поля модели:
source → superjob
отрасль → specialization
date → дата извлечения вакансии
tag → заполняем согласно отраслям см файл
На сколько вижу поле отрасль нельзя получить со страницы, по-этому предлагаю слать отрасль в параметре запроса. То есть на каждую отрасль свой запрос и на каждое ключевое слово Но несколько городов можно объединить в 1 запросе.
Уникальность
Парсер будем запускать раз в сутки.
Сохранять необходимо только новые (проверка по id или ссылке)
Перед исполнением надо будет обсудить тз
предлагайте стоимость