Система должна собирать данные из сайтов и баз данных. Все складывать в свою БД.
Два типа источников:
1 сайты, им нужен парсинг или более сложные способы эмуляции действия людей. Всего около 15 сайтов-источников.
2 структурированные файлы данных xml, dbfб csv и др Около 5 баз данных.
Надо сразу предусмотреть необходимость распараллеливания процессов
Как предположительное решение использование API Amazon серверов (AWS), средства для эмуляции работы человека
ТЗ должно состоять из двух частей:
1 общее ТЗ на всю систему парсинга
2 анализ конкретных источников (около 15 сайтов и 5 БД)
ВНИМАНИЕ. Задача срочная, и только для тех, кто имеет опыт ТЗ и 5(максимум) дней на написание ТЗ.
Исполнитель только из Москвы-Подмосковья или ближних областей. Аванс, разговор и комментарии по источникам в офисе ст м ВДНХ.
Встреча в офисе сегодня или максимум завтра.
Опубликован 08.12.2015 в 11:28
Заказ находится в архиве