Портфолио и кейсы фрилансеров по парсингу данных

sunwait67
Фрилансер 1 месяц назад
sunwait67
Фрилансер 1 месяц назад
sunwait67
Фрилансер 1 месяц назад
автопостинг контента в ВК
Автоматический постинг в группу ВКонтакте: из новостей или твоих материалов — готовый пост с текстом и уникальной картинкой, по расписанию. Что входит: - скрипт-пайплайн: получить ссылку → подготовить пост → сгенерировать картинку (gpt-image-1 через ProxyAPI) → опубликовать через VK API; - отложенный постинг по расписанию (например, по средам) или сразу; - защита от дублей и сбоев (retry при ошибках загрузки ВК); - выгрузка в твою группу, настройка прав токена. Можно адаптировать под Telegram-канал или другой источник новостей. Стек: Python, requests, ProxyAPI, VK API, python-dotenv.
Николай Алымов
Николай Алымов 1 месяц назад
Автоматический парсинг и сопоставление артикулов
🚀 Ozon Data Pipeline: Автоматизация сбора данных любой сложности Задача: Автоматизировать сбор информации о товарах Ozon по списку артикулов. Главные вызовы: антифрод, динамическая подгрузка характеристик и разный формат написания артикулов. Как проходил процесс? 🔹 Использовал Playwright с управлением сессиями. Это позволило имитировать действия человека, обходить блокировки и корректно подгружать данные через программный скролл и задержки. 🔹 Реализовал локальное кэширование. Скрипт сначала сохраняет страницы на диск, а затем парсер обрабатывает их автономно. Это защищает от банов и позволяет мгновенно менять логику извлечения данных без повторных запросов к сайту. 🔹 Разработал многоуровневую логику сопоставления. Система находит нужный товар, даже если форматы артикулов различаются (точки, тире...), последовательно проверяя партномера, SKU и вхождения в заголовки. Что получили на выходе: ✅ Excel-пакет: Готовый отчет со всеми полями: чистые описания, структурированные характеристики и габариты упаковки. ✅ HQ Контент: Скрипт находит оригиналы фото, очищая ссылки от параметров сжатия Ozon — вы получаете медиа в максимальном качестве. ✅ Надежность: Модульная архитектура делает процесс устойчивым к обрывам связи и изменениям верстки. 🛠 Стек: Python, Playwright, BeautifulSoup4, Pandas. 🚀 Итог: Рутинная работа недель превращена в процесс нескольких минут с гарантированной точностью данных! 📥 Нужен надежный парсер или автоматизация? Пишите — обсудим ваш проект!
Sergei Kolesov
Sergei Kolesov 2 месяца назад
Мониторинг цен B2B-площадки с обходом антибота
Задача: регулярно собирать тарифы с закрытой B2B-площадки, где стоит защита от ботов. Решение: парсер на Python с эмуляцией браузера, ротацией заголовков и паузами — проходит антибот-защиту и не попадает под блокировки. Сбор идёт по расписанию, результат автоматически выгружается в Excel по нужным полям. Работает стабильно без ручного вмешательства. Стек: Python, Playwright, pandas.
ВБ
Виталий Беляев 2 месяца назад
Парсер спортивных событий через API с выгрузкой в Excel
Проект разработан для автоматического сбора и подготовки данных о предстоящих футбольных событиях. Задача — заменить ручное копирование информации и получать готовую структурированную таблицу для дальнейшего анализа. Что реализовано: — загрузка событий через API с обработкой страниц; — отбор матчей на ближайшие 12 часов; — получение основных и дополнительных рынков; — очистка и нормализация названий и значений; — преобразование данных в формат «один матч — одна строка»; — выгрузка результатов в CSV для открытия в Excel; — отдельное сохранение подробной таблицы по всем рынкам. В контрольной выгрузке 40 основных событий были преобразованы в таблицу из 27 полей. Дополнительная таблица содержит более 6700 строк с детализированными данными. Парсер обрабатывает пустые значения, статусы событий и время начала матчей. Структуру итоговой таблицы можно изменить под требования заказчика.
Ратмир Фа
Ратмир Фа 2 месяца назад
Парсинг данных
Демонстрационный проект автоматизации мониторинга цен на Python. Система получает данные из открытого товарного каталога, сохраняет снимок состояния и сравнивает его с результатом предыдущего запуска. Реализовано: — сбор названий, цен и ссылок на товары; — сравнение двух снимков каталога; — определение новых, исчезнувших и изменившихся позиций; — расчёт абсолютного и процентного изменения цены; — формирование структурированного Excel-отчёта; — фильтры, формулы и цветовая индикация; — итоговая диаграмма изменений; — проверка корректности исходных данных. Источник данных — открытый учебный сайт Books to Scrape. Технологии: Python, HTML-парсинг, pandas, openpyxl, Excel. Решение можно адаптировать для мониторинга интернет-магазинов, поставщиков, товарных каталогов, цен и остатков. Частоту обновления, состав полей и формат отчёта можно настроить под задачу заказчика.
Рустам Каримов
Рустам Каримов 2 месяца назад
Правки и доработки сайтов
Дорабатываю и чиню сайты: вёрстка, формы, функционал, интеграции, ускорение, переезд на хостинг с SSL. WordPress, Tilda, самописные. Перед работой оцениваю объём и делаю резервную копию.
Рустам Каримов
Рустам Каримов 2 месяца назад
Telegram/MAX-бот под ключ с запуском на сервере
Разрабатываю ботов для Telegram и MAX: приём заявок, запись клиентов, каталоги, уведомления, интеграции (оплата, Google Таблицы, CRM, нейросети). Размещаю на сервере — работают 24/7. От сценария до запуска и поддержки.
Рустам Каримов
Рустам Каримов 2 месяца назад
Обработка и сведение таблиц Excel/CSV
Привожу в порядок таблицы любого объёма: сведение прайсов и выгрузок из 1С/CRM/маркетплейсов, поиск дублей, сопоставление по неточным совпадениям, сводные отчёты. Скриптами на Python — десятки тысяч строк за часы вместо недель ручной работы. Отдаю готовый файл или повторяемый скрипт.