Локальный ассистент для распознавания речи с определением говорящих

Ссылка на работу
Задача: Создать систему для распознавания аудиозаписей без использования облачных сервисов (для работы с чувствительными данными) Решение: Разработан локальный пайплайн обработки аудио: – очистка и улучшение качества (ffmpeg, demucs) – распознавание речи (Whisper) – выравнивание и таймкоды (WhisperX) – разделение по спикерам (Pyannote) Система полностью работает офлайн Результат: Повышенин разборчивости речи на записях и получение структурированных расшифровок с таймкодами и разделением говорящих.