Задача — автоматизировать локализацию видео: принять исходный файл, распознать речь, перевести текст, создать новую озвучку и собрать итоговый ролик без ручной переклейки аудиодорожки.
Собрал полный pipeline: загрузка видео, распознавание через Whisper, перевод, синтез речи, обработка FFmpeg и отправка результата в Telegram. Тайминги перевода восстанавливаются по сегментам, а длительность новой озвучки подгоняется под исходное видео.
Получился end-to-end инструмент локализации видео, который связывает STT, перевод, TTS и монтаж в одном процессе. Production-метрики и коммерческий эффект в исходных данных не подтверждены.