Есть готовый транскрипт диалога двух людей. Необходимо полностью восстановить аудиодиалог на его основе.
Для каждого участника требования разные:
Участник №1
Необходимо полностью синтезировать речь с использованием нового естественного AI-голоса. Исходный голос этого человека использовать нельзя. Речь должна звучать максимально естественно, с нормальными паузами, интонациями и эмоциональностью.
Участник №2
Необходимо синтезировать речь голосом, максимально похожим на предоставленный образец голоса. Образец будет предоставлен отдельно.
Требования к результату
Полностью озвучить весь предоставленный транскрипт.
Четко разделить реплики двух участников.
Для участника №1 использовать полностью новый синтетический голос.
Для участника №2 воспроизвести голос на основании предоставленного образца.
Сохранить естественный темп диалога, паузы, интонации и эмоциональность.
Диалог должен восприниматься как естественный разговор двух людей, а не последовательная механическая TTS-озвучка.
На выходе предоставить готовую аудиодорожку с полным диалогом.
Перед выполнением всей работы желательно сделать тестовый фрагмент продолжительностью 30-60 секунд.