Как написать промпт для озвученного диалога
Промпт для диалога — это мини-сценарий: реплики с указанием, кто говорит, короткое описание характера каждого голоса и общий тон сцены. Модель ElevenLabs Dialogue v3 собирает из такого сценария цельную многоголосую сценку: интонации подстраиваются под смысл реплик и заданные характеры, а не читаются ровным дикторским тоном.
Разница с обычной озвучкой принципиальная: если склеивать два отдельно озвученных монолога, персонажи «не слышат» друг друга — вопрос звучит без вопросительной интонации ответа, перебивки не работают. Диалоговая модель ведёт сцену целиком.
Структура сценария: три обязательных блока
Рабочий сценарий состоит из трёх частей — персонажи, реплики, тон сцены:
Персонажи: Аня — энергичная ведущая подкаста, говорит быстро, с азартом, иногда перебивает. Виктор — спокойный эксперт, низкий размеренный голос, лёгкая ирония.
Тон сцены: живой разговор, не радиоспектакль.
Аня: Так, стоп. Вы хотите сказать, что мы всё это время делали неправильно?
Виктор: Не то чтобы неправильно... скажем так — неоптимально.
Аня: Это же одно и то же!
Каждая реплика — с новой строки, с именем персонажа в начале. Не смешивайте описание характера с репликами: модель должна один раз понять, кто есть кто, и дальше читать чистый диалог.
Характер: описывайте поведение, а не тембр
Слабое описание — «весёлый голос», «серьёзный мужчина». Сильное — поведенческое: «говорит быстро, проглатывает концы фраз, посмеивается над собеседником», «отвечает с паузами, как будто взвешивает каждое слово». Модель интонирует то, что может сыграть, — действия и манеру, а не абстрактные эпитеты.
Полезно задать и отношения между персонажами: «старые друзья, подкалывают друг друга» звучит совсем иначе, чем «начальник и подчинённый на неприятном разговоре» — при одинаковых репликах.
Темп и паузы: пунктуация вместо режиссуры
Темпом сцены управляет в первую очередь текст реплик:
| Приём | Эффект |
|---|---|
| Многоточие внутри реплики | Заминка, пауза на раздумье |
| Короткие рубленые фразы | Быстрый, нервный темп |
| Длинные предложения с запятыми | Спокойная, размеренная речь |
| Вопрос — короткий ответ — вопрос | Ощущение допроса, напряжение |
| Повтор слова («Нет. Нет-нет-нет») | Эмоциональный всплеск |
Прежде чем усложнять описания характеров, прогоните сценарий с выверенной пунктуацией — часто этого достаточно, чтобы сцена «задышала».
Где это применять и сколько стоит
Типовые сценарии: заставки и рекламные вставки для подкастов, обучающие диалоги «ученик — наставник», сценки для соцсетей, реплики игровых персонажей — под них есть отдельная подборка промптов для игрового контента. Если у вас уже готов сценарий и нужно просто распределить голоса, удобнее стартовать со страницы озвучить по ролям.
Ориентир по ценам озвучки на ГПТ Россия: ElevenLabs Turbo v2.5 — 6 ₽ за 1000 знаков, ElevenLabs Multilingual v2 — 12 ₽ за 1000 знаков. Новичку начисляется 50 ₽ приветственного баланса — этого хватает, чтобы озвучить несколько тестовых сценок, оценить характеры и темп; оплата в рублях, VPN не нужен.
Частые вопросы
Чем диалоговая модель лучше склейки двух озвучек?
Склейка даёт два независимых монолога: интонации не связаны, реакции не звучат как реакции. Диалоговая модель читает сцену целиком — вопросительная интонация вызывает соответствующий ответ, перебивки и паузы работают на смысл.
Можно ли озвучивать диалоги на русском?
Да, сценарий пишется на русском — и реплики, и описания характеров. Именование персонажей и структура «Имя: реплика» сохраняются те же.
Сколько персонажей стоит закладывать в одну сценку?
Практический оптимум — два-три: так проще удержать характеры различимыми на слух. Если сценарий длинный и героев много, дробите его на эпизоды по 2-3 персонажа и генерируйте частями.
Как добиться нужной эмоции в конкретной реплике?
Сначала пунктуацией и формулировкой самой реплики, затем — уточнением характера персонажа. Если эмоция всё равно не та, перепишите реплику так, чтобы эмоция читалась из текста: модель играет то, что написано, а не то, что вы держали в голове.



