Озвучка й субтитри українською
Зробити готове відео (зняте на телефон чи згенероване AI) придатним для соцмереж: чиста озвучка, правильна українська вимова і субтитри, які реально читаються в стрічці.

- Є готовий відеоряд, але озвучка й субтитри роблять його схожим на чернетку
- Синтез мовлення читає власні назви й наголоси неправильно, і це чути
- Субтитри в TikTok/Reels наїжджають на інтерфейс або не встигають читатись
- Синтез мовлення (TTS) з українською мовою
- Мікрофон або диктофон для запису власного голосу
- Редактор субтитрів з експортом окремим файлом
Озвучка й субтитри — це не «технічний останній крок», а те, що вирішує, додивляться ролик чи гортатимуть далі. Пройди кроки по черзі: спочатку текст під голос, потім вимова й темп, потім субтитри під формат стрічки — і відео перестане звучати як робот і виглядати як чернетка.
- 01
Перепиши текст для вуха, а не для ока
Текст, який добре читається очима, майже завжди звучить погано вголос. Речення для статті — довгі, з підрядними конструкціями; речення для голосу — короткі й розмовні.
Перед озвучкою онов сценарій за трьома правилами:
- Коротке речення = одна думка. Якщо в реченні дві коми й слово «який/котрий» — розбий на два речення.
- Активне дієслово замість канцеляриту. «Здійснюється налаштування параметрів» → «Налаштуй параметри».
- Прочитай текст уголос і познач, де виникає заминка. Кожне слово чи зворот, на якому язик спотикається, — кандидат на переписування. Синтез повторить ту саму заминку, що й жива вимова.
Це не спрощення заради спрощення — вухо, на відміну від ока, не може «повернутись і перечитати» незрозуміле речення.
Готовий промпт Перепиши цей текст так, щоб він звучав природно, коли його читають уголос: короткі речення (не більше 12–15 слів), активні дієслова, розмовний тон, без канцеляриту й складних підрядних конструкцій. Збережи всі факти і головну думку без змін. Ось текст: [ТЕКСТ ЧОРНОВИКА]
Порада Читай сценарій із секундоміром: якщо на 30 секунд тексту припадає більш ніж дві заминки — переписуй текст, а не тренуй дикцію.
- 02
Постав паузи там, де вони працюють
Рівний темп без пауз — головна ознака «роботизованого» голосу, навіть якщо сам голос звучить якісно. Пауза — не порожнеча, а сигнал для мозку слухача: «зараз буде важливо».
Де ставити паузу свідомо:
- Перед головною думкою. «І ось у чому секрет.» [пауза] «.це робиться в одну дію».
- Після питання. Дай слухачу частку секунди подумати, перш ніж прозвучить відповідь.
- Між смисловими блоками — гачок, проблема, рішення, заклик — щоб думка встигла «переключитись».
Більшість синтезаторів мовлення розставляють паузи за розділовими знаками: крапка й знак питання дають довшу паузу, кома — коротшу, три крапки — паузу-роздум. Онов пунктуацію сценарію свідомо під ці паузи, а не лише за правилами граматики.
Порада Якщо мовлення звучить монотонно навіть із розділовими знаками — перевір, чи є в інструменті окреме керування темпом чи наголосом. Це працює по-різному в різних сервісах, тож перевіряй на своєму.
- 03
Впорайся з наголосами і власними назвами
Українські синтезатори найчастіше помиляються на трьох речах: омографах (слова, що пишуться однаково, а звучать по-різному залежно від наголосу), власних назвах і англіцизмах.
- Омографи: «за́мок» (споруда) і «замо́к» (пристрій), «а́тлас» і «атла́с». Синтез обирає один варіант за замовчуванням — і часто не той, що потрібен.
- Власні назви: імена, бренди, назви міст синтез читає «по літерах», без урахування реальної вимови.
- Англіцизми: «маркетинг», «воркшоп», «лендінг» — запозичені слова, які синтезатор іноді тягне до англійської вимови літер.
Якщо слово звучить неправильно — перепиши його фонетично, так, як воно має звучати: заміни літери на ті, що дадуть правильний наголос і вимову. Частина синтезаторів реагує на наголошений склад, виділений великою літерою (наприклад «маркЕтинг»), — але це працює не в усіх інструментах однаково, тож перевіряй результат на слух щоразу.
Готовий промпт Ось список слів і назв, які я озвучую українською: [СПИСОК СЛІВ І НАЗВ]. Для кожного напиши, де в ньому наголос, і фонетичний варіант запису, який допоможе синтезатору мовлення прочитати слово правильно.
Порада Виписуй проблемні слова в окремий список одразу після першого прослуховування — вони повторюватимуться в наступних роликах, і список економить час наступного разу.
- 04
Виріши: свій голос чи синтез
Обидва варіанти робочі, питання — що зараз важливіше.
Озвучуй своїм голосом, якщо:
- будуєш особистий бренд, і голос — частина впізнаваності;
- є тиха кімната і хоча б найпростіший мікрофон;
- текст короткий, і кілька дублів не забирають багато часу.
Обирай синтез (TTS), якщо:
- потрібно швидко багато варіантів чи кілька мов;
- немає умов для чистого запису — шум, відлуння, відсутня техніка;
- ідея ще тестується, і поки рано вкладати час у дублі.
TTS (text-to-speech, синтез мовлення) — технологія, яка перетворює написаний текст на голос: пишеш репліку, а програма «промовляє» її штучним голосом, часто майже невідрізненним від живого.
- 05
Налаштуй голос у синтезаторі
Обираючи інструмент синтезу мовлення, дивись не на красиву демку, а на конкретні параметри:
- Українська мова з природною інтонацією, а не «переклад з англійської вимови».
- Керування темпом — можливість сповільнити чи прискорити мовлення окремо від тону голосу.
- Кілька варіантів голосу, щоб підібрати тембр під тему ролика.
- Експорт чистого аудіофайлу окремо від відео — знадобиться для монтажу.
Згенеруй 2–3 варіанти з різним темпом і подачею й порівняй, який точніше передає гачок на початку ролика.
Готовий промпт Згенеруй 5 варіантів першої фрази-гачка для короткого відео на тему: [ТЕМА РОЛИКА]. Кожен варіант — не довше 8 слів, розмовною українською, з інтригою чи несподіваним твердженням у перших словах.
- 06
Зроби субтитри, які реально читаються в стрічці
У TikTok і Reels ролики дивляться здебільшого без звуку — тому субтитри мають працювати як самостійний текст, а не «підпис до голосу».
Вимірювані правила:
- Не більше ~2 рядків тексту на екрані одночасно, і до ~30–40 символів у рядку — довші рядки на телефоні переносяться і «стрибають».
- Час на екрані = час, потрібний прочитати вголос у комфортному темпі: не швидше за саму репліку, і не менше приблизно секунди навіть для найкоротшого субтитра.
- Безпечна зона: не став текст у нижні ~15% кадру — там кнопки лайку, підпис і музичний диск інтерфейсу перекриють текст. Верхні ~10% також краще лишати вільними під шапку профілю.
- Контраст: підложка або обводка під текстом, щоб субтитр читався на будь-якому фоні відео — і на світлому, і на темному.
Готовий промпт Скороти цей субтитр до [N] символів, зберігши головний зміст і розмовний тон, без втрати сенсу: [РЕЧЕННЯ]
Порада Якщо субтитр не влазить у ліміт навіть після скорочення — розбий репліку на два субтитри замість того, щоб зменшувати шрифт.
- 07
Синхронізуй голос із картинкою
Є два різні завдання, і їх не варто плутати:
- Voice-over — голос накладається поверх відео без прив'язки до губ (b-roll, закадровий текст). Головне тут — щоб репліка збігалася з тим, що показано в кадрі саме в цю секунду.
- Lip-sync — голос точно збігається з рухом губ персонажа чи аватара (детальніше — в уроці про talking-head). Тут навіть невелике розходження в частку секунди виглядає як «непроговорено».
Якщо озвучка вийшла коротшою чи довшою за відеоряд — підганяй монтаж або паузи в аудіо під зображення, а не розтягуй і не прискорюй сам голос: пришвидшений TTS-голос одразу видає неприродний тембр.
- 08
Прослухай перед публікацією
Останній крок — перевірка, яку неможливо зробити «на око».
- Прослухай готовий ролик на динаміку телефону, а не в навушниках, — саме так його почує більшість аудиторії.
- Перегляни без звуку, читаючи тільки субтитри, — чи зрозуміла суть без голосу взагалі.
- Перевір вимову всіх власних назв і англіцизмів ще раз — саме на них найчастіше «спотикається» синтез.
- Відкрий чернетку публікації в самому додатку (TikTok/Reels), а не лише в редакторі, — інтерфейс може перекрити субтитри, яких не було видно в експорті.
Готовий ролик із чистою природною озвучкою (своїм голосом або синтезом), правильно вимовленими власними назвами й субтитрами, які читаються в стрічці без перекриття інтерфейсом — придатний для публікації в Reels, TikTok чи Shorts і зі звуком, і без нього.
Найчастіша помилка — озвучувати текст, написаний «для читання очима»: складні речення, канцелярит, без свідомих пауз. Результат звучить монотонно й роботизовано, навіть якщо сам голос дуже якісний. Спочатку перепиши текст під голос — і лише потім озвучуй.
Хочеш спробувати?
Зареєструйся — і відкриєш цей і всі безкоштовні уроки.
Почитати за темою
Звук вирішує половину: озвучка, музика і атмосфера в AI-відео
Чому відео без звуку виглядає дешево: голос, ліпсинк, музика під темп монтажу, атмосферні шуми — і типові помилки, що псують мікс.
8 хвВідеоТри нейромережі — один кліп: як зібрати музичне відео з AI
Повноцінний музичний кліп: кінематографічний персонаж, який не «пливе» між кадрами, чистий lip sync і монтаж. Розбираю, який AI за що відповідав — і чому саме звʼязка з трьох інструментів, а не один.
5 хв