Перейти до основного вмісту
AI ACADEMY
Увійти
Усі уроки
ВідеоНовачокБезкоштовно

Озвучка й субтитри українською

Зробити готове відео (зняте на телефон чи згенероване AI) придатним для соцмереж: чиста озвучка, правильна українська вимова і субтитри, які реально читаються в стрічці.

20 хв8 кроків
Для кого
  • Є готовий відеоряд, але озвучка й субтитри роблять його схожим на чернетку
  • Синтез мовлення читає власні назви й наголоси неправильно, і це чути
  • Субтитри в TikTok/Reels наїжджають на інтерфейс або не встигають читатись
Що знадобиться
  • Синтез мовлення (TTS) з українською мовою
  • Мікрофон або диктофон для запису власного голосу
  • Редактор субтитрів з експортом окремим файлом

Озвучка й субтитри — це не «технічний останній крок», а те, що вирішує, додивляться ролик чи гортатимуть далі. Пройди кроки по черзі: спочатку текст під голос, потім вимова й темп, потім субтитри під формат стрічки — і відео перестане звучати як робот і виглядати як чернетка.

  1. 01

    Перепиши текст для вуха, а не для ока

    Текст, який добре читається очима, майже завжди звучить погано вголос. Речення для статті — довгі, з підрядними конструкціями; речення для голосу — короткі й розмовні.

    Перед озвучкою онов сценарій за трьома правилами:

    • Коротке речення = одна думка. Якщо в реченні дві коми й слово «який/котрий» — розбий на два речення.
    • Активне дієслово замість канцеляриту. «Здійснюється налаштування параметрів» → «Налаштуй параметри».
    • Прочитай текст уголос і познач, де виникає заминка. Кожне слово чи зворот, на якому язик спотикається, — кандидат на переписування. Синтез повторить ту саму заминку, що й жива вимова.

    Це не спрощення заради спрощення — вухо, на відміну від ока, не може «повернутись і перечитати» незрозуміле речення.

    Готовий промпт
    Перепиши цей текст так, щоб він звучав природно, коли його читають уголос: короткі речення (не більше 12–15 слів), активні дієслова, розмовний тон, без канцеляриту й складних підрядних конструкцій. Збережи всі факти і головну думку без змін. Ось текст: [ТЕКСТ ЧОРНОВИКА]

    Порада Читай сценарій із секундоміром: якщо на 30 секунд тексту припадає більш ніж дві заминки — переписуй текст, а не тренуй дикцію.

  2. 02

    Постав паузи там, де вони працюють

    Рівний темп без пауз — головна ознака «роботизованого» голосу, навіть якщо сам голос звучить якісно. Пауза — не порожнеча, а сигнал для мозку слухача: «зараз буде важливо».

    Де ставити паузу свідомо:

    • Перед головною думкою. «І ось у чому секрет.» [пауза] «.це робиться в одну дію».
    • Після питання. Дай слухачу частку секунди подумати, перш ніж прозвучить відповідь.
    • Між смисловими блоками — гачок, проблема, рішення, заклик — щоб думка встигла «переключитись».

    Більшість синтезаторів мовлення розставляють паузи за розділовими знаками: крапка й знак питання дають довшу паузу, кома — коротшу, три крапки — паузу-роздум. Онов пунктуацію сценарію свідомо під ці паузи, а не лише за правилами граматики.

    Порада Якщо мовлення звучить монотонно навіть із розділовими знаками — перевір, чи є в інструменті окреме керування темпом чи наголосом. Це працює по-різному в різних сервісах, тож перевіряй на своєму.

  3. 03

    Впорайся з наголосами і власними назвами

    Українські синтезатори найчастіше помиляються на трьох речах: омографах (слова, що пишуться однаково, а звучать по-різному залежно від наголосу), власних назвах і англіцизмах.

    • Омографи: «за́мок» (споруда) і «замо́к» (пристрій), «а́тлас» і «атла́с». Синтез обирає один варіант за замовчуванням — і часто не той, що потрібен.
    • Власні назви: імена, бренди, назви міст синтез читає «по літерах», без урахування реальної вимови.
    • Англіцизми: «маркетинг», «воркшоп», «лендінг» — запозичені слова, які синтезатор іноді тягне до англійської вимови літер.

    Якщо слово звучить неправильно — перепиши його фонетично, так, як воно має звучати: заміни літери на ті, що дадуть правильний наголос і вимову. Частина синтезаторів реагує на наголошений склад, виділений великою літерою (наприклад «маркЕтинг»), — але це працює не в усіх інструментах однаково, тож перевіряй результат на слух щоразу.

    Готовий промпт
    Ось список слів і назв, які я озвучую українською: [СПИСОК СЛІВ І НАЗВ]. Для кожного напиши, де в ньому наголос, і фонетичний варіант запису, який допоможе синтезатору мовлення прочитати слово правильно.

    Порада Виписуй проблемні слова в окремий список одразу після першого прослуховування — вони повторюватимуться в наступних роликах, і список економить час наступного разу.

  4. 04

    Виріши: свій голос чи синтез

    Обидва варіанти робочі, питання — що зараз важливіше.

    Озвучуй своїм голосом, якщо:

    • будуєш особистий бренд, і голос — частина впізнаваності;
    • є тиха кімната і хоча б найпростіший мікрофон;
    • текст короткий, і кілька дублів не забирають багато часу.

    Обирай синтез (TTS), якщо:

    • потрібно швидко багато варіантів чи кілька мов;
    • немає умов для чистого запису — шум, відлуння, відсутня техніка;
    • ідея ще тестується, і поки рано вкладати час у дублі.

    TTS (text-to-speech, синтез мовлення) — технологія, яка перетворює написаний текст на голос: пишеш репліку, а програма «промовляє» її штучним голосом, часто майже невідрізненним від живого.

  5. 05

    Налаштуй голос у синтезаторі

    Обираючи інструмент синтезу мовлення, дивись не на красиву демку, а на конкретні параметри:

    • Українська мова з природною інтонацією, а не «переклад з англійської вимови».
    • Керування темпом — можливість сповільнити чи прискорити мовлення окремо від тону голосу.
    • Кілька варіантів голосу, щоб підібрати тембр під тему ролика.
    • Експорт чистого аудіофайлу окремо від відео — знадобиться для монтажу.

    Згенеруй 2–3 варіанти з різним темпом і подачею й порівняй, який точніше передає гачок на початку ролика.

    Готовий промпт
    Згенеруй 5 варіантів першої фрази-гачка для короткого відео на тему: [ТЕМА РОЛИКА]. Кожен варіант — не довше 8 слів, розмовною українською, з інтригою чи несподіваним твердженням у перших словах.
  6. 06

    Зроби субтитри, які реально читаються в стрічці

    У TikTok і Reels ролики дивляться здебільшого без звуку — тому субтитри мають працювати як самостійний текст, а не «підпис до голосу».

    Вимірювані правила:

    • Не більше ~2 рядків тексту на екрані одночасно, і до ~30–40 символів у рядку — довші рядки на телефоні переносяться і «стрибають».
    • Час на екрані = час, потрібний прочитати вголос у комфортному темпі: не швидше за саму репліку, і не менше приблизно секунди навіть для найкоротшого субтитра.
    • Безпечна зона: не став текст у нижні ~15% кадру — там кнопки лайку, підпис і музичний диск інтерфейсу перекриють текст. Верхні ~10% також краще лишати вільними під шапку профілю.
    • Контраст: підложка або обводка під текстом, щоб субтитр читався на будь-якому фоні відео — і на світлому, і на темному.
    Готовий промпт
    Скороти цей субтитр до [N] символів, зберігши головний зміст і розмовний тон, без втрати сенсу: [РЕЧЕННЯ]

    Порада Якщо субтитр не влазить у ліміт навіть після скорочення — розбий репліку на два субтитри замість того, щоб зменшувати шрифт.

  7. 07

    Синхронізуй голос із картинкою

    Є два різні завдання, і їх не варто плутати:

    • Voice-over — голос накладається поверх відео без прив'язки до губ (b-roll, закадровий текст). Головне тут — щоб репліка збігалася з тим, що показано в кадрі саме в цю секунду.
    • Lip-sync — голос точно збігається з рухом губ персонажа чи аватара (детальніше — в уроці про talking-head). Тут навіть невелике розходження в частку секунди виглядає як «непроговорено».

    Якщо озвучка вийшла коротшою чи довшою за відеоряд — підганяй монтаж або паузи в аудіо під зображення, а не розтягуй і не прискорюй сам голос: пришвидшений TTS-голос одразу видає неприродний тембр.

  8. 08

    Прослухай перед публікацією

    Останній крок — перевірка, яку неможливо зробити «на око».

    • Прослухай готовий ролик на динаміку телефону, а не в навушниках, — саме так його почує більшість аудиторії.
    • Перегляни без звуку, читаючи тільки субтитри, — чи зрозуміла суть без голосу взагалі.
    • Перевір вимову всіх власних назв і англіцизмів ще раз — саме на них найчастіше «спотикається» синтез.
    • Відкрий чернетку публікації в самому додатку (TikTok/Reels), а не лише в редакторі, — інтерфейс може перекрити субтитри, яких не було видно в експорті.
Очікуваний результат

Готовий ролик із чистою природною озвучкою (своїм голосом або синтезом), правильно вимовленими власними назвами й субтитрами, які читаються в стрічці без перекриття інтерфейсом — придатний для публікації в Reels, TikTok чи Shorts і зі звуком, і без нього.

Головна помилка

Найчастіша помилка — озвучувати текст, написаний «для читання очима»: складні речення, канцелярит, без свідомих пауз. Результат звучить монотонно й роботизовано, навіть якщо сам голос дуже якісний. Спочатку перепиши текст під голос — і лише потім озвучуй.

Хочеш спробувати?

Зареєструйся — і відкриєш цей і всі безкоштовні уроки.

Отримати безкоштовно
Наступний урокUGC-ролик для реклами

Почитати за темою