BLOG Блог
Як зробити VSL відео за 15 хвилин: покрокова інструкція з ШІ
·5 хв читання
Ще недавно створення VSL відео означало студію, актора й тиждень монтажу. Тепер увесь цикл — від тексту до готового ролика з живим спікером — уміщається в один сервіс і займає хвилини: нейромережа для створення відео сама озвучує текст, оживляє фото і вшиває титри. Нижче — покрокова інструкція, як зробити VSL, на прикладі студії VSL·TOOLS: що підготувати, як іде генерація і де зазвичай помиляються.
Що потрібно на вході
- Сценарій. Текст ролика з розбивкою на репліки. Якщо тексту ще немає — див. структуру та формули VSL.
- Одне фото спікера. Анфас або три чверті, обличчя займає помітну частину кадру, без сильних тіней і окулярів із відблисками. Фото має бути вашим або людини, яка дала згоду на використання свого обличчя.
- 10 секунд голосу. Чистий запис без музики й шуму: голосове повідомлення з телефона підійде. Якщо зразка немає — голос проєктується за описом.
Усе. Жодних зелених екранів, зйомок і монтажних програм.
Крок 1. Вставте сценарій
Створіть VSL-проєкт і вставте текст. Сервіс сам розіб'є його на репліки й визначить, хто говорить: діалог двох персонажів розмічається автоматично, монолог — одним спікером.
Репліки — одиниця всієї подальшої роботи. Кожна озвучується, правиться й перегенерується окремо, тому краще тримати їх короткими: одне-два речення. Довгі абзаци сервіс сам розіб'є на речення.
Крок 2. Створіть персонажа: фото і голос
Для кожного спікера — одне фото та голос.
Клон голосу. Завантажте зразок на 10 секунд — сервіс розшифрує його й навчиться тембру, манери та темпу. Клон говорить будь-якою мовою: українською, англійською, іспанською, польською та десятками інших, — навіть якщо зразок записано лише однією.
Голос за описом. Немає зразка — оберіть характер: стать, вік, тембр, настрій. Нейромережа створить унікальний голос, якого немає в конкурентів і який не прив'язаний до реальної людини.
Порада: якщо ролик під конкретне гео, беріть зразок носія мови — клон успадкує акцент оригіналу.
Крок 3. Озвучте репліки
Натисніть «Озвучити все». Кожна репліка генерується окремо, і в цьому головна перевага перед «одним файлом на весь ролик»: не сподобалась інтонація третьої фрази — перегенеруйте лише її, решта залишиться без змін.
Що можна правити у вбудованому редакторі:
- Наголоси. Імена, бренди й рідкісні слова позначаються знаком наголосу прямо в тексті — сервіс веде базу проблемних слів і підставляє позначки сам.
- Паузи й темп. Розбивайте репліку крапкою або комою там, де потрібна пауза; емоційні фрази з «!» і «?» краще тримати окремою реплікою.
- Гучність і дублі. Кілька дублів однієї фрази — і вибір найкращого.
Вартість озвучки — за символи тексту (тарифи): трихвилинний ролик — це приблизно 3000 символів, тобто центи.
Крок 4. Згенеруйте відео з фото
Коли озвучка готова, сервіс збирає відеоряд — це генерація відео з фото, або, простіше, «оживити фото ШІ»: персонаж промовляє текст, губи потрапляють у кожне слово, сцени змінюються як у справжньому монтажі — загальний план, великий, інший ракурс.
Модель генерації обирайте під завдання:
| Тариф | Для чого | Особливість |
|---|---|---|
| Lite | Тести гіпотез, масові зв'язки | Швидко й дешево, стабільна картинка |
| Standard | Основні ролики, середні плани | Природні жести й міміка |
| Pro | Великі плани, фінальні версії | Максимальна деталізація обличчя |
Сервіс уміє підбирати модель сам за довжиною фрагментів: короткі репліки краще віддавати Standard, довгі монологи — Lite. Оплата — за секунди готового відео, тому 30-секундний тест хука коштує кілька десятків центів.
Крок 5. Додайте титри
Більшу частину стрічки дивляться без звуку, і хук без титрів просто не доходить. У сервісі титри робляться у два кліки: авторозшифровка з таймінгом до слова, вибір стилю (підкладка, обведення, підсвітка активного слова) і вшивання у відео. Прев'ю показує рівно те, що потрапить у фінал.
Крок 6. Зберіть фінал і перевірте
Фінальна збірка склеює сцени, вирівнює звук і віддає mp4 під платформу. Перед публікацією перевірте три речі:
- Перші 10 секунд — хук читається з титрами і без звуку?
- Стики реплік — чи немає проковтнутих закінчень слів (якщо є, коротку репліку варто переозвучити з крапкою в кінці).
- Обличчя на великих планах — чи не «пливе»; якщо план великий, а модель Lite, перемкніть його на Pro.
Скільки це коштує
На поточних тарифах ролик на 3 хвилини з одним спікером, клоном голосу й титрами обходиться приблизно так: озвучка ~3000 символів — близько $0.20, титри — близько $0.15, відео — від $1.80 на Standard 640p ($2.40 на Lite 480p) до $5.40 на Pro. Загалом від двох до шести доларів за готовий VSL проти сотень доларів за зйомку — і без перезйомки при правках.
Стартовий бонус при реєстрації покриває перший тестовий ролик, а аналіз готового відео для заміни спікера взагалі безкоштовний.
Часті помилки
- Погане фото. Розмите обличчя, малий розмір, сильне бічне світло — персонаж вийде «пластиковим». Беріть різкий портрет із рівним світлом.
- Шумний зразок голосу. Музика або другий голос у записі потраплять у клон. 10 секунд чистої мови важливіші за хвилину з шумом.
- Величезні репліки. Абзац на 800 символів важко правити й перегенерувати; тримайте репліки в межах 200 символів.
- Наголоси у звичайних словах. Позначки потрібні лише іменам, брендам і рідкісним словам — на частотних словах вони звучать як чужий акцент.
- Один ролик на всі гео. Перекладайте й переозвучуйте тим самим клоном під кожне гео — так глядач не відчуває підміни.
Що далі
Коли перший VSL готовий, масштабуйте: 5–10 варіантів хука на одному тілі ролика, другий спікер, інша тривалість. У готовому ролику можна замінити спікера або перекласти його іншою мовою, перегенерувавши лише змінені секунди.
Створити перший VSL можна просто зараз — реєстрація займає хвилину.
Зберіть свій VSL за хвилини
Даруємо $3 на перші генерації: клон голосу, живий персонаж із фото й титри — в одному циклі, оплата лише за секунди готового відео.
Створити перший VSL