VSL·TOOLS

BLOG Блог

Як зробити VSL відео за 15 хвилин: покрокова інструкція з ШІ

·5 хв читання

Ще недавно створення VSL відео означало студію, актора й тиждень монтажу. Тепер увесь цикл — від тексту до готового ролика з живим спікером — уміщається в один сервіс і займає хвилини: нейромережа для створення відео сама озвучує текст, оживляє фото і вшиває титри. Нижче — покрокова інструкція, як зробити VSL, на прикладі студії VSL·TOOLS: що підготувати, як іде генерація і де зазвичай помиляються.

Що потрібно на вході

  • Сценарій. Текст ролика з розбивкою на репліки. Якщо тексту ще немає — див. структуру та формули VSL.
  • Одне фото спікера. Анфас або три чверті, обличчя займає помітну частину кадру, без сильних тіней і окулярів із відблисками. Фото має бути вашим або людини, яка дала згоду на використання свого обличчя.
  • 10 секунд голосу. Чистий запис без музики й шуму: голосове повідомлення з телефона підійде. Якщо зразка немає — голос проєктується за описом.

Усе. Жодних зелених екранів, зйомок і монтажних програм.

Крок 1. Вставте сценарій

Створіть VSL-проєкт і вставте текст. Сервіс сам розіб'є його на репліки й визначить, хто говорить: діалог двох персонажів розмічається автоматично, монолог — одним спікером.

Репліки — одиниця всієї подальшої роботи. Кожна озвучується, правиться й перегенерується окремо, тому краще тримати їх короткими: одне-два речення. Довгі абзаци сервіс сам розіб'є на речення.

Крок 2. Створіть персонажа: фото і голос

Для кожного спікера — одне фото та голос.

Клон голосу. Завантажте зразок на 10 секунд — сервіс розшифрує його й навчиться тембру, манери та темпу. Клон говорить будь-якою мовою: українською, англійською, іспанською, польською та десятками інших, — навіть якщо зразок записано лише однією.

Голос за описом. Немає зразка — оберіть характер: стать, вік, тембр, настрій. Нейромережа створить унікальний голос, якого немає в конкурентів і який не прив'язаний до реальної людини.

Порада: якщо ролик під конкретне гео, беріть зразок носія мови — клон успадкує акцент оригіналу.

Крок 3. Озвучте репліки

Натисніть «Озвучити все». Кожна репліка генерується окремо, і в цьому головна перевага перед «одним файлом на весь ролик»: не сподобалась інтонація третьої фрази — перегенеруйте лише її, решта залишиться без змін.

Що можна правити у вбудованому редакторі:

  • Наголоси. Імена, бренди й рідкісні слова позначаються знаком наголосу прямо в тексті — сервіс веде базу проблемних слів і підставляє позначки сам.
  • Паузи й темп. Розбивайте репліку крапкою або комою там, де потрібна пауза; емоційні фрази з «!» і «?» краще тримати окремою реплікою.
  • Гучність і дублі. Кілька дублів однієї фрази — і вибір найкращого.

Вартість озвучки — за символи тексту (тарифи): трихвилинний ролик — це приблизно 3000 символів, тобто центи.

Крок 4. Згенеруйте відео з фото

Коли озвучка готова, сервіс збирає відеоряд — це генерація відео з фото, або, простіше, «оживити фото ШІ»: персонаж промовляє текст, губи потрапляють у кожне слово, сцени змінюються як у справжньому монтажі — загальний план, великий, інший ракурс.

Модель генерації обирайте під завдання:

Тариф Для чого Особливість
Lite Тести гіпотез, масові зв'язки Швидко й дешево, стабільна картинка
Standard Основні ролики, середні плани Природні жести й міміка
Pro Великі плани, фінальні версії Максимальна деталізація обличчя

Сервіс уміє підбирати модель сам за довжиною фрагментів: короткі репліки краще віддавати Standard, довгі монологи — Lite. Оплата — за секунди готового відео, тому 30-секундний тест хука коштує кілька десятків центів.

Крок 5. Додайте титри

Більшу частину стрічки дивляться без звуку, і хук без титрів просто не доходить. У сервісі титри робляться у два кліки: авторозшифровка з таймінгом до слова, вибір стилю (підкладка, обведення, підсвітка активного слова) і вшивання у відео. Прев'ю показує рівно те, що потрапить у фінал.

Крок 6. Зберіть фінал і перевірте

Фінальна збірка склеює сцени, вирівнює звук і віддає mp4 під платформу. Перед публікацією перевірте три речі:

  1. Перші 10 секунд — хук читається з титрами і без звуку?
  2. Стики реплік — чи немає проковтнутих закінчень слів (якщо є, коротку репліку варто переозвучити з крапкою в кінці).
  3. Обличчя на великих планах — чи не «пливе»; якщо план великий, а модель Lite, перемкніть його на Pro.

Скільки це коштує

На поточних тарифах ролик на 3 хвилини з одним спікером, клоном голосу й титрами обходиться приблизно так: озвучка ~3000 символів — близько $0.20, титри — близько $0.15, відео — від $1.80 на Standard 640p ($2.40 на Lite 480p) до $5.40 на Pro. Загалом від двох до шести доларів за готовий VSL проти сотень доларів за зйомку — і без перезйомки при правках.

Стартовий бонус при реєстрації покриває перший тестовий ролик, а аналіз готового відео для заміни спікера взагалі безкоштовний.

Часті помилки

  • Погане фото. Розмите обличчя, малий розмір, сильне бічне світло — персонаж вийде «пластиковим». Беріть різкий портрет із рівним світлом.
  • Шумний зразок голосу. Музика або другий голос у записі потраплять у клон. 10 секунд чистої мови важливіші за хвилину з шумом.
  • Величезні репліки. Абзац на 800 символів важко правити й перегенерувати; тримайте репліки в межах 200 символів.
  • Наголоси у звичайних словах. Позначки потрібні лише іменам, брендам і рідкісним словам — на частотних словах вони звучать як чужий акцент.
  • Один ролик на всі гео. Перекладайте й переозвучуйте тим самим клоном під кожне гео — так глядач не відчуває підміни.

Що далі

Коли перший VSL готовий, масштабуйте: 5–10 варіантів хука на одному тілі ролика, другий спікер, інша тривалість. У готовому ролику можна замінити спікера або перекласти його іншою мовою, перегенерувавши лише змінені секунди.

Створити перший VSL можна просто зараз — реєстрація займає хвилину.

Зберіть свій VSL за хвилини

Даруємо $3 на перші генерації: клон голосу, живий персонаж із фото й титри — в одному циклі, оплата лише за секунди готового відео.

Створити перший VSL
Створити перше крео