ШІ-стек для UGC-рекламного відео: 30-секундний ролик із трьох моделей і його ціна

33 хв. читання

Коротко (TL;DR)

  • Рекламний UGC-ролик на 30 секунд збирається з трьох моделей різного призначення: Claude Opus 5.5 пише сценарій і промпти, GPT Image 2.5 малює персонажа та продукт, Seedance 2.5 оживлює кадр разом зі звуком.
  • Прямі витрати через API — приблизно $12,5–47 за один прийнятий ролик (вересень 2026). Розкид майже вчетверо майже повністю дає відеоланка: у Seedance 2.5 немає єдиного світового прайсу.
  • Відео з’їдає 91–96% бюджету, тому економити має сенс лише там: чернетки в 480p, чистовик у 720p.
  • Нативного 4K в API поки немає. Анонс обіцяє 4K, а API на старті (серпень 2026) віддає 480p і 720p.
  • Розкриття — на двох рівнях: текст у самому креативі, якщо синтетичний персонаж говорить від імені «клієнта» (до цього веде правило FTC про фейкові відгуки), і позначка платформи там, де її вимагають правила майданчика.

Що таке UGC-відео з ШІ на практиці? Це не одна кнопка в конструкторі, а ланцюжок із чотирьох кроків: сценарій, персонаж, відео, монтаж із маркуванням. Нижче — як пройти його на трьох іменних моделях із відкритими цінами і скільки це коштує насправді. Конструктори, які продають те саме за підписку, ціну часто не показують узагалі: за індексом Playcut на 21 серпня 2026 року з 12 популярних платформ чотири не публікують тарифу, який можна перевірити.

Що таке UGC-відео і навіщо AI UGC-рекламу збирати з трьох моделей

UGC-відео (user-generated content) — ролик, який виглядає так, ніби його зняв звичайний користувач: вертикальний кадр, камера телефона, людина говорить просто в об’єктив. AI UGC означає той самий формат, де «користувача», його голос і сцену згенерували нейромережі. Одна модель такого ролика не збере: мовна не малює, графічна не анімує, відеомодель не пише сценарію.

Звідси й зв’язка. Кожна ланка має свою роботу:

  • Мовна модель перетворює фото продукту на текстовий «візуальний профіль», обирає рекламний кут, пише репліки з таймінгом і готує промпти для двох наступних моделей.
  • Модель зображень робить стартовий кадр: обличчя персонажа і продукт, які потім не мають змінюватися від сцени до сцени.
  • Відеомодель оживлює цей кадр: рух, міміку, мовлення і фоновий звук.

Патерн «LLM пише бриф → графічна модель тримає референс → відеомодель анімує» повторюється в більшості практичних гайдів із топу видачі. Там його зазвичай зібрано на інших моделях (Claude, Nano Banana, Veo або Kling). Ми беремо той самий каркас на моделях, що вийшли в червні–вересні 2026 року, бо кожна має властивість, яка закриває головний біль попереднього покоління: Seedance 2.5 знімає 30 секунд одним дублем, і склеювати шість коротких кліпів більше не потрібно.

Типовий ручний процес AI UGC-реклами, за розбором Retiplex, складається з 10 кроків, близько 7 окремих інструментів і забирає пів дня. Нативний звук Seedance 2.5 прибирає з нього два кроки — окреме клонування голосу і підганяння аудіо під губи, — якщо ролик вкладається в один 30-секундний дубль.

Приклади UGC-відео: чотири рекламні формати під один сценарій

Сценарій UGC-реклами майже ніколи не вигадують із нуля. Роками працюють чотири формати, і мовній моделі простіше обрати один із них, ніж винаходити свій. Ось як вони виглядають на прикладі умовного продукту — енергетичних жувальних цукерок:

ФорматЯк звучить хук (перші 3 секунди)Структура роликаКоли брати
Проблема → рішення«Щодня о другій дня я просто вимикалася»біль → спроби → продукт → результат → закликпродукт закриває зрозумілий побутовий біль
Відгук клієнта«Я скептично до цього ставилася, але…»сумнів → досвід → конкретний ефект → порадапотрібен соціальний доказ; найризикованіший формат для розкриття ШІ
До → після«Ось я місяць тому, а ось зараз»стан «до» → перехід → стан «після»ефект видно на око
Історія«Коротше, зі мною вчора сталося…»побутова сцена → продукт входить в історію → розв’язкапродукт складно показати безпосередньо

Формат «відгук клієнта» позначено не випадково: правило FTC забороняє видавати відгук за думку людини, якої не існує, — і синтетичний «клієнт» без розкриття ШІ під цей опис потрапляє. Детально — у розділі про маркування нижче.

Ритм у всіх чотирьох однаковий: хук, розвиток, продукт, доказ, заклик. У 30 секунд вкладається 40–80 вимовлених слів — це орієнтир Retiplex для роликів тривалістю 15–30 секунд.

Що потрібно для AI UGC-ролика: доступи до трьох моделей і файли

Перш ніж відкривати моделі, зберіть чотири речі. Без них кожен наступний крок вгадуватиме.

  1. Дві-три якісні фотографії продукту — упаковка, етикетка, сам продукт великим планом. За ними мовна модель опише продукт так, як його бачить камера.
  2. Доступ до Claude Opus 5.5 — через застосунок Claude або через API (модель claude-opus-5-5, доступна також в AWS, Google Cloud і Azure).
  3. Доступ до GPT Image 2.5 — у застосунку ChatGPT генерації входять у підписку, в API модель називається gpt-image-2.5-flare або gpt-image-2.5-sunburst.
  4. Доступ до Seedance 2.5. Офіційний API відкрито на китайській платформі Volcano Engine Ark із 7 серпня 2026 року (модель doubao-seedance-2-5-260628). Відкритого міжнародного прайсу й доступу через BytePlus на дату перевірки ми не знайшли, тому за межами Китаю модель беруть у посередників — наприклад, на fal.ai вона на 26 вересня 2026 доступна до 720p зі своєю ціною.

Окремо визначте формат: UGC живе вертикально, тому всі кадри й відео робимо у 9:16. Для фінального експорту практичні гайди радять 1080×1920.

Крок 1. Opus 5.5 пише сценарій, розкадрування і промпти ролика

Перша ланка — Claude Opus 5.5, перша модель сімейства Claude 5.5 від Anthropic, що вийшла 22 вересня 2026 року. Через API вона коштує $4 за мільйон вхідних токенів і $20 за мільйон вихідних (на 22 вересня 2026; ціну незалежно підтвердив TechCrunch), кешоване читання — $0,20 за мільйон. Є швидкий режим, до 2,5 раза швидший, але вдвічі дорожчий — $8 і $40; для сценарію швидкість не критична, він не потрібен.

Одна деталь впливає на рахунок: режим «міркування» в Opus 5.5 більше не можна вимкнути. Токени міркувань оплачуються як вихідні, тому коротка відповідь може коштувати дорожче, ніж здається з довжини тексту.

Увесь крок — це чотири запити в одному чаті. Шаблони нижче складено за структурою, яку використовують практичні гайди; їх варто адаптувати під свій продукт. Промпти для наступних моделей просимо в Opus одразу англійською — так їх без правок приймуть GPT Image 2.5 і Seedance 2.5. Готові англомовні добірки промптів корисні як зразок форми, але візуального профілю вашого продукту в них немає.

Запит 1. Візуальний профіль продукту (додаєте 2–3 фото):

Ось фото мого продукту. Опиши його для відеореклами: категорія, тип і матеріал
упаковки, точні кольори, фактура, весь текст на етикетці. Одним абзацом англійською,
який я вставлю в генератори зображень і відео, щоб вони малювали саме цей продукт.

Цей абзац — головний результат кроку. Ви вставлятимете його в кожен наступний промпт, і саме він тримає продукт однаковим в усіх сценах.

Запит 2. Вибір формату:

Продукт: [візуальний профіль]. Аудиторія: [хто і що їх турбує]. Мета: покупка.
Який формат UGC-реклами пасує найкраще: проблема → рішення, відгук, до → після чи історія?
Обери один і поясни у двох реченнях.

Запит 3. Сценарій:

Напиши сценарій UGC-ролика на 30 секунд для цього продукту. Формат: [обраний].
Структура: хук (перші 3 секунди), розвиток, поява продукту, доказ, заклик.
60–75 слів, розмовно, як друг говорить у камеру. Без хештегів і емодзі.
Не приписуй продукту властивостей, яких немає в описі.

Останній рядок — не формальність. Будь-яка обіцянка в рекламі має бути правдою незалежно від того, хто її вимовляє, людина чи синтетичний персонаж.

Запит 4. Розкадрування і промпти:

Розбий сценарій на 3–4 сцени. Для кожної: тип кадру (голова, що говорить, чи продукт),
опис сцени, точні слова за кадром, тривалість у секундах. Сума — рівно 30 секунд.
Потім дай англійською: (1) промпт портрета персонажа для генератора зображень,
(2) промпт продуктового кадру, (3) єдиний промпт для відеомоделі на 30 секунд
із таймкодами сцен і репліками в лапках. Формат усюди — вертикальний 9:16,
стиль — знято на телефон, природне світло, без глянцю.

Правило, яке порушують найчастіше: тривалості сцен мають сходитися рівно в 30 секунд, без пауз і накладань. Таблиця сцен стає картою для всіх наступних кроків.

Скільки це коштує: така сесія, за нашою оцінкою, займає 10–60 тисяч вхідних і 5–40 тисяч вихідних токенів з урахуванням міркувань. За ставками Opus 5.5 це $0,14–1,04. На тлі відео це похибка.

Тренд вересня 2026 року — цей самий крок автоматизують повністю: на GitHub з’явилися обгортки-скіли для Claude Code (наприклад, AI-UGC-Factory), які проводять ланцюжок «персонаж → продукт → відео» без ручного копіювання промптів. Для першого ролика ручний шлях однаково корисніший: ви побачите, де саме ланцюжок рветься.

Крок 2. GPT Image 2.5 збирає незмінного персонажа і продукт

Друга ланка — GPT Image 2.5 (у застосунку ChatGPT — Images 2.5), що вийшла 8 вересня 2026 року. Її завдання — зробити два стартові кадри: портрет «автора» ролика і чистий кадр продукту. В інтерфейсах конструкторів такого персонажа називають AI-актором: це синтетичний автор, від імені якого йде реклама.

Модель випускають у двох варіантах, і вибір між ними — про завдання, а не про гроші:

FlareSunburst
Назва в APIgpt-image-2.5-flaregpt-image-2.5-sunburst
Швидкістьшвидша, варіант за замовчуваннямповільніша
Сильна сторонамасова генерація, чернеткиточні правки: текст на етикетці, дрібні деталі
Ціна токенівта самата сама
Де в нашому процесіпідбір обличчя й пози персонажаправка продуктового кадру з написами

Ставки в обох однакові: за офіційним прайсом OpenAI — $5 за мільйон текстових вхідних токенів, $8 за мільйон токенів вхідного зображення-референсу і $30 за мільйон вихідних токенів зображення (на 26 вересня 2026). Не плутайте з цінами посередників: CometAPI, наприклад, продає доступ дешевше ($4 і $24), але це тариф реселера, а не OpenAI.

Ціни за картинку OpenAI для версії 2.5 не публікує: калькулятор GPT Image 2 витрату токенів версії 2.5 не оцінює — це прямо сказано в документації Flare і Sunburst. Сторонні оцінки для кадру 1024×1024 — від ~$0,006 на низькій якості до ~$0,21 на максимальній. Для реклами низька якість не годиться, тому в розрахунку нижче беремо $0,05–0,21 за кадр. Оцінки зроблено для квадрата 1024×1024, а скільки токенів 2.5 витрачає на вертикальний 1088×1920, OpenAI не публікує. Навіть якщо вертикальний кадр обійдеться вдвічі дорожче, до підсумку це додасть від $0,40 до $3,15, а відео однаково залишиться 85–93% бюджету.

Порядок роботи:

  1. Згенеруйте портрет у Flare за промптом із кроку 1. Розмір задайте вертикальний — наприклад, 1088×1920: у GPT Image 2.5 сторони мають бути кратними 16, а співвідношення сторін — у межах від 1:3 до 3:1, тож це майже рівно 9:16.
  2. Оберіть одне обличчя і більше не генеруйте його заново. Усі наступні кадри — тільки правками цього зображення. Саме на вільній перегенерації персонаж «пливе».
  3. Зробіть продуктовий кадр за фото продукту, передавши його як референс. Написи на етикетці правте в Sunburst: він точніший у тексті.
  4. Звірте кадри з візуальним профілем із кроку 1: колір упаковки, шрифт, кількість предметів.

OpenAI заявляє у 2.5 «вірність референсу» — збереження облич, логотипів і продуктів через серію правок. Це заява вендора, а не незалежний тест, тому крок 4 не пропускайте. Якщо GPT Image 2.5 з якоїсь причини не підходить, альтернативи та їхні ціни ми розбирали в огляді нейромереж для генерації картинок.

Крок 3. Seedance 2.5 оживлює кадр: 30-секундний дубль і звук

Третя ланка — Seedance 2.5 від ByteDance. Модель анонсували 23 червня 2026 року на конференції Volcano Engine FORCE, API відкрили 7 серпня. Головне для реклами — ролик до 30 секунд за один прохід зі звуком: у Seedance 2.0 стеля була близько 15 секунд, і 30-секундну рекламу збирали з кількох кліпів.

Перш ніж планувати бюджет, звірте анонс із тим, що реально доступно:

ПараметрЗаявлено в анонсіДоступно в API на старті (серпень 2026)
Тривалістьдо 30 секунд одним проходомвід 4 до 30 секунд
Роздільна здатністьнативний 4K, 10-бітний колірлише 480p і 720p
Референсидо 50 файлівдо 50: 30 зображень, 10 відео, 10 аудіо
Звукгенерується разом із відеоє, параметр generate_audio
Продовження і правкасценарії продовження та редагування заявленобагатораундове продовження є в документації Volcano Engine
Цінаобіцяли оголосити до релізуєдиного світового прайсу так і немає

Розрив між «нативним 4K» і реальними 480p/720p — головна пастка під час планування. Хто планує бюджет за рекламною карткою, отримує ролик іншої якості та інший кошторис. На 26 вересня 2026 року в тарифі fal.ai вже з’явився рядок 1080p ($1,164 за секунду), але опис моделі там і далі говорить про ролики до 720p, а 4K не пропонує ніхто.

Ліміт референсів зріс більш ніж утричі — з ~12–15 файлів у Seedance 2.0 до 50. Для порівняння: Veo 3.1 приймає 3 зображення. Для UGC це означає, що в один запит поміщаються портрет персонажа, продуктовий кадр із кількох ракурсів і зразок голосу.

Порядок роботи:

  1. Зберіть референси: портрет із кроку 2, продуктовий кадр, за потреби аудіозразок голосу.
  2. Вставте відеопромпт із кроку 1 — з таймкодами сцен і репліками в лапках. Тривалість — 30 секунд, формат кадру — 9:16 (параметр ratio), звук — увімкнено.
  3. Зробіть чернетку в 480p. Генерація асинхронна: ви створюєте завдання, а потім забираєте готовий ролик за його ідентифікатором.
  4. Перевірте чернетку за таблицею сцен: чи збігається обличчя зі стартовим кадром, чи не перемальовано продукт, чи встигає персонаж договорити.
  5. Перезапустіть вдалий варіант у 720p для чистовика. Композиція під час зміни роздільної здатності може зсунутися, тому дивіться чистовик так само уважно, як чернетку.

Якщо потрібен не рекламний ролик із мовленням, а просто рух у кадрі за фотографією, це інше завдання з іншою економікою — його ми розбирали в матеріалі про оживлення фото у відео нейромережею.

Крок 4. Монтаж, субтитри й маркування ШІ перед запуском реклами

Навіть 30-секундний дубль — ще не готова реклама. Останній крок робиться в будь-якому відеоредакторі (у гайдах найчастіше CapCut):

  • Субтитри — більшість роликів у стрічці дивляться без звуку.
  • Музика — тихою підкладкою під мовлення, якщо Seedance не згенерував фон.
  • Текст розкриття ШІ просто в кадрі, якщо персонаж говорить від імені клієнта: наприклад, «персонажа й відгук створено ШІ».
  • Експорт у 1080×1920, H.264. Вихідний файл 720p при цьому апскейлиться: картинка стане більшою, але деталей у ній не додасться.
  • Позначка про ШІ-контент — там, де майданчик її вимагає або пропонує під час запуску.

Якщо ролик не вклався в один дубль і частину сцен згенеровано окремо, голос може відрізнятися між кліпами. Практики розв’язують це клонуванням голосу з уже готового кліпу, де персонаж говорить (наприклад, в ElevenLabs): інтонація тоді збігається автоматично. У наш розрахунок цей крок не входить.

Скільки коштує один рекламний AI UGC-ролик із трьох нейромереж

Один 30-секундний AI UGC-ролик через API обходиться приблизно в $12,5–47 на вересень 2026 року. Нижня межа — мінімальна оцінка ціни секунди Seedance 2.5 і дві спроби, верхня — фактична ціна посередника fal.ai і три спроби. На сценарій і картинки навіть у найгіршому разі йде менше ніж $4,2, усе інше — відео.

Розрахунок прозорий, тому спочатку — вхідні дані.

Ціна секунди Seedance 2.5 — головна невідома. Єдиного світового прайсу в ByteDance немає: за межами Китаю модель купують у посередників за їхніми ставками. Оцінки й ціни на різні дати:

ДжерелоЦіна секундиДата
Kie.aiофіційного прайсу немає15 липня 2026
APIMart (ставки Seedance 2.0 Pro як орієнтир)$0,10 (480p) · $0,20 (720p) · $0,50 (1080p)7 липня 2026
Wan27¥1,5–3,0, тобто $0,21–0,42липень 2026
fal.ai, фактична ціна≈$0,22 (480p) · ≈$0,47 (720p)26 вересня 2026

Для 720p оцінки розходяться від $0,20 до ~$0,47 за секунду — майже у 2,5 раза. Тому розглядаємо два сценарії, а не одне «середнє» число, якого на ринку не існує.

Припущення: сценарна сесія Opus 5.5 — від 10 тис. вхідних і 5 тис. вихідних токенів до 60 тис. і 40 тис.; картинок GPT Image 2.5 — від 8 генерацій по $0,05 до 15 по $0,21; відео — 30 секунд 720p, від 2 до 3 спроб на прийнятий дубль. Множник спроб — орієнтир, а не константа: єдиний публічний замір частки браку зроблено на Seedance 2.0, ми детально розбирали його в розрахунку ціни секунди ШІ-відео з урахуванням браку.

ЛанкаМінімумМаксимум
Opus 5.5: сценарій і промпти10k × $4/1M + 5k × $20/1M = $0,1460k × $4/1M + 40k × $20/1M = $1,04
GPT Image 2.5: персонаж і продукт8 × $0,05 = $0,4015 × $0,21 = $3,15
Seedance 2.5: відео 30 с, 720p30 × $0,20 × 2 = $12,0030 × $0,473 × 3 = $42,57
Разом за прийнятий ролик≈$12,54≈$46,76
Частка відео в бюджеті96%91%

Одна спроба 30-секундного відео в 720p коштує від $6,00 до $14,19. Вхідні токени референсів у GPT Image 2.5 додають до розрахунку центи. На fal.ai ціну вказано за секунду згенерованого відео, звук вмикається опцією під час запуску. За відеореференси деякі постачальники беруть окремо — у Seedance 2.0 це було 50% ставки за кожну секунду вхідного відео.

Де реально економити. Якщо відео — це 91–96% грошей, оптимізувати сценарій чи картинки безглуздо. Працює одне: чернетки в 480p, чистовик у 720p. Дві чорнові спроби й один чистовик замість трьох спроб у 720p:

Три спроби в 720p2 чернетки 480p + 1 чистовик 720pЕкономія
За мінімальними оцінками ($0,10 / $0,20)$18,00$6,00 + $6,00 = $12,0033%
За цінами fal.ai ($0,2205 / $0,473)$42,57$13,23 + $14,19 = $27,4236%

З чим порівнювати. Живий UGC-креатор, за даними AdLibrary (оновлення квітня 2026), коштує $200–2000 за ролик і робить його 1–3 тижні. Навіть на верхній межі нашого розрахунку живий креатор приблизно вчетверо дорожчий, на нижній — у 16 разів. Але в нашій цифрі немає вашого часу: ручний процес забирає близько пів дня.

І порівняння з попереднім поколінням: той самий 30-секундний ролик на Seedance 2.0 вимагав шести кліпів по 5 секунд — $2,88 генерації за ставкою $0,096/с, плюс 2–4 години ручного склеювання й апскейлу (оцінка Kie.ai на 15 липня 2026). Генерація 2.5 дорожча, зате склеювання зникає.

Що застаріє першим: ціна секунди Seedance 2.5 і перелік роздільних здатностей. Коли ByteDance опублікує світовий прайс і відкриє 1080p/4K, рядок відео в таблиці зміниться; ставки Anthropic і OpenAI звіряйте на їхніх офіційних сторінках цін.

Типові помилки AI UGC-зв’язки: де персонаж «пливе» і як це виправити

Більшість зіпсованих роликів ламається не всередині моделі, а на стику двох моделей. Ось типові збої ланцюжка і способи їх виправити:

  1. Репліка коротша за сцену. Якщо слів менше, ніж секунд, відеомодель починає «домальовувати» мовлення й рухи, щоб заповнити час. Рішення — 40–80 слів на 15–30 секунд і перевірка таблиці сцен до генерації.
  2. Обличчя генерується заново в кожній сцені. Кожен новий портрет — нова людина. Рішення — один майстер-портрет із кроку 2 і передавання його референсом у кожен запит до Seedance.
  3. Продукт перемальовано. Відеомодель змінює колір упаковки або літери на етикетці. Рішення — продуктовий кадр окремим референсом і візуальний профіль із кроку 1 у тексті відеопромпту. Напис, який модель уперто спотворює, простіше накласти в монтажі.
  4. Голос змінюється між кліпами. Трапляється, коли ролик зібрано з кількох генерацій. Рішення — вкладатися в один 30-секундний дубль або клонувати голос із найкращого кліпу, де персонаж говорить.
  5. Бюджет розраховано за анонсом. План під 4K, а API віддає 720p. Рішення — планувати за таблицею «анонс проти API» з кроку 3.
  6. Розраховано ціну однієї генерації, а не прийнятого ролика. Правильна метрика — вартість ролика, який ви справді запустили, з урахуванням усіх відкинутих спроб. Модель, дорожча за кліп, може виявитися дешевшою за готовий ролик, якщо їй потрібно менше спроб.

Приклад того, як це виглядає на практиці: персонаж у першій сцені тримає банку з помаранчевою кришкою, а в третій — із синьою. Причина майже завжди в пункті 3: продуктовий кадр не передали референсом, і модель намалювала «схожий» продукт за текстом промпту.

Розкриття ШІ в рекламі та ризики: що вимагають FTC, Meta і TikTok

Коротко: якщо синтетичний персонаж говорить про продукт так, ніби це досвід реальної людини, це треба розкрити в самому ролику, а на майданчиках — ще й позначити за їхніми правилами. Одне не замінює іншого. Правило FTC діє у США, а правила маркування Meta і TikTok однакові для всіх ринків, де працює майданчик.

Що вимагає кожен регулятор і майданчик:

  • FTC (США). З 21 жовтня 2024 року діє правило FTC про фейкові відгуки: воно прямо забороняє відгуки й рекомендації від імені людей, яких не існує, — зокрема згенеровані ШІ, — і від тих, хто не мав реального досвіду з продуктом. Синтетичний персонаж, який розповідає про «свій досвід», потрапляє під цей опис, якщо глядач не розуміє, що перед ним ШІ. За свідомі порушення правила FTC може вимагати цивільний штраф — понад $50 тис. за кожне. Відповідає насамперед рекламодавець: пославшись на підрядника, який робив ролик, відповідальності не уникнути.
  • Meta. Обов’язкове розкриття цифрово створеного чи зміненого контенту в рекламі Meta вимагає для оголошень на соціальні та політичні теми. Реалістичні ШІ-відео й аудіо у звичайних публікаціях користувачі зобов’язані позначати самі, а мітку «AI info» платформа ставить і автоматично, коли розпізнає ШІ-контент за галузевими сигналами.
  • TikTok. Реалістичний ШІ-контент треба позначати під час публікації перемикачем «AI-generated content»; крім того, майданчик сам ставить мітку, якщо у файлі є метадані Content Credentials (C2PA).

Важливий нюанс: мітка платформи повідомляє, що контент зроблено ШІ, але не знімає питання, чия думка звучить у ролику. Текст розкриття в креативі закриває саме його, тому в чек-листі запуску потрібні обидві колонки.

Навколо самого формату триває відкрита суперечка. Частина маркетологів називає AI UGC-відгуки неетичними і «порушенням FTC» за визначенням. Їхні опоненти відповідають, що правила однакові для людей і для ШІ: твердження про продукт мають бути правдою, а спонсорство — розкритим. На практиці з цього випливає просте правило: ШІ не дає права вигадувати ефект, якого продукт не має.

Окремий ризик — чуже обличчя й голос. Згенерований персонаж не має копіювати реальну людину, а клон голосу робиться лише за згодою його власника. Тема болюча: у вересні 2026 року донька Робіна Вільямса публічно попросила припинити створювати ШІ-відео з образом її батька.

І останнє — дані. Фото продукту, який ще не анонсовано, потрапляють одразу до трьох постачальників. Anthropic пропонує Opus 5.5 з опцією нульового зберігання даних, а запити до офіційного API Seedance 2.5 йдуть на пекінський сервер Volcano Engine; посередник додає в ланцюжок ще одну сторону.

Зв’язка трьох моделей проти AI UGC-конструкторів: ціна і контроль

Готові конструктори — Arcads, Creatify, HeyGen, Higgsfield і десяток схожих — продають той самий ланцюжок усередині одного інтерфейсу; їхні англомовні вітрини рекламують саме AI UGC video ads «під ключ». Головна відмінність від нашої зв’язки — не якість, а те, наскільки можна заздалегідь розрахувати гроші.

КритерійЗв’язка Opus 5.5 + GPT Image 2.5 + Seedance 2.5Конструктори AI UGC
Прозорість ціниставки Anthropic і OpenAI опубліковано; у Seedance — діапазон оцінок і ціни посередників4 з 12 платформ не публікують ціни, яку можна перевірити (індекс Playcut на 21 серпня 2026)
Ціна генерації 30 секунд$6,00–14,19 за спробу, $12,5–47 за прийнятий ролик$0,07–6,00 у платформ з опублікованою ціною; дешевий край — аватар-«голова, що говорить», а не нативний UGC
Одиниця оплатитокени й секундикредити, хвилини, місця в команді — у кожного своя
Довжина одного дублядо 30 секундзалежить від рушія платформи
Контроль над кадромдо 50 референсів, свій сценарій і промптишаблони й бібліотека аватарів
Комерційна ліцензіяза умовами кожного постачальникау частини тарифів її немає: за даними Playcut, в Akool три з п’яти тарифів мають особисту ліцензію, у HeyGen безкоштовний план не можна використовувати в рекламі
Поріг входутри доступи й пів дня роботиреєстрація і шаблон

Одне застереження щодо джерела: Playcut сам продає сервіс для AI-реклами і входить у власний індекс, про це він пише відкрито. Цифри його індексу можна перевірити за сторінками вендорів, але висновки варто читати з цією поправкою.

З таблиці видно те, про що зазвичай не говорять: конструктор може бути дешевшим за кліп. Найнижча ціна в платформ з опублікованим тарифом — $0,07 за 30 секунд, це в десятки разів менше за наш мінімум. Але це аватар, що говорить, а не сцена з продуктом у руках, і такий ролик розв’язує інше завдання.

Зв’язка виграє там, де потрібні три речі: знати ціну до запуску, тримати власного персонажа від ролика до ролика і керувати сценарієм порядково. Програє — там, де потрібен швидкий потік однотипних «голів, що говорять» за копійки.

Практичний висновок для тих, хто обирає готовий конструктор: якщо платформа не показує ціну на своїй сторінці, вважайте це ризиком, а не дрібницею. За спостереженням Playcut, цифри, які гуляють мережею для таких сервісів, часто публікують прямі конкуренти — просіть ціну письмово.

Часті запитання

Чи можна зробити AI UGC-рекламу безкоштовно?

Повністю безкоштовно — ні, якщо ролик іде в рекламу. Безкоштовні тарифи конструкторів зазвичай ставлять водяний знак, а в частини сервісів безкоштовний результат прямо заборонено використовувати в рекламі. Мінімально розумний бюджет за нашою зв’язкою — близько $12,5 за 30-секундний ролик. Безкоштовно можна відпрацювати сценарій і промпти, а генерацію робити вже на платному доступі.

Чи треба розкривати, що рекламу зроблено ШІ, якщо аудиторія не у США?

Так, у більшості випадків. Правило FTC формально діє у США, але правила маркування Meta і TikTok не залежать від країни: TikTok вимагає позначати реалістичний ШІ-контент, Meta — розкривати його в рекламі на соціальні та політичні теми і сама ставить мітку «AI info». Якщо синтетичний персонаж розповідає про «свій досвід», безпечніше розкривати це просто в ролику.

Чи можна використати в ролику обличчя реальної людини без її згоди?

Ні. Обличчя й голос реальної людини без її явної згоди — прямий шлях до претензій щодо права на образ і до блокування реклами. Для UGC це й не потрібно: GPT Image 2.5 генерує синтетичного персонажа, якого не існує в реальності. Стежте лише, щоб промпт не описував упізнавану знаменитість, а голос клонуйте тільки за згодою його власника.

Чим Seedance 2.5 відрізняється від Veo 3.1 для такої реклами?

Головна відмінність — довжина дубля і кількість референсів. Seedance 2.5 робить до 30 секунд одним проходом і приймає до 50 референсів, Veo 3.1 генерує кліпи по 8 секунд і приймає 3 зображення. Зате у Veo 3.1 є офіційний прайс Google — $0,10 і $0,40 за секунду 720p у режимах Fast і Standard на 26 вересня 2026, — а в Seedance 2.5 його поки немає.

Чи можна замінити Opus 5.5 іншою мовною моделлю?

Так. Сценарій, розкадрування і промпти напише будь-яка сильна мовна модель — різниця у вартості тут менша за долар на ролик, а весь бюджет визначає відео. Обирати варто за якістю тексту вашою мовою і за тим, наскільки модель тримає обмеження промпту. Різницю в ціні й поведінці флагманів ми розбирали в огляді GPT-6 Sol і Luna.

Чи можна генерувати такі ролики на власній відеокарті?

Частково. Відкриті відеомоделі — Wan 2.2, LTX і HunyuanVideo 1.5 — запускаються вдома і знімають оплату за секунду. Системною вимогою для LTX у ComfyUI NVIDIA називає 16 ГБ відеопам’яті, а для реклами вирішальною виявляється ліцензія: не кожна відкрита модель дозволяє комерційне використання. Подробиці — у матеріалі про локальну генерацію відео на відеокарті.

Поділитися
Зв'язатися:
Крипто- та data-аналітик, інженер-програміст (факультет комп'ютерних наук ХНУРЕ). В IT з 2008 року: адміністрував корпоративний моніторинг у «Vodafone Україна», сім років розробляв і просував веб-проєкти, п'ять років керував маркетингом на метриках — конверсія, CTR, ROI, LTV.Криптовалютними ринками займаюся з 2021 року: ончейн-метрики, токеноміка, макроекономічні індикатори. Розробив власну data-driven модель аналізу ринку на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математична статистика та EDA; збір і звірку даних автоматизую AI-агентами.Принцип — «Don't trust, verify»: кожна цифра перевірена за першоджерелом, ключові — щонайменше за двома незалежними; прогнози — лише сценарії з умовами. Теза без даних не публікується.