ИИ-стек для UGC-рекламного видео: 30-секундный ролик из трёх моделей и его цена

33 мин. чтения

Коротко (TL;DR)

  • Рекламный UGC-ролик на 30 секунд собирается из трёх моделей разного назначения: Claude Opus 5.5 пишет сценарий и промпты, GPT Image 2.5 рисует персонажа и продукт, Seedance 2.5 оживляет кадр вместе со звуком.
  • Прямые затраты по API — примерно $12,5–47 за один принятый ролик (сентябрь 2026). Разброс почти в четыре раза почти целиком даёт видео-звено: у Seedance 2.5 нет единого мирового прайса.
  • Видео съедает 91–96% бюджета, поэтому экономить имеет смысл только там: черновики в 480p, чистовик в 720p.
  • Нативного 4K в API пока нет. Анонс обещает 4K, а API на старте (август 2026) отдаёт 480p и 720p.
  • Раскрытие — на двух уровнях: текст в самом креативе, если синтетический персонаж говорит от лица «клиента» (к этому ведёт правило FTC о фейковых отзывах), и метка платформы там, где её требуют правила площадки.

Создание AI UGC-видео (в англоязычных гайдах — AI UGC video creation) — это не одна кнопка в конструкторе, а цепочка из четырёх шагов: сценарий, персонаж, видео, монтаж с маркировкой. Ниже — как пройти её на трёх именных моделях с открытыми ценами и сколько это стоит на самом деле. Конструкторы, которые продают то же самое за подписку, цену часто не показывают вовсе: по индексу Playcut на 21 августа 2026 года из 12 популярных платформ четыре не публикуют проверяемого тарифа.

Что такое UGC-видео и зачем AI UGC-рекламу собирать из трёх моделей

UGC-видео (user-generated content) — ролик, который выглядит так, будто его снял обычный пользователь: вертикальный кадр, телефонная камера, человек говорит прямо в объектив. AI UGC — тот же формат, где «пользователь», его голос и сцена сгенерированы нейросетями. Одна модель такой ролик не собирает: языковая не рисует, графическая не анимирует, видеомодель не пишет сценарий.

Отсюда и связка. У каждого звена своя работа:

  • Языковая модель превращает фото продукта в текстовый «визуальный профиль», выбирает рекламный угол, пишет реплики с таймингом и готовит промпты для двух следующих моделей.
  • Модель изображений делает стартовый кадр: лицо персонажа и продукт, которые потом не должны меняться от сцены к сцене.
  • Видеомодель оживляет этот кадр: движение, мимику, речь и фоновый звук.

Паттерн «LLM пишет бриф → графическая модель держит референс → видеомодель анимирует» повторяется в большинстве практических гайдов топа выдачи. Там он обычно собран на других моделях (Claude, Nano Banana, Veo или Kling). Мы берём тот же каркас на моделях, вышедших в июне–сентябре 2026 года, потому что у каждой есть свойство, которое закрывает главную боль прошлого поколения: Seedance 2.5 снимает 30 секунд одним дублем, и склеивать шесть коротких клипов больше не нужно.

Типовой ручной процесс AI UGC-рекламы, по разбору Retiplex, состоит из 10 шагов, около 7 отдельных инструментов и занимает полдня. Нативный звук Seedance 2.5 убирает из него два шага — отдельное клонирование голоса и подгонку аудио к губам, — если ролик укладывается в один 30-секундный дубль.

Примеры UGC-видео: четыре рекламных формата под один сценарий

Сценарий UGC-рекламы почти никогда не придумывают с нуля. Годами работают четыре формата, и языковой модели проще выбрать один из них, чем изобретать свой. Вот как они выглядят на примере условного продукта — энергетических жевательных конфет:

ФорматКак звучит хук (первые 3 секунды)Структура роликаКогда брать
Проблема → решение«Каждый день в два часа дня я просто выключалась»боль → попытки → продукт → результат → призывпродукт закрывает понятную бытовую боль
Отзыв клиента«Я скептически к этому относилась, но…»сомнение → опыт → конкретный эффект → советнужен социальный довод; самый рискованный формат для раскрытия ИИ
До → после«Вот я месяц назад, а вот сейчас»состояние «до» → переход → состояние «после»эффект виден глазами
История«Короче, со мной вчера случилось…»бытовая сцена → продукт входит в историю → развязкапродукт сложно показать напрямую

Формат «отзыв клиента» отмечен не случайно: правило FTC запрещает выдавать отзыв за мнение человека, которого не существует, — и синтетический «клиент» без раскрытия ИИ под это описание попадает. Подробно — в разделе про маркировку ниже.

Ритм у всех четырёх один: хук, развитие, продукт, доказательство, призыв. В 30 секунд укладывается 40–80 произнесённых слов — это ориентир Retiplex для роликов длиной 15–30 секунд.

Что нужно для AI UGC-ролика: доступы к трём моделям и исходники

Прежде чем открывать модели, соберите четыре вещи. Без них каждый следующий шаг будет гадать.

  1. Две-три качественные фотографии продукта — упаковка, этикетка, сам продукт крупно. По ним языковая модель опишет продукт так, как его видит камера.
  2. Доступ к Claude Opus 5.5 — через приложение Claude или через API (модель claude-opus-5-5, доступна также в AWS, Google Cloud и Azure).
  3. Доступ к GPT Image 2.5 — в приложении ChatGPT генерации входят в подписку, по API модель называется gpt-image-2.5-flare или gpt-image-2.5-sunburst.
  4. Доступ к Seedance 2.5. Официальный API открыт на китайской платформе Volcano Engine Ark с 7 августа 2026 года (модель doubao-seedance-2-5-260628). Открытого международного прайса и доступа через BytePlus на дату проверки мы не нашли, поэтому за пределами Китая модель берут у посредников — например, на fal.ai она на 26 сентября 2026 доступна до 720p со своей ценой.

Отдельно решите формат: UGC живёт вертикально, поэтому все кадры и видео делаем в 9:16. Для финального экспорта практические гайды советуют 1080×1920.

Шаг 1. Opus 5.5 пишет сценарий, раскадровку и промпты ролика

Первое звено — Claude Opus 5.5, первая модель семейства Claude 5.5 от Anthropic, вышедшая 22 сентября 2026 года. По API он стоит $4 за миллион входных токенов и $20 за миллион выходных (на 22 сентября 2026; цену независимо подтвердил TechCrunch), кэшированное чтение — $0,20 за миллион. Есть быстрый режим до 2,5 раза быстрее, но вдвое дороже — $8 и $40; для сценария скорость не критична, он не нужен.

Одна деталь влияет на счёт: у Opus 5.5 режим «размышления» больше нельзя отключить. Токены рассуждений оплачиваются как выходные, поэтому короткий ответ может стоить дороже, чем кажется по длине текста.

Весь шаг — это четыре запроса в одном чате. Шаблоны ниже составлены по структуре, которую используют практические гайды; их стоит адаптировать под свой продукт. Промпты для следующих моделей просим у Opus сразу на английском — так их без правок примут GPT Image 2.5 и Seedance 2.5. Готовые англоязычные подборки AI UGC video prompts полезны как образец формы, но визуального профиля вашего продукта в них нет.

Запрос 1. Визуальный профиль продукта (прикладываете 2–3 фото):

Вот фото моего продукта. Опиши его для видеорекламы: категория, тип и материал
упаковки, точные цвета, фактура, весь текст на этикетке. Одним абзацем на английском,
который я вставлю в генераторы изображений и видео, чтобы они рисовали именно этот продукт.

Этот абзац — главный артефакт шага. Его вы будете вставлять в каждый следующий промпт, и именно он держит продукт одинаковым во всех сценах.

Запрос 2. Выбор формата:

Продукт: [визуальный профиль]. Аудитория: [кто и что их беспокоит]. Цель: покупка.
Какой формат UGC-рекламы подходит лучше: проблема → решение, отзыв, до → после или история?
Выбери один и объясни в двух предложениях.

Запрос 3. Сценарий:

Напиши сценарий UGC-ролика на 30 секунд для этого продукта. Формат: [выбранный].
Структура: хук (первые 3 секунды), развитие, появление продукта, доказательство, призыв.
60–75 слов, разговорно, как друг говорит в камеру. Без хэштегов и эмодзи.
Не приписывай продукту свойств, которых нет в описании.

Последняя строка — не формальность. Любое обещание в рекламе должно быть правдой независимо от того, кто его произносит, человек или синтетический персонаж.

Запрос 4. Раскадровка и промпты:

Разбей сценарий на 3–4 сцены. Для каждой: тип кадра (говорящая голова или продукт),
описание сцены, точные слова за кадром, длительность в секундах. Сумма — ровно 30 секунд.
Затем дай на английском: (1) промпт портрета персонажа для генератора изображений,
(2) промпт продуктового кадра, (3) единый промпт для видеомодели на 30 секунд
с таймкодами сцен и репликами в кавычках. Формат везде — вертикальный 9:16,
стиль — снято на телефон, естественный свет, без глянца.

Правило, которое чаще всего ломают: длительности сцен обязаны сходиться ровно в 30 секунд, без пауз и наложений. Таблица сцен становится картой для всех следующих шагов.

Сколько это стоит: такая сессия занимает по нашей оценке 10–60 тысяч входных и 5–40 тысяч выходных токенов с учётом рассуждений. По ставкам Opus 5.5 это $0,14–1,04. На фоне видео это погрешность.

Тренд сентября 2026 года — этот же шаг автоматизируют целиком: на GitHub появились обёртки-скиллы для Claude Code (например, AI-UGC-Factory), которые проводят цепочку «персонаж → продукт → видео» без ручного копирования промптов. Для первого ролика ручной путь всё равно полезнее: вы увидите, где именно цепочка рвётся.

Шаг 2. GPT Image 2.5 собирает консистентного персонажа и продукт

Второе звено — GPT Image 2.5 (в приложении ChatGPT — Images 2.5), вышедший 8 сентября 2026 года. Его задача — сделать два стартовых кадра: портрет «автора» ролика и чистый кадр продукта. В интерфейсах конструкторов такого персонажа называют AI-актёром: это синтетический автор, от лица которого идёт реклама.

Модель выпускается в двух вариантах, и выбор между ними — про задачу, а не про деньги:

FlareSunburst
Имя в APIgpt-image-2.5-flaregpt-image-2.5-sunburst
Скоростьбыстрее, вариант по умолчаниюмедленнее
Сильная сторонамассовая генерация, черновикиточные правки: текст на этикетке, мелкие детали
Цена токеновта жета же
Где в нашем процессеподбор лица и позы персонажаправка продуктового кадра с надписями

Ставки у обоих одинаковые: по официальному прайсу OpenAI — $5 за миллион текстовых входных токенов, $8 за миллион токенов входного изображения-референса и $30 за миллион выходных токенов изображения (на 26 сентября 2026). Не путайте с ценами посредников: CometAPI, например, продаёт доступ дешевле ($4 и $24), но это тариф реселлера, а не OpenAI.

Цены за картинку OpenAI для версии 2.5 не публикует: калькулятор GPT Image 2 расход токенов версии 2.5 не оценивает — это прямо сказано в документации Flare и Sunburst. Сторонние оценки для кадра 1024×1024 — от ~$0,006 на низком качестве до ~$0,21 на максимальном. Для рекламы низкое качество не годится, поэтому в расчёте ниже берём $0,05–0,21 за кадр. Оценки сделаны для квадрата 1024×1024, а сколько токенов 2.5 тратит на вертикальный 1088×1920, OpenAI не публикует. Даже если вертикальный кадр обойдётся вдвое дороже, к итогу это добавит от $0,40 до $3,15, а видео всё равно останется 85–93% бюджета.

Порядок работы:

  1. Сгенерируйте портрет во Flare по промпту из шага 1. Размер задайте вертикальный — например, 1088×1920: у GPT Image 2.5 стороны должны быть кратны 16, а соотношение сторон — в пределах от 1:3 до 3:1, так что это почти ровно 9:16.
  2. Выберите одно лицо и больше его не генерируйте заново. Все следующие кадры — только правками этого изображения. Именно на свободной перегенерации персонаж «плывёт».
  3. Сделайте продуктовый кадр по фото продукта, передав его как референс. Надписи на этикетке правьте в Sunburst: он точнее в тексте.
  4. Проверьте кадры против визуального профиля из шага 1: цвет упаковки, шрифт, количество предметов.

OpenAI заявляет у 2.5 «верность референсу» — сохранение лиц, логотипов и продуктов через серию правок. Это заявление вендора, а не независимый тест, поэтому шаг 4 не пропускайте. Если GPT Image 2.5 по какой-то причине не подходит, альтернативы и их цены мы разбирали в обзоре нейросетей для генерации картинок.

Шаг 3. Seedance 2.5 оживляет кадр: 30-секундный дубль и звук

Третье звено — Seedance 2.5 от ByteDance. Модель анонсировали 23 июня 2026 года на конференции Volcano Engine FORCE, API открыли 7 августа. Главное для рекламы — ролик до 30 секунд за один проход со звуком: у Seedance 2.0 потолок был около 15 секунд, и 30-секундная реклама собиралась из нескольких клипов.

Прежде чем бюджетировать, сверьте анонс с тем, что реально доступно:

ПараметрЗаявлено в анонсеДоступно в API на старте (август 2026)
Длительностьдо 30 секунд одним проходомот 4 до 30 секунд
Разрешениенативный 4K, 10-битный цветтолько 480p и 720p
Референсыдо 50 файловдо 50: 30 изображений, 10 видео, 10 аудио
Звукгенерируется вместе с видеоесть, параметр generate_audio
Продление и правкасценарии продления и редактирования заявленымногораундовое продление есть в документации Volcano Engine
Ценаобещали объявить до релизаединого мирового прайса так и нет

Разрыв между «нативным 4K» и реальными 480p/720p — главная ловушка при планировании. Кто считает бюджет по рекламной карточке, получает ролик другого качества и другую смету. На 26 сентября 2026 года в тарифе fal.ai уже появилась строка 1080p ($1,164 за секунду), но описание модели там по-прежнему говорит о роликах до 720p, а 4K не предлагает никто.

Лимит референсов вырос более чем втрое — с ~12–15 файлов у Seedance 2.0 до 50. Для сравнения: Veo 3.1 принимает 3 изображения. Для UGC это значит, что в один запрос помещаются портрет персонажа, продуктовый кадр с нескольких ракурсов и образец голоса.

Порядок работы:

  1. Соберите референсы: портрет из шага 2, продуктовый кадр, при необходимости аудио-образец голоса.
  2. Вставьте видеопромпт из шага 1 — с таймкодами сцен и репликами в кавычках. Длительность — 30 секунд, формат кадра — 9:16 (параметр ratio), звук — включён.
  3. Сделайте черновик в 480p. Генерация асинхронная: вы создаёте задачу, а потом забираете готовый ролик по её идентификатору.
  4. Проверьте черновик по таблице сцен: совпадает ли лицо со стартовым кадром, не перерисован ли продукт, успевает ли персонаж договорить.
  5. Перезапустите удачный вариант в 720p для чистовика. Композиция при смене разрешения может сместиться, поэтому смотрите чистовик так же внимательно, как черновик.

Если нужен не рекламный ролик с речью, а просто движение в кадре по фотографии, это другая задача с другой экономикой — её мы разбирали в материале про оживление фото в видео нейросетью.

Шаг 4. Монтаж, субтитры и маркировка ИИ перед запуском рекламы

Даже 30-секундный дубль — ещё не готовая реклама. Последний шаг делается в любом видеоредакторе (в гайдах чаще всего CapCut):

  • Субтитры — большая часть роликов в ленте смотрится без звука.
  • Музыка — тихой подложкой под речь, если Seedance не сгенерировал фон.
  • Текст раскрытия ИИ прямо в кадре, если персонаж говорит от лица клиента: например, «персонаж и отзыв созданы ИИ».
  • Экспорт в 1080×1920, H.264. Исходник 720p при этом апскейлится: картинка станет больше, но деталей в ней не прибавится.
  • Отметка об ИИ-контенте — там, где площадка её требует или предлагает при запуске.

Если ролик не уложился в один дубль и часть сцен сгенерирована отдельно, голос может отличаться между клипами. Практики решают это клонированием голоса из уже готового говорящего клипа (например, в ElevenLabs): интонация тогда совпадает автоматически. В наш расчёт этот шаг не входит.

Сколько стоит один рекламный AI UGC-ролик из трёх нейросетей

Один 30-секундный AI UGC-ролик по API обходится примерно в $12,5–47 на сентябрь 2026 года. Нижняя граница — минимальная оценка цены секунды Seedance 2.5 и две попытки, верхняя — фактическая цена посредника fal.ai и три попытки. На сценарий и картинки даже в худшем случае уходит меньше $4,2, всё остальное — видео.

Расчёт прозрачный, поэтому сначала — входные данные.

Цена секунды Seedance 2.5 — главная неизвестная. Единого мирового прайса у ByteDance нет: за пределами Китая модель покупают у посредников по их ставкам. Оценки и цены на разные даты:

ИсточникЦена секундыДата
Kie.aiофициального прайса нет15 июля 2026
APIMart (ставки Seedance 2.0 Pro как ориентир)$0,10 (480p) · $0,20 (720p) · $0,50 (1080p)7 июля 2026
Wan27¥1,5–3,0, то есть $0,21–0,42июль 2026
fal.ai, фактическая цена≈$0,22 (480p) · ≈$0,47 (720p)26 сентября 2026

Для 720p оценки расходятся от $0,20 до ~$0,47 за секунду — почти в 2,5 раза. Поэтому считаем два сценария, а не одно «среднее» число, которого на рынке не существует.

Допущения: сценарная сессия Opus 5.5 — от 10 тыс. входных и 5 тыс. выходных токенов до 60 тыс. и 40 тыс.; картинок GPT Image 2.5 — от 8 генераций по $0,05 до 15 по $0,21; видео — 30 секунд 720p, от 2 до 3 попыток на принятый дубль. Множитель попыток — ориентир, а не константа: единственный публичный замер доли брака сделан на Seedance 2.0, мы подробно разбирали его в расчёте цены секунды ИИ-видео с учётом брака.

ЗвеноМинимумМаксимум
Opus 5.5: сценарий и промпты10k × $4/1M + 5k × $20/1M = $0,1460k × $4/1M + 40k × $20/1M = $1,04
GPT Image 2.5: персонаж и продукт8 × $0,05 = $0,4015 × $0,21 = $3,15
Seedance 2.5: видео 30 с, 720p30 × $0,20 × 2 = $12,0030 × $0,473 × 3 = $42,57
Итого за принятый ролик≈$12,54≈$46,76
Доля видео в бюджете96%91%

Одна попытка 30-секундного видео в 720p стоит от $6,00 до $14,19. Входные токены референсов у GPT Image 2.5 добавляют к расчёту центы. На fal.ai цена указана за секунду сгенерированного видео, звук включается опцией при запуске. За видео-референсы некоторые поставщики берут отдельно — у Seedance 2.0 это было 50% ставки за каждую секунду входного видео.

Где реально экономить. Раз видео — это 91–96% денег, оптимизировать сценарий или картинки бессмысленно. Работает одно: черновики в 480p, чистовик в 720p. Две черновые попытки и один чистовик вместо трёх попыток в 720p:

Три попытки в 720p2 черновика 480p + 1 чистовик 720pЭкономия
По минимальным оценкам ($0,10 / $0,20)$18,00$6,00 + $6,00 = $12,0033%
По ценам fal.ai ($0,2205 / $0,473)$42,57$13,23 + $14,19 = $27,4236%

С чем сравнивать. Живой UGC-креатор, по данным AdLibrary (обновление апреля 2026), стоит $200–2000 за ролик и делает его 1–3 недели. Даже на верхней границе нашего расчёта живой креатор примерно вчетверо дороже, на нижней — в 16 раз. Но в нашей цифре нет вашего времени: ручной процесс занимает около полудня.

И сравнение с прошлым поколением: тот же 30-секундный ролик на Seedance 2.0 требовал шести клипов по 5 секунд — $2,88 генерации по ставке $0,096/с, плюс 2–4 часа ручной склейки и апскейла (оценка Kie.ai на 15 июля 2026). Генерация 2.5 дороже, зато склейка исчезает.

Что устареет первым: цена секунды Seedance 2.5 и список разрешений. Когда ByteDance опубликует мировой прайс и откроет 1080p/4K, строка видео в таблице изменится; ставки Anthropic и OpenAI сверяйте на их официальных страницах цен.

Частые ошибки AI UGC-связки: где персонаж «плывёт» и как это чинить

Большая часть испорченных роликов ломается не внутри модели, а на стыке двух моделей. Вот типовые сбои цепочки и способы их починить:

  1. Реплика короче сцены. Если слов меньше, чем секунд, видеомодель начинает «додумывать» речь и движения, чтобы заполнить время. Лечение — 40–80 слов на 15–30 секунд и проверка таблицы сцен до генерации.
  2. Лицо генерируется заново в каждой сцене. Каждый новый портрет — новый человек. Лечение — один мастер-портрет из шага 2 и передача его референсом в каждый запрос к Seedance.
  3. Продукт перерисован. Видеомодель меняет цвет упаковки или буквы на этикетке. Лечение — продуктовый кадр отдельным референсом и визуальный профиль из шага 1 в тексте видеопромпта. Надпись, которую модель упорно искажает, проще наложить в монтаже.
  4. Голос меняется между клипами. Происходит, когда ролик собран из нескольких генераций. Лечение — укладываться в один 30-секундный дубль или клонировать голос из лучшего говорящего клипа.
  5. Бюджет посчитан по анонсу. План под 4K, а API отдаёт 720p. Лечение — считать по таблице «анонс против API» из шага 3.
  6. Посчитана цена одной генерации, а не принятого ролика. Правильная метрика — стоимость ролика, который вы реально запустили, с учётом всех отброшенных попыток. Модель дороже за клип может оказаться дешевле за готовый ролик, если ей нужно меньше попыток.

Пример того, как это выглядит на практике: персонаж в первой сцене держит банку с оранжевой крышкой, а в третьей — с синей. Причина почти всегда в пункте 3: продуктовый кадр не передали референсом, и модель нарисовала «похожий» продукт по тексту промпта.

Раскрытие ИИ в рекламе и риски: что требуют FTC, Meta и TikTok

Коротко: если синтетический персонаж говорит о продукте так, будто это опыт реального человека, это нужно раскрыть в самом ролике, а на площадках — ещё и отметить по их правилам. Одно не заменяет другое. Правило FTC действует в США, а правила маркировки Meta и TikTok едины для всех рынков, где работает площадка.

Что требует каждый регулятор и площадка:

  • FTC (США). С 21 октября 2024 года действует правило FTC о фейковых отзывах: оно прямо запрещает отзывы и рекомендации от имени людей, которых не существует, — в том числе сгенерированные ИИ, — и от тех, у кого не было реального опыта с продуктом. Синтетический персонаж, который рассказывает о «своём опыте», попадает под это описание, если зритель не понимает, что перед ним ИИ. За заведомые нарушения правила FTC может требовать гражданский штраф — свыше $50 тыс. за каждое. Отвечает в первую очередь рекламодатель: сослаться на подрядчика, который делал ролик, не получится.
  • Meta. Обязательное раскрытие цифрово созданного или изменённого контента в рекламе Meta требует для объявлений на социальные и политические темы. Реалистичные ИИ-видео и аудио в обычных публикациях пользователи обязаны отмечать сами, а метку «AI info» платформа ставит и автоматически, когда распознаёт ИИ-контент по отраслевым сигналам.
  • TikTok. Реалистичный ИИ-контент нужно отмечать при публикации переключателем «AI-generated content»; кроме того, площадка сама ставит метку, если в файле есть метаданные Content Credentials (C2PA).

Важная тонкость: метка платформы сообщает, что контент сделан ИИ, но не снимает вопрос о том, чьё мнение звучит в ролике. Текст раскрытия в креативе закрывает именно его, поэтому в чек-листе запуска нужны обе колонки.

Вокруг самого формата идёт открытый спор. Часть маркетологов называет AI UGC-отзывы неэтичными и «нарушением FTC» по определению. Их оппоненты отвечают, что правила одни и те же для людей и для ИИ: утверждения о продукте должны быть правдой, а спонсорство — раскрыто. На практике из этого следует простое правило: ИИ не даёт права выдумывать эффект, которого у продукта нет.

Отдельный риск — чужое лицо и голос. Сгенерированный персонаж не должен копировать реального человека, а клон голоса делается только с согласия его владельца. Тема болезненная: в сентябре 2026 года дочь Робина Уильямса публично попросила прекратить создавать ИИ-видео с образом её отца.

И последнее — данные. Фото неанонсированного продукта уходят к трём поставщикам сразу. Anthropic предлагает Opus 5.5 с опцией нулевого хранения данных, а запросы к официальному API Seedance 2.5 идут на пекинский сервер Volcano Engine; посредник добавляет в цепочку ещё одну сторону.

Связка трёх моделей против AI UGC-конструкторов: цена и контроль

Готовые конструкторы — Arcads, Creatify, HeyGen, Higgsfield и десяток похожих — называют себя AI UGC video generator и продают ту же цепочку внутри одного интерфейса. Главное различие с нашей связкой — не качество, а то, насколько можно заранее посчитать деньги.

КритерийСвязка Opus 5.5 + GPT Image 2.5 + Seedance 2.5Конструкторы AI UGC
Прозрачность ценыставки Anthropic и OpenAI опубликованы; у Seedance — диапазон оценок и цены посредников4 из 12 платформ не публикуют проверяемой цены вовсе (индекс Playcut на 21 августа 2026)
Цена генерации 30 секунд$6,00–14,19 за попытку, $12,5–47 за принятый ролик$0,07–6,00 у платформ с опубликованной ценой; дешёвый край — аватар с «говорящей головой», а не нативный UGC
Единица оплатытокены и секундыкредиты, минуты, места в команде — у каждого своя
Длина одного дублядо 30 секундзависит от движка платформы
Контроль над кадромдо 50 референсов, свой сценарий и промптышаблоны и библиотека аватаров
Коммерческая лицензияпо условиям каждого поставщикау части тарифов её нет: по данным Playcut, у Akool три из пяти тарифов с личной лицензией, у HeyGen бесплатный план нельзя использовать в рекламе
Порог входатри доступа и полдня работырегистрация и шаблон

Одна оговорка к источнику: Playcut сам продаёт сервис для AI-рекламы и входит в собственный индекс, об этом он пишет открыто. Цифры его индекса проверяемы по страницам вендоров, но выводы стоит читать с этой поправкой.

Из таблицы видно то, что обычно не проговаривают: конструктор может быть дешевле за клип. Самая низкая цена у платформ с опубликованным тарифом — $0,07 за 30 секунд, это в десятки раз меньше нашего минимума. Но это говорящий аватар, а не сцена с продуктом в руках, и такой ролик решает другую задачу.

Связка выигрывает там, где нужны три вещи: знать цену до запуска, держать собственного персонажа от ролика к ролику и управлять сценарием построчно. Проигрывает — там, где нужен быстрый поток однотипных «говорящих голов» за копейки.

Практический вывод для тех, кто выбирает готовый конструктор: если платформа не показывает цену на своей странице, считайте это риском, а не мелочью. По наблюдению Playcut, цифры, которые гуляют по сети для таких сервисов, часто публикуют прямые конкуренты — просите цену письменно.

FAQ

Можно ли сделать AI UGC-рекламу бесплатно?

Полностью бесплатно — нет, если ролик идёт в рекламу. Бесплатные тарифы конструкторов обычно ставят водяной знак, а у части сервисов бесплатный результат прямо запрещено использовать в рекламе. Минимально разумный бюджет по нашей связке — около $12,5 за 30-секундный ролик. Бесплатно можно отработать сценарий и промпты, а генерацию делать уже на платном доступе.

Нужно ли раскрывать, что реклама сделана ИИ, если аудитория не в США?

Да, в большинстве случаев. Правило FTC формально действует в США, но правила маркировки Meta и TikTok не зависят от страны: TikTok требует отмечать реалистичный ИИ-контент, Meta — раскрывать его в рекламе на социальные и политические темы и сама ставит метку «AI info». Если синтетический персонаж рассказывает о «своём опыте», безопаснее раскрывать это прямо в ролике.

Можно ли использовать в ролике лицо реального человека без его согласия?

Нет. Лицо и голос реального человека без его явного согласия — прямой путь к претензиям о праве на образ и к блокировке рекламы. Для UGC это и не нужно: GPT Image 2.5 генерирует синтетического персонажа, которого нет в реальности. Следите лишь, чтобы промпт не описывал узнаваемую знаменитость, а голос клонируйте только с согласия его владельца.

Чем Seedance 2.5 отличается от Veo 3.1 для такой рекламы?

Главное отличие — длина дубля и число референсов. Seedance 2.5 делает до 30 секунд одним проходом и принимает до 50 референсов, Veo 3.1 генерирует клипы по 8 секунд и принимает 3 изображения. Зато у Veo 3.1 есть официальный прайс Google — $0,10 и $0,40 за секунду 720p в режимах Fast и Standard на 26 сентября 2026, — а у Seedance 2.5 его пока нет.

Можно ли заменить Opus 5.5 другой языковой моделью?

Да. Сценарий, раскадровку и промпты напишет любая сильная языковая модель — разница в стоимости здесь меньше доллара на ролик, а весь бюджет определяет видео. Выбирать стоит по качеству текста на вашем языке и по тому, насколько модель держит ограничения промпта. Разницу в цене и поведении флагманов мы разбирали в обзоре GPT-6 Sol и Luna.

Можно ли генерировать такие ролики на своей видеокарте?

Частично. Открытые видеомодели — Wan 2.2, LTX и HunyuanVideo 1.5 — запускаются дома и снимают оплату за секунду. Системным требованием для LTX в ComfyUI NVIDIA называет 16 ГБ видеопамяти, а для рекламы решающей оказывается лицензия: не каждая открытая модель разрешает коммерческое использование. Подробности — в материале про локальную генерацию видео на видеокарте.

Поделиться
Связаться:
Крипто- и data-аналитик, инженер-программист (факультет компьютерных наук ХНУРЭ). В IT с 2008 года: администрировал корпоративный мониторинг в «Vodafone Украина», семь лет разрабатывал и продвигал веб-проекты, пять лет руководил маркетингом на метриках — конверсия, CTR, ROI, LTV.Криптовалютными рынками занимаюсь с 2021 года: ончейн-метрики, токеномика, макроэкономические индикаторы. Разработал собственную data-driven модель анализа рынка на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математическая статистика и EDA; сбор и сверку данных автоматизирую AI-агентами.Принцип — «Don't trust, verify»: каждая цифра проверена по первоисточнику, ключевые — минимум по двум независимым; прогнозы — только сценарии с условиями. Тезис без данных не публикуется.