Пластилиновая анимация, нейросеть вместо студии покадровой съёмки и рекламный ролик на тридцать секунд к вечеру. Такую связку обещает туториал из корпоративного блога SYNTX на Хабре «Создаём Claymation-креативы для рекламы с помощью AI за 20 минут». Claymation — это пластилиновая покадровая анимация: фигурки с отпечатками пальцев, чуть дёрганое движение, игрушечные декорации. Раньше её лепили руками неделями. Теперь её предлагают генерировать.
Я разобрал этот гайд как пример производственной цепочки, а не как рецепт. Меня интересовало, какие нейросети для рекламы в нём задействованы, в каком порядке они передают друг другу работу, где контекст теряется и где автор подстраховывается. Для того, кто делает контент системой, пластилин здесь вторичен. Ценнее приём, который удерживает одного и того же персонажа на восьми сгенерированных сценах.
Дальше по порядку: из каких звеньев состоит конвейер, какие обещания источника подтверждены только словами автора и во что на деле превращаются «20 минут».
Зачем рекламе пластилин
Автор туториала начинает с тезиса «креатив — это новый таргетинг». Рекламные платформы, по его словам, упрощают интерфейсы: Meta, TikTok и Google движутся к меньшему числу настроек и большей автоматизации. Алгоритмы сами разбирают смысл ролика — визуал, эмоцию, сообщение — и решают, кому его показать. Отсюда вывод: аудиторию теперь выбирает креатив, а ручные настройки уходят на второй план.
Из этого тезиса вырастает рабочая проблема. Большинство таргетологов находят один удачный формат и масштабируют его, чаще всего это UGC — ролики, снятые как бы от лица обычного покупателя. Один формат попадает в один сегмент аудитории. Чтобы дотянуться до других, нужны другие форматы: анимация, говорящая голова, скринкаст и, по версии автора, Claymation.
Главная цифра материала: Claymation-креативы показывают результаты «в 3 раза лучше, чем UGC». Иллюстрация автора — если UGC приносит бренду $5k в неделю, Claymation может принести до $15k. Объяснение звучит логично: глаз натренирован пролистывать UGC и баннеры за долю секунды, а пластилин выглядит не так, как остальная лента, и останавливает скролл.
Здесь я отделяю факт от мнения. Источник не говорит, откуда взялось «в 3 раза»: нет ниши, периода, числа кампаний, метрики. Это оценка автора, а не результат опубликованного теста. Механика «у зрителя нет фильтра на этот формат» правдоподобна. На практике это, скорее всего, значит, что эффект держится, пока формат редкий, и слабеет по мере того, как его подхватывают конкуренты.
Как нейросеть делает пластилиновую анимацию: пять звеньев
Весь процесс в туториале разбит на пять шагов: сценарий, раскадровка, закадровый голос, генерация видео, сборка. На деле звеньев чуть больше, потому что между сценарием и видео встаёт стайлгайд и референс-лист. Вот цепочка целиком, с инструментами, которые называет автор.
| Звено | Вход | Выход | Инструмент в источнике |
|---|---|---|---|
| Сценарий | продукт, аудитория, боль, решение | текст озвучки около 75 слов, раскадровка по актам | Claude Sonnet 5.5 или ChatGPT 6 Luna |
| Стайлгайд | запрос на единый стиль | базовый промпт, палитра в hex, свет, персонаж, камера, негативный промпт | Claude Opus 5.5 или ChatGPT 6 Sol |
| Озвучка | текст озвучки | аудиодорожка | ElevenLabs |
| Референс-лист и промпты сцен | сценарий и стайлгайд | эталонное изображение, раскадровка на 8 сцен, 8 промптов | языковая модель по мастер-промпту, картинка — ChatGPT Image 2.5 Sunburst |
| Видео | промпт сцены и референс-лист | клипы | Veo Omni Flash 1.1, Kling 3.0, Seedance 2.0 |
| Сборка | клипы, голос, музыка | готовый ролик | CapCut, DaVinci Resolve |
У этой схемы одна общая черта. Каждое звено, кроме последних двух, выдаёт текст, и этот текст становится входом следующего. Языковая модель работает режиссёром и сценаристом, генераторы изображений и видео — исполнителями.
Для того, кто делает контент, отсюда следует практическая вещь. Текстовые артефакты сохраняются и переиспользуются. Стайлгайд, написанный под один ролик, годится для следующего; мастер-промпт годится для любого продукта. Дорого обходится только первая сборка цепочки, дальше в неё подставляются новые данные.
Сценарий: четыре акта за тридцать секунд
Автор настаивает: главное в формате — сторителлинг, а не пластилин. Тридцать секунд делятся на четыре акта: проблема (7 секунд), открытие (7), использование (8), трансформация с призывом к действию (8). Требования к сценарию — эмоциональная дуга от раздражения к радости, простые визуальные метафоры, минимум текста на экране, ощущение короткометражки вместо рекламы.
Пример в материале — онлайн-курс бизнес-английского для владельцев бизнеса 30–45 лет. Герой Илья на встрече с зарубежными партнёрами знает ответ, но изо рта у него появляется крошечное пластилиновое облачко и тут же сминается. Вечером над ним приоткрывается тяжёлый занавес. В симуляции переговоров карточки с условиями сделки выстраиваются в мост между собеседниками.
Самое полезное в этом примере — характер метафор. Каждая из них — физический предмет, который можно вылепить и снять: облачко, занавес, карточки, лампочка над головой. «Неуверенность» генератор видео не нарисует. Смятое облачко нарисует. По сути, сценарий пишется не для человека-режиссёра, а для генератора, и это правило переносится на любую нейросеть для создания рекламы.
Одна неточность в самом туториале. Задача шага сформулирована как «8 сцен по 3–4 секунды», а промпт и результат дают четыре акта. Восемь сцен появляются позже, на этапе референс-листа. Если повторять процесс, лучше сразу понимать, что сценарий описывает акты, а нарезку на сцены сделает следующее звено.
Референс-лист: как удержать одного героя на восьми сценах
Главная беда сгенерированных роликов из нескольких сцен — персонаж меняет лицо, одежду и пропорции от кадра к кадру. Туториал решает это в два хода.
Первый ход — стайлгайд. В примере он подробный: неизменное «ядро» промпта, которое копируется в каждую сцену, палитра из пяти цветов с hex-кодами и запретом на чёрный, отпечатки пальцев на поверхностях, тени, которые смещаются ступеньками, анимация «на двойках» (12 уникальных поз в секунду при выводе 24 fps). Отдельно описан персонаж: рост в три головы, глаза-бусины без век, два пальца на руках. В конце — негативный промпт и чеклист консистентности на каждую сцену.
Второй ход — мастер-промпт в три такта. Сначала модель пишет промпт для референс-листа: персонаж в четырёх ракурсах, сетка из шести эмоций, реквизит отдельными предметами, локация общим планом, всё при одном свете и на одном фоне. Лист генерируется картинкой, автор использовал ChatGPT Image 2.5 Sunburst. Затем модель пишет раскадровку на восемь сцен с жёстким ограничением: только персонажи, локации и предметы, которые есть на листе. Новый герой, новая комната или новый источник света запрещены.
Третий такт — промпты под Veo Omni Flash 1.1. Каждый открывается описанием персонажа и локации теми же словами, что в раскадровке, без синонимов и сокращений. Дальше идут формат и камера, движение по секундам, смена эмоции «от состояния с листа к состоянию с листа» и точка склейки со следующей сценой. Промпт уходит в Veo вместе с референс-листом в режиме References to Video. В конце мастер-промпт требует от модели самопроверки, в том числе что сумма таймингов равна 30 секундам.
Здесь есть деталь, которую легко пропустить. Стайлгайд содержит негативный промпт, а мастер-промпт прямо запрещает его для Veo: модель, по словам автора, лучше отрабатывает позитивное описание. Это не ошибка. Стайлгайд универсален, а промпты сцен подогнаны под конкретный генератор. Если меняете генератор, пересматривайте и это правило.
По-моему, именно этот приём — главное, что стоит вынести из туториала. Эталонный лист плюс запрет выходить за его пределы плюс дословное повторение описаний работают для любой серии с повторяющимся героем, пластилиновой или нет.
Генерация и сборка: нейросеть для видео рекламы и монтаж
Для генерации автор называет три модели и описывает их так: Kling 3.0 — «отличное качество, понимает claymation эстетику», Veo Omni Flash 1.1 — быстрая генерация и хорошее движение, Seedance 2.0 — лучше всех держит консистентность персонажа. Это характеристики из материала, сравнительного теста в нём нет.
Советы по генерации прямо говорят, что с первого раза ролик не получится:
- просить 6–8 секунд там, где по сценарию нужно 3–4, чтобы было из чего вырезать;
- держать референс-лист перед глазами и сверять каждый клип;
- генерировать каждую сцену 2–3 раза и выбирать лучший дубль;
- если сцена упорно не выходит, менять модель, а не переписывать промпт в третий раз.
Последний совет мне кажется самым трезвым во всём материале. Переписывание промпта ощущается как работа, но часто упирается в то, что конкретная модель конкретное движение не делает.
Сборка — в CapCut или в бесплатной версии DaVinci Resolve. Порядок обычный: обрезать сцены до 3–4 секунд, поставить короткие переходы (dissolve 0,2 секунды), наложить голос и синхронизировать с ним визуал, добавить музыку на 20% громкости. Субтитры автор называет обязательными со ссылкой на то, что «85% смотрят без звука»; источник этой цифры в материале не указан. Экспорт: MP4 (H.264), 1080x1080 или 1080x1920, битрейт 8–10 Mbps, 30 fps, файл меньше 30 MB.
Текст на экране и озвучка в промпты видео не попадают — мастер-промпт это запрещает. Звук и надписи накладываются на монтаже. Это разумно: генераторы плохо пишут буквы, а голос из ElevenLabs проще синхронизировать с готовыми клипами, чем наоборот.
Границы и цена
Двадцать минут — это оптимистичная цифра. Посчитаем по советам самого автора: восемь сцен, по 2–3 дубля на каждую, — это от 16 до 24 генераций видео, каждая на 6–8 секунд. Плюс генерация референс-листа, плюс правки раскадровки, которые туториал велит вносить до отправки промптов. Время одной генерации в материале не указано, поэтому точную оценку я не дам. Но 20 минут похожи на время того, у кого мастер-промпт и стайлгайд уже готовы и кому повезло с дублями.
Деньги в материале не названы. Автор сам пишет, что таблица моделей — это «пять-шесть сервисов, пять-шесть подписок», и что лимиты заканчиваются в момент, когда сцена наконец начала получаться. Цен ни одного сервиса в туториале нет, и я их не подставляю: тарифы генераторов видео меняются часто, сверяйтесь со страницами цен на дату запуска. Качественно понятно одно — самое дорогое звено здесь генерация видео, и бюджет считается в генерациях, а не в минутах.
Формат кадра нужно решить до старта. В примере стайлгайда записано 16:9 и 4K, мастер-промпт заказывает 9:16, экспорт предлагает 1080x1080 или 1080x1920. Стайлгайд задаёт вывод 24 fps, экспорт — 30 fps. Если не зафиксировать формат заранее, часть сгенерированного придётся переделывать или кадрировать с потерей композиции.
Цифры эффективности не подтверждены. «В 3 раза лучше UGC», «$15k в неделю», «85% без звука» — всё это утверждения автора без данных. Креативы для рекламы, которые сделала нейросеть, могут сработать и лучше, и хуже текущих — проверить это можно только своей кампанией.
Контекст между сервисами переносится руками. Автор описывает это честно: раскадровка из одного окна живёт в другом как скриншот, референс-лист, сценарий и стайлгайд нужно держать в поле зрения одновременно. Его решение — агрегатор SYNTX, где несколько моделей доступны в одном интерфейсе. Материал опубликован в блоге этой компании и заканчивается рекламой сервиса, так что вывод «в шести вкладках всё разваливается» — позиция продавца. Сам агрегатор я не оценивал. Проблема переноса контекста реальна при любом наборе инструментов.
Где формат, скорее всего, не подойдёт. Это моё мнение, не тезис источника. Пластилиновый ролик построен на метафорах, а не на показе. Если реклама должна показать реальный товар — фактуру ткани, интерфейс приложения, точный цвет упаковки, — генерация заменит его лепной условностью. И названия моделей в таблице устареют быстрее, чем сама цепочка: её стоит строить так, чтобы генератор можно было поменять, не переписывая всё.
Что с этим делать
- Возьмите приём с референс-листом даже без пластилина. Эталонное изображение героя, раскадровка «только из того, что есть на листе» и дословное повторение описаний в каждом промпте — это переносимая техника для любой серии сгенерированных кадров.
- Сохраните стайлгайд и мастер-промпт как шаблоны. Первая сборка цепочки — основная работа. Следующий ролик для другого продукта начинается с подстановки новых данных в готовые тексты.
- Зафиксируйте формат до первой генерации. Соотношение сторон, частота кадров и площадка определяются один раз и прописываются и в стайлгайд, и в промпты сцен.
- Считайте бюджет в генерациях. Закладывайте 2–3 дубля на сцену и запас длительности. Если лимиты тарифа меньше этого объёма, 20 минут превратятся в несколько дней.
- Проверяйте формат рядом с текущим, а не вместо него. Запустите пластилиновый ролик параллельно с работающим UGC и сравните на своих цифрах. Обещание «в 3 раза лучше» — гипотеза для теста, не прогноз выручки.
Источник: Создаём Claymation-креативы для рекламы с помощью AI за 20 минут
