Маркетинг-стратег, IT-предприниматель, ментор по вайбкодингу
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
🎯 О чём этот конспект: Пошаговое руководство по созданию кинематографичных анимационных роликов с единой стилистикой на основе готовых референсов (в духе «Одиссеи», Тима Бёртона или сериала «Любовь, смерть и роботы»). Разбирается полный производственный цикл: от поиска визуального ДНК и генерации ключевых кадров до генерации таймкод-промптов, озвучки с правильными ударениями и финального монтажа.
👤 Кому будет полезно: Контент-мейкерам, сторителлерам, вайбкодерам и AI-креаторам, создающим вирусные короткие видео (Shorts/Reels/TikTok) или коммерческую анимацию для клиентов.
✨ Что получите: Готовый рабочий пайплайн для генерации 30-секундных анимированных историй с сохранением стиля персонажей и локаций, использующий связку нейросетей Synx (GPT Image + Seedance 2.5 Omni), Claude, ElevenLabs и CapCut.
1. Подбор стилевых референсов и поиск визуального стиля
Контекст: Большинство авторов создают стандартную генеративную картинку в духе типичного Disney или Pixar, из-за чего ролики теряются в общей массе контента. Чтобы видео набирало миллионы просмотров и привлекало коммерческие заказы, необходим выразительный, нестандартный арт-стиль. Автор предлагает не пытаться описывать сложный художественный стиль словами с нуля, а заимствовать его из культовой анимации («Труп невесты», «Коралина в Стране Кошмаров», серии «Любовь, смерть и роботы», инди-анимации вроде вирусного ролика про Одиссею и Пенелопу). Главная задача на старте — собрать пул из нескольких ключевых скриншотов, содержащих нужные текстуры, освещение и технику рисовки.
Тайминг:
Выгода: Экономия часов на подборе текстовых описаний стиля (промпт-инжиниринге) и мгновенное получение премиального визуального ряда.
Как применить:
Шаг 1: Поиск исходного источника стиля — Найдите анимационный фильм, авторский ролик или мультсериал с необычной графикой (кукольная анимация, мрачная готика, стилизованный 2D/3D селл-шейдинг).
Шаг 2: Нарезка референсных кадров — Сделайте 3–6 четких скриншотов, демонстрирующих общие планы, персонажей, работу с тенями и цветовую гамму.
Шаг 3: Формирование референс-пака — Сохраните изображения в отдельную папку для последующей загрузки в нейросеть в качестве визуальных якорей.
Результат: Набор из 3–6 опорных изображений, определяющих визуальный код будущего проекта.
2. Генерация опорных кадров и раскадровки (Synx + ChatGPT)
Контекст: Текстовые генераторы изображений часто искажают сложную художественную технику, если полагаться только на текстовые промпты. Самый надежный подход — отправить нейросети подготовленные референсы и попросить перенести этот стиль на абсолютно новый сюжет (например, миф о Прометее). В системе Synx для этого используется модель GPT Image с загрузкой исходников, а в ChatGPT можно сгенерировать единую сетку-раскадровку на 12 кадров одним запросом. Это позволяет заранее утвердить дизайн главного героя и ключевые сцены до запуска генерации видео.
Тайминг:
Выгода: Получение консистентного персонажа и окружения без необходимости настраивать сложные LoRA-модели.
Как применить:
Шаг 1: Настройка сессии в Synx — Перейдите в раздел Image, создайте New Session, выберите модель GPT Image, формат 16:9 и уровень детализации Medium 2K.
Шаг 2: Генерация через прямую передачу стиля — Загрузите референсные картинки и задайте промпт на перенос стиля на нового персонажа.
Based on the visual style and art technique of these reference images, generate a portrait of Prometheus. He is the titan who stole fire from the gods, shown descending from Mount Olympus with sacred fire in his hands. Strictly preserve the exact art style, line work, shading, and color palette of the attached references.
Шаг 3: Альтернативный метод быстрой раскадровки (ChatGPT) — Загрузите референсы в ChatGPT и запросите единое полотно с раскадровкой истории.
Я делаю историю о Прометее. Создай одно изображение формата 16:9, содержащее раскадровку (storyboard) из 12 последовательных кадров на основе текста сюжета. Строго сохрани визуальный художественный стиль и технику рисовки с прикрепленных референсов.[Вставить текст сценария]
Шаг 4: Отбор кадров-якорей — Сохраните 3–5 наиболее удачных кадров (Олимп, Прометей с огнем, люди в темноте, наказание Зевса, орел).
Результат: Готовый набор сгенерированных кадров высокого разрешения, выполненных в едином визуальном стиле.
3. Написание драматического сценария и озвучка с фонетическими хаками (Claude + ElevenLabs)
Контекст: Для удержания внимания зрителя в коротком видеоролике необходим лаконичный, драматичный закадровый текст без лишних вводных слов. Сценарий генерируется через Claude с акцентом на конфликт и эмоцию. При последующей озвучке в ElevenLabs русскоязычные модели часто ошибаются в ударениях греческих имен и омографов. Чтобы избежать брака генерации, применяется прием принудительного выделения ударных гласных заглавными буквами.
Тайминг:
Выгода: Идеальная дикция нейроозвучки с первого дубля без искажения ударений и потери платных кредитов.
Как применить:
Шаг 1: Генерация текста истории — Используйте Claude для создания 30-секундного скрипта (около 50–60 слов).
Напиши короткий, эмоциональный и эпичный закадровый текст для 30-секундного видеоролика о мифе про Прометея. Текст должен быть разбит на короткие фразы, передающие контраст: холод людей, кражу огня с Олимпа, гнев Зевса и несокрушимость духа титана.
Шаг 2: Подготовка текста с фонетическими метками — Расставьте ударения в сложных словах с помощью заглавных букв:
Он похИтил огОнь у богОв и поплатИлся за это вЕчностью. Его звАли ПрометЕй. Когда лЮди дрожАли от хОлода во тьме, а бОги хранИли плАмя лишь для себЯ, он не вы́держал. ПрометЕй укрАл Искру с ОлИмпа и принЁс её на ЗЕмлю.
Шаг 3: Генерация аудио в ElevenLabs — Перейдите во вкладку Audio / Speech-to-Speech (или Text-to-Speech), выберите модель ElevenLabs Speech 2, укажите язык Russian, выберите голос (автор рекомендует женский голос Marina) и сгенерируйте дорожку.
Результат: Чистая эмоциональная аудиодорожка с точными ударениями, готовая для тайминга видеоряда.
4. Генерация видео по покадровому таймкод-промпту (LM Studio/Claude + Seedance 2.5)
Контекст: Сгенерировать длинный 30-секундный ролик одной общей фразой невозможно — видеомодель потеряет сюжетную линию. Решение заключается в создании единого структурированного таймкод-промпта (Unified Prompt), где посекундно расписана смена планов (крупный план, общий вид, вид сверху, детализация огня). Для генерации видео используется инструмент Synx с моделью Seedance 2.5 Omni Reference (CD 2.5), куда загружаются сгенерированные концепт-кадры и размечаются через тег @ прямо в теле промпта.
Тайминг:
Выгода: Создание непрерывного 30-секундного видеоролика с динамичной сменой планов и сохранением стиля за одну генерацию.
Как применить:
Шаг 1: Создание структуры промпта через Claude / LM Studio — Отправьте сценарий в нейросеть для разбивки по секундам и планам камеры.
I want to make a 30-second animation video clip in Seedance 2.5 Omni about the story of Prometheus based on my text and visual style references. Create a single unified English prompt for a 30-second clip (16:9). Break down the action second-by-second (0-1s, 2-5s, etc.) with diverse camera angles: close-ups, wide landscape shots, bird's-eye views, and extreme details (eyes, hands holding fire).
Шаг 2: Настройка видеогенератора в Synx — Откройте вкладку Video -> New Session. Выберите модель Seedance 2.5 Omni reference, соотношение сторон 16:9, разрешение 480p (для экономии кредитов на черновых тестах) и длительность 30 seconds.
Шаг 3: Загрузка референсов и тегирование через @ — Загрузите сгенерированные на Шаге 2 кадры (изображения Олимпа, людей, Прометея) и разметьте их в промпте через символ @, связывая конкретные кадры с соответствующими секундами таймлайна.
[00:00-00:05] Wide cinematic shot of Mount Olympus @Frame1 glowing under divine light.[00:05-00:10] Dark cold earth, shivering people in shadows @Frame2.[00:10-00:18] Close-up of Prometheus @Frame3 grasping divine fire spark and descending.[00:18-00:25] Zeus in rage, chaining Prometheus to a jagged cliff @Frame4.[00:25-00:30] Eagle swooping in, Prometheus remains determined and proud without regret.
Шаг 4: Запуск рендера — Отправьте задачу на генерацию и скачайте полученный MP4 файл.
Результат: 30-секундный анимированный видеоряд с кинематографичными переходами между сценами.
5. Сведение, синхронизация и компиляция мультидублей в CapCut
Контекст: Сгенерированное 30-секундное видео и озвучка редко совпадают по длительности секунда в секунду. Вместо перегенерации дорогостоящих видеодорожек несовпадения устраняются на этапе монтажа с помощью гибкого изменения скорости (Speed Ramping) аудио и видео. Кроме того, для максимального качества автор рекомендует сгенерировать 2–3 варианта видео и собрать финальный ролик из лучших дублей каждой сцены.
Тайминг:
Выгода: Идеальная синхронизация звука и картинки без дополнительных затрат токенов нейросети.
Как применить:
Шаг 1: Импорт ассетов — Откройте CapCut (на ПК или смартфоне) и перетащите на таймлайн полученный видеофайл и аудиодорожку из ElevenLabs.
Шаг 2: Подгонка хронометража (Speed Ramping) — Если аудио длиннее видео: выделите видеодорожку, перейдите во вкладку Speed и слегка замедлите видео (например, до 0.9x), а дорожку аудио ускорьте до 1.1x–1.15x до полного выравнивания границ.
Шаг 3: Склейка из нескольких генераций (Компиляция) — При наличии нескольких дублей разрежьте видеодорожки по смысловым блокам (кража огня, цепи, финал) и оставьте только самые динамичные и качественные фрагменты.
Шаг 4: Экспорт — Экспортируйте финальное видео в разрешении 1080p или 4K.
Результат: Полностью готовый к публикации вирусный ролик с выверенным темпоритмом и качественным саунд-дизайном.
FAQ
В: Почему лучше использовать референсы, а не подробное текстовое описание стиля в промпте? О: Современные диффузионные и авторегрессионные модели значительно точнее считывают художественные особенности (палитру, плотность штриха, текстуры) непосредственно из пикселей референсных изображений, чем из абстрактных текстовых терминов. Передача готовых картинок экономит токены и гарантирует визуальное попадание в желаемый стиль.
В: Как правильно ставить ударения в ElevenLabs для русского языка? О: ElevenLabs ориентируется на заглавные буквы внутри слов для определения ударного слога. Если модель искажает слово (например, «ПромЕтей» вместо «ПрометЕй» или путает омографы «зАмок» / «замОк»), напишите нужную гласную заглавной буквой: ПрометЕй, зАмок.
В: Зачем генерировать черновое видео в разрешении 480p? О: Генерация 30-секундных роликов требует большого количества вычислительных кредитов. Рендер в 480p позволяет быстро и с минимальными затратами протестировать таймкод-промпт, композицию и динамику движений перед финальным экспортом в высоком качестве.
В: Как работает тегирование через @ в модели Seedance 2.5 Omni Reference? О: При загрузке нескольких концепт-артов в сессию Synx каждому файлу присваивается порядковый идентификатор. Использование символа @ в текстовом промпте указывает нейросети, к какому именно загруженному кадру привязать конкретный временной интервал видео.
В: Что делать, если видеогенерация выдала неудачные кадры в середине ролика? О: Не пытайтесь перегенерировать весь ролик целиком. Сделайте второй дубль видеогенерации с тем же промптом, импортируйте обе дорожки в CapCut и скомпонуйте финальный таймлайн, вырезав и заменив неудачные сегменты лучшими дублями со второй дорожки.
Ресурсы и ссылки
Synx — Платформа для генерации изображений (GPT Image) и видео (Seedance 2.5 Omni Reference) — упомянут в видео.
ElevenLabs — Нейросеть для синтеза речи и генерации реалистичной озвучки (модель Speech 2, голос Marina) — упомянут в видео.
Claude (Anthropic) — LLM для генерации коротких драматических сценариев и покадровых видео-промптов — упомянут в видео.
LM Studio — Локальный интерфейс для запуска языковых моделей и генерации промптов — упомянут в видео.
ChatGPT (OpenAI) — Инструмент для генерации комплексных 12-кадровых раскадровок (storyboards) — упомянут в видео.
CapCut — Видеоредактор для ПК и мобильных устройств для монтажа и синхронизации скорости — упомянут в видео.
Конспект создан на основе видео «Как делать вирусные анимационные видео с помощью нейросетей» канала о генеративном контенте. Все права на оригинальный материал принадлежат авторам.Источник: https://www.youtube.com/watch?v=843zemGPg0Y