Конспекты
Смарт-конспекты YouTube-видео — ключевые идеи и инсайты без необходимости смотреть часовые ролики
Загрузка...
Смарт-конспекты YouTube-видео — ключевые идеи и инсайты без необходимости смотреть часовые ролики
Пошаговый гайд по созданию гиперреалистичных AI UGC видео: Nano Banana Pro, Gemini Omni, хаки интонации, референсы и преодоление Uncanny Valley.
Маркетинг-стратег, IT-предприниматель, ментор по вайбкодингу
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
Об авторе →Agent Reach: Полный гайд по подключению закрытого интернета к AI-агентам (Reddit, YouTube, GitHub)
Как подключить AI-агента (Claude Code, Cline) к Reddit, YouTube и GitHub через Agent Reach. Настройка сессий браузера и GitHub CLI без платных прокси.
Claude Code для бизнеса: Пошаговый гид по созданию AIOS и автоматизации процессов
Практическое руководство по автоматизации бизнеса с Claude Code: внедрение AIOS, протокол MCP, фреймворк SPARK и вайбкодинг живых дашбордов.
Создание ИИ-маркетинговой команды в ChatGPT: Пошаговый гайд по мультиагентной системе без кода
Пошаговый гайд по созданию мультиагентной ИИ-маркетинговой команды в ChatGPT: Work, Codex, Docs, генерация лендингов, креативов и интеграция со Slack.
Claude Code + Mobbin MCP: Генерация профессионального UI/UX и интерактивных прототипов
Пошаговый гайд по связке Claude Code и Mobbin MCP: генерация мобильного UI, интерактивных прототипов и лендингов на базе 600 000+ реальных экранов.
Маркетинг приложений через Silent UGC: Генерация вирусных AI-видео в Claude Code
Пошаговый гайд по генерации вирусных Silent UGC видео для продвижения приложений с помощью Claude Code, ArKads MCP и Seed Dance 2.5.
AI-генерация рекламы для E-commerce и услуг: Пошаговый пайплайн от анализа 10 000 креативов до генерации лидов
Практический гид по созданию прибыльной рекламы с ИИ: фреймворки PROOF и QUEST, связка Kixel и Astra, генерация UGC-видео и поиск B2B-клиентов.
Пошаговый технический и стратегический пайплайн создания гиперреалистичного UGC-видеоконтента (AI User Generated Content) для Performance-маркетинга и DTC-брендов. Автор раскрывает трёхэтапный процесс, позволяющий преодолеть эффект «зловещей долины» (Uncanny Valley), правильно работать с референсами реальных людей, настраивать промпты для видеомоделей и управлять интонацией речи AI-аватаров.
Готовый рабочий алгоритм генерации неотличимых от реальных людей UGC-креативов с помощью связки моделей Nano Banana Pro и Gemini Omni, правила структурирования трёхчастных видеопромптов и хаки управления темпом и логикой звука.
Контекст: Самый качественный и реалистичный аватар не спасёт рекламу, если в ней слабый сценарий или нарушена логика подачи. В топовых агентствах перед генерацией контента не бросаются сразу в нейросети, а проводят деконструкцию успешных связок (breakthrough iterations) и составляют чёткий покадровый план. Правило KISS (Keep It Simple, Stupid) означает отказ от перегруженного «brain-rot» монтажа в пользу кристально понятной доставки смыслов. Аватар должен обладать скрытым авторитетом: человек, который уже решил проблему продукта, а не страдает от неё прямо сейчас.
Тайминг: , , ,
Выгода: Экономия до 70% рекламного бюджета и генерационных кредитов за счёт исключения заведомо неконвертящих визуальных гипотез.
Как применить:
Результат: Готовый структурный каркас видеоролика, где каждый кадр аргументирован сценарием.
Контекст: Стандартная ошибка при создании AI UGC — прямая генерация лица через текстовые промпты в Midjourney или ChatGPT. Видеомодели при анимации таких изображений создают эффект восковой кожи («Uncanny Valley»), стирают поры и неестественно двигают губы, из-за чего мозг зрителя мгновенно считывает обман. Чтобы видео выглядело аутентично, нейросеть должна анимировать кадр, содержащий реальный сенсорный шум камеры смартфона, микроморщины, текстуру пор и блики на очках.
Тайминг: , , ,
Выгода: Полное устранение ощущения синтетики в видеоряде, рост Hook Rate и CTR за счёт органичной мимикрии под ленту соцсетей.
Как применить:
Shift + E для сохранения стоп-кадра в максимальном разрешении.Горячая клавиша захвата кадра (Premiere Pro): Shift + E
Результат: Реалистичный эталонный кадр (Reference Image) с естественным шумом матрицы, правильной светотенью и проработанной текстурой кожи.
Контекст: На основе исходного фото необходимо создать полностью нового, уникального персонажа, чтобы избежать юридических рисков дипфейка. Автор рекомендует модель Nano Banana Pro (оригинальную версию, а не v2) из-за её способности сохранять органические несовершенства, и предостерегает от использования излишне «вылизанных» моделей вроде GPT-2. Критически важно передать все изменения за один промпт (One-Shot): итеративное наложение правок по слоям размывает пиксели и создаёт артефакты при последующей анимации.
Тайминг: , , ,
Выгода: Создание уникального, юридически чистого аватара при сохранении геометрии, освещения и аутентичности оригинального кадра.
Как применить:
Результат: Готовый финальный статичный кадр аватара с микродеталями, готовый к подаче в видеомодель.
Контекст: Для превращения статичного аватара в говорящую голову используется модель Gemini Omni (внутри платформы Key/Krea на pay-as-you-go). Чтобы аватар не плыл, держал зрительный контакт и не страдал от галлюцинаций камеры, промпт делится на три строгие части: сцена/камера, прямая речь персонажа и жёсткие фиксированные правила поведения.
Тайминг: , , ,
Выгода: Стабильная синхронизация губ (lip-sync), исключение нежелательного дрейфа камеры и сохранение единого стиля персонажа на протяжении всей связки.
Как применить:
Static locked off shot, UGC iPhone footage. The character is sitting in his room looking directly at the camera, speaking with natural mouth movement and maintaining eye contact. He is super high energy as this is for a social video ad.
"[ВСТАВИТЬ РЕПЛИКУ СЦЕНАРИЯ ИЗ КАВЫЧЕК]"
Fixed rules: One continuous shot, no jump cuts, highly expressive facial movements, confident tone, clear pronunciation.Результат: Серия реалистичных видеоклипов с плавной мимикой, четким звуком и стабильным окружением.
Контекст: Новички тратят 90% времени на попытки спасти плохую генерацию видеомонтажом. В профессиональном пайплайне ключевая работа выполняется на этапе подготовки данных. Если видеомодель 1 раз из 10 выдает неестественный результат на конкретном аватаре, не нужно тратить генерации на исправление — проще заменить исходный референс.
Тайминг: , ,
Выгода: Ускорение производства связок креативов в 3–5 раз; себестоимость одной готовой видеорекламы снижается до минимума.
Как применить:
Результат: Чётко выстроенный конвейер производства, масштабируемый силами AI-агентов или джуниор-монтажёров.
Контекст: Gemini Omni генерирует видео фиксированными отрезками по 4, 6, 8 и 10 секунд. Если фраза длится 7 секунд, при выборе 6-секундного формата модель обрежет речь, а при выборе 8-секундного — неестественно замедлит голос («заторможенная речь»). Кроме того, монотонный голос убивает удержание. Решение — манипуляция регистром букв (CAPS LOCK) для смысловых ударений и добавление мусорного текста (хвоста) для сохранения естественного темпа.
Тайминг: , , ,
Выгода: Живая человеческая интонация без использования сторонних TTS-сервисов (ElevenLabs) и сохранение динамичного темпа речи без обрывов.
Как применить:
"So WEAK follicles WAKE back up and stay in the growth phase LONGER instead of shedding early.""We both went to a hair clinic and took what they gave us every day, except he's in Tokyo and that is why you know."Результат: Чистый, динамичный звук с идеальной ритмикой и акцентированными триггерными словами.
В: Почему нельзя брать референсы для лиц с Pinterest? О: Сейчас Pinterest переполнен низкокачественными AI-генерациями. Если взять синтетический кадр в качестве референса, видеомодель унаследует отсутствие текстуры пор и сенсорного шума, из-за чего финальное видео провалится в эффект «зловещей долины». Используйте скриншоты реальных видео из TikTok или Instagram.
В: Законно ли использовать реальных людей из TikTok как основу для AI-аватаров? О: Прямой дипфейк незаконен. Вы обязаны кардинально изменить внешность персонажа: форму носа, разрез глаз, тон кожи, прическу и одежду. Модификация должна быть такой, чтобы персонаж на финальном изображении не имел биологического сходства с автором оригинального видео.
В: Почему автор рекомендует именно Nano Banana Pro, а не новые модели генерации изображений? О: Современные модели (например, новые итерации на базе GPT/Flux) стремятся к идеализации картинки, делая кожу слишком гладкой. Оригинальная Nano Banana Pro сохраняет зернистость, артефакты съемки и микронеровности кожи, которые критически важны для правдоподобной последующей анимации.
В: Зачем прописывать в кадре наличие микрофона (DJI Mic или проводная гарнитура)? О: AI генерирует кристально чистый студийный звук. Если персонаж в кадре стоит далеко от камеры без микрофона, мозг зрителя подсознательно фиксирует несоответствие акустики помещения и идеального аудиоряда. Видимый микрофон логически обосновывает студийное качество звука.
В: Что делать, если после генерации лицо аватара всё равно кажется восковым? О: Проверьте исходный референс на наличие белых пересветов на лбу и носу. Если на коже есть зоны чистого белого цвета без пиксельных данных, видеомодель зальет их глянцем. Если проблема сохраняется, не тратьте генерации — смените референс.
В: Как предотвратить дергание и случайные движения камеры при генерации в Omni? О: Всегда начинайте промпт с четкой фиксации положения камеры: Static locked off shot для неподвижной камеры со штатива или Handheld UGC iPhone shot для съемки с рук во время ходьбы.
Shift + E — adobe.com/products/premiereКонспект создан на основе видео «How To Make Actually Realistic AI UGC (Full Workflow)» канала Ecom Talent. Все права на оригинальный материал принадлежат авторам. Источник: https://www.youtube.com/watch?v=kvf2lRSGixg