Конспекты
Смарт-конспекты YouTube-видео — ключевые идеи и инсайты без необходимости смотреть часовые ролики
Загрузка...
Смарт-конспекты YouTube-видео — ключевые идеи и инсайты без необходимости смотреть часовые ролики
Пошаговый гайд по редактированию AI-изображений через JSON в Gemini. Смена цветов, материалов и объектов без галлюцинаций нейросети.
Маркетинг-стратег, IT-предприниматель, ментор по вайбкодингу
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
Об авторе →7 Способов заработка на AI для новичков: От нарезки клипов до вайбкодинга приложений
Пошаговый гид по 7 методам заработка на AI: клиппинг, гострайтинг, Shopify, голосовые AI-агенты и вайбкодинг приложений без опыта программирования.
Kimi K3 и AI-скиллы: Как создать премиальный интерактивный сайт за $10,000 без кода
Пошаговый гайд по созданию дорогих сайтов с Kimi K3, скиллом Scroll World, 3D-анимацией и автогенерацией SEO-статей из YouTube видео.
Философия и безопасность ИИ: Природа сознания, проблема алайнмента и практический симбиоз с AI-агентами
Разбор природы интеллекта, проблемы AI Alignment и концепции Extended Mind: как безопасно управлять автономными агентами и стать симбиотическим киборгом.
ChatGPT Voice 2.0: 5 уровней автономного ИИ-ассистента для управления десктопом, кодинга и агентов
Практический гид по ChatGPT Voice 2.0: от фонового скрейпинга и генерации сайтов до управления локальным Hermes Agent и hands-free контроля UI.
AI-инженерия и Harness: Как перейти от наивного вайбкодинга к надежным агентным системам в продакшене
Гид по AI-инженерии: архитектура Harness, Verification Tax, протокол MCP, контекст-инжиниринг, Evals и уровни зрелости проектов по Stanford Benchmark.
Маркетинговые AI-агенты для стартапов: Полный гид по автономному привлечению клиентов и связке ClickHouse + Facebook Ads
Пошаговое руководство по созданию AI-агентов для Facebook Ads: архитектура ClickHouse + Airbyte, генерация креативов, борьба с энтропией и запуск стартапов.
Google AI Studio 2026: нативная разработка Android-приложений и интеграция с Workspace
Google превращает AI Studio в полноценную среду разработки: экспорт в Kotlin/Jetpack Compose, доступ к данным Drive/Sheets и мобильное приложение для кодинга на ходу.
Google AI Studio теперь умеет в вайб-кодинг нативных Android-приложений
Google представила обновление AI Studio на I/O 2026: теперь создавать нативные приложения на Kotlin и Jetpack Compose можно прямо в браузере без установки Android Studio.
Google AI Studio теперь собирает Android-приложения и запускает агентов
На Google I/O 2026 представили нативную генерацию Android-приложений прямо в браузере и управляемых агентов в изолированных Linux-средах.
Нейросети для вайбкодинга 2026: сравнение по задачам
Выбирая нейросеть для вайбкодинга в 2026 году, важно не только скорость генерации кода, но и экономия времени, стоимости и стабильности работы – сравните модели по бенчмаркам, ценам и реальным задачам.
Все AI IDE для вайбкодинга 2026: каталог и сравнение в таблице
В 2026 году AI‑IDE стали ключом к быстрым продуктам: в каталоге собраны 130+ инструментов, их сравнение и рекомендации по выбору.
Как создать SaaS за неделю через вайбкодинг: реальный кейс
Создай SaaS за 7 дней, используя AI‑инструменты: Claude Code, Cursor и Lovable, без найма разработчиков и длительных обучений. Узнай, как быстро вывести продукт с платежами и авторизацией.
🎯 О чём этот конспект: Разбор революционного метода управления генерацией изображений в Google Gemini с использованием JSON-структур. Этот подход позволяет изменять отдельные детали (цвет, материал, объекты, освещение), не нарушая общую композицию и перспективу исходного изображения.
👤 Кому будет полезно: Вайбкодерам, AI-художникам и разработчикам, которые столкнулись с проблемой «галлюцинаций» нейросетей при попытке внести точечные правки в готовые генерации.
✨ Что получите: Пошаговую методику превращения визуального контента в структурированный код, который можно редактировать как текстовый конфиг, получая предсказуемый и стабильный результат в модели Imagen 3 (упоминаемой в видео как Nano Banana 2).
Контекст: Главная проблема AI-редактирования — изменение промпта часто ведет к полной перерисовке сцены. Автор предлагает использовать Gemini 1.5 Pro для деконструкции изображения в JSON-код. Это превращает картинку в список объектов с параметрами: название, цвет, материал и координаты. Когда мы подаем этот код обратно вместе с оригиналом, AI четко понимает, что именно нужно изменить, а что оставить нетронутым.
Выгода: Полный контроль над композицией и исключение случайных изменений мебели, освещения или перспективы при редактировании мелких деталей.
Как применить:
color: "cream" на color: "light blue") и отправьте обратно с командой:Modify this image based on the following JSON prompt:
[ВСТАВИТЬ ВАШ JSON КОД]Результат: Изображение, где изменен только целевой параметр, а всё остальное совпадает с оригиналом пиксель в пиксель.
Контекст: Обычные промпты часто путают текстуры объектов, находящихся рядом. Через JSON можно изолировать конкретный предмет (например, комод или чашку) и задать ему уникальные свойства поверхности (глянец, матовое дерево, керамика), не затрагивая окружение.
Выгода: Возможность быстрого прототипирования дизайна интерьеров или предметной съемки без перегенерации всей сцены.
Как применить:
name или object_type.material и finish. Например, для комода:Результат: Реалистичная замена материалов с сохранением теней и отражений.
Контекст: Замена одного кресла на другое — сложная задача из-за наслоения объектов и теней. Автор предлагает использовать "слияние" двух JSON-структур: одну от исходной комнаты, вторую от нового объекта (даже если он снят под другим углом).
Выгода: Возможность вставлять конкретные модели мебели или предметов в готовые интерьеры с автоматической подстройкой перспективы и освещения.
Как применить:
Результат: Новый объект идеально вписывается в сцену, учитывая освещение и тени комнаты, даже если исходное фото объекта было в другом ракурсе.
Контекст: При попытке сделать "дождливый день" AI часто убирает шторы, чтобы показать дождь в окне. Чтобы этого избежать, нужно использовать специфический JSON, который разделяет внутреннее освещение и внешние погодные эффекты.
Выгода: Создание вариаций одного и того же интерьера в разное время суток (Golden Hour, ночь, пасмурно) при сохранении всех предметов на своих местах.
Как применить:
lighting_setup, color_temperature и atmospheric_effects.exterior_weather_visible: true. Это заставит модель изменить только свет внутри, не пытаясь "показать" улицу.Результат: Масштабное изменение настроения снимка без потери мелких деталей интерьера.
Контекст: Самая сложная задача — применить перспективу одного фото (например, Fisheye) к другому. JSON позволяет извлечь параметры камеры: фокусное расстояние (focal_length), глубину резкости (depth_of_field) и точку фокусировки.
Выгода: Создание серии изображений в едином кинематографическом стиле или с экстремальными углами обзора.
Как применить:
Результат: Исходная сцена перестраивается под новую перспективу (например, вид из угла комнаты под широким углом).
В: Почему нужно использовать именно Gemini 1.5 Pro, а не Flash? О: Модель Pro обладает гораздо более глубокими способностями к рассуждению (reasoning) и анализу кода. Она точнее сопоставляет визуальные объекты с их текстовым описанием в JSON, что критично для избежания галлюцинаций.
В: Что делать, если Gemini пишет, что не может отредактировать изображение? О: Убедитесь, что вы загрузили оригинальное изображение в тот же чат, где вставляете JSON. Иногда помогает фраза "Using the uploaded image as a base, apply these changes...". Также проверьте, не нарушает ли изображение политики безопасности Google.
В: Можно ли таким образом менять текст на изображениях? О: Да, это один из лучших способов. В JSON нужно найти блок, отвечающий за текст или логотип, и изменить значение строки. Модель Imagen 3 (Nano Banana 2) отлично справляется с сохранением текстуры (например, текст из хлеба), меняя только сами буквы.
В: Где взять базовые промпты для генерации этих JSON? О: Автор видео предоставляет их в своем Discord-сообществе. В общем виде промпт звучит так: "Analyze this image and provide a detailed JSON representation of its objects, materials, colors, and spatial coordinates".
В: Работает ли это в Google AI Studio? О: Да, если у вас закончились лимиты в обычном интерфейсе Gemini, вы можете использовать те же промпты в AI Studio, выбрав модель Gemini 1.5 Pro. Результат будет идентичным.
Конспект создан на основе видео «How to use JSON to control AI Image Editing» канала RenderDrop. Все права на оригинальный материал принадлежат авторам. Источник: https://youtu.be/uQc4TGhvDHc