Маркетинг-стратег, IT-предприниматель, ментор по вайбкодингу
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
🎯 О чём этот конспект: Подробный технический разбор двух фундаментальных релизов в мире искусственного интеллекта: новой флагманской языковой модели Claude Opus 5 от Anthropic и универсальной мультимодальной архитектуры Flux 3 от Black Forest Labs. Включает реальный стресс-тест Opus 5 на автономное создание сложного интерактивного 3D-веб-приложения с нуля без внешних библиотек, а также анализ видео- и action-возможностей открытой модели Flux 3.
👤 Кому будет полезно: Вайбкодерам, разработчикам интерактивных веб-приложений, создателям мультимедийного AI-контента и инженерам, проектирующим мультимодальные агентные пайплайны.
✨ Что получите: Понимание реальных возможностей и преимуществ Claude Opus 5 в агентном кодинге и 3D-математике по сравнению с моделями OpenAI, проверенный промпт для автономной разработки креативных приложений и ориентиры по работе с физикой в генеративном видео Flux 3.
1. Бенчмарки и архитектурные сдвиги Claude Opus 5
Контекст: Anthropic представила модель Claude Opus 5, позиционируя её как решение, вплотную приближающееся к передовым флагманским системам (Fable 5 / GPT-5.6 Soul), но по вдвое меньшей цене. В агентном терминальном кодинге модель показывает рост метрик до 43% против 33% у предыдущих итераций (+10% чистого прироста). Наибольший скачок зафиксирован в тесте ARC-AGI-3 — с 1.5% у версии 4.8 до 30% у Opus 5 при существенно сниженной стоимости инференса. Несмотря на дискуссии в сообществе о возможной «подгонке» под тесты путем перевода визуальных задач в явную алгебру, модель демонстрирует принципиально новые паттерны решения нетривиальных сред.
Тайминг:[01:18], [02:17], [02:41], [04:05]
Выгода: Снижение затрат на вызовы API в 2 раза при одновременном повышении надежности автономных терминальных агентов и качества логических рассуждений.
Как применить:
Шаг 1: Оценка применимости под стек — Claude Opus 5 — Используйте Opus 5 в задачах, требующих пространственного воображения, написания математических алгоритмов, 3D-рендеринга и прямого терминального кодинга.
Шаг 2: Маршрутизация запросов — LLM Router / OpenRouter — Разделяйте нагрузку: направляйте повседневные диалоговые задачи и фактологический поиск на более генерализованные модели (GPT-5.6), а архитектурные и сложные алгоритмические модули — на Opus 5.
Результат: Оптимизированный пайплайн разработки, где тяжелые вычислительные и инженерные задачи решаются моделью с высокой способностью к визуально-алгебраической логике.
2. Вайбкодинг автономного 3D-приложения: Кейс тренажера «Cutaway»
Контекст: Для проверки способностей модели к созданию готовых продуктов без участия человека Opus 5 получила максимально открытый промпт: придумать и написать с нуля полезную 3D-игру, которой еще не существовало. Модель самостоятельно провела исследовательскую работу, спроектировала концепцию, написала собственный программный Z-buffer рендерер без единой внешней зависимости (Three.js/WebGL-библиотек) и реализовала психометрический тренажер пространственного мышления «Cutaway». Игра предлагает пользователю предсказать и нарисовать 2D-срез сложного 3D-тела (куб, труба, восьмиугольная призма) под произвольным углом, после чего аналитически рассчитывает точное сечение и оценивает процент совпадения.
Выгода: Получение рабочего сложного математического веб-приложения с нулевыми зависимостями за один промпт без необходимости вручную дебажить рендеринг и логику пересечения геометрии.
Как применить:
Шаг 1: Подготовка открытого креативного промпта — Web UI Claude / API — Задайте модели рамки полной архитектурной свободы с упором на новизну и математическую строгость:
Create a 3D game that is genuinely intuitive and creative, serving a purpose not yet seen. In other words, invent something new and genuinely useful from scratch. You have full creative and execution freedom. Proceed as you wish.
Шаг 2: Автономный цикл выполнения — Claude Code / Agent Environment — Позвольте агенту спланировать архитектуру, провести smoke-тесты и исправить возникающие баги рендеринга до выдачи финального артефакта.
Шаг 3: Тестирование системы валидации — Браузер — Проверьте алгоритм аналитического сопоставления: приложение должно не просто возвращать булево значение, а вычислять процентную оценку ошибки на основе перекрытия площадей (overlap scoring).
Результат: Полностью автономно созданный интерактивный тренажер пространственного мышления с кастомным софтверным графическим движком.
3. Архитектура Flux 3: Единый мультимодальный бэкбон для видео, аудио и робототехники
Контекст: Компания Black Forest Labs анонсировала модель нового поколения Flux 3, построенную на единой мультимодальной архитектуре. В отличие от раздельных специализированных сетей, Flux 3 объединяет генерацию изображений (в нативном 4K), синтез видео, генерацию синхронного нативного аудио и предикцию действий (Action Prediction) для робототехники в рамках одной модели с открытыми весами (Open Weights). Интеграция с компанией Mimic Robotics (модель Flux Mimic) показала, что предварительное обучение на мультимодальных данных позволяет роботизированным манипуляторам решать неструктурированные задачи (монтаж кабелей, работа с мягкими телами, сборка автомобильных деталей для Audi) с возможностью автоматического восстановления после ошибок.
Выгода: Доступ к локально разворачиваемой модели уровня закрытых передовых генераторов (Sora 2 / SeaDance 2.0) с возможностью тонкой настройки под видеопроизводство и управление физическими агентами.
Как применить:
Шаг 1: Подача заявки на Early Access — Официальный сайт Black Forest Labs — Зарегистрируйтесь в программе раннего тестирования API до публичного релиза открытых весов.
Шаг 2: Подготовка инфраструктуры под Open Weights — RunPod / Vast.ai — Зарезервируйте GPU-кластеры с поддержкой вычислений высокой разрядности для последующего развертывания мультимодального бэкбона.
Шаг 3: Проектирование Action-пайплайнов — Robot Learning Scaffolding — Используйте предобученные веса Flux 3 для файн-тюнинга под задачи динамического манипулирования объектами в реальном времени.
Результат: Готовность к внедрению open-source пайплайна для мультимедийных задач и роботизированного управления на базе единого фундаментального чекпоинта.
4. Физическая симуляция и нативный звук во Flux 3 Video
Контекст: Тестирование видеомодели Flux 3 демонстрирует качественный скачок в симуляции физики реального мира по сравнению с предыдущими решениями. Модель корректно воспроизводит сложные динамические сцены: сжатие и расслабление подвески багги на песчаных дюнах, отскок снега от сноуборда при ударе о рельс, деформацию бампера раллийного авто при наезде на препятствие. Важной особенностью стал нативный аудиодвижок с эффектом присутствия (Foley-звук), который точно синхронизирует удары, шаги, шаги по снегу и всплески воды с визуальным рядом, избавляя от необходимости отдельного пост-продакшна саунд-дизайна.
Выгода: Сокращение времени генерации полноценных видеороликов с готовым аудиорядом в едином цикле без расхождения таймингов.
Как применить:
Шаг 1: Лаконичный промптинг — Flux 3 Video — Формируйте промпты без избыточных инструкций — модель способна самостоятельно достраивать контекст окружения и физические взаимодействия:
Two kids jousting in the backyard with pool noodles, cinematic natural lighting, highly detailed physics, 4k.
Шаг 2: Тестирование синхронизации ракурсов (Split-Screen) — Flux 3 Video — Проверяйте консистентность сцен с помощью промптов с разделением экрана:
A split screen video showing the same real-time action from two different camera angles: a domestic cat jumping from the wooden table to the floor.
Шаг 3: Балансировка нативного аудио — Видеоредактор / NLE — Поскольку встроенные звуковые эффекты генерируются с высокой акцентностью (Foley style), при финальном монтаже применяйте нормализацию уровня громкости фоновых эффектов.
Результат: Кинематографичные клипы с согласованной физикой движения объектов и автоматической звуковой дорожкой.
FAQ
В: В чем главное отличие Claude Opus 5 от GPT-5.6 Soul при написании кода? О: Claude Opus 5 значительно сильнее в задачах, связанных с 3D-геометрией, кастомным рендерингом, математической логикой и автономным решением архитектурных задач в терминале. GPT-5.6 Soul остается более универсальной моделью для общих повседневных запросов, фактологии и диалоговых интерфейсов.
В: Можно ли запустить 3D-приложение, созданное Opus 5, без установки сторонних библиотек? О: Да, Opus 5 способна писать софтверные 3D-рендереры на чистом JavaScript/HTML5 Canvas с собственной реализацией алгоритма Z-буферизации, расчета нормалей и матричных трансформаций, что исключает любые внешние зависимости вроде Three.js.
В: Что дает мультимодальность с поддержкой Action Prediction во Flux 3? О: Это означает, что модель не просто генерирует пиксели, но и понимает физику динамического мира. Это позволяет использовать её бэкбон для обучения роботизированных манипуляторов сложным физическим операциям (работа с кабелями, мягкими телами) с возможностью самокоррекции при сбоях.
В: Поддерживает ли Flux 3 Video генерацию звука по отдельной аудиодорожке? О: Да, архитектура поддерживает нативную синхронизацию аудио и видео, что позволяет подавать готовую звуковую дорожку на вход и генерировать видеоряд, точно попадающий в ритм и артикуляцию.
В: Как Claude Opus 5 показал такой резкий рост в тесте ARC-AGI-3? О: Модель обучена преобразовывать абстрактные визуальные головоломки в формальные алгебраические структуры, что позволяет аналитически находить паттерны и правила трансформации сетки данных.
В: Будет ли модель Flux 3 доступна локально? О: Black Forest Labs подтвердила выпуск версии с открытыми весами (Open Weights) для сообщества после завершения фазы раннего закрытого доступа через API.
Ресурсы и ссылки
Claude (Anthropic) — Интерфейс и API флагманских моделей Claude Opus 5 — упомянут в видео.
Black Forest Labs — Разработчик моделей семейства Flux (Flux 3, Flux Mimic) — https://blackforestlabs.ai
Mimic Robotics — Компания-партнер по внедрению Action-моделей в робототехнику — упомянут в видео.
ARC-AGI — Бенчмарк для измерения обобщенного интеллекта и рассуждений — упомянут в видео.
Конспект создан на основе видео «Claude Opus 5 is HERE + FLUX 3 (OMG)» канала MattVidPro AI. Все права на оригинальный материал принадлежат авторам.Источник: https://www.youtube.com/watch?v=1s3zslFOSh0