Ultra Mode в GPT-5.6 Sol запускает не одну модель, а четыре параллельных агента на одну задачу. По данным OpenAI, это подняло результат на Terminal-Bench 2.1 с 88.8% до 91.9%. Разница выглядит скромно на бумаге, но токены при этом сгорают в разы быст…
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
Об авторе →Claude Code: новый CLI-агент от Anthropic
Anthropic выпустила Claude Code — терминальный AI-агент для разработчиков. Инструмент работает прямо в командной строке и умеет писать, редактировать и запускать код.
Zcode AI: Полный гид по визуальному интерфейсу для Claude Code и AI-агентов
Узнайте, как использовать Zcode для управления Claude Code, Gemini и Codex в едином GUI. Настройка провайдеров, MCP-серверов и визуальный вайбкодинг.
YouTube-канал с монетизацией из любой точки мира: Пошаговый гайд 2026
Инструкция по созданию YouTube-канала: обход блокировок SMS, настройка расширенных функций через виртуальные номера и правила безопасности для монетизации.
Windsurf Code Maps: Как глубоко понимать архитектуру проекта перед написанием кода
Полный гайд по Windsurf Code Maps, модели Sway 1.5 и Sway Grep. Узнайте, как визуализировать архитектуру кода и ускорить разработку в 13 раз.
Vk Fast Cash Strategy
Аудитория ВКонтакте — это те же люди, что и в Instagram, но 'социальный контракт' площадки другой. Если Instagram — это 'дорогой ресторан' с демонстрацией успеха, то VK — это 'душевная шашлычная'. Здесь не работает глянцевый 'успешный успех
Ultra Mode в GPT-5.6 Sol запускает не одну модель, а четыре параллельных агента на одну задачу. По данным OpenAI, это подняло результат на Terminal-Bench 2.1 с 88.8% до 91.9%. Разница выглядит скромно на бумаге, но токены при этом сгорают в разы быстрее. Ниже разбираем, когда включать Ultra, а когда это просто дорогой способ получить тот же ответ.
Ultra Mode — это режим Sol, где задача делится между четырьмя субагентами, а не отдельная модель. Прирост на Terminal-Bench 2.1: +3.1 пункта. Отдельного тарифа на Ultra нет, платите за токены каждого агента. В статье: как считать стоимость, какие задачи реально параллелятся и два готовых промпта.
Ultra — это надстройка над флагманской моделью Sol, где один запрос обрабатывают четыре агента одновременно, а не отдельный продукт с собственным API-слагом.
OpenAI описывает Ultra как оркестрацию: задача дробится на потоки, каждый агент ведет свой участок, а затем результаты сводятся в единый ответ. Формально это настройка reasoning-эффорта поверх Sol, а не четвертая модель линейки Sol/Terra/Luna. По умолчанию Ultra разворачивает четыре агента, хотя в июле 2026 OpenAI показала и разгон до 64 агентов на одну открытую математическую задачу — но это был разовый эксперимент, не дефолтная конфигурация для клиентов.
Разница с обычным max-эффортом простая. Max дает одному агенту больше времени подумать. Ultra дает нескольким агентам работать параллельно и потом сверяет их выводы. Для последовательной логики, где шаг 2 зависит от результата шага 1, это бесполезно — агенты просто не смогут разделить работу.

На Terminal-Bench 2.1 Sol Ultra показал 91.9% против 88.8% у обычного Sol — прирост в 3.1 пункта, и это делает Sol Ultra лидером бенчмарка среди флагманов 2026 года.
Три очка звучат скромно, пока не смотришь на контекст задачи. Для агентных coding-бенчмарков, где счет идет за проценты решенных сложных кейсов, каждый пункт — это отдельная категория задач, которые обычная модель просто не закрывает.
| Модель / режим | Terminal-Bench 2.1 | SWE-Bench Pro |
|---|---|---|
| GPT-5.6 Sol (база) | 88.8% | 64.6% |
| GPT-5.6 Sol Ultra | 91.9% | — |
| GPT-5.5 | 88.0% | — |
| Claude Mythos 5 | 88.0% | 80.3% |
Здесь есть нюанс, который OpenAI не выносит в заголовки. На SWE-Bench Pro — бенчмарке, который ближе к реальным репозиториям, — Sol отстает от Claude Mythos 5 почти на 16 пунктов. Terminal-Bench 2.1 хорош для командной строки и агентных цепочек, но не универсальный показатель качества кода. Цифры OpenAI — вендорские, независимой проверки на своих репозиториях пока мало, и разработчики в комьюнити прямо об этом пишут.

Отдельного прайса на Ultra нет — OpenAI просто умножает токены, потому что каждый из четырех агентов считает независимо. База Sol стоит $5 за 1M входных токенов и $30 за 1M выходных.
Официальной строчки «Ultra: $X за 1M» в прайс-листе не существует. Задача, которую обычный Sol решил бы за условные 100 000 токенов, в Ultra может разойтись на четыре параллельных потока по 80-100 тысяч токенов каждый плюс токены на сведение результатов. На практике это выходит на 2.5-4 раза дороже одиночного запуска, в зависимости от того, насколько задача реально делится на независимые куски.
| Тир | Вход / 1M токенов | Выход / 1M токенов | Ultra доступен |
|---|---|---|---|
| Luna | $1 | $6 | Нет |
| Terra | $2.5 | $15 | Нет |
| Sol | $5 | $30 | Да |
Доступ тоже разный по продуктам. В Codex Ultra открыт с тарифа Plus. В ChatGPT Work — только Pro и Enterprise. Если у вас Plus в обычном чате, Ultra там просто не появится в настройках — это фича Codex и Work, а не рядового чата.

Ultra живет не в обычном чате, а в двух рабочих поверхностях — Codex и ChatGPT Work, и доступ к нему завязан на тариф, а не на модель.
В Codex переключатель Ultra доступен пользователям Plus и выше. В ChatGPT Work — только на Pro и Enterprise, дальше он не пробрасывается. Это отдельная настройка от max-эффорта: max можно включить на любом плане с доступом к GPT-5.6, а Ultra требует более высокого тарифа независимо от модели.
Для команд это значит простую вещь. Прежде чем закладывать Ultra в процесс, проверьте тариф каждого, кто будет им пользоваться. Часть команды на Plus в Codex получит доступ, часть на Pro в Work — тоже, но если кто-то сидит на обычном Plus в чате, Ultra он там не увидит вообще.

Ultra окупается на задачах, которые физически делятся на независимые куски: рефакторинг с параллельными тестами, аудит по нескольким направлениям сразу. На последовательной логике агенты друг другу не помогают.
Параллелится хорошо: рефакторинг крупного модуля, где один агент меняет код, второй параллельно чинит тесты, третий пишет документацию, четвертый проверяет обратную совместимость. Не параллелится: пошаговая отладка, где вывод шага 2 определяется результатом шага 1 — здесь агенты просто дублируют друг друга и жгут токены впустую.
Два рабочих промпта, которые можно взять как есть.
Рефакторинг на Ultra:
Проведи рефакторинг [компонент] на dependency injection.
Задача параллелится:
Агент 1: основной модуль
Агент 2: зависимые тесты
Агент 3: документация
Агент 4: проверка обратной совместимости
Верни единый PR.Аудит на Ultra:
Параллельный аудит проекта:
Агент 1: безопасность (OWASP Top 10)
Агент 2: производительность
Агент 3: UX и доступность
Агент 4: покрытие тестами
Consolidated report.В обоих случаях ключевое — явно назвать границы для каждого агента в промпте. Без этого Ultra может распределить работу криво, и агенты начнут пересекаться на одном и том же файле.

Простое правило: сравните разницу в цене между Sol и Sol Ultra с ценой часа вашей работы. Если Ultra экономит больше времени, чем стоит разница, включайте не думая.
Возьмем задачу примерно на 500 000 токенов. На обычном Sol это около $5 при среднем балансе входа и выхода, на Ultra — порядка $15-20 из-за параллельных потоков. Разница в 10-15 долларов. Если Ultra реально сокращает время ревью и доработки на час или больше, а час вашей работы стоит дороже этой разницы — экономика сходится сразу.
Максим: «У Нейроскрайба ждали от разработчика неделю-две-три. У Нейроштата целая команда работала — ждали целую фичу месяцами. Получили — и разочаровались, потому что время реализации критично.»
Именно поэтому Ultra интересен не как способ получить более умный ответ, а как способ получить рабочий результат быстрее на задачах, где скорость решает больше, чем экономия на токенах.

В июле 2026 OpenAI опубликовала proof для гипотезы Cycle Double Cover, полученный на конфигурации из 64 агентов Ultra. Это не дефолтный режим, который получают клиенты, а показательный разгон возможностей.
История наделала шума: открытая математическая задача около 50 лет, три страницы доказательства, приложенный промпт. Но сама конфигурация с 64 агентами — не то, что доступно в Codex или Work по умолчанию, там стоят четыре агента.
По независимым оценкам, такой прогон мог стоить от пары сотен до тринадцати тысяч долларов, а само доказательство еще не прошло верификацию математиков. Красивый кейс для заголовков, но для рабочих задач ориентируйтесь на цифры из таблицы выше, а не на разовый эксперимент.

На Terminal-Bench 2.1 Sol Ultra формально впереди, но на SWE-Bench Pro, ближе к реальным репозиториям, выигрывает Claude Mythos 5. Выбор зависит от типа задачи, а не от одного бенчмарка.
Если работа завязана на командную строку, множество мелких шагов и agentic-цепочки — Sol Ultra статистически сильнее по опубликованным данным. Если задача — это глубокое погружение в реальную кодовую базу с архитектурными решениями, разрыв на SWE-Bench Pro говорит в пользу Claude.
Разумный подход — не выбирать одного фаворита навсегда, а держать оба варианта под конкретные типы задач. Обзоры инструментов для вайбкодинга, включая Claude Code и Cursor, можно свести и сравнить в каталоге VibeCoderz.

Что такое Ultra Mode в GPT-5.6 Sol простыми словами?
Это настройка, при которой одну задачу решают четыре агента параллельно вместо одного. Агенты делят работу на куски, а затем результат собирается в единый ответ.
Сколько стоит Sol Ultra за 1M токенов?
Отдельного тарифа нет. База Sol — $5 за вход и $30 за выход на 1M токенов, а Ultra умножает расход токенов в 2.5-4 раза за счет параллельных агентов.
Где включить Ultra Mode?
В Codex — с тарифа Plus. В ChatGPT Work — только на Pro и Enterprise. В обычном чате ChatGPT Ultra не появляется вообще.
Ultra Mode это то же самое, что max-эффорт?
Нет. Max дает одному агенту больше времени на размышление. Ultra распределяет задачу между четырьмя агентами параллельно — это разные настройки, их можно комбинировать не всегда, зависит от продукта.
На каких задачах Ultra не имеет смысла включать?
На последовательной логике, где каждый следующий шаг зависит от предыдущего результата. Там агенты просто дублируют друг друга и увеличивают счет без пользы.
Правда ли что Sol Ultra доказал математическую теорему?
OpenAI опубликовала proof для гипотезы Cycle Double Cover, полученный на разгоне до 64 агентов. Это не дефолтная конфигурация Ultra и результат пока не прошел независимую верификацию математиков.
Ultra Mode лучше Claude Mythos 5 для кода?
На Terminal-Bench 2.1 у Sol Ultra формально выше результат. На SWE-Bench Pro, ближе к реальным репозиториям, впереди Claude Mythos 5. Смотрите на тип своей задачи, а не на один бенчмарк.
Если решаете, какой стек инструментов ставить под агентную разработку, посмотрите каталог AI-инструментов на VibeCoderz — там собраны обзоры Claude Code, Cursor и других IDE с реальными плюсами и минусами. А если нужен разбор именно под ваш проект — можно записаться на консультацию к Максиму.
Обновлено: июль 2026