Anthropic выпустила Claude Opus 5 — и это не просто новая версия в ряду обновлений. За три дня после релиза стало понятно: это лучшая модель для повседневной работы в экосистеме Claude прямо сейчас.
10+ лет в маркетинге, 300+ клиентских проектов: сайты, реклама, боты. Создатель GoBanana (228K+ пользователей, 11.6 млн ₽ выручки) и VibeCoderz. Делаю AI-продукты сам через Claude Code, Cursor, Windsurf и консультирую тех, кто хочет так же.
Об авторе →Claude Code: новый CLI-агент от Anthropic
Anthropic выпустила Claude Code — терминальный AI-агент для разработчиков. Инструмент работает прямо в командной строке и умеет писать, редактировать и запускать код.
Zcode AI: Полный гид по визуальному интерфейсу для Claude Code и AI-агентов
Узнайте, как использовать Zcode для управления Claude Code, Gemini и Codex в едином GUI. Настройка провайдеров, MCP-серверов и визуальный вайбкодинг.
YouTube-канал с монетизацией из любой точки мира: Пошаговый гайд 2026
Инструкция по созданию YouTube-канала: обход блокировок SMS, настройка расширенных функций через виртуальные номера и правила безопасности для монетизации.
Windsurf Code Maps: Как глубоко понимать архитектуру проекта перед написанием кода
Полный гайд по Windsurf Code Maps, модели Sway 1.5 и Sway Grep. Узнайте, как визуализировать архитектуру кода и ускорить разработку в 13 раз.
Vk Fast Cash Strategy
Аудитория ВКонтакте — это те же люди, что и в Instagram, но 'социальный контракт' площадки другой. Если Instagram — это 'дорогой ресторан' с демонстрацией успеха, то VK — это 'душевная шашлычная'. Здесь не работает глянцевый 'успешный успех
Anthropic выпустила Claude Opus 5 — и это не просто новая версия в ряду обновлений. За три дня после релиза стало понятно: это лучшая модель для повседневной работы в экосистеме Claude прямо сейчас.
Главный факт: Opus 5 обходит Fable 5 на 7 из 9 прямых сравнений. При этом стоит вдвое дешевле. Не имеет 30-дневного хранения данных. А safety-классификатор срабатывает на 85% реже, чем у Fable.

Opus 5 — четвёртая модель Claude пятого поколения за два месяца (Mythos → Fable → Sonnet → Opus). Такого темпа не показывает ни одна другая AI-лаборатория в 2026.
Claude Opus 5 (claude-opus-5) — вышел 24 июля 2026. Frontier-Bench 43.3% (×2.3 от Opus 4.8), ARC-AGI 3 30.2% (×20 от Opus 4.8), AA Intelligence Index 61 (первое место). $5/$25 за 1M токенов. Thinking ON по умолчанию. Новый уровень effort xhigh. Дефолтная модель Claude Max. В статье: всё про бенчмарки, цены, кейсы, миграцию и предостережения.
Ссылки:

Представьте, что Anthropic делает разные «версии умности» своего AI-помощника. До сих пор самой умной была Fable 5 — дорогая, мощная, но и хранящая ваши данные 30 дней.
Opus 5 — это версия, которая в большинстве задач делает то же самое или лучше, но стоит в два раза меньше и не хранит данные вообще.
Конкретно: если вы просите AI написать код, разобрать сложный документ, автоматизировать задачу — Opus 5 справится лучше Fable 5 или на том же уровне. За полцены.
Именно поэтому Anthropic сделала Opus 5 дефолтной моделью на плане Max.
Сравнение с предшественником Opus 4.8 говорит само за себя.
Есть бенчмарк Frontier-Bench — он тестирует, насколько хорошо модель справляется со сложными многошаговыми задачами реального мира. Opus 4.8 набирал 18.7%. Opus 5 — 43.3%. Это не улучшение на несколько процентов. Это больше чем в два раза.
ARC-AGI 3 — тест на способность решать принципиально новые задачи, с которыми модель никогда не сталкивалась. Opus 4.8: 1.5%. Opus 5: 30.2%. В 20 раз лучше. При этой же цене.
Вот полная картина прироста:
| Что улучшилось | Opus 4.8 | Opus 5 | Прирост |
|---|---|---|---|
| Frontier-Bench | 18.7% | 43.3% | ×2.3 |
| ARC-AGI 3 | 1.5% | 30.2% | ×20 |
| SWE-bench Verified | 88.6% | ~97% | +8.4 п.п. |
| Задачи по химии | baseline | +10.2 п.п. | — |
| Задачи по биологии | baseline | +7.7 п.п. | — |
| Токены (legal work) | baseline | -26% | экономия |
| Латентность | baseline | <50% | быстрее в 2× |
Это то, что реально важно для большинства читателей: нужен ли дорогой Fable 5, если есть Opus 5?
| Бенчмарк | Opus 5 | Fable 5 | Кто победил |
|---|---|---|---|
| Frontier-Bench v0.1 | 43.3% | 33.7% | Opus 5 +9.6 🔥 |
| GDPval-AA v2 (Elo) | 1861 | 1747 | Opus 5 +114 🔥 |
| AutomationBench | 26.0% | 17.4% | Opus 5 +8.6 🔥 |
| OSWorld 2.0 | 70.6% | 66.1% | Opus 5 +4.5 |
| BrowseComp | 90.8% | 87.4% | Opus 5 +3.4 |
| SWE-bench Verified | ~97% | 95.0% | Opus 5 +2 |
| HLE (with tools) | 64.7% | 63.9% | Opus 5 +0.8 |
| SWE-bench Pro | 79.2% | 80.0% | Fable 5 +0.8 |
| DeepSWE v1.1 | 68.8% | 69.7% | Fable 5 +0.9 |
| FrontierCode 1.1 | 53.4% | 53.5% | Ничья |
7 из 9 — у Opus 5. На двух специализированных кодинг-бенчмарках Fable чуть впереди, но разрыв меньше одного процентного пункта.
Artificial Analysis считает Intelligence Index — независимую оценку общего интеллекта модели:
| Модель | AA Intelligence Index |
|---|---|
| Claude Opus 5 | 61 🥇 |
| Claude Fable 5 | 60 |
| GPT-5.6 Sol | 59 |
Opus 5 — первое место в мире по этому показателю на момент выхода.
Opus 5 на уровне effort HIGH:
Fable 5:
Opus 5 на high effort бьёт Fable 5 на 32 Elo при стоимости 47% от цены Fable.
| Модель | Вход / 1M | Выход / 1M | Кэш-чтение | Кэш-запись |
|---|---|---|---|---|
| Opus 5 | $5 | $25 | $0.50 | $6.25 |
| Opus 5 Fast | $10 | $50 | $1.00 | $12.50 |
| Opus 4.8 | $5 | $25 | $0.50 | $6.25 |
| Fable 5 | $10 | $50 | $1.00 | $12.50 |
| Sonnet 5 | $2 ($3 с сент.) | $10 ($15) | $0.20 | $2.50 |
Opus 5 стоит столько же, сколько Opus 4.8 — и при этом значительно мощнее. Fable 5 — в два раза дороже при худших показателях на большинстве задач.
Opus 5 Fast — режим с ускорением в 2.5× раза. Стоит $10/$50 — столько же, сколько стандартный Fable 5. То есть: скорость Opus 5 Fast или глубина мышления Fable 5 за одну цену.
| План | Opus 5 | Fable 5 |
|---|---|---|
| Max | Дефолтная модель | Доступна, до 50% лимитов |
| Pro | Сильнейшая доступная | Требует usage credits |
| Team (premium) | Доступна | До 50% лимитов |
Если вы на Claude Max — Opus 5 уже ваша дефолтная модель. Fable 5 можно включить, но с ограниченными лимитами.
Самое важное изменение, которое может сломать существующие пайплайны.
В Opus 4.8 thinking был выключен — модель просто давала ответ. В Opus 5 thinking включён всегда. Это значит, что перед финальным ответом модель проходит через цепочку рассуждений — вы видите, как она думает.
Практическое следствие: thinking tokens теперь входят в max_tokens. Если у вас был жёсткий лимит на вывод — нужно его увеличить, иначе модель обрежется на середине мысли.
Отключить thinking можно, но только на уровнях low, medium, high. На xhigh и max отключение thinking возвращает HTTP 400 — это намеренное ограничение Anthropic.
Полная лестница стала длиннее: low → medium → high → xhigh → max.
Anthropic рекомендует начинать с high. Переходить на xhigh и max — только если на high явно чего-то не хватает и есть конкретное измерение разницы.
Opus 5 сам проверяет свою работу после выполнения. Это значит: если в вашем системном промпте есть «проверь себя», «добавь шаг верификации», «убедись что результат правильный» — удалите. Модель это уже делает. Повторная инструкция вызывает over-verification: модель начинает перепроверять до абсурда.
Теперь можно добавлять и убирать инструменты в середине диалога без инвалидации кэша. Для multi-step агентов это огромно: раньше смена набора инструментов обнуляла весь накопленный кэш.
Если запрос блокируется safety-классификатором, Opus 5 может автоматически перенаправить его на Opus 4.8. Режим "default" применяет рекомендованные Anthropic модели по категориям отказов. Меньше руководства вручную.
Минимальный промпт для кэширования снижен с 1024 до 512 токенов. Короткие системные промпты теперь кэшируются — это экономия для высокочастотных сценариев.
Кибер-классификатор Opus 5 срабатывает на 85% реже, чем у Fable 5. Это значит меньше ложных блокировок при работе с кодом безопасности. Но: бинарный анализ и пентест всё ещё под ограничениями. Для оффенсив-кибера и биологических задач на пределе — Mythos 5.
Behavioural audit: 2.3 балла — ниже всех предыдущих моделей. Меньше подвержен jailbreak'ам, меньше «соглашается» когда не должен. Это первое место по alignment среди всех Claude-моделей.
| Что сравниваем | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|
| Цена | $5 / $25 | $5 / $30 |
| AA Intelligence Index | 61 | 59 |
| Frontier-Bench | 43.3% | ~37.5% |
| ARC-AGI 3 | 30.2% | ~10% |
| SWE-bench Pro | 79.2% | 64.6% |
| AutomationBench | 26.0% | 18.1% |
| OSWorld 2.0 | 70.6% | 62.6% |
| Coding Agent Index | 66.7 | 80 (в Codex harness) |
| Скорость | 52.6 t/s (медленный) | Быстрее |
| Multi-agent (Ultra) | ❌ | ✅ |
Коротко: Opus 5 выигрывает на большинстве reasoning и агентских задач и дешевле на output ($25 против $30). GPT-5.6 Sol быстрее и значительно лучше в экосистеме Codex (Coding Agent Index 80 против 66.7 — здесь разрыв серьёзный).
Если основная среда — Claude Code и Cowork → Opus 5. Если основная среда — Codex CLI и GPT → Sol.
Opus 5 показали рисунок детали и попросили построить 3D FreeCAD-модель. Но доступа к самому изображению не дали — только текстовое описание задачи.
Что сделала модель: написала собственный computer-vision пайплайн, извлекла геометрию из пикселей изображения через код и построила деталь правильно. Пять других моделей эту задачу не решили ни разу.
Инженер трейдинговой фирмы просил построить market-data feed для новой биржи — задача, с которой предыдущие модели не справлялись даже при наличии готового плана.
Opus 5 написал собственный тестовый харнесс, проверил парсинг данных и сдал задачу в рамках одной сессии.
Opus 5 дали баг в популярном open-source пакетном менеджере. Конкурентная модель исправила симптом. Opus 5 отследил первопричину и пофиксил edge-case, который пропустил официальный патч сообщества.
Инженер Cristian Rivera дал Opus 5 роль начальника штаба на выходные. Модель: сама строила мониторинг, управляла машинами, дёргала человека только для реальных решений. «Agency and thoroughness» в действии.
Zapier CEO Wade Foster: Opus 5 получил сырой spreadsheet с health-метриками аккаунтов и задание провести churn-prevention анализ. Все предыдущие модели проваливали этот тест полностью. Opus 5 — 100%.
Тот же результат, что на Fable 5. 56% экономии.
Максим: «Ребят, это работает. Я переключился на Opus 5 в первый день — на GoBanana задачи по retention-анализу, которые раньше требовали 3-4 итерации с моей правкой, теперь проходят за одну. Модель сама проверяет логику. Сделал — получил цифру.»
1. Увеличьте max_tokens.
Thinking ON по умолчанию — токены на размышление входят в лимит вывода. Если у вас был max_tokens: 4096 — увеличьте как минимум вдвое, иначе модель обрежется.
2. Уберите thinking: {type: "disabled"} при effort xhigh и max.
На этих уровнях thinking отключить нельзя — получите HTTP 400. Либо убирайте disabled, либо переходите на effort high.
3. Уберите инструкции по верификации из промптов.
«Проверь себя», «добавь шаг верификации», «убедись в правильности» — Opus 5 делает это сам. Повторная инструкция вызывает over-verification: модель зацикливается на перепроверке.
4. Web fetch и Priority Tier недоступны.
Если пайплайн использовал эти фичи Opus 4.8 — нужна замена.
5. Запустите claude doctor в Claude Code.
Новая команда автоматически определяет устаревшие инструкции в вашем CLAUDE.md и подсказывает что удалить.
6. Начните с effort HIGH, не max.
На high Opus 5 уже бьёт Fable 5. xhigh и max — только если high явно недостаточно.
7. Упрощайте промпты.
Anthropic убрала >80% системного промпта Claude Code для Opus 5 без потери качества на coding-оценках. Это официальная рекомендация. Меньше инструкций — лучше результат.
8. Уберите «будь кратким».
Opus 5 и так отвечает короче Opus 4.8. Избыточная инструкция делает ответы слишком сухими.
9. Ограничьте scope явно.
Opus 5 проактивно расширяет задачи. Это полезно — но может удивить. Если нужна строгая граница — пропишите явно.
10. Новый токенизатор — пересчитайте бюджет.
Тот же текст теперь занимает на 35% больше токенов. Если бюджет токенов был важен — пересмотрите расчёты.
Dan Shipper из Every написал об этом прямо: Opus 5 может быть «pushy, verbose, and unwilling to follow a workflow». Скиллы, написанные под Opus 4.8, могут работать хуже — модель over-verifies, расширяет scope, делает больше чем просили.
Решение: упростите SKILL.md и системные промпты. Уберите инструкции по верификации и делегированию. Оставьте только границы задачи и acceptance criteria.
Неприятная новость. AA-Omniscience: Opus 5 — 50% hallucination rate против 36% у Opus 4.8. Модель стала более уверенной — в том числе когда ошибается. Для задач, где точность фактов критична, нужны guardrails и дополнительная верификация источников.
52.6 токена в секунду — это медленно. Медиана по классу — 76 t/s. Время до первого токена на max effort — 68 секунд (медиана класса — 2.81 секунды). Opus 5 — это модель для батч-обработки и фоновых задач, не для интерактивного чата в реальном времени.
Если нужна скорость — Opus 5 Fast ($10/$50) или Sonnet 5.
26 июля — час деградации. 27 июля — более широкий сбой (API + Claude.ai + Claude Code). За 72 часа два инцидента. Ожидаемо для запуска под нагрузкой, но для production-пайплайнов стоит держать fallback.
| Ситуация | Модель | Почему |
|---|---|---|
| Кодинг и daily work | Opus 5 | Frontier-Bench лидер, за полцены от Fable |
| Автономные агентские задачи | Opus 5 | AutomationBench +8.6 над Fable |
| Computer use / браузерные задачи | Opus 5 | OSWorld 2.0 +4.5 над Fable |
| Knowledge work, анализ | Opus 5 | GDPval-AA +114 Elo над Fable |
| Затраты критичны | Opus 5 | В 2× дешевле Fable на output |
| Regulated / zero-retention | Opus 5 | Нет 30-дневного retention |
| Cybersecurity (source code) | Opus 5 | Классификатор на 85% реже срабатывает |
| Терминальная работа в Codex | GPT-5.6 Sol | Coding Agent Index 80 vs 66.7 |
| SWE-bench Pro, нужно именно 80%+ | Fable 5 | Всё ещё +0.8 |
| Multi-day автономные проекты | Fable 5 | Anthropic рекомендует для max горизонта |
| Оффенсив-кибер / биологические пределы | Mythos 5 | Opus 5 намеренно ограничен |
| Скорость важнее глубины | Sonnet 5 | В несколько раз быстрее |
Opus 5 дороже чем Sonnet 5 — когда Sonnet достаточно?
Sonnet 5 ($2/$10-15) для рутинных задач — суммаризация, черновики, классификация, быстрые ответы. Opus 5 — для задач где нужна глубина: сложный код, многоступенчатый анализ, автономные агентские сессии. Anthropic сделала Opus 5 дефолтом на Max именно потому, что для большинства нетривиальных задач разница ощутима.
Что такое ARC-AGI 3 и почему 30.2% это важно?
ARC-AGI — самый сложный тест на способность решать принципиально новые задачи, которых нет в обучающих данных. Opus 4.8: 1.5%. Opus 5: 30.2% — в 20 раз больше. Это означает, что модель значительно лучше справляется с нестандартными ситуациями, которые она «никогда не видела».
Нужно ли обновляться если я на Claude Pro?
Да. На Pro Opus 5 — сильнейшая доступная модель. Fable 5 на Pro требует usage credits. Opus 5 включён.
Когда использовать Fast mode?
Opus 5 Fast ($10/$50 = цена как у стандартного Fable 5) — когда нужна скорость Opus 5, и при этом вы готовы платить как за Fable. Или когда 2.5× ускорение критично для UX, а качество Opus важнее качества Sonnet.
Какой effort выбрать для продакшена?
Начните с high. Он даёт Elo 1606 по AA-Briefcase, стоит $10.41 за задачу и бьёт Fable 5. xhigh и max — только при измеримой необходимости.
Thinking — режим, при котором модель проходит через цепочку рассуждений до финального ответа. В Opus 5 включён по умолчанию. Thinking tokens входят в max_tokens.
Effort level — параметр reasoning.effort в API. Определяет глубину thinking: low → medium → high → xhigh → max. Opus 5 добавил уровень xhigh между high и max.
Frontier-Bench — бенчмарк Anthropic для оценки сложных многошаговых задач реального мира. Opus 5: 43.3% vs 18.7% у Opus 4.8.
ARC-AGI 3 — тест на способность решать принципиально новые задачи без шаблонов из обучения. Считается одним из самых сложных и показательных тестов интеллекта модели.
GDPval-AA — бенчмарк Artificial Analysis для knowledge work (бизнес-анализ, юридические задачи, исследования). Opus 5 опережает Fable 5 на 114 Elo-пунктов.
AutomationBench — тест на автоматизацию задач через браузер и приложения. Opus 5: 26.0% vs 17.4% у Fable 5.
OSWorld 2.0 — тест на computer use: насколько хорошо модель управляет реальным компьютером. Opus 5: 70.6%.
AA Intelligence Index — сводный индекс общего интеллекта от Artificial Analysis. Opus 5: 61 (первое место в мире на момент выхода).
Fast mode — режим ускорения Opus 5 в 2.5× за $10/$50 (как стандартный Fable 5).
Mid-conversation tool changes — возможность менять набор инструментов агента в середине диалога без инвалидации кэша. Beta-фича Opus 5.
Auto fallbacks — автоматическое перенаправление заблокированных запросов на Opus 4.8. Beta-фича.
Over-verification — нежелательное поведение, при котором модель бесконечно перепроверяет результат. Возникает если в промпте есть избыточные инструкции по верификации.
claude doctor — новая команда Claude Code, которая анализирует CLAUDE.md и подсказывает какие инструкции устарели.
Официальная страница — anthropic.com/claude/opus. API-документация — platform.claude.com. Независимые бенчмарки — Artificial Analysis. Попробовать — claude.ai на плане Max.
Смотрите страницу Claude на VibeCoderz — там история релизов и актуальные сравнения.
Вопросы по миграции пайплайнов на Opus 5 — к Максиму.
Обновлено: 27 июля 2026. Источники: Anthropic, Artificial Analysis, BenchLM, llm-stats, TechCrunch, Axios, Fortune.