У Сбера сейчас пять моделей GigaChat одновременно: Lite, Pro, Max, флагманская 3.5 Ultra и новая 3.5 Reasoning с режимом рассуждений. Разброс цены на API, от 65 до 650 ₽ за миллион токенов, а самая мощная модель вообще пока не продается отдельно. Ниже разберем, какая модель закрывает какую задачу и где Сбер прячет бесплатные лимиты.
В 2026 году линейка GigaChat выросла до пяти моделей: Lite, Pro, Max, 3.5 Ultra и свежая 3.5 Reasoning от 10 сентября. Цены API, 65-650 ₽ за 1М токенов, у физлиц есть 365 млн бесплатных токенов в год. В статье, таблица выбора модели под задачу и честное сравнение с YandexGPT.
Сколько сейчас моделей у GigaChat и чем они отличаются?
У Сбера параллельно живут пять моделей: три рабочие лошадки поколения 2 (Lite, Pro, Max) и два свежих флагмана, 3.5 Ultra и 3.5 Reasoning. Разница между ними, не только в цене, но и в архитектуре.
GigaChat Lite, Pro и Max относятся к моделям второго поколения. Они доступны по API с ценами от 65 до 650 ₽ за миллион токенов. Они закрывают 90% типичных бизнес-задач: от чат-бота до анализа документов. Выше стоят два новых флагмана.
GigaChat 3.5 Ultra вышел в открытый доступ 6 июля 2026 года, модель на 432 млрд параметров (28 млрд активных, архитектура MoE), с гибридным вниманием, которое вчетверо экономит память на длинном контексте. А 10 сентября к линейке добавился GigaChat 3.5 Reasoning, первая российская открытая модель, которая перед ответом сама строит план и проверяет промежуточные шаги. Обе модели выложены под лицензией MIT, но на платный API Сбера пока не попали.

Какие задачи закрывает GigaChat Lite?
GigaChat 2 Lite, самая дешевая модель линейки, 65 ₽ за миллион токенов. Подходит для FAQ-ботов, коротких ответов и массовой обработки простых запросов, где важна скорость, а не глубина.
Если бот отвечает на типовые вопросы клиентов или разбирает заявки по шаблону, переплачивать за Pro или Max смысла нет. Lite отвечает быстро и стоит в 10 раз дешевле Max, для бизнеса это не абстракция, а конкретная строка в счете за месяц.
У физлиц на Lite действует freemium: 250 млн бесплатных токенов в год. Для теста идеи или маленького MVP-бота этого лимита обычно хватает на несколько месяцев без единого рубля затрат. Платный пакет для физлиц, 20 млн токенов за 1 300 ₽, для юрлиц pay-as-you-go считается уже по 65 ₽ за 1000 токенов в синхронном режиме.
Есть нюанс: на сложных инструкциях с несколькими условиями Lite начинает путаться. Если промпт длиннее пары абзацев и в нем есть развилки «если, то», лучше сразу брать Pro.

Когда переходить на GigaChat Pro?
GigaChat 2 Pro стоит 500 ₽ за миллион токенов, почти в 8 раз дороже Lite, но заметно лучше держит сложные инструкции. Подходит для копирайтинга, рерайта и работы с тоном текста.
Pro решает задачи, где важен не факт ответа, а его качество: адаптация текста под разные аудитории, посты для соцсетей, письма клиентам, рерайт больших кусков контента. По разбору бизнес-кейсов GigaChat умеет адаптировать один и тот же текст под зумеров и под миллениалов буквально по запросу, сохраняя смысл.
На физлиц-freemium приходится 40 млн бесплатных токенов Pro в год, заметно меньше, чем у Lite, и это логично: токены Pro считаются как более дорогой ресурс. Платный пакет для физлиц, 3 млн токенов за 1 500 ₽.
Маркетолог, который тратит на Pro час активной работы в день (около 40 диалогов), укладывается в 240-400 ₽ в месяц. Разница с Lite в деньгах ощутима, но на задачах с творческой составляющей она того стоит.

Для чего нужен GigaChat Max?
GigaChat 2 Max, самая мощная модель предыдущего поколения, 650 ₽ за миллион токенов, контекст 128 000 токенов. Работает с документами до 200 страниц за раз и справляется с многоэтапной аналитикой.
Max тянет задачи, где нужно держать в голове весь документ целиком: анализ финансовых отчетов, разбор договоров на противоречия, извлечение реквизитов из счетов. По обзорам бизнес-сценариев модель заметно прибавила именно в работе с юридическими текстами и финансовой отчетностью после последнего обновления.
Из полезного: встроенная транскрибация аудио прямо в чате. Записал голосовое от руководителя, скинул в GigaChat и получил текст без сторонних сервисов. То же самое работает с записями совещаний и лекциями. А пересказ видео тянется не только с YouTube, но и с RuTube и VK Видео с таймкодами. Этого пока нет у большинства зарубежных аналогов.

Бесплатный лимит для физлиц на Max, 25 млн токенов в год, самый скромный среди трех моделей поколения 2. Логично: если задача дошла до Max, скорее всего, она уже не для эксперимента, а для продакшна.
GigaChat 3.5 Ultra и GigaChat 3 Ultra это одна и та же модель?
Да, но с оговоркой. В API Сбера модель числится под id GigaChat-3-Ultra, а в маркетинге и на Hugging Face она же называется GigaChat 3.5 Ultra. Путаница в названии реальная, архитектура одна.
6 июля 2026 года Сбер выложил веса флагманской модели в открытый доступ под лицензией MIT, 432 млрд параметров всего, 28 млрд активных, архитектура смеси экспертов. Три четверти слоев используют линейное внимание GatedDeltaNet, а каждый четвертый, классическое MLA. Итог: KV-кэш на токен уменьшился примерно вчетверо, а в ту же видеопамять помещается в 2,14 раза больше контекста.
На практике это означает более дешевую обработку длинных документов и переписок в агентных сценариях. Позиционируется модель как «flagship instant model», быстрый ответ без долгих раздумий, в отличие от Reasoning-версии ниже.

Через бесплатного ассистента (giga.chat, приложения, боты в Telegram и VK) модель доступна каждому. А вот платного тарифа через API Сбера у нее пока нет: физлица могут дергать GigaChat-3-Ultra только в рамках freemium, 50 млн токенов в год. Юрлицам такой доступ пока недоступен вообще. Развернуть модель на своем железе тоже можно, но fp8-версии нужно около 432 ГБ видеопамяти. Это кластер уровня 8×H100, а не домашний сервер.
Что умеет GigaChat 3.5 Reasoning?
GigaChat 3.5 Reasoning вышел 10 сентября 2026 года, первая открытая российская модель с режимом рассуждений. Перед ответом она разбивает задачу на шаги, обращается к инструментам и проверяет собственные промежуточные выводы.
По разбору архитектуры и бенчмарков модели, модель построена на той же базе, что 3.5 Ultra: 432 млрд параметров, 28 активных, контекст около 262 тысяч токенов. Разница в дообучении, Reasoning специально учили держать длинную цепочку рассуждений вместо мгновенного ответа. По задачам это заметно: на AIME 2026 модель набрала 92 балла против 67 у обычной 3.5 Ultra Instruct, а на IFBench, 77 против 43,66.
Сравнение с DeepSeek V4 Flash Preview Reasoning неоднозначное. GigaChat немного впереди на AIME 2026 и заметно сильнее в IFBench, StructEval и русскоязычных аренах, Arena Hard Ru у него 60,7 против 36,8 у DeepSeek. А вот в SWE-bench Verified и Terminal-Bench 2 разрыв в пользу DeepSeek: 64,7 против 78,6 и 30,3 против 56,6 соответственно. Код и работа с терминалом пока не самая сильная сторона Reasoning-модели.

Доступ пока такой же, как у 3.5 Ultra: веса на Hugging Face под MIT, режим «Рассуждение» в веб-версии giga.chat, доступ для бизнеса через API Сбер обещает открыть в ближайшее время.
GigaChat или YandexGPT что выбрать в 2026 году?
Для генерации текста и картинок модели идут почти вровень, у каждой свои сильные места. По независимым сравнениям больше 70% российских компаний в 2025 году вообще не использовали ИИ-инструменты в работе. Выбор часто решается не качеством, а привычкой команды.
По разборам блогеров, тестировавших обе модели на реальных бизнес-задачах: GigaChat лучше пишет текст на изображениях и генерирует подкасты прямо в интерфейсе, а YandexGPT выигрывает по настройкам API, там есть выбор температуры и системный промпт из коробки. На логических и математических задачах разница между ними в 2026 году почти стерлась, но обе пока отстают от мировых лидеров в коде.
Если данные обязаны остаться в российском контуре, берете любую из двух и сравниваете на своих задачах, а не на чужих бенчмарках. Для маркетолога, который ведет соцсети и пишет коммерческие предложения, разница чаще всего не критична. Важнее то, какой инструмент команда реально будет открывать каждый день.

Максим: «Веб-версию GoBanana собрали за три часа после выхода новой модели. Суммарно ушло 6-8 часов на продукт, который принес 12 миллионов рублей без единого рубля в рекламу. Сработало, потому что не тянули с выбором инструмента, взяли то, что было под рукой, и сразу протестировали на реальной задаче.»
Сколько стоит GigaChat API в 2026 году?
Цены на API GigaChat действуют с 1 февраля и обновлены 7 сентября 2026 года. Lite стоит 65 ₽, Pro стоит 500 ₽, а Max стоит 650 ₽ за миллион токенов в синхронном режиме. Асинхронный режим дешевле в два раза.

| Модель | Цена, синхронный режим | Цена, асинхронный режим | Freemium для физлиц (в год) |
|---|---|---|---|
| GigaChat 2 Lite | 65 ₽ / 1М токенов | 32,5 ₽ / 1М токенов | 250 млн токенов |
| GigaChat 2 Pro | 500 ₽ / 1М токенов | 250 ₽ / 1М токенов | 40 млн токенов |
| GigaChat 2 Max | 650 ₽ / 1М токенов | 325 ₽ / 1М токенов | 25 млн токенов |
| GigaChat 3 Ultra (она же 3.5 Ultra) | платного тарифа пока нет | нет | 50 млн токенов |
| GigaChat 3.5 Reasoning | в API Сбера пока нет | нет | доступ через giga.chat бесплатно |
Итого freemium для физлиц дает 365 млн бесплатных токенов в год суммарно по всем моделям поколения 2 плюс 50 млн у Ultra. Для юрлиц минимальный чек по pay-as-you-go составляет 600 ₽ в месяц, даже если реально потрачено меньше.
Асинхронный режим стоит помнить отдельно: он дешевле в два раза, но ответ приходит не мгновенно. Для фоновых задач вроде массовой обработки заявок или ночной аналитики это почти всегда правильный выбор, который экономит бюджет без потери качества.
Какую модель GigaChat выбрать под свою задачу?
Простое правило: чем выше цена шага вверх по линейке, тем реже вы должны его делать. Начинайте с Lite и поднимайтесь только тогда, когда модель реально не справляется, а не «на всякий случай».

| Задача | Модель | Почему |
|---|---|---|
| FAQ-бот, короткие ответы клиентам | GigaChat 2 Lite | Дешевле всего, скорости хватает |
| Посты, письма, рерайт под аудиторию | GigaChat 2 Pro | Держит тон и сложные инструкции |
| Анализ договоров, финотчетов, документы до 200 страниц | GigaChat 2 Max | Большой контекст, сильнее на аналитике |
| Код, математика, длинные агентные сценарии | GigaChat 3.5 Ultra | Открытые веса, дешевле держит длинный контекст |
| Проверка договора на противоречия, сложные расчеты с проверкой шагов | GigaChat 3.5 Reasoning | Планирует и перепроверяет себя перед ответом |
Для команд, которые уже строят продукты на нейросетях и хотят сравнить GigaChat с мировыми моделями на реальных задачах, полезно свериться с каталогом ИИ-инструментов. Там собраны актуальные обзоры IDE и AI-сервисов, которые можно связать с GigaChat через API в одном пайплайне.
Часто задаваемые вопросы о моделях GigaChat
GigaChat бесплатный или платный?
Бесплатный ассистент в Telegram, VK и на giga.chat не ограничен по числу запросов. Через API у физлиц есть 365 млн бесплатных токенов в год суммарно по моделям поколения 2, плюс отдельный лимит 50 млн у Ultra.
Чем GigaChat 3.5 Ultra отличается от GigaChat 3.5 Reasoning?
Обе модели построены на одной архитектуре 432B/28B, но обучены под разные задачи. Ultra отвечает быстро, без долгих раздумий. Reasoning перед ответом строит план, проверяет шаги и лучше справляется с многоэтапными задачами, но медленнее и требует больше токенов на рассуждение.
Можно ли использовать GigaChat 3.5 Ultra через API Сбера прямо сейчас?
Только в рамках freemium для физлиц под id GigaChat-3-Ultra, 50 млн токенов в год. Платных тарифов для этой модели пока нет ни у физлиц, ни у юрлиц.
Какая модель GigaChat лучше всего пишет код?
Среди моделей линейки сильнее всего в коде должны быть 3.5 Ultra и 3.5 Reasoning: обе построены на MoE-архитектуре 432B. Но на SWE-bench Verified они пока заметно уступают DeepSeek V4 Flash Preview Reasoning, так что для тяжелых задач в коде разумно сравнивать несколько моделей на своих реальных репозиториях.
Нужен ли сертификат Минцифры для работы с GigaChat API?
Да, для бесплатного лимита в рамках freemium требуется сертификат НУЦ Минцифры. Без него доступны только платные пакеты.
Стоит ли переходить на GigaChat 2 Max, если хватает Pro?
Не всегда. Max стоит на 30% дороже Pro и оправдан, когда нужно держать в контексте весь документ целиком: договор, отчет, техническую документацию. Если задача укладывается в пару абзацев, переплата не окупается.
Как быстро проверить GigaChat на своей задаче без интеграции API?
Бесплатно в веб-версии giga.chat, в Telegram-боте или в мессенджере Max. Регистрация через SberID занимает пару минут, деньги не нужны.
Глоссарий
Токен: минимальная единица текста, которую обрабатывает нейросеть: часть слова, слово или знак препинания. От токенов зависит и стоимость запроса, и объем контекста.
Контекст (контекстное окно): сколько токенов модель одновременно держит «в памяти» во время диалога. Чем больше окно, тем длиннее документ можно скормить целиком.
MoE (Mixture of Experts): архитектура, где вместо одной большой сети работает набор «экспертов», а для каждого запроса активируется только часть из них. Экономит вычисления при том же качестве.
Freemium: режим, при котором часть токенов или запросов доступна бесплатно, а сверх лимита включается платная тарификация.
Reasoning-модель: нейросеть, которая перед финальным ответом проговаривает промежуточные шаги рассуждения, а не выдает результат сразу.
Открытые веса (open-weights): параметры модели, выложенные в открытый доступ для скачивания и запуска на своем оборудовании, в отличие от моделей, доступных только через закрытый API.
Стоит ли использовать GigaChat в 2026 году?
GigaChat закрывает большинство бизнес-задач внутри российского контура: от чат-бота на Lite до анализа договоров на Max и агентных сценариев на 3.5 Ultra. Главное правило простое: не переплачивать за модель мощнее, чем требует задача, и держать в уме, что топовые версии линейки пока живут отдельно от платного API.
Если планируете связать GigaChat с другими AI-инструментами в одном продукте, загляните в каталог ИИ-инструментов и IDE на VibeCoderz: там собраны актуальные обзоры и примеры, как собирать пайплайны без программистов. Маркетологам, которые строят такие связки под свои задачи, может пригодиться отдельный AI-агент для маркетолога. А если нужна стратегия под конкретный бизнес-кейс, разбор задачи можно обсудить на консультации с Максимом.
Обновлено: сентябрь 2026