GigaChat выпускается в трёх весах, Lite, Pro и Max, и вопрос для бизнеса ровно один: когда доплата за старшую модель окупается, а когда хватает младших. Разбираем место Max в линейке, цены по тарифам вендора и практические критерии выбора.
Место в линейке
GigaChat выпускается в трёх весах — Lite, Pro и Max, и по прайсам на сентябрь 2026 синхронный тариф различается почти десятикратно: 65 ₽ за 1 млн токенов у Lite против 650 ₽ у Max.
| Модель | Синхронно, ₽ за 1 млн токенов | Асинхронно, ₽ за 1 млн токенов |
|---|---|---|
| GigaChat Lite | 65 | 32,5 |
| GigaChat Pro | 500 | 250 |
| GigaChat Max | 650 | 325 |
Асинхронный (пакетный) режим вдвое дешевле синхронного для каждой модели — подходит для задач без требования мгновенного ответа: массовая обработка документов ночью, генерация карточек товаров пачкой, пакетная разметка обращений.
Разница в цене между Lite и Max объясняется размером модели: у Max больше параметров и глубже проработка контекста, поэтому вывод медленнее и дороже за токен, а качество на сложных задачах выше. Embeddings-модель в эту линейку входит отдельно — 14 ₽ за 1 млн токенов, и она нужна для построения поиска по смыслу (RAG-системы, база знаний), генерация текста здесь ни при чём.
Разница между синхронным и асинхронным режимом касается ещё и скорости ответа помимо цены: асинхронный подходит для задач, что ждут результата минутами или часами, вместо мгновенного ответа на экране.
Когда нужен Max
Max оправдан там, где цена ошибки высокая, а текст длинный и со сложной структурой: юридическое заключение по договору на полсотни страниц, сводный отчёт из нескольких источников, инструкция с множеством условных переходов. На таких задачах разница в качестве между Pro и Max заметнее, чем на коротком письме.
- Длинные документы со сложной внутренней логикой — договоры, регламенты, технические задания.
- Задачи, где точность русской деловой формулировки выходит на первый план, важнее общего смысла абзаца.
- Инструкции и регламенты, где ошибка в формулировке обходится дорого на практике.
На практике граница между «достаточно Pro» и «нужен Max» проходит скорее по количеству условий внутри задачи, чем по объёму текста самому по себе: чем больше исключений, перекрёстных ссылок и вложенной логики в документе, тем заметнее модель путается на менее мощной версии. Условный пример: договор поставки на пять страниц с одним приложением обычно по силам Pro, а тот же договор с десятком приложений, перекрёстными ссылками между пунктами и условиями, что меняются в зависимости от суммы сделки, — задача уже для Max.
Массовые типовые задачи
Короткие письма, типовые ответы клиентам по шаблону, обработка карточек товаров, генерация SEO-описаний массово — здесь Lite или Pro справляются с задачей и стоят кратно дешевле Max. Переплата за старшую модель на потоковых типовых задачах чаще уходит в минус, объём её редко окупает.
Условный пример: у компании полсотни обращений в день на карточки товаров под маркетплейс — на этом потоке Lite отрабатывает предсказуемо и по цене, и по скорости, а разница с Max на глазах читателя карточки едва заметна. Смешанная стратегия работает чаще, чем выбор одной модели на всю компанию: Lite держит поток типовых обращений, а Max подключается точечно — на договоры, заключения и документы, где цена ошибки выше разницы в цене за токен.
Прямое сравнение GigaChat Pro и YandexGPT Pro по качеству без независимого бенчмарка — спекуляция, и точной цифры здесь нет ни у одного вендора публично. Практичнее прогнать оба на паре реальных задач компании и сравнить результат глазами, чем ждать чужого рейтинга.
Какая задача в компании стабильно тянет время команды каждую неделю?
Как подключить
Доступ к GigaChat API получают через личный кабинет разработчика — процесс от начала до первого запроса разобран в статье как подключить GigaChat по API. С 1 сентября 2026 новые клиенты оформляют доступ через cloud.ru — это меняет разве что точку входа, тарифы на токены остаются те же.
Оплата идёт по факту использования, без предоплаты пакетом. Минимальная плата по счёту-оферте — 600 ₽ в месяц в те месяцы, когда сервис использовался; без обращений к модели счёт остаётся пустым.
Ключ и сервисный аккаунт настраиваются один раз, а дальше расход токенов отслеживается в отчёте кабинета помесячно — удобная точка сверки с бюджетом, прежде чем подключать модель к потоку задач. Смена модели в уже работающей интеграции обычно ограничивается одним параметром запроса, вызов остаётся тем же: это упрощает тестирование, Pro и Max можно сравнить на одних и тех же запросах без переделки интеграции.
- Оформить доступ разработчика в личном кабинете (для новых клиентов — через cloud.ru).
- Выбрать модель под задачу — Lite для потока, Max для сложных документов.
- Подключить оплату по счёту-оферте или договору, отслеживать расход токенов по отчёту кабинета.
Безопасность данных
Данные, что уходят в GigaChat API, хранятся и обрабатываются по правилам вендора — разбор, что происходит с корпоративной информацией на каждом шаге, собран в статье безопасен ли GigaChat для корпоративных данных.
Отдельный вопрос — разница между Pro и базовой моделью помимо цены: подробный разбор в статье GigaChat Pro: чем отличается от обычного. Max в этой логике — следующая ступень: те же принципы работы, выше потолок по сложности задач и по цене.
Для отраслей с повышенными требованиями к хранению данных (финансы, медицина, госсектор) выбор между Pro и Max смотрят вместе с условиями размещения данных — оба вопроса решаются на одном этапе проекта. Отдельно фиксируют, кто в компании отвечает за модель, что подключена к рабочему процессу, — интеграция без владельца и без регулярной проверки быстро превращается в фоновый процесс.
Тест начинают с одной задачи на границе сложности — документа, где Pro иногда справляется, а иногда путается. Прогнать его через Pro и Max параллельно, сравнить результат и посчитать разницу в цене на объёме месяца целиком, одного запроса для вывода мало.
Выбор модели — часть общего решения о внедрении, и на проекте внедрения ИИ мы разбираем конкретные задачи компании, прежде чем советовать модель.