GigaChat 3.5, GigaChat 2, GigaChat 3, GigaChat 4 — под этими цифрами в поиске ищут разные версии одной линейки, а по факту компания покупает один из трёх уровней: Lite, Pro или Max. Номера версий в открытых источниках расходятся и меняются быстрее справочника — ориентир держите на текущих названиях моделей в документации Сбера и cloud.ru, а цифра из заголовка поисковой выдачи остаётся лишь ярлыком. Дальше — как линейка Lite, Pro, Max соотносится с этими номерами, сколько стоит токен по прайсу на сентябрь 2026 и как выбрать уровень под задачу без риска сломать интеграцию при обновлении.
Номера и уровни
Коротко: GigaChat 2, 3, 3.5, 4 — это то, что ищут в поиске, а линейка, которую реально покупает компания, — GigaChat Lite, Pro и Max с ценой за токен по прайсу вендора.
Запросы вроде «gigachat 3.5» или «gigachat 4» отражают путаницу вокруг версий модели: даты релизов, названия и внутренняя нумерация меняются у вендора чаще, чем успевают разойтись по обзорам в интернете. Для бизнеса цифра поколения второстепенна: контракт и API работают с тремя уровнями линейки — Lite, Pro, Max — независимо от номера поколения внутри.
- GigaChat Lite — короткие типовые ответы: классификация обращений, короткие тексты, первичная сортировка
- GigaChat Pro — задачи со сложной инструкцией: развёрнутые тексты, работа с документами среднего объёма
- GigaChat Max — многошаговые задачи и рассуждение над объёмным контекстом, где цена ошибки выше
- Embeddings — отдельная модель для поиска и сравнения смысла текстов, без генерации ответа
На практике команда редко выбирает уровень один раз и навсегда. Типовой путь — старт с Lite на массовых задачах вроде классификации входящих сообщений, тест Pro на участке с более сложной инструкцией и перевод на Max только тех сценариев, где ошибка обходится дорого: юридический текст, финансовый расчёт, многошаговый анализ документа.
Что ищут под версией
Запрос «gigachat reasoning» тоже встречается регулярно — режим рассуждений вендоры анонсируют по-разному и в разное время, а держится ли он у конкретной версии, которую вы подключаете, проверяйте прямо в документации на момент запуска проекта — статья в интернете месячной давности здесь плохой источник. Полный разбор линейки и тарифов — в статье GigaChat для бизнеса — линейка, тарифы и путь внедрения, а вопрос данных и безопасности — в статье безопасен ли GigaChat для корпоративных данных.
Держитесь простого правила: цифра в заголовке статьи или в рекламе — ориентир для поиска, а точное название модели для вызова API берите из документации вендора на день интеграции. Так меньше риска, что описание из обзора разойдётся с тем, что реально скрывается за вызовом.
Ещё один частый запрос — «gigachat модели» целиком, без конкретного номера: так формулируют вопрос, когда сравнивают линейку впервые и хотят понять расклад сразу, целиком, вместо разбора версий по одной. Ответ короче, чем кажется: смотрите на уровень под задачу и цену за токен, а маркетинговый номер поколения держите на втором плане при выборе.
Уровень под задачу
| Задача | Уровень | Почему |
|---|---|---|
| Сортировка обращений по теме | Lite | Короткий и частый запрос, цена важнее глубины |
| Договор или письмо с инструкцией | Pro | Выдерживает развёрнутую инструкцию и объём текста |
| Многошаговый анализ документа | Max | Держит контекст и рассуждение на сложной задаче |
| Поиск похожих обращений в базе | Embeddings | Сравнение смысла текста вместо генерации ответа |
Ошибка на старте обычно одна — сразу берут Max там, где справится Lite, и платят за токен кратно больше без прироста качества ответа. Обратная ошибка встречается реже, но обходится дороже: экономят на уровне для задачи, где нужна глубина рассуждения, и получают поток ответов, которые правит человек на каждом втором обращении.
Какой уровень GigaChat подошёл бы вашей задаче?
Цена за токен
Цены на сентябрь 2026 за миллион токенов, синхронный режим: Lite 65 ₽, Pro 500 ₽, Max 650 ₽, Embeddings 14 ₽. Асинхронный режим вдвое дешевле: Lite 32,5 ₽, Pro 250 ₽, Max 325 ₽. Минимальная плата за токены — 600 ₽ в месяц, и списывается только в месяцы, где были запросы.
Разница между Lite и Max в цене за токен ощутима на объёме: на десятках тысяч запросов в месяц выбор уровня влияет на счёт сильнее, чем выбор модели у другого вендора. Асинхронный режим держите в уме отдельно — вдвое дешевле синхронного, но годится только там, где клиент ждёт ответ без привязки к моменту запроса.
- Возьмите 20–30 реальных обращений своей задачи — синтетические примеры из документации здесь слабый ориентир
- Прогоните один и тот же набор через Lite и Pro — сравните долю ответов без правки
- Считайте стоимость по своему объёму токенов на задачу вместо усреднённой оценки из обзора
- Фиксируйте версию модели в вызове API — так вы сами выбираете момент перехода на новую версию, а сюрпризы от тихого обновления вендора остаются в стороне
Обновление без сбоев
Обновляться без риска ломки интеграций — вопрос дисциплины вызова API, а выбор конкретной цифры версии здесь второстепенен. Подключение и параметры вызова разобраны в статье как подключить GigaChat по API, а границы между Pro и Max — в материале когда GigaChat Max нужен бизнесу, а когда хватит Pro.
- Закрепляйте версию модели явно в конфигурации — расчёт на «последнюю» по умолчанию здесь плохая стратегия
- Тестируйте новую версию на копии продакшен-сценариев перед переключением боевого трафика
- Держите план отката на предыдущую версию, если ответы модели заметно изменились
План отката спасает чаще, чем кажется на старте: вендор меняет модель под тем же названием уровня, стиль ответа сдвигается, и команда замечает это уже в потоке обращений клиентов, дальше по цепочке от этапа тестов. Отдельный конфиг с зафиксированной версией и запасной вариант возврата закрывают этот риск дёшево. Плановая проверка раз в месяц — прогнать десяток контрольных запросов и сравнить ответы с эталоном — обходится дешевле, чем разбор жалоб клиентов постфактум. Держите контрольный набор кейсов отдельным файлом, обновляйте его вместе с задачами бизнеса, и сверка перестанет отнимать время на подготовку каждый раз заново.
Выбор версии и уровня GigaChat — часть более широкой задачи внедрения. Обсудить, какой контур подходит вашей компании, можно на странице внедрение ИИ для бизнеса.