GigaChat 3.5, GigaChat 2, GigaChat 3, GigaChat 4 — под этими цифрами в поиске ищут разные версии одной линейки, а по факту компания покупает один из трёх уровней: Lite, Pro или Max. Номера версий в открытых источниках расходятся и меняются быстрее справочника — ориентир держите на текущих названиях моделей в документации Сбера и cloud.ru, а цифра из заголовка поисковой выдачи остаётся лишь ярлыком. Дальше — как линейка Lite, Pro, Max соотносится с этими номерами, сколько стоит токен по прайсу на сентябрь 2026 и как выбрать уровень под задачу без риска сломать интеграцию при обновлении.

Номера и уровни

TL;DR

Коротко: GigaChat 2, 3, 3.5, 4 — это то, что ищут в поиске, а линейка, которую реально покупает компания, — GigaChat Lite, Pro и Max с ценой за токен по прайсу вендора.

Запросы вроде «gigachat 3.5» или «gigachat 4» отражают путаницу вокруг версий модели: даты релизов, названия и внутренняя нумерация меняются у вендора чаще, чем успевают разойтись по обзорам в интернете. Для бизнеса цифра поколения второстепенна: контракт и API работают с тремя уровнями линейки — Lite, Pro, Max — независимо от номера поколения внутри.

  • GigaChat Lite — короткие типовые ответы: классификация обращений, короткие тексты, первичная сортировка
  • GigaChat Pro — задачи со сложной инструкцией: развёрнутые тексты, работа с документами среднего объёма
  • GigaChat Max — многошаговые задачи и рассуждение над объёмным контекстом, где цена ошибки выше
  • Embeddings — отдельная модель для поиска и сравнения смысла текстов, без генерации ответа

На практике команда редко выбирает уровень один раз и навсегда. Типовой путь — старт с Lite на массовых задачах вроде классификации входящих сообщений, тест Pro на участке с более сложной инструкцией и перевод на Max только тех сценариев, где ошибка обходится дорого: юридический текст, финансовый расчёт, многошаговый анализ документа.

Что ищут под версией

Запрос «gigachat reasoning» тоже встречается регулярно — режим рассуждений вендоры анонсируют по-разному и в разное время, а держится ли он у конкретной версии, которую вы подключаете, проверяйте прямо в документации на момент запуска проекта — статья в интернете месячной давности здесь плохой источник. Полный разбор линейки и тарифов — в статье GigaChat для бизнеса — линейка, тарифы и путь внедрения, а вопрос данных и безопасности — в статье безопасен ли GigaChat для корпоративных данных.

Держитесь простого правила: цифра в заголовке статьи или в рекламе — ориентир для поиска, а точное название модели для вызова API берите из документации вендора на день интеграции. Так меньше риска, что описание из обзора разойдётся с тем, что реально скрывается за вызовом.

Ещё один частый запрос — «gigachat модели» целиком, без конкретного номера: так формулируют вопрос, когда сравнивают линейку впервые и хотят понять расклад сразу, целиком, вместо разбора версий по одной. Ответ короче, чем кажется: смотрите на уровень под задачу и цену за токен, а маркетинговый номер поколения держите на втором плане при выборе.

Уровень под задачу

ЗадачаУровеньПочему
Сортировка обращений по темеLiteКороткий и частый запрос, цена важнее глубины
Договор или письмо с инструкциейProВыдерживает развёрнутую инструкцию и объём текста
Многошаговый анализ документаMaxДержит контекст и рассуждение на сложной задаче
Поиск похожих обращений в базеEmbeddingsСравнение смысла текста вместо генерации ответа

Ошибка на старте обычно одна — сразу берут Max там, где справится Lite, и платят за токен кратно больше без прироста качества ответа. Обратная ошибка встречается реже, но обходится дороже: экономят на уровне для задачи, где нужна глубина рассуждения, и получают поток ответов, которые правит человек на каждом втором обращении.

● Discovery · 1 час · бесплатно

Какой уровень GigaChat подошёл бы вашей задаче?

Прийти на Discovery →

Цена за токен

Цены на сентябрь 2026 за миллион токенов, синхронный режим: Lite 65 ₽, Pro 500 ₽, Max 650 ₽, Embeddings 14 ₽. Асинхронный режим вдвое дешевле: Lite 32,5 ₽, Pro 250 ₽, Max 325 ₽. Минимальная плата за токены — 600 ₽ в месяц, и списывается только в месяцы, где были запросы.

Разница между Lite и Max в цене за токен ощутима на объёме: на десятках тысяч запросов в месяц выбор уровня влияет на счёт сильнее, чем выбор модели у другого вендора. Асинхронный режим держите в уме отдельно — вдвое дешевле синхронного, но годится только там, где клиент ждёт ответ без привязки к моменту запроса.

  • Возьмите 20–30 реальных обращений своей задачи — синтетические примеры из документации здесь слабый ориентир
  • Прогоните один и тот же набор через Lite и Pro — сравните долю ответов без правки
  • Считайте стоимость по своему объёму токенов на задачу вместо усреднённой оценки из обзора
  • Фиксируйте версию модели в вызове API — так вы сами выбираете момент перехода на новую версию, а сюрпризы от тихого обновления вендора остаются в стороне

Обновление без сбоев

Обновляться без риска ломки интеграций — вопрос дисциплины вызова API, а выбор конкретной цифры версии здесь второстепенен. Подключение и параметры вызова разобраны в статье как подключить GigaChat по API, а границы между Pro и Max — в материале когда GigaChat Max нужен бизнесу, а когда хватит Pro.

  • Закрепляйте версию модели явно в конфигурации — расчёт на «последнюю» по умолчанию здесь плохая стратегия
  • Тестируйте новую версию на копии продакшен-сценариев перед переключением боевого трафика
  • Держите план отката на предыдущую версию, если ответы модели заметно изменились

План отката спасает чаще, чем кажется на старте: вендор меняет модель под тем же названием уровня, стиль ответа сдвигается, и команда замечает это уже в потоке обращений клиентов, дальше по цепочке от этапа тестов. Отдельный конфиг с зафиксированной версией и запасной вариант возврата закрывают этот риск дёшево. Плановая проверка раз в месяц — прогнать десяток контрольных запросов и сравнить ответы с эталоном — обходится дешевле, чем разбор жалоб клиентов постфактум. Держите контрольный набор кейсов отдельным файлом, обновляйте его вместе с задачами бизнеса, и сверка перестанет отнимать время на подготовку каждый раз заново.

Выбор версии и уровня GigaChat — часть более широкой задачи внедрения. Обсудить, какой контур подходит вашей компании, можно на странице внедрение ИИ для бизнеса.

Частые вопросы

Чем GigaChat 3.5 отличается от GigaChat 2 или 3?
Однозначного публичного сопоставления номеров нет — вендор меняет нумерацию и названия быстрее справочников. Для задачи компании важнее уровень: Lite, Pro или Max, цифра поколения вторична.
Что значит GigaChat reasoning?
Так ищут режим рассуждений модели — вендоры анонсируют его по-разному в разное время. Наличие и условия работы такого режима сверяйте прямо в документации на момент проекта.
GigaChat 4 уже доступен для бизнеса?
Актуальный список моделей вендор публикует в собственной документации на developers.sber.ru и cloud.ru — там же видно, какие уровни линейки открыты для подключения по API сейчас.
Какая цена у GigaChat Pro за миллион токенов?
По прайсам на сентябрь 2026 синхронный режим — 500 ₽ за миллион токенов, асинхронный — 250 ₽. Актуальные цифры проверяйте на странице тарифов вендора.
Как выбрать между GigaChat Lite и Pro для проекта?
Прогоните одинаковый набор реальных обращений через обе модели и сравните долю ответов без правки человека — разница в цене за токен оправдана только заметной разницей в качестве.
Что за модели скрываются под «gigachat модели» в поиске?
Обычно ищут сравнение линейки целиком — Lite, Pro, Max и Embeddings — и как выбрать нужную под задачу, без привязки к конкретному номеру версии.