● Концепция / Уровень: базовый / Q2 · 2026 / 102 из 102

Токенизация.

разбивка текста на куски, по которым модель считает объём и цену
Короткий
ответ
↳
Токенизация — это разбивка текста на маленькие куски, токены (часть слова, целое короткое слово или знак препинания), по которым модель считает объём запроса и формирует его цену. Русский текст из-за особенностей письма обычно распадается на больше токенов, чем тот же смысл на английском.

01 Простыми словами

Человек читает текст словами и буквами. Модель работает с другими единицами — токенами. Фраза «привет, как дела» распадается для модели на несколько токенов вместо привычных двух слов и запятой.

В одной фразе — токенизация превращает обычный текст в последовательность токенов, по которой модель считает и объём запроса, и его цену.

02 Как это работает

Большинство современных моделей режут текст алгоритмом byte-pair encoding: часто встречающиеся сочетания букв объединяются в один токен, редкие слова распадаются на несколько кусков.

  1. Модель заранее обучена на словаре из десятков тысяч токенов — устойчивых кусков текста разной длины.
  2. Входящий текст сверяют с этим словарём и режут на самые длинные подходящие куски, начиная с частых слов и заканчивая отдельными буквами для редких сочетаний.
  3. Получившуюся последовательность номеров токенов модель обрабатывает и по ней же формирует ответ, который потом токенизатор собирает обратно в читаемый текст.
Русский текст из-за особенностей алфавита и словообразования обычно распадается на больше токенов, чем тот же смысл на английском — это стоит учитывать при расчёте бюджета на запросы к иностранным моделям.

03 Где применяется

  • Поддержка клиентов. Число токенов в переписке напрямую влияет на цену за токен в счёте бота-оператора за месяц.
  • Разработка. Токенизация ограничивает, сколько кода поместится в один запрос к модели для разбора или комментирования.
  • Юристы. Длинный договор иногда превышает лимит контекста в токенах и требует разбивки на части перед отправкой модели.
  • Бухгалтерия. Отчёты с таблицами и цифрами обычно токенизируются гуще обычного текста — это стоит закладывать в оценку бюджета на запросы.
  • Маркетинг. Черновики рекламных текстов проверяют через модель пачками — экономия на токенах напрямую снижает счёт за месяц.
  • Логистика. Длинные накладные и инструкции по маршрутам режут на части, чтобы уложиться в лимит контекста конкретной модели.

04 Отчёт бухгалтера по шагам

Бухгалтер просит модель разобрать квартальный отчёт: «Проверь таблицу расходов на странице 12 и посчитай итоговую сумму по статье «аренда»». В таблице десятки строк с числами, датами и короткими комментариями. Вот что происходит с этим текстом внутри модели.

  1. Токенизатор режет текст на куски отдельно для слов и отдельно для чисел: цифры в таблице обычно распадаются на токены гуще обычных слов — каждая отдельная цифра или короткая группа цифр часто становится своим токеном.
  2. Вся таблица целиком, вместе с системным промптом и вопросом бухгалтера, укладывается в лимит контекстного окна модели, который считают именно в токенах.
  3. Счёт за запрос формирует именно число токенов на входе и на выходе — большая таблица с цифрами обходится заметно дороже такого же по смыслу текстового абзаца.

Похожий отчёт за другой квартал с тем же числом строк, но другими цифрами, займёт похожее число токенов — специфика чисел в тексте держит расход стабильно выше обычной прозы того же объёма.

Для бухгалтера подсчёт токенов остаётся скрытой механикой модели — на экране только итоговая сумма и счётчик расхода за месяц в панели вендора.

05 Ограничения и ошибки

  • Число токенов в тексте отличается от числа слов или символов — прямой перевод одного в другое работает лишь приблизительно.
  • Цифры, редкие термины и текст на нескольких языках сразу обычно превращаются в больше токенов, чем обычные слова, — это стоит учитывать при оценке стоимости запроса.
  • Лимит контекстного окна считают именно в токенах вместо символов — длинный текст с короткими словами иногда занимает меньше места, чем короткий текст с редкой лексикой.
  • Экономия на длине промпта — самый быстрый способ снизить счёт за месяц: лишние повторы инструкции в каждом запросе складываются в заметную сумму на больших объёмах.
  • Разные вендоры используют разные словари токенов — прямое сравнение цены «за токен» между сервисами без пересчёта на одинаковый текст может ввести в заблуждение.
Правило — точный бюджет на запросы даёт подсчёт реальных токенов на паре десятков примеров из практики отдела; оценка на глаз по числу слов почти всегда расходится с фактическим счётом.

Как считают цену запроса к модели по токенам — в статье про получение API-ключа DeepSeek и его цену. Как оценить итоговый бюджет на внедрение — в разделе про внедрение ИИ в бизнес.

// 06 · от практики

Как мы применяем Токенизация в работе с клиентами

В практике «Зинин × Штурбин» мы разбираем Токенизация на практике вашего бизнеса — это часть формата личное обучение фаундера. На реальных задачах это слово «привет» — один-два токена, цена API считается за токены и подобное. Рядом разбираем Токены — термины в словаре связаны так же, как в работе.

Не консультируем абстрактно: команда уходит с навыком и рабочим процессом, который применяет сама. Посмотреть программы и цены →

// 08

Частые вопросы

01 Что такое токен простыми словами?

Токен — кусок текста: часть слова, целое короткое слово или знак препинания. Модель считает объём и цену запроса именно в токенах вместо букв или слов.

02 Чем токен отличается от слова?

Короткое слово обычно укладывается в один токен, длинное или редкое — распадается на несколько. Соотношение зависит от языка и конкретной модели.

03 Нужно ли считать токены малому бизнесу?

Стоит хотя бы прикинуть при выборе тарифа модели для бота — расход токенов на переписку напрямую формирует ежемесячный счёт у вендора.

04 Сколько стоит запрос в токенах?

Тариф у каждого вендора свой: например, у GigaChat — Lite 65 ₽, Pro 500 ₽, Max 650 ₽ за миллион токенов, у YandexGPT Lite — 200 ₽ за миллион (данные на сентябрь 2026). Итоговая сумма зависит от объёма переписки.

05 Как проверить реальный расход токенов?

Панель большинства вендоров показывает точное число токенов по каждому запросу и итог за период — сверяйте эти цифры вместо приблизительной оценки по числу слов в переписке.

06 Можно ли снизить расход токенов без потери качества ответа?

Да, если сократить длину системного промпта и историю переписки в каждом запросе до необходимого минимума — это часто снижает счёт заметнее, чем смена модели на более дешёвую.

Понимаем — учим
работать с Токенизация
внутри команды.

Час бесплатной диагностики: разбираем 2–3 ваших процесса и говорим прямо, где AI окупится за квартал, а где брать рано. Знания остаются у вашей команды.

Готовы поговорить?
@Aleksei_Shturbin Бот →