LLMFinderнейросети для России

Почему русский текст в нейросетях стоит дороже английского

Нейросеть берёт деньги за токены, а русский текст режется на токены мельче английского. У токенизатора GPT-5 тот же смысл на русском занимает на 10–40 % больше токенов, у DeepSeek V4 — на 30–55 % больше. У GigaChat и YandexGPT разницы почти нет.

Два ряда блоков: короткий из четырёх широких и длинный из множества узких

Всеобщая декларация прав человека на русском у токенизатора GPT-5 занимает 2 810 токенов, на английском — 2 002. Смысл один, а платить за вход на 40 % больше. У GigaChat 3 та же пара текстов даёт 2 339 и 2 068 токенов, у YandexGPT 5 Lite — 2 268 и 2 135. Ниже — откуда разница, сколько символов помещается в токен у разных моделей и во сколько обходится 1 000 русских символов.

Почему русский режется мельче

Токенизатор делит текст на кусочки из словаря, а словарь собирают по обучающим текстам. Английского в них больше всего, поэтому частые английские слова целиком попадают в словарь, а русские слова чаще приходится собирать из нескольких кусочков.

Чем больше русских кусочков в словаре, тем дешевле русский текст. В словаре cl100k_base, на котором работал GPT-4, мы насчитали 726 токенов с кириллицей из 100 277. В o200k_base, который библиотека tiktoken указывает для GPT-4o и GPT-5, их 14 067 из 200 019. Поэтому GPT-5 тратит на русский текст почти вдвое меньше токенов, чем GPT-4.

Сколько символов помещается в токен: наш замер

Токенизатор Символов русского текста на токен Символов английского на токен Русский по сравнению с английским, по токенам
YandexGPT 5 Lite 5,2 4,9 от −16 до +6 %
GigaChat 3 5,0 5,1 от −11 до +13 %
Qwen 3.5 4,3 5,1 от +1 до +34 %
o200k_base (GPT-4o, GPT-5) 4,2 5,2 от +9 до +40 %
GLM-5 4,1 5,2 от +10 до +45 %
DeepSeek V4 3,8 5,3 от +32 до +55 %
cl100k_base (GPT-4, для сравнения) 2,3 5,2 от +89 до +157 %

Как мерили. Взяли два текста, у которых есть русская и английская версии. Первый — Всеобщая декларация прав человека в официальных переводах ООН (русский, английский), 11 763 и 10 588 символов. Второй мы написали сами: письмо службы поддержки и короткая инструкция по подключению API, около 1 600 символов на каждом языке. Символы считали с пробелами.

Токенизаторы взяли открытые: o200k_base и cl100k_base из tiktoken 0.14.0, остальные — файлы токенизаторов из открытых весов на Hugging Face: GigaChat3-10B-A1.8B, YandexGPT-5-Lite-8B-instruct, DeepSeek-V4-Pro, Qwen3.5-27B и GLM-5. Служебные токены не считали.

Разброс в последнем столбце — это разница между двумя текстами. Канцелярский текст декларации дал больший перерасход, обычная переписка — меньший. На ваших текстах цифры будут другими, но порядок общих моделей у нас совпал с независимым замером на четырёх парах текстов, который в октябре 2026 года опубликовал автор Хабра donseo.

Есть оговорка. Модели в API не всегда работают на том же токенизаторе, что и открытые веса. GigaChat 2 Max и YandexGPT Pro 5.1 мы посчитали по токенизаторам открытых GigaChat 3 и YandexGPT 5 Lite, потому что других открытых нет, а DeepSeek V4 Flash — по токенизатору DeepSeek-V4-Pro.

Claude: открытого токенизатора нет

Anthropic не публикует токенизатор Claude. В документации сказано, что модели начиная с Claude 4.7 используют новый токенизатор, и он даёт «approximately 30% more tokens for the same text» (цены Anthropic). Про русский язык отдельно ничего не сказано.

Единственный публичный замер для русского, который мы нашли, — та же статья на Хабре. По нему Claude Opus 5 укладывает в токен около 1 символа русского текста и 3,25 символа английского. Это втрое больше токенов на русском, чем на английском, и вчетверо больше, чем у GPT-5. Автор мерил через сервисы-посредники и сам предупреждает, что один из них возвращал пересчитанные, а не настоящие числа токенов. Новый токенизатор, по словам Anthropic, у всех моделей начиная с Claude 4.7, поэтому мы применили этот замер к Claude Sonnet 5.5. Цифры для Claude ниже — оценка, которую стоит проверить на своих запросах. Как это сделать, мы разбирали в статье о проверке подмены модели.

Сколько стоит 1 000 русских символов

Делим цену за 1 млн токенов на число символов в токене. Цены — по данным каталога на 2 октября 2026 года.

Модель Цена за 1 млн токенов, вход / выход Вход, ₽ за 1 000 символов Выход, ₽ за 1 000 символов
DeepSeek V4 Flash в Yandex AI Studio 300 / 500 ₽ с НДС 0,08 0,13
GPT-5.5 $5 / $30, это 416 / 2 497 ₽ 0,10 0,60
GigaChat 2 Max 650 / 650 ₽ с НДС 0,13 0,13
YandexGPT Pro 5.1 800 / 800 ₽ с НДС 0,15 0,15
Claude Sonnet 5.5, оценка $2 / $10, это 166 / 832 ₽ около 0,16 около 0,8

Цены GPT-5.5 и Claude Sonnet 5.5 — официальные цены разработчиков в долларах, пересчитанные по курсу ЦБ на 2 октября 2026 года (83,25 ₽ за доллар), без НДС. У российских провайдеров эти модели стоят иначе, все цены собраны на странице модели. Цены DeepSeek V4 Flash, GigaChat и YandexGPT — рублёвые цены Yandex AI Studio и GigaChat с НДС.

Что видно из таблицы:

  • Цена за токен обманывает. Входной токен Claude Sonnet 5.5 в 2,5 раза дешевле, чем у GPT-5.5, а на русском входе, если замер Хабра верен, дороже примерно в 1,6 раза.
  • Российские модели дешевле на выходе. За 1 млн входных токенов GigaChat 2 Max стоит дороже GPT-5.5, но ответ в 1 000 символов у GigaChat обходится в 0,13 ₽, а у GPT-5.5 — в 0,60 ₽.
  • На английском разница меньше. Для GPT-5.5 1 000 английских символов на входе стоят 0,08 ₽ против 0,10 ₽ за русские.

Качество ответов таблица не учитывает. Дешёвая на русском модель может хуже справляться с вашей задачей, поэтому сравнивайте на своих запросах. Подобрать модели под задачу и бюджет можно в подборе.

Как платить меньше за русский текст

Считайте по своим запросам, а не по прайсу. В ответе API есть число входных и выходных токенов. Отправьте десяток типичных запросов в две-три модели и разделите стоимость на число символов.

Кэшируйте постоянную часть. Инструкция, примеры и справочные документы, которые повторяются в каждом запросе, при кэшировании стоят дешевле. У Anthropic чтение из кэша стоит 10 % цены входа, у Claude Opus 5.5 — 5 %. В Yandex AI Studio кэшированный вход DeepSeek V4 Flash стоит 75 ₽ за 1 млн токенов вместо 300 ₽.

Следите за длиной ответов. Выходные токены у GPT-5.5 в 6 раз дороже входных, у Claude Sonnet 5.5 — в 5 раз. Просьба отвечать коротко и ограничение длины ответа часто экономят больше, чем сокращение промпта.

Для объёмного русского текста смотрите модели с хорошим русским токенизатором. GigaChat и YandexGPT тратят на русский текст меньше всего токенов, Qwen 3.5 — примерно столько же, сколько GPT-5. Для разметки, пересказа и перевода больших объёмов это заметно.

Перевод на английский: когда окупается

Перевести промпт на английский — очевидная идея, но выигрыш меньше, чем кажется.

  • У GigaChat и YandexGPT экономии нет. Русский у них занимает столько же токенов, сколько английский, а иногда меньше.
  • У GPT-5 экономия — до 30 % входных токенов на канцелярском тексте и около 8 % на обычной переписке, у DeepSeek V4 — от 25 до 35 %. Перевод тоже стоит денег и времени.
  • Ответ всё равно нужен на русском. Выход дороже входа, и если модель отвечает по-русски, основная часть счёта не меняется.
  • Перевод искажает смысл. Названия, юридические формулировки и профессиональные термины в обратном переводе могут поменяться.

Разумный компромисс — держать на английском длинную постоянную инструкцию и кэшировать её, а данные пользователя и ответ оставлять на русском. Перед тем как переводить, сравните качество ответов на своих примерах.

Цены и курс — по данным на 2 октября 2026 года. Актуальные цены всех провайдеров — в каталоге.

Частые вопросы

Сколько токенов в 1 000 русских символов?

По нашему замеру на 2 октября 2026 года: около 190–200 у токенизаторов YandexGPT 5 Lite и GigaChat 3, около 240 у токенизатора o200k_base, который tiktoken указывает для GPT-5, около 235 у Qwen 3.5, около 265 у DeepSeek V4. Символы считаются с пробелами.

Выгодно ли переводить промпт на английский?

Для GigaChat и YandexGPT нет: русский текст у них занимает столько же токенов, сколько английский, или меньше. Для GPT и DeepSeek перевод экономит от 8 до 35 % входных токенов, но перевод тоже стоит денег и может исказить термины, а ответ всё равно нужен на русском.

Как узнать, сколько токенов насчитал провайдер?

В ответе API есть поле usage с числом входных и выходных токенов. Отправьте один и тот же текст двум моделям и сравните input_tokens. Если число не меняется от модели к модели, провайдер мог пересчитать токены своим способом.

Читайте также