
Что такое токены в нейросети простыми словами — и почему в Китае их раздают как кэшбэк
Токен — это кусочек текста, которым нейросеть меряет всё, что вы ей пишете и что она отвечает. В среднем один токен — три-четыре символа, то есть чуть меньше слова; именно в токенах модели считают работу и именно за них берут деньги. А осенью 2026-го в Китае токены начали раздавать как кэшбэк по карте и как бонус к обеду — отличный повод разобраться, что это за единица и почему у нас за то же самое просят рубли.
Что такое токены в нейросети простыми словами
Модель не читает текст ни буквами, ни словами. Перед тем как попасть в нейросеть, текст режут на кусочки — токены. Частое короткое слово становится одним токеном целиком, редкое или длинное разваливается на два-три обрубка, пробелы и запятые тоже занимают место.
Причина бухгалтерская. У модели есть словарь фиксированного размера — обычно сто-двести тысяч позиций. Все слова всех языков туда не влезут, а кусочки влезают: из набора обрубков собирается любое слово, включая опечатку и незнакомый термин. Это компромисс между «читать по буквам» — слишком долго — и «читать словами» — слишком большой словарь.
Рабочая мерка: один токен — три-четыре символа, примерно три четверти английского слова. Когда говорят «контекст на 200 тысяч токенов», переводите в голове как «примерно полромана».
Почему русский текст стоит больше токенов, чем английский
Это не дискриминация, а следствие того, на чём собирали словарь: его строят по большому корпусу текстов, а английского там всегда было больше всего. Английские слова получили цельные экономные токены, русские дробятся на части.
По оценкам сервисов подсчёта, английское слово занимает около 1,3 токена, русское — около двух в современных словарях; в старых было три-пять. То есть один и тот же смысл по-русски обходится примерно в полтора-два раза дороже, хотя разрыв от поколения к поколению сокращается.
В пересчёте на символы: в английском тексте около четырёх знаков на токен, в русском — два-два с половиной. Вывод простой: если гоняете через платный API длинные русские тексты, счёт будет больше, чем подсказывает англоязычный калькулятор.
Сколько токенов в странице текста, книге и переписке за день
Числа ниже — оценки для русского текста: результат зависит от модели и от насыщенности текста цифрами и именами.
СКОЛЬКО ТОКЕНОВ — СКОЛЬКО ЭТО ТЕКСТА — НА ЧТО ХВАТИТ
1 000 — страница с хвостиком — один вопрос с развёрнутым ответом
10 000 — небольшая глава — вечер переписки по одной теме
100 000 — треть романа — разобрать большой документ целиком, а не кусками
1 000 000 — четыре-пять романов — месяц ежедневных вопросов обычного человека
10 000 000 — около сорока романов — год активной личной переписки с моделью
1 800 000 000 — библиотека в тысячи книг — расход небольшой команды за много месяцев
Два последних числа не с потолка: ровно столько раздают в Китае.

Почему токены вообще можно раздавать
Здесь ключ ко всей истории. За токеном стоит не строчка в базе, а время видеокарты в дата-центре. Ускоритель либо считает чей-то запрос, либо стоит без дела — но амортизацию, электричество и охлаждение ест в обоих случаях. Простаивающий GPU — убыток, который уже не вернуть.
Отсюда экономика подарков. Дата-центру для ИИ, по отраслевым оценкам, нужна загрузка около семидесяти процентов, чтобы выйти в плюс. Если реальная вдвое-втрое ниже, отдать простаивающие мощности бонусом дешевле, чем держать их выключенными: себестоимость лишнего токена в момент простоя близка к нулю, а подарок выглядит солидно. Токен оказался идеальной валютой лояльности: не портится, не требует склада, физической себестоимости нет, зато есть огромные красивые числа. Мили авиакомпаний работают так же — пустое кресло дешевле отдать, чем везти пустым.
Что происходит в Китае: токены как кэшбэк, тариф и подарок к обеду
Издание Rest of World 4 сентября 2026 года собрало примеры. Все суммы — на дату публикации, условия акций меняются быстро.
Банки. В июле 2026-го Moonshot AI вместе с Agricultural Bank of China и American Express выпустила карту, по которой за обычные покупки начисляются токены её модели Kimi — кэшбэк не деньгами, а машинным временем. В июне China Merchants Bank предлагал новым держателям карт до 1,8 миллиарда токенов на модели MiniMax, а Shanghai Pudong Development Bank — субсидии на сумму до 3 миллиардов токенов для моделей Qwen.
Операторы связи. China Mobile в Шанхае продавала 400 000 токенов за 1 юань. У China Telecom тарифы начинаются с 9,9 юаня в месяц за 10 миллионов токенов; компания держит площадку TokenHub со 142 моделями. China Unicom предлагает 6–18 миллионов токенов за 15–45 юаней в месяц.
Общепит. Пекинская пельменная Jingu Yuan раздаёт больше сотни талонов в день: пообедал — получил 10 юаней вычислительного кредита. AGI Bar в Пекине даёт к напитку доступ к DeepSeek V4 Flash, которая крутится на рабочей станции Nvidia прямо в баре. Кофейня в Чанше выдаёт токены с покупкой, а на барахолке Xianyu подаренные пакеты уже перепродают.
Масштаб: суточный расход токенов в Китае к середине 2026 года превысил 500 триллионов против примерно 100 миллиардов в начале 2024-го.
Токен-кредит: банк смотрит не на презентацию, а на расход
Самое интересное здесь — не пельменная, а банковский продукт. В августе 2026-го в районе Хайчжу города Гуанчжоу запустили «токен-кредит»: Bank of China, China CITIC Bank и Bank of Guangzhou оценивают кредитоспособность ИИ-стартапа по тому, сколько токенов он производит и потребляет.
Логика здравая. У молодой ИИ-компании нет ни выручки, ни залога, ни истории — есть презентация, которую умеет собрать кто угодно. А расход токенов подделать сложнее: это след реальной работы продукта. Люди задают вопросы, модель отвечает, счётчик крутится, и за каждый оборот кто-то платит настоящими деньгами. Накрутка стоит ровно столько же, сколько настоящая работа.
Ближайшая аналогия — оценивать кафе не по бизнес-плану, а по расходу электричества и закупке молока. Насколько метрика устойчива на дистанции, пока не знает никто: продукту от роду несколько недель.
Почему это возможно именно там
Совпало три вещи. Мощностей построили больше, чем требуется: сообщения о низкой загрузке китайских ИИ-дата-центров идут второй год. Свои модели, в том числе с открытыми весами, обходятся дешевле — Rest of World приводит оценку: на 60–90 процентов меньше сопоставимых у OpenAI и Anthropic, но без ссылки на прайс-лист, так что это порядок величины, а не цифра из счёта. И третье — гигантский внутренний рынок, где любая раздача масштабируется на сотни миллионов человек.
И честная оговорка, которую делает сама статья. Пекинский аналитик Poe Zhao, основатель Hello China Tech, называет происходящее «экспериментом со стороны предложения»: токены раздают не потому, что их просили, а потому что предложение обогнало спрос. Большинство людей вообще не видят никакого баланса — они просто открывают приложение и разговаривают. Это интерпретация, а не факт.
Почему у нас так не раздают
Вопрос, который возникает первым. Разберу без политики — тут хватает обычной арифметики.
Мощности. Раздавать можно только то, что и так простаивает. Свободных ускорителей нет: они дефицитны и дороги во всём мире, производители второй год отгружают всё в первую очередь крупным дата-центрам. Где мощности в очереди, а не в простое, дарить нечего.
Стоимость. Российские сервисы либо платят за доступ к чужим моделям, либо содержат свои — в обоих случаях каждый выданный токен стоит реальных денег. Дарить то, что закупаешь, — не утилизация простоя, а прямой убыток.
Размер рынка. Кэшбэк токенами имеет смысл, когда счётчик крутит сотни триллионов в сутки: тогда единица бонуса стоит доли копейки, а число в рекламе выглядит красиво. На меньших объёмах та же щедрость обходится дороже в пересчёте на клиента. Добавьте более дорогие расчёты с зарубежными поставщиками — и получится не жадность, а другая структура затрат.
Почему длинный диалог дорожает с каждым сообщением
Теперь то, что касается лично вас, даже если вы никогда не видели счёта за API.
Модель не помнит разговор. Совсем. На каждом новом сообщении ей заново скармливают всю переписку с начала — иначе она не поймёт, о чём речь. На первом шаге вы платите за одну порцию текста, на десятом — за десять. Суммарно за диалог из десяти реплик уходит не в десять, а примерно в пятьдесят пять раз больше токенов, чем за одну.
Это же объясняет, почему длинный чат тормозит и почему модель к концу разговора будто глупеет: она перечитывает гору текста, в которой ваш последний вопрос занимает полпроцента объёма.

Что реально экономит:
— начинайте новый чат, когда сменилась тема, а не тяните один бесконечный;
— не грузите файл целиком, если нужен один раздел;
— просите отвечать короче: ответ тоже состоит из токенов, и обычно они дороже входных;
— выкидывайте из диалога длинные простыни, которые больше не нужны;
— если в интерфейсе есть счётчик расхода, посмотрите на него один раз внимательно — этого хватает, чтобы понять свой профиль.
Где взять бесплатные токены легально
Конкретные сервисы называть не буду — они меняются каждый квартал. Назову принцип: почти у каждого крупного разработчика есть бесплатный уровень одного из четырёх видов. Тариф в веб-интерфейсе с лимитом сообщений в день. Стартовые кредиты при регистрации в API — их дают один раз, и они сгорают. Постоянный доступ к младшим и быстрым моделям с ограничением на запросы в минуту и в сутки; так устроены самые щедрые предложения на рынке. И открытые модели, запускаемые на своём компьютере, — тогда токены стоят только электричества.
Что проверять: сохраняются ли ваши запросы для обучения модели (у части бесплатных уровней данные и есть плата), в чём именно лимит — в минуту, в сутки или в месяц, и не превращается ли тариф в платный автоматически после квоты.
Безлимитного бесплатного доступа не бывает: за любой раздачей стоит либо чужой простаивающий ускоритель, либо ваши данные, либо желание приучить вас к сервису.
Частые вопросы
Токен нейросети и криптотокен — это одно и то же?
Нет. Криптотокен — запись в блокчейне, которую можно купить и продать. Токен нейросети — единица измерения текста, вроде килобайта или минуты разговора. Общее только слово.
Сколько токенов в одном слове?
В английском — примерно 1,3 токена на слово. В русском — около двух в современных моделях и заметно больше в старых. Короткие частые слова часто укладываются в один токен, длинные и редкие разбиваются на части.
Почему за ответ модели списывают больше, чем за мой вопрос?
У большинства сервисов выходные токены дороже входных, иногда в несколько раз. Причина техническая: входной текст модель обрабатывает разом, а ответ генерирует по одному токену за проход. Поэтому «отвечай короче» экономит сильнее, чем сокращение вопроса.
Можно ли посчитать токены заранее?
Точно — только тем же токенизатором, что использует конкретная модель; у разработчиков есть открытые библиотеки и веб-калькуляторы. Для прикидки делите число символов русского текста пополам.
Правда ли, что китайские модели дешевле западных?
Разница есть, и она большая, но цифра «на 60–90 процентов дешевле» — оценка из материала Rest of World от 4 сентября 2026 года, без ссылки на прайс-лист. Цены меняются ежемесячно, так что это порядок величины, а не факт из счёта.
Появится ли токен-кэшбэк у нас?
В такой форме — вряд ли скоро: нужен избыток простаивающих мощностей, которого нет. Более вероятный вариант — пакеты запросов внутри подписок и тарифов операторов: то же самое, но без слова «токены» на витрине.
Что мне в этой истории нравится больше всего: единица, придуманная как технический костыль для словаря, за пару лет доехала до банковской карты и кредитного скоринга. Так и выясняется, что технология вошла в быт, — не когда о ней пишут в новостях, а когда её начинают раздавать вместе с обедом.

Пока нет комментариев