Сначала увидел формулировку в духе:
«Z раздаёт пользователям по 100 миллионов токенов в день»
Подумал — ну да, конечно. Наверняка либо 100 миллионов каких-нибудь внутренних фантиков, либо акция на три с половиной человека.
И оказалось, что раздачи реально были. Причём местами даже жирнее.
Для тех, кто не в теме: у китайской компании Z есть своё десктопное приложение ZCode. По смыслу это примерно из той же оперы, что Claude Code, Codex и другие AI-инструменты для разработки.
То есть это не просто чат, где ты спрашиваешь:
«Напиши мне функцию на Python».
Ты даёшь ему проект, а дальше он может читать файлы, разбираться в кодовой базе, менять код, запускать команды, смотреть ошибки, исправлять их и продолжать работать дальше.
И вот для ZCode китайцы периодически начали устраивать довольно безумные раздачи.
Причём такие раздачи проходили несколько раз.
Потом была акция, где новым пользователям тоже выдавали 100 миллионов токенов, а для подписчиков открывали бесплатные часы работы с GLM-5.3-Flash.
А потом они вообще решили, что 100 миллионов — как-то мелко.
300 000 000 токенов на пользователя.
Правда, тут уже был лимит по количеству участников.
То есть схема простая: увидел раздачу — забирай. Потому что потом вполне может закончиться.
Я специально полез проверять слух про «100 миллионов токенов каждому каждый день».
И вот этого как постоянного тарифа я не нашёл.
То есть интернет тут, как обычно, слегка докрутил историю.
100 и 300 миллионов — это отдельные акции и раздачи.
А постоянно новым пользователям сейчас дают бесплатный тест.
Там примерно такая схема:
3 миллиона токенов GLM-5.3 в день
5 миллионов токенов GLM-5.3-Flash в день.
8 миллионов токенов в сутки.
Даже если не считать все эти специальные акции, для бесплатного теста это всё равно дофига.
Зачем вообще кому-то 100 миллионов токенов?
Если вы просто сидите в чатике и периодически спрашиваете:
«А как центрировать div?»
То вам столько токенов, наверное, хватит до пенсии.
А вот когда работает AI-агент — расход совершенно другой.
Он может прочитать половину репозитория.
Снова прочитать несколько файлов.
Потом выяснить, что сломал что-то ещё.
И повторить весь этот цикл несколько раз.
Вот там токены начинают улетать очень бодро.
Поэтому для агентного программирования 100 миллионов уже не выглядят какой-то абсолютно бессмысленной цифрой.
Что касается самой модели.
Основной интерес сейчас представляют GLM-5.3 и GLM-5.3-Flash.
GLM-5.3-Flash — большая MoE-модель: суммарно там сотни миллиардов параметров, но во время генерации используется только часть из них.
Модель заточена в том числе под кодинг и агентные задачи.
То есть китайцы сейчас пытаются конкурировать уже не просто в категории:
А непосредственно с Claude Code, Codex, Cursor и всем этим новым поколением AI-разработки.
И стратегия у них довольно понятная.
Не обязательно сразу доказать разработчику, что твоя модель самая умная на планете.
дать ему столько бесплатных токенов, чтобы он просто пошёл и попробовал.
А дальше уже пусть сам сравнивает.
Лично мне вообще нравится, куда двигается вся эта история.
Ещё недавно мы обсуждали:
— сколько стоит миллион токенов;
— сколько контекста даёт модель;
— не закончится ли лимит за вечер.
А теперь производители моделей постепенно переходят к:
«На тебе 100 миллионов. Иди пиши свой проект».
Если так пойдёт дальше, через год главным вопросом будет уже не:
«Какую нейросеть выбрать?»
«У кого сегодня раздают бесплатный миллиард токенов?»
Только не воспринимайте заголовки про «100 миллионов каждый день» буквально.
Постоянной раздачи 100M в сутки я не нашёл.
Но сами дропы по 100M и даже 300M — вполне реальные.