Учитываются запрос, контекст диалога, ответ и действия агента. Затем применяется коэффициент выбранной модели — насколько быстро она расходует общую квоту.
Под каждым ответом видно, сколько токенов списано с лимита.
Пример одного запроса
Что входит в расчёт
Запрос и контекст
2 000
Ответ модели
400
Кэшированный контекст
2 000 → 500
Действия агента
2 × 100 = 200
Поиск и источники
500 + 200
Кэшированный контекст учитывается только на 25%.
Промежуточный итог
3 800
Коэффициент выбранной моделиClaude Sonnet 5
Списано с лимита7 600 токенов
Пример. Реальные цифры зависят от запроса и модели. Сколько хватит на неделю по каждой модели — в таблице ниже.
Кэш дешевле
Повторно прочитанный контекст считается на 25%.
Коэффициент модели
У каждой модели свой. Сколько токенов хватит на неделю — в таблице ниже.
Минимум за запрос
Если модель начала работу, спишется не менее 400 токенов.
Новый чат дешевле
Контекст отправляется модели заново каждый ход. Когда переписка стала длинной, новый чат дешевле, чем продолжение этого.
Сколько токенов на каждой модели
Квота одна на все модели — отличается лишь скорость, с которой они её
тратят: чем дороже модель, тем быстрее. В таблице это уже посчитано —
столько токенов вы потратите за неделю, если возьмёте только эту модель.
Модель
Free
Стандарт
Про
Премиум
Claude Opus 5
—
—
—
16.7M
Claude Sonnet 5
—
—
4.2M
16.7M
Claude Haiku 4.5
—
833K
4.2M
16.7M
GPT-5.6 Sol
—
—
—
10M
GPT-5.6 Terra
—
—
2.5M
10M
GPT-5.6 Luna
—
500K
2.5M
10M
DeepSeek V4 Flash
50K
125K
625K
2.5M
Kimi K2.6
50K
125K
625K
2.5M
Таблицу можно листать влево и вправо.
Шестичасовое окно — пятая часть недельного: неделя это
ровно пять полных окон.
Частые вопросы
Почему длинный диалог может стоить дороже?
Модель не помнит прошлые ходы сама — нужный контекст отправляется ей заново. Чем длиннее переписка, тем больше данных она читает. Повторно прочитанный кэшированный контекст считается на 25%.
Что означает «списано» под ответом?
Ровно то, сколько токенов ушло с вашего лимита за этот ответ. Это итоговое число: в нём уже учтены запрос, контекст диалога, ответ, действия агента, скидка на кэш и коэффициент модели. Больше с лимита за этот ответ не спишется ничего.
Почему рядом с моделью не написан её коэффициент?
Потому что сравнивать модели по нему нельзя, а рядом с именем модели он читался бы именно так.
Коэффициент умножает объём, а объём у моделей разный: на одну и ту же задачу одна может перемолоть в десятки раз больше токенов, чем другая. Меньший коэффициент при большем объёме обходится дороже — такое число подталкивало бы к неверному выбору.
Вместо него мы показываем то, что сравнивать можно: сколько токенов каждой модели хватит на неделю — в таблице выше. А под каждым ответом стоит итог — сколько списано с лимита.
Кто устанавливает коэффициенты и могут ли они измениться?
Коэффициенты устанавливаем мы и выводим их из измерений: одинаковые задачи прогоняются по всем моделям, и коэффициент считается из фактического расхода. Модели и их версии меняются, поэтому измерения мы повторяем и коэффициенты пересматриваем. Сколько токенов хватит на неделю по каждой модели — в таблице выше, она пересчитывается вместе с коэффициентами. Фактическое списание видно под каждым ответом. Подробнее — в условиях, пункты 3.4–3.7.
Улучшение запроса тоже тратит токены?
Да. Кнопка «улучшить» отправляет настоящий запрос выбранной модели. Она читает ваш текст и контекст диалога, а точное списание появляется в карточке результата.