К содержанию

Токены списываются за работу модели

Учитываются запрос, контекст диалога, ответ и действия агента. Затем применяется коэффициент выбранной модели — насколько быстро она расходует общую квоту.

Под каждым ответом видно, сколько токенов списано с лимита.

Пример одного запроса

Запрос и контекст2 000
Ответ модели400
Кэшированный контекст2 000 → 500
Действия агента2 × 100 = 200
Поиск и источники500 + 200

Кэшированный контекст учитывается только на 25%.

3 800
Коэффициент выбранной моделиClaude Sonnet 5
Списано с лимита 7 600 токенов

Пример. Реальные цифры зависят от запроса и модели. Сколько хватит на неделю по каждой модели — в таблице ниже.

Кэш дешевле

Повторно прочитанный контекст считается на 25%.

Коэффициент модели

У каждой модели свой. Сколько токенов хватит на неделю — в таблице ниже.

Минимум за запрос

Если модель начала работу, спишется не менее 400 токенов.

Новый чат дешевле

Контекст отправляется модели заново каждый ход. Когда переписка стала длинной, новый чат дешевле, чем продолжение этого.

Сколько токенов на каждой модели

Квота одна на все модели — отличается лишь скорость, с которой они её тратят: чем дороже модель, тем быстрее. В таблице это уже посчитано — столько токенов вы потратите за неделю, если возьмёте только эту модель.

МодельFreeСтандартПроПремиум
Claude Opus 516.7M
Claude Sonnet 54.2M16.7M
Claude Haiku 4.5833K4.2M16.7M
GPT-5.6 Sol10M
GPT-5.6 Terra2.5M10M
GPT-5.6 Luna500K2.5M10M
DeepSeek V4 Flash50K125K625K2.5M
Kimi K2.650K125K625K2.5M

Таблицу можно листать влево и вправо.

Шестичасовое окно — пятая часть недельного: неделя это ровно пять полных окон.

Частые вопросы

Почему длинный диалог может стоить дороже?
Модель не помнит прошлые ходы сама — нужный контекст отправляется ей заново. Чем длиннее переписка, тем больше данных она читает. Повторно прочитанный кэшированный контекст считается на 25%.
Что означает «списано» под ответом?
Ровно то, сколько токенов ушло с вашего лимита за этот ответ. Это итоговое число: в нём уже учтены запрос, контекст диалога, ответ, действия агента, скидка на кэш и коэффициент модели. Больше с лимита за этот ответ не спишется ничего.
Почему рядом с моделью не написан её коэффициент?
Потому что сравнивать модели по нему нельзя, а рядом с именем модели он читался бы именно так.

Коэффициент умножает объём, а объём у моделей разный: на одну и ту же задачу одна может перемолоть в десятки раз больше токенов, чем другая. Меньший коэффициент при большем объёме обходится дороже — такое число подталкивало бы к неверному выбору.

Вместо него мы показываем то, что сравнивать можно: сколько токенов каждой модели хватит на неделю — в таблице выше. А под каждым ответом стоит итог — сколько списано с лимита.
Кто устанавливает коэффициенты и могут ли они измениться?
Коэффициенты устанавливаем мы и выводим их из измерений: одинаковые задачи прогоняются по всем моделям, и коэффициент считается из фактического расхода. Модели и их версии меняются, поэтому измерения мы повторяем и коэффициенты пересматриваем. Сколько токенов хватит на неделю по каждой модели — в таблице выше, она пересчитывается вместе с коэффициентами. Фактическое списание видно под каждым ответом. Подробнее — в условиях, пункты 3.4–3.7.
Улучшение запроса тоже тратит токены?
Да. Кнопка «улучшить» отправляет настоящий запрос выбранной модели. Она читает ваш текст и контекст диалога, а точное списание появляется в карточке результата.