1) Запрос = ОДИН вызов, который ваша программа делает к AI
Запрос — это когда программа один раз спрашивает AI и один раз получает ответ. ВНИМАНИЕ: одно написанное вами сообщение НЕ обязательно равно одному запросу. Сколько запросов получится из вашего сообщения, зависит от используемого инструмента.
Программа спрашивает→Модель думает→Модель отвечает
= 1 ЗАПРОСБудь ваше сообщение из 5 слов или из 500, этот ОДИН вызов считается за 1 запрос. Длина не меняет КОЛИЧЕСТВО запросов — но меняет сожжённые токены, а значит, и то, сколько вы платите при PAYG.
Так сколько же запросов получается из одного вашего сообщения?
Если вы пишете в окне чата: 1 сообщение = 1 запрос. Просто. Но в инструментах для кода (Claude Code, Cline, Codex…) всё ОЧЕНЬ иначе. Эти инструменты работают как «агенты»: вы пишете одно предложение, а они в фоне работают шаг за шагом и на КАЖДОМ шаге снова спрашивают модель.
Пример: вы сказали Claude Code «исправь эту ошибку». Что происходит в фоне:1Читает файлы → 1 запрос
2Изучает код, чтобы найти ошибку → 1 запрос
3Пишет исправление → 1 запрос
4Запускает тесты, читает результат → 1 запрос
5Если тест упал, исправляет снова → ещё 1 запрос… и так далее
То есть ваше ОДНО предложение может превратиться в фоне в 20–30 запросов. Именно поэтому пакет «1 000 запросов/день» заканчивается быстрее, чем вы ожидали. Это не ошибка — так работают агентные инструменты.
Сколько запросов вы израсходовали, всегда можно увидеть на странице «Активность» в панели; каждый запрос — отдельная строка.
2) Токен = части слов
AI читает слова не так, как мы. Он делит текст на маленькие части, и каждая такая часть называется ТОКЕНОМ. Токен — это иногда целое слово, иногда половина слова, иногда знак препинания.
Вот это предложение: «Сегодня прекрасная погода.»Bugün hava çok güzel.
Это примерно 5 токенов. Грубо: 1 токен ≈ 4 символа. В русском тексте слова длиннее, поэтому токенов выходит чуть больше. Стоимость рассчитывается по токенам — а не по словам или символам.
3) Есть два вида токенов: исходящие и входящие
В запросе токены текут в обе стороны. Считаются оба.
- ВХОД (то, что вы отправляете) — ваш вопрос + инструкции, данные AI + предыдущий разговор, если он есть.
- ВЫХОД (то, что пишет модель) — весь ответ, который вы получаете. Выход обычно дороже входа, потому что именно эта часть по-настоящему нагружает модель.
⚠ Самое удивительное: в чате история пересылается заново каждый раз
У AI НЕТ памяти. Он не помнит предыдущее сообщение. Поэтому когда вы продолжаете чат, программа заново отправляет ВЕСЬ разговор с самого начала — иначе модель не поймёт, о чём речь. То есть чем длиннее чат, тем дороже каждое сообщение:
11-е сообщение — отправляется только ваш вопрос~30 token
22-е сообщение — отправляются вопрос 1 + ответ 1 + вопрос 2~90 token
33-е сообщение — всё вышеперечисленное + вопрос 3~200 token
Что делать: когда тема меняется, открывайте НОВЫЙ ЧАТ. Накапливать 50 сообщений в одном чате — значит делать каждое новое сообщение очень дорогим.
4) В инструментах для кода даже «привет» не отправляется в одиночку
Инструменты вроде Claude Code и Cline незаметно для вас отправляют в фоне много всего: содержимое открытых файлов, структуру проекта, инструкции, данные инструменту… Поэтому даже если вы напишете «привет», в фоне могут уйти тысячи токенов.
Это не ошибка, а принцип работы инструмента — и он объясняет, почему даже маленький вопрос стоит денег.
5) Как ведётся подсчёт? В пакете и на балансе ПО-РАЗНОМУ
📦 Если вы купили пакетУ вас есть дневной лимит на количество единиц. Каждый ЗАПРОС (каждый вызов API) списывает 1 единицу — а не каждое написанное вами сообщение. Короткий он или длинный — неважно. Если у вас пакет на 500 запросов/день, агентный инструмент может израсходовать его за несколько задач.
1 вызов API = 1 единица 💳 Если вы платите с баланса (PAYG)Единиц нет. Сколько токенов сожжёт запрос, столько денег и спишется с баланса. Короткий вопрос = мало денег. Длинный чат = много денег.
платите по токенам
Реальный пример: на модели claude-haiku-4-5 1M токенов стоит 0.3 $. То есть запрос на 1 000 токенов обходится примерно в 0.0142 ₺. (Цены из живого каталога.)6) Почему в реестре я вижу ТРИ строки?
Заглянув в раздел «Активность» в панели, вы увидите три строки для одного запроса. Не пугайтесь — деньги списываются один раз. Работает так: в начале запроса мы не можем знать, сколько он будет стоить, поэтому сначала «откладываем» некоторую сумму. Когда всё завершается, мы возвращаем ВСЁ отложенное и списываем только то, что реально потрачено.
Резервация — отложено (оценочный максимум)−$0,05
Возврат — всё отложенное возвращено+$0,05
Использование — списано то, что реально потрачено−$0,01
Итог: из вашего кармана уходит только то, что реально потрачено. Все три несут один и тот же номер запроса, ничего не путается.
7) Как тратить меньше?
- Когда тема меняется, открывайте новый чат — чтобы старый разговор не пересылался каждый раз.
- Пишите запрос чётко. Вместо долгих объяснений скажите точно, что вам нужно.
- Для простых задач выбирайте дешёвую модель (например, GLM, Kimi). Не нужно запускать самую дорогую модель на каждую задачу.
- Если пользуетесь регулярно, купите пакет — так как он на основе единиц, на длинных запросах это выходит намного дешевле.