YapayZekaLabYapayZekaLab
ВходРегистрация

1) Запрос = ОДИН вызов, который ваша программа делает к AI

Запрос — это когда программа один раз спрашивает AI и один раз получает ответ. ВНИМАНИЕ: одно написанное вами сообщение НЕ обязательно равно одному запросу. Сколько запросов получится из вашего сообщения, зависит от используемого инструмента.

Программа спрашиваетМодель думаетМодель отвечает
= 1 ЗАПРОС

Будь ваше сообщение из 5 слов или из 500, этот ОДИН вызов считается за 1 запрос. Длина не меняет КОЛИЧЕСТВО запросов — но меняет сожжённые токены, а значит, и то, сколько вы платите при PAYG.

Так сколько же запросов получается из одного вашего сообщения?

Если вы пишете в окне чата: 1 сообщение = 1 запрос. Просто. Но в инструментах для кода (Claude Code, Cline, Codex…) всё ОЧЕНЬ иначе. Эти инструменты работают как «агенты»: вы пишете одно предложение, а они в фоне работают шаг за шагом и на КАЖДОМ шаге снова спрашивают модель.

Пример: вы сказали Claude Code «исправь эту ошибку». Что происходит в фоне:
1Читает файлы → 1 запрос
2Изучает код, чтобы найти ошибку → 1 запрос
3Пишет исправление → 1 запрос
4Запускает тесты, читает результат → 1 запрос
5Если тест упал, исправляет снова → ещё 1 запрос… и так далее

То есть ваше ОДНО предложение может превратиться в фоне в 20–30 запросов. Именно поэтому пакет «1 000 запросов/день» заканчивается быстрее, чем вы ожидали. Это не ошибка — так работают агентные инструменты.

Сколько запросов вы израсходовали, всегда можно увидеть на странице «Активность» в панели; каждый запрос — отдельная строка.

2) Токен = части слов

AI читает слова не так, как мы. Он делит текст на маленькие части, и каждая такая часть называется ТОКЕНОМ. Токен — это иногда целое слово, иногда половина слова, иногда знак препинания.

Вот это предложение: «Сегодня прекрасная погода.»
Bugün hava çok güzel.
Это примерно 5 токенов. Грубо: 1 токен ≈ 4 символа. В русском тексте слова длиннее, поэтому токенов выходит чуть больше.

Стоимость рассчитывается по токенам — а не по словам или символам.

3) Есть два вида токенов: исходящие и входящие

В запросе токены текут в обе стороны. Считаются оба.

  • ВХОД (то, что вы отправляете)ваш вопрос + инструкции, данные AI + предыдущий разговор, если он есть.
  • ВЫХОД (то, что пишет модель)весь ответ, который вы получаете. Выход обычно дороже входа, потому что именно эта часть по-настоящему нагружает модель.

Самое удивительное: в чате история пересылается заново каждый раз

У AI НЕТ памяти. Он не помнит предыдущее сообщение. Поэтому когда вы продолжаете чат, программа заново отправляет ВЕСЬ разговор с самого начала — иначе модель не поймёт, о чём речь. То есть чем длиннее чат, тем дороже каждое сообщение:

11-е сообщение — отправляется только ваш вопрос~30 token
22-е сообщение — отправляются вопрос 1 + ответ 1 + вопрос 2~90 token
33-е сообщение — всё вышеперечисленное + вопрос 3~200 token

Что делать: когда тема меняется, открывайте НОВЫЙ ЧАТ. Накапливать 50 сообщений в одном чате — значит делать каждое новое сообщение очень дорогим.

4) В инструментах для кода даже «привет» не отправляется в одиночку

Инструменты вроде Claude Code и Cline незаметно для вас отправляют в фоне много всего: содержимое открытых файлов, структуру проекта, инструкции, данные инструменту… Поэтому даже если вы напишете «привет», в фоне могут уйти тысячи токенов.

Это не ошибка, а принцип работы инструмента — и он объясняет, почему даже маленький вопрос стоит денег.

5) Как ведётся подсчёт? В пакете и на балансе ПО-РАЗНОМУ

📦 Если вы купили пакет

У вас есть дневной лимит на количество единиц. Каждый ЗАПРОС (каждый вызов API) списывает 1 единицу — а не каждое написанное вами сообщение. Короткий он или длинный — неважно. Если у вас пакет на 500 запросов/день, агентный инструмент может израсходовать его за несколько задач.

1 вызов API = 1 единица
💳 Если вы платите с баланса (PAYG)

Единиц нет. Сколько токенов сожжёт запрос, столько денег и спишется с баланса. Короткий вопрос = мало денег. Длинный чат = много денег.

платите по токенам
Реальный пример: на модели claude-haiku-4-5 1M токенов стоит 0.3 $. То есть запрос на 1 000 токенов обходится примерно в 0.0142 ₺. (Цены из живого каталога.)

6) Почему в реестре я вижу ТРИ строки?

Заглянув в раздел «Активность» в панели, вы увидите три строки для одного запроса. Не пугайтесь — деньги списываются один раз. Работает так: в начале запроса мы не можем знать, сколько он будет стоить, поэтому сначала «откладываем» некоторую сумму. Когда всё завершается, мы возвращаем ВСЁ отложенное и списываем только то, что реально потрачено.

Резервация — отложено (оценочный максимум)−$0,05
Возврат — всё отложенное возвращено+$0,05
Использование — списано то, что реально потрачено−$0,01

Итог: из вашего кармана уходит только то, что реально потрачено. Все три несут один и тот же номер запроса, ничего не путается.

7) Как тратить меньше?

  • Когда тема меняется, открывайте новый чат — чтобы старый разговор не пересылался каждый раз.
  • Пишите запрос чётко. Вместо долгих объяснений скажите точно, что вам нужно.
  • Для простых задач выбирайте дешёвую модель (например, GLM, Kimi). Не нужно запускать самую дорогую модель на каждую задачу.
  • Если пользуетесь регулярно, купите пакет — так как он на основе единиц, на длинных запросах это выходит намного дешевле.
YARDIM MERKEZİ

Sık sorulan sorular

Ücretlendirme, paketler, anahtarlar ve kapalı yüzeyler hakkında kısa ve dürüst cevaplar. Emin olmadığımız hiçbir şeyi kesinmiş gibi yazmıyoruz.

12 / 12 soru gösteriliyor. Doğrulanmamış hiçbir cevabı kesinmiş gibi yazmıyoruz — onay bekleyenler açıkça etiketlidir.

Cevabını bulamadın mı?

Destek kanalı adresleri doğrulanmadan yayınlanmaz — sahte link göstermiyoruz. Şimdilik en hızlı yol: dokümandaki hata kodları ve yanıttaki istek kimliği.

WhatsApp