Токены, списания и ошибки — частые вопросыTokens, charges and errors — FAQ

Частые вопросы. Не нашли ответ — напишите в Telegram, поможем.Frequently asked questions. No answer? Write on Telegram — we will help.

Как считаются списания?How are charges calculated?
За каждый запрос списывается (входные токены + выходные токены) × коэффициент модели. В логах на странице «Баланс и логи» видно каждое списание: модель, сколько токенов вошло/вышло и сколько списано. Кэшированные токены показываются отдельной колонкой «Кэш».Each request costs (input tokens + output tokens) × the model rate. The logs on the Balance and logs page show every charge: the model, tokens in/out and the amount. Cached tokens appear in a separate “Cache” column.
Что такое коэффициент и мощность модели?What are the rate multiplier and model power?
Коэффициент — «дороговизна» модели: модель с ×2 за миллион реальных токенов спишет 2 млн токенов баланса, модель с ×0,1 — всего 100 тысяч.
Мощность — наш рейтинг полезности: Флагман — максимум качества для сложных задач, Мощная — оптимум для кода и агентов, Средняя — рутина, Эконом — простые задачи по минимальной цене.
The rate multiplier is the model “price tag”: a ×2 model spends 2M balance tokens per million real tokens, a ×0.1 model spends just 100 thousand.
Power is our usefulness rating: Flagship — maximum quality for hard tasks, Powerful — sweet spot for code and agents, Mid — routine, Economy — simple tasks at the lowest price.
На сколько хватит пакета токенов?How long does a token pack last?
Зависит от коэффициента модели. Пакета 100 млн токенов хватит примерно на: ×0,05 — 2 млрд токенов запросов, ×0,1 — 1 млрд, ×0,5 — 200 млн, ×1 — 100 млн, ×2 — 50 млн, ×4 — 25 млн. Обычный запрос чата — это ~2–5 тыс. токенов (вход + выход), то есть при ×1 пакета хватает на десятки тысяч запросов.It depends on the model rate. A 100M token pack covers roughly: ×0.05 — 2B request tokens, ×0.1 — 1B, ×0.5 — 200M, ×1 — 100M, ×2 — 50M, ×4 — 25M. A typical chat request is ~2–5K tokens (input + output), so at ×1 a pack lasts for tens of thousands of requests.
Какую модель выбрать?Which model should I pick?
Для вайбкода и агентов: gpt-5.6-terra или claude-sonnet-5 (оптимум), gpt-5.6-luna (бюджетно), claude-opus-5 или gpt-5.6-sol (максимум). Для простых задач и массы запросов: deepseek-v4-flash, qwen3.7-plus, mimo-v2.5. Полный список — в таблице моделей.For vibe-coding and agents: gpt-5.6-terra or claude-sonnet-5 (sweet spot), gpt-5.6-luna (budget), claude-opus-5 or gpt-5.6-sol (maximum). For simple tasks and high volume: deepseek-v4-flash, qwen3.7-plus, mimo-v2.5. Full list in the models table.
Где взять ключ и как пополнить баланс?Where do I get a key and how do I top up?
Ключи выдаёт и пополняет продавец — напишите в Telegram. Скажите, сколько токенов нужно, — ключ выдадут или пополнят существующий за пару минут.The seller issues and tops up keys — write on Telegram. Say how many tokens you need and your key will be issued or topped up within minutes.
Запрос вернул ошибку — списались ли токены?A request returned an error — was I charged?
Списание происходит только за запросы, которые дошли до модели. Ошибки без обработки — 429 (лимит), 503 (перегрузка), обрыв связи — не списываются. Каждое списание видно в логах на странице «Баланс и логи» построчно: если видите списание за неудавшийся запрос — напишите продавцу, разберёмся по логам.You are charged only for requests that reached the model. Unhandled errors — 429 (rate limit), 503 (overload), connection drops — are not charged. Every charge is listed line by line on the Balance and logs page: if you see a charge for a failed request, write to the seller — we will sort it out via the logs.
Ключ перестал работать / я его потерялMy key stopped working / I lost it
Напишите продавцу — проверят ключ, при необходимости заморозят старый и выдадут новый. Если ключ где-то засветился — сообщите сразу.Write to the seller — they will check the key, freeze the old one if needed and issue a new one. If your key leaked anywhere, report it immediately.
Хранятся ли мои запросы?Are my requests stored?
Нет. В логах остаётся только техническая информация для биллинга: модель, число токенов, статус и время. Содержимое сообщений не сохраняется.No. The logs keep only technical billing data: model, token counts, status and time. Message contents are never stored.
Это официальный API OpenAI или Anthropic?Is this the official OpenAI or Anthropic API?
Нет. Это самостоятельный шлюз с OpenAI-совместимым форматом: любое приложение, умеющее «Base URL + API Key», работает без переделок.No. It is an independent gateway with an OpenAI-compatible format: any app that understands “Base URL + API Key” works as is.

Ошибки API и что делатьAPI errors and what to do

Полный разбор кодов. Ошибки приходят в JSON вида {"error":{"message":"…","code":"…"}}.Every code explained. Errors come as JSON: {"error":{"message":"…","code":"…"}}.

КодЧто значитЧто делать
400Неверный запрос: опечатка в названии модели, кривой JSON, лишний параметр.Bad request: a typo in the model name, malformed JSON or an extra parameter.Проверьте ID модели по таблице и формат запроса. Тот же запрос без изменений повторять бессмысленно.Check the model ID in the table and your request format. Repeating the same request unchanged is pointless.
401Ключ неверный, отозван или скопирован не полностью.The key is wrong, revoked, or was not copied in full.Скопируйте ключ заново, без пробелов. Не помогло — напишите продавцу.Copy the key again, with no spaces. Still failing — write to the seller.
402Баланс ключа исчерпан.The key balance is exhausted.Пополните ключ у продавца — напишите в Telegram.Top up your key with the seller — write on Telegram.
403Ключу запрещено это действие (например, модель не входит в список разрешённых для ключа).This action is not allowed for the key (for example, the model is not in the key allow-list).Выберите другую модель или уточните лимиты ключа у продавца.Pick another model or check the key limits with the seller.
404Модель не найдена или недоступна этому ключу.Model not found or not available to this key.Сверьте ID модели в таблице — имена пишутся точно, с точками и дефисами.Verify the model ID in the table — names are exact, with dots and hyphens.
429Слишком много запросов подряд (rate limit).Too many requests in a row (rate limit).Подождите 10–60 секунд. В заголовке ответа приходит Retry-After — сколько ждать.Wait 10–60 seconds. The response includes a Retry-After header saying how long.
500Внутренняя ошибка сервера.Internal server error.Повторите запрос через несколько секунд. Не списывается.Retry in a few seconds. Not charged.
503Временная перегрузка (нет свободной ёмкости у модели).Temporary overload (no free capacity for the model).Повторите через 10–60 секунд или возьмите другую модель. Транзиентно, не списывается.Retry in 10–60 seconds or switch models. Transient, not charged.
Failed to fetchБраузер/приложение не смогло достучаться до сервера.The browser/app could not reach the server.Проверьте интернет и что Base URL указан верно (заканчивается на /v1).Check your internet and that the Base URL is correct (ends with /v1).