GPT, Claude, Gemini — все модели через единый API. Работает в России без VPN.Начать бесплатно
FAQ

Ошибка: недостаточно средств (предварительная стоимость запроса)

Ответ

Ошибка 402 Недостаточно средств с «прогнозированной ценой запроса» чаще всего связана не с реальным расходом, а с лимитом токенов на ответ.

Что такое max_tokens и max_output_tokens

  • Chat Completions и Messages (Anthropic): параметр max_tokens
  • Responses API: параметр max_output_tokens

Он ограничивает максимум токенов, которые модель может сгенерировать в ответе.

Как работает предварительный расчёт

Перед выполнением запроса AITUNNEL проверяет, хватит ли баланса на худший сценарий: генерацию ответа длиной до указанного лимита (по самой дорогой стоимости токена для модели). Это и есть прогнозированная цена.

Если параметр не указан, система берёт максимум модели — прогноз получается очень большим, хотя вы, скорее всего, столько не потратите.

Что списывается по факту

Итоговая стоимость списывается только за реально сгенерированные токены. Если модель ответила короче лимита, вы платите только за фактический объём.

Что сделать

  1. Укажите max_tokens / max_output_tokens (если ещё не задан) — разумное значение под задачу, например 2048 или 8192.
  2. Или уменьшите уже заданный лимит, если он слишком большой.
  3. Либо пополните баланс, если прогноз соответствует реальной потребности.

После этого повторите запрос.

Быстрый старт с GPT 5

Пример вызова GPT 5 через AITUNNEL API:

from openai import OpenAI

client = OpenAI(
    api_key="ваш_ключ_aitunnel",
    base_url="https://api.aitunnel.ru/v1/"
)

response = client.chat.completions.create(
    model="gpt-5",
    messages=[
        {"role": "user", "content": "Привет! Как дела?"}
    ]
)

print(response.choices[0].message.content)

Похожие вопросы

Попробуйте сами через AITUNNEL

Получите API ключ и протестируйте модели. Работает из России без VPN, оплата в рублях.

Быстрый стартОплата картой РФПоддержка
Начать работуРегистрация за 1 минуту