Перейти к содержимому
AI Gateway

Аккаунт и лимиты

GET /v1/key и GET /v1/generation в Clipia AI Gateway — проверка лимитов и расхода ключа, точная стоимость запроса, заголовки rate-limit и ответ 429.

Clipia AI Gateway даёт OpenAI-совместимые эндпоинты для контроля ключа и расходов: GET /v1/key — лимиты и использование ключа, GET /v1/generation — фактическая стоимость конкретного запроса. Биллинг идёт в кредитах с баланса аккаунта.

Информация о ключе (GET /v1/key)

GET/v1/key
curl https://api.clipia.ai/v1/key \
  -H "Authorization: Bearer $CLIPIA_API_KEY"

Ответ 200

{
  "data": {
    "label": "prod key",
    "usage": 1240.5,
    "limit": null,
    "limit_remaining": null,
    "rate_limit": { "requests": 120, "interval": "1m" }
  }
}

Prop

Type

Стоимость запроса (GET /v1/generation)

Передайте id из ответа чата (chatcmpl-…), чтобы получить фактическую стоимость и расход токенов уже выполненного запроса.

GET/v1/generation?id={id}
curl "https://api.clipia.ai/v1/generation?id=chatcmpl-3f9a1c7e2b41" \
  -H "Authorization: Bearer $CLIPIA_API_KEY"

Ответ 200

{
  "data": {
    "id": "chatcmpl-3f9a1c7e2b41",
    "model": "claude-opus-5",
    "provider_name": "Clipia",
    "streamed": false,
    "total_cost": 0.046,
    "tokens_prompt": 28,
    "tokens_completion": 64,
    "finish_reason": "stop",
    "created_at": "2026-06-26T12:00:00Z"
  }
}

total_cost — фактическая стоимость запроса в кредитах. Это удобно для аудита расходов по каждому вызову независимо от поля usage в ответе чата.

Лимиты

Каждый ключ ограничен по числу запросов в минуту (RPM, по умолчанию 120) и, опционально, по числу токенов в минуту (TPM) и бюджету в кредитах. При превышении RPM/TPM запрос отклоняется с 429, при исчерпании бюджета — с 402.

Заголовки ответа

Prop

Type

Ответ 429

HTTP/1.1 429 Too Many Requests
Retry-After: 12
Content-Type: application/json
{
  "error": {
    "message": "Превышен лимит запросов. Повторите позже.",
    "type": "rate_limit_error",
    "param": null,
    "code": "rate_limit_exceeded"
  }
}

Соблюдайте Retry-After

При 429 подождите столько секунд, сколько указано в Retry-After, и только потом повторяйте — это надёжнее фиксированной задержки. Лимиты ключа можно поднять в консоли разработчика.

Сверьте с боевым ответом

Точная форма ответов GET /v1/key и GET /v1/generation, а также набор заголовков rate-limit могут отличаться — сверяйте с боевым API. Значения лимитов настраиваются на ключ.