Felkoder och rate limits

Senast uppdaterad:

På denna sida

Felkoder

KodBeskrivning
400Ogiltig request — t.ex. prompt + max_tokens överskrider modellens kontextfönster
401Ogiltig eller saknad API-nyckel
429Tokengräns överskriden eller alla slots upptagna
503Modellen tillfälligt otillgänglig

Ett 429-svar innehåller detaljer om fönstret och när kvoten frigörs, plus en Retry-After-header:

json
{
  "detail": {
    "message": "Daily token limit exceeded",
    "window": "daily",
    "tokens_used": 250000,
    "tokens_limit": 250000,
    "retry_after_seconds": 3600,
    "reset_at": "2026-08-30T00:00:00+00:00"
  }
}

Hantera 429 och 503 med backoff

Båda är övergående. Respektera Retry-After-headern (eller retry_after_seconds) och försök igen — vid 429 frigörs kvot löpande (rullande timfönster) eller vid midnatt UTC (dagliga gränser), se Planer och kvoter.

Rate limit-headers

Varje svar inkluderar headers som visar din aktuella tokenanvändning:

HeaderBeskrivning
X-RateLimit-Limit-TokensTokengräns för perioden
X-RateLimit-Used-TokensAnvända tokens
X-RateLimit-Remaining-TokensKvarvarande tokens

Tokenvarningar

  • Vid 80 % av kvoten inkluderas ett warning-fält i API-svaret
  • Vid 90 % skickas ett varningsmail (max ett per dygn)

Se din förbrukning i realtid via GET /v1/usage eller i dashboarden.