Felkoder och rate limits
Senast uppdaterad:
På denna sida
Felkoder
| Kod | Beskrivning |
|---|---|
| 400 | Ogiltig request — t.ex. prompt + max_tokens överskrider modellens kontextfönster |
| 401 | Ogiltig eller saknad API-nyckel |
| 429 | Tokengräns överskriden eller alla slots upptagna |
| 503 | Modellen tillfälligt otillgänglig |
Ett 429-svar innehåller detaljer om fönstret och när kvoten frigörs, plus en
Retry-After-header:
json
{
"detail": {
"message": "Daily token limit exceeded",
"window": "daily",
"tokens_used": 250000,
"tokens_limit": 250000,
"retry_after_seconds": 3600,
"reset_at": "2026-08-30T00:00:00+00:00"
}
}Hantera 429 och 503 med backoff
Båda är övergående. Respektera Retry-After-headern (eller
retry_after_seconds) och försök igen — vid 429 frigörs kvot löpande
(rullande timfönster) eller vid midnatt UTC (dagliga gränser), se
Planer och kvoter.
Rate limit-headers
Varje svar inkluderar headers som visar din aktuella tokenanvändning:
| Header | Beskrivning |
|---|---|
| X-RateLimit-Limit-Tokens | Tokengräns för perioden |
| X-RateLimit-Used-Tokens | Använda tokens |
| X-RateLimit-Remaining-Tokens | Kvarvarande tokens |
Tokenvarningar
- Vid 80 % av kvoten inkluderas ett
warning-fält i API-svaret - Vid 90 % skickas ett varningsmail (max ett per dygn)
Se din förbrukning i realtid via GET /v1/usage eller i
dashboarden.