Modeller

Senast uppdaterad:

På denna sida

Välj modell via model-fältet i din request. Varje modell kör på dedikerad GPU-hårdvara i Sverige.

ModellTillverkareParametrarKontextfönsterVision
qwen3.6:35b-a3bAlibaba35B MoE262 144
qwen3.5:9bAlibaba9.7B262 144
gemma4:31bGoogle DeepMind31B262 144
bge-m3:latestBAAI568M8 192embedding
kb-whisper-largeKungliga biblioteket1.5Baudio (sv)

qwen3.5:35b-a3b accepteras som bakåtkompatibelt alias för qwen3.6:35b-a3b.

Alla chat-modeller stödjer streaming och tool calling. Endast gemma4:31b har vision (16K kontextfönster för vision-anrop). Thinking-aliasen (qwen3.6:35b-a3b-thinking, qwen3.5:9b-thinking) beskrivs under Chat completions.

Modellerna är öppna vikter som vi hostar på egen hårdvara. KB-Whisper är den enda modellen vi kör som är tränad i Sverige.

Lista modeller programmatiskt

bash
curl https://api.staik.se/v1/models \
  -H "Authorization: Bearer sk-st-your-key"
json
{
  "data": [
    {
      "id": "qwen3.6:35b-a3b",
      "object": "model",
      "owned_by": "staik",
      "context_window": 262144,
      "capabilities": ["chat", "tools"]
    }
  ]
}

Svaret inkluderar context_window och capabilities per modell — användbart för klienter som konfigurerar sig själva.

Egna GPU:er (BYO): ometrat körfält

Har din organisation kopplat upp egna GPU:er (Dina GPU:er) väljer du körfält på modellnamnet:

  • Prefixat<org_slug>/<modell> kör ometrat mot er egen hårdvara (ingen dygns-/timgräns, inget tokenavdrag)
  • Bart modellnamn går till staiks delade pool och metras mot din plan
bash
# Ometrat: kör mot organisationens egen GPU (prefix = din org-slug)
curl https://api.staik.se/v1/chat/completions \
  -H "Authorization: Bearer $STAIK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "acme/qwen3.8:27b", "messages": [{"role": "user", "content": "Hej"}]}'

Har er org ingen frisk egen nod för modellen returneras 503 — ingen tyst fallback till staik. GET /v1/models listar era prefixade modeller. Prefixet fungerar likadant på /v1/chat/completions och /v1/messages.