Org-compute (BYO)
Senast uppdaterad:
På denna sida
GET /v1/org/compute returnerar hela organisationens compute-stack i ett enda
anrop: GPU:erna ni själva kopplat in (BYO), den delade staik-fleet ni kan nå, hur
era tokens fördelas mellan de två, och vad era egna noder kostar. Det är en ren
läs-overview — den ändrar aldrig routing eller fakturering.
GET https://api.staik.se/v1/org/computeAutentisering och scope
Skicka en org-scopad API-nyckel som Bearer-token (se
autentisering). Allt är scopat till er egen
organisation — ni kan aldrig se en annan orgs noder. En owner ser hela
organisationens token-split; en medlem ser bara sin egen andel. En nyckel
utan organisation returnerar 404.
Anrop
import httpx
r = httpx.get(
"https://api.staik.se/v1/org/compute",
headers={"Authorization": "Bearer sk-st-din-nyckel"},
)
print(r.json()["own_gpus"]["online_count"])Valfri query-parameter since (ISO-8601) begränsar token-splitten till ett
tidsfönster, t.ex. ?since=2026-09-01T00:00:00Z.
Svar
{
"org": {
"id": "…",
"name": "Acme AB",
"slug": "acme",
"status": "active",
"shared_pool_fallback": false
},
"own_gpus": {
"nodes": [
{
"id": "…",
"hostname": "cust-acme-0",
"base_url": "http://cust-acme-0:8000",
"engine": "vllm",
"served_model": "qwen3.5:9b",
"num_ctx": 65536,
"status": "online",
"last_seen_at": "2026-09-01T09:12:04Z",
"last_heartbeat_model": "qwen3.5:9b",
"online": true
}
],
"online_count": 1,
"total_count": 1,
"models": ["qwen3.5:9b"],
"total_context": 65536,
"billing": {
"price_per_gpu_sek": 99,
"billable_nodes": 1,
"monthly_cost_sek": 99
}
},
"shared_fleet": {
"fallback_enabled": false,
"models": [
{ "id": "qwen3.6:35b-a3b", "context_window": 262144, "capabilities": ["chat", "tools"], "owned_by": "staik" },
{ "id": "gemma4:31b", "context_window": 262144, "capabilities": ["chat", "vision", "tools"], "owned_by": "staik" }
]
},
"usage": {
"own_gpu_tokens": 1000,
"staik_tokens": 400,
"requests": 5,
"role": "owner"
}
}Fält
| Fält | Beskrivning |
|---|---|
org | Er organisation: id, namn, slug, status (active/suspended) och shared_pool_fallback. |
own_gpus.nodes[] | Era inkopplade GPU-noder. online härleds (se nedan); served_model är vad noden är konfigurerad att serva, last_heartbeat_model vad den senast rapporterade. |
own_gpus.online_count / total_count | Hur många av era noder som är online kontra registrerade totalt. |
own_gpus.models | Distinkta modeller era online-noder just nu servar. |
own_gpus.total_context | Största kontextfönstret (tokens) över era online-noder. |
own_gpus.billing | Per-GPU-fakturering: pris per GPU, antal debiterbara (icke-disabled) noder och resulterande månadskostnad. |
shared_fleet.fallback_enabled | Om organisationen valt att falla tillbaka till den delade poolen när ingen egen nod är frisk. |
shared_fleet.models[] | Modellerna ni kan nå på staiks delade hårdvara. Se hela tabellen under Modeller. |
usage | Token-split för fönstret: own_gpu_tokens (ometrat, er hårdvara) kontra staik_tokens (metrat), plus requests och er role. |
När är en nod online?
En nod räknas som online när status är online och den heartbeatat de
senaste 90 sekunderna. Om agenten tystnar rapporteras noden som offline även om
senast lagrade status var online, så overviewen speglar alltid faktisk nåbarhet.
Egen GPU kontra delad fleet
usage-splitten speglar hur routingen metras (se BYO-körfältet under
Modeller):
- Egen GPU (ometrat) — ett anrop som använde prefixet
<org_slug>/<model>kördes på er egen hårdvara och räknas motown_gpu_tokens. - staiks delade fleet (metrat) — ett bart modellnamn kördes på staiks delade
pool och räknas mot
staik_tokens, mot er plan.
staik lagrar bara användningsräknare för fakturering, aldrig innehållet i era
anrop (se BYO-säkerhet). För att följa rå
förbrukning över tid, använd GET /v1/usage.
Relaterat
- Koppla in din egen GPU — provisionera en nod
- Modeller — den delade fleet:en + det ometrade BYO-körfältet
- Dina GPU:er — hantera noder och medlemmar i dashboarden
- Fel — statuskoder och
GET /v1/usage