OpenClaw
Senast uppdaterad:
På denna sida
Konfigurera OpenClaw med staik för att använda alla modeller direkt via Telegram, Discord eller terminalen.
Konfiguration
Lägg till följande i din openclaw.json:
{
"models": {
"providers": {
"staik": {
"baseUrl": "https://api.staik.se/v1",
"apiKey": "sk-st-your-key",
"api": "openai-completions",
"models": [
{
"id": "gemma4:31b",
"name": "Gemma 4 31B",
"contextWindow": 262144,
"contextTokens": 64000,
"maxTokens": 8192
},
{
"id": "qwen3.6:35b-a3b",
"name": "Qwen 3.6 35B A3B",
"contextWindow": 262144,
"contextTokens": 64000,
"maxTokens": 8192
},
{
"id": "qwen3.5:9b",
"name": "Qwen 3.5 9B",
"contextWindow": 262144,
"contextTokens": 28000,
"maxTokens": 4096
}
]
}
}
},
"agents": {
"defaults": {
"model": {
"primary": "staik/gemma4:31b",
"fallbacks": ["staik/qwen3.6:35b-a3b", "staik/qwen3.5:9b"]
},
"compaction": {
"mode": "safeguard",
"keepRecentTokens": 20000,
"reserveTokens": 24000
}
}
}
}Växla modell med /models i OpenClaw. fallbacks ger automatisk failover om
primärmodellen är otillgänglig. Vilka modeller som passar vilken roll — se
Modeller.
Finjustera kontexthantering
| Parameter | Var | Beskrivning |
|---|---|---|
contextTokens | per modell | Max tokens konversationshistorik per request. Sänk om modellen tar timeout. |
maxTokens | per modell | Max tokens i modellens svar. Sänk om svaren avbryts. |
keepRecentTokens | compaction | Tokens av senaste meddelanden som aldrig komprimeras. |
reserveTokens | compaction | Tokens reserverade för svaret vid komprimering. Höj om svaren kapas. |
contextWindow | per modell | Modellens totala kontextfönster (262K för alla chat-modeller). |
Snabbdiagnos
Modellen slutar svara mitt i → sänk contextTokens. Svaren kapas → höj
reserveTokens. Modellen glömmer det ni just sa → höj keepRecentTokens.
Konfiguration per plan
Varje request räknar både prompt-tokens (historik) och completion-tokens
(svar). Nyckeln till att hålla budgeten är contextTokens — den styr hur
mycket historik som skickas per request.
{
"models": {
"providers": {
"staik": {
"baseUrl": "https://api.staik.se/v1",
"apiKey": "sk-st-your-key",
"api": "openai-completions",
"models": [
{
"id": "qwen3.5:9b",
"name": "Qwen 3.5 9B",
"contextWindow": 262144,
"contextTokens": 12000,
"maxTokens": 2048
}
]
}
}
},
"agents": {
"defaults": {
"model": { "primary": "staik/qwen3.5:9b" },
"compaction": {
"mode": "safeguard",
"keepRecentTokens": 6000,
"reserveTokens": 8000,
"maxHistoryShare": 0.3
}
}
}
}Tumregler per profil:
| Profil | contextTokens | maxTokens | Modell | Kapacitet (ca) |
|---|---|---|---|---|
| Sparsam (PAYG/EA-pott) | 12 000 | 2 048 | qwen3.5:9b | ~80 requests per 1M tokens |
| Hobby (250K/dag) | 24 000 | 4 096 | 9b + 35b | ~15 rundor/dag |
| Agent (500K/h rullande) | 48 000 | 8 192 | gemma4 + 35b + 9b | ~10 requests/h |
Den snabba 9b-modellen drar minst tokens; maxHistoryShare lågt komprimerar
tidigt och sparar budget. Med rullande timfönster (Agent-planerna) räknas
tokens från en timme sedan inte längre.
Sub-agenter (ACP)
Vid större projekt (t.ex. en flerfilssajt) bryter OpenClaw upp jobbet i sub-agenter via ACP (Agent Coordination Protocol). Varje sub-agent får isolerad kontext — utan ACP måste main-agenten hålla hela projektets state i varje request (5 filer × 30K kontext = 150K+ tokens på en enda omgång); med ACP kan tokenanvändningen sjunka 70–80 %.
{
"agents": {
"list": [{
"id": "<your_agent_id>",
"runtime": {
"type": "acp",
"acp": {
"agent": "codex",
"backend": "acpx",
"mode": "persistent"
}
}
}]
},
"session": {
"threadBindings": {
"enabled": true,
"spawnSubagentSessions": true
}
}
}Verifiera i din chat: /acp spawn <agent_id> startar en sub-agent manuellt,
/verbose visar i realtid vilka sub-agenter som spawnas och var fel uppstår.
Gateway-kopplingen är stängd?
Felet "Cannot start sub-agent (gateway connection closed)" gäller OpenClaws
interna gateway, inte staiks API. Kolla att acpx-backenden är installerad,
gateway.mode: "local" är satt, gatewayn kör på rätt port och att inga gamla
processer blockerar den. När ACP fallerar gör main-agenten allt själv — hela
projektkontexten skickas i varje request och tokens brinner snabbt.
Felsökning
OpenClaw ger inget svar
Stäng av streaming i provider-blocket — vissa kanaler har problem med streaming-svar; utan streaming skickas ett vanligt request som väntar på hela svaret:
{
"models": {
"providers": {
"staik": {
"baseUrl": "https://api.staik.se/v1",
"apiKey": "sk-st-your-key",
"api": "openai-completions",
"streaming": "off",
"models": ["..."]
}
}
}
}Agenten frågar "Ska jag köra?" mellan steg
Beteendet kommer från OpenClaws egen agent-prompt, inte från staik. Override:a
med en system prompt — per Telegram-grupp via
channels.telegram.groups.<chat_id>.systemPrompt, eller globalt via
workspace-filerna (~/.openclaw/workspace/IDENTITY.md eller SOUL.md):
Du är en autonom agent. Utför ALLA steg i en uppgift i en följd utan att
fråga mellan stegen. Stoppa endast vid (1) explicit fel som kräver beslut,
eller (2) när hela uppgiften är klar.Andra orsaker: sub-agenten kunde inte starta (se ACP ovan) eller uppgiften
kräver mer output än maxTokens — höj till 8192 om budgeten tillåter.
429 mitt i en session
Du har slagit tokengränsen. Sänk contextTokens (64000 → 16000–32000), byt
till qwen3.5:9b som primary, eller uppgradera plan — se
Felkoder och rate limits. Övervaka i realtid via
X-RateLimit-Used-Tokens-headern.