OpenClaw

Senast uppdaterad:

På denna sida

Konfigurera OpenClaw med staik för att använda alla modeller direkt via Telegram, Discord eller terminalen.

Konfiguration

Lägg till följande i din openclaw.json:

json
{
  "models": {
    "providers": {
      "staik": {
        "baseUrl": "https://api.staik.se/v1",
        "apiKey": "sk-st-your-key",
        "api": "openai-completions",
        "models": [
          {
            "id": "gemma4:31b",
            "name": "Gemma 4 31B",
            "contextWindow": 262144,
            "contextTokens": 64000,
            "maxTokens": 8192
          },
          {
            "id": "qwen3.6:35b-a3b",
            "name": "Qwen 3.6 35B A3B",
            "contextWindow": 262144,
            "contextTokens": 64000,
            "maxTokens": 8192
          },
          {
            "id": "qwen3.5:9b",
            "name": "Qwen 3.5 9B",
            "contextWindow": 262144,
            "contextTokens": 28000,
            "maxTokens": 4096
          }
        ]
      }
    }
  },
  "agents": {
    "defaults": {
      "model": {
        "primary": "staik/gemma4:31b",
        "fallbacks": ["staik/qwen3.6:35b-a3b", "staik/qwen3.5:9b"]
      },
      "compaction": {
        "mode": "safeguard",
        "keepRecentTokens": 20000,
        "reserveTokens": 24000
      }
    }
  }
}

Växla modell med /models i OpenClaw. fallbacks ger automatisk failover om primärmodellen är otillgänglig. Vilka modeller som passar vilken roll — se Modeller.

Finjustera kontexthantering

ParameterVarBeskrivning
contextTokensper modellMax tokens konversationshistorik per request. Sänk om modellen tar timeout.
maxTokensper modellMax tokens i modellens svar. Sänk om svaren avbryts.
keepRecentTokenscompactionTokens av senaste meddelanden som aldrig komprimeras.
reserveTokenscompactionTokens reserverade för svaret vid komprimering. Höj om svaren kapas.
contextWindowper modellModellens totala kontextfönster (262K för alla chat-modeller).

Snabbdiagnos

Modellen slutar svara mitt i → sänk contextTokens. Svaren kapas → höj reserveTokens. Modellen glömmer det ni just sa → höj keepRecentTokens.

Konfiguration per plan

Varje request räknar både prompt-tokens (historik) och completion-tokens (svar). Nyckeln till att hålla budgeten är contextTokens — den styr hur mycket historik som skickas per request.

json
{
  "models": {
    "providers": {
      "staik": {
        "baseUrl": "https://api.staik.se/v1",
        "apiKey": "sk-st-your-key",
        "api": "openai-completions",
        "models": [
          {
            "id": "qwen3.5:9b",
            "name": "Qwen 3.5 9B",
            "contextWindow": 262144,
            "contextTokens": 12000,
            "maxTokens": 2048
          }
        ]
      }
    }
  },
  "agents": {
    "defaults": {
      "model": { "primary": "staik/qwen3.5:9b" },
      "compaction": {
        "mode": "safeguard",
        "keepRecentTokens": 6000,
        "reserveTokens": 8000,
        "maxHistoryShare": 0.3
      }
    }
  }
}

Tumregler per profil:

ProfilcontextTokensmaxTokensModellKapacitet (ca)
Sparsam (PAYG/EA-pott)12 0002 048qwen3.5:9b~80 requests per 1M tokens
Hobby (250K/dag)24 0004 0969b + 35b~15 rundor/dag
Agent (500K/h rullande)48 0008 192gemma4 + 35b + 9b~10 requests/h

Den snabba 9b-modellen drar minst tokens; maxHistoryShare lågt komprimerar tidigt och sparar budget. Med rullande timfönster (Agent-planerna) räknas tokens från en timme sedan inte längre.

Sub-agenter (ACP)

Vid större projekt (t.ex. en flerfilssajt) bryter OpenClaw upp jobbet i sub-agenter via ACP (Agent Coordination Protocol). Varje sub-agent får isolerad kontext — utan ACP måste main-agenten hålla hela projektets state i varje request (5 filer × 30K kontext = 150K+ tokens på en enda omgång); med ACP kan tokenanvändningen sjunka 70–80 %.

json
{
  "agents": {
    "list": [{
      "id": "<your_agent_id>",
      "runtime": {
        "type": "acp",
        "acp": {
          "agent": "codex",
          "backend": "acpx",
          "mode": "persistent"
        }
      }
    }]
  },
  "session": {
    "threadBindings": {
      "enabled": true,
      "spawnSubagentSessions": true
    }
  }
}

Verifiera i din chat: /acp spawn <agent_id> startar en sub-agent manuellt, /verbose visar i realtid vilka sub-agenter som spawnas och var fel uppstår.

Gateway-kopplingen är stängd?

Felet "Cannot start sub-agent (gateway connection closed)" gäller OpenClaws interna gateway, inte staiks API. Kolla att acpx-backenden är installerad, gateway.mode: "local" är satt, gatewayn kör på rätt port och att inga gamla processer blockerar den. När ACP fallerar gör main-agenten allt själv — hela projektkontexten skickas i varje request och tokens brinner snabbt.

Felsökning

OpenClaw ger inget svar

Stäng av streaming i provider-blocket — vissa kanaler har problem med streaming-svar; utan streaming skickas ett vanligt request som väntar på hela svaret:

json
{
  "models": {
    "providers": {
      "staik": {
        "baseUrl": "https://api.staik.se/v1",
        "apiKey": "sk-st-your-key",
        "api": "openai-completions",
        "streaming": "off",
        "models": ["..."]
      }
    }
  }
}

Agenten frågar "Ska jag köra?" mellan steg

Beteendet kommer från OpenClaws egen agent-prompt, inte från staik. Override:a med en system prompt — per Telegram-grupp via channels.telegram.groups.<chat_id>.systemPrompt, eller globalt via workspace-filerna (~/.openclaw/workspace/IDENTITY.md eller SOUL.md):

text
Du är en autonom agent. Utför ALLA steg i en uppgift i en följd utan att
fråga mellan stegen. Stoppa endast vid (1) explicit fel som kräver beslut,
eller (2) när hela uppgiften är klar.

Andra orsaker: sub-agenten kunde inte starta (se ACP ovan) eller uppgiften kräver mer output än maxTokens — höj till 8192 om budgeten tillåter.

429 mitt i en session

Du har slagit tokengränsen. Sänk contextTokens (64000 → 16000–32000), byt till qwen3.5:9b som primary, eller uppgradera plan — se Felkoder och rate limits. Övervaka i realtid via X-RateLimit-Used-Tokens-headern.