c28aa4a6a2
Ampel / ampel (push) Successful in 22s
README war auf dem Stand "Final-Version eingefroren" und kannte weder Governor,
Coding-Bahn, CI-Ampel noch den Weg einer Idee. Neu geschrieben mit den echten
Ports/Diensten, den gemessenen Modell-Rollen und den vier Qualitaets-Toren.
Alle Verweise gegen den Baum geprueft.
Dabei aufgefallen: das eigene VERDIKT vom 24.07. ("Devstral bricht beim 32K-Prefill
auf 63 t/s ein") widerlegt meine Begruendung "ein Kritiker liest viel und schreibt
wenig, also stoert die Langsamkeit nicht" — es ist genau das LESEN, das einbricht.
Nachgemessen: Prefill 265-318 t/s (Coder 754). Der Kritiker ist deshalb in
llama-swap UND in beiden opencode.json auf 16384 gedeckelt; schlimmster Fall je
Review jetzt unter einer Minute statt 8+ Minuten.
VERDIKTE um zwei Eintraege ergaenzt: die enge Kritiker-Rolle mit Deckel, und die
llama-swap-Gruppenregel (eine Gruppe resident, persistent:false, OOM-Grenze).
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
89 lines
2.5 KiB
JSON
89 lines
2.5 KiB
JSON
{
|
|
"$schema": "https://opencode.ai/config.json",
|
|
"provider": {
|
|
"aibox": {
|
|
"npm": "@ai-sdk/openai-compatible",
|
|
"name": "AI-Box ueber Governor (192.168.178.151:8100)",
|
|
"options": {
|
|
"baseURL": "http://192.168.178.151:8100/v1",
|
|
"apiKey": "local"
|
|
},
|
|
"models": {
|
|
"heavy": {
|
|
"name": "heavy — Planer (gpt-oss-120b, 32k)",
|
|
"limit": {
|
|
"context": 32768,
|
|
"output": 8192
|
|
}
|
|
},
|
|
"coder": {
|
|
"name": "coder — Bauen (Qwen3-Coder-Next, 131k)",
|
|
"limit": {
|
|
"context": 131072,
|
|
"output": 16384
|
|
}
|
|
},
|
|
"hermes": {
|
|
"name": "hermes — Erkunden (Qwen3.6, immer warm, 69,6 t/s)",
|
|
"limit": {
|
|
"context": 65536,
|
|
"output": 8192
|
|
}
|
|
},
|
|
"kritiker": {
|
|
"name": "kritiker — Gegenlesen (Devstral-2, Mistral, 16k gedeckelt)",
|
|
"limit": {
|
|
"context": 16384,
|
|
"output": 4096
|
|
}
|
|
}
|
|
}
|
|
}
|
|
},
|
|
"model": "aibox/coder",
|
|
"small_model": "aibox/hermes",
|
|
"agent": {
|
|
"plan": {
|
|
"model": "aibox/coder",
|
|
"permission": {
|
|
"edit": "deny",
|
|
"bash": "deny"
|
|
}
|
|
},
|
|
"build": {
|
|
"model": "aibox/coder",
|
|
"permission": {
|
|
"edit": "allow",
|
|
"webfetch": "allow",
|
|
"bash": {
|
|
"*": "allow",
|
|
"ssh *": "deny",
|
|
"scp *": "deny",
|
|
"sftp *": "deny",
|
|
"ssh arcane@192.168.178.162 *": "allow",
|
|
"ssh -o StrictHostKeyChecking=no arcane@192.168.178.162 *": "allow",
|
|
"scp *arcane@192.168.178.162*": "allow"
|
|
}
|
|
}
|
|
},
|
|
"explore": {
|
|
"mode": "subagent",
|
|
"description": "Codebase schnell durchsuchen, Dateien finden, Fragen zum Code beantworten — nur lesen, läuft auf dem immer warmen Hirn",
|
|
"model": "aibox/hermes",
|
|
"permission": {
|
|
"edit": "deny",
|
|
"bash": "deny"
|
|
}
|
|
},
|
|
"review": {
|
|
"mode": "subagent",
|
|
"description": "Kritischer Code-Review nach jeder Etappe (Pflicht laut AGENTS.md): sucht erfundene APIs/CLI-Flags, stille Abweichungen vom KONZEPT, fehlende Tests, toten Code — meldet Befunde, ändert nichts. Läuft bewusst auf einer FREMDEN Modellfamilie (Mistral/Devstral statt Qwen), damit er andere blinde Flecken hat als der Coder.",
|
|
"model": "aibox/kritiker",
|
|
"permission": {
|
|
"edit": "deny",
|
|
"bash": "deny"
|
|
}
|
|
}
|
|
}
|
|
}
|