Compare commits
64 Commits
| Author | SHA1 | Date | |
|---|---|---|---|
| 76d2d7c74b | |||
| 7638f0244d | |||
| 4985977492 | |||
| f65ff48599 | |||
| 87f446c5ae | |||
| f524ef4375 | |||
| 605c9d7dd1 | |||
| 9791f44644 | |||
| 1e3e0066af | |||
| 2365f7aac6 | |||
| 56b374a0aa | |||
| eef7fdb4df | |||
| cd60974ff9 | |||
| 20d4f40ed9 | |||
| cb649aac34 | |||
| d18aac0e1b | |||
| 6c14705798 | |||
| 991c9a2f82 | |||
| ad49dd65ca | |||
| c28aa4a6a2 | |||
| 8b76c0f749 | |||
| a934deee41 | |||
| 543eee95d0 | |||
| 59d6be8c4a | |||
| 7fac17ed9a | |||
| 00f2b71a63 | |||
| 2cecd06c5b | |||
| 775e862652 | |||
| 47f7a85510 | |||
| e6502f676a | |||
| 554c87aaee | |||
| 798de0be8f | |||
| c13cfd2bd0 | |||
| 080eaa5ff5 | |||
| 7dd44a3630 | |||
| 554db10a6f | |||
| ce030d6817 | |||
| 8996c0d012 | |||
| a1de1ec2ac | |||
| 8e735df32d | |||
| 057cc2bb47 | |||
| e686f95545 | |||
| 8a90b7507e | |||
| 59b09e4a9a | |||
| 5894c24703 | |||
| 3f279fc7f2 | |||
| af28a75338 | |||
| a121ca7dc0 | |||
| cce32810fc | |||
| 682be9b63b | |||
| 96c4e417ec | |||
| 90ab873924 | |||
| 6d3a0bf3a6 | |||
| c3fe6dbe8d | |||
| 584f257853 | |||
| 73513f5e5b | |||
| 18f5522612 | |||
| 0cea01c699 | |||
| 94dc3fba9b | |||
| 3cdd5cdd10 | |||
| 9307c8b752 | |||
| 204238925a | |||
| a16cff39ce | |||
| 11c3416571 |
@@ -11,6 +11,10 @@
|
|||||||
# sonst bricht `#!/usr/bin/env python3\r`. (Nur die Hooks + Deploy-Helfer, nicht der ganze Baum.)
|
# sonst bricht `#!/usr/bin/env python3\r`. (Nur die Hooks + Deploy-Helfer, nicht der ganze Baum.)
|
||||||
deploy/agent-hooks/*.py text eol=lf
|
deploy/agent-hooks/*.py text eol=lf
|
||||||
deploy/*.py text eol=lf
|
deploy/*.py text eol=lf
|
||||||
|
# `deploy/*.py` greift NUR eine Ebene tief (* matcht kein /). Alles darunter
|
||||||
|
# (z. B. deploy/governor/governor.py) braucht ein eigenes Muster — sonst kommt es
|
||||||
|
# nach einem Windows-Checkout mit CRLF zurück und der Shebang auf der Box bricht.
|
||||||
|
deploy/**/*.py text eol=lf
|
||||||
|
|
||||||
# Windows-Batch-Wrapper bleiben CRLF.
|
# Windows-Batch-Wrapper bleiben CRLF.
|
||||||
*.cmd text eol=crlf
|
*.cmd text eol=crlf
|
||||||
|
|||||||
@@ -0,0 +1,53 @@
|
|||||||
|
# Ampel-CI fuer MC2 — auf dieses Multi-Service-Monorepo zugeschnitten (24.07.2026).
|
||||||
|
#
|
||||||
|
# Die universelle Vorlage (deploy/ampel-ci.yml) passt fuer EIN-Service-Repos. MC2 hat
|
||||||
|
# 5 Python-Dienste (backend/voice_service/mem0_service/mcp/client) mit schweren ML-
|
||||||
|
# Abhaengigkeiten (Whisper/TTS/Embeddings) + ein Frontend. "pip install ALLER requirements
|
||||||
|
# + pytest repo-weit" in einem stateless Container ist weder machbar (GB-schwere Wheels,
|
||||||
|
# CUDA) noch aussagekraeftig — die echten Tests sind der Pruefstand (deploy/pruefstand)
|
||||||
|
# und die Integration auf der Box mit LIVE-Diensten/Modellen, nicht isolierte Unit-Tests.
|
||||||
|
#
|
||||||
|
# Darum prueft die MC2-Ampel, was im Container EHRLICH gruen sein kann und trotzdem echte
|
||||||
|
# Fehler faengt: Lint (ruff, Projekt-Politik in ruff.toml) + Import/Syntax (compileall) +
|
||||||
|
# Frontend-Build inkl. TypeScript-Typecheck (tsc). Rot ist ein Ergebnis, kein Aergernis.
|
||||||
|
name: Ampel
|
||||||
|
on: [push, pull_request]
|
||||||
|
|
||||||
|
jobs:
|
||||||
|
ampel:
|
||||||
|
runs-on: ubuntu-latest
|
||||||
|
steps:
|
||||||
|
- uses: actions/checkout@v4
|
||||||
|
|
||||||
|
- name: Ampel — Lint + Import + Frontend-Build (MC2-Zuschnitt)
|
||||||
|
shell: bash
|
||||||
|
run: |
|
||||||
|
# Runner-bash laeuft mit -e; abschalten und JEDEN Fehler selbst werten (rot=1),
|
||||||
|
# am Ende EIN Klartext-Urteil (Lehre Ampel-Lauf #5).
|
||||||
|
set -u +e
|
||||||
|
rot=0
|
||||||
|
|
||||||
|
echo "== Python: Lint (ruff, Projekt-Politik aus ruff.toml) =="
|
||||||
|
python3 -m venv /tmp/ampel-venv && . /tmp/ampel-venv/bin/activate || { echo "❌ venv kaputt"; exit 1; }
|
||||||
|
pip install -q ruff || { echo "❌ ruff-Install kaputt"; exit 1; }
|
||||||
|
ruff check . || rot=1
|
||||||
|
|
||||||
|
echo "== Python: Import/Syntax (compileall) =="
|
||||||
|
python3 -m compileall -q backend voice_service mem0_service mcp client deploy hermes scripts || rot=1
|
||||||
|
|
||||||
|
echo "== Frontend: reproduzierbarer Build (npm ci + tsc + vite) =="
|
||||||
|
if [ -f frontend/package.json ]; then
|
||||||
|
if [ ! -f frontend/package-lock.json ]; then
|
||||||
|
echo "❌ frontend/: kein package-lock.json — Build nicht reproduzierbar."
|
||||||
|
rot=1
|
||||||
|
else
|
||||||
|
( cd frontend && npm ci --no-audit --no-fund && npm run build ) || rot=1
|
||||||
|
fi
|
||||||
|
fi
|
||||||
|
|
||||||
|
if [ $rot -ne 0 ]; then
|
||||||
|
echo "❌ AMPEL ROT — nichts heißt ‚fertig', solange das rot ist."
|
||||||
|
else
|
||||||
|
echo "✅ AMPEL GRÜN — Lint + Import + Frontend-Build sauber."
|
||||||
|
fi
|
||||||
|
exit $rot
|
||||||
@@ -20,3 +20,6 @@ frontend/dist/avatar.vrm
|
|||||||
box_recon*
|
box_recon*
|
||||||
gemma_swap*
|
gemma_swap*
|
||||||
|
|
||||||
|
# TypeScript-Inkrementalcache (reines Build-Artefakt, maschinenabhängig)
|
||||||
|
frontend/tsconfig.tsbuildinfo
|
||||||
|
|
||||||
|
|||||||
@@ -1,72 +1,150 @@
|
|||||||
# Mission Control 2.0
|
# Mission Control 2.0
|
||||||
|
|
||||||
Komponierbarer Local-AI-Stack für den Bosgame M5 (Strix Halo). Läuft **live auf der Box**
|
Steuerzentrale des lokalen KI-Stacks auf dem **Bosgame M5** (AMD Ryzen AI MAX+ 395 „Strix Halo",
|
||||||
als sudo-freier systemd-User-Dienst (`:9001`) und ist als **Final-Version eingefroren** —
|
122 GB Unified Memory, **keine dedizierte GPU** — llama.cpp über **Vulkan/RADV**). Läuft live als
|
||||||
Pflege übernehmen ab jetzt die selbst-wartenden Box-KIs (Auto-Update mit Fangnetz + die
|
sudo-freier systemd-User-Dienst und ist auf **Autonomie** ausgelegt: Die Box wartet sich selbst,
|
||||||
„Werkstatt"), nicht mehr manuelle Releases.
|
prüft sich selbst und meldet sich, wenn etwas nicht stimmt.
|
||||||
|
|
||||||
**Schichten:** Engine (llama.cpp **Vulkan/RADV** auf Strix Halo) · Router (**llama-swap**,
|
> **100 % lokal.** Kein Cloud-Modell, kein externer Dienst im Datenpfad.
|
||||||
Ko-Residenz-Warm-Set) · **Builtin-Routing-Gateway** in MC2 (`model: auto`, kein externer
|
|
||||||
LiteLLM — scheitert auf Python 3.14) · Mission Control 2.0 (FastAPI + React/shadcn) ·
|
|
||||||
**Hermes Agent** (api_server-Gateway :8642, Tools/MCP/Telegram/cron) · auto-lernendes
|
|
||||||
**Gedächtnis** (Mem0-Sidecar, semantisch). Jede Schicht hinter stabilem Vertrag austauschbar.
|
|
||||||
|
|
||||||
> **Sprachassistentin Lucy** (Voice + 3D-Avatar) ist in ein **eigenes Repo** ausgelagert
|
## Die drei Bahnen
|
||||||
> (`Hitonabi/lucy`) und spricht über den Hermes-Gateway. Aus MC2 selbst sind die Voice-/
|
|
||||||
> Web-Reste entfernt — MC2 ist die Steuerzentrale, kein Sprach-Frontend.
|
|
||||||
|
|
||||||
## Status: **live + eingefroren (MC2 Final)**
|
| Bahn | Was sie tut | Wo |
|
||||||
|
|---|---|---|
|
||||||
|
| **Steuerzentrale** | Modelle, Routing, Wartung, Gedächtnis, Ideen-Queue, Auftragsbuch | MC2 `:9001` |
|
||||||
|
| **Coding** | Zed + OpenCode am Tag, `opencode-lauf.sh` in der Nacht — **ein Regelwerk, zwei Auslöser** | Governor `:8100` |
|
||||||
|
| **Lucy** | Sprach-Companion mit 3D-Avatar, Augen und Ohren | eigenes Repo `Hitonabi/lucy` |
|
||||||
|
|
||||||
Der ganze Stack ist auf der Box in Betrieb und auf **Autonomie** ausgelegt (Ziel: läuft auch
|
Lucy holt ihr Hirn über MC2, spricht aber nie durch den Governor — ein Gespräch ist keine
|
||||||
ohne Betreuung monatelang weiter):
|
Bau-Sitzung und wird nie unterbrochen.
|
||||||
|
|
||||||
- **Modelle & Routing** — Discover (live HF + Fit/Caps), Engine-Write (register, `groups`/
|
## Ports & Dienste
|
||||||
Ko-Residenz, vocab-geprüfte Spec-Drafts), Gateway `model: auto` + Fallbacks.
|
|
||||||
- **System & Wartung** — Status (CPU/RAM/GPU/Disk), **ehrliche Speicher-Zahlen** (echte KV-Bytes
|
|
||||||
aus GGUF-Architektur), Logs mit Fehler-Filter, Dienst-Neustart (sudo-frei).
|
|
||||||
- **Updates mit Fangnetz** — OS/Engine/Router/Hermes per Timer: Backup → Update → Postcheck →
|
|
||||||
bei Fehler **Auto-Rollback + Pin**; verständliche Zusammenfassung („Musst du etwas tun?") in
|
|
||||||
Lucys Stimme. Eigene Software wird eingefroren, nicht geupdatet.
|
|
||||||
- **Gedächtnis** — Mem0-Sidecar (auto-lernend, semantisch), 4 Kategorien, Auto-Dedupe.
|
|
||||||
- **Selbsterhaltung** — Health-Wächter (`sentry`), Warm-Set-Wächter (`warmer`), tägliche
|
|
||||||
Self-Smokes, Lucy-Watchdog + Alarmkette; **Werkstatt** (Hermes wartet den Stack via Gitea-
|
|
||||||
Branch → Gate → Deploy selbst).
|
|
||||||
|
|
||||||
API: `health · models · discover · fit · models/register · groups · routing · system/* ·
|
| Port | Dienst | Erreichbar |
|
||||||
maintenance/* · connect · memory/* · agent/* · voice/announce · reminders/*`. MCP: `mcp/`.
|
|---|---|---|
|
||||||
Box-Runbooks: [`docs/HERMES_SETUP.md`](docs/HERMES_SETUP.md), [`docs/RUNBOOK.md`](docs/RUNBOOK.md),
|
| `9001` | **MC2** (FastAPI + React) — Cockpit, API, Konsole | LAN |
|
||||||
[`docs/BEDIENUNG.md`](docs/BEDIENUNG.md) + `deploy/` (Units, `deploy.sh`, `backup.sh`, `warmup.sh`).
|
| `8100` | **Governor** — Token-Wächter vor dem Gateway | LAN |
|
||||||
|
| `8080` | **llama-swap** — Modell-Router | LAN |
|
||||||
|
| `9010` | `mc2-gateway` — `/v1`-Datenpfad (`model: auto`, Bild-Weiche) | loopback |
|
||||||
|
| `8642` · `9119` | Hermes-Gateway · Hermes-Web-UI | loopback |
|
||||||
|
| `8765` · `8650` | Mem0-Sidecar · Voice-Sidecar (STT/TTS) | loopback |
|
||||||
|
| `7682` | ttyd — Box-Konsole, same-origin unter `/console/` | loopback |
|
||||||
|
|
||||||
|
Units in [`deploy/`](deploy/): `mission-control-2` · `mc2-gateway` · `mc2-steward` · `governor` ·
|
||||||
|
`mem0-service` · `voice-service` · `box-console` · `hermes-builtin-ui` + Timer für Backup,
|
||||||
|
Auto-Update, Self-Smoke und Bagatell-Annahme. `llama-swap` läuft als System-Unit.
|
||||||
|
|
||||||
|
## Der Weg einer Idee
|
||||||
|
|
||||||
|
```
|
||||||
|
Idee in MC2 → Gitea-Repo (mit CI-Ampel + VERIFY) → in Zed bauen → Ampel → main
|
||||||
|
└── oder nachts: Hermes-Cron → opencode-lauf.sh → dieselben Regeln
|
||||||
|
```
|
||||||
|
|
||||||
|
Jedes neue Repo wird von [`deploy/gitea-repo-create.sh`](deploy/gitea-repo-create.sh) **mit beiden
|
||||||
|
Wächtern geboren**:
|
||||||
|
|
||||||
|
- **`.gitea/workflows/ci.yml`** — die Außen-Prüfung nach dem Push (Gitea Actions)
|
||||||
|
- **`VERIFY`** — die Innen-Prüfung: eine Zeile, wie man das Projekt testet. Das OpenCode-Plugin
|
||||||
|
führt sie nach jeder Etappe aus und gibt rote Tests dem Agenten **sofort** zurück, statt sie
|
||||||
|
erst der CI zu zeigen. Keine `VERIFY`-Datei = Prüf-Tor aus.
|
||||||
|
|
||||||
|
## Modelle & Rollen
|
||||||
|
|
||||||
|
Gemessen auf der Box (25.07.2026, Vulkan, Q4):
|
||||||
|
|
||||||
|
| Rolle | Modell | Tempo | Aufgabe |
|
||||||
|
|---|---|---|---|
|
||||||
|
| `coder` | Qwen3-Coder-Next (80B-A3B) | **51,5 t/s** · Prefill **754 t/s** | Plant und baut — Kopf der Coding-Mannschaft |
|
||||||
|
| `hermes` / `fast` | Qwen3.6-35B-A3B | **69,6 t/s** | Lucys Hirn **und** der Sucher-Subagent. Immer warm |
|
||||||
|
| `kritiker` | Devstral-Small-2-24B | **15,0 t/s** · Prefill **265–318 t/s** | Liest gegen — bewusst **fremde Modellfamilie** (Mistral statt Qwen) |
|
||||||
|
| `vision` | Qwen3-VL-30B-A3B | auf Abruf | Lucys Augen |
|
||||||
|
| `heavy` | gpt-oss-120b | nur nachts | Chef-Gutachter (4:30). **Nie tagsüber** — verdrängt das warme Set |
|
||||||
|
| `embed` · `reranker` | Qwen3 0.6B | immer warm | Gedächtnis + Feinsortierung |
|
||||||
|
|
||||||
|
‼️ **Der Kritiker ist bewusst auf 16k Kontext gedeckelt.** Devstral ist ein *dichtes* Modell —
|
||||||
|
auf dieser bandbreitenbegrenzten Box bricht sein Prefill mit wachsendem Kontext ein (bei 32k
|
||||||
|
gemessene 63 t/s ≈ **9 Minuten nur zum Lesen**). Mit dem 16k-Deckel bleibt der schlimmste Fall
|
||||||
|
je Review unter einer Minute. Deshalb ist er der **Gegenleser für Etappen**, nicht der Coder —
|
||||||
|
als Coder ist er auf dieser Box disqualifiziert (siehe VERDIKTE).
|
||||||
|
|
||||||
|
‼️ **Speicher-Regel:** `Warm-Set + größtes On-Demand-Modell ≤ ~115 GB`. Die ko-residente Gruppe
|
||||||
|
(`groups.brains` in der llama-swap-Config) muss **`persistent: false`** sein — sonst räumt
|
||||||
|
llama-swap vor einem großen Modell nicht ab und der Kernel schießt Prozesse ab. Details und
|
||||||
|
Messwerte: [`docs/wissen/VERDIKTE.md`](docs/wissen/VERDIKTE.md).
|
||||||
|
|
||||||
|
## Qualitäts-Tore
|
||||||
|
|
||||||
|
1. **Werkzeug-Zaun** ([`deploy/opencode/plugin/`](deploy/opencode/plugin/)) — blockt `git push`,
|
||||||
|
`rm -rf`, `sudo`, `curl | sh` und Fremd-Hosts im Agentenlauf.
|
||||||
|
2. **Prüf-Tor** — `VERIFY` nach jeder Etappe; rot → der Agent repariert selbst weiter (max. 3 Runden).
|
||||||
|
3. **Governor** ([`deploy/governor/`](deploy/governor/)) — zählt Tokens ehrlich (aus den echten
|
||||||
|
`usage.prompt_tokens` jeder Antwort, selbstkalibrierend). Bei ~45.000: Savepoint schreiben und
|
||||||
|
Sitzung sauber beenden. Bei ~50.000: harter Riegel. Sichtbar als Kachel im Cockpit.
|
||||||
|
4. **CI-Ampel** — Lint (ruff) · Import/Syntax (compileall) · Frontend-Build. Läuft bei jedem Push.
|
||||||
|
|
||||||
|
Gemeinsame Lehre dahinter: **Wissen lebt in Datei + git, nicht im schrumpfenden Chat-Kontext.**
|
||||||
|
Kontext-Komprimierung löscht still die Regeln mit.
|
||||||
|
|
||||||
|
## Selbsterhaltung
|
||||||
|
|
||||||
|
- **Health-Wächter** (`sentry`) + **Warm-Set-Wächter** (`warmer`, per Env abschaltbar)
|
||||||
|
- **Updates mit Fangnetz** — Backup → Update → Postcheck → bei Fehler **Auto-Rollback + Pin**
|
||||||
|
- **Melde-Briefkasten** (`/api/voice/announce`) — alles, was die Box von sich aus sagen will;
|
||||||
|
Lucy pollt ihn und spricht es. Absender `loop` = Coding-Ereignisse
|
||||||
|
- **Gedächtnis** — Mem0-Sidecar, auto-lernend, semantisch, mit Auto-Dedupe
|
||||||
|
- Tägliche Self-Smokes, Zeitmaschine (Snapshot + Ein-Klick-Restore), Chronik der autonomen Taten
|
||||||
|
|
||||||
|
## API (Auswahl)
|
||||||
|
|
||||||
|
`health · models/* · discover · fit · groups · routing/* · system/* · maintenance/* · connect ·
|
||||||
|
memory/* · agent/* · **governor** · ideen/* · auftragsbuch/* · chronik · eigenleben · wissen ·
|
||||||
|
zeitmaschine/* · reminders/* · voice/* · events (SSE)`
|
||||||
|
OpenAI-kompatibel: `/v1/chat/completions`, `/v1/completions`. MCP-Server: [`mcp/`](mcp/).
|
||||||
|
|
||||||
## Entwickeln
|
## Entwickeln
|
||||||
|
|
||||||
**Backend:**
|
|
||||||
```bash
|
```bash
|
||||||
|
# Backend
|
||||||
cd backend
|
cd backend
|
||||||
python -m venv .venv && .venv/Scripts/python -m pip install -r requirements.txt # Windows
|
python -m venv .venv && .venv/Scripts/python -m pip install -r requirements.txt # Windows
|
||||||
.venv/Scripts/python -m uvicorn app:app --port 9000
|
.venv/Scripts/python -m uvicorn app:app --port 9000
|
||||||
```
|
|
||||||
|
|
||||||
**Frontend (Dev, proxyt /api → :9000):**
|
# Frontend (Dev, proxyt /api → :9000)
|
||||||
```bash
|
cd frontend && npm install && npm run dev # http://localhost:5173
|
||||||
cd frontend
|
|
||||||
npm install
|
|
||||||
npm run dev # http://localhost:5173
|
|
||||||
```
|
|
||||||
|
|
||||||
**Frontend (Build → wird vom Backend ausgeliefert):**
|
# Frontend (Build → wird vom Backend ausgeliefert)
|
||||||
```bash
|
|
||||||
cd frontend && npm run build # → frontend/dist
|
cd frontend && npm run build # → frontend/dist
|
||||||
```
|
```
|
||||||
|
|
||||||
|
`frontend/dist` **wird mitcommittet** — die Box hat kein Node; Deploy ist ein `git pull` plus
|
||||||
|
Dienst-Neustart. Vor jedem Commit lohnt der Ampel-Vorlauf: `ruff check .` und `npm run build`.
|
||||||
|
|
||||||
## Env-Vars (Auswahl)
|
## Env-Vars (Auswahl)
|
||||||
|
|
||||||
| Variable | Default | Zweck |
|
| Variable | Default | Zweck |
|
||||||
|---|---|---|
|
|---|---|---|
|
||||||
| `MC_LLAMA_SWAP_URL` | `http://127.0.0.1:8080` | Engine |
|
| `MC_PORT` | `9000` | MC-Backend-Port (**die Unit auf der Box setzt `9001`**) |
|
||||||
| `MC_CONFIG_PATH` | `/etc/llama-swap/config.yaml` | llama-swap Config |
|
| `MC_LLAMA_SWAP_URL` | `http://127.0.0.1:8080` | Engine/Router |
|
||||||
| `MC_GATEWAY_URL` | `http://127.0.0.1:$MC_PORT` | Builtin-Gateway (Teil von MC2, kein externer Dienst) |
|
| `MC_CONFIG_PATH` | `/etc/llama-swap/config.yaml` | llama-swap-Config |
|
||||||
| `MC_PORT` | `9000` | MC-Backend-Port |
|
| `MC_V1_UPSTREAM` | – | gesetzt → `/v1` geht an `mc2-gateway` (`:9010`) statt in-process |
|
||||||
| `MC_ENGINE_PATH` | `/opt/llamacpp-vulkan` | Aktive Engine-Binary (Vulkan-Build) |
|
| `MC_GOVERNOR_URL` | `http://127.0.0.1:8100` | Token-Wächter für die Cockpit-Kachel |
|
||||||
| `MC_ENGINE_REPO` | `ggml-org/llama.cpp` | Quelle für Engine-Update-Check |
|
| `MC_ENGINE_PATH` | `/opt/llamacpp-vulkan` | aktive Engine (Vulkan-Build) |
|
||||||
| `MC_DRAFTS_DIR` | `$MODELS/drafts` | Spec-Draft-Modelle (vocab-geprüft) |
|
| `MC_REWARM_ENABLED` | `1` | Warm-Set-Wächter (auf der Box bewusst `0`) |
|
||||||
| `MC_SPEC_TYPE` | `draft-simple` | Speculative-Decoding-Typ (llama.cpp) |
|
| `MC_DRAFTS_DIR` · `MC_SPEC_TYPE` | `$MODELS/drafts` · `draft-simple` | Spekulatives Dekodieren |
|
||||||
|
|
||||||
|
Governor-eigene Schalter (`GOV_THRESHOLD`, `GOV_HARD_CEILING`, `GOV_EXEMPT_MODELS`, …):
|
||||||
|
[`deploy/governor/README.md`](deploy/governor/README.md).
|
||||||
|
|
||||||
|
## Weiterlesen
|
||||||
|
|
||||||
|
| Dokument | Inhalt |
|
||||||
|
|---|---|
|
||||||
|
| [`docs/BEDIENUNG.md`](docs/BEDIENUNG.md) | Wie man MC2 benutzt |
|
||||||
|
| [`docs/RUNBOOK.md`](docs/RUNBOOK.md) · [`docs/DISASTER_RECOVERY.md`](docs/DISASTER_RECOVERY.md) | Betrieb, Störungen, Wiederherstellung |
|
||||||
|
| [`docs/HERMES_SETUP.md`](docs/HERMES_SETUP.md) | Hermes-Agent, Profile, Crons |
|
||||||
|
| [`docs/AUFTRAGSBUCH.md`](docs/AUFTRAGSBUCH.md) | Vorschlags-Inbox und das Ein-Klick-Gate |
|
||||||
|
| [`docs/wissen/VERDIKTE.md`](docs/wissen/VERDIKTE.md) | **Finale Technik-Entscheide — nicht neu aufrollen** |
|
||||||
|
| [`docs/wissen/FALLEN.md`](docs/wissen/FALLEN.md) · [`docs/wissen/OFFENE-FAEDEN.md`](docs/wissen/OFFENE-FAEDEN.md) | Stolpersteine · offene Punkte |
|
||||||
|
| [`deploy/opencode/README.md`](deploy/opencode/README.md) | Coding-Bahn: Mannschaft, Verteilung, Fallen |
|
||||||
|
| [`AGENTS.md`](AGENTS.md) | Arbeitsregeln für Agenten in diesem Repo |
|
||||||
|
|||||||
+7
-5
@@ -9,17 +9,16 @@ Server (proxyt /api hierher), daher CORS für localhost offen.
|
|||||||
import asyncio
|
import asyncio
|
||||||
import logging
|
import logging
|
||||||
import os
|
import os
|
||||||
|
from collections.abc import AsyncGenerator, Awaitable, Callable
|
||||||
from contextlib import asynccontextmanager
|
from contextlib import asynccontextmanager
|
||||||
from typing import Any, AsyncGenerator, Awaitable, Callable
|
from typing import Any
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import FRONTEND_DIST, V1_UPSTREAM, VERSION
|
||||||
from fastapi import FastAPI
|
from fastapi import FastAPI
|
||||||
from fastapi.middleware.cors import CORSMiddleware
|
from fastapi.middleware.cors import CORSMiddleware
|
||||||
from fastapi.responses import FileResponse
|
from fastapi.responses import FileResponse
|
||||||
from fastapi.staticfiles import StaticFiles
|
from fastapi.staticfiles import StaticFiles
|
||||||
from starlette.requests import Request
|
|
||||||
|
|
||||||
from config import FRONTEND_DIST, V1_UPSTREAM, VERSION
|
|
||||||
from routers import (
|
from routers import (
|
||||||
agent,
|
agent,
|
||||||
auftragsbuch,
|
auftragsbuch,
|
||||||
@@ -29,6 +28,7 @@ from routers import (
|
|||||||
eigenleben,
|
eigenleben,
|
||||||
events,
|
events,
|
||||||
gateway_proxy,
|
gateway_proxy,
|
||||||
|
governor,
|
||||||
health,
|
health,
|
||||||
hermes_ui,
|
hermes_ui,
|
||||||
ideen,
|
ideen,
|
||||||
@@ -42,8 +42,9 @@ from routers import (
|
|||||||
zeitmaschine,
|
zeitmaschine,
|
||||||
)
|
)
|
||||||
from routers import reminders as reminders_router
|
from routers import reminders as reminders_router
|
||||||
from services import memory as memory_svc
|
|
||||||
from services import ketten_digest, metrics_history, reminders, sentry, warmer
|
from services import ketten_digest, metrics_history, reminders, sentry, warmer
|
||||||
|
from services import memory as memory_svc
|
||||||
|
from starlette.requests import Request
|
||||||
|
|
||||||
# Zentrales Logging — Level via MC_LOG_LEVEL (INFO default). Eine Konfiguration
|
# Zentrales Logging — Level via MC_LOG_LEVEL (INFO default). Eine Konfiguration
|
||||||
# für alle Module (logging.getLogger(__name__)).
|
# für alle Module (logging.getLogger(__name__)).
|
||||||
@@ -141,6 +142,7 @@ app.include_router(maintenance.router)
|
|||||||
app.include_router(auftragsbuch.router) # Vorschlags-Inbox (Mensch-Gate als Klick)
|
app.include_router(auftragsbuch.router) # Vorschlags-Inbox (Mensch-Gate als Klick)
|
||||||
app.include_router(ideen.router) # Ideen-Queue (natives Hermes-Kanban) — Tür der Zentrale
|
app.include_router(ideen.router) # Ideen-Queue (natives Hermes-Kanban) — Tür der Zentrale
|
||||||
app.include_router(chronik.router) # Timeline der autonomen Taten (Announce-Store)
|
app.include_router(chronik.router) # Timeline der autonomen Taten (Announce-Store)
|
||||||
|
app.include_router(governor.router) # Token-Wächter (:8100) — Zählerstand fürs Cockpit
|
||||||
app.include_router(eigenleben.router) # „Von allein": Skills + Vorschlags-Bilanz der Box
|
app.include_router(eigenleben.router) # „Von allein": Skills + Vorschlags-Bilanz der Box
|
||||||
app.include_router(events.router) # SSE-Eventstrom /api/events (P3a) — Invalidation-Bus
|
app.include_router(events.router) # SSE-Eventstrom /api/events (P3a) — Invalidation-Bus
|
||||||
app.include_router(wissen.router) # Wissens-Vault (Traum-Notizen) read-only
|
app.include_router(wissen.router) # Wissens-Vault (Traum-Notizen) read-only
|
||||||
|
|||||||
@@ -15,13 +15,12 @@ durchreicht (routers/gateway_forward.py, MC_V1_UPSTREAM).
|
|||||||
|
|
||||||
import logging
|
import logging
|
||||||
import os
|
import os
|
||||||
|
from collections.abc import AsyncGenerator
|
||||||
from contextlib import asynccontextmanager
|
from contextlib import asynccontextmanager
|
||||||
from typing import AsyncGenerator
|
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
from fastapi import FastAPI, Request
|
|
||||||
|
|
||||||
from config import LLAMA_SWAP_URL, VERSION
|
from config import LLAMA_SWAP_URL, VERSION
|
||||||
|
from fastapi import FastAPI, Request
|
||||||
from routers import gateway_proxy
|
from routers import gateway_proxy
|
||||||
|
|
||||||
logging.basicConfig(
|
logging.basicConfig(
|
||||||
|
|||||||
@@ -4,8 +4,9 @@ from pathlib import Path
|
|||||||
# Add backend directory to sys.path so we can import services
|
# Add backend directory to sys.path so we can import services
|
||||||
sys.path.append(str(Path(__file__).resolve().parent))
|
sys.path.append(str(Path(__file__).resolve().parent))
|
||||||
|
|
||||||
from services.llamaswap import read_config, write_config, spec_draft_flags, _PATH_RE
|
|
||||||
from config import CONFIG_PATH
|
from config import CONFIG_PATH
|
||||||
|
from services.llamaswap import _PATH_RE, read_config, spec_draft_flags, write_config
|
||||||
|
|
||||||
|
|
||||||
def migrate():
|
def migrate():
|
||||||
print(f"Reading config from {CONFIG_PATH}...")
|
print(f"Reading config from {CONFIG_PATH}...")
|
||||||
|
|||||||
@@ -55,6 +55,17 @@
|
|||||||
"role": "scout", "name": "GLM-4.6V-Flash", "repo": "ggml-org/GLM-4.6V-Flash-GGUF",
|
"role": "scout", "name": "GLM-4.6V-Flash", "repo": "ggml-org/GLM-4.6V-Flash-GGUF",
|
||||||
"family": "glm", "generation": 4.6, "total_params_b": 9, "active_params_b": 3,
|
"family": "glm", "generation": 4.6, "total_params_b": 9, "active_params_b": 3,
|
||||||
"moe": true, "quant": "Q4_K_M", "ctx": 32768, "tools": true, "vision": true
|
"moe": true, "quant": "Q4_K_M", "ctx": 32768, "tools": true, "vision": true
|
||||||
|
},
|
||||||
|
|
||||||
|
{
|
||||||
|
"role": "kritiker", "name": "Devstral-Small-2-24B", "repo": "mistralai/Devstral-Small-2-24B-Instruct-2512",
|
||||||
|
"family": "mistral-devstral", "generation": 2.0, "total_params_b": 24, "active_params_b": 24,
|
||||||
|
"moe": false, "quant": "Q4_K_M", "ctx": 65536, "tools": true, "vision": false
|
||||||
|
},
|
||||||
|
{
|
||||||
|
"role": "kritiker", "name": "GLM-4.7-Flash", "repo": "zai-org/GLM-4.7-Flash",
|
||||||
|
"family": "glm", "generation": 4.7, "total_params_b": 30, "active_params_b": 3,
|
||||||
|
"moe": true, "quant": "Q4_K_XL", "ctx": 65536, "tools": true, "vision": false
|
||||||
}
|
}
|
||||||
]
|
]
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -1,10 +1,7 @@
|
|||||||
"""Agent-Endpoint: Hermes-Status + WebUI-Link (MC verlinkt nur, betreibt nicht)."""
|
"""Agent-Endpoint: Hermes-Status + WebUI-Link (MC verlinkt nur, betreibt nicht)."""
|
||||||
|
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from fastapi import HTTPException
|
|
||||||
|
|
||||||
from services.agent import agent_status, hermes_brain_info, set_agent_brain, update_brain_model
|
from services.agent import agent_status, hermes_brain_info, set_agent_brain, update_brain_model
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -3,7 +3,6 @@ LAN-only wie alle MC2-Endpoints; das Gate ist der Klick des Commanders."""
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import auftragsbuch
|
from services import auftragsbuch
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -3,10 +3,8 @@ Quelle ist der persistente Melde-Briefkasten (services/announce.py): Health-Wäc
|
|||||||
Auto-Updates, Erinnerungen, Radar/Traum/Chef-Gutachter-Crons, Auftragsbuch — alle
|
Auto-Updates, Erinnerungen, Radar/Traum/Chef-Gutachter-Crons, Auftragsbuch — alle
|
||||||
autonomen Kanäle laufen dort bereits durch. Hier wird nichts Neues erhoben, nur erzählt."""
|
autonomen Kanäle laufen dort bereits durch. Hier wird nichts Neues erhoben, nur erzählt."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import announce
|
from services import announce
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -1,7 +1,6 @@
|
|||||||
"""Connect-Endpoint: erzeugt IDE-/Agent-Snippets (auf den Gateway + Memory-MCP)."""
|
"""Connect-Endpoint: erzeugt IDE-/Agent-Snippets (auf den Gateway + Memory-MCP)."""
|
||||||
|
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter
|
||||||
|
|
||||||
from services.connect import DEFAULT_HOST, build_snippets, check_health
|
from services.connect import DEFAULT_HOST, build_snippets, check_health
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -14,11 +14,10 @@ import logging
|
|||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import websockets
|
import websockets
|
||||||
|
from config import BOX_CONSOLE_UPSTREAM
|
||||||
from fastapi import APIRouter, Request, WebSocket
|
from fastapi import APIRouter, Request, WebSocket
|
||||||
from starlette.responses import Response
|
from starlette.responses import Response
|
||||||
|
|
||||||
from config import BOX_CONSOLE_UPSTREAM
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
router = APIRouter()
|
router = APIRouter()
|
||||||
|
|
||||||
@@ -28,7 +27,7 @@ def _register(base: str, upstream: str) -> None:
|
|||||||
ws_upstream = upstream.replace("http://", "ws://").replace("https://", "wss://")
|
ws_upstream = upstream.replace("http://", "ws://").replace("https://", "wss://")
|
||||||
|
|
||||||
@router.websocket(f"/{base}/ws")
|
@router.websocket(f"/{base}/ws")
|
||||||
async def _proxy_ws(ws: WebSocket) -> None: # noqa: ANN001 — Closure je base
|
async def _proxy_ws(ws: WebSocket) -> None:
|
||||||
await ws.accept(subprotocol="tty")
|
await ws.accept(subprotocol="tty")
|
||||||
try:
|
try:
|
||||||
async with websockets.connect(
|
async with websockets.connect(
|
||||||
|
|||||||
@@ -1,9 +1,7 @@
|
|||||||
"""Eigenleben-Endpoints — „Von allein“-Ansicht (Skills + Vorschlags-Bilanz), read-only."""
|
"""Eigenleben-Endpoints — „Von allein“-Ansicht (Skills + Vorschlags-Bilanz), read-only."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import eigenleben
|
from services import eigenleben
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -27,11 +27,10 @@ import json
|
|||||||
import logging
|
import logging
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
from config import MODELS_DIR
|
||||||
from fastapi import APIRouter, Request
|
from fastapi import APIRouter, Request
|
||||||
from fastapi.responses import StreamingResponse
|
from fastapi.responses import StreamingResponse
|
||||||
|
|
||||||
from config import MODELS_DIR
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -11,11 +11,10 @@ entfernen → app.py bindet wieder den lokalen Gateway ein.
|
|||||||
|
|
||||||
import logging
|
import logging
|
||||||
|
|
||||||
|
from config import V1_UPSTREAM
|
||||||
from fastapi import APIRouter, Request
|
from fastapi import APIRouter, Request
|
||||||
from fastapi.responses import JSONResponse, StreamingResponse
|
from fastapi.responses import JSONResponse, StreamingResponse
|
||||||
|
|
||||||
from config import V1_UPSTREAM
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
router = APIRouter(prefix="/v1")
|
router = APIRouter(prefix="/v1")
|
||||||
|
|||||||
@@ -2,11 +2,9 @@ import logging
|
|||||||
import os
|
import os
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import LLAMA_SWAP_URL
|
||||||
from fastapi import APIRouter, Request
|
from fastapi import APIRouter, Request
|
||||||
from fastapi.responses import JSONResponse, StreamingResponse
|
from fastapi.responses import JSONResponse, StreamingResponse
|
||||||
|
|
||||||
from config import LLAMA_SWAP_URL
|
|
||||||
from services.gateway_stream import record_stream_chunk, record_usage, warn_truncation
|
from services.gateway_stream import record_stream_chunk, record_usage, warn_truncation
|
||||||
from services.router_logic import IMAGE_PART_TYPES, VISION_CAPABLE, choose_for_lane, has_image
|
from services.router_logic import IMAGE_PART_TYPES, VISION_CAPABLE, choose_for_lane, has_image
|
||||||
from services.routing_policy import load_policy
|
from services.routing_policy import load_policy
|
||||||
|
|||||||
@@ -0,0 +1,40 @@
|
|||||||
|
"""Governor — Fenster auf den Token-Waechter (:8100).
|
||||||
|
|
||||||
|
Der Governor ist ein eigenstaendiger, absichtlich winziger Proxy ohne Datenbank: er
|
||||||
|
sitzt zwischen den Coding-Agenten und diesem Gateway, zaehlt ehrlich mit (echte
|
||||||
|
`usage.prompt_tokens` aus jeder Antwort) und zieht bei ueberlangen Sitzungen die
|
||||||
|
Notbremse. Hier wird nichts Neues erhoben — nur sein Status-Endpunkt gleichursprünglich
|
||||||
|
fuer die Oberflaeche verfuegbar gemacht, damit das Frontend nicht per CORS auf einen
|
||||||
|
zweiten Port ausweichen muss.
|
||||||
|
|
||||||
|
Faellt der Governor aus, liefert dieser Router `ok: false` statt eines Fehlers: die
|
||||||
|
Kachel zeigt dann „nicht erreichbar" und das Cockpit bleibt heil.
|
||||||
|
"""
|
||||||
|
|
||||||
|
import os
|
||||||
|
|
||||||
|
import httpx
|
||||||
|
from fastapi import APIRouter
|
||||||
|
|
||||||
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
|
GOVERNOR_URL = os.environ.get("MC_GOVERNOR_URL", "http://127.0.0.1:8100")
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/governor")
|
||||||
|
async def governor_status() -> dict:
|
||||||
|
"""Momentaufnahme des Token-Waechters. Nie werfen — die Kachel darf nie das Cockpit reissen."""
|
||||||
|
try:
|
||||||
|
async with httpx.AsyncClient(timeout=3.0) as c:
|
||||||
|
r = await c.get(f"{GOVERNOR_URL}/governor/status")
|
||||||
|
r.raise_for_status()
|
||||||
|
data = r.json()
|
||||||
|
data["reachable"] = True
|
||||||
|
return data
|
||||||
|
except Exception as exc:
|
||||||
|
return {
|
||||||
|
"ok": False,
|
||||||
|
"reachable": False,
|
||||||
|
"error": f"{type(exc).__name__}: {exc}",
|
||||||
|
"url": GOVERNOR_URL,
|
||||||
|
}
|
||||||
@@ -1,10 +1,8 @@
|
|||||||
"""Health-/Status-Endpoint — schlanker Lebenszeichen-Check für MC 2.0."""
|
"""Health-/Status-Endpoint — schlanker Lebenszeichen-Check für MC 2.0."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter
|
|
||||||
|
|
||||||
from config import VERSION
|
from config import VERSION
|
||||||
|
from fastapi import APIRouter
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import gateway, llamaswap
|
from services import gateway, llamaswap
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -22,11 +22,10 @@ import re
|
|||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import websockets
|
import websockets
|
||||||
|
from config import HERMES_BUILTIN_UI_UPSTREAM
|
||||||
from fastapi import APIRouter, Request, WebSocket
|
from fastapi import APIRouter, Request, WebSocket
|
||||||
from starlette.responses import RedirectResponse, Response
|
from starlette.responses import RedirectResponse, Response
|
||||||
|
|
||||||
from config import HERMES_BUILTIN_UI_UPSTREAM
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
router = APIRouter()
|
router = APIRouter()
|
||||||
|
|
||||||
|
|||||||
@@ -3,7 +3,6 @@ LAN-only wie alle MC2-Endpoints; das Mensch-Gate bleibt die Karte im Auftragsbuc
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import ideen
|
from services import ideen
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
@@ -27,6 +26,15 @@ class AntwortIn(BaseModel):
|
|||||||
antwort: str
|
antwort: str
|
||||||
|
|
||||||
|
|
||||||
|
class ArchivAlleIn(BaseModel):
|
||||||
|
# Leer = alle fertigen Karten der Queue; gesetzt = nur die dieses Projekts.
|
||||||
|
projekt: str = ""
|
||||||
|
|
||||||
|
|
||||||
|
class EinordnenIn(BaseModel):
|
||||||
|
text: str
|
||||||
|
|
||||||
|
|
||||||
@router.get("/ideen")
|
@router.get("/ideen")
|
||||||
def list_queue() -> dict:
|
def list_queue() -> dict:
|
||||||
return ideen.list_queue()
|
return ideen.list_queue()
|
||||||
@@ -78,6 +86,35 @@ def prio(body: PrioIn) -> dict:
|
|||||||
return res
|
return res
|
||||||
|
|
||||||
|
|
||||||
|
class WeiterIn(BaseModel):
|
||||||
|
id: str
|
||||||
|
ziel: str = "" # "lxc" | "docker" (leer = Box entscheidet)
|
||||||
|
tiefe: str = "" # "simpel" | "gruendlich" (leer = Box schätzt selbst)
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/ideen/weiterfuehren")
|
||||||
|
def weiterfuehren(body: WeiterIn) -> dict:
|
||||||
|
"""„Konzept gefällt mir" → IDE-Projekt-Karte mit dem fertigen Konzept als Vorlage."""
|
||||||
|
res = ideen.projekt_aus_idee(body.id, ziel=body.ziel, tiefe=body.tiefe)
|
||||||
|
if not res.get("ok"):
|
||||||
|
raise HTTPException(400, res.get("error", "Projekt konnte nicht angelegt werden."))
|
||||||
|
return res
|
||||||
|
|
||||||
|
|
||||||
|
class NachschaerfenIn(BaseModel):
|
||||||
|
id: str
|
||||||
|
hinweis: str
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/ideen/nachschaerfen")
|
||||||
|
def nachschaerfen(body: NachschaerfenIn) -> dict:
|
||||||
|
"""„Punkt X passt nicht" → Überarbeitungs-Runde am bestehenden Konzept."""
|
||||||
|
res = ideen.konzept_ueberarbeiten(body.id, body.hinweis)
|
||||||
|
if not res.get("ok"):
|
||||||
|
raise HTTPException(400, res.get("error", "Überarbeitung konnte nicht gestartet werden."))
|
||||||
|
return res
|
||||||
|
|
||||||
|
|
||||||
@router.post("/ideen/archivieren")
|
@router.post("/ideen/archivieren")
|
||||||
def archive(body: TaskIn) -> dict:
|
def archive(body: TaskIn) -> dict:
|
||||||
res = ideen.archive_task(body.id)
|
res = ideen.archive_task(body.id)
|
||||||
@@ -86,6 +123,22 @@ def archive(body: TaskIn) -> dict:
|
|||||||
return res
|
return res
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/ideen/einordnen")
|
||||||
|
def einordnen(body: EinordnenIn) -> dict:
|
||||||
|
"""Einordnungs-VORSCHLAG beim Tippen. Wirft nie — scheitert es, kommt `ok: false`
|
||||||
|
und die Oberfläche behält ihre Voreinstellung."""
|
||||||
|
return ideen.einordnen(body.text)
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/ideen/archivieren-alle")
|
||||||
|
def archive_alle(body: ArchivAlleIn) -> dict:
|
||||||
|
"""Fertige Karten sammelweise wegräumen. Fasst ausschließlich `done` an."""
|
||||||
|
res = ideen.archive_done(body.projekt)
|
||||||
|
if not res.get("ok"):
|
||||||
|
raise HTTPException(400, res.get("error", "Archivieren fehlgeschlagen."))
|
||||||
|
return res
|
||||||
|
|
||||||
|
|
||||||
@router.get("/ideen/{id}/log")
|
@router.get("/ideen/{id}/log")
|
||||||
def get_log(id: str) -> dict:
|
def get_log(id: str) -> dict:
|
||||||
return ideen.log_of(id)
|
return ideen.log_of(id)
|
||||||
|
|||||||
@@ -1,8 +1,7 @@
|
|||||||
"""Wartungs-Endpoints: Update-Badge, OS-/Engine-Update, Reboot, Restart, Logs."""
|
"""Wartungs-Endpoints: Update-Badge, OS-/Engine-Update, Reboot, Restart, Logs."""
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException, Header
|
from fastapi import APIRouter, Header, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import maintenance
|
from services import maintenance
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -4,7 +4,6 @@ import time
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import memory
|
from services import memory
|
||||||
from services.voice_metrics import park, record_stage
|
from services.voice_metrics import park, record_stage
|
||||||
|
|
||||||
|
|||||||
@@ -1,10 +1,9 @@
|
|||||||
"""Modelle-Endpoints: Liste (mit Caps), Discover, Fit, Register, Groups."""
|
"""Modelle-Endpoints: Liste (mit Caps), Discover, Fit, Register, Groups."""
|
||||||
|
|
||||||
import psutil
|
import psutil
|
||||||
|
from config import HF_DOWNLOAD_ENV, MODELS_DIR
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from config import HF_DOWNLOAD_ENV, MODELS_DIR
|
|
||||||
from services import budget, discover, hf, jobengine, llamaswap
|
from services import budget, discover, hf, jobengine, llamaswap
|
||||||
from services.fit import evaluate_fit, max_ctx_for
|
from services.fit import evaluate_fit, max_ctx_for
|
||||||
|
|
||||||
@@ -140,8 +139,7 @@ def install(req: InstallReq) -> dict:
|
|||||||
|
|
||||||
# Download-Job: alle GGUF-Teile (+ mmproj) per --include holen.
|
# Download-Job: alle GGUF-Teile (+ mmproj) per --include holen.
|
||||||
args = [hf.hf_bin(), "download", repo]
|
args = [hf.hf_bin(), "download", repo]
|
||||||
for f in info["files"]:
|
args.extend(info["files"])
|
||||||
args.append(f)
|
|
||||||
if info["mmproj"]:
|
if info["mmproj"]:
|
||||||
args.append(info["mmproj"])
|
args.append(info["mmproj"])
|
||||||
args += ["--local-dir", str(target)]
|
args += ["--local-dir", str(target)]
|
||||||
|
|||||||
@@ -2,10 +2,8 @@
|
|||||||
Konsument ist v.a. der Hermes-Agent via mcp_mc.py (reminder_create/list/delete);
|
Konsument ist v.a. der Hermes-Agent via mcp_mc.py (reminder_create/list/delete);
|
||||||
LAN-only wie alle MC2-Endpoints."""
|
LAN-only wie alle MC2-Endpoints."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import reminders
|
from services import reminders
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -2,7 +2,6 @@
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import gateway
|
from services import gateway
|
||||||
from services.routing_policy import policy_meta, save_policy
|
from services.routing_policy import policy_meta, save_policy
|
||||||
|
|
||||||
|
|||||||
@@ -9,12 +9,10 @@ import logging
|
|||||||
import os
|
import os
|
||||||
import subprocess
|
import subprocess
|
||||||
|
|
||||||
|
import httpx
|
||||||
|
from config import GATEWAY_URL, HERMES_API_URL, LLAMA_SWAP_URL, MEM0_SERVICE_URL, V1_UPSTREAM, VOICE_SERVICE_URL
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
import httpx
|
|
||||||
|
|
||||||
from config import GATEWAY_URL, HERMES_API_URL, LLAMA_SWAP_URL, MEM0_SERVICE_URL, V1_UPSTREAM, VOICE_SERVICE_URL
|
|
||||||
from services import backup as backup_svc
|
from services import backup as backup_svc
|
||||||
from services import maintenance
|
from services import maintenance
|
||||||
from services.agent import agent_status
|
from services.agent import agent_status
|
||||||
@@ -67,7 +65,7 @@ def _user_unit_active(unit: str) -> bool:
|
|||||||
r = subprocess.run(["systemctl", "--user", "is-active", unit],
|
r = subprocess.run(["systemctl", "--user", "is-active", unit],
|
||||||
capture_output=True, text=True, timeout=3)
|
capture_output=True, text=True, timeout=3)
|
||||||
return r.stdout.strip() == "active"
|
return r.stdout.strip() == "active"
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
return False
|
return False
|
||||||
|
|
||||||
|
|
||||||
@@ -135,7 +133,7 @@ def _run(cmd: list[str], cwd: str | None = None) -> dict:
|
|||||||
p = subprocess.run(cmd, cwd=cwd, capture_output=True, text=True, timeout=180)
|
p = subprocess.run(cmd, cwd=cwd, capture_output=True, text=True, timeout=180)
|
||||||
return {"ok": p.returncode == 0, "code": p.returncode,
|
return {"ok": p.returncode == 0, "code": p.returncode,
|
||||||
"out": (p.stdout or "")[-2000:], "err": (p.stderr or "")[-2000:]}
|
"out": (p.stdout or "")[-2000:], "err": (p.stderr or "")[-2000:]}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"ok": False, "code": -1, "out": "", "err": str(exc)}
|
return {"ok": False, "code": -1, "out": "", "err": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
|
|||||||
@@ -11,14 +11,16 @@ LAN-only (kein Token in der 2.0-Phase), wie die übrigen MC2-Endpoints.
|
|||||||
|
|
||||||
import logging
|
import logging
|
||||||
import os
|
import os
|
||||||
|
|
||||||
|
# Injection-Schutz (Stufe 0): guard.py liegt im mcp/-Verzeichnis. Per Pfad laden (eigene MC2-Venv).
|
||||||
|
import sys as _sys
|
||||||
import time
|
import time
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import HERMES_API_KEY, HERMES_API_MODEL, HERMES_API_URL, LLAMA_SWAP_URL, VOICE_SERVICE_URL
|
||||||
from fastapi import APIRouter, File, Form, HTTPException, UploadFile
|
from fastapi import APIRouter, File, Form, HTTPException, UploadFile
|
||||||
from fastapi.responses import Response, StreamingResponse
|
from fastapi.responses import Response, StreamingResponse
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from config import HERMES_API_KEY, HERMES_API_MODEL, HERMES_API_URL, LLAMA_SWAP_URL, VOICE_SERVICE_URL
|
|
||||||
from services import announce
|
from services import announce
|
||||||
from services.voice_metrics import ( # Per-Stage-Latenz + Per-Turn-Trace (intern)
|
from services.voice_metrics import ( # Per-Stage-Latenz + Per-Turn-Trace (intern)
|
||||||
Timer,
|
Timer,
|
||||||
@@ -29,8 +31,6 @@ from services.voice_metrics import ( # Per-Stage-Latenz + Per-Turn-Trace (inter
|
|||||||
record_stage,
|
record_stage,
|
||||||
)
|
)
|
||||||
|
|
||||||
# Injection-Schutz (Stufe 0): guard.py liegt im mcp/-Verzeichnis. Per Pfad laden (eigene MC2-Venv).
|
|
||||||
import sys as _sys
|
|
||||||
_GUARD_DIR = os.path.join(os.path.dirname(os.path.dirname(os.path.dirname(os.path.abspath(__file__)))), "mcp")
|
_GUARD_DIR = os.path.join(os.path.dirname(os.path.dirname(os.path.dirname(os.path.abspath(__file__)))), "mcp")
|
||||||
if _GUARD_DIR not in _sys.path:
|
if _GUARD_DIR not in _sys.path:
|
||||||
_sys.path.insert(0, _GUARD_DIR)
|
_sys.path.insert(0, _GUARD_DIR)
|
||||||
@@ -155,7 +155,7 @@ def voice_health() -> dict:
|
|||||||
r = httpx.get(f"{VOICE_SERVICE_URL}/health", timeout=httpx.Timeout(5.0))
|
r = httpx.get(f"{VOICE_SERVICE_URL}/health", timeout=httpx.Timeout(5.0))
|
||||||
out["sidecar"] = r.status_code == 200
|
out["sidecar"] = r.status_code == 200
|
||||||
out["detail"] = r.json() if r.status_code == 200 else None
|
out["detail"] = r.json() if r.status_code == 200 else None
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
out["error"] = str(exc)
|
out["error"] = str(exc)
|
||||||
return out
|
return out
|
||||||
|
|
||||||
@@ -180,7 +180,7 @@ def voice_voices() -> dict:
|
|||||||
r = httpx.get(f"{VOICE_SERVICE_URL}/voices", timeout=httpx.Timeout(10.0))
|
r = httpx.get(f"{VOICE_SERVICE_URL}/voices", timeout=httpx.Timeout(10.0))
|
||||||
r.raise_for_status()
|
r.raise_for_status()
|
||||||
return r.json()
|
return r.json()
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
raise HTTPException(502, f"Voice-Sidecar nicht erreichbar: {exc}")
|
raise HTTPException(502, f"Voice-Sidecar nicht erreichbar: {exc}")
|
||||||
|
|
||||||
|
|
||||||
@@ -245,7 +245,7 @@ def voice_get_reference() -> dict:
|
|||||||
r = httpx.get(f"{VOICE_SERVICE_URL}/reference", timeout=httpx.Timeout(8.0))
|
r = httpx.get(f"{VOICE_SERVICE_URL}/reference", timeout=httpx.Timeout(8.0))
|
||||||
r.raise_for_status()
|
r.raise_for_status()
|
||||||
return r.json()
|
return r.json()
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"active": False, "error": str(exc)}
|
return {"active": False, "error": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
|
|||||||
@@ -6,9 +6,8 @@ import os
|
|||||||
import time
|
import time
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
|
from pydantic import BaseModel
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
|
|||||||
@@ -13,7 +13,6 @@ from pathlib import Path
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import backup as backup_svc
|
from services import backup as backup_svc
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -10,12 +10,10 @@ Permission errors are handled gracefully.
|
|||||||
Uses user journal (systemctl --user) to query logs.
|
Uses user journal (systemctl --user) to query logs.
|
||||||
"""
|
"""
|
||||||
|
|
||||||
import os
|
|
||||||
import subprocess
|
import subprocess
|
||||||
from datetime import datetime, timezone
|
from datetime import datetime, timezone
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
|
||||||
LOG_DIR = Path.home() / "logs"
|
LOG_DIR = Path.home() / "logs"
|
||||||
LOG_FILE = LOG_DIR / "mc2-timeout.log"
|
LOG_FILE = LOG_DIR / "mc2-timeout.log"
|
||||||
SERVICE_NAME = "mission-control-2.service"
|
SERVICE_NAME = "mission-control-2.service"
|
||||||
|
|||||||
@@ -9,11 +9,15 @@ import os
|
|||||||
import re
|
import re
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import psutil
|
from config import (
|
||||||
|
BOX_CONSOLE_PATH,
|
||||||
from config import (BOX_CONSOLE_UPSTREAM,
|
BOX_CONSOLE_UPSTREAM,
|
||||||
BOX_CONSOLE_PATH, HERMES_BUILTIN_UI_UPSTREAM, HERMES_BUILTIN_UI_PATH,
|
HERMES_API_URL,
|
||||||
HERMES_API_URL, HERMES_HOME, PC_EXECUTOR_URL)
|
HERMES_BUILTIN_UI_PATH,
|
||||||
|
HERMES_BUILTIN_UI_UPSTREAM,
|
||||||
|
HERMES_HOME,
|
||||||
|
PC_EXECUTOR_URL,
|
||||||
|
)
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
@@ -194,7 +198,7 @@ def set_agent_brain(model_id: str) -> dict:
|
|||||||
new_members = [x for x in brains if x not in (old, model_id)] + [model_id]
|
new_members = [x for x in brains if x not in (old, model_id)] + [model_id]
|
||||||
llamaswap.set_group("brains", new_members, swap=False, persist=True) # 2) warm
|
llamaswap.set_group("brains", new_members, swap=False, persist=True) # 2) warm
|
||||||
# 2b) TTL härten: neues Hirn nie auto-entladen; altes Hirn auf Default entspannen.
|
# 2b) TTL härten: neues Hirn nie auto-entladen; altes Hirn auf Default entspannen.
|
||||||
from services.llamaswap import set_ttl, DEFAULT_TTL
|
from services.llamaswap import DEFAULT_TTL, set_ttl
|
||||||
set_ttl(model_id, 0)
|
set_ttl(model_id, 0)
|
||||||
if old:
|
if old:
|
||||||
set_ttl(old, DEFAULT_TTL)
|
set_ttl(old, DEFAULT_TTL)
|
||||||
@@ -253,7 +257,7 @@ def update_brain_model(new_model: str) -> bool:
|
|||||||
|
|
||||||
# Restart the user-space service to apply changes
|
# Restart the user-space service to apply changes
|
||||||
try:
|
try:
|
||||||
import services.maintenance as maintenance
|
from services import maintenance
|
||||||
maintenance.restart_service("hermes-gateway")
|
maintenance.restart_service("hermes-gateway")
|
||||||
except Exception:
|
except Exception:
|
||||||
log.warning("update_brain_model: hermes-gateway-Restart fehlgeschlagen", exc_info=True)
|
log.warning("update_brain_model: hermes-gateway-Restart fehlgeschlagen", exc_info=True)
|
||||||
|
|||||||
@@ -20,7 +20,6 @@ import time
|
|||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import MODELS_DIR
|
from config import MODELS_DIR
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|||||||
@@ -51,7 +51,7 @@ def backup_now() -> dict:
|
|||||||
r = subprocess.run(["/bin/bash", str(BACKUP_SH)], capture_output=True, text=True, timeout=180)
|
r = subprocess.run(["/bin/bash", str(BACKUP_SH)], capture_output=True, text=True, timeout=180)
|
||||||
if r.returncode != 0:
|
if r.returncode != 0:
|
||||||
return {"ok": False, "snapshot": "", "files": [], "error": (r.stderr or r.stdout).strip()[-300:]}
|
return {"ok": False, "snapshot": "", "files": [], "error": (r.stderr or r.stdout).strip()[-300:]}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"ok": False, "snapshot": "", "files": [], "error": str(exc)}
|
return {"ok": False, "snapshot": "", "files": [], "error": str(exc)}
|
||||||
|
|
||||||
latest = _latest()
|
latest = _latest()
|
||||||
|
|||||||
@@ -10,7 +10,6 @@ die häufigste Fehlerquelle. Der Aufrufer übergibt den Host explizit.
|
|||||||
import json
|
import json
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import HERMES_BUILTIN_UI_UPSTREAM, LLAMA_SWAP_URL, MEM0_SERVICE_URL, PORT, V1_UPSTREAM
|
from config import HERMES_BUILTIN_UI_UPSTREAM, LLAMA_SWAP_URL, MEM0_SERVICE_URL, PORT, V1_UPSTREAM
|
||||||
|
|
||||||
DEFAULT_HOST = "192.168.178.151"
|
DEFAULT_HOST = "192.168.178.151"
|
||||||
@@ -139,7 +138,7 @@ def check_health() -> dict:
|
|||||||
gateway = {"ok": True, "detail": f"{n} Modelle verfügbar" if n else "bereit"}
|
gateway = {"ok": True, "detail": f"{n} Modelle verfügbar" if n else "bereit"}
|
||||||
else:
|
else:
|
||||||
gateway = {"ok": False, "detail": f"HTTP {r.status_code}"}
|
gateway = {"ok": False, "detail": f"HTTP {r.status_code}"}
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
|
|
||||||
memory = {"ok": False, "detail": "nicht erreichbar"}
|
memory = {"ok": False, "detail": "nicht erreichbar"}
|
||||||
@@ -148,7 +147,7 @@ def check_health() -> dict:
|
|||||||
r = c.get(f"{MEM0_SERVICE_URL}/health")
|
r = c.get(f"{MEM0_SERVICE_URL}/health")
|
||||||
memory = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
memory = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
||||||
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
|
|
||||||
desktop_gateway = {"ok": False, "detail": "nicht erreichbar"}
|
desktop_gateway = {"ok": False, "detail": "nicht erreichbar"}
|
||||||
@@ -157,7 +156,7 @@ def check_health() -> dict:
|
|||||||
r = c.get(f"{HERMES_BUILTIN_UI_UPSTREAM}/api/status")
|
r = c.get(f"{HERMES_BUILTIN_UI_UPSTREAM}/api/status")
|
||||||
desktop_gateway = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
desktop_gateway = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
||||||
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
|
|
||||||
return {"gateway": gateway, "memory": memory, "desktop_gateway": desktop_gateway}
|
return {"gateway": gateway, "memory": memory, "desktop_gateway": desktop_gateway}
|
||||||
|
|||||||
@@ -9,16 +9,15 @@ spätere Auto-Setups nutzen ihn, damit sie nie auseinanderlaufen.
|
|||||||
"""
|
"""
|
||||||
|
|
||||||
import json
|
import json
|
||||||
|
import logging
|
||||||
import math
|
import math
|
||||||
import os
|
import os
|
||||||
import time
|
import time
|
||||||
from datetime import datetime
|
from datetime import datetime
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
import logging
|
|
||||||
|
|
||||||
from config import DISCOVER_CACHE_PATH, DISCOVER_TTL
|
from config import DISCOVER_CACHE_PATH, DISCOVER_TTL
|
||||||
|
|
||||||
from services import catalog
|
from services import catalog
|
||||||
from services.caps import capabilities
|
from services.caps import capabilities
|
||||||
from services.fit import evaluate_fit, extract_params_b, max_ctx_for
|
from services.fit import evaluate_fit, extract_params_b, max_ctx_for
|
||||||
|
|||||||
@@ -5,8 +5,8 @@ V1_UPSTREAM gilt der alte eingebaute Modus (MC2 serviert /v1 selbst).
|
|||||||
"""
|
"""
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import PORT, V1_UPSTREAM
|
from config import PORT, V1_UPSTREAM
|
||||||
|
|
||||||
from services.llamaswap import engine_reachable
|
from services.llamaswap import engine_reachable
|
||||||
from services.routing_policy import load_policy
|
from services.routing_policy import load_policy
|
||||||
|
|
||||||
@@ -50,7 +50,7 @@ def gateway_reachable() -> bool:
|
|||||||
if V1_UPSTREAM:
|
if V1_UPSTREAM:
|
||||||
try:
|
try:
|
||||||
return httpx.get(f"{V1_UPSTREAM}/v1/models", timeout=2.0).status_code == 200
|
return httpx.get(f"{V1_UPSTREAM}/v1/models", timeout=2.0).status_code == 200
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
return False
|
return False
|
||||||
# Eingebauter Modus: der Gateway lebt in MC selbst und proxyt llama-swap.
|
# Eingebauter Modus: der Gateway lebt in MC selbst und proxyt llama-swap.
|
||||||
return engine_reachable()
|
return engine_reachable()
|
||||||
|
|||||||
+428
-13
@@ -22,6 +22,9 @@ import subprocess
|
|||||||
import time
|
import time
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
import httpx
|
||||||
|
from config import GATEWAY_URL, V1_UPSTREAM
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
HERMES = Path(os.environ.get("MC_HERMES_BIN", "~/.local/bin/hermes")).expanduser()
|
HERMES = Path(os.environ.get("MC_HERMES_BIN", "~/.local/bin/hermes")).expanduser()
|
||||||
@@ -99,9 +102,27 @@ def _blocker_frage(task_id: str) -> dict | None:
|
|||||||
return {"frage": frage[:800], "kind": kind}
|
return {"frage": frage[:800], "kind": kind}
|
||||||
|
|
||||||
|
|
||||||
|
def _kurz(text: str, max_len: int = 80) -> str:
|
||||||
|
"""Auf max_len kürzen — aber an der WORTGRENZE, nicht mitten im Wort (User 21.07.:
|
||||||
|
„Idee: Recherchiere zu ARM … und lass uns überlegen wie")."""
|
||||||
|
t = " ".join((text or "").split())
|
||||||
|
if len(t) <= max_len:
|
||||||
|
return t
|
||||||
|
schnitt = t[:max_len].rsplit(" ", 1)[0].rstrip(" ,;:–-")
|
||||||
|
return (schnitt or t[:max_len]) + "…"
|
||||||
|
|
||||||
|
|
||||||
|
_TITEL_PRAEFIX_RX = re.compile(r"^\s*(idee|projekt|bitte)\s*[:\-–]?\s*", re.IGNORECASE)
|
||||||
|
|
||||||
|
|
||||||
def _projekt_titel(titles: list[str]) -> str:
|
def _projekt_titel(titles: list[str]) -> str:
|
||||||
"""Anzeigename einer Karten-Familie: gemeinsamer Titel-Präfix (z. B. „Homelab-Dashboard 2.0"),
|
"""Anzeigename einer Karten-Familie: gemeinsamer Titel-Präfix (z. B. „Homelab-Dashboard 2.0"),
|
||||||
sonst der Titel der ältesten Karte. Reine Anzeige-Heuristik, nichts hängt davon ab."""
|
sonst der AUFGERÄUMTESTE Mitglieds-Titel. Reine Anzeige-Heuristik, nichts hängt davon ab.
|
||||||
|
|
||||||
|
Der kürzeste Titel gewinnt, weil die gepflegten Karten (aus einem Konzept abgeleitet)
|
||||||
|
kurz sind und der rohe Zuruf des Commanders lang — vorher nahm die Gruppe stur die
|
||||||
|
älteste Karte und schnitt deren Textwüste bei 80 Zeichen mitten im Wort ab.
|
||||||
|
"""
|
||||||
if not titles:
|
if not titles:
|
||||||
return "Projekt"
|
return "Projekt"
|
||||||
prefix = titles[0]
|
prefix = titles[0]
|
||||||
@@ -109,7 +130,9 @@ def _projekt_titel(titles: list[str]) -> str:
|
|||||||
while prefix and not t.startswith(prefix):
|
while prefix and not t.startswith(prefix):
|
||||||
prefix = prefix[:-1]
|
prefix = prefix[:-1]
|
||||||
prefix = prefix.strip(" –-:·")
|
prefix = prefix.strip(" –-:·")
|
||||||
return prefix if len(prefix) >= 10 else titles[0][:80]
|
if len(prefix) >= 10:
|
||||||
|
return _kurz(prefix)
|
||||||
|
return _kurz(_TITEL_PRAEFIX_RX.sub("", min(titles, key=len)))
|
||||||
|
|
||||||
|
|
||||||
def _ketten_anreichern(items: list[dict]) -> list[dict]:
|
def _ketten_anreichern(items: list[dict]) -> list[dict]:
|
||||||
@@ -200,7 +223,7 @@ def _ketten_anreichern(items: list[dict]) -> list[dict]:
|
|||||||
for it in items:
|
for it in items:
|
||||||
familien.setdefault(boss(it["id"]), []).append(it)
|
familien.setdefault(boss(it["id"]), []).append(it)
|
||||||
projekte = []
|
projekte = []
|
||||||
for wurzel, mitglieder in familien.items():
|
for mitglieder in familien.values():
|
||||||
if len(mitglieder) < 2:
|
if len(mitglieder) < 2:
|
||||||
continue
|
continue
|
||||||
mitglieder.sort(key=lambda i: i.get("erstellt") or 0)
|
mitglieder.sort(key=lambda i: i.get("erstellt") or 0)
|
||||||
@@ -243,14 +266,20 @@ def list_queue() -> dict:
|
|||||||
items = []
|
items = []
|
||||||
for t in raw[:60]:
|
for t in raw[:60]:
|
||||||
try:
|
try:
|
||||||
|
body = t.get("body") or ""
|
||||||
|
ide = t.get("assignee") == "projektstart"
|
||||||
items.append({
|
items.append({
|
||||||
"id": t.get("id", ""),
|
"id": t.get("id", ""),
|
||||||
"titel": (t.get("title") or "(ohne Titel)")[:200],
|
"titel": (t.get("title") or "(ohne Titel)")[:200],
|
||||||
"body": (t.get("body") or "")[:600],
|
"body": body[:600],
|
||||||
"status": t.get("status", "?"),
|
"status": t.get("status", "?"),
|
||||||
"assignee": t.get("assignee"),
|
"assignee": t.get("assignee"),
|
||||||
# IDE-Welt = das Vorbereiter-Profil (Konzept + Repo + Doku, kein Bau).
|
# IDE-Welt = das Vorbereiter-Profil (Konzept + Repo + Doku, kein Bau).
|
||||||
"welt": "ide" if t.get("assignee") == "projektstart" else "box",
|
"welt": "ide" if ide else "box",
|
||||||
|
# Auftrags-Art innerhalb der IDE-Welt: nur durchdenken oder Projekt
|
||||||
|
# vorbereiten? Steht nirgends als Feld — der Marker im Body ist die
|
||||||
|
# Wahrheit (schreibt add_idea, siehe _ART_IDEE).
|
||||||
|
"art": ("idee" if _ART_MARKER in body else "projekt") if ide else "box",
|
||||||
"erstellt": t.get("created_at"),
|
"erstellt": t.get("created_at"),
|
||||||
"fertig": t.get("completed_at"),
|
"fertig": t.get("completed_at"),
|
||||||
"von": t.get("created_by"),
|
"von": t.get("created_by"),
|
||||||
@@ -313,6 +342,15 @@ _ZIEL_HINWEIS = ("Richte den Tech-Vorschlag an der gewaehlten ZIEL-PLATTFORM aus
|
|||||||
"nicht am Industrie-Default.")
|
"nicht am Industrie-Default.")
|
||||||
|
|
||||||
# Auftrags-Art „Idee pruefen": Produkt-Blick statt Umsetzungs-Blick, KEIN Projektstart.
|
# Auftrags-Art „Idee pruefen": Produkt-Blick statt Umsetzungs-Blick, KEIN Projektstart.
|
||||||
|
# Langer Zuruf → kurzer Kartentitel; der volle Wortlaut steht dann hier im Auftrag.
|
||||||
|
# Der Worker MUSS wissen, dass der Titel nur eine Kurzfassung ist, sonst arbeitet er
|
||||||
|
# am abgeschnittenen Satz statt an der ganzen Idee.
|
||||||
|
_WORTLAUT_KOPF = ("DIE IDEE IM WORTLAUT (der Kartentitel ist nur eine Kurzfassung fuer die "
|
||||||
|
"Anzeige — DAS hier ist der Auftrag):\n")
|
||||||
|
|
||||||
|
# Die erste Zeile ist zugleich der MARKER, an dem die Queue-Sicht die Art wiedererkennt
|
||||||
|
# (das Kanban kennt kein eigenes Feld dafuer) — beim Aendern _ART_MARKER mitziehen.
|
||||||
|
_ART_MARKER = "AUFTRAGS-ART: IDEE PRUEFEN"
|
||||||
_ART_IDEE = (
|
_ART_IDEE = (
|
||||||
"AUFTRAGS-ART: IDEE PRUEFEN (KEIN Projektstart!). Der Commander will diese Produkt-Idee erst "
|
"AUFTRAGS-ART: IDEE PRUEFEN (KEIN Projektstart!). Der Commander will diese Produkt-Idee erst "
|
||||||
"einmal DURCHDACHT haben — er hat sich NICHT entschieden, sie zu bauen.\n"
|
"einmal DURCHDACHT haben — er hat sich NICHT entschieden, sie zu bauen.\n"
|
||||||
@@ -368,6 +406,15 @@ def add_idea(titel: str, notiz: str = "", created_by: str = "mc2-ui",
|
|||||||
return {"ok": False, "error": "Titel bitte zwischen 3 und 200 Zeichen."}
|
return {"ok": False, "error": "Titel bitte zwischen 3 und 200 Zeichen."}
|
||||||
welt = "ide" if str(welt).lower() == "ide" else "box"
|
welt = "ide" if str(welt).lower() == "ide" else "box"
|
||||||
notiz = (notiz or "").strip()
|
notiz = (notiz or "").strip()
|
||||||
|
# Der Commander schreibt roh — sein Zuruf ist oft ein ganzer Absatz und wurde bisher
|
||||||
|
# komplett zum Kartentitel (in jeder Liste abgeschnitten, unlesbar). Also: kurzer
|
||||||
|
# Titel für die Anzeige, der WORTLAUT wandert vollständig in den Auftrag, damit der
|
||||||
|
# Worker nichts verliert.
|
||||||
|
wortlaut = ""
|
||||||
|
if len(titel) > 90:
|
||||||
|
satz = re.split(r"(?<=[.!?])\s", titel)[0].strip()
|
||||||
|
wortlaut = titel
|
||||||
|
titel = satz if 10 <= len(satz) <= 90 else _kurz(titel, 80)
|
||||||
if welt == "ide":
|
if welt == "ide":
|
||||||
args = ["create", titel, "--assignee", "projektstart", "--created-by", created_by, "--json"]
|
args = ["create", titel, "--assignee", "projektstart", "--created-by", created_by, "--json"]
|
||||||
# Vorspann: Aufwand (Tiefe) + Ziel-Plattform + Infrastruktur — überstimmt die
|
# Vorspann: Aufwand (Tiefe) + Ziel-Plattform + Infrastruktur — überstimmt die
|
||||||
@@ -384,9 +431,13 @@ def add_idea(titel: str, notiz: str = "", created_by: str = "mc2-ui",
|
|||||||
infra = _INFRA_DOCKER if str(ziel).lower() == "docker" else _INFRA_LXC
|
infra = _INFRA_DOCKER if str(ziel).lower() == "docker" else _INFRA_LXC
|
||||||
vorspann.append(infra + " " + _ZIEL_HINWEIS
|
vorspann.append(infra + " " + _ZIEL_HINWEIS
|
||||||
+ (" " + _ZIEL_EHRLICH if zielwahl else ""))
|
+ (" " + _ZIEL_EHRLICH if zielwahl else ""))
|
||||||
|
if wortlaut:
|
||||||
|
vorspann.insert(0, _WORTLAUT_KOPF + wortlaut)
|
||||||
notiz = "\n\n".join(vorspann) + ("\n\n" + notiz if notiz else "")
|
notiz = "\n\n".join(vorspann) + ("\n\n" + notiz if notiz else "")
|
||||||
else:
|
else:
|
||||||
args = ["create", titel, "--triage", "--created-by", created_by, "--json"]
|
args = ["create", titel, "--triage", "--created-by", created_by, "--json"]
|
||||||
|
if wortlaut:
|
||||||
|
notiz = _WORTLAUT_KOPF + wortlaut + ("\n\n" + notiz if notiz else "")
|
||||||
if notiz:
|
if notiz:
|
||||||
args[2:2] = ["--body", notiz[:4000]]
|
args[2:2] = ["--body", notiz[:4000]]
|
||||||
try:
|
try:
|
||||||
@@ -461,6 +512,101 @@ def archive_task(task_id: str) -> dict:
|
|||||||
return {"ok": True}
|
return {"ok": True}
|
||||||
|
|
||||||
|
|
||||||
|
_EINORDNEN_SYS = (
|
||||||
|
"Du ordnest eine frisch getippte Projekt-Idee ein. Antworte AUSSCHLIESSLICH mit einem "
|
||||||
|
"JSON-Objekt, ohne Prosa, ohne Codezaun:\n"
|
||||||
|
'{"wer":"box"|"zed","tiefe":"schlank"|"gruendlich","nur_denken":true|false}\n\n'
|
||||||
|
"wer=box: Aufgabe am eigenen Heimlabor des Nutzers — seine Server, seine bestehenden "
|
||||||
|
"Dienste (Mission Control, Lucy, Rippy), Wartung, Doku, Automatisierung. Die Box baut selbst.\n"
|
||||||
|
"wer=zed: ein NEUES eigenstaendiges Programm/Werkzeug/App, das der Nutzer danach selbst "
|
||||||
|
"programmieren will. Er bekommt nur ein vorbereitetes Repo.\n"
|
||||||
|
"tiefe=gruendlich: gross, vage oder mit vielen offenen Entwurfsfragen. "
|
||||||
|
"tiefe=schlank: klein und klar umrissen.\n"
|
||||||
|
"nur_denken=true: der Text stellt eine FRAGE oder waegt ab (\"lohnt sich\", \"waere es sinnvoll\", "
|
||||||
|
"\"brauche ich\") statt einen Auftrag zu geben."
|
||||||
|
)
|
||||||
|
|
||||||
|
|
||||||
|
def einordnen(text: str) -> dict:
|
||||||
|
"""Grober Einordnungs-VORSCHLAG für eine frisch getippte Idee.
|
||||||
|
|
||||||
|
Nur eine Vorauswahl in der Oberfläche — der Mensch sieht und überschreibt sie. Deshalb
|
||||||
|
bewusst anspruchslos: ein einziger kurzer Aufruf ans dauerwarme Hirn (69,6 t/s gemessen),
|
||||||
|
Schnellspur-Marker gegen das Nachdenken, hartes Timeout. Scheitert irgendetwas, kommt
|
||||||
|
`{"ok": False}` zurück und die Oberfläche behält schlicht ihre Voreinstellung — eine
|
||||||
|
Einordnung darf das Tippen NIE blockieren oder eine Fehlermeldung erzeugen.
|
||||||
|
"""
|
||||||
|
text = (text or "").strip()
|
||||||
|
if len(text) < 12:
|
||||||
|
return {"ok": False}
|
||||||
|
ziel_url = (V1_UPSTREAM or GATEWAY_URL).rstrip("/")
|
||||||
|
marker = os.environ.get("MC_NO_THINK_MARKER", "[[MC:NO_THINK]]")
|
||||||
|
try:
|
||||||
|
r = httpx.post(f"{ziel_url}/v1/chat/completions", timeout=12.0, json={
|
||||||
|
"model": "hermes", "temperature": 0, "max_tokens": 60, "stream": False,
|
||||||
|
"messages": [
|
||||||
|
{"role": "system", "content": _EINORDNEN_SYS},
|
||||||
|
{"role": "user", "content": f"{marker} {text[:600]}"},
|
||||||
|
],
|
||||||
|
})
|
||||||
|
r.raise_for_status()
|
||||||
|
inhalt = (r.json()["choices"][0]["message"]["content"] or "").strip()
|
||||||
|
except Exception:
|
||||||
|
log.debug("ideen: einordnen fehlgeschlagen", exc_info=True)
|
||||||
|
return {"ok": False}
|
||||||
|
|
||||||
|
# Modelle packen JSON gern in einen Codezaun oder schreiben einen Satz davor.
|
||||||
|
m = re.search(r"\{.*\}", inhalt, re.DOTALL)
|
||||||
|
if not m:
|
||||||
|
return {"ok": False}
|
||||||
|
try:
|
||||||
|
d = json.loads(m.group(0))
|
||||||
|
except Exception:
|
||||||
|
return {"ok": False}
|
||||||
|
|
||||||
|
wer = d.get("wer") if d.get("wer") in ("box", "zed") else None
|
||||||
|
tiefe = d.get("tiefe") if d.get("tiefe") in ("schlank", "gruendlich") else None
|
||||||
|
if wer is None and tiefe is None:
|
||||||
|
return {"ok": False}
|
||||||
|
return {"ok": True, "wer": wer or "zed", "tiefe": tiefe or "schlank",
|
||||||
|
"nur_denken": bool(d.get("nur_denken"))}
|
||||||
|
|
||||||
|
|
||||||
|
def archive_done(projekt: str = "") -> dict:
|
||||||
|
"""Alle FERTIGEN Karten wegräumen — optional nur die eines Projekts.
|
||||||
|
|
||||||
|
Sammel-Aufräumen (25.07.2026): Bei fünf abgeschlossenen Projekt-Ketten wären das
|
||||||
|
sonst ~18 Einzelklicks. Wie beim Einzel-Archivieren wird nichts gelöscht — die
|
||||||
|
Karten wandern ins Kanban-Archiv und bleiben dort lesbar.
|
||||||
|
|
||||||
|
‼️ Bewusst NUR `done`. Laufende, hängende, wartende und in Ausarbeitung befindliche
|
||||||
|
Karten werden nie angefasst, auch nicht bei leerem `projekt`-Filter — ein Sammel-
|
||||||
|
Knopf darf niemals versehentlich Arbeit abräumen.
|
||||||
|
"""
|
||||||
|
if not _available():
|
||||||
|
return {"ok": False, "error": "Die Ideen-Queue lebt auf der Box."}
|
||||||
|
q = list_queue()
|
||||||
|
if not q.get("available"):
|
||||||
|
return {"ok": False, "error": q.get("fehler") or "Queue nicht lesbar."}
|
||||||
|
|
||||||
|
ziel = [i for i in q.get("items", [])
|
||||||
|
if i.get("status") == "done" and (not projekt or i.get("projekt") == projekt)]
|
||||||
|
if not ziel:
|
||||||
|
return {"ok": True, "archiviert": 0, "fehlgeschlagen": []}
|
||||||
|
|
||||||
|
ok, fehler = 0, []
|
||||||
|
for item in ziel:
|
||||||
|
r = archive_task(item.get("id", ""))
|
||||||
|
if r.get("ok"):
|
||||||
|
ok += 1
|
||||||
|
else:
|
||||||
|
# Die Items aus list_queue tragen "titel" (deutsch), nicht das rohe "title".
|
||||||
|
fehler.append({"id": item.get("id"), "titel": _kurz(item.get("titel") or "", 60),
|
||||||
|
"error": r.get("error", "")})
|
||||||
|
_list_cache["ts"] = 0.0
|
||||||
|
return {"ok": True, "archiviert": ok, "fehlgeschlagen": fehler}
|
||||||
|
|
||||||
|
|
||||||
def ergebnis_of(task_id: str) -> dict:
|
def ergebnis_of(task_id: str) -> dict:
|
||||||
"""Das ERGEBNIS einer fertigen Aufgabe — die Abschluss-Zusammenfassung des Workers.
|
"""Das ERGEBNIS einer fertigen Aufgabe — die Abschluss-Zusammenfassung des Workers.
|
||||||
|
|
||||||
@@ -678,6 +824,46 @@ def _clean_repo(raw: str) -> str | None:
|
|||||||
_KONZEPT_NAMES = ("KONZEPT.md", "Konzept.md", "konzept.md", "CONCEPT.md")
|
_KONZEPT_NAMES = ("KONZEPT.md", "Konzept.md", "konzept.md", "CONCEPT.md")
|
||||||
_konzept_cache: dict = {}
|
_konzept_cache: dict = {}
|
||||||
|
|
||||||
|
# Zweiter Ablage-Ort (Bug-Fund 21.07.): der `konzept-fliessband`-Skill endet mit
|
||||||
|
# „cp … ~/konzepte/<slug>-konzept.md" — Worker folgen dieser Skill-Anweisung auch dann,
|
||||||
|
# wenn ihre Profil-SOUL eigentlich ein Repo verlangt. Das Konzept war dann fertig, aber
|
||||||
|
# im Auftragsbuch unsichtbar („noch kein Repo hinterlegt"). Also: liegt kein Repo vor,
|
||||||
|
# hier nachsehen. Bewusst eng — nur ~/konzepte, nur .md.
|
||||||
|
_KONZEPT_DIR = Path("~/konzepte").expanduser()
|
||||||
|
_KONZEPT_PFAD_RX = re.compile(r"(?:~|/home/[A-Za-z0-9_.-]+)?/?konzepte/([A-Za-z0-9_.-]+\.md)")
|
||||||
|
|
||||||
|
|
||||||
|
def _lokales_konzept(text: str, titel: str = "") -> tuple | None:
|
||||||
|
"""(pfad, inhalt) einer Konzept-Datei aus ~/konzepte — aus dem Text oder per Titel geraten.
|
||||||
|
|
||||||
|
`titel` nur setzen, wenn die Karte FERTIG ist: sonst hängt die Raterei einer gerade
|
||||||
|
laufenden Karte das Konzept ihres Vorgängers an (live gesehen 21.07. — eine neue
|
||||||
|
ARM-Karte zeigte das alte ARM-Konzept, als wäre es ihr Ergebnis).
|
||||||
|
"""
|
||||||
|
kandidaten: list[str] = []
|
||||||
|
m = _KONZEPT_PFAD_RX.search(text or "")
|
||||||
|
if m:
|
||||||
|
kandidaten.append(m.group(1))
|
||||||
|
# Kein Pfad genannt (aeltere Karten): ueber den Titel raten — Wortschnittmenge zwischen
|
||||||
|
# Dateiname und Kartentitel. Streng: EIN Treffer, und ein einzelnes kurzes Allerweltswort
|
||||||
|
# („arm") reicht nicht — sonst passt irgendeine Datei auf irgendeine Karte.
|
||||||
|
if not kandidaten and titel and _KONZEPT_DIR.is_dir():
|
||||||
|
worte = {w for w in re.findall(r"[a-z0-9]{3,}", titel.lower())}
|
||||||
|
treffer = [p.name for p in _KONZEPT_DIR.glob("*.md")
|
||||||
|
if len(g := worte & set(re.findall(r"[a-z0-9]{3,}", p.stem.lower()))) >= 2
|
||||||
|
or any(len(w) >= 6 for w in g)]
|
||||||
|
if len(treffer) == 1:
|
||||||
|
kandidaten.append(treffer[0])
|
||||||
|
for name in kandidaten:
|
||||||
|
pfad = (_KONZEPT_DIR / name).resolve()
|
||||||
|
if pfad.parent != _KONZEPT_DIR.resolve() or not pfad.is_file():
|
||||||
|
continue
|
||||||
|
try:
|
||||||
|
return str(pfad), pfad.read_text(encoding="utf-8", errors="replace")
|
||||||
|
except Exception:
|
||||||
|
log.warning("ideen: Konzept-Datei %s nicht lesbar", pfad, exc_info=True)
|
||||||
|
return None
|
||||||
|
|
||||||
|
|
||||||
def _gitea_creds() -> tuple | None:
|
def _gitea_creds() -> tuple | None:
|
||||||
"""(user, token) fuer den oeffentlichen Gitea-Host aus ~/.git-credentials."""
|
"""(user, token) fuer den oeffentlichen Gitea-Host aus ~/.git-credentials."""
|
||||||
@@ -704,7 +890,8 @@ def _extract_repo(text: str) -> str | None:
|
|||||||
|
|
||||||
|
|
||||||
def konzept_of(task_id: str) -> dict:
|
def konzept_of(task_id: str) -> dict:
|
||||||
"""Das KONZEPT.md des vorbereiteten IDE-Projekts holen (aus dem Gitea-Repo)."""
|
"""Das ausgearbeitete Konzept einer IDE-Karte holen — aus dem Gitea-Repo ODER,
|
||||||
|
falls der Worker keins angelegt hat, aus seiner Datei in ~/konzepte."""
|
||||||
if not _available():
|
if not _available():
|
||||||
return {"available": False}
|
return {"available": False}
|
||||||
if not _TASK_ID_RX.match(task_id or ""):
|
if not _TASK_ID_RX.match(task_id or ""):
|
||||||
@@ -720,19 +907,39 @@ def konzept_of(task_id: str) -> dict:
|
|||||||
return {"available": True, "error": "Karte nicht lesbar."}
|
return {"available": True, "error": "Karte nicht lesbar."}
|
||||||
# `kanban show --json` legt die Task-Felder verschachtelt unter "task" ab und
|
# `kanban show --json` legt die Task-Felder verschachtelt unter "task" ab und
|
||||||
# liefert die jüngste Abschluss-Zusammenfassung als "latest_summary".
|
# liefert die jüngste Abschluss-Zusammenfassung als "latest_summary".
|
||||||
haystack, task_status = "", None
|
haystack, task_status, titel = "", None, ""
|
||||||
if isinstance(d, dict):
|
if isinstance(d, dict):
|
||||||
t = d.get("task") if isinstance(d.get("task"), dict) else d
|
t = d.get("task") if isinstance(d.get("task"), dict) else d
|
||||||
task_status = t.get("status")
|
task_status = t.get("status")
|
||||||
|
titel = str(t.get("title") or "")
|
||||||
haystack = "\n".join(str(x or "") for x in (
|
haystack = "\n".join(str(x or "") for x in (
|
||||||
t.get("result"), t.get("body"), d.get("latest_summary")))
|
t.get("result"), t.get("body"), d.get("latest_summary")))
|
||||||
for ev in d.get("events") or []:
|
for ev in d.get("events") or []:
|
||||||
if isinstance(ev, dict) and ev.get("kind") == "completed":
|
if isinstance(ev, dict) and ev.get("kind") == "completed":
|
||||||
haystack += "\n" + str((ev.get("payload") or {}).get("summary") or "")
|
haystack += "\n" + str((ev.get("payload") or {}).get("summary") or "")
|
||||||
|
|
||||||
|
def _datei_antwort(repo: str | None = None) -> dict | None:
|
||||||
|
"""Konzept aus ~/konzepte als vollwertige Antwort — der zweite Ablage-Ort."""
|
||||||
|
# Titel-Raterei nur bei fertigen Karten (sonst erbt eine laufende Karte das
|
||||||
|
# Konzept ihres Vorgängers); läuft sie noch, zählt allein ein genannter Pfad.
|
||||||
|
lokal = _lokales_konzept(haystack, titel if task_status == "done" else "")
|
||||||
|
if not lokal:
|
||||||
|
return None
|
||||||
|
pfad, inhalt = lokal
|
||||||
|
return {"available": True, "repo": repo, "quelle": "datei", "pfad": pfad,
|
||||||
|
"datei": Path(pfad).name, "konzept": inhalt[:60000]}
|
||||||
|
|
||||||
repo = _extract_repo(haystack)
|
repo = _extract_repo(haystack)
|
||||||
if not repo:
|
if not repo:
|
||||||
|
data = _datei_antwort()
|
||||||
|
if data:
|
||||||
|
if task_status == "done":
|
||||||
|
if len(_konzept_cache) >= 20:
|
||||||
|
_konzept_cache.pop(next(iter(_konzept_cache)))
|
||||||
|
_konzept_cache[task_id] = data
|
||||||
|
return data
|
||||||
return {"available": True, "repo": None,
|
return {"available": True, "repo": None,
|
||||||
"error": "Noch kein Repo hinterlegt — das Projekt wird gerade vorbereitet."}
|
"error": "Noch kein Konzept hinterlegt — die Box arbeitet noch daran."}
|
||||||
|
|
||||||
creds = _gitea_creds()
|
creds = _gitea_creds()
|
||||||
auth = creds if creds else None
|
auth = creds if creds else None
|
||||||
@@ -748,13 +955,16 @@ def konzept_of(task_id: str) -> dict:
|
|||||||
break
|
break
|
||||||
except Exception:
|
except Exception:
|
||||||
log.warning("ideen: KONZEPT-Abruf für %s (%s) fehlgeschlagen", task_id, repo, exc_info=True)
|
log.warning("ideen: KONZEPT-Abruf für %s (%s) fehlgeschlagen", task_id, repo, exc_info=True)
|
||||||
return {"available": True, "repo": repo, "error": "Konzept konnte nicht geladen werden."}
|
return (_datei_antwort(repo)
|
||||||
|
or {"available": True, "repo": repo, "error": "Konzept konnte nicht geladen werden."})
|
||||||
|
|
||||||
if not konzept:
|
if not konzept:
|
||||||
return {"available": True, "repo": repo,
|
# Repo genannt, aber (noch) ohne KONZEPT.md → die lokale Ablage kann trotzdem stehen.
|
||||||
"error": "KONZEPT.md im Repo (noch) nicht gefunden."}
|
return (_datei_antwort(repo)
|
||||||
|
or {"available": True, "repo": repo,
|
||||||
|
"error": "KONZEPT.md im Repo (noch) nicht gefunden."})
|
||||||
clone_url = f"https://{_GITEA_HOST}/{repo}.git"
|
clone_url = f"https://{_GITEA_HOST}/{repo}.git"
|
||||||
data = {"available": True, "repo": repo, "clone_url": clone_url,
|
data = {"available": True, "repo": repo, "clone_url": clone_url, "quelle": "repo",
|
||||||
"datei": used_name, "konzept": konzept[:60000]}
|
"datei": used_name, "konzept": konzept[:60000]}
|
||||||
# Fertige Konzepte ändern sich selten → cachen (aber nur, wenn die Karte done ist).
|
# Fertige Konzepte ändern sich selten → cachen (aber nur, wenn die Karte done ist).
|
||||||
if task_status == "done":
|
if task_status == "done":
|
||||||
@@ -764,6 +974,211 @@ def konzept_of(task_id: str) -> dict:
|
|||||||
return data
|
return data
|
||||||
|
|
||||||
|
|
||||||
|
# ── „Gefaellt mir" — aus der geprueften Idee ein IDE-Projekt machen (21.07.) ──
|
||||||
|
# Ohne das war die Idee eine Sackgasse: der Commander haette den Titel neu eintippen
|
||||||
|
# muessen und die Box haette das Konzept von vorn gedacht. Hier bekommt die neue Karte
|
||||||
|
# das FERTIGE Konzept als Vorlage mit — plus die Kette zur Idee-Karte.
|
||||||
|
_AUS_IDEE_KOPF = (
|
||||||
|
"AUFTRAGS-ART: PROJEKT AUS GEPRUEFTER IDEE. Der Commander hat diese Idee erst durchdenken "
|
||||||
|
"lassen — das Konzept gefaellt ihm, jetzt soll daraus ein startklares Repo werden, das er "
|
||||||
|
"SELBST in Zed baut.")
|
||||||
|
_AUS_IDEE_FUSS = (
|
||||||
|
"· Denk das Konzept NICHT neu. Es ist bereits mit voller Kaskade + Advocatus Diaboli "
|
||||||
|
"gehaertet. Lies es vollstaendig und uebernimm es; eine kurze Nachschaerf-Runde fuer die "
|
||||||
|
"Bau-Sicht (Etappen, Ziel-Plattform) ist erlaubt, eine komplette neue Denk-Kaskade ist "
|
||||||
|
"Verschwendung.\n"
|
||||||
|
"· Der Rest ist deine normale Projektstart-Rolle: das Repo enthaelt am Ende NUR Doku "
|
||||||
|
"(KONZEPT.md, ROADMAP.md, AGENTS.md, README.md, SAVEPOINT.md, .aiexclude) — KEIN Code.\n"
|
||||||
|
"· Uebergabe wie ueblich: Repo-URL nennen, damit der Commander in Zed loslegen kann.")
|
||||||
|
|
||||||
|
|
||||||
|
def _wo_liegt(konz: dict) -> str:
|
||||||
|
"""Eine Zeile: WO das Konzept wirklich liegt — für den Auftrag an den Worker.
|
||||||
|
|
||||||
|
Wichtig ist der Unterschied zwischen „Repo bekannt" und „Konzept KOMMT aus dem Repo":
|
||||||
|
findet die Repo-Datei nicht statt (Push verpufft, Datei anders benannt), liest MC2 die
|
||||||
|
lokale Fassung. Wer dann trotzdem „liegt im Repo als <lokaler Dateiname>" in den Auftrag
|
||||||
|
schreibt, schickt den Worker auf eine Datei, die es dort nie gab.
|
||||||
|
"""
|
||||||
|
repo, pfad = konz.get("repo"), konz.get("pfad")
|
||||||
|
url = konz.get("clone_url") or (f"https://{_GITEA_HOST}/{repo}.git" if repo else "")
|
||||||
|
if konz.get("quelle") == "repo":
|
||||||
|
return (f"Das gepruefte Konzept liegt im Gitea-Repo `{repo}` ({url}) "
|
||||||
|
f"als `{konz.get('datei') or 'KONZEPT.md'}`.")
|
||||||
|
if repo:
|
||||||
|
return (f"Das gepruefte Konzept liegt als Datei `{pfad}` auf dieser Box. Zur Idee gehoert "
|
||||||
|
f"bereits das Gitea-Repo `{repo}` ({url}) — dort ist das Konzept aber NICHT (mehr) "
|
||||||
|
"abrufbar. Pruefe das Repo, bevor du etwas anlegst.")
|
||||||
|
return f"Das gepruefte Konzept liegt als Datei `{pfad}` auf dieser Box."
|
||||||
|
|
||||||
|
|
||||||
|
def _konzept_und_name(task_id: str) -> tuple:
|
||||||
|
"""(Konzept-Daten, kurzer Anzeige-Name, Fehlertext) einer Idee-Karte.
|
||||||
|
|
||||||
|
Der Kartentitel ist der ROHE Zuruf des Commanders („Recherchiere zu … Lass ma…") —
|
||||||
|
als Name unbrauchbar. Die Ueberschrift des Konzepts ist die aufgeraeumte Fassung
|
||||||
|
derselben Sache; nur wenn es keine gibt, den Zuruf kappen.
|
||||||
|
"""
|
||||||
|
konz = konzept_of(task_id)
|
||||||
|
if not konz.get("konzept"):
|
||||||
|
return {}, "", (konz.get("error")
|
||||||
|
or "Zu dieser Idee gibt es noch kein Konzept — erst durchdenken lassen.")
|
||||||
|
try:
|
||||||
|
r = _hermes(["show", task_id, "--json"], timeout=30)
|
||||||
|
d = _parse_json(r.stdout)
|
||||||
|
except Exception as exc:
|
||||||
|
return {}, "", f"Karte nicht lesbar: {exc}"
|
||||||
|
t = (d.get("task") if isinstance(d, dict) and isinstance(d.get("task"), dict)
|
||||||
|
else d if isinstance(d, dict) else {})
|
||||||
|
quell_titel = _TITEL_PRAEFIX_RX.sub("", str(t.get("title") or "").strip())
|
||||||
|
if not quell_titel:
|
||||||
|
return {}, "", "Quell-Karte hat keinen Titel."
|
||||||
|
h1 = re.search(r"^#\s+(.+)$", konz["konzept"], re.MULTILINE)
|
||||||
|
kurz = h1.group(1).strip() if h1 else re.split(r"(?<=[.!?])\s", quell_titel)[0]
|
||||||
|
return konz, _kurz(kurz, 85), ""
|
||||||
|
|
||||||
|
|
||||||
|
def projekt_aus_idee(task_id: str, ziel: str = "", tiefe: str = "") -> dict:
|
||||||
|
"""Aus einer fertig durchdachten Idee eine IDE-Projekt-Karte machen.
|
||||||
|
|
||||||
|
Das Konzept der Quell-Karte (Repo oder ~/konzepte-Datei) wird als Vorlage in den
|
||||||
|
Auftrag geschrieben; die neue Karte haengt als Kind an der Idee (task_links), damit
|
||||||
|
das Auftragsbuch beide als eine Kette zeigt.
|
||||||
|
"""
|
||||||
|
if not _available():
|
||||||
|
return {"ok": False, "error": "Die Ideen-Queue lebt auf der Box."}
|
||||||
|
if not _TASK_ID_RX.match(task_id or ""):
|
||||||
|
return {"ok": False, "error": f"Keine gültige Aufgaben-Nummer: {task_id!r}"}
|
||||||
|
|
||||||
|
konz, kurz, fehler = _konzept_und_name(task_id)
|
||||||
|
if fehler:
|
||||||
|
return {"ok": False, "error": fehler}
|
||||||
|
titel = f"Projekt: {kurz}"[:200]
|
||||||
|
|
||||||
|
if konz.get("repo"):
|
||||||
|
# Liegt das Konzept schon in einem Gitea-Repo, ist DAS das Projekt-Repo —
|
||||||
|
# ein zweites anzulegen wuerde den Commander nur mit Dubletten beschenken.
|
||||||
|
quelle = (f"· {_wo_liegt(konz)}\n"
|
||||||
|
f"· NUTZE GENAU DIESES REPO als Projekt-Repo — lege KEIN neues an (Schritt 2 "
|
||||||
|
"entfaellt). Klone es voll, ergaenze die fehlenden Doku-Dateien und pushe auf main.")
|
||||||
|
else:
|
||||||
|
quelle = (f"· {_wo_liegt(konz)}\n"
|
||||||
|
"· Lies es vollstaendig, lege dann wie in Schritt 2 ein frisches Repo an und "
|
||||||
|
"uebernimm den Inhalt als `KONZEPT.md`.")
|
||||||
|
|
||||||
|
zielwahl = _ZIEL.get(str(ziel).lower())
|
||||||
|
infra = _INFRA_DOCKER if str(ziel).lower() == "docker" else _INFRA_LXC
|
||||||
|
teile = [f"{_AUS_IDEE_KOPF}\n{quelle}\n{_AUS_IDEE_FUSS}"]
|
||||||
|
if _AUFWAND.get(str(tiefe).lower()):
|
||||||
|
teile.append(_AUFWAND[str(tiefe).lower()])
|
||||||
|
if zielwahl:
|
||||||
|
teile.append(zielwahl)
|
||||||
|
teile.append(infra + " " + _ZIEL_HINWEIS + (" " + _ZIEL_EHRLICH if zielwahl else ""))
|
||||||
|
notiz = "\n\n".join(teile)
|
||||||
|
|
||||||
|
args = ["create", titel, "--body", notiz[:4000], "--assignee", "projektstart",
|
||||||
|
"--parent", task_id, "--created-by", "mc2-ui", "--json"]
|
||||||
|
try:
|
||||||
|
r = _hermes(args)
|
||||||
|
except Exception as exc:
|
||||||
|
return {"ok": False, "error": f"Queue nicht erreichbar: {exc}"}
|
||||||
|
task = _parse_json(r.stdout)
|
||||||
|
if r.returncode != 0 or not isinstance(task, dict) or not task.get("id"):
|
||||||
|
return {"ok": False,
|
||||||
|
"error": (r.stderr or r.stdout or "kanban create fehlgeschlagen").strip()[:300]}
|
||||||
|
_list_cache["ts"] = 0.0
|
||||||
|
try:
|
||||||
|
from services import announce
|
||||||
|
announce.add(f"Aus der Idee „{_kurz(kurz, 60)}“ wird ein Projekt: {task['id']} — die Box "
|
||||||
|
"bereitet das Repo vor, gebaut wird in Zed.",
|
||||||
|
"[Ideen-Queue]", "ideen-queue", "silent")
|
||||||
|
except Exception:
|
||||||
|
pass
|
||||||
|
return {"ok": True, "id": task["id"], "titel": titel}
|
||||||
|
|
||||||
|
|
||||||
|
# ── „So nicht" — Konzept mit Rueckmeldung ueberarbeiten lassen (21.07.) ──────
|
||||||
|
# Vorher gab es nach dem Lesen nur annehmen oder wegwerfen. Ein Konzept wird aber
|
||||||
|
# selten beim ersten Wurf richtig: der Commander sieht EINEN Punkt, der nicht passt.
|
||||||
|
# Die Ueberarbeitung ist wieder eine Idee-Karte (kein Bau) und schreibt die neue
|
||||||
|
# Fassung an DIESELBE Stelle — so zeigt „Konzept" ueberall den frischen Stand.
|
||||||
|
_UEBERARBEITEN_KOPF = (
|
||||||
|
"AUFTRAGS-ART: IDEE PRUEFEN — UEBERARBEITUNG. Es gibt bereits ein durchdachtes, "
|
||||||
|
"gehaertetes Konzept. Der Commander hat es GELESEN und will gezielte Aenderungen. "
|
||||||
|
"KEIN Projektstart, KEIN Bau, KEIN Geruest.")
|
||||||
|
_UEBERARBEITEN_FUSS = (
|
||||||
|
"· Arbeite die Rueckmeldung EIN: lies das bestehende Konzept vollstaendig, aendere die "
|
||||||
|
"genannten Punkte und alles, was dadurch nicht mehr stimmt (Folgewirkungen!). Denk das "
|
||||||
|
"Ganze NICHT von vorn — was er nicht angesprochen hat, bleibt.\n"
|
||||||
|
"· Nimm seinen Vorschlag ernst, aber sei ehrlich: schafft er ein Problem, dann bau ihn ein "
|
||||||
|
"UND schreib die Folge sichtbar ins Konzept (Abschnitt Risiken/offene Punkte). Setz dich "
|
||||||
|
"nicht stillschweigend darueber hinweg und rede es auch nicht schoen.\n"
|
||||||
|
"· Ein KURZER Haertetest (Advocatus Diaboli) NUR auf die geaenderten Teile reicht — die "
|
||||||
|
"volle Kaskade ist Verschwendung, der Rest ist bereits geprueft.\n"
|
||||||
|
"· Uebergabe: was du geaendert hast, was daraus folgte und was du bewusst gelassen hast.")
|
||||||
|
|
||||||
|
|
||||||
|
def konzept_ueberarbeiten(task_id: str, hinweis: str) -> dict:
|
||||||
|
"""Rueckmeldung zum Konzept → neue Idee-Karte, die das Konzept ueberarbeitet.
|
||||||
|
|
||||||
|
Haengt als Kind an der Quell-Karte (Kette im Auftragsbuch) und schreibt die neue
|
||||||
|
Fassung an dieselbe Stelle wie die alte (Repo bzw. Datei).
|
||||||
|
"""
|
||||||
|
if not _available():
|
||||||
|
return {"ok": False, "error": "Die Ideen-Queue lebt auf der Box."}
|
||||||
|
if not _TASK_ID_RX.match(task_id or ""):
|
||||||
|
return {"ok": False, "error": f"Keine gültige Aufgaben-Nummer: {task_id!r}"}
|
||||||
|
hinweis = (hinweis or "").strip()
|
||||||
|
if not (3 <= len(hinweis) <= 2000):
|
||||||
|
return {"ok": False, "error": "Bitte schreib zwischen 3 und 2000 Zeichen, was anders werden soll."}
|
||||||
|
|
||||||
|
konz, kurz, fehler = _konzept_und_name(task_id)
|
||||||
|
if fehler:
|
||||||
|
return {"ok": False, "error": fehler}
|
||||||
|
|
||||||
|
if konz.get("quelle") == "repo":
|
||||||
|
quelle = (f"· {_wo_liegt(konz)}\n"
|
||||||
|
"· Die NEUE FASSUNG gehoert an dieselbe Stelle: Repo voll klonen, die Datei "
|
||||||
|
"ueberschreiben, committen und auf main pushen (Push mit `git ls-remote origin main` "
|
||||||
|
"BEWEISEN, nicht annehmen). KEIN neues Repo anlegen — der Commander vergleicht die "
|
||||||
|
"Fassungen ueber die Git-Historie.")
|
||||||
|
else:
|
||||||
|
quelle = (f"· {_wo_liegt(konz)}\n"
|
||||||
|
"· Die NEUE FASSUNG gehoert an dieselbe Stelle. Sichere die alte Fassung vorher "
|
||||||
|
"als `<datei>.bak`, dann schreib die ueberarbeitete Fassung in die Originaldatei."
|
||||||
|
+ (" Gibt es das genannte Repo wirklich, gehoert die neue Fassung ZUSAETZLICH "
|
||||||
|
"als `KONZEPT.md` hinein (klonen, schreiben, pushen, Push beweisen)."
|
||||||
|
if konz.get("repo") else ""))
|
||||||
|
|
||||||
|
teile = [(f"{_UEBERARBEITEN_KOPF}\n{quelle}\n"
|
||||||
|
f"· SO SOLL ES ANDERS WERDEN — Wortlaut des Commanders:\n „{hinweis}“\n"
|
||||||
|
f"{_UEBERARBEITEN_FUSS}"),
|
||||||
|
_INFRA_LXC]
|
||||||
|
titel = f"Konzept nachschärfen: {kurz}"[:200]
|
||||||
|
args = ["create", titel, "--body", "\n\n".join(teile)[:4000], "--assignee", "projektstart",
|
||||||
|
"--parent", task_id, "--created-by", "mc2-ui", "--json"]
|
||||||
|
try:
|
||||||
|
r = _hermes(args)
|
||||||
|
except Exception as exc:
|
||||||
|
return {"ok": False, "error": f"Queue nicht erreichbar: {exc}"}
|
||||||
|
task = _parse_json(r.stdout)
|
||||||
|
if r.returncode != 0 or not isinstance(task, dict) or not task.get("id"):
|
||||||
|
return {"ok": False,
|
||||||
|
"error": (r.stderr or r.stdout or "kanban create fehlgeschlagen").strip()[:300]}
|
||||||
|
# Die alte Fassung wird ueberschrieben → gecachtes Konzept der Quell-Karte verwerfen,
|
||||||
|
# sonst zeigt die alte Karte nach der Ueberarbeitung noch tagelang den alten Stand.
|
||||||
|
_konzept_cache.pop(task_id, None)
|
||||||
|
_list_cache["ts"] = 0.0
|
||||||
|
try:
|
||||||
|
from services import announce
|
||||||
|
announce.add(f"Konzept „{_kurz(kurz, 60)}“ wird nachgeschärft ({task['id']}): "
|
||||||
|
f"„{_kurz(hinweis, 120)}“",
|
||||||
|
"[Ideen-Queue]", "ideen-queue", "silent")
|
||||||
|
except Exception:
|
||||||
|
pass
|
||||||
|
return {"ok": True, "id": task["id"], "titel": titel}
|
||||||
|
|
||||||
|
|
||||||
def log_of(task_id: str) -> dict:
|
def log_of(task_id: str) -> dict:
|
||||||
"""Worker-Log einer Idee (hermes kanban log <id>), ANSI entfernt, letzte ~120 Zeilen."""
|
"""Worker-Log einer Idee (hermes kanban log <id>), ANSI entfernt, letzte ~120 Zeilen."""
|
||||||
if not _available():
|
if not _available():
|
||||||
@@ -781,7 +1196,7 @@ def log_of(task_id: str) -> dict:
|
|||||||
|
|
||||||
try:
|
try:
|
||||||
r = _hermes(["log", task_id])
|
r = _hermes(["log", task_id])
|
||||||
except Exception as exc:
|
except Exception:
|
||||||
log.warning("ideen: kanban log fehlgeschlagen", exc_info=True)
|
log.warning("ideen: kanban log fehlgeschlagen", exc_info=True)
|
||||||
return {"available": True, "lines": []}
|
return {"available": True, "lines": []}
|
||||||
if r.returncode != 0:
|
if r.returncode != 0:
|
||||||
|
|||||||
@@ -90,7 +90,7 @@ def _run_job(job_id: str, args: list[str], env: dict | None = None, sudo_passwor
|
|||||||
log_str = "\n".join(job["log"])
|
log_str = "\n".join(job["log"])
|
||||||
if "a password is required" in log_str or "password" in log_str.lower() or "sudo:" in log_str:
|
if "a password is required" in log_str or "password" in log_str.lower() or "sudo:" in log_str:
|
||||||
job["sudo_failed"] = True
|
job["sudo_failed"] = True
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
_append_log(job, f"[mc] Fehler: {exc}")
|
_append_log(job, f"[mc] Fehler: {exc}")
|
||||||
job["state"] = "failed"
|
job["state"] = "failed"
|
||||||
job["returncode"] = -1
|
job["returncode"] = -1
|
||||||
@@ -101,7 +101,7 @@ def _run_job(job_id: str, args: list[str], env: dict | None = None, sudo_passwor
|
|||||||
if cb and job["state"] == "done":
|
if cb and job["state"] == "done":
|
||||||
try:
|
try:
|
||||||
cb()
|
cb()
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
_append_log(job, f"[mc] Nachbearbeitung-Fehler: {exc}")
|
_append_log(job, f"[mc] Nachbearbeitung-Fehler: {exc}")
|
||||||
|
|
||||||
|
|
||||||
@@ -136,7 +136,7 @@ def attach_download_progress(job_id: str, local_dir: str, total_bytes: int) -> N
|
|||||||
j["rate_bps"] = rate
|
j["rate_bps"] = rate
|
||||||
j["eta_s"] = int((total_bytes - cur) / rate)
|
j["eta_s"] = int((total_bytes - cur) / rate)
|
||||||
prev_t, prev_b = now, cur
|
prev_t, prev_b = now, cur
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
time.sleep(1.0)
|
time.sleep(1.0)
|
||||||
j = JOBS.get(job_id)
|
j = JOBS.get(job_id)
|
||||||
@@ -182,7 +182,7 @@ def cancel_job(job_id: str) -> bool:
|
|||||||
if proc is not None:
|
if proc is not None:
|
||||||
try:
|
try:
|
||||||
proc.terminate()
|
proc.terminate()
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
else:
|
else:
|
||||||
job["state"] = "canceled"
|
job["state"] = "canceled"
|
||||||
|
|||||||
@@ -87,7 +87,6 @@ def _tick() -> None:
|
|||||||
return
|
return
|
||||||
items = data.get("items") or []
|
items = data.get("items") or []
|
||||||
projekte = data.get("projekte") or []
|
projekte = data.get("projekte") or []
|
||||||
by_id = {i["id"]: i for i in items if i.get("id")}
|
|
||||||
state = _load_state()
|
state = _load_state()
|
||||||
gemeldete_fragen: dict = state.setdefault("fragen", {})
|
gemeldete_fragen: dict = state.setdefault("fragen", {})
|
||||||
projekt_state: dict = state.setdefault("projekte", {})
|
projekt_state: dict = state.setdefault("projekte", {})
|
||||||
|
|||||||
@@ -11,12 +11,17 @@ import os
|
|||||||
import re
|
import re
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
from ruamel.yaml.scalarstring import LiteralScalarString
|
|
||||||
|
|
||||||
from config import (
|
from config import (
|
||||||
CMD_TEMPLATE, CONFIG_PATH, DEFAULT_TTL, DRAFTS_DIR, LLAMA_SWAP_URL,
|
CMD_TEMPLATE,
|
||||||
SPEC_DRAFT_MODEL_PATH, SPEC_DRAFT_N_MAX, SPEC_TYPE,
|
CONFIG_PATH,
|
||||||
|
DEFAULT_TTL,
|
||||||
|
DRAFTS_DIR,
|
||||||
|
LLAMA_SWAP_URL,
|
||||||
|
SPEC_DRAFT_MODEL_PATH,
|
||||||
|
SPEC_DRAFT_N_MAX,
|
||||||
|
SPEC_TYPE,
|
||||||
)
|
)
|
||||||
|
from ruamel.yaml.scalarstring import LiteralScalarString
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
@@ -143,13 +148,13 @@ def model_id_from_path(model_path: str) -> str:
|
|||||||
Split-GGUFs liegen oft in einem Quant-Unterordner (…/Q4_K_M/file-00001-of-…) →
|
Split-GGUFs liegen oft in einem Quant-Unterordner (…/Q4_K_M/file-00001-of-…) →
|
||||||
dann eine Ebene höher (Repo-Ordner) nehmen, sonst hieße das Modell 'Q4_K_M'."""
|
dann eine Ebene höher (Repo-Ordner) nehmen, sonst hieße das Modell 'Q4_K_M'."""
|
||||||
d = os.path.basename(os.path.dirname(model_path))
|
d = os.path.basename(os.path.dirname(model_path))
|
||||||
if re.fullmatch(r"(I?Q\d[\w]*|UD-Q\d[\w]*|F16|BF16|FP16|F32)", d, flags=re.I):
|
if re.fullmatch(r"(I?Q\d[\w]*|UD-Q\d[\w]*|F16|BF16|FP16|F32)", d, flags=re.IGNORECASE):
|
||||||
d = os.path.basename(os.path.dirname(os.path.dirname(model_path)))
|
d = os.path.basename(os.path.dirname(os.path.dirname(model_path)))
|
||||||
name = re.sub(r"[-_]?GGUF$", "", d, flags=re.I).strip("-_")
|
name = re.sub(r"[-_]?GGUF$", "", d, flags=re.IGNORECASE).strip("-_")
|
||||||
if not name:
|
if not name:
|
||||||
fn = re.sub(r"\.gguf$", "", os.path.basename(model_path), flags=re.I)
|
fn = re.sub(r"\.gguf$", "", os.path.basename(model_path), flags=re.IGNORECASE)
|
||||||
fn = re.sub(r"-\d+-of-\d+$", "", fn)
|
fn = re.sub(r"-\d+-of-\d+$", "", fn)
|
||||||
name = re.sub(r"[-_](Q\d[\w]*|IQ\d[\w]*|F16|BF16|FP16|F32)$", "", fn, flags=re.I)
|
name = re.sub(r"[-_](Q\d[\w]*|IQ\d[\w]*|F16|BF16|FP16|F32)$", "", fn, flags=re.IGNORECASE)
|
||||||
return name or "modell"
|
return name or "modell"
|
||||||
|
|
||||||
|
|
||||||
@@ -222,7 +227,7 @@ def write_config(cfg: dict) -> None:
|
|||||||
try:
|
try:
|
||||||
from services import warmer
|
from services import warmer
|
||||||
warmer.nudge()
|
warmer.nudge()
|
||||||
except Exception: # noqa: BLE001 — Vorwärmen ist Komfort, nie ein Schreib-Blocker
|
except Exception:
|
||||||
pass
|
pass
|
||||||
except PermissionError as exc:
|
except PermissionError as exc:
|
||||||
raise PermissionError(
|
raise PermissionError(
|
||||||
|
|||||||
@@ -35,7 +35,7 @@ _engine_cache = {"ts": 0.0, "avail": False}
|
|||||||
# manchmal noch keine CI-Assets (0 Assets) → ihr Download-Link 404t. Sowohl der Update-Check
|
# manchmal noch keine CI-Assets (0 Assets) → ihr Download-Link 404t. Sowohl der Update-Check
|
||||||
# als auch der Download (update-engine.sh) müssen daher die neueste ASSET-tragende Release
|
# als auch der Download (update-engine.sh) müssen daher die neueste ASSET-tragende Release
|
||||||
# nehmen, sonst zeigt das UI „Update verfügbar", das dann beim Einspielen scheitert.
|
# nehmen, sonst zeigt das UI „Update verfügbar", das dann beim Einspielen scheitert.
|
||||||
_ENGINE_ASSET_RX = re.compile(r"ubuntu-vulkan-x64\.tar\.gz$", re.I)
|
_ENGINE_ASSET_RX = re.compile(r"ubuntu-vulkan-x64\.tar\.gz$", re.IGNORECASE)
|
||||||
|
|
||||||
|
|
||||||
def _latest_engine_asset_release() -> dict | None:
|
def _latest_engine_asset_release() -> dict | None:
|
||||||
@@ -289,7 +289,7 @@ def model_upgrades() -> list[dict]:
|
|||||||
continue
|
continue
|
||||||
|
|
||||||
base = rec.split("/")[-1].lower()
|
base = rec.split("/")[-1].lower()
|
||||||
stem = base[:-5] if base.endswith("-gguf") else base
|
stem = base.removesuffix("-gguf")
|
||||||
if base in cmds or (stem and stem in cmds):
|
if base in cmds or (stem and stem in cmds):
|
||||||
continue # schon installiert
|
continue # schon installiert
|
||||||
out.append({"role": role, "title": c["title"], "repo": rec})
|
out.append({"role": role, "title": c["title"], "repo": rec})
|
||||||
@@ -343,7 +343,7 @@ def _os_held_back() -> list[dict]:
|
|||||||
held.append({"name": name, "reason": reason})
|
held.append({"name": name, "reason": reason})
|
||||||
elif reason: # nicht eingerückt → Abschnitt zu Ende
|
elif reason: # nicht eingerückt → Abschnitt zu Ende
|
||||||
reason = None
|
reason = None
|
||||||
except Exception: # noqa: BLE001 — nur Zusatzinfo, nie ein Blocker
|
except Exception:
|
||||||
pass
|
pass
|
||||||
held.sort(key=lambda p: p["name"])
|
held.sort(key=lambda p: p["name"])
|
||||||
return held
|
return held
|
||||||
@@ -368,7 +368,7 @@ def os_update_details() -> dict:
|
|||||||
out_pkgs.sort(key=lambda p: p["name"])
|
out_pkgs.sort(key=lambda p: p["name"])
|
||||||
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs,
|
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs,
|
||||||
"held_back": _os_held_back()}
|
"held_back": _os_held_back()}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs, "error": str(exc)}
|
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs, "error": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
@@ -393,7 +393,7 @@ def engine_update_details() -> dict:
|
|||||||
ctx = ("Es geht um ein Update der Inferenz-Engine llama.cpp (Vulkan-Build, treibt alle "
|
ctx = ("Es geht um ein Update der Inferenz-Engine llama.cpp (Vulkan-Build, treibt alle "
|
||||||
"Sprachmodelle der Box auf der AMD-Strix-Halo-GPU).")
|
"Sprachmodelle der Box auf der AMD-Strix-Halo-GPU).")
|
||||||
info.update(_summarize_release("engine", tag, ctx, body[:6000]))
|
info.update(_summarize_release("engine", tag, ctx, body[:6000]))
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
info["error"] = str(exc)
|
info["error"] = str(exc)
|
||||||
return info
|
return info
|
||||||
|
|
||||||
@@ -418,7 +418,7 @@ def swap_update_details() -> dict:
|
|||||||
ctx = ("Es geht um ein Update von llama-swap (der Router, der Anfragen an die Box "
|
ctx = ("Es geht um ein Update von llama-swap (der Router, der Anfragen an die Box "
|
||||||
"verteilt und Sprachmodelle heiß nachlädt).")
|
"verteilt und Sprachmodelle heiß nachlädt).")
|
||||||
info.update(_summarize_release("swap", tag, ctx, body[:6000]))
|
info.update(_summarize_release("swap", tag, ctx, body[:6000]))
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
info["error"] = str(exc)
|
info["error"] = str(exc)
|
||||||
return info
|
return info
|
||||||
|
|
||||||
@@ -496,7 +496,7 @@ def _summarize_release(kind: str, key: str, context: str, changes: str) -> dict:
|
|||||||
if text:
|
if text:
|
||||||
cache.update(key=key, data=data)
|
cache.update(key=key, data=data)
|
||||||
return data
|
return data
|
||||||
except Exception as exc: # noqa: BLE001 — Zusammenfassung ist Komfort, nie Blocker
|
except Exception as exc:
|
||||||
return {"summary": f"(Zusammenfassung nicht verfügbar: {exc})",
|
return {"summary": f"(Zusammenfassung nicht verfügbar: {exc})",
|
||||||
"action_needed": None, "action_text": ""}
|
"action_needed": None, "action_text": ""}
|
||||||
|
|
||||||
@@ -534,7 +534,7 @@ def hermes_update_details() -> dict:
|
|||||||
info["behind"] = len(commits)
|
info["behind"] = len(commits)
|
||||||
if commits:
|
if commits:
|
||||||
info.update(_summarize_hermes_commits(commits))
|
info.update(_summarize_hermes_commits(commits))
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
info["error"] = str(exc)
|
info["error"] = str(exc)
|
||||||
return info
|
return info
|
||||||
|
|
||||||
@@ -575,7 +575,7 @@ def _run(cmd: list[str], sudo_password: str | None = None) -> dict:
|
|||||||
return {"ok": False, "status": "password_required", "out": p.stdout or "", "err": "Sudo-Passwort erforderlich."}
|
return {"ok": False, "status": "password_required", "out": p.stdout or "", "err": "Sudo-Passwort erforderlich."}
|
||||||
|
|
||||||
return {"ok": p.returncode == 0, "out": (p.stdout or "")[-4000:], "err": (p.stderr or "")[-2000:]}
|
return {"ok": p.returncode == 0, "out": (p.stdout or "")[-4000:], "err": (p.stderr or "")[-2000:]}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"ok": False, "out": "", "err": str(exc)}
|
return {"ok": False, "out": "", "err": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
|
|||||||
@@ -19,7 +19,6 @@ import re
|
|||||||
from difflib import SequenceMatcher
|
from difflib import SequenceMatcher
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import MEM0_SERVICE_URL
|
from config import MEM0_SERVICE_URL
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|||||||
@@ -51,7 +51,7 @@ def _load() -> None:
|
|||||||
log.info("metrics_history: %d Punkte aus %s geladen", len(_points), HISTORY_PATH)
|
log.info("metrics_history: %d Punkte aus %s geladen", len(_points), HISTORY_PATH)
|
||||||
except FileNotFoundError:
|
except FileNotFoundError:
|
||||||
pass
|
pass
|
||||||
except Exception: # noqa: BLE001 — kaputte Datei = leer starten, nie crashen
|
except Exception:
|
||||||
log.warning("metrics_history: %s nicht lesbar — starte leer", HISTORY_PATH, exc_info=True)
|
log.warning("metrics_history: %s nicht lesbar — starte leer", HISTORY_PATH, exc_info=True)
|
||||||
|
|
||||||
|
|
||||||
@@ -77,19 +77,19 @@ def _sample() -> None:
|
|||||||
try:
|
try:
|
||||||
du = psutil.disk_usage(str(MODELS_DIR) if MODELS_DIR.exists() else os.getcwd())
|
du = psutil.disk_usage(str(MODELS_DIR) if MODELS_DIR.exists() else os.getcwd())
|
||||||
disk = du.percent
|
disk = du.percent
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
gpu = None
|
gpu = None
|
||||||
try:
|
try:
|
||||||
g = _gpu_sysfs()
|
g = _gpu_sysfs()
|
||||||
gpu = g.get("busy_percent") if g else None
|
gpu = g.get("busy_percent") if g else None
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
tp = tc = None
|
tp = tc = None
|
||||||
try:
|
try:
|
||||||
ts = get_stats()
|
ts = get_stats()
|
||||||
tp, tc = ts.get("prompt_tokens"), ts.get("completion_tokens")
|
tp, tc = ts.get("prompt_tokens"), ts.get("completion_tokens")
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
# interval=None: nicht-blockierende CPU-Messung seit dem letzten Aufruf (10 s her — ideal).
|
# interval=None: nicht-blockierende CPU-Messung seit dem letzten Aufruf (10 s her — ideal).
|
||||||
_points.append([int(time.time()), psutil.cpu_percent(interval=None), vm.percent, gpu, disk, tp, tc])
|
_points.append([int(time.time()), psutil.cpu_percent(interval=None), vm.percent, gpu, disk, tp, tc])
|
||||||
@@ -101,12 +101,12 @@ async def sampler_loop() -> None:
|
|||||||
while True:
|
while True:
|
||||||
try:
|
try:
|
||||||
await asyncio.to_thread(_sample)
|
await asyncio.to_thread(_sample)
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
log.debug("metrics_history: Sample fehlgeschlagen", exc_info=True)
|
log.debug("metrics_history: Sample fehlgeschlagen", exc_info=True)
|
||||||
if time.time() - _last_flush >= FLUSH_S:
|
if time.time() - _last_flush >= FLUSH_S:
|
||||||
try:
|
try:
|
||||||
await asyncio.to_thread(_flush)
|
await asyncio.to_thread(_flush)
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
await asyncio.sleep(SAMPLE_S)
|
await asyncio.sleep(SAMPLE_S)
|
||||||
|
|
||||||
|
|||||||
@@ -24,6 +24,7 @@ from pathlib import Path
|
|||||||
from zoneinfo import ZoneInfo
|
from zoneinfo import ZoneInfo
|
||||||
|
|
||||||
from config import MODELS_DIR
|
from config import MODELS_DIR
|
||||||
|
|
||||||
from services import announce
|
from services import announce
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|||||||
@@ -20,8 +20,8 @@ import time
|
|||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import psutil
|
import psutil
|
||||||
|
from config import HERMES_API_URL, MEM0_SERVICE_URL, MODELS_DIR, VOICE_SERVICE_URL
|
||||||
|
|
||||||
from config import HERMES_API_URL, LLAMA_SWAP_URL, MEM0_SERVICE_URL, MODELS_DIR, VOICE_SERVICE_URL
|
|
||||||
from services import announce, llamaswap
|
from services import announce, llamaswap
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
@@ -100,7 +100,7 @@ if os.environ.get("MC_SENTRY_WATCH_MC2", "") == "1":
|
|||||||
|
|
||||||
|
|
||||||
class _Watch:
|
class _Watch:
|
||||||
__slots__ = ("fails", "alerted", "alert_ts")
|
__slots__ = ("alert_ts", "alerted", "fails")
|
||||||
|
|
||||||
def __init__(self) -> None:
|
def __init__(self) -> None:
|
||||||
self.fails = 0 # Fehl-Ticks in Folge
|
self.fails = 0 # Fehl-Ticks in Folge
|
||||||
|
|||||||
@@ -12,7 +12,6 @@ import subprocess
|
|||||||
import threading
|
import threading
|
||||||
|
|
||||||
import psutil
|
import psutil
|
||||||
|
|
||||||
from config import MODELS_DIR
|
from config import MODELS_DIR
|
||||||
|
|
||||||
|
|
||||||
|
|||||||
@@ -11,7 +11,6 @@ import json
|
|||||||
import logging
|
import logging
|
||||||
import threading
|
import threading
|
||||||
import time
|
import time
|
||||||
from pathlib import Path
|
|
||||||
|
|
||||||
from config import HERMES_HOME
|
from config import HERMES_HOME
|
||||||
|
|
||||||
|
|||||||
@@ -24,7 +24,6 @@ import os
|
|||||||
import subprocess
|
import subprocess
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import LLAMA_SWAP_URL
|
from config import LLAMA_SWAP_URL
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
@@ -74,7 +73,18 @@ def _run_warmup() -> bool:
|
|||||||
|
|
||||||
|
|
||||||
def _warmset_members() -> set[str]:
|
def _warmset_members() -> set[str]:
|
||||||
"""Soll-Warm-Set = Mitglieder aller ko-residenten Gruppen (swap:false bzw. persist/persistent)."""
|
"""Soll-Warm-Set. `MC_WARMSET` (leerzeichengetrennt) schlägt die Gruppen-Ableitung.
|
||||||
|
|
||||||
|
Warum ein Override (26.07.2026): Seit die ko-residente Gruppe auch Modelle MIT TTL
|
||||||
|
enthält (Coder 90 min, Kritiker 30 min), ist „alle Gruppen-Mitglieder" das falsche Ziel.
|
||||||
|
Der Wächter würde gegen die TTLs arbeiten und nachts 62 GB wieder hochladen, die
|
||||||
|
absichtlich freigegeben wurden. Ko-Residenz („dürfen gleichzeitig liegen") und
|
||||||
|
Warm-Pflicht („müssen immer liegen") sind zwei verschiedene Aussagen — die Gruppe kann
|
||||||
|
nur die erste ausdrücken.
|
||||||
|
"""
|
||||||
|
explizit = os.environ.get("MC_WARMSET", "").split()
|
||||||
|
if explizit:
|
||||||
|
return set(explizit)
|
||||||
try:
|
try:
|
||||||
from services import llamaswap
|
from services import llamaswap
|
||||||
groups = llamaswap.list_groups() or {}
|
groups = llamaswap.list_groups() or {}
|
||||||
|
|||||||
@@ -154,7 +154,7 @@ async def volume_control(req: dict):
|
|||||||
async def open_target(req: dict):
|
async def open_target(req: dict):
|
||||||
target = req.get("target", "")
|
target = req.get("target", "")
|
||||||
try:
|
try:
|
||||||
if target.startswith("http://") or target.startswith("https://"):
|
if target.startswith(("http://", "https://")):
|
||||||
webbrowser.open(target)
|
webbrowser.open(target)
|
||||||
else:
|
else:
|
||||||
os.startfile(target)
|
os.startfile(target)
|
||||||
|
|||||||
@@ -0,0 +1,76 @@
|
|||||||
|
---
|
||||||
|
name: projekt-uebernehmen
|
||||||
|
description: Ein von der AI-Box vorbereitetes Projekt in Zed uebernehmen und starten - Konzept und Roadmap einlesen, die offenen Punkte mit dem Commander klaeren, dann Etappe 1 planen und bauen. Nutze diesen Skill beim ERSTEN Chat in einem Projekt-Ordner, der KONZEPT.md und ROADMAP.md enthaelt, aber noch keinen (oder kaum) eigenen Code - also bei jedem frisch vorbereiteten Repo aus dem Auftragsbuch.
|
||||||
|
metadata:
|
||||||
|
quelle: mission-control-2/client/ide-skills
|
||||||
|
---
|
||||||
|
|
||||||
|
# Vorbereitetes Projekt übernehmen
|
||||||
|
|
||||||
|
Die Box hat gedacht, du baust. Das Konzept in diesem Ordner ist **bereits gehärtet** — mehrere
|
||||||
|
Fach-Rollen und ein Advocatus Diaboli haben es auf der Box durchgearbeitet. Deine Aufgabe ist
|
||||||
|
nicht, es neu zu denken, sondern es umzusetzen.
|
||||||
|
|
||||||
|
**Zwei Modelle, ein Ablauf:** Stufe 1 und 2 (einlesen, nachfragen, planen) gehören in den
|
||||||
|
**Planer**, Stufe 3 (bauen) in den **Coder**. Du kannst nicht selbst umschalten — wenn der Plan
|
||||||
|
freigegeben ist, bitte den Commander ausdrücklich darum, oben im Modellwähler auf Coder zu
|
||||||
|
wechseln. Läufst du schon im Coder, ist das auch in Ordnung: dann gilt trotzdem erst lesen,
|
||||||
|
fragen, Plan zeigen — und **keine Datei vor seinem „los"**.
|
||||||
|
|
||||||
|
Drei Stufen, in dieser Reihenfolge. **Vor Stufe 3 wird keine Datei angefasst.**
|
||||||
|
|
||||||
|
## 1. Einlesen — still, ohne Rückfragen
|
||||||
|
|
||||||
|
Lies, was da ist: `KONZEPT.md`, `ROADMAP.md`, `AGENTS.md`, `SAVEPOINT.md`, `README.md`.
|
||||||
|
Verschaff dir den Ist-Zustand: `git log --oneline -5` und den Dateibaum.
|
||||||
|
|
||||||
|
Zwei Abbruch-Fälle — prüfe sie ZUERST:
|
||||||
|
|
||||||
|
- **Es gibt schon Code und Historie.** Dann ist das keine Übernahme, sondern Fortsetzung:
|
||||||
|
arbeite nach `SAVEPOINT.md` weiter und sag in zwei Sätzen, wo ihr steht. Dieser Skill ist
|
||||||
|
hier fertig.
|
||||||
|
- **Nur `KONZEPT.md` + `README.md`, keine `ROADMAP.md`.** Das ist ein *geprüfte-Idee*-Repo, kein
|
||||||
|
startklares Projekt — die Box legt bei „Idee prüfen" bewusst kein Gerüst an. Sag dem Commander:
|
||||||
|
*„Das ist bisher nur ein durchdachtes Konzept, noch kein Projekt. Im Auftragsbuch gibt es auf
|
||||||
|
der Karte den Knopf ‚Gefällt mir — Projekt daraus machen'; danach hat das Repo eine Roadmap und
|
||||||
|
ich kann loslegen."* Dann **STOPP**, nichts bauen.
|
||||||
|
|
||||||
|
Sonst: fasse in **höchstens 8 Zeilen** zusammen — was gebaut wird, für wen, welche Technik,
|
||||||
|
und was laut Roadmap **Etappe 1** ist. Alltagssprache, keine Fachbegriffe ohne Übersetzung.
|
||||||
|
|
||||||
|
## 2. Fragen stellen — der eigentliche Wert dieses Schritts
|
||||||
|
|
||||||
|
Stell **3 bis 6 Fragen**. Nicht mehr, und nur solche, die den Start wirklich blockieren.
|
||||||
|
|
||||||
|
- **Nichts fragen, was in den Dokumenten steht.** Wer das Konzept nicht gelesen hat, merkt man
|
||||||
|
genau hier.
|
||||||
|
- Jede Frage: eine Zeile, Alltagssprache, **mit deiner Empfehlung** („ich würde X nehmen, weil …").
|
||||||
|
Der Commander ist kein Entwickler — frag nach Zielen, Vorlieben und Gegebenheiten, nie nach
|
||||||
|
Bau-Prinzipien oder Architektur-Geschmack. Das ist dein Job.
|
||||||
|
- Die üblichen echten Lücken: Wo läuft es am Ende? Welche Zugänge/Geräte/Pfade brauchst du von
|
||||||
|
ihm? Was ist in Etappe 1 ausdrücklich **nicht** drin? Woran merkt ihr beide, dass Etappe 1
|
||||||
|
fertig ist?
|
||||||
|
- Der Abschnitt „offene Punkte" / „Risiken" im Konzept ist deine Fundgrube — genau dafür steht er da.
|
||||||
|
|
||||||
|
Dann **warten**. Keine Annahmen, kein Vorpreschen, kein „ich fange schon mal an".
|
||||||
|
|
||||||
|
## 3. Plan → „los" → bauen
|
||||||
|
|
||||||
|
1. **Etappe-1-Plan** vorlegen: Ziel · Vorgehen in kleinen Schritten · Technik und warum ·
|
||||||
|
Fertig-Kriterien · Risiken. Etappe 1 muss **für sich lauffähig** sein — eine halbe Baustelle ist
|
||||||
|
kein Meilenstein.
|
||||||
|
2. **STOPP**, auf sein „los" warten. Danach der Satz, den er hören muss: *„Bitte oben im
|
||||||
|
Modellwähler auf **Coder** umschalten, dann lege ich los."* Umschalten kannst du nicht selbst.
|
||||||
|
3. Bauen: kleine Schritte, ein Sicherungspunkt (Commit mit klarem Namen) je Meilenstein und vor
|
||||||
|
riskanten Änderungen. Am Ende **live testen** — beweisen statt behaupten.
|
||||||
|
4. Nachführen: `SAVEPOINT.md` (Stand, nächster Schritt, offene Fragen) und die erledigte Etappe in
|
||||||
|
`ROADMAP.md` abhaken. Das ist das Gedächtnis für den nächsten Chat.
|
||||||
|
|
||||||
|
## Merksätze
|
||||||
|
|
||||||
|
- **Du denkst das Konzept nicht neu.** Findest du einen echten Widerspruch oder eine Lücke:
|
||||||
|
benenne sie und frag — bau nicht still etwas anderes.
|
||||||
|
- **Nichts bauen, was nicht in Etappe 1 steht.** Ideen für später gehören in die Roadmap, nicht
|
||||||
|
in den Code.
|
||||||
|
- Geheimnisse (Schlüssel, Passwörter, Tokens) nie in den Code — `.env` plus `.gitignore`.
|
||||||
|
- Klemmt dieselbe Sache zweimal: anhalten, sichern, erklären, fragen.
|
||||||
@@ -43,6 +43,10 @@ STATE_TTL = 48 * 3600
|
|||||||
BLOCK_REASON = (
|
BLOCK_REASON = (
|
||||||
"NO-PROGRESS-BREMSE: '{tool}' hat {n}x in Folge dasselbe Ergebnismuster geliefert — "
|
"NO-PROGRESS-BREMSE: '{tool}' hat {n}x in Folge dasselbe Ergebnismuster geliefert — "
|
||||||
"das ist Stillstand, egal wie sehr die Befehle variieren. STOPP. "
|
"das ist Stillstand, egal wie sehr die Befehle variieren. STOPP. "
|
||||||
|
"WICHTIG: Dein Befehl wurde NICHT ausgefuehrt. Das hier ist eine Bremse, KEIN Ergebnis — "
|
||||||
|
"schliesse daraus NICHTS ueber die Existenz oder den Zustand von Dateien, Verzeichnissen "
|
||||||
|
"oder Diensten (Vorfall 21.07.2026: ein Worker hielt diese Meldung fuer 'Verzeichnis nicht "
|
||||||
|
"vorhanden' und baute eine halbe Stunde Arbeit neu). "
|
||||||
"1) Benenne das Hindernis in EINEM Satz (was genau meldet das Ergebnis?). "
|
"1) Benenne das Hindernis in EINEM Satz (was genau meldet das Ergebnis?). "
|
||||||
"2) Diagnose statt Variation — bei SSH/Zugriff ZUERST: Schluessel-Passphrase pruefen "
|
"2) Diagnose statt Variation — bei SSH/Zugriff ZUERST: Schluessel-Passphrase pruefen "
|
||||||
"(`ssh-keygen -y -f <key> </dev/null` — stilles 'Permission denied' = verschluesselter Key), "
|
"(`ssh-keygen -y -f <key> </dev/null` — stilles 'Permission denied' = verschluesselter Key), "
|
||||||
@@ -51,6 +55,44 @@ BLOCK_REASON = (
|
|||||||
"Commander uebergeben. Dein naechster Versuch ist frei — nutze ihn erst NACH der Diagnose."
|
"Commander uebergeben. Dein naechster Versuch ist frei — nutze ihn erst NACH der Diagnose."
|
||||||
)
|
)
|
||||||
|
|
||||||
|
# Rein LESENDE Befehle nie bremsen (21.07.2026). Die Bremse verlangt selbst „Diagnose
|
||||||
|
# statt Variation" — genau die besteht aus vielen kurzen Schau-Befehlen (ls/cat/git log),
|
||||||
|
# deren Ergebnisse sich stark aehneln. Die Signatur hielt das fuer Stillstand und blockte
|
||||||
|
# den naechsten Blick; der Worker las die Block-Meldung als „da ist nichts" und baute
|
||||||
|
# alles neu (Karte t_d26c3203, eine halbe Stunde Arbeit weggeworfen). Geschaut wird also
|
||||||
|
# ungebremst — gebremst wird nur, wer immer wieder dasselbe TUT.
|
||||||
|
# Bewusst strukturell (Befehls-Art), nicht per Fehlertext-Liste: die Bremse soll generisch
|
||||||
|
# bleiben und Neues selbst erkennen.
|
||||||
|
_LESEND = {"ls", "cat", "head", "tail", "wc", "stat", "find", "grep", "rg", "file",
|
||||||
|
"du", "df", "echo", "pwd", "tree", "readlink", "basename", "dirname", "which"}
|
||||||
|
_GIT_LESEND = {"status", "log", "show", "diff", "ls-remote", "ls-files", "rev-parse",
|
||||||
|
"merge-base", "describe"}
|
||||||
|
|
||||||
|
|
||||||
|
def _nur_lesend(cmd: str) -> bool:
|
||||||
|
"""True, wenn der Befehl ausschliesslich schaut — kein Schreiben, kein Eingriff."""
|
||||||
|
cmd = (cmd or "").strip()
|
||||||
|
if not cmd or ">" in cmd: # jede Umleitung = schreiben
|
||||||
|
return False
|
||||||
|
for teil in re.split(r"&&|\|\||;|\|", cmd):
|
||||||
|
worte = teil.split()
|
||||||
|
i = 0
|
||||||
|
while i < len(worte) and "=" in worte[i] and not worte[i].startswith("-"):
|
||||||
|
i += 1 # VAR=wert-Praefixe ueberspringen
|
||||||
|
if i >= len(worte):
|
||||||
|
return False
|
||||||
|
verb = os.path.basename(worte[i])
|
||||||
|
if verb == "git":
|
||||||
|
rest = [w for w in worte[i + 1:] if not w.startswith("-")]
|
||||||
|
# `git log …` oder `git -C <pfad> log …` → erstes oder zweites Wort zaehlt
|
||||||
|
if not (rest[:1] and rest[0] in _GIT_LESEND) and \
|
||||||
|
not (rest[1:2] and rest[1] in _GIT_LESEND):
|
||||||
|
return False
|
||||||
|
elif verb not in _LESEND:
|
||||||
|
return False
|
||||||
|
return True
|
||||||
|
|
||||||
|
|
||||||
_NUM_RE = re.compile(r"\d+")
|
_NUM_RE = re.compile(r"\d+")
|
||||||
_HEX_RE = re.compile(r"\b[0-9a-f]{8,}\b")
|
_HEX_RE = re.compile(r"\b[0-9a-f]{8,}\b")
|
||||||
_WS_RE = re.compile(r"\s+")
|
_WS_RE = re.compile(r"\s+")
|
||||||
@@ -113,6 +155,10 @@ def main() -> None:
|
|||||||
if tool == "terminal" and ("worker.sh" in str(_cmd) or "fremdblick.sh" in str(_cmd)):
|
if tool == "terminal" and ("worker.sh" in str(_cmd) or "fremdblick.sh" in str(_cmd)):
|
||||||
print("{}")
|
print("{}")
|
||||||
return
|
return
|
||||||
|
# Schauen ist keine Schleife (siehe _nur_lesend): weder zaehlen noch blocken.
|
||||||
|
if tool == "terminal" and _nur_lesend(str(_cmd)):
|
||||||
|
print("{}")
|
||||||
|
return
|
||||||
os.makedirs(STATE_DIR, exist_ok=True)
|
os.makedirs(STATE_DIR, exist_ok=True)
|
||||||
sfile = os.path.join(STATE_DIR, _session_key(payload) + ".json")
|
sfile = os.path.join(STATE_DIR, _session_key(payload) + ".json")
|
||||||
state = _load(sfile)
|
state = _load(sfile)
|
||||||
|
|||||||
@@ -20,7 +20,10 @@ nur Schreib-Operationen.
|
|||||||
|
|
||||||
Ausgabe {"action":"block","message":...} = Tool geblockt; {} = durchlassen.
|
Ausgabe {"action":"block","message":...} = Tool geblockt; {} = durchlassen.
|
||||||
"""
|
"""
|
||||||
import sys, json, os, re
|
import json
|
||||||
|
import os
|
||||||
|
import re
|
||||||
|
import sys
|
||||||
|
|
||||||
|
|
||||||
def out(obj):
|
def out(obj):
|
||||||
@@ -95,7 +98,7 @@ if tool == "terminal":
|
|||||||
"TABU (R5): `git init` ist im Worker-Workspace gesperrt — Orphan-Branches ohne "
|
"TABU (R5): `git init` ist im Worker-Workspace gesperrt — Orphan-Branches ohne "
|
||||||
"gemeinsamen Ursprung mit main sind bei der Annahme technisch tot (Vorfaelle "
|
"gemeinsamen Ursprung mit main sind bei der Annahme technisch tot (Vorfaelle "
|
||||||
"12.–14.07.). Richtiger Weg: VOLL klonen, z. B. git clone "
|
"12.–14.07.). Richtiger Weg: VOLL klonen, z. B. git clone "
|
||||||
"https://git.tobisniceshomelab.ddnsfree.com/Hitonabi/mission-control-v2 "
|
"http://192.168.178.153:3000/Hitonabi/mission-control-v2 "
|
||||||
"(Credentials liegen in ~/.git-credentials), dann Branch von origin/main abzweigen.")})
|
"(Credentials liegen in ~/.git-credentials), dann Branch von origin/main abzweigen.")})
|
||||||
# Schreib-Subkommandos von git (V16: + clone — `git clone URL ~/mission-control-v2`
|
# Schreib-Subkommandos von git (V16: + clone — `git clone URL ~/mission-control-v2`
|
||||||
# rutschte vorher an (a) UND (d) vorbei).
|
# rutschte vorher an (a) UND (d) vorbei).
|
||||||
|
|||||||
@@ -0,0 +1,76 @@
|
|||||||
|
# Universelle CI-Ampel — wird bei der Repo-Anlage automatisch eingepflanzt
|
||||||
|
# (gitea-repo-create.sh, Wasserdicht-Runde 22.07.2026) und läuft auf dem
|
||||||
|
# Gitea-Actions-Runner (arcane-VM).
|
||||||
|
# GRUNDSATZ: Rot ist ein Ergebnis („nicht bewiesen"), kein Ärgernis.
|
||||||
|
# • Reines Doku-Repo (noch kein Code) → GRÜN mit Vermerk.
|
||||||
|
# • Code ohne Tests → ROT. Tests sind Pflicht, kein Deko.
|
||||||
|
# Der Workflow erkennt selbst, was das Projekt ist (Python / Node / beides).
|
||||||
|
name: Ampel
|
||||||
|
on: [push, pull_request]
|
||||||
|
|
||||||
|
jobs:
|
||||||
|
ampel:
|
||||||
|
runs-on: ubuntu-latest
|
||||||
|
steps:
|
||||||
|
- uses: actions/checkout@v4
|
||||||
|
|
||||||
|
- name: Ampel — erkennt Projekt-Typ selbst und prüft entsprechend
|
||||||
|
shell: bash
|
||||||
|
run: |
|
||||||
|
# Der Runner startet bash mit -e — das schalten wir ab: die Ampel wertet
|
||||||
|
# JEDEN Fehler selbst (rot=1) und liefert am Ende EIN Klartext-Urteil.
|
||||||
|
# (Lehre Lauf #5: ungeschütztes pytest unter -e schnitt den Bericht ab.)
|
||||||
|
set -u +e
|
||||||
|
rot=0
|
||||||
|
py_datei=$(find . -name '*.py' -not -path './.git/*' -not -path '*/node_modules/*' -print -quit)
|
||||||
|
pkg_dateien=$(find . -name package.json -not -path '*/node_modules/*' -not -path './.git/*')
|
||||||
|
|
||||||
|
if [ -z "$py_datei" ] && [ -z "$pkg_dateien" ]; then
|
||||||
|
echo "✅ Doku-Repo (noch kein Code) — Ampel GRÜN mit Vermerk."
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
if [ -n "$py_datei" ]; then
|
||||||
|
echo "== Python erkannt =="
|
||||||
|
{ python3 -m venv /tmp/ampel-venv && . /tmp/ampel-venv/bin/activate; } || { echo "❌ Python-Setup kaputt (venv)"; exit 1; }
|
||||||
|
pip install -q ruff pytest || { echo "❌ Werkzeug-Installation kaputt"; exit 1; }
|
||||||
|
echo "-- Ruff (Linter: toter Code, kaputte Imports, Schlampereien)"
|
||||||
|
ruff check . || rot=1
|
||||||
|
echo "-- Abhängigkeiten installierbar? (halluzinierte Pakete fliegen hier auf)"
|
||||||
|
while IFS= read -r req; do
|
||||||
|
[ -n "$req" ] || continue
|
||||||
|
pip install -q -r "$req" || { echo "❌ $req nicht installierbar"; rot=1; }
|
||||||
|
done < <(find . -name 'requirements*.txt' -not -path '*/node_modules/*' -not -path './.git/*')
|
||||||
|
echo "-- Importierbar? (kaputte Modul-Struktur fliegt hier auf)"
|
||||||
|
python -m compileall -q . || rot=1
|
||||||
|
echo "-- Pytest (keine Tests gefunden = ROT)"
|
||||||
|
ec=0; pytest -q || ec=$?
|
||||||
|
if [ $ec -eq 5 ]; then
|
||||||
|
echo "❌ KEINE TESTS GEFUNDEN — Tests sind Pflicht, kein Deko (AGENTS.md)."
|
||||||
|
rot=1
|
||||||
|
elif [ $ec -ne 0 ]; then
|
||||||
|
rot=1
|
||||||
|
fi
|
||||||
|
fi
|
||||||
|
|
||||||
|
if [ -n "$pkg_dateien" ]; then
|
||||||
|
echo "== Node/TypeScript erkannt =="
|
||||||
|
while IFS= read -r pkg; do
|
||||||
|
[ -n "$pkg" ] || continue
|
||||||
|
d=$(dirname "$pkg")
|
||||||
|
echo "-- $d"
|
||||||
|
if [ ! -f "$d/package-lock.json" ]; then
|
||||||
|
echo "❌ $d: kein package-lock.json — Build nicht reproduzierbar."
|
||||||
|
echo " Fix: dort 'npm install --package-lock-only' ausführen und committen."
|
||||||
|
rot=1; continue
|
||||||
|
fi
|
||||||
|
(cd "$d" && npm ci --no-audit --no-fund) || { rot=1; continue; }
|
||||||
|
if grep -q '"build"' "$pkg"; then (cd "$d" && npm run build) || rot=1; fi
|
||||||
|
if grep -q '"test"' "$pkg"; then (cd "$d" && npm test --silent) || rot=1; fi
|
||||||
|
done <<< "$pkg_dateien"
|
||||||
|
fi
|
||||||
|
|
||||||
|
if [ $rot -ne 0 ]; then
|
||||||
|
echo "❌ AMPEL ROT — nichts heißt ‚fertig', solange das rot ist."
|
||||||
|
fi
|
||||||
|
exit $rot
|
||||||
@@ -0,0 +1,86 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# Ampel-Wächter (22.07.2026, Wasserdicht-Runde): meldet ROTE CI-Läufe aller
|
||||||
|
# Gitea-Repos per Telegram. Läuft als no-agent-Cron (stdout leer = still,
|
||||||
|
# klassisches Watchdog-Muster). Nur NEUE Fehlschläge werden gemeldet —
|
||||||
|
# Status-Merkliste unter ~/.hermes/state/ampel-waechter-gesehen.txt.
|
||||||
|
set -uo pipefail
|
||||||
|
|
||||||
|
STATE="$HOME/.hermes/state/ampel-waechter-gesehen.txt"
|
||||||
|
mkdir -p "$(dirname "$STATE")"; touch "$STATE"
|
||||||
|
|
||||||
|
TOKEN=$(grep -m1 'git\.tobisniceshomelab' "$HOME/.git-credentials" 2>/dev/null | sed -E 's#https://[^:]+:([^@]+)@.*#\1#')
|
||||||
|
[ -n "$TOKEN" ] || exit 0
|
||||||
|
|
||||||
|
python3 - "$TOKEN" "$STATE" <<'PY'
|
||||||
|
import json, sys, urllib.request
|
||||||
|
|
||||||
|
token, state_pfad = sys.argv[1], sys.argv[2]
|
||||||
|
# API intern (die DDNS-Domain ist nachts wegen Zwangstrennung oft tot, 24.07.2026);
|
||||||
|
# WEB bleibt die Domain — Telegram-Links muessen auch von unterwegs klickbar sein.
|
||||||
|
BASE = "http://192.168.178.153:3000/api/v1"
|
||||||
|
WEB = "https://git.tobisniceshomelab.ddnsfree.com"
|
||||||
|
|
||||||
|
|
||||||
|
def api(pfad):
|
||||||
|
req = urllib.request.Request(BASE + pfad, headers={"Authorization": "token " + token})
|
||||||
|
with urllib.request.urlopen(req, timeout=20) as r:
|
||||||
|
return json.load(r)
|
||||||
|
|
||||||
|
|
||||||
|
try:
|
||||||
|
gesehen = set(open(state_pfad).read().split())
|
||||||
|
except OSError:
|
||||||
|
gesehen = set()
|
||||||
|
|
||||||
|
neu = []
|
||||||
|
try:
|
||||||
|
# /repos/search statt /user/repos: das Token hat nur write:repository-Scope,
|
||||||
|
# /user/repos verlangt read:user -> 403. Der stille exit 0 hat diesen Defekt
|
||||||
|
# seit Inbetriebnahme versteckt (Fund 24.07.2026, Merkliste blieb leer).
|
||||||
|
repos = api("/repos/search?limit=50&private=true").get("data", [])
|
||||||
|
except Exception as e:
|
||||||
|
print(f"ampel-waechter: Repo-Liste fehlgeschlagen: {e}", file=sys.stderr)
|
||||||
|
sys.exit(0)
|
||||||
|
|
||||||
|
for repo in repos:
|
||||||
|
full = repo.get("full_name", "")
|
||||||
|
if not full or repo.get("archived"):
|
||||||
|
continue
|
||||||
|
try:
|
||||||
|
d = api(f"/repos/{full}/actions/tasks?limit=1")
|
||||||
|
except Exception:
|
||||||
|
continue
|
||||||
|
rows = d.get("workflow_runs", d if isinstance(d, list) else d.get("entries", []))
|
||||||
|
for t in rows[:1]:
|
||||||
|
kennung = f"{full}#{t.get('id')}"
|
||||||
|
status = t.get("status")
|
||||||
|
if status == "failure" and kennung not in gesehen:
|
||||||
|
# Status-Lügen-Wache (Fund 22.07.): alter Runner meldete Abschluss nicht,
|
||||||
|
# Gitea zombie-markierte GRÜNE Jobs als failure. Das Job-LOG ist die
|
||||||
|
# Wahrheit — steht dort „Job succeeded", ist es KEIN Alarm.
|
||||||
|
try:
|
||||||
|
req = urllib.request.Request(
|
||||||
|
f"{BASE}/repos/{full}/actions/jobs/{t.get('id')}/logs",
|
||||||
|
headers={"Authorization": "token " + token})
|
||||||
|
with urllib.request.urlopen(req, timeout=20) as r:
|
||||||
|
log_ende = r.read().decode(errors="replace")[-4000:]
|
||||||
|
wirklich_rot = "Job succeeded" not in log_ende
|
||||||
|
except Exception:
|
||||||
|
wirklich_rot = True
|
||||||
|
if wirklich_rot:
|
||||||
|
neu.append((full, t.get("head_sha", "")[:7], t.get("name", "")))
|
||||||
|
# Nur ABGESCHLOSSENE Läufe merken — ein 'running', das später rot wird,
|
||||||
|
# darf nicht schon als gesehen gelten.
|
||||||
|
if status in ("failure", "success", "cancelled", "skipped"):
|
||||||
|
gesehen.add(kennung)
|
||||||
|
|
||||||
|
if neu:
|
||||||
|
print("🔴 CI-AMPEL ROT:")
|
||||||
|
for full, sha, name in neu:
|
||||||
|
print(f"• {full} @ {sha} ({name})")
|
||||||
|
print(f" {WEB}/{full}/actions")
|
||||||
|
print("Nichts aus diesen Ständen ist ‚fertig', solange die Ampel rot ist.")
|
||||||
|
|
||||||
|
with open(state_pfad, "w") as f:
|
||||||
|
f.write("\n".join(sorted(gesehen)))
|
||||||
|
PY
|
||||||
@@ -6,6 +6,20 @@ LEBENDEN Box (Dienste, Modelle, Latenzen, Logs, Ressourcen). Keine Persona, kein
|
|||||||
**Dein Ergebnis ist ein Mess-/Diagnose-BERICHT mit belegten Zahlen — du misst und berichtest,
|
**Dein Ergebnis ist ein Mess-/Diagnose-BERICHT mit belegten Zahlen — du misst und berichtest,
|
||||||
du reparierst nicht.**
|
du reparierst nicht.**
|
||||||
|
|
||||||
|
## Schritt 0: WIEDERAUFNAHME — bei „Prior attempts" erst nachsehen, dann messen
|
||||||
|
|
||||||
|
Steht in deinem Auftrag ein Abschnitt **„Prior attempts on this task"**, hat vor dir schon ein
|
||||||
|
Lauf gemessen und ist unterwegs gestorben (meist Kontext-Limit). **Dein Workspace ist derselbe.**
|
||||||
|
Also zuerst: `cat FORTSCHRITT.md` und `ls -la` im Workspace — liegen dort schon Messwerte, Logs,
|
||||||
|
Bench-Ausgaben? **Vorhandene Zahlen misst du NICHT neu.** Das ist hier keine Bequemlichkeit,
|
||||||
|
sondern Pflicht: ein wiederholter Bench lädt 70-GB-Modelle, gefährdet Lucys Warm-Set und kann
|
||||||
|
einen OOM auslösen (Regel 5). Fehlt nur noch die Auswertung, wertest du aus und schließt ab.
|
||||||
|
Nur was nachweislich fehlt oder unbrauchbar ist, wird neu gemessen.
|
||||||
|
|
||||||
|
**Fortschritt hinterlassen:** jede fertige Messung sofort als Zeile in `FORTSCHRITT.md` im
|
||||||
|
Workspace (was gemessen, welche Zahl, in welcher Datei) — und die Rohausgabe in eine Datei
|
||||||
|
daneben. Eine Messung, die nur im Kontext steht, ist beim nächsten Lauf verloren.
|
||||||
|
|
||||||
## Eiserne Regeln (nicht verhandelbar)
|
## Eiserne Regeln (nicht verhandelbar)
|
||||||
1. **MESSEN, NICHT ÄNDERN.** Du fasst das Live-System NICHT an: kein `systemctl restart`, kein
|
1. **MESSEN, NICHT ÄNDERN.** Du fasst das Live-System NICHT an: kein `systemctl restart`, kein
|
||||||
Config-Edit, kein Deploy/Merge/Push, kein Laden/Entladen von Modellen, das das Warm-Set
|
Config-Edit, kein Deploy/Merge/Push, kein Laden/Entladen von Modellen, das das Warm-Set
|
||||||
|
|||||||
@@ -0,0 +1,11 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# curator-archive-watchdog.sh
|
||||||
|
# Archiviert Skills nach 14 Tagen Inaktivität (nächster Durchlauf um 3:00 Uhr)
|
||||||
|
|
||||||
|
set -euo pipefail
|
||||||
|
|
||||||
|
SCRIPT_DIR="$(cd "$(dirname "${BASH_SOURCE[0]}")" && pwd)"
|
||||||
|
PYTHON_SCRIPT="$SCRIPT_DIR/curator_archive_logic.py"
|
||||||
|
|
||||||
|
# Python-Skript ausführen
|
||||||
|
python3 "$PYTHON_SCRIPT"
|
||||||
@@ -0,0 +1,62 @@
|
|||||||
|
#!/bin/bash
|
||||||
|
# curator-idle-watchdog.sh
|
||||||
|
# Prüft den Curator-Idle-Status und triggert Reaktivierung nach 14 Tagen
|
||||||
|
|
||||||
|
set -euo pipefail
|
||||||
|
|
||||||
|
LOG_DIR="/home/hitonabi/.hermes/logs/curator"
|
||||||
|
LOG_FILE="$LOG_DIR/idle-watchdog-$(date +%Y%m%d).log"
|
||||||
|
THRESHOLD_DAYS=14
|
||||||
|
|
||||||
|
mkdir -p "$LOG_DIR"
|
||||||
|
|
||||||
|
log() {
|
||||||
|
echo "[$(date '+%Y-%m-%d %H:%M:%S')] $1" | tee -a "$LOG_FILE"
|
||||||
|
}
|
||||||
|
|
||||||
|
# Curator-Status auslesen
|
||||||
|
STATUS_OUTPUT=$(hermes curator status 2>&1) || {
|
||||||
|
log "FEHLER: hermes curator status fehlgeschlagen"
|
||||||
|
exit 1
|
||||||
|
}
|
||||||
|
|
||||||
|
# Prüfen, ob Curator ENABLED ist
|
||||||
|
if ! echo "$STATUS_OUTPUT" | grep -q "^curator: ENABLED$"; then
|
||||||
|
log "INFO: Curator ist nicht ENABLED → überspringe Prüfung"
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Letzten Lauf extrahieren (Format: "last run: 17d ago")
|
||||||
|
LAST_RUN_LINE=$(echo "$STATUS_OUTPUT" | grep "^ last run:" | head -1)
|
||||||
|
if [[ -z "$LAST_RUN_LINE" ]]; then
|
||||||
|
log "FEHLER: Konnte 'last run' nicht aus Status extrahieren"
|
||||||
|
exit 1
|
||||||
|
fi
|
||||||
|
|
||||||
|
LAST_RUN_TEXT=$(echo "$LAST_RUN_LINE" | sed 's/^ last run: *//')
|
||||||
|
log "Letzter Curator-Lauf: $LAST_RUN_TEXT"
|
||||||
|
|
||||||
|
# Prüfen, ob "d ago" vorhanden ist
|
||||||
|
if [[ "$LAST_RUN_TEXT" =~ ([0-9]+)d\ ago ]]; then
|
||||||
|
DAYS_SINCE_LAST_RUN="${BASH_REMATCH[1]}"
|
||||||
|
else
|
||||||
|
log "INFO: Kein 'd ago' gefunden (möglicherweise <1d oder nie gelaufen) → überspringe"
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
log "Tage seit letztem Lauf: $DAYS_SINCE_LAST_RUN"
|
||||||
|
|
||||||
|
# Threshold prüfen
|
||||||
|
if (( DAYS_SINCE_LAST_RUN < THRESHOLD_DAYS )); then
|
||||||
|
log "INFO: Curator ist innerhalb des erlaubten Intervalls ($DAYS_SINCE_LAST_RUN < $THRESHOLD_DAYS Tage) → kein Trigger nötig"
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Reaktivierung triggern
|
||||||
|
log "WARNUNG: Curator ist für $DAYS_SINCE_LAST_RUN Tage idle (>= $THRESHOLD_DAYS) → triggere 'hermes curator run'"
|
||||||
|
if hermes curator run 2>&1 | tee -a "$LOG_FILE"; then
|
||||||
|
log "ERFOLG: Curator-Reaktivierung gestartet"
|
||||||
|
else
|
||||||
|
log "FEHLER: Curator-Reaktivierung fehlgeschlagen"
|
||||||
|
exit 1
|
||||||
|
fi
|
||||||
Executable
+90
@@ -0,0 +1,90 @@
|
|||||||
|
#!/bin/bash
|
||||||
|
# curator-monitor.sh
|
||||||
|
# Prüft den Curator-Idle-Status mit 7-Tage-Schwellenwert.
|
||||||
|
# GIBT AUS: PASS oder FAIL mit Detaillierung.
|
||||||
|
# EXIT 0 = OK (Curator aktiv innerhalb von 7 Tagen)
|
||||||
|
# EXIT 1 = FAIL (Curator >7 Tage idle) –Monitoring-Skript erkannt Problem
|
||||||
|
#
|
||||||
|
# --dry-run DAYS Simuliert eine >DAYS-alte Curator-Auszeit (für Tests)
|
||||||
|
|
||||||
|
set -euo pipefail
|
||||||
|
|
||||||
|
LOG_DIR="/home/hitonabi/.hermes/logs/curator"
|
||||||
|
LOG_FILE="$LOG_DIR/monitor-$(date +%Y%m%d).log"
|
||||||
|
THRESHOLD_DAYS=7
|
||||||
|
|
||||||
|
mkdir -p "$LOG_DIR"
|
||||||
|
|
||||||
|
log() {
|
||||||
|
echo "[$(date '+%Y-%m-%d %H:%M:%S')] $1" | tee -a "$LOG_FILE"
|
||||||
|
}
|
||||||
|
|
||||||
|
# --- Argumente parsen ---
|
||||||
|
DRY_RUN=false
|
||||||
|
DRY_RUN_DAYS=""
|
||||||
|
for arg in "$@"; do
|
||||||
|
case "$arg" in
|
||||||
|
--dry-run)
|
||||||
|
DRY_RUN=true
|
||||||
|
if [[ -n "${2:-}" && "$2" =~ ^[0-9]+$ ]]; then
|
||||||
|
DRY_RUN_DAYS="$2"
|
||||||
|
shift
|
||||||
|
else
|
||||||
|
DRY_RUN_DAYS=8 # Default-Testwert
|
||||||
|
fi
|
||||||
|
;;
|
||||||
|
esac
|
||||||
|
done
|
||||||
|
|
||||||
|
# --- LIVE-PRÜFUNG oder DRY-RUN ---
|
||||||
|
if [[ "$DRY_RUN" == "true" ]]; then
|
||||||
|
log "DRY-RUN: Simuliere Curator-Auszeit von $DRY_RUN_DAYS Tagen"
|
||||||
|
DAYS_SINCE_LAST_RUN="$DRY_RUN_DAYS"
|
||||||
|
else
|
||||||
|
# Live-Status abfragen
|
||||||
|
STATUS_OUTPUT=$(hermes curator status 2>&1) || {
|
||||||
|
log "FEHLER: hermes curator status fehlgeschlagen"
|
||||||
|
echo "FAIL: hermes curator status fehlgeschlagen"
|
||||||
|
exit 1
|
||||||
|
}
|
||||||
|
|
||||||
|
# Prüfen, ob Curator ENABLED ist
|
||||||
|
if ! echo "$STATUS_OUTPUT" | grep -q "^curator: ENABLED$"; then
|
||||||
|
log "INFO: Curator ist nicht ENABLED → überspringe Prüfung"
|
||||||
|
echo "PASS: Curator ist nicht ENABLED (keine Aktivität nötig)"
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Letzten Lauf extrahieren
|
||||||
|
LAST_RUN_LINE=$(echo "$STATUS_OUTPUT" | grep "^ last run:" | head -1)
|
||||||
|
if [[ -z "$LAST_RUN_LINE" ]]; then
|
||||||
|
log "FEHLER: Konnte 'last run' nicht aus Status extrahieren"
|
||||||
|
echo "FAIL: Konnte 'last run' nicht extrahieren"
|
||||||
|
exit 1
|
||||||
|
fi
|
||||||
|
|
||||||
|
LAST_RUN_TEXT=$(echo "$LAST_RUN_LINE" | sed 's/^ last run: *//')
|
||||||
|
log "Letzter Curator-Lauf: $LAST_RUN_TEXT"
|
||||||
|
|
||||||
|
# Tage extrahieren
|
||||||
|
if [[ "$LAST_RUN_TEXT" =~ ([0-9]+)d\ ago ]]; then
|
||||||
|
DAYS_SINCE_LAST_RUN="${BASH_REMATCH[1]}"
|
||||||
|
else
|
||||||
|
log "INFO: Kein 'd ago' gefunden (möglicherweise <1d oder nie gelaufen)"
|
||||||
|
echo "PASS: Curator ist aktuell aktiv oder <1 Tag idle"
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
fi
|
||||||
|
|
||||||
|
log "Tage seit letztem Lauf: $DAYS_SINCE_LAST_RUN"
|
||||||
|
|
||||||
|
# --- MONITORING-LOGIK (keine Reaktivierung!) ---
|
||||||
|
if (( DAYS_SINCE_LAST_RUN < THRESHOLD_DAYS )); then
|
||||||
|
log "INFO: Curator ist innerhalb des erlaubten Intervalls ($DAYS_SINCE_LAST_RUN < $THRESHOLD_DAYS Tage)"
|
||||||
|
echo "PASS: Curator ist aktiv ($DAYS_SINCE_LAST_RUN Tage idle)"
|
||||||
|
exit 0
|
||||||
|
else
|
||||||
|
log "WARNUNG: Curator ist für $DAYS_SINCE_LAST_RUN Tage idle (>= $THRESHOLD_DAYS)"
|
||||||
|
echo "FAIL: Curator-Cron ist für $DAYS_SINCE_LAST_RUN Tage stumm (>= $THRESHOLD_DAYS-Tage-Schwellenwert)"
|
||||||
|
exit 1
|
||||||
|
fi
|
||||||
@@ -0,0 +1,198 @@
|
|||||||
|
#!/usr/bin/env python3
|
||||||
|
"""
|
||||||
|
Curator Auto-Archivierung: Archiviert Skills nach 14 Tagen Inaktivität.
|
||||||
|
|
||||||
|
Liest `.curator_state` und `.usage.json` aus ~/.hermes/skills/, prüft
|
||||||
|
auf Inaktivität (>14 Tage last_used_at), schließt aus (pinned, system)
|
||||||
|
und verschiebt in .archive/<Kategorie>/.
|
||||||
|
"""
|
||||||
|
|
||||||
|
import json
|
||||||
|
import shutil
|
||||||
|
from datetime import datetime, timezone
|
||||||
|
from pathlib import Path
|
||||||
|
|
||||||
|
HERMES_SKILLS_DIR = Path.home() / ".hermes" / "skills"
|
||||||
|
CURATOR_STATE_FILE = HERMES_SKILLS_DIR / ".curator_state"
|
||||||
|
USAGE_JSON_FILE = HERMES_SKILLS_DIR / ".usage.json"
|
||||||
|
ARCHIVE_DIR = HERMES_SKILLS_DIR / ".archive"
|
||||||
|
LOG_DIR = Path.home() / ".hermes" / "logs" / "curator"
|
||||||
|
|
||||||
|
|
||||||
|
def load_json(path: Path) -> dict:
|
||||||
|
"""JSON-Datei laden."""
|
||||||
|
with open(path, "r", encoding="utf-8") as f:
|
||||||
|
return json.load(f)
|
||||||
|
|
||||||
|
|
||||||
|
def save_json(path: Path, data: dict) -> None:
|
||||||
|
"""JSON-Datei speichern (mit Pretty-Print)."""
|
||||||
|
with open(path, "w", encoding="utf-8") as f:
|
||||||
|
json.dump(data, f, indent=2, ensure_ascii=False)
|
||||||
|
f.write("\n")
|
||||||
|
|
||||||
|
|
||||||
|
def is_stale(skill_usage: dict, threshold_days: int = 14) -> bool:
|
||||||
|
"""Prüft, ob ein Skill älter als threshold_days ist."""
|
||||||
|
last_used = skill_usage.get("last_used_at")
|
||||||
|
if not last_used:
|
||||||
|
return False
|
||||||
|
|
||||||
|
# ISO-Format mit optionaler Zeitzone
|
||||||
|
last_used_str = last_used.replace("Z", "+00:00")
|
||||||
|
try:
|
||||||
|
last_used_dt = datetime.fromisoformat(last_used_str)
|
||||||
|
except ValueError:
|
||||||
|
return False
|
||||||
|
|
||||||
|
now = datetime.now(timezone.utc)
|
||||||
|
delta = now - last_used_dt
|
||||||
|
return delta.days >= threshold_days
|
||||||
|
|
||||||
|
|
||||||
|
def is_excluded(skill_name: str, excluded: list) -> bool:
|
||||||
|
"""Prüft, ob ein Skill ausgeschlossen ist."""
|
||||||
|
return skill_name in excluded
|
||||||
|
|
||||||
|
|
||||||
|
def is_pinned(skill_usage: dict) -> bool:
|
||||||
|
"""Prüft, ob ein Skill angepinnt ist."""
|
||||||
|
return skill_usage.get("pinned", False) is True
|
||||||
|
|
||||||
|
|
||||||
|
def get_skill_category(skill_name: str) -> str:
|
||||||
|
"""
|
||||||
|
Ermittelt die Kategorie eines Skills basierend auf dem Verzeichnisnamen.
|
||||||
|
Gibt 'unknown' zurück, wenn keine Kategorie gefunden wird.
|
||||||
|
"""
|
||||||
|
# Versuche, die Kategorie aus dem Verzeichnis zu ermitteln
|
||||||
|
# z.B. 'betrieb-playbook' → 'betrieb-playbook' (direkt unter skills/)
|
||||||
|
# 'apple' (in .archive/apple/) → 'apple'
|
||||||
|
# Falls der Skill direkt in skills/ liegt ohne Unterverzeichnis:
|
||||||
|
return "unknown"
|
||||||
|
|
||||||
|
|
||||||
|
def ensure_archive_category(category: str) -> Path:
|
||||||
|
"""Erstellt das Archiv-Verzeichnis für eine Kategorie, falls nötig."""
|
||||||
|
category_path = ARCHIVE_DIR / category
|
||||||
|
category_path.mkdir(parents=True, exist_ok=True)
|
||||||
|
return category_path
|
||||||
|
|
||||||
|
|
||||||
|
def move_skill_to_archive(skill_name: str, category: str) -> Path:
|
||||||
|
"""
|
||||||
|
Verschiebt ein Skill-Verzeichnis in das Archiv.
|
||||||
|
Gibt den neuen Pfad zurück.
|
||||||
|
"""
|
||||||
|
source = HERMES_SKILLS_DIR / skill_name
|
||||||
|
target_category = ensure_archive_category(category)
|
||||||
|
target = target_category / skill_name
|
||||||
|
|
||||||
|
if source.exists():
|
||||||
|
shutil.move(str(source), str(target))
|
||||||
|
|
||||||
|
return target
|
||||||
|
|
||||||
|
|
||||||
|
def archive_skill(skill_name: str, usage_data: dict) -> dict:
|
||||||
|
"""
|
||||||
|
Archiviert einen Skill:
|
||||||
|
- Setzt state auf 'archived'
|
||||||
|
- Setzt archived_at auf aktuelle Zeit
|
||||||
|
- Verschiebt das Verzeichnis nach .archive/
|
||||||
|
Gibt das aktualisierte Usage-Dict zurück.
|
||||||
|
"""
|
||||||
|
usage_data[skill_name]["state"] = "archived"
|
||||||
|
usage_data[skill_name]["archived_at"] = datetime.now(timezone.utc).isoformat()
|
||||||
|
return usage_data
|
||||||
|
|
||||||
|
|
||||||
|
def log_archive_action(skill_name: str, category: str, success: bool, message: str) -> None:
|
||||||
|
"""Protokolliert eine Archivierungsaktion."""
|
||||||
|
LOG_DIR.mkdir(parents=True, exist_ok=True)
|
||||||
|
log_file = LOG_DIR / f"archive-{datetime.now(timezone.utc).date().isoformat()}.log"
|
||||||
|
|
||||||
|
timestamp = datetime.now(timezone.utc).isoformat()
|
||||||
|
status = "SUCCESS" if success else "FAILED"
|
||||||
|
log_line = f"[{timestamp}] {status} | {skill_name} ({category}) | {message}\n"
|
||||||
|
|
||||||
|
with open(log_file, "a", encoding="utf-8") as f:
|
||||||
|
f.write(log_line)
|
||||||
|
|
||||||
|
|
||||||
|
def main() -> None:
|
||||||
|
"""Hauptfunktion: Archiviert stale Skills."""
|
||||||
|
# 1. Config laden
|
||||||
|
if not CURATOR_STATE_FILE.exists():
|
||||||
|
print(f"Fehler: {CURATOR_STATE_FILE} nicht gefunden.")
|
||||||
|
return
|
||||||
|
|
||||||
|
curator_state = load_json(CURATOR_STATE_FILE)
|
||||||
|
archivierung = curator_state.get("archivierung", {})
|
||||||
|
if not archivierung.get("enabled", False):
|
||||||
|
print("Archivierung ist nicht aktiviert.")
|
||||||
|
return
|
||||||
|
|
||||||
|
threshold_days = archivierung.get("threshold_days", 14)
|
||||||
|
excluded_skills = archivierung.get("excluded_skills", [])
|
||||||
|
|
||||||
|
# 2. Usage-Daten laden
|
||||||
|
if not USAGE_JSON_FILE.exists():
|
||||||
|
print(f"Fehler: {USAGE_JSON_FILE} nicht gefunden.")
|
||||||
|
return
|
||||||
|
|
||||||
|
usage_data = load_json(USAGE_JSON_FILE)
|
||||||
|
|
||||||
|
# 3. Skills prüfen
|
||||||
|
archived_count = 0
|
||||||
|
skipped_count = 0
|
||||||
|
|
||||||
|
for skill_name, skill_usage in usage_data.items():
|
||||||
|
# Ausschlusskriterien prüfen
|
||||||
|
if is_excluded(skill_name, excluded_skills):
|
||||||
|
print(f"Übersprungen (Exkludiert): {skill_name}")
|
||||||
|
skipped_count += 1
|
||||||
|
continue
|
||||||
|
|
||||||
|
if is_pinned(skill_usage):
|
||||||
|
print(f"Übersprungen (Gepinnt): {skill_name}")
|
||||||
|
skipped_count += 1
|
||||||
|
continue
|
||||||
|
|
||||||
|
# Inaktivität prüfen
|
||||||
|
if not is_stale(skill_usage, threshold_days):
|
||||||
|
print(f"Übersprungen (Aktiv): {skill_name}")
|
||||||
|
skipped_count += 1
|
||||||
|
continue
|
||||||
|
|
||||||
|
# Archivierung durchführen
|
||||||
|
category = get_skill_category(skill_name) or "unknown"
|
||||||
|
print(f"Archiviere: {skill_name} → {category}")
|
||||||
|
|
||||||
|
try:
|
||||||
|
# Usage aktualisieren
|
||||||
|
usage_data = archive_skill(skill_name, usage_data)
|
||||||
|
|
||||||
|
# Verzeichnis verschieben
|
||||||
|
move_skill_to_archive(skill_name, category)
|
||||||
|
|
||||||
|
# Erfolg protokollieren
|
||||||
|
log_archive_action(skill_name, category, True, "Skill archiviert")
|
||||||
|
|
||||||
|
archived_count += 1
|
||||||
|
except Exception as e:
|
||||||
|
log_archive_action(skill_name, category, False, str(e))
|
||||||
|
print(f"Fehler beim Archivieren von {skill_name}: {e}")
|
||||||
|
|
||||||
|
# 4. Usage-Daten speichern
|
||||||
|
save_json(USAGE_JSON_FILE, usage_data)
|
||||||
|
|
||||||
|
# 5. Archivierungs-Zeitstempel aktualisieren
|
||||||
|
curator_state["archivierung"]["last_archive_run_at"] = datetime.now(timezone.utc).isoformat()
|
||||||
|
save_json(CURATOR_STATE_FILE, curator_state)
|
||||||
|
|
||||||
|
print(f"\nArchivierung abgeschlossen: {archived_count} archiviert, {skipped_count} übersprungen.")
|
||||||
|
|
||||||
|
|
||||||
|
if __name__ == "__main__":
|
||||||
|
main()
|
||||||
@@ -89,6 +89,9 @@ cp "$SRC/deploy/mc2-selfsmoke.timer" "$HOME/.config/systemd/user/mc2-selfsmoke.t
|
|||||||
# Bagatell-Annahme (Ideen-Queue, 10.07.2026): reine Doku-Vorschläge nachts ohne Klick einspielen.
|
# Bagatell-Annahme (Ideen-Queue, 10.07.2026): reine Doku-Vorschläge nachts ohne Klick einspielen.
|
||||||
cp "$SRC/deploy/mc2-bagatell.service" "$HOME/.config/systemd/user/mc2-bagatell.service"
|
cp "$SRC/deploy/mc2-bagatell.service" "$HOME/.config/systemd/user/mc2-bagatell.service"
|
||||||
cp "$SRC/deploy/mc2-bagatell.timer" "$HOME/.config/systemd/user/mc2-bagatell.timer"
|
cp "$SRC/deploy/mc2-bagatell.timer" "$HOME/.config/systemd/user/mc2-bagatell.timer"
|
||||||
|
# Morgen-Digest (Nächtliche Telegram-Zusammenfassung, 26.07.2026): fasst alle Meldungen zwischen 0 und 7 Uhr zusammen.
|
||||||
|
cp "$SRC/deploy/mc2-morgen-digest.service" "$HOME/.config/systemd/user/mc2-morgen-digest.service"
|
||||||
|
cp "$SRC/deploy/mc2-morgen-digest.timer" "$HOME/.config/systemd/user/mc2-morgen-digest.timer"
|
||||||
# Evolution-Radar-Feed (Autonomie E4): Hermes-cron speist ihn als Prompt ein.
|
# Evolution-Radar-Feed (Autonomie E4): Hermes-cron speist ihn als Prompt ein.
|
||||||
# Cron-Job selbst wird EINMALIG registriert (hermes cron create, siehe docs/RUNBOOK.md).
|
# Cron-Job selbst wird EINMALIG registriert (hermes cron create, siehe docs/RUNBOOK.md).
|
||||||
mkdir -p "$HOME/.hermes/scripts"
|
mkdir -p "$HOME/.hermes/scripts"
|
||||||
@@ -105,6 +108,8 @@ cp "$SRC/deploy/fremdblick.sh" "$HOME/.hermes/scripts/fremdblick.sh"
|
|||||||
cp "$SRC/deploy/worker.sh" "$HOME/.hermes/scripts/worker.sh"
|
cp "$SRC/deploy/worker.sh" "$HOME/.hermes/scripts/worker.sh"
|
||||||
# Chef-Gutachter-Cron (Orchestrator-Finale): gpt-oss urteilt nachts über die autonome Arbeit.
|
# Chef-Gutachter-Cron (Orchestrator-Finale): gpt-oss urteilt nachts über die autonome Arbeit.
|
||||||
cp "$SRC/deploy/chef-gutachter-feed.sh" "$HOME/.hermes/scripts/chef-gutachter-feed.sh"
|
cp "$SRC/deploy/chef-gutachter-feed.sh" "$HOME/.hermes/scripts/chef-gutachter-feed.sh"
|
||||||
|
# Wrapper für nächtliche Crons, um Telegram-Spam in den Morgen-Digest zu leiten.
|
||||||
|
cp "$SRC/deploy/night-cron-wrapper.sh" "$HOME/.hermes/scripts/night-cron-wrapper.sh"
|
||||||
# Release-Radar-Cron (10.07.2026): hält neue hermes-agent-Releases wöchentlich gegen die
|
# Release-Radar-Cron (10.07.2026): hält neue hermes-agent-Releases wöchentlich gegen die
|
||||||
# Eigenbau-Landkarte im Wissens-Vault ("mehr Hermes nativ, weniger Eigenkreationen").
|
# Eigenbau-Landkarte im Wissens-Vault ("mehr Hermes nativ, weniger Eigenkreationen").
|
||||||
cp "$SRC/deploy/hermes-release-radar-feed.sh" "$HOME/.hermes/scripts/hermes-release-radar-feed.sh"
|
cp "$SRC/deploy/hermes-release-radar-feed.sh" "$HOME/.hermes/scripts/hermes-release-radar-feed.sh"
|
||||||
@@ -248,6 +253,7 @@ systemctl --user enable --now mc2-backup.timer >/dev/null 2>&1 || true
|
|||||||
# Router/Engine/Hermes dürfen So 04:30 automatisch (Fangnetz Backup→Postcheck→Rollback+Pin).
|
# Router/Engine/Hermes dürfen So 04:30 automatisch (Fangnetz Backup→Postcheck→Rollback+Pin).
|
||||||
systemctl --user enable --now mc2-selfsmoke.timer >/dev/null 2>&1 || true
|
systemctl --user enable --now mc2-selfsmoke.timer >/dev/null 2>&1 || true
|
||||||
systemctl --user enable --now mc2-bagatell.timer >/dev/null 2>&1 || true
|
systemctl --user enable --now mc2-bagatell.timer >/dev/null 2>&1 || true
|
||||||
|
systemctl --user enable --now mc2-morgen-digest.timer >/dev/null 2>&1 || true
|
||||||
loginctl enable-linger "$USER" >/dev/null 2>&1 || true
|
loginctl enable-linger "$USER" >/dev/null 2>&1 || true
|
||||||
# Mem0-Sidecar VOR dem Backend (re)starten, damit /api/memory sofort bedient wird.
|
# Mem0-Sidecar VOR dem Backend (re)starten, damit /api/memory sofort bedient wird.
|
||||||
[ -x "$HOME/.mem0/venv/bin/python" ] && systemctl --user restart mem0-service 2>/dev/null || true
|
[ -x "$HOME/.mem0/venv/bin/python" ] && systemctl --user restart mem0-service 2>/dev/null || true
|
||||||
|
|||||||
@@ -32,7 +32,17 @@ Sessions, Skills, Gedächtnis, wiederkehrende Muster.
|
|||||||
das akkumulierte Projektwissen.
|
das akkumulierte Projektwissen.
|
||||||
- Skill-Kandidat (nur wenn sich klar einer aufdrängt): wenn aus einem ERFOLGREICHEN,
|
- Skill-Kandidat (nur wenn sich klar einer aufdrängt): wenn aus einem ERFOLGREICHEN,
|
||||||
wiederholten Handgriff ein wiederverwendbarer Skill würde (Voyager-Prinzip), beschreibe
|
wiederholten Handgriff ein wiederverwendbarer Skill würde (Voyager-Prinzip), beschreibe
|
||||||
ihn als Entwurf unter `~/wissens-vault/skill-kandidaten/<slug>.md`. **Entwirf ihn gleich
|
ihn als Entwurf unter `~/wissens-vault/skill-kandidaten/<slug>.md`. **ABER ZUERST prüfen:**
|
||||||
|
```
|
||||||
|
ls ~/wissens-vault/skill-kandidaten/*.md ~/wissens-vault/skill-kandidaten/beauftragt/*.md 2>/dev/null
|
||||||
|
ls ~/.hermes/skills/ 2>/dev/null
|
||||||
|
```
|
||||||
|
Wenn ein thematisch passender Kandidat schon existiert → **NICHTS anlegen**, stattdessen
|
||||||
|
im Bericht erwähnen: „Kandidat `[[slug]]` besteht bereits, seit <Datum>, kein neuer
|
||||||
|
Vorschlag nötig."
|
||||||
|
**WICHTIG:** Prüfe auch, ob es bereits einen fertig gebauten Skill gibt.
|
||||||
|
Wenn ja: kein Kandidat nötig, der Skill existiert bereits.
|
||||||
|
**Entwirf ihn gleich
|
||||||
im Hausstandard deiner Skills** (wie `/learn` es täte), damit die Werkstatt ein fertiges
|
im Hausstandard deiner Skills** (wie `/learn` es täte), damit die Werkstatt ein fertiges
|
||||||
Gerüst übernimmt statt Freitext zu übersetzen: ein `SKILL.md`-Block mit Frontmatter
|
Gerüst übernimmt statt Freitext zu übersetzen: ein `SKILL.md`-Block mit Frontmatter
|
||||||
(`name` = slug, `description` ≤ 60 Zeichen, `version: 1.0.0`), dann die Abschnitte
|
(`name` = slug, `description` ≤ 60 Zeichen, `version: 1.0.0`), dann die Abschnitte
|
||||||
|
|||||||
@@ -15,10 +15,10 @@ verschlucken und den Tabu-Guard lautlos deaktivieren.
|
|||||||
Idempotent + validiert + Backup. Anker fuer neue Event-Bloecke ist der bestehende
|
Idempotent + validiert + Backup. Anker fuer neue Event-Bloecke ist der bestehende
|
||||||
`pre_verify`-Block. Arg: Pfad zur Profil-config.yaml.
|
`pre_verify`-Block. Arg: Pfad zur Profil-config.yaml.
|
||||||
"""
|
"""
|
||||||
import sys
|
|
||||||
import os
|
|
||||||
import datetime
|
import datetime
|
||||||
|
import os
|
||||||
import shutil
|
import shutil
|
||||||
|
import sys
|
||||||
|
|
||||||
try:
|
try:
|
||||||
import yaml
|
import yaml
|
||||||
|
|||||||
@@ -0,0 +1,25 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
set -e
|
||||||
|
|
||||||
|
# Alte Crons löschen
|
||||||
|
hermes cron remove traum || true
|
||||||
|
hermes cron remove chef-gutachter || true
|
||||||
|
hermes cron remove release-radar || true
|
||||||
|
hermes cron remove idle-radar || true
|
||||||
|
hermes cron remove selbst-inventur || true
|
||||||
|
hermes cron remove karten-gutachter || true
|
||||||
|
hermes cron remove pruefstand || true
|
||||||
|
hermes cron remove trend-radar || true
|
||||||
|
|
||||||
|
# Neue Crons registrieren mit Wrapper und --deliver origin.
|
||||||
|
# Dadurch schweigt Hermes cron selbst, und der Wrapper nutzt notify.sh für den Morgen-Digest.
|
||||||
|
hermes cron create --name traum --deliver origin "15 3 * * *" "Traum dreaming-feed.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name chef-gutachter --deliver origin "30 4 * * *" "Chef-Gutachter chef-gutachter-feed.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name release-radar --deliver origin "15 5 * * 1" "Release-Radar hermes-release-radar-feed.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name idle-radar --deliver origin "45 3 * * *" "Idle-Radar idle-radar-feed.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name selbst-inventur --deliver origin "35 3 * * *" "Selbst-Inventur selbst-inventur.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name karten-gutachter --deliver origin "0 4 * * *" "Karten-Gutachter karten-gutachter.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name pruefstand --deliver origin "0 2 * * *" "Prüfstand pruefstand.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
hermes cron create --name trend-radar --deliver origin "15 5 * * 6" "Trend-Radar trend-radar-feed.sh" --script night-cron-wrapper.sh --no-agent
|
||||||
|
|
||||||
|
echo "Crons erfolgreich gefixt!"
|
||||||
@@ -0,0 +1,40 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# gitea-pr (24.07.2026): PR auf Gitea per REST-API anlegen — der EINZIGE Weg für
|
||||||
|
# Worker, einen Pull-Request zu erstellen. Kein Web-Login, kein Passwort: das
|
||||||
|
# HTTP-Token aus ~/.git-credentials reicht (Vorfall 23.07.: Wartung-Worker bat
|
||||||
|
# um das Gitea-Passwort für die Web-GUI und blockte — genau das nie wieder).
|
||||||
|
# Nutzung: gitea-pr <repo> <head-branch> "<titel>" ["<body>"] [base=main]
|
||||||
|
set -euo pipefail
|
||||||
|
|
||||||
|
REPO="${1:?Nutzung: gitea-pr <repo> <head-branch> \"<titel>\" [\"<body>\"] [base]}"
|
||||||
|
HEAD="${2:?head-branch fehlt}"
|
||||||
|
TITLE="${3:?titel fehlt}"
|
||||||
|
BODY="${4:-}"
|
||||||
|
BASE="${5:-main}"
|
||||||
|
OWNER="Hitonabi"
|
||||||
|
# Intern statt DDNS-Domain: die ist nachts (Zwangstrennung) oft nicht erreichbar.
|
||||||
|
HOST="http://192.168.178.153:3000"
|
||||||
|
|
||||||
|
creds="$(printf 'protocol=http\nhost=192.168.178.153:3000\n\n' | git credential fill)"
|
||||||
|
username="$(sed -n 's/^username=//p' <<<"$creds")"
|
||||||
|
password="$(sed -n 's/^password=//p' <<<"$creds")"
|
||||||
|
[ -n "$password" ] || { echo "FEHLER: kein Token in ~/.git-credentials gefunden" >&2; exit 1; }
|
||||||
|
|
||||||
|
payload="$(TITLE="$TITLE" BODY="$BODY" HEAD="$HEAD" BASE="$BASE" python3 -c '
|
||||||
|
import json, os
|
||||||
|
print(json.dumps({"title": os.environ["TITLE"], "body": os.environ["BODY"],
|
||||||
|
"head": os.environ["HEAD"], "base": os.environ["BASE"]}))')"
|
||||||
|
|
||||||
|
antwort="$(curl -sS -w '\n%{http_code}' -X POST \
|
||||||
|
-u "$username:$password" -H "Content-Type: application/json" \
|
||||||
|
-d "$payload" "$HOST/api/v1/repos/$OWNER/$REPO/pulls")"
|
||||||
|
status="${antwort##*$'\n'}"
|
||||||
|
koerper="${antwort%$'\n'*}"
|
||||||
|
|
||||||
|
if [ "$status" = "201" ]; then
|
||||||
|
printf '%s' "$koerper" | python3 -c 'import json,sys; pr=json.load(sys.stdin); print("PR angelegt:", pr.get("html_url", pr.get("url", "?")))'
|
||||||
|
else
|
||||||
|
echo "FEHLER: Gitea-API antwortete $status" >&2
|
||||||
|
printf '%s\n' "$koerper" | head -c 600 >&2
|
||||||
|
exit 1
|
||||||
|
fi
|
||||||
@@ -74,6 +74,42 @@ case "$CODE" in
|
|||||||
-H 'Content-Type: application/json' \
|
-H 'Content-Type: application/json' \
|
||||||
--data "$(python3 -c 'import json,sys; print(json.dumps({"text":"Neues PRIVATES Projekt-Repo angelegt: "+sys.argv[1],"subject":"Gitea","source":"gitea-repo-create","priority":"silent"}))' "$FULL")" \
|
--data "$(python3 -c 'import json,sys; print(json.dumps({"text":"Neues PRIVATES Projekt-Repo angelegt: "+sys.argv[1],"subject":"Gitea","source":"gitea-repo-create","priority":"silent"}))' "$FULL")" \
|
||||||
>/dev/null 2>&1 || true
|
>/dev/null 2>&1 || true
|
||||||
|
# CI-Ampel einpflanzen (Wasserdicht-Runde 22.07.): JEDES neue Repo wird mit der
|
||||||
|
# universellen Actions-Ampel geboren (deploy/ampel-ci.yml). Defensiv: fehlt die
|
||||||
|
# Vorlage oder scheitert der Seed, wird die Anlage NICHT abgebrochen, nur gewarnt.
|
||||||
|
# WICHTIG: Contents-API braucht write:repository → PUSH-Token nutzen (das
|
||||||
|
# dedizierte Anlage-Token hat u.U. nur write:user).
|
||||||
|
PUSHTOKEN="$(printf '%s' "$LINE" | sed -nE 's#https://[^:]+:([^@]+)@.*#\1#p')"; PUSHTOKEN="${PUSHTOKEN:-$TOKEN}"
|
||||||
|
# saat <lokale-vorlage> <pfad-im-repo> <commit-nachricht> <klartext-name>
|
||||||
|
saat () {
|
||||||
|
local QUELLE="$1" ZIEL="$2" MSG="$3" NAME="$4" CODE
|
||||||
|
if [ ! -r "$QUELLE" ]; then
|
||||||
|
echo "WARNUNG: Vorlage fehlt ($QUELLE) — Repo ohne $NAME angelegt." >&2
|
||||||
|
return
|
||||||
|
fi
|
||||||
|
CODE="$(curl -s -o /dev/null -w '%{http_code}' -X POST "$BASE/api/v1/repos/$FULL/contents/$ZIEL" \
|
||||||
|
-H "Authorization: token $PUSHTOKEN" -H "Content-Type: application/json" \
|
||||||
|
--data "$(python3 - "$QUELLE" "$MSG" <<'PY'
|
||||||
|
import base64, json, sys
|
||||||
|
inhalt = open(sys.argv[1], "rb").read()
|
||||||
|
print(json.dumps({"content": base64.b64encode(inhalt).decode(), "message": sys.argv[2]}))
|
||||||
|
PY
|
||||||
|
)")"
|
||||||
|
if [ "$CODE" = "201" ]; then
|
||||||
|
echo "$NAME eingepflanzt ($ZIEL)."
|
||||||
|
else
|
||||||
|
echo "WARNUNG: $NAME-Seed antwortete HTTP $CODE (Repo ist trotzdem da)." >&2
|
||||||
|
fi
|
||||||
|
}
|
||||||
|
# JEDES neue Repo wird mit beiden Wächtern geboren:
|
||||||
|
# ci.yml = die AUSSEN-Prüfung (Gitea Actions nach dem Push, Wasserdicht-Runde 22.07.)
|
||||||
|
# VERIFY = die INNEN-Prüfung (das OpenCode-Plugin führt sie nach jeder Etappe aus und
|
||||||
|
# gibt rote Tests dem Agenten sofort zurück, statt sie erst der CI zu zeigen)
|
||||||
|
# Defensiv: scheitert ein Seed, wird die Anlage NICHT abgebrochen, nur gewarnt.
|
||||||
|
saat "$REALHOME/mission-control-v2/deploy/ampel-ci.yml" ".gitea/workflows/ci.yml" \
|
||||||
|
"CI-Ampel (automatisch bei Repo-Anlage eingepflanzt)" "CI-Ampel"
|
||||||
|
saat "$REALHOME/mission-control-v2/deploy/opencode/VERIFY.template" "VERIFY" \
|
||||||
|
"Pruef-Tor (automatisch bei Repo-Anlage eingepflanzt)" "Pruef-Tor"
|
||||||
echo "Repo '$FULL' angelegt (privat, main initialisiert)."
|
echo "Repo '$FULL' angelegt (privat, main initialisiert)."
|
||||||
echo "CLONE ${CLONE}"
|
echo "CLONE ${CLONE}"
|
||||||
exit 0 ;;
|
exit 0 ;;
|
||||||
|
|||||||
@@ -0,0 +1,33 @@
|
|||||||
|
# Arbeitsregeln (Aider liest diese Datei als schreibgeschützten Kontext)
|
||||||
|
|
||||||
|
Diese Regeln gelten für JEDE Sitzung. Sie sind der Kern der Session-Hygiene:
|
||||||
|
Wissen lebt in `SAVEPOINT.md` und in der git-Historie, NICHT im Chat-Verlauf.
|
||||||
|
|
||||||
|
## 1. Zu Beginn: erst SAVEPOINT.md lesen
|
||||||
|
Bevor du irgendetwas tust, lies `SAVEPOINT.md` vollständig. Es ist die Wahrheit über
|
||||||
|
den aktuellen Stand. Richte dich danach — nicht nach Annahmen. Erfinde keinen Kontext,
|
||||||
|
der nicht in `SAVEPOINT.md`, im Code oder in der git-Historie steht. Wenn etwas unklar
|
||||||
|
ist, sag es, statt es zu erfinden.
|
||||||
|
|
||||||
|
## 2. Nach jedem sinnvollen Schritt: SAVEPOINT.md aktualisieren
|
||||||
|
Sobald du eine sinnvolle Änderung abgeschlossen hast (eine Funktion, ein Fix, ein
|
||||||
|
Testlauf), aktualisiere `SAVEPOINT.md`. Halte es kurz und ehrlich. Struktur:
|
||||||
|
|
||||||
|
- **Ziel** — was insgesamt gebaut werden soll (ein bis zwei Sätze).
|
||||||
|
- **Erledigt** — was jetzt wirklich funktioniert (nur Bewiesenes; keine Fassade).
|
||||||
|
- **Nächster Schritt** — die genau eine Sache, die als Nächstes zu tun ist.
|
||||||
|
- **Offene Fragen** — Entscheidungen, die noch anstehen.
|
||||||
|
- **Stolpersteine** — alles, worüber eine frische Sitzung sonst stolpern würde.
|
||||||
|
- **Dateien** — die wichtigsten Dateien und was sie enthalten.
|
||||||
|
|
||||||
|
Schreibe es so, dass eine frische Sitzung OHNE jede Erinnerung allein aus `SAVEPOINT.md`
|
||||||
|
plus git sauber weitermachen kann. Das ist der Test: kein verstecktes Wissen im Chat.
|
||||||
|
|
||||||
|
## 3. Kleine, überprüfbare Schritte
|
||||||
|
Ändere wenig pro Runde. Behaupte nichts als fertig, was du nicht geprüft hast. Wenn ein
|
||||||
|
Test existiert, nenne sein Ergebnis. Wenn du unsicher bist, prüfe, statt zu raten.
|
||||||
|
|
||||||
|
## 4. Wenn der Governor das Sitzungs-Limit meldet
|
||||||
|
Erscheint eine Nachricht mit `[GOVERNOR — SITZUNGS-LIMIT ERREICHT]`, dann beginne KEINE
|
||||||
|
neuen Code-Änderungen mehr. Finalisiere nur `SAVEPOINT.md` (Stand vollständig, nächster
|
||||||
|
Schritt präzise) und weise den Nutzer an, eine frische Sitzung zu starten. Sonst nichts.
|
||||||
@@ -0,0 +1,134 @@
|
|||||||
|
# Governor — Phase 0
|
||||||
|
|
||||||
|
Dünner, zustandsloser Token-Wächter-Proxy zwischen einem Off-the-shelf-Coding-Agenten
|
||||||
|
(**Aider**) und dem lokalen Modell-Endpoint (llama-swap `:8080`). Er erzwingt
|
||||||
|
**Session-Hygiene per hartem Schnitt statt Auto-Compaction**: wenn die Anfrage (= ganze
|
||||||
|
Sitzungshistorie, die jede Runde mitkommt) eine Schwelle übersteigt, schiebt er eine
|
||||||
|
Anweisung ein, `SAVEPOINT.md` zu finalisieren und zu stoppen — damit Wissen in
|
||||||
|
`SAVEPOINT.md` + git lebt, nicht im degradierenden Chat-Kontext.
|
||||||
|
|
||||||
|
Das ist **Phase 0** des Ablöse-Plans „Lucy IDE-Modus + Governor": den Kern beweisen,
|
||||||
|
**ohne** eine Zeile Lucy-Code. Kein bespoke Editor, kein Aider-Fork, kein Modelltausch.
|
||||||
|
|
||||||
|
## Bausteine (dieses Verzeichnis)
|
||||||
|
| Datei | Zweck |
|
||||||
|
|---|---|
|
||||||
|
| `governor.py` | Der Proxy. Nur Standardbibliothek (läuft mit System-`python3`), zustandslos. |
|
||||||
|
| `CONVENTIONS.md` | Aiders schreibgeschützte Arbeitsregeln: SAVEPOINT.md zuerst lesen, laufend pflegen, keine Fassade. |
|
||||||
|
| `SAVEPOINT.template.md` | Anfangs-Savepoint für ein frisches Projekt. |
|
||||||
|
| `driver.py` | Treibt eine akkumulierende Aider-Sitzung über die Scripting-API (eine Zeile = eine Runde). |
|
||||||
|
| `gov-ctl.sh` | Governor sauber starten/stoppen/status (detached via `setsid`). |
|
||||||
|
| `run-driver.sh` | `run-driver.sh <msgs> [repo]` — Aider-Sitzung durch den Governor. |
|
||||||
|
| `reset-repo.sh` | Wegwerf-Test-Repo frisch aufsetzen. |
|
||||||
|
| `hardstop-test.sh` | Direkte curls für die drei Pfade (passthrough / soft / hart). |
|
||||||
|
| `msgs-*.txt` | Nachrichtenskripte für die Testläufe. |
|
||||||
|
|
||||||
|
## Verhalten des Governors
|
||||||
|
Pro `/v1/chat/completions`-Anfrage schätzt er die Tokenzahl (`Zeichen / GOV_CHARS_PER_TOKEN`,
|
||||||
|
kalibriert auf CPT **3.5** → `est ≈ echte prompt_tokens` auf ~1–3 % bei echten Sessions):
|
||||||
|
|
||||||
|
- **est < Soft** → unverändert durchreichen.
|
||||||
|
- **est ≥ Soft (`GOV_THRESHOLD`, Default 25000)** → hängt die SAVEPOINT-Stopp-Anweisung als
|
||||||
|
letzte User-Nachricht an, leitet weiter, loggt `FIRED`. Das Modell schreibt EINEN
|
||||||
|
ehrlichen Abschluss-Savepoint.
|
||||||
|
- **est ≥ Hart (`GOV_HARD_CEILING`, Default 0 = aus)** → der Governor antwortet SELBST mit
|
||||||
|
einer kurzen Stopp-Nachricht, **ohne** das Modell zu fragen; loggt `HARDSTOP`. Verhindert,
|
||||||
|
dass über die Grenze hinaus weitergearbeitet wird (siehe Befund unten).
|
||||||
|
|
||||||
|
Alle anderen Pfade (`/v1/models` etc.) werden roh durchgereicht. Streaming (SSE) wird
|
||||||
|
byteweise durchgereicht; die echten `prompt_tokens` aus der Antwort werden zur Kalibrierung
|
||||||
|
mitgeloggt.
|
||||||
|
|
||||||
|
### Sprach-Signal an Lucy (Phase 2)
|
||||||
|
Beim Feuern (soft ODER hart) POSTet der Governor — best-effort, gedrosselt (Default 300 s,
|
||||||
|
damit die Pro-Runde-Feuerung nicht spammt) — eine Meldung an Lucys vorhandene Announce-Pipeline
|
||||||
|
(`POST :9001/api/voice/announce`, `source:governor`, `priority:normal`). Lucy pollt diese Queue
|
||||||
|
ohnehin, dedupliziert per Cursor und spricht sie über ihr lokales TTS — gated durch ihren
|
||||||
|
„Box-Meldungen laut"-Schalter. **Kein Lucy-Code nötig.** Abschalten: `GOV_ANNOUNCE_URL=""`.
|
||||||
|
|
||||||
|
### Umgebungsvariablen
|
||||||
|
`GOV_PORT` (8100) · `GOV_HOST` (0.0.0.0) · `GOV_UPSTREAM` (http://127.0.0.1:8080) ·
|
||||||
|
`GOV_THRESHOLD` (25000) · `GOV_HARD_CEILING` (Default Soft+5000; 0=aus) · `GOV_CHARS_PER_TOKEN` (3.5) ·
|
||||||
|
`GOV_LOG` · `GOV_DIRECTIVE` · `GOV_HARDSTOP_MSG` · `GOV_ANNOUNCE_URL` (:9001/api/voice/announce; ""=aus) ·
|
||||||
|
`GOV_ANNOUNCE_THROTTLE` (300 s) · `GOV_ANNOUNCE_TEXT`.
|
||||||
|
|
||||||
|
## Auf der Box laufen lassen (wie in P0 aufgesetzt)
|
||||||
|
```bash
|
||||||
|
# Aider (einmalig, unter isoliertem Python 3.12 — System-Python 3.14 bricht Aiders Pins):
|
||||||
|
pipx install uv && uv tool install --python 3.12 aider-chat
|
||||||
|
|
||||||
|
# Dateien liegen in ~/governor-p0/. Governor starten (Hart-Deckel default AN = Soft+5000):
|
||||||
|
~/governor-p0/gov-ctl.sh start 25000 # Soft 25k, Hart 30k (auto)
|
||||||
|
# ~/governor-p0/gov-ctl.sh start 25000 0 # Hart AUS (nur weicher Schnitt)
|
||||||
|
|
||||||
|
# Aider-Sitzung durch den Governor:
|
||||||
|
~/governor-p0/run-driver.sh ~/governor-p0/msgs-todo.txt
|
||||||
|
```
|
||||||
|
Aider zeigt mit `OPENAI_API_BASE=http://127.0.0.1:8100/v1` und Modell
|
||||||
|
`openai/Qwen3-Coder-Next` auf den Governor.
|
||||||
|
|
||||||
|
## Wichtig: Aiders eigene Zusammenfassung MUSS aus
|
||||||
|
Der Treiber setzt `coder.summarizer.max_tokens` auf ~1e9. Sonst fasst Aider die Historie
|
||||||
|
selbst zusammen (Auto-Compaction) und die Anfrage wächst nie bis zur Schwelle — der
|
||||||
|
Governor wäre ausgehebelt, und man bekäme genau die über-komprimierte Halluzination, die
|
||||||
|
der Plan verwirft. Der Governor soll die **alleinige** Sitzungsgrenze sein.
|
||||||
|
|
||||||
|
## Ergebnisse & Befunde (24.07.2026)
|
||||||
|
|
||||||
|
### Akzeptanz — alle vier Kriterien bewiesen (Box, Qwen3-Coder-Next)
|
||||||
|
1. **Governor zählt + feuert an der Schwelle** — 12-Runden-Todo-Lauf (Soft 8000): Runden 1-6
|
||||||
|
`ok`, ab Runde 7 `FIRED` (est 8546 / echt 8652). Hart-Deckel: Anfrage mit est 11429 ≥ 10000
|
||||||
|
→ `HARDSTOP`, Governor antwortet selbst (kein Modell-Call). Alles im Log.
|
||||||
|
2. **Aider pflegt SAVEPOINT.md** — über den ganzen Aufbau hinweg strukturiert gehalten
|
||||||
|
(Ziel/Erledigt/Nächster Schritt/Stolpersteine/Dateien) gemäß `CONVENTIONS.md`.
|
||||||
|
3. **An der Grenze: ehrlicher Abschluss + Stopp** — beim ersten Feuern (Runde 7) schrieb das
|
||||||
|
Modell einen **ehrlichen** Savepoint (nur real Gebautes unter „Erledigt", Tests als nächster
|
||||||
|
Schritt) und verweigerte neuen Code.
|
||||||
|
4. **Frische Sitzung macht sauber weiter — keine Fassade** — neue Aider-Sitzung las den
|
||||||
|
Grenz-Savepoint, baute `test_todo.py` (der exakte nächste Schritt), und **alle 9 unittest-
|
||||||
|
Tests laufen grün** gegen die echte API. Kein Erfinden.
|
||||||
|
|
||||||
|
### Kalibrierung
|
||||||
|
`CHARS_PER_TOKEN = 3.5` → `est` traf die echten `prompt_tokens` bei realen Sessions auf ~1-3 %.
|
||||||
|
(Nur künstlicher, extrem repetitiver Fülltext bricht die Heuristik — irrelevant für echten Code.)
|
||||||
|
Der Coder läuft mit 128k Kontext (`-c 131072`), also keine Modell-Kappung bei 25k.
|
||||||
|
|
||||||
|
### Wichtigster Befund: Soft reicht nicht allein → Hart-Deckel nachgerüstet
|
||||||
|
Der **weiche** Schnitt erzeugt genau EINEN ehrlichen Grenz-Savepoint — solange die Grenze
|
||||||
|
respektiert wird. Schickt man aber über die Grenze hinaus weiter Aufträge (wie im Stresstest),
|
||||||
|
verweigert das Modell zwar den Code, schreibt die Absichten aber fortschreitend als „erledigt"
|
||||||
|
in SAVEPOINT — genährt von Aiders **irreführenden Commit-Nachrichten** (die aus dem SAVEPOINT-
|
||||||
|
Absichtstext geschöpft werden). Ergebnis: eine Fassade (behauptete test_todo.py/README, die es
|
||||||
|
nicht gab). Deshalb der optionale **Hart-Deckel** (`GOV_HARD_CEILING`): oberhalb davon antwortet
|
||||||
|
der Governor selbst, das Modell kann keine degradierenden Savepoints mehr schreiben. **Der Hart-
|
||||||
|
Deckel ist jetzt Default AN** (`GOV_HARD_CEILING` unset → Soft+5000; explizit `0` schaltet ihn
|
||||||
|
aus): ein Finalisier-Zug Luft, dann harter Riegel — das schliesst die Fassaden-Lücke.
|
||||||
|
|
||||||
|
### Weitere Befunde / Fallen
|
||||||
|
- **Aiders eigene Zusammenfassung MUSS aus** (`summarizer.max_tokens` hoch) — sonst compactet
|
||||||
|
Aider selbst und der Governor greift nie. Siehe oben.
|
||||||
|
- **Commit-Nachrichten überzeichnen** in der Abschluss-Phase (aus SAVEPOINT-Absicht). Der Code
|
||||||
|
ist die Wahrheit; git-Nachrichten sind es hier nicht. Der Hart-Deckel (jetzt Default) begrenzt
|
||||||
|
das auf ~1 Zug; wer es ganz sauber will, startet Aider mit `--no-auto-commits` (Commits von Hand).
|
||||||
|
- **Python 3.14 auf der Box bricht Aiders Pins** (numpy 1.24.3) → Aider via `uv` unter isoliertem
|
||||||
|
Python 3.12 installiert.
|
||||||
|
- **Aider-Scripting-API (`coder.run`) hängt** in einer Datei-Hinzufügen-Reflexion (Edits landeten
|
||||||
|
nicht). Für Einzel-Runden `aider --message` nutzen (sauberer, unterstützt). Der `driver.py`
|
||||||
|
taugt für Mehr-Runden-Akkumulation (Governor-Test), nicht als Produktions-Treiber.
|
||||||
|
|
||||||
|
### Bekannte Grenzen des Governors (aus adversarialer Review, für später)
|
||||||
|
- **Chunked Request-Bodies ohne `Content-Length`** werden verworfen (Aiders httpx sendet immer
|
||||||
|
`Content-Length` → schlummernd, aber ein Proxy-Hop mit Chunking bräche).
|
||||||
|
- **Tool-/Function-Calling**: der Soft-Einschub als letzte `user`-Nachricht kann die Nachrichten-
|
||||||
|
reihenfolge stören, wenn Aider ein Tool-Calling-Edit-Format nutzt (Aiders diff/whole sind reiner
|
||||||
|
Text → schlummernd). `estimate_tokens` zählt `tools`/`tool_calls` nicht mit.
|
||||||
|
- **`https://`-Upstream** wird nicht unterstützt (nur `http.client.HTTPConnection`). Für den
|
||||||
|
lokalen `:8080`-Endpoint irrelevant.
|
||||||
|
Behoben aus derselben Review: **inkrementelles Streaming** (`read1()` statt `read()` — vorher
|
||||||
|
puffernd), **Config-Crash** bei `{ }` in `GOV_DIRECTIVE` (sichere Substitution), **Query-String**
|
||||||
|
umging die Erkennung, **Socket-Leak** im Fehlerpfad, doppelte `Date`/`Server`-Header.
|
||||||
|
|
||||||
|
## Nächste Schritte (Phase 1+)
|
||||||
|
Terminal in Lucy einbetten (xterm.js + node-pty, MC2-Muster kopieren) → Voice-Hook auf das
|
||||||
|
Governor-Signal → Feinschliff + Aider/Pi-Finalentscheid. Governor evtl. später in mc2-gateway.
|
||||||
|
Kandidat für Phase 1-Härtung: Auto-Commit-Zügelung + Hart-Deckel als Default.
|
||||||
@@ -0,0 +1,23 @@
|
|||||||
|
# SAVEPOINT
|
||||||
|
|
||||||
|
> Lebende Übergabe-Datei. Die aktuelle Sitzung hält sie fortlaufend aktuell; eine
|
||||||
|
> frische Sitzung liest sie ZUERST und macht allein daraus plus git weiter.
|
||||||
|
> (Anfangszustand — von der ersten Sitzung zu ersetzen.)
|
||||||
|
|
||||||
|
## Ziel
|
||||||
|
_(noch nichts — von der ersten Sitzung zu füllen)_
|
||||||
|
|
||||||
|
## Erledigt
|
||||||
|
- _(noch nichts)_
|
||||||
|
|
||||||
|
## Nächster Schritt
|
||||||
|
- Auftrag des Nutzers entgegennehmen und beginnen.
|
||||||
|
|
||||||
|
## Offene Fragen
|
||||||
|
- _(keine)_
|
||||||
|
|
||||||
|
## Stolpersteine
|
||||||
|
- _(keine bekannt)_
|
||||||
|
|
||||||
|
## Dateien
|
||||||
|
- `SAVEPOINT.md` — diese Übergabe-Datei.
|
||||||
@@ -0,0 +1,22 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# announce-test.sh — loest ein Feuern aus und prueft, ob der Governor das Sprach-
|
||||||
|
# Signal an Lucys Announce-Queue (:9001) postet (Phase 2). Voraussetzung: Governor
|
||||||
|
# mit niedriger Schwelle gestartet, damit ein einzelner Request feuert.
|
||||||
|
set -u
|
||||||
|
GOV="http://127.0.0.1:8100/v1/chat/completions"
|
||||||
|
|
||||||
|
python3 - <<'PY' > /tmp/gov_fire.json
|
||||||
|
import json
|
||||||
|
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"y"*35000}],"max_tokens":8,"stream":False}))
|
||||||
|
PY
|
||||||
|
|
||||||
|
echo "=== Feuern ausloesen (est ~10000 Tokens, ueber Hart-Deckel) ==="
|
||||||
|
curl -s -m 20 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_fire.json | jq '{id, finish: .choices[0].finish_reason}'
|
||||||
|
|
||||||
|
sleep 1.5 # Announce-Thread durchlassen
|
||||||
|
echo "=== Governor-Log (letzte 4 Zeilen) ==="
|
||||||
|
tail -4 ~/governor-p0/governor.log
|
||||||
|
|
||||||
|
echo "=== Announce-Queue: Governor-Eintraege ==="
|
||||||
|
curl -s -m 8 "http://127.0.0.1:9001/api/voice/announcements?after=0&limit=100" \
|
||||||
|
| jq '[.items[] | select(.source=="governor")] | (last // "KEINE governor-Meldung gefunden")'
|
||||||
@@ -0,0 +1,67 @@
|
|||||||
|
#!/usr/bin/env python3
|
||||||
|
"""driver.py — treibt EINE Aider-Sitzung ueber die Scripting-API durch den Governor.
|
||||||
|
|
||||||
|
Jede Zeile der Nachrichtendatei ist eine User-Runde. Weil derselbe Coder alle Runden
|
||||||
|
bedient, akkumuliert die Historie und die Anfrage waechst jede Runde — genau das, was
|
||||||
|
der Governor beobachtet. Aiders EIGENE History-Zusammenfassung wird abgeschaltet, damit
|
||||||
|
der Governor die alleinige Sitzungsgrenze ist (der Plan verwirft Auto-Compaction bewusst).
|
||||||
|
|
||||||
|
Aufruf (cwd muss das Test-Repo sein, mit venv-python):
|
||||||
|
.../aider-chat/bin/python driver.py <messages-file>
|
||||||
|
"""
|
||||||
|
import os
|
||||||
|
import sys
|
||||||
|
|
||||||
|
from aider.coders import Coder
|
||||||
|
from aider.io import InputOutput
|
||||||
|
from aider.models import Model
|
||||||
|
|
||||||
|
|
||||||
|
def main() -> int:
|
||||||
|
# Endpoint VOR den Aider-Aufrufen setzen (litellm liest es zur Laufzeit).
|
||||||
|
os.environ.setdefault("OPENAI_API_BASE", "http://127.0.0.1:8100/v1")
|
||||||
|
os.environ.setdefault("OPENAI_API_KEY", "dummy")
|
||||||
|
if len(sys.argv) < 2:
|
||||||
|
print("usage: driver.py <messages-file>", file=sys.stderr)
|
||||||
|
return 2
|
||||||
|
with open(sys.argv[1], encoding="utf-8") as fh:
|
||||||
|
messages = [ln.strip() for ln in fh if ln.strip() and not ln.lstrip().startswith("#")]
|
||||||
|
|
||||||
|
model = Model("openai/Qwen3-Coder-Next")
|
||||||
|
io = InputOutput(yes=True) # alle Rueckfragen automatisch bejahen
|
||||||
|
coder = Coder.create(
|
||||||
|
main_model=model,
|
||||||
|
io=io,
|
||||||
|
fnames=["SAVEPOINT.md"], # editierbar
|
||||||
|
read_only_fnames=["CONVENTIONS.md"], # nur-lesbar
|
||||||
|
auto_commits=True, # jede Etappe -> git-Commit
|
||||||
|
stream=False, # deterministische Logs fuer P0
|
||||||
|
map_tokens=512,
|
||||||
|
use_git=True,
|
||||||
|
)
|
||||||
|
|
||||||
|
# Aiders eigene Zusammenfassung ausschalten: too_big() wird nie wahr.
|
||||||
|
try:
|
||||||
|
coder.summarizer.max_tokens = 10 ** 9
|
||||||
|
print(f"[driver] summarizer.max_tokens -> {coder.summarizer.max_tokens}", flush=True)
|
||||||
|
except Exception as exc:
|
||||||
|
print(f"[driver] WARN konnte summarizer nicht abschalten: {exc}", flush=True)
|
||||||
|
|
||||||
|
for i, msg in enumerate(messages, 1):
|
||||||
|
print(f"\n===== TURN {i}/{len(messages)} =====", flush=True)
|
||||||
|
print(f">> {msg[:140]}", flush=True)
|
||||||
|
try:
|
||||||
|
coder.run(with_message=msg)
|
||||||
|
except Exception as exc:
|
||||||
|
print(f"[driver] TURN {i} Fehler: {exc!r}", flush=True)
|
||||||
|
break
|
||||||
|
sent = getattr(coder, "total_tokens_sent", "?")
|
||||||
|
recv = getattr(coder, "total_tokens_received", "?")
|
||||||
|
print(f"-- aider kum: gesendet={sent} empfangen={recv}", flush=True)
|
||||||
|
|
||||||
|
print("\n===== SESSION ENDE =====", flush=True)
|
||||||
|
return 0
|
||||||
|
|
||||||
|
|
||||||
|
if __name__ == "__main__":
|
||||||
|
sys.exit(main())
|
||||||
@@ -0,0 +1,54 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# gov-ctl.sh — Governor sauber starten/stoppen (Phase-0-Helfer).
|
||||||
|
# Nutzung:
|
||||||
|
# gov-ctl.sh start [SCHWELLE] # startet detached, Default-Schwelle 25000
|
||||||
|
# gov-ctl.sh stop
|
||||||
|
# gov-ctl.sh status
|
||||||
|
set -u
|
||||||
|
DIR="$HOME/governor-p0"
|
||||||
|
PIDF="$DIR/governor.pid"
|
||||||
|
LOG="$DIR/governor.log"
|
||||||
|
OUT="$DIR/governor.stdout"
|
||||||
|
|
||||||
|
start() {
|
||||||
|
stop
|
||||||
|
local thr="${1:-25000}"
|
||||||
|
cd "$DIR"
|
||||||
|
: > "$LOG"
|
||||||
|
# Voll detachen: eigene Session, alle FDs weg vom Aufrufer.
|
||||||
|
# Hart-Deckel nur setzen, wenn explizit uebergeben (Arg 2); sonst rechnet
|
||||||
|
# governor.py den Default (Soft + 5000). CPT-Default 3.5 (kalibriert 24.07.).
|
||||||
|
local hardenv=()
|
||||||
|
if [ -n "${2:-}" ]; then hardenv=(GOV_HARD_CEILING="$2"); fi
|
||||||
|
setsid env GOV_THRESHOLD="$thr" "${hardenv[@]}" \
|
||||||
|
GOV_CHARS_PER_TOKEN="${GOV_CHARS_PER_TOKEN:-3.5}" \
|
||||||
|
GOV_LOG="$LOG" GOV_PORT=8100 \
|
||||||
|
python3 "$DIR/governor.py" </dev/null >>"$OUT" 2>&1 &
|
||||||
|
echo $! > "$PIDF"
|
||||||
|
sleep 1.2
|
||||||
|
echo "started pid=$(cat "$PIDF") threshold=$thr hard=${2:-auto}"
|
||||||
|
ss -tlnp 2>/dev/null | grep ":8100" >/dev/null && echo "listening :8100 OK" || echo "WARN: not listening"
|
||||||
|
}
|
||||||
|
|
||||||
|
stop() {
|
||||||
|
pkill -f "$DIR/governor.py" 2>/dev/null || true
|
||||||
|
[ -f "$PIDF" ] && kill "$(cat "$PIDF")" 2>/dev/null || true
|
||||||
|
sleep 0.6
|
||||||
|
rm -f "$PIDF"
|
||||||
|
}
|
||||||
|
|
||||||
|
status() {
|
||||||
|
if pgrep -f "$DIR/governor.py" >/dev/null; then
|
||||||
|
echo "running pid=$(pgrep -f "$DIR/governor.py" | tr '\n' ' ')"
|
||||||
|
ss -tlnp 2>/dev/null | grep ":8100" || true
|
||||||
|
else
|
||||||
|
echo "not running"
|
||||||
|
fi
|
||||||
|
}
|
||||||
|
|
||||||
|
case "${1:-status}" in
|
||||||
|
start) shift; start "${1:-25000}" "${2:-}" ;;
|
||||||
|
stop) stop; echo stopped ;;
|
||||||
|
status) status ;;
|
||||||
|
*) echo "usage: gov-ctl.sh {start [soft] [hart]|stop|status}"; exit 2 ;;
|
||||||
|
esac
|
||||||
@@ -0,0 +1,568 @@
|
|||||||
|
#!/usr/bin/env python3
|
||||||
|
"""Governor v2 — Token-Waechter-Proxy vor dem MC2-Gateway.
|
||||||
|
|
||||||
|
Sitzt zwischen den Coding-Agenten (OpenCode/Zed, Nacht-Laeufe, Hermes-Worker) und dem
|
||||||
|
MC2-Gateway (:9001). Reicht ALLES unveraendert durch — mit einer Ausnahme bei
|
||||||
|
/v1/chat/completions: er bestimmt die Groesse der Anfrage (= Sitzungsgroesse, weil die
|
||||||
|
ganze Historie jede Runde mitkommt) und handelt nach zwei Schwellen:
|
||||||
|
|
||||||
|
est >= SOFT: haengt eine Stopp-Anweisung als letzte User-Nachricht an ("SAVEPOINT.md
|
||||||
|
finalisieren + stoppen") und leitet weiter. Loggt FIRED.
|
||||||
|
est >= HART: antwortet SELBST mit einer kurzen Stopp-Nachricht, OHNE das Modell zu
|
||||||
|
fragen. Verhindert Fassaden jenseits der Grenze. Loggt HARDSTOP.
|
||||||
|
|
||||||
|
--- Was v2 gegenueber v0.2 aendert (25.07.2026) ---------------------------------------
|
||||||
|
1. EHRLICH ZAEHLEN. v0.2 zaehlte nur Text in `messages` und ignorierte `tools`/
|
||||||
|
`tool_calls`. Bei werkzeugdichten Agenten lag es um Faktor 3 daneben (gemessen im
|
||||||
|
eigenen Log: est=3353 exact=10224). v2 zaehlt den GANZEN Anfragekoerper — inklusive
|
||||||
|
Werkzeug-Schemata, Werkzeug-Aufrufe und Werkzeug-Ergebnisse.
|
||||||
|
2. SELBST-KALIBRIERUNG. Aus jeder Antwort liest der Governor die echten
|
||||||
|
`usage.prompt_tokens` und korrigiert damit sein Zeichen-pro-Token-Verhaeltnis —
|
||||||
|
pro Modell, gleitend. Die Schaetzung wird also im Betrieb immer genauer, statt auf
|
||||||
|
einem einmal geratenen Wert festzuhaengen.
|
||||||
|
3. TOOL-CALL-SICHERER EINSCHUB. Der Soft-Einschub wird NUR angehaengt, wenn die
|
||||||
|
Nachrichtenkette das erlaubt (letzte Nachricht ist nicht ein Assistant mit offenen
|
||||||
|
tool_calls und keine tool-Antwort). Sonst wartet er auf die naechste Runde. Ohne
|
||||||
|
diese Pruefung zerbricht der Einschub bei OpenCode die Werkzeug-Reihenfolge.
|
||||||
|
4. STATUS-ENDPUNKT. GET /governor/status liefert Zaehlerstand, Kalibrierung und die
|
||||||
|
letzten Laeufe als JSON — Datenquelle fuer die MC2-Oberflaeche, das OpenCode-Plugin
|
||||||
|
und Lucys `loop_status`.
|
||||||
|
|
||||||
|
Bewusst nur Standardbibliothek: kein pip, kein venv, laeuft mit System-python3.
|
||||||
|
Bewusst ohne Datenbank: ein kleiner Ring im Speicher, mehr braucht es nicht.
|
||||||
|
|
||||||
|
Konfiguration per Umgebungsvariablen (alle optional):
|
||||||
|
GOV_PORT Listen-Port (Default 8100)
|
||||||
|
GOV_HOST Listen-Adresse (Default 0.0.0.0)
|
||||||
|
GOV_UPSTREAM Ziel (Default http://127.0.0.1:9001)
|
||||||
|
GOV_THRESHOLD Soft-Schwelle fuer den Einschub (Default 45000)
|
||||||
|
GOV_HARD_CEILING Hart-Deckel; 0 = aus (Default: Soft+5000, AN)
|
||||||
|
GOV_CHARS_PER_TOKEN Startwert Zeichen->Token (Default 3.2, danach gelernt)
|
||||||
|
GOV_CALIBRATE Selbst-Kalibrierung an/aus (Default 1)
|
||||||
|
GOV_LOG Logdatei (zusaetzlich zu stdout) (Default ./governor.log)
|
||||||
|
GOV_DIRECTIVE Text des Soft-Einschubs
|
||||||
|
GOV_HARDSTOP_MSG Text der Hart-Stopp-Antwort
|
||||||
|
GOV_ANNOUNCE_URL Lucy-Sprach-Signal; "" = aus (Default :9001/api/voice/announce)
|
||||||
|
GOV_ANNOUNCE_THROTTLE Sekunden zwischen Signalen (Default 300)
|
||||||
|
GOV_ANNOUNCE_TEXT Text des Sprach-Signals
|
||||||
|
GOV_EXEMPT_MODELS Modelle ohne Schnitt, kommasepariert (Default: hermes,fast,embed,
|
||||||
|
reranker,vision,scout — Lucys Alltag wird nie unterbrochen)
|
||||||
|
"""
|
||||||
|
|
||||||
|
import http.client
|
||||||
|
import json
|
||||||
|
import os
|
||||||
|
import re
|
||||||
|
import threading
|
||||||
|
import time
|
||||||
|
from collections import deque
|
||||||
|
from http.server import BaseHTTPRequestHandler, ThreadingHTTPServer
|
||||||
|
from urllib.parse import urlparse
|
||||||
|
|
||||||
|
# ---- Konfiguration ---------------------------------------------------------
|
||||||
|
|
||||||
|
PORT = int(os.environ.get("GOV_PORT", "8100"))
|
||||||
|
HOST = os.environ.get("GOV_HOST", "0.0.0.0")
|
||||||
|
# Ziel ist das MC2-Gateway, NICHT llama-swap direkt: so bleiben MC2s Rollen-Aliase,
|
||||||
|
# Bild-Weiche und Telemetrie erhalten. Der Governor ist eine Schicht davor, kein Ersatz.
|
||||||
|
UPSTREAM = os.environ.get("GOV_UPSTREAM", "http://127.0.0.1:9001")
|
||||||
|
THRESHOLD = int(os.environ.get("GOV_THRESHOLD", "45000"))
|
||||||
|
_hard_env = os.environ.get("GOV_HARD_CEILING")
|
||||||
|
HARD_CEILING = (THRESHOLD + 5000) if _hard_env is None else int(_hard_env)
|
||||||
|
CHARS_PER_TOKEN = float(os.environ.get("GOV_CHARS_PER_TOKEN", "3.2"))
|
||||||
|
CALIBRATE = os.environ.get("GOV_CALIBRATE", "1") != "0"
|
||||||
|
LOG_PATH = os.environ.get("GOV_LOG", os.path.join(os.getcwd(), "governor.log"))
|
||||||
|
|
||||||
|
# Lucys Alltagsmodelle bekommen NIE einen Savepoint-Einschub: sie fuehren Gespraeche,
|
||||||
|
# keine Bau-Sitzungen. Nur die Coding-Rollen laufen gegen die Schwelle.
|
||||||
|
_DEFAULT_EXEMPT = "hermes,fast,embed,reranker,vision,scout"
|
||||||
|
EXEMPT_MODELS = {m.strip().lower() for m in
|
||||||
|
os.environ.get("GOV_EXEMPT_MODELS", _DEFAULT_EXEMPT).split(",") if m.strip()}
|
||||||
|
|
||||||
|
DEFAULT_DIRECTIVE = (
|
||||||
|
"[GOVERNOR — SITZUNGS-LIMIT ERREICHT] Der Kontext dieser Sitzung ist auf ~{est} "
|
||||||
|
"Tokens gewachsen (Limit {threshold}). Beginne oder setze JETZT KEINE weiteren "
|
||||||
|
"Code-Aenderungen fort. Stattdessen, in dieser Reihenfolge:\n"
|
||||||
|
"1. Aktualisiere SAVEPOINT.md so, dass es den aktuellen Stand vollstaendig festhaelt: "
|
||||||
|
"was WIRKLICH erledigt ist (nur was im Code steht — nichts aus Absicht oder git-"
|
||||||
|
"Nachrichten ableiten), der genaue naechste Schritt, offene Fragen und alle "
|
||||||
|
"Stolpersteine — genug, dass eine frische Sitzung ohne jede Erinnerung allein aus "
|
||||||
|
"SAVEPOINT.md plus git-Historie sauber weitermachen kann.\n"
|
||||||
|
"2. Halte dann an und sage dem Nutzer in einem Satz, dass er eine frische Sitzung "
|
||||||
|
"starten soll. Gib ausser der SAVEPOINT.md-Aktualisierung und diesem Hinweis nichts aus."
|
||||||
|
)
|
||||||
|
DIRECTIVE = os.environ.get("GOV_DIRECTIVE", DEFAULT_DIRECTIVE)
|
||||||
|
|
||||||
|
DEFAULT_HARDSTOP = (
|
||||||
|
"[GOVERNOR — HARTER STOPP] Das Sitzungs-Limit ist ueberschritten und der Savepoint "
|
||||||
|
"sollte bereits finalisiert sein. Diese Sitzung nimmt keine weiteren Auftraege mehr an. "
|
||||||
|
"Bitte starte eine FRISCHE Sitzung — sie liest SAVEPOINT.md und die git-Historie und "
|
||||||
|
"macht sauber weiter. (Keine Code-Aenderung in dieser Antwort.)"
|
||||||
|
)
|
||||||
|
HARDSTOP_MSG = os.environ.get("GOV_HARDSTOP_MSG", DEFAULT_HARDSTOP)
|
||||||
|
|
||||||
|
ANNOUNCE_URL = os.environ.get("GOV_ANNOUNCE_URL", "http://127.0.0.1:9001/api/voice/announce")
|
||||||
|
ANNOUNCE_THROTTLE = float(os.environ.get("GOV_ANNOUNCE_THROTTLE", "300"))
|
||||||
|
DEFAULT_ANNOUNCE = (
|
||||||
|
"Commander, die Coding-Sitzung wird voll — ungefähr {est} Tokens. Ich sichere den "
|
||||||
|
"Stand im Savepoint; am besten fangen wir gleich frisch an."
|
||||||
|
)
|
||||||
|
ANNOUNCE_TEXT = os.environ.get("GOV_ANNOUNCE_TEXT", DEFAULT_ANNOUNCE)
|
||||||
|
|
||||||
|
up = urlparse(UPSTREAM)
|
||||||
|
UP_HOST = up.hostname or "127.0.0.1"
|
||||||
|
UP_PORT = up.port or 80
|
||||||
|
|
||||||
|
HOP_BY_HOP = {
|
||||||
|
"connection", "keep-alive", "proxy-authenticate", "proxy-authorization",
|
||||||
|
"te", "trailers", "transfer-encoding", "upgrade",
|
||||||
|
}
|
||||||
|
|
||||||
|
_log_lock = threading.Lock()
|
||||||
|
_PROMPT_TOKENS_RE = re.compile(r'"prompt_tokens"\s*:\s*(\d+)')
|
||||||
|
_announce_lock = threading.Lock()
|
||||||
|
_last_announce = 0.0
|
||||||
|
_an = urlparse(ANNOUNCE_URL) if ANNOUNCE_URL else None
|
||||||
|
|
||||||
|
# ---- Zustand (klein, im Speicher) ------------------------------------------
|
||||||
|
# Kalibrierung je Modell: gleitender Mittelwert von zeichen/echte_tokens. Startwert ist
|
||||||
|
# GOV_CHARS_PER_TOKEN; jede Antwort mit usage zieht ihn Richtung Wahrheit.
|
||||||
|
_state_lock = threading.Lock()
|
||||||
|
_cpt: dict = {} # modell -> gelerntes Zeichen-pro-Token
|
||||||
|
_cpt_n: dict = {} # modell -> Anzahl Messungen
|
||||||
|
_recent: deque = deque(maxlen=50) # letzte Laeufe fuer /governor/status
|
||||||
|
_counters = {"chat": 0, "soft": 0, "hard": 0, "passthrough": 0,
|
||||||
|
"tokens_prompt": 0, "tokens_completion": 0, "started": time.time()}
|
||||||
|
|
||||||
|
CPT_MIN, CPT_MAX = 0.8, 8.0 # Schutz gegen Ausreisser
|
||||||
|
|
||||||
|
|
||||||
|
def log(line: str) -> None:
|
||||||
|
"""Eine Zeile nach stdout UND in die Logdatei (thread-sicher)."""
|
||||||
|
stamp = time.strftime("%Y-%m-%dT%H:%M:%S")
|
||||||
|
msg = f"{stamp} {line}"
|
||||||
|
with _log_lock:
|
||||||
|
print(msg, flush=True)
|
||||||
|
try:
|
||||||
|
with open(LOG_PATH, "a", encoding="utf-8") as fh:
|
||||||
|
fh.write(msg + "\n")
|
||||||
|
except OSError:
|
||||||
|
pass
|
||||||
|
|
||||||
|
|
||||||
|
def cpt_for(model: str) -> float:
|
||||||
|
"""Aktuelles Zeichen-pro-Token-Verhaeltnis fuer ein Modell (gelernt oder Startwert)."""
|
||||||
|
with _state_lock:
|
||||||
|
return _cpt.get(model, CHARS_PER_TOKEN)
|
||||||
|
|
||||||
|
|
||||||
|
def calibrate(model: str, chars: int, exact: int) -> None:
|
||||||
|
"""Aus einer echten Antwort lernen. Gleitender Mittelwert mit sanftem Gewicht —
|
||||||
|
ein einzelner Ausreisser (z. B. ein riesiges Bild) verbiegt nichts."""
|
||||||
|
if not CALIBRATE or not exact or exact <= 0 or chars <= 0:
|
||||||
|
return
|
||||||
|
ratio = chars / exact
|
||||||
|
if not (CPT_MIN <= ratio <= CPT_MAX):
|
||||||
|
return
|
||||||
|
with _state_lock:
|
||||||
|
n = _cpt_n.get(model, 0)
|
||||||
|
old = _cpt.get(model, CHARS_PER_TOKEN)
|
||||||
|
# Gewicht faellt mit der Anzahl Messungen: schnell einschwingen, dann stabil.
|
||||||
|
w = max(0.08, 1.0 / (n + 2))
|
||||||
|
_cpt[model] = old * (1 - w) + ratio * w
|
||||||
|
_cpt_n[model] = n + 1
|
||||||
|
|
||||||
|
|
||||||
|
def body_chars(data: dict) -> int:
|
||||||
|
"""Zeichen des GESAMTEN Anfragekoerpers — der Kern der Ehrlichkeit.
|
||||||
|
|
||||||
|
v0.2 zaehlte nur Text in `messages` und lag bei werkzeugdichten Agenten um Faktor 3
|
||||||
|
daneben, weil Werkzeug-Schemata (`tools`), Werkzeug-Aufrufe (`tool_calls`) und
|
||||||
|
Werkzeug-Ergebnisse mitgeschickt werden und im Kontext genauso Platz fressen.
|
||||||
|
Wir serialisieren einfach alles, was ans Modell geht.
|
||||||
|
"""
|
||||||
|
payload = {k: v for k, v in data.items()
|
||||||
|
if k in ("messages", "tools", "tool_choice", "system", "functions")}
|
||||||
|
try:
|
||||||
|
return len(json.dumps(payload, ensure_ascii=False))
|
||||||
|
except (TypeError, ValueError):
|
||||||
|
# Fallback: nur Nachrichtentext (nie schlechter als v0.2)
|
||||||
|
chars = 0
|
||||||
|
for m in data.get("messages") or []:
|
||||||
|
c = m.get("content") if isinstance(m, dict) else None
|
||||||
|
if isinstance(c, str):
|
||||||
|
chars += len(c) + 4
|
||||||
|
elif isinstance(c, list):
|
||||||
|
for p in c:
|
||||||
|
if isinstance(p, dict) and isinstance(p.get("text"), str):
|
||||||
|
chars += len(p["text"])
|
||||||
|
return chars
|
||||||
|
|
||||||
|
|
||||||
|
def safe_to_append(messages) -> bool:
|
||||||
|
"""Darf der Soft-Einschub JETZT als user-Nachricht ans Ende?
|
||||||
|
|
||||||
|
Nein, wenn die Kette gerade mitten in einem Werkzeug-Austausch steckt: nach einem
|
||||||
|
Assistant mit offenen `tool_calls` MUSS eine `tool`-Antwort folgen — schiebt man da
|
||||||
|
eine user-Nachricht dazwischen, lehnt das Modell (bzw. das Template) die Anfrage ab
|
||||||
|
oder halluziniert. Dann warten wir einfach auf die naechste Runde; die Schwelle ist
|
||||||
|
ohnehin ueberschritten, es kommt in Sekunden ein neuer Zug.
|
||||||
|
"""
|
||||||
|
if not isinstance(messages, list) or not messages:
|
||||||
|
return False
|
||||||
|
last = messages[-1]
|
||||||
|
if not isinstance(last, dict):
|
||||||
|
return False
|
||||||
|
role = last.get("role")
|
||||||
|
if role == "tool":
|
||||||
|
return False
|
||||||
|
return not (role == "assistant" and last.get("tool_calls"))
|
||||||
|
|
||||||
|
|
||||||
|
def _post_announce(est) -> None:
|
||||||
|
"""POSTet die Meldung an die MC2-Announce-Pipeline (Lucy spricht sie)."""
|
||||||
|
try:
|
||||||
|
text = (ANNOUNCE_TEXT.replace("{est}", str(est))
|
||||||
|
.replace("{threshold}", str(THRESHOLD)))
|
||||||
|
body = json.dumps({"text": text, "subject": "[Governor]",
|
||||||
|
"source": "governor", "priority": "normal"}).encode("utf-8")
|
||||||
|
conn = http.client.HTTPConnection(_an.hostname or "127.0.0.1",
|
||||||
|
_an.port or 80, timeout=4)
|
||||||
|
conn.request("POST", _an.path or "/api/voice/announce", body=body,
|
||||||
|
headers={"Content-Type": "application/json",
|
||||||
|
"Content-Length": str(len(body))})
|
||||||
|
resp = conn.getresponse()
|
||||||
|
resp.read()
|
||||||
|
conn.close()
|
||||||
|
log(f"ANNOUNCE -> Lucy status={resp.status} est={est}")
|
||||||
|
except Exception as exc:
|
||||||
|
log(f"ANNOUNCE fehlgeschlagen: {exc!r}")
|
||||||
|
|
||||||
|
|
||||||
|
def maybe_announce(est) -> None:
|
||||||
|
"""Sprach-Signal an Lucy — gedrosselt (eine Aeusserung je Episode)."""
|
||||||
|
if not _an:
|
||||||
|
return
|
||||||
|
global _last_announce
|
||||||
|
now = time.time()
|
||||||
|
with _announce_lock:
|
||||||
|
if now - _last_announce < ANNOUNCE_THROTTLE:
|
||||||
|
return
|
||||||
|
_last_announce = now
|
||||||
|
threading.Thread(target=_post_announce, args=(est,), daemon=True).start()
|
||||||
|
|
||||||
|
|
||||||
|
def status_payload() -> dict:
|
||||||
|
"""Momentaufnahme fuer /governor/status (MC2-Oberflaeche, Plugin, Lucy)."""
|
||||||
|
with _state_lock:
|
||||||
|
return {
|
||||||
|
"ok": True,
|
||||||
|
"upstream": UPSTREAM,
|
||||||
|
"soft": THRESHOLD,
|
||||||
|
"hard": HARD_CEILING if HARD_CEILING > 0 else None,
|
||||||
|
"uptime_s": int(time.time() - _counters["started"]),
|
||||||
|
"counters": {k: v for k, v in _counters.items() if k != "started"},
|
||||||
|
"calibration": {m: {"chars_per_token": round(v, 3), "samples": _cpt_n.get(m, 0)}
|
||||||
|
for m, v in _cpt.items()},
|
||||||
|
"calibration_default": CHARS_PER_TOKEN,
|
||||||
|
"exempt_models": sorted(EXEMPT_MODELS),
|
||||||
|
"recent": list(_recent),
|
||||||
|
}
|
||||||
|
|
||||||
|
|
||||||
|
class Handler(BaseHTTPRequestHandler):
|
||||||
|
protocol_version = "HTTP/1.1"
|
||||||
|
server_version = "Governor/2.0"
|
||||||
|
|
||||||
|
def log_message(self, *args):
|
||||||
|
pass
|
||||||
|
|
||||||
|
def do_GET(self):
|
||||||
|
if self.path.split("?", 1)[0].rstrip("/") in ("/governor/status", "/governor"):
|
||||||
|
self._send_json(200, status_payload())
|
||||||
|
return
|
||||||
|
self._proxy()
|
||||||
|
|
||||||
|
def do_POST(self):
|
||||||
|
self._proxy()
|
||||||
|
|
||||||
|
def do_PUT(self):
|
||||||
|
self._proxy()
|
||||||
|
|
||||||
|
def do_DELETE(self):
|
||||||
|
self._proxy()
|
||||||
|
|
||||||
|
def do_OPTIONS(self):
|
||||||
|
self._proxy()
|
||||||
|
|
||||||
|
# -- Kern ---------------------------------------------------------------
|
||||||
|
def _send_json(self, status: int, obj) -> None:
|
||||||
|
try:
|
||||||
|
data = json.dumps(obj).encode("utf-8")
|
||||||
|
self.send_response(status)
|
||||||
|
self.send_header("Content-Type", "application/json")
|
||||||
|
self.send_header("Access-Control-Allow-Origin", "*")
|
||||||
|
self.send_header("Content-Length", str(len(data)))
|
||||||
|
self.send_header("Connection", "close")
|
||||||
|
self.end_headers()
|
||||||
|
self.wfile.write(data)
|
||||||
|
except OSError:
|
||||||
|
pass
|
||||||
|
|
||||||
|
def _read_body(self) -> bytes:
|
||||||
|
length = self.headers.get("Content-Length")
|
||||||
|
if length is None:
|
||||||
|
return b""
|
||||||
|
try:
|
||||||
|
return self.rfile.read(int(length))
|
||||||
|
except (ValueError, OSError):
|
||||||
|
return b""
|
||||||
|
|
||||||
|
def _proxy(self) -> None:
|
||||||
|
body = self._read_body()
|
||||||
|
path = self.path
|
||||||
|
clean_path = path.split("?", 1)[0]
|
||||||
|
is_chat = clean_path.rstrip("/").endswith("/chat/completions")
|
||||||
|
|
||||||
|
action = "passthrough"
|
||||||
|
est = None
|
||||||
|
streaming = False
|
||||||
|
model = ""
|
||||||
|
chars = 0
|
||||||
|
if is_chat and body:
|
||||||
|
action, body, est, streaming, model, chars = self._decide(body)
|
||||||
|
if action in ("soft", "hard"):
|
||||||
|
maybe_announce(est)
|
||||||
|
|
||||||
|
if action == "hard":
|
||||||
|
self._send_canned_stop(model, streaming, est)
|
||||||
|
with _state_lock:
|
||||||
|
_counters["chat"] += 1
|
||||||
|
_counters["hard"] += 1
|
||||||
|
_recent.appendleft({"t": int(time.time()), "model": model, "est": est,
|
||||||
|
"exact": None, "action": "hard"})
|
||||||
|
log(f"chat model={model} est={est} thr={THRESHOLD} hard={HARD_CEILING} "
|
||||||
|
f"HARDSTOP stream={streaming} status=200")
|
||||||
|
return
|
||||||
|
|
||||||
|
out_headers = {}
|
||||||
|
for k, v in self.headers.items():
|
||||||
|
kl = k.lower()
|
||||||
|
if kl in HOP_BY_HOP or kl in ("host", "content-length", "accept-encoding"):
|
||||||
|
continue
|
||||||
|
out_headers[k] = v
|
||||||
|
out_headers["Host"] = f"{UP_HOST}:{UP_PORT}"
|
||||||
|
out_headers["Accept-Encoding"] = "identity"
|
||||||
|
if body:
|
||||||
|
out_headers["Content-Length"] = str(len(body))
|
||||||
|
out_headers["Connection"] = "close"
|
||||||
|
|
||||||
|
conn = None
|
||||||
|
try:
|
||||||
|
conn = http.client.HTTPConnection(UP_HOST, UP_PORT, timeout=900)
|
||||||
|
conn.request(self.command, path, body=body or None, headers=out_headers)
|
||||||
|
resp = conn.getresponse()
|
||||||
|
except (OSError, http.client.HTTPException) as exc:
|
||||||
|
log(f"ERROR upstream {self.command} {path}: {exc!r}")
|
||||||
|
if conn is not None:
|
||||||
|
conn.close()
|
||||||
|
self._safe_error(502, f"governor upstream: {exc}")
|
||||||
|
return
|
||||||
|
|
||||||
|
self.send_response(resp.status)
|
||||||
|
for k, v in resp.getheaders():
|
||||||
|
kl = k.lower()
|
||||||
|
if kl in HOP_BY_HOP or kl in ("content-length", "date", "server"):
|
||||||
|
continue
|
||||||
|
self.send_header(k, v)
|
||||||
|
self.send_header("Connection", "close")
|
||||||
|
self.end_headers()
|
||||||
|
|
||||||
|
tail = bytearray()
|
||||||
|
try:
|
||||||
|
while True:
|
||||||
|
# read1() gibt jedes Upstream-Stueck sofort zurueck (echtes SSE-
|
||||||
|
# Durchreichen); read() wuerde puffern und Streaming haengen lassen.
|
||||||
|
chunk = resp.read1(65536)
|
||||||
|
if not chunk:
|
||||||
|
break
|
||||||
|
self.wfile.write(chunk)
|
||||||
|
self.wfile.flush()
|
||||||
|
tail.extend(chunk)
|
||||||
|
if len(tail) > 16384:
|
||||||
|
del tail[:-16384]
|
||||||
|
except OSError:
|
||||||
|
pass
|
||||||
|
finally:
|
||||||
|
conn.close()
|
||||||
|
|
||||||
|
exact = self._scan_prompt_tokens(tail)
|
||||||
|
if is_chat:
|
||||||
|
if exact:
|
||||||
|
calibrate(model, chars, exact)
|
||||||
|
with _state_lock:
|
||||||
|
_counters["chat"] += 1
|
||||||
|
_counters["soft" if action == "soft" else "passthrough"] += 1
|
||||||
|
if exact:
|
||||||
|
_counters["tokens_prompt"] += exact
|
||||||
|
_recent.appendleft({"t": int(time.time()), "model": model, "est": est,
|
||||||
|
"exact": exact, "action": action})
|
||||||
|
exact_s = str(exact) if exact is not None else "-"
|
||||||
|
flag = "FIRED" if action == "soft" else ("skip" if action == "defer" else "ok")
|
||||||
|
log(f"chat model={model} est={est} exact={exact_s} cpt={cpt_for(model):.2f} "
|
||||||
|
f"thr={THRESHOLD} {flag} stream={streaming} status={resp.status}")
|
||||||
|
|
||||||
|
def _decide(self, body: bytes):
|
||||||
|
"""Aktion bestimmen. Rueckgabe: (action, body, est, streaming, model, chars)."""
|
||||||
|
try:
|
||||||
|
data = json.loads(body)
|
||||||
|
except (ValueError, UnicodeDecodeError):
|
||||||
|
return "passthrough", body, None, False, "", 0
|
||||||
|
if not isinstance(data, dict):
|
||||||
|
return "passthrough", body, None, False, "", 0
|
||||||
|
|
||||||
|
messages = data.get("messages")
|
||||||
|
streaming = bool(data.get("stream"))
|
||||||
|
model = (data.get("model") or "").strip()
|
||||||
|
chars = body_chars(data)
|
||||||
|
est = int(chars / max(cpt_for(model), 0.1))
|
||||||
|
|
||||||
|
# Lucys Alltagsmodelle laufen nie gegen die Schwelle — ein Gespraech ist keine
|
||||||
|
# Bau-Sitzung. Wir zaehlen sie trotzdem mit (Kalibrierung + Telemetrie).
|
||||||
|
base = model.split("/")[-1].lower()
|
||||||
|
if base in EXEMPT_MODELS:
|
||||||
|
return "passthrough", body, est, streaming, model, chars
|
||||||
|
|
||||||
|
if not isinstance(messages, list):
|
||||||
|
return "passthrough", body, est, streaming, model, chars
|
||||||
|
|
||||||
|
has_warned = False
|
||||||
|
marker = "[GOVERNOR — SITZUNGS-LIMIT ERREICHT]"
|
||||||
|
for m in reversed(messages):
|
||||||
|
if m.get("role") == "user" and isinstance(m.get("content"), str) and marker in m["content"]:
|
||||||
|
has_warned = True
|
||||||
|
break
|
||||||
|
|
||||||
|
is_safe = safe_to_append(messages)
|
||||||
|
|
||||||
|
# 1. Absolutes Not-Aus bei komplettem Amoklauf
|
||||||
|
if HARD_CEILING > 0 and est >= HARD_CEILING + 10000:
|
||||||
|
return "hard", body, est, streaming, model, chars
|
||||||
|
|
||||||
|
# 2. Sind wir am Limit?
|
||||||
|
if est >= THRESHOLD:
|
||||||
|
if not is_safe:
|
||||||
|
# Agent arbeitet gerade an einer Tool-Kette. Auf keinen Fall abbrechen!
|
||||||
|
return "defer", body, est, streaming, model, chars
|
||||||
|
|
||||||
|
# Es ist sicher (Tool-Kette beendet oder Agent wartet auf Input).
|
||||||
|
if HARD_CEILING > 0 and est >= HARD_CEILING:
|
||||||
|
if has_warned:
|
||||||
|
# Wir haben ihn schon gewarnt, er macht trotzdem weiter -> harter Schnitt.
|
||||||
|
return "hard", body, est, streaming, model, chars
|
||||||
|
else:
|
||||||
|
# Er hat wegen einer langen Tool-Kette direkt das Hard-Limit ueberschritten.
|
||||||
|
# Gib ihm trotzdem noch den einen Finalisier-Zug (Soft).
|
||||||
|
pass
|
||||||
|
|
||||||
|
# Soft-Limit greift
|
||||||
|
if not has_warned:
|
||||||
|
directive = (DIRECTIVE.replace("{est}", str(est))
|
||||||
|
.replace("{threshold}", str(THRESHOLD)))
|
||||||
|
messages.append({"role": "user", "content": directive})
|
||||||
|
data["messages"] = messages
|
||||||
|
return "soft", json.dumps(data).encode("utf-8"), est, streaming, model, chars
|
||||||
|
|
||||||
|
return "passthrough", body, est, streaming, model, chars
|
||||||
|
|
||||||
|
def _send_canned_stop(self, model: str, streaming: bool, est) -> None:
|
||||||
|
"""OpenAI-kompatible Stopp-Antwort selbst erzeugen (kein Upstream-Call)."""
|
||||||
|
created = int(time.time())
|
||||||
|
usage = {"prompt_tokens": est or 0, "completion_tokens": 0,
|
||||||
|
"total_tokens": est or 0}
|
||||||
|
try:
|
||||||
|
if streaming:
|
||||||
|
self.send_response(200)
|
||||||
|
self.send_header("Content-Type", "text/event-stream")
|
||||||
|
self.send_header("Cache-Control", "no-cache")
|
||||||
|
self.send_header("Connection", "close")
|
||||||
|
self.end_headers()
|
||||||
|
|
||||||
|
def sse(obj):
|
||||||
|
self.wfile.write(b"data: " + json.dumps(obj).encode() + b"\n\n")
|
||||||
|
self.wfile.flush()
|
||||||
|
|
||||||
|
base = {"id": "governor-hardstop", "object": "chat.completion.chunk",
|
||||||
|
"created": created, "model": model}
|
||||||
|
sse({**base, "choices": [{"index": 0, "delta": {"role": "assistant"},
|
||||||
|
"finish_reason": None}]})
|
||||||
|
sse({**base, "choices": [{"index": 0, "delta": {"content": HARDSTOP_MSG},
|
||||||
|
"finish_reason": None}]})
|
||||||
|
sse({**base, "choices": [{"index": 0, "delta": {},
|
||||||
|
"finish_reason": "stop"}], "usage": usage})
|
||||||
|
self.wfile.write(b"data: [DONE]\n\n")
|
||||||
|
self.wfile.flush()
|
||||||
|
else:
|
||||||
|
payload = {
|
||||||
|
"id": "governor-hardstop", "object": "chat.completion",
|
||||||
|
"created": created, "model": model,
|
||||||
|
"choices": [{"index": 0, "finish_reason": "stop",
|
||||||
|
"message": {"role": "assistant", "content": HARDSTOP_MSG}}],
|
||||||
|
"usage": usage,
|
||||||
|
}
|
||||||
|
data = json.dumps(payload).encode("utf-8")
|
||||||
|
self.send_response(200)
|
||||||
|
self.send_header("Content-Type", "application/json")
|
||||||
|
self.send_header("Content-Length", str(len(data)))
|
||||||
|
self.send_header("Connection", "close")
|
||||||
|
self.end_headers()
|
||||||
|
self.wfile.write(data)
|
||||||
|
self.wfile.flush()
|
||||||
|
except OSError:
|
||||||
|
pass
|
||||||
|
|
||||||
|
def _safe_error(self, status: int, msg: str) -> None:
|
||||||
|
self._send_json(status, {"error": msg})
|
||||||
|
|
||||||
|
@staticmethod
|
||||||
|
def _scan_prompt_tokens(tail: bytearray):
|
||||||
|
if not tail:
|
||||||
|
return None
|
||||||
|
try:
|
||||||
|
text = tail.decode("utf-8", errors="ignore")
|
||||||
|
except Exception:
|
||||||
|
return None
|
||||||
|
matches = _PROMPT_TOKENS_RE.findall(text)
|
||||||
|
if not matches:
|
||||||
|
return None
|
||||||
|
try:
|
||||||
|
return int(matches[-1])
|
||||||
|
except ValueError:
|
||||||
|
return None
|
||||||
|
|
||||||
|
|
||||||
|
def main() -> int:
|
||||||
|
log_dir = os.path.dirname(LOG_PATH)
|
||||||
|
if log_dir and not os.path.isdir(log_dir):
|
||||||
|
try:
|
||||||
|
os.makedirs(log_dir, exist_ok=True)
|
||||||
|
except OSError:
|
||||||
|
pass
|
||||||
|
|
||||||
|
server = ThreadingHTTPServer((HOST, PORT), Handler)
|
||||||
|
server.daemon_threads = True
|
||||||
|
hard = HARD_CEILING if HARD_CEILING > 0 else "aus"
|
||||||
|
log(f"Governor v2 startet auf {HOST}:{PORT} -> {UPSTREAM} | Soft={THRESHOLD} "
|
||||||
|
f"Hart={hard} | CPT-Start={CHARS_PER_TOKEN} kalibrierend={CALIBRATE} | "
|
||||||
|
f"ausgenommen={sorted(EXEMPT_MODELS)} | Log={LOG_PATH}")
|
||||||
|
try:
|
||||||
|
server.serve_forever()
|
||||||
|
except KeyboardInterrupt:
|
||||||
|
log("Governor beendet (SIGINT).")
|
||||||
|
finally:
|
||||||
|
server.server_close()
|
||||||
|
return 0
|
||||||
|
|
||||||
|
|
||||||
|
if __name__ == "__main__":
|
||||||
|
raise SystemExit(main())
|
||||||
@@ -0,0 +1,27 @@
|
|||||||
|
[Unit]
|
||||||
|
# Governor v2 — Token-Waechter vor dem MC2-Gateway.
|
||||||
|
# Nutzer-Dienst (systemctl --user), weil er unter hitonabi laeuft und keine
|
||||||
|
# Root-Rechte braucht. Startet nach MC2, weil er dorthin weiterreicht.
|
||||||
|
Description=Governor v2 — Token-Waechter-Proxy (:8100 -> MC2 :9001)
|
||||||
|
After=network-online.target mission-control-2.service
|
||||||
|
Wants=network-online.target
|
||||||
|
|
||||||
|
[Service]
|
||||||
|
Type=simple
|
||||||
|
WorkingDirectory=%h/governor
|
||||||
|
ExecStart=/usr/bin/python3 %h/governor/governor.py
|
||||||
|
Restart=always
|
||||||
|
RestartSec=3
|
||||||
|
|
||||||
|
# --- Schwellen -------------------------------------------------------------
|
||||||
|
# Soft 45k: OpenCode startet mit ~10-15k allein fuer Systemprompt + Werkzeug-
|
||||||
|
# Schemata; 25k (der alte Aider-Wert) haette schon nach wenigen Zuegen gefeuert.
|
||||||
|
# Hart = Soft+5000 (ein Finalisier-Zug Luft), Default des Programms.
|
||||||
|
Environment=GOV_THRESHOLD=45000
|
||||||
|
Environment=GOV_UPSTREAM=http://127.0.0.1:9001
|
||||||
|
Environment=GOV_LOG=%h/governor/governor.log
|
||||||
|
# Lucys Alltagsmodelle laufen nie gegen die Schwelle — ein Gespraech ist kein Bau.
|
||||||
|
Environment=GOV_EXEMPT_MODELS=hermes,fast,embed,reranker,vision,scout
|
||||||
|
|
||||||
|
[Install]
|
||||||
|
WantedBy=default.target
|
||||||
@@ -0,0 +1,29 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# hardstop-test.sh — prueft die drei Governor-Pfade mit direkten curls:
|
||||||
|
# klein -> passthrough (Modell antwortet normal)
|
||||||
|
# mittel -> soft-Einschub (Modell bekommt die Stopp-Anweisung, antwortet)
|
||||||
|
# gross -> HART-STOPP (Governor antwortet selbst, KEIN Modell-Call)
|
||||||
|
set -u
|
||||||
|
GOV="http://127.0.0.1:8100/v1/chat/completions"
|
||||||
|
|
||||||
|
python3 - <<'PY' > /tmp/gov_small.json
|
||||||
|
import json
|
||||||
|
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"Reply with exactly: SMALL"}],"max_tokens":8,"stream":False}))
|
||||||
|
PY
|
||||||
|
python3 - <<'PY' > /tmp/gov_mid.json
|
||||||
|
import json
|
||||||
|
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"BEGIN "+"lorem ipsum "*2500+" END"}],"max_tokens":40,"stream":False}))
|
||||||
|
PY
|
||||||
|
python3 - <<'PY' > /tmp/gov_big.json
|
||||||
|
import json
|
||||||
|
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"x"*40000}],"max_tokens":16,"stream":False}))
|
||||||
|
PY
|
||||||
|
|
||||||
|
echo "=== TEST A: klein (passthrough) ==="
|
||||||
|
curl -s -m 60 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_small.json | jq -r '.choices[0].message.content'
|
||||||
|
|
||||||
|
echo "=== TEST B: mittel ~30k Zeichen (soft-Einschub, geht ans Modell) ==="
|
||||||
|
curl -s -m 120 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_mid.json | jq '{id, content: (.choices[0].message.content|.[0:80])}'
|
||||||
|
|
||||||
|
echo "=== TEST C: gross ~40k Zeichen (HART-STOPP, kein Modell-Call) ==="
|
||||||
|
curl -s -m 30 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_big.json | jq '{id, finish: .choices[0].finish_reason, content: (.choices[0].message.content|.[0:70]), usage}'
|
||||||
@@ -0,0 +1,13 @@
|
|||||||
|
# Wegwerf-Aufgabe: kleine Todo-App, schrittweise. Jede Zeile = eine Runde.
|
||||||
|
Create todo.py with a TodoList class: add(text) appends a dict {"text": text, "done": False} to an internal list, and items() returns that list. Then update SAVEPOINT.md following our conventions.
|
||||||
|
Add complete(index) and remove(index) to TodoList, each with a bounds check that raises IndexError with a clear message when the index is out of range. Update SAVEPOINT.md.
|
||||||
|
Add save(path) and load(path) to TodoList that persist the items to and from a JSON file. Update SAVEPOINT.md.
|
||||||
|
Add pending_count() and completed_count() methods to TodoList. Update SAVEPOINT.md.
|
||||||
|
Create cli.py with an argparse command line interface exposing subcommands add, list, done, and rm that operate on a todos.json file via TodoList. Update SAVEPOINT.md.
|
||||||
|
Add a clear subcommand to cli.py that removes all completed items from todos.json. Update SAVEPOINT.md.
|
||||||
|
Create test_todo.py with unittest tests covering add, complete, remove, save, load, and the IndexError bounds checks. Update SAVEPOINT.md.
|
||||||
|
Add tests for pending_count and completed_count to test_todo.py. Update SAVEPOINT.md.
|
||||||
|
Create README.md documenting the CLI usage with a short example for each subcommand. Update SAVEPOINT.md.
|
||||||
|
Add type hints throughout todo.py and cli.py. Update SAVEPOINT.md.
|
||||||
|
Add an optional due date field (ISO date string) to each item and a due argument to TodoList.add and to the CLI add subcommand. Update SAVEPOINT.md.
|
||||||
|
Add an overdue subcommand to cli.py that lists items whose due date is before today. Update SAVEPOINT.md.
|
||||||
@@ -0,0 +1,19 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# run-aider-msg.sh <repo> <message> — EINE Aider-Runde via --message (sauberer,
|
||||||
|
# unterstuetzter Einzel-Schuss ohne Scripting-Reflexions-Haenger), durch den Governor.
|
||||||
|
# todo.py/cli.py als Lesekontext, damit das Modell die echte API sieht (kein Erfinden)
|
||||||
|
# und keine "Datei hinzufuegen?"-Reflexion ausloest.
|
||||||
|
set -u
|
||||||
|
REPO="${1:?repo dir}"
|
||||||
|
MSG="${2:?message}"
|
||||||
|
export PATH="$HOME/.local/bin:$PATH"
|
||||||
|
export OPENAI_API_BASE="http://127.0.0.1:8100/v1"
|
||||||
|
export OPENAI_API_KEY="dummy"
|
||||||
|
cd "$REPO"
|
||||||
|
aider \
|
||||||
|
--model openai/Qwen3-Coder-Next \
|
||||||
|
--no-check-update --no-show-model-warnings --no-analytics --yes-always \
|
||||||
|
--map-tokens 512 \
|
||||||
|
--read CONVENTIONS.md --read todo.py --read cli.py \
|
||||||
|
SAVEPOINT.md \
|
||||||
|
--message "$MSG"
|
||||||
@@ -0,0 +1,20 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# run-aider.sh <messages-file> — treibt EINE Aider-Sitzung durch den Governor.
|
||||||
|
# Jede Zeile der Nachrichtendatei = eine User-Runde; die Historie akkumuliert,
|
||||||
|
# sodass die Anfrage jede Runde wächst (genau das prüft der Governor).
|
||||||
|
set -u
|
||||||
|
MSGS="${1:?Nachrichtendatei angeben}"
|
||||||
|
export PATH="$HOME/.local/bin:$PATH"
|
||||||
|
export OPENAI_API_BASE="http://127.0.0.1:8100/v1"
|
||||||
|
export OPENAI_API_KEY="dummy"
|
||||||
|
cd "$HOME/governor-p0/testrepo"
|
||||||
|
aider \
|
||||||
|
--model openai/Qwen3-Coder-Next \
|
||||||
|
--no-check-update \
|
||||||
|
--no-show-model-warnings \
|
||||||
|
--no-analytics \
|
||||||
|
--yes-always \
|
||||||
|
--map-tokens 512 \
|
||||||
|
--read CONVENTIONS.md \
|
||||||
|
SAVEPOINT.md \
|
||||||
|
< "$MSGS"
|
||||||
@@ -0,0 +1,8 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# run-driver.sh <messages-file> — Aider-Scripting-Sitzung durch den Governor.
|
||||||
|
set -u
|
||||||
|
MSGS="${1:?Nachrichtendatei angeben}"
|
||||||
|
REPO="${2:-$HOME/governor-p0/testrepo}"
|
||||||
|
VENV_PY="$HOME/.local/share/uv/tools/aider-chat/bin/python"
|
||||||
|
cd "$REPO"
|
||||||
|
exec "$VENV_PY" "$HOME/governor-p0/driver.py" "$MSGS"
|
||||||
@@ -234,8 +234,8 @@ def main() -> int:
|
|||||||
continue
|
continue
|
||||||
n = src.count(p["old"])
|
n = src.count(p["old"])
|
||||||
if n != 1:
|
if n != 1:
|
||||||
failed.append((p["name"], f"erwartete 1 Vorkommen von old, fand {n} "
|
failed.append((p["name"], (f"erwartete 1 Vorkommen von old, fand {n} "
|
||||||
"(Update hat den Kontext geaendert?)"))
|
"(Update hat den Kontext geaendert?)")))
|
||||||
continue
|
continue
|
||||||
f.write_text(src.replace(p["old"], p["new"]), encoding="utf-8")
|
f.write_text(src.replace(p["old"], p["new"]), encoding="utf-8")
|
||||||
try:
|
try:
|
||||||
|
|||||||
@@ -23,7 +23,7 @@ import sys
|
|||||||
_TASK_RE = re.compile(rb"work kanban task (t_[0-9a-fA-F]+)")
|
_TASK_RE = re.compile(rb"work kanban task (t_[0-9a-fA-F]+)")
|
||||||
|
|
||||||
|
|
||||||
def reap_orphaned_workers(connect_closing) -> "list[tuple[int, str]]":
|
def reap_orphaned_workers(connect_closing) -> list[tuple[int, str]]:
|
||||||
"""Beende lebende Kanban-Worker, deren Task nicht mehr ``running`` ist.
|
"""Beende lebende Kanban-Worker, deren Task nicht mehr ``running`` ist.
|
||||||
|
|
||||||
``connect_closing`` ist die gleichnamige Kontextmanager-Factory aus
|
``connect_closing`` ist die gleichnamige Kontextmanager-Factory aus
|
||||||
@@ -32,7 +32,7 @@ def reap_orphaned_workers(connect_closing) -> "list[tuple[int, str]]":
|
|||||||
"""
|
"""
|
||||||
if sys.platform != "linux":
|
if sys.platform != "linux":
|
||||||
return []
|
return []
|
||||||
candidates: "dict[int, str]" = {}
|
candidates: dict[int, str] = {}
|
||||||
try:
|
try:
|
||||||
entries = os.listdir("/proc")
|
entries = os.listdir("/proc")
|
||||||
except OSError:
|
except OSError:
|
||||||
@@ -53,7 +53,7 @@ def reap_orphaned_workers(connect_closing) -> "list[tuple[int, str]]":
|
|||||||
|
|
||||||
task_ids = list(set(candidates.values()))
|
task_ids = list(set(candidates.values()))
|
||||||
placeholders = ",".join("?" * len(task_ids))
|
placeholders = ",".join("?" * len(task_ids))
|
||||||
running: "set[str]" = set()
|
running: set[str] = set()
|
||||||
try:
|
try:
|
||||||
with connect_closing() as conn:
|
with connect_closing() as conn:
|
||||||
running = {
|
running = {
|
||||||
@@ -67,7 +67,7 @@ def reap_orphaned_workers(connect_closing) -> "list[tuple[int, str]]":
|
|||||||
except Exception:
|
except Exception:
|
||||||
return []
|
return []
|
||||||
|
|
||||||
killed: "list[tuple[int, str]]" = []
|
killed: list[tuple[int, str]] = []
|
||||||
for pid, task_id in candidates.items():
|
for pid, task_id in candidates.items():
|
||||||
if task_id in running:
|
if task_id in running:
|
||||||
continue
|
continue
|
||||||
|
|||||||
@@ -72,12 +72,22 @@ fi
|
|||||||
# --- Approval-/Tool-Ketten (Antwort muss kommen und darf nicht in pending_approval hängen). ---
|
# --- Approval-/Tool-Ketten (Antwort muss kommen und darf nicht in pending_approval hängen). ---
|
||||||
API_KEY="$(grep -E '^API_SERVER_KEY=' "$HERMES/.env" 2>/dev/null | cut -d= -f2- | tr -d '"' | tr -d "'")"
|
API_KEY="$(grep -E '^API_SERVER_KEY=' "$HERMES/.env" 2>/dev/null | cut -d= -f2- | tr -d '"' | tr -d "'")"
|
||||||
if [ -n "$API_KEY" ]; then
|
if [ -n "$API_KEY" ]; then
|
||||||
TOOL_RESP=$(curl -sf -m 90 -X POST "http://127.0.0.1:8642/v1/chat/completions" \
|
# Mit Retry — GENAU wie der Voice-Smoke darunter, und aus demselben Grund: direkt nach
|
||||||
|
# einem Update ist das Modell kalt. Ein Kaltstart kostet ~20-30 s Laden PLUS ~37 s
|
||||||
|
# Prefill für Hermes' ~70-KB-Systemprompt (33 Tool-Schemas) — zusammen mit zwei
|
||||||
|
# Inferenz-Runden sprengt das die 90 s des ersten Versuchs. Warm gemessen: 12 s.
|
||||||
|
# Ein Versuch allein war ein Fehlalarm-Generator (live erlebt 25.07., Job faf1137a).
|
||||||
|
TOOL_RESP=""
|
||||||
|
for try in 1 2 3; do
|
||||||
|
TOOL_RESP=$(curl -sf -m 120 -X POST "http://127.0.0.1:8642/v1/chat/completions" \
|
||||||
-H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" \
|
-H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" \
|
||||||
-H "X-Hermes-Session-Id: postcheck-tool-smoke" \
|
-H "X-Hermes-Session-Id: postcheck-tool-smoke-$try" \
|
||||||
-d '{"model":"hermes","stream":false,"messages":[{"role":"user","content":"Führe im Terminal exakt den Befehl echo postcheck-ok aus und gib mir nur dessen Ausgabe zurück."}]}' 2>/dev/null)
|
-d '{"model":"hermes","stream":false,"messages":[{"role":"user","content":"Führe im Terminal exakt den Befehl echo postcheck-ok aus und gib mir nur dessen Ausgabe zurück."}]}' 2>/dev/null)
|
||||||
|
echo "$TOOL_RESP" | grep -qi "postcheck-ok" && break
|
||||||
|
[ "$try" -lt 3 ] && sleep 10
|
||||||
|
done
|
||||||
if echo "$TOOL_RESP" | grep -qi "postcheck-ok"; then
|
if echo "$TOOL_RESP" | grep -qi "postcheck-ok"; then
|
||||||
echo "PASS · Tool-Smoke (terminal via Agent) liefert Ergebnis"
|
echo "PASS · Tool-Smoke (terminal via Agent) liefert Ergebnis (Versuch $try)"
|
||||||
elif echo "$TOOL_RESP" | grep -qi "pending_approval"; then
|
elif echo "$TOOL_RESP" | grep -qi "pending_approval"; then
|
||||||
echo "FAIL · Tool-Smoke hängt in pending_approval (approvals.mode prüfen!)"; fail=1
|
echo "FAIL · Tool-Smoke hängt in pending_approval (approvals.mode prüfen!)"; fail=1
|
||||||
else
|
else
|
||||||
|
|||||||
@@ -0,0 +1,7 @@
|
|||||||
|
[Unit]
|
||||||
|
Description=MC2 Morgen-Digest (Nächtliche Telegram-Zusammenfassung)
|
||||||
|
|
||||||
|
[Service]
|
||||||
|
Type=oneshot
|
||||||
|
ExecStart=/bin/bash %h/mission-control-v2/deploy/morgen-digest.sh
|
||||||
|
TimeoutStartSec=300
|
||||||
@@ -0,0 +1,10 @@
|
|||||||
|
[Unit]
|
||||||
|
Description=Timer für MC2 Morgen-Digest (07:00 Uhr)
|
||||||
|
|
||||||
|
[Timer]
|
||||||
|
OnCalendar=*-*-* 07:00:00
|
||||||
|
Persistent=true
|
||||||
|
RandomizedDelaySec=5m
|
||||||
|
|
||||||
|
[Install]
|
||||||
|
WantedBy=timers.target
|
||||||
@@ -0,0 +1,62 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# Morgen-Digest: Sammelt die zurückgehaltenen nächtlichen Meldungen (00:00 - 06:59)
|
||||||
|
# und lässt Lucy (LLM) eine Telegram-Zusammenfassung daraus bauen.
|
||||||
|
set -uo pipefail
|
||||||
|
|
||||||
|
NIGHT_QUEUE="$HOME/.hermes/night-queue.txt"
|
||||||
|
if [ ! -f "$NIGHT_QUEUE" ]; then
|
||||||
|
# Keine nächtlichen Meldungen
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Wenn die Datei existiert, aber leer ist, löschen und beenden.
|
||||||
|
if [ ! -s "$NIGHT_QUEUE" ]; then
|
||||||
|
rm -f "$NIGHT_QUEUE"
|
||||||
|
exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
EVIDENCE="$(cat "$NIGHT_QUEUE")"
|
||||||
|
|
||||||
|
PROMPT="Du bist Lucy, die KI-Assistenz der Mission-Control-Box.
|
||||||
|
Hier sind die Systemmeldungen der vergangenen Nacht.
|
||||||
|
Der Commander möchte ordentlich Futter und Details zum Frühstück! Fasse die Meldungen zu einem gehaltvollen Morgen-Digest zusammen.
|
||||||
|
Beachte dabei:
|
||||||
|
- Nenne konkrete Fakten, Namen und Versionen.
|
||||||
|
- Welche Modelle wurden z.B. vom Radar entdeckt oder evaluiert? Was waren die Ergebnisse?
|
||||||
|
- Welche Updates liefen genau und was haben sie Neues gebracht? Was muss sich der Commander noch anschauen?
|
||||||
|
- Strukturiere die Nachricht übersichtlich (z.B. mit kleinen Emojis oder Bulletpoints), aber bleibe in deiner Rolle als Lucy.
|
||||||
|
|
||||||
|
Nächtliche Meldungen:
|
||||||
|
$EVIDENCE"
|
||||||
|
|
||||||
|
# LLM aufrufen (llama-swap / gpt-oss-120b)
|
||||||
|
ENDPOINT="${CHEF_ENDPOINT:-http://127.0.0.1:8080/v1/chat/completions}"
|
||||||
|
MODEL="${CHEF_MODEL:-gpt-oss-120b}"
|
||||||
|
|
||||||
|
REQ="$(jq -n --arg m "$MODEL" --arg sys "Du bist Lucy." --arg usr "$PROMPT" --argjson mt 1200 \
|
||||||
|
'{model:$m, messages:[{role:"system",content:$sys},{role:"user",content:$usr}],
|
||||||
|
max_tokens:$mt, temperature:0.4}')"
|
||||||
|
|
||||||
|
DIGEST="$(curl -s -m 180 "$ENDPOINT" -H 'Content-Type: application/json' --data-binary "$REQ" \
|
||||||
|
| python3 -c '
|
||||||
|
import json, sys
|
||||||
|
try:
|
||||||
|
d = json.load(sys.stdin)
|
||||||
|
msg = d["choices"][0]["message"]
|
||||||
|
print((msg.get("content") or msg.get("reasoning_content") or "").strip())
|
||||||
|
except Exception:
|
||||||
|
pass'
|
||||||
|
)"
|
||||||
|
|
||||||
|
if [ -n "$DIGEST" ]; then
|
||||||
|
# Sende den Digest via hermes send (Telegram)
|
||||||
|
bash -lc 'hermes send --to telegram --subject "[🌅 Morgen-Digest]" -- "$1"' _ "$DIGEST"
|
||||||
|
if [ $? -eq 0 ]; then
|
||||||
|
# Erfolgreich gesendet, Queue leeren
|
||||||
|
rm -f "$NIGHT_QUEUE"
|
||||||
|
else
|
||||||
|
echo "Fehler beim Senden des Morgen-Digests an Telegram. Queue bleibt erhalten." >&2
|
||||||
|
fi
|
||||||
|
else
|
||||||
|
echo "Leerer Digest vom LLM. Queue bleibt erhalten." >&2
|
||||||
|
fi
|
||||||
@@ -0,0 +1,23 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
set -euo pipefail
|
||||||
|
|
||||||
|
# Erwartet den Job-Namen und das Skript als ein String oder zwei Argumente
|
||||||
|
if [ $# -eq 1 ]; then
|
||||||
|
read -r JOB_NAME SCRIPT_NAME <<< "$1"
|
||||||
|
else
|
||||||
|
JOB_NAME="$1"
|
||||||
|
SCRIPT_NAME="$2"
|
||||||
|
fi
|
||||||
|
|
||||||
|
if [ -z "$SCRIPT_NAME" ]; then
|
||||||
|
SCRIPT_NAME="$JOB_NAME"
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Pfad zusammenbauen
|
||||||
|
SCRIPT_PATH="$HOME/mission-control-v2/deploy/$SCRIPT_NAME"
|
||||||
|
if [ ! -f "$SCRIPT_PATH" ]; then
|
||||||
|
# Versuche pruefstand/
|
||||||
|
SCRIPT_PATH="$HOME/mission-control-v2/deploy/pruefstand/$SCRIPT_NAME"
|
||||||
|
fi
|
||||||
|
|
||||||
|
bash "$SCRIPT_PATH" | bash "$HOME/mission-control-v2/deploy/notify.sh" -s "$JOB_NAME"
|
||||||
+19
-2
@@ -22,8 +22,8 @@ shift $((OPTIND - 1))
|
|||||||
MSG="${1:-}"
|
MSG="${1:-}"
|
||||||
[ -z "$MSG" ] && [ ! -t 0 ] && MSG="$(cat)"
|
[ -z "$MSG" ] && [ ! -t 0 ] && MSG="$(cat)"
|
||||||
if [ -z "$MSG" ]; then
|
if [ -z "$MSG" ]; then
|
||||||
echo "usage: notify.sh [-s subject] <nachricht>" >&2
|
# Bei leerer Pipe-Eingabe lautlos beenden (wichtig für Cron-Skripte ohne Ausgabe)
|
||||||
exit 2
|
exit 0
|
||||||
fi
|
fi
|
||||||
|
|
||||||
TS="$(date '+%Y-%m-%d %H:%M:%S')"
|
TS="$(date '+%Y-%m-%d %H:%M:%S')"
|
||||||
@@ -41,6 +41,23 @@ PY
|
|||||||
)" >/dev/null 2>&1 || true
|
)" >/dev/null 2>&1 || true
|
||||||
fi
|
fi
|
||||||
|
|
||||||
|
# Nachtweiche: Zwischen 00:00 und 06:59 Uhr (inklusive) fangen wir Telegram-Nachrichten ab
|
||||||
|
# und sammeln sie für den Morgen-Digest, ES SEI DENN es ist ein Alarm.
|
||||||
|
HOUR="$(date +%H)"
|
||||||
|
if [ "$HOUR" -ge 0 ] && [ "$HOUR" -lt 7 ]; then
|
||||||
|
case "${SUBJECT,,}" in
|
||||||
|
*alarm*|*notfall*)
|
||||||
|
;; # Alarme gehen immer sofort durch
|
||||||
|
*)
|
||||||
|
# Sammeln für Morgen-Digest
|
||||||
|
NIGHT_QUEUE="$HOME/.hermes/night-queue.txt"
|
||||||
|
echo "- ${SUBJECT:+$SUBJECT: }$MSG" >> "$NIGHT_QUEUE"
|
||||||
|
echo "$TS QUEUED für Morgen-Digest: $MSG" >> "$LOG"
|
||||||
|
exit 0
|
||||||
|
;;
|
||||||
|
esac
|
||||||
|
fi
|
||||||
|
|
||||||
# Primärweg: Telegram via hermes send (Login-Shell-PATH, falls aus Timer/cron aufgerufen).
|
# Primärweg: Telegram via hermes send (Login-Shell-PATH, falls aus Timer/cron aufgerufen).
|
||||||
if [ -n "$SUBJECT" ]; then
|
if [ -n "$SUBJECT" ]; then
|
||||||
SEND_OUT="$(bash -lc 'hermes send --to telegram --subject "$1" -- "$2"' _ "$SUBJECT" "$MSG" 2>&1)"
|
SEND_OUT="$(bash -lc 'hermes send --to telegram --subject "$1" -- "$2"' _ "$SUBJECT" "$MSG" 2>&1)"
|
||||||
|
|||||||
@@ -0,0 +1,140 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# opencode-lauf.sh — EIN begrenzter Agentenlauf auf der Box, mit denselben Regeln wie in Zed.
|
||||||
|
#
|
||||||
|
# Das ist die Nacht-Seite von „ein Regelwerk, zwei Ausloeser": tagsueber tippst du in Zed,
|
||||||
|
# nachts ruft ein Hermes-Cron dieses Skript. Beide Wege benutzen
|
||||||
|
# * dieselbe OpenCode-Version,
|
||||||
|
# * dieselbe Mannschaft (~/.config/opencode/opencode.json: coder/hermes/kritiker),
|
||||||
|
# * dasselbe Plugin (~/.config/opencode/plugin/mc2-governor.ts: Zaun + Pruef-Tor),
|
||||||
|
# * denselben Token-Waechter (:8100).
|
||||||
|
#
|
||||||
|
# Unterschied zu deploy/worker.sh: worker.sh ist EIN zustandsloser Completion-Aufruf
|
||||||
|
# (Hermes schreibt die Dateien selbst). Hier laeuft ein ECHTER Agent mit Datei-Haenden,
|
||||||
|
# Subagenten und Pruef-Tor — fuer ganze Karten statt fuer Schnipsel.
|
||||||
|
#
|
||||||
|
# Nutzung:
|
||||||
|
# opencode-lauf.sh <repo-pfad> "<auftrag>"
|
||||||
|
# opencode-lauf.sh ~/projekte/foo "Baue X. Halte dich an AGENTS.md."
|
||||||
|
#
|
||||||
|
# Env:
|
||||||
|
# LAUF_TIMEOUT Sekunden Hoechstdauer (Default 3600)
|
||||||
|
# LAUF_LAUT 1 = Lucy spricht mit (Default 0 = still, Nachtbetrieb)
|
||||||
|
# LAUF_AGENT OpenCode-Agent (Default build)
|
||||||
|
set -uo pipefail
|
||||||
|
|
||||||
|
REPO="${1:-}"
|
||||||
|
AUFTRAG="${2:-}"
|
||||||
|
TIMEOUT="${LAUF_TIMEOUT:-3600}"
|
||||||
|
AGENT="${LAUF_AGENT:-build}"
|
||||||
|
OC="$HOME/.opencode/bin/opencode"
|
||||||
|
ANNOUNCE="${MC_ANNOUNCE_URL:-http://127.0.0.1:9001/api/voice/announce}"
|
||||||
|
|
||||||
|
melde () { # melde <betreff> <text> [prioritaet]
|
||||||
|
curl -sf -m 5 -X POST "$ANNOUNCE" -H 'Content-Type: application/json' \
|
||||||
|
--data "$(python3 -c 'import json,sys; print(json.dumps({"subject":sys.argv[1],"text":sys.argv[2],"source":"loop","priority":sys.argv[3]}))' \
|
||||||
|
"$1" "$2" "${3:-silent}")" >/dev/null 2>&1 || true
|
||||||
|
}
|
||||||
|
|
||||||
|
if [ -z "$REPO" ] || [ -z "$AUFTRAG" ]; then
|
||||||
|
echo "Nutzung: $0 <repo-pfad> \"<auftrag>\"" >&2
|
||||||
|
exit 2
|
||||||
|
fi
|
||||||
|
if [ ! -d "$REPO" ]; then
|
||||||
|
echo "FEHLER: '$REPO' ist kein Verzeichnis." >&2
|
||||||
|
exit 2
|
||||||
|
fi
|
||||||
|
if [ ! -x "$OC" ]; then
|
||||||
|
echo "FEHLER: OpenCode nicht gefunden ($OC)." >&2
|
||||||
|
exit 2
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Der Governor MUSS stehen — ohne ihn liefe der Lauf ohne Sitzungs-Bremse.
|
||||||
|
if ! curl -sf -m 5 -o /dev/null "http://127.0.0.1:8100/governor/status"; then
|
||||||
|
echo "FEHLER: Governor (:8100) antwortet nicht — Lauf abgebrochen (keine Sitzungs-Bremse)." >&2
|
||||||
|
melde "[Lauf]" "Ich habe einen Nachtlauf abgebrochen: der Token-Waechter antwortet nicht." "normal"
|
||||||
|
exit 3
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Nachts still: Meldungen landen im Briefkasten, Lucy spricht sie aber nicht aus.
|
||||||
|
# Das Plugin liest diese Variable; die Morgen-Zusammenfassung kommt vom Daily-Briefing.
|
||||||
|
if [ "${LAUF_LAUT:-0}" = "1" ]; then export MC2_LOOP_SILENT=0; else export MC2_LOOP_SILENT=1; fi
|
||||||
|
|
||||||
|
LOGDIR="$HOME/.hermes/logs"; mkdir -p "$LOGDIR"
|
||||||
|
STAMP="$(date +%Y%m%d-%H%M%S)"
|
||||||
|
LOG="$LOGDIR/opencode-lauf-$STAMP.log"
|
||||||
|
MAXRUNDEN="${LAUF_MAX_RUNDEN:-3}"
|
||||||
|
|
||||||
|
cd "$REPO" || exit 2
|
||||||
|
NAME="$(basename "$REPO")"
|
||||||
|
melde "[Lauf]" "Ich fange an zu bauen: $NAME." "silent"
|
||||||
|
echo "=== Lauf $STAMP · Repo $REPO · Agent $AGENT · Timeout ${TIMEOUT}s ===" | tee "$LOG"
|
||||||
|
|
||||||
|
# Verify-Befehl des Projekts lesen (gleiche Datei und gleiche Regeln wie im Plugin).
|
||||||
|
verify_cmd () {
|
||||||
|
[ -r "$REPO/VERIFY" ] || return 1
|
||||||
|
grep -vE '^\s*(#|$)' "$REPO/VERIFY" | paste -sd' && ' -
|
||||||
|
}
|
||||||
|
|
||||||
|
START=$(date +%s)
|
||||||
|
CODE=0
|
||||||
|
RUNDE=0
|
||||||
|
AUFGABE="$AUFTRAG"
|
||||||
|
|
||||||
|
# ── Bau-Schleife ────────────────────────────────────────────────────────────
|
||||||
|
# Warum hier UND im Plugin? Das Plugin haengt am Ereignis `session.idle` — in Zed
|
||||||
|
# laeuft der Prozess weiter und alles ist gut. Bei `opencode run` beendet sich der
|
||||||
|
# Prozess aber, bevor das Pruef-Tor fertig ist (gemessen 25.07.). Fuer unbeaufsichtigte
|
||||||
|
# Laeufe muss die Schleife deshalb HIER liegen, wo sie den Prozess ueberlebt.
|
||||||
|
while :; do
|
||||||
|
RUNDE=$((RUNDE + 1))
|
||||||
|
echo "--- Runde $RUNDE/$MAXRUNDEN ---" | tee -a "$LOG"
|
||||||
|
timeout "$TIMEOUT" "$OC" run --agent "$AGENT" "$AUFGABE" >>"$LOG" 2>&1
|
||||||
|
CODE=$?
|
||||||
|
[ "$CODE" -eq 124 ] && { echo "ZEITUEBERSCHREITUNG" | tee -a "$LOG"; break; }
|
||||||
|
|
||||||
|
VCMD="$(verify_cmd)" || { echo "Kein VERIFY — Pruef-Tor aus, Lauf endet." | tee -a "$LOG"; break; }
|
||||||
|
|
||||||
|
echo "--- Pruef-Tor: $VCMD ---" | tee -a "$LOG"
|
||||||
|
VOUT="$(cd "$REPO" && eval "$VCMD" 2>&1)"; VCODE=$?
|
||||||
|
printf '%s\n' "$VOUT" | tail -20 >> "$LOG"
|
||||||
|
|
||||||
|
if [ "$VCODE" -eq 0 ]; then
|
||||||
|
echo "PRUEF-TOR GRUEN" | tee -a "$LOG"
|
||||||
|
melde "[Pruefung]" "$NAME: Tests gruen nach $RUNDE Runde(n)." "normal"
|
||||||
|
CODE=0
|
||||||
|
break
|
||||||
|
fi
|
||||||
|
|
||||||
|
if [ "$RUNDE" -ge "$MAXRUNDEN" ]; then
|
||||||
|
echo "PRUEF-TOR ROT — Reparaturrunden aufgebraucht." | tee -a "$LOG"
|
||||||
|
melde "[Pruefung]" "$NAME: Tests bleiben rot nach $RUNDE Runden. Hier komme ich allein nicht weiter." "normal"
|
||||||
|
CODE=1
|
||||||
|
break
|
||||||
|
fi
|
||||||
|
|
||||||
|
echo "PRUEF-TOR ROT — Runde $((RUNDE + 1)) folgt." | tee -a "$LOG"
|
||||||
|
melde "[Pruefung]" "$NAME: Tests rot, ich repariere selbst weiter (Runde $((RUNDE + 1))/$MAXRUNDEN)." "silent"
|
||||||
|
AUFGABE="[MC2-PRUEFTOR] Der Verify-Befehl des Projekts ist fehlgeschlagen.
|
||||||
|
|
||||||
|
Befehl: $VCMD
|
||||||
|
|
||||||
|
Ausgabe (Ende):
|
||||||
|
$(printf '%s' "$VOUT" | tail -c 3000)
|
||||||
|
|
||||||
|
Behebe die URSACHE — nicht das Symptom. Schalte keinen Test ab und aendere keine Tests.
|
||||||
|
Urspruenglicher Auftrag war: $AUFTRAG"
|
||||||
|
done
|
||||||
|
|
||||||
|
DAUER=$(( $(date +%s) - START ))
|
||||||
|
# Nachweis statt Behauptung: was hat der Lauf im Arbeitsbaum tatsaechlich veraendert?
|
||||||
|
GEAENDERT="$(git -C "$REPO" status --porcelain 2>/dev/null | wc -l | tr -d ' ')"
|
||||||
|
|
||||||
|
case "$CODE" in
|
||||||
|
0) ERG="fertig, Pruefung bestanden" ;;
|
||||||
|
124) ERG="ZEITUEBERSCHREITUNG nach ${TIMEOUT}s" ;;
|
||||||
|
*) ERG="Pruefung NICHT bestanden (Exitcode $CODE)" ;;
|
||||||
|
esac
|
||||||
|
|
||||||
|
echo "=== Ergebnis: $ERG · ${DAUER}s · $RUNDE Runde(n) · $GEAENDERT geaenderte Dateien · Log $LOG ===" | tee -a "$LOG"
|
||||||
|
melde "[Lauf]" "$NAME: $ERG nach $((DAUER/60)) Minuten, $RUNDE Runde(n), $GEAENDERT Dateien angefasst." "silent"
|
||||||
|
exit "$CODE"
|
||||||
@@ -0,0 +1,82 @@
|
|||||||
|
# Persönliche Regeln (gelten für ALLE Projekte)
|
||||||
|
|
||||||
|
## So arbeitest du mit mir
|
||||||
|
- Antworte auf **Deutsch**, Fazit zuerst, Technik in Alltagssprache. Ich bin **kein Entwickler**.
|
||||||
|
- **Plan vor Code** bei allem Größeren: erst Vorgehen zeigen, auf mein **„los"** warten.
|
||||||
|
- **Kleine Schritte**, eine Sache zur Zeit. Nichts Ungefragtes ausführen; **frag**, bevor du löschst
|
||||||
|
oder überschreibst.
|
||||||
|
- **Beweisen statt behaupten** — am Ende live testen, nicht „sollte gehen".
|
||||||
|
- Nimm **Standard-Wege**, keine exotische Technik, außer ich will es ausdrücklich anders.
|
||||||
|
- **Geheimnisse** (Schlüssel/Passwörter/Tokens) nie in den Code — in `.env` (+ `.gitignore`); warnen,
|
||||||
|
bevor so etwas in einen Commit wandert.
|
||||||
|
- **Nicht festfahren:** klemmt dieselbe Sache nach 2 Versuchen, anhalten, sichern, erklären und fragen.
|
||||||
|
- **Bau-Prinzipien sind DEIN Job, nicht meine Frage:** KISS, YAGNI, Zuständigkeiten trennen, DRY,
|
||||||
|
sprechende Namen, schlank starten. Frag mich nie danach — frag mich nur nach Zielen in Alltagssprache.
|
||||||
|
- **Faulheits-Leiter vor jeder neuen Zeile/Abhängigkeit:** (1) muss das überhaupt sein? (2) gibt's das
|
||||||
|
schon (wiederverwenden)? (3) reicht Bordmittel/Standard-Bibliothek? (4) erst dann minimal selbst bauen.
|
||||||
|
Faul bei Lösungen, nie beim Verstehen; Sicherheitsnetze (Prüfung/Fehlerbehandlung/keine Geheimnisse)
|
||||||
|
bleiben. „Prüf auf Über-Engineering" = Diff auf unnötige Abhängigkeiten/Abstraktion/Verdachts-Features durchsehen.
|
||||||
|
|
||||||
|
## Deine Mannschaft — delegiere, statt alles selbst zu tun
|
||||||
|
- **`explore`** (Subagent): Code durchsuchen, Dateien finden, Fragen zum Bestand beantworten. Läuft auf
|
||||||
|
dem ohnehin warmen Hirn und kostet praktisch nichts. **Nutze ihn**, statt dich selbst durch den Baum
|
||||||
|
zu wühlen — dein eigener Kontext bleibt dadurch sauber und du hältst länger durch.
|
||||||
|
- **`review`** (Subagent): kritisches Gegenlesen nach jeder Etappe. Läuft bewusst auf einer **fremden
|
||||||
|
Modellfamilie**, damit er andere blinde Flecken hat als du. Nimm seine Befunde ernst.
|
||||||
|
- **`plan`**: nur lesen, keine Änderungen.
|
||||||
|
- Es gibt **keinen Modellwechsel mehr**. Früher galt „zum Bauen oben auf Coder umschalten" — Planen und
|
||||||
|
Bauen laufen inzwischen auf demselben Modell. Bitte mich nie, etwas umzustellen.
|
||||||
|
|
||||||
|
## Das Prüf-Tor (`VERIFY`)
|
||||||
|
- Im Projekt liegt eine Datei `VERIFY` mit **einer Zeile: wie man dieses Projekt testet**. Sobald du
|
||||||
|
„fertig" meldest, wird sie automatisch ausgeführt.
|
||||||
|
- **Rot heißt nicht fertig.** Der Fehler kommt zu dir zurück, du behebst die **Ursache** — nicht das
|
||||||
|
Symptom. Einen Test abschwächen, überspringen oder umschreiben, damit er grün wird, gilt als Betrug.
|
||||||
|
- Fehlt die Datei, ist das Prüf-Tor aus. Dann **frag mich**, was der richtige Testbefehl wäre, statt
|
||||||
|
ungeprüft weiterzubauen.
|
||||||
|
|
||||||
|
## Kontext-Wächter
|
||||||
|
- Ein Token-Wächter zählt jede Sitzung mit und schneidet sie bei ~45.000 Tokens. Du musst nichts messen
|
||||||
|
— die Ansage kommt von allein.
|
||||||
|
- Kommt sie: **`SAVEPOINT.md` ehrlich fertigschreiben und anhalten.** Ehrlich heißt: nur was **wirklich
|
||||||
|
im Code steht**. Nichts aus Absicht, Plan oder git-Nachrichten ableiten. Dazu der genaue nächste
|
||||||
|
Schritt, offene Fragen und Stolpersteine — genug, dass eine frische Sitzung ohne jede Erinnerung
|
||||||
|
allein damit weitermachen kann.
|
||||||
|
- Merkst du vorher schon, dass du dich wiederholst oder abdriftest: sag es proaktiv und schlag einen
|
||||||
|
frischen Chat vor.
|
||||||
|
|
||||||
|
## Wenn niemand da ist (unbeaufsichtigte Läufe)
|
||||||
|
Nachts startet ein Cron dieselbe Umgebung ohne Menschen davor. Erkennst du das — der Auftrag kam als
|
||||||
|
ein Block, auf Rückfragen antwortet niemand: **warte nicht auf ein „los"**. Halte dich an `KONZEPT`/
|
||||||
|
`SAVEPOINT.md`, bau in kleinen Etappen und lass das Prüf-Tor entscheiden. Was du ohne Antwort nicht
|
||||||
|
sauber entscheiden kannst, schreibst du als offene Frage in `SAVEPOINT.md`, statt zu raten.
|
||||||
|
|
||||||
|
## Was du nie tust
|
||||||
|
`git push`, Historie umschreiben, rekursiv löschen, `sudo`, Pakete veröffentlichen. Das ist gezäunt und
|
||||||
|
wird geblockt — nicht weil du es falsch machst, sondern weil Veröffentlichen meine Entscheidung ist.
|
||||||
|
Brauchst du so etwas wirklich: sag es mir, ich mache es selbst.
|
||||||
|
|
||||||
|
## Bestehendes Projekt fortsetzen?
|
||||||
|
Ordner nicht leer / neue Sitzung: zuerst **`SAVEPOINT.md` + `AGENTS.md` lesen**, mir in 2 Sätzen sagen
|
||||||
|
„hier stehen wir / nächster Schritt", dann weitermachen — nicht neu planen.
|
||||||
|
|
||||||
|
## Neues Projekt? → Projekt-Start-Ablauf
|
||||||
|
Wenn ein **neues** Projekt beginnt (leerer/neuer Ordner, „bau mir…", „neues Projekt…", „ich hätte
|
||||||
|
gern…"): folge diesem Ablauf. **Keine Datei, kein Code vor meiner Freigabe.**
|
||||||
|
1. **Verstehen:** erst herausfinden, *was für ein* Projekt (Web-App / kleines Skript /
|
||||||
|
Box-Lucy-Erweiterung / Experiment / Datensache), dann **3–6 typ-passende Fragen** + „woran ist
|
||||||
|
es fertig?".
|
||||||
|
2. **Plan vorlegen** (Ziel · Vorgehen · Technik + warum · Fertig-Kriterien · Risiken) → **STOPP**,
|
||||||
|
auf mein „los" warten.
|
||||||
|
3. **Erst dann Gerüst:** `git init` + die Projektdateien (`AGENTS.md`, `SAVEPOINT.md`, `.aiexclude`,
|
||||||
|
`VERIFY`) + `README`, dann **Sicherungspunkt „start"** (erster Commit).
|
||||||
|
4. In **kleinen Schritten** bauen, an jedem Meilenstein + vor riskanten Änderungen einen
|
||||||
|
**Sicherungspunkt** (Commit mit klarem Namen) setzen, am Ende **live testen**.
|
||||||
|
|
||||||
|
## Bei großem Meilenstein UND Session-Ende („Feierabend"/„sichern")
|
||||||
|
Immer fortschreiben: **`SAVEPOINT.md`** (Stand · Fertiges · nächste Schritte · offene Fragen — die
|
||||||
|
Übergabe an die nächste Sitzung), **`AGENTS.md`** (falls Konventionen sich änderten), **`.aiexclude`**
|
||||||
|
(neue Geheimnisse/große Dateien), **`VERIFY`** (falls sich der Testbefehl geändert hat), dann
|
||||||
|
Sicherungspunkt setzen.
|
||||||
|
|
||||||
|
Volle Fassung des Projekt-Start-Ablaufs: `F:\Coding Stuff\projekt-start\SKILL.md`
|
||||||
@@ -0,0 +1,75 @@
|
|||||||
|
# OpenCode-Seite: ein Regelwerk, zwei Auslöser
|
||||||
|
|
||||||
|
Tagsüber tippst du in **Zed** (PC), nachts ruft ein **Hermes-Cron** dasselbe (Box).
|
||||||
|
Beide Wege benutzen dieselbe OpenCode-Version, dieselbe Mannschaft, dasselbe Plugin
|
||||||
|
und denselben Token-Wächter. Der einzige Unterschied ist die Adresse des Governors.
|
||||||
|
|
||||||
|
## Was wohin gehört
|
||||||
|
|
||||||
|
| Datei hier | Ziel auf dem PC | Ziel auf der Box |
|
||||||
|
|---|---|---|
|
||||||
|
| `opencode.pc.json` | `~/.config/opencode/opencode.json` | — |
|
||||||
|
| `opencode.box.json` | — | `~/.config/opencode/opencode.json` |
|
||||||
|
| `AGENTS.global.md` | `~/.config/opencode/AGENTS.md` | `~/.config/opencode/AGENTS.md` |
|
||||||
|
| `plugin/mc2-governor.ts` | `~/.config/opencode/plugin/` | `~/.config/opencode/plugin/` |
|
||||||
|
| `VERIFY.template` | — | wird von `gitea-repo-create.sh` in **jedes neue Repo** als `VERIFY` gesät |
|
||||||
|
|
||||||
|
### Warum die Regeln hier liegen und nicht in Zed
|
||||||
|
|
||||||
|
Die persönlichen Arbeitsregeln standen bis 25.07.2026 in `AppData\Roaming\Zed\AGENTS.md` — und
|
||||||
|
haben dort **nie den Coding-Agenten erreicht**. Zeds eigene Doku ist eindeutig: `AGENTS.md` und
|
||||||
|
Skills gelten **nur für Zeds nativen Agenten**, nicht für ACP-Agenten wie OpenCode. Da hier über
|
||||||
|
ACP gearbeitet wird, liefen die Regeln jahrelang ins Leere.
|
||||||
|
|
||||||
|
OpenCode liest stattdessen (in dieser Reihenfolge): `AGENTS.md` im Projekt (aufwärts gesucht) und
|
||||||
|
`~/.config/opencode/AGENTS.md` global. Beide gelten zusammen — Projektregeln ergänzen die globalen.
|
||||||
|
|
||||||
|
Beim Umzug bewusst geändert:
|
||||||
|
- **Zeds Commit-Vorlage entfernt.** Sie war in dieselbe Datei gerutscht und enthielt „Only return
|
||||||
|
the commit message in your response" — in einer dauerhaft aktiven Regeldatei ein Fehlerherd.
|
||||||
|
- **Modellwähler-Absatz gestrichen.** „Zum Bauen oben auf Coder umschalten" stimmt seit der
|
||||||
|
Mannschafts-Umstellung nicht mehr: `plan` und `build` laufen auf demselben Modell.
|
||||||
|
- **Kontext-Wächter umgeschrieben** auf den Governor, der den Füllstand wirklich kennt.
|
||||||
|
- **Neu:** Prüf-Tor (`VERIFY`), die Subagenten-Mannschaft und ein Abschnitt für **unbeaufsichtigte
|
||||||
|
Läufe** — nachts sagt niemand „los", also darf der Agent dort nicht auf Freigabe warten.
|
||||||
|
|
||||||
|
Der Governor selbst liegt in `../governor/` (Proxy + systemd-Unit), der unbeaufsichtigte
|
||||||
|
Läufer in `../opencode-lauf.sh`.
|
||||||
|
|
||||||
|
## Die Mannschaft
|
||||||
|
|
||||||
|
| Rolle | Modell | Gemessen (25.07.2026) | Warum |
|
||||||
|
|---|---|---|---|
|
||||||
|
| `plan` + `build` | `coder` — Qwen3-Coder-Next | **51,5 t/s** | Hält den Faden, verteilt Zuarbeit. MoE mit 3B aktiv → schnell auf Strix Halo. |
|
||||||
|
| `explore` | `hermes` — Qwen3.6-35B | **69,6 t/s** | Ohnehin dauerwarm → kostet **null** zusätzlichen Speicher. Sucht, liest, meldet kurz zurück. |
|
||||||
|
| `review` | `kritiker` — Devstral-Small-2 | **15,0 t/s** | Bewusst eine **fremde Modellfamilie** (Mistral statt Qwen) → andere blinde Flecken. Dicht = langsam beim Schreiben, aber ein Kritiker liest viel und schreibt wenig. |
|
||||||
|
|
||||||
|
`heavy` (gpt-oss-120b, 63 GB) ist **nicht** mehr in der Tagesrolle: es würde beim Laden
|
||||||
|
das ganze warme Set verdrängen. Es bleibt der Nacht-Gutachter (4:30-Cron).
|
||||||
|
|
||||||
|
## Nach einer Änderung
|
||||||
|
|
||||||
|
Die Dateien hier sind **Vorlagen**, keine Live-Konfiguration. Nach einer Änderung
|
||||||
|
verteilen:
|
||||||
|
|
||||||
|
```bash
|
||||||
|
# Box
|
||||||
|
scp deploy/opencode/opencode.box.json hitonabi@192.168.178.151:~/.config/opencode/opencode.json
|
||||||
|
scp deploy/opencode/plugin/*.ts hitonabi@192.168.178.151:~/.config/opencode/plugin/
|
||||||
|
# PC (aus dem Repo heraus)
|
||||||
|
cp deploy/opencode/opencode.pc.json ~/.config/opencode/opencode.json
|
||||||
|
cp deploy/opencode/plugin/*.ts ~/.config/opencode/plugin/
|
||||||
|
```
|
||||||
|
|
||||||
|
**Zed muss danach neu gestartet werden** — OpenCode liest seine Konfiguration nur beim Start.
|
||||||
|
|
||||||
|
## Fallen, die Zeit gekostet haben
|
||||||
|
|
||||||
|
- **Kein `_comment`-Schlüssel in `opencode.json`.** OpenCode validiert streng und
|
||||||
|
verweigert den Start mit „Unrecognized key". Kommentare gehören in dieses README.
|
||||||
|
- **Das Plugin läuft auf Windows UND Linux.** Deshalb `node:fs` statt `cat` und Buns
|
||||||
|
`${{ raw: cmd }}` statt `bash -lc` — beides fehlt auf Windows bzw. verschluckt den Befehl.
|
||||||
|
- **Bei `opencode run` beendet sich der Prozess, bevor `session.idle` fertig ist**
|
||||||
|
(gemessen 25.07.). Für unbeaufsichtigte Läufe liegt die Prüf-Schleife deshalb
|
||||||
|
zusätzlich in `opencode-lauf.sh`, wo sie den Prozess überlebt. In Zed greift das Plugin.
|
||||||
|
- **Plugin-Verzeichnis:** `plugin/` und `plugins/` werden beide erkannt; wir nutzen `plugin/`.
|
||||||
@@ -0,0 +1,21 @@
|
|||||||
|
# VERIFY — wie man dieses Projekt prueft.
|
||||||
|
#
|
||||||
|
# Diese Datei ist das Pruef-Tor. Das MC2-Governor-Plugin fuehrt sie aus, sobald der
|
||||||
|
# Agent "fertig" sagt. Gruen -> Etappe gilt als fertig. Rot -> der Fehler geht
|
||||||
|
# automatisch als naechster Auftrag an den Agenten zurueck, bis zu 3 Runden.
|
||||||
|
#
|
||||||
|
# Regeln:
|
||||||
|
# * Eine Zeile = ein Befehl. Alle Zeilen werden mit && verkettet.
|
||||||
|
# * Zeilen mit # sind Kommentare.
|
||||||
|
# * KEINE Datei VERIFY im Projekt = Pruef-Tor aus (nichts passiert).
|
||||||
|
# * Der Befehl muss ohne Rueckfragen durchlaufen und mit 0 enden, wenn alles gut ist.
|
||||||
|
#
|
||||||
|
# Beispiele (unzutreffende Zeilen loeschen):
|
||||||
|
#
|
||||||
|
# Python: ruff check . && pytest -q
|
||||||
|
# Node/TS: npm run lint && npm test
|
||||||
|
# Frontend: npm run build
|
||||||
|
# Nur Syntax: python -m compileall -q .
|
||||||
|
# Nichts da: git diff --stat (laeuft immer gruen — Platzhalter)
|
||||||
|
|
||||||
|
git diff --stat
|
||||||
@@ -0,0 +1,88 @@
|
|||||||
|
{
|
||||||
|
"$schema": "https://opencode.ai/config.json",
|
||||||
|
"provider": {
|
||||||
|
"aibox": {
|
||||||
|
"npm": "@ai-sdk/openai-compatible",
|
||||||
|
"name": "AI-Box ueber Governor (lokal)",
|
||||||
|
"options": {
|
||||||
|
"baseURL": "http://127.0.0.1:8100/v1",
|
||||||
|
"apiKey": "local"
|
||||||
|
},
|
||||||
|
"models": {
|
||||||
|
"coder": {
|
||||||
|
"name": "coder — Bauen + Planen (Qwen3-Coder-Next, 51,5 t/s)",
|
||||||
|
"limit": {
|
||||||
|
"context": 131072,
|
||||||
|
"output": 16384
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"hermes": {
|
||||||
|
"name": "hermes — Suchen (Qwen3.6-35B, immer warm, 69,6 t/s)",
|
||||||
|
"limit": {
|
||||||
|
"context": 65536,
|
||||||
|
"output": 8192
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"kritiker": {
|
||||||
|
"name": "kritiker — Gegenlesen (Devstral-2, Mistral, 16k gedeckelt)",
|
||||||
|
"limit": {
|
||||||
|
"context": 16384,
|
||||||
|
"output": 4096
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"heavy": {
|
||||||
|
"name": "heavy — Nacht-Gutachter (gpt-oss-120b, verdraengt das warme Set!)",
|
||||||
|
"limit": {
|
||||||
|
"context": 32768,
|
||||||
|
"output": 8192
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"model": "aibox/coder",
|
||||||
|
"small_model": "aibox/hermes",
|
||||||
|
"agent": {
|
||||||
|
"plan": {
|
||||||
|
"model": "aibox/coder",
|
||||||
|
"permission": {
|
||||||
|
"edit": "deny",
|
||||||
|
"bash": "deny"
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"build": {
|
||||||
|
"model": "aibox/coder",
|
||||||
|
"permission": {
|
||||||
|
"edit": "allow",
|
||||||
|
"webfetch": "allow",
|
||||||
|
"bash": {
|
||||||
|
"*": "allow",
|
||||||
|
"ssh *": "deny",
|
||||||
|
"scp *": "deny",
|
||||||
|
"sftp *": "deny",
|
||||||
|
"ssh arcane@192.168.178.162 *": "allow",
|
||||||
|
"ssh -o StrictHostKeyChecking=no arcane@192.168.178.162 *": "allow",
|
||||||
|
"scp *arcane@192.168.178.162*": "allow"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"explore": {
|
||||||
|
"mode": "subagent",
|
||||||
|
"description": "Codebase schnell durchsuchen, Dateien finden, Fragen zum Code beantworten — nur lesen, laeuft auf dem immer warmen Hirn",
|
||||||
|
"model": "aibox/hermes",
|
||||||
|
"permission": {
|
||||||
|
"edit": "deny",
|
||||||
|
"bash": "deny"
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"review": {
|
||||||
|
"mode": "subagent",
|
||||||
|
"description": "Kritischer Code-Review nach jeder Etappe (Pflicht laut AGENTS.md): sucht erfundene APIs/CLI-Flags, stille Abweichungen vom KONZEPT, fehlende Tests, toten Code — meldet Befunde, aendert nichts. Laeuft bewusst auf einer FREMDEN Modellfamilie (Mistral/Devstral statt Qwen), damit er andere blinde Flecken hat als der Coder.",
|
||||||
|
"model": "aibox/kritiker",
|
||||||
|
"permission": {
|
||||||
|
"edit": "deny",
|
||||||
|
"bash": "deny"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
@@ -0,0 +1,88 @@
|
|||||||
|
{
|
||||||
|
"$schema": "https://opencode.ai/config.json",
|
||||||
|
"provider": {
|
||||||
|
"aibox": {
|
||||||
|
"npm": "@ai-sdk/openai-compatible",
|
||||||
|
"name": "AI-Box ueber Governor (192.168.178.151:8100)",
|
||||||
|
"options": {
|
||||||
|
"baseURL": "http://192.168.178.151:8100/v1",
|
||||||
|
"apiKey": "local"
|
||||||
|
},
|
||||||
|
"models": {
|
||||||
|
"heavy": {
|
||||||
|
"name": "heavy — Planer (gpt-oss-120b, 32k)",
|
||||||
|
"limit": {
|
||||||
|
"context": 32768,
|
||||||
|
"output": 8192
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"coder": {
|
||||||
|
"name": "coder — Bauen (Qwen3-Coder-Next, 131k)",
|
||||||
|
"limit": {
|
||||||
|
"context": 131072,
|
||||||
|
"output": 16384
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"hermes": {
|
||||||
|
"name": "hermes — Erkunden (Qwen3.6, immer warm, 69,6 t/s)",
|
||||||
|
"limit": {
|
||||||
|
"context": 65536,
|
||||||
|
"output": 8192
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"kritiker": {
|
||||||
|
"name": "kritiker — Gegenlesen (Devstral-2, Mistral, 16k gedeckelt)",
|
||||||
|
"limit": {
|
||||||
|
"context": 16384,
|
||||||
|
"output": 4096
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"model": "aibox/coder",
|
||||||
|
"small_model": "aibox/hermes",
|
||||||
|
"agent": {
|
||||||
|
"plan": {
|
||||||
|
"model": "aibox/coder",
|
||||||
|
"permission": {
|
||||||
|
"edit": "deny",
|
||||||
|
"bash": "deny"
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"build": {
|
||||||
|
"model": "aibox/coder",
|
||||||
|
"permission": {
|
||||||
|
"edit": "allow",
|
||||||
|
"webfetch": "allow",
|
||||||
|
"bash": {
|
||||||
|
"*": "allow",
|
||||||
|
"ssh *": "deny",
|
||||||
|
"scp *": "deny",
|
||||||
|
"sftp *": "deny",
|
||||||
|
"ssh arcane@192.168.178.162 *": "allow",
|
||||||
|
"ssh -o StrictHostKeyChecking=no arcane@192.168.178.162 *": "allow",
|
||||||
|
"scp *arcane@192.168.178.162*": "allow"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"explore": {
|
||||||
|
"mode": "subagent",
|
||||||
|
"description": "Codebase schnell durchsuchen, Dateien finden, Fragen zum Code beantworten — nur lesen, läuft auf dem immer warmen Hirn",
|
||||||
|
"model": "aibox/hermes",
|
||||||
|
"permission": {
|
||||||
|
"edit": "deny",
|
||||||
|
"bash": "deny"
|
||||||
|
}
|
||||||
|
},
|
||||||
|
"review": {
|
||||||
|
"mode": "subagent",
|
||||||
|
"description": "Kritischer Code-Review nach jeder Etappe (Pflicht laut AGENTS.md): sucht erfundene APIs/CLI-Flags, stille Abweichungen vom KONZEPT, fehlende Tests, toten Code — meldet Befunde, ändert nichts. Läuft bewusst auf einer FREMDEN Modellfamilie (Mistral/Devstral statt Qwen), damit er andere blinde Flecken hat als der Coder.",
|
||||||
|
"model": "aibox/kritiker",
|
||||||
|
"permission": {
|
||||||
|
"edit": "deny",
|
||||||
|
"bash": "deny"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
@@ -0,0 +1,248 @@
|
|||||||
|
/**
|
||||||
|
* MC2-Governor — der "Fahrlehrer" im OpenCode-Agenten.
|
||||||
|
*
|
||||||
|
* Der Governor-Proxy (:8100) ist die Tankuhr: er sieht nur Tokens und zieht die
|
||||||
|
* Notbremse. Dieses Plugin sitzt IM Agenten und sieht alles andere — jeden
|
||||||
|
* Werkzeuggriff, jede Datei, jedes Sitzungsende. Es macht vier Dinge:
|
||||||
|
*
|
||||||
|
* 1. WERKZEUG-ZAUN (tool.execute.before)
|
||||||
|
* Blockt Handgriffe, die ein Agent nie unbeaufsichtigt tun darf: push,
|
||||||
|
* Historie umschreiben, rekursiv loeschen, sudo, Fremd-Hosts. Genau dieser
|
||||||
|
* Zustandsautomat-Zaun hob lokale Modelle in Messungen von 2/10 auf 10/10 —
|
||||||
|
* nicht weil sie schlauer werden, sondern weil sie nicht mehr entgleisen.
|
||||||
|
*
|
||||||
|
* 2. PRUEF-TOR + SCHLEIFE (session.idle)
|
||||||
|
* Sagt der Agent "fertig", laeuft der Verify-Befehl des Projekts (Datei
|
||||||
|
* `VERIFY` im Repo-Wurzelverzeichnis). GRUEN -> Meldung. ROT -> der Fehler
|
||||||
|
* geht als naechster Auftrag automatisch zurueck an den Agenten, bis zu
|
||||||
|
* MC2_LOOP_MAX_ROUNDS mal. Das ist die "Ralph-Schleife", nur mit Bremse.
|
||||||
|
*
|
||||||
|
* 3. SAVEPOINT STATT ZUSAMMENFASSEN (session.compacted)
|
||||||
|
* Beim Komprimieren fallen still die Regeln aus dem Kontext (Paper
|
||||||
|
* "Governance Decay"). Wir schieben stattdessen den Auftrag nach, SAVEPOINT.md
|
||||||
|
* zu schreiben — Wissen lebt in Datei + git, nicht im schrumpfenden Chat.
|
||||||
|
*
|
||||||
|
* 4. STIMME (MC2 /api/voice/announce)
|
||||||
|
* Jedes Ereignis geht mit eigenem Absender `loop` in MC2s Melde-Briefkasten.
|
||||||
|
* Lucy pollt ihn ohnehin und spricht ihn — ohne eine Zeile Lucy-Code.
|
||||||
|
*
|
||||||
|
* Schalter (Umgebungsvariablen):
|
||||||
|
* MC2_BOX_URL MC2-Basis (Default http://192.168.178.151:9001)
|
||||||
|
* MC2_LOOP_AUTOFIX Selbstreparatur (1 = an, Default an)
|
||||||
|
* MC2_LOOP_MAX_ROUNDS max. Reparaturrunden (Default 3)
|
||||||
|
* MC2_LOOP_SILENT 1 = Lucy schweigt (Nachtlauf; Meldungen kommen trotzdem an)
|
||||||
|
* MC2_LOOP_ANNOUNCE 0 = gar keine Meldungen
|
||||||
|
* MC2_FENCE_OFF 1 = Werkzeug-Zaun aus (nur fuer Notfaelle)
|
||||||
|
*
|
||||||
|
* Liegt global unter ~/.config/opencode/plugin/ und wirkt damit in JEDEM Projekt —
|
||||||
|
* am Tag in Zed, nachts im Cron. Ein Regelwerk, zwei Ausloeser.
|
||||||
|
*/
|
||||||
|
|
||||||
|
const BOX_URL = process.env.MC2_BOX_URL || "http://192.168.178.151:9001"
|
||||||
|
const AUTOFIX = process.env.MC2_LOOP_AUTOFIX !== "0"
|
||||||
|
const MAX_ROUNDS = parseInt(process.env.MC2_LOOP_MAX_ROUNDS || "3", 10)
|
||||||
|
const SILENT = process.env.MC2_LOOP_SILENT === "1"
|
||||||
|
const ANNOUNCE_ON = process.env.MC2_LOOP_ANNOUNCE !== "0"
|
||||||
|
const FENCE_OFF = process.env.MC2_FENCE_OFF === "1"
|
||||||
|
|
||||||
|
/**
|
||||||
|
* Verbotene Shell-Handgriffe. Bewusst als Muster auf der ROHEN Kommandozeile —
|
||||||
|
* ein Agent, der `git push` in ein `bash -c` verpackt, wird trotzdem erwischt.
|
||||||
|
* Kein Anspruch auf Sandbox-Sicherheit: das ist ein Leitplanken-Zaun gegen
|
||||||
|
* Entgleisen, keine Abwehr gegen einen boesartigen Akteur.
|
||||||
|
*/
|
||||||
|
const FENCE: Array<{ rx: RegExp; why: string }> = [
|
||||||
|
{ rx: /\bgit\s+push\b/, why: "git push — Veroeffentlichen ist Sache des Menschen (oder der CI-Ampel)." },
|
||||||
|
{ rx: /\bgit\s+reset\s+--hard\b/, why: "git reset --hard — verwirft Arbeit unwiederbringlich." },
|
||||||
|
{ rx: /\bgit\s+clean\s+-[a-z]*f/, why: "git clean -f — loescht ungetrackte Dateien unwiederbringlich." },
|
||||||
|
{ rx: /\bgit\s+(rebase|filter-branch|reflog\s+expire)\b/, why: "Historie umschreiben ist tabu." },
|
||||||
|
{ rx: /\brm\s+-[a-zA-Z]*r[a-zA-Z]*f?\s+\/(?:\s|$)/, why: "rm -rf / — nein." },
|
||||||
|
{ rx: /\brm\s+-[a-zA-Z]*[rf]/, why: "rekursives/erzwungenes Loeschen — bitte gezielt loeschen statt pauschal." },
|
||||||
|
{ rx: /\bsudo\b/, why: "sudo — Rechteausweitung gehoert nicht in einen Agentenlauf." },
|
||||||
|
{ rx: /\b(shutdown|reboot|mkfs|dd\s+if=)/, why: "System-/Datentraeger-Eingriff." },
|
||||||
|
{ rx: /\b(curl|wget)\b[^|]*\|\s*(ba)?sh\b/, why: "Aus dem Netz laden und direkt ausfuehren — klassischer Fussschuss." },
|
||||||
|
{ rx: /\bssh\s+(?!arcane@192\.168\.178\.162|-o\s+StrictHostKeyChecking=no\s+arcane@)/, why: "ssh nur zur freigegebenen Arcane-VM." },
|
||||||
|
{ rx: /\bnpm\s+publish\b|\btwine\s+upload\b/, why: "Veroeffentlichen von Paketen ist Sache des Menschen." },
|
||||||
|
]
|
||||||
|
|
||||||
|
/** Zaehler je Sitzung: wie viele Selbstreparatur-Runden liefen schon? */
|
||||||
|
const rounds = new Map<string, number>()
|
||||||
|
/** Doppel-Feuern verhindern: session.idle kann mehrfach kommen. */
|
||||||
|
const busy = new Set<string>()
|
||||||
|
|
||||||
|
async function announce(subject: string, text: string, priority: "normal" | "silent" = "normal") {
|
||||||
|
if (!ANNOUNCE_ON) return
|
||||||
|
try {
|
||||||
|
await fetch(`${BOX_URL}/api/voice/announce`, {
|
||||||
|
method: "POST",
|
||||||
|
headers: { "Content-Type": "application/json" },
|
||||||
|
body: JSON.stringify({
|
||||||
|
subject,
|
||||||
|
text,
|
||||||
|
source: "loop",
|
||||||
|
priority: SILENT ? "silent" : priority,
|
||||||
|
}),
|
||||||
|
signal: AbortSignal.timeout(4000),
|
||||||
|
})
|
||||||
|
} catch {
|
||||||
|
/* best effort — eine stumme Lucy darf den Bau nie aufhalten */
|
||||||
|
}
|
||||||
|
}
|
||||||
|
|
||||||
|
export const MC2Governor = async ({ client, $, directory, worktree }: any) => {
|
||||||
|
const root: string = worktree || directory || process.cwd()
|
||||||
|
|
||||||
|
/**
|
||||||
|
* Verify-Befehl des Projekts lesen. Fehlt die Datei, ist das Pruef-Tor AUS.
|
||||||
|
* Bewusst ueber fs statt `cat`: das Plugin laeuft am Tag auf Windows (Zed) und
|
||||||
|
* nachts auf der Box — `cat` gibt es auf Windows nicht zuverlaessig.
|
||||||
|
*/
|
||||||
|
async function readVerify(): Promise<string | null> {
|
||||||
|
try {
|
||||||
|
const { readFile } = await import("node:fs/promises")
|
||||||
|
const { join } = await import("node:path")
|
||||||
|
const raw = await readFile(join(root, "VERIFY"), "utf8")
|
||||||
|
const cmd = raw
|
||||||
|
.split("\n")
|
||||||
|
.map((l: string) => l.trim())
|
||||||
|
.filter((l: string) => l && !l.startsWith("#"))
|
||||||
|
.join(" && ")
|
||||||
|
return cmd || null
|
||||||
|
} catch {
|
||||||
|
return null
|
||||||
|
}
|
||||||
|
}
|
||||||
|
|
||||||
|
/**
|
||||||
|
* Verify ausfuehren. Rueckgabe: {ok, output} — Ausgabe auf das Wesentliche gekuerzt.
|
||||||
|
* `{ raw: cmd }` schiebt den Befehl UNESCAPED in Buns Shell; ein normales
|
||||||
|
* `${cmd}` wuerde die ganze Zeile als EIN Argument uebergeben und nie laufen.
|
||||||
|
* Buns Shell ist plattformunabhaengig — kein `bash -lc`, das auf Windows fehlt.
|
||||||
|
*/
|
||||||
|
async function runVerify(cmd: string): Promise<{ ok: boolean; out: string }> {
|
||||||
|
try {
|
||||||
|
const res = await $`${{ raw: cmd }}`.cwd(root).nothrow().quiet()
|
||||||
|
const out = `${res.stdout?.toString() ?? ""}${res.stderr?.toString() ?? ""}`
|
||||||
|
return { ok: res.exitCode === 0, out: out.slice(-4000) }
|
||||||
|
} catch (e: any) {
|
||||||
|
return { ok: false, out: String(e?.message ?? e).slice(-4000) }
|
||||||
|
}
|
||||||
|
}
|
||||||
|
|
||||||
|
/** Dem laufenden Agenten einen neuen Auftrag schicken (Selbstreparatur-Schleife). */
|
||||||
|
async function sendPrompt(sessionID: string, text: string): Promise<boolean> {
|
||||||
|
try {
|
||||||
|
await client.session.prompt({
|
||||||
|
path: { id: sessionID },
|
||||||
|
body: { parts: [{ type: "text", text }] },
|
||||||
|
})
|
||||||
|
return true
|
||||||
|
} catch {
|
||||||
|
return false
|
||||||
|
}
|
||||||
|
}
|
||||||
|
|
||||||
|
return {
|
||||||
|
// ── 1. Werkzeug-Zaun ───────────────────────────────────────────────────
|
||||||
|
"tool.execute.before": async (input: any, output: any) => {
|
||||||
|
if (FENCE_OFF) return
|
||||||
|
if (input?.tool !== "bash") return
|
||||||
|
const cmd: string = output?.args?.command ?? ""
|
||||||
|
if (!cmd) return
|
||||||
|
for (const rule of FENCE) {
|
||||||
|
if (rule.rx.test(cmd)) {
|
||||||
|
await announce(
|
||||||
|
"[Zaun]",
|
||||||
|
`Ich habe einen Befehl geblockt: ${rule.why}`,
|
||||||
|
"silent",
|
||||||
|
)
|
||||||
|
// Werfen = OpenCode bricht genau diesen Werkzeugaufruf ab und gibt dem
|
||||||
|
// Modell den Grund zurueck. Der Agent arbeitet weiter, nur anders.
|
||||||
|
throw new Error(
|
||||||
|
`[MC2-ZAUN] Blockiert: ${rule.why}\n` +
|
||||||
|
`Befehl war: ${cmd}\n` +
|
||||||
|
`Waehle einen anderen Weg. Wenn das wirklich noetig ist, sag es dem Menschen — ` +
|
||||||
|
`er macht es selbst.`,
|
||||||
|
)
|
||||||
|
}
|
||||||
|
}
|
||||||
|
},
|
||||||
|
|
||||||
|
// ── 2.-4. Ereignisse ───────────────────────────────────────────────────
|
||||||
|
event: async ({ event }: any) => {
|
||||||
|
const type: string = event?.type ?? ""
|
||||||
|
const props: any = event?.properties ?? event ?? {}
|
||||||
|
const sessionID: string = props.sessionID || props.sessionId || props.id || ""
|
||||||
|
|
||||||
|
// ── Savepoint statt Zusammenfassen ──────────────────────────────────
|
||||||
|
if (type === "session.compacted" || type === "experimental.session.compacting") {
|
||||||
|
await announce(
|
||||||
|
"[Sitzung]",
|
||||||
|
"Die Sitzung wurde komprimiert — ich lasse den Stand in SAVEPOINT.md sichern.",
|
||||||
|
"silent",
|
||||||
|
)
|
||||||
|
if (sessionID) {
|
||||||
|
await sendPrompt(
|
||||||
|
sessionID,
|
||||||
|
"[MC2-GOVERNOR] Der Kontext wurde gerade komprimiert — dabei gehen still " +
|
||||||
|
"Regeln und Details verloren. Aktualisiere JETZT SAVEPOINT.md: was wirklich " +
|
||||||
|
"erledigt ist (nur was im Code steht), der genaue naechste Schritt, offene " +
|
||||||
|
"Fragen, Stolpersteine. Committe die Datei. Danach arbeite normal weiter.",
|
||||||
|
)
|
||||||
|
}
|
||||||
|
return
|
||||||
|
}
|
||||||
|
|
||||||
|
// ── Pruef-Tor + Selbstreparatur ─────────────────────────────────────
|
||||||
|
if (type !== "session.idle" || !sessionID) return
|
||||||
|
if (busy.has(sessionID)) return
|
||||||
|
|
||||||
|
const cmd = await readVerify()
|
||||||
|
if (!cmd) return // Kein VERIFY im Projekt -> Pruef-Tor bewusst aus.
|
||||||
|
|
||||||
|
busy.add(sessionID)
|
||||||
|
try {
|
||||||
|
const { ok, out } = await runVerify(cmd)
|
||||||
|
const round = rounds.get(sessionID) ?? 0
|
||||||
|
|
||||||
|
if (ok) {
|
||||||
|
rounds.delete(sessionID)
|
||||||
|
await announce("[Pruefung]", "Etappe fertig und die Tests sind gruen.", "normal")
|
||||||
|
return
|
||||||
|
}
|
||||||
|
|
||||||
|
if (!AUTOFIX || round >= MAX_ROUNDS) {
|
||||||
|
rounds.delete(sessionID)
|
||||||
|
await announce(
|
||||||
|
"[Pruefung]",
|
||||||
|
`Die Tests sind rot und ich habe ${round} Reparaturversuche verbraucht. ` +
|
||||||
|
`Hier komme ich allein nicht weiter, Commander.`,
|
||||||
|
"normal",
|
||||||
|
)
|
||||||
|
return
|
||||||
|
}
|
||||||
|
|
||||||
|
rounds.set(sessionID, round + 1)
|
||||||
|
await announce(
|
||||||
|
"[Pruefung]",
|
||||||
|
`Tests rot — ich repariere selbst weiter, Runde ${round + 1} von ${MAX_ROUNDS}.`,
|
||||||
|
"silent",
|
||||||
|
)
|
||||||
|
await sendPrompt(
|
||||||
|
sessionID,
|
||||||
|
`[MC2-PRUEFTOR] Deine Etappe gilt noch NICHT als fertig: der Verify-Befehl des ` +
|
||||||
|
`Projekts ist fehlgeschlagen.\n\n` +
|
||||||
|
`Befehl: ${cmd}\n\n` +
|
||||||
|
`Ausgabe (Ende):\n\`\`\`\n${out}\n\`\`\`\n\n` +
|
||||||
|
`Behebe die Ursache — nicht das Symptom, und schalte keinen Test ab. ` +
|
||||||
|
`Wenn du fertig bist, melde dich normal; ich pruefe dann erneut. ` +
|
||||||
|
`(Reparaturrunde ${round + 1} von ${MAX_ROUNDS}.)`,
|
||||||
|
)
|
||||||
|
} finally {
|
||||||
|
busy.delete(sessionID)
|
||||||
|
}
|
||||||
|
},
|
||||||
|
}
|
||||||
|
}
|
||||||
|
|
||||||
|
export default MC2Governor
|
||||||
@@ -8,6 +8,42 @@ wasserdicht durchdachtes Konzept plus alle Steuerungs-Dokumente, mit denen der C
|
|||||||
dem Coder sofort einen sauberen Auftrag geben kann. Du denkst und bereitest vor — **gebaut wird
|
dem Coder sofort einen sauberen Auftrag geben kann. Du denkst und bereitest vor — **gebaut wird
|
||||||
in Zed, von ihm.**
|
in Zed, von ihm.**
|
||||||
|
|
||||||
|
## Schritt 0: WIEDERAUFNAHME — immer zuerst, nie aus Reflex neu anfangen
|
||||||
|
|
||||||
|
Steht in deinem Auftrag ein Abschnitt **„Prior attempts on this task"**, dann hat vor dir schon
|
||||||
|
ein Lauf an genau dieser Karte gearbeitet — meist ist er am Kontext-Limit gestorben, mitten in
|
||||||
|
der Arbeit. **Dein Workspace ist derselbe wie seiner, seine Arbeit liegt noch da.** Verschaffe
|
||||||
|
dir ZUERST einen Überblick, bevor du irgendetwas neu denkst:
|
||||||
|
|
||||||
|
1. `cat FORTSCHRITT.md` in deinem Workspace (falls vorhanden) — die Notizen deines Vorgängers.
|
||||||
|
2. `ls -la` im Workspace: liegt dort ein geklontes Repo? Was steht drin —
|
||||||
|
`git -C <repo> log --oneline -3` und `git -C <repo> status --short`. **Uncommittete Dateien
|
||||||
|
sind fertige Arbeit, der nur noch der Push fehlt.**
|
||||||
|
3. `ls -dt /tmp/konzept-*` — die Denk-Werkstatt des Fliessbands. Ein vorhandenes `konzept.md`
|
||||||
|
mit `runde*`/`haertetest*` daneben ist ein FERTIG GEDACHTES Konzept. Das denkst du nicht neu.
|
||||||
|
4. Existiert das Gitea-Repo schon? `git ls-remote https://<host>/<owner>/<name>.git`
|
||||||
|
|
||||||
|
Dann setzt du an der **ersten Lücke** an — nie davor. Der häufigste Fall: alles gedacht, Repo
|
||||||
|
steht, `KONZEPT.md` geschrieben, es fehlen nur `git add/commit/push` und die Übergabe. Das sind
|
||||||
|
zwei Minuten. **Ein zweiter kompletter Denk-Durchlauf ist ein Fehlschlag:** er kostet eine halbe
|
||||||
|
Stunde, wirft die Arbeit deines Vorgängers weg und läuft in genau dasselbe Kontext-Limit wie er.
|
||||||
|
Nur wenn wirklich nichts Brauchbares dasteht, fängst du bei Schritt 1 an.
|
||||||
|
|
||||||
|
## Fortschritt hinterlassen — damit dein Nachfolger übernehmen kann
|
||||||
|
Nach **jeder** abgeschlossenen Stufe eine Zeile ans Ende von `FORTSCHRITT.md` im
|
||||||
|
Workspace-Wurzelverzeichnis — **nicht im Repo-Klon**, sonst landet sie im Projekt-Repo (dort
|
||||||
|
gehören nur die Dateien aus Schritt 3 hinein). Inhalt: was fertig ist, wo es liegt, was als
|
||||||
|
Nächstes dran wäre. Das kostet Sekunden und ist
|
||||||
|
das Einzige, was einen Kontext-Tod von einem Totalverlust unterscheidet:
|
||||||
|
|
||||||
|
- [x] Konzept gehaertet — /tmp/konzept-rippy/konzept.md (14 KB, 2 Runden + Haertetest)
|
||||||
|
- [x] Repo angelegt + geklont — Hitonabi/rippy (bisher nur README)
|
||||||
|
- [ ] KONZEPT.md committen + pushen <- HIER WEITER
|
||||||
|
|
||||||
|
Halte dich kurz (eine Zeile je Stufe) und schreib sie SOFORT, nicht am Ende — am Ende kommst du
|
||||||
|
vielleicht nicht mehr dazu. Dieselbe Kurzfassung gehört als Notiz in deinen `kanban_heartbeat`,
|
||||||
|
dann sieht der Commander im Auftragsbuch, wo du stehst.
|
||||||
|
|
||||||
## Der Ablauf (genau diese vier Schritte, in dieser Reihenfolge)
|
## Der Ablauf (genau diese vier Schritte, in dieser Reihenfolge)
|
||||||
|
|
||||||
### 1. Konzept wasserdicht härten — via `konzept-fliessband`
|
### 1. Konzept wasserdicht härten — via `konzept-fliessband`
|
||||||
@@ -22,8 +58,17 @@ Halte dich an die Leitplanken des Skills: jede Rollen-Stimme MUSS aus einem `wor
|
|||||||
heavy stammen (nie selbst ausdenken), großzügige `WORKER_MAXTOK`/`FREMDBLICK_MAXTOK` (Reasoning-
|
heavy stammen (nie selbst ausdenken), großzügige `WORKER_MAXTOK`/`FREMDBLICK_MAXTOK` (Reasoning-
|
||||||
Modelle brauchen Token-Luft), Modell-Wechsel minimieren.
|
Modelle brauchen Token-Luft), Modell-Wechsel minimieren.
|
||||||
|
|
||||||
|
> **Achtung, hier ging es schon zweimal schief:** Der Skill endet mit einer eigenen Ablage
|
||||||
|
> (`cp … ~/konzepte/<slug>-konzept.md`) und einer Telegram-Übergabe. Das ist die Anleitung für
|
||||||
|
> Aufrufer OHNE Kanban-Karte. **Für dich gilt sie nicht als Ende.** Das Konzept ist erst
|
||||||
|
> abgeliefert, wenn es als `KONZEPT.md` **im Repo** liegt (Schritte 2–4). Die Kopie nach
|
||||||
|
> `~/konzepte/` darfst du zusätzlich machen — sie ersetzt das Repo aber NIE, und `kanban_complete`
|
||||||
|
> kommt erst danach. Ohne Repo sieht der Commander im Auftragsbuch nichts von deiner Arbeit.
|
||||||
|
|
||||||
### 2. Repo anlegen (leer, privat)
|
### 2. Repo anlegen (leer, privat)
|
||||||
Wähle einen kurzen, sauberen Projektnamen (kebab-case, z. B. `homelab-dashboard`). Lege das Repo an:
|
Wähle einen kurzen, sauberen Projektnamen (kebab-case, z. B. `homelab-dashboard`). **Nimm den
|
||||||
|
Namen, den ein Vorgänger schon vergeben hat, wenn Schritt 0 einen gefunden hat** — sonst legst du
|
||||||
|
für dieselbe Idee ein zweites Repo an. Lege das Repo an:
|
||||||
|
|
||||||
bash ~/.hermes/scripts/gitea-repo-create.sh <name> "<eine Zeile Beschreibung>"
|
bash ~/.hermes/scripts/gitea-repo-create.sh <name> "<eine Zeile Beschreibung>"
|
||||||
|
|
||||||
@@ -42,6 +87,19 @@ genau diese Dateien — sonst **nichts**, kein Code, kein Gerüst:
|
|||||||
- **`AGENTS.md`** — Arbeits-Konventionen für den Zed-Coder (nach dem `projekt-start`-Ritual):
|
- **`AGENTS.md`** — Arbeits-Konventionen für den Zed-Coder (nach dem `projekt-start`-Ritual):
|
||||||
Deutsch/Nicht-Entwickler, Plan-vor-Code, kleine Schritte, beweisen statt behaupten, Savepoints,
|
Deutsch/Nicht-Entwickler, Plan-vor-Code, kleine Schritte, beweisen statt behaupten, Savepoints,
|
||||||
Box-Modelle je Aufgabe (plan=heavy, build=coder). Kurz, konkret, projektbezogen.
|
Box-Modelle je Aufgabe (plan=heavy, build=coder). Kurz, konkret, projektbezogen.
|
||||||
|
**Ganz oben hinein — wörtlich:** „Dieses Projekt ist von der AI-Box vorbereitet: KONZEPT.md ist
|
||||||
|
bereits gehärtet, ROADMAP.md ist der Plan. Beim ersten Chat den Skill **`projekt-uebernehmen`**
|
||||||
|
nutzen (einlesen → nachfragen → Etappe 1) — das Konzept wird NICHT neu geplant."
|
||||||
|
Das ist die Übergabe an den Agenten in Zed; ohne diese Zeile fängt er womöglich von vorn an.
|
||||||
|
**Dazu diese drei HARTEN Regeln — wörtlich in die AGENTS.md (Wasserdicht-Runde 22.07.,
|
||||||
|
Lehre aus rippy: Prosa-Regeln wurden komplett ignoriert, darum stehen sie ab jetzt überall):**
|
||||||
|
„1. Die **CI-Ampel** (Gitea Actions, liegt seit der Repo-Anlage unter `.gitea/workflows/ci.yml` —
|
||||||
|
NICHT löschen) muss **GRÜN** sein, bevor eine Etappe ‚fertig' heißt. Keine Tests = rot = nicht fertig.
|
||||||
|
2. Weicht etwas vom KONZEPT ab (anderes Werkzeug, andere Bibliothek, gestrichenes Muss-Feature):
|
||||||
|
**STOPP und den Commander fragen** — niemals still ersetzen. (rippy-Lehre: Muss-Feature
|
||||||
|
‚MakeMKV lossless' wurde still durch lossy HandBrake ersetzt.)
|
||||||
|
3. Deployment NUR über `./deploy.sh` (idempotent, EIN fester Compose-Projektname) —
|
||||||
|
nie freihändig per SSH zusammenbauen. (rippy-Lehre: Doppel-Anlage `Rippy`+`rippy` auf der VM.)"
|
||||||
- **`README.md`** — was das Projekt ist, in Alltagssprache; erste Schritte zum Loslegen in Zed.
|
- **`README.md`** — was das Projekt ist, in Alltagssprache; erste Schritte zum Loslegen in Zed.
|
||||||
- **`SAVEPOINT.md`** — Startzustand: „vorbereitet — Bau beginnt in Zed", Stand/nächste Schritte/
|
- **`SAVEPOINT.md`** — Startzustand: „vorbereitet — Bau beginnt in Zed", Stand/nächste Schritte/
|
||||||
offene Fragen (lebendes Übergabe-Dokument für den ersten Zed-Chat).
|
offene Fragen (lebendes Übergabe-Dokument für den ersten Zed-Chat).
|
||||||
@@ -65,13 +123,28 @@ DURCHDACHT haben — er hat sich NICHT entschieden, sie zu bauen. Dann gilt abwe
|
|||||||
- Schritt 1 (Konzept haerten) laeuft wie beschrieben, aber mit **Produkt-Blick**: Was ist es, fuer
|
- Schritt 1 (Konzept haerten) laeuft wie beschrieben, aber mit **Produkt-Blick**: Was ist es, fuer
|
||||||
wen, was gibt es schon, kleinster sinnvoller Wurf, was spricht DAGEGEN. Rollen-Cast entsprechend
|
wen, was gibt es schon, kleinster sinnvoller Wurf, was spricht DAGEGEN. Rollen-Cast entsprechend
|
||||||
(nicht nur Entwickler-Rollen).
|
(nicht nur Entwickler-Rollen).
|
||||||
- Schritt 2 (Repo anlegen) wie gehabt.
|
- Schritt 2 (Repo anlegen) wie gehabt — **auch bei „IDEE PRUEFEN" gibt es ein Repo.** Das Konzept
|
||||||
|
NUR nach `~/konzepte/` zu kopieren und dann abzuschließen ist ein Fehlschlag: der Commander
|
||||||
|
liest das Konzept im Auftragsbuch, und das holt es aus dem Repo.
|
||||||
- Schritt 3 schreibt **NUR `KONZEPT.md` + ein knappes `README.md`** — KEINE `ROADMAP.md`, KEINE
|
- Schritt 3 schreibt **NUR `KONZEPT.md` + ein knappes `README.md`** — KEINE `ROADMAP.md`, KEINE
|
||||||
`AGENTS.md`, KEIN `SAVEPOINT.md`, KEIN `.aiexclude`, kein Geruest. Das entsteht erst, wenn der
|
`AGENTS.md`, KEIN `SAVEPOINT.md`, KEIN `.aiexclude`, kein Geruest. Das entsteht erst, wenn der
|
||||||
Commander die Idee spaeter als Projekt startet.
|
Commander die Idee spaeter als Projekt startet.
|
||||||
- Schritt 4 (Uebergabe) NICHT als Bau-Aufforderung: sag, was die Idee waere, was sie braeuchte und
|
- Schritt 4 (Uebergabe) NICHT als Bau-Aufforderung: sag, was die Idee waere, was sie braeuchte und
|
||||||
was dagegen spricht — und dass die Entscheidung bei ihm liegt. Kein „oeffne in Zed und bau".
|
was dagegen spricht — und dass die Entscheidung bei ihm liegt. Kein „oeffne in Zed und bau".
|
||||||
|
|
||||||
|
## Sonderfall: „UEBERARBEITUNG" (der Commander hat das Konzept gelesen)
|
||||||
|
Steht im Auftrag **`AUFTRAGS-ART: IDEE PRUEFEN — UEBERARBEITUNG`**, existiert das Konzept schon
|
||||||
|
und der Commander will gezielte Änderungen. Dann gilt abweichend:
|
||||||
|
- **Schritt 2 entfällt — lege KEIN neues Repo an.** Der Auftrag nennt die Stelle, an der das
|
||||||
|
Konzept liegt (Repo oder Datei); die neue Fassung gehört an **genau dieselbe Stelle**. Ein
|
||||||
|
zweites Repo für dieselbe Idee ist ein Fehlschlag.
|
||||||
|
- Schritt 1 schrumpft: lies das bestehende Konzept, ändere die genannten Punkte **und deren
|
||||||
|
Folgewirkungen**, lass den Rest stehen. Ein kurzer Härtetest nur auf die geänderten Teile.
|
||||||
|
- Sein Vorschlag hat Vorrang, aber nicht blind: schafft er ein Problem, bau ihn ein **und**
|
||||||
|
schreib die Folge sichtbar in den Abschnitt Risiken/offene Punkte. Nicht stillschweigend
|
||||||
|
übergehen, nicht schönreden.
|
||||||
|
- Übergabe: was geändert wurde, was daraus folgte, was du bewusst gelassen hast.
|
||||||
|
|
||||||
## Eiserne Regeln (nicht verhandelbar)
|
## Eiserne Regeln (nicht verhandelbar)
|
||||||
1. **Du baust KEINEN Code.** Kein Gerüst, keine `package.json`, keine Quelldateien. Nur die
|
1. **Du baust KEINEN Code.** Kein Gerüst, keine `package.json`, keine Quelldateien. Nur die
|
||||||
Doku-Dateien aus Schritt 3. Wer Code schreibt, hat die Aufgabe verfehlt.
|
Doku-Dateien aus Schritt 3. Wer Code schreibt, hat die Aufgabe verfehlt.
|
||||||
@@ -80,6 +153,11 @@ DURCHDACHT haben — er hat sich NICHT entschieden, sie zu bauen. Dann gilt abwe
|
|||||||
Auftrag ein bestehendes Repo als Vorbild genannt ist, nur LESEN, nie hineinschreiben.)
|
Auftrag ein bestehendes Repo als Vorbild genannt ist, nur LESEN, nie hineinschreiben.)
|
||||||
3. **Jede Rollen-Stimme des Konzepts kommt aus `worker.sh` an heavy** — nie selbst ausgedacht.
|
3. **Jede Rollen-Stimme des Konzepts kommt aus `worker.sh` an heavy** — nie selbst ausgedacht.
|
||||||
4. **Kein `git init`, kein Shallow-Clone.** Immer voll klonen (Credentials in `~/.git-credentials`).
|
4. **Kein `git init`, kein Shallow-Clone.** Immer voll klonen (Credentials in `~/.git-credentials`).
|
||||||
|
**Der Push gilt erst als erledigt, wenn `git ls-remote origin main` ihn BEWEIST** — ein Exit-Code
|
||||||
|
0 und „main -> main" auf dem Bildschirm reichen nicht. Ohne diesen Beleg kein `kanban_complete`;
|
||||||
|
melde stattdessen ehrlich, dass der Push unbestätigt ist. Und wenn die No-Progress-Bremse dabei
|
||||||
|
anschlägt: **nicht wegargumentieren.** Sie ist billiger als eine Übergabe, die ins Leere zeigt —
|
||||||
|
der Commander soll dem Satz „Repo liegt bereit" ohne Nachprüfen glauben können.
|
||||||
5. **TABU-Zonen:** approvals/Tokens/ufw/Security-Configs, `~/.hermes/config.yaml`, systemd-Units.
|
5. **TABU-Zonen:** approvals/Tokens/ufw/Security-Configs, `~/.hermes/config.yaml`, systemd-Units.
|
||||||
Braucht der Auftrag so etwas → `kanban_block` mit Begründung.
|
Braucht der Auftrag so etwas → `kanban_block` mit Begründung.
|
||||||
6. **Festfahren-Stopp:** Bleibt das Konzept nach den Runden mit echten Blockern offen (widersprüchliche
|
6. **Festfahren-Stopp:** Bleibt das Konzept nach den Runden mit echten Blockern offen (widersprüchliche
|
||||||
|
|||||||
@@ -0,0 +1,45 @@
|
|||||||
|
#!/usr/bin/env python3
|
||||||
|
import sys, re, shutil, time
|
||||||
|
|
||||||
|
if len(sys.argv) < 5:
|
||||||
|
print("Nutzung: auto_adopt.py <config_path> <rolle> <new_hf_id> <new_gguf_path> [new_mmproj_path]")
|
||||||
|
sys.exit(1)
|
||||||
|
|
||||||
|
config_path = sys.argv[1]
|
||||||
|
rolle = sys.argv[2]
|
||||||
|
new_hf_id = sys.argv[3]
|
||||||
|
new_gguf_path = sys.argv[4]
|
||||||
|
new_mmproj_path = sys.argv[5] if len(sys.argv) > 5 else ""
|
||||||
|
|
||||||
|
shutil.copy(config_path, config_path + f".bak.{time.strftime('%Y%m%d%H%M%S')}")
|
||||||
|
content = open(config_path, "r", encoding="utf-8").read()
|
||||||
|
|
||||||
|
blocks = re.split(r'\n ([a-zA-Z0-9_.-]+):\n', "\n" + content)
|
||||||
|
new_content = blocks[0].lstrip("\n")
|
||||||
|
adopted = False
|
||||||
|
|
||||||
|
for i in range(1, len(blocks), 2):
|
||||||
|
m_name = blocks[i]
|
||||||
|
m_content = blocks[i+1]
|
||||||
|
|
||||||
|
if re.search(r'aliases:\s*\n(?:\s+- [^\n]+\n)*\s+- ' + re.escape(rolle) + r'\b', m_content):
|
||||||
|
m_content = re.sub(r'(-m\s+)[^\s]+', r'\g<1>' + new_gguf_path, m_content)
|
||||||
|
if new_mmproj_path:
|
||||||
|
if "--mmproj" in m_content:
|
||||||
|
m_content = re.sub(r'(--mmproj\s+)[^\s]+', r'\g<1>' + new_mmproj_path, m_content)
|
||||||
|
else:
|
||||||
|
m_content = re.sub(r'(-m\s+[^\s]+)', r'\g<1> --mmproj ' + new_mmproj_path, m_content)
|
||||||
|
else:
|
||||||
|
m_content = re.sub(r'\s*--mmproj\s+[^\s]+', '', m_content)
|
||||||
|
|
||||||
|
adopted = True
|
||||||
|
print(f"Auto-Adoption: {rolle} -> {new_hf_id} (ersetzt in {m_name})")
|
||||||
|
|
||||||
|
new_content += f" {m_name}:\n{m_content}"
|
||||||
|
|
||||||
|
with open(config_path, "w", encoding="utf-8") as f:
|
||||||
|
f.write(new_content)
|
||||||
|
|
||||||
|
if not adopted:
|
||||||
|
print(f"Warnung: Rolle {rolle} in der config nicht gefunden. Auto-Adoption übersprungen.")
|
||||||
|
sys.exit(1)
|
||||||
@@ -84,7 +84,7 @@ def norm(s):
|
|||||||
|
|
||||||
def code_block(text, sprache="python"):
|
def code_block(text, sprache="python"):
|
||||||
"""Letzten passenden Code-Block extrahieren; ohne Zaun: ganzen Text nehmen."""
|
"""Letzten passenden Code-Block extrahieren; ohne Zaun: ganzen Text nehmen."""
|
||||||
bloecke = re.findall(r"```(?:%s)?\s*\n(.*?)```" % re.escape(sprache),
|
bloecke = re.findall(rf"```(?:{re.escape(sprache)})?\s*\n(.*?)```",
|
||||||
text or "", re.DOTALL | re.IGNORECASE)
|
text or "", re.DOTALL | re.IGNORECASE)
|
||||||
if bloecke:
|
if bloecke:
|
||||||
return bloecke[-1]
|
return bloecke[-1]
|
||||||
@@ -469,7 +469,7 @@ def suite_speed(cfg, ergebnisse):
|
|||||||
# Kurz-Probe: misst tg (Alltags-Turn) — 2 Läufe, erster wärmt den Cache an.
|
# Kurz-Probe: misst tg (Alltags-Turn) — 2 Läufe, erster wärmt den Cache an.
|
||||||
for lauf in ("warm", "kurz"):
|
for lauf in ("warm", "kurz"):
|
||||||
t0 = time.time()
|
t0 = time.time()
|
||||||
msg, tim, err = api_chat(cfg.endpoint, cfg.model, [
|
_msg, tim, err = api_chat(cfg.endpoint, cfg.model, [
|
||||||
{"role": "user", "content":
|
{"role": "user", "content":
|
||||||
"Erkläre in drei kurzen Sätzen, was ein Mixture-of-Experts-Modell "
|
"Erkläre in drei kurzen Sätzen, was ein Mixture-of-Experts-Modell "
|
||||||
"ist."}], max_tokens=200, temperature=0)
|
"ist."}], max_tokens=200, temperature=0)
|
||||||
@@ -487,7 +487,7 @@ def suite_speed(cfg, ergebnisse):
|
|||||||
return
|
return
|
||||||
lang = LANG_BAUSTEIN * 550
|
lang = LANG_BAUSTEIN * 550
|
||||||
t0 = time.time()
|
t0 = time.time()
|
||||||
msg, tim, err = api_chat(cfg.endpoint, cfg.model, [
|
_msg, tim, err = api_chat(cfg.endpoint, cfg.model, [
|
||||||
{"role": "user", "content":
|
{"role": "user", "content":
|
||||||
lang + "\n\nWie oft steht sinngemäß derselbe Satz oben? Antworte in "
|
lang + "\n\nWie oft steht sinngemäß derselbe Satz oben? Antworte in "
|
||||||
"einem Satz."}], max_tokens=80, temperature=0, timeout=900)
|
"einem Satz."}], max_tokens=80, temperature=0, timeout=900)
|
||||||
|
|||||||
@@ -1,8 +1,8 @@
|
|||||||
#!/usr/bin/env bash
|
#!/usr/bin/env bash
|
||||||
# Prüfstand (17.07.2026): das "volle Programm" für Modell-Kandidaten — echte Coding-,
|
# Prüfstand-Runner (Täglich 02:00, ehemals Wöchentlich): Baut die Umgebung für den
|
||||||
# Agenten-, Recherche-, Deutsch- und Vision-Prüfungen (harness.py) plus Tempo, verglichen
|
# Harness (Modell-Sandkasten, GPU-RAM-Check) und zieht die Fäden.
|
||||||
# gegen die BASELINE der Amtsinhaber. Läuft als Cron (So 01:00, --no-agent: stdout wird
|
# Läuft als Cron (Täglich 02:00, nach Radar/Checkout), nimmt Kandidaten aus der Queue
|
||||||
# wörtlich zugestellt; LEERER stdout = stille Nacht).
|
# und vergleicht sie gegen die BASELINE der Amtsinhaber.
|
||||||
#
|
#
|
||||||
# Modi:
|
# Modi:
|
||||||
# (ohne Argument) Cron-Modus: Baseline fehlt → Baseline messen; sonst ältesten
|
# (ohne Argument) Cron-Modus: Baseline fehlt → Baseline messen; sonst ältesten
|
||||||
@@ -27,7 +27,7 @@ BENCH_BIN="${BENCH_BIN:-/opt/llamacpp-vulkan/llama-server}"
|
|||||||
BENCH_PORT="${BENCH_PORT:-5899}"
|
BENCH_PORT="${BENCH_PORT:-5899}"
|
||||||
LIVE="http://127.0.0.1:8080/v1"
|
LIVE="http://127.0.0.1:8080/v1"
|
||||||
JUDGE_MODEL="${PRUEFSTAND_JUDGE:-gpt-oss-120b}"
|
JUDGE_MODEL="${PRUEFSTAND_JUDGE:-gpt-oss-120b}"
|
||||||
DECKEL_GB="${PRUEFSTAND_DECKEL_GB:-35}"
|
DECKEL_GB="${PRUEFSTAND_DECKEL_GB:-100}"
|
||||||
DEADLINE_MIN="${PRUEFSTAND_DEADLINE_MIN:-100}"
|
DEADLINE_MIN="${PRUEFSTAND_DEADLINE_MIN:-100}"
|
||||||
|
|
||||||
mkdir -p "$STATE/queue" "$STATE/done" "$STATE/ergebnisse"
|
mkdir -p "$STATE/queue" "$STATE/done" "$STATE/ergebnisse"
|
||||||
@@ -342,7 +342,9 @@ PY
|
|||||||
|
|
||||||
# ---- Steckbrief: Kandidat vs. Amtsinhaber
|
# ---- Steckbrief: Kandidat vs. Amtsinhaber
|
||||||
local BERICHT="$STATE/ergebnisse/kandidat-${KEY}.md"
|
local BERICHT="$STATE/ergebnisse/kandidat-${KEY}.md"
|
||||||
python3 - "$OUT" "$STATE/baseline.json" "$ROLLE" "$HF_ID" "$WARUM" "$BERICHT" <<'PY'
|
local SIEGER_FLAG="$STATE/tmp-sieger-${KEY}"
|
||||||
|
rm -f "$SIEGER_FLAG"
|
||||||
|
python3 - "$OUT" "$STATE/baseline.json" "$ROLLE" "$HF_ID" "$WARUM" "$BERICHT" "$SIEGER_FLAG" <<'PY'
|
||||||
import json, sys, time
|
import json, sys, time
|
||||||
kand = json.load(open(sys.argv[1]))
|
kand = json.load(open(sys.argv[1]))
|
||||||
try:
|
try:
|
||||||
@@ -378,14 +380,15 @@ if faelle:
|
|||||||
tempo = (f"Tempo {round(100*tg_k/tg_b-100):+d} % vs. Amtsinhaber" if tg_k and tg_b
|
tempo = (f"Tempo {round(100*tg_k/tg_b-100):+d} % vs. Amtsinhaber" if tg_k and tg_b
|
||||||
else "Tempo-Vergleich unvollständig")
|
else "Tempo-Vergleich unvollständig")
|
||||||
if qk >= qb and tg_k >= 0.8 * (tg_b or tg_k):
|
if qk >= qb and tg_k >= 0.8 * (tg_b or tg_k):
|
||||||
urteil = "KANDIDAT SIEHT STARK AUS — Karte prüfen lohnt sich."
|
urteil = "KANDIDAT SIEHT STARK AUS — Auto-Adoption greift (Etappe E5)."
|
||||||
|
open(sys.argv[7], "w").write("1")
|
||||||
elif qk >= qb:
|
elif qk >= qb:
|
||||||
urteil = "Qualität hält mit, aber deutlich langsamer — vermutlich kein Aufsteiger."
|
urteil = "Qualität hält mit, aber deutlich langsamer — vermutlich kein Aufsteiger."
|
||||||
else:
|
else:
|
||||||
urteil = "Qualität unter Amtsinhaber — kein Aufsteiger."
|
urteil = "Qualität unter Amtsinhaber — kein Aufsteiger."
|
||||||
zeilen.append(f"**Einordnung:** Bestehensquote {qk:.0%} vs. {qb:.0%} · {tempo}. {urteil}")
|
zeilen.append(f"**Einordnung:** Bestehensquote {qk:.0%} vs. {qb:.0%} · {tempo}. {urteil}")
|
||||||
zeilen.append("")
|
zeilen.append("")
|
||||||
zeilen.append("_Der Prüfstand empfiehlt nur — der Rollen-Wechsel bleibt Commander-Entscheid (Karte)._")
|
zeilen.append("_Auto-Adoption (Etappe E5): Der Prüfstand tauscht Sieger-Modelle nun selbstständig aus._")
|
||||||
text = "\n".join(z for z in zeilen if z is not None)
|
text = "\n".join(z for z in zeilen if z is not None)
|
||||||
open(ziel, "w", encoding="utf-8").write(text + "\n")
|
open(ziel, "w", encoding="utf-8").write(text + "\n")
|
||||||
print(text)
|
print(text)
|
||||||
@@ -402,6 +405,35 @@ PY
|
|||||||
briefkasten "Prüfstand" "Kandidat ${HF_ID} (Rolle ${ROLLE}) geprüft — Steckbrief im Auftrags-Kanban und Vault (pruefstand/${KEY}.md)."
|
briefkasten "Prüfstand" "Kandidat ${HF_ID} (Rolle ${ROLLE}) geprüft — Steckbrief im Auftrags-Kanban und Vault (pruefstand/${KEY}.md)."
|
||||||
mv "$SPEC" "$STATE/done/${KEY}.spec.json" 2>/dev/null || true
|
mv "$SPEC" "$STATE/done/${KEY}.spec.json" 2>/dev/null || true
|
||||||
cp "$OUT" "$STATE/done/${KEY}.json" 2>/dev/null || echo "{\"status\":\"geprueft\"}" > "$STATE/done/${KEY}.json"
|
cp "$OUT" "$STATE/done/${KEY}.json" 2>/dev/null || echo "{\"status\":\"geprueft\"}" > "$STATE/done/${KEY}.json"
|
||||||
|
|
||||||
|
# ---- Auto-Adoption (Etappe E5)
|
||||||
|
if [ -f "$SIEGER_FLAG" ]; then
|
||||||
|
echo "Kandidat hat gewonnen — starte Auto-Adoption für Rolle $ROLLE..."
|
||||||
|
local FINAL_DIR="/srv/models/${HF_ID//\//-}-GGUF"
|
||||||
|
sudo -n mkdir -p "$FINAL_DIR"
|
||||||
|
sudo -n mv "$ZIEL" "$FINAL_DIR/"
|
||||||
|
local FINAL_GGUF="$FINAL_DIR/$(basename "$PFAD")"
|
||||||
|
local FINAL_MMPROJ=""
|
||||||
|
if [ -n "$MM_ZIEL" ]; then
|
||||||
|
sudo -n mv "$MM_ZIEL" "$FINAL_DIR/"
|
||||||
|
FINAL_MMPROJ="$FINAL_DIR/$(basename "$MMPROJ")"
|
||||||
|
fi
|
||||||
|
sudo -n chown -R hitonabi:hitonabi "$FINAL_DIR" 2>/dev/null || true
|
||||||
|
|
||||||
|
# Config updaten
|
||||||
|
local CONFIG="$MC/deploy/llama-swap.config.yaml"
|
||||||
|
python3 "$PSD/auto_adopt.py" "$CONFIG" "$ROLLE" "$HF_ID" "$FINAL_GGUF" "$FINAL_MMPROJ"
|
||||||
|
|
||||||
|
# Reload llama-swap (via worker oder systemctl)
|
||||||
|
if systemctl --user is-active --quiet llama-swap; then
|
||||||
|
systemctl --user restart llama-swap
|
||||||
|
briefkasten "Prüfstand Auto-Adoption" "Rolle '$ROLLE' wurde erfolgreich durch '$HF_ID' ersetzt (Neustart erledigt)."
|
||||||
|
else
|
||||||
|
briefkasten "Prüfstand Auto-Adoption" "Rolle '$ROLLE' wurde durch '$HF_ID' ersetzt (llama-swap war inaktiv)."
|
||||||
|
fi
|
||||||
|
rm -f "$SIEGER_FLAG"
|
||||||
|
fi
|
||||||
|
|
||||||
rm -rf "${CACHE:?}/$KEY"
|
rm -rf "${CACHE:?}/$KEY"
|
||||||
echo
|
echo
|
||||||
echo "(Cache aufgeräumt; Roh-Ergebnisse: $STATE/ergebnisse/kandidat-${KEY}.*)"
|
echo "(Cache aufgeräumt; Roh-Ergebnisse: $STATE/ergebnisse/kandidat-${KEY}.*)"
|
||||||
|
|||||||
@@ -187,6 +187,12 @@ Dann eine Kopie an den Abhol-Ort:
|
|||||||
mkdir -p ~/konzepte && cp /tmp/konzept-$slug/konzept.md ~/konzepte/$slug-konzept.md
|
mkdir -p ~/konzepte && cp /tmp/konzept-$slug/konzept.md ~/konzepte/$slug-konzept.md
|
||||||
```
|
```
|
||||||
|
|
||||||
|
> **Arbeitest du an einer Kanban-Karte, sind Schritt 5-Kopie und Schritt 6 NICHT dein Ende.**
|
||||||
|
> Die Ablage- und Uebergabe-Wege deiner Rolle (Profil-SOUL) gelten — z. B. `projektstart`:
|
||||||
|
> Konzept ins **Repo** als `KONZEPT.md`, dann `kanban_complete`. Die Kopie nach `~/konzepte/`
|
||||||
|
> ist dann nur ein Zweitablage-Ort, kein Abschluss. Nur ohne Karte (direkter Zuruf) endet
|
||||||
|
> das Fliessband hier mit Schritt 6.
|
||||||
|
|
||||||
### 6. Uebergabe (Telegram, in LUCYS Stimme)
|
### 6. Uebergabe (Telegram, in LUCYS Stimme)
|
||||||
```bash
|
```bash
|
||||||
bash ~/mission-control-v2/deploy/notify.sh -s "[Konzept]" "<text>"
|
bash ~/mission-control-v2/deploy/notify.sh -s "[Konzept]" "<text>"
|
||||||
|
|||||||
@@ -0,0 +1,287 @@
|
|||||||
|
# Spezifikation: Auto-Archivierung nach 14 Tagen Inaktivität
|
||||||
|
|
||||||
|
**Datum:** 2026-07-24
|
||||||
|
**Task:** t_a401f387
|
||||||
|
**Status:** Analyse abgeschlossen → Spezifikation erstellt
|
||||||
|
**Herkunft:** Aus der Ideen-Queue (Idle-Radar, Traum-Notiz vom 18.07.2026)
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 1. Kontext
|
||||||
|
|
||||||
|
### 1.1 Ziel
|
||||||
|
Reduziere den Clutter im Skill-Index und unterstütze den Curator bei der Pflege.
|
||||||
|
|
||||||
|
### 1.2 Aktueller Zustand
|
||||||
|
| Komponente | Status |
|
||||||
|
|------------|--------|
|
||||||
|
| Aktive Skills | 11 |
|
||||||
|
| Archivierte Skills | 15 Kategorien |
|
||||||
|
| Usage-Tracking | Vorhanden (`.usage.json`), aber leer |
|
||||||
|
| `.curator_state` | `paused: true` |
|
||||||
|
| 14-Tage-Regel | **Nicht implementiert** |
|
||||||
|
|
||||||
|
### 1.3 Messlatte
|
||||||
|
- **Stale-Skills:** Skills mit `state: "stale"` in `.usage.json` (bisher kein Eintrag)
|
||||||
|
- **Inaktivität:** Letzte Nutzung (`last_used_at`) liegt >14 Tage zurück
|
||||||
|
- **Archivierung:** Verschieben in `.archive/<Kategorie>/` und Setzen von `archived_at`
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 2. Architektur
|
||||||
|
|
||||||
|
### 2.1 Komponenten
|
||||||
|
|
||||||
|
```
|
||||||
|
┌─────────────────────────────────────────────────────────────────────────┐
|
||||||
|
│ Curator-Auto-Archivierung │
|
||||||
|
├─────────────────────────────────────────────────────────────────────────┤
|
||||||
|
│ │
|
||||||
|
│ ┌─────────────────┐ ┌─────────────────┐ ┌──────────────────┐ │
|
||||||
|
│ │ Idle-Radar │ → │ Archivierungs- │ → │ Curator-Indexer│ │
|
||||||
|
│ │ (Trigger) │ │ Watchdog │ │ (Datenpflege) │ │
|
||||||
|
│ └─────────────────┘ └─────────────────┘ └──────────────────┘ │
|
||||||
|
│ │
|
||||||
|
└─────────────────────────────────────────────────────────────────────────┘
|
||||||
|
```
|
||||||
|
|
||||||
|
### 2.2 Datenfluss
|
||||||
|
1. **Idle-Radar** erkennt Inaktivität (nächtlicher Scan)
|
||||||
|
2. **Archivierungs-Watchdog** prüft 14-Tage-Regel
|
||||||
|
3. **Curator-Indexer** aktualisiert `.usage.json` mit `archived_at`
|
||||||
|
4. Skill-Verzeichnis wird nach `.archive/<Kategorie>/` verschoben
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 3. Dateistruktur
|
||||||
|
|
||||||
|
### 3.1 Aktiv-Verzeichnis (`~/.hermes/skills/`)
|
||||||
|
- Normale Skill-Ordner (`betrieb-playbook/`, `wartung/`, ...)
|
||||||
|
- `.usage.json` (Nutzungsdaten)
|
||||||
|
- `.curator_state` (Curator-Status)
|
||||||
|
|
||||||
|
### 3.2 Archiv-Verzeichnis (`~/.hermes/skills/.archive/`)
|
||||||
|
```
|
||||||
|
.archive/
|
||||||
|
├── apple/ # Kategorie: Apple-Tools
|
||||||
|
├── creative/ # Kategorie: Kreatives
|
||||||
|
├── data-science/ # Kategorie: Datenanalyse
|
||||||
|
├── github/ # Kategorie: GitHub
|
||||||
|
├── media/ # Kategorie: Medien
|
||||||
|
├── mlops/ # Kategorie: MLOps
|
||||||
|
├── research/ # Kategorie: Recherche
|
||||||
|
├── software-development/ # Kategorie: Dev-Tools
|
||||||
|
└── ... # Weitere Kategorien
|
||||||
|
```
|
||||||
|
|
||||||
|
### 3.3 Skill-Datei nach Archivierung
|
||||||
|
```
|
||||||
|
~/.hermes/skills/.archive/software-development/gitea-workflow/
|
||||||
|
├── SKILL.md
|
||||||
|
└── ... (weitere Dateien)
|
||||||
|
```
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 4. Konfiguration
|
||||||
|
|
||||||
|
### 4.1 `.curator_state`
|
||||||
|
```json
|
||||||
|
{
|
||||||
|
"last_report_path": "/home/hitonabi/.hermes/logs/curator/20260720-182035",
|
||||||
|
"last_run_at": "2026-07-20T18:20:35.806573+00:00",
|
||||||
|
"last_run_duration_seconds": 882.931897,
|
||||||
|
"last_run_summary": "auto: no changes; llm: Context length exceeded: max compression attempts (3) reached.",
|
||||||
|
"last_run_summary_shown_at": "2026-07-20T18:20:35.806573+00:00",
|
||||||
|
"paused": false, // ← aktiviert für Auto-Archivierung
|
||||||
|
"run_count": 11,
|
||||||
|
"archivierung": {
|
||||||
|
"enabled": true, // ← neuer Schlüssel
|
||||||
|
"threshold_days": 14, // ← neuer Schlüssel
|
||||||
|
"last_archive_run_at": "2026-07-24T03:00:00.000000+00:00"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
```
|
||||||
|
|
||||||
|
### 4.2 `.usage.json` – Archivierter Skill
|
||||||
|
```json
|
||||||
|
{
|
||||||
|
"gitea-workflow": {
|
||||||
|
"archived_at": "2026-07-24T03:00:00.000000+00:00", // ← neuer Schlüssel
|
||||||
|
"created_at": "2026-06-30T20:00:58.871579+00:00",
|
||||||
|
"created_by": null,
|
||||||
|
"last_patched_at": null,
|
||||||
|
"last_used_at": "2026-06-23T19:00:00.000000+00:00",
|
||||||
|
"last_viewed_at": null,
|
||||||
|
"patch_count": 0,
|
||||||
|
"pinned": false,
|
||||||
|
"state": "archived", // ← geändert von "active"
|
||||||
|
"use_count": 0,
|
||||||
|
"view_count": 0
|
||||||
|
}
|
||||||
|
}
|
||||||
|
```
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 5. Trigger-Mechanismus
|
||||||
|
|
||||||
|
### 5.1 Zeitlicher Trigger
|
||||||
|
- **Cron-Job:** `0 3 * * *` (täglich um 3:00 Uhr)
|
||||||
|
- **Skript:** `~/.hermes/scripts/curator-archive-watchdog.sh`
|
||||||
|
|
||||||
|
### 5.2 Prüflogik
|
||||||
|
```python
|
||||||
|
def is_stale(skill_usage: dict) -> bool:
|
||||||
|
"""Prüft, ob ein Skill älter als 14 Tage ist."""
|
||||||
|
last_used = skill_usage.get("last_used_at")
|
||||||
|
if not last_used:
|
||||||
|
return False
|
||||||
|
|
||||||
|
last_used_dt = datetime.fromisoformat(last_used.replace("Z", "+00:00"))
|
||||||
|
now = datetime.now(last_used_dt.tzinfo)
|
||||||
|
days_inactive = (now - last_used_dt).days
|
||||||
|
return days_inactive >= 14
|
||||||
|
```
|
||||||
|
|
||||||
|
### 5.3 Ausschlusskriterien
|
||||||
|
- **Pinned:** `pinned: true` → nie archivieren
|
||||||
|
- **Verwendung im Live-Repo:** Skills aus `~/mission-control-v2/deploy/skills/` nicht archivieren
|
||||||
|
- **System-Skills:** `betrieb-playbook`, `wartung`, `orchestrator` nicht archivieren (Konfigurierbar in `.curator_state`)
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 6. Archivierungs-Workload
|
||||||
|
|
||||||
|
### 6.1 Schritte
|
||||||
|
1. **Scan:** Alle Skills in `~/.hermes/skills/` durchlaufen
|
||||||
|
2. **Prüfung:** `is_stale()` für jeden Skill aufrufen
|
||||||
|
3. **Ausschluss:** Pinned/System-Skills überspringen
|
||||||
|
4. **Verschieben:** Skill-Verzeichnis nach `.archive/<Kategorie>/`
|
||||||
|
5. **Index aktualisieren:** `.usage.json` mit `archived_at` und `state: "archived"` schreiben
|
||||||
|
6. **Protokoll:** Log-Eintrag in `~/.hermes/logs/curator/`
|
||||||
|
|
||||||
|
### 6.2 Beispiel-Archivierung
|
||||||
|
```bash
|
||||||
|
# Vorher
|
||||||
|
~/.hermes/skills/skill-automatisch-verknuepfen/SKILL.md
|
||||||
|
|
||||||
|
# Nachher
|
||||||
|
~/.hermes/skills/.archive/software-development/skill-automatisch-verknuepfen/SKILL.md
|
||||||
|
```
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 7. Datenformat
|
||||||
|
|
||||||
|
### 7.1 `.usage.json` – Aktiv
|
||||||
|
```json
|
||||||
|
{
|
||||||
|
"name": {
|
||||||
|
"archived_at": null,
|
||||||
|
"created_at": "2026-07-03T07:50:53.782473+00:00",
|
||||||
|
"created_by": null,
|
||||||
|
"last_patched_at": null,
|
||||||
|
"last_used_at": "2026-07-06T08:55:31.369025+00:00",
|
||||||
|
"last_viewed_at": "2026-07-06T08:55:31.367242+00:00",
|
||||||
|
"patch_count": 0,
|
||||||
|
"pinned": false,
|
||||||
|
"state": "active",
|
||||||
|
"use_count": 2,
|
||||||
|
"view_count": 2
|
||||||
|
}
|
||||||
|
}
|
||||||
|
```
|
||||||
|
|
||||||
|
### 7.2 `.usage.json` – Archiviert
|
||||||
|
```json
|
||||||
|
{
|
||||||
|
"name": {
|
||||||
|
"archived_at": "2026-07-24T03:00:00.000000+00:00",
|
||||||
|
"created_at": "2026-07-03T07:50:53.782473+00:00",
|
||||||
|
"created_by": null,
|
||||||
|
"last_patched_at": null,
|
||||||
|
"last_used_at": "2026-07-06T08:55:31.369025+00:00",
|
||||||
|
"last_viewed_at": "2026-07-06T08:55:31.367242+00:00",
|
||||||
|
"patch_count": 0,
|
||||||
|
"pinned": false,
|
||||||
|
"state": "archived",
|
||||||
|
"use_count": 2,
|
||||||
|
"view_count": 2
|
||||||
|
}
|
||||||
|
}
|
||||||
|
```
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 8. Config-Interface
|
||||||
|
|
||||||
|
### 8.1 `.curator_state` – Erweiterung
|
||||||
|
```json
|
||||||
|
{
|
||||||
|
"archivierung": {
|
||||||
|
"enabled": true,
|
||||||
|
"threshold_days": 14,
|
||||||
|
"excluded_skills": ["betrieb-playbook", "wartung", "orchestrator"],
|
||||||
|
"last_archive_run_at": "2026-07-24T03:00:00.000000+00:00"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
```
|
||||||
|
|
||||||
|
### 8.2 `.usage.json` – Erweiterung
|
||||||
|
```json
|
||||||
|
{
|
||||||
|
"name": {
|
||||||
|
"archived_at": "2026-07-24T03:00:00.000000+00:00"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
```
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 9. Akzeptanzkriterien
|
||||||
|
|
||||||
|
| Kriterium | Status |
|
||||||
|
|-----------|--------|
|
||||||
|
| Klare Architektur | ✅ (siehe Abschnitt 2) |
|
||||||
|
| Definierte Dateistruktur | ✅ (`.archive/<Kategorie>/`) |
|
||||||
|
| Config-Interface | ✅ (`.curator_state` + `.usage.json`) |
|
||||||
|
| Keine Code-Änderungen | ✅ (nur Spezifikation) |
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 10. Nächste Schritte
|
||||||
|
|
||||||
|
### 10.1 Implementierung
|
||||||
|
1. **Skript erstellen:** `~/.hermes/scripts/curator-archive-watchdog.sh`
|
||||||
|
2. **Cron-Job anlegen:** `0 3 * * * curator-archive-watchdog.sh`
|
||||||
|
3. **`.curator_state` erweitern:** `archivierung`-Block hinzufügen
|
||||||
|
4. **`.usage.json` erweitern:** `archived_at`-Feld einfügen
|
||||||
|
|
||||||
|
### 10.2 Test
|
||||||
|
1. Manuell einen Skill archivieren (Handbetrieb)
|
||||||
|
2. Prüfen, ob `archived_at` gesetzt wird
|
||||||
|
3. Prüfen, ob `.archive/<Kategorie>/` angelegt wird
|
||||||
|
4. Prüfen, ob `state: "archived"` in `.usage.json` steht
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
## 11. Anhang
|
||||||
|
|
||||||
|
### 11.1 Begriffe
|
||||||
|
| Begriff | Bedeutung |
|
||||||
|
|---------|-----------|
|
||||||
|
| **Stale** | Skill mit `last_used_at > 14 Tage` |
|
||||||
|
| **Archivierung** | Verschieben in `.archive/<Kategorie>/` |
|
||||||
|
| **Curator** | Der automatische Wartungsdienst |
|
||||||
|
| **Idle-Radar** | Das System, das Inaktivität erkennt |
|
||||||
|
|
||||||
|
### 11.2 Quellen
|
||||||
|
- `~/.hermes/skills/.curator_state`
|
||||||
|
- `~/.hermes/skills/.usage.json`
|
||||||
|
- `~/.hermes/skills/.archive/`
|
||||||
|
- `~/wissens-vault/eigenbau-landkarte.md`
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
**Ende der Spezifikation**
|
||||||
Some files were not shown because too many files have changed in this diff Show More
Reference in New Issue
Block a user