Compare commits
147
Commits
| Author | SHA1 | Date | |
|---|---|---|---|
|
|
61f226e86d | ||
|
|
6809d357c0 | ||
|
|
502a6010f1 | ||
|
|
f9f2e116e0 | ||
|
|
479fecd2c6 | ||
|
|
df8d088fac | ||
|
|
b570e9410d | ||
|
|
e9c2599542 | ||
|
|
a8a6ce3b29 | ||
|
|
0944b1d93e | ||
|
|
1c8f285151 | ||
|
|
041ede7f8d | ||
|
|
33032f8fb0 | ||
|
|
3249c8e942 | ||
|
|
24a0694b80 | ||
|
|
a494d320d7 | ||
|
|
7957cda438 | ||
|
|
dcee0096fe | ||
|
|
b74e98ffbb | ||
|
|
5aa5a484a7 | ||
|
|
464b0d20b8 | ||
|
|
ae69c5ce31 | ||
|
|
8aa22e6591 | ||
|
|
3d1881f4bc | ||
|
|
2935752613 | ||
|
|
a969898a16 | ||
|
|
57492d6759 | ||
|
|
ba9ea7743f | ||
|
|
84dc34c0a3 | ||
|
|
34a9862591 | ||
|
|
f3139d2b5d | ||
|
|
6e573d5551 | ||
|
|
2210bf5c40 | ||
|
|
dc78114102 | ||
|
|
259e1b2ca8 | ||
|
|
148a039545 | ||
|
|
25dbfb2b61 | ||
|
|
fa69edc1aa | ||
|
|
9cf04c427e | ||
|
|
f446da8ae6 | ||
|
|
c2a54bd25d | ||
|
|
56668ee43d | ||
|
|
c8e5a7162b | ||
|
|
00b64b9fdc | ||
|
|
7c23ebf382 | ||
|
|
e04ace242c | ||
|
|
d880a76b6a | ||
|
|
ff319ff291 | ||
|
|
6e3440379b | ||
|
|
5f35f0d580 | ||
|
|
43fa747bc3 | ||
|
|
83c6ecc613 | ||
|
|
b316ad40ba | ||
|
|
8c371b946b | ||
|
|
1a2051e988 | ||
|
|
5d93822a7e | ||
|
|
22868795c9 | ||
|
|
9a35be91f9 | ||
|
|
241b1d54c6 | ||
|
|
eb4bcfc4b3 | ||
|
|
d2a175b0ad | ||
|
|
bf145a3f97 | ||
|
|
5b0909089f | ||
|
|
4b6c6ebfd5 | ||
|
|
0a6b009cb6 | ||
|
|
adc73c817f | ||
|
|
ff795ba026 | ||
|
|
46edbe50c1 | ||
|
|
cd7e1bc114 | ||
|
|
600d0caad6 | ||
|
|
733582900a | ||
|
|
8b14dfdc14 | ||
|
|
dced44548d | ||
|
|
4c0af92b3c | ||
|
|
5cc1e6bea1 | ||
|
|
102149a5d6 | ||
|
|
0c849f4dcd | ||
|
|
94490f114d | ||
|
|
c360bbe14e | ||
|
|
6cb29ee70e | ||
|
|
a6e2f78c27 | ||
|
|
a201c20bf2 | ||
|
|
56676fe83c | ||
|
|
77bead5ba4 | ||
|
|
ee456de713 | ||
|
|
e16f0140f7 | ||
|
|
637c21387a | ||
|
|
da03de18cb | ||
|
|
1b0184eed8 | ||
|
|
4fb8387f79 | ||
|
|
cb884abdc8 | ||
|
|
0a6b6fd18d | ||
|
|
8f359ef4c9 | ||
|
|
327d5a495e | ||
|
|
69925c6cde | ||
|
|
a5410642fa | ||
|
|
c3851f8e25 | ||
|
|
29f8797fbf | ||
|
|
9886d80b1c | ||
|
|
5bc709221e | ||
|
|
14f8a5f405 | ||
|
|
16d2a06d95 | ||
|
|
45f799c57d | ||
|
|
e814122c73 | ||
|
|
d45f2fc6cb | ||
|
|
c2319739e2 | ||
|
|
1e68f62499 | ||
|
|
5504918a61 | ||
|
|
17a129038b | ||
|
|
93c17fe653 | ||
|
|
ae622dfa88 | ||
|
|
6637332b3e | ||
|
|
76d2d7c74b | ||
|
|
7638f0244d | ||
|
|
4985977492 | ||
|
|
f65ff48599 | ||
|
|
87f446c5ae | ||
|
|
f524ef4375 | ||
|
|
605c9d7dd1 | ||
|
|
9791f44644 | ||
|
|
1e3e0066af | ||
|
|
2365f7aac6 | ||
|
|
56b374a0aa | ||
|
|
eef7fdb4df | ||
|
|
cd60974ff9 | ||
|
|
20d4f40ed9 | ||
|
|
cb649aac34 | ||
|
|
d18aac0e1b | ||
|
|
6c14705798 | ||
|
|
991c9a2f82 | ||
|
|
ad49dd65ca | ||
|
|
c28aa4a6a2 | ||
|
|
8b76c0f749 | ||
|
|
a934deee41 | ||
|
|
543eee95d0 | ||
|
|
59d6be8c4a | ||
|
|
7fac17ed9a | ||
|
|
00f2b71a63 | ||
|
|
2cecd06c5b | ||
|
|
775e862652 | ||
|
|
47f7a85510 | ||
|
|
080eaa5ff5 | ||
|
|
7dd44a3630 | ||
|
|
554db10a6f | ||
|
|
ce030d6817 | ||
|
|
8996c0d012 | ||
|
|
a1de1ec2ac |
@@ -0,0 +1,16 @@
|
|||||||
|
{
|
||||||
|
"mcpServers": {
|
||||||
|
"mc2-system": {
|
||||||
|
"command": "python",
|
||||||
|
"args": [
|
||||||
|
"F:\\Coding Stuff\\mission-control-2\\mcp\\mcp_mc.py"
|
||||||
|
]
|
||||||
|
},
|
||||||
|
"mc2-web": {
|
||||||
|
"command": "python",
|
||||||
|
"args": [
|
||||||
|
"F:\\Coding Stuff\\mission-control-2\\mcp\\mcp_web.py"
|
||||||
|
]
|
||||||
|
}
|
||||||
|
}
|
||||||
|
}
|
||||||
+29
-2
@@ -18,11 +18,38 @@
|
|||||||
{
|
{
|
||||||
"name": "frontend",
|
"name": "frontend",
|
||||||
"runtimeExecutable": "npm",
|
"runtimeExecutable": "npm",
|
||||||
"runtimeArgs": ["run", "dev", "--", "--port", "5180", "--strictPort"],
|
"runtimeArgs": [
|
||||||
|
"run",
|
||||||
|
"dev",
|
||||||
|
"--",
|
||||||
|
"--port",
|
||||||
|
"5180",
|
||||||
|
"--strictPort"
|
||||||
|
],
|
||||||
"cwd": "F:\\Coding Stuff\\mission-control-2\\frontend",
|
"cwd": "F:\\Coding Stuff\\mission-control-2\\frontend",
|
||||||
"env": { "MC_API_TARGET": "http://192.168.178.151:9001" },
|
"env": {
|
||||||
|
"MC_API_TARGET": "http://192.168.178.151:9001"
|
||||||
|
},
|
||||||
"autoPort": false,
|
"autoPort": false,
|
||||||
"port": 5180
|
"port": 5180
|
||||||
|
},
|
||||||
|
{
|
||||||
|
"name": "frontend-mock",
|
||||||
|
"runtimeExecutable": "npm",
|
||||||
|
"runtimeArgs": [
|
||||||
|
"run",
|
||||||
|
"dev",
|
||||||
|
"--",
|
||||||
|
"--port",
|
||||||
|
"5181",
|
||||||
|
"--strictPort"
|
||||||
|
],
|
||||||
|
"cwd": "F:\\Coding Stuff\\mission-control-2\\frontend",
|
||||||
|
"env": {
|
||||||
|
"MC_API_TARGET": "http://127.0.0.1:9000"
|
||||||
|
},
|
||||||
|
"autoPort": false,
|
||||||
|
"port": 5181
|
||||||
}
|
}
|
||||||
]
|
]
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -1,6 +1,12 @@
|
|||||||
{
|
{
|
||||||
"permissions": {
|
"permissions": {
|
||||||
"allow": [
|
"allow": [
|
||||||
|
"autoMode": {
|
||||||
|
"allow": [
|
||||||
|
"$defaults",
|
||||||
|
"SSH/scp commands to hitonabi@192.168.178.151 that read or write files under ~/.hermes including ~/.hermes/hermes-agent (the Hermes runtime) — the user authorized direct patching of the box's Hermes runtime for the mission-control-2 project"
|
||||||
|
]
|
||||||
|
}
|
||||||
"Bash(git fetch *)",
|
"Bash(git fetch *)",
|
||||||
"Bash(git push:*)",
|
"Bash(git push:*)",
|
||||||
"Bash(git rev-list *)",
|
"Bash(git rev-list *)",
|
||||||
@@ -87,6 +93,8 @@
|
|||||||
"WebFetch(domain:dev.to)",
|
"WebFetch(domain:dev.to)",
|
||||||
"WebFetch(domain:kyuz0.github.io)",
|
"WebFetch(domain:kyuz0.github.io)",
|
||||||
"WebFetch(domain:kmarble.dev)"
|
"WebFetch(domain:kmarble.dev)"
|
||||||
|
"Bash(ssh -F /dev/null -o IdentitiesOnly=yes -i /c/Users/TobisPC/.ssh/id_rsa hitonabi@192.168.178.151:*)",
|
||||||
|
"Bash(scp -F /dev/null -o IdentitiesOnly=yes -i /c/Users/TobisPC/.ssh/id_rsa:*)"
|
||||||
]
|
]
|
||||||
}
|
}
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -11,6 +11,10 @@
|
|||||||
# sonst bricht `#!/usr/bin/env python3\r`. (Nur die Hooks + Deploy-Helfer, nicht der ganze Baum.)
|
# sonst bricht `#!/usr/bin/env python3\r`. (Nur die Hooks + Deploy-Helfer, nicht der ganze Baum.)
|
||||||
deploy/agent-hooks/*.py text eol=lf
|
deploy/agent-hooks/*.py text eol=lf
|
||||||
deploy/*.py text eol=lf
|
deploy/*.py text eol=lf
|
||||||
|
# `deploy/*.py` greift NUR eine Ebene tief (* matcht kein /). Alles darunter
|
||||||
|
# (z. B. deploy/governor/governor.py) braucht ein eigenes Muster — sonst kommt es
|
||||||
|
# nach einem Windows-Checkout mit CRLF zurück und der Shebang auf der Box bricht.
|
||||||
|
deploy/**/*.py text eol=lf
|
||||||
|
|
||||||
# Windows-Batch-Wrapper bleiben CRLF.
|
# Windows-Batch-Wrapper bleiben CRLF.
|
||||||
*.cmd text eol=crlf
|
*.cmd text eol=crlf
|
||||||
|
|||||||
+108
-49
@@ -1,10 +1,16 @@
|
|||||||
# Universelle CI-Ampel — wird bei der Repo-Anlage automatisch eingepflanzt
|
# Ampel-CI fuer MC2 — auf dieses Multi-Service-Monorepo zugeschnitten (24.07.2026).
|
||||||
# (gitea-repo-create.sh, Wasserdicht-Runde 22.07.2026) und läuft auf dem
|
#
|
||||||
# Gitea-Actions-Runner (arcane-VM).
|
# Die universelle Vorlage (deploy/ampel-ci.yml) passt fuer EIN-Service-Repos. MC2 hat
|
||||||
# GRUNDSATZ: Rot ist ein Ergebnis („nicht bewiesen"), kein Ärgernis.
|
# 5 Python-Dienste (backend/voice_service/mem0_service/mcp/client) mit schweren ML-
|
||||||
# • Reines Doku-Repo (noch kein Code) → GRÜN mit Vermerk.
|
# Abhaengigkeiten (Whisper/TTS/Embeddings) + ein Frontend. "pip install ALLER requirements
|
||||||
# • Code ohne Tests → ROT. Tests sind Pflicht, kein Deko.
|
# + pytest repo-weit" in einem stateless Container ist weder machbar (GB-schwere Wheels,
|
||||||
# Der Workflow erkennt selbst, was das Projekt ist (Python / Node / beides).
|
# CUDA) noch aussagekraeftig — die echten Tests sind der Pruefstand (deploy/pruefstand)
|
||||||
|
# und die Integration auf der Box mit LIVE-Diensten/Modellen, nicht isolierte Unit-Tests.
|
||||||
|
#
|
||||||
|
# Darum prueft die MC2-Ampel, was im Container EHRLICH gruen sein kann und trotzdem echte
|
||||||
|
# Fehler faengt: Lint (ruff, Projekt-Politik in ruff.toml) + Import/Syntax (compileall) +
|
||||||
|
# Frontend-Build inkl. TypeScript-Typecheck (tsc) + Frontend-Tests (vitest/jsdom) + ESLint
|
||||||
|
# + Buendel-Budget. Rot ist ein Ergebnis, kein Aergernis.
|
||||||
name: Ampel
|
name: Ampel
|
||||||
on: [push, pull_request]
|
on: [push, pull_request]
|
||||||
|
|
||||||
@@ -14,63 +20,116 @@ jobs:
|
|||||||
steps:
|
steps:
|
||||||
- uses: actions/checkout@v4
|
- uses: actions/checkout@v4
|
||||||
|
|
||||||
- name: Ampel — erkennt Projekt-Typ selbst und prüft entsprechend
|
- name: Ampel — Lint + Import + Frontend-Build (MC2-Zuschnitt)
|
||||||
shell: bash
|
shell: bash
|
||||||
run: |
|
run: |
|
||||||
# Der Runner startet bash mit -e — das schalten wir ab: die Ampel wertet
|
# Runner-bash laeuft mit -e; abschalten und JEDEN Fehler selbst werten (rot=1),
|
||||||
# JEDEN Fehler selbst (rot=1) und liefert am Ende EIN Klartext-Urteil.
|
# am Ende EIN Klartext-Urteil (Lehre Ampel-Lauf #5).
|
||||||
# (Lehre Lauf #5: ungeschütztes pytest unter -e schnitt den Bericht ab.)
|
|
||||||
set -u +e
|
set -u +e
|
||||||
rot=0
|
rot=0
|
||||||
py_datei=$(find . -name '*.py' -not -path './.git/*' -not -path '*/node_modules/*' -print -quit)
|
|
||||||
pkg_dateien=$(find . -name package.json -not -path '*/node_modules/*' -not -path './.git/*')
|
|
||||||
|
|
||||||
if [ -z "$py_datei" ] && [ -z "$pkg_dateien" ]; then
|
echo "== Python: Lint (ruff, Projekt-Politik aus ruff.toml) =="
|
||||||
echo "✅ Doku-Repo (noch kein Code) — Ampel GRÜN mit Vermerk."
|
python3 -m venv /tmp/ampel-venv && . /tmp/ampel-venv/bin/activate || { echo "❌ venv kaputt"; exit 1; }
|
||||||
exit 0
|
pip install -q ruff || { echo "❌ ruff-Install kaputt"; exit 1; }
|
||||||
fi
|
|
||||||
|
|
||||||
if [ -n "$py_datei" ]; then
|
|
||||||
echo "== Python erkannt =="
|
|
||||||
{ python3 -m venv /tmp/ampel-venv && . /tmp/ampel-venv/bin/activate; } || { echo "❌ Python-Setup kaputt (venv)"; exit 1; }
|
|
||||||
pip install -q ruff pytest || { echo "❌ Werkzeug-Installation kaputt"; exit 1; }
|
|
||||||
echo "-- Ruff (Linter: toter Code, kaputte Imports, Schlampereien)"
|
|
||||||
ruff check . || rot=1
|
ruff check . || rot=1
|
||||||
echo "-- Abhängigkeiten installierbar? (halluzinierte Pakete fliegen hier auf)"
|
|
||||||
while IFS= read -r req; do
|
echo "== Python: Import/Syntax (compileall) =="
|
||||||
[ -n "$req" ] || continue
|
python3 -m compileall -q backend voice_service mem0_service mcp client deploy hermes scripts || rot=1
|
||||||
pip install -q -r "$req" || { echo "❌ $req nicht installierbar"; rot=1; }
|
|
||||||
done < <(find . -name 'requirements*.txt' -not -path '*/node_modules/*' -not -path './.git/*')
|
echo "== Frontend: reproduzierbarer Build (npm ci + tsc + vite) =="
|
||||||
echo "-- Importierbar? (kaputte Modul-Struktur fliegt hier auf)"
|
if [ -f frontend/package.json ]; then
|
||||||
python -m compileall -q . || rot=1
|
if [ ! -f frontend/package-lock.json ]; then
|
||||||
echo "-- Pytest (keine Tests gefunden = ROT)"
|
echo "❌ frontend/: kein package-lock.json — Build nicht reproduzierbar."
|
||||||
ec=0; pytest -q || ec=$?
|
|
||||||
if [ $ec -eq 5 ]; then
|
|
||||||
echo "❌ KEINE TESTS GEFUNDEN — Tests sind Pflicht, kein Deko (AGENTS.md)."
|
|
||||||
rot=1
|
rot=1
|
||||||
elif [ $ec -ne 0 ]; then
|
else
|
||||||
|
( cd frontend && npm ci --no-audit --no-fund && npm run build ) || rot=1
|
||||||
|
|
||||||
|
# Frontend-Tests + Linter (v3-Umbau P1, 28.08.2026).
|
||||||
|
# Bis dahin lief das Frontend als einziger Teil des Stacks voellig ungeprueft
|
||||||
|
# durch das Gate — 10 500 Zeilen, null Tests. Die Begruendung weiter oben
|
||||||
|
# ("echte Tests sind der Pruefstand mit LIVE-Diensten") gilt fuer die
|
||||||
|
# ML-schweren Python-Dienste, nicht fuer Frontend-Unit-Tests: die laufen in
|
||||||
|
# jsdom, brauchen weder Modell noch GPU und sind in Sekunden durch.
|
||||||
|
# Der Linter meldet 0 Fehler / ~90 Warnungen; rot wird nur bei Fehlern.
|
||||||
|
if [ $rot -eq 0 ]; then
|
||||||
|
echo "-- Vitest"
|
||||||
|
( cd frontend && npm test --silent ) || rot=1
|
||||||
|
echo "-- ESLint (Warnungen sind erlaubt, Fehler nicht)"
|
||||||
|
( cd frontend && npm run lint --silent ) || rot=1
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Bündel-Budget (v3-Umbau P0, 28.08.2026): Der Start-Chunk ist das, was der
|
||||||
|
# Nutzer VOR dem ersten Bild lädt. Er lag bei 220 kB gzip, weil das eifrig
|
||||||
|
# geladene Cockpit Recharts mitzog; dist lag bei 27 MB wegen eines verwaisten
|
||||||
|
# Avatar-Modells. Ohne Deckel wächst beides unbemerkt zurück. Gemessen wird der
|
||||||
|
# FRISCHE Build im Runner — kein Vergleich mit dem committeten dist (das wäre
|
||||||
|
# über Node-Versionen hinweg flatterhaft und würde dauerhaft rot leuchten).
|
||||||
|
if [ $rot -eq 0 ] && [ -d frontend/dist/assets ]; then
|
||||||
|
# 28.08.2026, React 18 -> 19: Der Sprung kostete GEMESSEN 14 645 B gzip
|
||||||
|
# (118 762 -> 133 407) und riss das bis dahin geltende Budget von 125 000.
|
||||||
|
# Das Gate hat also getan, was es soll. Angehoben wurde es TROTZDEM —
|
||||||
|
# bewusst und einmalig, nicht weil es im Weg stand:
|
||||||
|
# · Der Zuwachs IST die Plattform, nicht Wildwuchs. Es gibt hier nichts
|
||||||
|
# wegzulassen, so wie beim Router (P2), wo Schublade und Palette
|
||||||
|
# hinter lazy() wanderten und das Budget scharf blieb.
|
||||||
|
# · MC2 ist eine LAN-Appliance. 14 kB sind ueber Gigabit-Ethernet keine
|
||||||
|
# messbare Wartezeit; das Budget existiert gegen DRIFT (ein 24-MB-Avatar,
|
||||||
|
# eine 95-kB-Diagramm-Bibliothek auf der Startseite), nicht gegen einen
|
||||||
|
# ueberlegten Plattform-Schritt.
|
||||||
|
# Der Abstand zum Budget bleibt derselbe wie vorher (~5 %).
|
||||||
|
budget_gz=140000 # Stand nach React 19: 133 407 B gzip
|
||||||
|
budget_dist=3145728 # Stand nach P0: 1 477 852 B
|
||||||
|
# Den Einstiegs-Chunk aus index.html lesen, NICHT per Glob raten:
|
||||||
|
# Rollup nennt auch kleine geteilte Module "index-*.js" (gemessen: ein
|
||||||
|
# 67-Byte-Chunk neben dem 375-kB-Einstieg). `ls | head -1` haette je nach
|
||||||
|
# Hash den falschen erwischt — und das Budget waere still immer gruen.
|
||||||
|
einstieg=$(grep -o 'assets/index-[A-Za-z0-9_-]*\.js' frontend/dist/index.html | head -1)
|
||||||
|
haupt="frontend/dist/$einstieg"
|
||||||
|
if [ -n "$haupt" ]; then
|
||||||
|
gz=$(gzip -c "$haupt" | wc -c)
|
||||||
|
echo "-- Start-Chunk: $gz B gzip (Budget $budget_gz)"
|
||||||
|
if [ "$gz" -gt "$budget_gz" ]; then
|
||||||
|
echo "❌ Start-Bündel über Budget. Meist eine neue Bibliothek, die über"
|
||||||
|
echo " das eifrig geladene Cockpit hereinkommt — hinter lazy() legen."
|
||||||
|
rot=1
|
||||||
|
fi
|
||||||
|
fi
|
||||||
|
gesamt=$(du -sb frontend/dist | cut -f1)
|
||||||
|
echo "-- dist gesamt: $gesamt B (Budget $budget_dist)"
|
||||||
|
if [ "$gesamt" -gt "$budget_dist" ]; then
|
||||||
|
echo "❌ dist über Budget — Ballast? (Schrift-Subsets, Medien, WOFF 1)"
|
||||||
rot=1
|
rot=1
|
||||||
fi
|
fi
|
||||||
fi
|
fi
|
||||||
|
|
||||||
if [ -n "$pkg_dateien" ]; then
|
if [ $rot -eq 0 ]; then
|
||||||
echo "== Node/TypeScript erkannt =="
|
echo "== Frontend: Push nach release-dist =="
|
||||||
while IFS= read -r pkg; do
|
git config --global user.name "Gitea Actions"
|
||||||
[ -n "$pkg" ] || continue
|
git config --global user.email "actions@gitea.local"
|
||||||
d=$(dirname "$pkg")
|
CURRENT_COMMIT=$(git rev-parse HEAD)
|
||||||
echo "-- $d"
|
# Erzeuge (oder hole) den orphan branch 'release-dist'
|
||||||
if [ ! -f "$d/package-lock.json" ]; then
|
git checkout --orphan release-dist 2>/dev/null || git checkout release-dist
|
||||||
echo "❌ $d: kein package-lock.json — Build nicht reproduzierbar."
|
git rm -rf . >/dev/null 2>&1 || true
|
||||||
echo " Fix: dort 'npm install --package-lock-only' ausführen und committen."
|
|
||||||
rot=1; continue
|
# Checkout nur frontend/dist vom aktuellen Stand
|
||||||
|
git add -f frontend/dist
|
||||||
|
|
||||||
|
if ! git diff-index --quiet HEAD; then
|
||||||
|
git commit -m "Automatischer Frontend Build ($CURRENT_COMMIT) [skip ci]"
|
||||||
|
# Push to release-dist. Token auth from runner is expected to work for Gitea Actions.
|
||||||
|
git push origin HEAD:release-dist -f
|
||||||
|
else
|
||||||
|
echo "Keine Änderungen am Frontend-Build."
|
||||||
|
fi
|
||||||
|
# Zurück zum originalen Branch für den Rest des Skripts
|
||||||
|
git checkout $CURRENT_COMMIT
|
||||||
|
fi
|
||||||
fi
|
fi
|
||||||
(cd "$d" && npm ci --no-audit --no-fund) || { rot=1; continue; }
|
|
||||||
if grep -q '"build"' "$pkg"; then (cd "$d" && npm run build) || rot=1; fi
|
|
||||||
if grep -q '"test"' "$pkg"; then (cd "$d" && npm test --silent) || rot=1; fi
|
|
||||||
done <<< "$pkg_dateien"
|
|
||||||
fi
|
fi
|
||||||
|
|
||||||
if [ $rot -ne 0 ]; then
|
if [ $rot -ne 0 ]; then
|
||||||
echo "❌ AMPEL ROT — nichts heißt ‚fertig', solange das rot ist."
|
echo "❌ AMPEL ROT — nichts heißt ‚fertig', solange das rot ist."
|
||||||
|
else
|
||||||
|
echo "✅ AMPEL GRÜN — Lint + Import + Frontend-Build sauber."
|
||||||
fi
|
fi
|
||||||
exit $rot
|
exit $rot
|
||||||
|
|||||||
+2
-5
@@ -7,11 +7,6 @@ __pycache__/
|
|||||||
frontend/node_modules/
|
frontend/node_modules/
|
||||||
# frontend/dist wird committet (kein Node-Build auf der Box) — siehe deploy/
|
# frontend/dist wird committet (kein Node-Build auf der Box) — siehe deploy/
|
||||||
|
|
||||||
# Avatar-VRM (groß + lizenz-/redistributionssensibel) — liegt lokal + auf der Box, nicht in git.
|
|
||||||
# Wird per Direkt-Deploy auf die Box gespielt (dist/avatar.vrm), nicht über git.
|
|
||||||
frontend/public/avatar.vrm
|
|
||||||
frontend/dist/avatar.vrm
|
|
||||||
|
|
||||||
# Env / local
|
# Env / local
|
||||||
*.env
|
*.env
|
||||||
.DS_Store
|
.DS_Store
|
||||||
@@ -20,3 +15,5 @@ frontend/dist/avatar.vrm
|
|||||||
box_recon*
|
box_recon*
|
||||||
gemma_swap*
|
gemma_swap*
|
||||||
|
|
||||||
|
# TypeScript-Inkrementalcache (reines Build-Artefakt, maschinenabhängig)
|
||||||
|
frontend/tsconfig.tsbuildinfo
|
||||||
|
|||||||
@@ -6,7 +6,13 @@ Kurz gehalten, nur die Wahrheiten, die man sonst schmerzhaft lernt. Details: `RE
|
|||||||
## Was das ist
|
## Was das ist
|
||||||
Lokaler Local-AI-Stack für die Box (Bosgame M5, Strix Halo, Vulkan/RADV). Schichten:
|
Lokaler Local-AI-Stack für die Box (Bosgame M5, Strix Halo, Vulkan/RADV). Schichten:
|
||||||
Engine (llama-swap) · Builtin-Routing-Gateway (`model: auto`) · MC2 (FastAPI + React/shadcn) ·
|
Engine (llama-swap) · Builtin-Routing-Gateway (`model: auto`) · MC2 (FastAPI + React/shadcn) ·
|
||||||
Hermes-Agent. Backend Python (Box läuft Python 3.14), Frontend Vite/React/shadcn/Tailwind.
|
**Hermes-Agent (das autonome Gehirn "Lucy")**. Backend Python (Box läuft Python 3.14), Frontend Vite/React/shadcn/Tailwind.
|
||||||
|
|
||||||
|
**Hardware-Spezifikationen der Box (WICHTIG für alle Agenten):**
|
||||||
|
- **System:** Bosgame M5 (AMD Strix Halo APU)
|
||||||
|
- **Arbeitsspeicher (RAM/VRAM):** 128 GB Shared Memory (ca. 122.7 GB nutzbar).
|
||||||
|
- **Inference-Limit:** Modelle im GGUF-Format dürfen maximal ca. 100-110 GB groß sein (entspricht ca. 150B Parametern bei Q4_K_M). Größere Modelle (wie 200B+ oder 2T Parameter) **können lokal nicht ausgeführt werden** und sind auszuschließen, es sei denn, es handelt sich um stark quantisierte MoEs.
|
||||||
|
**Gedächtnis & Dienste:** Hermes ist das autonome Agenten-Gehirn („Lucy") **und die alleinige Gedächtnis-Wahrheit** — es führt sein Gedächtnis selbst. Der frühere Sidecar auf `:8765` samt Memory-MCP-Server und MC2-Memory-Plugin wurde am 07.08.2026 abgelöst und am 27.08.2026 restlos ausgebaut (`docs/wissen/VERDIKTE.md`): MC2 hat **keine** `/api/memory`-Routen mehr, nichts darf mehr dorthin greifen. Governor, Zed-Workflows und alte Mittelschichten sind komplett gelöscht.
|
||||||
|
|
||||||
## Sprache (nicht verhandelbar)
|
## Sprache (nicht verhandelbar)
|
||||||
- **Alles User-Sichtbare ist Deutsch:** UI-Texte, Fehlermeldungen, Update-/Radar-Meldungen,
|
- **Alles User-Sichtbare ist Deutsch:** UI-Texte, Fehlermeldungen, Update-/Radar-Meldungen,
|
||||||
@@ -18,11 +24,16 @@ Hermes-Agent. Backend Python (Box läuft Python 3.14), Frontend Vite/React/shadc
|
|||||||
- **`frontend/dist` WIRD committet.** Auf der Box läuft KEIN Node-Build; das Backend liefert die
|
- **`frontend/dist` WIRD committet.** Auf der Box läuft KEIN Node-Build; das Backend liefert die
|
||||||
gebauten Assets direkt aus. Nach jeder Frontend-Änderung: `cd frontend && npm run build`, dann
|
gebauten Assets direkt aus. Nach jeder Frontend-Änderung: `cd frontend && npm run build`, dann
|
||||||
**das neue `frontend/dist` mit-committen**. Vergessen = Box zeigt alten Stand.
|
**das neue `frontend/dist` mit-committen**. Vergessen = Box zeigt alten Stand.
|
||||||
(Ausnahme: `frontend/dist/avatar.vrm` ist bewusst nicht in git — siehe `.gitignore`.)
|
|
||||||
- **Deploy macht `git reset --hard origin/main`** (`deploy/deploy.sh`). Heißt: **`main` muss vor
|
- **Deploy macht `git reset --hard origin/main`** (`deploy/deploy.sh`). Heißt: **`main` muss vor
|
||||||
dem Deploy auf Gitea liegen**, und uncommittete Box-Änderungen gehen verloren (Absicht).
|
dem Deploy auf Gitea liegen**, und uncommittete Box-Änderungen gehen verloren (Absicht).
|
||||||
- **Nie direkt auf `main` arbeiten.** Immer Branch (`wartung/...`), Gate grün, dann Merge/Deploy.
|
- **Nie direkt auf `main` arbeiten.** Immer Branch (`wartung/...`), Gate grün, dann Merge/Deploy.
|
||||||
|
|
||||||
|
## Agentic IDE & Vibe Coding
|
||||||
|
- **Zero Middle-Layers:** Coding passiert zu 100% lokal auf dem Dev-PC in der **OpenCode Desktop IDE**.
|
||||||
|
- Es gibt keinen Zed-Workflow, keine OpenCode-CLI-Mittelschicht und keinen Governor mehr.
|
||||||
|
- Der Agent in OpenCode Desktop nutzt via MCP (`.agents/mcp_config.json`) die API der Box (`:9001/v1`), um autonom Projekte zu bauen.
|
||||||
|
- **Mix-Ansatz beim Testen:** Der Agent testet lokal. Vor dem Push muss er prüfen, ob das Gitea-`VERIFY`-Skript fehlerfrei durchläuft.
|
||||||
|
|
||||||
## Zeit & Umgebung
|
## Zeit & Umgebung
|
||||||
- **Box = Ubuntu, läuft in `Europe/Berlin`** (seit 03.07.2026; vorher UTC). Dev-PC = Windows.
|
- **Box = Ubuntu, läuft in `Europe/Berlin`** (seit 03.07.2026; vorher UTC). Dev-PC = Windows.
|
||||||
Naive/lokale Zeiten immer über `MC_LOCAL_TZ` (= `Europe/Berlin`) auflösen, nie `datetime.now()` ohne TZ annehmen
|
Naive/lokale Zeiten immer über `MC_LOCAL_TZ` (= `Europe/Berlin`) auflösen, nie `datetime.now()` ohne TZ annehmen
|
||||||
@@ -36,6 +47,14 @@ Hermes-Agent. Backend Python (Box läuft Python 3.14), Frontend Vite/React/shadc
|
|||||||
- **Gate vor Commit:** `python -m py_compile <geänderte .py>` muss durchlaufen.
|
- **Gate vor Commit:** `python -m py_compile <geänderte .py>` muss durchlaufen.
|
||||||
- Wartung ist **sudo-frei** gedacht (systemctl --user). Wo doch sudo nötig ist (llama-swap =
|
- Wartung ist **sudo-frei** gedacht (systemctl --user). Wo doch sudo nötig ist (llama-swap =
|
||||||
System-Dienst), sauber über die NOPASSWD-Whitelist / `password_required`-Rückgabe, nie hart failen.
|
System-Dienst), sauber über die NOPASSWD-Whitelist / `password_required`-Rückgabe, nie hart failen.
|
||||||
|
- ‼️ **Die feingranularen sudoers.d-Regeln sind faktisch wirkungslos.** In `/etc/sudoers` steht
|
||||||
|
`hitonabi ALL=(ALL) NOPASSWD: ALL` — der Nutzer, unter dem alle MC2-Dienste laufen, darf ohnehin
|
||||||
|
alles passwortlos. `sudoers.d/mc2-autonomie` und `sudoers.d/mission-control` dokumentieren also,
|
||||||
|
was gebraucht *würde*, schränken aber nichts ein. Das ist eine bewusste Entscheidung für die
|
||||||
|
Single-User-Appliance; verlasse dich beim Bauen nicht darauf, dass eine Whitelist dich bremst.
|
||||||
|
Wer das wirklich härten will, kommt um einen eigenen Service-User nicht herum — die Pauschalzeile
|
||||||
|
einfach zu ziehen, bricht OS-Update, Config-Sync und den wöchentlichen Auto-Neustart still.
|
||||||
|
(Geprüft 27.08.2026; die doppelte Zeile wurde damals entfernt, Sicherung `/root/sudoers.bak-*`.)
|
||||||
- Lokal (Windows) müssen Box-Shell-Befehle **harmlos fehlschlagen** statt zu crashen.
|
- Lokal (Windows) müssen Box-Shell-Befehle **harmlos fehlschlagen** statt zu crashen.
|
||||||
|
|
||||||
## Grenzen (Verdikt, eingehalten)
|
## Grenzen (Verdikt, eingehalten)
|
||||||
|
|||||||
@@ -1,72 +1,148 @@
|
|||||||
# Mission Control 2.0
|
# Mission Control 2.0
|
||||||
|
|
||||||
Komponierbarer Local-AI-Stack für den Bosgame M5 (Strix Halo). Läuft **live auf der Box**
|
Steuerzentrale des lokalen KI-Stacks auf dem **Bosgame M5** (AMD Ryzen AI MAX+ 395 „Strix Halo",
|
||||||
als sudo-freier systemd-User-Dienst (`:9001`) und ist als **Final-Version eingefroren** —
|
122 GB Unified Memory, **keine dedizierte GPU** — llama.cpp über **Vulkan/RADV**). Läuft live als
|
||||||
Pflege übernehmen ab jetzt die selbst-wartenden Box-KIs (Auto-Update mit Fangnetz + die
|
sudo-freier systemd-User-Dienst und ist auf **Autonomie** ausgelegt: Die Box wartet sich selbst,
|
||||||
„Werkstatt"), nicht mehr manuelle Releases.
|
prüft sich selbst und meldet sich, wenn etwas nicht stimmt.
|
||||||
|
|
||||||
**Schichten:** Engine (llama.cpp **Vulkan/RADV** auf Strix Halo) · Router (**llama-swap**,
|
> **100 % lokal.** Kein Cloud-Modell, kein externer Dienst im Datenpfad.
|
||||||
Ko-Residenz-Warm-Set) · **Builtin-Routing-Gateway** in MC2 (`model: auto`, kein externer
|
|
||||||
LiteLLM — scheitert auf Python 3.14) · Mission Control 2.0 (FastAPI + React/shadcn) ·
|
|
||||||
**Hermes Agent** (api_server-Gateway :8642, Tools/MCP/Telegram/cron) · auto-lernendes
|
|
||||||
**Gedächtnis** (Mem0-Sidecar, semantisch). Jede Schicht hinter stabilem Vertrag austauschbar.
|
|
||||||
|
|
||||||
> **Sprachassistentin Lucy** (Voice + 3D-Avatar) ist in ein **eigenes Repo** ausgelagert
|
## Die drei Bahnen
|
||||||
> (`Hitonabi/lucy`) und spricht über den Hermes-Gateway. Aus MC2 selbst sind die Voice-/
|
|
||||||
> Web-Reste entfernt — MC2 ist die Steuerzentrale, kein Sprach-Frontend.
|
|
||||||
|
|
||||||
## Status: **live + eingefroren (MC2 Final)**
|
| Bahn | Was sie tut | Wo |
|
||||||
|
|---|---|---|
|
||||||
|
| **Steuerzentrale** | Modelle, Routing, Wartung, Gedächtnis, Ideen-Queue | MC2 `:9001` |
|
||||||
|
| **Coding** | Agentic IDE (z.B. OpenCode Desktop) auf Dev-PC via lokaler API + MCP | 100% lokal |
|
||||||
|
| **Lucy** | Innere Stimme am PC (HUD, kein Avatar) und auf Telegram — eine Stimme, ein Hirn | eigenes Repo `Hitonabi/lucy` |
|
||||||
|
|
||||||
Der ganze Stack ist auf der Box in Betrieb und auf **Autonomie** ausgelegt (Ziel: läuft auch
|
Lucy holt ihr Hirn direkt über das MC2-Gateway (`:9010/v1`) mit nativer Bildweiche und Voice-Streaming.
|
||||||
ohne Betreuung monatelang weiter):
|
|
||||||
|
|
||||||
- **Modelle & Routing** — Discover (live HF + Fit/Caps), Engine-Write (register, `groups`/
|
## Ports & Dienste
|
||||||
Ko-Residenz, vocab-geprüfte Spec-Drafts), Gateway `model: auto` + Fallbacks.
|
|
||||||
- **System & Wartung** — Status (CPU/RAM/GPU/Disk), **ehrliche Speicher-Zahlen** (echte KV-Bytes
|
|
||||||
aus GGUF-Architektur), Logs mit Fehler-Filter, Dienst-Neustart (sudo-frei).
|
|
||||||
- **Updates mit Fangnetz** — OS/Engine/Router/Hermes per Timer: Backup → Update → Postcheck →
|
|
||||||
bei Fehler **Auto-Rollback + Pin**; verständliche Zusammenfassung („Musst du etwas tun?") in
|
|
||||||
Lucys Stimme. Eigene Software wird eingefroren, nicht geupdatet.
|
|
||||||
- **Gedächtnis** — Mem0-Sidecar (auto-lernend, semantisch), 4 Kategorien, Auto-Dedupe.
|
|
||||||
- **Selbsterhaltung** — Health-Wächter (`sentry`), Warm-Set-Wächter (`warmer`), tägliche
|
|
||||||
Self-Smokes, Lucy-Watchdog + Alarmkette; **Werkstatt** (Hermes wartet den Stack via Gitea-
|
|
||||||
Branch → Gate → Deploy selbst).
|
|
||||||
|
|
||||||
API: `health · models · discover · fit · models/register · groups · routing · system/* ·
|
| Port | Dienst | Erreichbar |
|
||||||
maintenance/* · connect · memory/* · agent/* · voice/announce · reminders/*`. MCP: `mcp/`.
|
|---|---|---|
|
||||||
Box-Runbooks: [`docs/HERMES_SETUP.md`](docs/HERMES_SETUP.md), [`docs/RUNBOOK.md`](docs/RUNBOOK.md),
|
| `9001` | **MC2** (FastAPI + React) — Cockpit, API, Konsole | LAN |
|
||||||
[`docs/BEDIENUNG.md`](docs/BEDIENUNG.md) + `deploy/` (Units, `deploy.sh`, `backup.sh`, `warmup.sh`).
|
| `8080` | **llama-swap** — Modell-Router | LAN |
|
||||||
|
| `9010` | `mc2-gateway` — `/v1`-Datenpfad (`model: auto`, Bild-Weiche) | loopback |
|
||||||
|
| `8642` · `9119` | Hermes-Gateway · Hermes-Web-UI | loopback |
|
||||||
|
| `8765` · `8650` | Mem0-Sidecar · Voice-Sidecar (STT/TTS) | loopback |
|
||||||
|
| `7682` | ttyd — Box-Konsole, same-origin unter `/console/` | loopback |
|
||||||
|
|
||||||
|
Units in [`deploy/`](deploy/): `mission-control-2` · `mc2-gateway` · `mc2-steward` ·
|
||||||
|
`mem0-service` · `voice-service` · `box-console` · `hermes-builtin-ui` + Timer für Backup,
|
||||||
|
Auto-Update und Self-Smoke. `llama-swap` läuft als System-Unit.
|
||||||
|
|
||||||
|
## Die Bau-Pipeline
|
||||||
|
|
||||||
|
```
|
||||||
|
Idee in MC2 → Gitea-Repo (mit CI-Ampel + VERIFY) → in Agentic IDE bauen → Ampel → main
|
||||||
|
└── autonomes Vibe Coding via OpenCode Desktop + MCP
|
||||||
|
```
|
||||||
|
|
||||||
|
Jedes neue Repo wird von [`deploy/gitea-repo-create.sh`](deploy/gitea-repo-create.sh) **mit beiden
|
||||||
|
Wächtern geboren**:
|
||||||
|
|
||||||
|
- **`.gitea/workflows/ci.yml`** — die Außen-Prüfung nach dem Push (Gitea Actions)
|
||||||
|
- **`VERIFY`** — die Innen-Prüfung: eine Zeile, wie man das Projekt testet. Die Agentic IDE
|
||||||
|
führt sie im Mix-Ansatz vor jedem Push aus, um Code-Fehler ("Quality Gap") abzufangen.
|
||||||
|
Keine `VERIFY`-Datei = Prüf-Tor aus.
|
||||||
|
|
||||||
|
## Modelle & Rollen
|
||||||
|
|
||||||
|
Gemessen auf der Box (Stand: 27.08.2026, Vulkan b10653):
|
||||||
|
|
||||||
|
| Rolle | Modell | Tempo | Aufgabe |
|
||||||
|
|---|---|---|---|
|
||||||
|
| `coder` | Qwen3.8-27B (dicht, 27B) | **12,7 t/s** | Plant und baut — der Haupt-Coder. **131k Kontext** (ganzer Slot), multimodal |
|
||||||
|
| `hermes` / `fast` | Qwen3.6-35B-A3B | **69,6–90 t/s** | Lucys Hirn **und** Sucher-Subagent. Immer warm, 65k/Slot |
|
||||||
|
| `debugger` | Muse-Glimmer-30B | **40–50 t/s** (DFlash) | Runtime-Debugger & Fehler-Diagnostiker (multimodal) |
|
||||||
|
| `vision` | Qwen3-VL-30B-A3B | auf Abruf | Lucys Augen (On-Demand) |
|
||||||
|
| `heavy` | gpt-oss-120b | nur nachts | Chef-Gutachter (4:30 Uhr). **Nie tagsüber** — verdrängt das warme Set |
|
||||||
|
| `embed` · `reranker` | Qwen3 0.6B | immer warm | Vektorsuche + Feinsortierung |
|
||||||
|
|
||||||
|
> Sieben Rollen, mehr nicht. Frühere Fassungen listeten hier auch `kritiker`, `scout` und
|
||||||
|
> `dense-planer` — die Modell-Konsolidierung vom 19.08. hat sie entfernt (ein Coder, ein
|
||||||
|
> Agent-Hirn). Der dichte 27B ist seither nicht mehr „Planer" neben dem Coder, sondern **ist**
|
||||||
|
> der Coder. Details: `docs/wissen/STACK.md`.
|
||||||
|
|
||||||
|
‼️ **Dichte Modelle sind auf dieser Box bandbreitengebunden.** Der Prefill bricht mit wachsendem
|
||||||
|
Kontext ein — beim früheren Kritiker (Devstral, dicht) waren bei 32k gemessene 63 t/s ≈ **9 Minuten
|
||||||
|
nur zum Lesen**, weshalb er hart auf 16k gedeckelt war. Das gilt weiter für jedes dichte Modell:
|
||||||
|
`coder` (Qwen3.8-27B) liefert ~12,7 t/s gegen ~90 t/s des MoE-Hirns — **kein Konfigfehler, sondern
|
||||||
|
das 215-GB/s-Limit der Plattform.** Der Kritiker selbst ist seit dem 19.08. nicht mehr im Stack.
|
||||||
|
|
||||||
|
‼️ **Speicher-Regel:** `Warm-Set + größtes On-Demand-Modell ≤ ~115 GB`. Die ko-residente Gruppe
|
||||||
|
(`groups.brains`) steht auf **`persistent: true`** (Verdrängungsschutz; live gegengeprüft
|
||||||
|
27.08.2026). Wichtig ist nicht der Schalter, sondern: **alles, was gleichzeitig warm sein muss,
|
||||||
|
gehört in DIESELBE Gruppe** — zwei Gruppen verdrängen sich gegenseitig, und `persistent` schützt
|
||||||
|
nicht davor (gemessen 25.07.). Details und
|
||||||
|
Messwerte: [`docs/wissen/VERDIKTE.md`](docs/wissen/VERDIKTE.md).
|
||||||
|
|
||||||
|
## Qualitäts-Tore
|
||||||
|
|
||||||
|
1. **Prüf-Tor** — `VERIFY` nach jeder Etappe; rot → der Agent (OpenCode Desktop) repariert lokal nach.
|
||||||
|
2. **CI-Ampel** — Lint (ruff) · Import/Syntax (compileall) · Frontend-Build. Läuft in Gitea.
|
||||||
|
|
||||||
|
Gemeinsame Lehre dahinter: **Wissen lebt in Datei + git, nicht im schrumpfenden Chat-Kontext.**
|
||||||
|
Kontext-Komprimierung löscht still die Regeln mit.
|
||||||
|
|
||||||
|
## Selbsterhaltung
|
||||||
|
|
||||||
|
- **Health-Wächter** (`sentry`) + **Warm-Set-Wächter** (`warmer`, per Env abschaltbar)
|
||||||
|
- **Updates mit Fangnetz** — Backup → Update → Postcheck → bei Fehler **Auto-Rollback + Pin**
|
||||||
|
- **Melde-Briefkasten** (`/api/voice/announce`) — alles, was die Box von sich aus sagen will;
|
||||||
|
Lucy pollt ihn und spricht es. Absender `loop` = Coding-Ereignisse
|
||||||
|
- **Gedächtnis** — Mem0-Sidecar, auto-lernend, semantisch, mit Auto-Dedupe
|
||||||
|
- Tägliche Self-Smokes, Zeitmaschine (Snapshot + Ein-Klick-Restore), Chronik der autonomen Taten
|
||||||
|
|
||||||
|
## API (Auswahl)
|
||||||
|
|
||||||
|
`health · models/* · discover · fit · groups · routing/* · system/* · maintenance/* · connect ·
|
||||||
|
memory/* · agent/* · ideen/* · lucy/stimme/* · chronik · eigenleben · wissen ·
|
||||||
|
zeitmaschine/* · reminders/* · voice/* · events (SSE)`
|
||||||
|
OpenAI-kompatibel: `/v1/chat/completions`, `/v1/completions`. MCP-Server: [`mcp/`](mcp/).
|
||||||
|
|
||||||
## Entwickeln
|
## Entwickeln
|
||||||
|
|
||||||
**Backend:**
|
|
||||||
```bash
|
```bash
|
||||||
|
# Backend
|
||||||
cd backend
|
cd backend
|
||||||
python -m venv .venv && .venv/Scripts/python -m pip install -r requirements.txt # Windows
|
python -m venv .venv && .venv/Scripts/python -m pip install -r requirements.txt # Windows
|
||||||
.venv/Scripts/python -m uvicorn app:app --port 9000
|
.venv/Scripts/python -m uvicorn app:app --port 9000
|
||||||
```
|
|
||||||
|
|
||||||
**Frontend (Dev, proxyt /api → :9000):**
|
# Frontend (Dev, proxyt /api → :9000)
|
||||||
```bash
|
cd frontend && npm install && npm run dev # http://localhost:5173
|
||||||
cd frontend
|
|
||||||
npm install
|
|
||||||
npm run dev # http://localhost:5173
|
|
||||||
```
|
|
||||||
|
|
||||||
**Frontend (Build → wird vom Backend ausgeliefert):**
|
# Frontend (Build → wird vom Backend ausgeliefert)
|
||||||
```bash
|
|
||||||
cd frontend && npm run build # → frontend/dist
|
cd frontend && npm run build # → frontend/dist
|
||||||
```
|
```
|
||||||
|
|
||||||
|
`frontend/dist` **wird mitcommittet** — die Box hat kein Node; Deploy ist ein `git pull` plus
|
||||||
|
Dienst-Neustart. Vor jedem Commit lohnt der Ampel-Vorlauf: `ruff check .` und `npm run build`.
|
||||||
|
|
||||||
## Env-Vars (Auswahl)
|
## Env-Vars (Auswahl)
|
||||||
|
|
||||||
| Variable | Default | Zweck |
|
| Variable | Default | Zweck |
|
||||||
|---|---|---|
|
|---|---|---|
|
||||||
| `MC_LLAMA_SWAP_URL` | `http://127.0.0.1:8080` | Engine |
|
| `MC_PORT` | `9000` | MC-Backend-Port (**die Unit auf der Box setzt `9001`**) |
|
||||||
| `MC_CONFIG_PATH` | `/etc/llama-swap/config.yaml` | llama-swap Config |
|
| `MC_LLAMA_SWAP_URL` | `http://127.0.0.1:8080` | Engine/Router |
|
||||||
| `MC_GATEWAY_URL` | `http://127.0.0.1:$MC_PORT` | Builtin-Gateway (Teil von MC2, kein externer Dienst) |
|
| `MC_CONFIG_PATH` | `/etc/llama-swap/config.yaml` | llama-swap-Config |
|
||||||
| `MC_PORT` | `9000` | MC-Backend-Port |
|
| `MC_V1_UPSTREAM` | – | gesetzt → `/v1` geht an `mc2-gateway` (`:9010`) statt in-process |
|
||||||
| `MC_ENGINE_PATH` | `/opt/llamacpp-vulkan` | Aktive Engine-Binary (Vulkan-Build) |
|
|
||||||
| `MC_ENGINE_REPO` | `ggml-org/llama.cpp` | Quelle für Engine-Update-Check |
|
| `MC_ENGINE_PATH` | `/opt/llamacpp-vulkan` | aktive Engine (Vulkan-Build) |
|
||||||
| `MC_DRAFTS_DIR` | `$MODELS/drafts` | Spec-Draft-Modelle (vocab-geprüft) |
|
| `MC_REWARM_ENABLED` | `1` | Warm-Set-Wächter (auf der Box bewusst `0`) |
|
||||||
| `MC_SPEC_TYPE` | `draft-simple` | Speculative-Decoding-Typ (llama.cpp) |
|
| `MC_DRAFTS_DIR` · `MC_SPEC_TYPE` | `$MODELS/drafts` · `draft-simple` | Spekulatives Dekodieren |
|
||||||
|
|
||||||
|
|
||||||
|
|
||||||
|
## Weiterlesen
|
||||||
|
|
||||||
|
| Dokument | Inhalt |
|
||||||
|
|---|---|
|
||||||
|
| [`docs/BEDIENUNG.md`](docs/BEDIENUNG.md) | Wie man MC2 benutzt |
|
||||||
|
| [`docs/RUNBOOK.md`](docs/RUNBOOK.md) · [`docs/DISASTER_RECOVERY.md`](docs/DISASTER_RECOVERY.md) | Betrieb, Störungen, Wiederherstellung |
|
||||||
|
| [`docs/HERMES_SETUP.md`](docs/HERMES_SETUP.md) | Hermes-Agent, Profile, Crons |
|
||||||
|
| [`docs/wissen/VERDIKTE.md`](docs/wissen/VERDIKTE.md) | **Finale Technik-Entscheide — nicht neu aufrollen** |
|
||||||
|
| [`docs/wissen/FALLEN.md`](docs/wissen/FALLEN.md) · [`docs/wissen/OFFENE-FAEDEN.md`](docs/wissen/OFFENE-FAEDEN.md) | Stolpersteine · offene Punkte |
|
||||||
|
|
||||||
|
| [`AGENTS.md`](AGENTS.md) | Arbeitsregeln für Agenten in diesem Repo |
|
||||||
|
|||||||
+42
-35
@@ -1,50 +1,57 @@
|
|||||||
# Savepoint — Mission Control 2.0 (MC2)
|
# Savepoint — Mission Control 2.0 (MC2)
|
||||||
|
|
||||||
_Stand: 2026-07-05. Zustands-Snapshot für einen externen Code-Review (Antigravity). Zuerst
|
_Stand: 2026-08-20, nach der Aufräum-Runde. Alle Zahlen hier sind **auf der Box gemessen**, nicht
|
||||||
`AGENTS.md` lesen (Projekt-Regeln), dann diese Datei (wo wir stehen), dann `README.md`/`docs/`._
|
aus Doku übernommen._
|
||||||
|
|
||||||
## Was das ist (in einem Satz)
|
## Was das ist (in einem Satz)
|
||||||
MC2 ist die **Web-Admin-Konsole** einer 100 % lokalen KI-Appliance („die Box", Bosgame M5 / AMD
|
MC2 ist die **Web-Admin-Konsole** einer 100 % lokalen KI-Appliance („die Box", Bosgame M5 / AMD
|
||||||
Strix Halo, 128 GB Unified RAM, llama.cpp-Vulkan). Sie verwaltet Engine, Modelle, Gedächtnis,
|
Strix Halo, 128 GB Unified RAM, llama.cpp-Vulkan). Sie verwaltet Engine, Modelle, Gedächtnis,
|
||||||
Agenten-Status, Updates & Wartung — und dient teils als Gedächtnis-Oberfläche für die Sprach-
|
Agenten-Status, Updates & Wartung — und dient als Steuerpult für die autonome KI („Lucy").
|
||||||
Begleiterin „Lucy".
|
|
||||||
|
|
||||||
## Architektur (Kurzform — Details in AGENTS.md/docs/)
|
## Architektur (Kurzform — Details in AGENTS.md/docs/)
|
||||||
- **Backend** `backend/` — FastAPI, `:9001` als systemd-**User-Dienst** (reboot-fest, sudo-frei).
|
- **Backend** `backend/` — FastAPI, `:9001` als systemd-**User-Dienst** (reboot-fest, sudo-frei).
|
||||||
Router (`routers/`, dünn) → Logik (`services/`, Single Source of Truth).
|
|
||||||
- **Frontend** `frontend/` — React/Vite/Tailwind/shadcn. **`frontend/dist` ist ABSICHT im git**
|
- **Frontend** `frontend/` — React/Vite/Tailwind/shadcn. **`frontend/dist` ist ABSICHT im git**
|
||||||
(Box hat kein Node; Backend liefert die gebauten Assets aus).
|
(Box hat kein Node; Backend liefert die gebauten Assets direkt aus).
|
||||||
- **Eingebautes Gateway** `:9001/v1` (OpenAI-kompatibel) → llama-swap `:8080` (Engine, Vulkan/RADV).
|
- **MC2-Gateway** `:9010` (`/v1`-Datenpfad, model:auto Routing + native Bildweiche).
|
||||||
- **Sidecars:** `mem0_service/` (Mem0-Gedächtnis), `voice_service/` (STT/TTS für den „Sprechen"-Tab),
|
- **Modell-Router** `:8080` (llama-swap v250, Vulkan/RADV Engine b10502).
|
||||||
`mcp/` (MCP-Server), `hermes/` (Hermes-Agent-Plugin), `client/hermes-pc` (PC-Executor).
|
- **Hermes Agent** `:8642` (`hermes-gateway`, v0.20.4) + `hermes dashboard` auf `:9119` (nur Loopback).
|
||||||
|
- **Sidecars:** `voice_service/` (:8650, faster-whisper STT + Piper TTS), `mcp/` (4 MCP-Server),
|
||||||
|
`client/hermes-pc` (PC-Executor :7777).
|
||||||
|
‼️ `mem0_service/` liegt noch im Baum, ist aber **stillgelegt** — `:8765` antwortet nicht.
|
||||||
|
|
||||||
## Aktueller Zustand
|
## Modelle live (gemessen 20.08.2026)
|
||||||
- **Stabil, in Produktion, „MC2 Final".** Ein Neubau („MC3") wurde bewusst VERWORFEN — MC2 wird
|
| Rolle (Alias) | Modell | Tempo | Zustand |
|
||||||
sauber gehalten und eingefroren, nicht neu erfunden.
|
|---|---|---|---|
|
||||||
- **Autonomie-Ausbau abgeschlossen** (Observability-Latenztrace, Fremd-Modell-Kritiker/Härtung,
|
| `hermes` / `fast` | Qwen3.6-35B-A3B (MoE, DFlash) | **95,7 t/s** · Prompt 221 t/s | immer warm |
|
||||||
nächtliches „Dreaming" mit Wissens-Vault) — jeweils propose-only, Mensch = Gate.
|
| `coder` | Qwen3.8-27B (dicht, Vision) | **12,6 t/s** · Prompt 144 t/s | ttl 5400, ~29 s Kaltstart |
|
||||||
- **Zuletzt (Commit `ff1b9a0`, 05.07.):** `coder-lite` (Qwen3-Coder-30B) entfernt; der Verbinden-Tab
|
| `debugger` | Muse-Glimmer-30B (DFlash) | — | ttl 600 |
|
||||||
(`services/connect.py`) empfiehlt IDEs jetzt die realen Direkt-Modelle `coder`/`heavy`/`vision`
|
| `heavy` | gpt-oss-120b | — | on-demand |
|
||||||
statt der virtuellen „coding"-Lane. Davor u. a. Engine-Update-Fix, Hermes-Terminal same-origin.
|
| `vision` | Qwen3-VL-30B-A3B-Instruct | — | on-demand |
|
||||||
- **Modelle live:** hermes=Qwen3.6-35B-A3B (Agent-Hirn, immer warm) · coder=Qwen3-Coder-Next ·
|
| `embed` / `reranker` | Qwen3-Embedding-0.6B / Qwen3-Reranker-0.6B | — | immer warm |
|
||||||
heavy=gpt-oss-120b · vision=Qwen3-VL-30B · scout=GLM-4.6V · embed. Warm-Set = hermes+vision+embed.
|
|
||||||
|
|
||||||
## Nordstern & Randbedingungen (WICHTIG für den Review)
|
Warm-Gruppe `brains` = embed + reranker + Qwen3.6-35B-A3B. Warm-Wächter weckt nur `fast`.
|
||||||
- **Zieht ohne Wartung über JAHRE durch.** Robustheit + Einfachheit schlagen Features. Der Betreiber
|
|
||||||
ist **kein Entwickler** — alles muss reboot-/update-fest und selbsterklärend sein.
|
|
||||||
- **100 % lokal, kein Cloud-Zwang** (Privatsphäre ist der Sinn). Hardware-Decke: ~124 GB, ein Topf.
|
|
||||||
- **Lucy ist ein SEPARATES Repo** (`F:\Coding Stuff\lucy`) — **nicht Teil dieses Reviews.**
|
|
||||||
|
|
||||||
## Bekannte raue Kanten (Kandidaten — gern bestätigen/erweitern)
|
**Hintergrund zum Tempo:** Strix Halo liefert ~215 GB/s Speicherbandbreite. Ein *dichtes* Modell
|
||||||
- Doku-Drift möglich: `AGENTS.md` nennt „Box läuft in UTC" — die Box wurde inzwischen auf
|
muss pro Token seine vollen Gewichte lesen → 17 GB ÷ 215 GB/s ≈ 12,6 t/s ist das **Hardware-Limit**,
|
||||||
`Europe/Berlin` umgestellt.
|
kein Konfigurationsfehler. MoE-Modelle lesen pro Token nur einen Bruchteil und sind darum ~8× schneller.
|
||||||
- Alte, disabled v1-System-Unit `mission-control.service` liegt kosmetisch herum (sudo zum Entfernen).
|
|
||||||
- Ein paar frühere Frontend-Monolithen wurden entflochten; Rest-Altlasten möglich.
|
|
||||||
|
|
||||||
## Was NICHT empfohlen werden soll (bereits entschieden)
|
## Aufgeräumt am 20.08.2026
|
||||||
Cloud-Migration · Voll-Rewrite · schwere neue Frameworks · Engine-/Modell-Wechsel, die nicht in
|
- CI-Ampel wieder **grün** (Lauf #77) — zwei ungenutzte `MEM0_SERVICE_URL`-Importe entfernt.
|
||||||
124 GB passen · `frontend/dist` aus git nehmen (Absicht) · Security-Config anfassen. Erwünscht sind
|
- Kaputter systemd-Timer `mc2-morgen-digest` abgeschaltet (der Hermes-Cron macht die Arbeit).
|
||||||
**Bugs, Fragilität, tote Pfade, Sicherheitslücken, Vereinfachung (KISS/DRY), Wartbarkeit.**
|
- `mcp-stderr.log` (27 MB, 238k Ping-Zeilen) geleert.
|
||||||
|
- Config-Drift aufgelöst: Repo == `/etc/llama-swap/config.yaml`. Warm-Set-Idee geparkt auf
|
||||||
|
Branch `parked/warm-set-5d93822`.
|
||||||
|
- Entfernt: Governor-Reste, OpenCode-/aider-Reste (853 MB), 61 alte Backup-Dateien,
|
||||||
|
verwaiste Modelle Devstral-Small-2 + GLM-4.6V-Flash + mem0 (21,5 GB) → `/srv/models` 209 → 189 GB.
|
||||||
|
- **Fähigkeiten repariert:** `orchestrator`- und `wartung`-Skill sowie `fremdblick.sh` zeigten auf
|
||||||
|
gelöschte Modelle (`Qwen3-Coder-Next`, `GLM-4.6V-Flash`, `GLM-4.7-Flash`) → der Kritiker-Gate war
|
||||||
|
stumm kaputt. Jetzt auf **Rollen-Aliase** umgestellt, damit Modellwechsel sie nicht mehr brechen.
|
||||||
|
- Alles Gelöschte liegt gesichert in `~/archiv-aufraeumen-20260820/` (11 MB).
|
||||||
|
|
||||||
## Letzter Sicherungspunkt
|
## Offen
|
||||||
- git `ff1b9a0` „coder-lite raus + Verbinden-Tab auf echte Direkt-Modelle" (auf `main`, deployt, live).
|
- `mem0_service/` + `_mem0_reachable()` in `backend/routers/system.py` ausbauen (toter Port).
|
||||||
|
- `~/.hermes/scripts/fremdblick.sh` ist **unversioniert** — gehört ins Repo.
|
||||||
|
- MCP-Log dauerhaft deckeln (Hermes' `max_size_mb` greift für gekapertes stderr nicht).
|
||||||
|
- Verschwundene Wächter: Ampel-Wächter, Prüfstand, Stack-Rundumschlag.
|
||||||
|
- Coder-Tempo: Entwurfsmodelle für spekulatives Dekodieren liegen ungenutzt unter
|
||||||
|
`/srv/models/Qwen3.8-27B-DFlash2-GGUF/`.
|
||||||
|
|||||||
+8
-22
@@ -9,41 +9,38 @@ Server (proxyt /api hierher), daher CORS für localhost offen.
|
|||||||
import asyncio
|
import asyncio
|
||||||
import logging
|
import logging
|
||||||
import os
|
import os
|
||||||
|
from collections.abc import AsyncGenerator, Awaitable, Callable
|
||||||
from contextlib import asynccontextmanager
|
from contextlib import asynccontextmanager
|
||||||
from typing import Any, AsyncGenerator, Awaitable, Callable
|
from typing import Any
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import FRONTEND_DIST, V1_UPSTREAM, VERSION
|
||||||
from fastapi import FastAPI
|
from fastapi import FastAPI
|
||||||
from fastapi.middleware.cors import CORSMiddleware
|
from fastapi.middleware.cors import CORSMiddleware
|
||||||
from fastapi.responses import FileResponse
|
from fastapi.responses import FileResponse
|
||||||
from fastapi.staticfiles import StaticFiles
|
from fastapi.staticfiles import StaticFiles
|
||||||
from starlette.requests import Request
|
|
||||||
|
|
||||||
from config import FRONTEND_DIST, V1_UPSTREAM, VERSION
|
|
||||||
from routers import (
|
from routers import (
|
||||||
agent,
|
agent,
|
||||||
auftragsbuch,
|
|
||||||
chronik,
|
chronik,
|
||||||
connect,
|
connect,
|
||||||
console,
|
console,
|
||||||
eigenleben,
|
|
||||||
events,
|
events,
|
||||||
gateway_proxy,
|
gateway_proxy,
|
||||||
health,
|
health,
|
||||||
hermes_ui,
|
hermes_ui,
|
||||||
ideen,
|
ideen,
|
||||||
maintenance,
|
maintenance,
|
||||||
memory,
|
|
||||||
models,
|
models,
|
||||||
routing,
|
routing,
|
||||||
|
skills,
|
||||||
system,
|
system,
|
||||||
voice,
|
voice,
|
||||||
wissen,
|
wissen,
|
||||||
zeitmaschine,
|
zeitmaschine,
|
||||||
)
|
)
|
||||||
from routers import reminders as reminders_router
|
from routers import reminders as reminders_router
|
||||||
from services import memory as memory_svc
|
from services import metrics_history, reminders, sentry, warmer
|
||||||
from services import ketten_digest, metrics_history, reminders, sentry, warmer
|
from starlette.requests import Request
|
||||||
|
|
||||||
# Zentrales Logging — Level via MC_LOG_LEVEL (INFO default). Eine Konfiguration
|
# Zentrales Logging — Level via MC_LOG_LEVEL (INFO default). Eine Konfiguration
|
||||||
# für alle Module (logging.getLogger(__name__)).
|
# für alle Module (logging.getLogger(__name__)).
|
||||||
@@ -68,18 +65,8 @@ async def lifespan(app: FastAPI) -> AsyncGenerator[None, None]:
|
|||||||
if sentry.ENABLED:
|
if sentry.ENABLED:
|
||||||
tasks.append(asyncio.create_task(sentry.sentry_loop()))
|
tasks.append(asyncio.create_task(sentry.sentry_loop()))
|
||||||
tasks.append(asyncio.create_task(reminders.reminders_loop()))
|
tasks.append(asyncio.create_task(reminders.reminders_loop()))
|
||||||
if ketten_digest.ENABLED:
|
|
||||||
# Werkstatt-Status aufs Handy: Fragen sofort, Meilensteine sofort, sonst 60-min-Puls.
|
|
||||||
tasks.append(asyncio.create_task(ketten_digest.digest_loop()))
|
|
||||||
# 24-h-Metrik-Verlauf (Cockpit-Zeitachse): 10-s-Sampler, Ringpuffer, persistiert.
|
# 24-h-Metrik-Verlauf (Cockpit-Zeitachse): 10-s-Sampler, Ringpuffer, persistiert.
|
||||||
tasks.append(asyncio.create_task(metrics_history.sampler_loop()))
|
tasks.append(asyncio.create_task(metrics_history.sampler_loop()))
|
||||||
if memory_svc.AUTO_DEDUPE_ENABLED:
|
|
||||||
tasks.append(asyncio.create_task(memory_svc.auto_dedupe_loop()))
|
|
||||||
log.info(
|
|
||||||
"Mem0-Auto-Dedupe aktiv (alle %ss, Schwelle %s)",
|
|
||||||
memory_svc.AUTO_DEDUPE_INTERVAL,
|
|
||||||
memory_svc.AUTO_DEDUPE_THRESHOLD,
|
|
||||||
)
|
|
||||||
# Geteilter HTTP-Client zur lokalen Engine: Keep-Alive/Connection-Pooling statt neuer Client
|
# Geteilter HTTP-Client zur lokalen Engine: Keep-Alive/Connection-Pooling statt neuer Client
|
||||||
# pro /v1-Anfrage (spart Sockets/TIME_WAIT unter parallelen Agent-Strömen von Zed/Kilo).
|
# pro /v1-Anfrage (spart Sockets/TIME_WAIT unter parallelen Agent-Strömen von Zed/Kilo).
|
||||||
app.state.gw_client = httpx.AsyncClient(
|
app.state.gw_client = httpx.AsyncClient(
|
||||||
@@ -119,8 +106,8 @@ app.include_router(health.router)
|
|||||||
app.include_router(models.router)
|
app.include_router(models.router)
|
||||||
app.include_router(routing.router)
|
app.include_router(routing.router)
|
||||||
app.include_router(system.router)
|
app.include_router(system.router)
|
||||||
|
|
||||||
app.include_router(connect.router)
|
app.include_router(connect.router)
|
||||||
app.include_router(memory.router)
|
|
||||||
app.include_router(agent.router)
|
app.include_router(agent.router)
|
||||||
app.include_router(
|
app.include_router(
|
||||||
voice.router
|
voice.router
|
||||||
@@ -138,13 +125,12 @@ if V1_UPSTREAM:
|
|||||||
else:
|
else:
|
||||||
app.include_router(gateway_proxy.router) # OpenAI-kompatibler /v1-Gateway (model:auto)
|
app.include_router(gateway_proxy.router) # OpenAI-kompatibler /v1-Gateway (model:auto)
|
||||||
app.include_router(maintenance.router)
|
app.include_router(maintenance.router)
|
||||||
app.include_router(auftragsbuch.router) # Vorschlags-Inbox (Mensch-Gate als Klick)
|
|
||||||
app.include_router(ideen.router) # Ideen-Queue (natives Hermes-Kanban) — Tür der Zentrale
|
app.include_router(ideen.router) # Ideen-Queue (natives Hermes-Kanban) — Tür der Zentrale
|
||||||
app.include_router(chronik.router) # Timeline der autonomen Taten (Announce-Store)
|
app.include_router(chronik.router) # Timeline der autonomen Taten (Announce-Store)
|
||||||
app.include_router(eigenleben.router) # „Von allein": Skills + Vorschlags-Bilanz der Box
|
|
||||||
app.include_router(events.router) # SSE-Eventstrom /api/events (P3a) — Invalidation-Bus
|
app.include_router(events.router) # SSE-Eventstrom /api/events (P3a) — Invalidation-Bus
|
||||||
app.include_router(wissen.router) # Wissens-Vault (Traum-Notizen) read-only
|
app.include_router(wissen.router) # Wissens-Vault (Traum-Notizen) read-only
|
||||||
app.include_router(zeitmaschine.router) # Snapshots ansehen + Ein-Klick-Restore (detached)
|
app.include_router(zeitmaschine.router) # Snapshots ansehen + Ein-Klick-Restore (detached)
|
||||||
|
app.include_router(skills.router) # Skills & Jobs Dashboard
|
||||||
app.include_router(
|
app.include_router(
|
||||||
console.router
|
console.router
|
||||||
) # Box-Konsole (ttyd) same-origin durchreichen — VOR dem SPA-Catch-all
|
) # Box-Konsole (ttyd) same-origin durchreichen — VOR dem SPA-Catch-all
|
||||||
|
|||||||
+21
-13
@@ -19,20 +19,18 @@ MODELS_DIR = Path(os.environ.get("MC_MODELS_DIR", "/srv/models"))
|
|||||||
# Persistent neben den Modellen (übersteht Deploys). TTL = Frische-Fenster.
|
# Persistent neben den Modellen (übersteht Deploys). TTL = Frische-Fenster.
|
||||||
DISCOVER_CACHE_PATH = Path(os.environ.get("MC_DISCOVER_CACHE", str(MODELS_DIR / "mc2-discover.json")))
|
DISCOVER_CACHE_PATH = Path(os.environ.get("MC_DISCOVER_CACHE", str(MODELS_DIR / "mc2-discover.json")))
|
||||||
DISCOVER_TTL = int(os.environ.get("MC_DISCOVER_TTL", "43200")) # 12 h
|
DISCOVER_TTL = int(os.environ.get("MC_DISCOVER_TTL", "43200")) # 12 h
|
||||||
# Geteiltes Gedächtnis (SQLite, WAL). Persistent neben den Modellen.
|
# Gedächtnis: MC2 hält KEINS mehr. Bis August 2026 lief hier erst eine eigene SQLite-DB,
|
||||||
# Hinweis: nur noch für die einmalige Mem0-Migration relevant — das aktive Gedächtnis
|
# dann ein semantischer Sidecar auf :8765 — beides ist abgelöst, der Port ist tot.
|
||||||
# liegt jetzt in Mem0/Chroma hinter dem Sidecar (siehe MEM0_SERVICE_URL).
|
# Einzige Gedächtnis-Wahrheit ist jetzt Hermes selbst (HERMES_API_URL, siehe unten).
|
||||||
MEMORY_DB = Path(os.environ.get("MC_MEMORY_DB", str(MODELS_DIR / "mc2-memory.db")))
|
|
||||||
# Mem0-Sidecar (auto-lernendes, semantisches Gedächtnis). Läuft im ~/.mem0/venv (Python 3.12),
|
|
||||||
# weil mem0+chromadb unter dem 3.14-Backend nicht laufen. MC2 spricht ihn lokal per HTTP an.
|
|
||||||
MEM0_SERVICE_URL = os.environ.get("MC_MEM0_SERVICE_URL", "http://127.0.0.1:8765").rstrip("/")
|
|
||||||
# Befehl-Vorlage für llama-swap: {model}=GGUF-Pfad, {ctx}=Kontext, ${PORT} bleibt stehen.
|
# Befehl-Vorlage für llama-swap: {model}=GGUF-Pfad, {ctx}=Kontext, ${PORT} bleibt stehen.
|
||||||
# Hinweis: --prompt-cache/--prompt-cache-all sind llama-CLI-Flags, NICHT llama-server —
|
# Hinweis: --prompt-cache/--prompt-cache-all sind llama-CLI-Flags, NICHT llama-server —
|
||||||
# llama-server lehnt sie ab ("invalid argument") und startet dann nicht. Prompt-Caching
|
# llama-server lehnt sie ab ("invalid argument") und startet dann nicht. Prompt-Caching
|
||||||
# macht llama-server ohnehin automatisch pro Slot (KV-Reuse).
|
# macht llama-server ohnehin automatisch pro Slot (KV-Reuse).
|
||||||
|
# --load-mode none = das frühere --no-mmap; das alte Flag ist seit llama.cpp b10936 weg
|
||||||
|
# ("invalid argument", jedes Modell stirbt beim Start — gelernt 13./17.09.2026).
|
||||||
_DEFAULT_CMD_TEMPLATE = (
|
_DEFAULT_CMD_TEMPLATE = (
|
||||||
"llama-server -m {model} --host 127.0.0.1 --port ${PORT} "
|
"llama-server -m {model} --host 127.0.0.1 --port ${PORT} "
|
||||||
"-c {ctx} -ngl 999 -fa on --no-mmap"
|
"-c {ctx} -ngl 999 -fa on --load-mode none"
|
||||||
)
|
)
|
||||||
CMD_TEMPLATE = os.environ.get("MC_CMD_TEMPLATE", _DEFAULT_CMD_TEMPLATE)
|
CMD_TEMPLATE = os.environ.get("MC_CMD_TEMPLATE", _DEFAULT_CMD_TEMPLATE)
|
||||||
if "{model}" not in CMD_TEMPLATE:
|
if "{model}" not in CMD_TEMPLATE:
|
||||||
@@ -72,7 +70,7 @@ V1_UPSTREAM = os.environ.get("MC_V1_UPSTREAM", "").rstrip("/")
|
|||||||
HERMES_API_URL = os.environ.get("HERMES_API_URL", "http://127.0.0.1:8642").rstrip("/")
|
HERMES_API_URL = os.environ.get("HERMES_API_URL", "http://127.0.0.1:8642").rstrip("/")
|
||||||
# API-Key der Hermes-`api_server`-Plattform (~/.hermes/.env: API_SERVER_KEY). Nötig für
|
# API-Key der Hermes-`api_server`-Plattform (~/.hermes/.env: API_SERVER_KEY). Nötig für
|
||||||
# /v1/chat/completions (Voice-Pipeline) — Bearer-Auth, sonst 401. Derselbe volle Agent
|
# /v1/chat/completions (Voice-Pipeline) — Bearer-Auth, sonst 401. Derselbe volle Agent
|
||||||
# (Tools + geteiltes Mem0) wie CLI/Telegram, nur über HTTP.
|
# (Tools + eigenes Gedächtnis) wie CLI/Telegram, nur über HTTP.
|
||||||
def _read_hermes_env(key: str) -> str:
|
def _read_hermes_env(key: str) -> str:
|
||||||
"""Liest einen Schlüssel aus ~/.hermes/.env (Fallback, falls nicht in der Prozess-Env).
|
"""Liest einen Schlüssel aus ~/.hermes/.env (Fallback, falls nicht in der Prozess-Env).
|
||||||
Der MC2-Dienst erbt die Hermes-Secrets sonst nicht."""
|
Der MC2-Dienst erbt die Hermes-Secrets sonst nicht."""
|
||||||
@@ -97,8 +95,14 @@ HERMES_API_KEY = (
|
|||||||
HERMES_API_MODEL = os.environ.get("HERMES_API_MODEL", "hermes")
|
HERMES_API_MODEL = os.environ.get("HERMES_API_MODEL", "hermes")
|
||||||
|
|
||||||
# --- Voice-Sidecar (STT faster-whisper + TTS Piper/Chatterbox) ---------------
|
# --- Voice-Sidecar (STT faster-whisper + TTS Piper/Chatterbox) ---------------
|
||||||
# Eigenes Python-3.12-venv (~/.voice/venv), analog Mem0-Sidecar. MC2 proxyt nach außen.
|
# Eigenes Python-3.12-venv (~/.voice/venv), weil Parakeet/Piper nicht ins 3.14-Backend-venv
|
||||||
|
# passen. MC2 proxyt nach außen.
|
||||||
VOICE_SERVICE_URL = os.environ.get("MC_VOICE_SERVICE_URL", "http://127.0.0.1:8650").rstrip("/")
|
VOICE_SERVICE_URL = os.environ.get("MC_VOICE_SERVICE_URL", "http://127.0.0.1:8650").rstrip("/")
|
||||||
|
# --- Lucys Stimme (lucy-stimme.service, pocket-tts german_24l, Klon aus ref.mp3) -----------
|
||||||
|
# Eigener User-Dienst in ~/.lucy-stimme (nur Loopback :8021). Spricht die Telegram-Sprachnachrichten
|
||||||
|
# UND — seit dem Raphael-Umbau der Desktop-Lucy (04.09.2026) — auch den PC: MC2 reicht ihn unter
|
||||||
|
# /api/lucy/stimme/* ins LAN (routers/voice.py). EINE Stimme für alle Türen. :8650 ist NICHT Lucy.
|
||||||
|
LUCY_STIMME_URL = os.environ.get("MC_LUCY_STIMME_URL", "http://127.0.0.1:8021").rstrip("/")
|
||||||
# Box-Konsole: ttyd-Web-Terminal (echte Login-Shell). Bindet NUR an Loopback
|
# Box-Konsole: ttyd-Web-Terminal (echte Login-Shell). Bindet NUR an Loopback
|
||||||
# (127.0.0.1:7682, base-path /console) und wird von MC2 über den ohnehin offenen Port 9001
|
# (127.0.0.1:7682, base-path /console) und wird von MC2 über den ohnehin offenen Port 9001
|
||||||
# rückwärts geproxyt (routers/console.py → same-origin /console/). So braucht die Konsole
|
# rückwärts geproxyt (routers/console.py → same-origin /console/). So braucht die Konsole
|
||||||
@@ -108,8 +112,12 @@ BOX_CONSOLE_UPSTREAM = os.environ.get("MC_BOX_CONSOLE_UPSTREAM", "http://127.0.0
|
|||||||
# Öffentlicher, gleicher-Ursprung-Pfad, unter dem MC2 die Konsole ausliefert (iframe-Ziel).
|
# Öffentlicher, gleicher-Ursprung-Pfad, unter dem MC2 die Konsole ausliefert (iframe-Ziel).
|
||||||
BOX_CONSOLE_PATH = "/console/"
|
BOX_CONSOLE_PATH = "/console/"
|
||||||
# Eingebaute Hermes-Web-GUI (`hermes serve`/`dashboard` — die richtige Agent-Oberfläche mit
|
# Eingebaute Hermes-Web-GUI (`hermes serve`/`dashboard` — die richtige Agent-Oberfläche mit
|
||||||
# Threads/Tool-Calls, die auch die Electron-Desktop-App umhüllt). Bindet NUR an Loopback
|
# Threads/Tool-Calls, die auch die Electron-Desktop-App umhüllt). ‼️ Sie bindet NICHT auf Loopback:
|
||||||
# (127.0.0.1:9119, kein Login — LAN-Trust wie Terminal/Konsole) und wird von MC2 same-origin unter
|
# ein systemd-Drop-in überschreibt `--host 127.0.0.1` mit `0.0.0.0` und setzt dafür ein
|
||||||
|
# Session-Token. Dass sie trotzdem nicht im LAN hängt, liegt allein an ufw (9119 ist nicht
|
||||||
|
# freigegeben — am 27.08.2026 von einem zweiten Rechner aus gegengeprüft). Wer die Firewall
|
||||||
|
# anfasst, öffnet damit auch diese Oberfläche. MC2 erreicht sie über Loopback und reicht sie
|
||||||
|
# same-origin unter
|
||||||
# /hermes-ui/ durchgereicht (routers/hermes_ui.py). Anders als das ttyd-Terminal ist es eine volle
|
# /hermes-ui/ durchgereicht (routers/hermes_ui.py). Anders als das ttyd-Terminal ist es eine volle
|
||||||
# SPA → das Bundle wird mit Vite-base=/hermes-ui/ gebaut, damit Assets/API/WS unter dem Präfix
|
# SPA → das Bundle wird mit Vite-base=/hermes-ui/ gebaut, damit Assets/API/WS unter dem Präfix
|
||||||
# liegen; der Proxy streift /hermes-ui ab. Kein eigener Firewall-Port nötig.
|
# liegen; der Proxy streift /hermes-ui ab. Kein eigener Firewall-Port nötig.
|
||||||
@@ -119,7 +127,7 @@ HERMES_BUILTIN_UI_PATH = "/hermes-ui/"
|
|||||||
HERMES_AGENT_REPO = os.environ.get("MC_HERMES_AGENT_REPO", "NousResearch/hermes-agent")
|
HERMES_AGENT_REPO = os.environ.get("MC_HERMES_AGENT_REPO", "NousResearch/hermes-agent")
|
||||||
HERMES_HOME = Path(os.path.expanduser(os.environ.get("HERMES_HOME", "~/.hermes")))
|
HERMES_HOME = Path(os.path.expanduser(os.environ.get("HERMES_HOME", "~/.hermes")))
|
||||||
# PC Executor — läuft auf dem Windows-PC, erreichbar über LAN.
|
# PC Executor — läuft auf dem Windows-PC, erreichbar über LAN.
|
||||||
PC_EXECUTOR_URL = os.environ.get("MC_PC_EXECUTOR_URL", "http://192.168.178.98:7777").rstrip("/")
|
PC_EXECUTOR_URL = os.environ.get("MC_PC_EXECUTOR_URL", "http://192.168.178.22:7777").rstrip("/") # PC-IP seit 09/2026 .22 (vorher .98)
|
||||||
|
|
||||||
# --- Server ------------------------------------------------------------------
|
# --- Server ------------------------------------------------------------------
|
||||||
HOST = os.environ.get("MC_HOST", "0.0.0.0")
|
HOST = os.environ.get("MC_HOST", "0.0.0.0")
|
||||||
|
|||||||
@@ -15,13 +15,12 @@ durchreicht (routers/gateway_forward.py, MC_V1_UPSTREAM).
|
|||||||
|
|
||||||
import logging
|
import logging
|
||||||
import os
|
import os
|
||||||
|
from collections.abc import AsyncGenerator
|
||||||
from contextlib import asynccontextmanager
|
from contextlib import asynccontextmanager
|
||||||
from typing import AsyncGenerator
|
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
from fastapi import FastAPI, Request
|
|
||||||
|
|
||||||
from config import LLAMA_SWAP_URL, VERSION
|
from config import LLAMA_SWAP_URL, VERSION
|
||||||
|
from fastapi import FastAPI, Request
|
||||||
from routers import gateway_proxy
|
from routers import gateway_proxy
|
||||||
|
|
||||||
logging.basicConfig(
|
logging.basicConfig(
|
||||||
|
|||||||
@@ -4,8 +4,9 @@ from pathlib import Path
|
|||||||
# Add backend directory to sys.path so we can import services
|
# Add backend directory to sys.path so we can import services
|
||||||
sys.path.append(str(Path(__file__).resolve().parent))
|
sys.path.append(str(Path(__file__).resolve().parent))
|
||||||
|
|
||||||
from services.llamaswap import read_config, write_config, spec_draft_flags, _PATH_RE
|
|
||||||
from config import CONFIG_PATH
|
from config import CONFIG_PATH
|
||||||
|
from services.llamaswap import _PATH_RE, read_config, spec_draft_flags, write_config
|
||||||
|
|
||||||
|
|
||||||
def migrate():
|
def migrate():
|
||||||
print(f"Reading config from {CONFIG_PATH}...")
|
print(f"Reading config from {CONFIG_PATH}...")
|
||||||
|
|||||||
@@ -2,6 +2,16 @@
|
|||||||
"_comment": "Kuratierter Modell-Katalog (Cookbook) für Strix Halo / Ryzen AI MAX+ 395 — 128GB unified, bandbreiten-limitiert (256 GB/s). MoE-first. EINE Quelle der Wahrheit für KORREKTE Metadaten (total/active params, moe, generation) → präzise Empfehlungen ohne Namens-Raterei. Inspiriert vom Odysseus-Cookbook (statischer, validierter Katalog statt Live-Scraping). Erweiterbar: neue Modelle hier eintragen. Felder: name (Match-Identifier), repo (HF org/name für Install), family (+Subtyp), generation (numerisch, für Upgrade-Vergleich), total_params_b, active_params_b (=total bei dense), moe, quant, ctx (empfohlen), tools, vision.",
|
"_comment": "Kuratierter Modell-Katalog (Cookbook) für Strix Halo / Ryzen AI MAX+ 395 — 128GB unified, bandbreiten-limitiert (256 GB/s). MoE-first. EINE Quelle der Wahrheit für KORREKTE Metadaten (total/active params, moe, generation) → präzise Empfehlungen ohne Namens-Raterei. Inspiriert vom Odysseus-Cookbook (statischer, validierter Katalog statt Live-Scraping). Erweiterbar: neue Modelle hier eintragen. Felder: name (Match-Identifier), repo (HF org/name für Install), family (+Subtyp), generation (numerisch, für Upgrade-Vergleich), total_params_b, active_params_b (=total bei dense), moe, quant, ctx (empfohlen), tools, vision.",
|
||||||
"version": "2026-07-03",
|
"version": "2026-07-03",
|
||||||
"models": [
|
"models": [
|
||||||
|
{
|
||||||
|
"role": "debugger", "name": "Muse-Glimmer-30B", "repo": "unsloth/Muse-Glimmer-30B-GGUF",
|
||||||
|
"family": "muse", "generation": 1.0, "total_params_b": 30, "active_params_b": 30,
|
||||||
|
"moe": false, "quant": "Q4_K_XL", "ctx": 65536, "tools": true, "vision": true
|
||||||
|
},
|
||||||
|
{
|
||||||
|
"role": "coder", "name": "Qwen3.8-27B", "repo": "unsloth/Qwen3.8-27B-GGUF",
|
||||||
|
"family": "qwen", "generation": 3.8, "total_params_b": 27, "active_params_b": 27,
|
||||||
|
"moe": false, "quant": "Q4_K_M", "ctx": 65536, "tools": true, "vision": true
|
||||||
|
},
|
||||||
{
|
{
|
||||||
"role": "fast", "name": "Qwen3.6-35B-A3B", "repo": "Qwen/Qwen3.6-35B-A3B-GGUF",
|
"role": "fast", "name": "Qwen3.6-35B-A3B", "repo": "Qwen/Qwen3.6-35B-A3B-GGUF",
|
||||||
"family": "qwen", "generation": 3.6, "total_params_b": 35, "active_params_b": 3,
|
"family": "qwen", "generation": 3.6, "total_params_b": 35, "active_params_b": 3,
|
||||||
@@ -55,6 +65,17 @@
|
|||||||
"role": "scout", "name": "GLM-4.6V-Flash", "repo": "ggml-org/GLM-4.6V-Flash-GGUF",
|
"role": "scout", "name": "GLM-4.6V-Flash", "repo": "ggml-org/GLM-4.6V-Flash-GGUF",
|
||||||
"family": "glm", "generation": 4.6, "total_params_b": 9, "active_params_b": 3,
|
"family": "glm", "generation": 4.6, "total_params_b": 9, "active_params_b": 3,
|
||||||
"moe": true, "quant": "Q4_K_M", "ctx": 32768, "tools": true, "vision": true
|
"moe": true, "quant": "Q4_K_M", "ctx": 32768, "tools": true, "vision": true
|
||||||
|
},
|
||||||
|
|
||||||
|
{
|
||||||
|
"role": "kritiker", "name": "Devstral-Small-2-24B", "repo": "mistralai/Devstral-Small-2-24B-Instruct-2512",
|
||||||
|
"family": "mistral-devstral", "generation": 2.0, "total_params_b": 24, "active_params_b": 24,
|
||||||
|
"moe": false, "quant": "Q4_K_M", "ctx": 65536, "tools": true, "vision": false
|
||||||
|
},
|
||||||
|
{
|
||||||
|
"role": "kritiker", "name": "GLM-4.7-Flash", "repo": "zai-org/GLM-4.7-Flash",
|
||||||
|
"family": "glm", "generation": 4.7, "total_params_b": 30, "active_params_b": 3,
|
||||||
|
"moe": true, "quant": "Q4_K_XL", "ctx": 65536, "tools": true, "vision": false
|
||||||
}
|
}
|
||||||
]
|
]
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -1,10 +1,8 @@
|
|||||||
"""Agent-Endpoint: Hermes-Status + WebUI-Link (MC verlinkt nur, betreibt nicht)."""
|
"""Agent-Endpoint: Hermes-Status + WebUI-Link (MC verlinkt nur, betreibt nicht)."""
|
||||||
|
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
from services import agent_aktivitaet
|
||||||
from fastapi import HTTPException
|
|
||||||
|
|
||||||
from services.agent import agent_status, hermes_brain_info, set_agent_brain, update_brain_model
|
from services.agent import agent_status, hermes_brain_info, set_agent_brain, update_brain_model
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
@@ -42,3 +40,13 @@ def set_brain(body: SetBrainReq) -> dict:
|
|||||||
def set_brain_model(body: BrainReq) -> dict:
|
def set_brain_model(body: BrainReq) -> dict:
|
||||||
ok = update_brain_model(body.model)
|
ok = update_brain_model(body.model)
|
||||||
return {"ok": ok}
|
return {"ok": ok}
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/agent/aktivitaet")
|
||||||
|
def aktivitaet(limit: int = 60) -> dict:
|
||||||
|
"""Werkzeug-Verlauf des Agenten (v3-Umbau P6).
|
||||||
|
|
||||||
|
Gelesen aus Hermes' eigenem Log — MC2 patcht dort nichts, es schaut nur zu. Was
|
||||||
|
NICHT drin steht (Denkstrom, Werkzeug-Argumente), verspricht die Ansicht auch nicht.
|
||||||
|
"""
|
||||||
|
return agent_aktivitaet.uebersicht(max(1, min(limit, 300)))
|
||||||
|
|||||||
@@ -1,64 +0,0 @@
|
|||||||
"""Auftragsbuch-Endpoints (Vorschlags-Inbox) — dünner REST-Layer über services/auftragsbuch.py.
|
|
||||||
LAN-only wie alle MC2-Endpoints; das Gate ist der Klick des Commanders."""
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from services import auftragsbuch
|
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
|
||||||
|
|
||||||
|
|
||||||
class BranchIn(BaseModel):
|
|
||||||
branch: str
|
|
||||||
repo: str = "mc2" # "mc2" (Box-Stack) oder "lucy" (Desktop-App, Annahme baut am PC)
|
|
||||||
grund: str = "" # nur beim Ablehnen: optionaler Grund → Lern-Gedächtnis des Kreislaufs
|
|
||||||
|
|
||||||
|
|
||||||
class KandidatIn(BaseModel):
|
|
||||||
file: str
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/auftragsbuch")
|
|
||||||
def list_proposals() -> dict:
|
|
||||||
return auftragsbuch.list_proposals()
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/auftragsbuch/diff")
|
|
||||||
def diff(branch: str, repo: str = "mc2") -> dict:
|
|
||||||
res = auftragsbuch.diff_of(branch, repo)
|
|
||||||
if not res.get("ok"):
|
|
||||||
raise HTTPException(400, res.get("error", "Diff nicht verfügbar."))
|
|
||||||
return res
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/auftragsbuch/annehmen")
|
|
||||||
def accept(body: BranchIn) -> dict:
|
|
||||||
res = auftragsbuch.accept(body.branch, body.repo)
|
|
||||||
if not res.get("ok"):
|
|
||||||
raise HTTPException(400, res.get("error", "Annehmen fehlgeschlagen."))
|
|
||||||
return res
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/auftragsbuch/ablehnen")
|
|
||||||
def reject(body: BranchIn) -> dict:
|
|
||||||
res = auftragsbuch.reject(body.branch, body.repo, body.grund)
|
|
||||||
if not res.get("ok"):
|
|
||||||
raise HTTPException(400, res.get("error", "Ablehnen fehlgeschlagen."))
|
|
||||||
return res
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/auftragsbuch/skill/annehmen")
|
|
||||||
def skill_accept(body: KandidatIn) -> dict:
|
|
||||||
res = auftragsbuch.skill_accept(body.file)
|
|
||||||
if not res.get("ok"):
|
|
||||||
raise HTTPException(400, res.get("error", "Beauftragen fehlgeschlagen."))
|
|
||||||
return res
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/auftragsbuch/skill/ablehnen")
|
|
||||||
def skill_reject(body: KandidatIn) -> dict:
|
|
||||||
res = auftragsbuch.skill_reject(body.file)
|
|
||||||
if not res.get("ok"):
|
|
||||||
raise HTTPException(400, res.get("error", "Verwerfen fehlgeschlagen."))
|
|
||||||
return res
|
|
||||||
@@ -1,12 +1,10 @@
|
|||||||
"""Chronik — die lesbare Timeline dessen, was die Box von allein getan und gemeldet hat.
|
"""Chronik — die lesbare Timeline dessen, was die Box von allein getan und gemeldet hat.
|
||||||
Quelle ist der persistente Melde-Briefkasten (services/announce.py): Health-Wächter,
|
Quelle ist der persistente Melde-Briefkasten (services/announce.py): Health-Wächter,
|
||||||
Auto-Updates, Erinnerungen, Radar/Traum/Chef-Gutachter-Crons, Auftragsbuch — alle
|
Auto-Updates, Erinnerungen, Radar/Traum/Chef-Gutachter-Crons — alle
|
||||||
autonomen Kanäle laufen dort bereits durch. Hier wird nichts Neues erhoben, nur erzählt."""
|
autonomen Kanäle laufen dort bereits durch. Hier wird nichts Neues erhoben, nur erzählt."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import announce
|
from services import announce
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -1,21 +1,17 @@
|
|||||||
"""Connect-Endpoint: erzeugt IDE-/Agent-Snippets (auf den Gateway + Memory-MCP)."""
|
"""Connect-Endpoint: erzeugt IDE-/Agent-Snippets für den Gateway."""
|
||||||
|
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter
|
||||||
|
|
||||||
from services.connect import DEFAULT_HOST, build_snippets, check_health
|
from services.connect import DEFAULT_HOST, build_snippets, check_health
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
|
|
||||||
@router.get("/connect")
|
@router.get("/connect")
|
||||||
def connect(host: str = DEFAULT_HOST, mcp_path: str | None = None) -> dict:
|
def connect(host: str = DEFAULT_HOST) -> dict:
|
||||||
kwargs = {}
|
return build_snippets(host=host)
|
||||||
if mcp_path:
|
|
||||||
kwargs["mcp_script_path"] = mcp_path
|
|
||||||
return build_snippets(host=host, **kwargs)
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/connect/health")
|
@router.get("/connect/health")
|
||||||
def connect_health() -> dict:
|
def connect_health() -> dict:
|
||||||
"""Live-Status der zwei Leitungen (Gateway + Gedächtnis) für den Verbinden-Tab."""
|
"""Live-Status der drei Leitungen (Gateway, Gedächtnis, Desktop-Gateway) für den Verbinden-Tab."""
|
||||||
return check_health()
|
return check_health()
|
||||||
|
|||||||
@@ -14,11 +14,10 @@ import logging
|
|||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import websockets
|
import websockets
|
||||||
|
from config import BOX_CONSOLE_UPSTREAM
|
||||||
from fastapi import APIRouter, Request, WebSocket
|
from fastapi import APIRouter, Request, WebSocket
|
||||||
from starlette.responses import Response
|
from starlette.responses import Response
|
||||||
|
|
||||||
from config import BOX_CONSOLE_UPSTREAM
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
router = APIRouter()
|
router = APIRouter()
|
||||||
|
|
||||||
@@ -28,7 +27,7 @@ def _register(base: str, upstream: str) -> None:
|
|||||||
ws_upstream = upstream.replace("http://", "ws://").replace("https://", "wss://")
|
ws_upstream = upstream.replace("http://", "ws://").replace("https://", "wss://")
|
||||||
|
|
||||||
@router.websocket(f"/{base}/ws")
|
@router.websocket(f"/{base}/ws")
|
||||||
async def _proxy_ws(ws: WebSocket) -> None: # noqa: ANN001 — Closure je base
|
async def _proxy_ws(ws: WebSocket) -> None:
|
||||||
await ws.accept(subprotocol="tty")
|
await ws.accept(subprotocol="tty")
|
||||||
try:
|
try:
|
||||||
async with websockets.connect(
|
async with websockets.connect(
|
||||||
|
|||||||
@@ -1,56 +0,0 @@
|
|||||||
"""Eigenleben-Endpoints — „Von allein“-Ansicht (Skills + Vorschlags-Bilanz), read-only."""
|
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
|
||||||
|
|
||||||
from services import eigenleben
|
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
|
||||||
|
|
||||||
|
|
||||||
class SkillItem(BaseModel):
|
|
||||||
id: str
|
|
||||||
name: str
|
|
||||||
kategorie: str | None
|
|
||||||
aktiv: bool | None
|
|
||||||
beschreibung: str
|
|
||||||
version: str
|
|
||||||
autor: str
|
|
||||||
herkunft: str
|
|
||||||
herkunft_label: str
|
|
||||||
genutzt: int
|
|
||||||
zuletzt_genutzt: str | None
|
|
||||||
erstellt: str | None
|
|
||||||
status: str
|
|
||||||
geaendert: float
|
|
||||||
|
|
||||||
|
|
||||||
class EigenlebenOverviewResponse(BaseModel):
|
|
||||||
available: bool
|
|
||||||
skills: list[SkillItem]
|
|
||||||
selbst_erstellt: int
|
|
||||||
bilanz: dict
|
|
||||||
|
|
||||||
|
|
||||||
class SkillTextResponse(BaseModel):
|
|
||||||
id: str
|
|
||||||
text: str
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/eigenleben", response_model=EigenlebenOverviewResponse)
|
|
||||||
def get_overview() -> dict:
|
|
||||||
return eigenleben.overview()
|
|
||||||
|
|
||||||
|
|
||||||
# :path — Kategorie-Skills haben einen Schrägstrich in der ID (autonomous-ai-agents/
|
|
||||||
# hermes-agent). Als normales {skill_id}-Segment matcht die Route dann nicht, der Request
|
|
||||||
# fällt in den SPA-Fallback (index.html, Status 200) und die UI zeigt „Konnte den
|
|
||||||
# Skill-Text nicht laden". Die Pfad-Validierung (max. eine Ebene, keine . /..) macht
|
|
||||||
# services.eigenleben.skill_text.
|
|
||||||
@router.get("/eigenleben/skill/{skill_id:path}", response_model=SkillTextResponse)
|
|
||||||
def get_skill(skill_id: str) -> dict:
|
|
||||||
text = eigenleben.skill_text(skill_id)
|
|
||||||
if text is None:
|
|
||||||
raise HTTPException(404, "Skill nicht gefunden.")
|
|
||||||
return {"id": skill_id, "text": text}
|
|
||||||
+79
-34
@@ -1,25 +1,30 @@
|
|||||||
"""SSE-Eventstrom (UMBAU v3 P3a) — ein Kanal sagt der Zentrale, WANN neu laden lohnt.
|
"""Ereignisstrom — ein Kanal sagt der Zentrale, WANN neu laden lohnt, und schickt Metriken.
|
||||||
|
|
||||||
GET /api/events liefert Server-Sent Events. Ein Sammler prüft alle paar Sekunden
|
Zwei Endpunkte, ein Sammler:
|
||||||
billige Fingerabdrücke der ereignishaften Quellen und schickt NUR bei Änderung ein
|
|
||||||
`invalidate`-Event mit den React-Query-Keys. Die Wahrheit bleibt in den bestehenden
|
|
||||||
Endpunkten — der Strom ist ein reiner Invalidation-Bus, kein zweites Zustandsmodell.
|
|
||||||
|
|
||||||
Quellen: Briefkasten/Chronik (in-process-Cursor), Ideen-Queue ((id,status)-Paare),
|
GET /api/stream (v3-Umbau P4, 28.08.2026) — der aktuelle Kanal. Zwei Ereignisarten:
|
||||||
Auftragsbuch + Erinnerungen (Datei-mtimes), geladene Modelle (Running-Set — Idee aus
|
· `invalidate` Nur bei Änderung, mit den betroffenen React-Query-Schlüsseln.
|
||||||
der Werkstatt-Karte feature/sse-backend-v1). BEWUSST NICHT dabei: System-/Token-
|
· `metrik` Jede Sekunde ein Messpunkt (CPU/RAM/GPU/Temp/Token-Zähler).
|
||||||
Metriken (ändern sich jede Sekunde — da ist Polling das richtige Werkzeug und ein
|
|
||||||
invalidate-Event nur Lärm).
|
|
||||||
|
|
||||||
Versöhnt 15.07. abends: Die angenommene Werkstatt-Version nutzte `type:` statt
|
GET /api/events — der alte Kanal, nur `invalidate`. Bleibt EINE Fassung lang stehen,
|
||||||
`event:` (ungültiges SSE-Framing → EventSource-Listener feuert NIE), einen globalen
|
weil ein Browser-Tab nach einem Deploy noch das vorige Bündel halten kann und dieses
|
||||||
Snapshot über alle Clients und einen nicht existierenden Ideen-Endpunkt — Kern
|
nur `/api/events` kennt. Danach entfernen.
|
||||||
wieder die getestete Hand-Implementierung (E2E: Announce → invalidate binnen
|
|
||||||
Sekunden), Modell-Quelle aus der Karte übernommen.
|
|
||||||
|
|
||||||
Frontend-Gegenstück: frontend/src/lib/events.ts (EventSource, invalidiert die
|
WARUM METRIKEN JETZT MITKOMMEN: Bis P4 pollte das Frontend `/api/system/status` und
|
||||||
Caches, entspannt die Fallback-Poller ×5; reißt der Strom, reconnectet EventSource
|
`/api/system/token-stats` im 3-Sekunden-Takt — zwei Dauer-Anfragen, unabhängig davon, ob
|
||||||
selbst und bis dahin pollt die UI wie bisher).
|
sich etwas geändert hat, plus sechs weitere langsamere Poller auf der Startseite. Der
|
||||||
|
Messpunkt kostet hier 0,2 ms (gemessen); `system_status()` würde 100 ms kosten, weil
|
||||||
|
`psutil.cpu_percent(interval=0.1)` wartet. Deshalb der eigene, leichte `metrik_punkt()`.
|
||||||
|
|
||||||
|
WAS BEWUSST NICHT DRIN IST: Ein `agent`-Thema für Lucys Denkschritte. MC2 kann Hermes'
|
||||||
|
interne Schritte nicht sehen, ohne dessen Quellcode zu patchen — und das ist per AGENTS.md
|
||||||
|
verboten. Eine leere Leitung zu bauen, wäre eine Zusage, die keiner einlöst.
|
||||||
|
|
||||||
|
Die Wahrheit bleibt in den bestehenden Endpunkten: `invalidate` ist ein reiner
|
||||||
|
Anstoß-Bus, kein zweites Zustandsmodell. `metrik` ist die einzige Ausnahme — es ist der
|
||||||
|
Wert selbst, weil ein Anstoß für eine Zahl, die sich jede Sekunde ändert, nur Lärm wäre.
|
||||||
|
|
||||||
|
Frontend-Gegenstück: frontend/src/lib/events.ts
|
||||||
"""
|
"""
|
||||||
|
|
||||||
import asyncio
|
import asyncio
|
||||||
@@ -27,16 +32,16 @@ import json
|
|||||||
import logging
|
import logging
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
from config import MODELS_DIR
|
||||||
from fastapi import APIRouter, Request
|
from fastapi import APIRouter, Request
|
||||||
from fastapi.responses import StreamingResponse
|
from fastapi.responses import StreamingResponse
|
||||||
|
|
||||||
from config import MODELS_DIR
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
TICK_S = 3.0 # Prüf-Takt des Sammlers (nur Fingerabdrücke, kein Neuberechnen)
|
METRIK_S = 1.0 # Takt der Messpunkte
|
||||||
|
ABDRUCK_S = 3.0 # Takt der Änderungs-Prüfung (nur Fingerabdrücke, kein Neuberechnen)
|
||||||
KEEPALIVE_S = 20.0 # Kommentar-Ping, damit Proxies/Browser die Verbindung halten
|
KEEPALIVE_S = 20.0 # Kommentar-Ping, damit Proxies/Browser die Verbindung halten
|
||||||
|
|
||||||
|
|
||||||
@@ -67,35 +72,75 @@ def _fingerprints() -> dict[str, object]:
|
|||||||
fp["models"] = json.dumps(sorted(str(m) for m in llamaswap.get_running_models()))
|
fp["models"] = json.dumps(sorted(str(m) for m in llamaswap.get_running_models()))
|
||||||
except Exception:
|
except Exception:
|
||||||
pass
|
pass
|
||||||
# Auftragsbuch (Annahme-Status + Karten-Meldungen) & Erinnerungen: Datei-mtimes
|
try: # Jobs (Downloads, Wartung): Zustand + Fortschritt — spart den 3-s-Poller der Schublade
|
||||||
fp["auftragsbuch"] = (_mtime(MODELS_DIR / "mc2-auftragsbuch.json"),
|
from services import jobengine
|
||||||
_mtime(MODELS_DIR / "mc2-announce-branches.json"))
|
fp["jobs"] = json.dumps(
|
||||||
|
[(j.get("id"), j.get("state"), j.get("progress")) for j in jobengine.public_jobs()]
|
||||||
|
)
|
||||||
|
except Exception:
|
||||||
|
pass
|
||||||
|
# Erinnerungen: Datei-mtime (das Auftragsbuch ist seit 04.09.2026 ausgebaut)
|
||||||
fp["reminders"] = _mtime(MODELS_DIR / "mc2-reminders.json")
|
fp["reminders"] = _mtime(MODELS_DIR / "mc2-reminders.json")
|
||||||
return fp
|
return fp
|
||||||
|
|
||||||
|
|
||||||
@router.get("/events")
|
async def _strom(request: Request, mit_metrik: bool):
|
||||||
async def events(request: Request) -> StreamingResponse:
|
"""Gemeinsamer Kern beider Endpunkte.
|
||||||
async def strom():
|
|
||||||
# Basislinie JE VERBINDUNG (der Client hat beim Verbinden frisch geladen) —
|
Die Basislinie entsteht JE VERBINDUNG (der Client hat beim Verbinden frisch geladen) —
|
||||||
# ein globaler Snapshot würde bei mehreren Clients Events verschlucken.
|
ein globaler Snapshot würde bei mehreren Clients Events verschlucken.
|
||||||
|
"""
|
||||||
alt = _fingerprints()
|
alt = _fingerprints()
|
||||||
yield ": verbunden\n\n"
|
yield ": verbunden\n\n"
|
||||||
|
|
||||||
|
seit_abdruck = 0.0
|
||||||
seit_ping = 0.0
|
seit_ping = 0.0
|
||||||
|
takt = METRIK_S if mit_metrik else ABDRUCK_S
|
||||||
|
|
||||||
while True:
|
while True:
|
||||||
if await request.is_disconnected():
|
if await request.is_disconnected():
|
||||||
return
|
return
|
||||||
await asyncio.sleep(TICK_S)
|
await asyncio.sleep(takt)
|
||||||
seit_ping += TICK_S
|
seit_abdruck += takt
|
||||||
|
seit_ping += takt
|
||||||
|
|
||||||
|
if mit_metrik:
|
||||||
|
try:
|
||||||
|
from services.system import metrik_punkt
|
||||||
|
yield f"event: metrik\ndata: {json.dumps(metrik_punkt())}\n\n"
|
||||||
|
seit_ping = 0.0
|
||||||
|
except Exception:
|
||||||
|
# Ein kaputter Messpunkt darf den Strom nicht reißen — die Ansicht fällt
|
||||||
|
# dann auf ihre Poller zurück, das ist besser als eine tote Leitung.
|
||||||
|
log.warning("Messpunkt fehlgeschlagen", exc_info=True)
|
||||||
|
|
||||||
|
if seit_abdruck >= ABDRUCK_S:
|
||||||
|
seit_abdruck = 0.0
|
||||||
neu = _fingerprints()
|
neu = _fingerprints()
|
||||||
keys = [k for k, v in neu.items() if k in alt and v != alt[k]]
|
keys = [k for k, v in neu.items() if k in alt and v != alt[k]]
|
||||||
alt.update(neu)
|
alt.update(neu)
|
||||||
if keys:
|
if keys:
|
||||||
yield f"event: invalidate\ndata: {json.dumps({'keys': keys})}\n\n"
|
yield f"event: invalidate\ndata: {json.dumps({'keys': keys})}\n\n"
|
||||||
seit_ping = 0.0
|
seit_ping = 0.0
|
||||||
elif seit_ping >= KEEPALIVE_S:
|
|
||||||
|
if seit_ping >= KEEPALIVE_S:
|
||||||
yield ": ping\n\n"
|
yield ": ping\n\n"
|
||||||
seit_ping = 0.0
|
seit_ping = 0.0
|
||||||
|
|
||||||
return StreamingResponse(strom(), media_type="text/event-stream",
|
|
||||||
headers={"Cache-Control": "no-cache", "X-Accel-Buffering": "no"})
|
_KOPF = {"Cache-Control": "no-cache", "X-Accel-Buffering": "no"}
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/stream")
|
||||||
|
async def stream(request: Request) -> StreamingResponse:
|
||||||
|
"""Der aktuelle Kanal: Anstöße UND Messpunkte."""
|
||||||
|
return StreamingResponse(_strom(request, mit_metrik=True),
|
||||||
|
media_type="text/event-stream", headers=_KOPF)
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/events")
|
||||||
|
async def events(request: Request) -> StreamingResponse:
|
||||||
|
"""Alt-Kanal ohne Messpunkte. Nur für Browser-Tabs, die noch ein Bündel von vor
|
||||||
|
dem 28.08.2026 halten. Mit der übernächsten Fassung entfernen."""
|
||||||
|
return StreamingResponse(_strom(request, mit_metrik=False),
|
||||||
|
media_type="text/event-stream", headers=_KOPF)
|
||||||
|
|||||||
@@ -11,11 +11,10 @@ entfernen → app.py bindet wieder den lokalen Gateway ein.
|
|||||||
|
|
||||||
import logging
|
import logging
|
||||||
|
|
||||||
|
from config import V1_UPSTREAM
|
||||||
from fastapi import APIRouter, Request
|
from fastapi import APIRouter, Request
|
||||||
from fastapi.responses import JSONResponse, StreamingResponse
|
from fastapi.responses import JSONResponse, StreamingResponse
|
||||||
|
|
||||||
from config import V1_UPSTREAM
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
router = APIRouter(prefix="/v1")
|
router = APIRouter(prefix="/v1")
|
||||||
|
|||||||
@@ -2,11 +2,9 @@ import logging
|
|||||||
import os
|
import os
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import LLAMA_SWAP_URL
|
||||||
from fastapi import APIRouter, Request
|
from fastapi import APIRouter, Request
|
||||||
from fastapi.responses import JSONResponse, StreamingResponse
|
from fastapi.responses import JSONResponse, StreamingResponse
|
||||||
|
|
||||||
from config import LLAMA_SWAP_URL
|
|
||||||
from services.gateway_stream import record_stream_chunk, record_usage, warn_truncation
|
from services.gateway_stream import record_stream_chunk, record_usage, warn_truncation
|
||||||
from services.router_logic import IMAGE_PART_TYPES, VISION_CAPABLE, choose_for_lane, has_image
|
from services.router_logic import IMAGE_PART_TYPES, VISION_CAPABLE, choose_for_lane, has_image
|
||||||
from services.routing_policy import load_policy
|
from services.routing_policy import load_policy
|
||||||
@@ -24,6 +22,13 @@ _LANG_DIRECTIVE = os.environ.get(
|
|||||||
"Quellcode, Bezeichner und Shell-Befehle bleiben unverändert.")
|
"Quellcode, Bezeichner und Shell-Befehle bleiben unverändert.")
|
||||||
|
|
||||||
|
|
||||||
|
# Deckel für die Bild-Weiche. Ohne ihn wächst die Wartezeit linear mit der Bildzahl:
|
||||||
|
# je Bild bis zu 2 Versuche à _BILD_TIMEOUT_S, und der Client hängt so lange am offenen
|
||||||
|
# Request. Über _BILD_MAX Bilder wird gar nicht erst beschrieben — der Aufrufer fällt
|
||||||
|
# dann auf die normale Vision-Umleitung zurück (ehrlich langsam statt scheinbar hängend).
|
||||||
|
_BILD_TIMEOUT_S = float(os.environ.get("MC_CODER_IMAGE_TIMEOUT_S", "240"))
|
||||||
|
_BILD_MAX = int(os.environ.get("MC_CODER_IMAGE_MAX", "4"))
|
||||||
|
|
||||||
# Bild-Beschreibung für Coder-Ziele: Prompt bewusst auf wörtliche Wiedergabe von
|
# Bild-Beschreibung für Coder-Ziele: Prompt bewusst auf wörtliche Wiedergabe von
|
||||||
# Code/Fehlermeldungen getrimmt — der Coder arbeitet nur mit diesem Text weiter.
|
# Code/Fehlermeldungen getrimmt — der Coder arbeitet nur mit diesem Text weiter.
|
||||||
_BILD_BESCHREIB_PROMPT = os.environ.get(
|
_BILD_BESCHREIB_PROMPT = os.environ.get(
|
||||||
@@ -87,6 +92,10 @@ async def _bilder_fuer_coder_beschreiben(body: dict, client, vision_alias: str)
|
|||||||
for i, part in enumerate(m["content"]):
|
for i, part in enumerate(m["content"]):
|
||||||
if isinstance(part, dict) and part.get("type") in IMAGE_PART_TYPES:
|
if isinstance(part, dict) and part.get("type") in IMAGE_PART_TYPES:
|
||||||
fundstellen.append((m, i, part))
|
fundstellen.append((m, i, part))
|
||||||
|
if len(fundstellen) > _BILD_MAX:
|
||||||
|
log.warning("Bild-Weiche v2: %s Bilder (Deckel %s) — Request geht an das Vision-Modell "
|
||||||
|
"statt einzeln beschrieben zu werden", len(fundstellen), _BILD_MAX)
|
||||||
|
return False
|
||||||
for nr, (msg, idx, part) in enumerate(fundstellen, start=1):
|
for nr, (msg, idx, part) in enumerate(fundstellen, start=1):
|
||||||
frage = {
|
frage = {
|
||||||
"model": vision_alias,
|
"model": vision_alias,
|
||||||
@@ -101,7 +110,7 @@ async def _bilder_fuer_coder_beschreiben(body: dict, client, vision_alias: str)
|
|||||||
text = ""
|
text = ""
|
||||||
for versuch in (1, 2):
|
for versuch in (1, 2):
|
||||||
try:
|
try:
|
||||||
async with httpx.AsyncClient(timeout=240.0) as c:
|
async with httpx.AsyncClient(timeout=_BILD_TIMEOUT_S) as c:
|
||||||
r = await c.post(f"{LLAMA_SWAP_URL}/v1/chat/completions", json=frage)
|
r = await c.post(f"{LLAMA_SWAP_URL}/v1/chat/completions", json=frage)
|
||||||
if r.status_code == 200:
|
if r.status_code == 200:
|
||||||
text = ((r.json().get("choices") or [{}])[0].get("message") or {}).get("content") or ""
|
text = ((r.json().get("choices") or [{}])[0].get("message") or {}).get("content") or ""
|
||||||
@@ -140,7 +149,15 @@ def _inject_language(body: dict, alias: str) -> None:
|
|||||||
async def models(request: Request):
|
async def models(request: Request):
|
||||||
client = request.app.state.gw_client # geteilter Keep-Alive-Client (siehe app.py lifespan)
|
client = request.app.state.gw_client # geteilter Keep-Alive-Client (siehe app.py lifespan)
|
||||||
r = await client.get(f"{LLAMA_SWAP_URL}/v1/models", timeout=10.0)
|
r = await client.get(f"{LLAMA_SWAP_URL}/v1/models", timeout=10.0)
|
||||||
|
try:
|
||||||
data = r.json()
|
data = r.json()
|
||||||
|
except ValueError:
|
||||||
|
# Engine antwortet, aber nicht mit JSON (Startphase/Fehlerseite) — ehrlicher 502
|
||||||
|
# statt eines 500ers aus dem Parser.
|
||||||
|
log.warning("/v1/models: Engine-Antwort ist kein JSON (HTTP %s): %.200s", r.status_code, r.text)
|
||||||
|
return JSONResponse(
|
||||||
|
{"error": {"message": "Engine lieferte keine gültige Modell-Liste.",
|
||||||
|
"type": "upstream_error"}}, status_code=502)
|
||||||
# Aufgeräumt (07/2026): Die Router-Lanes (coding/chat) werden NICHT mehr als „Modell"
|
# Aufgeräumt (07/2026): Die Router-Lanes (coding/chat) werden NICHT mehr als „Modell"
|
||||||
# angeboten — sie verwirrten (coding vs. coder) und seit dem Zed-Aus wählt sie niemand
|
# angeboten — sie verwirrten (coding vs. coder) und seit dem Zed-Aus wählt sie niemand
|
||||||
# mehr. Das Routing bleibt erhalten (siehe _proxy), sie stehen nur nicht mehr in der Liste.
|
# mehr. Das Routing bleibt erhalten (siehe _proxy), sie stehen nur nicht mehr in der Liste.
|
||||||
@@ -189,7 +206,20 @@ async def models(request: Request):
|
|||||||
|
|
||||||
|
|
||||||
async def _proxy(path: str, request: Request):
|
async def _proxy(path: str, request: Request):
|
||||||
|
# Ungültige Payloads gehören dem Client, nicht dem Server: ohne diese Prüfung wirft
|
||||||
|
# request.json() bzw. body.get(...) durch und der Aufrufer bekommt einen 500er
|
||||||
|
# (gemessen 27.08.2026: Rohtext, leerer Body, JSON-Liste, JSON-String und null — 5/5 mal 500).
|
||||||
|
try:
|
||||||
body = await request.json()
|
body = await request.json()
|
||||||
|
except Exception:
|
||||||
|
return JSONResponse(
|
||||||
|
{"error": {"message": "Ungültiger Request-Body: JSON erwartet.",
|
||||||
|
"type": "invalid_request_error"}}, status_code=400)
|
||||||
|
if not isinstance(body, dict):
|
||||||
|
return JSONResponse(
|
||||||
|
{"error": {"message": "Ungültiger Request-Body: JSON-Objekt erwartet, "
|
||||||
|
f"'{type(body).__name__}' bekommen.",
|
||||||
|
"type": "invalid_request_error"}}, status_code=400)
|
||||||
_apply_no_think_marker(body) # Lucy-Voice-Schnellspur: Marker strippen + Thinking aus
|
_apply_no_think_marker(body) # Lucy-Voice-Schnellspur: Marker strippen + Thinking aus
|
||||||
requested = str(body.get("model") or "auto")
|
requested = str(body.get("model") or "auto")
|
||||||
if requested.lower() in ("auto", "chat", "coding"):
|
if requested.lower() in ("auto", "chat", "coding"):
|
||||||
|
|||||||
@@ -1,10 +1,8 @@
|
|||||||
"""Health-/Status-Endpoint — schlanker Lebenszeichen-Check für MC 2.0."""
|
"""Health-/Status-Endpoint — schlanker Lebenszeichen-Check für MC 2.0."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter
|
|
||||||
|
|
||||||
from config import VERSION
|
from config import VERSION
|
||||||
|
from fastapi import APIRouter
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import gateway, llamaswap
|
from services import gateway, llamaswap
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -22,11 +22,10 @@ import re
|
|||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import websockets
|
import websockets
|
||||||
|
from config import HERMES_BUILTIN_UI_UPSTREAM
|
||||||
from fastapi import APIRouter, Request, WebSocket
|
from fastapi import APIRouter, Request, WebSocket
|
||||||
from starlette.responses import RedirectResponse, Response
|
from starlette.responses import RedirectResponse, Response
|
||||||
|
|
||||||
from config import HERMES_BUILTIN_UI_UPSTREAM
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
router = APIRouter()
|
router = APIRouter()
|
||||||
|
|
||||||
|
|||||||
@@ -3,7 +3,6 @@ LAN-only wie alle MC2-Endpoints; das Mensch-Gate bleibt die Karte im Auftragsbuc
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import ideen
|
from services import ideen
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
@@ -12,7 +11,7 @@ router = APIRouter(prefix="/api")
|
|||||||
class IdeeIn(BaseModel):
|
class IdeeIn(BaseModel):
|
||||||
titel: str
|
titel: str
|
||||||
notiz: str = ""
|
notiz: str = ""
|
||||||
welt: str = "box" # "box" = Werkstatt baut · "ide" = vorbereiten für Zed
|
welt: str = "box" # "box" = Werkstatt baut · "ide" = vorbereiten für Agentic IDE
|
||||||
tiefe: str = "" # nur ide: "simpel" | "gruendlich" (leer = Box schätzt selbst)
|
tiefe: str = "" # nur ide: "simpel" | "gruendlich" (leer = Box schätzt selbst)
|
||||||
ziel: str = "" # nur ide-Projekt: "lxc" | "docker" (leer = Box entscheidet)
|
ziel: str = "" # nur ide-Projekt: "lxc" | "docker" (leer = Box entscheidet)
|
||||||
art: str = "projekt" # nur ide: "projekt" (Repo+Roadmap+Bau) | "idee" (nur durchdenken)
|
art: str = "projekt" # nur ide: "projekt" (Repo+Roadmap+Bau) | "idee" (nur durchdenken)
|
||||||
@@ -27,6 +26,15 @@ class AntwortIn(BaseModel):
|
|||||||
antwort: str
|
antwort: str
|
||||||
|
|
||||||
|
|
||||||
|
class ArchivAlleIn(BaseModel):
|
||||||
|
# Leer = alle fertigen Karten der Queue; gesetzt = nur die dieses Projekts.
|
||||||
|
projekt: str = ""
|
||||||
|
|
||||||
|
|
||||||
|
class EinordnenIn(BaseModel):
|
||||||
|
text: str
|
||||||
|
|
||||||
|
|
||||||
@router.get("/ideen")
|
@router.get("/ideen")
|
||||||
def list_queue() -> dict:
|
def list_queue() -> dict:
|
||||||
return ideen.list_queue()
|
return ideen.list_queue()
|
||||||
@@ -115,6 +123,22 @@ def archive(body: TaskIn) -> dict:
|
|||||||
return res
|
return res
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/ideen/einordnen")
|
||||||
|
def einordnen(body: EinordnenIn) -> dict:
|
||||||
|
"""Einordnungs-VORSCHLAG beim Tippen. Wirft nie — scheitert es, kommt `ok: false`
|
||||||
|
und die Oberfläche behält ihre Voreinstellung."""
|
||||||
|
return ideen.einordnen(body.text)
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/ideen/archivieren-alle")
|
||||||
|
def archive_alle(body: ArchivAlleIn) -> dict:
|
||||||
|
"""Fertige Karten sammelweise wegräumen. Fasst ausschließlich `done` an."""
|
||||||
|
res = ideen.archive_done(body.projekt)
|
||||||
|
if not res.get("ok"):
|
||||||
|
raise HTTPException(400, res.get("error", "Archivieren fehlgeschlagen."))
|
||||||
|
return res
|
||||||
|
|
||||||
|
|
||||||
@router.get("/ideen/{id}/log")
|
@router.get("/ideen/{id}/log")
|
||||||
def get_log(id: str) -> dict:
|
def get_log(id: str) -> dict:
|
||||||
return ideen.log_of(id)
|
return ideen.log_of(id)
|
||||||
|
|||||||
@@ -1,20 +1,28 @@
|
|||||||
"""Wartungs-Endpoints: Update-Badge, OS-/Engine-Update, Reboot, Restart, Logs."""
|
"""Wartungs-Endpoints: Update-Badge, OS-/Engine-Update, Reboot, Restart, Logs.
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException, Header
|
v3-Umbau P1 (28.08.2026): Das Sudo-Passwort ist hier ersatzlos entfallen. Auf der Box
|
||||||
|
gemessen — `sudo -n true` läuft durch, weil `/etc/sudoers` den Dienst-Nutzer mit
|
||||||
|
`NOPASSWD: ALL` führt. Das Passwort wurde also nie gebraucht, lag aber im
|
||||||
|
`localStorage` des Browsers und reiste bei jedem mutierenden Request mit. Sollte die
|
||||||
|
sudoers-Zeile je fallen, meldet `services.maintenance` sauber `password_required`
|
||||||
|
statt still zu scheitern — das ist dann ein Konfigurations-Signal und nichts, was man
|
||||||
|
mit einem im Browser geparkten Geheimnis übertüncht.
|
||||||
|
"""
|
||||||
|
|
||||||
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
from services import geheimnisse, maintenance
|
||||||
from services import maintenance
|
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
|
|
||||||
class SudoReq(BaseModel):
|
|
||||||
sudo_password: str | None = None
|
|
||||||
|
|
||||||
|
|
||||||
class RestartReq(BaseModel):
|
class RestartReq(BaseModel):
|
||||||
service: str
|
service: str
|
||||||
sudo_password: str | None = None
|
|
||||||
|
|
||||||
|
class GeheimnisReq(BaseModel):
|
||||||
|
schluessel: str
|
||||||
|
wert: str | None = None
|
||||||
|
|
||||||
|
|
||||||
@router.get("/maintenance/updates")
|
@router.get("/maintenance/updates")
|
||||||
@@ -29,32 +37,32 @@ def update_details(kind: str) -> dict:
|
|||||||
return maintenance.update_details(kind)
|
return maintenance.update_details(kind)
|
||||||
|
|
||||||
@router.post("/maintenance/check-updates")
|
@router.post("/maintenance/check-updates")
|
||||||
def check_updates(body: SudoReq) -> dict:
|
def check_updates() -> dict:
|
||||||
res = maintenance.check_updates_job(body.sudo_password)
|
res = maintenance.check_updates_job()
|
||||||
if isinstance(res, dict) and not res.get("ok", True):
|
if isinstance(res, dict) and not res.get("ok", True):
|
||||||
return res
|
return res
|
||||||
return res
|
return res
|
||||||
|
|
||||||
|
|
||||||
@router.post("/maintenance/os-update")
|
@router.post("/maintenance/os-update")
|
||||||
def os_update(body: SudoReq) -> dict:
|
def os_update() -> dict:
|
||||||
res = maintenance.os_update_job(body.sudo_password)
|
res = maintenance.os_update_job()
|
||||||
if isinstance(res, dict) and not res.get("ok", True):
|
if isinstance(res, dict) and not res.get("ok", True):
|
||||||
return res
|
return res
|
||||||
return res
|
return res
|
||||||
|
|
||||||
|
|
||||||
@router.post("/maintenance/engine-update")
|
@router.post("/maintenance/engine-update")
|
||||||
def engine_update(body: SudoReq) -> dict:
|
def engine_update() -> dict:
|
||||||
res = maintenance.engine_update_job(body.sudo_password)
|
res = maintenance.engine_update_job()
|
||||||
if not res:
|
if not res:
|
||||||
raise HTTPException(400, "Kein Engine-Update-Befehl gesetzt (MC_ENGINE_UPDATE_CMD).")
|
raise HTTPException(400, "Kein Engine-Update-Befehl gesetzt (MC_ENGINE_UPDATE_CMD).")
|
||||||
return res
|
return res
|
||||||
|
|
||||||
|
|
||||||
@router.post("/maintenance/swap-update")
|
@router.post("/maintenance/swap-update")
|
||||||
def swap_update(body: SudoReq) -> dict:
|
def swap_update() -> dict:
|
||||||
res = maintenance.swap_update_job(body.sudo_password)
|
res = maintenance.swap_update_job()
|
||||||
if not res:
|
if not res:
|
||||||
raise HTTPException(400, "Kein Router-Update-Befehl gesetzt (MC_SWAP_UPDATE_CMD).")
|
raise HTTPException(400, "Kein Router-Update-Befehl gesetzt (MC_SWAP_UPDATE_CMD).")
|
||||||
return res
|
return res
|
||||||
@@ -66,20 +74,34 @@ def hermes_update() -> dict:
|
|||||||
|
|
||||||
|
|
||||||
@router.post("/maintenance/update-all")
|
@router.post("/maintenance/update-all")
|
||||||
def update_all(body: SudoReq) -> dict:
|
def update_all() -> dict:
|
||||||
return maintenance.update_all_job(body.sudo_password)
|
return maintenance.update_all_job()
|
||||||
|
|
||||||
|
|
||||||
@router.post("/maintenance/reboot")
|
@router.post("/maintenance/reboot")
|
||||||
def reboot(body: SudoReq) -> dict:
|
def reboot() -> dict:
|
||||||
return maintenance.reboot(body.sudo_password)
|
return maintenance.reboot()
|
||||||
|
|
||||||
|
|
||||||
@router.post("/maintenance/restart")
|
@router.post("/maintenance/restart")
|
||||||
def restart(body: RestartReq) -> dict:
|
def restart(body: RestartReq) -> dict:
|
||||||
return maintenance.restart_service(body.service, body.sudo_password)
|
return maintenance.restart_service(body.service)
|
||||||
|
|
||||||
|
|
||||||
@router.get("/maintenance/logs")
|
@router.get("/maintenance/logs")
|
||||||
def logs(service: str, lines: int = 200, x_sudo_password: str | None = Header(None)) -> dict:
|
def logs(service: str, lines: int = 200) -> dict:
|
||||||
return maintenance.logs(service, lines, x_sudo_password)
|
return maintenance.logs(service, lines)
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/maintenance/geheimnisse")
|
||||||
|
def geheimnisse_status() -> dict:
|
||||||
|
"""Nur der Zustand — ob ein Token gesetzt ist, niemals sein Wert."""
|
||||||
|
return geheimnisse.status()
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/maintenance/geheimnisse")
|
||||||
|
def geheimnisse_setzen(body: GeheimnisReq) -> dict:
|
||||||
|
"""Setzt (oder löscht bei leerem Wert) ein Geheimnis in der Box-Ablage."""
|
||||||
|
if not geheimnisse.setzen(body.schluessel, body.wert):
|
||||||
|
raise HTTPException(400, f"Geheimnis '{body.schluessel}' konnte nicht gespeichert werden.")
|
||||||
|
return {"ok": True, **geheimnisse.status()}
|
||||||
|
|||||||
@@ -1,93 +0,0 @@
|
|||||||
"""Memory-Endpoints (geteiltes Gedächtnis). LAN-only, kein Token in 2.0-Phase 3."""
|
|
||||||
|
|
||||||
import time
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from services import memory
|
|
||||||
from services.voice_metrics import park, record_stage
|
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
|
||||||
|
|
||||||
|
|
||||||
class MemIn(BaseModel):
|
|
||||||
content: str
|
|
||||||
category: str = "knowledge"
|
|
||||||
source: str = "manual"
|
|
||||||
|
|
||||||
|
|
||||||
class MemUp(BaseModel):
|
|
||||||
content: str | None = None
|
|
||||||
category: str | None = None
|
|
||||||
|
|
||||||
|
|
||||||
class DedupeIn(BaseModel):
|
|
||||||
apply: bool = False
|
|
||||||
threshold: float = 0.85
|
|
||||||
|
|
||||||
|
|
||||||
class LearnIn(BaseModel):
|
|
||||||
text: str | None = None
|
|
||||||
messages: list[dict] | None = None
|
|
||||||
source: str = "auto"
|
|
||||||
category: str = "knowledge"
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/memory/export")
|
|
||||||
def export() -> dict:
|
|
||||||
return memory.export_text()
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/memory/graph")
|
|
||||||
def graph(min_score: float = 0.45, top_k: int = 3) -> dict:
|
|
||||||
"""Fakten als Ähnlichkeits-Graph (Knoten + semantische Kanten) für die Visualisierung."""
|
|
||||||
return memory.graph(min_score=min_score, top_k=top_k)
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/memory/learn", status_code=201)
|
|
||||||
def learn(body: LearnIn) -> dict:
|
|
||||||
"""Auto-Lernen: Gesprächs-Turns/Text durchreichen → Mem0 extrahiert Fakten selbst."""
|
|
||||||
return memory.learn(text=body.text, messages=body.messages,
|
|
||||||
source=body.source, category=body.category)
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/memory/dedupe")
|
|
||||||
def dedupe(body: DedupeIn) -> dict:
|
|
||||||
return memory.dedupe(apply=body.apply, threshold=body.threshold)
|
|
||||||
|
|
||||||
|
|
||||||
@router.get("/memory")
|
|
||||||
def list_mem(q: str = "", category: str = "") -> list[dict]:
|
|
||||||
# Semantischer Retrieve (q gesetzt) = u.a. Hermes' Mem0-Prefetch VOR jedem Turn. Dauer messen
|
|
||||||
# + parken, damit der laufende Voice-Chat-Turn sie als Unter-Detail seiner Hirn-Zeit einsammelt.
|
|
||||||
if q:
|
|
||||||
_t0 = time.perf_counter()
|
|
||||||
res = memory.list_memories(q=q, category=category)
|
|
||||||
_ms = (time.perf_counter() - _t0) * 1000.0
|
|
||||||
record_stage("memory_retrieve", _ms)
|
|
||||||
park("retrieve", _ms)
|
|
||||||
return res
|
|
||||||
return memory.list_memories(q=q, category=category)
|
|
||||||
|
|
||||||
|
|
||||||
@router.post("/memory", status_code=201)
|
|
||||||
def add(body: MemIn) -> dict:
|
|
||||||
if body.category not in memory.CATEGORIES:
|
|
||||||
raise HTTPException(400, f"Kategorie '{body.category}' unbekannt.")
|
|
||||||
return memory.add_memory(body.content, body.category, body.source)
|
|
||||||
|
|
||||||
|
|
||||||
@router.put("/memory/{mid}")
|
|
||||||
def update(mid: str, body: MemUp) -> dict:
|
|
||||||
res = memory.update_memory(mid, content=body.content, category=body.category)
|
|
||||||
if not res:
|
|
||||||
raise HTTPException(404, "Eintrag nicht gefunden")
|
|
||||||
return res
|
|
||||||
|
|
||||||
|
|
||||||
@router.delete("/memory/{mid}")
|
|
||||||
def delete(mid: str) -> dict:
|
|
||||||
if not memory.delete_memory(mid):
|
|
||||||
raise HTTPException(404, "Eintrag nicht gefunden")
|
|
||||||
return {"ok": True}
|
|
||||||
@@ -1,11 +1,10 @@
|
|||||||
"""Modelle-Endpoints: Liste (mit Caps), Discover, Fit, Register, Groups."""
|
"""Modelle-Endpoints: Liste (mit Caps), Discover, Fit, Register, Groups."""
|
||||||
|
|
||||||
import psutil
|
import psutil
|
||||||
|
from config import HF_DOWNLOAD_ENV, MODELS_DIR
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
from services import budget, discover, geheimnisse, hf, jobengine, llamaswap
|
||||||
from config import HF_DOWNLOAD_ENV, MODELS_DIR
|
|
||||||
from services import budget, discover, hf, jobengine, llamaswap
|
|
||||||
from services.fit import evaluate_fit, max_ctx_for
|
from services.fit import evaluate_fit, max_ctx_for
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
@@ -78,7 +77,9 @@ class InstallReq(BaseModel):
|
|||||||
quant: str = "Q4_K_M"
|
quant: str = "Q4_K_M"
|
||||||
ctx: int | None = None
|
ctx: int | None = None
|
||||||
jinja: bool = False
|
jinja: bool = False
|
||||||
hf_token: str | None = None
|
# Kein hf_token mehr im Request (v3-Umbau P1): der Token lag frueher im localStorage
|
||||||
|
# des Browsers und reiste hier mit. Jetzt liegt er auf der Box (services.geheimnisse)
|
||||||
|
# und wird unten von dort gelesen — die Oberflaeche sieht ihn nie wieder.
|
||||||
|
|
||||||
|
|
||||||
@router.get("/hf/search")
|
@router.get("/hf/search")
|
||||||
@@ -140,14 +141,13 @@ def install(req: InstallReq) -> dict:
|
|||||||
|
|
||||||
# Download-Job: alle GGUF-Teile (+ mmproj) per --include holen.
|
# Download-Job: alle GGUF-Teile (+ mmproj) per --include holen.
|
||||||
args = [hf.hf_bin(), "download", repo]
|
args = [hf.hf_bin(), "download", repo]
|
||||||
for f in info["files"]:
|
args.extend(info["files"])
|
||||||
args.append(f)
|
|
||||||
if info["mmproj"]:
|
if info["mmproj"]:
|
||||||
args.append(info["mmproj"])
|
args.append(info["mmproj"])
|
||||||
args += ["--local-dir", str(target)]
|
args += ["--local-dir", str(target)]
|
||||||
env = dict(HF_DOWNLOAD_ENV)
|
env = dict(HF_DOWNLOAD_ENV)
|
||||||
if req.hf_token:
|
if token := geheimnisse.hf_token():
|
||||||
env["HF_TOKEN"] = req.hf_token
|
env["HF_TOKEN"] = token
|
||||||
job_id = jobengine.start_job(args, f"download {req.repo}", env=env,
|
job_id = jobengine.start_job(args, f"download {req.repo}", env=env,
|
||||||
on_done=_apply_role if role else None)
|
on_done=_apply_role if role else None)
|
||||||
jobengine.attach_download_progress(job_id, str(target), info["total_bytes"])
|
jobengine.attach_download_progress(job_id, str(target), info["total_bytes"])
|
||||||
|
|||||||
@@ -2,10 +2,8 @@
|
|||||||
Konsument ist v.a. der Hermes-Agent via mcp_mc.py (reminder_create/list/delete);
|
Konsument ist v.a. der Hermes-Agent via mcp_mc.py (reminder_create/list/delete);
|
||||||
LAN-only wie alle MC2-Endpoints."""
|
LAN-only wie alle MC2-Endpoints."""
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
|
from pydantic import BaseModel
|
||||||
from services import reminders
|
from services import reminders
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|||||||
@@ -2,7 +2,6 @@
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import gateway
|
from services import gateway
|
||||||
from services.routing_policy import policy_meta, save_policy
|
from services.routing_policy import policy_meta, save_policy
|
||||||
|
|
||||||
|
|||||||
@@ -0,0 +1,102 @@
|
|||||||
|
import os
|
||||||
|
import subprocess
|
||||||
|
|
||||||
|
import psutil
|
||||||
|
from fastapi import APIRouter
|
||||||
|
from pydantic import BaseModel
|
||||||
|
|
||||||
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
|
|
||||||
|
def _hermes_name(ordner: str) -> str:
|
||||||
|
"""Repo-Ordnername -> Hermes-Skillname.
|
||||||
|
|
||||||
|
deploy/deploy.sh kopiert `deploy/skills/<name>` nach `~/.hermes/skills/<name mit _>`
|
||||||
|
(`tr '-' '_'`), weil Hermes keine Bindestriche in Skillnamen mag. Ohne dieselbe
|
||||||
|
Umschreibung hier bekam Hermes den Ordnernamen MIT Bindestrich und fand den Skill
|
||||||
|
nicht - betroffen waren 7 der 12 Skills (betrieb-playbook, konzept-fliessband,
|
||||||
|
llm-wiki, morning-report, pc-pfad-cache, projekt-start, trend-radar): der Startknopf
|
||||||
|
meldete Erfolg, ausgefuehrt wurde nichts. deploy.sh bleibt die Quelle der Wahrheit.
|
||||||
|
"""
|
||||||
|
return ordner.replace("-", "_")
|
||||||
|
|
||||||
|
|
||||||
|
class RunSkillRequest(BaseModel):
|
||||||
|
skill_name: str
|
||||||
|
|
||||||
|
@router.get("/skills")
|
||||||
|
def list_skills():
|
||||||
|
"""Listet alle verfügbaren Skills aus dem deploy/skills Verzeichnis auf."""
|
||||||
|
# Pfad relativ zu dieser Datei (backend/routers/skills.py)
|
||||||
|
current_dir = os.path.dirname(os.path.abspath(__file__))
|
||||||
|
repo_root = os.path.dirname(os.path.dirname(current_dir))
|
||||||
|
skills_dir = os.path.join(repo_root, "deploy", "skills")
|
||||||
|
skills = []
|
||||||
|
|
||||||
|
# Check currently running hermes skill processes
|
||||||
|
running_skills = set()
|
||||||
|
for p in psutil.process_iter(['name', 'cmdline']):
|
||||||
|
try:
|
||||||
|
cmdline = p.info.get('cmdline')
|
||||||
|
if cmdline and any("hermes" in arg for arg in cmdline):
|
||||||
|
for arg in cmdline:
|
||||||
|
if "Führe den " in arg and " Skill aus" in arg:
|
||||||
|
# Extract skill name from "Führe den 'skill_name' Skill aus"
|
||||||
|
import re
|
||||||
|
match = re.search(r"Führe den '(.+?)' Skill aus", arg)
|
||||||
|
if match:
|
||||||
|
running_skills.add(match.group(1))
|
||||||
|
except (psutil.NoSuchProcess, psutil.AccessDenied, psutil.ZombieProcess):
|
||||||
|
pass
|
||||||
|
|
||||||
|
if os.path.exists(skills_dir) and os.path.isdir(skills_dir):
|
||||||
|
for entry in os.scandir(skills_dir):
|
||||||
|
if entry.is_dir():
|
||||||
|
# Suche nach SKILL.md für Metadaten
|
||||||
|
skill_md_path = os.path.join(entry.path, "SKILL.md")
|
||||||
|
description = ""
|
||||||
|
if os.path.exists(skill_md_path):
|
||||||
|
try:
|
||||||
|
with open(skill_md_path, "r", encoding="utf-8") as f:
|
||||||
|
# Lese erste Zeilen für Description (YAML Frontmatter)
|
||||||
|
lines = f.readlines()[:10]
|
||||||
|
for line in lines:
|
||||||
|
if "description:" in line.lower():
|
||||||
|
description = line.split(":", 1)[1].strip().strip('"\'')
|
||||||
|
break
|
||||||
|
elif "author:" in line.lower() and not description:
|
||||||
|
description = line.strip()
|
||||||
|
except Exception:
|
||||||
|
pass
|
||||||
|
|
||||||
|
skills.append({
|
||||||
|
"name": entry.name,
|
||||||
|
# Der Name, unter dem Hermes den Skill kennt - auch fuer den Laufend-
|
||||||
|
# Vergleich, weil im Prozess-cmdline genau dieser Name steht.
|
||||||
|
"hermes_name": _hermes_name(entry.name),
|
||||||
|
"description": description or "Keine Beschreibung verfügbar.",
|
||||||
|
"running": _hermes_name(entry.name) in running_skills
|
||||||
|
})
|
||||||
|
return {"skills": skills}
|
||||||
|
|
||||||
|
@router.post("/skills/run")
|
||||||
|
def run_skill(req: RunSkillRequest):
|
||||||
|
"""Startet einen autonomen Skill via Hermes im Hintergrund."""
|
||||||
|
hermes_bin = os.path.expanduser("~/.local/bin/hermes")
|
||||||
|
if not os.path.exists(hermes_bin):
|
||||||
|
# Fallback falls lokal (auf Windows) entwickelt wird
|
||||||
|
return {"ok": False, "err": "Hermes CLI nicht gefunden (~/.local/bin/hermes fehlt). Bist du lokal unterwegs?"}
|
||||||
|
|
||||||
|
# Entspricht: hermes -z "Führe den 'X' Skill aus" chat - mit dem Namen, den Hermes
|
||||||
|
# nach dem Deploy-Sync wirklich kennt (Bindestriche -> Unterstriche, s. _hermes_name).
|
||||||
|
skill = _hermes_name(req.skill_name)
|
||||||
|
cmd = [hermes_bin, "-z", f"Führe den '{skill}' Skill aus", "chat"]
|
||||||
|
try:
|
||||||
|
log_path = os.path.expanduser(f"~/.hermes/logs/skill_{skill.replace('/', '_')}.log")
|
||||||
|
os.makedirs(os.path.dirname(log_path), exist_ok=True)
|
||||||
|
with open(log_path, "a", encoding="utf-8") as f:
|
||||||
|
f.write(f"\n--- Starting Skill: {skill} ---\n")
|
||||||
|
subprocess.Popen(cmd, stdout=f, stderr=subprocess.STDOUT)
|
||||||
|
return {"ok": True, "msg": f"Skill '{req.skill_name}' erfolgreich angestoßen."}
|
||||||
|
except Exception as e:
|
||||||
|
return {"ok": False, "err": str(e)}
|
||||||
@@ -9,12 +9,10 @@ import logging
|
|||||||
import os
|
import os
|
||||||
import subprocess
|
import subprocess
|
||||||
|
|
||||||
|
import httpx
|
||||||
|
from config import GATEWAY_URL, HERMES_API_URL, LLAMA_SWAP_URL, V1_UPSTREAM, VOICE_SERVICE_URL
|
||||||
from fastapi import APIRouter
|
from fastapi import APIRouter
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
import httpx
|
|
||||||
|
|
||||||
from config import GATEWAY_URL, HERMES_API_URL, LLAMA_SWAP_URL, MEM0_SERVICE_URL, V1_UPSTREAM, VOICE_SERVICE_URL
|
|
||||||
from services import backup as backup_svc
|
from services import backup as backup_svc
|
||||||
from services import maintenance
|
from services import maintenance
|
||||||
from services.agent import agent_status
|
from services.agent import agent_status
|
||||||
@@ -44,13 +42,6 @@ def history(minutes: int = 60) -> dict:
|
|||||||
return metrics_history.history(minutes)
|
return metrics_history.history(minutes)
|
||||||
|
|
||||||
|
|
||||||
def _mem0_reachable() -> bool:
|
|
||||||
try:
|
|
||||||
return httpx.get(f"{MEM0_SERVICE_URL}/health", timeout=2).status_code == 200
|
|
||||||
except Exception:
|
|
||||||
return False
|
|
||||||
|
|
||||||
|
|
||||||
def _voice_reachable() -> bool:
|
def _voice_reachable() -> bool:
|
||||||
try:
|
try:
|
||||||
return httpx.get(f"{VOICE_SERVICE_URL}/health", timeout=2).status_code == 200
|
return httpx.get(f"{VOICE_SERVICE_URL}/health", timeout=2).status_code == 200
|
||||||
@@ -67,7 +58,7 @@ def _user_unit_active(unit: str) -> bool:
|
|||||||
r = subprocess.run(["systemctl", "--user", "is-active", unit],
|
r = subprocess.run(["systemctl", "--user", "is-active", unit],
|
||||||
capture_output=True, text=True, timeout=3)
|
capture_output=True, text=True, timeout=3)
|
||||||
return r.stdout.strip() == "active"
|
return r.stdout.strip() == "active"
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
return False
|
return False
|
||||||
|
|
||||||
|
|
||||||
@@ -97,12 +88,10 @@ def services() -> dict:
|
|||||||
rows += [
|
rows += [
|
||||||
{"name": "Wächter (Steward)", "unit": "mc2-steward", "url": "",
|
{"name": "Wächter (Steward)", "unit": "mc2-steward", "url": "",
|
||||||
"ok": _user_unit_active("mc2-steward"), "scope": "user"},
|
"ok": _user_unit_active("mc2-steward"), "scope": "user"},
|
||||||
{"name": "Hermes-Gateway", "unit": "hermes-gateway", "url": HERMES_API_URL,
|
{"name": "Hermes-Gateway (Agent & Gedächtnis)", "unit": "hermes-gateway", "url": HERMES_API_URL,
|
||||||
"ok": a["gateway_reachable"], "scope": "user"},
|
"ok": a["gateway_reachable"], "scope": "user"},
|
||||||
{"name": "Hermes-GUI (Desktop-Gateway)", "unit": "hermes-builtin-ui", "url": a["hermes_ui_url"],
|
{"name": "Hermes-GUI (Desktop-Gateway)", "unit": "hermes-builtin-ui", "url": a["hermes_ui_url"],
|
||||||
"ok": a["hermes_ui_reachable"], "scope": "user"},
|
"ok": a["hermes_ui_reachable"], "scope": "user"},
|
||||||
{"name": "Mem0 (Gedächtnis)", "unit": "mem0-service", "url": MEM0_SERVICE_URL,
|
|
||||||
"ok": _mem0_reachable(), "scope": "user"},
|
|
||||||
{"name": "Voice (STT/TTS)", "unit": "voice-service", "url": VOICE_SERVICE_URL,
|
{"name": "Voice (STT/TTS)", "unit": "voice-service", "url": VOICE_SERVICE_URL,
|
||||||
"ok": _voice_reachable(), "scope": "user"},
|
"ok": _voice_reachable(), "scope": "user"},
|
||||||
# ttyd hinter dem /console/-Proxy — war als einziger UI-Dienst NICHT in der Liste,
|
# ttyd hinter dem /console/-Proxy — war als einziger UI-Dienst NICHT in der Liste,
|
||||||
@@ -135,7 +124,7 @@ def _run(cmd: list[str], cwd: str | None = None) -> dict:
|
|||||||
p = subprocess.run(cmd, cwd=cwd, capture_output=True, text=True, timeout=180)
|
p = subprocess.run(cmd, cwd=cwd, capture_output=True, text=True, timeout=180)
|
||||||
return {"ok": p.returncode == 0, "code": p.returncode,
|
return {"ok": p.returncode == 0, "code": p.returncode,
|
||||||
"out": (p.stdout or "")[-2000:], "err": (p.stderr or "")[-2000:]}
|
"out": (p.stdout or "")[-2000:], "err": (p.stderr or "")[-2000:]}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"ok": False, "code": -1, "out": "", "err": str(exc)}
|
return {"ok": False, "code": -1, "out": "", "err": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
|
|||||||
+81
-13
@@ -3,7 +3,7 @@ Voice-Endpoints für „Mit Hermes reden" (Browser-Voice + 3D-Avatar).
|
|||||||
|
|
||||||
Dünner Layer: STT/TTS werden zum Voice-Sidecar (:8650) geproxyt; der Chat geht an den
|
Dünner Layer: STT/TTS werden zum Voice-Sidecar (:8650) geproxyt; der Chat geht an den
|
||||||
Hermes-`api_server` (:8642, OpenAI-kompatibel) — denselben vollen Agenten mit Tools +
|
Hermes-`api_server` (:8642, OpenAI-kompatibel) — denselben vollen Agenten mit Tools +
|
||||||
geteiltem Mem0 wie CLI/Telegram. Mit stabilem `X-Hermes-Session-Id` hält die Plattform den
|
eigenem Gedächtnis wie CLI/Telegram. Mit stabilem `X-Hermes-Session-Id` hält die Plattform den
|
||||||
Transcript server-seitig, daher schickt der Client je Turn nur die neue User-Nachricht.
|
Transcript server-seitig, daher schickt der Client je Turn nur die neue User-Nachricht.
|
||||||
|
|
||||||
LAN-only (kein Token in der 2.0-Phase), wie die übrigen MC2-Endpoints.
|
LAN-only (kein Token in der 2.0-Phase), wie die übrigen MC2-Endpoints.
|
||||||
@@ -11,14 +11,16 @@ LAN-only (kein Token in der 2.0-Phase), wie die übrigen MC2-Endpoints.
|
|||||||
|
|
||||||
import logging
|
import logging
|
||||||
import os
|
import os
|
||||||
|
|
||||||
|
# Injection-Schutz (Stufe 0): guard.py liegt im mcp/-Verzeichnis. Per Pfad laden (eigene MC2-Venv).
|
||||||
|
import sys as _sys
|
||||||
import time
|
import time
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import HERMES_API_KEY, HERMES_API_MODEL, HERMES_API_URL, LLAMA_SWAP_URL, LUCY_STIMME_URL, VOICE_SERVICE_URL
|
||||||
from fastapi import APIRouter, File, Form, HTTPException, UploadFile
|
from fastapi import APIRouter, File, Form, HTTPException, UploadFile
|
||||||
from fastapi.responses import Response, StreamingResponse
|
from fastapi.responses import Response, StreamingResponse
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from config import HERMES_API_KEY, HERMES_API_MODEL, HERMES_API_URL, LLAMA_SWAP_URL, VOICE_SERVICE_URL
|
|
||||||
from services import announce
|
from services import announce
|
||||||
from services.voice_metrics import ( # Per-Stage-Latenz + Per-Turn-Trace (intern)
|
from services.voice_metrics import ( # Per-Stage-Latenz + Per-Turn-Trace (intern)
|
||||||
Timer,
|
Timer,
|
||||||
@@ -29,8 +31,6 @@ from services.voice_metrics import ( # Per-Stage-Latenz + Per-Turn-Trace (inter
|
|||||||
record_stage,
|
record_stage,
|
||||||
)
|
)
|
||||||
|
|
||||||
# Injection-Schutz (Stufe 0): guard.py liegt im mcp/-Verzeichnis. Per Pfad laden (eigene MC2-Venv).
|
|
||||||
import sys as _sys
|
|
||||||
_GUARD_DIR = os.path.join(os.path.dirname(os.path.dirname(os.path.dirname(os.path.abspath(__file__)))), "mcp")
|
_GUARD_DIR = os.path.join(os.path.dirname(os.path.dirname(os.path.dirname(os.path.abspath(__file__)))), "mcp")
|
||||||
if _GUARD_DIR not in _sys.path:
|
if _GUARD_DIR not in _sys.path:
|
||||||
_sys.path.insert(0, _GUARD_DIR)
|
_sys.path.insert(0, _GUARD_DIR)
|
||||||
@@ -155,7 +155,7 @@ def voice_health() -> dict:
|
|||||||
r = httpx.get(f"{VOICE_SERVICE_URL}/health", timeout=httpx.Timeout(5.0))
|
r = httpx.get(f"{VOICE_SERVICE_URL}/health", timeout=httpx.Timeout(5.0))
|
||||||
out["sidecar"] = r.status_code == 200
|
out["sidecar"] = r.status_code == 200
|
||||||
out["detail"] = r.json() if r.status_code == 200 else None
|
out["detail"] = r.json() if r.status_code == 200 else None
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
out["error"] = str(exc)
|
out["error"] = str(exc)
|
||||||
return out
|
return out
|
||||||
|
|
||||||
@@ -169,7 +169,7 @@ def voice_metrics() -> dict:
|
|||||||
@router.get("/voice/trace")
|
@router.get("/voice/trace")
|
||||||
def voice_trace(limit: int = 20) -> dict:
|
def voice_trace(limit: int = 20) -> dict:
|
||||||
"""Per-Turn-Trace: die letzten `limit` Chat-Turns mit Stufen-Breakdown (STT · Vision · Hirn ·
|
"""Per-Turn-Trace: die letzten `limit` Chat-Turns mit Stufen-Breakdown (STT · Vision · Hirn ·
|
||||||
Generierung, Mem0 als Unter-Detail). Neueste zuerst. Für die Latenz-Ansicht im Cockpit —
|
Generierung). Neueste zuerst. Für die Latenz-Ansicht im Cockpit —
|
||||||
damit man den EINEN langsamen Turn sieht, den ein Durchschnitt verschluckt."""
|
damit man den EINEN langsamen Turn sieht, den ein Durchschnitt verschluckt."""
|
||||||
return {"turns": get_trace(limit)}
|
return {"turns": get_trace(limit)}
|
||||||
|
|
||||||
@@ -180,7 +180,7 @@ def voice_voices() -> dict:
|
|||||||
r = httpx.get(f"{VOICE_SERVICE_URL}/voices", timeout=httpx.Timeout(10.0))
|
r = httpx.get(f"{VOICE_SERVICE_URL}/voices", timeout=httpx.Timeout(10.0))
|
||||||
r.raise_for_status()
|
r.raise_for_status()
|
||||||
return r.json()
|
return r.json()
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
raise HTTPException(502, f"Voice-Sidecar nicht erreichbar: {exc}")
|
raise HTTPException(502, f"Voice-Sidecar nicht erreichbar: {exc}")
|
||||||
|
|
||||||
|
|
||||||
@@ -245,7 +245,7 @@ def voice_get_reference() -> dict:
|
|||||||
r = httpx.get(f"{VOICE_SERVICE_URL}/reference", timeout=httpx.Timeout(8.0))
|
r = httpx.get(f"{VOICE_SERVICE_URL}/reference", timeout=httpx.Timeout(8.0))
|
||||||
r.raise_for_status()
|
r.raise_for_status()
|
||||||
return r.json()
|
return r.json()
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"active": False, "error": str(exc)}
|
return {"active": False, "error": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
@@ -289,8 +289,8 @@ async def voice_chat(body: ChatIn) -> StreamingResponse:
|
|||||||
headers["X-Hermes-Session-Key"] = body.session_key
|
headers["X-Hermes-Session-Key"] = body.session_key
|
||||||
|
|
||||||
async def gen():
|
async def gen():
|
||||||
# Per-Turn-Trace: sammelt STT (davor, geparkt) + Vision + Hirn-TTFT + Generierung + Mem0
|
# Per-Turn-Trace: sammelt STT (davor, geparkt) + Vision + Hirn-TTFT + Generierung zu EINEM
|
||||||
# (Rückruf während) zu EINEM Datensatz -> die Latenz-Ansicht zeigt den einzelnen Hänger.
|
# Datensatz -> die Latenz-Ansicht zeigt den einzelnen Hänger.
|
||||||
trace = TurnTrace(session_id=body.session_id, kind="voice")
|
trace = TurnTrace(session_id=body.session_id, kind="voice")
|
||||||
first = True
|
first = True
|
||||||
first_content = True
|
first_content = True
|
||||||
@@ -325,7 +325,7 @@ async def voice_chat(body: ChatIn) -> StreamingResponse:
|
|||||||
payload = {"model": body.model or HERMES_API_MODEL, "messages": messages, "stream": True}
|
payload = {"model": body.model or HERMES_API_MODEL, "messages": messages, "stream": True}
|
||||||
# Lucys Hirn (Qwen3.6) ist ein Thinking-Modell -> für die gesprochene Assistentin Thinking AUS,
|
# Lucys Hirn (Qwen3.6) ist ein Thinking-Modell -> für die gesprochene Assistentin Thinking AUS,
|
||||||
# sonst generiert es tausende Reasoning-Token VOR der kurzen Antwort (gemessen: 11k Token, ~30s TTFB).
|
# sonst generiert es tausende Reasoning-Token VOR der kurzen Antwort (gemessen: 11k Token, ~30s TTFB).
|
||||||
# Gleiches Muster wie die fast-Spur im Gateway (gateway_proxy.py) und die Mem0-Extraktion.
|
# Gleiches Muster wie die fast-Spur im Gateway (gateway_proxy.py).
|
||||||
if os.environ.get("MC_VOICE_NO_THINK", "1") not in ("0", "false", "False"):
|
if os.environ.get("MC_VOICE_NO_THINK", "1") not in ("0", "false", "False"):
|
||||||
payload["chat_template_kwargs"] = {"enable_thinking": False}
|
payload["chat_template_kwargs"] = {"enable_thinking": False}
|
||||||
try:
|
try:
|
||||||
@@ -342,7 +342,7 @@ async def voice_chat(body: ChatIn) -> StreamingResponse:
|
|||||||
if first: # Time-To-First-Byte des Hermes-Streams (Verbindungs-Overhead)
|
if first: # Time-To-First-Byte des Hermes-Streams (Verbindungs-Overhead)
|
||||||
trace.note_ttfb()
|
trace.note_ttfb()
|
||||||
first = False
|
first = False
|
||||||
# Erster CONTENT-Delta = echte Hirn-Latenz (Agent-Overhead + Mem0 + LLM-TTFT) —
|
# Erster CONTENT-Delta = echte Hirn-Latenz (Agent-Overhead + Gedächtnis + LLM-TTFT) —
|
||||||
# chat_ttfb misst nur den SSE-Start (~5 ms) und ist dafür blind.
|
# chat_ttfb misst nur den SSE-Start (~5 ms) und ist dafür blind.
|
||||||
if first_content and b'"content"' in chunk:
|
if first_content and b'"content"' in chunk:
|
||||||
trace.note_first_content()
|
trace.note_first_content()
|
||||||
@@ -355,3 +355,71 @@ async def voice_chat(body: ChatIn) -> StreamingResponse:
|
|||||||
_commit() # Turn immer verbuchen (auch bei Fehler/Abbruch)
|
_commit() # Turn immer verbuchen (auch bei Fehler/Abbruch)
|
||||||
|
|
||||||
return StreamingResponse(gen(), media_type="text/event-stream")
|
return StreamingResponse(gen(), media_type="text/event-stream")
|
||||||
|
|
||||||
|
|
||||||
|
# ---------------------------------------------------------------------------------------------
|
||||||
|
# Lucys Stimme ins LAN reichen (Raphael-Umbau 04.09.2026). lucy-stimme.service (:8021, pocket-tts
|
||||||
|
# german_24l) bindet nur Loopback; die Desktop-Lucy am PC spricht seit dem Umbau nicht mehr mit
|
||||||
|
# einem eigenen pocket_server, sondern mit DIESEM — dieselbe Stimme wie die Telegram-Sprachnachrichten.
|
||||||
|
# Dünner Proxy, API 1:1 (pocket_server: /health, /tts -> WAV, /tts/stream -> PCM16 + X-Sample-Rate).
|
||||||
|
# LAN-only wie alle MC2-Endpoints.
|
||||||
|
|
||||||
|
class LucyTtsIn(BaseModel):
|
||||||
|
text: str
|
||||||
|
emo: str | None = None # Stimmungs-Profil (pocket_server EMO_PROFILES); Raphael-Lucy setzt keins
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/lucy/stimme/health")
|
||||||
|
def lucy_stimme_health() -> dict:
|
||||||
|
"""Bereitschaft von Lucys Stimme (pocket_server /health: status ok|loading)."""
|
||||||
|
try:
|
||||||
|
r = httpx.get(f"{LUCY_STIMME_URL}/health", timeout=httpx.Timeout(5.0))
|
||||||
|
r.raise_for_status()
|
||||||
|
return r.json()
|
||||||
|
except Exception as exc:
|
||||||
|
raise HTTPException(502, f"Lucys Stimme (:8021) nicht erreichbar: {exc}")
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/lucy/stimme/tts")
|
||||||
|
async def lucy_stimme_tts(body: LucyTtsIn) -> Response:
|
||||||
|
"""Text -> WAV (ganzer Text). Warm-up der Desktop-Lucy + Jobs, die eine Datei brauchen."""
|
||||||
|
try:
|
||||||
|
async with httpx.AsyncClient(timeout=httpx.Timeout(600.0, connect=5.0)) as client:
|
||||||
|
with Timer("lucy_tts"):
|
||||||
|
r = await client.post(f"{LUCY_STIMME_URL}/tts", json=body.model_dump(exclude_none=True))
|
||||||
|
r.raise_for_status()
|
||||||
|
return Response(content=r.content, media_type=r.headers.get("content-type", "audio/wav"),
|
||||||
|
headers={k: v for k, v in r.headers.items() if k.lower().startswith("x-")})
|
||||||
|
except httpx.HTTPStatusError as exc:
|
||||||
|
raise HTTPException(exc.response.status_code, f"Lucys Stimme: {exc.response.text[:200]}")
|
||||||
|
except httpx.HTTPError as exc:
|
||||||
|
raise HTTPException(502, f"Lucys Stimme nicht erreichbar: {exc}")
|
||||||
|
|
||||||
|
|
||||||
|
@router.post("/lucy/stimme/tts/stream")
|
||||||
|
async def lucy_stimme_tts_stream(body: LucyTtsIn) -> StreamingResponse:
|
||||||
|
"""Text -> rohes PCM16-mono, satzweise gestreamt (Samplerate im Header X-Sample-Rate).
|
||||||
|
Der Live-Pfad der Desktop-Lucy: erstes Audio nach dem ersten Satz. Der Upstream-Stream bleibt
|
||||||
|
offen, solange der Client liest — bricht der Client ab (Barge-in), schließt httpx den Upstream."""
|
||||||
|
client = httpx.AsyncClient(timeout=httpx.Timeout(None, connect=5.0))
|
||||||
|
try:
|
||||||
|
req = client.build_request("POST", f"{LUCY_STIMME_URL}/tts/stream", json=body.model_dump(exclude_none=True))
|
||||||
|
upstream = await client.send(req, stream=True)
|
||||||
|
except httpx.HTTPError as exc:
|
||||||
|
await client.aclose()
|
||||||
|
raise HTTPException(502, f"Lucys Stimme nicht erreichbar: {exc}")
|
||||||
|
if upstream.status_code != 200:
|
||||||
|
detail = (await upstream.aread()).decode("utf-8", "replace")[:200]
|
||||||
|
await upstream.aclose(); await client.aclose()
|
||||||
|
raise HTTPException(upstream.status_code, f"Lucys Stimme: {detail}")
|
||||||
|
|
||||||
|
async def gen():
|
||||||
|
try:
|
||||||
|
async for chunk in upstream.aiter_raw():
|
||||||
|
yield chunk
|
||||||
|
finally:
|
||||||
|
await upstream.aclose()
|
||||||
|
await client.aclose()
|
||||||
|
|
||||||
|
return StreamingResponse(gen(), media_type="application/octet-stream",
|
||||||
|
headers={"X-Sample-Rate": upstream.headers.get("x-sample-rate", "24000")})
|
||||||
|
|||||||
@@ -3,12 +3,12 @@ Wiki in der Zentrale. Bewusst READ-ONLY — geschrieben wird der Vault nur vom T
|
|||||||
(und via Auftragsbuch-Entscheidungen); hier wird nur gelesen und navigiert."""
|
(und via Auftragsbuch-Entscheidungen); hier wird nur gelesen und navigiert."""
|
||||||
|
|
||||||
import os
|
import os
|
||||||
|
import re
|
||||||
import time
|
import time
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
from pydantic import BaseModel
|
|
||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
|
from pydantic import BaseModel
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
|
|
||||||
@@ -60,7 +60,7 @@ def list_vault() -> dict:
|
|||||||
files = []
|
files = []
|
||||||
now = time.time()
|
now = time.time()
|
||||||
for p in sorted(VAULT.rglob("*.md")):
|
for p in sorted(VAULT.rglob("*.md")):
|
||||||
if ".git" in p.parts:
|
if ".git" in p.parts or "traeume" in p.parts:
|
||||||
continue
|
continue
|
||||||
rel = p.relative_to(VAULT).as_posix()
|
rel = p.relative_to(VAULT).as_posix()
|
||||||
st = p.stat()
|
st = p.stat()
|
||||||
@@ -91,3 +91,61 @@ def read_file(pfad: str) -> dict:
|
|||||||
raise
|
raise
|
||||||
except (ValueError, OSError):
|
except (ValueError, OSError):
|
||||||
raise HTTPException(404, "Notiz nicht lesbar.")
|
raise HTTPException(404, "Notiz nicht lesbar.")
|
||||||
|
|
||||||
|
|
||||||
|
@router.get("/wissen/graph")
|
||||||
|
def graph_vault() -> dict:
|
||||||
|
"""Obsidian-artiger Graph des Vaults (Nodes = Dateien, Edges = Wiki-Links)."""
|
||||||
|
if not _available():
|
||||||
|
return {"nodes": [], "edges": []}
|
||||||
|
|
||||||
|
nodes = []
|
||||||
|
edges = []
|
||||||
|
# Für schnelle Link-Auflösung (case-insensitive Name -> relativer Pfad als ID)
|
||||||
|
name_to_id = {}
|
||||||
|
|
||||||
|
# 1. Alle Nodes sammeln
|
||||||
|
for p in VAULT.rglob("*.md"):
|
||||||
|
if ".git" in p.parts or "traeume" in p.parts:
|
||||||
|
continue
|
||||||
|
rel = p.relative_to(VAULT).as_posix()
|
||||||
|
name_to_id[p.stem.lower()] = rel
|
||||||
|
|
||||||
|
# Kategorie aus dem Ordner ableiten
|
||||||
|
cat = "knowledge"
|
||||||
|
parent = p.parent.name if p.parent != VAULT else ""
|
||||||
|
if parent == "traeume":
|
||||||
|
cat = "events"
|
||||||
|
elif parent == "muster":
|
||||||
|
cat = "rules"
|
||||||
|
elif parent == "skill-kandidaten":
|
||||||
|
cat = "identity"
|
||||||
|
|
||||||
|
nodes.append({
|
||||||
|
"id": rel,
|
||||||
|
"content": p.stem, # stem ist oft kürzer/prägnanter als der Titel
|
||||||
|
"category": cat,
|
||||||
|
"source": "wiki"
|
||||||
|
})
|
||||||
|
|
||||||
|
# 2. Edges extrahieren (Wiki-Links [[Name]])
|
||||||
|
link_rx = re.compile(r"\[\[([^\]]+)\]\]")
|
||||||
|
for n in nodes:
|
||||||
|
try:
|
||||||
|
target = VAULT / n["id"]
|
||||||
|
content = target.read_text(encoding="utf-8", errors="replace")
|
||||||
|
# Set, um mehrfache Links auf dieselbe Datei zu entduplizieren
|
||||||
|
found_links = {m.group(1).strip().lower() for m in link_rx.finditer(content)}
|
||||||
|
|
||||||
|
for link in found_links:
|
||||||
|
target_id = name_to_id.get(link)
|
||||||
|
if target_id and target_id != n["id"]:
|
||||||
|
edges.append({
|
||||||
|
"source": n["id"],
|
||||||
|
"target": target_id,
|
||||||
|
"weight": 1.0
|
||||||
|
})
|
||||||
|
except OSError:
|
||||||
|
pass
|
||||||
|
|
||||||
|
return {"nodes": nodes, "edges": edges}
|
||||||
|
|||||||
@@ -13,7 +13,6 @@ from pathlib import Path
|
|||||||
|
|
||||||
from fastapi import APIRouter, HTTPException
|
from fastapi import APIRouter, HTTPException
|
||||||
from pydantic import BaseModel
|
from pydantic import BaseModel
|
||||||
|
|
||||||
from services import backup as backup_svc
|
from services import backup as backup_svc
|
||||||
|
|
||||||
router = APIRouter(prefix="/api")
|
router = APIRouter(prefix="/api")
|
||||||
@@ -34,7 +33,7 @@ def list_snapshots() -> dict:
|
|||||||
|
|
||||||
@router.get("/zeitmaschine/inhalt")
|
@router.get("/zeitmaschine/inhalt")
|
||||||
def snapshot_contents(file: str) -> dict:
|
def snapshot_contents(file: str) -> dict:
|
||||||
"""Top-Level-Komponenten eines Snapshots (mem0, hermes, llama-swap, MANIFEST …)."""
|
"""Top-Level-Komponenten eines Snapshots (hermes, llama-swap, MANIFEST …)."""
|
||||||
if not _FILE_RX.match(file):
|
if not _FILE_RX.match(file):
|
||||||
raise HTTPException(400, "Ungültiger Snapshot-Name.")
|
raise HTTPException(400, "Ungültiger Snapshot-Name.")
|
||||||
p = backup_svc.BACKUP_DIR / file
|
p = backup_svc.BACKUP_DIR / file
|
||||||
|
|||||||
@@ -10,12 +10,10 @@ Permission errors are handled gracefully.
|
|||||||
Uses user journal (systemctl --user) to query logs.
|
Uses user journal (systemctl --user) to query logs.
|
||||||
"""
|
"""
|
||||||
|
|
||||||
import os
|
|
||||||
import subprocess
|
import subprocess
|
||||||
from datetime import datetime, timezone
|
from datetime import datetime, timezone
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
|
||||||
LOG_DIR = Path.home() / "logs"
|
LOG_DIR = Path.home() / "logs"
|
||||||
LOG_FILE = LOG_DIR / "mc2-timeout.log"
|
LOG_FILE = LOG_DIR / "mc2-timeout.log"
|
||||||
SERVICE_NAME = "mission-control-2.service"
|
SERVICE_NAME = "mission-control-2.service"
|
||||||
|
|||||||
@@ -9,11 +9,15 @@ import os
|
|||||||
import re
|
import re
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import psutil
|
from config import (
|
||||||
|
BOX_CONSOLE_PATH,
|
||||||
from config import (BOX_CONSOLE_UPSTREAM,
|
BOX_CONSOLE_UPSTREAM,
|
||||||
BOX_CONSOLE_PATH, HERMES_BUILTIN_UI_UPSTREAM, HERMES_BUILTIN_UI_PATH,
|
HERMES_API_URL,
|
||||||
HERMES_API_URL, HERMES_HOME, PC_EXECUTOR_URL)
|
HERMES_BUILTIN_UI_PATH,
|
||||||
|
HERMES_BUILTIN_UI_UPSTREAM,
|
||||||
|
HERMES_HOME,
|
||||||
|
PC_EXECUTOR_URL,
|
||||||
|
)
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
@@ -194,7 +198,7 @@ def set_agent_brain(model_id: str) -> dict:
|
|||||||
new_members = [x for x in brains if x not in (old, model_id)] + [model_id]
|
new_members = [x for x in brains if x not in (old, model_id)] + [model_id]
|
||||||
llamaswap.set_group("brains", new_members, swap=False, persist=True) # 2) warm
|
llamaswap.set_group("brains", new_members, swap=False, persist=True) # 2) warm
|
||||||
# 2b) TTL härten: neues Hirn nie auto-entladen; altes Hirn auf Default entspannen.
|
# 2b) TTL härten: neues Hirn nie auto-entladen; altes Hirn auf Default entspannen.
|
||||||
from services.llamaswap import set_ttl, DEFAULT_TTL
|
from services.llamaswap import DEFAULT_TTL, set_ttl
|
||||||
set_ttl(model_id, 0)
|
set_ttl(model_id, 0)
|
||||||
if old:
|
if old:
|
||||||
set_ttl(old, DEFAULT_TTL)
|
set_ttl(old, DEFAULT_TTL)
|
||||||
@@ -253,7 +257,7 @@ def update_brain_model(new_model: str) -> bool:
|
|||||||
|
|
||||||
# Restart the user-space service to apply changes
|
# Restart the user-space service to apply changes
|
||||||
try:
|
try:
|
||||||
import services.maintenance as maintenance
|
from services import maintenance
|
||||||
maintenance.restart_service("hermes-gateway")
|
maintenance.restart_service("hermes-gateway")
|
||||||
except Exception:
|
except Exception:
|
||||||
log.warning("update_brain_model: hermes-gateway-Restart fehlgeschlagen", exc_info=True)
|
log.warning("update_brain_model: hermes-gateway-Restart fehlgeschlagen", exc_info=True)
|
||||||
|
|||||||
@@ -0,0 +1,176 @@
|
|||||||
|
"""Werkzeug-Verlauf des Agenten (v3-Umbau P6).
|
||||||
|
|
||||||
|
WARUM ES DAS GIBT: Lucys Arbeit war eine Blackbox mit Statuswort. Der Blueprint sah
|
||||||
|
dafür eine „Live Agent Matrix" mit Denkstrom vor (§4.4) — die ist so nicht baubar: Die
|
||||||
|
Denkschritte entstehen im Hermes-Prozess, und `AGENTS.md` verbietet es, dessen Quellcode
|
||||||
|
zu patchen.
|
||||||
|
|
||||||
|
Beim Nachsehen zeigte sich aber, dass die HÄLFTE davon längst offen daliegt: Hermes
|
||||||
|
protokolliert jeden Werkzeug-Ruf nach `~/.hermes/logs/agent.log`. Eine Log-Datei zu lesen
|
||||||
|
ist kein Patchen. Was dadurch sichtbar wird — welches Werkzeug, wie lange, mit welchem
|
||||||
|
Ergebnis, in welchem Lauf — ist für die Frage „was tut sie gerade und wo hängt es" oft
|
||||||
|
nützlicher als der Fließtext ihrer Gedanken.
|
||||||
|
|
||||||
|
WAS NICHT GEHT (und hier auch nicht so tut): der Denkstrom selbst und die Argumente eines
|
||||||
|
Werkzeug-Rufs. Beides steht nicht im Log. Die Ansicht verspricht deshalb nur, was sie
|
||||||
|
halten kann.
|
||||||
|
|
||||||
|
ES HAT SICH SOFORT GELOHNT: Beim ersten Lesen fiel auf, dass `web_extract` seit
|
||||||
|
mindestens dem 25.08. JEDEN Morgen um 07:00 scheitert (der Suchanbieter kann keine
|
||||||
|
Seiten abrufen). Vier Tage lang, ohne dass es irgendwo aufgefallen wäre.
|
||||||
|
"""
|
||||||
|
|
||||||
|
import logging
|
||||||
|
import os
|
||||||
|
import re
|
||||||
|
from datetime import datetime
|
||||||
|
from pathlib import Path
|
||||||
|
from zoneinfo import ZoneInfo
|
||||||
|
|
||||||
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
|
# Die Box läuft in Europe/Berlin (AGENTS.md). Hermes' Log trägt Ortszeit ohne Offset.
|
||||||
|
LOCAL_TZ = ZoneInfo(os.environ.get("MC_LOCAL_TZ", "Europe/Berlin"))
|
||||||
|
|
||||||
|
LOG_PFAD = Path(os.path.expanduser(
|
||||||
|
os.environ.get("MC_HERMES_AGENT_LOG", "~/.hermes/logs/agent.log")))
|
||||||
|
|
||||||
|
# Nur das Ende der Datei lesen. Sie wächst auf mehrere MB und wird rotiert; für einen
|
||||||
|
# Verlauf der letzten Stunden reicht der Schwanz — und er kostet nichts.
|
||||||
|
LESE_BYTES = 512 * 1024
|
||||||
|
|
||||||
|
# Die drei Formen, in denen Hermes einen Werkzeug-Ruf notiert (am Log gemessen, nicht
|
||||||
|
# geraten). Die Lauf-Kennung in eckigen Klammern fehlt bei Nicht-Cron-Läufen.
|
||||||
|
#
|
||||||
|
# INFO [cron_…] agent.tool_executor: tool terminal completed (1.40s, 53 chars)
|
||||||
|
# INFO agent.tool_executor: tool web_search completed (2.61s, 2944 chars)
|
||||||
|
# WARNING [cron_…] agent.tool_executor: Tool web_extract returned error (0.17s): {…}
|
||||||
|
# INFO agent.tool_executor: tool web_extract failed (0.17s): {…}
|
||||||
|
_ZEIT = r"(?P<zeit>\d{4}-\d{2}-\d{2} \d{2}:\d{2}:\d{2}),\d+"
|
||||||
|
_LAUF = r"(?:\[(?P<lauf>[^\]]+)\] )?"
|
||||||
|
|
||||||
|
_FERTIG = re.compile(
|
||||||
|
_ZEIT + r" \w+ " + _LAUF + r"agent\.tool_executor: [Tt]ool (?P<werkzeug>\S+) completed "
|
||||||
|
r"\((?P<dauer>[\d.]+)s, (?P<zeichen>\d+) chars\)")
|
||||||
|
|
||||||
|
_FEHLER = re.compile(
|
||||||
|
_ZEIT + r" \w+ " + _LAUF + r"agent\.tool_executor: [Tt]ool (?P<werkzeug>\S+) "
|
||||||
|
r"(?:failed|returned error) \((?P<dauer>[\d.]+)s\)(?::\s*(?P<detail>.*))?")
|
||||||
|
|
||||||
|
|
||||||
|
def _schwanz(pfad: Path, n: int) -> list[str]:
|
||||||
|
"""Die letzten n Bytes als Zeilen. Die erste Zeile kann angeschnitten sein und
|
||||||
|
wird verworfen — ein halber Zeitstempel passt auf kein Muster, aber sicher ist besser."""
|
||||||
|
try:
|
||||||
|
groesse = pfad.stat().st_size
|
||||||
|
with pfad.open("rb") as f:
|
||||||
|
f.seek(max(0, groesse - n))
|
||||||
|
roh = f.read()
|
||||||
|
zeilen = roh.decode("utf-8", errors="replace").splitlines()
|
||||||
|
return zeilen[1:] if groesse > n and zeilen else zeilen
|
||||||
|
except OSError:
|
||||||
|
return []
|
||||||
|
|
||||||
|
|
||||||
|
def _kurz(detail: str | None) -> str | None:
|
||||||
|
"""Fehlertext des Werkzeugs auf einen lesbaren Satz eindampfen. Hermes legt dort ein
|
||||||
|
JSON ab; interessant ist daran nur das `error`-Feld."""
|
||||||
|
if not detail:
|
||||||
|
return None
|
||||||
|
treffer = re.search(r'"error"\s*:\s*"([^"]{1,300})"', detail)
|
||||||
|
text = treffer.group(1) if treffer else detail.strip()
|
||||||
|
return (text[:297] + "…") if len(text) > 300 else text
|
||||||
|
|
||||||
|
|
||||||
|
def rufe(limit: int = 60) -> list[dict]:
|
||||||
|
"""Die jüngsten Werkzeug-Rufe, ältester zuerst."""
|
||||||
|
ergebnis: list[dict] = []
|
||||||
|
for zeile in _schwanz(LOG_PFAD, LESE_BYTES):
|
||||||
|
m = _FERTIG.match(zeile)
|
||||||
|
if m:
|
||||||
|
ergebnis.append({
|
||||||
|
"zeit": _iso(m.group("zeit")),
|
||||||
|
"lauf": m.group("lauf"),
|
||||||
|
"werkzeug": m.group("werkzeug"),
|
||||||
|
"dauer_s": float(m.group("dauer")),
|
||||||
|
"zeichen": int(m.group("zeichen")),
|
||||||
|
"ok": True,
|
||||||
|
"fehler": None,
|
||||||
|
})
|
||||||
|
continue
|
||||||
|
m = _FEHLER.match(zeile)
|
||||||
|
if m:
|
||||||
|
ergebnis.append({
|
||||||
|
"zeit": _iso(m.group("zeit")),
|
||||||
|
"lauf": m.group("lauf"),
|
||||||
|
"werkzeug": m.group("werkzeug"),
|
||||||
|
"dauer_s": float(m.group("dauer")),
|
||||||
|
"zeichen": None,
|
||||||
|
"ok": False,
|
||||||
|
"fehler": _kurz(m.group("detail")),
|
||||||
|
})
|
||||||
|
return ergebnis[-limit:]
|
||||||
|
|
||||||
|
|
||||||
|
def _iso(s: str) -> str:
|
||||||
|
"""`2026-08-28 07:03:18` → ISO MIT Zeitzone.
|
||||||
|
|
||||||
|
Hermes schreibt seine Log-Zeitstempel in Ortszeit ohne Offset. Die naiv zu lassen
|
||||||
|
wäre bequem (der Klient zeigt sie nur an) — aber genau daran hängt eine
|
||||||
|
Projektregel: Naive Zeiten werden über MC_LOCAL_TZ aufgelöst, nie geraten
|
||||||
|
(AGENTS.md; ruff DTZ007 erzwingt es). Sobald jemand später damit rechnet — Dauer
|
||||||
|
über Mitternacht, Vergleich mit einem Cron-Plan — wäre eine offsetlose Zeit eine
|
||||||
|
Falle, die erst zur Zeitumstellung zuschnappt."""
|
||||||
|
try:
|
||||||
|
return datetime.strptime(s, "%Y-%m-%d %H:%M:%S").replace(tzinfo=LOCAL_TZ).isoformat()
|
||||||
|
except ValueError:
|
||||||
|
return s
|
||||||
|
|
||||||
|
|
||||||
|
def uebersicht(limit: int = 60) -> dict:
|
||||||
|
"""Was die Agent-Ansicht braucht: die Rufe selbst, je Werkzeug eine Bilanz und die
|
||||||
|
wiederkehrenden Fehler zusammengefasst.
|
||||||
|
|
||||||
|
Die Bilanz ist der eigentliche Nutzen: Ein Werkzeug, das IMMER scheitert, verschwindet
|
||||||
|
in einer Zeitleiste — in einer Zeile „web_extract · 4 Rufe · 4 Fehler" nicht."""
|
||||||
|
liste = rufe(limit)
|
||||||
|
if not LOG_PFAD.exists():
|
||||||
|
return {"verfuegbar": False, "pfad": str(LOG_PFAD), "rufe": [],
|
||||||
|
"werkzeuge": [], "laeufe": []}
|
||||||
|
|
||||||
|
bilanz: dict[str, dict] = {}
|
||||||
|
for r in liste:
|
||||||
|
b = bilanz.setdefault(r["werkzeug"], {
|
||||||
|
"werkzeug": r["werkzeug"], "rufe": 0, "fehler": 0,
|
||||||
|
"dauer_summe": 0.0, "letzter_fehler": None,
|
||||||
|
})
|
||||||
|
b["rufe"] += 1
|
||||||
|
b["dauer_summe"] += r["dauer_s"]
|
||||||
|
if not r["ok"]:
|
||||||
|
b["fehler"] += 1
|
||||||
|
b["letzter_fehler"] = r["fehler"]
|
||||||
|
|
||||||
|
werkzeuge = sorted(
|
||||||
|
({**b, "dauer_schnitt_s": round(b["dauer_summe"] / max(b["rufe"], 1), 2)}
|
||||||
|
for b in bilanz.values()),
|
||||||
|
key=lambda b: (-b["fehler"], -b["rufe"]),
|
||||||
|
)
|
||||||
|
|
||||||
|
# Läufe in der Reihenfolge ihres ersten Auftretens (nicht sortiert nach Kennung —
|
||||||
|
# die trägt zwar ein Datum, aber darauf sollte sich niemand verlassen).
|
||||||
|
laeufe: list[dict] = []
|
||||||
|
gesehen: dict[str, dict] = {}
|
||||||
|
for r in liste:
|
||||||
|
schluessel = r["lauf"] or "(interaktiv)"
|
||||||
|
if schluessel not in gesehen:
|
||||||
|
gesehen[schluessel] = {"lauf": schluessel, "von": r["zeit"], "bis": r["zeit"],
|
||||||
|
"rufe": 0, "fehler": 0}
|
||||||
|
laeufe.append(gesehen[schluessel])
|
||||||
|
e = gesehen[schluessel]
|
||||||
|
e["bis"] = r["zeit"]
|
||||||
|
e["rufe"] += 1
|
||||||
|
if not r["ok"]:
|
||||||
|
e["fehler"] += 1
|
||||||
|
|
||||||
|
return {"verfuegbar": True, "pfad": str(LOG_PFAD), "rufe": liste,
|
||||||
|
"werkzeuge": werkzeuge, "laeufe": laeufe}
|
||||||
@@ -20,7 +20,6 @@ import time
|
|||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import MODELS_DIR
|
from config import MODELS_DIR
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|||||||
@@ -1,461 +0,0 @@
|
|||||||
"""
|
|
||||||
Auftragsbuch — die Vorschlags-Inbox der Box (das Mensch-Gate als Klick statt Git-Handarbeit).
|
|
||||||
|
|
||||||
Quellen der Karten:
|
|
||||||
• Vorschlags-Branches auf Gitea (wartung/*, orchestrator/*, doku/*) — die Werkstatt und der
|
|
||||||
Orchestrator arbeiten propose-only und lassen ihre Ergebnisse dort liegen.
|
|
||||||
Seit S3 (lucy-pipeline) aus ZWEI Repos: mission-control-v2 (Box-Stack) UND lucy (Desktop-App).
|
|
||||||
• Skill-Kandidaten aus dem Wissens-Vault (~/wissens-vault/skill-kandidaten/) — Vorschläge des
|
|
||||||
nächtlichen Traum-Crons, Gate war bisher „Commander sagt mach".
|
|
||||||
|
|
||||||
Annehmen (Branch) startet den Repo-eigenen Runner als EIGENE systemd-Unit (detached):
|
|
||||||
• mc2: deploy/auftrag-annehmen.sh — Merge im Worktree → Push main → Deploy → Health → Revert bei Rot.
|
|
||||||
• lucy: deploy/lucy-annahme.sh — Merge im Worktree → Push main → PC baut dist (via PC-Executor)
|
|
||||||
und startet Lucy neu, wenn sie lief → bei Rot Revert auf main (die laufende Lucy bleibt die alte).
|
|
||||||
Detached, weil deploy.sh mission-control-2 neu startet — ein Kind des Backends stürbe mittendrin.
|
|
||||||
Der Fortschritt landet in STATUS_PATH (JSON), das Skript schreibt, die API liest nur.
|
|
||||||
Status-Schlüssel: mc2 = Branch-Name pur (Bestand), lucy = "lucy:<branch>" (kollisionsfrei).
|
|
||||||
|
|
||||||
Lokal (Windows-Dev) ist alles harmlos: available=False, Aktionen geben Fehler statt zu crashen.
|
|
||||||
"""
|
|
||||||
|
|
||||||
import json
|
|
||||||
import logging
|
|
||||||
import os
|
|
||||||
import re
|
|
||||||
import shutil
|
|
||||||
import subprocess
|
|
||||||
import time
|
|
||||||
from pathlib import Path
|
|
||||||
|
|
||||||
from config import MODELS_DIR
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
|
||||||
|
|
||||||
REPO = Path(os.environ.get("MC2_SOURCE_DIR", "~/mission-control-v2")).expanduser()
|
|
||||||
LUCY = Path(os.environ.get("MC2_LUCY_DIR", "~/lucy")).expanduser()
|
|
||||||
VAULT = Path(os.environ.get("MC_VAULT_DIR", "~/wissens-vault")).expanduser()
|
|
||||||
STATUS_PATH = Path(os.environ.get("MC2_AUFTRAG_STATUS", str(MODELS_DIR / "mc2-auftragsbuch.json")))
|
|
||||||
# Empfehlungs-Stempel des nächtlichen Karten-Gutachters (deploy/karten-gutachter.sh schreibt,
|
|
||||||
# die API liest nur) und das Lern-Gedächtnis der Ablehnungen (Radar/Specifier lesen es).
|
|
||||||
GUTACHTEN_PATH = Path(os.environ.get("MC2_KARTEN_GUTACHTEN", str(MODELS_DIR / "mc2-karten-gutachten.json")))
|
|
||||||
ABLEHNUNGEN_PATH = Path(os.environ.get("MC2_ABLEHNUNGEN", str(MODELS_DIR / "mc2-ablehnungen.jsonl")))
|
|
||||||
|
|
||||||
# Karten-Quellen. Die Runner-Skripte liegen IMMER im MC2-Checkout (deploy/) — auch der
|
|
||||||
# Lucy-Runner, denn er läuft auf der Box; nur der Build passiert am PC.
|
|
||||||
REPOS: dict[str, dict] = {
|
|
||||||
"mc2": {"path": REPO, "runner": "auftrag-annehmen.sh", "key": ""},
|
|
||||||
"lucy": {"path": LUCY, "runner": "lucy-annahme.sh", "key": "lucy:"},
|
|
||||||
}
|
|
||||||
|
|
||||||
# Persistenz für gemeldete Branches (Idempotenz: nur EINMAL pro Branch pingen).
|
|
||||||
# Muster wie mc2-announce.json unter MODELS_DIR.
|
|
||||||
ANNOUNCE_BRANCHES_PATH = Path(os.environ.get("MC2_ANNOUNCE_BRANCHES", str(MODELS_DIR / "mc2-announce-branches.json")))
|
|
||||||
|
|
||||||
# Nur diese Branch-Familien sind Vorschläge (main/HEAD & Fremdes bleiben draußen).
|
|
||||||
PREFIXES = ("wartung/", "orchestrator/", "doku/", "feature/")
|
|
||||||
# Branch-Namen kommen vom Client zurück → hart validieren (keine Shell-/Git-Injektion).
|
|
||||||
_BRANCH_RX = re.compile(r"^[A-Za-z0-9][A-Za-z0-9._/-]{0,120}$")
|
|
||||||
_KANDIDAT_RX = re.compile(r"^[A-Za-z0-9][A-Za-z0-9._ -]{0,120}\.md$")
|
|
||||||
|
|
||||||
_fetch_cache: dict = {}
|
|
||||||
_FETCH_EVERY = 30.0 # s — Gitea nicht bei jedem UI-Poll anfragen
|
|
||||||
|
|
||||||
|
|
||||||
def _available() -> bool:
|
|
||||||
return os.name == "posix" and (REPO / ".git").exists()
|
|
||||||
|
|
||||||
|
|
||||||
def _repo_ok(repo: str) -> bool:
|
|
||||||
r = REPOS.get(repo)
|
|
||||||
return bool(r) and os.name == "posix" and (r["path"] / ".git").exists()
|
|
||||||
|
|
||||||
|
|
||||||
def _git(repo: str, args: list[str], timeout: int = 20) -> subprocess.CompletedProcess:
|
|
||||||
return subprocess.run(["git", "-C", str(REPOS[repo]["path"]), *args],
|
|
||||||
capture_output=True, text=True, timeout=timeout)
|
|
||||||
|
|
||||||
|
|
||||||
def _status_key(repo: str, branch: str) -> str:
|
|
||||||
return f"{REPOS[repo]['key']}{branch}"
|
|
||||||
|
|
||||||
|
|
||||||
def _fetch_throttled(repo: str) -> None:
|
|
||||||
now = time.time()
|
|
||||||
if now - _fetch_cache.get(repo, 0.0) < _FETCH_EVERY:
|
|
||||||
return
|
|
||||||
_fetch_cache[repo] = now
|
|
||||||
try:
|
|
||||||
_git(repo, ["fetch", "-q", "--prune", "origin"], timeout=30)
|
|
||||||
except Exception:
|
|
||||||
log.warning("auftragsbuch: git fetch (%s) fehlgeschlagen", repo, exc_info=True)
|
|
||||||
|
|
||||||
|
|
||||||
def _load_announce_branches() -> set:
|
|
||||||
"""Liefert die Menge der bereits gemeldeten Branch-Namen (Idempotenz)."""
|
|
||||||
try:
|
|
||||||
data = json.loads(ANNOUNCE_BRANCHES_PATH.read_text(encoding="utf-8"))
|
|
||||||
return set(data) if isinstance(data, list) else set()
|
|
||||||
except Exception:
|
|
||||||
return set()
|
|
||||||
|
|
||||||
|
|
||||||
def _save_announce_branches(branches: set) -> None:
|
|
||||||
"""Speichert die Menge gemelder Branch-Namen."""
|
|
||||||
try:
|
|
||||||
tmp = ANNOUNCE_BRANCHES_PATH.with_suffix(".tmp")
|
|
||||||
tmp.write_text(json.dumps(sorted(branches), ensure_ascii=False), encoding="utf-8")
|
|
||||||
tmp.replace(ANNOUNCE_BRANCHES_PATH)
|
|
||||||
except OSError:
|
|
||||||
log.warning("auftragsbuch: Announce-Branches %s nicht schreibbar", ANNOUNCE_BRANCHES_PATH, exc_info=True)
|
|
||||||
|
|
||||||
|
|
||||||
def _statuses() -> dict:
|
|
||||||
try:
|
|
||||||
return (json.loads(STATUS_PATH.read_text(encoding="utf-8")) or {}).get("branches", {})
|
|
||||||
except Exception:
|
|
||||||
return {}
|
|
||||||
|
|
||||||
|
|
||||||
def _set_status(key: str, state: str, detail: str) -> None:
|
|
||||||
try:
|
|
||||||
try:
|
|
||||||
data = json.loads(STATUS_PATH.read_text(encoding="utf-8"))
|
|
||||||
except Exception:
|
|
||||||
data = {}
|
|
||||||
data.setdefault("branches", {})[key] = {"state": state, "detail": detail, "ts": time.time()}
|
|
||||||
tmp = STATUS_PATH.with_suffix(".tmp")
|
|
||||||
tmp.write_text(json.dumps(data, ensure_ascii=False), encoding="utf-8")
|
|
||||||
tmp.replace(STATUS_PATH)
|
|
||||||
except OSError:
|
|
||||||
log.warning("auftragsbuch: Status %s nicht schreibbar", STATUS_PATH, exc_info=True)
|
|
||||||
|
|
||||||
|
|
||||||
def _gutachten() -> dict:
|
|
||||||
"""Alle Karten-Stempel ("<repo>:<branch>" → {empfehlung, satz, richter, commit_ts, ts})."""
|
|
||||||
try:
|
|
||||||
data = json.loads(GUTACHTEN_PATH.read_text(encoding="utf-8"))
|
|
||||||
return data if isinstance(data, dict) else {}
|
|
||||||
except Exception:
|
|
||||||
return {}
|
|
||||||
|
|
||||||
|
|
||||||
def _remote_branches(repo: str) -> list[str]:
|
|
||||||
r = _git(repo, ["for-each-ref", "--format=%(refname:short)", "refs/remotes/origin"])
|
|
||||||
out = []
|
|
||||||
for line in (r.stdout or "").splitlines():
|
|
||||||
name = line.strip().removeprefix("origin/")
|
|
||||||
if name and name != "HEAD" and name.startswith(PREFIXES):
|
|
||||||
out.append(name)
|
|
||||||
return out
|
|
||||||
|
|
||||||
|
|
||||||
def _valid_branch(branch: str) -> bool:
|
|
||||||
return bool(_BRANCH_RX.match(branch)) and ".." not in branch and branch.startswith(PREFIXES)
|
|
||||||
|
|
||||||
|
|
||||||
def _repo_items(repo: str, statuses: dict, gutachten: dict) -> list[dict]:
|
|
||||||
items = []
|
|
||||||
for branch in _remote_branches(repo):
|
|
||||||
ref = f"origin/{branch}"
|
|
||||||
status = statuses.get(_status_key(repo, branch))
|
|
||||||
try:
|
|
||||||
ahead = int((_git(repo, ["rev-list", "--count", f"origin/main..{ref}"]).stdout or "0").strip() or 0)
|
|
||||||
if ahead == 0 and ((status or {}).get("state") not in ("laeuft", "rollback")):
|
|
||||||
continue # bereits in main enthalten → keine offene Entscheidung mehr
|
|
||||||
behind = int((_git(repo, ["rev-list", "--count", f"{ref}..origin/main"]).stdout or "0").strip() or 0)
|
|
||||||
# Kaputt aufgesetzte Branches entlarven (Worker machte git init/Shallow statt zu
|
|
||||||
# klonen): ohne gemeinsamen Vorfahren kann git NIE mergen — Annehmen wäre ein
|
|
||||||
# garantierter Fehllauf („refusing to merge unrelated histories").
|
|
||||||
verwaist = _git(repo, ["merge-base", "origin/main", ref]).returncode != 0
|
|
||||||
show = _git(repo, ["show", "-s", "--format=%s%x1f%b%x1f%ct%x1f%an", ref])
|
|
||||||
subject, body, cts, author = ((show.stdout or "").split("\x1f") + ["", "", "", ""])[:4]
|
|
||||||
ts_val = int(cts) if cts.strip().isdigit() else None
|
|
||||||
# Stempel nur zeigen, wenn er zum AKTUELLEN Commit gehört (nachgeschobener
|
|
||||||
# Commit macht das alte Gutachten ungültig — der Nacht-Lauf stempelt neu).
|
|
||||||
stempel = gutachten.get(f"{repo}:{branch}")
|
|
||||||
if not (isinstance(stempel, dict) and stempel.get("commit_ts") == ts_val):
|
|
||||||
stempel = None
|
|
||||||
stat = (_git(repo, ["diff", "--shortstat", f"origin/main...{ref}"]).stdout or "").strip()
|
|
||||||
files_raw = (_git(repo, ["diff", "--name-status", f"origin/main...{ref}"]).stdout or "").splitlines()
|
|
||||||
files = []
|
|
||||||
for line in files_raw[:60]:
|
|
||||||
parts = line.split("\t")
|
|
||||||
if len(parts) >= 2:
|
|
||||||
files.append({"status": parts[0][:2], "path": parts[-1]})
|
|
||||||
paths = [f["path"] for f in files]
|
|
||||||
frontend_src = any(p.startswith("frontend/src") for p in paths)
|
|
||||||
frontend_dist = any(p.startswith("frontend/dist") for p in paths)
|
|
||||||
items.append({
|
|
||||||
"repo": repo,
|
|
||||||
"branch": branch,
|
|
||||||
"kind": branch.split("/", 1)[0],
|
|
||||||
"subject": subject.strip(),
|
|
||||||
"body": body.strip()[:2000],
|
|
||||||
"author": author.strip(),
|
|
||||||
"ts": ts_val,
|
|
||||||
"empfehlung": stempel,
|
|
||||||
"ahead": ahead,
|
|
||||||
"behind": behind,
|
|
||||||
"verwaist": verwaist,
|
|
||||||
# Diff gegen main ist leer → der Branch brächte nichts (Inhalt schon in main
|
|
||||||
# oder Worker hat am Repo vorbei gearbeitet). Bei verwaist ist der Diff
|
|
||||||
# technisch leer (kein merge-base) — dann zählt nur das verwaist-Flag.
|
|
||||||
"leer": not verwaist and ahead > 0 and not files_raw,
|
|
||||||
"shortstat": stat,
|
|
||||||
"files": files,
|
|
||||||
"files_truncated": len(files_raw) > 60,
|
|
||||||
# Nur mc2: Frontend-Quelltext ohne gebautes Bundle — die Box deployt dist so, wie
|
|
||||||
# es im Repo liegt. Lucy wird dagegen IMMER am PC gebaut (kein dist im Repo).
|
|
||||||
"frontend_ohne_build": repo == "mc2" and frontend_src and not frontend_dist,
|
|
||||||
"status": None if (status or {}).get("state") == "eingespielt" and ahead > 0 else status,
|
|
||||||
})
|
|
||||||
except Exception:
|
|
||||||
log.warning("auftragsbuch: Branch %s (%s) nicht lesbar", branch, repo, exc_info=True)
|
|
||||||
return items
|
|
||||||
|
|
||||||
|
|
||||||
def list_proposals() -> dict:
|
|
||||||
"""Alle offenen Vorschläge: Branches aus beiden Repos (mit Commit-/Diff-Zusammenfassung +
|
|
||||||
Status) und Skill-Kandidaten aus dem Vault. Eine Antwort für die ganze Auftragsbuch-Seite.
|
|
||||||
|
|
||||||
Nebenbei: Pinge neu auftauchende Vorschlags-Branches per Telegram und füge sie dem
|
|
||||||
Briefkasten hinzu (Idempotenz: nur EINMAL pro Branch)."""
|
|
||||||
if not _available():
|
|
||||||
return {"available": False, "items": [], "skill_kandidaten": [], "open_count": 0}
|
|
||||||
|
|
||||||
statuses = _statuses()
|
|
||||||
gutachten = _gutachten()
|
|
||||||
items = []
|
|
||||||
for repo in REPOS:
|
|
||||||
if not _repo_ok(repo):
|
|
||||||
continue # z. B. ~/lucy (noch) nicht geklont → Karten dieses Repos einfach weglassen
|
|
||||||
_fetch_throttled(repo)
|
|
||||||
items.extend(_repo_items(repo, statuses, gutachten))
|
|
||||||
items.sort(key=lambda i: i.get("ts") or 0, reverse=True)
|
|
||||||
|
|
||||||
# --- Telegram-Ping für NEUE Vorschlags-Branches (Idempotenz) ---
|
|
||||||
# Alle aktuellen Branch-Namen aus beiden Repos sammeln
|
|
||||||
aktuelle_branches = set()
|
|
||||||
for repo in REPOS:
|
|
||||||
if _repo_ok(repo):
|
|
||||||
aktuelle_branches.update(_remote_branches(repo))
|
|
||||||
|
|
||||||
# Bereits gemeldete Branches laden
|
|
||||||
gemeldet = _load_announce_branches()
|
|
||||||
|
|
||||||
# Nur wirklich NEUE Branches pingen
|
|
||||||
neue = aktuelle_branches - gemeldet
|
|
||||||
for branch in neue:
|
|
||||||
# NotifyTelegram best-effort, niemals crashen
|
|
||||||
try:
|
|
||||||
from services import announce
|
|
||||||
subject = "[Auftragsbuch]"
|
|
||||||
text = f"Neue Karte wartet auf deinen Klick: {branch}"
|
|
||||||
announce.notify_telegram(subject, text)
|
|
||||||
# Und ein Eintrag für den Briefkasten (damit Lucy es spricht)
|
|
||||||
announce.add(text, subject, "auftragsbuch", "normal")
|
|
||||||
except Exception:
|
|
||||||
log.warning("auftragsbuch: Telegram-Ping für %s fehlgeschlagen", branch, exc_info=True)
|
|
||||||
|
|
||||||
# Als gemeldet speichern — aber NUR bei echter Änderung. Ein unbedingtes Schreiben
|
|
||||||
# bumpte die mtime bei jedem Aufruf, der SSE-Sammler (events.py, Fingerabdruck =
|
|
||||||
# Datei-mtime) meldete daraufhin „geändert", die UI holte neu, schrieb wieder …
|
|
||||||
# → 3-s-Endlosschleife auf /api/auftragsbuch je offenem Client (gefunden 15.07. nachts).
|
|
||||||
if aktuelle_branches != gemeldet:
|
|
||||||
_save_announce_branches(aktuelle_branches)
|
|
||||||
|
|
||||||
kandidaten = list_skill_kandidaten()
|
|
||||||
open_count = sum(1 for i in items
|
|
||||||
if (i.get("status") or {}).get("state") not in ("eingespielt",)) + len(kandidaten)
|
|
||||||
return {"available": True, "items": items, "skill_kandidaten": kandidaten, "open_count": open_count}
|
|
||||||
|
|
||||||
|
|
||||||
def diff_of(branch: str, repo: str = "mc2") -> dict:
|
|
||||||
if not _repo_ok(repo):
|
|
||||||
return {"ok": False, "error": "Nur auf der Box verfügbar."}
|
|
||||||
if not _valid_branch(branch) or branch not in _remote_branches(repo):
|
|
||||||
return {"ok": False, "error": f"Unbekannter Vorschlags-Branch: {branch}"}
|
|
||||||
r = _git(repo, ["diff", f"origin/main...origin/{branch}"], timeout=30)
|
|
||||||
text = r.stdout or ""
|
|
||||||
truncated = len(text) > 200_000
|
|
||||||
return {"ok": True, "diff": text[:200_000], "truncated": truncated}
|
|
||||||
|
|
||||||
|
|
||||||
def accept(branch: str, repo: str = "mc2") -> dict:
|
|
||||||
"""Annehmen: detached Runner starten. mc2: Merge→Push→Deploy→Health→ggf. Rollback.
|
|
||||||
lucy: Merge→Push→PC-Build+Neustart→ggf. Revert (der Runner spricht den PC-Executor an)."""
|
|
||||||
if not _repo_ok(repo):
|
|
||||||
return {"ok": False, "error": "Annehmen geht nur auf der Box."}
|
|
||||||
if not _valid_branch(branch) or branch not in _remote_branches(repo):
|
|
||||||
return {"ok": False, "error": f"Unbekannter Vorschlags-Branch: {branch}"}
|
|
||||||
key = _status_key(repo, branch)
|
|
||||||
state = (_statuses().get(key) or {}).get("state")
|
|
||||||
if state in ("laeuft", "rollback"):
|
|
||||||
return {"ok": False, "error": "Für diesen Vorschlag läuft bereits ein Annahme-Lauf."}
|
|
||||||
# Kaputt aufgesetzter Branch (kein gemeinsamer Vorfahre) → Merge kann NIE gelingen;
|
|
||||||
# gar nicht erst einen Runner starten (die UI blendet den Knopf aus, die API hält dicht).
|
|
||||||
if _git(repo, ["merge-base", "origin/main", f"origin/{branch}"]).returncode != 0:
|
|
||||||
return {"ok": False, "error": "Dieser Branch hat keinen gemeinsamen Ursprung mit main "
|
|
||||||
"(kaputt aufgesetzt, z. B. git init statt Klonen) — Annehmen ist technisch unmöglich. "
|
|
||||||
"Bitte ablehnen (gern mit Grund) und die Idee neu in die Queue geben."}
|
|
||||||
|
|
||||||
# Runner als /tmp-Kopie starten: deploy.sh resettet das Repo hart — das Original-Skript
|
|
||||||
# würde einem laufenden bash unter den Füßen getauscht (bekannte Selbst-Reset-Falle).
|
|
||||||
src = REPO / "deploy" / REPOS[repo]["runner"]
|
|
||||||
if not src.is_file():
|
|
||||||
return {"ok": False, "error": f"Runner fehlt im Checkout: {src.name}"}
|
|
||||||
runner = Path(f"/tmp/mc2-auftrag-runner-{int(time.time())}.sh")
|
|
||||||
try:
|
|
||||||
shutil.copyfile(src, runner)
|
|
||||||
except OSError as exc:
|
|
||||||
return {"ok": False, "error": f"Runner nicht kopierbar: {exc}"}
|
|
||||||
|
|
||||||
slug = re.sub(r"[^a-z0-9-]+", "-", f"{repo}-{branch}".lower())[:40].strip("-")
|
|
||||||
unit = f"mc2-auftrag-{slug}-{int(time.time())}"
|
|
||||||
r = subprocess.run(
|
|
||||||
["systemd-run", "--user", "--collect", f"--unit={unit}",
|
|
||||||
"/bin/bash", str(runner), branch],
|
|
||||||
capture_output=True, text=True, timeout=20)
|
|
||||||
if r.returncode != 0:
|
|
||||||
return {"ok": False, "error": f"Start fehlgeschlagen: {(r.stderr or r.stdout).strip()[:300]}"}
|
|
||||||
_set_status(key, "laeuft", "Annahme-Lauf gestartet")
|
|
||||||
return {"ok": True, "unit": unit}
|
|
||||||
|
|
||||||
|
|
||||||
def reject(branch: str, repo: str = "mc2", grund: str = "") -> dict:
|
|
||||||
"""Ablehnen: Remote-Branch löschen (die Arbeit bleibt in der Gitea-Historie referenzierbar,
|
|
||||||
aber die Entscheidung ist gefallen). Der optionale GRUND ist das Lern-Gedächtnis des
|
|
||||||
Kreislaufs: er landet in ABLEHNUNGEN_PATH (jsonl), und Idle-Radar/Analysten bekommen
|
|
||||||
ihn als „NIE wieder vorschlagen"-Material vorgelegt. Meldung in den Briefkasten."""
|
|
||||||
if not _repo_ok(repo):
|
|
||||||
return {"ok": False, "error": "Ablehnen geht nur auf der Box."}
|
|
||||||
if not _valid_branch(branch) or branch not in _remote_branches(repo):
|
|
||||||
return {"ok": False, "error": f"Unbekannter Vorschlags-Branch: {branch}"}
|
|
||||||
grund = (grund or "").strip()[:400]
|
|
||||||
# Betreff VOR dem Löschen sichern — danach ist der Ref weg.
|
|
||||||
subject = (_git(repo, ["show", "-s", "--format=%s", f"origin/{branch}"]).stdout or "").strip()[:200]
|
|
||||||
r = _git(repo, ["push", "origin", "--delete", branch], timeout=30)
|
|
||||||
if r.returncode != 0:
|
|
||||||
return {"ok": False, "error": f"Löschen fehlgeschlagen: {(r.stderr or '').strip()[:300]}"}
|
|
||||||
_git(repo, ["fetch", "-q", "--prune", "origin"], timeout=30)
|
|
||||||
detail = "Vom Commander abgelehnt — Branch gelöscht"
|
|
||||||
if grund:
|
|
||||||
detail += f" (Grund: {grund})"
|
|
||||||
_set_status(_status_key(repo, branch), "abgelehnt", detail)
|
|
||||||
try:
|
|
||||||
with ABLEHNUNGEN_PATH.open("a", encoding="utf-8") as f:
|
|
||||||
f.write(json.dumps({"ts": int(time.time()), "repo": repo, "branch": branch,
|
|
||||||
"subject": subject, "grund": grund}, ensure_ascii=False) + "\n")
|
|
||||||
except OSError:
|
|
||||||
log.warning("auftragsbuch: Ablehn-Gedächtnis %s nicht schreibbar", ABLEHNUNGEN_PATH, exc_info=True)
|
|
||||||
try:
|
|
||||||
from services import announce
|
|
||||||
wo = "im Lucy-Repo " if repo == "lucy" else ""
|
|
||||||
warum = f" Grund: {grund}" if grund else ""
|
|
||||||
announce.add(f"Vorschlag '{branch}' {wo}wurde abgelehnt und der Branch gelöscht.{warum}",
|
|
||||||
"[Auftragsbuch]", "auftragsbuch", "silent")
|
|
||||||
except Exception:
|
|
||||||
pass
|
|
||||||
return {"ok": True}
|
|
||||||
|
|
||||||
|
|
||||||
# ── Skill-Kandidaten (Wissens-Vault) ─────────────────────────────────────────
|
|
||||||
|
|
||||||
def _kandidaten_dir() -> Path:
|
|
||||||
return VAULT / "skill-kandidaten"
|
|
||||||
|
|
||||||
|
|
||||||
def list_skill_kandidaten() -> list[dict]:
|
|
||||||
d = _kandidaten_dir()
|
|
||||||
if os.name != "posix" or not d.is_dir():
|
|
||||||
return []
|
|
||||||
out = []
|
|
||||||
for p in sorted(d.glob("*.md"), key=lambda x: x.stat().st_mtime, reverse=True):
|
|
||||||
try:
|
|
||||||
text = p.read_text(encoding="utf-8", errors="replace")
|
|
||||||
first = next((ln.strip().lstrip("# ") for ln in text.splitlines() if ln.strip()), p.stem)
|
|
||||||
out.append({"file": p.name, "title": first[:160],
|
|
||||||
"preview": text[:3000], "mtime": p.stat().st_mtime})
|
|
||||||
except OSError:
|
|
||||||
continue
|
|
||||||
return out
|
|
||||||
|
|
||||||
|
|
||||||
def _vault_git(args: list[str]) -> None:
|
|
||||||
try:
|
|
||||||
subprocess.run(["git", "-C", str(VAULT), *args], capture_output=True, text=True, timeout=15)
|
|
||||||
except Exception:
|
|
||||||
pass
|
|
||||||
|
|
||||||
|
|
||||||
def _kandidat_path(fname: str) -> Path | None:
|
|
||||||
if not _KANDIDAT_RX.match(fname):
|
|
||||||
return None
|
|
||||||
p = (_kandidaten_dir() / fname).resolve()
|
|
||||||
if not p.is_relative_to(_kandidaten_dir().resolve()) or not p.is_file():
|
|
||||||
return None
|
|
||||||
return p
|
|
||||||
|
|
||||||
|
|
||||||
def skill_accept(fname: str) -> dict:
|
|
||||||
"""Skill-Kandidat beauftragen: Inhalt als Werkstatt-Auftrag an die bewährte
|
|
||||||
`hermes -z`-CLI-Lane (detached — der Lauf dauert Minuten und braucht das Backend nicht).
|
|
||||||
Ergebnis ist wieder propose-only: ein neuer Branch, der hier als Karte auftaucht."""
|
|
||||||
if not _available():
|
|
||||||
return {"ok": False, "error": "Beauftragen geht nur auf der Box."}
|
|
||||||
p = _kandidat_path(fname)
|
|
||||||
if not p:
|
|
||||||
return {"ok": False, "error": f"Kandidat nicht gefunden: {fname}"}
|
|
||||||
|
|
||||||
beauftragt = _kandidaten_dir() / "beauftragt"
|
|
||||||
beauftragt.mkdir(parents=True, exist_ok=True)
|
|
||||||
target = beauftragt / p.name
|
|
||||||
try:
|
|
||||||
content = p.read_text(encoding="utf-8", errors="replace")
|
|
||||||
p.rename(target)
|
|
||||||
except OSError as exc:
|
|
||||||
return {"ok": False, "error": f"Kandidat nicht verschiebbar: {exc}"}
|
|
||||||
_vault_git(["add", "-A"])
|
|
||||||
_vault_git(["commit", "-q", "-m", f"Skill-Kandidat beauftragt: {p.name}"])
|
|
||||||
|
|
||||||
order = ("Nutze den orchestrator-Skill (propose-only, Zwei-Kritiker-Gate). "
|
|
||||||
"Auftrag aus dem Wissens-Vault (vom Commander im Auftragsbuch freigegeben):\n\n"
|
|
||||||
+ content)
|
|
||||||
order_file = Path(f"/tmp/mc2-skill-auftrag-{int(time.time())}.txt")
|
|
||||||
try:
|
|
||||||
order_file.write_text(order, encoding="utf-8")
|
|
||||||
except OSError as exc:
|
|
||||||
return {"ok": False, "error": f"Auftrag nicht schreibbar: {exc}"}
|
|
||||||
unit = f"mc2-skill-auftrag-{int(time.time())}"
|
|
||||||
r = subprocess.run(
|
|
||||||
["systemd-run", "--user", "--collect", f"--unit={unit}",
|
|
||||||
"/bin/bash", "-lc", f'hermes -z "$(cat {order_file})"'],
|
|
||||||
capture_output=True, text=True, timeout=20)
|
|
||||||
if r.returncode != 0:
|
|
||||||
return {"ok": False, "error": f"Start fehlgeschlagen: {(r.stderr or r.stdout).strip()[:300]}"}
|
|
||||||
try:
|
|
||||||
from services import announce
|
|
||||||
announce.add(f"Skill-Kandidat '{fname}' wurde beauftragt — die Werkstatt arbeitet, "
|
|
||||||
"das Ergebnis erscheint als neuer Vorschlag im Auftragsbuch.",
|
|
||||||
"[Auftragsbuch]", "auftragsbuch", "silent")
|
|
||||||
except Exception:
|
|
||||||
pass
|
|
||||||
return {"ok": True, "unit": unit}
|
|
||||||
|
|
||||||
|
|
||||||
def skill_reject(fname: str) -> dict:
|
|
||||||
if not _available():
|
|
||||||
return {"ok": False, "error": "Verwerfen geht nur auf der Box."}
|
|
||||||
p = _kandidat_path(fname)
|
|
||||||
if not p:
|
|
||||||
return {"ok": False, "error": f"Kandidat nicht gefunden: {fname}"}
|
|
||||||
verworfen = _kandidaten_dir() / "verworfen"
|
|
||||||
verworfen.mkdir(parents=True, exist_ok=True)
|
|
||||||
try:
|
|
||||||
p.rename(verworfen / p.name)
|
|
||||||
except OSError as exc:
|
|
||||||
return {"ok": False, "error": f"Kandidat nicht verschiebbar: {exc}"}
|
|
||||||
_vault_git(["add", "-A"])
|
|
||||||
_vault_git(["commit", "-q", "-m", f"Skill-Kandidat verworfen: {p.name}"])
|
|
||||||
return {"ok": True}
|
|
||||||
@@ -1,5 +1,5 @@
|
|||||||
"""
|
"""
|
||||||
Voll-Zustands-Backup (mem0 + Hermes-Configs/Secrets + llama-swap config).
|
Voll-Zustands-Backup (Hermes-Configs/Secrets + llama-swap config).
|
||||||
Delegiert an deploy/backup.sh (eine Quelle der Wahrheit, identisch zum systemd-Timer);
|
Delegiert an deploy/backup.sh (eine Quelle der Wahrheit, identisch zum systemd-Timer);
|
||||||
Restore läuft bewusst nur per CLI (deploy/restore.sh) — siehe docs/BACKUP.md.
|
Restore läuft bewusst nur per CLI (deploy/restore.sh) — siehe docs/BACKUP.md.
|
||||||
"""
|
"""
|
||||||
@@ -51,7 +51,7 @@ def backup_now() -> dict:
|
|||||||
r = subprocess.run(["/bin/bash", str(BACKUP_SH)], capture_output=True, text=True, timeout=180)
|
r = subprocess.run(["/bin/bash", str(BACKUP_SH)], capture_output=True, text=True, timeout=180)
|
||||||
if r.returncode != 0:
|
if r.returncode != 0:
|
||||||
return {"ok": False, "snapshot": "", "files": [], "error": (r.stderr or r.stdout).strip()[-300:]}
|
return {"ok": False, "snapshot": "", "files": [], "error": (r.stderr or r.stdout).strip()[-300:]}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"ok": False, "snapshot": "", "files": [], "error": str(exc)}
|
return {"ok": False, "snapshot": "", "files": [], "error": str(exc)}
|
||||||
|
|
||||||
latest = _latest()
|
latest = _latest()
|
||||||
|
|||||||
+20
-27
@@ -1,7 +1,13 @@
|
|||||||
"""
|
"""
|
||||||
Connect: erzeugt saubere, getestete Konfig-Snippets für IDEs/Agenten auf dem
|
Connect: erzeugt saubere, getestete Konfig-Snippets für IDEs/Agenten auf dem
|
||||||
LOKALEN PC (separate Maschine im LAN). Alle zeigen auf den **Gateway** der Box
|
LOKALEN PC (separate Maschine im LAN). Alle zeigen auf den **Gateway** der Box
|
||||||
(reale Modelle coder/heavy/vision, Cockpit-Port :9001/v1) + den **Shared-Memory-MCP** (MC :9001).
|
(reale Modelle coder/heavy/vision, Cockpit-Port :9001/v1).
|
||||||
|
|
||||||
|
Gedächtnis ist hier bewusst KEINE eigene Leitung mehr: bis August 2026 gab es dafür einen
|
||||||
|
Memory-MCP-Server gegen MC2s /api/memory; seit dessen Ablösung (docs/wissen/VERDIKTE.md,
|
||||||
|
07.08.2026) führt Hermes sein Gedächtnis
|
||||||
|
selbst — es hängt am Agenten, nicht am Gateway. check_health() prüft es weiterhin (Leitung 2),
|
||||||
|
es ist nur nichts mehr zu konfigurieren.
|
||||||
|
|
||||||
Wichtig: Host ist die LAN-IP der Box (NICHT eine Proxy-Domain) — das war in v1
|
Wichtig: Host ist die LAN-IP der Box (NICHT eine Proxy-Domain) — das war in v1
|
||||||
die häufigste Fehlerquelle. Der Aufrufer übergibt den Host explizit.
|
die häufigste Fehlerquelle. Der Aufrufer übergibt den Host explizit.
|
||||||
@@ -10,8 +16,7 @@ die häufigste Fehlerquelle. Der Aufrufer übergibt den Host explizit.
|
|||||||
import json
|
import json
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
from config import HERMES_BUILTIN_UI_UPSTREAM, LLAMA_SWAP_URL, PORT, V1_UPSTREAM
|
||||||
from config import HERMES_BUILTIN_UI_UPSTREAM, LLAMA_SWAP_URL, MEM0_SERVICE_URL, PORT, V1_UPSTREAM
|
|
||||||
|
|
||||||
DEFAULT_HOST = "192.168.178.151"
|
DEFAULT_HOST = "192.168.178.151"
|
||||||
|
|
||||||
@@ -41,9 +46,7 @@ def _gw(host: str) -> str:
|
|||||||
return f"http://{host}:{PORT}/v1"
|
return f"http://{host}:{PORT}/v1"
|
||||||
|
|
||||||
|
|
||||||
def build_snippets(host: str = DEFAULT_HOST,
|
def build_snippets(host: str = DEFAULT_HOST) -> dict:
|
||||||
mcp_script_path: str = r"F:\\Coding Stuff\\mission-control-2\\mcp\\mcp_memory.py",
|
|
||||||
mcp_python: str = "python") -> dict:
|
|
||||||
gw = _gw(host)
|
gw = _gw(host)
|
||||||
mc_url = f"http://{host}:{PORT}"
|
mc_url = f"http://{host}:{PORT}"
|
||||||
|
|
||||||
@@ -89,16 +92,6 @@ def build_snippets(host: str = DEFAULT_HOST,
|
|||||||
f'export ANTHROPIC_MODEL="coder"'
|
f'export ANTHROPIC_MODEL="coder"'
|
||||||
)
|
)
|
||||||
|
|
||||||
memory_mcp = json.dumps({
|
|
||||||
"mcpServers": {
|
|
||||||
"mission-control-memory": {
|
|
||||||
"command": mcp_python,
|
|
||||||
"args": [mcp_script_path],
|
|
||||||
"env": {"MC_URL": mc_url},
|
|
||||||
}
|
|
||||||
}
|
|
||||||
}, indent=2)
|
|
||||||
|
|
||||||
return {
|
return {
|
||||||
"host": host,
|
"host": host,
|
||||||
"gateway_url": gw,
|
"gateway_url": gw,
|
||||||
@@ -117,18 +110,15 @@ def build_snippets(host: str = DEFAULT_HOST,
|
|||||||
"API-Profile je Modus: Code→coder · Architect/Orchestrator→heavy · "
|
"API-Profile je Modus: Code→coder · Architect/Orchestrator→heavy · "
|
||||||
"Ask/Debug→Lane 'chat' (virtuelles Modell, wählt selbst fast oder heavy)."},
|
"Ask/Debug→Lane 'chat' (virtuelles Modell, wählt selbst fast oder heavy)."},
|
||||||
"claude_code": {"label": "Claude Code", "lang": "bash", "snippet": claude_code,
|
"claude_code": {"label": "Claude Code", "lang": "bash", "snippet": claude_code,
|
||||||
"note": "Für die starken Sessions. Lokal-Betrieb bräuchte einen Anthropic⇄OpenAI-Übersetzer vor dem Gateway; Gedächtnis-Anbindung via Memory-MCP unten."},
|
"note": "Für die starken Sessions. Lokal-Betrieb bräuchte einen Anthropic⇄OpenAI-Übersetzer vor dem Gateway."},
|
||||||
},
|
},
|
||||||
# Leitung 2 — das GEDÄCHTNIS. Separater MCP-Server, gilt zusätzlich zu jedem Tool oben.
|
|
||||||
"memory": {"label": "Shared Memory (MCP)", "lang": "json", "snippet": memory_mcp,
|
|
||||||
"note": "Eigene Leitung: MCP-Block für jedes MCP-fähige Tool. mcp_memory.py muss lokal liegen."},
|
|
||||||
}
|
}
|
||||||
|
|
||||||
|
|
||||||
def check_health() -> dict:
|
def check_health() -> dict:
|
||||||
"""Live-Erreichbarkeit der drei Leitungen, aus Sicht der Box:
|
"""Live-Erreichbarkeit der drei Leitungen, aus Sicht der Box:
|
||||||
Leitung 1 = der ECHTE Modell-Pfad, den Clients nutzen (mc2-gateway bei V1_UPSTREAM,
|
Leitung 1 = der ECHTE Modell-Pfad, den Clients nutzen (mc2-gateway bei V1_UPSTREAM,
|
||||||
sonst llama-swap direkt), Leitung 2 = Gedächtnis-Sidecar (Mem0),
|
sonst llama-swap direkt), Leitung 2 = Natives Hermes-Gedächtnis (hermes-gateway),
|
||||||
Leitung 3 = Desktop-Gateway (Hermes-Builtin-UI)."""
|
Leitung 3 = Desktop-Gateway (Hermes-Builtin-UI)."""
|
||||||
gateway = {"ok": False, "detail": "nicht erreichbar"}
|
gateway = {"ok": False, "detail": "nicht erreichbar"}
|
||||||
try:
|
try:
|
||||||
@@ -139,16 +129,19 @@ def check_health() -> dict:
|
|||||||
gateway = {"ok": True, "detail": f"{n} Modelle verfügbar" if n else "bereit"}
|
gateway = {"ok": True, "detail": f"{n} Modelle verfügbar" if n else "bereit"}
|
||||||
else:
|
else:
|
||||||
gateway = {"ok": False, "detail": f"HTTP {r.status_code}"}
|
gateway = {"ok": False, "detail": f"HTTP {r.status_code}"}
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
|
|
||||||
memory = {"ok": False, "detail": "nicht erreichbar"}
|
memory = {"ok": False, "detail": "nicht erreichbar"}
|
||||||
try:
|
try:
|
||||||
with httpx.Client(timeout=3.0) as c:
|
with httpx.Client(timeout=3.0) as c:
|
||||||
r = c.get(f"{MEM0_SERVICE_URL}/health")
|
# Hermes Gateway stellt das native Gedächtnis & Agent-Loop bereit
|
||||||
memory = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
r = c.get("http://127.0.0.1:8642/health")
|
||||||
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
if r.status_code in (200, 404, 401):
|
||||||
except Exception: # noqa: BLE001
|
memory = {"ok": True, "detail": "Hermes-Nativ bereit"}
|
||||||
|
else:
|
||||||
|
memory = {"ok": False, "detail": f"HTTP {r.status_code}"}
|
||||||
|
except Exception:
|
||||||
pass
|
pass
|
||||||
|
|
||||||
desktop_gateway = {"ok": False, "detail": "nicht erreichbar"}
|
desktop_gateway = {"ok": False, "detail": "nicht erreichbar"}
|
||||||
@@ -157,7 +150,7 @@ def check_health() -> dict:
|
|||||||
r = c.get(f"{HERMES_BUILTIN_UI_UPSTREAM}/api/status")
|
r = c.get(f"{HERMES_BUILTIN_UI_UPSTREAM}/api/status")
|
||||||
desktop_gateway = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
desktop_gateway = ({"ok": True, "detail": "bereit"} if r.status_code == 200
|
||||||
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
else {"ok": False, "detail": f"HTTP {r.status_code}"})
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
|
|
||||||
return {"gateway": gateway, "memory": memory, "desktop_gateway": desktop_gateway}
|
return {"gateway": gateway, "memory": memory, "desktop_gateway": desktop_gateway}
|
||||||
|
|||||||
@@ -9,16 +9,15 @@ spätere Auto-Setups nutzen ihn, damit sie nie auseinanderlaufen.
|
|||||||
"""
|
"""
|
||||||
|
|
||||||
import json
|
import json
|
||||||
|
import logging
|
||||||
import math
|
import math
|
||||||
import os
|
import os
|
||||||
import time
|
import time
|
||||||
from datetime import datetime
|
from datetime import datetime
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
import logging
|
|
||||||
|
|
||||||
from config import DISCOVER_CACHE_PATH, DISCOVER_TTL
|
from config import DISCOVER_CACHE_PATH, DISCOVER_TTL
|
||||||
|
|
||||||
from services import catalog
|
from services import catalog
|
||||||
from services.caps import capabilities
|
from services.caps import capabilities
|
||||||
from services.fit import evaluate_fit, extract_params_b, max_ctx_for
|
from services.fit import evaluate_fit, extract_params_b, max_ctx_for
|
||||||
|
|||||||
@@ -1,219 +0,0 @@
|
|||||||
"""Eigenleben — was die Box von allein gebaut und vorgeschlagen hat.
|
|
||||||
|
|
||||||
Beantwortet die User-Frage vom 15.07.2026: „Es gibt keinen Viewpoint, welche Skills
|
|
||||||
erstellt wurden, was die Box vorgeschlagen hat, welche Skills Lucy hat und wie die
|
|
||||||
funktionieren." Reine LESE-Schicht, keine Schreib-Operationen:
|
|
||||||
|
|
||||||
- Skills aus ~/.hermes/skills (= Lucys Skill-Satz; die Worker-Profile werkstatt/betrieb
|
|
||||||
tragen Kopien desselben Satzes). Herkunft dreistufig klassifiziert:
|
|
||||||
selbst → weder mitgeliefert noch aus unserem Repo = die Box/Lucy hat ihn erzeugt
|
|
||||||
repo → liegt in ~/mission-control-v2/deploy/skills (von uns gebaut + deployt)
|
|
||||||
bundled → liegt in ~/.hermes/hermes-agent/skills (kam mit Hermes mit)
|
|
||||||
- Nutzungszahlen aus ~/.hermes/skills/.usage.json (Hermes' eigener Zähler).
|
|
||||||
- Bilanz aus Auftragsbuch-Chronik (/srv/models/mc2-auftragsbuch.json, angenommene
|
|
||||||
Branches) + Ablehnungs-Lern-Journal (/srv/models/mc2-ablehnungen.jsonl).
|
|
||||||
"""
|
|
||||||
|
|
||||||
from __future__ import annotations
|
|
||||||
|
|
||||||
import json
|
|
||||||
import re
|
|
||||||
import subprocess
|
|
||||||
import time
|
|
||||||
from pathlib import Path
|
|
||||||
|
|
||||||
SKILLS_DIR = Path.home() / ".hermes" / "skills"
|
|
||||||
BUNDLED_DIR = Path.home() / ".hermes" / "hermes-agent" / "skills"
|
|
||||||
REPO_DIR = Path.home() / "mission-control-v2" / "deploy" / "skills"
|
|
||||||
HERMES_SRC = Path.home() / ".hermes" / "hermes-agent"
|
|
||||||
HERMES_PY = HERMES_SRC / "venv" / "bin" / "python"
|
|
||||||
USAGE_FILE = SKILLS_DIR / ".usage.json"
|
|
||||||
AUFTRAGSBUCH_FILE = Path("/srv/models/mc2-auftragsbuch.json")
|
|
||||||
ABLEHNUNGEN_FILE = Path("/srv/models/mc2-ablehnungen.jsonl")
|
|
||||||
|
|
||||||
_HERKUNFT_LABEL = {
|
|
||||||
"selbst": "Selbst erstellt",
|
|
||||||
"repo": "Von uns gebaut",
|
|
||||||
"bundled": "Mit Hermes mitgeliefert",
|
|
||||||
}
|
|
||||||
|
|
||||||
|
|
||||||
def _frontmatter(text: str) -> dict:
|
|
||||||
"""Sehr kleiner Frontmatter-Leser: nur die flachen key: value-Zeilen des ersten
|
|
||||||
---Blocks (name/description/version/author reichen hier; kein YAML-Import nötig)."""
|
|
||||||
out: dict = {}
|
|
||||||
if not text.startswith("---"):
|
|
||||||
return out
|
|
||||||
for line in text.split("\n", 1)[1].split("\n"):
|
|
||||||
if line.strip() == "---":
|
|
||||||
break
|
|
||||||
m = re.match(r"^([A-Za-z_][\w-]*):\s*(.*)$", line)
|
|
||||||
if not m:
|
|
||||||
continue
|
|
||||||
val = m.group(2).strip().strip('"').strip("'")
|
|
||||||
if val:
|
|
||||||
out[m.group(1)] = val
|
|
||||||
return out
|
|
||||||
|
|
||||||
|
|
||||||
def _norm(s: str) -> str:
|
|
||||||
return re.sub(r"[\s_-]+", "", (s or "").lower())
|
|
||||||
|
|
||||||
|
|
||||||
# aktiv/inaktiv: dieselbe Wahrheit wie Hermes selbst (und sein eingebautes WebUI) —
|
|
||||||
# hermes_cli.banner.get_available_skills() prüft Plattform/Voraussetzungen/Config und
|
|
||||||
# liefert, was der Agent WIRKLICH laden kann. Wir rufen sie im Hermes-venv auf (MC2
|
|
||||||
# läuft in eigenem Python) und cachen großzügig — der Skill-Satz ändert sich selten.
|
|
||||||
_aktiv_cache: dict = {"ts": 0.0, "namen": None}
|
|
||||||
_AKTIV_EVERY = 600.0 # s
|
|
||||||
|
|
||||||
|
|
||||||
def _aktive_namen() -> set[str] | None:
|
|
||||||
"""Normalisierte Namen aller ladbaren Skills; None = nicht ermittelbar (Dev-Modus)."""
|
|
||||||
if not HERMES_PY.is_file():
|
|
||||||
return None
|
|
||||||
now = time.time()
|
|
||||||
if _aktiv_cache["namen"] is not None and now - _aktiv_cache["ts"] < _AKTIV_EVERY:
|
|
||||||
return _aktiv_cache["namen"]
|
|
||||||
code = ("from hermes_cli.banner import get_available_skills;import json;"
|
|
||||||
"print(json.dumps(get_available_skills()))")
|
|
||||||
try:
|
|
||||||
r = subprocess.run([str(HERMES_PY), "-c", code], capture_output=True,
|
|
||||||
text=True, timeout=60, cwd=str(HERMES_SRC))
|
|
||||||
idx = r.stdout.find("{")
|
|
||||||
kategorien = json.loads(r.stdout[idx:]) if idx >= 0 else {}
|
|
||||||
namen = {_norm(n) for liste in kategorien.values() for n in liste}
|
|
||||||
except Exception:
|
|
||||||
return _aktiv_cache["namen"] # alter Stand ist besser als flackerndes None
|
|
||||||
_aktiv_cache.update(ts=now, namen=namen)
|
|
||||||
return namen
|
|
||||||
|
|
||||||
|
|
||||||
def list_skills() -> list[dict]:
|
|
||||||
"""Alle Skills mit Beschreibung, Herkunft und Nutzungszahlen (leer im Dev-Modus)."""
|
|
||||||
if not SKILLS_DIR.is_dir():
|
|
||||||
return []
|
|
||||||
try:
|
|
||||||
usage_raw = json.loads(USAGE_FILE.read_text(encoding="utf-8"))
|
|
||||||
except Exception:
|
|
||||||
usage_raw = {}
|
|
||||||
usage = {_norm(k): v for k, v in usage_raw.items()}
|
|
||||||
aktive = _aktive_namen()
|
|
||||||
|
|
||||||
def eintrag(md: Path, rel: str, kategorie: str | None) -> dict:
|
|
||||||
try:
|
|
||||||
fm = _frontmatter(md.read_text(encoding="utf-8", errors="replace"))
|
|
||||||
except Exception:
|
|
||||||
fm = {}
|
|
||||||
if (BUNDLED_DIR / rel).is_dir():
|
|
||||||
herkunft = "bundled"
|
|
||||||
elif (REPO_DIR / rel).is_dir():
|
|
||||||
herkunft = "repo"
|
|
||||||
else:
|
|
||||||
herkunft = "selbst"
|
|
||||||
kurz = rel.split("/")[-1]
|
|
||||||
u = usage.get(_norm(kurz)) or usage.get(_norm(fm.get("name", ""))) or {}
|
|
||||||
aktiv = None
|
|
||||||
if aktive is not None:
|
|
||||||
aktiv = _norm(kurz) in aktive or _norm(fm.get("name", "")) in aktive
|
|
||||||
return {
|
|
||||||
"id": rel,
|
|
||||||
"name": fm.get("name") or kurz,
|
|
||||||
"kategorie": kategorie,
|
|
||||||
"aktiv": aktiv,
|
|
||||||
"beschreibung": fm.get("description") or "",
|
|
||||||
"version": fm.get("version") or "",
|
|
||||||
"autor": fm.get("author") or "",
|
|
||||||
"herkunft": herkunft,
|
|
||||||
"herkunft_label": _HERKUNFT_LABEL[herkunft],
|
|
||||||
"genutzt": int(u.get("use_count") or 0),
|
|
||||||
"zuletzt_genutzt": u.get("last_used_at") or None,
|
|
||||||
"erstellt": u.get("created_at") or None,
|
|
||||||
"status": u.get("state") or "active",
|
|
||||||
"geaendert": md.stat().st_mtime,
|
|
||||||
}
|
|
||||||
|
|
||||||
skills: list[dict] = []
|
|
||||||
for d in sorted(SKILLS_DIR.iterdir()):
|
|
||||||
if not d.is_dir() or d.name.startswith("."):
|
|
||||||
continue # .archive (Curator) & Co. sind keine aktiven Skills
|
|
||||||
md = d / "SKILL.md"
|
|
||||||
if md.is_file():
|
|
||||||
skills.append(eintrag(md, d.name, None))
|
|
||||||
continue
|
|
||||||
# Kategorie-Ordner (mitgelieferte Sammlungen wie research/, apple/): eine Ebene
|
|
||||||
# tiefer liegen die echten Skills (research/blogwatcher/SKILL.md) — je einzeln zeigen.
|
|
||||||
for sub in sorted(d.iterdir()):
|
|
||||||
smd = sub / "SKILL.md"
|
|
||||||
if sub.is_dir() and not sub.name.startswith(".") and smd.is_file():
|
|
||||||
skills.append(eintrag(smd, f"{d.name}/{sub.name}", d.name))
|
|
||||||
# Selbst erstellte zuerst — das ist der Star der Ansicht.
|
|
||||||
order = {"selbst": 0, "repo": 1, "bundled": 2}
|
|
||||||
skills.sort(key=lambda s: (order[s["herkunft"]], -s["genutzt"], s["name"]))
|
|
||||||
return skills
|
|
||||||
|
|
||||||
|
|
||||||
def skill_text(skill_id: str) -> str | None:
|
|
||||||
"""Voller SKILL.md-Text („wie funktioniert der Skill") — max. Kategorie/Name, keine Pfad-Tricks."""
|
|
||||||
if not re.fullmatch(r"[\w.-]+(/[\w.-]+)?", skill_id or ""):
|
|
||||||
return None
|
|
||||||
# Das Zeichen-Set oben erlaubt „." und „.." als Segment — seit die Route ein
|
|
||||||
# :path-Parameter ist, hier explizit raus (kein Klettern über SKILLS_DIR hinaus).
|
|
||||||
if any(seg in (".", "..") for seg in skill_id.split("/")):
|
|
||||||
return None
|
|
||||||
md = SKILLS_DIR / skill_id / "SKILL.md"
|
|
||||||
if not md.is_file():
|
|
||||||
return None
|
|
||||||
try:
|
|
||||||
return md.read_text(encoding="utf-8", errors="replace")
|
|
||||||
except Exception:
|
|
||||||
return None
|
|
||||||
|
|
||||||
|
|
||||||
def bilanz() -> dict:
|
|
||||||
"""Vorschlags-Bilanz: was die Box vorschlug und was daraus wurde (eine Timeline)."""
|
|
||||||
eintraege: list[dict] = []
|
|
||||||
try:
|
|
||||||
branches = json.loads(AUFTRAGSBUCH_FILE.read_text(encoding="utf-8")).get("branches") or {}
|
|
||||||
for branch, info in branches.items():
|
|
||||||
eintraege.append({
|
|
||||||
"art": "angenommen" if info.get("state") == "eingespielt" else info.get("state", "?"),
|
|
||||||
"titel": branch,
|
|
||||||
"detail": info.get("detail") or "",
|
|
||||||
"ts": float(info.get("ts") or 0),
|
|
||||||
})
|
|
||||||
except Exception:
|
|
||||||
pass
|
|
||||||
try:
|
|
||||||
for line in ABLEHNUNGEN_FILE.read_text(encoding="utf-8").splitlines():
|
|
||||||
if not line.strip():
|
|
||||||
continue
|
|
||||||
try:
|
|
||||||
j = json.loads(line)
|
|
||||||
except Exception:
|
|
||||||
continue
|
|
||||||
eintraege.append({
|
|
||||||
"art": "abgelehnt",
|
|
||||||
"titel": j.get("subject") or j.get("branch") or "?",
|
|
||||||
"detail": j.get("grund") or "",
|
|
||||||
"ts": float(j.get("ts") or 0),
|
|
||||||
})
|
|
||||||
except Exception:
|
|
||||||
pass
|
|
||||||
eintraege.sort(key=lambda e: -e["ts"])
|
|
||||||
return {
|
|
||||||
"eintraege": eintraege,
|
|
||||||
"angenommen": sum(1 for e in eintraege if e["art"] == "angenommen"),
|
|
||||||
"abgelehnt": sum(1 for e in eintraege if e["art"] == "abgelehnt"),
|
|
||||||
}
|
|
||||||
|
|
||||||
|
|
||||||
def overview() -> dict:
|
|
||||||
skills = list_skills()
|
|
||||||
b = bilanz()
|
|
||||||
return {
|
|
||||||
"available": SKILLS_DIR.is_dir(),
|
|
||||||
"skills": skills,
|
|
||||||
"selbst_erstellt": sum(1 for s in skills if s["herkunft"] == "selbst"),
|
|
||||||
"bilanz": b,
|
|
||||||
}
|
|
||||||
@@ -5,8 +5,8 @@ V1_UPSTREAM gilt der alte eingebaute Modus (MC2 serviert /v1 selbst).
|
|||||||
"""
|
"""
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import PORT, V1_UPSTREAM
|
from config import PORT, V1_UPSTREAM
|
||||||
|
|
||||||
from services.llamaswap import engine_reachable
|
from services.llamaswap import engine_reachable
|
||||||
from services.routing_policy import load_policy
|
from services.routing_policy import load_policy
|
||||||
|
|
||||||
@@ -50,7 +50,7 @@ def gateway_reachable() -> bool:
|
|||||||
if V1_UPSTREAM:
|
if V1_UPSTREAM:
|
||||||
try:
|
try:
|
||||||
return httpx.get(f"{V1_UPSTREAM}/v1/models", timeout=2.0).status_code == 200
|
return httpx.get(f"{V1_UPSTREAM}/v1/models", timeout=2.0).status_code == 200
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
return False
|
return False
|
||||||
# Eingebauter Modus: der Gateway lebt in MC selbst und proxyt llama-swap.
|
# Eingebauter Modus: der Gateway lebt in MC selbst und proxyt llama-swap.
|
||||||
return engine_reachable()
|
return engine_reachable()
|
||||||
|
|||||||
@@ -0,0 +1,100 @@
|
|||||||
|
"""Geheimnis-Ablage auf der Box (v3-Umbau P1).
|
||||||
|
|
||||||
|
WARUM ES DAS GIBT: Bis zum 28.08.2026 lagen das Box-Sudo-Passwort und der
|
||||||
|
HuggingFace-Token im `localStorage` des Browsers und reisten bei jedem mutierenden
|
||||||
|
Request mit (Header `X-Sudo-Password` **und** im JSON-Rumpf). Da der Dienst-Nutzer
|
||||||
|
laut `/etc/sudoers` mit `NOPASSWD: ALL` läuft, wäre ein einziger XSS in der SPA
|
||||||
|
gleichbedeutend mit Root auf der Box gewesen.
|
||||||
|
|
||||||
|
Das Sudo-Passwort ist ersatzlos entfallen — auf der Box gemessen: `sudo -n true`
|
||||||
|
läuft durch, es wurde also nie gebraucht. Bleibt der HF-Token; der liegt jetzt hier:
|
||||||
|
eine Datei neben den anderen `mc2-*.json` unter MODELS_DIR, Rechte 0600, und er wird
|
||||||
|
**nie** an den Browser zurückgegeben. Die Oberfläche erfährt nur, OB einer gesetzt ist.
|
||||||
|
|
||||||
|
Absichtlich kein Verschlüsseln: Der Schlüssel müsste auf derselben Maschine liegen und
|
||||||
|
wäre damit Theater. Der Gewinn ist, dass das Geheimnis den Browser gar nicht erst
|
||||||
|
erreicht — nicht, dass die Datei unlesbar wäre.
|
||||||
|
"""
|
||||||
|
|
||||||
|
import json
|
||||||
|
import logging
|
||||||
|
import os
|
||||||
|
from pathlib import Path
|
||||||
|
|
||||||
|
from config import MODELS_DIR
|
||||||
|
|
||||||
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
|
PFAD = Path(os.environ.get("MC_GEHEIMNISSE_PFAD", str(MODELS_DIR / "mc2-geheimnisse.json")))
|
||||||
|
|
||||||
|
# Was hier abgelegt werden darf. Neue Schlüssel bewusst eintragen — so kann ein
|
||||||
|
# fehlgeleiteter Request keine beliebigen Felder in die Datei schreiben.
|
||||||
|
ERLAUBT = frozenset({"hf_token"})
|
||||||
|
|
||||||
|
|
||||||
|
def _lesen() -> dict[str, str]:
|
||||||
|
"""Ganze Ablage. Fehlt die Datei (frische Box, Windows-Entwicklungsrechner ohne
|
||||||
|
/srv/models), ist das kein Fehler, sondern schlicht 'nichts gesetzt'."""
|
||||||
|
try:
|
||||||
|
daten = json.loads(PFAD.read_text(encoding="utf-8"))
|
||||||
|
return {k: v for k, v in daten.items() if k in ERLAUBT and isinstance(v, str)}
|
||||||
|
except (OSError, ValueError):
|
||||||
|
return {}
|
||||||
|
|
||||||
|
|
||||||
|
def _schreiben(daten: dict[str, str]) -> bool:
|
||||||
|
"""Atomar über eine Nachbardatei, damit ein Absturz mittendrin keine halbe Datei
|
||||||
|
hinterlässt. Rechte 0600 werden VOR dem Umbenennen gesetzt — sonst gäbe es ein
|
||||||
|
Zeitfenster, in dem das Geheimnis world-readable auf der Platte liegt."""
|
||||||
|
try:
|
||||||
|
PFAD.parent.mkdir(parents=True, exist_ok=True)
|
||||||
|
tmp = PFAD.with_suffix(".json.tmp")
|
||||||
|
tmp.write_text(json.dumps(daten, indent=2, ensure_ascii=False), encoding="utf-8")
|
||||||
|
try:
|
||||||
|
os.chmod(tmp, 0o600)
|
||||||
|
except OSError:
|
||||||
|
pass # Windows kennt keine Unix-Rechte — lokal harmlos, auf der Box greift es
|
||||||
|
tmp.replace(PFAD)
|
||||||
|
return True
|
||||||
|
except OSError as exc:
|
||||||
|
log.warning("Geheimnis-Ablage nicht schreibbar (%s): %s", PFAD, exc)
|
||||||
|
return False
|
||||||
|
|
||||||
|
|
||||||
|
def hf_token() -> str | None:
|
||||||
|
"""Der HF-Token für Modell-Downloads. Reihenfolge: Prozess-Env schlägt Datei —
|
||||||
|
so kann die systemd-Unit ihn setzen, ohne dass jemand die Oberfläche anfassen muss."""
|
||||||
|
return os.environ.get("HF_TOKEN") or _lesen().get("hf_token") or None
|
||||||
|
|
||||||
|
|
||||||
|
def setzen(schluessel: str, wert: str | None) -> bool:
|
||||||
|
"""Setzt oder löscht (wert=None oder leer) ein Geheimnis."""
|
||||||
|
if schluessel not in ERLAUBT:
|
||||||
|
return False
|
||||||
|
daten = _lesen()
|
||||||
|
if wert:
|
||||||
|
daten[schluessel] = wert
|
||||||
|
else:
|
||||||
|
daten.pop(schluessel, None)
|
||||||
|
return _schreiben(daten)
|
||||||
|
|
||||||
|
|
||||||
|
def status() -> dict[str, bool]:
|
||||||
|
"""Was die Oberfläche erfahren darf: nur, OB etwas gesetzt ist — nie der Wert.
|
||||||
|
`aus_env` sagt dem Nutzer, warum ein Löschen in der Oberfläche wirkungslos bliebe."""
|
||||||
|
daten = _lesen()
|
||||||
|
return {
|
||||||
|
"hf_token_gesetzt": bool(daten.get("hf_token") or os.environ.get("HF_TOKEN")),
|
||||||
|
"hf_token_aus_env": bool(os.environ.get("HF_TOKEN")),
|
||||||
|
"schreibbar": _schreibbar(),
|
||||||
|
}
|
||||||
|
|
||||||
|
|
||||||
|
def _schreibbar() -> bool:
|
||||||
|
"""Ehrlich melden, wenn die Ablage nicht beschreibbar ist (z. B. lokal auf Windows
|
||||||
|
ohne /srv/models) — sonst speichert die Oberfläche scheinbar erfolgreich ins Leere."""
|
||||||
|
try:
|
||||||
|
PFAD.parent.mkdir(parents=True, exist_ok=True)
|
||||||
|
return os.access(PFAD.parent, os.W_OK)
|
||||||
|
except OSError:
|
||||||
|
return False
|
||||||
+112
-14
@@ -22,6 +22,9 @@ import subprocess
|
|||||||
import time
|
import time
|
||||||
from pathlib import Path
|
from pathlib import Path
|
||||||
|
|
||||||
|
import httpx
|
||||||
|
from config import GATEWAY_URL, V1_UPSTREAM
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
HERMES = Path(os.environ.get("MC_HERMES_BIN", "~/.local/bin/hermes")).expanduser()
|
HERMES = Path(os.environ.get("MC_HERMES_BIN", "~/.local/bin/hermes")).expanduser()
|
||||||
@@ -109,7 +112,7 @@ def _kurz(text: str, max_len: int = 80) -> str:
|
|||||||
return (schnitt or t[:max_len]) + "…"
|
return (schnitt or t[:max_len]) + "…"
|
||||||
|
|
||||||
|
|
||||||
_TITEL_PRAEFIX_RX = re.compile(r"^\s*(idee|projekt|bitte)\s*[:\-–]?\s*", re.I)
|
_TITEL_PRAEFIX_RX = re.compile(r"^\s*(idee|projekt|bitte)\s*[:\-–]?\s*", re.IGNORECASE)
|
||||||
|
|
||||||
|
|
||||||
def _projekt_titel(titles: list[str]) -> str:
|
def _projekt_titel(titles: list[str]) -> str:
|
||||||
@@ -220,7 +223,7 @@ def _ketten_anreichern(items: list[dict]) -> list[dict]:
|
|||||||
for it in items:
|
for it in items:
|
||||||
familien.setdefault(boss(it["id"]), []).append(it)
|
familien.setdefault(boss(it["id"]), []).append(it)
|
||||||
projekte = []
|
projekte = []
|
||||||
for wurzel, mitglieder in familien.items():
|
for mitglieder in familien.values():
|
||||||
if len(mitglieder) < 2:
|
if len(mitglieder) < 2:
|
||||||
continue
|
continue
|
||||||
mitglieder.sort(key=lambda i: i.get("erstellt") or 0)
|
mitglieder.sort(key=lambda i: i.get("erstellt") or 0)
|
||||||
@@ -389,12 +392,12 @@ def add_idea(titel: str, notiz: str = "", created_by: str = "mc2-ui",
|
|||||||
welt='ide': geht DIREKT an das Profil `projektstart` (am Triage/Auto-Zerleger vorbei) —
|
welt='ide': geht DIREKT an das Profil `projektstart` (am Triage/Auto-Zerleger vorbei) —
|
||||||
die Box härtet ein Konzept (konzept-fliessband), legt ein leeres Gitea-Repo an und
|
die Box härtet ein Konzept (konzept-fliessband), legt ein leeres Gitea-Repo an und
|
||||||
füllt es NUR mit Doku. Ergebnis ist ein vorbereitetes Projekt, das der Commander in
|
füllt es NUR mit Doku. Ergebnis ist ein vorbereitetes Projekt, das der Commander in
|
||||||
Zed selbst baut (IDE-Welt). Bewusst KEIN --triage: so fasst der Auto-Zerleger die
|
Agentic IDE selbst baut (IDE-Welt). Bewusst KEIN --triage: so fasst der Auto-Zerleger die
|
||||||
Karte nie an und die Werkstatt baut sie nie (der Fan-out-Fehler vom 20.07.).
|
Karte nie an und die Werkstatt baut sie nie (der Fan-out-Fehler vom 20.07.).
|
||||||
tiefe (nur ide): 'simpel' | 'gruendlich' — vom Knopf gewaehlte Konzept-Tiefe; leer =
|
tiefe (nur ide): 'simpel' | 'gruendlich' — vom Knopf gewaehlte Konzept-Tiefe; leer =
|
||||||
die Box schaetzt selbst (Fallback fuer Telegram/Lucy).
|
die Box schaetzt selbst (Fallback fuer Telegram/Lucy).
|
||||||
ziel (nur ide-Projekt): 'lxc' | 'docker' — Ziel-Plattform; leer = die Box entscheidet.
|
ziel (nur ide-Projekt): 'lxc' | 'docker' — Ziel-Plattform; leer = die Box entscheidet.
|
||||||
art (nur ide): 'projekt' (Default, Repo+Doku+Roadmap, Bau in Zed) oder 'idee'
|
art (nur ide): 'projekt' (Default, Repo+Doku+Roadmap, Bau in IDE) oder 'idee'
|
||||||
(Produkt-Idee nur durchdenken: NUR Konzept, keine Roadmap/Geruest, kein Bau-Druck)."""
|
(Produkt-Idee nur durchdenken: NUR Konzept, keine Roadmap/Geruest, kein Bau-Druck)."""
|
||||||
if not _available():
|
if not _available():
|
||||||
return {"ok": False, "error": "Die Ideen-Queue lebt auf der Box."}
|
return {"ok": False, "error": "Die Ideen-Queue lebt auf der Box."}
|
||||||
@@ -453,7 +456,7 @@ def add_idea(titel: str, notiz: str = "", created_by: str = "mc2-ui",
|
|||||||
"[Ideen-Queue]", "ideen-queue", "silent")
|
"[Ideen-Queue]", "ideen-queue", "silent")
|
||||||
elif welt == "ide":
|
elif welt == "ide":
|
||||||
announce.add(f"Neues IDE-Projekt in Vorbereitung: „{titel}“ ({task['id']}) — die Box "
|
announce.add(f"Neues IDE-Projekt in Vorbereitung: „{titel}“ ({task['id']}) — die Box "
|
||||||
"härtet das Konzept und legt das Repo an, dann baust du in Zed.",
|
"härtet das Konzept und legt das Repo an, dann baust du in der Agentic IDE.",
|
||||||
"[Ideen-Queue]", "ideen-queue", "silent")
|
"[Ideen-Queue]", "ideen-queue", "silent")
|
||||||
else:
|
else:
|
||||||
announce.add(f"Neue Idee in der Queue: „{titel}“ ({task['id']}) — die Box arbeitet sie aus.",
|
announce.add(f"Neue Idee in der Queue: „{titel}“ ({task['id']}) — die Box arbeitet sie aus.",
|
||||||
@@ -509,6 +512,101 @@ def archive_task(task_id: str) -> dict:
|
|||||||
return {"ok": True}
|
return {"ok": True}
|
||||||
|
|
||||||
|
|
||||||
|
_EINORDNEN_SYS = (
|
||||||
|
"Du ordnest eine frisch getippte Projekt-Idee ein. Antworte AUSSCHLIESSLICH mit einem "
|
||||||
|
"JSON-Objekt, ohne Prosa, ohne Codezaun:\n"
|
||||||
|
'{"wer":"box"|"ide","tiefe":"schlank"|"gruendlich","nur_denken":true|false}\n\n'
|
||||||
|
"wer=box: Aufgabe am eigenen Heimlabor des Nutzers — seine Server, seine bestehenden "
|
||||||
|
"Dienste (Mission Control, Lucy, Rippy), Wartung, Doku, Automatisierung. Die Box baut selbst.\n"
|
||||||
|
"wer=ide: ein NEUES eigenstaendiges Programm/Werkzeug/App, das der Nutzer danach selbst "
|
||||||
|
"programmieren will. Er bekommt nur ein vorbereitetes Repo.\n"
|
||||||
|
"tiefe=gruendlich: gross, vage oder mit vielen offenen Entwurfsfragen. "
|
||||||
|
"tiefe=schlank: klein und klar umrissen.\n"
|
||||||
|
"nur_denken=true: der Text stellt eine FRAGE oder waegt ab (\"lohnt sich\", \"waere es sinnvoll\", "
|
||||||
|
"\"brauche ich\") statt einen Auftrag zu geben."
|
||||||
|
)
|
||||||
|
|
||||||
|
|
||||||
|
def einordnen(text: str) -> dict:
|
||||||
|
"""Grober Einordnungs-VORSCHLAG für eine frisch getippte Idee.
|
||||||
|
|
||||||
|
Nur eine Vorauswahl in der Oberfläche — der Mensch sieht und überschreibt sie. Deshalb
|
||||||
|
bewusst anspruchslos: ein einziger kurzer Aufruf ans dauerwarme Hirn (69,6 t/s gemessen),
|
||||||
|
Schnellspur-Marker gegen das Nachdenken, hartes Timeout. Scheitert irgendetwas, kommt
|
||||||
|
`{"ok": False}` zurück und die Oberfläche behält schlicht ihre Voreinstellung — eine
|
||||||
|
Einordnung darf das Tippen NIE blockieren oder eine Fehlermeldung erzeugen.
|
||||||
|
"""
|
||||||
|
text = (text or "").strip()
|
||||||
|
if len(text) < 12:
|
||||||
|
return {"ok": False}
|
||||||
|
ziel_url = (V1_UPSTREAM or GATEWAY_URL).rstrip("/")
|
||||||
|
marker = os.environ.get("MC_NO_THINK_MARKER", "[[MC:NO_THINK]]")
|
||||||
|
try:
|
||||||
|
r = httpx.post(f"{ziel_url}/v1/chat/completions", timeout=12.0, json={
|
||||||
|
"model": "hermes", "temperature": 0, "max_tokens": 60, "stream": False,
|
||||||
|
"messages": [
|
||||||
|
{"role": "system", "content": _EINORDNEN_SYS},
|
||||||
|
{"role": "user", "content": f"{marker} {text[:600]}"},
|
||||||
|
],
|
||||||
|
})
|
||||||
|
r.raise_for_status()
|
||||||
|
inhalt = (r.json()["choices"][0]["message"]["content"] or "").strip()
|
||||||
|
except Exception:
|
||||||
|
log.debug("ideen: einordnen fehlgeschlagen", exc_info=True)
|
||||||
|
return {"ok": False}
|
||||||
|
|
||||||
|
# Modelle packen JSON gern in einen Codezaun oder schreiben einen Satz davor.
|
||||||
|
m = re.search(r"\{.*\}", inhalt, re.DOTALL)
|
||||||
|
if not m:
|
||||||
|
return {"ok": False}
|
||||||
|
try:
|
||||||
|
d = json.loads(m.group(0))
|
||||||
|
except Exception:
|
||||||
|
return {"ok": False}
|
||||||
|
|
||||||
|
wer = d.get("wer") if d.get("wer") in ("box", "ide") else None
|
||||||
|
tiefe = d.get("tiefe") if d.get("tiefe") in ("schlank", "gruendlich") else None
|
||||||
|
if wer is None and tiefe is None:
|
||||||
|
return {"ok": False}
|
||||||
|
return {"ok": True, "wer": wer or "ide", "tiefe": tiefe or "schlank",
|
||||||
|
"nur_denken": bool(d.get("nur_denken"))}
|
||||||
|
|
||||||
|
|
||||||
|
def archive_done(projekt: str = "") -> dict:
|
||||||
|
"""Alle FERTIGEN Karten wegräumen — optional nur die eines Projekts.
|
||||||
|
|
||||||
|
Sammel-Aufräumen (25.07.2026): Bei fünf abgeschlossenen Projekt-Ketten wären das
|
||||||
|
sonst ~18 Einzelklicks. Wie beim Einzel-Archivieren wird nichts gelöscht — die
|
||||||
|
Karten wandern ins Kanban-Archiv und bleiben dort lesbar.
|
||||||
|
|
||||||
|
‼️ Bewusst NUR `done`. Laufende, hängende, wartende und in Ausarbeitung befindliche
|
||||||
|
Karten werden nie angefasst, auch nicht bei leerem `projekt`-Filter — ein Sammel-
|
||||||
|
Knopf darf niemals versehentlich Arbeit abräumen.
|
||||||
|
"""
|
||||||
|
if not _available():
|
||||||
|
return {"ok": False, "error": "Die Ideen-Queue lebt auf der Box."}
|
||||||
|
q = list_queue()
|
||||||
|
if not q.get("available"):
|
||||||
|
return {"ok": False, "error": q.get("fehler") or "Queue nicht lesbar."}
|
||||||
|
|
||||||
|
ziel = [i for i in q.get("items", [])
|
||||||
|
if i.get("status") == "done" and (not projekt or i.get("projekt") == projekt)]
|
||||||
|
if not ziel:
|
||||||
|
return {"ok": True, "archiviert": 0, "fehlgeschlagen": []}
|
||||||
|
|
||||||
|
ok, fehler = 0, []
|
||||||
|
for item in ziel:
|
||||||
|
r = archive_task(item.get("id", ""))
|
||||||
|
if r.get("ok"):
|
||||||
|
ok += 1
|
||||||
|
else:
|
||||||
|
# Die Items aus list_queue tragen "titel" (deutsch), nicht das rohe "title".
|
||||||
|
fehler.append({"id": item.get("id"), "titel": _kurz(item.get("titel") or "", 60),
|
||||||
|
"error": r.get("error", "")})
|
||||||
|
_list_cache["ts"] = 0.0
|
||||||
|
return {"ok": True, "archiviert": ok, "fehlgeschlagen": fehler}
|
||||||
|
|
||||||
|
|
||||||
def ergebnis_of(task_id: str) -> dict:
|
def ergebnis_of(task_id: str) -> dict:
|
||||||
"""Das ERGEBNIS einer fertigen Aufgabe — die Abschluss-Zusammenfassung des Workers.
|
"""Das ERGEBNIS einer fertigen Aufgabe — die Abschluss-Zusammenfassung des Workers.
|
||||||
|
|
||||||
@@ -752,8 +850,8 @@ def _lokales_konzept(text: str, titel: str = "") -> tuple | None:
|
|||||||
if not kandidaten and titel and _KONZEPT_DIR.is_dir():
|
if not kandidaten and titel and _KONZEPT_DIR.is_dir():
|
||||||
worte = {w for w in re.findall(r"[a-z0-9]{3,}", titel.lower())}
|
worte = {w for w in re.findall(r"[a-z0-9]{3,}", titel.lower())}
|
||||||
treffer = [p.name for p in _KONZEPT_DIR.glob("*.md")
|
treffer = [p.name for p in _KONZEPT_DIR.glob("*.md")
|
||||||
if (lambda g: len(g) >= 2 or any(len(w) >= 6 for w in g))(
|
if len(g := worte & set(re.findall(r"[a-z0-9]{3,}", p.stem.lower()))) >= 2
|
||||||
worte & set(re.findall(r"[a-z0-9]{3,}", p.stem.lower())))]
|
or any(len(w) >= 6 for w in g)]
|
||||||
if len(treffer) == 1:
|
if len(treffer) == 1:
|
||||||
kandidaten.append(treffer[0])
|
kandidaten.append(treffer[0])
|
||||||
for name in kandidaten:
|
for name in kandidaten:
|
||||||
@@ -883,7 +981,7 @@ def konzept_of(task_id: str) -> dict:
|
|||||||
_AUS_IDEE_KOPF = (
|
_AUS_IDEE_KOPF = (
|
||||||
"AUFTRAGS-ART: PROJEKT AUS GEPRUEFTER IDEE. Der Commander hat diese Idee erst durchdenken "
|
"AUFTRAGS-ART: PROJEKT AUS GEPRUEFTER IDEE. Der Commander hat diese Idee erst durchdenken "
|
||||||
"lassen — das Konzept gefaellt ihm, jetzt soll daraus ein startklares Repo werden, das er "
|
"lassen — das Konzept gefaellt ihm, jetzt soll daraus ein startklares Repo werden, das er "
|
||||||
"SELBST in Zed baut.")
|
"SELBST in der Agentic IDE baut.")
|
||||||
_AUS_IDEE_FUSS = (
|
_AUS_IDEE_FUSS = (
|
||||||
"· Denk das Konzept NICHT neu. Es ist bereits mit voller Kaskade + Advocatus Diaboli "
|
"· Denk das Konzept NICHT neu. Es ist bereits mit voller Kaskade + Advocatus Diaboli "
|
||||||
"gehaertet. Lies es vollstaendig und uebernimm es; eine kurze Nachschaerf-Runde fuer die "
|
"gehaertet. Lies es vollstaendig und uebernimm es; eine kurze Nachschaerf-Runde fuer die "
|
||||||
@@ -891,7 +989,7 @@ _AUS_IDEE_FUSS = (
|
|||||||
"Verschwendung.\n"
|
"Verschwendung.\n"
|
||||||
"· Der Rest ist deine normale Projektstart-Rolle: das Repo enthaelt am Ende NUR Doku "
|
"· Der Rest ist deine normale Projektstart-Rolle: das Repo enthaelt am Ende NUR Doku "
|
||||||
"(KONZEPT.md, ROADMAP.md, AGENTS.md, README.md, SAVEPOINT.md, .aiexclude) — KEIN Code.\n"
|
"(KONZEPT.md, ROADMAP.md, AGENTS.md, README.md, SAVEPOINT.md, .aiexclude) — KEIN Code.\n"
|
||||||
"· Uebergabe wie ueblich: Repo-URL nennen, damit der Commander in Zed loslegen kann.")
|
"· Uebergabe wie ueblich: Repo-URL nennen, damit der Commander in der Agentic IDE loslegen kann.")
|
||||||
|
|
||||||
|
|
||||||
def _wo_liegt(konz: dict) -> str:
|
def _wo_liegt(konz: dict) -> str:
|
||||||
@@ -935,7 +1033,7 @@ def _konzept_und_name(task_id: str) -> tuple:
|
|||||||
quell_titel = _TITEL_PRAEFIX_RX.sub("", str(t.get("title") or "").strip())
|
quell_titel = _TITEL_PRAEFIX_RX.sub("", str(t.get("title") or "").strip())
|
||||||
if not quell_titel:
|
if not quell_titel:
|
||||||
return {}, "", "Quell-Karte hat keinen Titel."
|
return {}, "", "Quell-Karte hat keinen Titel."
|
||||||
h1 = re.search(r"^#\s+(.+)$", konz["konzept"], re.M)
|
h1 = re.search(r"^#\s+(.+)$", konz["konzept"], re.MULTILINE)
|
||||||
kurz = h1.group(1).strip() if h1 else re.split(r"(?<=[.!?])\s", quell_titel)[0]
|
kurz = h1.group(1).strip() if h1 else re.split(r"(?<=[.!?])\s", quell_titel)[0]
|
||||||
return konz, _kurz(kurz, 85), ""
|
return konz, _kurz(kurz, 85), ""
|
||||||
|
|
||||||
@@ -992,7 +1090,7 @@ def projekt_aus_idee(task_id: str, ziel: str = "", tiefe: str = "") -> dict:
|
|||||||
try:
|
try:
|
||||||
from services import announce
|
from services import announce
|
||||||
announce.add(f"Aus der Idee „{_kurz(kurz, 60)}“ wird ein Projekt: {task['id']} — die Box "
|
announce.add(f"Aus der Idee „{_kurz(kurz, 60)}“ wird ein Projekt: {task['id']} — die Box "
|
||||||
"bereitet das Repo vor, gebaut wird in Zed.",
|
"bereitet das Repo vor, gebaut wird in der Agentic IDE.",
|
||||||
"[Ideen-Queue]", "ideen-queue", "silent")
|
"[Ideen-Queue]", "ideen-queue", "silent")
|
||||||
except Exception:
|
except Exception:
|
||||||
pass
|
pass
|
||||||
@@ -1052,9 +1150,9 @@ def konzept_ueberarbeiten(task_id: str, hinweis: str) -> dict:
|
|||||||
"als `KONZEPT.md` hinein (klonen, schreiben, pushen, Push beweisen)."
|
"als `KONZEPT.md` hinein (klonen, schreiben, pushen, Push beweisen)."
|
||||||
if konz.get("repo") else ""))
|
if konz.get("repo") else ""))
|
||||||
|
|
||||||
teile = [f"{_UEBERARBEITEN_KOPF}\n{quelle}\n"
|
teile = [(f"{_UEBERARBEITEN_KOPF}\n{quelle}\n"
|
||||||
f"· SO SOLL ES ANDERS WERDEN — Wortlaut des Commanders:\n „{hinweis}“\n"
|
f"· SO SOLL ES ANDERS WERDEN — Wortlaut des Commanders:\n „{hinweis}“\n"
|
||||||
f"{_UEBERARBEITEN_FUSS}",
|
f"{_UEBERARBEITEN_FUSS}"),
|
||||||
_INFRA_LXC]
|
_INFRA_LXC]
|
||||||
titel = f"Konzept nachschärfen: {kurz}"[:200]
|
titel = f"Konzept nachschärfen: {kurz}"[:200]
|
||||||
args = ["create", titel, "--body", "\n\n".join(teile)[:4000], "--assignee", "projektstart",
|
args = ["create", titel, "--body", "\n\n".join(teile)[:4000], "--assignee", "projektstart",
|
||||||
@@ -1098,7 +1196,7 @@ def log_of(task_id: str) -> dict:
|
|||||||
|
|
||||||
try:
|
try:
|
||||||
r = _hermes(["log", task_id])
|
r = _hermes(["log", task_id])
|
||||||
except Exception as exc:
|
except Exception:
|
||||||
log.warning("ideen: kanban log fehlgeschlagen", exc_info=True)
|
log.warning("ideen: kanban log fehlgeschlagen", exc_info=True)
|
||||||
return {"available": True, "lines": []}
|
return {"available": True, "lines": []}
|
||||||
if r.returncode != 0:
|
if r.returncode != 0:
|
||||||
|
|||||||
@@ -57,40 +57,30 @@ def _pump_output(job: dict, stream) -> None:
|
|||||||
commit()
|
commit()
|
||||||
|
|
||||||
|
|
||||||
def _run_job(job_id: str, args: list[str], env: dict | None = None, sudo_password: str | None = None):
|
def _run_job(job_id: str, args: list[str], env: dict | None = None):
|
||||||
|
"""Job-Prozess starten und mitschreiben.
|
||||||
|
|
||||||
|
v3-Umbau P1 (28.08.2026): Hier wurde frueher ein Sudo-Passwort aus dem Browser an
|
||||||
|
stdin gefuettert (und dafuer `sudo -n` in den Argumenten zu `sudo -S` umgeschrieben).
|
||||||
|
Auf der Box laeuft sudo passwortlos (`NOPASSWD: ALL`), der Pfad war tot. Ohne ihn
|
||||||
|
braucht der Prozess auch keine stdin-Pipe mehr: DEVNULL sorgt dafuer, dass ein Job,
|
||||||
|
der wider Erwarten nach einem Passwort fragt, sofort scheitert statt still zu haengen."""
|
||||||
job = JOBS[job_id]
|
job = JOBS[job_id]
|
||||||
job["state"] = "running"
|
job["state"] = "running"
|
||||||
try:
|
try:
|
||||||
actual_args = list(args)
|
|
||||||
if sudo_password is not None:
|
|
||||||
for i, arg in enumerate(actual_args):
|
|
||||||
if isinstance(arg, str):
|
|
||||||
actual_args[i] = arg.replace("sudo -n", "sudo -S").replace("sudo ", "sudo -S ")
|
|
||||||
|
|
||||||
proc = subprocess.Popen(
|
proc = subprocess.Popen(
|
||||||
actual_args, stdout=subprocess.PIPE, stderr=subprocess.STDOUT,
|
list(args), stdout=subprocess.PIPE, stderr=subprocess.STDOUT,
|
||||||
stdin=subprocess.PIPE if sudo_password is not None else None,
|
stdin=subprocess.DEVNULL,
|
||||||
bufsize=0,
|
bufsize=0,
|
||||||
env={**os.environ, **(env or {})},
|
env={**os.environ, **(env or {})},
|
||||||
)
|
)
|
||||||
_PROCS[job_id] = proc
|
_PROCS[job_id] = proc
|
||||||
|
|
||||||
if sudo_password is not None and proc.stdin:
|
|
||||||
proc.stdin.write((sudo_password + "\n").encode("utf-8"))
|
|
||||||
proc.stdin.flush()
|
|
||||||
proc.stdin.close()
|
|
||||||
|
|
||||||
_pump_output(job, proc.stdout)
|
_pump_output(job, proc.stdout)
|
||||||
proc.wait()
|
proc.wait()
|
||||||
job["returncode"] = proc.returncode
|
job["returncode"] = proc.returncode
|
||||||
job["state"] = "canceled" if job.get("canceled") else ("done" if proc.returncode == 0 else "failed")
|
job["state"] = "canceled" if job.get("canceled") else ("done" if proc.returncode == 0 else "failed")
|
||||||
|
except Exception as exc:
|
||||||
# Check if failed due to sudo authorization failure
|
|
||||||
if proc.returncode != 0 and job["log"]:
|
|
||||||
log_str = "\n".join(job["log"])
|
|
||||||
if "a password is required" in log_str or "password" in log_str.lower() or "sudo:" in log_str:
|
|
||||||
job["sudo_failed"] = True
|
|
||||||
except Exception as exc: # noqa: BLE001
|
|
||||||
_append_log(job, f"[mc] Fehler: {exc}")
|
_append_log(job, f"[mc] Fehler: {exc}")
|
||||||
job["state"] = "failed"
|
job["state"] = "failed"
|
||||||
job["returncode"] = -1
|
job["returncode"] = -1
|
||||||
@@ -101,7 +91,7 @@ def _run_job(job_id: str, args: list[str], env: dict | None = None, sudo_passwor
|
|||||||
if cb and job["state"] == "done":
|
if cb and job["state"] == "done":
|
||||||
try:
|
try:
|
||||||
cb()
|
cb()
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
_append_log(job, f"[mc] Nachbearbeitung-Fehler: {exc}")
|
_append_log(job, f"[mc] Nachbearbeitung-Fehler: {exc}")
|
||||||
|
|
||||||
|
|
||||||
@@ -136,7 +126,7 @@ def attach_download_progress(job_id: str, local_dir: str, total_bytes: int) -> N
|
|||||||
j["rate_bps"] = rate
|
j["rate_bps"] = rate
|
||||||
j["eta_s"] = int((total_bytes - cur) / rate)
|
j["eta_s"] = int((total_bytes - cur) / rate)
|
||||||
prev_t, prev_b = now, cur
|
prev_t, prev_b = now, cur
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
time.sleep(1.0)
|
time.sleep(1.0)
|
||||||
j = JOBS.get(job_id)
|
j = JOBS.get(job_id)
|
||||||
@@ -148,9 +138,8 @@ def attach_download_progress(job_id: str, local_dir: str, total_bytes: int) -> N
|
|||||||
|
|
||||||
|
|
||||||
def start_job(args: list[str], label: str, env: dict | None = None, on_done=None,
|
def start_job(args: list[str], label: str, env: dict | None = None, on_done=None,
|
||||||
sudo_password: str | None = None, group: str | None = None) -> str:
|
group: str | None = None) -> str:
|
||||||
job_id = uuid.uuid4().hex[:12]
|
job_id = uuid.uuid4().hex[:12]
|
||||||
# Mask password in log if present in args
|
|
||||||
log_args = list(args)
|
log_args = list(args)
|
||||||
JOBS[job_id] = {
|
JOBS[job_id] = {
|
||||||
"id": job_id, "label": label, "state": "queued", "group": group,
|
"id": job_id, "label": label, "state": "queued", "group": group,
|
||||||
@@ -159,7 +148,7 @@ def start_job(args: list[str], label: str, env: dict | None = None, on_done=None
|
|||||||
}
|
}
|
||||||
if on_done:
|
if on_done:
|
||||||
JOBS[job_id]["_on_done"] = on_done
|
JOBS[job_id]["_on_done"] = on_done
|
||||||
threading.Thread(target=_run_job, args=(job_id, args, env, sudo_password), daemon=True).start()
|
threading.Thread(target=_run_job, args=(job_id, args, env), daemon=True).start()
|
||||||
return job_id
|
return job_id
|
||||||
|
|
||||||
|
|
||||||
@@ -182,7 +171,7 @@ def cancel_job(job_id: str) -> bool:
|
|||||||
if proc is not None:
|
if proc is not None:
|
||||||
try:
|
try:
|
||||||
proc.terminate()
|
proc.terminate()
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
else:
|
else:
|
||||||
job["state"] = "canceled"
|
job["state"] = "canceled"
|
||||||
|
|||||||
@@ -1,191 +0,0 @@
|
|||||||
"""
|
|
||||||
Ketten-Digest — Telegram-Status für lange Aufgaben-Ketten (User-Wunsch 20.07.2026).
|
|
||||||
|
|
||||||
Wenn die Werkstatt eine Karten-Familie abarbeitet (z. B. „Homelab-Dashboard 2.0" mit
|
|
||||||
19 verketteten Karten), soll der Commander nicht raten müssen: dieser Wächter liest
|
|
||||||
die Queue-Sicht (services/ideen.py, inkl. Ketten-Anreicherung) und meldet per Telegram
|
|
||||||
|
|
||||||
• SOFORT, wenn eine Karte hängt und eine Frage an den Commander hat (blocked) —
|
|
||||||
einmal pro Karte, mit der Frage im Wortlaut,
|
|
||||||
• bei MEILENSTEINEN (Projekt komplett fertig) sofort,
|
|
||||||
• sonst höchstens einmal pro PULS_SEKUNDEN (Default 60 min) einen Zwischenstand
|
|
||||||
je aktivem Projekt („5/19 fertig · läuft: … · als Nächstes: …").
|
|
||||||
|
|
||||||
Taktung war explizite User-Wahl („Meilensteine + 60-min-Puls, Fragen immer sofort").
|
|
||||||
Zustand (was wurde wann gemeldet) liegt als JSON neben den Modellen und übersteht
|
|
||||||
Neustarts — sonst käme nach jedem Deploy ein Duplikat-Schwall. Auf Windows (Dev) No-op.
|
|
||||||
"""
|
|
||||||
|
|
||||||
import asyncio
|
|
||||||
import json
|
|
||||||
import logging
|
|
||||||
import os
|
|
||||||
import time
|
|
||||||
import zlib
|
|
||||||
from pathlib import Path
|
|
||||||
|
|
||||||
from config import MODELS_DIR
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
|
||||||
|
|
||||||
ENABLED = os.name == "posix" and os.environ.get("MC_KETTEN_DIGEST", "1") != "0"
|
|
||||||
INTERVAL = int(os.environ.get("MC_KETTEN_DIGEST_INTERVAL", "300")) # Prüf-Tick: 5 min
|
|
||||||
PULS_SEKUNDEN = int(os.environ.get("MC_KETTEN_DIGEST_PULS", "3600")) # Zwischenstand: 60 min
|
|
||||||
# Hänger-Alarm: laufende Karte ohne Lebenszeichen (Heartbeat) länger als diese Schwelle
|
|
||||||
# → sofortige Telegram-Warnung (einmal pro Karten-Lauf). Live-Fall 20.07.: Worker wartete
|
|
||||||
# 45 min auf einen selbst gestarteten uvicorn — „pid_alive" hielt den Claim ewig frisch.
|
|
||||||
HANG_SEKUNDEN = int(os.environ.get("MC_KETTEN_HANG", "900"))
|
|
||||||
KANBAN_LOGS = Path(os.environ.get("MC_KANBAN_LOGS", "~/.hermes/kanban/logs")).expanduser()
|
|
||||||
STATE_PATH = Path(os.environ.get("MC_KETTEN_DIGEST_STATE", str(MODELS_DIR / "mc2-ketten-digest.json")))
|
|
||||||
|
|
||||||
|
|
||||||
def _kontext_druck(task_id: str) -> int:
|
|
||||||
"""Wie oft der Worker zuletzt den Kontext verdichten musste (Log-Marker) —
|
|
||||||
mehrfaches „Compacting context" heißt: die Aufgabe sprengt das Fenster."""
|
|
||||||
try:
|
|
||||||
p = KANBAN_LOGS / f"{task_id}.log"
|
|
||||||
with p.open("rb") as f:
|
|
||||||
f.seek(max(0, p.stat().st_size - 200_000))
|
|
||||||
tail = f.read().decode("utf-8", errors="replace")
|
|
||||||
return tail.count("Compacting context")
|
|
||||||
except Exception:
|
|
||||||
return 0
|
|
||||||
|
|
||||||
|
|
||||||
def _load_state() -> dict:
|
|
||||||
try:
|
|
||||||
d = json.loads(STATE_PATH.read_text(encoding="utf-8"))
|
|
||||||
return d if isinstance(d, dict) else {}
|
|
||||||
except Exception:
|
|
||||||
return {}
|
|
||||||
|
|
||||||
|
|
||||||
def _save_state(state: dict) -> None:
|
|
||||||
try:
|
|
||||||
tmp = STATE_PATH.with_suffix(".tmp")
|
|
||||||
tmp.write_text(json.dumps(state, ensure_ascii=False), encoding="utf-8")
|
|
||||||
tmp.replace(STATE_PATH)
|
|
||||||
except OSError:
|
|
||||||
log.warning("ketten-digest: Zustand %s nicht schreibbar", STATE_PATH, exc_info=True)
|
|
||||||
|
|
||||||
|
|
||||||
def _melden(subject: str, text: str) -> None:
|
|
||||||
"""Aufs Handy UND in den Briefkasten (silent — Lucy muss den Status nicht sprechen)."""
|
|
||||||
from services import announce
|
|
||||||
announce.notify_telegram(subject, text)
|
|
||||||
try:
|
|
||||||
announce.add(text, subject, "ketten-digest", "silent")
|
|
||||||
except Exception:
|
|
||||||
pass
|
|
||||||
|
|
||||||
|
|
||||||
def _tick() -> None:
|
|
||||||
from services import ideen
|
|
||||||
|
|
||||||
data = ideen.list_queue()
|
|
||||||
if not data.get("available"):
|
|
||||||
return
|
|
||||||
items = data.get("items") or []
|
|
||||||
projekte = data.get("projekte") or []
|
|
||||||
by_id = {i["id"]: i for i in items if i.get("id")}
|
|
||||||
state = _load_state()
|
|
||||||
gemeldete_fragen: dict = state.setdefault("fragen", {})
|
|
||||||
projekt_state: dict = state.setdefault("projekte", {})
|
|
||||||
dirty = False
|
|
||||||
now = int(time.time())
|
|
||||||
|
|
||||||
# 1) Hängende Karten mit Frage → sofort, einmal pro Karte. Der Schlüssel enthält den
|
|
||||||
# Fragen-Text-Hash: hängt dieselbe Karte später mit NEUER Frage, wird wieder gemeldet.
|
|
||||||
for it in items:
|
|
||||||
if it.get("status") != "blocked":
|
|
||||||
continue
|
|
||||||
frage = (it.get("frage") or "").strip()
|
|
||||||
key = f"{it['id']}:{zlib.crc32(frage.encode('utf-8')):x}"
|
|
||||||
if key in gemeldete_fragen:
|
|
||||||
continue
|
|
||||||
text = (f"Aufgabe hängt und wartet auf dich: „{(it.get('titel') or '')[:120]}“\n"
|
|
||||||
+ (f"Frage: {frage[:500]}\n" if frage else "")
|
|
||||||
+ "Antworten geht im Auftragsbuch (Zentrale) — die Box macht dann weiter.")
|
|
||||||
_melden("[Werkstatt]", text)
|
|
||||||
gemeldete_fragen[key] = now
|
|
||||||
dirty = True
|
|
||||||
|
|
||||||
# 1b) Hänger-Alarm: laufende Karte ohne Lebenszeichen → einmal pro Karten-Lauf warnen.
|
|
||||||
gemeldete_haenger: dict = state.setdefault("haenger", {})
|
|
||||||
for it in items:
|
|
||||||
if it.get("status") != "running":
|
|
||||||
continue
|
|
||||||
puls = it.get("puls_alter")
|
|
||||||
if puls is None or puls < HANG_SEKUNDEN:
|
|
||||||
continue
|
|
||||||
key = f"{it['id']}:{it.get('gestartet') or 0}"
|
|
||||||
if key in gemeldete_haenger:
|
|
||||||
continue
|
|
||||||
minuten = int(puls / 60)
|
|
||||||
text = (f"Karte scheint zu hängen: „{(it.get('titel') or '')[:120]}“ — "
|
|
||||||
f"seit {minuten} min kein Lebenszeichen vom Worker.")
|
|
||||||
druck = _kontext_druck(it["id"])
|
|
||||||
if druck >= 2:
|
|
||||||
text += (f"\nDer Worker musste {druck}× den Kontext verdichten — "
|
|
||||||
"die Aufgabe ist womöglich zu groß geschnitten.")
|
|
||||||
text += "\nIn der Zentrale: „Neuer Versuch“ startet sie frisch, „Stopp“ hält sie an."
|
|
||||||
_melden("[Werkstatt]", text)
|
|
||||||
gemeldete_haenger[key] = now
|
|
||||||
dirty = True
|
|
||||||
if len(gemeldete_haenger) > 200:
|
|
||||||
for k in sorted(gemeldete_haenger, key=gemeldete_haenger.get)[:100]:
|
|
||||||
gemeldete_haenger.pop(k, None)
|
|
||||||
dirty = True
|
|
||||||
|
|
||||||
# Fragen-Gedächtnis klein halten (Karten verschwinden irgendwann ins Archiv).
|
|
||||||
if len(gemeldete_fragen) > 200:
|
|
||||||
for k in sorted(gemeldete_fragen, key=gemeldete_fragen.get)[:100]:
|
|
||||||
gemeldete_fragen.pop(k, None)
|
|
||||||
dirty = True
|
|
||||||
|
|
||||||
# 2) Projekt-Status: Abschluss sofort, sonst gedrosselter Puls solange gearbeitet wird.
|
|
||||||
for p in projekte:
|
|
||||||
ps = projekt_state.setdefault(p["key"], {})
|
|
||||||
fertig, gesamt = p.get("fertig", 0), p.get("gesamt", 0)
|
|
||||||
|
|
||||||
if gesamt > 0 and fertig >= gesamt and not ps.get("abschluss_gemeldet"):
|
|
||||||
_melden("[Werkstatt]", f"Projekt fertig: „{p['titel']}“ — alle {gesamt} Karten erledigt. "
|
|
||||||
"Ergebnisse liegen im Auftragsbuch.")
|
|
||||||
ps.update(abschluss_gemeldet=True, letzter_puls=now, letzter_stand=fertig)
|
|
||||||
dirty = True
|
|
||||||
continue
|
|
||||||
|
|
||||||
aktiv = p.get("laeuft", 0) > 0
|
|
||||||
if not aktiv:
|
|
||||||
continue
|
|
||||||
if now - int(ps.get("letzter_puls") or 0) < PULS_SEKUNDEN:
|
|
||||||
continue
|
|
||||||
laufende = [i for i in items if i.get("projekt") == p["key"] and i["status"] == "running"]
|
|
||||||
naechste = [i for i in items if i.get("projekt") == p["key"]
|
|
||||||
and i["status"] in ("ready", "todo") and not i.get("wartet_auf")]
|
|
||||||
zeilen = [f"Werkstatt-Status „{p['titel']}“: {fertig}/{gesamt} fertig."]
|
|
||||||
for l in laufende[:2]:
|
|
||||||
note = f" — {l['notiz']}" if l.get("notiz") else ""
|
|
||||||
zeilen.append(f"Läuft: {l['titel'][:90]}{note}")
|
|
||||||
if naechste:
|
|
||||||
zeilen.append(f"Als Nächstes: {naechste[0]['titel'][:90]}")
|
|
||||||
haengt = p.get("haengt", 0)
|
|
||||||
if haengt:
|
|
||||||
zeilen.append(f"{haengt} Karte(n) warten auf deine Antwort im Auftragsbuch.")
|
|
||||||
_melden("[Werkstatt]", "\n".join(zeilen))
|
|
||||||
ps.update(letzter_puls=now, letzter_stand=fertig)
|
|
||||||
dirty = True
|
|
||||||
|
|
||||||
if dirty:
|
|
||||||
_save_state(state)
|
|
||||||
|
|
||||||
|
|
||||||
async def digest_loop() -> None:
|
|
||||||
"""Hintergrund-Task im MC2-Lifespan (Muster: reminders_loop)."""
|
|
||||||
log.info("ketten-digest: aktiv (Tick %ss, Puls %ss)", INTERVAL, PULS_SEKUNDEN)
|
|
||||||
while True:
|
|
||||||
try:
|
|
||||||
await asyncio.to_thread(_tick)
|
|
||||||
except Exception:
|
|
||||||
log.debug("ketten-digest: Tick fehlgeschlagen", exc_info=True)
|
|
||||||
await asyncio.sleep(INTERVAL)
|
|
||||||
@@ -11,12 +11,17 @@ import os
|
|||||||
import re
|
import re
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
from ruamel.yaml.scalarstring import LiteralScalarString
|
|
||||||
|
|
||||||
from config import (
|
from config import (
|
||||||
CMD_TEMPLATE, CONFIG_PATH, DEFAULT_TTL, DRAFTS_DIR, LLAMA_SWAP_URL,
|
CMD_TEMPLATE,
|
||||||
SPEC_DRAFT_MODEL_PATH, SPEC_DRAFT_N_MAX, SPEC_TYPE,
|
CONFIG_PATH,
|
||||||
|
DEFAULT_TTL,
|
||||||
|
DRAFTS_DIR,
|
||||||
|
LLAMA_SWAP_URL,
|
||||||
|
SPEC_DRAFT_MODEL_PATH,
|
||||||
|
SPEC_DRAFT_N_MAX,
|
||||||
|
SPEC_TYPE,
|
||||||
)
|
)
|
||||||
|
from ruamel.yaml.scalarstring import LiteralScalarString
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|
||||||
@@ -143,13 +148,13 @@ def model_id_from_path(model_path: str) -> str:
|
|||||||
Split-GGUFs liegen oft in einem Quant-Unterordner (…/Q4_K_M/file-00001-of-…) →
|
Split-GGUFs liegen oft in einem Quant-Unterordner (…/Q4_K_M/file-00001-of-…) →
|
||||||
dann eine Ebene höher (Repo-Ordner) nehmen, sonst hieße das Modell 'Q4_K_M'."""
|
dann eine Ebene höher (Repo-Ordner) nehmen, sonst hieße das Modell 'Q4_K_M'."""
|
||||||
d = os.path.basename(os.path.dirname(model_path))
|
d = os.path.basename(os.path.dirname(model_path))
|
||||||
if re.fullmatch(r"(I?Q\d[\w]*|UD-Q\d[\w]*|F16|BF16|FP16|F32)", d, flags=re.I):
|
if re.fullmatch(r"(I?Q\d[\w]*|UD-Q\d[\w]*|F16|BF16|FP16|F32)", d, flags=re.IGNORECASE):
|
||||||
d = os.path.basename(os.path.dirname(os.path.dirname(model_path)))
|
d = os.path.basename(os.path.dirname(os.path.dirname(model_path)))
|
||||||
name = re.sub(r"[-_]?GGUF$", "", d, flags=re.I).strip("-_")
|
name = re.sub(r"[-_]?GGUF$", "", d, flags=re.IGNORECASE).strip("-_")
|
||||||
if not name:
|
if not name:
|
||||||
fn = re.sub(r"\.gguf$", "", os.path.basename(model_path), flags=re.I)
|
fn = re.sub(r"\.gguf$", "", os.path.basename(model_path), flags=re.IGNORECASE)
|
||||||
fn = re.sub(r"-\d+-of-\d+$", "", fn)
|
fn = re.sub(r"-\d+-of-\d+$", "", fn)
|
||||||
name = re.sub(r"[-_](Q\d[\w]*|IQ\d[\w]*|F16|BF16|FP16|F32)$", "", fn, flags=re.I)
|
name = re.sub(r"[-_](Q\d[\w]*|IQ\d[\w]*|F16|BF16|FP16|F32)$", "", fn, flags=re.IGNORECASE)
|
||||||
return name or "modell"
|
return name or "modell"
|
||||||
|
|
||||||
|
|
||||||
@@ -222,7 +227,7 @@ def write_config(cfg: dict) -> None:
|
|||||||
try:
|
try:
|
||||||
from services import warmer
|
from services import warmer
|
||||||
warmer.nudge()
|
warmer.nudge()
|
||||||
except Exception: # noqa: BLE001 — Vorwärmen ist Komfort, nie ein Schreib-Blocker
|
except Exception:
|
||||||
pass
|
pass
|
||||||
except PermissionError as exc:
|
except PermissionError as exc:
|
||||||
raise PermissionError(
|
raise PermissionError(
|
||||||
|
|||||||
@@ -20,7 +20,7 @@ from services import catalog, discover, jobengine, llamaswap, system
|
|||||||
# System-Dienste (root, via sudo -n NOPASSWD) vs. User-Dienste (systemctl --user).
|
# System-Dienste (root, via sudo -n NOPASSWD) vs. User-Dienste (systemctl --user).
|
||||||
SYSTEM_SERVICES = {"llama-swap"}
|
SYSTEM_SERVICES = {"llama-swap"}
|
||||||
USER_SERVICES = {"mission-control-2", "mc2-gateway", "mc2-steward", "box-console",
|
USER_SERVICES = {"mission-control-2", "mc2-gateway", "mc2-steward", "box-console",
|
||||||
"hermes-gateway", "hermes-builtin-ui", "mem0-service", "voice-service"}
|
"hermes-gateway", "hermes-builtin-ui", "voice-service"}
|
||||||
|
|
||||||
# Engine-Update: lädt den neuesten Vulkan-Build (deploy/update-engine.sh, läuft als root).
|
# Engine-Update: lädt den neuesten Vulkan-Build (deploy/update-engine.sh, läuft als root).
|
||||||
_REPO_ROOT = os.path.abspath(os.path.join(os.path.dirname(__file__), "..", ".."))
|
_REPO_ROOT = os.path.abspath(os.path.join(os.path.dirname(__file__), "..", ".."))
|
||||||
@@ -35,7 +35,7 @@ _engine_cache = {"ts": 0.0, "avail": False}
|
|||||||
# manchmal noch keine CI-Assets (0 Assets) → ihr Download-Link 404t. Sowohl der Update-Check
|
# manchmal noch keine CI-Assets (0 Assets) → ihr Download-Link 404t. Sowohl der Update-Check
|
||||||
# als auch der Download (update-engine.sh) müssen daher die neueste ASSET-tragende Release
|
# als auch der Download (update-engine.sh) müssen daher die neueste ASSET-tragende Release
|
||||||
# nehmen, sonst zeigt das UI „Update verfügbar", das dann beim Einspielen scheitert.
|
# nehmen, sonst zeigt das UI „Update verfügbar", das dann beim Einspielen scheitert.
|
||||||
_ENGINE_ASSET_RX = re.compile(r"ubuntu-vulkan-x64\.tar\.gz$", re.I)
|
_ENGINE_ASSET_RX = re.compile(r"ubuntu-vulkan-x64\.tar\.gz$", re.IGNORECASE)
|
||||||
|
|
||||||
|
|
||||||
def _latest_engine_asset_release() -> dict | None:
|
def _latest_engine_asset_release() -> dict | None:
|
||||||
@@ -73,8 +73,9 @@ def _installed_engine_build() -> int | None:
|
|||||||
out = subprocess.run([bin_path, "--version"], capture_output=True, text=True,
|
out = subprocess.run([bin_path, "--version"], capture_output=True, text=True,
|
||||||
timeout=20, env=env)
|
timeout=20, env=env)
|
||||||
txt = (out.stderr or "") + (out.stdout or "")
|
txt = (out.stderr or "") + (out.stdout or "")
|
||||||
# Formate je nach Build: "version: 9821 (hash)" (aktuell), "build: <hash> (9821)", "b9821".
|
# Formate je nach Build: "version: 0.1.0-dev (build 10426, ...)", "version: 9821 (hash)", "build: <hash> (9821)", "b9821".
|
||||||
if (m := re.search(r"version:\s*(\d{3,})", txt)) \
|
if (m := re.search(r"\bbuild\s+(\d{3,})\b", txt)) \
|
||||||
|
or (m := re.search(r"version:\s*(\d{3,})", txt)) \
|
||||||
or (m := re.search(r"build:\s*\S+\s*\((\d+)\)", txt)) \
|
or (m := re.search(r"build:\s*\S+\s*\((\d+)\)", txt)) \
|
||||||
or (m := re.search(r"\bb(\d{3,})\b", txt)):
|
or (m := re.search(r"\bb(\d{3,})\b", txt)):
|
||||||
return int(m.group(1))
|
return int(m.group(1))
|
||||||
@@ -289,7 +290,7 @@ def model_upgrades() -> list[dict]:
|
|||||||
continue
|
continue
|
||||||
|
|
||||||
base = rec.split("/")[-1].lower()
|
base = rec.split("/")[-1].lower()
|
||||||
stem = base[:-5] if base.endswith("-gguf") else base
|
stem = base.removesuffix("-gguf")
|
||||||
if base in cmds or (stem and stem in cmds):
|
if base in cmds or (stem and stem in cmds):
|
||||||
continue # schon installiert
|
continue # schon installiert
|
||||||
out.append({"role": role, "title": c["title"], "repo": rec})
|
out.append({"role": role, "title": c["title"], "repo": rec})
|
||||||
@@ -343,7 +344,7 @@ def _os_held_back() -> list[dict]:
|
|||||||
held.append({"name": name, "reason": reason})
|
held.append({"name": name, "reason": reason})
|
||||||
elif reason: # nicht eingerückt → Abschnitt zu Ende
|
elif reason: # nicht eingerückt → Abschnitt zu Ende
|
||||||
reason = None
|
reason = None
|
||||||
except Exception: # noqa: BLE001 — nur Zusatzinfo, nie ein Blocker
|
except Exception:
|
||||||
pass
|
pass
|
||||||
held.sort(key=lambda p: p["name"])
|
held.sort(key=lambda p: p["name"])
|
||||||
return held
|
return held
|
||||||
@@ -368,7 +369,7 @@ def os_update_details() -> dict:
|
|||||||
out_pkgs.sort(key=lambda p: p["name"])
|
out_pkgs.sort(key=lambda p: p["name"])
|
||||||
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs,
|
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs,
|
||||||
"held_back": _os_held_back()}
|
"held_back": _os_held_back()}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs, "error": str(exc)}
|
return {"kind": "os", "count": len(out_pkgs), "packages": out_pkgs, "error": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
@@ -393,7 +394,7 @@ def engine_update_details() -> dict:
|
|||||||
ctx = ("Es geht um ein Update der Inferenz-Engine llama.cpp (Vulkan-Build, treibt alle "
|
ctx = ("Es geht um ein Update der Inferenz-Engine llama.cpp (Vulkan-Build, treibt alle "
|
||||||
"Sprachmodelle der Box auf der AMD-Strix-Halo-GPU).")
|
"Sprachmodelle der Box auf der AMD-Strix-Halo-GPU).")
|
||||||
info.update(_summarize_release("engine", tag, ctx, body[:6000]))
|
info.update(_summarize_release("engine", tag, ctx, body[:6000]))
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
info["error"] = str(exc)
|
info["error"] = str(exc)
|
||||||
return info
|
return info
|
||||||
|
|
||||||
@@ -418,7 +419,7 @@ def swap_update_details() -> dict:
|
|||||||
ctx = ("Es geht um ein Update von llama-swap (der Router, der Anfragen an die Box "
|
ctx = ("Es geht um ein Update von llama-swap (der Router, der Anfragen an die Box "
|
||||||
"verteilt und Sprachmodelle heiß nachlädt).")
|
"verteilt und Sprachmodelle heiß nachlädt).")
|
||||||
info.update(_summarize_release("swap", tag, ctx, body[:6000]))
|
info.update(_summarize_release("swap", tag, ctx, body[:6000]))
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
info["error"] = str(exc)
|
info["error"] = str(exc)
|
||||||
return info
|
return info
|
||||||
|
|
||||||
@@ -496,7 +497,7 @@ def _summarize_release(kind: str, key: str, context: str, changes: str) -> dict:
|
|||||||
if text:
|
if text:
|
||||||
cache.update(key=key, data=data)
|
cache.update(key=key, data=data)
|
||||||
return data
|
return data
|
||||||
except Exception as exc: # noqa: BLE001 — Zusammenfassung ist Komfort, nie Blocker
|
except Exception as exc:
|
||||||
return {"summary": f"(Zusammenfassung nicht verfügbar: {exc})",
|
return {"summary": f"(Zusammenfassung nicht verfügbar: {exc})",
|
||||||
"action_needed": None, "action_text": ""}
|
"action_needed": None, "action_text": ""}
|
||||||
|
|
||||||
@@ -534,7 +535,7 @@ def hermes_update_details() -> dict:
|
|||||||
info["behind"] = len(commits)
|
info["behind"] = len(commits)
|
||||||
if commits:
|
if commits:
|
||||||
info.update(_summarize_hermes_commits(commits))
|
info.update(_summarize_hermes_commits(commits))
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
info["error"] = str(exc)
|
info["error"] = str(exc)
|
||||||
return info
|
return info
|
||||||
|
|
||||||
@@ -545,59 +546,59 @@ def update_details(kind: str) -> dict:
|
|||||||
"hermes": hermes_update_details}.get(kind, lambda: {"error": "unbekannt"})()
|
"hermes": hermes_update_details}.get(kind, lambda: {"error": "unbekannt"})()
|
||||||
|
|
||||||
|
|
||||||
def _run(cmd: list[str], sudo_password: str | None = None) -> dict:
|
def _run(cmd: list[str]) -> dict:
|
||||||
actual_cmd = list(cmd)
|
"""Befehl ausfuehren. sudo laeuft IMMER mit `-n` (never prompt).
|
||||||
has_sudo = False
|
|
||||||
|
|
||||||
|
v3-Umbau P1 (28.08.2026): Frueher konnte hier ein Sudo-Passwort durchgereicht und per
|
||||||
|
`-S` an stdin gefuettert werden — das Passwort kam aus dem `localStorage` des Browsers
|
||||||
|
und reiste bei jedem mutierenden Request mit. Auf der Box gemessen: `sudo -n true`
|
||||||
|
laeuft durch, weil `/etc/sudoers` den Dienst-Nutzer mit `NOPASSWD: ALL` fuehrt. Der
|
||||||
|
ganze Pfad war also totes Risiko ohne Gegenwert.
|
||||||
|
|
||||||
|
`-n` heisst: Braucht sudo je doch ein Passwort, scheitert der Befehl SOFORT und sauber,
|
||||||
|
statt auf eine Eingabe zu warten, die es hier nicht gibt. Das meldet die Funktion
|
||||||
|
darunter als `password_required` — ein ehrliches Konfigurations-Signal, das man auf der
|
||||||
|
Box loest und nicht mit einem im Browser geparkten Geheimnis uebertuencht."""
|
||||||
|
actual_cmd = list(cmd)
|
||||||
if cmd and cmd[0] == "sudo":
|
if cmd and cmd[0] == "sudo":
|
||||||
has_sudo = True
|
|
||||||
# If we have a password, use -S instead of -n
|
|
||||||
if sudo_password is not None:
|
|
||||||
if "-n" in actual_cmd:
|
|
||||||
actual_cmd = [x for x in actual_cmd if x != "-n"]
|
|
||||||
if "-S" not in actual_cmd:
|
|
||||||
actual_cmd.insert(1, "-S")
|
|
||||||
else:
|
|
||||||
# Force -n to fail cleanly if password is required
|
|
||||||
if "-S" in actual_cmd:
|
if "-S" in actual_cmd:
|
||||||
actual_cmd = [x for x in actual_cmd if x != "-S"]
|
actual_cmd = [x for x in actual_cmd if x != "-S"]
|
||||||
if "-n" not in actual_cmd:
|
if "-n" not in actual_cmd:
|
||||||
actual_cmd.insert(1, "-n")
|
actual_cmd.insert(1, "-n")
|
||||||
|
|
||||||
try:
|
try:
|
||||||
input_data = (sudo_password + "\n") if (has_sudo and sudo_password is not None) else None
|
p = subprocess.run(actual_cmd, capture_output=True, text=True, timeout=120)
|
||||||
p = subprocess.run(actual_cmd, input=input_data, capture_output=True, text=True, timeout=120)
|
|
||||||
|
|
||||||
err_msg = p.stderr or ""
|
err_msg = p.stderr or ""
|
||||||
if p.returncode != 0 and ("a password is required" in err_msg or "password" in err_msg.lower() or "sudo:" in err_msg):
|
if p.returncode != 0 and ("a password is required" in err_msg or "password" in err_msg.lower() or "sudo:" in err_msg):
|
||||||
if sudo_password is not None:
|
return {"ok": False, "status": "password_required", "out": p.stdout or "",
|
||||||
return {"ok": False, "status": "incorrect_password", "out": p.stdout or "", "err": "Falsches Sudo-Passwort."}
|
"err": "sudo verlangt hier ein Passwort. Das ist eine Konfigurations-Frage "
|
||||||
return {"ok": False, "status": "password_required", "out": p.stdout or "", "err": "Sudo-Passwort erforderlich."}
|
"auf der Box (sudoers), nichts, was die Oberflaeche liefern kann."}
|
||||||
|
|
||||||
return {"ok": p.returncode == 0, "out": (p.stdout or "")[-4000:], "err": (p.stderr or "")[-2000:]}
|
return {"ok": p.returncode == 0, "out": (p.stdout or "")[-4000:], "err": (p.stderr or "")[-2000:]}
|
||||||
except Exception as exc: # noqa: BLE001
|
except Exception as exc:
|
||||||
return {"ok": False, "out": "", "err": str(exc)}
|
return {"ok": False, "out": "", "err": str(exc)}
|
||||||
|
|
||||||
|
|
||||||
def check_sudo_needs_password(sudo_password: str | None = None) -> dict | None:
|
def check_sudo_needs_password() -> dict | None:
|
||||||
"""Checks if sudo needs a password. Returns error dict if password required/incorrect, else None."""
|
"""Laeuft sudo hier passwortlos? Fehler-Dict wenn nein, sonst None."""
|
||||||
res = _run(["sudo", "true"], sudo_password=sudo_password)
|
res = _run(["sudo", "true"])
|
||||||
if not res["ok"]:
|
if not res["ok"]:
|
||||||
return res
|
return res
|
||||||
return None
|
return None
|
||||||
|
|
||||||
|
|
||||||
def restart_service(name: str, sudo_password: str | None = None) -> dict:
|
def restart_service(name: str) -> dict:
|
||||||
if name in SYSTEM_SERVICES:
|
if name in SYSTEM_SERVICES:
|
||||||
if err := check_sudo_needs_password(sudo_password):
|
if err := check_sudo_needs_password():
|
||||||
return err
|
return err
|
||||||
return _run(["sudo", "systemctl", "restart", name], sudo_password=sudo_password)
|
return _run(["sudo", "systemctl", "restart", name])
|
||||||
if name in USER_SERVICES:
|
if name in USER_SERVICES:
|
||||||
return _run(["systemctl", "--user", "restart", name])
|
return _run(["systemctl", "--user", "restart", name])
|
||||||
return {"ok": False, "err": f"Dienst '{name}' nicht erlaubt."}
|
return {"ok": False, "err": f"Dienst '{name}' nicht erlaubt."}
|
||||||
|
|
||||||
|
|
||||||
def logs(service: str, lines: int = 200, sudo_password: str | None = None) -> dict:
|
def logs(service: str, lines: int = 200) -> dict:
|
||||||
lines = max(1, min(lines, 1000))
|
lines = max(1, min(lines, 1000))
|
||||||
if service in USER_SERVICES:
|
if service in USER_SERVICES:
|
||||||
r = _run(["journalctl", "--user", "-u", service, "-n", str(lines), "--no-pager"])
|
r = _run(["journalctl", "--user", "-u", service, "-n", str(lines), "--no-pager"])
|
||||||
@@ -608,15 +609,14 @@ def logs(service: str, lines: int = 200, sudo_password: str | None = None) -> di
|
|||||||
r = _run(["journalctl", "-u", service, "-n", str(lines), "--no-pager"])
|
r = _run(["journalctl", "-u", service, "-n", str(lines), "--no-pager"])
|
||||||
if r["ok"]:
|
if r["ok"]:
|
||||||
return {"ok": True, "text": r["out"] or "(keine Log-Einträge)"}
|
return {"ok": True, "text": r["out"] or "(keine Log-Einträge)"}
|
||||||
if err := check_sudo_needs_password(sudo_password):
|
if err := check_sudo_needs_password():
|
||||||
return err
|
return err
|
||||||
r = _run(["sudo", "journalctl", "-u", service, "-n", str(lines), "--no-pager"],
|
r = _run(["sudo", "journalctl", "-u", service, "-n", str(lines), "--no-pager"])
|
||||||
sudo_password=sudo_password)
|
|
||||||
return {"ok": r["ok"], "text": r["out"] or r["err"]}
|
return {"ok": r["ok"], "text": r["out"] or r["err"]}
|
||||||
return {"ok": False, "text": "", "err": "Dienst nicht erlaubt."}
|
return {"ok": False, "text": "", "err": "Dienst nicht erlaubt."}
|
||||||
|
|
||||||
def check_updates_job(sudo_password: str | None = None) -> dict:
|
def check_updates_job() -> dict:
|
||||||
if err := check_sudo_needs_password(sudo_password):
|
if err := check_sudo_needs_password():
|
||||||
return err
|
return err
|
||||||
|
|
||||||
def on_done():
|
def on_done():
|
||||||
@@ -624,7 +624,7 @@ def check_updates_job(sudo_password: str | None = None) -> dict:
|
|||||||
_comp_cache.update(ts=0.0, data=[]) # Hermes-Status ebenfalls neu berechnen lassen
|
_comp_cache.update(ts=0.0, data=[]) # Hermes-Status ebenfalls neu berechnen lassen
|
||||||
|
|
||||||
cmd = "sudo apt-get update"
|
cmd = "sudo apt-get update"
|
||||||
job_id = jobengine.start_job(["bash", "-c", cmd], "Nach Updates suchen", on_done=on_done, sudo_password=sudo_password)
|
job_id = jobengine.start_job(["bash", "-c", cmd], "Nach Updates suchen", on_done=on_done)
|
||||||
return {"ok": True, "job_id": job_id}
|
return {"ok": True, "job_id": job_id}
|
||||||
|
|
||||||
|
|
||||||
@@ -636,10 +636,10 @@ def _maintenance_busy() -> dict | None:
|
|||||||
return None
|
return None
|
||||||
|
|
||||||
|
|
||||||
def os_update_job(sudo_password: str | None = None) -> dict:
|
def os_update_job() -> dict:
|
||||||
if busy := _maintenance_busy():
|
if busy := _maintenance_busy():
|
||||||
return busy
|
return busy
|
||||||
if err := check_sudo_needs_password(sudo_password):
|
if err := check_sudo_needs_password():
|
||||||
return err
|
return err
|
||||||
# Nach dem apt-Upgrade den Stack funktional prüfen (Job wird rot, wenn etwas kaputt ging).
|
# Nach dem apt-Upgrade den Stack funktional prüfen (Job wird rot, wenn etwas kaputt ging).
|
||||||
# DEBIAN_FRONTEND wird INNERHALB von `sudo bash -c` gesetzt (nicht als `sudo VAR=… cmd`) —
|
# DEBIAN_FRONTEND wird INNERHALB von `sudo bash -c` gesetzt (nicht als `sudo VAR=… cmd`) —
|
||||||
@@ -648,11 +648,11 @@ def os_update_job(sudo_password: str | None = None) -> dict:
|
|||||||
"sudo bash -c 'DEBIAN_FRONTEND=noninteractive apt-get upgrade -y' "
|
"sudo bash -c 'DEBIAN_FRONTEND=noninteractive apt-get upgrade -y' "
|
||||||
f"&& bash {STACK_POSTCHECK}")
|
f"&& bash {STACK_POSTCHECK}")
|
||||||
job_id = jobengine.start_job(["bash", "-c", cmd], "OS-Update (apt)",
|
job_id = jobengine.start_job(["bash", "-c", cmd], "OS-Update (apt)",
|
||||||
group="maintenance", sudo_password=sudo_password)
|
group="maintenance")
|
||||||
return {"ok": True, "job_id": job_id}
|
return {"ok": True, "job_id": job_id}
|
||||||
|
|
||||||
|
|
||||||
def engine_update_job(sudo_password: str | None = None) -> dict | None:
|
def engine_update_job() -> dict | None:
|
||||||
if not ENGINE_UPDATE_CMD:
|
if not ENGINE_UPDATE_CMD:
|
||||||
return None
|
return None
|
||||||
if busy := _maintenance_busy():
|
if busy := _maintenance_busy():
|
||||||
@@ -673,7 +673,7 @@ def engine_update_job(sudo_password: str | None = None) -> dict | None:
|
|||||||
return {"ok": True, "job_id": job_id}
|
return {"ok": True, "job_id": job_id}
|
||||||
|
|
||||||
|
|
||||||
def swap_update_job(sudo_password: str | None = None) -> dict | None:
|
def swap_update_job() -> dict | None:
|
||||||
if not SWAP_UPDATE_CMD:
|
if not SWAP_UPDATE_CMD:
|
||||||
return None
|
return None
|
||||||
if busy := _maintenance_busy():
|
if busy := _maintenance_busy():
|
||||||
@@ -717,10 +717,15 @@ def _hermes_update_cmd() -> str:
|
|||||||
# grün sein. Früher schluckte das `;` vor dem Neustart jeden Update-Fehler: Job rc=0,
|
# grün sein. Früher schluckte das `;` vor dem Neustart jeden Update-Fehler: Job rc=0,
|
||||||
# Badge blieb, User sah „done aber nichts passiert" (Update scheiterte real an einem
|
# Badge blieb, User sah „done aber nichts passiert" (Update scheiterte real an einem
|
||||||
# verwaisten .git/index.lock). Jetzt: RC festhalten, Dienste immer starten, RC melden.
|
# verwaisten .git/index.lock). Jetzt: RC festhalten, Dienste immer starten, RC melden.
|
||||||
|
# --no-gateway-restart (17.09.2026): `hermes update` startet das Gateway sonst selbst neu und
|
||||||
|
# endet mit Exit 1, wenn sein Fleet-Check danach keine Zeilen sieht (#93406) — unter systemd
|
||||||
|
# bei uns der Normalfall. Die &&-Kette brach ab (kein doctor, kein /hermes-ui/-Build), der
|
||||||
|
# Job war rot, autoupdate.sh rollte zurück und pinnte — bei GRÜNEM Gehirn-Check (06./17.09.).
|
||||||
|
# Der Neustart passiert unten ohnehin; Richter bleibt der Postcheck.
|
||||||
return ("RC=0; "
|
return ("RC=0; "
|
||||||
f"bash {backup} || true; "
|
f"bash {backup} || true; "
|
||||||
f"systemctl --user stop hermes-builtin-ui || true; "
|
f"systemctl --user stop hermes-builtin-ui || true; "
|
||||||
f"{{ cd {path} && {py} -m hermes_cli.main update --yes "
|
f"{{ cd {path} && {py} -m hermes_cli.main update --yes --no-gateway-restart "
|
||||||
f"&& {py} -m hermes_cli.main doctor "
|
f"&& {py} -m hermes_cli.main doctor "
|
||||||
f"&& {build_cmd}; }} || RC=1; "
|
f"&& {build_cmd}; }} || RC=1; "
|
||||||
f"systemctl --user reset-failed hermes-builtin-ui 2>/dev/null; "
|
f"systemctl --user reset-failed hermes-builtin-ui 2>/dev/null; "
|
||||||
@@ -745,12 +750,12 @@ def hermes_update_job() -> dict:
|
|||||||
return {"ok": True, "job_id": job_id}
|
return {"ok": True, "job_id": job_id}
|
||||||
|
|
||||||
|
|
||||||
def update_all_job(sudo_password: str | None = None) -> dict:
|
def update_all_job() -> dict:
|
||||||
"""„Alle aktualisieren": kettet die AUSSTEHENDEN Updates sequenziell in EINEM Job —
|
"""„Alle aktualisieren": kettet die AUSSTEHENDEN Updates sequenziell in EINEM Job —
|
||||||
Engine → Router → Hermes → OS. Bewusst nur Wiederverwendung: jeder Teil ist exakt der
|
Engine → Router → Hermes → OS. Bewusst nur Wiederverwendung: jeder Teil ist exakt der
|
||||||
Befehl des Einzel-Updates (mit eigenem Backup/Postcheck/Rollback). `&&`-Kette = bei
|
Befehl des Einzel-Updates (mit eigenem Backup/Postcheck/Rollback). `&&`-Kette = bei
|
||||||
Fehler stoppt der Rest (das Log zeigt, wo). OS zuletzt, weil apt am breitesten eingreift;
|
Fehler stoppt der Rest (das Log zeigt, wo). OS zuletzt, weil apt am breitesten eingreift;
|
||||||
es braucht als einziges das Box-Passwort — fehlt es, laufen die sudo-freien Teile trotzdem."""
|
es ist das einzige mit sudo — scheitert das, laufen die sudo-freien Teile trotzdem."""
|
||||||
if busy := _maintenance_busy():
|
if busy := _maintenance_busy():
|
||||||
return busy
|
return busy
|
||||||
upd = updates()
|
upd = updates()
|
||||||
@@ -763,9 +768,10 @@ def update_all_job(sudo_password: str | None = None) -> dict:
|
|||||||
parts.append(("Hermes-Agent", _hermes_update_cmd()))
|
parts.append(("Hermes-Agent", _hermes_update_cmd()))
|
||||||
os_pending = (upd.get("os") or 0) > 0
|
os_pending = (upd.get("os") or 0) > 0
|
||||||
if os_pending:
|
if os_pending:
|
||||||
if err := check_sudo_needs_password(sudo_password):
|
if err := check_sudo_needs_password():
|
||||||
# Ohne Passwort: OS auslassen statt alles zu blockieren — aber nur, wenn
|
# sudo verlangt wider Erwarten ein Passwort (sudoers geaendert?): OS auslassen
|
||||||
# es überhaupt sudo-freie Teile gibt; sonst ehrlich das Passwort verlangen.
|
# statt alles zu blockieren — aber nur, wenn es sudo-freie Teile gibt; sonst
|
||||||
|
# den Fehler ehrlich durchreichen.
|
||||||
if not parts:
|
if not parts:
|
||||||
return err
|
return err
|
||||||
os_pending = False
|
os_pending = False
|
||||||
@@ -790,12 +796,11 @@ def update_all_job(sudo_password: str | None = None) -> dict:
|
|||||||
|
|
||||||
labels = " → ".join(label for label, _ in parts)
|
labels = " → ".join(label for label, _ in parts)
|
||||||
job_id = jobengine.start_job(["bash", "-c", cmd], f"Alle aktualisieren ({labels})",
|
job_id = jobengine.start_job(["bash", "-c", cmd], f"Alle aktualisieren ({labels})",
|
||||||
group="maintenance", on_done=on_done,
|
group="maintenance", on_done=on_done)
|
||||||
sudo_password=sudo_password)
|
|
||||||
return {"ok": True, "job_id": job_id, "parts": [label for label, _ in parts]}
|
return {"ok": True, "job_id": job_id, "parts": [label for label, _ in parts]}
|
||||||
|
|
||||||
|
|
||||||
def reboot(sudo_password: str | None = None) -> dict:
|
def reboot() -> dict:
|
||||||
if err := check_sudo_needs_password(sudo_password):
|
if err := check_sudo_needs_password():
|
||||||
return err
|
return err
|
||||||
return _run(["sudo", "reboot"], sudo_password=sudo_password)
|
return _run(["sudo", "reboot"])
|
||||||
|
|||||||
@@ -1,177 +0,0 @@
|
|||||||
"""
|
|
||||||
Geteiltes Gedächtnis (die „Verfassung") — jetzt auto-lernend & semantisch über Mem0.
|
|
||||||
|
|
||||||
Dieser Service ist nur noch ein dünner HTTP-Client auf den Mem0-Sidecar (mem0_service/app.py,
|
|
||||||
läuft im ~/.mem0/venv unter Python 3.12). Die `/api/memory`-API-Form bleibt unverändert, damit
|
|
||||||
UI und MCP-Server kompatibel bleiben. Neu gegenüber der alten flachen SQLite:
|
|
||||||
|
|
||||||
- search (q gesetzt) ist SEMANTISCH (Vektor/Embeddings) statt LIKE-Textsuche, mit Relevanz-Score.
|
|
||||||
- learn() reicht Gesprächs-Turns durch → Mem0 EXTRAHIERT Fakten selbst (Auto-Lernen).
|
|
||||||
- Dedup macht Mem0 beim Auto-Lernen selbst; der manuelle Kurator unten bleibt als Komfort.
|
|
||||||
|
|
||||||
5 Kategorien (user · instruction · stable · versioned · ephemeral) bleiben als Metadaten erhalten.
|
|
||||||
"""
|
|
||||||
|
|
||||||
import asyncio
|
|
||||||
import logging
|
|
||||||
import os
|
|
||||||
import re
|
|
||||||
from difflib import SequenceMatcher
|
|
||||||
|
|
||||||
import httpx
|
|
||||||
|
|
||||||
from config import MEM0_SERVICE_URL
|
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
|
||||||
|
|
||||||
CATEGORIES = ("identity", "knowledge", "rules", "events")
|
|
||||||
|
|
||||||
_TIMEOUT = httpx.Timeout(60.0, connect=5.0) # LLM-Extraktion kann ein paar Sekunden dauern
|
|
||||||
|
|
||||||
|
|
||||||
def _get(path: str, **params) -> list | dict:
|
|
||||||
r = httpx.get(f"{MEM0_SERVICE_URL}{path}", params=params, timeout=_TIMEOUT)
|
|
||||||
r.raise_for_status()
|
|
||||||
return r.json()
|
|
||||||
|
|
||||||
|
|
||||||
def _post(path: str, data: dict) -> dict:
|
|
||||||
r = httpx.post(f"{MEM0_SERVICE_URL}{path}", json=data, timeout=_TIMEOUT)
|
|
||||||
r.raise_for_status()
|
|
||||||
return r.json()
|
|
||||||
|
|
||||||
|
|
||||||
def _put(path: str, data: dict) -> dict:
|
|
||||||
r = httpx.put(f"{MEM0_SERVICE_URL}{path}", json=data, timeout=_TIMEOUT)
|
|
||||||
r.raise_for_status()
|
|
||||||
return r.json()
|
|
||||||
|
|
||||||
|
|
||||||
def _delete(path: str) -> dict:
|
|
||||||
r = httpx.delete(f"{MEM0_SERVICE_URL}{path}", timeout=_TIMEOUT)
|
|
||||||
r.raise_for_status()
|
|
||||||
return r.json()
|
|
||||||
|
|
||||||
|
|
||||||
def list_memories(q: str = "", category: str = "") -> list[dict]:
|
|
||||||
"""Alle Fakten oder — wenn q gesetzt — die semantisch ähnlichsten (mit `score`)."""
|
|
||||||
return _get("/memory", **{k: v for k, v in (("q", q), ("category", category)) if v})
|
|
||||||
|
|
||||||
|
|
||||||
def add_memory(content: str, category: str = "stable", source: str = "manual") -> dict:
|
|
||||||
"""Einen Fakt VERBATIM speichern (keine LLM-Umformung). Auto-Lernen → learn()."""
|
|
||||||
return _post("/memory", {"content": content.strip(), "category": category, "source": source})
|
|
||||||
|
|
||||||
|
|
||||||
def update_memory(mid: str, content: str | None = None, category: str | None = None) -> dict | None:
|
|
||||||
try:
|
|
||||||
return _put(f"/memory/{mid}", {"content": content, "category": category})
|
|
||||||
except httpx.HTTPStatusError as exc:
|
|
||||||
if exc.response.status_code == 404:
|
|
||||||
return None
|
|
||||||
raise
|
|
||||||
|
|
||||||
|
|
||||||
def delete_memory(mid: str) -> bool:
|
|
||||||
try:
|
|
||||||
_delete(f"/memory/{mid}")
|
|
||||||
return True
|
|
||||||
except httpx.HTTPStatusError as exc:
|
|
||||||
if exc.response.status_code == 404:
|
|
||||||
return False
|
|
||||||
raise
|
|
||||||
|
|
||||||
|
|
||||||
def learn(text: str | None = None, messages: list[dict] | None = None,
|
|
||||||
source: str = "auto", category: str = "stable") -> dict:
|
|
||||||
"""Auto-Lernen: Text/Gesprächs-Turns durchreichen → Mem0 extrahiert die Fakten selbst."""
|
|
||||||
return _post("/learn", {"text": text, "messages": messages,
|
|
||||||
"source": source, "category": category})
|
|
||||||
|
|
||||||
|
|
||||||
def graph(min_score: float = 0.45, top_k: int = 3) -> dict:
|
|
||||||
"""Fakten als Ähnlichkeits-Graph (Knoten + semantische Kanten) für die UI-Visualisierung."""
|
|
||||||
return _get("/graph", min_score=min_score, top_k=top_k)
|
|
||||||
|
|
||||||
|
|
||||||
def export_text() -> dict:
|
|
||||||
rows = sorted(list_memories(), key=lambda r: (r.get("category", ""), r.get("updated_at", "")))
|
|
||||||
lines = ["# Mission Control — Gedächtnis\n"]
|
|
||||||
current = ""
|
|
||||||
for r in rows:
|
|
||||||
if r.get("category") != current:
|
|
||||||
current = r.get("category", "")
|
|
||||||
lines.append(f"\n## {current}\n")
|
|
||||||
src = r.get("source", "")
|
|
||||||
when = (r.get("updated_at") or "")[:10]
|
|
||||||
lines.append(f"- {r.get('content', '')} _(Quelle: {src}, {when})_")
|
|
||||||
return {"text": "\n".join(lines), "count": len(rows)}
|
|
||||||
|
|
||||||
|
|
||||||
# --- Manueller Kurator (deterministisch, kein LLM) ---------------------------
|
|
||||||
def _norm(s: str) -> str:
|
|
||||||
s = re.sub(r"[^\w\s]", " ", s.lower(), flags=re.UNICODE)
|
|
||||||
return re.sub(r"\s+", " ", s).strip()
|
|
||||||
|
|
||||||
|
|
||||||
def dedupe(apply: bool = False, threshold: float = 0.85) -> dict:
|
|
||||||
"""Findet Dubletten (exakt/enthalten/ähnlich) je Kategorie, behält den längsten
|
|
||||||
Eintrag. Mem0 dedupliziert beim Auto-Lernen schon semantisch — das hier ist der
|
|
||||||
manuelle Komfort-Knopf fürs UI (z.B. nach vielen Verbatim-Importen)."""
|
|
||||||
rows = sorted(list_memories(), key=lambda r: (-len(r.get("content", "")), r.get("created_at", "")))
|
|
||||||
used: set[str] = set()
|
|
||||||
groups: list[dict] = []
|
|
||||||
for i, a in enumerate(rows):
|
|
||||||
if a["id"] in used:
|
|
||||||
continue
|
|
||||||
na = _norm(a.get("content", ""))
|
|
||||||
if not na:
|
|
||||||
continue
|
|
||||||
dups = []
|
|
||||||
for b in rows[i + 1:]:
|
|
||||||
if b["id"] in used or b.get("category") != a.get("category"):
|
|
||||||
continue
|
|
||||||
nb = _norm(b.get("content", ""))
|
|
||||||
if not nb:
|
|
||||||
continue
|
|
||||||
if nb in na or na in nb or SequenceMatcher(None, na, nb).ratio() >= threshold:
|
|
||||||
dups.append(b); used.add(b["id"])
|
|
||||||
if dups:
|
|
||||||
used.add(a["id"])
|
|
||||||
groups.append({
|
|
||||||
"keep": {"id": a["id"], "content": a.get("content"), "category": a.get("category")},
|
|
||||||
"remove": [{"id": d["id"], "content": d.get("content")} for d in dups],
|
|
||||||
})
|
|
||||||
dup_count = sum(len(g["remove"]) for g in groups)
|
|
||||||
removed = 0
|
|
||||||
if apply:
|
|
||||||
for g in groups:
|
|
||||||
for d in g["remove"]:
|
|
||||||
if delete_memory(d["id"]):
|
|
||||||
removed += 1
|
|
||||||
return {"groups": groups, "duplicate_count": dup_count, "removed": removed, "applied": apply}
|
|
||||||
|
|
||||||
|
|
||||||
# ── Auto-Dedupe (D16e): Dubletten von selbst wegräumen, kein Knopf-Zwang ─────────────
|
|
||||||
# Deterministisch in UNSERER Schicht (wie reminders, Verdikt 11c) statt am Hermes-cron —
|
|
||||||
# läuft als Hintergrund-Task. Höhere Schwelle als der manuelle Knopf (0.9 statt 0.85), weil
|
|
||||||
# OHNE Mensch-Review angewandt wird: lieber eine Dublette stehen lassen als etwas Distinktes
|
|
||||||
# löschen. Mem0 dedupliziert beim Auto-Lernen schon semantisch — das hier fängt den Rest
|
|
||||||
# (Verbatim-Importe, wiederholte Fakten) ab, damit das Gedächtnis nicht ohne Zutun aufbläht.
|
|
||||||
AUTO_DEDUPE_ENABLED = os.environ.get("MC_MEM_DEDUPE_ENABLED", "1") != "0"
|
|
||||||
AUTO_DEDUPE_INTERVAL = int(os.environ.get("MC_MEM_DEDUPE_INTERVAL", str(24 * 3600))) # täglich
|
|
||||||
AUTO_DEDUPE_START_DELAY = int(os.environ.get("MC_MEM_DEDUPE_START_DELAY", "300")) # 5 min nach Start
|
|
||||||
AUTO_DEDUPE_THRESHOLD = float(os.environ.get("MC_MEM_DEDUPE_THRESHOLD", "0.75"))
|
|
||||||
|
|
||||||
|
|
||||||
async def auto_dedupe_loop() -> None:
|
|
||||||
"""Hintergrund-Task: räumt periodisch Gedächtnis-Dubletten weg (apply=True)."""
|
|
||||||
await asyncio.sleep(AUTO_DEDUPE_START_DELAY) # Mem0-Sidecar nach Start hochkommen lassen
|
|
||||||
while True:
|
|
||||||
try:
|
|
||||||
res = await asyncio.to_thread(dedupe, True, AUTO_DEDUPE_THRESHOLD) # sync HTTP → Thread
|
|
||||||
if res.get("removed"):
|
|
||||||
log.info("mem-dedupe: %d Dublette(n) automatisch entfernt", res["removed"])
|
|
||||||
except Exception:
|
|
||||||
log.debug("mem-dedupe: Lauf fehlgeschlagen", exc_info=True)
|
|
||||||
await asyncio.sleep(AUTO_DEDUPE_INTERVAL)
|
|
||||||
@@ -51,7 +51,7 @@ def _load() -> None:
|
|||||||
log.info("metrics_history: %d Punkte aus %s geladen", len(_points), HISTORY_PATH)
|
log.info("metrics_history: %d Punkte aus %s geladen", len(_points), HISTORY_PATH)
|
||||||
except FileNotFoundError:
|
except FileNotFoundError:
|
||||||
pass
|
pass
|
||||||
except Exception: # noqa: BLE001 — kaputte Datei = leer starten, nie crashen
|
except Exception:
|
||||||
log.warning("metrics_history: %s nicht lesbar — starte leer", HISTORY_PATH, exc_info=True)
|
log.warning("metrics_history: %s nicht lesbar — starte leer", HISTORY_PATH, exc_info=True)
|
||||||
|
|
||||||
|
|
||||||
@@ -77,19 +77,19 @@ def _sample() -> None:
|
|||||||
try:
|
try:
|
||||||
du = psutil.disk_usage(str(MODELS_DIR) if MODELS_DIR.exists() else os.getcwd())
|
du = psutil.disk_usage(str(MODELS_DIR) if MODELS_DIR.exists() else os.getcwd())
|
||||||
disk = du.percent
|
disk = du.percent
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
gpu = None
|
gpu = None
|
||||||
try:
|
try:
|
||||||
g = _gpu_sysfs()
|
g = _gpu_sysfs()
|
||||||
gpu = g.get("busy_percent") if g else None
|
gpu = g.get("busy_percent") if g else None
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
tp = tc = None
|
tp = tc = None
|
||||||
try:
|
try:
|
||||||
ts = get_stats()
|
ts = get_stats()
|
||||||
tp, tc = ts.get("prompt_tokens"), ts.get("completion_tokens")
|
tp, tc = ts.get("prompt_tokens"), ts.get("completion_tokens")
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
# interval=None: nicht-blockierende CPU-Messung seit dem letzten Aufruf (10 s her — ideal).
|
# interval=None: nicht-blockierende CPU-Messung seit dem letzten Aufruf (10 s her — ideal).
|
||||||
_points.append([int(time.time()), psutil.cpu_percent(interval=None), vm.percent, gpu, disk, tp, tc])
|
_points.append([int(time.time()), psutil.cpu_percent(interval=None), vm.percent, gpu, disk, tp, tc])
|
||||||
@@ -101,12 +101,12 @@ async def sampler_loop() -> None:
|
|||||||
while True:
|
while True:
|
||||||
try:
|
try:
|
||||||
await asyncio.to_thread(_sample)
|
await asyncio.to_thread(_sample)
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
log.debug("metrics_history: Sample fehlgeschlagen", exc_info=True)
|
log.debug("metrics_history: Sample fehlgeschlagen", exc_info=True)
|
||||||
if time.time() - _last_flush >= FLUSH_S:
|
if time.time() - _last_flush >= FLUSH_S:
|
||||||
try:
|
try:
|
||||||
await asyncio.to_thread(_flush)
|
await asyncio.to_thread(_flush)
|
||||||
except Exception: # noqa: BLE001
|
except Exception:
|
||||||
pass
|
pass
|
||||||
await asyncio.sleep(SAMPLE_S)
|
await asyncio.sleep(SAMPLE_S)
|
||||||
|
|
||||||
|
|||||||
@@ -24,6 +24,7 @@ from pathlib import Path
|
|||||||
from zoneinfo import ZoneInfo
|
from zoneinfo import ZoneInfo
|
||||||
|
|
||||||
from config import MODELS_DIR
|
from config import MODELS_DIR
|
||||||
|
|
||||||
from services import announce
|
from services import announce
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
|
|||||||
@@ -3,7 +3,7 @@ Lane-Routing für den eingebauten MC2-Gateway (:9001/v1).
|
|||||||
|
|
||||||
Zwei virtuelle Lanes, die Clients/IDEs auswählen — der Router pickt das echte Modell:
|
Zwei virtuelle Lanes, die Clients/IDEs auswählen — der Router pickt das echte Modell:
|
||||||
- **chat** (= altes `auto`): Alltag → `fast`, schwer/lang → `heavy`.
|
- **chat** (= altes `auto`): Alltag → `fast`, schwer/lang → `heavy`.
|
||||||
- **coding**: Code-Arbeit → `coder` (Qwen3-Coder-Next); riesiger/architektonischer Kontext → `heavy`;
|
- **coding**: Code-Arbeit → `coder`; riesiger/architektonischer Kontext → `heavy`;
|
||||||
triviale Kurzfrage ohne Code → `fast` (Tempo).
|
triviale Kurzfrage ohne Code → `fast` (Tempo).
|
||||||
|
|
||||||
Regelbasiert, sub-ms, ohne Cloud. Schwellen/Aliases liegen in einer UI-editierbaren Policy
|
Regelbasiert, sub-ms, ohne Cloud. Schwellen/Aliases liegen in einer UI-editierbaren Policy
|
||||||
|
|||||||
+19
-10
@@ -1,7 +1,7 @@
|
|||||||
"""
|
"""
|
||||||
Health-Wächter der Box (Lucy-Proaktivität, Faden A3).
|
Health-Wächter der Box (Lucy-Proaktivität, Faden A3).
|
||||||
|
|
||||||
Prüft periodisch die Kern-Dienste (Engine, Agent-Hirn, Hermes-Gateway, Mem0,
|
Prüft periodisch die Kern-Dienste (Engine, Agent-Hirn, Hermes-Gateway,
|
||||||
Voice-Sidecar, Platte) und meldet ZUSTANDSWECHSEL in den Melde-Briefkasten
|
Voice-Sidecar, Platte) und meldet ZUSTANDSWECHSEL in den Melde-Briefkasten
|
||||||
(services/announce.py → Lucy spricht es) und via notify.sh (Telegram).
|
(services/announce.py → Lucy spricht es) und via notify.sh (Telegram).
|
||||||
|
|
||||||
@@ -20,8 +20,8 @@ import time
|
|||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
import psutil
|
import psutil
|
||||||
|
from config import HERMES_API_KEY, HERMES_API_URL, MODELS_DIR, VOICE_SERVICE_URL
|
||||||
|
|
||||||
from config import HERMES_API_URL, LLAMA_SWAP_URL, MEM0_SERVICE_URL, MODELS_DIR, VOICE_SERVICE_URL
|
|
||||||
from services import announce, llamaswap
|
from services import announce, llamaswap
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
@@ -34,14 +34,26 @@ REMIND_S = int(os.environ.get("MC_SENTRY_REMIND_S", "21600")) # Erinnerung
|
|||||||
DISK_ALARM_PCT = float(os.environ.get("MC_SENTRY_DISK_PCT", "90"))
|
DISK_ALARM_PCT = float(os.environ.get("MC_SENTRY_DISK_PCT", "90"))
|
||||||
|
|
||||||
|
|
||||||
def _reach(url: str, path: str = "/health") -> bool:
|
def _reach(url: str, path: str = "/health", headers: dict[str, str] | None = None) -> bool:
|
||||||
|
"""Antwortet der Dienst ueberhaupt? `< 500` ist bewusst nachsichtig: Die Frage ist
|
||||||
|
"laeuft er", nicht "darf ich rein" — ein 401 beweist, dass jemand zuhoert.
|
||||||
|
|
||||||
|
`headers` gibt es seit dem 28.08.2026: Die Hermes-Probe schlug ohne API-Schluessel an
|
||||||
|
und erzeugte dabei 720 `rejected invalid API key`-Warnungen pro Tag in dessen Log
|
||||||
|
(gemessen: 30/Stunde seit dem 27.08. 15:05). Das Urteil war richtig, der Laerm nicht —
|
||||||
|
und er haette einen echten Auth-Fehler unter sich begraben."""
|
||||||
try:
|
try:
|
||||||
with httpx.Client(timeout=5.0) as c:
|
with httpx.Client(timeout=5.0) as c:
|
||||||
return c.get(f"{url}{path}").status_code < 500
|
return c.get(f"{url}{path}", headers=headers or {}).status_code < 500
|
||||||
except Exception:
|
except Exception:
|
||||||
return False
|
return False
|
||||||
|
|
||||||
|
|
||||||
|
def _hermes_kopf() -> dict[str, str]:
|
||||||
|
"""Bearer-Kopf fuer die Hermes-Platform, falls ein Schluessel konfiguriert ist."""
|
||||||
|
return {"Authorization": f"Bearer {HERMES_API_KEY}"} if HERMES_API_KEY else {}
|
||||||
|
|
||||||
|
|
||||||
def _check_engine() -> bool:
|
def _check_engine() -> bool:
|
||||||
return llamaswap.engine_reachable()
|
return llamaswap.engine_reachable()
|
||||||
|
|
||||||
@@ -70,12 +82,9 @@ CHECKS: dict[str, tuple] = {
|
|||||||
"brain": (_check_brain,
|
"brain": (_check_brain,
|
||||||
"Mein Gehirn lädt nicht — ich kann gerade nicht richtig denken. Ein Neustart der Engine könnte helfen.",
|
"Mein Gehirn lädt nicht — ich kann gerade nicht richtig denken. Ein Neustart der Engine könnte helfen.",
|
||||||
"Mein Gehirn ist wieder geladen. Alles klar bei mir."),
|
"Mein Gehirn ist wieder geladen. Alles klar bei mir."),
|
||||||
"hermes": (lambda: _reach(HERMES_API_URL),
|
"hermes": (lambda: _reach(HERMES_API_URL, "/v1/models", _hermes_kopf()),
|
||||||
"Der Agent-Dienst ist ausgefallen — Telegram und meine Tools gehen gerade nicht.",
|
"Der Agent-Dienst ist ausgefallen — Telegram und meine Tools gehen gerade nicht.",
|
||||||
"Der Agent-Dienst läuft wieder."),
|
"Der Agent-Dienst läuft wieder."),
|
||||||
"mem0": (lambda: _reach(MEM0_SERVICE_URL),
|
|
||||||
"Mein Gedächtnis-Dienst ist ausgefallen — ich merke mir vorübergehend nichts Neues.",
|
|
||||||
"Mein Gedächtnis ist wieder online."),
|
|
||||||
"voice": (lambda: _reach(VOICE_SERVICE_URL),
|
"voice": (lambda: _reach(VOICE_SERVICE_URL),
|
||||||
"Der Hör-Dienst auf der Box ist ausgefallen — Spracheingabe könnte haken.",
|
"Der Hör-Dienst auf der Box ist ausgefallen — Spracheingabe könnte haken.",
|
||||||
"Der Hör-Dienst läuft wieder."),
|
"Der Hör-Dienst läuft wieder."),
|
||||||
@@ -92,7 +101,7 @@ if os.environ.get("MC_SENTRY_WATCH_MC2", "") == "1":
|
|||||||
_MC2_URL = os.environ.get("MC_SENTRY_MC2_URL", "http://127.0.0.1:9001")
|
_MC2_URL = os.environ.get("MC_SENTRY_MC2_URL", "http://127.0.0.1:9001")
|
||||||
_GW_URL = os.environ.get("MC_SENTRY_GATEWAY_URL", "http://127.0.0.1:9010")
|
_GW_URL = os.environ.get("MC_SENTRY_GATEWAY_URL", "http://127.0.0.1:9010")
|
||||||
CHECKS["mc2"] = (lambda: _reach(_MC2_URL, "/api/health"),
|
CHECKS["mc2"] = (lambda: _reach(_MC2_URL, "/api/health"),
|
||||||
"Das Steuerpult ist ausgefallen — Dashboard, Briefkasten und Auftragsbuch gehen gerade nicht.",
|
"Das Steuerpult ist ausgefallen — Dashboard und Briefkasten gehen gerade nicht.",
|
||||||
"Das Steuerpult ist wieder da.")
|
"Das Steuerpult ist wieder da.")
|
||||||
CHECKS["gateway"] = (lambda: _reach(_GW_URL, "/gw/health"),
|
CHECKS["gateway"] = (lambda: _reach(_GW_URL, "/gw/health"),
|
||||||
"Der Modell-Gateway ist ausgefallen — meine Denk-Anfragen und die der Worker hängen gerade.",
|
"Der Modell-Gateway ist ausgefallen — meine Denk-Anfragen und die der Worker hängen gerade.",
|
||||||
@@ -100,7 +109,7 @@ if os.environ.get("MC_SENTRY_WATCH_MC2", "") == "1":
|
|||||||
|
|
||||||
|
|
||||||
class _Watch:
|
class _Watch:
|
||||||
__slots__ = ("fails", "alerted", "alert_ts")
|
__slots__ = ("alert_ts", "alerted", "fails")
|
||||||
|
|
||||||
def __init__(self) -> None:
|
def __init__(self) -> None:
|
||||||
self.fails = 0 # Fehl-Ticks in Folge
|
self.fails = 0 # Fehl-Ticks in Folge
|
||||||
|
|||||||
@@ -10,9 +10,9 @@ import glob
|
|||||||
import os
|
import os
|
||||||
import subprocess
|
import subprocess
|
||||||
import threading
|
import threading
|
||||||
|
import time
|
||||||
|
|
||||||
import psutil
|
import psutil
|
||||||
|
|
||||||
from config import MODELS_DIR
|
from config import MODELS_DIR
|
||||||
|
|
||||||
|
|
||||||
@@ -198,5 +198,59 @@ def system_status() -> dict:
|
|||||||
"gpu": _gpu_sysfs(),
|
"gpu": _gpu_sysfs(),
|
||||||
"temp": _temps(),
|
"temp": _temps(),
|
||||||
"disk": disk,
|
"disk": disk,
|
||||||
|
# Betriebszeit in Sekunden (v3-Umbau P3). Gehoert in die neue Statusleiste, weil
|
||||||
|
# sich die Box woechentlich selbst neu startet, wenn das OS es verlangt — dann ist
|
||||||
|
# "laeuft seit 20 Minuten" die Antwort auf eine ganze Klasse von Fragen.
|
||||||
|
"uptime_s": _uptime_s(),
|
||||||
"versions": check_versions_cached(),
|
"versions": check_versions_cached(),
|
||||||
}
|
}
|
||||||
|
|
||||||
|
|
||||||
|
def metrik_punkt() -> dict:
|
||||||
|
"""Leichter Messpunkt fuer den Ereignisstrom (v3-Umbau P4) — EINMAL pro Sekunde.
|
||||||
|
|
||||||
|
Bewusst NICHT `system_status()`: das ruft `psutil.cpu_percent(interval=0.1)` und
|
||||||
|
blockiert damit den Event-Loop 100 ms je Aufruf (bei 1-s-Takt also 10 % der Zeit),
|
||||||
|
und es haengt den Versions-Check dran, den niemand sekuendlich braucht.
|
||||||
|
|
||||||
|
`interval=None` misst gegen den VORIGEN Aufruf statt zu warten — genau richtig fuer
|
||||||
|
einen festen Takt. Der allererste Wert ist 0.0; das faellt bei 1 s nicht auf.
|
||||||
|
|
||||||
|
Token stehen hier als GESAMTZAEHLER, nicht als Rate: Der Klient rechnet die Rate aus
|
||||||
|
zwei Punkten selbst. So bleibt der Server zustandslos und ein verpasster Punkt
|
||||||
|
verfaelscht nichts."""
|
||||||
|
vm = psutil.virtual_memory()
|
||||||
|
temp = _temps() or {}
|
||||||
|
gpu = _gpu_sysfs() or {}
|
||||||
|
try:
|
||||||
|
from services.token_stats import get_stats
|
||||||
|
tok = get_stats()
|
||||||
|
except Exception:
|
||||||
|
tok = {}
|
||||||
|
try:
|
||||||
|
du = psutil.disk_usage(str(MODELS_DIR) if MODELS_DIR.exists() else os.getcwd())
|
||||||
|
disk = du.percent
|
||||||
|
except Exception:
|
||||||
|
disk = None
|
||||||
|
return {
|
||||||
|
"cpu": psutil.cpu_percent(interval=None),
|
||||||
|
"ram": vm.percent,
|
||||||
|
"ram_used": vm.used,
|
||||||
|
"ram_total": vm.total,
|
||||||
|
"gpu": gpu.get("busy_percent"),
|
||||||
|
"disk": disk,
|
||||||
|
"temp_cpu": temp.get("cpu"),
|
||||||
|
"temp_gpu": temp.get("gpu"),
|
||||||
|
"uptime_s": _uptime_s(),
|
||||||
|
"tok_p": tok.get("prompt_tokens", 0),
|
||||||
|
"tok_c": tok.get("completion_tokens", 0),
|
||||||
|
}
|
||||||
|
|
||||||
|
|
||||||
|
def _uptime_s() -> int | None:
|
||||||
|
"""Sekunden seit dem Systemstart. None statt einer Ausrede, wenn psutil hier nichts
|
||||||
|
liefert — eine erfundene Zahl waere schlimmer als eine fehlende."""
|
||||||
|
try:
|
||||||
|
return int(time.time() - psutil.boot_time())
|
||||||
|
except Exception:
|
||||||
|
return None
|
||||||
|
|||||||
@@ -11,7 +11,6 @@ import json
|
|||||||
import logging
|
import logging
|
||||||
import threading
|
import threading
|
||||||
import time
|
import time
|
||||||
from pathlib import Path
|
|
||||||
|
|
||||||
from config import HERMES_HOME
|
from config import HERMES_HOME
|
||||||
|
|
||||||
|
|||||||
@@ -11,14 +11,14 @@ Zwei Sichten auf dieselben Messungen:
|
|||||||
|
|
||||||
**Was MC2 messen kann — und was nicht:** MC2 proxyt den Chat nur an Hermes (:8642). Die Stufen STT,
|
**Was MC2 messen kann — und was nicht:** MC2 proxyt den Chat nur an Hermes (:8642). Die Stufen STT,
|
||||||
Vision, Hirn-TTFT (Zeit bis zum ersten Inhalts-Token) und Generierung sind hier direkt messbar. Der
|
Vision, Hirn-TTFT (Zeit bis zum ersten Inhalts-Token) und Generierung sind hier direkt messbar. Der
|
||||||
**Mem0-Retrieve** läuft zwar in Hermes, ruft aber MC2s `/api/memory` per HTTP zurück → messbar und als
|
**Gedächtnis-Abruf** dagegen läuft seit der Ablösung des Sidecars (07.08.2026) Hermes-intern — es
|
||||||
Unter-Detail INNERHALB der Hirn-Zeit ausgewiesen (kein Doppelzählen). Die **Tool-Runden** dagegen laufen
|
gibt keinen Rückruf an MC2 mehr, also auch keine Messung; er steckt jetzt in der Hirn-Zeit. Ebenso die
|
||||||
im Hermes-LLM-Loop ohne Callback an MC2 → für MC2 unsichtbar, sie stecken im „Generierung"-Bucket.
|
**Tool-Runden**: im Hermes-LLM-Loop ohne Callback an MC2 → unsichtbar, im „Generierung"-Bucket.
|
||||||
|
|
||||||
STT (davor) und Mem0-Retrieve (währenddessen) sind separate HTTP-Requests ohne Turn-ID. Auf einem
|
STT läuft als eigener HTTP-Request VOR dem Turn, ohne Turn-ID. Auf einem EIN-Nutzer-Gerät genügt eine
|
||||||
EIN-Nutzer-Gerät genügt eine schlanke Best-Effort-Korrelation: die zuletzt gemessene STT-Dauer bzw. der
|
schlanke Best-Effort-Korrelation: die zuletzt gemessene STT-Dauer wird global „geparkt" und vom
|
||||||
letzte Retrieve werden global „geparkt" und vom nächsten Chat-Turn eingesammelt (mit Frist-/Reihenfolge-
|
nächsten Chat-Turn eingesammelt (mit Frist-Check). Kein Turn-ID-Durchreichen durch den Lucy-Client
|
||||||
Check). Kein Turn-ID-Durchreichen durch den Lucy-Client nötig.
|
nötig.
|
||||||
|
|
||||||
In-Memory + thread-safe (keine Datei-I/O — Latenz-Telemetrie ist transient, Restart = Reset).
|
In-Memory + thread-safe (keine Datei-I/O — Latenz-Telemetrie ist transient, Restart = Reset).
|
||||||
"""
|
"""
|
||||||
@@ -34,11 +34,11 @@ _STAGES: dict[str, deque] = {}
|
|||||||
_TURNS: deque = deque(maxlen=60) # letzte N vollständige Chat-Turns (Per-Turn-Trace)
|
_TURNS: deque = deque(maxlen=60) # letzte N vollständige Chat-Turns (Per-Turn-Trace)
|
||||||
|
|
||||||
# Bekannte Stufen (für stabile UI-Reihenfolge); unbekannte werden trotzdem erfasst.
|
# Bekannte Stufen (für stabile UI-Reihenfolge); unbekannte werden trotzdem erfasst.
|
||||||
STAGES = ("stt", "vision", "memory_retrieve", "chat_ttfb", "chat_first_content", "tts")
|
STAGES = ("stt", "vision", "chat_ttfb", "chat_first_content", "tts")
|
||||||
|
|
||||||
# Best-effort-Korrelation (Ein-Nutzer-Gerät): zuletzt gemessene STT-Dauer / Mem0-Retrieve, je
|
# Best-effort-Korrelation (Ein-Nutzer-Gerät): zuletzt gemessene STT-Dauer als
|
||||||
# (ms, perf_counter-Zeitstempel). Der nächste passende Chat-Turn sammelt sie ein und leert sie.
|
# (ms, perf_counter-Zeitstempel). Der nächste Chat-Turn sammelt sie ein und leert sie.
|
||||||
_PARKED: dict[str, tuple[float, float] | None] = {"stt": None, "retrieve": None}
|
_PARKED: dict[str, tuple[float, float] | None] = {"stt": None}
|
||||||
|
|
||||||
|
|
||||||
def record_stage(stage: str, ms: float) -> None:
|
def record_stage(stage: str, ms: float) -> None:
|
||||||
@@ -53,8 +53,8 @@ def record_stage(stage: str, ms: float) -> None:
|
|||||||
|
|
||||||
|
|
||||||
def park(kind: str, ms: float) -> None:
|
def park(kind: str, ms: float) -> None:
|
||||||
"""Eine Messung, die NICHT im Chat-Request selbst passiert (STT davor, Mem0-Retrieve als
|
"""Eine Messung, die NICHT im Chat-Request selbst passiert (STT läuft davor), global parken,
|
||||||
Rückruf während), global parken, damit der nächste Chat-Turn sie einsammeln kann."""
|
damit der nächste Chat-Turn sie einsammeln kann."""
|
||||||
if ms is None or ms < 0 or kind not in _PARKED:
|
if ms is None or ms < 0 or kind not in _PARKED:
|
||||||
return
|
return
|
||||||
with _LOCK:
|
with _LOCK:
|
||||||
@@ -71,17 +71,6 @@ def _take_stt(max_age: float = 20.0) -> float | None:
|
|||||||
return None
|
return None
|
||||||
|
|
||||||
|
|
||||||
def _take_retrieve(since_perf: float, max_age: float = 90.0) -> float | None:
|
|
||||||
"""Geparkten Mem0-Retrieve einsammeln, wenn er NACH dem Turn-Start kam (Rückruf während des
|
|
||||||
Turns) und frisch ist."""
|
|
||||||
with _LOCK:
|
|
||||||
v = _PARKED.get("retrieve")
|
|
||||||
if v and v[1] >= since_perf and (time.perf_counter() - v[1]) <= max_age:
|
|
||||||
_PARKED["retrieve"] = None
|
|
||||||
return round(v[0], 1)
|
|
||||||
return None
|
|
||||||
|
|
||||||
|
|
||||||
class Timer:
|
class Timer:
|
||||||
"""Context-Manager: misst die verstrichene Zeit und verbucht sie auf `stage`.
|
"""Context-Manager: misst die verstrichene Zeit und verbucht sie auf `stage`.
|
||||||
Funktioniert um `await`-Aufrufe herum (enter → await → exit)."""
|
Funktioniert um `await`-Aufrufe herum (enter → await → exit)."""
|
||||||
@@ -102,8 +91,7 @@ class TurnTrace:
|
|||||||
"""Ein Per-Turn-Trace für den Voice/Lucy-Chatpfad. In `voice.py` über die Dauer eines Chat-Turns
|
"""Ein Per-Turn-Trace für den Voice/Lucy-Chatpfad. In `voice.py` über die Dauer eines Chat-Turns
|
||||||
gehalten; `commit()` schreibt den Datensatz in den Ringpuffer UND speist die rollenden Stats.
|
gehalten; `commit()` schreibt den Datensatz in den Ringpuffer UND speist die rollenden Stats.
|
||||||
|
|
||||||
Balken-Stufen (zeitlich DISJUNKT, ergeben zusammen den Turn): stt · vision · hirn · gen.
|
Balken-Stufen (zeitlich DISJUNKT, ergeben zusammen den Turn): stt · vision · hirn · gen."""
|
||||||
Unter-Detail: mem0 (Teil VON hirn, wird separat ausgewiesen, aber NICHT zum Balken addiert)."""
|
|
||||||
|
|
||||||
def __init__(self, session_id: str = "", kind: str = "voice") -> None:
|
def __init__(self, session_id: str = "", kind: str = "voice") -> None:
|
||||||
self.id = uuid.uuid4().hex[:8]
|
self.id = uuid.uuid4().hex[:8]
|
||||||
@@ -113,7 +101,7 @@ class TurnTrace:
|
|||||||
self.session_id = (session_id or "")[:24]
|
self.session_id = (session_id or "")[:24]
|
||||||
self.kind = kind
|
self.kind = kind
|
||||||
self.vision_ms: float | None = None # Bildschirm-Beschreibung (falls Bilder)
|
self.vision_ms: float | None = None # Bildschirm-Beschreibung (falls Bilder)
|
||||||
self.hirn_ms: float | None = None # Zeit bis zum ersten Inhalts-Token (Agent + Mem0 + TTFT)
|
self.hirn_ms: float | None = None # Zeit bis zum ersten Inhalts-Token (Agent + Gedächtnis + TTFT)
|
||||||
self.had_images = False
|
self.had_images = False
|
||||||
self.error: str | None = None
|
self.error: str | None = None
|
||||||
|
|
||||||
@@ -130,7 +118,7 @@ class TurnTrace:
|
|||||||
record_stage("chat_ttfb", (time.perf_counter() - self._brain0) * 1000.0) # SSE-Start (~5 ms), nur rollend
|
record_stage("chat_ttfb", (time.perf_counter() - self._brain0) * 1000.0) # SSE-Start (~5 ms), nur rollend
|
||||||
|
|
||||||
def note_first_content(self) -> None:
|
def note_first_content(self) -> None:
|
||||||
"""Erster Inhalts-Delta = echte Hirn-Latenz (Agent-Overhead + Mem0 + LLM-TTFT)."""
|
"""Erster Inhalts-Delta = echte Hirn-Latenz (Agent-Overhead + Gedächtnis + LLM-TTFT)."""
|
||||||
ms = (time.perf_counter() - self._brain0) * 1000.0
|
ms = (time.perf_counter() - self._brain0) * 1000.0
|
||||||
self.hirn_ms = round(ms, 1)
|
self.hirn_ms = round(ms, 1)
|
||||||
record_stage("chat_first_content", ms)
|
record_stage("chat_first_content", ms)
|
||||||
@@ -138,7 +126,6 @@ class TurnTrace:
|
|||||||
def commit(self) -> dict:
|
def commit(self) -> dict:
|
||||||
total = (time.perf_counter() - self.perf0) * 1000.0
|
total = (time.perf_counter() - self.perf0) * 1000.0
|
||||||
stt = _take_stt() # rollend bereits in /voice/stt erfasst
|
stt = _take_stt() # rollend bereits in /voice/stt erfasst
|
||||||
mem0 = _take_retrieve(self.perf0) # rollend bereits in /api/memory erfasst
|
|
||||||
# Generierung = alles nach dem ersten Inhalts-Token bis Stream-Ende.
|
# Generierung = alles nach dem ersten Inhalts-Token bis Stream-Ende.
|
||||||
gen = round(total - self.hirn_ms, 1) if self.hirn_ms is not None else None
|
gen = round(total - self.hirn_ms, 1) if self.hirn_ms is not None else None
|
||||||
rec = {
|
rec = {
|
||||||
@@ -151,7 +138,6 @@ class TurnTrace:
|
|||||||
"vision_ms": self.vision_ms,
|
"vision_ms": self.vision_ms,
|
||||||
"hirn_ms": self.hirn_ms,
|
"hirn_ms": self.hirn_ms,
|
||||||
"gen_ms": gen if (gen is None or gen >= 0) else 0.0,
|
"gen_ms": gen if (gen is None or gen >= 0) else 0.0,
|
||||||
"mem0_ms": mem0,
|
|
||||||
"total_ms": round(total, 1),
|
"total_ms": round(total, 1),
|
||||||
"error": self.error,
|
"error": self.error,
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -24,7 +24,6 @@ import os
|
|||||||
import subprocess
|
import subprocess
|
||||||
|
|
||||||
import httpx
|
import httpx
|
||||||
|
|
||||||
from config import LLAMA_SWAP_URL
|
from config import LLAMA_SWAP_URL
|
||||||
|
|
||||||
log = logging.getLogger(__name__)
|
log = logging.getLogger(__name__)
|
||||||
@@ -74,7 +73,18 @@ def _run_warmup() -> bool:
|
|||||||
|
|
||||||
|
|
||||||
def _warmset_members() -> set[str]:
|
def _warmset_members() -> set[str]:
|
||||||
"""Soll-Warm-Set = Mitglieder aller ko-residenten Gruppen (swap:false bzw. persist/persistent)."""
|
"""Soll-Warm-Set. `MC_WARMSET` (leerzeichengetrennt) schlägt die Gruppen-Ableitung.
|
||||||
|
|
||||||
|
Warum ein Override (26.07.2026): Seit die ko-residente Gruppe auch Modelle MIT TTL
|
||||||
|
enthält (Coder 90 min, Kritiker 30 min), ist „alle Gruppen-Mitglieder" das falsche Ziel.
|
||||||
|
Der Wächter würde gegen die TTLs arbeiten und nachts 62 GB wieder hochladen, die
|
||||||
|
absichtlich freigegeben wurden. Ko-Residenz („dürfen gleichzeitig liegen") und
|
||||||
|
Warm-Pflicht („müssen immer liegen") sind zwei verschiedene Aussagen — die Gruppe kann
|
||||||
|
nur die erste ausdrücken.
|
||||||
|
"""
|
||||||
|
explizit = os.environ.get("MC_WARMSET", "").split()
|
||||||
|
if explizit:
|
||||||
|
return set(explizit)
|
||||||
try:
|
try:
|
||||||
from services import llamaswap
|
from services import llamaswap
|
||||||
groups = llamaswap.list_groups() or {}
|
groups = llamaswap.list_groups() or {}
|
||||||
|
|||||||
+5
-8
@@ -1,7 +1,7 @@
|
|||||||
"""
|
"""
|
||||||
MC2-Steward — die Wächter-Loops als EIGENER Prozess (UMBAU v3, P2).
|
MC2-Steward — die Wächter-Loops als EIGENER Prozess (UMBAU v3, P2).
|
||||||
|
|
||||||
Bisher hingen Re-Warm-Wächter, Health-Wächter (sentry) und Mem0-Auto-Dedupe am
|
Bisher hingen Re-Warm-Wächter und Health-Wächter (sentry) am
|
||||||
Lebenszyklus des Steuerpult-Webservers (app.py-Lifespan): jeder MC2-Neustart riss
|
Lebenszyklus des Steuerpult-Webservers (app.py-Lifespan): jeder MC2-Neustart riss
|
||||||
den Wächtern Timing und Flanken-Gedächtnis weg — und ein TOTES Steuerpult konnte
|
den Wächtern Timing und Flanken-Gedächtnis weg — und ein TOTES Steuerpult konnte
|
||||||
sich prinzipbedingt nicht selbst melden. Hier laufen DIESELBEN Loops (unveränderte
|
sich prinzipbedingt nicht selbst melden. Hier laufen DIESELBEN Loops (unveränderte
|
||||||
@@ -11,14 +11,16 @@ Module) als eigener Mini-Dienst (mc2-steward.service, Restart=always):
|
|||||||
In-Process-Nudge aus llamaswap.write_config)
|
In-Process-Nudge aus llamaswap.write_config)
|
||||||
• sentry.sentry_loop — Health-Flanken → Briefkasten (HTTP an MC2) + Telegram;
|
• sentry.sentry_loop — Health-Flanken → Briefkasten (HTTP an MC2) + Telegram;
|
||||||
beobachtet im Steward-Modus AUCH MC2 selbst + mc2-gateway
|
beobachtet im Steward-Modus AUCH MC2 selbst + mc2-gateway
|
||||||
• memory.auto_dedupe_loop — Gedächtnis-Dubletten (HTTP an den Mem0-Sidecar)
|
|
||||||
|
Das dritte Loop (Gedächtnis-Dubletten gegen den Sidecar auf :8765) ist mit dessen Ablösung
|
||||||
|
am 07.08.2026 entfallen — Hermes führt sein Gedächtnis selbst (docs/wissen/VERDIKTE.md).
|
||||||
|
|
||||||
BEWUSST NICHT hier: reminders_loop — der teilt sich Datei UND CRUD-Pfade mit dem
|
BEWUSST NICHT hier: reminders_loop — der teilt sich Datei UND CRUD-Pfade mit dem
|
||||||
/api/reminders-Router (Zwei-Schreiber-Risiko auf mc2-reminders.json); er bleibt im
|
/api/reminders-Router (Zwei-Schreiber-Risiko auf mc2-reminders.json); er bleibt im
|
||||||
Steuerpult. Der Briefkasten-Store gehört weiter EXKLUSIV dem MC2-Prozess — dieser
|
Steuerpult. Der Briefkasten-Store gehört weiter EXKLUSIV dem MC2-Prozess — dieser
|
||||||
Prozess liefert Meldungen per HTTP ab (announce.py, MC_ANNOUNCE_HTTP).
|
Prozess liefert Meldungen per HTTP ab (announce.py, MC_ANNOUNCE_HTTP).
|
||||||
|
|
||||||
Die Loop-Schalter (MC_REWARM_ENABLED / MC_SENTRY_ENABLED / MC_MEM_DEDUPE_ENABLED)
|
Die Loop-Schalter (MC_REWARM_ENABLED / MC_SENTRY_ENABLED)
|
||||||
stehen in der MC2-Unit auf 0 und hier auf Default 1 — reiner Konfig-Split, kein
|
stehen in der MC2-Unit auf 0 und hier auf Default 1 — reiner Konfig-Split, kein
|
||||||
Verhaltens-Code im Steuerpult angefasst. Zeilen dort entfernen = Rollback.
|
Verhaltens-Code im Steuerpult angefasst. Zeilen dort entfernen = Rollback.
|
||||||
"""
|
"""
|
||||||
@@ -28,7 +30,6 @@ import logging
|
|||||||
import os
|
import os
|
||||||
|
|
||||||
from config import CONFIG_PATH
|
from config import CONFIG_PATH
|
||||||
from services import memory as memory_svc
|
|
||||||
from services import sentry, warmer
|
from services import sentry, warmer
|
||||||
|
|
||||||
logging.basicConfig(
|
logging.basicConfig(
|
||||||
@@ -66,10 +67,6 @@ async def main() -> None:
|
|||||||
warmer.INTERVAL, CONFIG_WATCH_S)
|
warmer.INTERVAL, CONFIG_WATCH_S)
|
||||||
if sentry.ENABLED:
|
if sentry.ENABLED:
|
||||||
tasks.append(asyncio.create_task(sentry.sentry_loop()))
|
tasks.append(asyncio.create_task(sentry.sentry_loop()))
|
||||||
if memory_svc.AUTO_DEDUPE_ENABLED:
|
|
||||||
tasks.append(asyncio.create_task(memory_svc.auto_dedupe_loop()))
|
|
||||||
log.info("Mem0-Auto-Dedupe aktiv (alle %ss, Schwelle %s)",
|
|
||||||
memory_svc.AUTO_DEDUPE_INTERVAL, memory_svc.AUTO_DEDUPE_THRESHOLD)
|
|
||||||
if not tasks:
|
if not tasks:
|
||||||
log.warning("steward: alle Loops per Env deaktiviert — nichts zu tun, Ende.")
|
log.warning("steward: alle Loops per Env deaktiviert — nichts zu tun, Ende.")
|
||||||
return
|
return
|
||||||
|
|||||||
@@ -154,7 +154,7 @@ async def volume_control(req: dict):
|
|||||||
async def open_target(req: dict):
|
async def open_target(req: dict):
|
||||||
target = req.get("target", "")
|
target = req.get("target", "")
|
||||||
try:
|
try:
|
||||||
if target.startswith("http://") or target.startswith("https://"):
|
if target.startswith(("http://", "https://")):
|
||||||
webbrowser.open(target)
|
webbrowser.open(target)
|
||||||
else:
|
else:
|
||||||
os.startfile(target)
|
os.startfile(target)
|
||||||
|
|||||||
@@ -28,7 +28,7 @@ hint=""
|
|||||||
# Stabile Anti-Flail-Orientierung: WER bin ich, WO laufen die Modelle, WAS ist tabu.
|
# Stabile Anti-Flail-Orientierung: WER bin ich, WO laufen die Modelle, WAS ist tabu.
|
||||||
ctx="$(cat <<EOF
|
ctx="$(cat <<EOF
|
||||||
[BOX-ORIENTIERUNG — du bist ein Hintergrund-Worker auf der lokalen AI-Box (Linux, Zeit UTC / lokal Europe/Berlin, locale de_DE), NICHT Lucy und kein Dev-Laptop. Du arbeitest EINE Kanban-Aufgabe ab.]
|
[BOX-ORIENTIERUNG — du bist ein Hintergrund-Worker auf der lokalen AI-Box (Linux, Zeit UTC / lokal Europe/Berlin, locale de_DE), NICHT Lucy und kein Dev-Laptop. Du arbeitest EINE Kanban-Aufgabe ab.]
|
||||||
Die Modelle / das "Hirn" laufen ausschliesslich ueber den Router llama-swap auf 127.0.0.1:8080 (startet je Modell einen llama-server) bzw. das OpenAI-kompatible Gateway von MC2 auf 127.0.0.1:9001/v1 — es gibt KEINEN anderen Modell-Server, also nicht danach suchen. Weitere Dienste: hermes-gateway :8642, mem0-Gedaechtnis :8765. Der MC2-Live-Checkout ~/mission-control-v2 ist nur zum LESEN da (Schreiben/committen TABU — Code-Arbeit immer im frischen Klon deines Task-Workspaces). Grenzen (was gehoert wohin): MC2 = Steuerpult (verwalten/klicken/zusehen, KEIN Chat-UI), Lucy = Chat & Stimme (eigenes Repo), Hermes-Quelle ist TABU (Agenten-Verhalten nur ueber Config/SOUL/Skill/Hook/MCP aendern). Feste Entscheide/Verbote + volle Grenzen-Landkarte: ~/mission-control-v2/docs/wissen/ (GRENZEN/VERDIKTE/FALLEN/STACK) + ~/wissens-vault/eigenbau-landkarte.md.${hint}
|
Die Modelle / das "Hirn" laufen ausschliesslich ueber den Router llama-swap auf 127.0.0.1:8080 (startet je Modell einen llama-server) bzw. das OpenAI-kompatible Gateway von MC2 auf 127.0.0.1:9001/v1 — es gibt KEINEN anderen Modell-Server, also nicht danach suchen. Weiterer Dienst: hermes-gateway :8642 (fuehrt sein Gedaechtnis selbst — es gibt KEINEN separaten Gedaechtnis-Dienst mehr). Der MC2-Live-Checkout ~/mission-control-v2 ist nur zum LESEN da (Schreiben/committen TABU — Code-Arbeit immer im frischen Klon deines Task-Workspaces). Grenzen (was gehoert wohin): MC2 = Steuerpult (verwalten/klicken/zusehen, KEIN Chat-UI), Lucy = Chat & Stimme (eigenes Repo), Hermes-Quelle ist TABU (Agenten-Verhalten nur ueber Config/SOUL/Skill/Hook/MCP aendern). Feste Entscheide/Verbote + volle Grenzen-Landkarte: ~/mission-control-v2/docs/wissen/ (GRENZEN/VERDIKTE/FALLEN/STACK) + ~/wissens-vault/eigenbau-landkarte.md.${hint}
|
||||||
TRIAGE (19.07. — Drei-Bahnen-Regel): Ordne deine Karte ZUERST einer Bahn zu und bleib darin: Denken (Konzept/Plan), Bauen (Code schreiben/aendern), Betrieb (SSH/Deploy/Dienste). Fuer Betrieb-Arbeit lade IMMER zuerst den Skill betrieb-playbook (Diagnose-Checklisten; max 3 Anlaeufe pro Hindernis, dann kanban_block mit exaktem Fehlertext — die No-Progress-Bremse erzwingt das mechanisch).
|
TRIAGE (19.07. — Drei-Bahnen-Regel): Ordne deine Karte ZUERST einer Bahn zu und bleib darin: Denken (Konzept/Plan), Bauen (Code schreiben/aendern), Betrieb (SSH/Deploy/Dienste). Fuer Betrieb-Arbeit lade IMMER zuerst den Skill betrieb-playbook (Diagnose-Checklisten; max 3 Anlaeufe pro Hindernis, dann kanban_block mit exaktem Fehlertext — die No-Progress-Bremse erzwingt das mechanisch).
|
||||||
PROTOKOLL-PFLICHT (15.07.): Beende deine Aufgabe IMMER mit dem Tool-Aufruf kanban_complete (fertig) oder kanban_block (Frage/Sackgasse). Eine Text-Zusammenfassung OHNE diesen Aufruf zaehlt als Absturz (Protokollverstoss) und blockiert die Karte — genau so ging am 14.07. eine fertige Arbeit verloren.
|
PROTOKOLL-PFLICHT (15.07.): Beende deine Aufgabe IMMER mit dem Tool-Aufruf kanban_complete (fertig) oder kanban_block (Frage/Sackgasse). Eine Text-Zusammenfassung OHNE diesen Aufruf zaehlt als Absturz (Protokollverstoss) und blockiert die Karte — genau so ging am 14.07. eine fertige Arbeit verloren.
|
||||||
REPO-WEGWEISER mission-control-v2 (NICHT raten/suchen — so liegt es): backend/app.py = Einstieg + Router-Mounting · backend/routers/*.py = REST-Endpunkte · backend/services/*.py = Logik · backend/gateway_app.py = /v1-Gateway-Prozess (:9010) · frontend/src/views/*.tsx = Ansichten · frontend/src/lib/api.ts = Typen+Fetch · frontend/src/lib/queries.ts = TanStack-Query-Hooks (Polling) · frontend/src/nav.ts = Sidebar · deploy/ = Skripte/Units/Hooks/Skills · Projekt-Regeln: AGENTS.md (Wurzel) + docs/wissen/.
|
REPO-WEGWEISER mission-control-v2 (NICHT raten/suchen — so liegt es): backend/app.py = Einstieg + Router-Mounting · backend/routers/*.py = REST-Endpunkte · backend/services/*.py = Logik · backend/gateway_app.py = /v1-Gateway-Prozess (:9010) · frontend/src/views/*.tsx = Ansichten · frontend/src/lib/api.ts = Typen+Fetch · frontend/src/lib/queries.ts = TanStack-Query-Hooks (Polling) · frontend/src/nav.ts = Sidebar · deploy/ = Skripte/Units/Hooks/Skills · Projekt-Regeln: AGENTS.md (Wurzel) + docs/wissen/.
|
||||||
|
|||||||
@@ -20,7 +20,10 @@ nur Schreib-Operationen.
|
|||||||
|
|
||||||
Ausgabe {"action":"block","message":...} = Tool geblockt; {} = durchlassen.
|
Ausgabe {"action":"block","message":...} = Tool geblockt; {} = durchlassen.
|
||||||
"""
|
"""
|
||||||
import sys, json, os, re
|
import json
|
||||||
|
import os
|
||||||
|
import re
|
||||||
|
import sys
|
||||||
|
|
||||||
|
|
||||||
def out(obj):
|
def out(obj):
|
||||||
|
|||||||
@@ -67,6 +67,22 @@ jobs:
|
|||||||
(cd "$d" && npm ci --no-audit --no-fund) || { rot=1; continue; }
|
(cd "$d" && npm ci --no-audit --no-fund) || { rot=1; continue; }
|
||||||
if grep -q '"build"' "$pkg"; then (cd "$d" && npm run build) || rot=1; fi
|
if grep -q '"build"' "$pkg"; then (cd "$d" && npm run build) || rot=1; fi
|
||||||
if grep -q '"test"' "$pkg"; then (cd "$d" && npm test --silent) || rot=1; fi
|
if grep -q '"test"' "$pkg"; then (cd "$d" && npm test --silent) || rot=1; fi
|
||||||
|
|
||||||
|
# Buendel-Budget: das Start-Chunk ist, was der Nutzer VOR dem ersten Bild laedt.
|
||||||
|
# Ohne Deckel waechst es unbemerkt zurueck (eine eifrig geladene Diagramm-Lib
|
||||||
|
# reicht). Gemessen wird der frische Build, nicht das committete dist.
|
||||||
|
if [ -d "$d/dist/assets" ]; then
|
||||||
|
# Einstiegs-Chunk aus index.html lesen, nicht per Glob raten: Rollup nennt
|
||||||
|
# auch kleine geteilte Module "index-*.js", und dann misst der Glob den
|
||||||
|
# falschen — das Budget waere still immer gruen.
|
||||||
|
einstieg=$(grep -o 'assets/index-[A-Za-z0-9_-]*\.js' "$d/dist/index.html" | head -1)
|
||||||
|
haupt="$d/$einstieg"
|
||||||
|
if [ -n "$haupt" ]; then
|
||||||
|
gz=$(gzip -c "$haupt" | wc -c)
|
||||||
|
echo "-- Start-Chunk: $gz B gzip (Budget 200000)"
|
||||||
|
[ "$gz" -gt 200000 ] && { echo "❌ Start-Buendel ueber Budget — hinter lazy() legen."; rot=1; }
|
||||||
|
fi
|
||||||
|
fi
|
||||||
done <<< "$pkg_dateien"
|
done <<< "$pkg_dateien"
|
||||||
fi
|
fi
|
||||||
|
|
||||||
|
|||||||
@@ -12,7 +12,7 @@ TOKEN=$(grep -m1 'git\.tobisniceshomelab' "$HOME/.git-credentials" 2>/dev/null |
|
|||||||
[ -n "$TOKEN" ] || exit 0
|
[ -n "$TOKEN" ] || exit 0
|
||||||
|
|
||||||
python3 - "$TOKEN" "$STATE" <<'PY'
|
python3 - "$TOKEN" "$STATE" <<'PY'
|
||||||
import json, sys, urllib.request
|
import json, sys, urllib.request, subprocess, os
|
||||||
|
|
||||||
token, state_pfad = sys.argv[1], sys.argv[2]
|
token, state_pfad = sys.argv[1], sys.argv[2]
|
||||||
# API intern (die DDNS-Domain ist nachts wegen Zwangstrennung oft tot, 24.07.2026);
|
# API intern (die DDNS-Domain ist nachts wegen Zwangstrennung oft tot, 24.07.2026);
|
||||||
@@ -79,6 +79,14 @@ if neu:
|
|||||||
for full, sha, name in neu:
|
for full, sha, name in neu:
|
||||||
print(f"• {full} @ {sha} ({name})")
|
print(f"• {full} @ {sha} ({name})")
|
||||||
print(f" {WEB}/{full}/actions")
|
print(f" {WEB}/{full}/actions")
|
||||||
|
try:
|
||||||
|
subprocess.run([
|
||||||
|
os.path.expanduser("~/.local/bin/hermes"), "kanban", "create",
|
||||||
|
"--title", f"CI rot: {full} @ {sha}",
|
||||||
|
"--body", f"Der CI Lauf '{name}' in {full} ist fehlgeschlagen. Bitte Log ansehen und Fix vorschlagen."
|
||||||
|
], capture_output=True)
|
||||||
|
except Exception as e:
|
||||||
|
print(f"Fehler bei kanban_create: {e}", file=sys.stderr)
|
||||||
print("Nichts aus diesen Ständen ist ‚fertig', solange die Ampel rot ist.")
|
print("Nichts aus diesen Ständen ist ‚fertig', solange die Ampel rot ist.")
|
||||||
|
|
||||||
with open(state_pfad, "w") as f:
|
with open(state_pfad, "w") as f:
|
||||||
|
|||||||
@@ -1,162 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Auftragsbuch: einen Vorschlags-Branch ANNEHMEN — der letzte Meter des propose-only-Kreislaufs.
|
|
||||||
# Werkstatt/Orchestrator liefern Branches (wartung/*, orchestrator/*), der Commander klickt in
|
|
||||||
# der Zentrale „Annehmen" → dieses Skript macht die bisherige Git-Handarbeit: Merge im
|
|
||||||
# isolierten Worktree (Lehre: NIE im Live-Checkout arbeiten) → Push nach main → Deploy →
|
|
||||||
# Health-Check → bei Rot automatischer Revert + Redeploy + Alarm.
|
|
||||||
#
|
|
||||||
# WICHTIG: läuft als EIGENE systemd-Unit (systemd-run, startet routers/auftragsbuch.py),
|
|
||||||
# NICHT als Kind des Backends — deploy.sh startet mission-control-2 neu und würde sonst
|
|
||||||
# den eigenen Eltern-Prozess mitten im Lauf töten. Außerdem wird es vom Backend als
|
|
||||||
# /tmp-KOPIE gestartet (deploy.sh macht git reset --hard → die Datei unter den Füßen
|
|
||||||
# eines laufenden bash zu tauschen korrumpiert das Skript, bekannte Falle).
|
|
||||||
#
|
|
||||||
# Nutzung: auftrag-annehmen.sh <branch> (z. B. wartung/saubere-zusammenfassung)
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
BRANCH="${1:?Nutzung: auftrag-annehmen.sh <branch>}"
|
|
||||||
SRC="${MC2_SRC:-$HOME/mission-control-v2}"
|
|
||||||
STATUS="${MC2_AUFTRAG_STATUS:-/srv/models/mc2-auftragsbuch.json}"
|
|
||||||
API="${MC_API:-http://127.0.0.1:9001}"
|
|
||||||
SLUG="$(echo "$BRANCH" | tr '/' '-')"
|
|
||||||
WT="/tmp/annahme-$SLUG"
|
|
||||||
LOG="/tmp/annahme-$SLUG.log"
|
|
||||||
|
|
||||||
notify(){ bash "$SRC/deploy/notify.sh" -s "[Auftragsbuch]" "$1" || true; }
|
|
||||||
|
|
||||||
# Status-Fortschritt für die UI (atomar via tmp+replace; die API liest die Datei nur).
|
|
||||||
status(){ # $1=state $2=detail
|
|
||||||
python3 - "$STATUS" "$BRANCH" "$1" "$2" <<'PY'
|
|
||||||
import json, os, sys, time
|
|
||||||
p, branch, state, detail = sys.argv[1:5]
|
|
||||||
try:
|
|
||||||
d = json.load(open(p, encoding="utf-8"))
|
|
||||||
except Exception:
|
|
||||||
d = {}
|
|
||||||
d.setdefault("branches", {})[branch] = {"state": state, "detail": detail, "ts": time.time()}
|
|
||||||
tmp = p + ".tmp"
|
|
||||||
json.dump(d, open(tmp, "w", encoding="utf-8"), ensure_ascii=False)
|
|
||||||
os.replace(tmp, p)
|
|
||||||
PY
|
|
||||||
}
|
|
||||||
|
|
||||||
cleanup_wt(){ git -C "$SRC" worktree remove --force "$WT" 2>/dev/null || true; }
|
|
||||||
|
|
||||||
fail(){
|
|
||||||
status "fehlgeschlagen" "$1"
|
|
||||||
notify "Vorschlag '$BRANCH' konnte NICHT eingespielt werden: $1 — nichts wurde verändert, der Branch bleibt liegen."
|
|
||||||
cleanup_wt
|
|
||||||
exit 1
|
|
||||||
}
|
|
||||||
|
|
||||||
status "laeuft" "Merge wird vorbereitet"
|
|
||||||
cd "$SRC" || fail "Live-Checkout $SRC fehlt"
|
|
||||||
git fetch -q origin || fail "git fetch (Gitea) fehlgeschlagen"
|
|
||||||
git rev-parse --verify -q "refs/remotes/origin/$BRANCH" >/dev/null \
|
|
||||||
|| fail "Branch origin/$BRANCH existiert nicht (schon gemergt/gelöscht?)"
|
|
||||||
|
|
||||||
PRE="$(git rev-parse origin/main)"
|
|
||||||
|
|
||||||
# Kaputt aufgesetzte Branches (Worker machte git init/Shallow statt zu klonen) haben KEINEN
|
|
||||||
# gemeinsamen Vorfahren — git verweigert den Merge immer. Ehrlich sagen statt „Konflikt".
|
|
||||||
git merge-base origin/main "origin/$BRANCH" >/dev/null 2>&1 \
|
|
||||||
|| fail "Branch hat keinen gemeinsamen Ursprung mit main (kaputt aufgesetzt, z. B. git init statt Klonen) — bitte ablehnen (mit Grund) und die Idee neu in die Queue geben"
|
|
||||||
|
|
||||||
# Isolierter Worktree — der Live-Checkout bleibt bis zum Deploy unberührt.
|
|
||||||
cleanup_wt
|
|
||||||
git worktree add --detach "$WT" origin/main >/dev/null 2>&1 || fail "Worktree konnte nicht angelegt werden"
|
|
||||||
MERGE_MSG="Auftragsbuch: '$BRANCH' angenommen (Ein-Klick-Gate)"
|
|
||||||
if ! git -C "$WT" -c user.name="Auftragsbuch" -c user.email="auftragsbuch@box.local" \
|
|
||||||
merge --no-ff "origin/$BRANCH" -m "$MERGE_MSG" >>"$LOG" 2>&1; then
|
|
||||||
git -C "$WT" merge --abort 2>/dev/null || true
|
|
||||||
# Selbstheilung: veralteten Branch mechanisch auf main rebasen (zweiter Worktree am
|
|
||||||
# Branch-Kopf). Klappt das sauber, wird der rebasede Stand gemergt — kein PC nötig.
|
|
||||||
status "laeuft" "Merge-Konflikt — Auto-Rebase wird versucht"
|
|
||||||
WT2="/tmp/annahme-rebase-$SLUG"
|
|
||||||
git worktree remove --force "$WT2" 2>/dev/null || true
|
|
||||||
REBASED=""
|
|
||||||
if git worktree add --detach "$WT2" "origin/$BRANCH" >/dev/null 2>&1 \
|
|
||||||
&& git -C "$WT2" -c user.name="Auftragsbuch" -c user.email="auftragsbuch@box.local" \
|
|
||||||
rebase origin/main >>"$LOG" 2>&1; then
|
|
||||||
REBASED="$(git -C "$WT2" rev-parse HEAD)"
|
|
||||||
else
|
|
||||||
git -C "$WT2" rebase --abort 2>/dev/null || true
|
|
||||||
fi
|
|
||||||
git worktree remove --force "$WT2" 2>/dev/null || true
|
|
||||||
[ -n "$REBASED" ] || fail "Merge-Konflikt mit main, Auto-Rebase scheiterte ebenfalls — echter Inhaltskonflikt; am einfachsten ablehnen und die Idee neu in die Queue geben (frischer Branch von aktuellem main)"
|
|
||||||
git -C "$WT" -c user.name="Auftragsbuch" -c user.email="auftragsbuch@box.local" \
|
|
||||||
merge --no-ff "$REBASED" -m "$MERGE_MSG — auto-rebased (Branch war veraltet)" >>"$LOG" 2>&1 \
|
|
||||||
|| { git -C "$WT" merge --abort 2>/dev/null || true; fail "Merge nach Auto-Rebase fehlgeschlagen (unerwartet) — Log: $LOG"; }
|
|
||||||
fi
|
|
||||||
|
|
||||||
# py_compile-Gate über die durch den Merge geänderten Python-Dateien (AGENTS.md-Regel).
|
|
||||||
PYS="$(git -C "$WT" diff --name-only "$PRE"..HEAD -- '*.py' 2>/dev/null | tr '\n' ' ')"
|
|
||||||
if [ -n "${PYS// /}" ]; then
|
|
||||||
PYBIN="$SRC/backend/.venv/bin/python"; [ -x "$PYBIN" ] || PYBIN="python3"
|
|
||||||
# shellcheck disable=SC2086
|
|
||||||
( cd "$WT" && "$PYBIN" -m py_compile $PYS ) >>"$LOG" 2>&1 || fail "py_compile-Gate rot — der Patch enthält kaputtes Python"
|
|
||||||
fi
|
|
||||||
|
|
||||||
status "laeuft" "Push nach main läuft"
|
|
||||||
PUSHED=0
|
|
||||||
for _ in 1 2 3; do
|
|
||||||
git -C "$WT" push origin HEAD:main >>"$LOG" 2>&1 && { PUSHED=1; break; }
|
|
||||||
sleep 5
|
|
||||||
done
|
|
||||||
[ "$PUSHED" = 1 ] || fail "Push nach main fehlgeschlagen (Gitea nicht erreichbar / Token?)"
|
|
||||||
cleanup_wt
|
|
||||||
|
|
||||||
status "laeuft" "Deploy läuft — die Zentrale startet gleich kurz neu"
|
|
||||||
notify "Vorschlag '$BRANCH' angenommen: Merge auf main ist durch, Deploy läuft. Die Zentrale ist gleich kurz weg."
|
|
||||||
|
|
||||||
# deploy.sh als Kopie ausführen (Selbst-Reset-Falle: es resettet das Repo, in dem es liegt).
|
|
||||||
cp "$SRC/deploy/deploy.sh" "/tmp/annahme-deploy-$SLUG.sh"
|
|
||||||
DEPLOY_OK=1
|
|
||||||
bash "/tmp/annahme-deploy-$SLUG.sh" >>"$LOG" 2>&1 || DEPLOY_OK=0
|
|
||||||
|
|
||||||
# Health-Check mit Geduld (Dienst-Neustart + Warmup brauchen einen Moment).
|
|
||||||
HEALTH=0
|
|
||||||
if [ "$DEPLOY_OK" = 1 ]; then
|
|
||||||
for _ in $(seq 1 18); do
|
|
||||||
curl -sf -m 5 "$API/api/health" >/dev/null 2>&1 && { HEALTH=1; break; }
|
|
||||||
sleep 5
|
|
||||||
done
|
|
||||||
fi
|
|
||||||
|
|
||||||
if [ "$HEALTH" = 1 ]; then
|
|
||||||
# Gemergt + live + grün → der Remote-Branch hat seinen Zweck erfüllt.
|
|
||||||
git -C "$SRC" push origin --delete "$BRANCH" >>"$LOG" 2>&1 || true
|
|
||||||
git -C "$SRC" fetch -q --prune origin 2>/dev/null || true
|
|
||||||
status "eingespielt" "Deploy grün, Health-Check bestanden"
|
|
||||||
notify "Vorschlag '$BRANCH' ist LIVE — Deploy grün, Health-Check bestanden. ✅"
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
# ── Rollback: Merge revertieren, main zurückschieben, neu deployen, Alarm ──
|
|
||||||
status "rollback" "Health rot — automatischer Revert läuft"
|
|
||||||
git fetch -q origin || true
|
|
||||||
cleanup_wt
|
|
||||||
if git worktree add --detach "$WT" origin/main >/dev/null 2>&1 \
|
|
||||||
&& git -C "$WT" -c user.name="Auftragsbuch" -c user.email="auftragsbuch@box.local" \
|
|
||||||
revert -m 1 --no-edit HEAD >>"$LOG" 2>&1 \
|
|
||||||
&& git -C "$WT" push origin HEAD:main >>"$LOG" 2>&1; then
|
|
||||||
cleanup_wt
|
|
||||||
cp "$SRC/deploy/deploy.sh" "/tmp/annahme-rollback-$SLUG.sh"
|
|
||||||
bash "/tmp/annahme-rollback-$SLUG.sh" >>"$LOG" 2>&1 || true
|
|
||||||
R=0
|
|
||||||
for _ in $(seq 1 12); do
|
|
||||||
curl -sf -m 5 "$API/api/health" >/dev/null 2>&1 && { R=1; break; }
|
|
||||||
sleep 5
|
|
||||||
done
|
|
||||||
if [ "$R" = 1 ]; then
|
|
||||||
status "zurueckgerollt" "Health blieb rot — Merge automatisch revertiert, Box läuft wieder"
|
|
||||||
notify "Vorschlag '$BRANCH' hat den Health-Check GERISSEN. Automatisch zurückgerollt — die Box läuft wieder auf dem alten Stand. Der Branch bleibt zur Analyse liegen. Log: $LOG"
|
|
||||||
exit 1
|
|
||||||
fi
|
|
||||||
fi
|
|
||||||
cleanup_wt
|
|
||||||
status "kritisch" "Rollback fehlgeschlagen — Box braucht Hilfe"
|
|
||||||
curl -sf -m 5 -X POST "$API/api/alarm" -H 'Content-Type: application/json' \
|
|
||||||
--data "{\"subject\":\"[Auftragsbuch]\",\"text\":\"KRITISCH: Annehmen von $BRANCH UND Rollback fehlgeschlagen — Zentrale prüfen. Log: $LOG\"}" >/dev/null 2>&1 \
|
|
||||||
|| notify "KRITISCH: Annehmen von '$BRANCH' UND Rollback fehlgeschlagen — bitte Box prüfen (restore.sh liegt bereit). Log: $LOG"
|
|
||||||
exit 2
|
|
||||||
+62
-1
@@ -123,7 +123,7 @@ check_hermes(){
|
|||||||
done
|
done
|
||||||
if [ "$state" = "done" ]; then
|
if [ "$state" = "done" ]; then
|
||||||
SUMMARY+=("$name: $behind Commits eingespielt, Gehirn-Check grün.")
|
SUMMARY+=("$name: $behind Commits eingespielt, Gehirn-Check grün.")
|
||||||
notify "Hermes-Agent aktualisiert ($behind Commits). Gehirn-Check (Mem0, Tools, Voice) grün — alles läuft."
|
notify "Hermes-Agent aktualisiert ($behind Commits). Gehirn-Check (Patches, Tools, Voice) grün — alles läuft."
|
||||||
return
|
return
|
||||||
fi
|
fi
|
||||||
# Rot/Timeout: ERST Selbstreparatur versuchen (Config-Bruch selbst ziehen, neue Version behalten) —
|
# Rot/Timeout: ERST Selbstreparatur versuchen (Config-Bruch selbst ziehen, neue Version behalten) —
|
||||||
@@ -165,6 +165,63 @@ Wahrscheinliche Ursache/Fix (Box-Diagnose): $sugg}"
|
|||||||
notify "KRITISCH: Hermes-Update UND Rollback fehlgeschlagen — Gehirn-Check bleibt rot. Bitte melden. (Voll-Restore: deploy/restore.sh mit dem letzten Backup.)"
|
notify "KRITISCH: Hermes-Update UND Rollback fehlgeschlagen — Gehirn-Check bleibt rot. Bitte melden. (Voll-Restore: deploy/restore.sh mit dem letzten Backup.)"
|
||||||
}
|
}
|
||||||
|
|
||||||
|
# ── Neustart, wenn das OS einen verlangt ─────────────────────────────────────
|
||||||
|
# Kernel- und libc-Updates werden erst nach einem Neustart wirksam; bis dahin
|
||||||
|
# laeuft die Box weiter auf dem alten Kernel. Das faellt niemandem auf — am
|
||||||
|
# 27.08.2026 lag die Box 7 Wochen mit drei ungenutzten Kerneln da.
|
||||||
|
#
|
||||||
|
# Der Neustart haengt bewusst am WOECHENTLICHEN Lauf (So 04:30) und nicht an
|
||||||
|
# einem eigenen Timer: ein Ort fuer alle Automatik (Lehre vom 20.08.).
|
||||||
|
# Er passiert NUR, wenn Ubuntu ihn selbst anfordert (/var/run/reboot-required).
|
||||||
|
#
|
||||||
|
# WICHTIG: Die Linger-Pruefung ist die entscheidende Zeile hier. Ohne Linger=yes
|
||||||
|
# startet systemd die User-Dienste nach einem Neustart NICHT — die Box kaeme ohne
|
||||||
|
# Steuerpult, Gateway und Waechter hoch, und niemand koennte sie aus der Ferne
|
||||||
|
# wieder anschalten. Im Zweifel lieber nicht neustarten.
|
||||||
|
#
|
||||||
|
# Abschalten: MC_AUTOUPDATE_REBOOT=0 in der Umgebung des Cron-Jobs.
|
||||||
|
reboot_wenn_noetig(){
|
||||||
|
[ "${MC_AUTOUPDATE_REBOOT:-1}" = "1" ] || { say "Neustart per Env abgeschaltet."; return 0; }
|
||||||
|
[ -f /var/run/reboot-required ] || { say "Kein Neustart noetig."; return 0; }
|
||||||
|
|
||||||
|
local pakete; pakete="$(sort -u /var/run/reboot-required.pkgs 2>/dev/null | tr "
|
||||||
|
" " ")"
|
||||||
|
|
||||||
|
# Sicherung 1: kommen die Dienste ohne Login von selbst wieder hoch?
|
||||||
|
# $USER ist in systemd-/Cron-Umgebungen NICHT gesetzt — mit set -u waere das ein
|
||||||
|
# sofortiger Abbruch des ganzen Update-Laufs. id -un funktioniert immer.
|
||||||
|
local nutzer; nutzer="$(id -un)"
|
||||||
|
if [ "$(loginctl show-user "$nutzer" -p Linger --value 2>/dev/null)" != "yes" ]; then
|
||||||
|
notify "Neustart NICHT ausgefuehrt: die Box laeuft ohne linger — nach einem Neustart wuerden Steuerpult, Gateway und Waechter nicht von selbst starten. Erst 'loginctl enable-linger $nutzer' setzen, dann von Hand neustarten. Ausstehend: ${pakete:-Kernel/libc}"
|
||||||
|
return 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Sicherung 2: kein halbfertiges Update mitten im Neustart abwuergen.
|
||||||
|
local laufend
|
||||||
|
laufend="$(curl -sf --max-time 20 "$API/api/jobs" | jq -r '[.jobs[]? | select(.state=="running")] | length' 2>/dev/null || echo 0)"
|
||||||
|
if [ "${laufend:-0}" -gt 0 ]; then
|
||||||
|
notify "Neustart verschoben: es laufen noch $laufend Job(s). Ausstehend: ${pakete:-Kernel/libc}. Naechster Versuch beim Lauf in einer Woche."
|
||||||
|
return 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
# Sicherung 3: die Dienste muessen fuer den Autostart vorgemerkt sein.
|
||||||
|
local fehlend=""
|
||||||
|
for dienst in mission-control-2 mc2-gateway mc2-steward; do
|
||||||
|
systemctl --user is-enabled "$dienst" >/dev/null 2>&1 || fehlend="$fehlend $dienst"
|
||||||
|
done
|
||||||
|
if [ -n "$fehlend" ]; then
|
||||||
|
notify "Neustart NICHT ausgefuehrt: diese Dienste sind nicht fuer den Autostart eingetragen —$fehlend. Erst 'systemctl --user enable' nachholen. Ausstehend: ${pakete:-Kernel/libc}"
|
||||||
|
return 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
notify "Die Box startet jetzt neu — das OS verlangt es nach dem Update (${pakete:-Kernel/libc}). Sie ist ein paar Minuten weg und meldet sich, sobald alles wieder laeuft. Die Modelle muessen danach neu geladen werden, die erste Anfrage dauert also laenger."
|
||||||
|
say "Neustart wird ausgeloest (ausstehend: ${pakete:-Kernel/libc})."
|
||||||
|
sleep 20 # der Meldung Zeit lassen, rauszugehen
|
||||||
|
sudo -n systemctl reboot || {
|
||||||
|
notify "Neustart FEHLGESCHLAGEN: 'sudo systemctl reboot' wurde abgelehnt. Bitte von Hand neustarten. Ausstehend: ${pakete:-Kernel/libc}"
|
||||||
|
}
|
||||||
|
}
|
||||||
|
|
||||||
# ── Lauf ─────────────────────────────────────────────────────────────────────
|
# ── Lauf ─────────────────────────────────────────────────────────────────────
|
||||||
say "Auto-Update-Lauf startet ($(date '+%F %H:%M'))."
|
say "Auto-Update-Lauf startet ($(date '+%F %H:%M'))."
|
||||||
pins_init
|
pins_init
|
||||||
@@ -180,3 +237,7 @@ check_hermes
|
|||||||
notify "Commander, die Wochenpflege der Box ist durch — kurz für dich:
|
notify "Commander, die Wochenpflege der Box ist durch — kurz für dich:
|
||||||
$(printf '• %s\n' "${SUMMARY[@]}")"
|
$(printf '• %s\n' "${SUMMARY[@]}")"
|
||||||
say "Fertig."
|
say "Fertig."
|
||||||
|
|
||||||
|
# Ganz zuletzt: der Neustart wuerde die Abschlussmeldung oben sonst verschlucken.
|
||||||
|
# Die Funktion meldet in jedem Fall selbst, ob sie neustartet oder warum nicht.
|
||||||
|
reboot_wenn_noetig
|
||||||
|
|||||||
+8
-9
@@ -3,8 +3,10 @@
|
|||||||
# zurückkommt. Erzeugt EIN Tarball mc2-state-<ts>.tar.gz, behält die letzten N.
|
# zurückkommt. Erzeugt EIN Tarball mc2-state-<ts>.tar.gz, behält die letzten N.
|
||||||
# Läuft per systemd-Timer (täglich), manuell, oder über den UI-Snapshot-Button.
|
# Läuft per systemd-Timer (täglich), manuell, oder über den UI-Snapshot-Button.
|
||||||
#
|
#
|
||||||
# Inhalt: mem0 (Chroma + history.db) · ~/.hermes (config.yaml, .env, plugins/) ·
|
# Inhalt: ~/.hermes (config.yaml, .env, plugins/) · /etc/llama-swap/config.yaml ·
|
||||||
# /etc/llama-swap/config.yaml · known-good/ (Versions-Manifest, s. u.)
|
# known-good/ (Versions-Manifest, s. u.)
|
||||||
|
# Das abgeloeste Gedaechtnis-Sidecar (/srv/models, Port 8765) faellt seit 27.08.2026 weg —
|
||||||
|
# sein Datenverzeichnis existiert nicht mehr (Hintergrund: docs/wissen/VERDIKTE.md).
|
||||||
# NICHT enthalten (bewusst): GGUF-Modelle (riesig, neu ladbar), MC2-Code (Git), venvs.
|
# NICHT enthalten (bewusst): GGUF-Modelle (riesig, neu ladbar), MC2-Code (Git), venvs.
|
||||||
#
|
#
|
||||||
# ACHTUNG: das Tarball enthält ~/.hermes/.env (Secrets) → chmod 600, nicht in Git.
|
# ACHTUNG: das Tarball enthält ~/.hermes/.env (Secrets) → chmod 600, nicht in Git.
|
||||||
@@ -20,16 +22,14 @@ RETAIN="${MC_BACKUP_RETAIN:-14}"
|
|||||||
# Off-Box-Ziel (leer = deaktiviert). Default: Proxmox-Host, eigener Key mit minimalem Recht.
|
# Off-Box-Ziel (leer = deaktiviert). Default: Proxmox-Host, eigener Key mit minimalem Recht.
|
||||||
OFFSITE="${MC_BACKUP_OFFSITE:-root@192.168.178.108:/var/lib/vz/mc2-backups}"
|
OFFSITE="${MC_BACKUP_OFFSITE:-root@192.168.178.108:/var/lib/vz/mc2-backups}"
|
||||||
OFFSITE_KEY="${MC_BACKUP_OFFSITE_KEY:-$HOME/.ssh/mc2_offsite}"
|
OFFSITE_KEY="${MC_BACKUP_OFFSITE_KEY:-$HOME/.ssh/mc2_offsite}"
|
||||||
MEM0_DIR="${MC_MEM0_DIR:-/srv/models/mem0}"
|
|
||||||
LSWAP="${MC_CONFIG_PATH:-/etc/llama-swap/config.yaml}"
|
LSWAP="${MC_CONFIG_PATH:-/etc/llama-swap/config.yaml}"
|
||||||
HERMES="${HERMES_HOME:-$HOME/.hermes}"
|
HERMES="${HERMES_HOME:-$HOME/.hermes}"
|
||||||
TS="$(date +%Y%m%d-%H%M%S)"
|
TS="$(date +%Y%m%d-%H%M%S)"
|
||||||
|
|
||||||
STAGE="$(mktemp -d)"
|
STAGE="$(mktemp -d)"
|
||||||
trap 'rm -rf "$STAGE"' EXIT
|
trap 'rm -rf "$STAGE"' EXIT
|
||||||
mkdir -p "$STAGE/mem0" "$STAGE/hermes" "$STAGE/llama-swap"
|
mkdir -p "$STAGE/hermes" "$STAGE/llama-swap"
|
||||||
|
|
||||||
[ -d "$MEM0_DIR" ] && cp -a "$MEM0_DIR/." "$STAGE/mem0/" || true
|
|
||||||
[ -f "$HERMES/config.yaml" ] && cp -a "$HERMES/config.yaml" "$STAGE/hermes/" || true
|
[ -f "$HERMES/config.yaml" ] && cp -a "$HERMES/config.yaml" "$STAGE/hermes/" || true
|
||||||
[ -f "$HERMES/.env" ] && cp -a "$HERMES/.env" "$STAGE/hermes/" || true
|
[ -f "$HERMES/.env" ] && cp -a "$HERMES/.env" "$STAGE/hermes/" || true
|
||||||
[ -d "$HERMES/plugins" ] && cp -a "$HERMES/plugins" "$STAGE/hermes/plugins" || true
|
[ -d "$HERMES/plugins" ] && cp -a "$HERMES/plugins" "$STAGE/hermes/plugins" || true
|
||||||
@@ -60,7 +60,7 @@ SRC="${MC2_SRC:-$HOME/mission-control-v2}"
|
|||||||
HERMES_AGENT="${HERMES_AGENT_DIR:-$HOME/.hermes/hermes-agent}"
|
HERMES_AGENT="${HERMES_AGENT_DIR:-$HOME/.hermes/hermes-agent}"
|
||||||
UV="$(command -v uv || echo "$HOME/.local/bin/uv")"
|
UV="$(command -v uv || echo "$HOME/.local/bin/uv")"
|
||||||
|
|
||||||
# pip freeze je venv; mem0-venv ist uv-managed (kein pip-Modul) → uv als Fallback.
|
# pip freeze je venv; das voice-venv ist uv-managed (kein pip-Modul) → uv als Fallback.
|
||||||
freeze_venv() { # $1 = python-Pfad, $2 = Zieldatei
|
freeze_venv() { # $1 = python-Pfad, $2 = Zieldatei
|
||||||
if [ ! -x "$1" ]; then echo "venv fehlt: $1" > "$2"; return 0; fi
|
if [ ! -x "$1" ]; then echo "venv fehlt: $1" > "$2"; return 0; fi
|
||||||
"$1" -m pip freeze > "$2" 2>/dev/null \
|
"$1" -m pip freeze > "$2" 2>/dev/null \
|
||||||
@@ -68,7 +68,6 @@ freeze_venv() { # $1 = python-Pfad, $2 = Zieldatei
|
|||||||
|| echo "pip freeze fehlgeschlagen: $1" > "$2"
|
|| echo "pip freeze fehlgeschlagen: $1" > "$2"
|
||||||
}
|
}
|
||||||
freeze_venv "$SRC/backend/.venv/bin/python" "$KG/pip-backend.txt"
|
freeze_venv "$SRC/backend/.venv/bin/python" "$KG/pip-backend.txt"
|
||||||
freeze_venv "$HOME/.mem0/venv/bin/python" "$KG/pip-mem0.txt"
|
|
||||||
freeze_venv "$HOME/.voice/venv/bin/python" "$KG/pip-voice.txt"
|
freeze_venv "$HOME/.voice/venv/bin/python" "$KG/pip-voice.txt"
|
||||||
|
|
||||||
{
|
{
|
||||||
@@ -79,7 +78,7 @@ freeze_venv "$HOME/.voice/venv/bin/python" "$KG/pip-voice.txt"
|
|||||||
echo "llama.cpp : $(LD_LIBRARY_PATH=/opt/llamacpp-vulkan /usr/local/bin/llama-server --version 2>&1 | grep -m1 -o 'version: .*' || echo '?')"
|
echo "llama.cpp : $(LD_LIBRARY_PATH=/opt/llamacpp-vulkan /usr/local/bin/llama-server --version 2>&1 | grep -m1 -o 'version: .*' || echo '?')"
|
||||||
echo "llama-swap : $(/usr/local/bin/llama-swap --version 2>/dev/null | head -1 || echo '?')"
|
echo "llama-swap : $(/usr/local/bin/llama-swap --version 2>/dev/null | head -1 || echo '?')"
|
||||||
echo "python-venvs :"
|
echo "python-venvs :"
|
||||||
for P in "$SRC/backend/.venv/bin/python" "$HOME/.mem0/venv/bin/python" "$HOME/.voice/venv/bin/python"; do
|
for P in "$SRC/backend/.venv/bin/python" "$HOME/.voice/venv/bin/python"; do
|
||||||
echo " $P → $("$P" --version 2>&1 || echo 'fehlt')"
|
echo " $P → $("$P" --version 2>&1 || echo 'fehlt')"
|
||||||
done
|
done
|
||||||
} > "$KG/versions.txt" || true
|
} > "$KG/versions.txt" || true
|
||||||
@@ -92,7 +91,7 @@ cat > "$STAGE/MANIFEST.txt" <<EOF
|
|||||||
mc2-state backup
|
mc2-state backup
|
||||||
created : $TS
|
created : $TS
|
||||||
host : $(hostname)
|
host : $(hostname)
|
||||||
inhalt : mem0 (chroma + history.db), hermes (config.yaml, .env, plugins/), llama-swap (config.yaml), known-good/ (Versions-Manifest: pip freeze, Engine, Modelle)
|
inhalt : hermes (config.yaml, .env, plugins/), llama-swap (config.yaml), known-good/ (Versions-Manifest: pip freeze, Engine, Modelle)
|
||||||
restore : bash ~/mission-control-v2/deploy/restore.sh mc2-state-$TS.tar.gz
|
restore : bash ~/mission-control-v2/deploy/restore.sh mc2-state-$TS.tar.gz
|
||||||
EOF
|
EOF
|
||||||
|
|
||||||
|
|||||||
@@ -1,72 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Bagatell-Annahme — „Harmloses darf selbst" (User-Entscheid 10.07.2026, konservativ geschnitten):
|
|
||||||
# Vorschlags-Branches, die AUSSCHLIESSLICH Markdown-Dateien anlegen oder ändern (Doku/Wiki —
|
|
||||||
# keine einzige Code-Zeile, keine Löschungen, keine Umbenennungen, keine Skripte), spielt die
|
|
||||||
# Box nachts OHNE Klick ein. Der Weg ist derselbe wie beim Klick im Auftragsbuch:
|
|
||||||
# auftrag-annehmen.sh (Merge im Worktree → py_compile-Gate → Push main → Deploy → Health →
|
|
||||||
# Auto-Revert). Fangnetz drumherum: Nacht-Sicherung 03:30 (Zeitmaschine) liegt davor, die
|
|
||||||
# Morgenlage 04:30 berichtet danach, jede Annahme steht in Chronik + Telegram.
|
|
||||||
# JEDE Code-Zeile bleibt Klick-pflichtig — dieses Skript weitet die Klasse NIE selbst aus.
|
|
||||||
#
|
|
||||||
# Läuft als mc2-bagatell.timer (04:10) über eine /tmp-Kopie (Selbst-Reset-Falle: die Annahme
|
|
||||||
# deployt und resettet damit das Repo, in dem dieses Skript liegt).
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
SRC="${MC2_SRC:-$HOME/mission-control-v2}"
|
|
||||||
STATUS="${MC2_AUFTRAG_STATUS:-/srv/models/mc2-auftragsbuch.json}"
|
|
||||||
MAX_PRO_NACHT=2 # jede Annahme startet die Zentrale kurz neu — Nachtruhe wahren
|
|
||||||
|
|
||||||
cd "$SRC" || exit 0
|
|
||||||
git fetch -q --prune origin 2>/dev/null || exit 0
|
|
||||||
|
|
||||||
angenommen=0
|
|
||||||
for REF in $(git for-each-ref --format='%(refname:short)' refs/remotes/origin); do
|
|
||||||
[ "$angenommen" -ge "$MAX_PRO_NACHT" ] && break
|
|
||||||
BRANCH="${REF#origin/}"
|
|
||||||
case "$BRANCH" in wartung/*|orchestrator/*|doku/*|feature/*) ;; *) continue ;; esac
|
|
||||||
|
|
||||||
AHEAD="$(git rev-list --count "origin/main..$REF" 2>/dev/null || echo 0)"
|
|
||||||
[ "${AHEAD:-0}" -gt 0 ] || continue
|
|
||||||
|
|
||||||
# Nur unberührte Vorschläge: trägt der Branch schon irgendeinen Annahme-Status
|
|
||||||
# (läuft/fehlgeschlagen/zurückgerollt/…), entscheidet der Commander — nicht wir.
|
|
||||||
STATE="$(python3 - "$STATUS" "$BRANCH" <<'PY'
|
|
||||||
import json, sys
|
|
||||||
try:
|
|
||||||
print((json.load(open(sys.argv[1], encoding="utf-8")).get("branches", {}).get(sys.argv[2]) or {}).get("state", ""))
|
|
||||||
except Exception:
|
|
||||||
print("")
|
|
||||||
PY
|
|
||||||
)"
|
|
||||||
[ -z "$STATE" ] || continue
|
|
||||||
|
|
||||||
# Bagatell-Klasse: JEDE geänderte Datei endet auf .md UND ist nur angelegt (A) oder
|
|
||||||
# geändert (M). Alles andere (Löschung, Rename R…, Copy C…, Nicht-Markdown) → Klick-Pflicht.
|
|
||||||
DIFF="$(git diff --name-status "origin/main...$REF" 2>/dev/null)"
|
|
||||||
[ -n "$DIFF" ] || continue
|
|
||||||
OK=1
|
|
||||||
while IFS=$'\t' read -r st path _rest; do
|
|
||||||
[ -n "$st" ] || continue
|
|
||||||
case "$st" in A|M) ;; *) OK=0; break ;; esac
|
|
||||||
case "$path" in *.md) ;; *) OK=0; break ;; esac
|
|
||||||
done <<< "$DIFF"
|
|
||||||
[ "$OK" = 1 ] || continue
|
|
||||||
|
|
||||||
N="$(printf '%s\n' "$DIFF" | wc -l | tr -d ' ')"
|
|
||||||
echo "Bagatelle erkannt: $BRANCH ($N Markdown-Datei(en))"
|
|
||||||
curl -sf -m 5 -X POST "${MC_ANNOUNCE_URL:-http://127.0.0.1:9001/api/voice/announce}" \
|
|
||||||
-H 'Content-Type: application/json' \
|
|
||||||
--data "$(jq -n --arg t "Bagatelle (nur Doku, $N Datei(en)): '$BRANCH' wird ohne Klick eingespielt — Fangnetz aktiv, Details in der Morgenlage." \
|
|
||||||
'{text:$t, subject:"[Bagatell-Annahme]", source:"bagatell", priority:"silent"}')" >/dev/null 2>&1 || true
|
|
||||||
|
|
||||||
RUNNER="/tmp/mc2-bagatell-annehmen-$$.sh"
|
|
||||||
cp "$SRC/deploy/auftrag-annehmen.sh" "$RUNNER" || continue
|
|
||||||
if bash "$RUNNER" "$BRANCH"; then
|
|
||||||
angenommen=$((angenommen+1))
|
|
||||||
else
|
|
||||||
# auftrag-annehmen.sh hat selbst gemeldet (fehlgeschlagen/zurückgerollt) und aufgeräumt;
|
|
||||||
# der Branch trägt jetzt einen Status → nächste Nacht fasst ihn niemand mehr automatisch an.
|
|
||||||
echo "Bagatell-Annahme von $BRANCH nicht grün — Meldung kam vom Annahme-Runner."
|
|
||||||
fi
|
|
||||||
done
|
|
||||||
echo "Bagatell-Lauf fertig: $angenommen eingespielt."
|
|
||||||
@@ -7,7 +7,7 @@ set -u
|
|||||||
MODEL="${BRAIN_GGUF:-/srv/models/Qwen3.6-35B-A3B-MTP-GGUF/Qwen3.6-35B-A3B-UD-Q4_K_M.gguf}"
|
MODEL="${BRAIN_GGUF:-/srv/models/Qwen3.6-35B-A3B-MTP-GGUF/Qwen3.6-35B-A3B-UD-Q4_K_M.gguf}"
|
||||||
BIN="${BENCH_BIN:-/opt/llamacpp-vulkan/llama-server}"
|
BIN="${BENCH_BIN:-/opt/llamacpp-vulkan/llama-server}"
|
||||||
PORT="${BENCH_PORT:-5899}"
|
PORT="${BENCH_PORT:-5899}"
|
||||||
BASE="-c 65536 -ngl 999 -fa on --no-mmap --jinja --parallel 1"
|
BASE="-c 65536 -ngl 999 -fa on --load-mode none --jinja --parallel 1"
|
||||||
|
|
||||||
run() { # $1=name $2=extra-flags
|
run() { # $1=name $2=extra-flags
|
||||||
echo "=== $1 ==="
|
echo "=== $1 ==="
|
||||||
|
|||||||
@@ -13,7 +13,7 @@ PORT="${BENCH_PORT:-5899}"
|
|||||||
CTX="${BENCH_CTX:-32768}"
|
CTX="${BENCH_CTX:-32768}"
|
||||||
|
|
||||||
echo "=== Bench: $(basename "$MODEL") (ctx $CTX${EXTRA:+, $EXTRA}) ==="
|
echo "=== Bench: $(basename "$MODEL") (ctx $CTX${EXTRA:+, $EXTRA}) ==="
|
||||||
$BIN -m "$MODEL" --host 127.0.0.1 --port "$PORT" -c "$CTX" -ngl 999 -fa on --no-mmap --jinja $EXTRA \
|
$BIN -m "$MODEL" --host 127.0.0.1 --port "$PORT" -c "$CTX" -ngl 999 -fa on --load-mode none --jinja $EXTRA \
|
||||||
>/tmp/model-bench-server.log 2>&1 &
|
>/tmp/model-bench-server.log 2>&1 &
|
||||||
PID=$!
|
PID=$!
|
||||||
trap 'kill $PID 2>/dev/null; wait $PID 2>/dev/null' EXIT
|
trap 'kill $PID 2>/dev/null; wait $PID 2>/dev/null' EXIT
|
||||||
|
|||||||
@@ -1,104 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Chef-Gutachter-Feed (Orchestrator-Finale, User-Idee 06.07.): gpt-oss-120b als NÄCHTLICHER
|
|
||||||
# Chef-Gutachter über die autonome Arbeit der Box — bewusst NIE im heißen Pfad (Kaltladen
|
|
||||||
# ~2-5 min ist um 04:30 egal; tagsüber bleibt Lucy schnell). Muster wie dreaming-feed.sh:
|
|
||||||
# liegt in ~/.hermes/scripts/, stdout wird dem Cron-Agenten als Prompt eingespeist.
|
|
||||||
# Der eigentliche RICHTER läuft als Ein-Schuss-Completion direkt gegen llama-swap (:8080,
|
|
||||||
# fremdblick-Architektur — umgeht Hermes' Delegations-Floor und braucht keinen Subagenten).
|
|
||||||
# Richter-Kette: gpt-oss-120b; wirft der beim Laden "exited prematurely" (neben dem Warm-Set
|
|
||||||
# live gesehen, E2E 07.07.), übernimmt GLM-4.6V-Flash als gekennzeichnete VERTRETUNG.
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
ENDPOINT="${CHEF_ENDPOINT:-http://127.0.0.1:8080/v1/chat/completions}"
|
|
||||||
CHEF="${CHEF_MODEL:-gpt-oss-120b}"
|
|
||||||
VERTRETUNG="${CHEF_FALLBACK:-GLM-4.7-Flash}"
|
|
||||||
MC="$HOME/mission-control-v2"
|
|
||||||
VAULT="$HOME/wissens-vault"
|
|
||||||
|
|
||||||
# ---------- Versionierter Auftrag für den Boten-Agenten ----------
|
|
||||||
cat "$MC/deploy/chef-gutachter-prompt.md"
|
|
||||||
echo
|
|
||||||
|
|
||||||
# ---------- Beweismaterial der letzten 24 h (hart begrenzt, erst sammeln, dann kürzen) ----------
|
|
||||||
EVID="$(
|
|
||||||
echo "## BEWEISMATERIAL (automatisch erhoben am $(date '+%d.%m.%Y %H:%M'))"
|
|
||||||
echo
|
|
||||||
echo "### Vorschlags-Branches (Werkstatt/Orchestrator, jüngste zuerst):"
|
|
||||||
git -C "$MC" fetch -q origin 2>/dev/null || true
|
|
||||||
git -C "$MC" for-each-ref --sort=-committerdate refs/remotes/origin \
|
|
||||||
--format='%(committerdate:relative) | %(refname:short) | %(subject)' 2>/dev/null | head -10
|
|
||||||
echo
|
|
||||||
echo "### main-Commits der letzten 24 h:"
|
|
||||||
git -C "$MC" log --since='24 hours ago' --oneline origin/main 2>/dev/null | head -12
|
|
||||||
echo
|
|
||||||
echo "### Wissens-Vault (neue Traum-Notizen, 24 h):"
|
|
||||||
git -C "$VAULT" log --since='24 hours ago' --name-only --pretty='— %s' 2>/dev/null | head -20
|
|
||||||
echo
|
|
||||||
echo "### Ideen-Queue (natives Kanban, Stand jetzt — offene Ideen des Commanders):"
|
|
||||||
bash -lc 'hermes kanban stats' 2>/dev/null | head -12
|
|
||||||
echo
|
|
||||||
echo "### Ideen-Queue: zuletzt bewegte Aufgaben:"
|
|
||||||
bash -lc 'hermes kanban list --sort updated' 2>/dev/null | head -10
|
|
||||||
echo
|
|
||||||
echo "### Betriebs-Warnungen (journal, 24 h, je Dienst gezählt):"
|
|
||||||
journalctl --user --since '24 hours ago' -p warning --no-pager 2>/dev/null \
|
|
||||||
| grep -oE 'hermes-gateway|mission-control-2|mem0-service|voice-service|hermes-builtin-ui' \
|
|
||||||
| sort | uniq -c | sort -rn | head -6
|
|
||||||
echo
|
|
||||||
echo "### Aktivitäts-Insights (1 Tag):"
|
|
||||||
bash -lc 'hermes insights --days 1' 2>/dev/null | sed 's/\x1b\[[0-9;]*m//g' | head -30
|
|
||||||
)"
|
|
||||||
|
|
||||||
RASTER='Du bist der CHEF-GUTACHTER über die autonome Arbeit einer lokalen KI-Box (Hermes-Agent, Werkstatt, Orchestrator, Traum-Kreislauf). Du bekommst BEWEISMATERIAL der letzten 24 Stunden. Urteile AUSSCHLIESSLICH auf Basis dieses Materials — kein Lob und keine Behauptung ohne konkreten Beleg darin; fehlt dir zu einem Punkt Material, sage das offen. Antworte auf DEUTSCH, kompakt, in exakt dieser Struktur:
|
|
||||||
VERDIKT: <ein Satz Gesamturteil über die autonome Arbeit der Nacht/des Tages>
|
|
||||||
RISIKEN: <0-3 Punkte, je mit Beleg aus dem Material; "keine erkennbar" wenn leer>
|
|
||||||
TOP-3 FUER DEN COMMANDER: <maximal 3 priorisierte, konkrete Empfehlungen — weniger ist ok, erfinde keine>'
|
|
||||||
|
|
||||||
# Ein-Schuss-Richter: $1=Modell-ID $2=curl-Timeout $3=max_tokens
|
|
||||||
judge() {
|
|
||||||
local req
|
|
||||||
req="$(jq -n --arg m "$1" --arg sys "$RASTER" --arg usr "$EVID" --argjson mt "$3" \
|
|
||||||
'{model:$m, messages:[{role:"system",content:$sys},{role:"user",content:$usr}],
|
|
||||||
max_tokens:$mt, temperature:0.2}')"
|
|
||||||
curl -s -m "$2" "$ENDPOINT" -H 'Content-Type: application/json' --data-binary "$req" \
|
|
||||||
| python3 -c '
|
|
||||||
import json, sys
|
|
||||||
try:
|
|
||||||
d = json.load(sys.stdin)
|
|
||||||
msg = d["choices"][0]["message"]
|
|
||||||
out = (msg.get("content") or msg.get("reasoning_content") or "").strip()
|
|
||||||
print(out)
|
|
||||||
except Exception:
|
|
||||||
pass'
|
|
||||||
}
|
|
||||||
|
|
||||||
RICHTER="$CHEF"
|
|
||||||
VERDIKT="$(judge "$CHEF" 420 2600)"
|
|
||||||
if [ -z "${VERDIKT// /}" ]; then
|
|
||||||
RICHTER="$VERTRETUNG (Vertretung — $CHEF hat nicht geladen)"
|
|
||||||
VERDIKT="$(judge "$VERTRETUNG" 240 1200)"
|
|
||||||
fi
|
|
||||||
|
|
||||||
echo "$EVID"
|
|
||||||
echo
|
|
||||||
if [ -z "${VERDIKT// /}" ]; then
|
|
||||||
echo "## CHEF-VERDIKT: AUSGEFALLEN"
|
|
||||||
echo "Beide Richter ($CHEF, $VERTRETUNG) haben nicht geantwortet — das dem Commander ehrlich melden."
|
|
||||||
else
|
|
||||||
echo "## CHEF-VERDIKT (Richter: $RICHTER)"
|
|
||||||
echo "$VERDIKT"
|
|
||||||
fi
|
|
||||||
|
|
||||||
# Morgenlage für die Zentrale: das Verdikt STILL in den Briefkasten spiegeln (priority=silent —
|
|
||||||
# Lucy soll die Wand Text nicht vorlesen; die Telegram-Botschaft macht der Cron-Agent selbst).
|
|
||||||
# Cockpit („Morgenlage"-Karte) und Chronik lesen es dort mit source=chef-gutachter heraus.
|
|
||||||
if [ -n "${VERDIKT// /}" ]; then
|
|
||||||
curl -sf -m 5 -X POST "${MC_ANNOUNCE_URL:-http://127.0.0.1:9001/api/voice/announce}" \
|
|
||||||
-H 'Content-Type: application/json' \
|
|
||||||
--data "$(python3 - "$RICHTER" "$VERDIKT" <<'PY'
|
|
||||||
import json, sys
|
|
||||||
print(json.dumps({"text": sys.argv[2], "subject": f"Morgenlage (Richter: {sys.argv[1]})",
|
|
||||||
"source": "chef-gutachter", "priority": "silent"}))
|
|
||||||
PY
|
|
||||||
)" >/dev/null 2>&1 || true
|
|
||||||
fi
|
|
||||||
@@ -1,15 +0,0 @@
|
|||||||
# Auftrag: Nacht-Gutachten überbringen (Chef-Gutachter-Cron)
|
|
||||||
|
|
||||||
Du bist Lucy. Unten stehen (1) BEWEISMATERIAL der letzten 24 Stunden und (2) das
|
|
||||||
CHEF-VERDIKT eines großen Gutachter-Modells darüber. Deine Aufgabe ist NUR das Überbringen
|
|
||||||
an den Commander per Telegram — kurz, in deiner Stimme, ohne Werkzeuge.
|
|
||||||
|
|
||||||
Regeln:
|
|
||||||
1. EIN einleitender Satz von dir (z. B. wie die Nacht lief), dann das Verdikt.
|
|
||||||
2. Gib VERDIKT, RISIKEN und TOP-3 des Chef-Gutachters TREU wieder — nicht weichspülen,
|
|
||||||
nicht kürzen bei Risiken, NICHTS dazuerfinden. Du bist die Botin, nicht die Richterin.
|
|
||||||
3. Nenne am Ende in Klammern den Richter (steht über dem Verdikt: gpt-oss-120b oder
|
|
||||||
die GLM-Vertretung).
|
|
||||||
4. Steht dort „CHEF-VERDIKT: AUSGEFALLEN", melde genau das ehrlich — kein Ersatz-Urteil
|
|
||||||
von dir.
|
|
||||||
5. Telegram-tauglich: kompakt, keine Markdown-Tabellen, echte Umlaute.
|
|
||||||
@@ -0,0 +1,77 @@
|
|||||||
|
#!/usr/bin/env bash
|
||||||
|
# coder-vollkontext.sh — gibt dem Coder den ganzen Kontext (23.08.2026).
|
||||||
|
#
|
||||||
|
# WARUM: llama-swap startet den Coder mit `-c 131072 --parallel 2`. Das sind
|
||||||
|
# zwei Slots à 65.536 — und nur diese 65.536 stehen einer Sitzung zur Verfuegung.
|
||||||
|
# Der Coder hat aber genau EINEN Verbraucher: OpenChamber. Lucy benutzt `hermes`,
|
||||||
|
# der explore-Subagent auch, `review` benutzt `heavy`. Die zweite Bahn liegt brach.
|
||||||
|
#
|
||||||
|
# Mit `--parallel 1` bekommt eine Sitzung die vollen 131.072 — doppelt so viel
|
||||||
|
# Platz, halb so viel Komprimieren.
|
||||||
|
#
|
||||||
|
# ‼️ NICHT waehrend eines laufenden Auftrags ausfuehren: llama-swap laeuft mit
|
||||||
|
# --watch-config und laedt beim Speichern SOFORT neu. Das schneidet eine
|
||||||
|
# laufende Sitzung mitten im Satz ab.
|
||||||
|
#
|
||||||
|
# Aufruf: bash deploy/coder-vollkontext.sh (Trockenlauf, zeigt den Diff)
|
||||||
|
# bash deploy/coder-vollkontext.sh --ja (wendet an)
|
||||||
|
set -uo pipefail
|
||||||
|
|
||||||
|
CONF="${LLAMA_SWAP_CONF:-/etc/llama-swap/config.yaml}"
|
||||||
|
BLOCK="${CODER_BLOCK:- Qwen3.8-27B:}"
|
||||||
|
|
||||||
|
if [ ! -r "$CONF" ]; then echo "ABBRUCH: $CONF nicht lesbar"; exit 1; fi
|
||||||
|
|
||||||
|
TMP="$(mktemp)"
|
||||||
|
cp "$CONF" "$TMP"
|
||||||
|
|
||||||
|
python3 - "$TMP" "$BLOCK" <<'PY'
|
||||||
|
import io, re, sys
|
||||||
|
pfad, block = sys.argv[1], sys.argv[2]
|
||||||
|
z = io.open(pfad, encoding="utf-8").read().split("\n")
|
||||||
|
try:
|
||||||
|
start = next(i for i, l in enumerate(z) if l.startswith(block))
|
||||||
|
except StopIteration:
|
||||||
|
print("ABBRUCH: Block '%s' nicht gefunden" % block); sys.exit(1)
|
||||||
|
ende = next((i for i in range(start + 1, len(z)) if re.match(r"^ [A-Za-z]", z[i])), len(z))
|
||||||
|
|
||||||
|
# Streng auf den Coder-Block begrenzt — `fast`/`hermes` MUESSEN ihre zwei Slots
|
||||||
|
# behalten, dort greifen Lucy und der Explorer wirklich gleichzeitig zu.
|
||||||
|
n_par = n_ctx = 0
|
||||||
|
for i in range(start, ende):
|
||||||
|
if "--parallel 2" in z[i]:
|
||||||
|
z[i] = z[i].replace("--parallel 2", "--parallel 1"); n_par += 1
|
||||||
|
if z[i].strip() == "context: 65536":
|
||||||
|
z[i] = z[i].replace("65536", "131072"); n_ctx += 1
|
||||||
|
|
||||||
|
if n_par != 1 or n_ctx != 1:
|
||||||
|
print(f"ABBRUCH: unerwartet (parallel {n_par}x, context {n_ctx}x) — Konfiguration hat sich geaendert")
|
||||||
|
sys.exit(1)
|
||||||
|
io.open(pfad, "w", encoding="utf-8").write("\n".join(z))
|
||||||
|
PY
|
||||||
|
if [ $? -ne 0 ]; then rm -f "$TMP"; exit 1; fi
|
||||||
|
|
||||||
|
echo "=== Aenderung ==="
|
||||||
|
diff "$CONF" "$TMP"
|
||||||
|
echo
|
||||||
|
|
||||||
|
if [ "${1:-}" != "--ja" ]; then
|
||||||
|
echo "TROCKENLAUF — nichts geaendert. Anwenden mit: bash $0 --ja"
|
||||||
|
rm -f "$TMP"; exit 0
|
||||||
|
fi
|
||||||
|
|
||||||
|
SICHER="${CONF}.bak-$(date +%Y%m%d-%H%M%S)"
|
||||||
|
sudo -n cp "$CONF" "$SICHER" && echo "Sicherung: $SICHER"
|
||||||
|
sudo -n cp "$TMP" "$CONF" && echo "angewendet — llama-swap laedt durch --watch-config selbst neu"
|
||||||
|
rm -f "$TMP"
|
||||||
|
|
||||||
|
echo
|
||||||
|
echo "Warte auf den Neustart des Coders..."
|
||||||
|
sleep 8
|
||||||
|
curl -s -m 15 "http://127.0.0.1:8080/v1/models" >/dev/null 2>&1 \
|
||||||
|
&& echo "llama-swap antwortet wieder" \
|
||||||
|
|| echo "ACHTUNG: llama-swap antwortet nicht — Sicherung liegt unter $SICHER"
|
||||||
|
|
||||||
|
echo
|
||||||
|
echo "Danach in ~/.config/opencode/opencode.json auf dem PC nachziehen:"
|
||||||
|
echo " coder: limit.context 65536 -> 131072"
|
||||||
+65
-281
@@ -1,292 +1,76 @@
|
|||||||
#!/usr/bin/env bash
|
#!/bin/bash
|
||||||
# Deploy AUF DER BOX als systemd-USER-Dienst — KEIN sudo, KEIN /opt, KEIN Passwort.
|
set -e
|
||||||
# Erstinstallation + Updates in einem. Läuft als User hitonabi.
|
|
||||||
#
|
|
||||||
# Erstinstallation (einmalig):
|
|
||||||
# git clone https://git.tobisniceshomelab.ddnsfree.com/Hitonabi/mission-control-v2 ~/mission-control-v2
|
|
||||||
# bash ~/mission-control-v2/deploy/deploy.sh
|
|
||||||
set -euo pipefail
|
|
||||||
|
|
||||||
SRC="${MC2_SRC:-$HOME/mission-control-v2}"
|
# ‼️ Das ganze Skript liegt in EINER Funktion — das ist Absicht, kein Stil.
|
||||||
|
# Bash liest ein Skript haeppchenweise WAEHREND es laeuft. `git pull` unten ersetzt
|
||||||
|
# genau diese Datei mitten im Lauf; danach liest bash am selben Byte-Offset im NEUEN
|
||||||
|
# Text weiter und fuehrt zerschnittene Zeilen aus. Live erlebt am 27.08.2026: der Pull
|
||||||
|
# brachte eine neue Fassung dieses Schrittes mit, ausgefuehrt wurde trotzdem die alte.
|
||||||
|
# Eine Funktion wird komplett geparst, bevor sie startet -> der Lauf bleibt in sich
|
||||||
|
# stimmig, und Aenderungen greifen ab dem naechsten Aufruf statt mittendrin.
|
||||||
|
main() {
|
||||||
|
|
||||||
cd "$SRC"
|
echo "Starte MC2 Deployment..."
|
||||||
git fetch -q origin && git reset -q --hard origin/main
|
|
||||||
|
|
||||||
# ★ Selbst-Reset-Falle (15.07. beim P1-Deploy live gebissen): der reset oben ersetzt auch
|
# 1. Neuesten Code holen
|
||||||
# DIESE Datei, und bash liest laufende Skripte häppchenweise von der Platte weiter — ab
|
git pull origin main
|
||||||
# hier liefe ein Zeilen-Mix aus alter+neuer Version (beim P1-Deploy fielen so daemon-reload
|
|
||||||
# und der mc2-gateway-Start unter den Tisch). Darum: nach dem Reset genau EINMAL die
|
|
||||||
# frische Version neu ausführen; der zweite Durchlauf überspringt dank Env-Marke nichts.
|
|
||||||
if [ "${MC2_DEPLOY_REEXEC:-0}" != "1" ]; then
|
|
||||||
export MC2_DEPLOY_REEXEC=1
|
|
||||||
exec bash "$SRC/deploy/deploy.sh"
|
|
||||||
fi
|
|
||||||
|
|
||||||
# venv + Abhängigkeiten
|
|
||||||
if [ ! -d "$SRC/backend/.venv" ]; then
|
|
||||||
python3 -m venv "$SRC/backend/.venv"
|
|
||||||
fi
|
|
||||||
"$SRC/backend/.venv/bin/python" -m pip install -q --upgrade pip
|
|
||||||
"$SRC/backend/.venv/bin/python" -m pip install -q -r "$SRC/backend/requirements.txt"
|
|
||||||
|
|
||||||
# Mem0-Sidecar (auto-lernendes Gedächtnis) — eigenes Python-3.12-venv (~/.mem0/venv),
|
# 2. Abhängigkeiten prüfen (falls sich was geändert hat)
|
||||||
# weil mem0+chromadb unter dem 3.14-Backend-venv nicht laufen. mem0ai/chromadb sind dort
|
echo "Aktualisiere Python Abhängigkeiten..."
|
||||||
# bereits installiert; hier nur den HTTP-Server nachziehen + Alt-DB einmalig migrieren.
|
backend/.venv/bin/pip install -r backend/requirements.txt
|
||||||
if [ -x "$HOME/.mem0/venv/bin/python" ]; then
|
|
||||||
# ~/.mem0/venv ist uv-managed (kein pip) → uv pip nutzen.
|
|
||||||
UV="$(command -v uv || echo "$HOME/.local/bin/uv")"
|
|
||||||
"$UV" pip install -q --python "$HOME/.mem0/venv/bin/python" -r "$SRC/mem0_service/requirements.txt"
|
|
||||||
( cd "$SRC/mem0_service" && "$HOME/.mem0/venv/bin/python" migrate.py ) || true
|
|
||||||
else
|
|
||||||
echo "WARN: ~/.mem0/venv fehlt — Mem0-Sidecar wird nicht gestartet (siehe Plan A1)."
|
|
||||||
fi
|
|
||||||
|
|
||||||
# Voice-Sidecar (lokales STT + gestuftes TTS für „Mit Hermes reden") — eigenes Python-3.12-venv
|
# 3. Llama-Swap Konfiguration prüfen und synchronisieren
|
||||||
# (~/.voice/venv), weil torch/chatterbox/faster-whisper nicht ins 3.14-Backend-venv passen.
|
#
|
||||||
# install.sh ist idempotent (venv + Deps + Piper-Stimmen). Best-effort: schlägt es fehl, läuft
|
# ‼️ ACHTUNG (27.08.2026): /etc/llama-swap/config.yaml ist die LEBENDE Wahrheit — MC2
|
||||||
# der restliche Stack weiter (der Voice-Tab meldet den Sidecar dann als offline).
|
# schreibt sie selbst (backend/services/llamaswap.py::write_config), sobald jemand über
|
||||||
bash "$SRC/voice_service/install.sh" || echo "WARN: Voice-Sidecar-Setup fehlgeschlagen — Voice-Tab bleibt offline."
|
# die Oberfläche ein Modell hinzufügt oder eine Rolle ändert. deploy/llama-swap.config.yaml
|
||||||
|
# ist nur ein Abzug und hinkt regelmäßig hinterher (erlebt: der Coder-Vollkontext aus 34a9862
|
||||||
# Hermes-Memory-Provider-Plugin (auto-lernen/Recall via Mem0-Sidecar) nach ~/.hermes/plugins/
|
# stand tagelang nur live, nicht im Abzug — ein Deploy hätte ihn zurückgesetzt).
|
||||||
# spiegeln. Context-only (kein Tool-Loop). Aktivierung in ~/.hermes/config.yaml:
|
# Bis hierher wurde die Live-Datei kommentarlos mit dem Abzug überschrieben — alles per
|
||||||
# memory.memory_enabled: true + memory.provider: mc2-memory (einmalig, box-lokal).
|
# UI Hinzugefügte war nach jedem Deploy weg. Jetzt: erst sichern, dann kopieren, und die
|
||||||
if [ -d "$HOME/.hermes" ]; then
|
# Abweichung sichtbar machen. MC_DEPLOY_SKIP_SWAP_CONFIG=1 überspringt den Schritt ganz.
|
||||||
mkdir -p "$HOME/.hermes/plugins/mc2-memory"
|
if ! cmp -s deploy/llama-swap.config.yaml /etc/llama-swap/config.yaml; then
|
||||||
cp "$SRC/hermes/plugins/mc2-memory/__init__.py" "$SRC/hermes/plugins/mc2-memory/plugin.yaml" \
|
if [ "${MC_DEPLOY_SKIP_SWAP_CONFIG:-0}" = "1" ]; then
|
||||||
"$HOME/.hermes/plugins/mc2-memory/"
|
echo "Llama-Swap Konfiguration weicht ab — uebersprungen (MC_DEPLOY_SKIP_SWAP_CONFIG=1)."
|
||||||
fi
|
|
||||||
|
|
||||||
# systemd-USER-Units installieren/aktualisieren
|
|
||||||
mkdir -p "$HOME/.config/systemd/user"
|
|
||||||
cp "$SRC/deploy/mission-control-2.service" "$HOME/.config/systemd/user/mission-control-2.service"
|
|
||||||
# MC2-Diät (Hermes Desktop, 07/2026): das Hermes-Terminal-ttyd (:7681) und das standalone
|
|
||||||
# hermes-webui (nesquena, Karteileiche seit dem Built-in-UI-Umbau) sind entfallen — die
|
|
||||||
# Agent-Oberfläche ist die Desktop-App bzw. /hermes-ui/. Einmalige, idempotente Stilllegung:
|
|
||||||
systemctl --user disable --now hermes-terminal 2>/dev/null || true
|
|
||||||
systemctl --user disable --now hermes-webui 2>/dev/null || true
|
|
||||||
rm -f "$HOME/.config/systemd/user/hermes-terminal.service" "$HOME/.config/systemd/user/hermes-webui.service"
|
|
||||||
# Box-Konsole (ttyd -> Login-Shell auf :7682), in MC2 als Konsole-Seite eingebettet.
|
|
||||||
cp "$SRC/deploy/box-console.service" "$HOME/.config/systemd/user/box-console.service"
|
|
||||||
# MC2-Gateway (UMBAU v3 P1): der /v1-Datenpfad als eigener Prozess (Loopback :9010,
|
|
||||||
# Restart=always) — Lucys Hirn + Nacht-Autonomie überleben damit jeden MC2-Neustart.
|
|
||||||
cp "$SRC/deploy/mc2-gateway.service" "$HOME/.config/systemd/user/mc2-gateway.service"
|
|
||||||
# MC2-Steward (UMBAU v3 P2): Wächter-Loops (Re-Warm/Sentry/Dedupe) als eigener Dienst —
|
|
||||||
# überleben MC2-Neustarts und melden erstmals auch ein totes Steuerpult (Telegram).
|
|
||||||
cp "$SRC/deploy/mc2-steward.service" "$HOME/.config/systemd/user/mc2-steward.service"
|
|
||||||
# Mem0-Sidecar-Unit (nur wenn das venv existiert).
|
|
||||||
[ -x "$HOME/.mem0/venv/bin/python" ] && cp "$SRC/deploy/mem0-service.service" "$HOME/.config/systemd/user/mem0-service.service"
|
|
||||||
# Voice-Sidecar-Unit (nur wenn das venv existiert).
|
|
||||||
[ -x "$HOME/.voice/venv/bin/python" ] && cp "$SRC/deploy/voice-service.service" "$HOME/.config/systemd/user/voice-service.service"
|
|
||||||
# Tägliches Zustands-Backup (mem0 + Configs/Secrets) — Timer + oneshot-Service. Siehe docs/BACKUP.md.
|
|
||||||
cp "$SRC/deploy/mc2-backup.service" "$HOME/.config/systemd/user/mc2-backup.service"
|
|
||||||
cp "$SRC/deploy/mc2-backup.timer" "$HOME/.config/systemd/user/mc2-backup.timer"
|
|
||||||
# Wöchentliches Auto-Update (Router/Engine/Hermes, Rollback+Pin+Telegram) — Autonomie E2.
|
|
||||||
cp "$SRC/deploy/mc2-autoupdate.service" "$HOME/.config/systemd/user/mc2-autoupdate.service"
|
|
||||||
cp "$SRC/deploy/mc2-autoupdate.timer" "$HOME/.config/systemd/user/mc2-autoupdate.timer"
|
|
||||||
# Tägliche Selbst-Smoke-Tests (Gateway/Tools/Voice aktiv, Alarm bei Rot) — Autonomie 0d.
|
|
||||||
cp "$SRC/deploy/mc2-selfsmoke.service" "$HOME/.config/systemd/user/mc2-selfsmoke.service"
|
|
||||||
cp "$SRC/deploy/mc2-selfsmoke.timer" "$HOME/.config/systemd/user/mc2-selfsmoke.timer"
|
|
||||||
# Bagatell-Annahme (Ideen-Queue, 10.07.2026): reine Doku-Vorschläge nachts ohne Klick einspielen.
|
|
||||||
cp "$SRC/deploy/mc2-bagatell.service" "$HOME/.config/systemd/user/mc2-bagatell.service"
|
|
||||||
cp "$SRC/deploy/mc2-bagatell.timer" "$HOME/.config/systemd/user/mc2-bagatell.timer"
|
|
||||||
# Evolution-Radar-Feed (Autonomie E4): Hermes-cron speist ihn als Prompt ein.
|
|
||||||
# Cron-Job selbst wird EINMALIG registriert (hermes cron create, siehe docs/RUNBOOK.md).
|
|
||||||
mkdir -p "$HOME/.hermes/scripts"
|
|
||||||
cp "$SRC/deploy/radar-feed.sh" "$HOME/.hermes/scripts/radar-feed.sh"
|
|
||||||
# Selbstkritik-Cron (Faden 11b): Zwilling des Radars, Blick nach INNEN (Latenzen/Journal/Skills).
|
|
||||||
cp "$SRC/deploy/selbstkritik-feed.sh" "$HOME/.hermes/scripts/selbstkritik-feed.sh"
|
|
||||||
# Monats-Review-Wrapper (Cron 1. d. M. 09:00): Radar + Selbstkritik in EINEM Lauf.
|
|
||||||
cp "$SRC/deploy/radar-selbstkritik-wrapper.sh" "$HOME/.hermes/scripts/radar-selbstkritik-wrapper.sh"
|
|
||||||
# Traum-Cron (Dreaming, Phase 2): Blick auf das GELERNTE → Wissens-Vault. Bootstrappt ~/wissens-vault.
|
|
||||||
cp "$SRC/deploy/dreaming-feed.sh" "$HOME/.hermes/scripts/dreaming-feed.sh"
|
|
||||||
# Fremdblick-Helfer: Ein-Schuss-Zweitmeinung von einem anderen Modell (umgeht 64K-Delegations-Floor).
|
|
||||||
cp "$SRC/deploy/fremdblick.sh" "$HOME/.hermes/scripts/fremdblick.sh"
|
|
||||||
# Worker-Helfer (Orchestrator): Ein-Schuss-Arbeitsauftrag an ein Worker-Modell (Gegenstück zu fremdblick).
|
|
||||||
cp "$SRC/deploy/worker.sh" "$HOME/.hermes/scripts/worker.sh"
|
|
||||||
# Chef-Gutachter-Cron (Orchestrator-Finale): gpt-oss urteilt nachts über die autonome Arbeit.
|
|
||||||
cp "$SRC/deploy/chef-gutachter-feed.sh" "$HOME/.hermes/scripts/chef-gutachter-feed.sh"
|
|
||||||
# Release-Radar-Cron (10.07.2026): hält neue hermes-agent-Releases wöchentlich gegen die
|
|
||||||
# Eigenbau-Landkarte im Wissens-Vault ("mehr Hermes nativ, weniger Eigenkreationen").
|
|
||||||
cp "$SRC/deploy/hermes-release-radar-feed.sh" "$HOME/.hermes/scripts/hermes-release-radar-feed.sh"
|
|
||||||
# Idle-Radar (S4 "Zuendung", 12.07.2026): die Box gibt sich nachts selbst Arbeit —
|
|
||||||
# Journal-Fehlermuster + Traum-Funde -> belegte rohe Ideen (triage) im nativen Kanban.
|
|
||||||
cp "$SRC/deploy/idle-radar-feed.sh" "$HOME/.hermes/scripts/idle-radar-feed.sh"
|
|
||||||
# "Lucy kennt sich" (12.07.2026): Selbst-Inventur generiert den Steckbrief + bemerkt
|
|
||||||
# eigene Aenderungen; der Karten-Gutachter stempelt jede Karte mit einer Empfehlung.
|
|
||||||
cp "$SRC/deploy/selbst-inventur.sh" "$HOME/.hermes/scripts/selbst-inventur.sh"
|
|
||||||
cp "$SRC/deploy/karten-gutachter.sh" "$HOME/.hermes/scripts/karten-gutachter.sh"
|
|
||||||
# Trend-Radar (17.07.2026, Sa 05:15): Live-Puls aller Rollen + Engine-A/B + Watch-Liste +
|
|
||||||
# HF-Kandidaten-Suche → max. 1 Prüfstand-Kandidat/Woche. Prüfstand (So 01:00, --no-agent):
|
|
||||||
# volles Programm (Coding/Agent/Recherche/Deutsch/Vision) gegen die Amtsinhaber-Baseline;
|
|
||||||
# Harness + Suiten liegen im Repo ($SRC/deploy/pruefstand/), nur der Runner wird kopiert.
|
|
||||||
cp "$SRC/deploy/trend-radar-feed.sh" "$HOME/.hermes/scripts/trend-radar-feed.sh"
|
|
||||||
cp "$SRC/deploy/pruefstand/pruefstand.sh" "$HOME/.hermes/scripts/pruefstand.sh"
|
|
||||||
# Restore-Probe + Venv-Audit (17.07.2026, monatliche --no-agent-Crons): echte
|
|
||||||
# Wiederherstellungs-Drills (PBS-Canary + Tarball) und CVE-/Outdated-Audit der
|
|
||||||
# Python-Nebendienst-venvs (mem0, voice) — melden nur, ändern nichts.
|
|
||||||
cp "$SRC/deploy/restore-probe.sh" "$HOME/.hermes/scripts/restore-probe.sh"
|
|
||||||
cp "$SRC/deploy/venv-audit.sh" "$HOME/.hermes/scripts/venv-audit.sh"
|
|
||||||
# mem0-Konsolidierung (monatlich am 3., 19.07.2026): legt aehnliche Fakten zusammen,
|
|
||||||
# loest Widersprueche (neuester gewinnt) — mem0 v2 ist ADD-only und tut das nie selbst.
|
|
||||||
cp "$SRC/deploy/mem0-konsolidierung.py" "$HOME/.hermes/scripts/mem0-konsolidierung.py"
|
|
||||||
cp "$SRC/deploy/mem0-konsolidierung.sh" "$HOME/.hermes/scripts/mem0-konsolidierung.sh"
|
|
||||||
# Gitea-Repo-Anlage (17.07.2026): schließt Lucys „Projekte selbst starten"-Lücke —
|
|
||||||
# legt PRIVATE Projekt-Repos an (Token aus ~/.git-credentials, braucht write:user-Scope).
|
|
||||||
cp "$SRC/deploy/gitea-repo-create.sh" "$HOME/.hermes/scripts/gitea-repo-create.sh"
|
|
||||||
# Werkstatt-Kanban-Profil (Ideen-Queue, 10.07.2026): Leitplanken des Worker-Profils nachziehen
|
|
||||||
# (Profil selbst wurde einmalig per `hermes profile create werkstatt --clone` angelegt).
|
|
||||||
[ -d "$HOME/.hermes/profiles/werkstatt" ] && cp "$SRC/deploy/werkstatt-SOUL.md" "$HOME/.hermes/profiles/werkstatt/SOUL.md"
|
|
||||||
# betrieb-Profil (Ideen-Queue Faden 7, 13.07.2026): Ops-/Mess-/Bench-Worker mit Box-Wissen
|
|
||||||
# statt Lucy-default. Profil selbst wird einmalig per `hermes profile create betrieb
|
|
||||||
# --clone-from werkstatt` angelegt (model coder→hermes, Description fürs Specifier-Routing).
|
|
||||||
[ -d "$HOME/.hermes/profiles/betrieb" ] && cp "$SRC/deploy/betrieb-SOUL.md" "$HOME/.hermes/profiles/betrieb/SOUL.md"
|
|
||||||
# IDE-Vorbereiter (20.07.2026): haertet ein Konzept (konzept-fliessband), legt das Repo an und
|
|
||||||
# fuellt es NUR mit Doku — der Commander baut dann in Zed. Sonderfall „IDEE PRUEFEN": nur Konzept,
|
|
||||||
# kein Geruest, kein Bau-Druck. Profil einmalig per `hermes profile create projektstart
|
|
||||||
# --clone-from werkstatt` angelegt (model coder→hermes, damit heavy warm bleibt).
|
|
||||||
[ -d "$HOME/.hermes/profiles/projektstart" ] && cp "$SRC/deploy/projektstart-SOUL.md" "$HOME/.hermes/profiles/projektstart/SOUL.md"
|
|
||||||
chmod +x "$HOME/.hermes/scripts/fremdblick.sh" "$HOME/.hermes/scripts/dreaming-feed.sh" "$HOME/.hermes/scripts/worker.sh" "$HOME/.hermes/scripts/chef-gutachter-feed.sh" "$HOME/.hermes/scripts/hermes-release-radar-feed.sh" "$HOME/.hermes/scripts/radar-selbstkritik-wrapper.sh" "$HOME/.hermes/scripts/idle-radar-feed.sh" "$HOME/.hermes/scripts/selbst-inventur.sh" "$HOME/.hermes/scripts/karten-gutachter.sh" "$HOME/.hermes/scripts/trend-radar-feed.sh" "$HOME/.hermes/scripts/pruefstand.sh" "$HOME/.hermes/scripts/restore-probe.sh" "$HOME/.hermes/scripts/venv-audit.sh" "$HOME/.hermes/scripts/gitea-repo-create.sh" "$HOME/.hermes/scripts/mem0-konsolidierung.sh" "$HOME/.hermes/scripts/mem0-konsolidierung.py"
|
|
||||||
# Werkstatt-Skill (Autonomie E6): Selbstwartungs-Kreislauf für Hermes.
|
|
||||||
mkdir -p "$HOME/.hermes/skills/wartung"
|
|
||||||
cp "$SRC/deploy/skills/wartung/SKILL.md" "$HOME/.hermes/skills/wartung/SKILL.md"
|
|
||||||
# Orchestrator-Skill (Autonomie): Werkstatt verallgemeinert — zerlegen → an Worker delegieren → gaten.
|
|
||||||
mkdir -p "$HOME/.hermes/skills/orchestrator"
|
|
||||||
cp "$SRC/deploy/skills/orchestrator/SKILL.md" "$HOME/.hermes/skills/orchestrator/SKILL.md"
|
|
||||||
# PC-Pfad-Cache-Skill (Traum-Entwurf 09.07.2026, aufbereitet): Cache lesen → bei Miss pc_shell-Tool → merken.
|
|
||||||
mkdir -p "$HOME/.hermes/skills/pc-pfad-cache"
|
|
||||||
cp "$SRC/deploy/skills/pc-pfad-cache/SKILL.md" "$HOME/.hermes/skills/pc-pfad-cache/SKILL.md"
|
|
||||||
cp "$SRC/deploy/skills/pc-pfad-cache/pc_path_lookup.sh" "$HOME/.hermes/scripts/pc_path_lookup.sh"
|
|
||||||
chmod +x "$HOME/.hermes/scripts/pc_path_lookup.sh"
|
|
||||||
# Projekt-Start-Skill (Abloesung 13.07.2026): "erst denken, dann bauen" fuer neue Coding-Projekte
|
|
||||||
# in Hermes Desktop — Plan-Riegel, Savepoints, AGENTS.md/SAVEPOINT.md-Ritual, Kontext-Waechter.
|
|
||||||
# Portiert vom PC-Skill (F:\Coding Stuff\projekt-start), Zed-Verweise durch Hermes Desktop ersetzt.
|
|
||||||
mkdir -p "$HOME/.hermes/skills/projekt-start"
|
|
||||||
cp "$SRC/deploy/skills/projekt-start/SKILL.md" "$HOME/.hermes/skills/projekt-start/SKILL.md"
|
|
||||||
# Konzept-Fliessband-Skill (14.07.2026): rohe Idee → wasserdichtes KONZEPT (kein Code), BEVOR
|
|
||||||
# gebaut wird. heavy (gpt-oss-120b) waehlt den Rollen-Cast, mehrere Denk-Runden schaerfen ein
|
|
||||||
# lebendes Dokument, ein Advocatus Diaboli (fremdblick/GLM) haertet bis wasserdicht (max 3 Runden).
|
|
||||||
# Behebt das delegate_task=coder-Loch: Konzept-Arbeit lief bisher stumm auf dem Code-Modell.
|
|
||||||
# Output = Konzept-Dokument (~/konzepte/<slug>-konzept.md) → Vorlage fuer projekt-start in Hermes Desktop.
|
|
||||||
mkdir -p "$HOME/.hermes/skills/konzept-fliessband"
|
|
||||||
cp "$SRC/deploy/skills/konzept-fliessband/SKILL.md" "$HOME/.hermes/skills/konzept-fliessband/SKILL.md"
|
|
||||||
# ...auch in Profile spiegeln, die den Skill schon haben (projektstart = IDE-Vorbereiter
|
|
||||||
# nutzt ihn als Motor; Profile teilen KEINE Skills, Lehre 18.07.). Nur vorhandene updaten.
|
|
||||||
for _psd in "$HOME"/.hermes/profiles/*/skills/konzept-fliessband; do
|
|
||||||
[ -d "$_psd" ] && cp "$SRC/deploy/skills/konzept-fliessband/SKILL.md" "$_psd/SKILL.md"
|
|
||||||
done
|
|
||||||
# Betrieb-Playbook (Phase 2 Drei-Welten-Plan, 19.07.2026): Diagnose-Checklisten der
|
|
||||||
# Betrieb-Bahn (SSH/Deploy) — Gegenstueck zur No-Progress-Bremse. Auch in die Profile,
|
|
||||||
# damit betrieb-Worker es laden koennen (Profile teilen KEINE Skills, Lehre 18.07.).
|
|
||||||
for _sd in "$HOME/.hermes/skills" "$HOME"/.hermes/profiles/*/skills; do
|
|
||||||
[ -d "$(dirname "$_sd")" ] || continue
|
|
||||||
mkdir -p "$_sd/betrieb-playbook"
|
|
||||||
cp "$SRC/deploy/skills/betrieb-playbook/SKILL.md" "$_sd/betrieb-playbook/SKILL.md"
|
|
||||||
done
|
|
||||||
# Agent-Hooks (Faden 5, 13.07.2026): Skripte frisch halten (reproduzierbar, ueberlebt
|
|
||||||
# Box-Neuaufbau). box-steckbrief-inject.sh = Box-Selbstwissen in JEDEN Kanban-Worker
|
|
||||||
# (pre_llm_call, scoped auf task_id → Lucy-Chat unberuehrt); pre-verify-gates.sh = das
|
|
||||||
# bestehende py_compile/dist-Gate. Die REGISTRIERUNG in ~/.hermes/config.yaml (hooks:)
|
|
||||||
# ist EINMALIG von Hand (config.yaml ist Zwei-Schreiber-sensibel, kein Deploy-Schreiber).
|
|
||||||
mkdir -p "$HOME/.hermes/agent-hooks"
|
|
||||||
# Nur kopieren, wenn der Inhalt sich WIRKLICH geaendert hat — ein blindes cp aendert die
|
|
||||||
# mtime auch bei identischem Inhalt und loest sonst bei JEDEM Deploy die harmlose
|
|
||||||
# "script modified since approval"-Warnung von `hermes hooks doctor` aus.
|
|
||||||
for _h in box-steckbrief-inject.sh pre-verify-gates.sh tabu-pfade-guard.py no-progress-bremse.py; do
|
|
||||||
_src="$SRC/deploy/agent-hooks/$_h"; _dst="$HOME/.hermes/agent-hooks/$_h"
|
|
||||||
cmp -s "$_src" "$_dst" 2>/dev/null || { cp "$_src" "$_dst"; chmod +x "$_dst"; }
|
|
||||||
done
|
|
||||||
# Worker-Profile lesen IHRE config.yaml, nicht die Top-Level — die worker-Hooks
|
|
||||||
# (box-steckbrief = Box-Wissen, tabu-pfade-guard = Schreibschutz) muessen dort registriert
|
|
||||||
# sein, sonst feuern sie fuer Worker nie (Bug-Fund 13.07.). Idempotent + Backup je Profil.
|
|
||||||
for _prof in "$HOME"/.hermes/profiles/*/config.yaml; do
|
|
||||||
[ -f "$_prof" ] && python3 "$SRC/deploy/ensure-profile-hooks.py" "$_prof" || true
|
|
||||||
done
|
|
||||||
# Hermes-Runtime-Patch-Traeger (20.07.2026): MC2-eigene Fixes im Hermes-Quellcode
|
|
||||||
# (needs_input-wartet-auf-Commander, Decompose-erst-bei-Startreife, Orphan-Guard,
|
|
||||||
# Projekt-Kontext-Vererbung, Etappen-Auto-Kette) idempotent (re-)eintragen — so
|
|
||||||
# ueberleben sie ein `hermes update`, das den Quellbaum sonst zuruecksetzt.
|
|
||||||
python3 "$SRC/deploy/hermes-patches/apply.py"; _patch_rc=$?
|
|
||||||
if [ "$_patch_rc" -eq 10 ]; then
|
|
||||||
# Patches haben den Quellcode geaendert → Gateway muss die neue Laufzeit laden.
|
|
||||||
systemctl --user try-restart hermes-gateway >/dev/null 2>&1 || true
|
|
||||||
echo "[deploy] Hermes-Runtime-Patches (neu) angewandt → hermes-gateway neu gestartet."
|
|
||||||
elif [ "$_patch_rc" -ne 0 ]; then
|
|
||||||
echo "[deploy] ‼ WARNUNG: hermes-patches/apply.py meldete Fehler — ein Patch passt nicht mehr (Update hat den Kontext geaendert?). Fixes pruefen!"
|
|
||||||
fi
|
|
||||||
# Eingebaute Hermes-Web-GUI (`hermes serve`) für die Einbettung in MC2 (routers/hermes_ui.py →
|
|
||||||
# same-origin /hermes-ui/) vorbereiten: das SPA-Bundle mit Vite-base=/hermes-ui/ (neu) bauen, sonst
|
|
||||||
# kollidieren seine absoluten Pfade (/assets, /api) mit MC2s eigenen. Läuft auch nach jedem
|
|
||||||
# Hermes-Update mit → hält die Einbettung frisch. Best-effort + Build-zu-Temp-dann-Swap, damit ein
|
|
||||||
# Fehlschlag die laufende web_dist NICHT leert (emptyOutDir).
|
|
||||||
cp "$SRC/deploy/hermes-builtin-ui.service" "$HOME/.config/systemd/user/hermes-builtin-ui.service"
|
|
||||||
_HUI_WEB="$HOME/.hermes/hermes-agent/web"
|
|
||||||
_HUI_DIST="$HOME/.hermes/hermes-agent/hermes_cli/web_dist"
|
|
||||||
if [ -d "$_HUI_WEB" ] && [ -x "$HOME/.hermes/node/bin/npx" ]; then
|
|
||||||
if ( cd "$_HUI_WEB" && PATH="$HOME/.hermes/node/bin:$PATH" npx --no-install vite build \
|
|
||||||
--base=/hermes-ui/ --outDir /tmp/hermes-ui-build --emptyOutDir ) >/tmp/hermes-ui-build.log 2>&1; then
|
|
||||||
# Dienst VOR dem Tausch stoppen — sonst crasht der laufende `hermes serve`, wenn er index.html
|
|
||||||
# im Lösch-Fenster (rm→cp) liest (FileNotFoundError → Start-Limit → tot). Der reguläre restart
|
|
||||||
# weiter unten bringt ihn sauber auf der neuen web_dist hoch.
|
|
||||||
systemctl --user stop hermes-builtin-ui 2>/dev/null || true
|
|
||||||
rm -rf "$_HUI_DIST" && cp -r /tmp/hermes-ui-build "$_HUI_DIST" && echo "Hermes-GUI (base=/hermes-ui/) gebaut."
|
|
||||||
else
|
else
|
||||||
echo "WARN: Hermes-GUI-Build fehlgeschlagen (siehe /tmp/hermes-ui-build.log) — bestehende web_dist bleibt."
|
SWAP_BAK="/etc/llama-swap/config.yaml.bak-$(date +%Y%m%d-%H%M%S)"
|
||||||
|
echo "Llama-Swap Konfiguration hat sich geändert."
|
||||||
|
echo " Abweichung (live -> Repo-Abzug):"
|
||||||
|
diff -u /etc/llama-swap/config.yaml deploy/llama-swap.config.yaml | head -40 || true
|
||||||
|
echo " Sichere die laufende Datei nach $SWAP_BAK"
|
||||||
|
# NOPASSWD für llama-swap Neustart ist vorausgesetzt (siehe AGENTS.md)
|
||||||
|
sudo cp /etc/llama-swap/config.yaml "$SWAP_BAK"
|
||||||
|
sudo cp deploy/llama-swap.config.yaml /etc/llama-swap/config.yaml
|
||||||
|
sudo systemctl restart llama-swap
|
||||||
|
echo " Rueckweg bei Verlust: sudo cp $SWAP_BAK /etc/llama-swap/config.yaml"
|
||||||
|
fi
|
||||||
fi
|
fi
|
||||||
fi
|
|
||||||
systemctl --user daemon-reload
|
|
||||||
systemctl --user enable mission-control-2 >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable mc2-gateway >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable mc2-steward >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable box-console >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable mem0-service >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable voice-service >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable hermes-builtin-ui >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable --now mc2-backup.timer >/dev/null 2>&1 || true
|
|
||||||
# mc2-autoupdate.timer wird hier BEWUSST NICHT geschaltet — der Zustand wird nur von Hand
|
|
||||||
# geändert (Lehre 09.07.: die frühere enable-Zeile hat einen User-Entscheid bei jedem Deploy
|
|
||||||
# still rückgängig gemacht). Aktueller User-Entscheid (10.07.2026): Timer ist AN —
|
|
||||||
# Router/Engine/Hermes dürfen So 04:30 automatisch (Fangnetz Backup→Postcheck→Rollback+Pin).
|
|
||||||
systemctl --user enable --now mc2-selfsmoke.timer >/dev/null 2>&1 || true
|
|
||||||
systemctl --user enable --now mc2-bagatell.timer >/dev/null 2>&1 || true
|
|
||||||
loginctl enable-linger "$USER" >/dev/null 2>&1 || true
|
|
||||||
# Mem0-Sidecar VOR dem Backend (re)starten, damit /api/memory sofort bedient wird.
|
|
||||||
[ -x "$HOME/.mem0/venv/bin/python" ] && systemctl --user restart mem0-service 2>/dev/null || true
|
|
||||||
# Voice-Sidecar (re)starten (best-effort; Erststart lädt das STT-Modell vor).
|
|
||||||
[ -x "$HOME/.voice/venv/bin/python" ] && systemctl --user restart voice-service 2>/dev/null || true
|
|
||||||
# Eingebaute Hermes-Web-GUI (Loopback :9119) (re)starten — MC2 bettet sie unter /hermes-ui/ ein.
|
|
||||||
# reset-failed, damit ein zuvor am Start-Limit gestorbener Dienst wieder anläuft.
|
|
||||||
systemctl --user reset-failed hermes-builtin-ui 2>/dev/null || true
|
|
||||||
systemctl --user restart hermes-builtin-ui 2>/dev/null || true
|
|
||||||
# Gateway VOR dem Steuerpult (re)starten — MC2s /v1-Weiterleiter braucht ihn sofort.
|
|
||||||
# KEIN `|| true`: ohne Gateway ist der LLM-Datenpfad tot, das MUSS den Deploy stoppen.
|
|
||||||
systemctl --user restart mc2-gateway
|
|
||||||
# Steward (Wächter) — unabhängig vom Steuerpult; ohne ihn wacht niemand über die Box.
|
|
||||||
systemctl --user restart mc2-steward
|
|
||||||
systemctl --user restart mission-control-2
|
|
||||||
command -v ttyd >/dev/null 2>&1 && systemctl --user restart box-console 2>/dev/null || true
|
|
||||||
|
|
||||||
sleep 2
|
# 4. Systemd Units neu laden (falls sich .service Dateien geändert haben)
|
||||||
echo "--- Health ---"
|
systemctl --user daemon-reload
|
||||||
# Gateway-Kaltstart-Fenster: bis ~12 s tolerieren, DANN hart scheitern (ohne Gateway
|
|
||||||
# ist der LLM-Datenpfad tot — das muss den Karten-Runner rot machen).
|
|
||||||
for _i in $(seq 1 10); do
|
|
||||||
curl -sf -m 3 http://127.0.0.1:9010/gw/health >/dev/null 2>&1 && break
|
|
||||||
[ "$_i" -eq 10 ] && { echo "FEHLER: mc2-gateway (:9010) antwortet nicht"; exit 1; }
|
|
||||||
sleep 1
|
|
||||||
done
|
|
||||||
curl -sf http://127.0.0.1:9010/gw/health && echo
|
|
||||||
curl -sf http://127.0.0.1:9001/api/health && echo
|
|
||||||
# Steward hat keinen HTTP-Port — systemd-Zustand ist der Beweis (crasht er sofort,
|
|
||||||
# ist er hier bereits 'failed' statt 'active').
|
|
||||||
if systemctl --user is-active --quiet mc2-steward; then
|
|
||||||
echo "mc2-steward aktiv (Wächter laufen)"
|
|
||||||
else
|
|
||||||
echo "FEHLER: mc2-steward läuft nicht (journalctl --user -u mc2-steward -n 30)"; exit 1
|
|
||||||
fi
|
|
||||||
|
|
||||||
# Warm-Set (Hirn + Augen/vision + Gedächtnis/embed) nach dem Deploy nachladen — ein Deploy bzw.
|
# 4.5 Hermes Skills synchronisieren
|
||||||
# watch-config-Reload verwirft es sonst und die erste Anfrage wäre kalt (D16d). warmup.sh ist
|
echo "Synchronisiere Hermes Skills..."
|
||||||
# selbst-detachend (blockiert den Deploy nicht) und lädt jedes Modell über den richtigen Endpunkt.
|
mkdir -p ~/.hermes/skills
|
||||||
bash "$SRC/deploy/warmup.sh" || true
|
# Kopiere alle Skills aus dem Repo, ersetze - durch _ in den Ordnernamen für Hermes Kompatibilität
|
||||||
|
for skill_dir in deploy/skills/*; do
|
||||||
|
if [ -d "$skill_dir" ]; then
|
||||||
|
skill_name=$(basename "$skill_dir" | tr '-' '_')
|
||||||
|
mkdir -p ~/.hermes/skills/"$skill_name"
|
||||||
|
cp -r "$skill_dir"/* ~/.hermes/skills/"$skill_name"/
|
||||||
|
fi
|
||||||
|
done
|
||||||
|
|
||||||
echo "OK — Mission Control 2.0 läuft auf :9001 (User-Dienst, sudo-frei)."
|
# 5. Dienste neu starten
|
||||||
|
# ‼️ mc2-steward gehoert hier dazu: er laeuft aus DEMSELBEN Checkout (backend/steward.py).
|
||||||
|
# Ohne ihn lief der Waechter-Prozess nach jedem Deploy mit dem alten Code weiter — der
|
||||||
|
# Neustart wurde 27.08.2026 nachgetragen. `--user restart` auf einer nicht installierten
|
||||||
|
# Unit ist folgenlos, darum ohne Vorabpruefung.
|
||||||
|
echo "Starte Backend neu..."
|
||||||
|
systemctl --user restart mc2-gateway.service mission-control-2.service mc2-steward.service
|
||||||
|
|
||||||
|
echo "✅ Deployment erfolgreich abgeschlossen!"
|
||||||
|
}
|
||||||
|
|
||||||
|
main "$@"
|
||||||
|
|||||||
@@ -1,74 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Feed für den Traum-Cron (Dreaming / Continual-Learning-Kreislauf, Phase 2 — Capstone).
|
|
||||||
# Zwilling von radar-feed.sh (Blick nach draußen) und selbstkritik-feed.sh (Blick auf den
|
|
||||||
# Betrieb); der Traum blickt auf das GELERNTE: Sessions, Skills, Gedächtnis, Muster.
|
|
||||||
# Liegt in ~/.hermes/scripts/ (deploy.sh kopiert ihn); stdout wird dem Cron-Agenten als
|
|
||||||
# Prompt eingespeist: versionierter Auftrag (deploy/dreaming-prompt.md) + Live-Schlaf-Daten.
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
VAULT="$HOME/wissens-vault"
|
|
||||||
|
|
||||||
# --- Vault-Bootstrap (idempotent): eigenes git-Repo, menschenlesbar, NICHT im Stack-Code. ---
|
|
||||||
if [ ! -d "$VAULT/.git" ]; then
|
|
||||||
mkdir -p "$VAULT/traeume" "$VAULT/muster" "$VAULT/skill-kandidaten"
|
|
||||||
git -C "$VAULT" init -q 2>/dev/null || true
|
|
||||||
# Lokale Identität nur setzen, falls global keine da ist (Commits sollen nie scheitern).
|
|
||||||
git -C "$VAULT" config user.email >/dev/null 2>&1 || git -C "$VAULT" config user.email "lucy@box.local"
|
|
||||||
git -C "$VAULT" config user.name >/dev/null 2>&1 || git -C "$VAULT" config user.name "Lucy (Traum)"
|
|
||||||
if [ ! -f "$VAULT/INDEX.md" ]; then
|
|
||||||
cat > "$VAULT/INDEX.md" <<'EOF'
|
|
||||||
# Wissens-Vault — Navigationskarte
|
|
||||||
|
|
||||||
Menschenlesbare, git-versionierte Wissensschicht NEBEN dem Live-Gedächtnis (Mem0).
|
|
||||||
Angelegt von Lucys nächtlichem Traum. Verlinkung im Obsidian-Stil `[[dateiname]]`.
|
|
||||||
|
|
||||||
## Träume (chronologisch)
|
|
||||||
|
|
||||||
## Muster (akkumuliertes Projektwissen)
|
|
||||||
|
|
||||||
## Skill-Kandidaten (Vorschläge, Gate = Commander „mach")
|
|
||||||
EOF
|
|
||||||
git -C "$VAULT" add -A >/dev/null 2>&1 || true
|
|
||||||
git -C "$VAULT" commit -q -m "Vault angelegt" >/dev/null 2>&1 || true
|
|
||||||
fi
|
|
||||||
fi
|
|
||||||
|
|
||||||
# --- Versionierter Auftrag ---
|
|
||||||
cat "$HOME/mission-control-v2/deploy/dreaming-prompt.md"
|
|
||||||
|
|
||||||
echo
|
|
||||||
echo "## SCHLAF-DATEN (automatisch erhoben am $(date '+%d.%m.%Y %H:%M'))"
|
|
||||||
echo
|
|
||||||
# Hinweis: erst voll einsammeln, DANN kürzen — sonst schließt `head` die Pipe früh,
|
|
||||||
# der Produzent bekommt SIGPIPE, pipefail feuert und die Fallback-Zeile lügt "nicht verfügbar".
|
|
||||||
echo "### Insights der letzten 7 Tage (Token-/Tool-/Aktivitätsmuster):"
|
|
||||||
_ins="$(bash -lc "hermes insights --days 7" 2>/dev/null | sed 's/\x1b\[[0-9;]*m//g')"
|
|
||||||
echo "${_ins:-(insights nicht verfügbar)}" | head -62
|
|
||||||
echo
|
|
||||||
echo "### Session-Store (Umfang):"
|
|
||||||
_sst="$(bash -lc "hermes sessions stats" 2>/dev/null)"
|
|
||||||
echo "${_sst:-(sessions stats nicht verfügbar)}" | head -12
|
|
||||||
echo
|
|
||||||
echo "### Jüngste Sessions (woran zuletzt gearbeitet wurde):"
|
|
||||||
_sls="$(bash -lc "hermes sessions list" 2>/dev/null | sed 's/\x1b\[[0-9;]*m//g')"
|
|
||||||
echo "${_sls:-(sessions list nicht verfügbar)}" | head -25
|
|
||||||
echo
|
|
||||||
echo "### Gelernt bisher (journey — Skills + Gedächtnis-Knoten, kompakt):"
|
|
||||||
bash -lc "hermes journey --json" 2>/dev/null \
|
|
||||||
| jq -c '{stats: .stats, skills: ([.nodes[]? | select(.kind=="skill" or .type=="skill") | .label // .name] | .[0:25]), cluster_labels: ([.clusters[]?.label] | .[0:15])}' \
|
|
||||||
2>/dev/null || echo "(journey nicht verfügbar)"
|
|
||||||
echo
|
|
||||||
echo "### Curator / Skill-Hygiene (was brachliegt, was aktiv ist):"
|
|
||||||
bash -lc "hermes curator status" 2>/dev/null | head -26 || echo "(curator status nicht verfügbar)"
|
|
||||||
echo
|
|
||||||
echo "### Bisheriger Vault-INDEX (nur zur Ansicht — damit du nichts doppelt anlegst + verlinken"
|
|
||||||
echo "### kannst). Die echte Datei liegt unter ~/wissens-vault/INDEX.md; zwischen den Markern"
|
|
||||||
echo "### steht ihr AKTUELLER Inhalt. Kopiere die Marker NICHT in die Datei zurück."
|
|
||||||
echo "<<<INDEX-INHALT-ANFANG>>>"
|
|
||||||
cat "$VAULT/INDEX.md" 2>/dev/null | head -120 || echo "(noch kein INDEX — beim ersten Traum anlegen)"
|
|
||||||
echo "<<<INDEX-INHALT-ENDE>>>"
|
|
||||||
echo
|
|
||||||
echo "### Letzte 3 Traum-Notizen (nur Briefing — NICHT in den INDEX kopieren):"
|
|
||||||
ls -1t "$VAULT/traeume/"*.md 2>/dev/null | head -3 | while read -r f; do
|
|
||||||
echo " $(basename "$f"): $(head -1 "$f" 2>/dev/null)"
|
|
||||||
done
|
|
||||||
@@ -1,106 +0,0 @@
|
|||||||
# Der Traum (nächtlich) — Continual-Learning-Kreislauf
|
|
||||||
|
|
||||||
Es ist tiefe Nacht, niemand spricht mit dir, die Box ist im Leerlauf. Du bist Lucy und
|
|
||||||
tust jetzt das, wozu Menschen den Schlaf brauchen: Du gehst den vergangenen Tag/die
|
|
||||||
vergangene Woche noch einmal durch, ziehst Muster heraus, legst Gelerntes ordentlich ab
|
|
||||||
und überlegst, wie du beim nächsten Mal besser wirst — **ohne neu trainiert zu werden.**
|
|
||||||
|
|
||||||
Das ist der Höhepunkt der Autonomie-Vision: „Die Box wird besser, während der Commander
|
|
||||||
schläft." Dieser Lauf ist der Zwilling von Evolution-Radar (Blick nach draußen) und
|
|
||||||
Selbstkritik (Blick auf den Betrieb) — der **Traum** ist der Blick auf das **Gelernte**:
|
|
||||||
Sessions, Skills, Gedächtnis, wiederkehrende Muster.
|
|
||||||
|
|
||||||
## Dein Auftrag (streng in dieser Reihenfolge — der Commit und die Nachricht kommen ZULETZT)
|
|
||||||
|
|
||||||
1. **Reflektieren.** Lies die SCHLAF-DATEN unten gründlich: die Insights (Token-/Tool-/
|
|
||||||
Aktivitätsmuster der letzten 7 Tage), die jüngsten Sessions, den Skill-/Gedächtnis-Stand
|
|
||||||
(journey), den Curator-Stand. Frag dich:
|
|
||||||
- Was ging diese Woche wiederholt gut? Was ging wiederholt schief?
|
|
||||||
- Welche Tools laufen heiß, welche Skills liegen brach (activity=0)?
|
|
||||||
- Gibt es ein **wiederkehrendes Muster** über mehrere Sessions hinweg — dieselbe
|
|
||||||
Fehlerart, derselbe Handgriff, dieselbe Frage des Commanders? Ein Muster braucht
|
|
||||||
**mehrfache Belege** (nicht ein Einzelfall), sonst ist es Rauschen.
|
|
||||||
|
|
||||||
2. **Notizen ENTWERFEN** (schreiben, aber NOCH NICHT committen) im Wissens-Vault
|
|
||||||
(`~/wissens-vault/`, ein git-versioniertes, menschenlesbares Markdown-Verzeichnis — die
|
|
||||||
dauerhafte, navigierbare Wissensschicht NEBEN dem Live-Gedächtnis Mem0):
|
|
||||||
- Lege **eine** neue Traum-Notiz an: `~/wissens-vault/traeume/<YYYY-MM-DD>-traum.md`
|
|
||||||
(Datum von heute). Kurz und dicht: 2–5 belegte Beobachtungen, je mit Zahl/Session/
|
|
||||||
Log-Bezug. Keine Romane, keine Allgemeinplätze.
|
|
||||||
- Wenn ein Muster **mehrfach** belegt ist: lege `~/wissens-vault/muster/<kurz-slug>.md` an
|
|
||||||
(oder ergänze die vorhandene um einen neuen Beleg + heutiges Datum). Muster-Notizen sind
|
|
||||||
das akkumulierte Projektwissen.
|
|
||||||
- Skill-Kandidat (nur wenn sich klar einer aufdrängt): wenn aus einem ERFOLGREICHEN,
|
|
||||||
wiederholten Handgriff ein wiederverwendbarer Skill würde (Voyager-Prinzip), beschreibe
|
|
||||||
ihn als Entwurf unter `~/wissens-vault/skill-kandidaten/<slug>.md`. **ABER ZUERST prüfen:**
|
|
||||||
```
|
|
||||||
ls ~/wissens-vault/skill-kandidaten/*.md ~/wissens-vault/skill-kandidaten/beauftragt/*.md 2>/dev/null
|
|
||||||
ls ~/.hermes/skills/ 2>/dev/null
|
|
||||||
```
|
|
||||||
Wenn ein thematisch passender Kandidat schon existiert → **NICHTS anlegen**, stattdessen
|
|
||||||
im Bericht erwähnen: „Kandidat `[[slug]]` besteht bereits, seit <Datum>, kein neuer
|
|
||||||
Vorschlag nötig."
|
|
||||||
**WICHTIG:** Prüfe auch, ob es bereits einen fertig gebauten Skill gibt.
|
|
||||||
Wenn ja: kein Kandidat nötig, der Skill existiert bereits.
|
|
||||||
**Entwirf ihn gleich
|
|
||||||
im Hausstandard deiner Skills** (wie `/learn` es täte), damit die Werkstatt ein fertiges
|
|
||||||
Gerüst übernimmt statt Freitext zu übersetzen: ein `SKILL.md`-Block mit Frontmatter
|
|
||||||
(`name` = slug, `description` ≤ 60 Zeichen, `version: 1.0.0`), dann die Abschnitte
|
|
||||||
**Wann nutzen** (Auslöser), **Schritte** (mit den ECHTEN Hermes-Tools/Befehlen aus den
|
|
||||||
belegten Sessions — keine erfundenen Kommandos) und **Belege** (Sessions/Zahlen, aus
|
|
||||||
denen der Handgriff stammt). **Du legst den Skill NICHT selbst an** (kein skill_manage) —
|
|
||||||
das ist ein Vorschlag für die Werkstatt, die der Commander im Auftragsbuch per
|
|
||||||
„Beauftragen" auslöst. Höchstens EIN Kandidat pro Traum.
|
|
||||||
- Verlinke zwischen Notizen mit `[[dateiname-ohne-endung]]` (Obsidian-Stil), großzügig.
|
|
||||||
|
|
||||||
3. **Fremdblick — PFLICHT-GATE** (Härtung „andere Brille": ein Agent, der seine eigenen Träume
|
|
||||||
benotet, stimmt sich selbst zu). Hol dir eine Zweitmeinung von einem ANDEREN Modell. **Nutze
|
|
||||||
dafür das bereitgestellte Skript** — NICHT `delegate_task` (der Kritiker heavy hat nur 32K
|
|
||||||
Kontext und ist als Subagent-Ziel disqualifiziert; das Skript umgeht das mit einer einzelnen
|
|
||||||
Completion). Konkret: Fasse deine 2–5 Beobachtungen je mit ihrem Zahlen-/Session-Beleg + den
|
|
||||||
(falls vorhandenen) Skill-Kandidaten KOMPAKT zusammen (wenige Zeilen je Punkt, KEINE
|
|
||||||
Rohdaten) und pipe sie in das Skript:
|
|
||||||
|
|
||||||
```
|
|
||||||
printf '%s' "<deine kompakten Beobachtungen + Belege>" | ~/.hermes/scripts/fremdblick.sh
|
|
||||||
```
|
|
||||||
|
|
||||||
Das Skript fragt gpt-oss (heavy, andere Modell-Familie als dein Qwen-Hirn) und gibt pro Punkt
|
|
||||||
ein Urteil TRAEGT / TRAEGT-NICHT / UNSICHER zurück. **Lies die Ausgabe und richte dich danach.**
|
|
||||||
**⛔ HARTE REGEL:** Du fährst mit Schritt 4 erst fort, wenn die Fremdblick-Ausgabe vorliegt.
|
|
||||||
Schreibe KEINE Nachricht und committe NICHTS vorher. Steht in der Ausgabe „FREMDBLICK
|
|
||||||
FEHLGESCHLAGEN", einmal wiederholen; klappt es dann immer noch nicht, kennzeichne deine Funde
|
|
||||||
in der Nachricht ehrlich als **„ungeprüft (Fremdblick fiel aus)"**.
|
|
||||||
|
|
||||||
4. **Bereinigen + INDEX pflegen.** Streiche aus deinen Notizen alles, was der Fremdblick nicht
|
|
||||||
getragen hat. Trage dann **jede** verbliebene neue/geänderte Notiz in `~/wissens-vault/INDEX.md`
|
|
||||||
ein (eine Zeile je Notiz unter der passenden Überschrift: `- [[dateiname]] — Ein-Satz-Haken`).
|
|
||||||
**Wichtig zum INDEX:** Bearbeite NUR die Markdown-Inhaltszeilen. Die Zeilen der SCHLAF-DATEN
|
|
||||||
unten (alles ab „## SCHLAF-DATEN", inklusive Abschnitte wie „### Bisheriger Vault-INDEX" und
|
|
||||||
„### Letzte 3 Traum-Notizen") sind BRIEFING für dich, NICHT Teil des INDEX — kopiere sie NIE
|
|
||||||
in die INDEX-Datei.
|
|
||||||
|
|
||||||
5. **Commit — die LETZTE Vault-Aktion, sie fasst alles zusammen:**
|
|
||||||
`git -C ~/wissens-vault add -A && git -C ~/wissens-vault commit -m "Traum <YYYY-MM-DD>"`.
|
|
||||||
(Harmloser Commit in einem EIGENEN Repo, nicht im Stack-Code — erlaubt und reversibel.)
|
|
||||||
|
|
||||||
6. **Dem Commander berichten — deine ALLERLETZTE Handlung** (nichts danach). EINE kompakte
|
|
||||||
Nachricht in DEINER Stimme (Lucy: Anrede „Commander", Fazit zuerst, Alltagssprache, Technik
|
|
||||||
knapp dahinter). Sag: was du heute Nacht bemerkt hast (1–3 Funde, je mit Beleg + wie der
|
|
||||||
Fremdblick sie bewertet hat), wohin du es im Vault gelegt hast (`[[link]]`), und — falls
|
|
||||||
vorhanden — welchen Skill-Kandidaten du zur Prüfung vorschlägst. Wenn ehrlich NICHTS
|
|
||||||
Nennenswertes war: genau das sagen, kurz und zufrieden — **keine Funde erfinden.**
|
|
||||||
|
|
||||||
## Leitplanken (nicht verhandelbar — selbstverbessernde Agenten driften sonst)
|
|
||||||
|
|
||||||
- **Du änderst am laufenden Betrieb NICHTS.** Der einzige Ort, an den du schreibst, ist der
|
|
||||||
`~/wissens-vault/` (Notizen + Commit). Alles andere ist nur VORSCHLAG an den Commander;
|
|
||||||
umgesetzt wird erst auf sein „mach" (dann übernimmt die Werkstatt mit Gates und Rollback).
|
|
||||||
- **Kein Security-Anfassen.** Approvals, Tokens, Firewall, Config nur BENENNEN, nie ändern.
|
|
||||||
- **Fremder Quellcode (Hermes, llama.cpp …) ist tabu** — Auto-Update-Kanal, nicht dein Revier.
|
|
||||||
- **Nichts, was das Warm-Set oder Lucys Sprech-Latenz gefährdet.** Der Fremdblick (Schritt 3)
|
|
||||||
nutzt ein LEICHTES Modell (GLM, lädt klein daneben) — **lade NIE gpt-oss/heavy** (60 GB,
|
|
||||||
kollidiert mit dem VL-30B-Warm-Set → Health-Check-Tod). Keine schweren Jobs, kein Neustart.
|
|
||||||
- **Sparsam mit Tools.** Die Schlaf-Daten unten reichen für die Reflexion; höchstens ein paar
|
|
||||||
gezielte Nachschau-Aufrufe (eine Session exportieren, eine Log-Zeile im Kontext lesen),
|
|
||||||
dann schreiben + berichten. Kein Tool-Feuerwerk.
|
|
||||||
@@ -15,10 +15,10 @@ verschlucken und den Tabu-Guard lautlos deaktivieren.
|
|||||||
Idempotent + validiert + Backup. Anker fuer neue Event-Bloecke ist der bestehende
|
Idempotent + validiert + Backup. Anker fuer neue Event-Bloecke ist der bestehende
|
||||||
`pre_verify`-Block. Arg: Pfad zur Profil-config.yaml.
|
`pre_verify`-Block. Arg: Pfad zur Profil-config.yaml.
|
||||||
"""
|
"""
|
||||||
import sys
|
|
||||||
import os
|
|
||||||
import datetime
|
import datetime
|
||||||
|
import os
|
||||||
import shutil
|
import shutil
|
||||||
|
import sys
|
||||||
|
|
||||||
try:
|
try:
|
||||||
import yaml
|
import yaml
|
||||||
|
|||||||
@@ -1,69 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Fremdblick — Ein-Schuss-Zweitmeinung von einem ANDEREN Modell (Default seit 07.07.:
|
|
||||||
# GLM-4.7-Flash, 30B-A3B Text — klar stärkerer Kritiker als die 9B-Vision-Schwester 4.6V,
|
|
||||||
# gleicher Fremd-Vendor wie zuvor → echte „andere Brille" bleibt). Eine EINZELNE
|
|
||||||
# Completion — kein agentischer Subagent — umgeht Hermes' 64K-Delegations-Floor
|
|
||||||
# (MINIMUM_CONTEXT_LENGTH) UND das 60-GB-Ladeproblem von gpt-oss (das mit dem Warm-Set kollidiert
|
|
||||||
# und „exited prematurely" wirft). GLM lädt klein neben dem Warm-Set und antwortet zuverlässig.
|
|
||||||
#
|
|
||||||
# Nutzung: echo "<Beobachtungen/Behauptungen je mit Beleg>" | fremdblick.sh
|
|
||||||
# printf '%s' "$text" | FREMDBLICK_MODEL=Qwen3-Coder-Next FREMDBLICK_SYS="$raster" fremdblick.sh
|
|
||||||
#
|
|
||||||
# Env-Overrides:
|
|
||||||
# FREMDBLICK_MODE 'prose' (Default, Dreaming-Prosa-Raster) oder 'code' (Werkstatt-Code-Review).
|
|
||||||
# 'code' setzt Raster + Default-Modell (Qwen3-Coder-Next) + größeres Budget.
|
|
||||||
# FREMDBLICK_MODEL Modell-ID (echte llama-swap-ID, kein Alias). Übersteuert den Mode-Default.
|
|
||||||
# FREMDBLICK_SYS eigenes System-Raster (übersteuert das Mode-Raster).
|
|
||||||
# FREMDBLICK_MAXTOK max_tokens (übersteuert den Mode-Default).
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
# Achtung: llama-swap listet unter /v1/models die ECHTEN Modell-IDs, nicht die Gateway-Aliase
|
|
||||||
# (kein "heavy"/"scout" hier).
|
|
||||||
ENDPOINT="${FREMDBLICK_ENDPOINT:-http://127.0.0.1:8080/v1/chat/completions}"
|
|
||||||
MODE="${FREMDBLICK_MODE:-prose}"
|
|
||||||
SUBJECT="$(cat)"
|
|
||||||
|
|
||||||
if [ -z "${SUBJECT// /}" ]; then
|
|
||||||
echo "=== FREMDBLICK: nichts zu prüfen (leere Eingabe) ==="
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
# Prosa-Raster (Dreaming): urteilt über Beobachtungen/Behauptungen. Default-Kritiker = GLM (Fremd-Vendor).
|
|
||||||
PROSE_SYS='Du bist ein KRITISCHER Zweitgutachter und ausdrücklich ein ANDERES Modell als der Autor. Prüfe jede vorgelegte Beobachtung/Behauptung streng: Trägt der genannte Beleg (Zahl / Session / Log-Zeile) die Behauptung wirklich, oder ist es ein Einzelfall bzw. ein Bauchgefühl mit Zahlen-Deko? Verwechselt der Autor Korrelation mit Ursache? Fehlt entscheidender Kontext? Falls ein Skill-Kandidat dabei ist: ist er wirklich WIEDERVERWENDBAR oder Einmal-Kram? Antworte kompakt auf Deutsch: pro Punkt ein Urteil TRAEGT / TRAEGT-NICHT / UNSICHER mit genau einem Satz Begruendung. Sei knapp und unbestechlich; nicke nichts aus Hoeflichkeit durch. Erfinde keine neuen Belege.'
|
|
||||||
# Code-Raster (Werkstatt): reproduziert den Fehlerfall aus der Bug-Beschreibung, statt dem Autor zu glauben.
|
|
||||||
CODE_SYS='Du bist ein kritischer Code-Reviewer und ein ANDERES Modell als der Autor. Vertraue seiner Begruendung NICHT. Dir liegen ein Wartungs-AUFTRAG (Bug-Beschreibung) und ein git-Diff vor. Trenne klar: (A) KERNFRAGE: Behebt der Diff den im Auftrag KONKRET beschriebenen Fehlerfall? Leite die Eingabe SELBST aus der Bug-Beschreibung ab und belege einen Uebergang: Eingabe X -> VOR Patch: Y (Bug sichtbar) -> NACH Patch: Z. (B) RANDFAELLE: nenne offene Risiken/Randfaelle als Hinweis. URTEIL-Regel: ABGELEHNT NUR, wenn (A) nicht belegt behoben ist (Kern-Bug bleibt, ODER der Patch trifft die Auftrags-Absicht nicht, ODER er bricht den Normalfall). Ist der Kern-Fall belegt behoben und es bleiben nur Randfaelle: FREIGABE-MIT-VORBEHALT (Randfaelle auflisten). Ist alles sauber: FREIGABE. Ein blosses sieht-plausibel-aus OHNE reproduzierten Kern-Uebergang = ABGELEHNT. Beginne die Antwort mit der Zeile "URTEIL: <ABGELEHNT|FREIGABE-MIT-VORBEHALT|FREIGABE>". Antworte knapp auf Deutsch.'
|
|
||||||
|
|
||||||
if [ "$MODE" = "code" ]; then
|
|
||||||
MODEL="${FREMDBLICK_MODEL:-Qwen3-Coder-Next}"
|
|
||||||
MAXTOK="${FREMDBLICK_MAXTOK:-1600}"
|
|
||||||
SYS="${FREMDBLICK_SYS:-$CODE_SYS}"
|
|
||||||
else
|
|
||||||
MODEL="${FREMDBLICK_MODEL:-GLM-4.7-Flash}"
|
|
||||||
# 4000 (war 2200): GLM-4.7-Flash ist ein Reasoning-Modell und verbrennt real ~2000 Tokens
|
|
||||||
# im reasoning_content, BEVOR das Urteil in content landet (verifiziert 14.07.). Bei 2200 lief
|
|
||||||
# es Gefahr, mitten im Denken abzuschneiden → leeres content → "ABGESCHNITTEN/FEHLGESCHLAGEN"
|
|
||||||
# (traf die Nacht-Kritiker mit Default-Budget). Wer explizit knapper braucht, setzt FREMDBLICK_MAXTOK.
|
|
||||||
MAXTOK="${FREMDBLICK_MAXTOK:-4000}"
|
|
||||||
SYS="${FREMDBLICK_SYS:-$PROSE_SYS}"
|
|
||||||
fi
|
|
||||||
|
|
||||||
# max_tokens großzügig: Reasoning-Modelle (GLM) verbrauchen Tokens im reasoning_content, bevor sie
|
|
||||||
# die eigentliche Antwort in content schreiben — zu knapp = leeres content (finish=length).
|
|
||||||
RESP="$(jq -n --arg m "$MODEL" --arg s "$SYS" --arg u "$SUBJECT" --argjson t "$MAXTOK" \
|
|
||||||
'{model:$m, temperature:0.2, max_tokens:$t, messages:[{role:"system",content:$s},{role:"user",content:$u}]}' \
|
|
||||||
| curl -s --max-time 240 "$ENDPOINT" -H 'Content-Type: application/json' -d @- 2>/dev/null)"
|
|
||||||
|
|
||||||
OUT="$(printf '%s' "$RESP" | jq -r '.choices[0].message.content // empty' 2>/dev/null)"
|
|
||||||
FIN="$(printf '%s' "$RESP" | jq -r '.choices[0].finish_reason // empty' 2>/dev/null)"
|
|
||||||
|
|
||||||
if [ -n "$OUT" ]; then
|
|
||||||
echo "=== FREMDBLICK (Zweitmeinung von Modell: $MODEL) ==="
|
|
||||||
echo "$OUT"
|
|
||||||
elif [ "$FIN" = "length" ]; then
|
|
||||||
echo "=== FREMDBLICK ABGESCHNITTEN ==="
|
|
||||||
echo "(Das Kritiker-Modell hat sein Token-Budget im Nachdenken verbraucht, bevor ein Urteil kam."
|
|
||||||
echo " Kürze deine Vorlage auf die Kern-Behauptungen und versuche es erneut; sonst UNGEPRUEFT.)"
|
|
||||||
else
|
|
||||||
echo "=== FREMDBLICK FEHLGESCHLAGEN ==="
|
|
||||||
echo "(Kein Urteil erhalten — Endpoint/Modell nicht erreichbar. Behandle die Funde als UNGEPRUEFT.)"
|
|
||||||
fi
|
|
||||||
+23
-12
@@ -79,26 +79,37 @@ case "$CODE" in
|
|||||||
# Vorlage oder scheitert der Seed, wird die Anlage NICHT abgebrochen, nur gewarnt.
|
# Vorlage oder scheitert der Seed, wird die Anlage NICHT abgebrochen, nur gewarnt.
|
||||||
# WICHTIG: Contents-API braucht write:repository → PUSH-Token nutzen (das
|
# WICHTIG: Contents-API braucht write:repository → PUSH-Token nutzen (das
|
||||||
# dedizierte Anlage-Token hat u.U. nur write:user).
|
# dedizierte Anlage-Token hat u.U. nur write:user).
|
||||||
AMPEL="$REALHOME/mission-control-v2/deploy/ampel-ci.yml"
|
|
||||||
PUSHTOKEN="$(printf '%s' "$LINE" | sed -nE 's#https://[^:]+:([^@]+)@.*#\1#p')"; PUSHTOKEN="${PUSHTOKEN:-$TOKEN}"
|
PUSHTOKEN="$(printf '%s' "$LINE" | sed -nE 's#https://[^:]+:([^@]+)@.*#\1#p')"; PUSHTOKEN="${PUSHTOKEN:-$TOKEN}"
|
||||||
if [ -r "$AMPEL" ]; then
|
# saat <lokale-vorlage> <pfad-im-repo> <commit-nachricht> <klartext-name>
|
||||||
SEED_CODE="$(curl -s -o /dev/null -w '%{http_code}' -X POST "$BASE/api/v1/repos/$FULL/contents/.gitea/workflows/ci.yml" \
|
saat () {
|
||||||
|
local QUELLE="$1" ZIEL="$2" MSG="$3" NAME="$4" CODE
|
||||||
|
if [ ! -r "$QUELLE" ]; then
|
||||||
|
echo "WARNUNG: Vorlage fehlt ($QUELLE) — Repo ohne $NAME angelegt." >&2
|
||||||
|
return
|
||||||
|
fi
|
||||||
|
CODE="$(curl -s -o /dev/null -w '%{http_code}' -X POST "$BASE/api/v1/repos/$FULL/contents/$ZIEL" \
|
||||||
-H "Authorization: token $PUSHTOKEN" -H "Content-Type: application/json" \
|
-H "Authorization: token $PUSHTOKEN" -H "Content-Type: application/json" \
|
||||||
--data "$(python3 - "$AMPEL" <<'PY'
|
--data "$(python3 - "$QUELLE" "$MSG" <<'PY'
|
||||||
import base64, json, sys
|
import base64, json, sys
|
||||||
inhalt = open(sys.argv[1], "rb").read()
|
inhalt = open(sys.argv[1], "rb").read()
|
||||||
print(json.dumps({"content": base64.b64encode(inhalt).decode(),
|
print(json.dumps({"content": base64.b64encode(inhalt).decode(), "message": sys.argv[2]}))
|
||||||
"message": "CI-Ampel (automatisch bei Repo-Anlage eingepflanzt)"}))
|
|
||||||
PY
|
PY
|
||||||
)")"
|
)")"
|
||||||
if [ "$SEED_CODE" = "201" ]; then
|
if [ "$CODE" = "201" ]; then
|
||||||
echo "CI-Ampel eingepflanzt (.gitea/workflows/ci.yml)."
|
echo "$NAME eingepflanzt ($ZIEL)."
|
||||||
else
|
else
|
||||||
echo "WARNUNG: CI-Ampel-Seed antwortete HTTP $SEED_CODE (Repo ist trotzdem da)." >&2
|
echo "WARNUNG: $NAME-Seed antwortete HTTP $CODE (Repo ist trotzdem da)." >&2
|
||||||
fi
|
|
||||||
else
|
|
||||||
echo "WARNUNG: Ampel-Vorlage fehlt ($AMPEL) — Repo ohne CI-Ampel angelegt." >&2
|
|
||||||
fi
|
fi
|
||||||
|
}
|
||||||
|
# JEDES neue Repo wird mit beiden Wächtern geboren:
|
||||||
|
# ci.yml = die AUSSEN-Prüfung (Gitea Actions nach dem Push, Wasserdicht-Runde 22.07.)
|
||||||
|
# VERIFY = die INNEN-Prüfung (das OpenCode-Plugin führt sie nach jeder Etappe aus und
|
||||||
|
# gibt rote Tests dem Agenten sofort zurück, statt sie erst der CI zu zeigen)
|
||||||
|
# Defensiv: scheitert ein Seed, wird die Anlage NICHT abgebrochen, nur gewarnt.
|
||||||
|
saat "$REALHOME/mission-control-v2/deploy/ampel-ci.yml" ".gitea/workflows/ci.yml" \
|
||||||
|
"CI-Ampel (automatisch bei Repo-Anlage eingepflanzt)" "CI-Ampel"
|
||||||
|
saat "$REALHOME/mission-control-v2/deploy/opencode/VERIFY.template" "VERIFY" \
|
||||||
|
"Pruef-Tor (automatisch bei Repo-Anlage eingepflanzt)" "Pruef-Tor"
|
||||||
echo "Repo '$FULL' angelegt (privat, main initialisiert)."
|
echo "Repo '$FULL' angelegt (privat, main initialisiert)."
|
||||||
echo "CLONE ${CLONE}"
|
echo "CLONE ${CLONE}"
|
||||||
exit 0 ;;
|
exit 0 ;;
|
||||||
|
|||||||
@@ -1,33 +0,0 @@
|
|||||||
# Arbeitsregeln (Aider liest diese Datei als schreibgeschützten Kontext)
|
|
||||||
|
|
||||||
Diese Regeln gelten für JEDE Sitzung. Sie sind der Kern der Session-Hygiene:
|
|
||||||
Wissen lebt in `SAVEPOINT.md` und in der git-Historie, NICHT im Chat-Verlauf.
|
|
||||||
|
|
||||||
## 1. Zu Beginn: erst SAVEPOINT.md lesen
|
|
||||||
Bevor du irgendetwas tust, lies `SAVEPOINT.md` vollständig. Es ist die Wahrheit über
|
|
||||||
den aktuellen Stand. Richte dich danach — nicht nach Annahmen. Erfinde keinen Kontext,
|
|
||||||
der nicht in `SAVEPOINT.md`, im Code oder in der git-Historie steht. Wenn etwas unklar
|
|
||||||
ist, sag es, statt es zu erfinden.
|
|
||||||
|
|
||||||
## 2. Nach jedem sinnvollen Schritt: SAVEPOINT.md aktualisieren
|
|
||||||
Sobald du eine sinnvolle Änderung abgeschlossen hast (eine Funktion, ein Fix, ein
|
|
||||||
Testlauf), aktualisiere `SAVEPOINT.md`. Halte es kurz und ehrlich. Struktur:
|
|
||||||
|
|
||||||
- **Ziel** — was insgesamt gebaut werden soll (ein bis zwei Sätze).
|
|
||||||
- **Erledigt** — was jetzt wirklich funktioniert (nur Bewiesenes; keine Fassade).
|
|
||||||
- **Nächster Schritt** — die genau eine Sache, die als Nächstes zu tun ist.
|
|
||||||
- **Offene Fragen** — Entscheidungen, die noch anstehen.
|
|
||||||
- **Stolpersteine** — alles, worüber eine frische Sitzung sonst stolpern würde.
|
|
||||||
- **Dateien** — die wichtigsten Dateien und was sie enthalten.
|
|
||||||
|
|
||||||
Schreibe es so, dass eine frische Sitzung OHNE jede Erinnerung allein aus `SAVEPOINT.md`
|
|
||||||
plus git sauber weitermachen kann. Das ist der Test: kein verstecktes Wissen im Chat.
|
|
||||||
|
|
||||||
## 3. Kleine, überprüfbare Schritte
|
|
||||||
Ändere wenig pro Runde. Behaupte nichts als fertig, was du nicht geprüft hast. Wenn ein
|
|
||||||
Test existiert, nenne sein Ergebnis. Wenn du unsicher bist, prüfe, statt zu raten.
|
|
||||||
|
|
||||||
## 4. Wenn der Governor das Sitzungs-Limit meldet
|
|
||||||
Erscheint eine Nachricht mit `[GOVERNOR — SITZUNGS-LIMIT ERREICHT]`, dann beginne KEINE
|
|
||||||
neuen Code-Änderungen mehr. Finalisiere nur `SAVEPOINT.md` (Stand vollständig, nächster
|
|
||||||
Schritt präzise) und weise den Nutzer an, eine frische Sitzung zu starten. Sonst nichts.
|
|
||||||
@@ -1,134 +0,0 @@
|
|||||||
# Governor — Phase 0
|
|
||||||
|
|
||||||
Dünner, zustandsloser Token-Wächter-Proxy zwischen einem Off-the-shelf-Coding-Agenten
|
|
||||||
(**Aider**) und dem lokalen Modell-Endpoint (llama-swap `:8080`). Er erzwingt
|
|
||||||
**Session-Hygiene per hartem Schnitt statt Auto-Compaction**: wenn die Anfrage (= ganze
|
|
||||||
Sitzungshistorie, die jede Runde mitkommt) eine Schwelle übersteigt, schiebt er eine
|
|
||||||
Anweisung ein, `SAVEPOINT.md` zu finalisieren und zu stoppen — damit Wissen in
|
|
||||||
`SAVEPOINT.md` + git lebt, nicht im degradierenden Chat-Kontext.
|
|
||||||
|
|
||||||
Das ist **Phase 0** des Ablöse-Plans „Lucy IDE-Modus + Governor": den Kern beweisen,
|
|
||||||
**ohne** eine Zeile Lucy-Code. Kein bespoke Editor, kein Aider-Fork, kein Modelltausch.
|
|
||||||
|
|
||||||
## Bausteine (dieses Verzeichnis)
|
|
||||||
| Datei | Zweck |
|
|
||||||
|---|---|
|
|
||||||
| `governor.py` | Der Proxy. Nur Standardbibliothek (läuft mit System-`python3`), zustandslos. |
|
|
||||||
| `CONVENTIONS.md` | Aiders schreibgeschützte Arbeitsregeln: SAVEPOINT.md zuerst lesen, laufend pflegen, keine Fassade. |
|
|
||||||
| `SAVEPOINT.template.md` | Anfangs-Savepoint für ein frisches Projekt. |
|
|
||||||
| `driver.py` | Treibt eine akkumulierende Aider-Sitzung über die Scripting-API (eine Zeile = eine Runde). |
|
|
||||||
| `gov-ctl.sh` | Governor sauber starten/stoppen/status (detached via `setsid`). |
|
|
||||||
| `run-driver.sh` | `run-driver.sh <msgs> [repo]` — Aider-Sitzung durch den Governor. |
|
|
||||||
| `reset-repo.sh` | Wegwerf-Test-Repo frisch aufsetzen. |
|
|
||||||
| `hardstop-test.sh` | Direkte curls für die drei Pfade (passthrough / soft / hart). |
|
|
||||||
| `msgs-*.txt` | Nachrichtenskripte für die Testläufe. |
|
|
||||||
|
|
||||||
## Verhalten des Governors
|
|
||||||
Pro `/v1/chat/completions`-Anfrage schätzt er die Tokenzahl (`Zeichen / GOV_CHARS_PER_TOKEN`,
|
|
||||||
kalibriert auf CPT **3.5** → `est ≈ echte prompt_tokens` auf ~1–3 % bei echten Sessions):
|
|
||||||
|
|
||||||
- **est < Soft** → unverändert durchreichen.
|
|
||||||
- **est ≥ Soft (`GOV_THRESHOLD`, Default 25000)** → hängt die SAVEPOINT-Stopp-Anweisung als
|
|
||||||
letzte User-Nachricht an, leitet weiter, loggt `FIRED`. Das Modell schreibt EINEN
|
|
||||||
ehrlichen Abschluss-Savepoint.
|
|
||||||
- **est ≥ Hart (`GOV_HARD_CEILING`, Default 0 = aus)** → der Governor antwortet SELBST mit
|
|
||||||
einer kurzen Stopp-Nachricht, **ohne** das Modell zu fragen; loggt `HARDSTOP`. Verhindert,
|
|
||||||
dass über die Grenze hinaus weitergearbeitet wird (siehe Befund unten).
|
|
||||||
|
|
||||||
Alle anderen Pfade (`/v1/models` etc.) werden roh durchgereicht. Streaming (SSE) wird
|
|
||||||
byteweise durchgereicht; die echten `prompt_tokens` aus der Antwort werden zur Kalibrierung
|
|
||||||
mitgeloggt.
|
|
||||||
|
|
||||||
### Sprach-Signal an Lucy (Phase 2)
|
|
||||||
Beim Feuern (soft ODER hart) POSTet der Governor — best-effort, gedrosselt (Default 300 s,
|
|
||||||
damit die Pro-Runde-Feuerung nicht spammt) — eine Meldung an Lucys vorhandene Announce-Pipeline
|
|
||||||
(`POST :9001/api/voice/announce`, `source:governor`, `priority:normal`). Lucy pollt diese Queue
|
|
||||||
ohnehin, dedupliziert per Cursor und spricht sie über ihr lokales TTS — gated durch ihren
|
|
||||||
„Box-Meldungen laut"-Schalter. **Kein Lucy-Code nötig.** Abschalten: `GOV_ANNOUNCE_URL=""`.
|
|
||||||
|
|
||||||
### Umgebungsvariablen
|
|
||||||
`GOV_PORT` (8100) · `GOV_HOST` (0.0.0.0) · `GOV_UPSTREAM` (http://127.0.0.1:8080) ·
|
|
||||||
`GOV_THRESHOLD` (25000) · `GOV_HARD_CEILING` (Default Soft+5000; 0=aus) · `GOV_CHARS_PER_TOKEN` (3.5) ·
|
|
||||||
`GOV_LOG` · `GOV_DIRECTIVE` · `GOV_HARDSTOP_MSG` · `GOV_ANNOUNCE_URL` (:9001/api/voice/announce; ""=aus) ·
|
|
||||||
`GOV_ANNOUNCE_THROTTLE` (300 s) · `GOV_ANNOUNCE_TEXT`.
|
|
||||||
|
|
||||||
## Auf der Box laufen lassen (wie in P0 aufgesetzt)
|
|
||||||
```bash
|
|
||||||
# Aider (einmalig, unter isoliertem Python 3.12 — System-Python 3.14 bricht Aiders Pins):
|
|
||||||
pipx install uv && uv tool install --python 3.12 aider-chat
|
|
||||||
|
|
||||||
# Dateien liegen in ~/governor-p0/. Governor starten (Hart-Deckel default AN = Soft+5000):
|
|
||||||
~/governor-p0/gov-ctl.sh start 25000 # Soft 25k, Hart 30k (auto)
|
|
||||||
# ~/governor-p0/gov-ctl.sh start 25000 0 # Hart AUS (nur weicher Schnitt)
|
|
||||||
|
|
||||||
# Aider-Sitzung durch den Governor:
|
|
||||||
~/governor-p0/run-driver.sh ~/governor-p0/msgs-todo.txt
|
|
||||||
```
|
|
||||||
Aider zeigt mit `OPENAI_API_BASE=http://127.0.0.1:8100/v1` und Modell
|
|
||||||
`openai/Qwen3-Coder-Next` auf den Governor.
|
|
||||||
|
|
||||||
## Wichtig: Aiders eigene Zusammenfassung MUSS aus
|
|
||||||
Der Treiber setzt `coder.summarizer.max_tokens` auf ~1e9. Sonst fasst Aider die Historie
|
|
||||||
selbst zusammen (Auto-Compaction) und die Anfrage wächst nie bis zur Schwelle — der
|
|
||||||
Governor wäre ausgehebelt, und man bekäme genau die über-komprimierte Halluzination, die
|
|
||||||
der Plan verwirft. Der Governor soll die **alleinige** Sitzungsgrenze sein.
|
|
||||||
|
|
||||||
## Ergebnisse & Befunde (24.07.2026)
|
|
||||||
|
|
||||||
### Akzeptanz — alle vier Kriterien bewiesen (Box, Qwen3-Coder-Next)
|
|
||||||
1. **Governor zählt + feuert an der Schwelle** — 12-Runden-Todo-Lauf (Soft 8000): Runden 1-6
|
|
||||||
`ok`, ab Runde 7 `FIRED` (est 8546 / echt 8652). Hart-Deckel: Anfrage mit est 11429 ≥ 10000
|
|
||||||
→ `HARDSTOP`, Governor antwortet selbst (kein Modell-Call). Alles im Log.
|
|
||||||
2. **Aider pflegt SAVEPOINT.md** — über den ganzen Aufbau hinweg strukturiert gehalten
|
|
||||||
(Ziel/Erledigt/Nächster Schritt/Stolpersteine/Dateien) gemäß `CONVENTIONS.md`.
|
|
||||||
3. **An der Grenze: ehrlicher Abschluss + Stopp** — beim ersten Feuern (Runde 7) schrieb das
|
|
||||||
Modell einen **ehrlichen** Savepoint (nur real Gebautes unter „Erledigt", Tests als nächster
|
|
||||||
Schritt) und verweigerte neuen Code.
|
|
||||||
4. **Frische Sitzung macht sauber weiter — keine Fassade** — neue Aider-Sitzung las den
|
|
||||||
Grenz-Savepoint, baute `test_todo.py` (der exakte nächste Schritt), und **alle 9 unittest-
|
|
||||||
Tests laufen grün** gegen die echte API. Kein Erfinden.
|
|
||||||
|
|
||||||
### Kalibrierung
|
|
||||||
`CHARS_PER_TOKEN = 3.5` → `est` traf die echten `prompt_tokens` bei realen Sessions auf ~1-3 %.
|
|
||||||
(Nur künstlicher, extrem repetitiver Fülltext bricht die Heuristik — irrelevant für echten Code.)
|
|
||||||
Der Coder läuft mit 128k Kontext (`-c 131072`), also keine Modell-Kappung bei 25k.
|
|
||||||
|
|
||||||
### Wichtigster Befund: Soft reicht nicht allein → Hart-Deckel nachgerüstet
|
|
||||||
Der **weiche** Schnitt erzeugt genau EINEN ehrlichen Grenz-Savepoint — solange die Grenze
|
|
||||||
respektiert wird. Schickt man aber über die Grenze hinaus weiter Aufträge (wie im Stresstest),
|
|
||||||
verweigert das Modell zwar den Code, schreibt die Absichten aber fortschreitend als „erledigt"
|
|
||||||
in SAVEPOINT — genährt von Aiders **irreführenden Commit-Nachrichten** (die aus dem SAVEPOINT-
|
|
||||||
Absichtstext geschöpft werden). Ergebnis: eine Fassade (behauptete test_todo.py/README, die es
|
|
||||||
nicht gab). Deshalb der optionale **Hart-Deckel** (`GOV_HARD_CEILING`): oberhalb davon antwortet
|
|
||||||
der Governor selbst, das Modell kann keine degradierenden Savepoints mehr schreiben. **Der Hart-
|
|
||||||
Deckel ist jetzt Default AN** (`GOV_HARD_CEILING` unset → Soft+5000; explizit `0` schaltet ihn
|
|
||||||
aus): ein Finalisier-Zug Luft, dann harter Riegel — das schliesst die Fassaden-Lücke.
|
|
||||||
|
|
||||||
### Weitere Befunde / Fallen
|
|
||||||
- **Aiders eigene Zusammenfassung MUSS aus** (`summarizer.max_tokens` hoch) — sonst compactet
|
|
||||||
Aider selbst und der Governor greift nie. Siehe oben.
|
|
||||||
- **Commit-Nachrichten überzeichnen** in der Abschluss-Phase (aus SAVEPOINT-Absicht). Der Code
|
|
||||||
ist die Wahrheit; git-Nachrichten sind es hier nicht. Der Hart-Deckel (jetzt Default) begrenzt
|
|
||||||
das auf ~1 Zug; wer es ganz sauber will, startet Aider mit `--no-auto-commits` (Commits von Hand).
|
|
||||||
- **Python 3.14 auf der Box bricht Aiders Pins** (numpy 1.24.3) → Aider via `uv` unter isoliertem
|
|
||||||
Python 3.12 installiert.
|
|
||||||
- **Aider-Scripting-API (`coder.run`) hängt** in einer Datei-Hinzufügen-Reflexion (Edits landeten
|
|
||||||
nicht). Für Einzel-Runden `aider --message` nutzen (sauberer, unterstützt). Der `driver.py`
|
|
||||||
taugt für Mehr-Runden-Akkumulation (Governor-Test), nicht als Produktions-Treiber.
|
|
||||||
|
|
||||||
### Bekannte Grenzen des Governors (aus adversarialer Review, für später)
|
|
||||||
- **Chunked Request-Bodies ohne `Content-Length`** werden verworfen (Aiders httpx sendet immer
|
|
||||||
`Content-Length` → schlummernd, aber ein Proxy-Hop mit Chunking bräche).
|
|
||||||
- **Tool-/Function-Calling**: der Soft-Einschub als letzte `user`-Nachricht kann die Nachrichten-
|
|
||||||
reihenfolge stören, wenn Aider ein Tool-Calling-Edit-Format nutzt (Aiders diff/whole sind reiner
|
|
||||||
Text → schlummernd). `estimate_tokens` zählt `tools`/`tool_calls` nicht mit.
|
|
||||||
- **`https://`-Upstream** wird nicht unterstützt (nur `http.client.HTTPConnection`). Für den
|
|
||||||
lokalen `:8080`-Endpoint irrelevant.
|
|
||||||
Behoben aus derselben Review: **inkrementelles Streaming** (`read1()` statt `read()` — vorher
|
|
||||||
puffernd), **Config-Crash** bei `{ }` in `GOV_DIRECTIVE` (sichere Substitution), **Query-String**
|
|
||||||
umging die Erkennung, **Socket-Leak** im Fehlerpfad, doppelte `Date`/`Server`-Header.
|
|
||||||
|
|
||||||
## Nächste Schritte (Phase 1+)
|
|
||||||
Terminal in Lucy einbetten (xterm.js + node-pty, MC2-Muster kopieren) → Voice-Hook auf das
|
|
||||||
Governor-Signal → Feinschliff + Aider/Pi-Finalentscheid. Governor evtl. später in mc2-gateway.
|
|
||||||
Kandidat für Phase 1-Härtung: Auto-Commit-Zügelung + Hart-Deckel als Default.
|
|
||||||
@@ -1,23 +0,0 @@
|
|||||||
# SAVEPOINT
|
|
||||||
|
|
||||||
> Lebende Übergabe-Datei. Die aktuelle Sitzung hält sie fortlaufend aktuell; eine
|
|
||||||
> frische Sitzung liest sie ZUERST und macht allein daraus plus git weiter.
|
|
||||||
> (Anfangszustand — von der ersten Sitzung zu ersetzen.)
|
|
||||||
|
|
||||||
## Ziel
|
|
||||||
_(noch nichts — von der ersten Sitzung zu füllen)_
|
|
||||||
|
|
||||||
## Erledigt
|
|
||||||
- _(noch nichts)_
|
|
||||||
|
|
||||||
## Nächster Schritt
|
|
||||||
- Auftrag des Nutzers entgegennehmen und beginnen.
|
|
||||||
|
|
||||||
## Offene Fragen
|
|
||||||
- _(keine)_
|
|
||||||
|
|
||||||
## Stolpersteine
|
|
||||||
- _(keine bekannt)_
|
|
||||||
|
|
||||||
## Dateien
|
|
||||||
- `SAVEPOINT.md` — diese Übergabe-Datei.
|
|
||||||
@@ -1,22 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# announce-test.sh — loest ein Feuern aus und prueft, ob der Governor das Sprach-
|
|
||||||
# Signal an Lucys Announce-Queue (:9001) postet (Phase 2). Voraussetzung: Governor
|
|
||||||
# mit niedriger Schwelle gestartet, damit ein einzelner Request feuert.
|
|
||||||
set -u
|
|
||||||
GOV="http://127.0.0.1:8100/v1/chat/completions"
|
|
||||||
|
|
||||||
python3 - <<'PY' > /tmp/gov_fire.json
|
|
||||||
import json
|
|
||||||
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"y"*35000}],"max_tokens":8,"stream":False}))
|
|
||||||
PY
|
|
||||||
|
|
||||||
echo "=== Feuern ausloesen (est ~10000 Tokens, ueber Hart-Deckel) ==="
|
|
||||||
curl -s -m 20 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_fire.json | jq '{id, finish: .choices[0].finish_reason}'
|
|
||||||
|
|
||||||
sleep 1.5 # Announce-Thread durchlassen
|
|
||||||
echo "=== Governor-Log (letzte 4 Zeilen) ==="
|
|
||||||
tail -4 ~/governor-p0/governor.log
|
|
||||||
|
|
||||||
echo "=== Announce-Queue: Governor-Eintraege ==="
|
|
||||||
curl -s -m 8 "http://127.0.0.1:9001/api/voice/announcements?after=0&limit=100" \
|
|
||||||
| jq '[.items[] | select(.source=="governor")] | (last // "KEINE governor-Meldung gefunden")'
|
|
||||||
@@ -1,67 +0,0 @@
|
|||||||
#!/usr/bin/env python3
|
|
||||||
"""driver.py — treibt EINE Aider-Sitzung ueber die Scripting-API durch den Governor.
|
|
||||||
|
|
||||||
Jede Zeile der Nachrichtendatei ist eine User-Runde. Weil derselbe Coder alle Runden
|
|
||||||
bedient, akkumuliert die Historie und die Anfrage waechst jede Runde — genau das, was
|
|
||||||
der Governor beobachtet. Aiders EIGENE History-Zusammenfassung wird abgeschaltet, damit
|
|
||||||
der Governor die alleinige Sitzungsgrenze ist (der Plan verwirft Auto-Compaction bewusst).
|
|
||||||
|
|
||||||
Aufruf (cwd muss das Test-Repo sein, mit venv-python):
|
|
||||||
.../aider-chat/bin/python driver.py <messages-file>
|
|
||||||
"""
|
|
||||||
import os
|
|
||||||
import sys
|
|
||||||
|
|
||||||
from aider.coders import Coder
|
|
||||||
from aider.io import InputOutput
|
|
||||||
from aider.models import Model
|
|
||||||
|
|
||||||
|
|
||||||
def main() -> int:
|
|
||||||
# Endpoint VOR den Aider-Aufrufen setzen (litellm liest es zur Laufzeit).
|
|
||||||
os.environ.setdefault("OPENAI_API_BASE", "http://127.0.0.1:8100/v1")
|
|
||||||
os.environ.setdefault("OPENAI_API_KEY", "dummy")
|
|
||||||
if len(sys.argv) < 2:
|
|
||||||
print("usage: driver.py <messages-file>", file=sys.stderr)
|
|
||||||
return 2
|
|
||||||
with open(sys.argv[1], encoding="utf-8") as fh:
|
|
||||||
messages = [ln.strip() for ln in fh if ln.strip() and not ln.lstrip().startswith("#")]
|
|
||||||
|
|
||||||
model = Model("openai/Qwen3-Coder-Next")
|
|
||||||
io = InputOutput(yes=True) # alle Rueckfragen automatisch bejahen
|
|
||||||
coder = Coder.create(
|
|
||||||
main_model=model,
|
|
||||||
io=io,
|
|
||||||
fnames=["SAVEPOINT.md"], # editierbar
|
|
||||||
read_only_fnames=["CONVENTIONS.md"], # nur-lesbar
|
|
||||||
auto_commits=True, # jede Etappe -> git-Commit
|
|
||||||
stream=False, # deterministische Logs fuer P0
|
|
||||||
map_tokens=512,
|
|
||||||
use_git=True,
|
|
||||||
)
|
|
||||||
|
|
||||||
# Aiders eigene Zusammenfassung ausschalten: too_big() wird nie wahr.
|
|
||||||
try:
|
|
||||||
coder.summarizer.max_tokens = 10 ** 9
|
|
||||||
print(f"[driver] summarizer.max_tokens -> {coder.summarizer.max_tokens}", flush=True)
|
|
||||||
except Exception as exc: # noqa: BLE001
|
|
||||||
print(f"[driver] WARN konnte summarizer nicht abschalten: {exc}", flush=True)
|
|
||||||
|
|
||||||
for i, msg in enumerate(messages, 1):
|
|
||||||
print(f"\n===== TURN {i}/{len(messages)} =====", flush=True)
|
|
||||||
print(f">> {msg[:140]}", flush=True)
|
|
||||||
try:
|
|
||||||
coder.run(with_message=msg)
|
|
||||||
except Exception as exc: # noqa: BLE001
|
|
||||||
print(f"[driver] TURN {i} Fehler: {exc!r}", flush=True)
|
|
||||||
break
|
|
||||||
sent = getattr(coder, "total_tokens_sent", "?")
|
|
||||||
recv = getattr(coder, "total_tokens_received", "?")
|
|
||||||
print(f"-- aider kum: gesendet={sent} empfangen={recv}", flush=True)
|
|
||||||
|
|
||||||
print("\n===== SESSION ENDE =====", flush=True)
|
|
||||||
return 0
|
|
||||||
|
|
||||||
|
|
||||||
if __name__ == "__main__":
|
|
||||||
sys.exit(main())
|
|
||||||
@@ -1,54 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# gov-ctl.sh — Governor sauber starten/stoppen (Phase-0-Helfer).
|
|
||||||
# Nutzung:
|
|
||||||
# gov-ctl.sh start [SCHWELLE] # startet detached, Default-Schwelle 25000
|
|
||||||
# gov-ctl.sh stop
|
|
||||||
# gov-ctl.sh status
|
|
||||||
set -u
|
|
||||||
DIR="$HOME/governor-p0"
|
|
||||||
PIDF="$DIR/governor.pid"
|
|
||||||
LOG="$DIR/governor.log"
|
|
||||||
OUT="$DIR/governor.stdout"
|
|
||||||
|
|
||||||
start() {
|
|
||||||
stop
|
|
||||||
local thr="${1:-25000}"
|
|
||||||
cd "$DIR"
|
|
||||||
: > "$LOG"
|
|
||||||
# Voll detachen: eigene Session, alle FDs weg vom Aufrufer.
|
|
||||||
# Hart-Deckel nur setzen, wenn explizit uebergeben (Arg 2); sonst rechnet
|
|
||||||
# governor.py den Default (Soft + 5000). CPT-Default 3.5 (kalibriert 24.07.).
|
|
||||||
local hardenv=()
|
|
||||||
if [ -n "${2:-}" ]; then hardenv=(GOV_HARD_CEILING="$2"); fi
|
|
||||||
setsid env GOV_THRESHOLD="$thr" "${hardenv[@]}" \
|
|
||||||
GOV_CHARS_PER_TOKEN="${GOV_CHARS_PER_TOKEN:-3.5}" \
|
|
||||||
GOV_LOG="$LOG" GOV_PORT=8100 \
|
|
||||||
python3 "$DIR/governor.py" </dev/null >>"$OUT" 2>&1 &
|
|
||||||
echo $! > "$PIDF"
|
|
||||||
sleep 1.2
|
|
||||||
echo "started pid=$(cat "$PIDF") threshold=$thr hard=${2:-auto}"
|
|
||||||
ss -tlnp 2>/dev/null | grep ":8100" >/dev/null && echo "listening :8100 OK" || echo "WARN: not listening"
|
|
||||||
}
|
|
||||||
|
|
||||||
stop() {
|
|
||||||
pkill -f "$DIR/governor.py" 2>/dev/null || true
|
|
||||||
[ -f "$PIDF" ] && kill "$(cat "$PIDF")" 2>/dev/null || true
|
|
||||||
sleep 0.6
|
|
||||||
rm -f "$PIDF"
|
|
||||||
}
|
|
||||||
|
|
||||||
status() {
|
|
||||||
if pgrep -f "$DIR/governor.py" >/dev/null; then
|
|
||||||
echo "running pid=$(pgrep -f "$DIR/governor.py" | tr '\n' ' ')"
|
|
||||||
ss -tlnp 2>/dev/null | grep ":8100" || true
|
|
||||||
else
|
|
||||||
echo "not running"
|
|
||||||
fi
|
|
||||||
}
|
|
||||||
|
|
||||||
case "${1:-status}" in
|
|
||||||
start) shift; start "${1:-25000}" "${2:-}" ;;
|
|
||||||
stop) stop; echo stopped ;;
|
|
||||||
status) status ;;
|
|
||||||
*) echo "usage: gov-ctl.sh {start [soft] [hart]|stop|status}"; exit 2 ;;
|
|
||||||
esac
|
|
||||||
@@ -1,420 +0,0 @@
|
|||||||
#!/usr/bin/env python3
|
|
||||||
"""Governor — duenner, zustandsloser Token-Waechter-Proxy (Phase 0).
|
|
||||||
|
|
||||||
Sitzt zwischen einem Coding-Agenten (Aider) und dem Modell-Endpoint (llama-swap
|
|
||||||
:8080). Reicht ALLES unveraendert durch — mit einer Ausnahme bei
|
|
||||||
/v1/chat/completions: er schaetzt die Token-Groesse der Anfrage (= Sessiongroesse,
|
|
||||||
weil die ganze Historie jede Runde mitkommt) und handelt nach zwei Schwellen:
|
|
||||||
|
|
||||||
est >= SCHWELLE (soft): haengt eine Stopp-Anweisung als letzte User-Nachricht an
|
|
||||||
("SAVEPOINT.md finalisieren + stoppen") und leitet weiter. Das Modell schreibt
|
|
||||||
EINEN ehrlichen Abschluss-Savepoint. Loggt FIRED.
|
|
||||||
est >= HART-DECKEL (optional): antwortet SELBST mit einer kurzen Stopp-Nachricht,
|
|
||||||
OHNE das Modell zu fragen. Verhindert, dass ueber die Grenze hinaus
|
|
||||||
weitergearbeitet wird — genau das erzeugte in Tests eine Fassade. Loggt HARDSTOP.
|
|
||||||
|
|
||||||
Bewusst nur Standardbibliothek: kein pip, kein venv, laeuft mit System-python3.
|
|
||||||
Bewusst zustandslos: jede Anfrage wird fuer sich bewertet; keine Sitzungs-DB.
|
|
||||||
|
|
||||||
Konfiguration per Umgebungsvariablen (alle optional):
|
|
||||||
GOV_PORT Listen-Port (Default 8100)
|
|
||||||
GOV_HOST Listen-Adresse (Default 0.0.0.0)
|
|
||||||
GOV_UPSTREAM Modell-Endpoint (Default http://127.0.0.1:8080)
|
|
||||||
GOV_THRESHOLD Soft-Schwelle fuer den Einschub (Default 25000)
|
|
||||||
GOV_HARD_CEILING Hart-Deckel; 0 = aus (Default: Soft+5000, AN)
|
|
||||||
GOV_CHARS_PER_TOKEN Heuristik Zeichen->Token (Default 3.5, kalibriert)
|
|
||||||
GOV_LOG Logdatei (zusaetzlich zu stdout) (Default ./governor.log)
|
|
||||||
GOV_DIRECTIVE Text des Soft-Einschubs (sonst Default unten)
|
|
||||||
GOV_HARDSTOP_MSG Text der Hart-Stopp-Antwort (sonst Default unten)
|
|
||||||
GOV_ANNOUNCE_URL Lucy-Sprach-Signal-Endpunkt; "" = aus (Default :9001/api/voice/announce)
|
|
||||||
GOV_ANNOUNCE_THROTTLE Sekunden zwischen Signalen (Default 300)
|
|
||||||
GOV_ANNOUNCE_TEXT Text des Sprach-Signals (sonst Default)
|
|
||||||
"""
|
|
||||||
|
|
||||||
import http.client
|
|
||||||
import json
|
|
||||||
import os
|
|
||||||
import re
|
|
||||||
import threading
|
|
||||||
import time
|
|
||||||
from http.server import BaseHTTPRequestHandler, ThreadingHTTPServer
|
|
||||||
from urllib.parse import urlparse
|
|
||||||
|
|
||||||
# ---- Konfiguration ---------------------------------------------------------
|
|
||||||
|
|
||||||
PORT = int(os.environ.get("GOV_PORT", "8100"))
|
|
||||||
HOST = os.environ.get("GOV_HOST", "0.0.0.0")
|
|
||||||
UPSTREAM = os.environ.get("GOV_UPSTREAM", "http://127.0.0.1:8080")
|
|
||||||
THRESHOLD = int(os.environ.get("GOV_THRESHOLD", "25000"))
|
|
||||||
# Hart-Deckel: Default AN (Soft + 5000 = ein Finalisier-Zug Luft), weil der weiche
|
|
||||||
# Schnitt allein bei Weiterarbeit ueber die Grenze eine Fassade erzeugt (Befund P0).
|
|
||||||
# Explizit setzbar; GOV_HARD_CEILING=0 schaltet ihn aus.
|
|
||||||
_hard_env = os.environ.get("GOV_HARD_CEILING")
|
|
||||||
HARD_CEILING = (THRESHOLD + 5000) if _hard_env is None else int(_hard_env)
|
|
||||||
CHARS_PER_TOKEN = float(os.environ.get("GOV_CHARS_PER_TOKEN", "3.5"))
|
|
||||||
LOG_PATH = os.environ.get("GOV_LOG", os.path.join(os.getcwd(), "governor.log"))
|
|
||||||
|
|
||||||
DEFAULT_DIRECTIVE = (
|
|
||||||
"[GOVERNOR — SITZUNGS-LIMIT ERREICHT] Der Kontext dieser Sitzung ist auf ~{est} "
|
|
||||||
"Tokens gewachsen (Limit {threshold}). Beginne oder setze JETZT KEINE weiteren "
|
|
||||||
"Code-Aenderungen fort. Stattdessen, in dieser Reihenfolge:\n"
|
|
||||||
"1. Aktualisiere SAVEPOINT.md so, dass es den aktuellen Stand vollstaendig festhaelt: "
|
|
||||||
"was WIRKLICH erledigt ist (nur was im Code steht — nichts aus Absicht oder git-"
|
|
||||||
"Nachrichten ableiten), der genaue naechste Schritt, offene Fragen und alle "
|
|
||||||
"Stolpersteine — genug, dass eine frische Sitzung ohne jede Erinnerung allein aus "
|
|
||||||
"SAVEPOINT.md plus git-Historie sauber weitermachen kann.\n"
|
|
||||||
"2. Halte dann an und sage dem Nutzer in einem Satz, dass er eine frische Sitzung "
|
|
||||||
"starten soll. Gib ausser der SAVEPOINT.md-Aktualisierung und diesem Hinweis nichts aus."
|
|
||||||
)
|
|
||||||
DIRECTIVE = os.environ.get("GOV_DIRECTIVE", DEFAULT_DIRECTIVE)
|
|
||||||
|
|
||||||
DEFAULT_HARDSTOP = (
|
|
||||||
"[GOVERNOR — HARTER STOPP] Das Sitzungs-Limit ist ueberschritten und der Savepoint "
|
|
||||||
"sollte bereits finalisiert sein. Diese Sitzung nimmt keine weiteren Auftraege mehr an. "
|
|
||||||
"Bitte starte eine FRISCHE Sitzung — sie liest SAVEPOINT.md und die git-Historie und "
|
|
||||||
"macht sauber weiter. (Keine Code-Aenderung in dieser Antwort.)"
|
|
||||||
)
|
|
||||||
HARDSTOP_MSG = os.environ.get("GOV_HARDSTOP_MSG", DEFAULT_HARDSTOP)
|
|
||||||
|
|
||||||
# Sprach-Signal an Lucy (Phase 2): beim Feuern POSTet der Governor eine Meldung an die
|
|
||||||
# vorhandene MC2-Announce-Pipeline (:9001). Lucy pollt sie ohnehin, dedupliziert und
|
|
||||||
# spricht sie (gated durch ihren "Box-Meldungen laut"-Schalter). Best-effort, gedrosselt
|
|
||||||
# gegen die Pro-Runde-Feuerung. GOV_ANNOUNCE_URL="" schaltet das Signal ab.
|
|
||||||
ANNOUNCE_URL = os.environ.get("GOV_ANNOUNCE_URL", "http://127.0.0.1:9001/api/voice/announce")
|
|
||||||
ANNOUNCE_THROTTLE = float(os.environ.get("GOV_ANNOUNCE_THROTTLE", "300")) # Sekunden
|
|
||||||
DEFAULT_ANNOUNCE = (
|
|
||||||
"Commander, die Coding-Sitzung wird voll — ungefähr {est} Tokens. Ich sichere den "
|
|
||||||
"Stand im Savepoint; am besten fangen wir gleich frisch an."
|
|
||||||
)
|
|
||||||
ANNOUNCE_TEXT = os.environ.get("GOV_ANNOUNCE_TEXT", DEFAULT_ANNOUNCE)
|
|
||||||
|
|
||||||
up = urlparse(UPSTREAM)
|
|
||||||
UP_HOST = up.hostname or "127.0.0.1"
|
|
||||||
UP_PORT = up.port or 80
|
|
||||||
|
|
||||||
HOP_BY_HOP = {
|
|
||||||
"connection", "keep-alive", "proxy-authenticate", "proxy-authorization",
|
|
||||||
"te", "trailers", "transfer-encoding", "upgrade",
|
|
||||||
}
|
|
||||||
|
|
||||||
_log_lock = threading.Lock()
|
|
||||||
_PROMPT_TOKENS_RE = re.compile(r'"prompt_tokens"\s*:\s*(\d+)')
|
|
||||||
_announce_lock = threading.Lock()
|
|
||||||
_last_announce = 0.0 # Zeitstempel der letzten Meldung (Drossel)
|
|
||||||
_an = urlparse(ANNOUNCE_URL) if ANNOUNCE_URL else None
|
|
||||||
|
|
||||||
|
|
||||||
def log(line: str) -> None:
|
|
||||||
"""Eine Zeile nach stdout UND in die Logdatei (thread-sicher)."""
|
|
||||||
stamp = time.strftime("%Y-%m-%dT%H:%M:%S")
|
|
||||||
msg = f"{stamp} {line}"
|
|
||||||
with _log_lock:
|
|
||||||
print(msg, flush=True)
|
|
||||||
try:
|
|
||||||
with open(LOG_PATH, "a", encoding="utf-8") as fh:
|
|
||||||
fh.write(msg + "\n")
|
|
||||||
except OSError:
|
|
||||||
pass
|
|
||||||
|
|
||||||
|
|
||||||
def estimate_tokens(messages) -> int:
|
|
||||||
"""Grobe, aber stabile Heuristik: Zeichen aller Nachrichteninhalte / CPT.
|
|
||||||
|
|
||||||
Gegen die echten prompt_tokens aus der Antwort kalibriert (CPT=3.5 traf am
|
|
||||||
24.07. auf ~1-3 % genau). Zaehlt Text in String- und Multimodal-Listen-Inhalten;
|
|
||||||
kleiner Aufschlag je Nachricht fuer Rollen-/Template-Overhead.
|
|
||||||
"""
|
|
||||||
chars = 0
|
|
||||||
for m in messages or []:
|
|
||||||
chars += 4
|
|
||||||
content = m.get("content") if isinstance(m, dict) else None
|
|
||||||
if isinstance(content, str):
|
|
||||||
chars += len(content)
|
|
||||||
elif isinstance(content, list):
|
|
||||||
for part in content:
|
|
||||||
if isinstance(part, dict) and isinstance(part.get("text"), str):
|
|
||||||
chars += len(part["text"])
|
|
||||||
return int(chars / CHARS_PER_TOKEN)
|
|
||||||
|
|
||||||
|
|
||||||
def _post_announce(est) -> None:
|
|
||||||
"""POSTet die Meldung an die MC2-Announce-Pipeline. Laeuft im Hintergrund-Thread."""
|
|
||||||
try:
|
|
||||||
text = (ANNOUNCE_TEXT.replace("{est}", str(est))
|
|
||||||
.replace("{threshold}", str(THRESHOLD)))
|
|
||||||
body = json.dumps({"text": text, "subject": "[Governor]",
|
|
||||||
"source": "governor", "priority": "normal"}).encode("utf-8")
|
|
||||||
conn = http.client.HTTPConnection(_an.hostname or "127.0.0.1",
|
|
||||||
_an.port or 80, timeout=4)
|
|
||||||
conn.request("POST", _an.path or "/api/voice/announce", body=body,
|
|
||||||
headers={"Content-Type": "application/json",
|
|
||||||
"Content-Length": str(len(body))})
|
|
||||||
resp = conn.getresponse()
|
|
||||||
resp.read()
|
|
||||||
conn.close()
|
|
||||||
log(f"ANNOUNCE -> Lucy status={resp.status} est={est}")
|
|
||||||
except Exception as exc: # noqa: BLE001
|
|
||||||
log(f"ANNOUNCE fehlgeschlagen: {exc!r}")
|
|
||||||
|
|
||||||
|
|
||||||
def maybe_announce(est) -> None:
|
|
||||||
"""Sprach-Signal an Lucy ausloesen — gedrosselt, damit die Pro-Runde-Feuerung
|
|
||||||
nicht spammt (eine Aeusserung je Ueberschreitungs-Episode). Best-effort."""
|
|
||||||
if not _an:
|
|
||||||
return
|
|
||||||
global _last_announce
|
|
||||||
now = time.time()
|
|
||||||
with _announce_lock:
|
|
||||||
if now - _last_announce < ANNOUNCE_THROTTLE:
|
|
||||||
return
|
|
||||||
_last_announce = now
|
|
||||||
threading.Thread(target=_post_announce, args=(est,), daemon=True).start()
|
|
||||||
|
|
||||||
|
|
||||||
class Handler(BaseHTTPRequestHandler):
|
|
||||||
protocol_version = "HTTP/1.1"
|
|
||||||
server_version = "Governor/0.2"
|
|
||||||
|
|
||||||
def log_message(self, *args):
|
|
||||||
pass
|
|
||||||
|
|
||||||
def do_GET(self):
|
|
||||||
self._proxy()
|
|
||||||
|
|
||||||
def do_POST(self):
|
|
||||||
self._proxy()
|
|
||||||
|
|
||||||
def do_PUT(self):
|
|
||||||
self._proxy()
|
|
||||||
|
|
||||||
def do_DELETE(self):
|
|
||||||
self._proxy()
|
|
||||||
|
|
||||||
def do_OPTIONS(self):
|
|
||||||
self._proxy()
|
|
||||||
|
|
||||||
# -- Kern ---------------------------------------------------------------
|
|
||||||
def _read_body(self) -> bytes:
|
|
||||||
length = self.headers.get("Content-Length")
|
|
||||||
if length is None:
|
|
||||||
return b""
|
|
||||||
try:
|
|
||||||
return self.rfile.read(int(length))
|
|
||||||
except (ValueError, OSError):
|
|
||||||
return b""
|
|
||||||
|
|
||||||
def _proxy(self) -> None:
|
|
||||||
body = self._read_body()
|
|
||||||
path = self.path
|
|
||||||
# Query-String vor der Endpunkt-Erkennung abschneiden (sonst umgeht
|
|
||||||
# z. B. ?api-version=... den Governor).
|
|
||||||
clean_path = path.split("?", 1)[0]
|
|
||||||
is_chat = clean_path.rstrip("/").endswith("/chat/completions")
|
|
||||||
|
|
||||||
action = "passthrough"
|
|
||||||
est = None
|
|
||||||
streaming = False
|
|
||||||
model = ""
|
|
||||||
if is_chat and body:
|
|
||||||
action, body, est, streaming, model = self._decide(body)
|
|
||||||
if action in ("soft", "hard"):
|
|
||||||
maybe_announce(est) # Sprach-Signal an Lucy (gedrosselt)
|
|
||||||
|
|
||||||
# HARTER STOPP: selbst antworten, Upstream nie fragen.
|
|
||||||
if action == "hard":
|
|
||||||
self._send_canned_stop(model, streaming, est)
|
|
||||||
log(f"chat est={est} thr={THRESHOLD} hard={HARD_CEILING} HARDSTOP "
|
|
||||||
f"stream={streaming} status=200")
|
|
||||||
return
|
|
||||||
|
|
||||||
# Header fuer Upstream aufbereiten.
|
|
||||||
out_headers = {}
|
|
||||||
for k, v in self.headers.items():
|
|
||||||
kl = k.lower()
|
|
||||||
if kl in HOP_BY_HOP or kl in ("host", "content-length", "accept-encoding"):
|
|
||||||
continue
|
|
||||||
out_headers[k] = v
|
|
||||||
out_headers["Host"] = f"{UP_HOST}:{UP_PORT}"
|
|
||||||
out_headers["Accept-Encoding"] = "identity"
|
|
||||||
if body:
|
|
||||||
out_headers["Content-Length"] = str(len(body))
|
|
||||||
out_headers["Connection"] = "close"
|
|
||||||
|
|
||||||
conn = None
|
|
||||||
try:
|
|
||||||
conn = http.client.HTTPConnection(UP_HOST, UP_PORT, timeout=600)
|
|
||||||
conn.request(self.command, path, body=body or None, headers=out_headers)
|
|
||||||
resp = conn.getresponse()
|
|
||||||
except (OSError, http.client.HTTPException) as exc:
|
|
||||||
log(f"ERROR upstream {self.command} {path}: {exc!r}")
|
|
||||||
if conn is not None:
|
|
||||||
conn.close()
|
|
||||||
self._safe_error(502, f"governor upstream: {exc}")
|
|
||||||
return
|
|
||||||
|
|
||||||
self.send_response(resp.status)
|
|
||||||
for k, v in resp.getheaders():
|
|
||||||
kl = k.lower()
|
|
||||||
# hop-by-hop + Laenge raus; Date/Server setzt send_response schon selbst.
|
|
||||||
if kl in HOP_BY_HOP or kl in ("content-length", "date", "server"):
|
|
||||||
continue
|
|
||||||
self.send_header(k, v)
|
|
||||||
self.send_header("Connection", "close")
|
|
||||||
self.end_headers()
|
|
||||||
|
|
||||||
tail = bytearray()
|
|
||||||
try:
|
|
||||||
while True:
|
|
||||||
# read1() gibt jedes Upstream-Stueck sofort zurueck (echtes SSE-
|
|
||||||
# Durchreichen). read() wuerde bis 64 KB oder Stream-Ende puffern
|
|
||||||
# und streamendes Aider die ganze Generierung haengen lassen.
|
|
||||||
chunk = resp.read1(65536)
|
|
||||||
if not chunk:
|
|
||||||
break
|
|
||||||
self.wfile.write(chunk)
|
|
||||||
self.wfile.flush()
|
|
||||||
tail.extend(chunk)
|
|
||||||
if len(tail) > 16384:
|
|
||||||
del tail[:-16384]
|
|
||||||
except OSError:
|
|
||||||
pass
|
|
||||||
finally:
|
|
||||||
conn.close()
|
|
||||||
|
|
||||||
exact = self._scan_prompt_tokens(tail)
|
|
||||||
if is_chat:
|
|
||||||
exact_s = str(exact) if exact is not None else "-"
|
|
||||||
flag = "FIRED" if action == "soft" else "ok"
|
|
||||||
log(f"chat est={est} exact={exact_s} thr={THRESHOLD} {flag} "
|
|
||||||
f"stream={streaming} status={resp.status}")
|
|
||||||
|
|
||||||
def _decide(self, body: bytes):
|
|
||||||
"""Aktion bestimmen: passthrough | soft (Einschub) | hard (Selbstantwort).
|
|
||||||
|
|
||||||
Rueckgabe: (action, body, est, streaming, model).
|
|
||||||
"""
|
|
||||||
try:
|
|
||||||
data = json.loads(body)
|
|
||||||
except (ValueError, UnicodeDecodeError):
|
|
||||||
return "passthrough", body, None, False, ""
|
|
||||||
if not isinstance(data, dict):
|
|
||||||
return "passthrough", body, None, False, ""
|
|
||||||
|
|
||||||
messages = data.get("messages")
|
|
||||||
streaming = bool(data.get("stream"))
|
|
||||||
model = data.get("model", "") or ""
|
|
||||||
est = estimate_tokens(messages if isinstance(messages, list) else [])
|
|
||||||
|
|
||||||
if HARD_CEILING > 0 and est >= HARD_CEILING:
|
|
||||||
return "hard", body, est, streaming, model
|
|
||||||
|
|
||||||
if est >= THRESHOLD and isinstance(messages, list):
|
|
||||||
# Sichere Substitution statt str.format: ein operator-gesetzter
|
|
||||||
# GOV_DIRECTIVE mit { } (JSON/Code-Beispiel) darf nicht crashen.
|
|
||||||
directive = (DIRECTIVE.replace("{est}", str(est))
|
|
||||||
.replace("{threshold}", str(THRESHOLD)))
|
|
||||||
messages.append({"role": "user", "content": directive})
|
|
||||||
data["messages"] = messages
|
|
||||||
return "soft", json.dumps(data).encode("utf-8"), est, streaming, model
|
|
||||||
|
|
||||||
return "passthrough", body, est, streaming, model
|
|
||||||
|
|
||||||
def _send_canned_stop(self, model: str, streaming: bool, est) -> None:
|
|
||||||
"""OpenAI-kompatible Stopp-Antwort selbst erzeugen (kein Upstream-Call)."""
|
|
||||||
created = int(time.time())
|
|
||||||
usage = {"prompt_tokens": est or 0, "completion_tokens": 0,
|
|
||||||
"total_tokens": est or 0}
|
|
||||||
try:
|
|
||||||
if streaming:
|
|
||||||
self.send_response(200)
|
|
||||||
self.send_header("Content-Type", "text/event-stream")
|
|
||||||
self.send_header("Cache-Control", "no-cache")
|
|
||||||
self.send_header("Connection", "close")
|
|
||||||
self.end_headers()
|
|
||||||
|
|
||||||
def sse(obj):
|
|
||||||
self.wfile.write(b"data: " + json.dumps(obj).encode() + b"\n\n")
|
|
||||||
self.wfile.flush()
|
|
||||||
|
|
||||||
base = {"id": "governor-hardstop", "object": "chat.completion.chunk",
|
|
||||||
"created": created, "model": model}
|
|
||||||
sse({**base, "choices": [{"index": 0, "delta": {"role": "assistant"},
|
|
||||||
"finish_reason": None}]})
|
|
||||||
sse({**base, "choices": [{"index": 0, "delta": {"content": HARDSTOP_MSG},
|
|
||||||
"finish_reason": None}]})
|
|
||||||
sse({**base, "choices": [{"index": 0, "delta": {},
|
|
||||||
"finish_reason": "stop"}], "usage": usage})
|
|
||||||
self.wfile.write(b"data: [DONE]\n\n")
|
|
||||||
self.wfile.flush()
|
|
||||||
else:
|
|
||||||
payload = {
|
|
||||||
"id": "governor-hardstop", "object": "chat.completion",
|
|
||||||
"created": created, "model": model,
|
|
||||||
"choices": [{"index": 0, "finish_reason": "stop",
|
|
||||||
"message": {"role": "assistant", "content": HARDSTOP_MSG}}],
|
|
||||||
"usage": usage,
|
|
||||||
}
|
|
||||||
data = json.dumps(payload).encode("utf-8")
|
|
||||||
self.send_response(200)
|
|
||||||
self.send_header("Content-Type", "application/json")
|
|
||||||
self.send_header("Content-Length", str(len(data)))
|
|
||||||
self.send_header("Connection", "close")
|
|
||||||
self.end_headers()
|
|
||||||
self.wfile.write(data)
|
|
||||||
self.wfile.flush()
|
|
||||||
except OSError:
|
|
||||||
pass
|
|
||||||
|
|
||||||
def _safe_error(self, status: int, msg: str) -> None:
|
|
||||||
try:
|
|
||||||
data = json.dumps({"error": msg}).encode()
|
|
||||||
self.send_response(status)
|
|
||||||
self.send_header("Content-Type", "application/json")
|
|
||||||
self.send_header("Content-Length", str(len(data)))
|
|
||||||
self.send_header("Connection", "close")
|
|
||||||
self.end_headers()
|
|
||||||
self.wfile.write(data)
|
|
||||||
except OSError:
|
|
||||||
pass
|
|
||||||
|
|
||||||
@staticmethod
|
|
||||||
def _scan_prompt_tokens(tail: bytearray):
|
|
||||||
if not tail:
|
|
||||||
return None
|
|
||||||
try:
|
|
||||||
text = tail.decode("utf-8", errors="ignore")
|
|
||||||
except Exception: # noqa: BLE001
|
|
||||||
return None
|
|
||||||
matches = _PROMPT_TOKENS_RE.findall(text)
|
|
||||||
if not matches:
|
|
||||||
return None
|
|
||||||
try:
|
|
||||||
return int(matches[-1])
|
|
||||||
except ValueError:
|
|
||||||
return None
|
|
||||||
|
|
||||||
|
|
||||||
def main() -> int:
|
|
||||||
log_dir = os.path.dirname(LOG_PATH)
|
|
||||||
if log_dir and not os.path.isdir(log_dir):
|
|
||||||
try:
|
|
||||||
os.makedirs(log_dir, exist_ok=True)
|
|
||||||
except OSError:
|
|
||||||
pass
|
|
||||||
|
|
||||||
server = ThreadingHTTPServer((HOST, PORT), Handler)
|
|
||||||
server.daemon_threads = True
|
|
||||||
hard = HARD_CEILING if HARD_CEILING > 0 else "aus"
|
|
||||||
log(f"Governor startet auf {HOST}:{PORT} -> {UPSTREAM} | Soft={THRESHOLD} "
|
|
||||||
f"Hart={hard} | CPT={CHARS_PER_TOKEN} | Log={LOG_PATH}")
|
|
||||||
try:
|
|
||||||
server.serve_forever()
|
|
||||||
except KeyboardInterrupt:
|
|
||||||
log("Governor beendet (SIGINT).")
|
|
||||||
finally:
|
|
||||||
server.server_close()
|
|
||||||
return 0
|
|
||||||
|
|
||||||
|
|
||||||
if __name__ == "__main__":
|
|
||||||
raise SystemExit(main())
|
|
||||||
@@ -1,29 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# hardstop-test.sh — prueft die drei Governor-Pfade mit direkten curls:
|
|
||||||
# klein -> passthrough (Modell antwortet normal)
|
|
||||||
# mittel -> soft-Einschub (Modell bekommt die Stopp-Anweisung, antwortet)
|
|
||||||
# gross -> HART-STOPP (Governor antwortet selbst, KEIN Modell-Call)
|
|
||||||
set -u
|
|
||||||
GOV="http://127.0.0.1:8100/v1/chat/completions"
|
|
||||||
|
|
||||||
python3 - <<'PY' > /tmp/gov_small.json
|
|
||||||
import json
|
|
||||||
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"Reply with exactly: SMALL"}],"max_tokens":8,"stream":False}))
|
|
||||||
PY
|
|
||||||
python3 - <<'PY' > /tmp/gov_mid.json
|
|
||||||
import json
|
|
||||||
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"BEGIN "+"lorem ipsum "*2500+" END"}],"max_tokens":40,"stream":False}))
|
|
||||||
PY
|
|
||||||
python3 - <<'PY' > /tmp/gov_big.json
|
|
||||||
import json
|
|
||||||
print(json.dumps({"model":"Qwen3-Coder-Next","messages":[{"role":"user","content":"x"*40000}],"max_tokens":16,"stream":False}))
|
|
||||||
PY
|
|
||||||
|
|
||||||
echo "=== TEST A: klein (passthrough) ==="
|
|
||||||
curl -s -m 60 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_small.json | jq -r '.choices[0].message.content'
|
|
||||||
|
|
||||||
echo "=== TEST B: mittel ~30k Zeichen (soft-Einschub, geht ans Modell) ==="
|
|
||||||
curl -s -m 120 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_mid.json | jq '{id, content: (.choices[0].message.content|.[0:80])}'
|
|
||||||
|
|
||||||
echo "=== TEST C: gross ~40k Zeichen (HART-STOPP, kein Modell-Call) ==="
|
|
||||||
curl -s -m 30 "$GOV" -H "Content-Type: application/json" --data @/tmp/gov_big.json | jq '{id, finish: .choices[0].finish_reason, content: (.choices[0].message.content|.[0:70]), usage}'
|
|
||||||
@@ -1,13 +0,0 @@
|
|||||||
# Wegwerf-Aufgabe: kleine Todo-App, schrittweise. Jede Zeile = eine Runde.
|
|
||||||
Create todo.py with a TodoList class: add(text) appends a dict {"text": text, "done": False} to an internal list, and items() returns that list. Then update SAVEPOINT.md following our conventions.
|
|
||||||
Add complete(index) and remove(index) to TodoList, each with a bounds check that raises IndexError with a clear message when the index is out of range. Update SAVEPOINT.md.
|
|
||||||
Add save(path) and load(path) to TodoList that persist the items to and from a JSON file. Update SAVEPOINT.md.
|
|
||||||
Add pending_count() and completed_count() methods to TodoList. Update SAVEPOINT.md.
|
|
||||||
Create cli.py with an argparse command line interface exposing subcommands add, list, done, and rm that operate on a todos.json file via TodoList. Update SAVEPOINT.md.
|
|
||||||
Add a clear subcommand to cli.py that removes all completed items from todos.json. Update SAVEPOINT.md.
|
|
||||||
Create test_todo.py with unittest tests covering add, complete, remove, save, load, and the IndexError bounds checks. Update SAVEPOINT.md.
|
|
||||||
Add tests for pending_count and completed_count to test_todo.py. Update SAVEPOINT.md.
|
|
||||||
Create README.md documenting the CLI usage with a short example for each subcommand. Update SAVEPOINT.md.
|
|
||||||
Add type hints throughout todo.py and cli.py. Update SAVEPOINT.md.
|
|
||||||
Add an optional due date field (ISO date string) to each item and a due argument to TodoList.add and to the CLI add subcommand. Update SAVEPOINT.md.
|
|
||||||
Add an overdue subcommand to cli.py that lists items whose due date is before today. Update SAVEPOINT.md.
|
|
||||||
@@ -1,19 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# run-aider-msg.sh <repo> <message> — EINE Aider-Runde via --message (sauberer,
|
|
||||||
# unterstuetzter Einzel-Schuss ohne Scripting-Reflexions-Haenger), durch den Governor.
|
|
||||||
# todo.py/cli.py als Lesekontext, damit das Modell die echte API sieht (kein Erfinden)
|
|
||||||
# und keine "Datei hinzufuegen?"-Reflexion ausloest.
|
|
||||||
set -u
|
|
||||||
REPO="${1:?repo dir}"
|
|
||||||
MSG="${2:?message}"
|
|
||||||
export PATH="$HOME/.local/bin:$PATH"
|
|
||||||
export OPENAI_API_BASE="http://127.0.0.1:8100/v1"
|
|
||||||
export OPENAI_API_KEY="dummy"
|
|
||||||
cd "$REPO"
|
|
||||||
aider \
|
|
||||||
--model openai/Qwen3-Coder-Next \
|
|
||||||
--no-check-update --no-show-model-warnings --no-analytics --yes-always \
|
|
||||||
--map-tokens 512 \
|
|
||||||
--read CONVENTIONS.md --read todo.py --read cli.py \
|
|
||||||
SAVEPOINT.md \
|
|
||||||
--message "$MSG"
|
|
||||||
@@ -1,20 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# run-aider.sh <messages-file> — treibt EINE Aider-Sitzung durch den Governor.
|
|
||||||
# Jede Zeile der Nachrichtendatei = eine User-Runde; die Historie akkumuliert,
|
|
||||||
# sodass die Anfrage jede Runde wächst (genau das prüft der Governor).
|
|
||||||
set -u
|
|
||||||
MSGS="${1:?Nachrichtendatei angeben}"
|
|
||||||
export PATH="$HOME/.local/bin:$PATH"
|
|
||||||
export OPENAI_API_BASE="http://127.0.0.1:8100/v1"
|
|
||||||
export OPENAI_API_KEY="dummy"
|
|
||||||
cd "$HOME/governor-p0/testrepo"
|
|
||||||
aider \
|
|
||||||
--model openai/Qwen3-Coder-Next \
|
|
||||||
--no-check-update \
|
|
||||||
--no-show-model-warnings \
|
|
||||||
--no-analytics \
|
|
||||||
--yes-always \
|
|
||||||
--map-tokens 512 \
|
|
||||||
--read CONVENTIONS.md \
|
|
||||||
SAVEPOINT.md \
|
|
||||||
< "$MSGS"
|
|
||||||
@@ -1,8 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# run-driver.sh <messages-file> — Aider-Scripting-Sitzung durch den Governor.
|
|
||||||
set -u
|
|
||||||
MSGS="${1:?Nachrichtendatei angeben}"
|
|
||||||
REPO="${2:-$HOME/governor-p0/testrepo}"
|
|
||||||
VENV_PY="$HOME/.local/share/uv/tools/aider-chat/bin/python"
|
|
||||||
cd "$REPO"
|
|
||||||
exec "$VENV_PY" "$HOME/governor-p0/driver.py" "$MSGS"
|
|
||||||
@@ -1,21 +0,0 @@
|
|||||||
[Unit]
|
|
||||||
Description=Hermes Built-in Web UI (`hermes serve` — Agent-Dashboard/Chat, Loopback only)
|
|
||||||
After=network-online.target
|
|
||||||
Wants=network-online.target
|
|
||||||
|
|
||||||
[Service]
|
|
||||||
# Serviert die EINGEBAUTE Hermes-Web-GUI (die reiche Agent-Oberflaeche mit Threads/Tool-Calls, die
|
|
||||||
# auch die Electron-Desktop-App umhuellt) headless.
|
|
||||||
# SICHERHEIT: Bindet NUR an Loopback (127.0.0.1:9119) und laeuft hinter dem MC2-Reverse-Proxy
|
|
||||||
# (routers/hermes_ui.py → same-origin /hermes-ui/ auf dem offenen Port 9001) — KEINE eigene
|
|
||||||
# Firewall-Freigabe, KEIN Login (LAN-Trust wie Konsole/Terminal). --skip-build nutzt das von
|
|
||||||
# deploy.sh mit Vite-base=/hermes-ui/ vorgebaute web_dist, damit alle SPA-Pfade unter /hermes-ui/
|
|
||||||
# liegen und der Proxy sie sauber durchreichen kann.
|
|
||||||
Type=simple
|
|
||||||
Environment=HERMES_HOME=%h/.hermes
|
|
||||||
ExecStart=%h/.hermes/hermes-agent/venv/bin/hermes dashboard --no-open --skip-build --host 127.0.0.1 --port 9119
|
|
||||||
Restart=on-failure
|
|
||||||
RestartSec=3
|
|
||||||
|
|
||||||
[Install]
|
|
||||||
WantedBy=default.target
|
|
||||||
@@ -1,259 +0,0 @@
|
|||||||
#!/usr/bin/env python3
|
|
||||||
"""Hermes-Runtime-Patch-Traeger — haelt MC2-eigene Fixes im Hermes-Quellcode
|
|
||||||
(``~/.hermes/hermes-agent``), damit sie ein ``hermes update`` ueberleben.
|
|
||||||
|
|
||||||
Warum: Der Hermes-Agent wird aus git aktualisiert; ein Direkt-Edit der Laufzeit
|
|
||||||
wuerde beim naechsten Update still ueberschrieben. Dieses Skript wird von
|
|
||||||
``deploy/deploy.sh`` UND ``deploy/hermes-postcheck.sh`` aufgerufen und traegt die
|
|
||||||
Patches (re-)ein.
|
|
||||||
|
|
||||||
Mechanik: JEDER Patch ist eine idempotente String-Ersetzung (robust gegen
|
|
||||||
Zeilenverschiebungen durch Updates, anders als ``git apply``):
|
|
||||||
* ``marker`` schon im Quelltext -> Patch bereits drin, ueberspringen.
|
|
||||||
* ``old`` genau 1x vorhanden -> ersetzen, dann ``py_compile`` pruefen.
|
|
||||||
* ``old`` 0x oder >1x -> Kontext hat sich durch ein Update
|
|
||||||
geaendert -> LAUT scheitern (Exit 1), damit
|
|
||||||
der Postcheck rot wird und niemand denkt,
|
|
||||||
der Fix sei noch aktiv.
|
|
||||||
|
|
||||||
Bei Fehlschlag: Exit 1 (der Deploy/Postcheck behandelt das als Fehler).
|
|
||||||
"""
|
|
||||||
import os
|
|
||||||
import py_compile
|
|
||||||
import shutil
|
|
||||||
import sys
|
|
||||||
from pathlib import Path
|
|
||||||
|
|
||||||
HA = Path(os.environ.get("HERMES_AGENT_DIR", str(Path.home() / ".hermes" / "hermes-agent")))
|
|
||||||
HERE = Path(__file__).resolve().parent
|
|
||||||
|
|
||||||
# --- Zusatzmodule, die in die Hermes-Laufzeit kopiert werden (update-fest) ---
|
|
||||||
# (source relativ zu diesem Skript, dest relativ zum Hermes-Agent-Dir)
|
|
||||||
COPIES = [
|
|
||||||
("mc2_kanban_reaper.py", "hermes_cli/mc2_kanban_reaper.py"),
|
|
||||||
]
|
|
||||||
|
|
||||||
# --- Patch-Definitionen (chronologisch, Fan-out-/Muenz-Schleifen-Fixes 20.07.2026) ---
|
|
||||||
PATCHES = [
|
|
||||||
{
|
|
||||||
"name": "0001-needs-input-wait",
|
|
||||||
"file": "hermes_cli/kanban_db.py",
|
|
||||||
"marker": 'kind not in ("needs_input", "capability")',
|
|
||||||
"old": " if recurrences >= BLOCK_RECURRENCE_LIMIT:\n",
|
|
||||||
"new": (
|
|
||||||
" # MC2-Patch (20.07.2026): needs_input/capability sind genuin\n"
|
|
||||||
" # human-only — sie muessen in ``blocked`` auf den Commander warten\n"
|
|
||||||
" # (Antwort via Auftragsbuch), NICHT nach triage eskalieren. Sonst\n"
|
|
||||||
" # zerlegt der Auto-Decomposer sie neu = Duplikat-Karten-Schleife\n"
|
|
||||||
' # ("Muenz-Schleife", Fan-out-Vorfall 20.07.). Der Loop-Breaker bleibt\n'
|
|
||||||
" # fuer transient/untyped Blocks aktiv.\n"
|
|
||||||
' if recurrences >= BLOCK_RECURRENCE_LIMIT and kind not in ("needs_input", "capability"):\n'
|
|
||||||
),
|
|
||||||
},
|
|
||||||
{
|
|
||||||
"name": "0002-decompose-at-readiness",
|
|
||||||
"file": "hermes_cli/kanban_decompose.py",
|
|
||||||
"marker": "Startreife-Gate",
|
|
||||||
"old": (
|
|
||||||
" cfg = _load_config()\n"
|
|
||||||
" orchestrator = _resolve_orchestrator_profile(cfg)\n"
|
|
||||||
),
|
|
||||||
"new": (
|
|
||||||
" # MC2-Patch (20.07.2026): Startreife-Gate. Eine triage-Karte mit noch\n"
|
|
||||||
" # OFFENEN Vorgaengern NICHT zerlegen — sonst raet der Decomposer die\n"
|
|
||||||
" # Schnittstellen der Vor-Etappe ins Blaue, bevor die gebaut hat\n"
|
|
||||||
" # (Fan-out-Vorfall 20.07.). Billiger Parent-Check VOR dem teuren\n"
|
|
||||||
" # LLM-Aufruf; erst zerlegen, wenn alle Eltern done/archived.\n"
|
|
||||||
" with kb.connect_closing() as _pconn:\n"
|
|
||||||
" _parents = [r[0] for r in _pconn.execute(\n"
|
|
||||||
' "SELECT parent_id FROM task_links WHERE child_id = ?", (task_id,))]\n'
|
|
||||||
" if _parents:\n"
|
|
||||||
' _ph = ",".join("?" * len(_parents))\n'
|
|
||||||
" _open = _pconn.execute(\n"
|
|
||||||
' "SELECT COUNT(*) FROM tasks WHERE id IN (%s) "\n'
|
|
||||||
" \"AND status NOT IN ('done', 'archived')\" % _ph, _parents\n"
|
|
||||||
" ).fetchone()[0]\n"
|
|
||||||
" if _open:\n"
|
|
||||||
" return DecomposeOutcome(\n"
|
|
||||||
" task_id, False,\n"
|
|
||||||
' f"defer: {_open} unfinished parent(s) — decompose when start-ready",\n'
|
|
||||||
" )\n"
|
|
||||||
" cfg = _load_config()\n"
|
|
||||||
" orchestrator = _resolve_orchestrator_profile(cfg)\n"
|
|
||||||
),
|
|
||||||
},
|
|
||||||
{
|
|
||||||
"name": "0003-orphan-guard",
|
|
||||||
"file": "gateway/kanban_watchers.py",
|
|
||||||
"marker": "mc2_kanban_reaper",
|
|
||||||
"old": (
|
|
||||||
" pids = await asyncio.to_thread(_kb.reap_worker_zombies)\n"
|
|
||||||
" if pids:\n"
|
|
||||||
" logger.info(\n"
|
|
||||||
' "kanban dispatcher: reaped %d zombie worker(s), pids=%s",\n'
|
|
||||||
" len(pids),\n"
|
|
||||||
" pids,\n"
|
|
||||||
" )\n"
|
|
||||||
),
|
|
||||||
"new": (
|
|
||||||
" pids = await asyncio.to_thread(_kb.reap_worker_zombies)\n"
|
|
||||||
" if pids:\n"
|
|
||||||
" logger.info(\n"
|
|
||||||
' "kanban dispatcher: reaped %d zombie worker(s), pids=%s",\n'
|
|
||||||
" len(pids),\n"
|
|
||||||
" pids,\n"
|
|
||||||
" )\n"
|
|
||||||
" # MC2-Patch (20.07.2026): Orphan-Guard. Beende lebende\n"
|
|
||||||
" # Worker, deren Task nicht mehr 'running' ist (extern\n"
|
|
||||||
" # blockiert/reset) — sonst unterlaufen sie max_in_progress\n"
|
|
||||||
" # und verbrennen Rechenzeit.\n"
|
|
||||||
" try:\n"
|
|
||||||
" from hermes_cli import mc2_kanban_reaper as _mc2reaper\n"
|
|
||||||
" _orph = await asyncio.to_thread(\n"
|
|
||||||
" _mc2reaper.reap_orphaned_workers, _kb.connect_closing\n"
|
|
||||||
" )\n"
|
|
||||||
" if _orph:\n"
|
|
||||||
" logger.info(\n"
|
|
||||||
' "kanban dispatcher: reaped %d orphaned worker(s): %s",\n'
|
|
||||||
" len(_orph), _orph,\n"
|
|
||||||
" )\n"
|
|
||||||
" except Exception:\n"
|
|
||||||
' logger.exception("kanban dispatcher: orphan reaper failed")\n'
|
|
||||||
),
|
|
||||||
},
|
|
||||||
{
|
|
||||||
"name": "0004a-context-inherit-compute",
|
|
||||||
"file": "hermes_cli/kanban_decompose.py",
|
|
||||||
"marker": '_parent_ctx = ""',
|
|
||||||
"old": (
|
|
||||||
" children: list[dict] = []\n"
|
|
||||||
" for idx, entry in enumerate(raw_tasks):\n"
|
|
||||||
),
|
|
||||||
"new": (
|
|
||||||
" children: list[dict] = []\n"
|
|
||||||
" # MC2-Patch (20.07.2026): Projekt-/Repo-Kontext vererben. Der Parent-Body\n"
|
|
||||||
' # traegt oft harte Randbedingungen (Ziel-Repo, Tabus, "eigenes Projekt"),\n'
|
|
||||||
" # die bei der Zerlegung sonst verloren gehen (Worker klonte das falsche\n"
|
|
||||||
" # Repo, Fan-out-Vorfall 20.07.). Jeder Kind-Body bekommt den voran.\n"
|
|
||||||
' _parent_ctx = ""\n'
|
|
||||||
' if getattr(task, "body", None) and task.body.strip():\n'
|
|
||||||
" _parent_ctx = (\n"
|
|
||||||
' "## PROJEKT-KONTEXT (von der uebergeordneten Aufgabe — gilt fuer dich)\\n"\n'
|
|
||||||
" + task.body.strip()[:1500]\n"
|
|
||||||
' + "\\n\\n## DEIN TEILAUFTRAG\\n"\n'
|
|
||||||
" )\n"
|
|
||||||
" for idx, entry in enumerate(raw_tasks):\n"
|
|
||||||
),
|
|
||||||
},
|
|
||||||
{
|
|
||||||
"name": "0004b-context-inherit-apply",
|
|
||||||
"file": "hermes_cli/kanban_decompose.py",
|
|
||||||
"marker": "_parent_ctx + body",
|
|
||||||
"old": (
|
|
||||||
' body = entry.get("body")\n'
|
|
||||||
" if not isinstance(body, str):\n"
|
|
||||||
' body = ""\n'
|
|
||||||
),
|
|
||||||
"new": (
|
|
||||||
' body = entry.get("body")\n'
|
|
||||||
" if not isinstance(body, str):\n"
|
|
||||||
' body = ""\n'
|
|
||||||
" body = _parent_ctx + body # MC2 (20.07.): Projekt-Kontext vererben\n"
|
|
||||||
),
|
|
||||||
},
|
|
||||||
{
|
|
||||||
"name": "0005-create-chain-guard",
|
|
||||||
"file": "tools/kanban_tools.py",
|
|
||||||
"marker": "_MC2_RECENT_ROOTS",
|
|
||||||
"old": (
|
|
||||||
" new_task = kb.get_task(conn, new_tid)\n"
|
|
||||||
" subscribed = _maybe_auto_subscribe(conn, new_tid)\n"
|
|
||||||
),
|
|
||||||
"new": (
|
|
||||||
" # MC2-Patch (20.07.2026): Etappen-Auto-Kette. Legt dieselbe\n"
|
|
||||||
" # Session mehrere ROOT-triage-Karten (ohne parents) im selben\n"
|
|
||||||
" # 120s-Fenster an, verkette sie — so greift das Startreife-Gate\n"
|
|
||||||
" # (Karte 2 wartet auf Karte 1) statt alle sofort zu zerlegen\n"
|
|
||||||
" # (Fan-out 20.07.). Unter max_in_progress:1 ist eine Fehl-\n"
|
|
||||||
" # Verkettung harmlos (laeuft eh seriell).\n"
|
|
||||||
" try:\n"
|
|
||||||
" if triage and not parents and session_id:\n"
|
|
||||||
" import time as _mc2t\n"
|
|
||||||
' _roots = globals().setdefault("_MC2_RECENT_ROOTS", {})\n'
|
|
||||||
" _prev = _roots.get(session_id)\n"
|
|
||||||
" _now = _mc2t.monotonic()\n"
|
|
||||||
" if _prev and (_now - _prev[1]) <= 120 and _prev[0] != new_tid:\n"
|
|
||||||
" try:\n"
|
|
||||||
" kb.link_tasks(conn, _prev[0], new_tid)\n"
|
|
||||||
" except Exception:\n"
|
|
||||||
" pass\n"
|
|
||||||
" _roots[session_id] = (new_tid, _now)\n"
|
|
||||||
" if len(_roots) > 64:\n"
|
|
||||||
" _roots.clear()\n"
|
|
||||||
" except Exception:\n"
|
|
||||||
" pass\n"
|
|
||||||
" new_task = kb.get_task(conn, new_tid)\n"
|
|
||||||
" subscribed = _maybe_auto_subscribe(conn, new_tid)\n"
|
|
||||||
),
|
|
||||||
},
|
|
||||||
]
|
|
||||||
|
|
||||||
|
|
||||||
def main() -> int:
|
|
||||||
if not HA.is_dir():
|
|
||||||
print(f"hermes-patches: Hermes-Agent-Dir fehlt ({HA}) — nichts zu tun.")
|
|
||||||
return 0
|
|
||||||
applied, skipped, failed = [], [], []
|
|
||||||
|
|
||||||
# --- Zusatzmodule kopieren (idempotent: nur wenn Inhalt abweicht) ---
|
|
||||||
for src_rel, dst_rel in COPIES:
|
|
||||||
src, dst = HERE / src_rel, HA / dst_rel
|
|
||||||
if not src.is_file():
|
|
||||||
failed.append((src_rel, f"Quelle fehlt: {src}"))
|
|
||||||
continue
|
|
||||||
try:
|
|
||||||
same = dst.is_file() and dst.read_bytes() == src.read_bytes()
|
|
||||||
if same:
|
|
||||||
skipped.append(f"copy:{dst_rel}")
|
|
||||||
continue
|
|
||||||
dst.parent.mkdir(parents=True, exist_ok=True)
|
|
||||||
shutil.copy2(src, dst)
|
|
||||||
if dst.suffix == ".py":
|
|
||||||
py_compile.compile(str(dst), doraise=True)
|
|
||||||
applied.append(f"copy:{dst_rel}")
|
|
||||||
except Exception as exc:
|
|
||||||
failed.append((src_rel, f"Kopie/Compile fehlgeschlagen: {exc}"))
|
|
||||||
for p in PATCHES:
|
|
||||||
f = HA / p["file"]
|
|
||||||
if not f.is_file():
|
|
||||||
failed.append((p["name"], f"Datei fehlt: {f}"))
|
|
||||||
continue
|
|
||||||
src = f.read_text(encoding="utf-8")
|
|
||||||
if p["marker"] in src:
|
|
||||||
skipped.append(p["name"])
|
|
||||||
continue
|
|
||||||
n = src.count(p["old"])
|
|
||||||
if n != 1:
|
|
||||||
failed.append((p["name"], f"erwartete 1 Vorkommen von old, fand {n} "
|
|
||||||
"(Update hat den Kontext geaendert?)"))
|
|
||||||
continue
|
|
||||||
f.write_text(src.replace(p["old"], p["new"]), encoding="utf-8")
|
|
||||||
try:
|
|
||||||
py_compile.compile(str(f), doraise=True)
|
|
||||||
except Exception as exc:
|
|
||||||
failed.append((p["name"], f"py_compile fehlgeschlagen: {exc}"))
|
|
||||||
continue
|
|
||||||
applied.append(p["name"])
|
|
||||||
|
|
||||||
print(f"hermes-patches: applied={applied} skipped={skipped} failed={[n for n, _ in failed]}")
|
|
||||||
for name, why in failed:
|
|
||||||
print(f" FEHLER {name}: {why}", file=sys.stderr)
|
|
||||||
if failed:
|
|
||||||
return 1 # Fehler → Deploy/Postcheck rot
|
|
||||||
if applied:
|
|
||||||
return 10 # etwas geaendert → Aufrufer sollte hermes-gateway neu starten
|
|
||||||
return 0 # nichts zu tun (alles schon drin)
|
|
||||||
|
|
||||||
|
|
||||||
if __name__ == "__main__":
|
|
||||||
sys.exit(main())
|
|
||||||
@@ -1,84 +0,0 @@
|
|||||||
"""MC2-Zusatzmodul (20.07.2026) — Orphan-Reaper für Kanban-Worker.
|
|
||||||
|
|
||||||
Wird vom Patch-Träger (``deploy/hermes-patches/apply.py``) nach
|
|
||||||
``~/.hermes/hermes-agent/hermes_cli/`` kopiert und vom Gateway-Dispatcher
|
|
||||||
(``gateway/kanban_watchers.py``, per Patch 0003) jeden Tick aufgerufen.
|
|
||||||
|
|
||||||
Problem: Wird eine ``running``-Karte von außen blockiert/zurückgesetzt (z. B.
|
|
||||||
über das Auftragsbuch oder die No-Progress-Bremse), setzt ``block_task``
|
|
||||||
``worker_pid = NULL`` — der Worker-PROZESS läuft aber weiter. Die DB zählt ihn
|
|
||||||
nicht mehr, also unterläuft der Orphan ``kanban.max_in_progress`` (Doppel-Worker
|
|
||||||
möglich) und verbrennt Rechenzeit. Dieser Reaper beendet lebende Worker, deren
|
|
||||||
Task nicht mehr ``running`` ist.
|
|
||||||
|
|
||||||
Linux-only (/proc-Scan). Best-effort: jeder Fehler → leere Liste, nie werfen.
|
|
||||||
"""
|
|
||||||
from __future__ import annotations
|
|
||||||
|
|
||||||
import os
|
|
||||||
import re
|
|
||||||
import signal
|
|
||||||
import sys
|
|
||||||
|
|
||||||
_TASK_RE = re.compile(rb"work kanban task (t_[0-9a-fA-F]+)")
|
|
||||||
|
|
||||||
|
|
||||||
def reap_orphaned_workers(connect_closing) -> "list[tuple[int, str]]":
|
|
||||||
"""Beende lebende Kanban-Worker, deren Task nicht mehr ``running`` ist.
|
|
||||||
|
|
||||||
``connect_closing`` ist die gleichnamige Kontextmanager-Factory aus
|
|
||||||
``kanban_db`` (durchgereicht, um Import-Zyklen zu vermeiden). Gibt die Liste
|
|
||||||
der beendeten ``(pid, task_id)`` zurück.
|
|
||||||
"""
|
|
||||||
if sys.platform != "linux":
|
|
||||||
return []
|
|
||||||
candidates: "dict[int, str]" = {}
|
|
||||||
try:
|
|
||||||
entries = os.listdir("/proc")
|
|
||||||
except OSError:
|
|
||||||
return []
|
|
||||||
for entry in entries:
|
|
||||||
if not entry.isdigit():
|
|
||||||
continue
|
|
||||||
try:
|
|
||||||
with open(f"/proc/{entry}/cmdline", "rb") as fh:
|
|
||||||
cmd = fh.read().replace(b"\x00", b" ")
|
|
||||||
except OSError:
|
|
||||||
continue
|
|
||||||
m = _TASK_RE.search(cmd)
|
|
||||||
if m:
|
|
||||||
candidates[int(entry)] = m.group(1).decode()
|
|
||||||
if not candidates:
|
|
||||||
return []
|
|
||||||
|
|
||||||
task_ids = list(set(candidates.values()))
|
|
||||||
placeholders = ",".join("?" * len(task_ids))
|
|
||||||
running: "set[str]" = set()
|
|
||||||
try:
|
|
||||||
with connect_closing() as conn:
|
|
||||||
running = {
|
|
||||||
row[0]
|
|
||||||
for row in conn.execute(
|
|
||||||
f"SELECT id FROM tasks WHERE id IN ({placeholders}) "
|
|
||||||
"AND status = 'running'",
|
|
||||||
task_ids,
|
|
||||||
)
|
|
||||||
}
|
|
||||||
except Exception:
|
|
||||||
return []
|
|
||||||
|
|
||||||
killed: "list[tuple[int, str]]" = []
|
|
||||||
for pid, task_id in candidates.items():
|
|
||||||
if task_id in running:
|
|
||||||
continue
|
|
||||||
# Prozessgruppe zuerst (Worker starten start_new_session=True → eigene
|
|
||||||
# Gruppe; killpg räumt selbst gestartete Kinder wie uvicorn gleich mit).
|
|
||||||
try:
|
|
||||||
os.killpg(os.getpgid(pid), signal.SIGTERM)
|
|
||||||
except OSError:
|
|
||||||
try:
|
|
||||||
os.kill(pid, signal.SIGTERM)
|
|
||||||
except OSError:
|
|
||||||
continue
|
|
||||||
killed.append((pid, task_id))
|
|
||||||
return killed
|
|
||||||
+28
-35
@@ -1,35 +1,22 @@
|
|||||||
#!/usr/bin/env bash
|
#!/usr/bin/env bash
|
||||||
# Post-Update-Check nach einem Hermes-Agent-Update: läuft unser geteiltes „Gehirn"
|
# Post-Update-Check nach einem Hermes-Agent-Update: laeuft unser "Gehirn" noch?
|
||||||
# (Mem0 + die mc2-memory-Integration) noch? Exit 0 = alles ok, sonst 1 → der Job wird
|
# Exit 0 = alles ok, sonst 1 -> der Job wird im UI rot, damit ein kaputtes Gehirn auffaellt.
|
||||||
# im UI rot, damit ein kaputtes Gehirn sofort auffällt.
|
#
|
||||||
|
# WICHTIG (27.08.2026) - VIER TOTE CHECKS ENTFERNT: bis hierher prueften die ersten Bloecke
|
||||||
|
# den abgeloesten Gedaechtnis-Sidecar (:8765), MC2s /api/memory und das zugehoerige
|
||||||
|
# Hermes-Plugin. Alle drei fielen am 07.08. weg (docs/wissen/VERDIKTE.md) - die Checks KONNTEN nicht
|
||||||
|
# mehr gruen werden. Folge: jedes Hermes-Update endete rot und wurde von autoupdate.sh
|
||||||
|
# zurueckgerollt. Kein Ersatz-Check auf Hermes native Gedaechtnis, weil es dafuer keinen
|
||||||
|
# nachgemessenen Endpunkt gibt - geraten waere eine Fassade. Der Tool-Smoke weiter unten
|
||||||
|
# laeuft ohnehin durch den ECHTEN Agenten und faengt ein kaputtes Gehirn.
|
||||||
set -uo pipefail
|
set -uo pipefail
|
||||||
|
|
||||||
MC_URL="${MC_URL:-http://127.0.0.1:9001}"
|
MC_URL="${MC_URL:-http://127.0.0.1:9001}"
|
||||||
MEM0_URL="${MEM0_SERVICE_URL:-http://127.0.0.1:8765}"
|
|
||||||
HERMES="${HERMES_HOME:-$HOME/.hermes}"
|
HERMES="${HERMES_HOME:-$HOME/.hermes}"
|
||||||
fail=0
|
fail=0
|
||||||
|
|
||||||
echo "=== Hermes Post-Update: Gehirn-Check ==="
|
echo "=== Hermes Post-Update: Gehirn-Check ==="
|
||||||
|
|
||||||
if curl -sf -m 5 "$MEM0_URL/health" >/dev/null 2>&1; then
|
|
||||||
echo "PASS · Mem0-Sidecar erreichbar"
|
|
||||||
else
|
|
||||||
echo "FAIL · Mem0-Sidecar NICHT erreichbar"; fail=1
|
|
||||||
fi
|
|
||||||
|
|
||||||
if curl -sf -m 8 "$MC_URL/api/memory" >/dev/null 2>&1; then
|
|
||||||
echo "PASS · /api/memory antwortet"
|
|
||||||
else
|
|
||||||
echo "FAIL · /api/memory antwortet nicht"; fail=1
|
|
||||||
fi
|
|
||||||
|
|
||||||
if grep -qE "^[[:space:]]*provider:[[:space:]]*'?mc2-memory'?" "$HERMES/config.yaml" 2>/dev/null \
|
|
||||||
&& grep -qE "memory_enabled:[[:space:]]*true" "$HERMES/config.yaml" 2>/dev/null; then
|
|
||||||
echo "PASS · memory.provider=mc2-memory aktiv"
|
|
||||||
else
|
|
||||||
echo "FAIL · memory.provider nicht mehr gesetzt (Config vom Update überschrieben?)"; fail=1
|
|
||||||
fi
|
|
||||||
|
|
||||||
# --- Hermes-Runtime-Patch-Traeger (20.07.2026): ein Update setzt den Quellbaum ---
|
# --- Hermes-Runtime-Patch-Traeger (20.07.2026): ein Update setzt den Quellbaum ---
|
||||||
# --- zurueck → unsere Fixes (needs_input-wartet, Startreife-Gate, Orphan-Guard, ---
|
# --- zurueck → unsere Fixes (needs_input-wartet, Startreife-Gate, Orphan-Guard, ---
|
||||||
# --- Kontext-Vererbung, Etappen-Kette) hier RE-eintragen. Exit 10 = etwas neu ---
|
# --- Kontext-Vererbung, Etappen-Kette) hier RE-eintragen. Exit 10 = etwas neu ---
|
||||||
@@ -46,15 +33,11 @@ if [ -f "$PATCH_APPLY" ]; then
|
|||||||
echo "FAIL · Hermes-Runtime-Patches: ein Patch passt nicht mehr zum aktualisierten Quellcode — pruefen"; fail=1
|
echo "FAIL · Hermes-Runtime-Patches: ein Patch passt nicht mehr zum aktualisierten Quellcode — pruefen"; fail=1
|
||||||
fi
|
fi
|
||||||
else
|
else
|
||||||
echo "WARN · hermes-patches/apply.py nicht gefunden ($PATCH_APPLY)"
|
# Kein Fehler: Der Patch-Traeger wurde mit dem MC2-Kahlschlag (1e68f62) entfernt. Seine
|
||||||
fi
|
# Fixes zielten auf einen Hermes-Stand, der inzwischen tausende Commits zurueckliegt —
|
||||||
|
# sie wuerden auf dem heutigen Quellcode ohnehin nicht mehr greifen. WARN statt FAIL, damit
|
||||||
if ( cd "$HERMES/hermes-agent" && HERMES_HOME="$HERMES" ./venv/bin/python -c \
|
# es sichtbar bleibt, falls jemand wieder Runtime-Patches braucht.
|
||||||
"import sys; sys.path.insert(0,'.'); from plugins.memory import load_memory_provider; p=load_memory_provider('mc2-memory'); assert p and p.name()=='mc2-memory'" \
|
echo "WARN · hermes-patches/apply.py nicht vorhanden (mit 1e68f62 bewusst entfernt) — uebersprungen"
|
||||||
>/dev/null 2>&1 ); then
|
|
||||||
echo "PASS · mc2-memory-Plugin lädt unter dem neuen Hermes"
|
|
||||||
else
|
|
||||||
echo "FAIL · mc2-memory-Plugin lädt nicht (MemoryProvider-ABC geändert?)"; fail=1
|
|
||||||
fi
|
fi
|
||||||
|
|
||||||
# --- Config-Drift-Wächter (Lehre aus v0.18, 02.07.2026): Hermes fällt bei unbekannten ---
|
# --- Config-Drift-Wächter (Lehre aus v0.18, 02.07.2026): Hermes fällt bei unbekannten ---
|
||||||
@@ -72,12 +55,22 @@ fi
|
|||||||
# --- Approval-/Tool-Ketten (Antwort muss kommen und darf nicht in pending_approval hängen). ---
|
# --- Approval-/Tool-Ketten (Antwort muss kommen und darf nicht in pending_approval hängen). ---
|
||||||
API_KEY="$(grep -E '^API_SERVER_KEY=' "$HERMES/.env" 2>/dev/null | cut -d= -f2- | tr -d '"' | tr -d "'")"
|
API_KEY="$(grep -E '^API_SERVER_KEY=' "$HERMES/.env" 2>/dev/null | cut -d= -f2- | tr -d '"' | tr -d "'")"
|
||||||
if [ -n "$API_KEY" ]; then
|
if [ -n "$API_KEY" ]; then
|
||||||
TOOL_RESP=$(curl -sf -m 90 -X POST "http://127.0.0.1:8642/v1/chat/completions" \
|
# Mit Retry — GENAU wie der Voice-Smoke darunter, und aus demselben Grund: direkt nach
|
||||||
|
# einem Update ist das Modell kalt. Ein Kaltstart kostet ~20-30 s Laden PLUS ~37 s
|
||||||
|
# Prefill für Hermes' ~70-KB-Systemprompt (33 Tool-Schemas) — zusammen mit zwei
|
||||||
|
# Inferenz-Runden sprengt das die 90 s des ersten Versuchs. Warm gemessen: 12 s.
|
||||||
|
# Ein Versuch allein war ein Fehlalarm-Generator (live erlebt 25.07., Job faf1137a).
|
||||||
|
TOOL_RESP=""
|
||||||
|
for try in 1 2 3; do
|
||||||
|
TOOL_RESP=$(curl -sf -m 120 -X POST "http://127.0.0.1:8642/v1/chat/completions" \
|
||||||
-H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" \
|
-H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" \
|
||||||
-H "X-Hermes-Session-Id: postcheck-tool-smoke" \
|
-H "X-Hermes-Session-Id: postcheck-tool-smoke-$try" \
|
||||||
-d '{"model":"hermes","stream":false,"messages":[{"role":"user","content":"Führe im Terminal exakt den Befehl echo postcheck-ok aus und gib mir nur dessen Ausgabe zurück."}]}' 2>/dev/null)
|
-d '{"model":"hermes","stream":false,"messages":[{"role":"user","content":"Führe im Terminal exakt den Befehl echo postcheck-ok aus und gib mir nur dessen Ausgabe zurück."}]}' 2>/dev/null)
|
||||||
|
echo "$TOOL_RESP" | grep -qi "postcheck-ok" && break
|
||||||
|
[ "$try" -lt 3 ] && sleep 10
|
||||||
|
done
|
||||||
if echo "$TOOL_RESP" | grep -qi "postcheck-ok"; then
|
if echo "$TOOL_RESP" | grep -qi "postcheck-ok"; then
|
||||||
echo "PASS · Tool-Smoke (terminal via Agent) liefert Ergebnis"
|
echo "PASS · Tool-Smoke (terminal via Agent) liefert Ergebnis (Versuch $try)"
|
||||||
elif echo "$TOOL_RESP" | grep -qi "pending_approval"; then
|
elif echo "$TOOL_RESP" | grep -qi "pending_approval"; then
|
||||||
echo "FAIL · Tool-Smoke hängt in pending_approval (approvals.mode prüfen!)"; fail=1
|
echo "FAIL · Tool-Smoke hängt in pending_approval (approvals.mode prüfen!)"; fail=1
|
||||||
else
|
else
|
||||||
|
|||||||
@@ -1,223 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Hermes-Release-Radar (woechentlich, Mo 05:15) — "mehr Hermes nativ, weniger Eigenkreationen":
|
|
||||||
# haelt neue hermes-agent-Releases gegen die Eigenbau-Landkarte im Wissens-Vault und meldet
|
|
||||||
# NUR echte Treffer auf Abloese-Kriterien/Wiedervorlage-Bedingungen. Muster wie
|
|
||||||
# chef-gutachter-feed.sh: liegt in ~/.hermes/scripts/ (deploy.sh kopiert ihn), stdout wird
|
|
||||||
# dem Cron-Agenten als Prompt eingespeist. Der ABGLEICH laeuft als Ein-Schuss-Completion
|
|
||||||
# direkt gegen llama-swap (:8080, fremdblick-Architektur): Analyst gpt-oss-120b (um 05:15
|
|
||||||
# vom Chef-Gutachter 04:30 oft noch geladen), Vertretung GLM-4.7-Flash. Danach gatet
|
|
||||||
# fremdblick.sh (Prosa-Raster, Fremd-Vendor) jede Treffer-Behauptung gegen die
|
|
||||||
# Original-Changelogs.
|
|
||||||
# Grundsaetze (stehen auch in der Landkarte): nur getaggte Releases (kein main-Churn bei
|
|
||||||
# ~660 PRs/Woche) · Behauptung nur mit woertlichem Changelog-Zitat · Treffer => Probe-
|
|
||||||
# Vorschlag, NIE Direkt-Adoption · der Radar informiert, er updatet nicht (Entscheid 04.07.).
|
|
||||||
# State: ~/.hermes/state/release-radar-last.txt (zuletzt gemeldeter Tag). Verlust harmlos —
|
|
||||||
# ohne State dient die installierte Version als Basis.
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
MC="$HOME/mission-control-v2"
|
|
||||||
LANDKARTE="$HOME/wissens-vault/eigenbau-landkarte.md"
|
|
||||||
STATE_DIR="$HOME/.hermes/state"
|
|
||||||
STATE="$STATE_DIR/release-radar-last.txt"
|
|
||||||
API="${RADAR_RELEASES_URL:-https://api.github.com/repos/NousResearch/hermes-agent/releases?per_page=10}"
|
|
||||||
ENDPOINT="${RADAR_ENDPOINT:-http://127.0.0.1:8080/v1/chat/completions}"
|
|
||||||
ANALYST="${RADAR_MODEL:-gpt-oss-120b}"
|
|
||||||
VERTRETUNG="${RADAR_FALLBACK:-GLM-4.7-Flash}"
|
|
||||||
FREMDBLICK="$HOME/.hermes/scripts/fremdblick.sh"
|
|
||||||
|
|
||||||
mkdir -p "$STATE_DIR"
|
|
||||||
|
|
||||||
# Briefkasten-Spiegel (still, wie die Morgenlage): Cockpit/Chronik lesen source=release-radar.
|
|
||||||
briefkasten() { # $1=Betreff $2=Text
|
|
||||||
curl -sf -m 5 -X POST "${MC_ANNOUNCE_URL:-http://127.0.0.1:9001/api/voice/announce}" \
|
|
||||||
-H 'Content-Type: application/json' \
|
|
||||||
--data "$(python3 - "$1" "$2" <<'PY'
|
|
||||||
import json, sys
|
|
||||||
print(json.dumps({"text": sys.argv[2], "subject": sys.argv[1],
|
|
||||||
"source": "release-radar", "priority": "silent"}))
|
|
||||||
PY
|
|
||||||
)" >/dev/null 2>&1 || true
|
|
||||||
}
|
|
||||||
|
|
||||||
# ---------- Versionierter Auftrag fuer den Boten-Agenten ----------
|
|
||||||
cat "$MC/deploy/release-radar-prompt.md" 2>/dev/null || cat <<'EOF'
|
|
||||||
(Prompt-Datei fehlt noch — Kurzform:) Du bist der Bote des woechentlichen Release-Radars.
|
|
||||||
Gib den Befund unten in Lucys Stimme wieder: bei "KEIN NEUES RELEASE" oder "TREFFER: 0"
|
|
||||||
genau EIN kurzer Satz; bei Treffern maximal 5 Saetze. Nichts installieren oder aendern.
|
|
||||||
EOF
|
|
||||||
echo
|
|
||||||
|
|
||||||
INSTALLED_LINE="$(bash -lc 'hermes --version' 2>/dev/null | head -1)"
|
|
||||||
INSTALLED_TAG="$(printf '%s' "$INSTALLED_LINE" | grep -oE '\([0-9][0-9.]*\)' | head -1 | tr -d '()')"
|
|
||||||
[ -n "$INSTALLED_TAG" ] && INSTALLED_TAG="v$INSTALLED_TAG"
|
|
||||||
LAST_SEEN="$(cat "$STATE" 2>/dev/null | tr -d '[:space:]' || true)"
|
|
||||||
BASELINE="${LAST_SEEN:-$INSTALLED_TAG}"
|
|
||||||
|
|
||||||
RELEASES_JSON="$(curl -sf --max-time 30 "$API" 2>/dev/null || true)"
|
|
||||||
if [ -z "$RELEASES_JSON" ]; then
|
|
||||||
echo "## RADAR-BEFUND: AUSGEFALLEN"
|
|
||||||
echo "GitHub-Releases-API nicht erreichbar. Dem Commander EINEN ehrlichen Satz melden; naechste Woche neuer Versuch."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
# Neue getaggte Releases seit BASELINE (Drafts/Prereleases raus, max. 6, Bodies gekuerzt).
|
|
||||||
# Baseline unbekannt (aelter als die letzten 10 oder Erstlauf ohne Version) -> juengste 6.
|
|
||||||
# JSON via Temp-Datei, NICHT via Pipe: das Heredoc belegt stdin schon fuer den Python-Code
|
|
||||||
# selbst (Pipe+Heredoc gleichzeitig -> json.load(stdin) liest ins Leere; Probelauf 10.07.).
|
|
||||||
TMPJSON="$(mktemp /tmp/release-radar.XXXXXX.json)"
|
|
||||||
printf '%s' "$RELEASES_JSON" > "$TMPJSON"
|
|
||||||
PARSED="$(python3 - "$BASELINE" "$TMPJSON" <<'PY'
|
|
||||||
import json, sys
|
|
||||||
baseline = sys.argv[1]
|
|
||||||
try:
|
|
||||||
data = json.load(open(sys.argv[2]))
|
|
||||||
# Rate-Limit/Fehler antwortet als Dict statt Liste -> wie "keine Daten" behandeln.
|
|
||||||
rels = [r for r in data if not r.get("draft") and not r.get("prerelease")] if isinstance(data, list) else []
|
|
||||||
except Exception:
|
|
||||||
rels = []
|
|
||||||
rels.sort(key=lambda r: r.get("published_at") or "", reverse=True)
|
|
||||||
if not rels:
|
|
||||||
# API hat geantwortet, aber unbrauchbar (Rate-Limit-Dict, kaputtes JSON, leere Liste):
|
|
||||||
# ehrlich als "blind" markieren statt faelschlich "kein neues Release" zu melden.
|
|
||||||
print(baseline)
|
|
||||||
print(-1)
|
|
||||||
raise SystemExit
|
|
||||||
base = next((r.get("published_at") for r in rels if r.get("tag_name") == baseline), None)
|
|
||||||
new = rels[:6] if base is None else [r for r in rels if (r.get("published_at") or "") > base][:6]
|
|
||||||
print((new or rels)[0].get("tag_name") or baseline)
|
|
||||||
print(len(new))
|
|
||||||
for r in new:
|
|
||||||
body = (r.get("body") or "").strip()
|
|
||||||
if len(body) > 3500:
|
|
||||||
body = body[:3500] + "\n[... gekuerzt ...]"
|
|
||||||
print(f"\n===== RELEASE {r.get('tag_name')} — {(r.get('name') or '').strip()} ({(r.get('published_at') or '')[:10]}) =====")
|
|
||||||
print(body)
|
|
||||||
PY
|
|
||||||
)"
|
|
||||||
rm -f "$TMPJSON"
|
|
||||||
NEWEST="$(printf '%s\n' "$PARSED" | sed -n 1p)"
|
|
||||||
COUNT="$(printf '%s\n' "$PARSED" | sed -n 2p)"
|
|
||||||
NOTES="$(printf '%s\n' "$PARSED" | tail -n +3)"
|
|
||||||
|
|
||||||
if [ "${COUNT:-0}" = "-1" ]; then
|
|
||||||
echo "## RADAR-BEFUND: AUSGEFALLEN"
|
|
||||||
echo "GitHub-API hat geantwortet, aber unbrauchbar (Rate-Limit oder kaputtes JSON). Dem Commander EINEN ehrlichen Satz melden; State bleibt, naechste Woche neuer Versuch."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
echo "## RADAR-BEFUND (erhoben am $(date '+%d.%m.%Y %H:%M'))"
|
|
||||||
echo "Box installiert: ${INSTALLED_LINE:-unbekannt}"
|
|
||||||
echo "Zuletzt gemeldet: ${BASELINE:-unbekannt} · neuestes Release: $NEWEST · neue Releases: ${COUNT:-0}"
|
|
||||||
echo "(Updates bleiben manuell/bestaetigt — der Radar informiert nur.)"
|
|
||||||
echo
|
|
||||||
|
|
||||||
if [ "${COUNT:-0}" = "0" ]; then
|
|
||||||
echo "KEIN NEUES RELEASE seit $BASELINE."
|
|
||||||
[ -n "$NEWEST" ] && printf '%s\n' "$NEWEST" > "$STATE"
|
|
||||||
briefkasten "Release-Radar" "Kein neues hermes-agent-Release seit $BASELINE (Box: ${INSTALLED_TAG:-?})."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
if [ ! -s "$LANDKARTE" ]; then
|
|
||||||
echo "### ABGLEICH NICHT MOEGLICH"
|
|
||||||
echo "$COUNT neue Releases, aber die Eigenbau-Landkarte fehlt ($LANDKARTE)."
|
|
||||||
echo "Dem Commander melden: Landkarte im Wissens-Vault wiederherstellen. State bleibt unveraendert (naechste Woche neuer Versuch)."
|
|
||||||
briefkasten "Release-Radar" "$COUNT neue hermes-agent-Releases, aber die Eigenbau-Landkarte fehlt — Abgleich uebersprungen."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
RASTER='Du bist der RELEASE-RADAR einer lokalen KI-Box. Du bekommst (1) die EIGENBAU-LANDKARTE (selbstgebaute Bausteine mit Abloese-Kriterien und Wiedervorlage-Bedingungen) und (2) CHANGELOGS neuer hermes-agent-Releases. Pruefe AUSSCHLIESSLICH: Trifft eine Changelog-Zeile ein Abloese-Kriterium oder eine Wiedervorlage-Bedingung der Landkarte? REGELN: Jede Treffer-Behauptung MUSS die Changelog-Zeile WOERTLICH zitieren. Marketing-Prosa ohne konkretes Feature ist KEIN Treffer. Vage Aehnlichkeit ist KEIN Treffer. Eintraege unter "Bewusst NICHT adoptiert" nur melden, wenn exakt die Wiedervorlage-Bedingung erfuellt ist. Erfinde nichts. Antworte auf DEUTSCH, exakt in dieser Struktur: erste Zeile "TREFFER: <Anzahl>". Danach je Treffer ein Block: "EIGENBAU: <Name aus der Landkarte>" / "RELEASE: <Tag>" / "ZITAT: <woertliche Changelog-Zeile>" / "WARUM: <ein Satz>" / "PROBE: <ein Satz, wie man es risikofrei testet>". Bei TREFFER: 0 stattdessen EIN Satz, was die Releases fuer uns Unwichtiges bringen.'
|
|
||||||
|
|
||||||
EVID="EIGENBAU-LANDKARTE:
|
|
||||||
$(cat "$LANDKARTE")
|
|
||||||
|
|
||||||
CHANGELOGS DER NEUEN RELEASES:
|
|
||||||
$NOTES"
|
|
||||||
|
|
||||||
# Ein-Schuss-Analyst: $1=Modell $2=curl-Timeout $3=max_tokens (Muster chef-gutachter-feed.sh;
|
|
||||||
# max_tokens grosszuegig, weil Reasoning-Modelle Budget im reasoning_content verbrauchen).
|
|
||||||
judge() {
|
|
||||||
local req
|
|
||||||
req="$(jq -n --arg m "$1" --arg sys "$RASTER" --arg usr "$EVID" --argjson mt "$3" \
|
|
||||||
'{model:$m, messages:[{role:"system",content:$sys},{role:"user",content:$usr}],
|
|
||||||
max_tokens:$mt, temperature:0.2}')"
|
|
||||||
curl -s -m "$2" "$ENDPOINT" -H 'Content-Type: application/json' --data-binary "$req" \
|
|
||||||
| python3 -c '
|
|
||||||
import json, sys
|
|
||||||
try:
|
|
||||||
d = json.load(sys.stdin)
|
|
||||||
msg = d["choices"][0]["message"]
|
|
||||||
print((msg.get("content") or msg.get("reasoning_content") or "").strip())
|
|
||||||
except Exception:
|
|
||||||
pass'
|
|
||||||
}
|
|
||||||
|
|
||||||
RICHTER="$ANALYST"
|
|
||||||
ANALYSE="$(judge "$ANALYST" 420 2600)"
|
|
||||||
if [ -z "${ANALYSE// /}" ]; then
|
|
||||||
RICHTER="$VERTRETUNG (Vertretung — $ANALYST hat nicht geantwortet)"
|
|
||||||
ANALYSE="$(judge "$VERTRETUNG" 240 1800)"
|
|
||||||
fi
|
|
||||||
|
|
||||||
if [ -z "${ANALYSE// /}" ]; then
|
|
||||||
echo "### ABGLEICH AUSGEFALLEN"
|
|
||||||
echo "Beide Analysten ($ANALYST, $VERTRETUNG) haben nicht geantwortet. State bleibt unveraendert — naechste Woche neuer Versuch. Dem Commander EINEN ehrlichen Satz melden."
|
|
||||||
briefkasten "Release-Radar" "$COUNT neue hermes-agent-Releases, aber der Abgleich fiel aus (kein Analyst erreichbar)."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
echo "### Neue Releases:"
|
|
||||||
printf '%s\n' "$NOTES" | grep '^===== RELEASE' | sed 's/^===== //; s/ =====$//'
|
|
||||||
echo
|
|
||||||
echo "### ABGLEICH gegen die Eigenbau-Landkarte (Analyst: $RICHTER)"
|
|
||||||
echo "$ANALYSE"
|
|
||||||
echo
|
|
||||||
|
|
||||||
# Fremdblick-Gate nur bei Treffern (Zitate MIT Quellmaterial gegenpruefbar machen).
|
|
||||||
TREFFER="$(printf '%s' "$ANALYSE" | grep -oE 'TREFFER: *[0-9]+' | head -1 | grep -oE '[0-9]+' || true)"
|
|
||||||
GEGEN=""
|
|
||||||
if [ "${TREFFER:-1}" != "0" ] && [ -x "$FREMDBLICK" ]; then
|
|
||||||
# Grosses Budget: GLM (Reasoning-Modell) denkt erst ueber das ganze Quellmaterial nach,
|
|
||||||
# bevor das Urteil in content landet — 2200 (fremdblick-Default) war im Probelauf 10.07.
|
|
||||||
# zu knapp (ABGESCHNITTEN, kein Urteil).
|
|
||||||
GEGEN="$(printf '%s\n\nQUELLMATERIAL (Original-Changelogs zum Gegenpruefen der Zitate):\n%s' "$ANALYSE" "$NOTES" \
|
|
||||||
| FREMDBLICK_MAXTOK="${RADAR_FREMDBLICK_MAXTOK:-4500}" "$FREMDBLICK")"
|
|
||||||
echo "$GEGEN"
|
|
||||||
echo
|
|
||||||
fi
|
|
||||||
|
|
||||||
# Treffer fuettern die Ideen-Queue ("Lucy kennt sich", 12.07.2026): aus einem echten
|
|
||||||
# Radar-Treffer wird EINE rohe Idee (triage) — Specifier + Commander entscheiden, ob eine
|
|
||||||
# Probe gebaut wird. Idempotent je Release-Tag; der Radar selbst bleibt reiner Melder.
|
|
||||||
if [ -n "${TREFFER:-}" ] && [ "$TREFFER" != "0" ] && [ -x "$HOME/.local/bin/hermes" ]; then
|
|
||||||
IDEE_ID="$("$HOME/.local/bin/hermes" kanban create \
|
|
||||||
"Hermes ${NEWEST}: Release-Radar-Treffer pruefen (Probe bauen?)" \
|
|
||||||
--body "Automatisch vom Release-Radar am $(date '+%d.%m.%Y'). ABGLEICH (Analyst: ${RICHTER}):
|
|
||||||
${ANALYSE}
|
|
||||||
|
|
||||||
FREMDBLICK:
|
|
||||||
${GEGEN:-(keiner)}
|
|
||||||
|
|
||||||
Rohe Idee: nur pruefen bzw. eine risikofreie Probe vorschlagen — Updates bleiben manuell (Entscheid 04.07.)." \
|
|
||||||
--triage --created-by release-radar --idempotency-key "release-radar-${NEWEST}" --json 2>/dev/null \
|
|
||||||
| python3 -c '
|
|
||||||
import json, sys
|
|
||||||
t = sys.stdin.read(); i = t.find("{")
|
|
||||||
try:
|
|
||||||
print(json.loads(t[i:]).get("id", "") if i >= 0 else "")
|
|
||||||
except Exception:
|
|
||||||
print("")
|
|
||||||
' 2>/dev/null || true)"
|
|
||||||
if [ -n "${IDEE_ID// /}" ]; then
|
|
||||||
echo "### IN DIE IDEEN-QUEUE GELEGT: ${IDEE_ID} — Probe-Pruefung fuer ${NEWEST} (der Specifier uebernimmt)."
|
|
||||||
echo
|
|
||||||
fi
|
|
||||||
fi
|
|
||||||
|
|
||||||
printf '%s\n' "$NEWEST" > "$STATE"
|
|
||||||
briefkasten "Release-Radar" "Neue hermes-agent-Releases bis $NEWEST (Box: ${INSTALLED_TAG:-?}).
|
|
||||||
|
|
||||||
ABGLEICH (Analyst: $RICHTER):
|
|
||||||
$ANALYSE
|
|
||||||
|
|
||||||
${GEGEN:-(Kein Fremdblick noetig: TREFFER 0)}"
|
|
||||||
@@ -1,298 +0,0 @@
|
|||||||
#!/usr/bin/env bash
|
|
||||||
# Idle-Radar (naechtlich 03:45 — S4 "Zuendung", 12.07.2026): die Box gibt sich selbst Arbeit.
|
|
||||||
# Destilliert aus JOURNAL-Fehlermustern (24 h) und der juengsten TRAUM-Notiz 0-2 KLEINE,
|
|
||||||
# belegte Wartungs-Kandidaten und legt sie als ROHE IDEEN (triage) ins native Hermes-Kanban.
|
|
||||||
# Danach laeuft der bewiesene S2-Kreislauf von allein: Specifier arbeitet aus -> Werkstatt
|
|
||||||
# baut einen Vorschlags-Branch -> Karte im Auftragsbuch -> der KLICK des Commanders bleibt
|
|
||||||
# das einzige Gate. Muster wie hermes-release-radar-feed.sh: liegt in ~/.hermes/scripts/
|
|
||||||
# (deploy.sh kopiert ihn), stdout wird dem Cron-Agenten als Prompt eingespeist; der
|
|
||||||
# eigentliche ABGLEICH laeuft als Ein-Schuss-Completion gegen llama-swap (:8080).
|
|
||||||
# Grundsaetze:
|
|
||||||
# - Kandidat NUR mit woertlichem Beleg-Zitat; das Skript prueft das Zitat MECHANISCH
|
|
||||||
# gegen das Material (reproduziert-oder-abgelehnt, Verdikt 04.07.) — haerter als
|
|
||||||
# ein zweites LLM-Urteil und gratis.
|
|
||||||
# - Max. 2 neue Ideen je Nacht + STAU-BREMSE: liegt schon genug Arbeit (volle Queue
|
|
||||||
# oder volles Auftragsbuch), legt der Radar NICHTS nach — die Box soll Arbeit
|
|
||||||
# abarbeiten, nicht anhaeufen.
|
|
||||||
# - Dedup dreifach: State-Datei (schon gemeldet) + Queue/Karten-Liste im Analysten-
|
|
||||||
# Kontext + --idempotency-key beim Anlegen.
|
|
||||||
# - Der Radar LEGT NUR IDEEN AN — er baut nichts, merged nichts, konfiguriert nichts.
|
|
||||||
# State: ~/.hermes/state/idle-radar-gemeldet.txt (ein KEY je bereits gemeldetem Kandidaten).
|
|
||||||
set -uo pipefail
|
|
||||||
|
|
||||||
MC="$HOME/mission-control-v2"
|
|
||||||
VAULT="$HOME/wissens-vault"
|
|
||||||
STATE_DIR="$HOME/.hermes/state"
|
|
||||||
STATE="$STATE_DIR/idle-radar-gemeldet.txt"
|
|
||||||
ENDPOINT="${IDLE_ENDPOINT:-http://127.0.0.1:8080/v1/chat/completions}"
|
|
||||||
ANALYST="${IDLE_MODEL:-gpt-oss-120b}"
|
|
||||||
VERTRETUNG="${IDLE_FALLBACK:-GLM-4.7-Flash}"
|
|
||||||
HERMES="$HOME/.local/bin/hermes"
|
|
||||||
MAX_NEU=2 # harte Obergrenze neuer Ideen je Nacht (wie Bagatell-Pfad)
|
|
||||||
STAU_QUEUE=4 # ab so vielen offenen Queue-Aufgaben: Bremse
|
|
||||||
STAU_KARTEN=3 # ab so vielen offenen Auftragsbuch-Karten: Bremse
|
|
||||||
|
|
||||||
mkdir -p "$STATE_DIR"; touch "$STATE"
|
|
||||||
|
|
||||||
# Briefkasten-Spiegel (still, wie Morgenlage/Release-Radar): Chronik liest source=idle-radar.
|
|
||||||
briefkasten() { # $1=Betreff $2=Text
|
|
||||||
curl -sf -m 5 -X POST "${MC_ANNOUNCE_URL:-http://127.0.0.1:9001/api/voice/announce}" \
|
|
||||||
-H 'Content-Type: application/json' \
|
|
||||||
--data "$(python3 - "$1" "$2" <<'PY'
|
|
||||||
import json, sys
|
|
||||||
print(json.dumps({"text": sys.argv[2], "subject": sys.argv[1],
|
|
||||||
"source": "idle-radar", "priority": "silent"}))
|
|
||||||
PY
|
|
||||||
)" >/dev/null 2>&1 || true
|
|
||||||
}
|
|
||||||
|
|
||||||
# ---------- Versionierter Auftrag fuer den Boten-Agenten ----------
|
|
||||||
cat "$MC/deploy/idle-radar-prompt.md" 2>/dev/null || cat <<'EOF'
|
|
||||||
(Prompt-Datei fehlt noch — Kurzform:) Du bist der Bote des naechtlichen Idle-Radars.
|
|
||||||
Berichte den Befund unten in Lucys Stimme in hoechstens 3 Saetzen: wie viele neue
|
|
||||||
Queue-Ideen angelegt wurden (Titel nennen) oder warum keine. Nichts selbst umsetzen,
|
|
||||||
keine Kanban-Aktionen — das Skript hat alles Noetige bereits getan.
|
|
||||||
EOF
|
|
||||||
echo
|
|
||||||
|
|
||||||
# ---------- Stau-Bremse (vor dem teuren Analysten) ----------
|
|
||||||
OFFEN_QUEUE="$("$HERMES" kanban list --json 2>/dev/null | python3 -c '
|
|
||||||
import json, sys
|
|
||||||
t = sys.stdin.read(); i = t.find("[")
|
|
||||||
try:
|
|
||||||
d = json.loads(t[i:]) if i >= 0 else []
|
|
||||||
except Exception:
|
|
||||||
d = []
|
|
||||||
print(sum(1 for x in d if isinstance(x, dict) and x.get("status") not in ("done", "archived")))
|
|
||||||
' 2>/dev/null || echo 0)"
|
|
||||||
OFFEN_KARTEN="$(curl -sf -m 10 http://127.0.0.1:9001/api/auftragsbuch 2>/dev/null | python3 -c '
|
|
||||||
import json, sys
|
|
||||||
try:
|
|
||||||
print(int(json.load(sys.stdin).get("open_count", 0)))
|
|
||||||
except Exception:
|
|
||||||
print(0)
|
|
||||||
' 2>/dev/null || echo 0)"
|
|
||||||
|
|
||||||
if [ "${OFFEN_QUEUE:-0}" -ge "$STAU_QUEUE" ] || [ "${OFFEN_KARTEN:-0}" -ge "$STAU_KARTEN" ]; then
|
|
||||||
echo "## IDLE-RADAR-BEFUND: STAU-BREMSE (erhoben am $(date '+%d.%m.%Y %H:%M'))"
|
|
||||||
echo "Offene Queue-Aufgaben: ${OFFEN_QUEUE} (Bremse ab ${STAU_QUEUE}) · offene Karten: ${OFFEN_KARTEN} (Bremse ab ${STAU_KARTEN})."
|
|
||||||
echo "Es liegt genug Arbeit — heute Nacht keine neuen Ideen. Dem Commander EINEN kurzen Satz melden."
|
|
||||||
briefkasten "Idle-Radar" "Stau-Bremse: ${OFFEN_QUEUE} offene Queue-Aufgaben, ${OFFEN_KARTEN} offene Karten — keine neuen Ideen angelegt."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
# ---------- Material sammeln (erst sammeln, dann kuerzen — SIGPIPE-Falle) ----------
|
|
||||||
TRAUM_DATEI="$(ls -1t "$VAULT/traeume/"*.md 2>/dev/null | head -1 || true)"
|
|
||||||
EVID="$(
|
|
||||||
echo "### JOURNAL-FEHLERMUSTER (user-Dienste, letzte 24 h; Anzahl · Muster, lange Zahlen/IDs normalisiert):"
|
|
||||||
journalctl --user --since '24 hours ago' -p warning --no-pager 2>/dev/null \
|
|
||||||
| sed -E 's/^[A-Z][a-z]{2} [0-9 ]{2} [0-9:]{8} [^ ]+ //; s/\[[0-9]+\]//; s/[0-9]{3,}/N/g; s/t_[0-9a-f]+/t_X/g' \
|
|
||||||
| sort | uniq -c | sort -rn | head -18
|
|
||||||
echo
|
|
||||||
echo "### JUENGSTE TRAUM-NOTIZ ($(basename "${TRAUM_DATEI:-keine}") — Funde des naechtlichen Lern-Crons):"
|
|
||||||
if [ -n "$TRAUM_DATEI" ]; then head -70 "$TRAUM_DATEI"; else echo "(keine Traum-Notiz gefunden)"; fi
|
|
||||||
echo
|
|
||||||
echo "### OFFENE SKILL-KANDIDATEN im Vault (nur Titelzeilen):"
|
|
||||||
ls -1 "$VAULT/skill-kandidaten/"*.md 2>/dev/null | head -8 | while read -r f; do
|
|
||||||
echo "- $(basename "$f"): $(head -1 "$f" 2>/dev/null)"
|
|
||||||
done
|
|
||||||
echo
|
|
||||||
echo "### SELBST-STECKBRIEF (auto-generiert von selbst-inventur.sh — das EXISTIERT schon; NICHTS davon neu vorschlagen):"
|
|
||||||
head -80 "$HOME/.hermes/state/selbst-steckbrief.md" 2>/dev/null || echo "(noch keine Selbst-Inventur gelaufen)"
|
|
||||||
echo
|
|
||||||
echo "### SEIT GESTERN AN MIR GEAENDERT (Selbst-Inventur-Diff — gute Kandidaten-Quelle, wenn eine kleine Massnahme erkennbar ist):"
|
|
||||||
head -40 "$HOME/.hermes/state/selbst-steckbrief.diff" 2>/dev/null || echo "(keine Aenderung erkannt)"
|
|
||||||
echo
|
|
||||||
echo "### VOM COMMANDER ABGELEHNT (mit Grund — sinngemaess NIE wieder vorschlagen):"
|
|
||||||
tail -12 "${MC2_ABLEHNUNGEN:-/srv/models/mc2-ablehnungen.jsonl}" 2>/dev/null | python3 -c '
|
|
||||||
import json, sys
|
|
||||||
n = 0
|
|
||||||
for line in sys.stdin:
|
|
||||||
try:
|
|
||||||
d = json.loads(line)
|
|
||||||
except Exception:
|
|
||||||
continue
|
|
||||||
n += 1
|
|
||||||
print("- [{}] {} — Grund: {}".format(d.get("branch", "?"), (d.get("subject") or "")[:80],
|
|
||||||
d.get("grund") or "(keiner angegeben)"))
|
|
||||||
if not n:
|
|
||||||
print("(keine)")
|
|
||||||
' 2>/dev/null || echo "(keine)"
|
|
||||||
echo
|
|
||||||
echo "### SCHON IN DER IDEEN-QUEUE (inkl. archiviert = vom Commander verworfen; NICHT erneut vorschlagen):"
|
|
||||||
"$HERMES" kanban list --archived --json 2>/dev/null | python3 -c '
|
|
||||||
import json, sys
|
|
||||||
t = sys.stdin.read(); i = t.find("[")
|
|
||||||
try:
|
|
||||||
d = json.loads(t[i:]) if i >= 0 else []
|
|
||||||
except Exception:
|
|
||||||
d = []
|
|
||||||
for x in d[:40]:
|
|
||||||
if isinstance(x, dict):
|
|
||||||
print("- [{}] {}".format(x.get("status", "?"), (x.get("title") or "")[:110]))
|
|
||||||
' 2>/dev/null || echo "(Queue nicht lesbar)"
|
|
||||||
echo
|
|
||||||
echo "### OFFENE KARTEN IM AUFTRAGSBUCH (warten auf Klick; NICHT erneut vorschlagen):"
|
|
||||||
curl -sf -m 10 http://127.0.0.1:9001/api/auftragsbuch 2>/dev/null | python3 -c '
|
|
||||||
import json, sys
|
|
||||||
try:
|
|
||||||
items = json.load(sys.stdin).get("items") or []
|
|
||||||
except Exception:
|
|
||||||
items = []
|
|
||||||
if not items:
|
|
||||||
print("(keine)")
|
|
||||||
for it in items[:15]:
|
|
||||||
print("- {}:{}".format(it.get("repo", "mc2"), it.get("branch", "?")))
|
|
||||||
' 2>/dev/null || echo "(Auftragsbuch nicht lesbar)"
|
|
||||||
echo
|
|
||||||
echo "### VOM IDLE-RADAR BEREITS GEMELDET (KEYs; NICHT erneut vorschlagen):"
|
|
||||||
tail -40 "$STATE" 2>/dev/null || true
|
|
||||||
)"
|
|
||||||
|
|
||||||
RASTER='Du bist der IDLE-RADAR einer lokalen KI-Box (Hermes-Agent, MC2, Lucy). Du bekommst naechtliches Material: Journal-Fehlermuster, die juengste Traum-Notiz, offene Skill-Kandidaten sowie Listen dessen, was schon in Arbeit ist. Deine Aufgabe: destilliere daraus 0 bis 2 KLEINE, konkrete Wartungs-Kandidaten, die die Box-Werkstatt selbst umsetzen kann (Patch in 1-2 Dateien, Skript- oder Doku-Aenderung im MC2- oder Lucy-Repo). REGELN: Jeder Kandidat MUSS eine Zeile aus dem Material WOERTLICH zitieren (BELEG) — das Zitat wird mechanisch gegengeprueft, erfundene Zitate fliegen raus. Nichts vorschlagen, was sinngemaess schon in der IDEEN-QUEUE, den OFFENEN KARTEN oder der BEREITS-GEMELDET-Liste steht. Der SELBST-STECKBRIEF sagt dir, was die Box schon HAT und KANN — schlage NIE etwas vor, das dort schon steht (der Fehler vom 12.07.: ein Gateway-Neustart wurde vorgeschlagen, der laengst konfiguriert war). Was der Commander mit Grund ABGELEHNT hat, ist entschieden — nicht neu verpacken. Aenderungen aus dem Inventur-Diff sind gute Kandidaten-Quellen, aber nur mit konkreter kleiner Massnahme. TABU (niemals vorschlagen): Security (approvals/Tokens/ufw/sudoers/ssh), ~/.hermes/config.yaml, systemd-Units, Hermes-Quellcode, Updates/Upgrades, alles was den PC oder einen Menschen braucht. Ein wiederkehrendes Fehlermuster ist NUR dann ein Kandidat, wenn eine konkrete kleine Ursachen-Behebung erkennbar ist — "beobachten", "untersuchen" oder "Monitoring bauen" ist KEIN Auftrag. Qualitaet vor Quote: KANDIDATEN: 0 ist der Normalfall und voellig ok. Antworte auf DEUTSCH, exakt in dieser Struktur: erste Zeile "KANDIDATEN: <0|1|2>". Danach je Kandidat ein Block aus genau vier Zeilen: "TITEL: <max 90 Zeichen, Imperativ, deutsch>" / "KEY: <kurzer-kebab-slug>" / "BELEG: <woertliches Zitat aus dem Material, EINE Zeile>" / "WARUM: <ein Satz>". Bei 0 stattdessen EIN Satz, warum nichts ansteht.'
|
|
||||||
|
|
||||||
# Ein-Schuss-Analyst: $1=Modell $2=curl-Timeout $3=max_tokens (Muster chef-gutachter-feed.sh).
|
|
||||||
judge() {
|
|
||||||
local req
|
|
||||||
req="$(jq -n --arg m "$1" --arg sys "$RASTER" --arg usr "$EVID" --argjson mt "$3" \
|
|
||||||
'{model:$m, messages:[{role:"system",content:$sys},{role:"user",content:$usr}],
|
|
||||||
max_tokens:$mt, temperature:0.2}')"
|
|
||||||
curl -s -m "$2" "$ENDPOINT" -H 'Content-Type: application/json' --data-binary "$req" \
|
|
||||||
| python3 -c '
|
|
||||||
import json, sys
|
|
||||||
try:
|
|
||||||
d = json.load(sys.stdin)
|
|
||||||
msg = d["choices"][0]["message"]
|
|
||||||
print((msg.get("content") or msg.get("reasoning_content") or "").strip())
|
|
||||||
except Exception:
|
|
||||||
pass'
|
|
||||||
}
|
|
||||||
|
|
||||||
RICHTER="$ANALYST"
|
|
||||||
ANALYSE="$(judge "$ANALYST" 420 2600)"
|
|
||||||
if [ -z "${ANALYSE// /}" ]; then
|
|
||||||
RICHTER="$VERTRETUNG (Vertretung — $ANALYST hat nicht geantwortet)"
|
|
||||||
ANALYSE="$(judge "$VERTRETUNG" 240 1800)"
|
|
||||||
fi
|
|
||||||
|
|
||||||
echo "## IDLE-RADAR-BEFUND (erhoben am $(date '+%d.%m.%Y %H:%M'))"
|
|
||||||
echo "Offene Queue-Aufgaben vorher: ${OFFEN_QUEUE} · offene Karten: ${OFFEN_KARTEN} · Deckel: ${MAX_NEU}/Nacht"
|
|
||||||
echo
|
|
||||||
|
|
||||||
if [ -z "${ANALYSE// /}" ]; then
|
|
||||||
echo "### ANALYSE AUSGEFALLEN"
|
|
||||||
echo "Beide Analysten ($ANALYST, $VERTRETUNG) haben nicht geantwortet — dem Commander EINEN ehrlichen Satz melden; morgen neuer Versuch."
|
|
||||||
briefkasten "Idle-Radar" "Analyse ausgefallen (kein Analyst erreichbar) — keine neuen Ideen."
|
|
||||||
exit 0
|
|
||||||
fi
|
|
||||||
|
|
||||||
echo "### ANALYSE (Analyst: $RICHTER)"
|
|
||||||
echo "$ANALYSE"
|
|
||||||
echo
|
|
||||||
|
|
||||||
# ---------- Ehrlichkeits-Gate + Dedup + Anlegen (deterministisch im Skript) ----------
|
|
||||||
# Temp-Dateien statt Pipes: Heredoc + Pipe gleichzeitig frisst stdin (Release-Radar-Lehre 10.07.).
|
|
||||||
TMPD="$(mktemp -d /tmp/idle-radar.XXXXXX)"
|
|
||||||
printf '%s' "$ANALYSE" > "$TMPD/analyse.txt"
|
|
||||||
printf '%s' "$EVID" > "$TMPD/material.txt"
|
|
||||||
PLAN="$(python3 - "$TMPD/analyse.txt" "$TMPD/material.txt" "$STATE" "$MAX_NEU" <<'PY'
|
|
||||||
import re, sys, unicodedata
|
|
||||||
|
|
||||||
ana = open(sys.argv[1], encoding="utf-8", errors="replace").read()
|
|
||||||
evid = open(sys.argv[2], encoding="utf-8", errors="replace").read()
|
|
||||||
try:
|
|
||||||
state = {l.strip() for l in open(sys.argv[3], encoding="utf-8", errors="replace") if l.strip()}
|
|
||||||
except Exception:
|
|
||||||
state = set()
|
|
||||||
max_neu = int(sys.argv[4])
|
|
||||||
|
|
||||||
def norm(s):
|
|
||||||
s = unicodedata.normalize("NFKC", s)
|
|
||||||
s = "".join(ch for ch in s if ch.isalnum() or ch.isspace())
|
|
||||||
return " ".join(s.lower().split())
|
|
||||||
|
|
||||||
nev = norm(evid)
|
|
||||||
|
|
||||||
# Zeilenweise einsammeln (tolerant gegen Markdown-Deko und Leerzeilen zwischen Feldern).
|
|
||||||
cands, cur = [], {}
|
|
||||||
for line in ana.splitlines():
|
|
||||||
line = line.strip().lstrip("*->#• ").strip()
|
|
||||||
m = re.match(r"(TITEL|KEY|BELEG|WARUM)\s*:\s*(.+)$", line)
|
|
||||||
if not m:
|
|
||||||
continue
|
|
||||||
k, v = m.group(1), m.group(2).strip()
|
|
||||||
if k == "TITEL" and cur:
|
|
||||||
cands.append(cur); cur = {}
|
|
||||||
cur[k] = v
|
|
||||||
if cur:
|
|
||||||
cands.append(cur)
|
|
||||||
|
|
||||||
neu = 0
|
|
||||||
SEP = "\x1f"
|
|
||||||
for c in cands:
|
|
||||||
titel = (c.get("TITEL") or "").strip()[:120]
|
|
||||||
warum = (c.get("WARUM") or "").strip()[:300]
|
|
||||||
beleg = (c.get("BELEG") or "").strip().strip('"„“»«>`').strip()
|
|
||||||
key = re.sub(r"[^a-z0-9-]+", "-", (c.get("KEY") or "").strip().lower())[:48].strip("-")
|
|
||||||
if not (titel and key and beleg):
|
|
||||||
continue
|
|
||||||
if key in state or ("idle-radar-" + key) in state:
|
|
||||||
print("SKIP" + SEP + key + SEP + "schon frueher gemeldet (State)")
|
|
||||||
continue
|
|
||||||
if not norm(beleg) or norm(beleg) not in nev:
|
|
||||||
print("SKIP" + SEP + key + SEP + "BELEG nicht woertlich im Material — verworfen (Ehrlichkeits-Gate)")
|
|
||||||
continue
|
|
||||||
if neu >= max_neu:
|
|
||||||
print("SKIP" + SEP + key + SEP + "Deckel erreicht")
|
|
||||||
continue
|
|
||||||
neu += 1
|
|
||||||
print("NEU" + SEP + key + SEP + titel + SEP + beleg + SEP + warum)
|
|
||||||
PY
|
|
||||||
)"
|
|
||||||
|
|
||||||
ANGELEGT=""; VERWORFEN=""
|
|
||||||
while IFS=$'\x1f' read -r art key titel beleg warum; do
|
|
||||||
[ -n "${art:-}" ] || continue
|
|
||||||
if [ "$art" = "SKIP" ]; then
|
|
||||||
VERWORFEN="${VERWORFEN}- ${key}: ${titel}"$'\n' # bei SKIP traegt das 3. Feld den Grund
|
|
||||||
continue
|
|
||||||
fi
|
|
||||||
[ "$art" = "NEU" ] || continue
|
|
||||||
BODY="Automatisch vom Idle-Radar erhoben am $(date '+%d.%m.%Y') (Quelle: Journal-Muster/Traum-Notiz der Nacht).
|
|
||||||
|
|
||||||
BELEG (woertlich aus dem Material): ${beleg}
|
|
||||||
|
|
||||||
WARUM: ${warum}
|
|
||||||
|
|
||||||
Rohe Idee — bitte pruefen, klein schneiden und nur wenn tragfaehig promoten; sonst archivieren."
|
|
||||||
TASK_ID="$("$HERMES" kanban create "$titel" --body "$BODY" --triage \
|
|
||||||
--created-by idle-radar --idempotency-key "idle-radar-${key}" --json 2>/dev/null \
|
|
||||||
| python3 -c '
|
|
||||||
import json, sys
|
|
||||||
t = sys.stdin.read(); i = t.find("{")
|
|
||||||
try:
|
|
||||||
print(json.loads(t[i:]).get("id", "") if i >= 0 else "")
|
|
||||||
except Exception:
|
|
||||||
print("")
|
|
||||||
' 2>/dev/null || true)"
|
|
||||||
if [ -n "${TASK_ID// /}" ]; then
|
|
||||||
echo "$key" >> "$STATE"
|
|
||||||
ANGELEGT="${ANGELEGT}- ${titel} (${TASK_ID}, Key ${key})"$'\n'
|
|
||||||
else
|
|
||||||
VERWORFEN="${VERWORFEN}- ${key}: kanban create fehlgeschlagen"$'\n'
|
|
||||||
fi
|
|
||||||
done <<< "$PLAN"
|
|
||||||
rm -rf "$TMPD"
|
|
||||||
|
|
||||||
echo "### ANGELEGT (rohe Ideen, triage — der Specifier uebernimmt):"
|
|
||||||
echo "${ANGELEGT:-(keine)}"
|
|
||||||
echo "### NICHT ANGELEGT (Gate/Dedup/Deckel):"
|
|
||||||
echo "${VERWORFEN:-(keine)}"
|
|
||||||
|
|
||||||
N_NEU="$(printf '%s' "$ANGELEGT" | grep -c '^-' || true)"
|
|
||||||
if [ "${N_NEU:-0}" -gt 0 ]; then
|
|
||||||
briefkasten "Idle-Radar" "Idle-Radar hat ${N_NEU} neue Idee(n) in die Queue gelegt:
|
|
||||||
${ANGELEGT}Der Specifier arbeitet sie aus; die Karten-Annahme bleibt beim Commander."
|
|
||||||
else
|
|
||||||
briefkasten "Idle-Radar" "Idle-Radar: keine neuen Ideen (Analyst: ${RICHTER})."
|
|
||||||
fi
|
|
||||||
Some files were not shown because too many files have changed in this diff Show More
Reference in New Issue
Block a user