aebe10306d
Die Box-lesbare Kapsel des kompletten Umbaus: Architektur, neue Mechanik, Verdikte, IDE-Pfade, offene Faeden. Claude-Gedaechtnis/Artifacts werden mit Abo-Ende unlesbar - alles Betriebsrelevante steht ab jetzt HIER. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
7.2 KiB
7.2 KiB
Offene Fäden — DIE eine Liste
Stand 12.07.2026 (Session S3 lucy-pipeline). Regel: Neues hier rein, Erledigtes hier raus, keine zweite Liste anlegen. Verdikte werden NICHT als „offen" geführt → VERDIKTE.md.
➡️ 19.07.2026 — DREI-WELTEN-UMBAU KOMPLETT: UEBERGABE-DREI-WELTEN.md ist die finale Übergabe der externen Claude-Sessions (Architektur, neue Mechanik — No-Progress-Bremse, Betrieb-Playbook, mem0-Bündelung/Bereiche/Konsolidierung —, neue Verdikte, IDE-Welt Zed+OpenCode, offene Fäden Stand 19.07.). Bei Widerspruch zu älteren Abschnitten unten gilt die Übergabe.
Termine (auch als Box-Reminder hinterlegt)
- Mo 13.07., 05:15 — erster echter Release-Radar-Cron-Lauf → Morgenlage/Chronik prüfen.
- täglich 03:45 (ab Registrierung) — Idle-Radar legt max. 2 belegte Wartungs-Ideen in die Queue; erste Läufe in der Morgenlage prüfen.
- 20.–25.07. — ROCm-Recheck (Anlass: Ryzen-AI-Halo-Launch 06.07., ROCm 7.13 Preview). Fragen: neue Halo-Community-Benches? llama.cpp-Issue #21284 (gfx1151-Prefill) gemerged? kyuz0-Grid aktualisiert (kyuz0.github.io/amd-strix-halo-toolboxes)? Falls ROCm dann Langkontext-Prefill-Bedarf trifft: NUR Hybrid für heavy/coder erwägen — Hirn bleibt auf Vulkan, kein Voll-Cut.
- hipEngine-Watch (shisa-ai/hipEngine, natives HIP gfx1151, nur Qwen3.6, >2× Prefill):
reif genug? Dann mit
deploy/bench/brain-bench.shgegen Vulkan messen.
Das Ablösungs-Paket (Kurs, siehe ZIELBILD.md)
- S2 „leg los queue" ✅ (10.+12.07.): Queue = natives Hermes-Kanban, Türen live
(Zentrale/Telegram/Lucy), Bagatell-Pfad enabled; voller Kreislauf einmal komplett
durchlaufen (
wartung/fix-double-zero-self-repair). Rest: Live-Telegram-Test beim nächsten echten Zuruf beobachten; Specifier schreibt Titel englisch (ggf. tunen). - S3 „leg los lucy-pipeline" ✅ (12.07., beide Karten angenommen): PC-Annahme-Weg live —
Auftragsbuch liest ZWEI Repos (mc2 + lucy), Lucy-Annahme = Merge auf der Box +
dist-Build/Neustart am PC via PC-Executor (
deploy/lucy-annahme.sh+deploy/lucy-annahme.ps1im Lucy-Repo), Auto-Revert bei Rot. Erster echter Auftrag durch: A4-Turncheck Default AUS (680 Entscheidungen, 79 % der Halte umsonst), dist am PC gebaut. Erster Live-Lauf fand 2 Runner-Bugs (Start-Process-Quoting bei Leerzeichen-Pfad, f-String-\"auf Python 3.14 → Poll blind; Abschluss manuell nachgezogen, Build war grün) — Fixes + Executor-Fensterblitz-Fix in Kartewartung/lucy-annahme-fixes(✅ angenommen). Details FALLEN.md. Der nächste Lucy-Auftrag ist der ehrliche Voll-Automatik-Test. - Annahme-Selbstheilung (12.07. abends, nach cleanse-skill-index-Vorfall): Auftragsbuch
erkennt Orphan-Branches („kein gemeinsamer Ursprung", Annehmen-Knopf weg) und leere
Diffs; beide Runner rebasen veraltete Branches automatisch, bevor sie aufgeben;
werkstatt-SOUL: voll klonen + merge-base-Selbstcheck + fetch/rebase vor Push, nie
~/.hermes-Artefakte committen. Karte
wartung/annahme-selbstheilung. - S4 „leg los zuendung" ✅ gebaut (12.07.): Idle-Radar (
deploy/idle-radar-feed.sh, Hermes-Cron nächtlich 03:45): Journal-Fehlermuster + Traum-Funde → max. 2 belegte rohe Ideen/Nacht ins native Kanban (Ehrlichkeits-Gate prüft Beleg-Zitate mechanisch, Stau-Bremse bei voller Queue/vollem Auftragsbuch, dreifacher Dedup inkl. archivierter Ideen) · Großbau-Etappen-Regeln in werkstatt-SOUL + wartung-/orchestrator-Skill (jede Etappe für sich lauffähig + annehmbar, NIE auf unangenommene Branches bauen, Folge-Etappen als neue Queue-Aufgaben). Generalprobe ohne Claude BESTANDEN 12.07. ~19:00–19:30: Radar legte 2 echte Ideen, Specifier zerlegte (deutsch), Werkstatt lieferte Kartewartung/hermes-gateway-restart— deren Inhalt war redundant (Restart längst konfiguriert) → daraus entstand noch am selben Tag das „Lucy kennt sich"-Paket (User-Auftrag): Selbst-Inventur-Cron 03:35 (Steckbrief auto-generiert + Änderungs-Erkennung), Karten-Gutachter-Cron 04:00 (Empfehlungs- Stempel auf jeder Karte), Ablehnen-mit-Grund (Lern-Gedächtnis/srv/models/mc2-ablehnungen.jsonl), Realitäts-Check-Regel (werkstatt-SOUL 7 + wartung-Skill), Release-Radar-Treffer → Queue-Idee. Offen: erste Scharf-Nächte in der Morgenlage beobachten (03:35 Inventur → 03:45 Idle-Radar → 04:00 Gutachter → 04:10 Bagatell → 04:30 Morgenlage → Mo 05:15 Release-Radar).
Lucy
- Mini-Stimme v2: Übernacht-Datensatz v2 (DE-Tech + EN) war für 10.07. armiert;
User-Schritte: Zip → Drive →
Lucy_Stimme_Training_v2.ipynbauf Colab T4 → Hörtest. Danach: Lexikon-Injektion in kokoro_server + Modell-Tausch. pocket bleibt Default, bis v2 den Live-Test gewinnt (Umschalter „Neue Stimme (Mini-Lucy)" in der Steuerung). - Saber-/XTTS-Altlasten in lucy-tts/ (untracked venvs, Datasets, tote Notebooks) — aufräumen nur mit User-Ja (v2-Pipeline ersetzt sie).
- „Lucy light"-Experiment: ungestartet, Idee geparkt.
- Frechheit-Regler Phase 3 ist LIVE; weitere Animations-Wünsche nur auf Zuruf.
- A4-Turncheck: nach dem Default-AUS (S3) gilt — wer ihn wieder will, setzt
localStorage.lucy_turncheck="1"; Telemetrie loggt dann nur noch in die Konsole (lucy_perf="1"), die Log-Dateilucy-turncheck.logwird nicht mehr beschrieben. - Emotions-Stimme = Zukunftsfaden (Klon-DNA ist ruhig; warten auf Qwen-instruct-Clone o. ä.).
Box / MC2 (Kleinkram + Politur)
- D16-Reste: c) System-Logs ausbauen (alle Dienste, Fehler-Filter) · e) Mem0-Dubletten automatisch (an Curator/Selbstkritik hängen) · f) Politur (Cockpit Zone C entflechten, Faden 6 Voice-Sidecar-Diät: Lucy-Reste aus dem Web-UI).
- C13 Bare-Metal-Bootstrap/First-Run-Wizard (Konzept: docs/DISASTER_RECOVERY.md) ·
C14 sudo-Kleinkram (stale v1-Unit
mission-control.service, alter :9000-Rest) · C15 Docs-Refresh (README, STATUS.md, CUTOVER.md, HERMES_SETUP.md). - Tarball-Backup-Schicht nach ~2 Wochen grüner PBS-Verifys in Rente schicken (ab ~23.07.).
- Embedding-A/B-Bench (0.6B vs 4B/8B) als ruhiger Bench-Job; Discover.ROLE_METADATA hat für neue Rollen (kritiker/reranker) nur Fallback-Texte.
- radar-feed.sh + selbstkritik-feed.sh haben keinen EIGENEN Cron mehr (laufen im Monats-Review-Wrapper) — Aufräum-Kandidat, bewusst liegen gelassen.
- Orchestrator-Härtungs-Kandidaten (erst beobachten, ob es wieder passiert): Schreibziel-Pflicht /tmp/orch-/ vor jedem write_file · große Artefakte nie in die Antwort (Output-Limit-Tod).
- Selbstkritik-Cron in die Morgenlage falten (Empfehlung steht, Eingriff braucht Ja).
- pve-root-Passwort unverändert (User-Entscheid 09.07., „nur LAN") — bei Gelegenheit ändern.
Beobachten (kein Handlungsbedarf)
- Erste Nächte des neuen Stacks weiter im Blick: Traum 03:15 / Chef-Gutachter 04:30 / Briefing 08:00 / self-smoke 07:15 — Morgenlage lesen.
- Telegram-Hänger-Verdacht: NICHT der Prompt (gecacht) — echte Verdächtige sind kalter Cache nach Modell-Reload oder Mem0/Session-Resume beim 1. Turn; braucht echte Telegram-Log-Messung, falls es wieder auffällt.
- GLM-4.7-Flash tauchte 08.07. ~17:00 warm auf (irgendwas nutzte den Kritiker aktiv) — unkritisch, nicht weiter verfolgt.