961b003df4
- deploy/idle-radar-feed.sh (Hermes-Cron 03:45): destilliert aus Journal- Fehlermustern (24h) + juengster Traum-Notiz max. 2 belegte Wartungs- Kandidaten und legt sie als rohe Ideen (triage) ins native Kanban. Ehrlichkeits-Gate: Beleg-Zitat wird MECHANISCH gegen das Material geprueft (reproduziert-oder-abgelehnt). Stau-Bremse (>=4 offene Queue- Aufgaben oder >=3 offene Karten -> nichts Neues), Dedup dreifach (State-Datei + Board-Abgleich inkl. archivierter + --idempotency-key), Security/Config/Updates tabu. Analyst gpt-oss-120b, Vertretung GLM. - deploy/idle-radar-prompt.md: versionierter Boten-Auftrag (Lucys Stimme, max 3 Saetze, nichts selbst umsetzen). - deploy.sh: kopiert idle-radar-feed.sh nach ~/.hermes/scripts/ (greift wegen Selbst-Reset-Falle erst ab dem 2. Deploy -> Vorinstallation einmalig von Hand; Cron-Registrierung einmalig: hermes cron create). - Grossbau-Etappen-Regeln (Zielbild-Entscheid 4, 10.07.): werkstatt-SOUL Regel 6 + wartung-/orchestrator-SKILL Scope-Check: Grosses nicht mehr ablehnen, sondern in Etappen bauen - jede Etappe eigener Branch, fuer sich lauffaehig + annehmbar, Folge-Etappen als neue Queue-Aufgaben, NIE auf unangenommene Branches aufbauen. - Doku: AUFTRAGSBUCH.md (Idle-Radar-Abschnitt), wissen/OFFENE-FAEDEN.md. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
5.7 KiB
5.7 KiB
Offene Fäden — DIE eine Liste
Stand 12.07.2026 (Session S3 lucy-pipeline). Regel: Neues hier rein, Erledigtes hier raus, keine zweite Liste anlegen. Verdikte werden NICHT als „offen" geführt → VERDIKTE.md.
Termine (auch als Box-Reminder hinterlegt)
- Mo 13.07., 05:15 — erster echter Release-Radar-Cron-Lauf → Morgenlage/Chronik prüfen.
- täglich 03:45 (ab Registrierung) — Idle-Radar legt max. 2 belegte Wartungs-Ideen in die Queue; erste Läufe in der Morgenlage prüfen.
- 20.–25.07. — ROCm-Recheck (Anlass: Ryzen-AI-Halo-Launch 06.07., ROCm 7.13 Preview). Fragen: neue Halo-Community-Benches? llama.cpp-Issue #21284 (gfx1151-Prefill) gemerged? kyuz0-Grid aktualisiert (kyuz0.github.io/amd-strix-halo-toolboxes)? Falls ROCm dann Langkontext-Prefill-Bedarf trifft: NUR Hybrid für heavy/coder erwägen — Hirn bleibt auf Vulkan, kein Voll-Cut.
- hipEngine-Watch (shisa-ai/hipEngine, natives HIP gfx1151, nur Qwen3.6, >2× Prefill):
reif genug? Dann mit
deploy/bench/brain-bench.shgegen Vulkan messen.
Das Ablösungs-Paket (Kurs, siehe ZIELBILD.md)
- S2 „leg los queue" ✅ (10.+12.07.): Queue = natives Hermes-Kanban, Türen live
(Zentrale/Telegram/Lucy), Bagatell-Pfad enabled; voller Kreislauf einmal komplett
durchlaufen (
wartung/fix-double-zero-self-repair). Rest: Live-Telegram-Test beim nächsten echten Zuruf beobachten; Specifier schreibt Titel englisch (ggf. tunen). - S3 „leg los lucy-pipeline" ✅ (12.07., beide Karten angenommen): PC-Annahme-Weg live —
Auftragsbuch liest ZWEI Repos (mc2 + lucy), Lucy-Annahme = Merge auf der Box +
dist-Build/Neustart am PC via PC-Executor (
deploy/lucy-annahme.sh+deploy/lucy-annahme.ps1im Lucy-Repo), Auto-Revert bei Rot. Erster echter Auftrag durch: A4-Turncheck Default AUS (680 Entscheidungen, 79 % der Halte umsonst), dist am PC gebaut. Erster Live-Lauf fand 2 Runner-Bugs (Start-Process-Quoting bei Leerzeichen-Pfad, f-String-\"auf Python 3.14 → Poll blind; Abschluss manuell nachgezogen, Build war grün) — Fixes + Executor-Fensterblitz-Fix in Kartewartung/lucy-annahme-fixes. Details FALLEN.md. Der nächste Lucy-Auftrag ist der ehrliche Voll-Automatik-Test. - S4 „leg los zuendung" ✅ gebaut (12.07.): Idle-Radar (
deploy/idle-radar-feed.sh, Hermes-Cron nächtlich 03:45): Journal-Fehlermuster + Traum-Funde → max. 2 belegte rohe Ideen/Nacht ins native Kanban (Ehrlichkeits-Gate prüft Beleg-Zitate mechanisch, Stau-Bremse bei voller Queue/vollem Auftragsbuch, dreifacher Dedup inkl. archivierter Ideen) · Großbau-Etappen-Regeln in werkstatt-SOUL + wartung-/orchestrator-Skill (jede Etappe für sich lauffähig + annehmbar, NIE auf unangenommene Branches bauen, Folge-Etappen als neue Queue-Aufgaben). Offen: erste Scharf-Läufe in der Morgenlage beobachten; der volle Kreislauf ohne Claude (Radar → Specifier → Werkstatt → Karte) ist die eigentliche Generalprobe.
Lucy
- Mini-Stimme v2: Übernacht-Datensatz v2 (DE-Tech + EN) war für 10.07. armiert;
User-Schritte: Zip → Drive →
Lucy_Stimme_Training_v2.ipynbauf Colab T4 → Hörtest. Danach: Lexikon-Injektion in kokoro_server + Modell-Tausch. pocket bleibt Default, bis v2 den Live-Test gewinnt (Umschalter „Neue Stimme (Mini-Lucy)" in der Steuerung). - Saber-/XTTS-Altlasten in lucy-tts/ (untracked venvs, Datasets, tote Notebooks) — aufräumen nur mit User-Ja (v2-Pipeline ersetzt sie).
- „Lucy light"-Experiment: ungestartet, Idee geparkt.
- Frechheit-Regler Phase 3 ist LIVE; weitere Animations-Wünsche nur auf Zuruf.
- A4-Turncheck: nach dem Default-AUS (S3) gilt — wer ihn wieder will, setzt
localStorage.lucy_turncheck="1"; Telemetrie loggt dann nur noch in die Konsole (lucy_perf="1"), die Log-Dateilucy-turncheck.logwird nicht mehr beschrieben. - Emotions-Stimme = Zukunftsfaden (Klon-DNA ist ruhig; warten auf Qwen-instruct-Clone o. ä.).
Box / MC2 (Kleinkram + Politur)
- D16-Reste: c) System-Logs ausbauen (alle Dienste, Fehler-Filter) · e) Mem0-Dubletten automatisch (an Curator/Selbstkritik hängen) · f) Politur (Cockpit Zone C entflechten, Faden 6 Voice-Sidecar-Diät: Lucy-Reste aus dem Web-UI).
- C13 Bare-Metal-Bootstrap/First-Run-Wizard (Konzept: docs/DISASTER_RECOVERY.md) ·
C14 sudo-Kleinkram (stale v1-Unit
mission-control.service, alter :9000-Rest) · C15 Docs-Refresh (README, STATUS.md, CUTOVER.md, HERMES_SETUP.md). - Tarball-Backup-Schicht nach ~2 Wochen grüner PBS-Verifys in Rente schicken (ab ~23.07.).
- Embedding-A/B-Bench (0.6B vs 4B/8B) als ruhiger Bench-Job; Discover.ROLE_METADATA hat für neue Rollen (kritiker/reranker) nur Fallback-Texte.
- radar-feed.sh + selbstkritik-feed.sh haben keinen EIGENEN Cron mehr (laufen im Monats-Review-Wrapper) — Aufräum-Kandidat, bewusst liegen gelassen.
- Orchestrator-Härtungs-Kandidaten (erst beobachten, ob es wieder passiert): Schreibziel-Pflicht /tmp/orch-/ vor jedem write_file · große Artefakte nie in die Antwort (Output-Limit-Tod).
- Selbstkritik-Cron in die Morgenlage falten (Empfehlung steht, Eingriff braucht Ja).
- pve-root-Passwort unverändert (User-Entscheid 09.07., „nur LAN") — bei Gelegenheit ändern.
Beobachten (kein Handlungsbedarf)
- Erste Nächte des neuen Stacks weiter im Blick: Traum 03:15 / Chef-Gutachter 04:30 / Briefing 08:00 / self-smoke 07:15 — Morgenlage lesen.
- Telegram-Hänger-Verdacht: NICHT der Prompt (gecacht) — echte Verdächtige sind kalter Cache nach Modell-Reload oder Mem0/Session-Resume beim 1. Turn; braucht echte Telegram-Log-Messung, falls es wieder auffällt.
- GLM-4.7-Flash tauchte 08.07. ~17:00 warm auf (irgendwas nutzte den Kritiker aktiv) — unkritisch, nicht weiter verfolgt.