E4-Haertung: /v1/models liefert context_length + Alias-Eintraege (heavy/coder/...)
Radar-Erstlauf-Lehre: Hermes-Subagents fanden keine Kontextlaenge (llama-swap listet nur kanonische Namen, ohne Metadaten), nahmen 256k an und rissen mit ihren max_tokens den Server-Kontext. Gateway blendet jetzt Rollen-Aliase als Eintraege ein und liefert context_length aus der geparsten llama-swap-Config. Delegation per hermes config auf Verdikt gesetzt (max_concurrent_children 2, max_spawn_depth 1). Radar-Prompt: Fallback "sequenziell selbst recherchieren, Report muss IMMER kommen". Erstlauf-Ergebnis: Report wurde an Telegram zugestellt (Last run ok). Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
This commit is contained in:
@@ -13,6 +13,9 @@ Web-Suche, FILTERT Marketing-Geschwätz aus und liefert dir nur eine Substanz-Zu
|
||||
(max. 5 Zeilen pro Komponente). Du konsolidierst am Ende. Erwähne im Endbericht nur, was
|
||||
Substanz hat — „nichts Nennenswertes" ist ein gültiges und gutes Ergebnis je Gruppe.
|
||||
|
||||
Scheitern Subagents wiederholt (z. B. Kontext-Fehler), recherchiere die betroffenen Gruppen
|
||||
selbst sequenziell — der Report muss IMMER zustande kommen.
|
||||
|
||||
Task-Aufteilung (5 Subagents):
|
||||
1. **Engine/Router:** llama.cpp (Vulkan, gfx1151/Strix Halo relevant!), llama-swap (mostlygeek)
|
||||
2. **Agent/Runtime:** hermes-agent (NousResearch), Electron (Major-Sprünge), three-vrm/@pixiv
|
||||
|
||||
Reference in New Issue
Block a user