Warmhalte-Fix: llama-swap-Key heißt persistent, nicht persist
Live gefunden (Zed-Start warf Lucys Hirn raus): llama-swap ignoriert unbekannte Group-Keys stillschweigend — der Verdrängungsschutz der brains-Gruppe war seit jeher wirkungslos. set_group() schreibt jetzt beide Keys (persistent für llama-swap, persist für MC2-API/UI), budget.py rechnet die echte Ko-Residenz (on-demand reserviert das Warm-Set statt 0), Warn-Texte beschreiben Überlauf statt Verdrängung. Box-Config live gefixt + verifiziert: Coder und Qwen3.6 gleichzeitig ready. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
This commit is contained in:
@@ -210,7 +210,7 @@ export function Cockpit() {
|
||||
async function handleBrainUpdate(repo: string) {
|
||||
const b = brain?.budget
|
||||
const warn = b && !b.fits
|
||||
? `\n\n⚠ Speicher-Warnung: Dieses Brain (~${b.brain_gb} GB) muss immer resident sein. Zusammen mit dem größten on-demand-Modell (~${b.largest_ondemand_gb} GB) sprengt das das Budget (${b.gtt_gb} GB) → heavy/coder würden das Brain verdrängen. Erwäge ein kleineres Brain oder weniger Kontext.`
|
||||
? `\n\n⚠ Speicher-Warnung: Dieses Brain (~${b.brain_gb} GB) bleibt immer resident (persistent). Zusammen mit dem größten on-demand-Modell (~${b.largest_ondemand_gb} GB) sprengt das das Budget (${b.gtt_gb} GB) → beim Laden von heavy/coder droht ein Überlauf. Erwäge ein kleineres Brain oder weniger Kontext.`
|
||||
: ""
|
||||
showConfirm(
|
||||
"Agent-Hirn aktualisieren?",
|
||||
|
||||
Reference in New Issue
Block a user