de21e1ac68
Drei Luecken aus der Selbst-Review 17.07.: 1. MTP-Fairness: Kandidaten mit MTP-Kopf (Dateiname oder nextn-Tensoren im GGUF-Kopf) bekommen eine Zusatz-Tempomessung mit draft-mtp; Steckbrief rechnet best-of speed/speed_mtp - das Live-Hirn laeuft schliesslich MIT MTP. 2. Baseline-Refresh: baseline.json traegt jetzt den Engine-Build; weicht die installierte Engine ab (So-Auto-Update), misst der Pruefstand-Cron nur den Tempo-Teil aller Rollen neu (Geister-Zahlen-Schutz, Qualitaet bleibt gueltig). 3. Langzeit-Historie: Puls wird als JSONL angehaengt statt ueberschrieben; Radar vergleicht zusaetzlich gegen ~8 Wochen zurueck und meldet SCHLEICHENDE REGRESSION, die woechentlich unter der 10-%-Schwelle bleibt. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>