From 960bda60212c30df92d0f5c4b3d7c783b765fcc1 Mon Sep 17 00:00:00 2001 From: Hitonabi Date: Tue, 14 Jul 2026 10:54:07 +0200 Subject: [PATCH] fremdblick.sh: Prosa-Default 2200 -> 4000 Tokens (Reasoning-Modell-Headroom) GLM-4.7-Flash (Prosa-Kritiker) ist ein Reasoning-Modell und verbrennt real ~2000 Tokens im reasoning_content, bevor das Urteil in content landet (verifiziert 14.07.). Bei 2200 schnitt es Gefahr mitten im Denken ab -> leeres content -> FEHLGESCHLAGEN; das traf die naechtlichen Kritiker mit Default-Budget (Traum-Gate etc.). Der Release-Radar ueberschreibt ohnehin auf 4500; der Code-Modus (Qwen-Coder, 1600) ist kein Reasoning-Modell und bleibt unberuehrt. Co-Authored-By: Claude Opus 4.8 --- deploy/fremdblick.sh | 6 +++++- 1 file changed, 5 insertions(+), 1 deletion(-) diff --git a/deploy/fremdblick.sh b/deploy/fremdblick.sh index 345d675..c83f1c6 100644 --- a/deploy/fremdblick.sh +++ b/deploy/fremdblick.sh @@ -39,7 +39,11 @@ if [ "$MODE" = "code" ]; then SYS="${FREMDBLICK_SYS:-$CODE_SYS}" else MODEL="${FREMDBLICK_MODEL:-GLM-4.7-Flash}" - MAXTOK="${FREMDBLICK_MAXTOK:-2200}" + # 4000 (war 2200): GLM-4.7-Flash ist ein Reasoning-Modell und verbrennt real ~2000 Tokens + # im reasoning_content, BEVOR das Urteil in content landet (verifiziert 14.07.). Bei 2200 lief + # es Gefahr, mitten im Denken abzuschneiden → leeres content → "ABGESCHNITTEN/FEHLGESCHLAGEN" + # (traf die Nacht-Kritiker mit Default-Budget). Wer explizit knapper braucht, setzt FREMDBLICK_MAXTOK. + MAXTOK="${FREMDBLICK_MAXTOK:-4000}" SYS="${FREMDBLICK_SYS:-$PROSE_SYS}" fi